Panoramica delle nuove funzionalità, delle modifiche incompatibili e dei miglioramenti delle capacità in Claude Fable 5.1 e Claude Mythos 5.1.
Claude Fable 5.1 estende Claude Fable 5 allo stesso prezzo per token, con prestazioni più solide nella programmazione agentica di lunga durata, nella ricerca multistep e nel lavoro su documenti, fogli di calcolo e presentazioni. Per la maggior parte dei carichi di lavoro, inizia con Claude Opus 5 (vedi Scegliere un modello). Usa Claude Fable 5.1 per ragionamenti impegnativi e lavoro agentico a lungo orizzonte, oppure quando le tue valutazioni su Claude Opus 5 a un livello di effort più alto risultano ancora insufficienti. Claude Mythos 5.1 offre le stesse capacità esclusivamente ai partecipanti di Project Glasswing.
Se già chiami Claude Fable 5, tre modifiche introducono incompatibilità: l'uso forzato degli strumenti restituisce un errore, i modelli precedenti non possono leggere i suoi blocchi di pensiero e la modifica dei turni precedenti invalida i blocchi di pensiero. Cinque sono additive: effort per messaggio (beta), messaggi di sistema con ambito di turno (beta), aggiornamenti di avanzamento leggibili tra le chiamate agli strumenti (display: "updates", beta), un prezzo di lettura della cache più basso e la provenienza dei contenuti.
| Modello | ID Claude API | Descrizione | Disponibilità |
|---|---|---|---|
| Claude Fable 5.1 | Successore di Claude Fable 5, per programmazione agentica di lunga durata, lavoro di conoscenza e ricerca | Tutti i clienti, sulla Claude API e sulle piattaforme partner | |
| Claude Mythos 5.1 | Stesse capacità di Claude Fable 5.1. Successore di Claude Mythos 5. | Solo partecipanti di Project Glasswing |
Claude Fable 5.1 e Claude Mythos 5.1 condividono specifiche e prezzi:
Per tutti i modelli attuali, vedi la panoramica dei modelli.
Claude Fable 5.1 e Claude Mythos 5.1 non supportano il "forced tool use" (uso forzato degli strumenti). tool_choice impostato su {"type": "any"} o {"type": "tool", "name": "..."} restituisce un errore 400 invalid_request_error:
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (il valore predefinito) e {"type": "none"} restano invariati. La stessa validazione si applica all'endpoint di conteggio dei token.
Il pensiero è sempre attivo per questi modelli, e una chiamata forzata a uno strumento lo salterebbe. Il modello scriverebbe invece il proprio ragionamento negli argomenti dello strumento, il che riduce la qualità degli argomenti. Per ottenere JSON valido rispetto allo schema, mantieni tool_choice: {"type": "auto"} e imposta strict: true con lo "strict tool use" (uso degli strumenti rigoroso), oppure sposta lo schema negli "structured outputs" (output strutturati). Per fare in modo che il modello chiami uno strumento invece di rispondere in testo, indica nel prompt quando lo strumento si applica (ad esempio, "Usa lo strumento get_weather per rispondere"). Claude Fable 5.1 segue in modo affidabile le istruzioni esplicite sugli strumenti.
Ogni blocco di pensiero registra quale modello lo ha prodotto, ed è preservato in una sola direzione: Claude Fable 5.1 legge i blocchi di pensiero dei modelli precedenti, e nessun modello precedente legge quelli di Claude Fable 5.1. Una conversazione che passa a Claude Fable 5.1 (da Claude Opus 5, Claude Fable 5 o qualsiasi modello Claude precedente) mantiene il proprio ragionamento. Una conversazione che passa da Claude Fable 5.1 a uno qualsiasi di questi modelli lo perde per i turni eseguiti lì.
Quando una richiesta contiene un blocco che il modello di destinazione non può leggere (ad esempio un router o un fallback che cambia modello a metà conversazione), l'API scarta il blocco prima che il modello lo veda. I blocchi scartati non vengono conteggiati in input_tokens e non vengono fatturati. Con l'header beta thinking-binding-controls-2026-08-01, lo scarto viene segnalato in un array input_transformations di primo livello. Senza di esso, lo scarto è silenzioso. Vedi Pensiero preservato.
Modificare qualsiasi cosa prima di un blocco di pensiero di Claude Fable 5.1 (il prompt system, i tools o un messaggio precedente) provoca un errore alla richiesta successiva, oppure l'eliminazione del blocco se scegli questa opzione. Claude Code, claude.ai, Claude Managed Agents e il Claude Agent SDK mantengono quel prefisso intatto per te. Se il tuo codice costruisce da solo l'array messages, controllalo prima di migrare: Pensiero preservato illustra il controllo e ogni correzione. Il controllo è applicato per i nuovi account creati a partire dal 31 agosto 2026. Per gli account creati prima, l'API registra la discrepanza ma agisce su di essa solo quando la richiesta imposta thinking.block_binding.prefix_mismatch_behavior.
Questi pattern invalidano ogni blocco di pensiero successivo:
system di primo livello o l'array tools tra richieste nella stessa conversazione.Questi mantengono validi i blocchi successivi: rimuovere una sequenza iniziale di blocchi di pensiero (dal più vecchio), lasciare che la compattazione lato server o la modifica del contesto riducano la cronologia, spostare i marcatori cache_control e cambiare effort tra le richieste. Rimuovere un blocco di pensiero da qualsiasi posizione diversa dall'inizio della sequenza invalida ogni blocco di pensiero successivo.
Dove la verifica è applicata, una richiesta che ripropone un blocco invalidato viene rifiutata con un 400 il cui messaggio dice The block is bound to a different conversation. Per scartare il blocco e continuare invece, invia l'header beta thinking-binding-controls-2026-08-01 con thinking.block_binding.prefix_mismatch_behavior: "drop_block". Lo scarto viene segnalato in input_transformations con reason: "prefix_binding_mismatch".
Per mantenere valido il pensiero durante una sessione lunga, tratta la conversazione come append-only (solo in aggiunta). Aggiungi istruzioni con un messaggio di sistema a metà conversazione (con ambito di turno se deve applicarsi a un solo turno) e cambia gli strumenti con le modifiche degli strumenti a metà conversazione invece di modificare system o tools. Riduci il contesto con la modifica del contesto lato server o la compattazione, che non contano come modifiche. Questi pattern mantengono anche calda la "prompt cache" (cache dei prompt). Per scoprire se la tua integrazione modifica la cronologia, esegui una sessione con prefix_mismatch_behavior: "drop_block" e registra input_transformations: la guida alla migrazione contiene la verifica in tre passaggi. Vedi Pensiero preservato per le regole complete.
Su Claude Fable 5.1 puoi cambiare il livello di effort a metà conversazione senza invalidare la cache dei prompt. Aumentalo per un passaggio difficile e abbassalo per quelli di routine. L'effort per messaggio è in beta: includi l'header beta mid-conversation-output-config-2026-07-01. Claude Fable 5.1, Claude Mythos 5.1 e Claude Opus 5 lo supportano sulla Claude API.
client = anthropic.Anthropic()
response = client.beta.messages.create(
model="claude-fable-5-1",
max_tokens=4096,
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
},
{
"role": "assistant",
"content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
},
# Messaggio di sistema solo effort: il nuovo livello ha effetto dal prossimo turno utente.
{"role": "system", "content": [], "output_config": {"effort": "low"}},
{"role": "user", "content": "Summarize the plan in one sentence."},
],
betas=["mid-conversation-output-config-2026-07-01"],
)
for block in response.content:
if block.type == "text":
print(block.text)Vedi Effort per messaggio per i dettagli.
Un messaggio di sistema a metà conversazione può essere limitato a un solo turno. Imposta clear_at: "next_user_message" su un messaggio con role: "system" e il suo testo avrà l'autorità di un "system prompt" (prompt di sistema) per il turno corrente, poi smetterà di essere reso una volta che esiste un messaggio user successivo. Il messaggio rimane in messages e continui a rimandarlo testualmente, quindi nulla di precedente nella conversazione cambia. La cache dei prompt continua a corrispondere, i blocchi di pensiero successivi restano validi e un messaggio cancellato non costa token di input. Usalo per promemoria per turno in un ciclo di strumenti ("controlla la tua casella prima di eseguire altro codice", "l'utente non può vedere l'output di quello strumento") invece di iniettare testo nella cronologia ed eliminarlo alla richiesta successiva. I messaggi di sistema con ambito di turno sono in beta: includi l'header beta mid-conversation-system-clear-at-2026-08-21. Vedi Messaggi di sistema con ambito di turno.
{
"role": "system",
"clear_at": "next_user_message",
"content": "Results have landed in your inbox. Check it before running more code."
}Come Claude Fable 5, Claude Fable 5.1 scrive brevi aggiornamenti di avanzamento tra le chiamate agli strumenti su ciò che ha trovato e su ciò che farà dopo, anche se in numero minore (vedi Cambiato rispetto a Claude Fable 5). Ogni aggiornamento arriva come blocco thinking a sé stante immediatamente prima della chiamata allo strumento. Con il valore predefinito di thinking.display pari a "omitted", quei blocchi tornano vuoti, come il ragionamento, quindi un lungo turno agentico può apparire silenzioso ai tuoi utenti. La novità è l'opzione display: "updates": impostala con l'header beta thinking-display-updates-2026-08-18 per ricevere gli aggiornamenti di avanzamento come testo mentre il ragionamento resta nascosto. Qualsiasi blocco thinking con testo non vuoto è quindi una riga di stato che puoi mostrare all'utente. Anche "summarized" li restituisce, mescolati al ragionamento riassunto. Vedi Aggiornamenti di avanzamento tra le chiamate agli strumenti.
Il testo generato da Claude Fable 5.1 e Claude Mythos 5.1 porta il watermark testuale statistico di Anthropic su ogni piattaforma in cui il modello è disponibile. I file immagine e video supportati che Claude produce (ad esempio tramite lo strumento di esecuzione del codice) portano Content Credentials C2PA firmate quando li recuperi tramite la Files API sulla Claude API.
Il watermark non cambia il significato, la qualità o la leggibilità dell'output. Non aggiunge token né caratteri nascosti, non contiene informazioni su di te o sulla tua organizzazione e non richiede modifiche alle tue richieste o risposte. Per approfondire, vedi Come Claude contrassegna i contenuti generati dall'IA e Come funziona il watermark testuale di Claude.
Claude Fable 5.1 differisce da Claude Fable 5 in tre modi che si manifestano senza alcuna modifica al codice. Ciascuno ha una correzione tramite prompt in Prompting di Claude Fable 5.1:
thinking.display su "updates" (beta) per ricevere gli aggiornamenti di avanzamento che scrive. Vedi Chiedi aggiornamenti di avanzamento rivolti all'utente.low. Al livello di effort più basso il modello chiama meno spesso uno strumento di ricerca o recupero. Alza l'effort per i turni che richiedono informazioni aggiornate, anche a metà conversazione.Questi comportamenti della Messages API vengono mantenuti invariati da Claude Fable 5:
thinking: {"type": "enabled"} con budget_tokens e thinking: {"type": "disabled"} restituiscono entrambi un errore 400. Ometti thinking o invia {"type": "adaptive"}.thinking.display ha come valore predefinito "omitted". "summarized" è disponibile, e la catena di pensiero grezza non viene mai restituita.temperature, top_p o top_k restituiscono un errore 400.Claude Fable 5.1 migliora rispetto a Claude Fable 5, e il divario è più ampio ai livelli di effort più alti. I progressi si concentrano in sei aree:
Le prestazioni multilingue sono alla pari con Claude Fable 5.
Claude Fable 5.1 include classificatori di sicurezza che coprono le stesse categorie stop_details di Claude Fable 5, e tutto ciò che è descritto in Rifiuti e fallback si applica.
stop_reason: "refusal" e un oggetto stop_details che indica l'area di policy attivata.fallbacks: "default" (beta) riprova una richiesta rifiutata sul modello che Anthropic raccomanda per quella categoria. I target di fallback consentiti per Claude Fable 5.1 sono Claude Opus 4.8 e Claude Opus 5.Claude Fable 5.1 e Claude Mythos 5.1 hanno lo stesso prezzo di Claude Fable 5, tranne per le letture della cache (prezzi in USD):
| Input base | Scritture cache 5m | Scritture cache 1h | Letture cache | Output |
|---|---|---|---|---|
| $10 / MTok | $12,50 / MTok | $20 / MTok | $0,25 / MTok | $50 / MTok |
Le letture della cache (hit e refresh) costano 0,025 volte il prezzo di input base su questi modelli, rispetto a 0,1 sugli altri modelli Claude. Le lunghe sessioni agentiche che rileggono un prefisso in cache pagano un quarto della tariffa di Claude Fable 5. Le scritture della cache e la lunghezza minima del prompt memorizzabile in cache di 512 token restano invariate.
L'elaborazione batch costa $5 USD per milione di token di input e $25 USD per milione di token di output. Vedi Prezzi per la residenza dei dati e i prezzi degli strumenti.
Claude Fable 5.1 è disponibile su:
claude-fable-5-1.anthropic.claude-fable-5-1, e Claude Platform on AWS, come claude-fable-5-1.claude-fable-5-1.Claude Mythos 5.1 è offerto solo ai clienti approvati in Project Glasswing. Per l'accesso, contatta il tuo team account Anthropic, AWS o Google Cloud.
Claude Fable 5.1 e Claude Mythos 5.1 prevedono una conservazione dei dati di 30 giorni e non sono disponibili con zero data retention salvo espressa autorizzazione di Anthropic. Entrambi sono Covered Models, come Claude Fable 5 e Claude Mythos 5. Vedi Requisiti di conservazione dei dati specifici per modello.
Per migrare da Claude Fable 5, aggiorna il tuo ID modello:
model = "claude-fable-5" # Before
model = "claude-fable-5-1" # AfterPoi rivedi questi punti:
tool_choice di tipo any o tool. Sposta l'applicazione dello schema allo strict tool use con tool_choice: {"type": "auto"} o agli output strutturati.messages, esegui la verifica della modifica della cronologia: sposta i promemoria per turno che attualmente inietti ed elimini nei messaggi di sistema con ambito di turno, sposta le modifiche a system e tools nei messaggi di sistema a metà conversazione, riduci il contesto lato server o rimuovi i blocchi di pensiero dai turni che trasporti attraverso un riepilogo lato client, poi scegli un prefix_mismatch_behavior di produzione e monitora input_transformations.high) e valuta di cambiarlo a metà conversazione invece di mantenere un unico livello per l'intera sessione.Vedi la guida alla migrazione per istruzioni passo passo, anche da Claude Opus 5 e modelli precedenti.
Specifiche e prezzi per ogni modello Claude attuale.
Migrazione da Claude Fable 5, Claude Opus 5 e modelli precedenti.
Pattern di prompting specifici per Claude Fable 5.1.
Was this page helpful?