Novità in Claude Fable 5.1
Panoramica delle nuove funzionalità, delle modifiche incompatibili e dei miglioramenti delle capacità in Claude Fable 5.1 e Claude Mythos 5.1.
Claude Fable 5.1 estende Claude Fable 5 agli stessi prezzi di input e output, con letture dalla cache a un quarto del costo, e offre prestazioni più solide nella programmazione agentica di lunga durata, nella ricerca multistep e nel lavoro su documenti, fogli di calcolo e presentazioni. Per la maggior parte dei carichi di lavoro, inizia con Claude Opus 5 (vedi Scegliere un modello). Usa Claude Fable 5.1 per ragionamenti impegnativi e lavoro agentico a lungo orizzonte, oppure quando le tue valutazioni su Claude Opus 5 a effort più elevato risultano ancora insufficienti. Claude Mythos 5.1 offre le stesse capacità esclusivamente ai partecipanti di Project Glasswing.
Se chiami già Claude Fable 5, tre modifiche sono incompatibili: l'uso forzato degli strumenti restituisce un errore, i modelli precedenti non possono leggere i suoi blocchi di pensiero e la modifica dei turni precedenti invalida i blocchi di pensiero. Cinque sono additive: effort per messaggio (beta), messaggi di sistema limitati al turno (beta), aggiornamenti di avanzamento leggibili tra le chiamate agli strumenti (display: "updates", beta), un prezzo inferiore per le letture dalla cache e la provenienza dei contenuti.
Modelli
| Modello | ID Claude API | Descrizione | Disponibilità |
|---|---|---|---|
| Claude Fable 5.1 | Successore di Claude Fable 5, per programmazione agentica di lunga durata, lavoro di conoscenza e ricerca | Tutti i clienti, sulla Claude API e sulle piattaforme partner | |
| Claude Mythos 5.1 | Stesse capacità di Claude Fable 5.1. Successore di Claude Mythos 5. | Solo partecipanti di Project Glasswing |
Claude Fable 5.1 e Claude Mythos 5.1 condividono specifiche e prezzi:
- Finestra di contesto e output: una "context window" (finestra di contesto) da 1M di token (predefinita e massima) al prezzo standard per token sull'intera finestra, e 128k token di output massimi.
- Pensiero: il pensiero adattivo è sempre attivo. Usa il parametro effort per controllare la profondità del pensiero.
- Prezzi: gli stessi di Claude Fable 5, ad eccezione di un prezzo inferiore per le letture dalla cache.
- Tokenizer: lo stesso di Claude Fable 5 (introdotto con Claude Opus 4.7). Rispetto ai modelli precedenti a Claude Opus 4.7, lo stesso testo produce circa il 30% di token in più. Vedi Conteggio dei token.
Per tutti i modelli attuali, vedi la panoramica dei modelli.
Modifiche incompatibili
L'uso forzato degli strumenti non è supportato
Claude Fable 5.1 e Claude Mythos 5.1 non supportano l'uso forzato degli strumenti. tool_choice impostato su {"type": "any"} o {"type": "tool", "name": "..."} restituisce un errore 400 invalid_request_error:
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (il valore predefinito) e {"type": "none"} restano invariati. La stessa validazione si applica all'endpoint di conteggio dei token.
Il pensiero è sempre attivo per questi modelli, e una chiamata forzata a uno strumento lo salterebbe. Il modello scriverebbe invece il proprio ragionamento negli argomenti dello strumento, il che riduce la qualità degli argomenti. Per ottenere JSON valido rispetto allo schema, mantieni tool_choice: {"type": "auto"} e imposta strict: true con l'uso rigoroso degli strumenti, oppure sposta lo schema negli output strutturati. Per far sì che il modello chiami uno strumento invece di rispondere in testo, indica nel prompt quando lo strumento si applica (ad esempio, "Usa lo strumento get_weather per rispondere"). Claude Fable 5.1 segue in modo affidabile le istruzioni esplicite sugli strumenti.
I modelli precedenti non possono leggere i blocchi di pensiero di Claude Fable 5.1
Ogni blocco di pensiero registra quale modello lo ha prodotto, ed è preservato in una sola direzione: Claude Fable 5.1 legge i blocchi di pensiero dei modelli precedenti, e nessun modello precedente legge quelli di Claude Fable 5.1. Una conversazione che passa a Claude Fable 5.1 (da Claude Opus 5, Claude Fable 5 o qualsiasi modello Claude precedente) mantiene il proprio ragionamento. Una conversazione che passa da Claude Fable 5.1 a uno qualsiasi di quei modelli lo perde per i turni eseguiti lì.
Quando una richiesta contiene un blocco che il modello di destinazione non può leggere (ad esempio un router o un fallback che cambia modello a metà conversazione), l'API scarta il blocco prima che il modello lo veda. I blocchi scartati non vengono conteggiati in input_tokens e non vengono fatturati. Con l'header beta thinking-binding-controls-2026-08-01, lo scarto viene segnalato in un array input_transformations di primo livello. Senza di esso, lo scarto è silenzioso. Vedi Pensiero preservato.
La modifica dei turni precedenti invalida i blocchi di pensiero
Modificare qualsiasi cosa prima di un blocco di pensiero di Claude Fable 5.1 (il prompt system, i tools o un messaggio precedente) produce un errore alla richiesta successiva, oppure lo scarto del blocco se scegli questa opzione. Claude Mythos 5.1 non esegue questo controllo. Claude Code, claude.ai, Claude Managed Agents e il Claude Agent SDK mantengono intatto quel prefisso per te. Se il tuo codice costruisce da sé l'array messages, controllalo prima di migrare: Pensiero preservato illustra il controllo e ciascuna correzione. Il controllo viene applicato per i nuovi account creati a partire dal 31 agosto 2026. Per gli account creati in precedenza, l'API registra la discrepanza ma agisce su di essa solo quando la richiesta imposta thinking.block_binding.prefix_mismatch_behavior.
Questi pattern invalidano ogni blocco di pensiero successivo:
- Modificare, riordinare o rimuovere un turno precedente mantenendo quelli successivi.
- Iniettare testo per richiesta in un turno precedente (un promemoria o una riga di stato) che rimuovi alla richiesta successiva.
- Ricostruire il prompt
systemdi primo livello o l'arraytoolstra richieste nella stessa conversazione. - Un URL di immagine o documento che serve byte diversi in una richiesta successiva (il controllo riguarda i byte, non l'URL, quindi un URL firmato a rotazione per lo stesso file va bene).
Questi mantengono validi i blocchi successivi: rimuovere una sequenza iniziale di blocchi di pensiero (dal più vecchio), lasciare che la compattazione lato server o la modifica del contesto riducano la cronologia, spostare i marcatori cache_control e cambiare effort tra le richieste. Rimuovere un blocco di pensiero da qualsiasi punto diverso dall'inizio della sequenza invalida ogni blocco di pensiero successivo.
Dove il controllo è applicato, una richiesta che ripropone un blocco invalidato viene rifiutata con un 400 il cui messaggio dice The block is bound to a different conversation. Per scartare il blocco e continuare invece, invia l'header beta thinking-binding-controls-2026-08-01 con thinking.block_binding.prefix_mismatch_behavior: "drop_block". Lo scarto viene segnalato in input_transformations con reason: "prefix_binding_mismatch".
Per mantenere valido il pensiero durante una sessione lunga, tratta la conversazione come append-only. Aggiungi istruzioni con un messaggio di sistema a metà conversazione (limitato al turno se deve applicarsi a un solo turno) e cambia gli strumenti con le modifiche agli strumenti a metà conversazione invece di modificare system o tools. Riduci il contesto con la modifica del contesto lato server o la compattazione, che non contano come modifiche. Questi pattern mantengono anche calda la "prompt cache" (cache dei prompt). Per scoprire se la tua integrazione modifica la cronologia, esegui una sessione con prefix_mismatch_behavior: "drop_block" e registra input_transformations: la guida alla migrazione contiene il controllo in tre passaggi. Vedi Pensiero preservato per le regole complete.
Nuove funzionalità
Cambiare l'effort a metà conversazione (beta)
Su Claude Fable 5.1 puoi cambiare il livello di effort a metà conversazione senza invalidare la cache dei prompt. Aumentalo per un passaggio difficile e riducilo per quelli di routine. L'effort per messaggio è in beta: includi l'header beta mid-conversation-output-config-2026-07-01. Claude Fable 5.1, Claude Mythos 5.1 e Claude Opus 5 lo supportano sulla Claude API.
client = anthropic.Anthropic()
response = client.beta.messages.create(
model="claude-fable-5-1",
max_tokens=4096,
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
},
{
"role": "assistant",
"content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
},
# Messaggio di sistema solo effort: il nuovo livello ha effetto dal turno utente successivo.
{"role": "system", "content": [], "output_config": {"effort": "low"}},
{"role": "user", "content": "Summarize the plan in one sentence."},
],
betas=["mid-conversation-output-config-2026-07-01"],
)
for block in response.content:
if block.type == "text":
print(block.text)Vedi Effort per messaggio per i dettagli.
Messaggi di sistema limitati al turno (beta)
Un messaggio di sistema a metà conversazione può essere limitato a un solo turno. Imposta clear_at: "next_user_message" su un messaggio role: "system" e il suo testo ha l'autorità di un "system prompt" (prompt di sistema) per il turno corrente, poi smette di essere reso una volta che esiste un messaggio user successivo. Il messaggio rimane in messages e continui a rinviarlo alla lettera, quindi nulla di precedente nella conversazione cambia. La cache dei prompt continua a corrispondere, i blocchi di pensiero successivi restano validi e un messaggio cancellato non costa token di input. Usalo per promemoria per turno in un ciclo di strumenti ("controlla la tua casella di posta prima di eseguire altro codice", "l'utente non può vedere l'output di quello strumento") invece di iniettare testo nella cronologia ed eliminarlo alla richiesta successiva. I messaggi di sistema limitati al turno sono in beta: includi l'header beta mid-conversation-system-clear-at-2026-08-21. Vedi Messaggi di sistema limitati al turno.
{
"role": "system",
"clear_at": "next_user_message",
"content": "Results have landed in your inbox. Check it before running more code."
}Aggiornamenti di avanzamento tra le chiamate agli strumenti (beta)
Come Claude Fable 5, Claude Fable 5.1 scrive brevi aggiornamenti di avanzamento tra le chiamate agli strumenti su ciò che ha trovato e su ciò che farà dopo, anche se in numero minore (vedi Cambiamenti rispetto a Claude Fable 5). Ogni aggiornamento arriva come proprio blocco thinking immediatamente prima della chiamata allo strumento. Con il valore predefinito di thinking.display pari a "omitted" quei blocchi tornano vuoti, come il ragionamento, quindi un lungo turno agentico può sembrare silenzioso ai tuoi utenti. La novità è l'opzione display: "updates": impostala con l'header beta thinking-display-updates-2026-08-18 per ricevere gli aggiornamenti di avanzamento come testo mentre il ragionamento resta nascosto. Qualsiasi blocco thinking con testo non vuoto è quindi una riga di stato che puoi mostrare all'utente. Anche "summarized" li restituisce, mescolati al ragionamento riassunto. Vedi Aggiornamenti di avanzamento tra le chiamate agli strumenti.
Provenienza dei contenuti
Il testo generato da Claude Fable 5.1 e Claude Mythos 5.1 porta il watermark testuale statistico di Anthropic su ogni piattaforma in cui il modello è disponibile. I file immagine e video supportati che Claude produce (ad esempio tramite lo strumento di esecuzione del codice) portano Content Credentials C2PA firmate quando li recuperi tramite la Files API sulla Claude API.
Il watermark non cambia il significato, la qualità o la leggibilità dell'output. Non aggiunge token o caratteri nascosti, non contiene informazioni su di te o sulla tua organizzazione e non richiede modifiche alle tue richieste o risposte. Per approfondire, vedi Come Claude contrassegna i contenuti generati dall'IA e Come funziona il watermark testuale di Claude.
Differenze di comportamento
Cambiamenti rispetto a Claude Fable 5
Claude Fable 5.1 differisce da Claude Fable 5 in diversi modi che si manifestano senza alcuna modifica al codice. Ciascuno ha una correzione tramite prompt in Prompting per Claude Fable 5.1:
- Le chiamate parallele agli strumenti sono più variabili. Claude Fable 5.1 può emettere una chiamata a strumento per turno dove Claude Fable 5 ne raggruppava diverse. Questo si manifesta nei lunghi cicli agentici in cui le successive letture indipendenti sono solo implicite: agenti di programmazione personalizzati, harness bash-e-editor, computer use. I turni aggiuntivi costano token, round trip e tempo reale ma non riducono la qualità delle risposte. Le richieste che nominano diverse cose da recuperare vengono comunque eseguite in parallelo. Aggiungi l'istruzione di raggruppamento di una riga da Raggruppare le chiamate indipendenti agli strumenti nei cicli agentici.
- Meno aggiornamenti di avanzamento durante le lunghe esecuzioni di strumenti. Il modello scrive meno testo rivolto all'utente tra le chiamate agli strumenti, specialmente a effort più elevato. Imposta
thinking.displaysu"updates"(beta) per ricevere gli aggiornamenti di avanzamento che scrive, e rimuovi qualsiasi riga del prompt che gli dica di trattenere i risultati per la risposta finale. Se la tua UI dipende dalla narrazione, chiedi esplicitamente una riga di apertura, aggiornamenti periodici e un riepilogo finale. Vedi Chiedere aggiornamenti di avanzamento rivolti all'utente. - Risponde più spesso a memoria a effort
low. Al livello di effort più basso il modello chiama meno spesso uno strumento di ricerca o recupero. Aumenta l'effort per i turni che richiedono informazioni aggiornate, anche a metà conversazione, oppure aggiungi lo stimolo alla verifica da Attivazione della ricerca a effort basso. - Prosa più densa in alcuni punti. In alcuni casi la sua prosa è più densa di quella di Claude Fable 5, con frasi più lunghe e meno interruzioni di paragrafo. Vedi Densità della scrittura.
- Meno formattazione in chat. Il modello usa grassetto, intestazioni ed elenchi meno dei modelli Claude precedenti, quindi le regole anti-formattazione scritte per quei modelli possono sopprimere la struttura di cui il contenuto ha bisogno. Vedi Formattazione in chat.
- Citazioni non contrassegnate nei riassunti. Quando riassume documenti, il modello è più propenso a riprodurre passaggi della fonte senza contrassegnarli come citazioni. Vedi Citare le fonti recuperate.
- Riscritture dell'intero file per piccole modifiche. Quando modifica file di testo, il modello è più propenso a riscrivere l'intero file piuttosto che effettuare una modifica mirata. Il risultato è solitamente lo stesso, ma la riscrittura costa più token di output e tempo. Vedi Preferire modifiche mirate alle riscritture dell'intero file.
Invariato rispetto a Claude Fable 5
Questi comportamenti della Messages API sono ereditati da Claude Fable 5 senza modifiche:
- Il pensiero adattivo è sempre attivo.
thinking: {"type": "enabled"}conbudget_tokensethinking: {"type": "disabled"}restituiscono entrambi un errore 400. Omettithinkingo invia{"type": "adaptive"}. thinking.displayha come valore predefinito"omitted"."summarized"è disponibile, e la catena di pensiero grezza non viene mai restituita.- Il ragionamento tra le chiamate agli strumenti appare nei blocchi di pensiero anziché nel testo, e il pensiero interleaved è automatico senza header beta.
- Il prefill della risposta dell'assistente restituisce un errore 400.
- Valori non predefiniti di
temperature,top_potop_krestituiscono un errore 400. - La lunghezza minima del prompt memorizzabile in cache è di 512 token.
- I messaggi di sistema a metà conversazione e le modifiche agli strumenti sono supportati.
Miglioramenti delle capacità
Claude Fable 5.1 migliora rispetto a Claude Fable 5, e il divario è più ampio ai livelli di effort più elevati. I progressi si concentrano in sei aree:
- Programmazione agentica su sessioni lunghe, incluse funzionalità multi-file, grandi refactoring e migrazioni, debugging e revisione del codice in sessioni che durano ore.
- Lavoro di conoscenza con documenti, fogli di calcolo e presentazioni, portando un'analisi da una prima domanda a un documento finito, un foglio di calcolo con formule attive o una presentazione costruita da una pagina bianca.
- Ricerca e search, con maggiore accuratezza nella ricerca web multistep e nelle attività di ricerca approfondita che danno seguito a ciò che trovano.
- Visione, leggendo grafici densi, documenti ufficiali e tabelle annidate nei PDF, anche con strumenti di ritaglio e zoom sui grafici.
- Lavoro a contesto lungo, ragionando e collegando dettagli sull'intera finestra di contesto da 1M di token.
- Computer use, operando un browser e applicazioni desktop in modo più affidabile e recuperando dai passaggi falliti.
Le prestazioni multilingue sono alla pari con Claude Fable 5.
Rifiuti, fallback e fatturazione
Claude Fable 5.1 include classificatori di sicurezza che coprono le stesse categorie stop_details di Claude Fable 5, e tutto ciò che è descritto in Rifiuti e fallback si applica. Può restituire stop_reason: "refusal", quindi gestisci i rifiuti e configura il fallback.
- Rifiuti: una richiesta rifiutata restituisce HTTP 200 con
stop_reason: "refusal"e un oggettostop_detailsche indica l'area di policy attivata. - Fallback: riprova una richiesta rifiutata su un altro modello con il fallback lato server, il middleware SDK o un tuo meccanismo di retry.
fallbacks: "default"(beta) riprova una richiesta rifiutata sul modello che Anthropic raccomanda per quella categoria. Le destinazioni di fallback consentite per Claude Fable 5.1 sono Claude Opus 4.8 e Claude Opus 5. - Fatturazione: non ti viene addebitato un rifiuto che arriva prima di qualsiasi output e, per Claude Fable 5.1, il credito di fallback rimborsa il costo della cache dei prompt dovuto al cambio di modello.
Prezzi
Claude Fable 5.1 e Claude Mythos 5.1 hanno gli stessi prezzi di Claude Fable 5, ad eccezione delle letture dalla cache (prezzi in USD):
| Input base | Scritture cache 5m | Scritture cache 1h | Letture cache | Output |
|---|---|---|---|---|
| $10 / MTok | $12,50 / MTok | $20 / MTok | $0,25 / MTok | $50 / MTok |
Le letture dalla cache (hit e refresh) costano 0,025 volte il prezzo di input base su questi modelli, rispetto a 0,1 sugli altri modelli Claude. Le lunghe sessioni agentiche che rileggono un prefisso in cache pagano un quarto della tariffa di Claude Fable 5. Le scritture in cache e la lunghezza minima del prompt memorizzabile in cache di 512 token restano invariate.
L'elaborazione batch costa $5 USD per milione di token di input e $25 USD per milione di token di output. Vedi Prezzi per la residenza dei dati e i prezzi degli strumenti.
Disponibilità
Claude Fable 5.1 è disponibile su:
- Claude API: tutti i clienti, come
claude-fable-5-1. - AWS: Claude in Amazon Bedrock, come
anthropic.claude-fable-5-1, e Claude Platform su AWS, comeclaude-fable-5-1. - Google Cloud: Claude su Google Cloud, come
claude-fable-5-1. - Microsoft Foundry: Claude in Microsoft Foundry, su infrastruttura Anthropic.
Claude Mythos 5.1 è offerto solo ai clienti approvati in Project Glasswing. Per l'accesso, contatta il tuo team account Anthropic, AWS o Google Cloud.
Claude Fable 5.1 e Claude Mythos 5.1 prevedono una conservazione dei dati di 30 giorni e non sono disponibili con zero data retention salvo espressa autorizzazione di Anthropic. Entrambi sono Covered Models, come Claude Fable 5 e Claude Mythos 5. Vedi Requisiti di conservazione dei dati specifici per modello.
Migrare da Claude Fable 5
Per migrare da Claude Fable 5, aggiorna il tuo ID modello:
model = "claude-fable-5" # Before
model = "claude-fable-5-1" # AfterPoi rivedi questi punti:
- Rimuovi qualsiasi
tool_choicedi tipoanyotool. Sposta l'applicazione dello schema all'uso rigoroso degli strumenti contool_choice: {"type": "auto"}o agli output strutturati. - Restituisci i blocchi di pensiero invariati e mantieni la cronologia append-only. Se il tuo codice costruisce da sé l'array
messages, esegui il controllo sulla modifica della cronologia: sposta i promemoria per turno che attualmente inietti ed elimini nei messaggi di sistema limitati al turno, sposta le modifiche asystemetoolsnei messaggi di sistema a metà conversazione, riduci il contesto lato server o rimuovi i blocchi di pensiero dai turni che trasporti attraverso un riassunto lato client, poi scegli unprefix_mismatch_behaviordi produzione e monitorainput_transformations. - Ricalibra l'effort rispetto al valore predefinito (
high), e considera di cambiarlo a metà conversazione invece di mantenere un unico livello per l'intera sessione. - Nei cicli agentici, fai attenzione a una chiamata a strumento per turno dove Claude Fable 5 ne raggruppava diverse, e aggiungi la nota per turno da Prompting per Claude Fable 5.1.
- Riesegui le tue valutazioni. La gestione dei rifiuti, il fallback, il credito di fallback e i conteggi dei token restano invariati. Le letture dalla cache costano meno (vedi Prezzi), e il comportamento predefinito differisce nei modi elencati in Cambiamenti rispetto a Claude Fable 5.
Vedi la guida alla migrazione per istruzioni passo passo, anche da Claude Opus 5 e modelli precedenti.
Prossimi passi
Specifiche e prezzi per ogni modello Claude attuale.
Migrazione da Claude Fable 5, Claude Opus 5 e modelli precedenti.
Pattern di prompting specifici per Claude Fable 5.1.
Was this page helpful?