Migrazione a Claude Mythos 5 e Claude Fable 5
Migra a Claude Mythos 5 e Claude Fable 5 da Claude Mythos Preview, Claude Opus 5 o Claude Opus 4.8: ID dei modelli, modifiche all'API e checklist di migrazione.
Claude Fable 5 è progettato per il ragionamento impegnativo e il lavoro agentico a lungo orizzonte. Claude Fable 5.1 si basa su di esso. Claude Fable 5 è disponibile sulla Claude API, su Amazon Bedrock, Claude Platform on AWS, Google Cloud e Microsoft Foundry. Claude Mythos 5 condivide le stesse capacità ed è offerto solo ai clienti approvati in Project Glasswing.
Le impostazioni di base condivise da claude-fable-5 e claude-mythos-5:
- Thinking: L'adaptive thinking (pensiero adattivo) è sempre attivo. Il modello determina quando e quanto pensare per ogni richiesta, e non è richiesta alcuna configurazione
thinking. Siathinking: {type: "disabled"}sia l'"extended thinking" (pensiero esteso) manuale (thinking: {type: "enabled", budget_tokens: N}) restituiscono un errore 400. - Prefill: Il prefill del messaggio dell'assistente restituisce un errore 400. Usa invece le istruzioni nel "system prompt" (prompt di sistema).
- Finestra di contesto e output: Una "context window" (finestra di contesto) da 1M di token per impostazione predefinita, e fino a 128k token di output per richiesta.
- Prezzi: $10 USD per milione di token di input e $50 USD per milione di token di output. Consulta Prezzi di Claude.
- Conservazione dei dati: Entrambi i modelli richiedono una conservazione dei dati di 30 giorni e non sono disponibili con accordi di zero data retention (ZDR) salvo espressa autorizzazione di Anthropic. Entrambi sono designati come Covered Models. Sulla Claude API, una richiesta a Claude Fable 5 da un'organizzazione la cui configurazione di conservazione dei dati non soddisfa questo requisito restituisce un errore 400
invalid_request_error. Le organizzazioni con un accordo ZDR dovrebbero contattare il proprio team account Anthropic per discutere la configurazione della conservazione dei dati, oppure configurare la conservazione dei dati per singolo workspace. Consulta Requisiti di conservazione dei dati specifici per modello per i dettagli per piattaforma.
Dove i due modelli divergono:
- Disponibilità: Claude Fable 5 non richiede approvazione dell'accesso. Claude Mythos 5 è disponibile solo per i clienti approvati in Project Glasswing.
- Classificatori di sicurezza: Claude Fable 5 esegue classificatori di sicurezza che possono rifiutare richieste con
stop_reason: "refusal". Claude Mythos 5 non include questi classificatori. Consulta Rifiuti e fallback. - Priority Tier: Il Priority Tier è supportato su Claude Fable 5 ma non su Claude Mythos 5.
Migrazione a Claude Mythos 5 e Claude Fable 5 da Claude Mythos Preview
Claude Mythos 5 è il successore ad accesso controllato di Claude Mythos Preview, l'anteprima di ricerca solo su invito. Claude Fable 5 offre le stesse capacità e non richiede approvazione dell'accesso. Le modifiche in questa sezione si applicano in egual modo a entrambe le destinazioni.
La migrazione è per lo più drop-in. Claude Mythos 5 e Claude Fable 5 usano la stessa Messages API e gli stessi pattern di "tool use" (uso degli strumenti) di Claude Mythos Preview, e i conteggi dei token sono pressoché invariati perché tutti e tre i modelli usano lo stesso tokenizer. Le modifiche principali da verificare sono le funzionalità non più disponibili (elencate nella sezione successiva) e l'output del thinking. Se migri a Claude Fable 5, pianifica anche la gestione dei rifiuti dei classificatori di sicurezza, che Claude Mythos Preview e Claude Mythos 5 non hanno; consulta Rifiuti e fallback.
Per la tempistica di ritiro di Claude Mythos Preview, consulta Deprecazioni dei modelli.
Aggiorna il nome del modello
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Oppure, per il modello con le stesse capacità e senza requisito di approvazione dell'accesso:
model = "claude-fable-5" # AfterFunzionalità non disponibili su Claude Mythos 5 e Claude Fable 5
-
Pensiero esteso e budget di token di thinking: Il pensiero esteso manuale (
thinking: {type: "enabled", budget_tokens: N}) non è supportato suclaude-mythos-5oclaude-fable-5e restituisce un errore 400. L'adaptive thinking è sempre attivo: il modello determina quando e quanto pensare per ogni richiesta, e non è richiesta alcuna configurazionethinking.thinking: {type: "disabled"}restituisce un errore.budget_tokensnon ha un sostituto diretto: il thinking è adattivo, e il parametro effort è un controllo separato a livello di output, non un budget di thinking.Prima (Claude Mythos Preview):
client.messages.create( model="claude-mythos-preview", max_tokens=16000, thinking={"type": "enabled", "budget_tokens": 10000}, messages=[{"role": "user", "content": "..."}], )Dopo (Claude Mythos 5):
client.messages.create( model="claude-mythos-5", max_tokens=16000, messages=[{"role": "user", "content": "..."}], )La modifica per Claude Fable 5 è identica, con
claude-fable-5come nome del modello. -
Prefill dell'assistente: Il prefill del messaggio dell'assistente non è supportato su
claude-mythos-5oclaude-fable-5e restituisce un errore 400, come su Claude Mythos Preview. Usa invece le istruzioni nel prompt di sistema. -
Output del thinking: Su
claude-mythos-5eclaude-fable-5, la catena di pensiero grezza non viene mai restituita, ma i blocchi thinking contengono comunque testo riassunto leggibile quandothinking.displayè impostato susummarized. Ripassa i blocchi thinking invariati quando continui una conversazione sullo stesso modello. Consulta Output del thinking sui modelli Claude Fable e Claude Mythos.
Conteggio dei token e fatturazione
claude-mythos-5 e claude-fable-5 usano lo stesso tokenizer di claude-mythos-preview (il tokenizer introdotto con Claude Opus 4.7). I conteggi dei token sono pressoché invariati nella migrazione da claude-mythos-preview. Rispetto ai modelli precedenti a Claude Opus 4.7, lo stesso contenuto può essere tokenizzato in circa il 30% di token in più, con variazioni in base al contenuto e alla forma del carico di lavoro.
/v1/messages/count_tokens restituisce valori pressoché invariati per claude-mythos-5 e claude-fable-5 rispetto a claude-mythos-preview. Ricalcola la baseline di costo e "latency" (latenza) sui tuoi carichi di lavoro.
Checklist di migrazione
- Aggiorna il nome del modello da
claude-mythos-previewaclaude-mythos-5, oppure aclaude-fable-5, che offre le stesse capacità e non richiede approvazione dell'accesso. - Rimuovi la configurazione manuale del pensiero esteso (
thinking: {type: "enabled", budget_tokens: N}). L'adaptive thinking è sempre attivo, e non è richiesto alcun campothinking. - Rimuovi qualsiasi configurazione
thinking: {type: "disabled"}. Disabilitare il thinking restituisce un errore suclaude-mythos-5eclaude-fable-5. - Rimuovi
budget_tokens. Non ha un sostituto diretto: il thinking è adattivo, e il parametroeffortè un controllo separato a livello di output, non un budget di thinking. - Verifica che qualsiasi codice che analizza il campo
thinkinglo tratti solo come testo da visualizzare e ripassi i blocchi thinking invariati quando continui sullo stesso modello.thinking.displayha come valore predefinito"omitted"suclaude-mythos-5eclaude-fable-5, come su Claude Mythos Preview. Impostadisplay: "summarized"per ricevere riassunti leggibili. Consulta Output del thinking sui modelli Claude Fable e Claude Mythos. - Se riproduci la cronologia della conversazione su un modello precedente, rimuovi prima i blocchi
thinkingeredacted_thinkingdai turni precedenti dell'assistente. I blocchi thinking diclaude-fable-5eclaude-mythos-5sono leggibili solo dal modello che li ha prodotti o da uno più recente: i modelli precedenti li ignorano silenziosamente, mentre Claude Fable 5.1 e Claude Mythos 5.1 li leggono, quindi conservali quando sposti una conversazione verso quei modelli (consulta Thinking preservato). La rimozione mantiene le richieste ai modelli precedenti minime e uniformi. - Se migri a Claude Fable 5, gestisci
stop_reason: "refusal"e leggi il campostop_details.category. Claude Fable 5 esegue classificatori di sicurezza che Claude Mythos Preview e Claude Mythos 5 non hanno. Consulta Rifiuti e fallback. - Ricalcola la baseline dei conteggi dei token e dei costi sui tuoi carichi di lavoro. I conteggi dei token sono pressoché invariati nella migrazione da
claude-mythos-preview.
Migrazione a Claude Mythos 5 e Claude Fable 5 da Claude Opus 5
Claude Fable 5 e Claude Mythos 5 usano la stessa Messages API e gli stessi pattern di uso degli strumenti di Claude Opus 5, con la stessa finestra di contesto da 1M di token per impostazione predefinita e gli stessi 128k token di output massimi. Le restrizioni su prefill e parametri di campionamento, e il comportamento di visualizzazione del thinking, vengono mantenuti invariati da Claude Opus 5. Le modifiche da verificare sono il thinking sempre attivo, i prezzi, il Priority Tier e la conservazione dei dati.
Aggiorna il nome del modello
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Oppure, per il modello Project Glasswing con le stesse funzionalità:
model = "claude-mythos-5" # AfterCosa è cambiato
-
Il thinking non può più essere disabilitato: Su Claude Opus 5, il thinking è attivo per impostazione predefinita e può essere disattivato con
thinking: {type: "disabled"}a un livello di effort pari ahigho inferiore. Suclaude-fable-5eclaude-mythos-5, l'adaptive thinking è sempre attivo, ethinking: {type: "disabled"}restituisce un errore 400 a qualsiasi livello di effort. Rimuovi la configurazionethinking: {type: "disabled"}e usa invece livelli di effort più bassi per controllare la spesa in token.Se le tue richieste a Claude Opus 5 disabilitavano il thinking, la forma della risposta cambia: una risposta può iniziare con uno o più blocchi
thinkingprima del primo bloccotext, restituiti con un campothinkingvuoto con il valore predefinitodisplay: "omitted"(lo stesso valore predefinito di Claude Opus 5). Il codice che legge la risposta per posizione, comecontent[0].texto un gestore di stream che tratta il primo blocco di contenuto come testo, deve invece selezionare i blocchi di contenuto in base al loro campotype, e i loop di uso degli strumenti devono ripassare i blocchithinkingcompleti e non modificati insieme ai risultati degli strumenti. L'API rifiuta i blocchi thinking modificati, riordinati o parzialmente eliminati con un errore 400 (consulta Preservare i blocchi thinking). I token di thinking sono fatturati come token di output anche quando il testo del thinking non viene restituito. -
Prezzi: Claude Fable 5 e Claude Mythos 5 hanno un prezzo di $10 USD per milione di token di input e $50 USD per milione di token di output, rispetto a $5 USD e $25 USD per Claude Opus 5. Consulta Prezzi di Claude.
-
Priority Tier: Il Priority Tier non è supportato su Claude Opus 5, quindi nessun traffico esistente è interessato. Se la tua organizzazione ha un impegno Priority Tier, Claude Fable 5 lo supporta; Claude Mythos 5 no.
-
Conservazione dei dati: Claude Fable 5 e Claude Mythos 5 richiedono una conservazione dei dati di 30 giorni e non sono disponibili con accordi di zero data retention (ZDR) salvo espressa autorizzazione di Anthropic. Entrambi sono designati come Covered Models. Consulta Requisiti di conservazione dei dati specifici per modello.
Checklist di migrazione
- Aggiorna il nome del modello da
claude-opus-5aclaude-fable-5(oclaude-mythos-5). - Rimuovi qualsiasi configurazione
thinking: {type: "disabled"}; restituisce un errore 400 suclaude-fable-5eclaude-mythos-5. Usa invece livelli di effort più bassi per controllare la spesa in token, e rivedimax_tokensper i carichi di lavoro che venivano eseguiti con il thinking disabilitato su Claude Opus 5. - Se quei carichi di lavoro leggono il contenuto per posizione, come
content[0].text, aggiornali per selezionare i blocchi di contenuto in base atype: i blocchithinkingora arrivano prima dei blocchitext. Ripassa i blocchithinkingcompleti e non modificati nei loop di uso degli strumenti; i blocchi modificati restituiscono un errore 400. - Se la tua organizzazione ha un accordo di zero data retention (ZDR), conferma l'idoneità prima di migrare: questi modelli non sono disponibili con ZDR salvo espressa autorizzazione di Anthropic. Consulta Requisiti di conservazione dei dati specifici per modello.
- Ricalcola la baseline dei costi sui tuoi carichi di lavoro. I conteggi dei token sono pressoché invariati; il prezzo per token è diverso, e i carichi di lavoro che venivano eseguiti con il thinking disabilitato ora producono token di thinking, che sono fatturati come token di output.
Migrazione a Claude Mythos 5 e Claude Fable 5 da Claude Opus 4.8
La migrazione è per lo più drop-in. Claude Fable 5 e Claude Mythos 5 usano la stessa Messages API e gli stessi pattern di uso degli strumenti di Claude Opus 4.8, con la stessa finestra di contesto da 1M di token per impostazione predefinita e gli stessi 128k token di output massimi. I conteggi dei token sono pressoché invariati perché i modelli usano lo stesso tokenizer. Le modifiche principali da verificare sono l'adaptive thinking sempre attivo, l'output del thinking, i rifiuti dei classificatori di sicurezza (solo Claude Fable 5) e i prezzi.
Aggiorna il nome del modello
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Oppure, per il modello Project Glasswing con le stesse capacità:
model = "claude-mythos-5" # AfterCosa è cambiato
Le voci in questa sezione descrivono le differenze di API e di comportamento che vale la pena verificare dopo aver sostituito l'ID del modello. Salvo dove indicato, si applicano in egual modo a claude-fable-5 e claude-mythos-5.
-
L'adaptive thinking è sempre attivo: L'adaptive thinking è l'unica modalità di thinking su
claude-fable-5eclaude-mythos-5. Il modello determina quando e quanto pensare per ogni richiesta, e non è richiesta alcuna configurazionethinking.thinking: {type: "disabled"}restituisce un errore. Usa il parametro effort per controllare la profondità del thinking.La modifica di comportamento da verificare: su Claude Opus 4.8, le richieste senza un campo
thinkingvengono eseguite senza thinking; suclaude-fable-5eclaude-mythos-5, quelle stesse richieste vengono eseguite con adaptive thinking.max_tokensrimane un limite rigido sull'output totale, thinking più testo della risposta, quindi rivedilo per i carichi di lavoro che venivano eseguiti senza thinking su Claude Opus 4.8. Consulta Controllo dei costi. Le risposte possono anche iniziare con uno o più blocchithinkingprima del primo bloccotext, quindi il codice che legge la risposta per posizione (ad esempio,content[0].text, o un gestore di stream che tratta il primo blocco di contenuto come testo) deve invece selezionare i blocchi di contenuto in base al loro campotype. I token di thinking sono fatturati come token di output anche quando il testo del thinking non ti viene restituito, quindi un carico di lavoro che veniva eseguito senza thinking su Claude Opus 4.8 produce più token di output per richiesta, oltre alla differenza di prezzo per token.Se esegui un loop di uso degli strumenti, ripassa all'API i blocchi
thinkingdi ogni risposta dell'assistente completi e non modificati quando restituisci i risultati degli strumenti, inclusi i blocchi il cui campothinkingè vuoto. Rimanda il messaggio dell'assistente così come ricevuto anziché filtrarne i blocchi di contenuto per tipo o ricostruirlo: l'API rifiuta i blocchi thinking modificati, riordinati o parzialmente eliminati con un errore 400. Consulta Preservare i blocchi thinking.Prima (Claude Opus 4.8):
client.messages.create( model="claude-opus-4-8", max_tokens=16000, thinking={"type": "adaptive"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )Dopo (Claude Fable 5):
client.messages.create( model="claude-fable-5", max_tokens=16000, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )La modifica per Claude Mythos 5 è identica, con
claude-mythos-5come nome del modello. -
Pensiero esteso e budget di thinking (invariato): Il pensiero esteso manuale (
thinking: {type: "enabled", budget_tokens: N}) non è supportato suclaude-fable-5oclaude-mythos-5e restituisce un errore 400, come su Claude Opus 4.8.budget_tokensnon ha un sostituto diretto: il thinking è adattivo, e il parametro effort è un controllo separato a livello di output, non un budget di thinking. -
Prefill dell'assistente (invariato): Il prefill del messaggio dell'assistente non è supportato su
claude-fable-5oclaude-mythos-5e restituisce un errore 400, come su Claude Opus 4.8. Usa invece le istruzioni nel prompt di sistema. -
Output del thinking: Su
claude-fable-5eclaude-mythos-5, la catena di pensiero grezza non viene mai restituita, ma i blocchi thinking contengono comunque testo riassunto leggibile quandothinking.displayè impostato susummarized. Ripassa i blocchi thinking invariati quando continui una conversazione sullo stesso modello. Consulta Output del thinking sui modelli Claude Fable e Claude Mythos. -
Classificatori di sicurezza e lo stop reason
refusal(solo Claude Fable 5):claude-fable-5esegue classificatori di sicurezza sulle richieste e durante la generazione della risposta. Claude Mythos 5 non include questi classificatori. Quando un classificatore rifiuta una richiesta, la Messages API restituiscestop_reason: "refusal"come risposta HTTP 200 riuscita, non come errore. Il campostop_details.categoryriporta quale classificatore si è attivato, con categorie come"cyber","bio"e"reasoning_extraction", oppurenullquando il rifiuto non corrisponde a nessuna categoria denominata. Consulta la tabella delle categorie di rifiuto per l'elenco completo.Non ti vengono fatturati i token di input di una richiesta rifiutata prima che venga generato qualsiasi output. Quando un classificatore si attiva a metà stream, l'input e l'output già trasmesso in streaming vengono fatturati; scarta l'output parziale.
Per rieseguire automaticamente le richieste rifiutate su un altro modello, passa il parametro opt-in
fallbacks, che è in beta sulla Claude API. Il parametro non è disponibile sulla Message Batches API né su Amazon Bedrock, Google Cloud e Microsoft Foundry; su queste tre piattaforme, esegui il retry lato client oppure usa il middleware di refusal-fallback dell'SDK. Consulta Rifiuti e fallback. -
Inizia con effort
high: Il valore predefinito del parametro effort rimanehigh. Su Claude Opus 4.8, la raccomandazione per il coding e il lavoro ad alta autonomia è impostare esplicitamentexhigh. Suclaude-fable-5eclaude-mythos-5, usahighcome valore predefinito per la maggior parte delle attività e riservaxhighai carichi di lavoro più sensibili alle capacità. Le impostazioni di effort più basse offrono comunque buone prestazioni e spesso superano le prestazioni dixhighsui modelli precedenti. Riduci l'effort se un'attività viene completata ma richiede più tempo del necessario. Consulta Prompting di Claude Fable 5. -
Minimo più basso per la cache dei prompt: La lunghezza minima del prompt memorizzabile in cache su
claude-fable-5eclaude-mythos-5è di 512 token, inferiore ai 1.024 token di Claude Opus 4.8. I prompt che erano troppo corti per essere memorizzati in cache su Claude Opus 4.8 possono ora creare voci di cache, senza modifiche al codice. Consulta "Prompt caching" (cache dei prompt) per i minimi per modello.
Checklist di migrazione
- Se la tua organizzazione ha un accordo di zero data retention (ZDR), conferma l'idoneità prima di migrare.
claude-fable-5eclaude-mythos-5richiedono una conservazione dei dati di 30 giorni e non sono disponibili con ZDR salvo espressa autorizzazione di Anthropic. Sulla Claude API, le richieste aclaude-fable-5che non soddisfano questo requisito restituiscono un errore 400invalid_request_error. Claude Opus 4.8 è disponibile con ZDR. Consulta Requisiti di conservazione dei dati specifici per modello. - Aggiorna il nome del modello da
claude-opus-4-8aclaude-fable-5(oclaude-mythos-5). - Rimuovi qualsiasi configurazione
thinking: {type: "disabled"}. Disabilitare il thinking restituisce un errore suclaude-fable-5eclaude-mythos-5, e le richieste senza un campothinkingvengono eseguite con adaptive thinking. - Aggiorna il parsing delle risposte che legge il contenuto per posizione, come
content[0].text: con l'adaptive thinking sempre attivo, i blocchithinkingarrivano prima dei blocchitext. Seleziona invece i blocchi di contenuto in base atype, e ripassa i blocchithinkingcompleti e non modificati nei loop di uso degli strumenti; i blocchi modificati restituiscono un errore 400. Consulta Preservare i blocchi thinking. - Se hai rimosso il pensiero esteso manuale e i prefill dell'assistente durante migrazioni precedenti, non è necessaria alcuna azione: entrambi rimangono non supportati su
claude-fable-5eclaude-mythos-5. - Verifica che qualsiasi codice che analizza il campo
thinkinglo tratti solo come testo da visualizzare e ripassi i blocchi thinking invariati quando continui sullo stesso modello.thinking.displayha come valore predefinito"omitted"suclaude-fable-5eclaude-mythos-5, come su Claude Opus 4.8. Impostadisplay: "summarized"per ricevere riassunti leggibili. Consulta Output del thinking sui modelli Claude Fable e Claude Mythos. - Se riproduci la cronologia della conversazione su un modello precedente, rimuovi prima i blocchi
thinkingeredacted_thinkingdai turni precedenti dell'assistente. I blocchi thinking diclaude-fable-5eclaude-mythos-5sono leggibili solo dal modello che li ha prodotti o da uno più recente: i modelli precedenti li ignorano silenziosamente, mentre Claude Fable 5.1 e Claude Mythos 5.1 li leggono, quindi conservali quando sposti una conversazione verso quei modelli (consulta Thinking preservato). La rimozione mantiene le richieste ai modelli precedenti minime e uniformi. L'eccezione è il riscatto di un credito di fallback, che richiede che il corpo della richiesta venga rimandato secondo le regole esatte di quella funzionalità. - Se migri a Claude Fable 5, gestisci
stop_reason: "refusal"e leggi il campostop_details.category. Per rieseguire automaticamente le richieste rifiutate su un altro modello, considera il parametro opt-infallbacks(beta). Consulta Rifiuti e fallback. - Rivaluta la tua impostazione di
effort. Inizia conhighper la maggior parte delle attività, inclusi i carichi di lavoro che venivano eseguiti conxhighsu Claude Opus 4.8. - Ricalcola la baseline di costo e latenza sui tuoi carichi di lavoro. I conteggi dei token sono pressoché invariati nella migrazione da
claude-opus-4-8; il prezzo per token è diverso, e i token di thinking sono fatturati come token di output, quindi i carichi di lavoro che venivano eseguiti senza thinking producono più token di output per richiesta.
Was this page helpful?