Migra a Claude Mythos 5 e Claude Fable 5 da Claude Mythos Preview, Claude Opus 5 o Claude Opus 4.8: ID dei modelli, modifiche all'API e checklist di migrazione.
Claude Fable 5 è il modello più capace di Anthropic tra quelli ampiamente rilasciati, disponibile sulla Claude API, su Amazon Bedrock, Claude Platform on AWS, Google Cloud e Microsoft Foundry. Claude Mythos 5 condivide le stesse capacità ed è offerto solo ai clienti approvati in Project Glasswing.
Le impostazioni di base condivise da claude-fable-5 e claude-mythos-5:
thinking. Sia thinking: {type: "disabled"} sia l'"extended thinking" (pensiero esteso) manuale (thinking: {type: "enabled", budget_tokens: N}) restituiscono un errore 400.invalid_request_error. Le organizzazioni con un accordo ZDR devono contattare il proprio team account Anthropic per discutere la configurazione della conservazione dei dati. In alternativa, puoi configurare la conservazione dei dati per singolo workspace. Consulta Requisiti di conservazione dei dati specifici per modello per i dettagli per piattaforma.
Dove i due modelli divergono:
stop_reason: "refusal". Claude Mythos 5 non include questi classificatori. Consulta Rifiuti e fallback.Claude Mythos 5 è il successore ad accesso controllato di Claude Mythos Preview, l'anteprima di ricerca solo su invito. Claude Fable 5 offre le stesse capacità e non richiede approvazione dell'accesso. Le modifiche in questa sezione si applicano in egual modo a entrambe le destinazioni.
La migrazione è per lo più drop-in. Claude Mythos 5 e Claude Fable 5 usano la stessa Messages API e gli stessi pattern di "tool use" (uso degli strumenti) di Claude Mythos Preview, e i conteggi dei token sono pressoché invariati perché tutti e tre i modelli usano lo stesso tokenizer. Le modifiche principali da verificare sono le funzionalità non più disponibili (elencate nella sezione successiva) e l'output del thinking. Se migri a Claude Fable 5, pianifica anche la gestione dei rifiuti dei classificatori di sicurezza, che Claude Mythos Preview e Claude Mythos 5 non hanno; consulta Rifiuti e fallback.
Per la tempistica di ritiro di Claude Mythos Preview, consulta Deprecazioni dei modelli.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Oppure, per il modello con le stesse capacità e senza requisito di approvazione dell'accesso:
model = "claude-fable-5" # AfterPensiero esteso e budget di token per il thinking: Il pensiero esteso manuale (thinking: {type: "enabled", budget_tokens: N}) non è supportato su claude-mythos-5 o claude-fable-5 e restituisce un errore 400. L'adaptive thinking è sempre attivo: il modello determina quando e quanto pensare per ogni richiesta, e non è richiesta alcuna configurazione thinking. thinking: {type: "disabled"} restituisce un errore. budget_tokens non ha un sostituto diretto: il thinking è adattivo, e il parametro effort è un controllo separato a livello di output, non un budget per il thinking.
Prima (Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)Dopo (Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)La modifica per Claude Fable 5 è identica, con claude-fable-5 come nome del modello.
Prefill dell'assistente: Il prefill del messaggio dell'assistente non è supportato su claude-mythos-5 o claude-fable-5 e restituisce un errore 400, come su Claude Mythos Preview. Usa invece le istruzioni nel prompt di sistema.
Output del thinking: Su claude-mythos-5 e claude-fable-5, la catena di pensiero grezza non viene mai restituita, ma i blocchi thinking contengono comunque testo riassunto leggibile quando thinking.display è impostato su summarized. Ripassa i blocchi thinking invariati quando continui una conversazione sullo stesso modello. Consulta Output del thinking su Claude Fable 5 e Claude Mythos 5.
claude-mythos-5 e claude-fable-5 usano lo stesso tokenizer di claude-mythos-preview (il tokenizer introdotto con Claude Opus 4.7). I conteggi dei token sono pressoché invariati nella migrazione da claude-mythos-preview. Rispetto ai modelli precedenti a Claude Opus 4.7, lo stesso contenuto può essere tokenizzato in circa il 30% di token in più, con variazioni in base al contenuto e alla forma del carico di lavoro.
/v1/messages/count_tokens restituisce valori pressoché invariati per claude-mythos-5 e claude-fable-5 rispetto a claude-mythos-preview. Ricalcola la baseline di costo e "latency" (latenza) sui tuoi carichi di lavoro.
claude-mythos-preview a claude-mythos-5, oppure a claude-fable-5, che offre le stesse capacità e non richiede approvazione dell'accesso.thinking: {type: "enabled", budget_tokens: N}). L'adaptive thinking è sempre attivo, e non è richiesto alcun campo thinking.thinking: {type: "disabled"}. Disabilitare il thinking restituisce un errore su claude-mythos-5 e claude-fable-5.budget_tokens. Non ha un sostituto diretto: il thinking è adattivo, e il parametro effort è un controllo separato a livello di output, non un budget per il thinking.thinking lo tratti solo come testo da visualizzare e ripassi i blocchi thinking invariati quando continui sullo stesso modello. thinking.display ha come valore predefinito "omitted" su claude-mythos-5 e claude-fable-5, come su Claude Mythos Preview; imposta display: "summarized" per ricevere riassunti leggibili. Consulta Output del thinking su Claude Fable 5 e Claude Mythos 5.
thinking e redacted_thinking dai turni precedenti dell'assistente. I blocchi thinking di claude-mythos-5 e claude-fable-5 sono legati al modello che li ha prodotti, e i modelli diversi da Claude Fable 5 e Claude Mythos 5 li ignorano silenziosamente. La rimozione mantiene le richieste tra modelli diversi minime e uniformi.
stop_reason: "refusal" e leggi il campo stop_details.category. Claude Fable 5 esegue classificatori di sicurezza che Claude Mythos Preview e Claude Mythos 5 non hanno. Consulta Rifiuti e fallback.claude-mythos-preview.Claude Fable 5 e Claude Mythos 5 usano la stessa Messages API e gli stessi pattern di uso degli strumenti di Claude Opus 5, con la stessa finestra di contesto da 1M di token per impostazione predefinita e gli stessi 128k token massimi di output. Le restrizioni su prefill e parametri di campionamento, e il comportamento di visualizzazione del thinking, vengono ereditati da Claude Opus 5 senza modifiche. Le modifiche da verificare sono il thinking sempre attivo, i prezzi, il Priority Tier e la conservazione dei dati.
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Oppure, per il modello Project Glasswing con le stesse capacità:
model = "claude-mythos-5" # AfterIl thinking non può più essere disabilitato: Su Claude Opus 5, il thinking è attivo per impostazione predefinita e può essere disattivato con thinking: {type: "disabled"} a un livello di effort pari a high o inferiore. Su claude-fable-5 e claude-mythos-5, l'adaptive thinking è sempre attivo, e thinking: {type: "disabled"} restituisce un errore 400 a qualsiasi livello di effort. Rimuovi la configurazione thinking: {type: "disabled"} e usa invece livelli di effort più bassi per controllare la spesa in token.
Se le tue richieste a Claude Opus 5 disabilitavano il thinking, la forma della risposta cambia: una risposta può iniziare con uno o più blocchi thinking prima del primo blocco text, restituiti con un campo thinking vuoto con il valore predefinito display: "omitted" (lo stesso valore predefinito di Claude Opus 5). Il codice che legge la risposta per posizione, come content[0].text o un gestore di stream che tratta il primo blocco di contenuto come testo, deve invece selezionare i blocchi di contenuto in base al loro campo type, e i cicli di uso degli strumenti devono ripassare i blocchi thinking completi e non modificati insieme ai risultati degli strumenti. L'API rifiuta i blocchi thinking modificati, riordinati o parzialmente eliminati con un errore 400 (consulta Preservare i blocchi thinking). I token di thinking vengono fatturati come token di output anche quando il testo del thinking non viene restituito.
Prezzi: Claude Fable 5 e Claude Mythos 5 hanno un prezzo di $10 USD per milione di token di input e $50 USD per milione di token di output, rispetto a $5 USD e $25 USD per Claude Opus 5. Consulta Prezzi di Claude.
Priority Tier: Il Priority Tier non è supportato su Claude Opus 5, quindi nessun traffico esistente è interessato. Se la tua organizzazione ha un impegno Priority Tier, Claude Fable 5 lo supporta; Claude Mythos 5 no.
Conservazione dei dati: Claude Fable 5 e Claude Mythos 5 richiedono una conservazione dei dati di 30 giorni e non sono disponibili nell'ambito di accordi di zero data retention (ZDR); entrambi sono designati come Covered Models. Consulta Requisiti di conservazione dei dati specifici per modello.
claude-opus-5 a claude-fable-5 (o claude-mythos-5).thinking: {type: "disabled"}; restituisce un errore 400 su claude-fable-5 e claude-mythos-5. Usa invece livelli di effort più bassi per controllare la spesa in token, e rivedi max_tokens per i carichi di lavoro che venivano eseguiti con il thinking disabilitato su Claude Opus 5.content[0].text, aggiornali per selezionare i blocchi di contenuto in base a type: i blocchi thinking ora arrivano prima dei blocchi text. Ripassa i blocchi thinking completi e non modificati nei cicli di uso degli strumenti; i blocchi modificati restituiscono un errore 400.La migrazione è per lo più drop-in. Claude Fable 5 e Claude Mythos 5 usano la stessa Messages API e gli stessi pattern di uso degli strumenti di Claude Opus 4.8, con la stessa finestra di contesto da 1M di token per impostazione predefinita e gli stessi 128k token massimi di output. I conteggi dei token sono pressoché invariati perché i modelli usano lo stesso tokenizer. Le modifiche principali da verificare sono l'adaptive thinking sempre attivo, l'output del thinking, i rifiuti dei classificatori di sicurezza (solo Claude Fable 5) e i prezzi.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Oppure, per il modello Project Glasswing con le stesse capacità:
model = "claude-mythos-5" # AfterLe voci in questa sezione descrivono le differenze di API e di comportamento che vale la pena verificare dopo aver sostituito l'ID del modello. Salvo dove indicato, si applicano in egual modo a claude-fable-5 e claude-mythos-5.
L'adaptive thinking è sempre attivo: L'adaptive thinking è l'unica modalità di thinking su claude-fable-5 e claude-mythos-5. Il modello determina quando e quanto pensare per ogni richiesta, e non è richiesta alcuna configurazione thinking. thinking: {type: "disabled"} restituisce un errore. Usa il parametro effort per controllare la profondità del thinking.
La modifica di comportamento da verificare: su Claude Opus 4.8, le richieste senza un campo thinking vengono eseguite senza thinking; su claude-fable-5 e claude-mythos-5, quelle stesse richieste vengono eseguite con adaptive thinking. max_tokens rimane un limite rigido sull'output totale, thinking più testo della risposta, quindi rivedilo per i carichi di lavoro che venivano eseguiti senza thinking su Claude Opus 4.8. Consulta Controllo dei costi. Le risposte possono anche iniziare con uno o più blocchi thinking prima del primo blocco text, quindi il codice che legge la risposta per posizione (ad esempio, content[0].text, o un gestore di stream che tratta il primo blocco di contenuto come testo) deve invece selezionare i blocchi di contenuto in base al loro campo type. I token di thinking vengono fatturati come token di output anche quando il testo del thinking non ti viene restituito, quindi un carico di lavoro che veniva eseguito senza thinking su Claude Opus 4.8 produce più token di output per richiesta, oltre alla differenza di prezzo per token.
Se esegui un ciclo di uso degli strumenti, ripassa all'API i blocchi thinking di ogni risposta dell'assistente completi e non modificati quando restituisci i risultati degli strumenti, inclusi i blocchi il cui campo thinking è vuoto. Rimanda il messaggio dell'assistente così come ricevuto anziché filtrarne i blocchi di contenuto per tipo o ricostruirlo: l'API rifiuta i blocchi thinking modificati, riordinati o parzialmente eliminati con un errore 400. Consulta Preservare i blocchi thinking.
Prima (Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Dopo (Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)La modifica per Claude Mythos 5 è identica, con claude-mythos-5 come nome del modello.
Pensiero esteso e budget per il thinking (invariato): Il pensiero esteso manuale (thinking: {type: "enabled", budget_tokens: N}) non è supportato su claude-fable-5 o claude-mythos-5 e restituisce un errore 400, come su Claude Opus 4.8. budget_tokens non ha un sostituto diretto: il thinking è adattivo, e il parametro effort è un controllo separato a livello di output, non un budget per il thinking.
Prefill dell'assistente (invariato): Il prefill del messaggio dell'assistente non è supportato su claude-fable-5 o claude-mythos-5 e restituisce un errore 400, come su Claude Opus 4.8. Usa invece le istruzioni nel prompt di sistema.
Output del thinking: Su claude-fable-5 e claude-mythos-5, la catena di pensiero grezza non viene mai restituita, ma i blocchi thinking contengono comunque testo riassunto leggibile quando thinking.display è impostato su summarized. Ripassa i blocchi thinking invariati quando continui una conversazione sullo stesso modello. Consulta Output del thinking su Claude Fable 5 e Claude Mythos 5.
Classificatori di sicurezza e stop reason refusal (solo Claude Fable 5): claude-fable-5 esegue classificatori di sicurezza sulle richieste e durante la generazione della risposta. Claude Mythos 5 non include questi classificatori. Quando un classificatore rifiuta una richiesta, la Messages API restituisce stop_reason: "refusal" come risposta HTTP 200 riuscita, non come errore. Il campo stop_details.category riporta quale classificatore si è attivato, con categorie come "cyber", "bio" e "reasoning_extraction", oppure null quando il rifiuto non corrisponde a nessuna categoria denominata. Consulta la tabella delle categorie di rifiuto per l'elenco completo.
Non ti vengono fatturati i token di input di una richiesta rifiutata prima che venga generato qualsiasi output. Quando un classificatore si attiva a metà stream, l'input e l'output già trasmesso in streaming vengono fatturati; scarta l'output parziale.
Per rieseguire automaticamente le richieste rifiutate su un altro modello, passa il parametro opt-in fallbacks, che è in beta sulla Claude API. Il parametro non è disponibile sulla Message Batches API né su Amazon Bedrock, Google Cloud e Microsoft Foundry; su queste tre piattaforme, esegui il retry lato client oppure usa il middleware di refusal-fallback dell'SDK. Consulta Rifiuti e fallback.
Inizia con effort high: Il valore predefinito del parametro effort rimane high. Su Claude Opus 4.8, la raccomandazione per il coding e il lavoro ad alta autonomia è impostare esplicitamente xhigh. Su claude-fable-5 e claude-mythos-5, usa high come valore predefinito per la maggior parte delle attività e riserva xhigh ai carichi di lavoro più sensibili alle capacità. Le impostazioni di effort più basse offrono comunque buone prestazioni e spesso superano le prestazioni di xhigh sui modelli precedenti. Riduci l'effort se un'attività viene completata ma richiede più tempo del necessario. Consulta Prompting di Claude Fable 5.
Minimo più basso per la cache dei prompt: La lunghezza minima del prompt memorizzabile in cache su claude-fable-5 e claude-mythos-5 è di 512 token, inferiore ai 1.024 token di Claude Opus 4.8. I prompt che erano troppo brevi per essere memorizzati in cache su Claude Opus 4.8 possono ora creare voci di cache, senza modifiche al codice. Consulta "Prompt caching" (cache dei prompt) per i minimi per modello.
claude-fable-5 e claude-mythos-5 richiedono una conservazione dei dati di 30 giorni; sulla Claude API, le richieste a claude-fable-5 che non soddisfano questo requisito restituiscono un errore 400 invalid_request_error. Claude Opus 4.8 rimane disponibile in ZDR. Consulta Requisiti di conservazione dei dati specifici per modello.
claude-opus-4-8 a claude-fable-5 (o claude-mythos-5).thinking: {type: "disabled"}. Disabilitare il thinking restituisce un errore su claude-fable-5 e claude-mythos-5, e le richieste senza un campo thinking vengono eseguite con adaptive thinking.content[0].text: con l'adaptive thinking sempre attivo, i blocchi thinking arrivano prima dei blocchi text. Seleziona invece i blocchi di contenuto in base a type, e ripassa i blocchi thinking completi e non modificati nei cicli di uso degli strumenti; i blocchi modificati restituiscono un errore 400. Consulta Preservare i blocchi thinking.claude-fable-5 e claude-mythos-5.thinking lo tratti solo come testo da visualizzare e ripassi i blocchi thinking invariati quando continui sullo stesso modello. thinking.display ha come valore predefinito "omitted" su claude-fable-5 e claude-mythos-5, come su Claude Opus 4.8; imposta display: "summarized" per ricevere riassunti leggibili. Consulta Output del thinking su Claude Fable 5 e Claude Mythos 5.
thinking e redacted_thinking dai turni precedenti dell'assistente. I blocchi thinking di claude-fable-5 e claude-mythos-5 sono legati al modello che li ha prodotti, e i modelli diversi da Claude Fable 5 e Claude Mythos 5 li ignorano silenziosamente. La rimozione mantiene le richieste tra modelli diversi minime e uniformi. L'eccezione è il riscatto di un credito di fallback, che richiede che il corpo della richiesta venga rimandato secondo le regole esatte di quella funzionalità.
stop_reason: "refusal" e leggi il campo stop_details.category. Per rieseguire automaticamente le richieste rifiutate su un altro modello, considera il parametro opt-in fallbacks (beta). Consulta Rifiuti e fallback.effort. Inizia con high per la maggior parte delle attività, inclusi i carichi di lavoro che venivano eseguiti con xhigh su Claude Opus 4.8.claude-opus-4-8; il prezzo per token è diverso, e i token di thinking vengono fatturati come token di output, quindi i carichi di lavoro che venivano eseguiti senza thinking producono più token di output per richiesta.Was this page helpful?