Migration zu Claude Mythos 5 und Claude Fable 5
Migriere zu Claude Mythos 5 und Claude Fable 5 von Claude Mythos Preview, Claude Opus 5 oder Claude Opus 4.8: Modell-IDs, API-Änderungen und Migrations-Checklisten.
Claude Fable 5 ist für anspruchsvolles Reasoning und agentische Arbeit mit langem Zeithorizont gebaut. Claude Fable 5.1 baut darauf auf. Claude Fable 5 ist auf der Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry verfügbar. Claude Mythos 5 verfügt über dieselben Fähigkeiten und wird nur zugelassenen Kunden in Project Glasswing angeboten.
Die gemeinsamen Grundeinstellungen von claude-fable-5 und claude-mythos-5:
- Denken: „Adaptive thinking“ (adaptives Denken) ist immer aktiviert. Das Modell bestimmt bei jeder Anfrage selbst, wann und wie viel es denkt, und es ist keine
thinking-Konfiguration erforderlich. Sowohlthinking: {type: "disabled"}als auch manuelles „extended thinking“ (erweitertes Denken) (thinking: {type: "enabled", budget_tokens: N}) geben einen 400-Fehler zurück. - Prefill: Das Vorbefüllen der Assistant-Nachricht gibt einen 400-Fehler zurück. Verwende stattdessen Anweisungen im System-Prompt.
- Kontextfenster und Ausgabe: Standardmäßig ein „context window“ (Kontextfenster) von 1M Token und bis zu 128k Output-Token pro Anfrage.
- Preise: 10 $ USD pro Million Input-Token und 50 $ USD pro Million Output-Token. Siehe Claude-Preise.
- Datenspeicherung: Beide Modelle erfordern eine 30-tägige Datenspeicherung und sind nicht im Rahmen von „zero data retention“-Vereinbarungen (keine Datenspeicherung), oder ZDR, verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Beide sind als Covered Models eingestuft. Auf der Claude API gibt eine Anfrage an Claude Fable 5 von einer Organisation, deren Datenspeicherungskonfiguration diese Anforderung nicht erfüllt, einen 400
invalid_request_errorzurück. Organisationen mit einer ZDR-Vereinbarung sollten sich an ihr Anthropic-Account-Team wenden, um die Datenspeicherungskonfiguration zu besprechen, oder die Datenspeicherung pro Workspace konfigurieren. Siehe Modellspezifische Anforderungen an die Datenspeicherung für plattformspezifische Details.
Wo sich die beiden Modelle unterscheiden:
- Verfügbarkeit: Claude Fable 5 erfordert keine Zugangsgenehmigung. Claude Mythos 5 ist nur für zugelassene Kunden in Project Glasswing verfügbar.
- Sicherheitsklassifikatoren: Claude Fable 5 führt Sicherheitsklassifikatoren aus, die Anfragen mit
stop_reason: "refusal"ablehnen können. Claude Mythos 5 enthält diese Klassifikatoren nicht. Siehe Ablehnungen und Fallback. - Priority Tier: Priority Tier wird auf Claude Fable 5 unterstützt, aber nicht auf Claude Mythos 5.
Migration zu Claude Mythos 5 und Claude Fable 5 von Claude Mythos Preview
Claude Mythos 5 ist der zugangsbeschränkte Nachfolger von Claude Mythos Preview, der Research-Preview nur auf Einladung. Claude Fable 5 bietet dieselben Fähigkeiten und erfordert keine Zugangsgenehmigung. Die Änderungen in diesem Abschnitt gelten gleichermaßen für beide Ziele.
Die Migration ist größtenteils ein Drop-in-Austausch. Claude Mythos 5 und Claude Fable 5 verwenden dieselbe Messages API und dieselben Muster für „tool use“ (Tool-Nutzung) wie Claude Mythos Preview, und die Token-Anzahlen bleiben ungefähr unverändert, da alle drei Modelle denselben Tokenizer verwenden. Die wichtigsten zu prüfenden Änderungen sind die nicht mehr verfügbaren Funktionen (im nächsten Abschnitt aufgeführt) und die Denkausgabe. Wenn du zu Claude Fable 5 migrierst, plane außerdem Ablehnungen durch Sicherheitsklassifikatoren ein, die Claude Mythos Preview und Claude Mythos 5 nicht haben; siehe Ablehnungen und Fallback.
Den Zeitplan für die Einstellung von Claude Mythos Preview findest du unter Modell-Abkündigungen.
Aktualisiere deinen Modellnamen
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Oder, für das Modell mit denselben Fähigkeiten und ohne erforderliche Zugriffsgenehmigung:
model = "claude-fable-5" # AfterFunktionen, die auf Claude Mythos 5 und Claude Fable 5 nicht verfügbar sind
-
Erweitertes Denken und Denk-Token-Budgets: Manuelles erweitertes Denken (
thinking: {type: "enabled", budget_tokens: N}) wird aufclaude-mythos-5undclaude-fable-5nicht unterstützt und gibt einen 400-Fehler zurück. Adaptives Denken ist immer aktiviert: Das Modell bestimmt bei jeder Anfrage selbst, wann und wie viel es denkt, und es ist keinethinking-Konfiguration erforderlich.thinking: {type: "disabled"}gibt einen Fehler zurück.budget_tokenshat keinen direkten Ersatz: Das Denken ist adaptiv, und der effort-Parameter ist eine separate Steuerung auf Ausgabeebene, kein Denkbudget.Vorher (Claude Mythos Preview):
client.messages.create( model="claude-mythos-preview", max_tokens=16000, thinking={"type": "enabled", "budget_tokens": 10000}, messages=[{"role": "user", "content": "..."}], )Nachher (Claude Mythos 5):
client.messages.create( model="claude-mythos-5", max_tokens=16000, messages=[{"role": "user", "content": "..."}], )Die Änderung für Claude Fable 5 ist identisch, mit
claude-fable-5als Modellname. -
Assistant-Prefill: Das Vorbefüllen der Assistant-Nachricht wird auf
claude-mythos-5undclaude-fable-5nicht unterstützt und gibt einen 400-Fehler zurück, genau wie auf Claude Mythos Preview. Verwende stattdessen Anweisungen im System-Prompt. -
Denkausgabe: Auf
claude-mythos-5undclaude-fable-5wird die rohe Gedankenkette nie zurückgegeben, aber Thinking-Blöcke enthalten weiterhin lesbaren zusammengefassten Text, wennthinking.displayaufsummarizedgesetzt ist. Gib Thinking-Blöcke unverändert zurück, wenn du eine Konversation auf demselben Modell fortsetzt. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen.
Token-Zählung und Abrechnung
claude-mythos-5 und claude-fable-5 verwenden denselben Tokenizer wie claude-mythos-preview (den mit Claude Opus 4.7 eingeführten Tokenizer). Die Token-Anzahlen bleiben bei der Migration von claude-mythos-preview ungefähr unverändert. Im Vergleich zu Modellen vor Claude Opus 4.7 kann derselbe Inhalt zu ungefähr 30 % mehr Token tokenisiert werden, abhängig von Inhalt und Workload-Form.
/v1/messages/count_tokens gibt für claude-mythos-5 und claude-fable-5 im Vergleich zu claude-mythos-preview ungefähr unveränderte Werte zurück. Ermittle Kosten und Latenz für deine eigenen Workloads neu.
Migrations-Checkliste
- Aktualisiere den Modellnamen von
claude-mythos-previewaufclaude-mythos-5oder aufclaude-fable-5, das dieselben Fähigkeiten bietet und keine Zugangsgenehmigung erfordert. - Entferne die Konfiguration für manuelles erweitertes Denken (
thinking: {type: "enabled", budget_tokens: N}). Adaptives Denken ist immer aktiviert, und es ist keinthinking-Feld erforderlich. - Entferne jegliche
thinking: {type: "disabled"}-Konfiguration. Das Deaktivieren des Denkens gibt aufclaude-mythos-5undclaude-fable-5einen Fehler zurück. - Entferne
budget_tokens. Es hat keinen direkten Ersatz: Das Denken ist adaptiv, und dereffort-Parameter ist eine separate Steuerung auf Ausgabeebene, kein Denkbudget. - Stelle sicher, dass jeglicher Code, der das
thinking-Feld parst, es nur als Anzeigetext behandelt und Thinking-Blöcke unverändert zurückgibt, wenn auf demselben Modell fortgesetzt wird.thinking.displayist aufclaude-mythos-5undclaude-fable-5standardmäßig"omitted", genau wie auf Claude Mythos Preview. Setzedisplay: "summarized", um lesbare Zusammenfassungen zu erhalten. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen. - Wenn du den Konversationsverlauf auf einem früheren Modell erneut abspielst, entferne zuerst
thinking- undredacted_thinking-Blöcke aus vorherigen Assistant-Turns. Thinking-Blöcke vonclaude-fable-5undclaude-mythos-5sind nur von dem Modell lesbar, das sie erzeugt hat, oder einem neueren: Frühere Modelle ignorieren sie stillschweigend, während Claude Fable 5.1 und Claude Mythos 5.1 sie lesen, behalte sie also bei, wenn du eine Konversation auf diese Modelle hochstufst (siehe Erhaltenes Denken). Das Entfernen hält Anfragen an frühere Modelle minimal und einheitlich. - Wenn du zu Claude Fable 5 migrierst, behandle
stop_reason: "refusal"und lies das Feldstop_details.category. Claude Fable 5 führt Sicherheitsklassifikatoren aus, die Claude Mythos Preview und Claude Mythos 5 nicht haben. Siehe Ablehnungen und Fallback. - Ermittle Token-Anzahlen und Kosten für deine eigenen Workloads neu. Die Token-Anzahlen bleiben bei der Migration von
claude-mythos-previewungefähr unverändert.
Migration zu Claude Mythos 5 und Claude Fable 5 von Claude Opus 5
Claude Fable 5 und Claude Mythos 5 verwenden dieselbe Messages API und dieselben Muster für Tool-Nutzung wie Claude Opus 5, mit demselben standardmäßigen Kontextfenster von 1M Token und denselben 128k maximalen Output-Token. Die Einschränkungen bei Prefill und Sampling-Parametern sowie das Verhalten der Denkanzeige werden unverändert von Claude Opus 5 übernommen. Die zu prüfenden Änderungen sind das immer aktivierte Denken, die Preise, Priority Tier und die Datenspeicherung.
Aktualisiere deinen Modellnamen
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Oder für das Project Glasswing-Modell mit denselben Fähigkeiten:
model = "claude-mythos-5" # AfterWas sich geändert hat
-
Denken kann nicht mehr deaktiviert werden: Auf Claude Opus 5 ist das Denken standardmäßig aktiviert und kann mit
thinking: {type: "disabled"}bei einem effort-Level vonhighoder darunter ausgeschaltet werden. Aufclaude-fable-5undclaude-mythos-5ist adaptives Denken immer aktiviert, undthinking: {type: "disabled"}gibt bei jedem effort-Level einen 400-Fehler zurück. Entferne diethinking: {type: "disabled"}-Konfiguration und verwende stattdessen niedrigere effort-Level, um den Token-Verbrauch zu steuern.Wenn deine Claude Opus 5-Anfragen das Denken deaktiviert haben, ändert sich die Antwortform: Eine Antwort kann mit einem oder mehreren
thinking-Blöcken vor dem erstentext-Block beginnen, die beim Standardwertdisplay: "omitted"(derselbe Standard wie bei Claude Opus 5) mit einem leerenthinking-Feld zurückgegeben werden. Code, der die Antwort nach Position liest, wiecontent[0].textoder ein Stream-Handler, der den ersten Content-Block als Text behandelt, muss Content-Blöcke stattdessen anhand ihrestype-Felds auswählen, und Tool-Use-Schleifen müssenthinking-Blöcke vollständig und unverändert zusammen mit ihren Tool-Ergebnissen zurückgeben. Die API lehnt bearbeitete, umsortierte oder teilweise entfernte Thinking-Blöcke mit einem 400-Fehler ab (siehe Thinking-Blöcke erhalten). Denk-Token werden als Output-Token abgerechnet, auch wenn der Denktext nicht zurückgegeben wird. -
Preise: Claude Fable 5 und Claude Mythos 5 kosten 10 $ USD pro Million Input-Token und 50 $ USD pro Million Output-Token, im Vergleich zu 5 $ USD und 25 $ USD für Claude Opus 5. Siehe Claude-Preise.
-
Priority Tier: Priority Tier wird auf Claude Opus 5 nicht unterstützt, daher ist kein bestehender Traffic betroffen. Wenn deine Organisation eine Priority-Tier-Verpflichtung hat, unterstützt Claude Fable 5 diese; Claude Mythos 5 nicht.
-
Datenspeicherung: Claude Fable 5 und Claude Mythos 5 erfordern eine 30-tägige Datenspeicherung und sind nicht im Rahmen von ZDR-Vereinbarungen (zero data retention) verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Beide sind als Covered Models eingestuft. Siehe Modellspezifische Anforderungen an die Datenspeicherung.
Migrations-Checkliste
- Aktualisiere den Modellnamen von
claude-opus-5aufclaude-fable-5(oderclaude-mythos-5). - Entferne jegliche
thinking: {type: "disabled"}-Konfiguration; sie gibt aufclaude-fable-5undclaude-mythos-5einen 400-Fehler zurück. Verwende stattdessen niedrigere effort-Level, um den Token-Verbrauch zu steuern, und überprüfemax_tokensfür Workloads, die auf Claude Opus 5 mit deaktiviertem Denken liefen. - Wenn diese Workloads Inhalte nach Position lesen, wie
content[0].text, aktualisiere sie so, dass sie Content-Blöcke nachtypeauswählen:thinking-Blöcke kommen jetzt vortext-Blöcken an. Gibthinking-Blöcke in Tool-Use-Schleifen vollständig und unverändert zurück; veränderte Blöcke geben einen 400-Fehler zurück. - Wenn deine Organisation eine ZDR-Vereinbarung (zero data retention) hat, bestätige die Berechtigung vor der Migration: Diese Modelle sind unter ZDR nicht verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Siehe Modellspezifische Anforderungen an die Datenspeicherung.
- Ermittle die Kosten für deine eigenen Workloads neu. Die Token-Anzahlen bleiben ungefähr unverändert; die Preise pro Token unterscheiden sich, und Workloads, die mit deaktiviertem Denken liefen, erzeugen jetzt Denk-Token, die als Output-Token abgerechnet werden.
Migration zu Claude Mythos 5 und Claude Fable 5 von Claude Opus 4.8
Die Migration ist größtenteils ein Drop-in-Austausch. Claude Fable 5 und Claude Mythos 5 verwenden dieselbe Messages API und dieselben Muster für Tool-Nutzung wie Claude Opus 4.8, mit demselben standardmäßigen Kontextfenster von 1M Token und denselben 128k maximalen Output-Token. Die Token-Anzahlen bleiben ungefähr unverändert, da die Modelle denselben Tokenizer verwenden. Die wichtigsten zu prüfenden Änderungen sind das immer aktivierte adaptive Denken, die Denkausgabe, Ablehnungen durch Sicherheitsklassifikatoren (nur Claude Fable 5) und die Preise.
Aktualisiere deinen Modellnamen
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Oder für das Project Glasswing-Modell mit denselben Fähigkeiten:
model = "claude-mythos-5" # AfterWas sich geändert hat
Die Punkte in diesem Abschnitt beschreiben die API- und Verhaltensunterschiede, die nach dem Austausch der Modell-ID geprüft werden sollten. Sofern nicht anders angegeben, gelten sie gleichermaßen für claude-fable-5 und claude-mythos-5.
-
Adaptives Denken ist immer aktiviert: Adaptives Denken ist der einzige Denkmodus auf
claude-fable-5undclaude-mythos-5. Das Modell bestimmt bei jeder Anfrage selbst, wann und wie viel es denkt, und es ist keinethinking-Konfiguration erforderlich.thinking: {type: "disabled"}gibt einen Fehler zurück. Verwende den effort-Parameter, um die Denktiefe zu steuern.Die zu prüfende Verhaltensänderung: Auf Claude Opus 4.8 laufen Anfragen ohne
thinking-Feld ohne Denken; aufclaude-fable-5undclaude-mythos-5laufen dieselben Anfragen mit adaptivem Denken.max_tokensbleibt eine harte Grenze für die Gesamtausgabe, Denken plus Antworttext, überprüfe es also für Workloads, die auf Claude Opus 4.8 ohne Denken liefen. Siehe Kostenkontrolle. Antworten können außerdem mit einem oder mehrerenthinking-Blöcken vor dem erstentext-Block beginnen, sodass Code, der die Antwort nach Position liest (zum Beispielcontent[0].textoder ein Stream-Handler, der den ersten Content-Block als Text behandelt), Content-Blöcke stattdessen anhand ihrestype-Felds auswählen muss. Denk-Token werden als Output-Token abgerechnet, auch wenn der Denktext nicht an dich zurückgegeben wird, sodass ein Workload, der auf Claude Opus 4.8 ohne Denken lief, zusätzlich zum Preisunterschied pro Token mehr Output-Token pro Anfrage erzeugt.Wenn du eine Tool-Use-Schleife ausführst, gib die
thinking-Blöcke aus jeder Assistant-Antwort vollständig und unverändert an die API zurück, wenn du Tool-Ergebnisse zurückgibst, einschließlich Blöcken, derenthinking-Feld leer ist. Gib die Assistant-Nachricht so zurück, wie du sie erhalten hast, anstatt ihre Content-Blöcke nach Typ zu filtern oder sie neu aufzubauen: Die API lehnt bearbeitete, umsortierte oder teilweise entfernte Thinking-Blöcke mit einem 400-Fehler ab. Siehe Thinking-Blöcke erhalten.Vorher (Claude Opus 4.8):
client.messages.create( model="claude-opus-4-8", max_tokens=16000, thinking={"type": "adaptive"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )Nachher (Claude Fable 5):
client.messages.create( model="claude-fable-5", max_tokens=16000, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )Die Änderung für Claude Mythos 5 ist identisch, mit
claude-mythos-5als Modellname. -
Erweitertes Denken und Denkbudgets (unverändert): Manuelles erweitertes Denken (
thinking: {type: "enabled", budget_tokens: N}) wird aufclaude-fable-5undclaude-mythos-5nicht unterstützt und gibt einen 400-Fehler zurück, genau wie auf Claude Opus 4.8.budget_tokenshat keinen direkten Ersatz: Das Denken ist adaptiv, und der effort-Parameter ist eine separate Steuerung auf Ausgabeebene, kein Denkbudget. -
Assistant-Prefill (unverändert): Das Vorbefüllen der Assistant-Nachricht wird auf
claude-fable-5undclaude-mythos-5nicht unterstützt und gibt einen 400-Fehler zurück, genau wie auf Claude Opus 4.8. Verwende stattdessen Anweisungen im System-Prompt. -
Denkausgabe: Auf
claude-fable-5undclaude-mythos-5wird die rohe Gedankenkette nie zurückgegeben, aber Thinking-Blöcke enthalten weiterhin lesbaren zusammengefassten Text, wennthinking.displayaufsummarizedgesetzt ist. Gib Thinking-Blöcke unverändert zurück, wenn du eine Konversation auf demselben Modell fortsetzt. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen. -
Sicherheitsklassifikatoren und der Stop-Reason
refusal(nur Claude Fable 5):claude-fable-5führt Sicherheitsklassifikatoren bei Anfragen und während der Antwortgenerierung aus. Claude Mythos 5 enthält diese Klassifikatoren nicht. Wenn ein Klassifikator eine Anfrage ablehnt, gibt die Messages APIstop_reason: "refusal"als erfolgreiche HTTP-200-Antwort zurück, nicht als Fehler. Das Feldstop_details.categorygibt an, welcher Klassifikator ausgelöst wurde, mit Kategorien wie"cyber","bio"und"reasoning_extraction", odernull, wenn die Ablehnung keiner benannten Kategorie zugeordnet ist. Siehe die Tabelle der Ablehnungskategorien für die vollständige Liste.Die Input-Token einer Anfrage, die abgelehnt wird, bevor eine Ausgabe generiert wurde, werden dir nicht in Rechnung gestellt. Wenn ein Klassifikator mitten im Stream auslöst, werden der Input und die bereits gestreamte Ausgabe abgerechnet; verwirf die Teilausgabe.
Um abgelehnte Anfragen automatisch auf einem anderen Modell erneut auszuführen, übergib den Opt-in-Parameter
fallbacks, der sich auf der Claude API in der Beta befindet. Der Parameter ist nicht auf der Message Batches API oder auf Amazon Bedrock, Google Cloud und Microsoft Foundry verfügbar; führe auf diesen drei Plattformen den Retry clientseitig aus oder verwende die Refusal-Fallback-Middleware des SDK. Siehe Ablehnungen und Fallback. -
Beginne mit effort
high: Der Standardwert des effort-Parameters bleibthigh. Auf Claude Opus 4.8 lautet die Empfehlung für Coding und Arbeit mit hoher Autonomie,xhighexplizit zu setzen. Aufclaude-fable-5undclaude-mythos-5verwendehighals Standard für die meisten Aufgaben und reservierexhighfür die fähigkeitssensibelsten Workloads. Niedrigere effort-Einstellungen liefern weiterhin gute Leistung und übertreffen oft diexhigh-Leistung früherer Modelle. Reduziere effort, wenn eine Aufgabe abgeschlossen wird, aber länger dauert als nötig. Siehe Prompting für Claude Fable 5. -
Niedrigeres Minimum für Prompt-Caching: Die minimale cachebare Prompt-Länge für „prompt caching“ (Prompt-Caching) auf
claude-fable-5undclaude-mythos-5beträgt 512 Token, niedriger als die 1.024 Token auf Claude Opus 4.8. Prompts, die auf Claude Opus 4.8 zu kurz zum Cachen waren, können jetzt Cache-Einträge erstellen, ohne dass Code-Änderungen erforderlich sind. Siehe Prompt-Caching für modellspezifische Mindestwerte.
Migrations-Checkliste
- Wenn deine Organisation eine ZDR-Vereinbarung (zero data retention) hat, bestätige die Berechtigung vor der Migration.
claude-fable-5undclaude-mythos-5erfordern eine 30-tägige Datenspeicherung und sind unter ZDR nicht verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Auf der Claude API geben Anfragen anclaude-fable-5, die diese Anforderung nicht erfüllen, einen 400invalid_request_errorzurück. Claude Opus 4.8 ist unter ZDR verfügbar. Siehe Modellspezifische Anforderungen an die Datenspeicherung. - Aktualisiere den Modellnamen von
claude-opus-4-8aufclaude-fable-5(oderclaude-mythos-5). - Entferne jegliche
thinking: {type: "disabled"}-Konfiguration. Das Deaktivieren des Denkens gibt aufclaude-fable-5undclaude-mythos-5einen Fehler zurück, und Anfragen ohnethinking-Feld laufen mit adaptivem Denken. - Aktualisiere das Antwort-Parsing, das Inhalte nach Position liest, wie
content[0].text: Da adaptives Denken immer aktiviert ist, kommenthinking-Blöcke vortext-Blöcken an. Wähle Content-Blöcke stattdessen nachtypeaus und gibthinking-Blöcke in Tool-Use-Schleifen vollständig und unverändert zurück; veränderte Blöcke geben einen 400-Fehler zurück. Siehe Thinking-Blöcke erhalten. - Wenn du manuelles erweitertes Denken und Assistant-Prefills bereits bei früheren Migrationen entfernt hast, ist keine Aktion erforderlich: Beides bleibt auf
claude-fable-5undclaude-mythos-5nicht unterstützt. - Stelle sicher, dass jeglicher Code, der das
thinking-Feld parst, es nur als Anzeigetext behandelt und Thinking-Blöcke unverändert zurückgibt, wenn auf demselben Modell fortgesetzt wird.thinking.displayist aufclaude-fable-5undclaude-mythos-5standardmäßig"omitted", genau wie auf Claude Opus 4.8. Setzedisplay: "summarized", um lesbare Zusammenfassungen zu erhalten. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen. - Wenn du den Konversationsverlauf auf einem früheren Modell erneut abspielst, entferne zuerst
thinking- undredacted_thinking-Blöcke aus vorherigen Assistant-Turns. Thinking-Blöcke vonclaude-fable-5undclaude-mythos-5sind nur von dem Modell lesbar, das sie erzeugt hat, oder einem neueren: Frühere Modelle ignorieren sie stillschweigend, während Claude Fable 5.1 und Claude Mythos 5.1 sie lesen, behalte sie also bei, wenn du eine Konversation auf diese Modelle hochstufst (siehe Erhaltenes Denken). Das Entfernen hält Anfragen an frühere Modelle minimal und einheitlich. Die Ausnahme ist das Einlösen eines Fallback-Guthabens, das erfordert, dass der Request-Body nach den genauen Regeln dieser Funktion zurückgegeben wird. - Wenn du zu Claude Fable 5 migrierst, behandle
stop_reason: "refusal"und lies das Feldstop_details.category. Um abgelehnte Anfragen automatisch auf einem anderen Modell erneut auszuführen, ziehe den Opt-in-Parameterfallbacks(Beta) in Betracht. Siehe Ablehnungen und Fallback. - Bewerte deine
effort-Einstellung neu. Beginne für die meisten Aufgaben mithigh, einschließlich Workloads, die auf Claude Opus 4.8 mitxhighliefen. - Ermittle Kosten und Latenz für deine eigenen Workloads neu. Die Token-Anzahlen bleiben bei der Migration von
claude-opus-4-8ungefähr unverändert; die Preise pro Token unterscheiden sich, und Denk-Token werden als Output-Token abgerechnet, sodass Workloads, die ohne Denken liefen, mehr Output-Token pro Anfrage erzeugen.
Was this page helpful?