Claude Platform Docs
Documentation

Migration zu Claude Mythos 5 und Claude Fable 5

Migriere zu Claude Mythos 5 und Claude Fable 5 von Claude Mythos Preview, Claude Opus 5 oder Claude Opus 4.8: Modell-IDs, API-Änderungen und Migrations-Checklisten.

Claude Fable 5 ist für anspruchsvolles Reasoning und agentische Arbeit mit langem Zeithorizont gebaut. Claude Fable 5.1 baut darauf auf. Claude Fable 5 ist auf der Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry verfügbar. Claude Mythos 5 verfügt über dieselben Fähigkeiten und wird nur zugelassenen Kunden in Project Glasswing angeboten.

Die gemeinsamen Grundeinstellungen von claude-fable-5 und claude-mythos-5:

  • Denken: „Adaptive thinking“ (adaptives Denken) ist immer aktiviert. Das Modell bestimmt bei jeder Anfrage selbst, wann und wie viel es denkt, und es ist keine thinking-Konfiguration erforderlich. Sowohl thinking: {type: "disabled"} als auch manuelles „extended thinking“ (erweitertes Denken) (thinking: {type: "enabled", budget_tokens: N}) geben einen 400-Fehler zurück.
  • Prefill: Das Vorbefüllen der Assistant-Nachricht gibt einen 400-Fehler zurück. Verwende stattdessen Anweisungen im System-Prompt.
  • Kontextfenster und Ausgabe: Standardmäßig ein „context window“ (Kontextfenster) von 1M Token und bis zu 128k Output-Token pro Anfrage.
  • Preise: 10 $ USD pro Million Input-Token und 50 $ USD pro Million Output-Token. Siehe Claude-Preise.
  • Datenspeicherung: Beide Modelle erfordern eine 30-tägige Datenspeicherung und sind nicht im Rahmen von „zero data retention“-Vereinbarungen (keine Datenspeicherung), oder ZDR, verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Beide sind als Covered Models eingestuft. Auf der Claude API gibt eine Anfrage an Claude Fable 5 von einer Organisation, deren Datenspeicherungskonfiguration diese Anforderung nicht erfüllt, einen 400 invalid_request_error zurück. Organisationen mit einer ZDR-Vereinbarung sollten sich an ihr Anthropic-Account-Team wenden, um die Datenspeicherungskonfiguration zu besprechen, oder die Datenspeicherung pro Workspace konfigurieren. Siehe Modellspezifische Anforderungen an die Datenspeicherung für plattformspezifische Details.

Wo sich die beiden Modelle unterscheiden:

  • Verfügbarkeit: Claude Fable 5 erfordert keine Zugangsgenehmigung. Claude Mythos 5 ist nur für zugelassene Kunden in Project Glasswing verfügbar.
  • Sicherheitsklassifikatoren: Claude Fable 5 führt Sicherheitsklassifikatoren aus, die Anfragen mit stop_reason: "refusal" ablehnen können. Claude Mythos 5 enthält diese Klassifikatoren nicht. Siehe Ablehnungen und Fallback.
  • Priority Tier: Priority Tier wird auf Claude Fable 5 unterstützt, aber nicht auf Claude Mythos 5.

Migration zu Claude Mythos 5 und Claude Fable 5 von Claude Mythos Preview

Claude Mythos 5 ist der zugangsbeschränkte Nachfolger von Claude Mythos Preview, der Research-Preview nur auf Einladung. Claude Fable 5 bietet dieselben Fähigkeiten und erfordert keine Zugangsgenehmigung. Die Änderungen in diesem Abschnitt gelten gleichermaßen für beide Ziele.

Die Migration ist größtenteils ein Drop-in-Austausch. Claude Mythos 5 und Claude Fable 5 verwenden dieselbe Messages API und dieselben Muster für „tool use“ (Tool-Nutzung) wie Claude Mythos Preview, und die Token-Anzahlen bleiben ungefähr unverändert, da alle drei Modelle denselben Tokenizer verwenden. Die wichtigsten zu prüfenden Änderungen sind die nicht mehr verfügbaren Funktionen (im nächsten Abschnitt aufgeführt) und die Denkausgabe. Wenn du zu Claude Fable 5 migrierst, plane außerdem Ablehnungen durch Sicherheitsklassifikatoren ein, die Claude Mythos Preview und Claude Mythos 5 nicht haben; siehe Ablehnungen und Fallback.

Den Zeitplan für die Einstellung von Claude Mythos Preview findest du unter Modell-Abkündigungen.

Aktualisiere deinen Modellnamen

model = "claude-mythos-preview"  # Before
model = "claude-mythos-5"  # After

# Oder, für das Modell mit denselben Fähigkeiten und ohne erforderliche Zugriffsgenehmigung:
model = "claude-fable-5"  # After

Funktionen, die auf Claude Mythos 5 und Claude Fable 5 nicht verfügbar sind

  1. Erweitertes Denken und Denk-Token-Budgets: Manuelles erweitertes Denken (thinking: {type: "enabled", budget_tokens: N}) wird auf claude-mythos-5 und claude-fable-5 nicht unterstützt und gibt einen 400-Fehler zurück. Adaptives Denken ist immer aktiviert: Das Modell bestimmt bei jeder Anfrage selbst, wann und wie viel es denkt, und es ist keine thinking-Konfiguration erforderlich. thinking: {type: "disabled"} gibt einen Fehler zurück. budget_tokens hat keinen direkten Ersatz: Das Denken ist adaptiv, und der effort-Parameter ist eine separate Steuerung auf Ausgabeebene, kein Denkbudget.

    Vorher (Claude Mythos Preview):

    client.messages.create(
        model="claude-mythos-preview",
        max_tokens=16000,
        thinking={"type": "enabled", "budget_tokens": 10000},
        messages=[{"role": "user", "content": "..."}],
    )

    Nachher (Claude Mythos 5):

    client.messages.create(
        model="claude-mythos-5",
        max_tokens=16000,
        messages=[{"role": "user", "content": "..."}],
    )

    Die Änderung für Claude Fable 5 ist identisch, mit claude-fable-5 als Modellname.

  2. Assistant-Prefill: Das Vorbefüllen der Assistant-Nachricht wird auf claude-mythos-5 und claude-fable-5 nicht unterstützt und gibt einen 400-Fehler zurück, genau wie auf Claude Mythos Preview. Verwende stattdessen Anweisungen im System-Prompt.

  3. Denkausgabe: Auf claude-mythos-5 und claude-fable-5 wird die rohe Gedankenkette nie zurückgegeben, aber Thinking-Blöcke enthalten weiterhin lesbaren zusammengefassten Text, wenn thinking.display auf summarized gesetzt ist. Gib Thinking-Blöcke unverändert zurück, wenn du eine Konversation auf demselben Modell fortsetzt. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen.

Token-Zählung und Abrechnung

claude-mythos-5 und claude-fable-5 verwenden denselben Tokenizer wie claude-mythos-preview (den mit Claude Opus 4.7 eingeführten Tokenizer). Die Token-Anzahlen bleiben bei der Migration von claude-mythos-preview ungefähr unverändert. Im Vergleich zu Modellen vor Claude Opus 4.7 kann derselbe Inhalt zu ungefähr 30 % mehr Token tokenisiert werden, abhängig von Inhalt und Workload-Form.

/v1/messages/count_tokens gibt für claude-mythos-5 und claude-fable-5 im Vergleich zu claude-mythos-preview ungefähr unveränderte Werte zurück. Ermittle Kosten und Latenz für deine eigenen Workloads neu.

Migrations-Checkliste

  • Aktualisiere den Modellnamen von claude-mythos-preview auf claude-mythos-5 oder auf claude-fable-5, das dieselben Fähigkeiten bietet und keine Zugangsgenehmigung erfordert.
  • Entferne die Konfiguration für manuelles erweitertes Denken (thinking: {type: "enabled", budget_tokens: N}). Adaptives Denken ist immer aktiviert, und es ist kein thinking-Feld erforderlich.
  • Entferne jegliche thinking: {type: "disabled"}-Konfiguration. Das Deaktivieren des Denkens gibt auf claude-mythos-5 und claude-fable-5 einen Fehler zurück.
  • Entferne budget_tokens. Es hat keinen direkten Ersatz: Das Denken ist adaptiv, und der effort-Parameter ist eine separate Steuerung auf Ausgabeebene, kein Denkbudget.
  • Stelle sicher, dass jeglicher Code, der das thinking-Feld parst, es nur als Anzeigetext behandelt und Thinking-Blöcke unverändert zurückgibt, wenn auf demselben Modell fortgesetzt wird. thinking.display ist auf claude-mythos-5 und claude-fable-5 standardmäßig "omitted", genau wie auf Claude Mythos Preview. Setze display: "summarized", um lesbare Zusammenfassungen zu erhalten. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen.
  • Wenn du den Konversationsverlauf auf einem früheren Modell erneut abspielst, entferne zuerst thinking- und redacted_thinking-Blöcke aus vorherigen Assistant-Turns. Thinking-Blöcke von claude-fable-5 und claude-mythos-5 sind nur von dem Modell lesbar, das sie erzeugt hat, oder einem neueren: Frühere Modelle ignorieren sie stillschweigend, während Claude Fable 5.1 und Claude Mythos 5.1 sie lesen, behalte sie also bei, wenn du eine Konversation auf diese Modelle hochstufst (siehe Erhaltenes Denken). Das Entfernen hält Anfragen an frühere Modelle minimal und einheitlich.
  • Wenn du zu Claude Fable 5 migrierst, behandle stop_reason: "refusal" und lies das Feld stop_details.category. Claude Fable 5 führt Sicherheitsklassifikatoren aus, die Claude Mythos Preview und Claude Mythos 5 nicht haben. Siehe Ablehnungen und Fallback.
  • Ermittle Token-Anzahlen und Kosten für deine eigenen Workloads neu. Die Token-Anzahlen bleiben bei der Migration von claude-mythos-preview ungefähr unverändert.

Migration zu Claude Mythos 5 und Claude Fable 5 von Claude Opus 5

Claude Fable 5 und Claude Mythos 5 verwenden dieselbe Messages API und dieselben Muster für Tool-Nutzung wie Claude Opus 5, mit demselben standardmäßigen Kontextfenster von 1M Token und denselben 128k maximalen Output-Token. Die Einschränkungen bei Prefill und Sampling-Parametern sowie das Verhalten der Denkanzeige werden unverändert von Claude Opus 5 übernommen. Die zu prüfenden Änderungen sind das immer aktivierte Denken, die Preise, Priority Tier und die Datenspeicherung.

Aktualisiere deinen Modellnamen

model = "claude-opus-5"  # Before
model = "claude-fable-5"  # After

# Oder für das Project Glasswing-Modell mit denselben Fähigkeiten:
model = "claude-mythos-5"  # After

Was sich geändert hat

  1. Denken kann nicht mehr deaktiviert werden: Auf Claude Opus 5 ist das Denken standardmäßig aktiviert und kann mit thinking: {type: "disabled"} bei einem effort-Level von high oder darunter ausgeschaltet werden. Auf claude-fable-5 und claude-mythos-5 ist adaptives Denken immer aktiviert, und thinking: {type: "disabled"} gibt bei jedem effort-Level einen 400-Fehler zurück. Entferne die thinking: {type: "disabled"}-Konfiguration und verwende stattdessen niedrigere effort-Level, um den Token-Verbrauch zu steuern.

    Wenn deine Claude Opus 5-Anfragen das Denken deaktiviert haben, ändert sich die Antwortform: Eine Antwort kann mit einem oder mehreren thinking-Blöcken vor dem ersten text-Block beginnen, die beim Standardwert display: "omitted" (derselbe Standard wie bei Claude Opus 5) mit einem leeren thinking-Feld zurückgegeben werden. Code, der die Antwort nach Position liest, wie content[0].text oder ein Stream-Handler, der den ersten Content-Block als Text behandelt, muss Content-Blöcke stattdessen anhand ihres type-Felds auswählen, und Tool-Use-Schleifen müssen thinking-Blöcke vollständig und unverändert zusammen mit ihren Tool-Ergebnissen zurückgeben. Die API lehnt bearbeitete, umsortierte oder teilweise entfernte Thinking-Blöcke mit einem 400-Fehler ab (siehe Thinking-Blöcke erhalten). Denk-Token werden als Output-Token abgerechnet, auch wenn der Denktext nicht zurückgegeben wird.

  2. Preise: Claude Fable 5 und Claude Mythos 5 kosten 10 $ USD pro Million Input-Token und 50 $ USD pro Million Output-Token, im Vergleich zu 5 $ USD und 25 $ USD für Claude Opus 5. Siehe Claude-Preise.

  3. Priority Tier: Priority Tier wird auf Claude Opus 5 nicht unterstützt, daher ist kein bestehender Traffic betroffen. Wenn deine Organisation eine Priority-Tier-Verpflichtung hat, unterstützt Claude Fable 5 diese; Claude Mythos 5 nicht.

  4. Datenspeicherung: Claude Fable 5 und Claude Mythos 5 erfordern eine 30-tägige Datenspeicherung und sind nicht im Rahmen von ZDR-Vereinbarungen (zero data retention) verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Beide sind als Covered Models eingestuft. Siehe Modellspezifische Anforderungen an die Datenspeicherung.

Migrations-Checkliste

  • Aktualisiere den Modellnamen von claude-opus-5 auf claude-fable-5 (oder claude-mythos-5).
  • Entferne jegliche thinking: {type: "disabled"}-Konfiguration; sie gibt auf claude-fable-5 und claude-mythos-5 einen 400-Fehler zurück. Verwende stattdessen niedrigere effort-Level, um den Token-Verbrauch zu steuern, und überprüfe max_tokens für Workloads, die auf Claude Opus 5 mit deaktiviertem Denken liefen.
  • Wenn diese Workloads Inhalte nach Position lesen, wie content[0].text, aktualisiere sie so, dass sie Content-Blöcke nach type auswählen: thinking-Blöcke kommen jetzt vor text-Blöcken an. Gib thinking-Blöcke in Tool-Use-Schleifen vollständig und unverändert zurück; veränderte Blöcke geben einen 400-Fehler zurück.
  • Wenn deine Organisation eine ZDR-Vereinbarung (zero data retention) hat, bestätige die Berechtigung vor der Migration: Diese Modelle sind unter ZDR nicht verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Siehe Modellspezifische Anforderungen an die Datenspeicherung.
  • Ermittle die Kosten für deine eigenen Workloads neu. Die Token-Anzahlen bleiben ungefähr unverändert; die Preise pro Token unterscheiden sich, und Workloads, die mit deaktiviertem Denken liefen, erzeugen jetzt Denk-Token, die als Output-Token abgerechnet werden.

Migration zu Claude Mythos 5 und Claude Fable 5 von Claude Opus 4.8

Die Migration ist größtenteils ein Drop-in-Austausch. Claude Fable 5 und Claude Mythos 5 verwenden dieselbe Messages API und dieselben Muster für Tool-Nutzung wie Claude Opus 4.8, mit demselben standardmäßigen Kontextfenster von 1M Token und denselben 128k maximalen Output-Token. Die Token-Anzahlen bleiben ungefähr unverändert, da die Modelle denselben Tokenizer verwenden. Die wichtigsten zu prüfenden Änderungen sind das immer aktivierte adaptive Denken, die Denkausgabe, Ablehnungen durch Sicherheitsklassifikatoren (nur Claude Fable 5) und die Preise.

Aktualisiere deinen Modellnamen

model = "claude-opus-4-8"  # Before
model = "claude-fable-5"  # After

# Oder für das Project Glasswing-Modell mit denselben Fähigkeiten:
model = "claude-mythos-5"  # After

Was sich geändert hat

Die Punkte in diesem Abschnitt beschreiben die API- und Verhaltensunterschiede, die nach dem Austausch der Modell-ID geprüft werden sollten. Sofern nicht anders angegeben, gelten sie gleichermaßen für claude-fable-5 und claude-mythos-5.

  1. Adaptives Denken ist immer aktiviert: Adaptives Denken ist der einzige Denkmodus auf claude-fable-5 und claude-mythos-5. Das Modell bestimmt bei jeder Anfrage selbst, wann und wie viel es denkt, und es ist keine thinking-Konfiguration erforderlich. thinking: {type: "disabled"} gibt einen Fehler zurück. Verwende den effort-Parameter, um die Denktiefe zu steuern.

    Die zu prüfende Verhaltensänderung: Auf Claude Opus 4.8 laufen Anfragen ohne thinking-Feld ohne Denken; auf claude-fable-5 und claude-mythos-5 laufen dieselben Anfragen mit adaptivem Denken. max_tokens bleibt eine harte Grenze für die Gesamtausgabe, Denken plus Antworttext, überprüfe es also für Workloads, die auf Claude Opus 4.8 ohne Denken liefen. Siehe Kostenkontrolle. Antworten können außerdem mit einem oder mehreren thinking-Blöcken vor dem ersten text-Block beginnen, sodass Code, der die Antwort nach Position liest (zum Beispiel content[0].text oder ein Stream-Handler, der den ersten Content-Block als Text behandelt), Content-Blöcke stattdessen anhand ihres type-Felds auswählen muss. Denk-Token werden als Output-Token abgerechnet, auch wenn der Denktext nicht an dich zurückgegeben wird, sodass ein Workload, der auf Claude Opus 4.8 ohne Denken lief, zusätzlich zum Preisunterschied pro Token mehr Output-Token pro Anfrage erzeugt.

    Wenn du eine Tool-Use-Schleife ausführst, gib die thinking-Blöcke aus jeder Assistant-Antwort vollständig und unverändert an die API zurück, wenn du Tool-Ergebnisse zurückgibst, einschließlich Blöcken, deren thinking-Feld leer ist. Gib die Assistant-Nachricht so zurück, wie du sie erhalten hast, anstatt ihre Content-Blöcke nach Typ zu filtern oder sie neu aufzubauen: Die API lehnt bearbeitete, umsortierte oder teilweise entfernte Thinking-Blöcke mit einem 400-Fehler ab. Siehe Thinking-Blöcke erhalten.

    Vorher (Claude Opus 4.8):

    client.messages.create(
        model="claude-opus-4-8",
        max_tokens=16000,
        thinking={"type": "adaptive"},
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Nachher (Claude Fable 5):

    client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Die Änderung für Claude Mythos 5 ist identisch, mit claude-mythos-5 als Modellname.

  2. Erweitertes Denken und Denkbudgets (unverändert): Manuelles erweitertes Denken (thinking: {type: "enabled", budget_tokens: N}) wird auf claude-fable-5 und claude-mythos-5 nicht unterstützt und gibt einen 400-Fehler zurück, genau wie auf Claude Opus 4.8. budget_tokens hat keinen direkten Ersatz: Das Denken ist adaptiv, und der effort-Parameter ist eine separate Steuerung auf Ausgabeebene, kein Denkbudget.

  3. Assistant-Prefill (unverändert): Das Vorbefüllen der Assistant-Nachricht wird auf claude-fable-5 und claude-mythos-5 nicht unterstützt und gibt einen 400-Fehler zurück, genau wie auf Claude Opus 4.8. Verwende stattdessen Anweisungen im System-Prompt.

  4. Denkausgabe: Auf claude-fable-5 und claude-mythos-5 wird die rohe Gedankenkette nie zurückgegeben, aber Thinking-Blöcke enthalten weiterhin lesbaren zusammengefassten Text, wenn thinking.display auf summarized gesetzt ist. Gib Thinking-Blöcke unverändert zurück, wenn du eine Konversation auf demselben Modell fortsetzt. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen.

  5. Sicherheitsklassifikatoren und der Stop-Reason refusal (nur Claude Fable 5): claude-fable-5 führt Sicherheitsklassifikatoren bei Anfragen und während der Antwortgenerierung aus. Claude Mythos 5 enthält diese Klassifikatoren nicht. Wenn ein Klassifikator eine Anfrage ablehnt, gibt die Messages API stop_reason: "refusal" als erfolgreiche HTTP-200-Antwort zurück, nicht als Fehler. Das Feld stop_details.category gibt an, welcher Klassifikator ausgelöst wurde, mit Kategorien wie "cyber", "bio" und "reasoning_extraction", oder null, wenn die Ablehnung keiner benannten Kategorie zugeordnet ist. Siehe die Tabelle der Ablehnungskategorien für die vollständige Liste.

    Die Input-Token einer Anfrage, die abgelehnt wird, bevor eine Ausgabe generiert wurde, werden dir nicht in Rechnung gestellt. Wenn ein Klassifikator mitten im Stream auslöst, werden der Input und die bereits gestreamte Ausgabe abgerechnet; verwirf die Teilausgabe.

    Um abgelehnte Anfragen automatisch auf einem anderen Modell erneut auszuführen, übergib den Opt-in-Parameter fallbacks, der sich auf der Claude API in der Beta befindet. Der Parameter ist nicht auf der Message Batches API oder auf Amazon Bedrock, Google Cloud und Microsoft Foundry verfügbar; führe auf diesen drei Plattformen den Retry clientseitig aus oder verwende die Refusal-Fallback-Middleware des SDK. Siehe Ablehnungen und Fallback.

  6. Beginne mit effort high: Der Standardwert des effort-Parameters bleibt high. Auf Claude Opus 4.8 lautet die Empfehlung für Coding und Arbeit mit hoher Autonomie, xhigh explizit zu setzen. Auf claude-fable-5 und claude-mythos-5 verwende high als Standard für die meisten Aufgaben und reserviere xhigh für die fähigkeitssensibelsten Workloads. Niedrigere effort-Einstellungen liefern weiterhin gute Leistung und übertreffen oft die xhigh-Leistung früherer Modelle. Reduziere effort, wenn eine Aufgabe abgeschlossen wird, aber länger dauert als nötig. Siehe Prompting für Claude Fable 5.

  7. Niedrigeres Minimum für Prompt-Caching: Die minimale cachebare Prompt-Länge für „prompt caching“ (Prompt-Caching) auf claude-fable-5 und claude-mythos-5 beträgt 512 Token, niedriger als die 1.024 Token auf Claude Opus 4.8. Prompts, die auf Claude Opus 4.8 zu kurz zum Cachen waren, können jetzt Cache-Einträge erstellen, ohne dass Code-Änderungen erforderlich sind. Siehe Prompt-Caching für modellspezifische Mindestwerte.

Migrations-Checkliste

  • Wenn deine Organisation eine ZDR-Vereinbarung (zero data retention) hat, bestätige die Berechtigung vor der Migration. claude-fable-5 und claude-mythos-5 erfordern eine 30-tägige Datenspeicherung und sind unter ZDR nicht verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Auf der Claude API geben Anfragen an claude-fable-5, die diese Anforderung nicht erfüllen, einen 400 invalid_request_error zurück. Claude Opus 4.8 ist unter ZDR verfügbar. Siehe Modellspezifische Anforderungen an die Datenspeicherung.
  • Aktualisiere den Modellnamen von claude-opus-4-8 auf claude-fable-5 (oder claude-mythos-5).
  • Entferne jegliche thinking: {type: "disabled"}-Konfiguration. Das Deaktivieren des Denkens gibt auf claude-fable-5 und claude-mythos-5 einen Fehler zurück, und Anfragen ohne thinking-Feld laufen mit adaptivem Denken.
  • Aktualisiere das Antwort-Parsing, das Inhalte nach Position liest, wie content[0].text: Da adaptives Denken immer aktiviert ist, kommen thinking-Blöcke vor text-Blöcken an. Wähle Content-Blöcke stattdessen nach type aus und gib thinking-Blöcke in Tool-Use-Schleifen vollständig und unverändert zurück; veränderte Blöcke geben einen 400-Fehler zurück. Siehe Thinking-Blöcke erhalten.
  • Wenn du manuelles erweitertes Denken und Assistant-Prefills bereits bei früheren Migrationen entfernt hast, ist keine Aktion erforderlich: Beides bleibt auf claude-fable-5 und claude-mythos-5 nicht unterstützt.
  • Stelle sicher, dass jeglicher Code, der das thinking-Feld parst, es nur als Anzeigetext behandelt und Thinking-Blöcke unverändert zurückgibt, wenn auf demselben Modell fortgesetzt wird. thinking.display ist auf claude-fable-5 und claude-mythos-5 standardmäßig "omitted", genau wie auf Claude Opus 4.8. Setze display: "summarized", um lesbare Zusammenfassungen zu erhalten. Siehe Denkausgabe bei Claude Fable- und Claude Mythos-Modellen.
  • Wenn du den Konversationsverlauf auf einem früheren Modell erneut abspielst, entferne zuerst thinking- und redacted_thinking-Blöcke aus vorherigen Assistant-Turns. Thinking-Blöcke von claude-fable-5 und claude-mythos-5 sind nur von dem Modell lesbar, das sie erzeugt hat, oder einem neueren: Frühere Modelle ignorieren sie stillschweigend, während Claude Fable 5.1 und Claude Mythos 5.1 sie lesen, behalte sie also bei, wenn du eine Konversation auf diese Modelle hochstufst (siehe Erhaltenes Denken). Das Entfernen hält Anfragen an frühere Modelle minimal und einheitlich. Die Ausnahme ist das Einlösen eines Fallback-Guthabens, das erfordert, dass der Request-Body nach den genauen Regeln dieser Funktion zurückgegeben wird.
  • Wenn du zu Claude Fable 5 migrierst, behandle stop_reason: "refusal" und lies das Feld stop_details.category. Um abgelehnte Anfragen automatisch auf einem anderen Modell erneut auszuführen, ziehe den Opt-in-Parameter fallbacks (Beta) in Betracht. Siehe Ablehnungen und Fallback.
  • Bewerte deine effort-Einstellung neu. Beginne für die meisten Aufgaben mit high, einschließlich Workloads, die auf Claude Opus 4.8 mit xhigh liefen.
  • Ermittle Kosten und Latenz für deine eigenen Workloads neu. Die Token-Anzahlen bleiben bei der Migration von claude-opus-4-8 ungefähr unverändert; die Preise pro Token unterscheiden sich, und Denk-Token werden als Output-Token abgerechnet, sodass Workloads, die ohne Denken liefen, mehr Output-Token pro Anfrage erzeugen.

Was this page helpful?