Überblick über neue Funktionen, Breaking Changes und Leistungsverbesserungen in Claude Fable 5.1 und Claude Mythos 5.1.
Claude Fable 5.1 erweitert Claude Fable 5 zum gleichen Preis pro Token, mit stärkerem lang laufendem agentischem Coding, mehrstufiger Recherche sowie Arbeit mit Dokumenten, Tabellenkalkulationen und Folien. Für die meisten Workloads beginne mit Claude Opus 5 (siehe Ein Modell auswählen). Verwende Claude Fable 5.1 für anspruchsvolles Reasoning und agentische Arbeit mit langem Horizont, oder wenn deine Evals auf Claude Opus 5 bei höherem Effort immer noch nicht ausreichen. Claude Mythos 5.1 bietet dieselben Fähigkeiten ausschließlich Teilnehmern von Project Glasswing.
Wenn du bereits Claude Fable 5 aufrufst, sind drei Änderungen Breaking Changes: erzwungene Tool-Nutzung gibt einen Fehler zurück, frühere Modelle können seine Thinking-Blöcke nicht lesen und das Bearbeiten früherer Turns macht Thinking-Blöcke ungültig. Fünf sind additiv: Effort pro Nachricht (Beta), Turn-bezogene System-Nachrichten (Beta), lesbare Fortschrittsupdates zwischen Tool-Aufrufen (display: "updates", Beta), ein niedrigerer Cache-Read-Preis und Herkunftsnachweis für Inhalte.
| Modell | Claude API ID | Beschreibung | Verfügbarkeit |
|---|---|---|---|
| Claude Fable 5.1 | Nachfolger von Claude Fable 5, für lang laufendes agentisches Coding, Wissensarbeit und Recherche | Alle Kunden, auf der Claude API und Partnerplattformen | |
| Claude Mythos 5.1 | Dieselben Fähigkeiten wie Claude Fable 5.1. Nachfolger von Claude Mythos 5. | Nur Teilnehmer von Project Glasswing |
Claude Fable 5.1 und Claude Mythos 5.1 teilen Spezifikationen und Preise:
Alle aktuellen Modelle findest du in der Modellübersicht.
Claude Fable 5.1 und Claude Mythos 5.1 unterstützen keine „forced tool use" (erzwungene Tool-Nutzung). tool_choice mit dem Wert {"type": "any"} oder {"type": "tool", "name": "..."} gibt einen 400 invalid_request_error zurück:
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (der Standard) und {"type": "none"} bleiben unverändert. Dieselbe Validierung gilt für den Endpunkt zur Token-Zählung.
Thinking ist bei diesen Modellen immer aktiviert, und ein erzwungener Tool-Aufruf würde es überspringen. Das Modell würde seine Überlegungen stattdessen in die Tool-Argumente schreiben, was die Qualität der Argumente senkt. Für schemakonformes JSON behalte tool_choice: {"type": "auto"} bei und setze strict: true mit strikter Tool-Nutzung, oder verschiebe das Schema in strukturierte Ausgaben. Damit das Modell ein Tool aufruft, statt in Text zu antworten, gib im Prompt an, wann das Tool anzuwenden ist (zum Beispiel „Verwende das Tool get_weather, um zu antworten"). Claude Fable 5.1 befolgt explizite Tool-Anweisungen zuverlässig.
Jeder Thinking-Block zeichnet auf, welches Modell ihn erzeugt hat, und er wird nur in eine Richtung bewahrt: Claude Fable 5.1 liest die Thinking-Blöcke früherer Modelle, und kein früheres Modell liest die von Claude Fable 5.1. Eine Konversation, die zu Claude Fable 5.1 wechselt (von Claude Opus 5, Claude Fable 5 oder einem beliebigen früheren Claude-Modell), behält ihr Reasoning. Eine Konversation, die von Claude Fable 5.1 zu einem dieser Modelle wechselt, verliert es für die Turns, die dort laufen.
Wenn eine Anfrage einen Block enthält, den das Zielmodell nicht lesen kann (zum Beispiel ein Router oder Fallback, der mitten in der Konversation das Modell wechselt), entfernt die API den Block, bevor das Modell ihn sieht. Entfernte Blöcke zählen nicht zu input_tokens und werden nicht abgerechnet. Mit dem Beta-Header thinking-binding-controls-2026-08-01 wird das Entfernen in einem input_transformations-Array auf oberster Ebene gemeldet. Ohne ihn erfolgt das Entfernen stillschweigend. Siehe Bewahrtes Denken.
Das Ändern von irgendetwas vor einem Claude Fable 5.1 Thinking-Block (dem system-Prompt, den tools oder einer früheren Nachricht) führt bei der nächsten Anfrage zu einem Fehler, oder dazu, dass der Block verworfen wird, wenn du dich dafür entscheidest. Claude Code, claude.ai, Claude Managed Agents und das Claude Agent SDK halten dieses Präfix für dich intakt. Wenn dein Code das messages-Array selbst aufbaut, überprüfe es, bevor du migrierst: Bewahrtes Denken führt durch die Prüfung und jede Korrektur. Die Prüfung wird für neue Konten durchgesetzt, die am oder nach dem 31. August 2026 erstellt wurden. Für früher erstellte Konten zeichnet die API die Abweichung auf, handelt aber nur dann danach, wenn die Anfrage thinking.block_binding.prefix_mismatch_behavior setzt.
Diese Muster machen jeden späteren Thinking-Block ungültig:
system-Prompts oder des tools-Arrays auf oberster Ebene zwischen Anfragen in derselben Konversation.Diese halten spätere Blöcke gültig: Entfernen einer führenden Folge von Thinking-Blöcken (älteste zuerst), Kürzen des Verlaufs durch serverseitige Compaction oder Context Editing, Verschieben von cache_control-Markern und Ändern von effort zwischen Anfragen. Das Entfernen eines Thinking-Blocks an einer anderen Stelle als am Anfang der Folge macht jeden Thinking-Block danach ungültig.
Wo die Prüfung durchgesetzt wird, wird eine Anfrage, die einen ungültig gemachten Block erneut sendet, mit einem 400 abgelehnt, dessen Meldung The block is bound to a different conversation lautet. Um den Block stattdessen zu entfernen und fortzufahren, sende den Beta-Header thinking-binding-controls-2026-08-01 mit thinking.block_binding.prefix_mismatch_behavior: "drop_block". Das Entfernen wird in input_transformations mit reason: "prefix_binding_mismatch" gemeldet.
Um Thinking über eine lange Sitzung hinweg gültig zu halten, behandle die Konversation als append-only. Füge Anweisungen mit einer System-Nachricht mitten in der Konversation hinzu (Turn-bezogen, wenn sie nur für einen Turn gelten soll) und ändere Tools mit Tool-Änderungen mitten in der Konversation, statt system oder tools zu bearbeiten. Kürze den Kontext mit serverseitigem Context Editing oder Compaction, die nicht als Bearbeitungen zählen. Diese Muster halten auch den Prompt-Cache warm. Um herauszufinden, ob deine Integration den Verlauf bearbeitet, führe eine Sitzung mit prefix_mismatch_behavior: "drop_block" aus und protokolliere input_transformations: Der Migrationsleitfaden enthält die dreistufige Prüfung. Siehe Bewahrtes Denken für die vollständigen Regeln.
Bei Claude Fable 5.1 kannst du das Effort-Level mitten in der Konversation ändern, ohne den Prompt-Cache ungültig zu machen. Erhöhe es für einen schwierigen Schritt und senke es für routinemäßige. Effort pro Nachricht ist in der Beta: füge den Beta-Header mid-conversation-output-config-2026-07-01 hinzu. Claude Fable 5.1, Claude Mythos 5.1 und Claude Opus 5 unterstützen es auf der Claude API.
client = anthropic.Anthropic()
response = client.beta.messages.create(
model="claude-fable-5-1",
max_tokens=4096,
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
},
{
"role": "assistant",
"content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
},
# Reine Effort-Systemnachricht: Die neue Stufe gilt ab dem nächsten Nutzer-Turn.
{"role": "system", "content": [], "output_config": {"effort": "low"}},
{"role": "user", "content": "Summarize the plan in one sentence."},
],
betas=["mid-conversation-output-config-2026-07-01"],
)
for block in response.content:
if block.type == "text":
print(block.text)Weitere Informationen findest du unter Effort pro Nachricht.
Eine System-Nachricht mitten in der Konversation kann auf einen Turn beschränkt werden. Setze clear_at: "next_user_message" auf einer Nachricht mit role: "system", und ihr Text trägt für den aktuellen Turn die Autorität eines System-Prompts und wird dann nicht mehr gerendert, sobald eine spätere user-Nachricht existiert. Die Nachricht bleibt in messages und du sendest sie weiterhin wortwörtlich zurück, sodass sich nichts Früheres in der Konversation ändert. Der Prompt-Cache trifft weiterhin, spätere Thinking-Blöcke bleiben gültig, und eine gelöschte Nachricht kostet keine Input-Token. Verwende sie für Erinnerungen pro Turn in einer Tool-Schleife („prüfe deinen Posteingang, bevor du weiteren Code ausführst", „der Nutzer kann diese Tool-Ausgabe nicht sehen"), statt Text in den Verlauf einzufügen und ihn bei der nächsten Anfrage zu löschen. Turn-bezogene System-Nachrichten sind in der Beta: Füge den Beta-Header mid-conversation-system-clear-at-2026-08-21 hinzu. Siehe Turn-bezogene System-Nachrichten.
{
"role": "system",
"clear_at": "next_user_message",
"content": "Results have landed in your inbox. Check it before running more code."
}Wie Claude Fable 5 schreibt Claude Fable 5.1 zwischen Tool-Aufrufen kurze Fortschrittsupdates darüber, was es gefunden hat und was es als Nächstes tun wird, allerdings weniger davon (siehe Geändert gegenüber Claude Fable 5). Jedes Update kommt als eigener thinking-Block unmittelbar vor dem Tool-Aufruf an. Unter dem Standardwert "omitted" für thinking.display kommen diese Blöcke leer zurück, wie Reasoning, sodass ein langer agentischer Turn für deine Nutzer stumm wirken kann. Neu ist die Option display: "updates": Setze sie mit dem Beta-Header thinking-display-updates-2026-08-18, um die Fortschrittsupdates als Text zu erhalten, während das Reasoning verborgen bleibt. Jeder thinking-Block mit nicht leerem Text ist dann eine Statuszeile, die du dem Nutzer anzeigen kannst. "summarized" gibt sie ebenfalls zurück, gemischt mit zusammengefasstem Reasoning. Siehe Fortschrittsupdates zwischen Tool-Aufrufen.
Von Claude Fable 5.1 und Claude Mythos 5.1 generierter Text trägt Anthropics statistisches Text-Wasserzeichen auf jeder Plattform, auf der das Modell verfügbar ist. Unterstützte Bild- und Videodateien, die Claude erzeugt (zum Beispiel über das Code-Execution-Tool), tragen signierte C2PA Content Credentials, wenn du sie über die Files API auf der Claude API abrufst.
Das Wasserzeichen verändert weder Bedeutung noch Qualität noch Lesbarkeit der Ausgabe. Es fügt keine Token oder versteckten Zeichen hinzu, enthält keine Informationen über dich oder deine Organisation und erfordert keine Änderungen an deinen Anfragen oder Antworten. Hintergrundinformationen findest du unter Wie Claude KI-generierte Inhalte kennzeichnet und Wie Claudes Text-Wasserzeichen funktioniert.
Claude Fable 5.1 unterscheidet sich von Claude Fable 5 in drei Punkten, die sich ohne jede Codeänderung zeigen. Für jeden gibt es eine Prompting-Korrektur in Prompting für Claude Fable 5.1:
thinking.display auf "updates" (Beta), um die Fortschrittsupdates zu erhalten, die es schreibt. Siehe Um nutzerseitige Fortschrittsupdates bitten.low Effort häufiger aus dem Gedächtnis. Auf der niedrigsten Effort-Stufe ruft das Modell ein Such- oder Retrieval-Tool seltener auf. Erhöhe den Effort für Turns, die aktuelle Informationen benötigen, auch mitten in der Konversation.Diese Verhaltensweisen der Messages API werden unverändert von Claude Fable 5 übernommen:
thinking: {"type": "enabled"} mit budget_tokens und thinking: {"type": "disabled"} geben beide einen 400-Fehler zurück. Lass thinking weg oder sende {"type": "adaptive"}.thinking.display ist standardmäßig "omitted". "summarized" ist verfügbar, und die rohe Gedankenkette wird nie zurückgegeben.temperature, top_p oder top_k geben einen 400-Fehler zurück.Claude Fable 5.1 verbessert sich gegenüber Claude Fable 5, und der Abstand ist bei höheren Effort-Stufen am größten. Die Zugewinne konzentrieren sich auf sechs Bereiche:
Die mehrsprachige Leistung ist auf dem Niveau von Claude Fable 5.
Claude Fable 5.1 enthält Sicherheitsklassifikatoren, die dieselben stop_details-Kategorien wie Claude Fable 5 abdecken, und alles in Ablehnungen und Fallback gilt.
stop_reason: "refusal" und einem stop_details-Objekt zurück, das den ausgelösten Richtlinienbereich benennt.fallbacks: "default" (Beta) wiederholt eine abgelehnte Anfrage auf dem Modell, das Anthropic für diese Kategorie empfiehlt. Die zulässigen Fallback-Ziele für Claude Fable 5.1 sind Claude Opus 4.8 und Claude Opus 5.Claude Fable 5.1 und Claude Mythos 5.1 sind gleich bepreist wie Claude Fable 5, mit Ausnahme von Cache-Reads (Preise in USD):
| Basis-Input | 5m Cache-Writes | 1h Cache-Writes | Cache-Reads | Output |
|---|---|---|---|---|
| 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 0,25 $ / MTok | 50 $ / MTok |
Cache-Reads (Treffer und Aktualisierungen) kosten bei diesen Modellen das 0,025-Fache des Basis-Input-Preises, verglichen mit dem 0,1-Fachen bei anderen Claude-Modellen. Lange agentische Sitzungen, die ein gecachtes Präfix erneut lesen, zahlen ein Viertel des Claude-Fable-5-Tarifs. Cache-Writes und die minimale cachebare Prompt-Länge von 512 Token bleiben unverändert.
Batch-Verarbeitung kostet 5 $ pro Million Input-Token und 25 $ pro Million Output-Token. Siehe Preise für Datenresidenz und Tool-Preise.
Claude Fable 5.1 ist verfügbar auf:
claude-fable-5-1.anthropic.claude-fable-5-1, und Claude Platform on AWS, als claude-fable-5-1.claude-fable-5-1.Claude Mythos 5.1 wird nur zugelassenen Kunden in Project Glasswing angeboten. Für den Zugang wende dich an dein Account-Team bei Anthropic, AWS oder Google Cloud.
Claude Fable 5.1 und Claude Mythos 5.1 unterliegen einer 30-tägigen Datenaufbewahrung und sind nicht unter Zero Data Retention verfügbar, sofern nicht ausdrücklich von Anthropic genehmigt. Beide sind Covered Models, wie Claude Fable 5 und Claude Mythos 5. Siehe Modellspezifische Anforderungen an die Datenaufbewahrung.
Um von Claude Fable 5 zu migrieren, aktualisiere deine Modell-ID:
model = "claude-fable-5" # Before
model = "claude-fable-5-1" # AfterPrüfe dann diese Punkte:
tool_choice vom Typ any oder tool. Verschiebe die Schema-Durchsetzung zu strikter Tool-Nutzung mit tool_choice: {"type": "auto"} oder zu strukturierten Ausgaben.messages-Array selbst aufbaut, führe die Prüfung auf Verlaufsbearbeitung durch: Verschiebe Erinnerungen pro Turn, die du derzeit einfügst und löschst, in Turn-bezogene System-Nachrichten, verschiebe Änderungen an system und tools in System-Nachrichten mitten in der Konversation, kürze den Kontext serverseitig oder entferne Thinking-Blöcke aus Turns, die du über eine clientseitige Zusammenfassung hinweg mitnimmst, wähle dann ein prefix_mismatch_behavior für die Produktion und überwache input_transformations.high) neu ab und erwäge, ihn mitten in der Konversation zu ändern, statt eine Stufe für die gesamte Sitzung beizubehalten.Siehe den Migrationsleitfaden für Schritt-für-Schritt-Anleitungen, auch von Claude Opus 5 und früheren Modellen.
Spezifikationen und Preise für jedes aktuelle Claude-Modell.
Migration von Claude Fable 5, Claude Opus 5 und früheren Modellen.
Prompting-Muster speziell für Claude Fable 5.1.
Was this page helpful?