Neuerungen in Claude Sonnet 5.5
Was sich beim Wechsel von Claude Sonnet 5 zu Claude Sonnet 5.5 ändert: Breaking Changes, Funktionsunterstützung, Verhaltensunterschiede, Preise und Verfügbarkeit.
Claude Sonnet 5.5 bietet die beste Kombination aus Geschwindigkeit und Intelligenz. Fünf „Breaking Changes" (inkompatible Änderungen) betreffen Code, der bereits auf Claude Sonnet 5 läuft:
- Schalte vorgelagertes Nachdenken mit
between_toolsab. - Erzwungene Tool-Nutzung gibt einen Fehler zurück.
- Thinking-Blöcke sind an das Modell und die Konversation gebunden.
- Auf der Claude API und Google Cloud wird das frühere Computer-Use-Tool
computer_20251124nicht akzeptiert. - Das Advisor-Tool lehnt Claude Opus 4.8, Claude Opus 4.7 und Claude Sonnet 5 als Advisor ab.
Eine weitere Änderung verändert die Form der Antwort, ohne dass eine Anfrage fehlschlägt: Text zwischen Tool-Aufrufen kommt in thinking-Blöcken zurück. Eine Anwendung, die diesen Text an ihre Nutzer streamt, verstummt zwischen Tool-Aufrufen, bis sie einen display-Wert setzt, der den Text zurückgibt, oder vorgelagertes Nachdenken mit between_tools abschaltet.
Neues Modell
| Modell | Claude API ID | Beschreibung |
|---|---|---|
| Claude Sonnet 5.5 | Die beste Kombination aus Geschwindigkeit und Intelligenz |
„Adaptive thinking" (adaptives Nachdenken) ist standardmäßig aktiviert, und der Effort-Parameter steuert die Tiefe des Nachdenkens. Sein Standardwert auf der Claude API ist high. Der Tokenizer ist derselbe wie bei Claude Sonnet 5, sodass derselbe Text dieselbe Anzahl an Token ergibt. Informationen zum „context window" (Kontextfenster), zu Ausgabelimits, zum Wissensstichtag und zu Preisen findest du auf der Modellseite von Claude Sonnet 5.5.
Alle aktuellen Modelle findest du in der Modellübersicht.
Breaking Changes
Vorgelagertes Nachdenken mit between_tools abschalten
Um vorgelagertes Nachdenken auf Claude Sonnet 5.5 abzuschalten, sende thinking: {"type": "between_tools"} statt "disabled". Das ist die niedrigste Thinking-Einstellung auf diesem Modell. Sie ist auf jeder Plattform verfügbar, die Claude Sonnet 5.5 anbietet. Sie benötigt keinen Beta-Header. Die kurzen Fortschrittsupdates, die das Modell zwischen Tool-Aufrufen schreibt, kommen weiterhin als thinking-Blöcke mit ihrem Zusammenfassungstext zurück. Gib diese Blöcke unverändert zusammen mit dem Rest des Assistant-Turns zurück. Ein Fortschrittsupdate-Block, den du zurücksendest, gibt dem Modell die vollständige Notiz, die es geschrieben hat, nicht die Zusammenfassung. Wenn deine Anfragen keine Tools verwenden, enthält die Antwort nur Text, wie bei disabled auf Claude Sonnet 5.
Auf Claude Sonnet 5.5 gibt eine Anfrage, die thinking: {"type": "disabled"} sendet, einen 400-Fehler invalid_request_error zurück, dessen Meldung auf between_tools verweist.
between_tools wird bei den Effort-Stufen low, medium und high akzeptiert. Bei xhigh oder max gibt eine Anfrage mit between_tools einen 400-Fehler zurück. Um mit xhigh oder max zu arbeiten, verwende adaptives Nachdenken: Lass das Feld thinking weg oder sende thinking: {"type": "adaptive"}, was gleichwertig ist. Mit between_tools kann sich der Effort nicht mitten in der Konversation ändern: Ein nachrichtenspezifisches output_config.effort, das von der aktuell geltenden Stufe abweicht, gibt einen 400-Fehler zurück. Um den Effort pro Turn zu variieren, verwende adaptives Nachdenken.
between_tools akzeptiert kein weiteres Feld: display, budget_tokens oder block_binding, die damit gesendet werden, geben einen 400-Fehler zurück. Manuelle Thinking-Budgets (thinking: {"type": "enabled", "budget_tokens": N}) geben einen 400-Fehler zurück. Siehe Nachdenken und das Vorher-Nachher-Beispiel im Migrationsleitfaden.
Erzwungene Tool-Nutzung wird nicht unterstützt
Claude Sonnet 5.5 unterstützt keine erzwungene „tool use" (Tool-Nutzung). Ein auf {"type": "any"} oder {"type": "tool", "name": "..."} gesetztes tool_choice gibt einen 400-Fehler invalid_request_error zurück:
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (der Standard) und {"type": "none"} werden unterstützt. Dieselbe Prüfung gilt für den Endpunkt zur Token-Zählung. Für schemakonforme Tool-Eingaben behalte tool_choice: {"type": "auto"} bei und setze strict: true mit strikter Tool-Nutzung, oder verlagere das Schema in strukturierte Ausgaben. Damit das Modell ein Tool aufruft, statt in Text zu antworten, gib im Prompt an, wann das Tool zum Einsatz kommt. Der Migrationsleitfaden zeigt das Vorher-Nachher-Beispiel.
Thinking-Blöcke sind an das Modell und die Konversation gebunden
Jeder „thinking block" (Thinking-Block) hält fest, welches Modell ihn erzeugt hat. Jedes Modell liest seine eigenen Blöcke und nur die Blöcke einiger anderer Modelle. Claude Sonnet 5.5 liest Thinking-Blöcke von Claude Sonnet 5, Claude Opus 4.8, Claude Haiku 4.5 und früheren Modellen, aber nicht von Claude Opus 5, Claude Opus 5.5 oder einem Claude Fable- oder Claude Mythos-Modell. Kein anderes Modell liest Thinking-Blöcke von Claude Sonnet 5.5.
Eine Konversation, die von Claude Sonnet 5 zu Claude Sonnet 5.5 wechselt, behält also ihr Reasoning, und eine, die von Claude Sonnet 5.5 zu einem anderen Modell wechselt, führt die Turns nach dem Wechsel ohne es aus. Wenn eine Anfrage einen Block enthält, den das Zielmodell nicht lesen kann, verwirft die API ihn, bevor das Modell ihn sieht: Die Anfrage ist erfolgreich, und verworfene Blöcke werden nicht berechnet. Mit dem Beta-Header thinking-binding-controls-2026-08-01 wird das Verwerfen in einem input_transformations-Array auf oberster Ebene gemeldet. Siehe Modellwechsel mitten in der Konversation.
Die API prüft außerdem, ob sich etwas vor einem Thinking-Block von Claude Sonnet 5.5 geändert hat, seit der Block erzeugt wurde: der system-Prompt, die tools oder eine frühere Nachricht. Standardmäßig erzwingt sie diese Prüfung für Konten, die am oder nach dem 31. August 2026, 00:00 UTC, erstellt wurden, und zwar auf der Claude API, Amazon Bedrock und Google Cloud. Bei diesen Konten gibt eine Anfrage, die nach einer solchen Änderung einen Block erneut sendet, einen 400-Fehler zurück. Um die betroffenen Blöcke stattdessen zu verwerfen, sende den Beta-Header thinking-binding-controls-2026-08-01 und setze thinking.block_binding.prefix_mismatch_behavior auf "drop_block". Bei älteren Konten aktiviert das Setzen dieses Felds auf einen der beiden Werte die Prüfung für die Anfrage. block_binding funktioniert nur mit thinking: {"type": "adaptive"}. Halte mit between_tools den Verlauf append-only, oder entferne die Thinking-Blöcke ab dem bearbeiteten Turn.
Halte die Konversation append-only, damit die Prüfung nie fehlschlägt: Ändere Anweisungen oder Tools mit Systemnachrichten mitten in der Konversation statt mit Bearbeitungen. Siehe Bewahrtes Nachdenken und den Hinweis zu dieser Änderung im Migrationsleitfaden.
Das Computer-Use-Tool computer_20251124 wird auf der Claude API und Google Cloud nicht unterstützt
Auf der Claude API und Google Cloud unterstützt Claude Sonnet 5.5 Computer Use nur über das Toolset computer_toolset_20260801. Eine Anfrage, die das frühere Tool computer_20251124 deklariert, gibt einen 400-Fehler invalid_request_error zurück. Auf der Claude API nennt die Meldung den abgelehnten Typ und listet dann die Tool-Typen auf, die das Modell akzeptiert. Sie beginnt so:
'claude-sonnet-5-5' does not support tool types: computer_20251124.Auf Amazon Bedrock akzeptiert Claude Sonnet 5.5 das frühere Tool computer_20251124.
Um eine bestehende Integration auf der Claude API oder Google Cloud umzustellen, folge Migration von computer_20251124, wo die Anfrage vorher und nachher gezeigt wird. Entferne den Beta-Header, ersetze den tools-Eintrag durch {"type": "computer_toolset_20260801"} und passe deine Agent-Schleife für Member-tool_use-Blöcke, Batch-Aktionen und toolset_name in Ergebnissen an. Das Toolset ist auf der Claude API und Google Cloud verfügbar. Für andere Plattformen siehe den Abschnitt Kompatibilität des Computer-Use-Tools. Integrationen, die das Toolset bereits verwenden, sowie das Browser-Use-Tool benötigen keine Änderung.
Einige Advisor-Tool-Kombinationen werden nicht unterstützt
Mit dem Advisor-Tool (Beta) benötigt ein Claude Sonnet 5.5-Executor Claude Mythos 5.1, Claude Fable 5.1, Claude Mythos 5, Claude Fable 5, Claude Opus 5.5 oder Claude Opus 5 als Advisor, oder Claude Sonnet 5.5 selbst. Advisor mit Claude Opus 4.8, Claude Opus 4.7 und Claude Sonnet 5 funktionieren mit einem Claude Sonnet 5-Executor, geben aber mit einem Claude Sonnet 5.5-Executor einen 400-Fehler invalid_request_error zurück. Jeder Advisor, den Claude Sonnet 5.5 akzeptiert, gibt seinen Rat verschlüsselt als advisor_redacted_result-Block zurück, sodass dein Client den Text des Rats nicht lesen kann. Siehe Modellkompatibilität und Ergebnisvarianten des Advisor-Tools.
Funktionsunterstützung
Claude Sonnet 5.5 unterstützt nachrichtenspezifischen Effort (Beta), Systemnachrichten mitten in der Konversation, Tool-Änderungen mitten in der Konversation (Beta), „prompt caching" (Prompt-Caching) mit einer Mindestlänge von 512 Token für cachebare Prompts, Batch-Verarbeitung, die Files API, PDF-Unterstützung, Vision sowie serverseitige und clientseitige Tools. Nachrichtenspezifischer Effort, Systemnachrichten mitten in der Konversation und Tool-Änderungen mitten in der Konversation sind auf Claude Sonnet 5 nicht verfügbar, dessen Mindestlänge für cachebare Prompts 1.024 Token beträgt. Auf der Claude API und Google Cloud erfordert Computer Use das Toolset computer_toolset_20260801 (siehe den Breaking Change). Informationen zur Modellverfügbarkeit findest du auf der Seite der jeweiligen Funktion.
Komprimierung bei Bedarf (Beta)
Mit dem Beta-Header compact-2026-09-04 gibt eine Anfrage, die den Parameter compaction auf oberster Ebene sendet, einen signierten compaction-Block zurück, der die gesamte Konversation zusammenfasst. Diesen Block sendest du dann als Erstes, anstelle der zusammengefassten Nachrichten. Du entscheidest, wann komprimiert wird, und die Thinking-Blöcke in den Turns, die du behältst, können nach dem Austausch gültig bleiben, unter den in Komprimierung und bewahrtes Nachdenken beschriebenen Bedingungen. Das ist bei Claude Sonnet 5.5 wichtig, weil seine Thinking-Blöcke an die Konversation gebunden sind. Siehe Komprimierung bei Bedarf für die Plattformverfügbarkeit und den vollständigen Anfrageablauf.
Tools in einer Nachricht definieren (Beta)
Mit dem Beta-Header inline-tools-2026-09-15 kann ein tool_addition-Block in einer Systemnachricht mitten in der Konversation eine vollständige Tool-Definition statt einer Referenz enthalten. Du kannst mitten in der Konversation ein Tool hinzufügen, sein Schema ändern oder ein Server-Tool auf eine neuere Version umstellen, ohne tools zu bearbeiten und ohne den Prompt-Cache zu verlieren. Siehe Tools in einer Nachricht definieren.
Thinking-Blöcke bleiben bei dem Konto, das sie erzeugt hat
Thinking-Blöcke, die Claude Sonnet 5.5 erzeugt, funktionieren nur in dem Konto, das sie erzeugt hat, oder in einem damit verknüpften Konto. Wenn ein anderes Konto einen dieser Blöcke sendet, verwirft die API den Block, bevor das Modell ihn sieht, und die Anfrage ist erfolgreich. Auf der Claude API und Google Cloud listet die Antwort mit dem Beta-Header thinking-binding-controls-2026-08-01 jeden verworfenen Block in input_transformations mit reason: "organization_binding_mismatch" auf. Blöcke früherer Modelle sind nicht betroffen. Siehe Bewahrtes Nachdenken.
Verhaltensunterschiede
Claude Sonnet 5.5 unterscheidet sich von Claude Sonnet 5 in mehreren Punkten, die sich ohne jede Codeänderung bemerkbar machen. Prompting für Claude Sonnet 5.5 enthält Hinweise zu jedem davon:
- Effort-Stufen sind neu kalibriert. Eine Effort-Stufe erzeugt nicht mehr dieselbe Menge an Nachdenken wie auf Claude Sonnet 5. Führe deinen Effort-Vergleich erneut durch, statt eine Einstellung zu übernehmen. Beginne mit
high, es sei denn, deine Workload ist agentisch oder latenzkritisch. Für agentisches Programmieren und mehrstufige Tool-Nutzung beginne bei klar spezifizierten Aufgaben mitmediumund wechsle bei schwierigeren oder längeren Aufgaben zuhigh. Für Chat und andere latenzkritische Anwendungen beginne mitmediumoderlow. - Text zwischen Tool-Aufrufen kommt in Thinking-Blöcken zurück. Zwischen Tool-Aufrufen kommen Notizen, die länger als ein oder zwei Sätze sind, als Fortschrittsupdate-
thinking-Blöcke zurück. Kürzere Bemerkungen bleibentext. Beim Standardwertdisplay: "omitted"ist der Text der Fortschrittsupdate-Blöcke leer, sodass eine Anwendung, die diese Notizen an ihre Nutzer streamt, zwischen Tool-Aufrufen verstummt, ohne dass ein Fehler auftritt. Wenn du vorgelagertes Nachdenken mitbetween_toolsabschaltest, kommt der Text zurück. Der Migrationsleitfaden zeigt, wie du ihn empfängst. - Schutzkategorien. Die Schutzmechanismen des Modells können eine Anfrage in fünf
stop_details-Kategorien ablehnen."cyber"bedeutet, dass die Anfrage Cyberschäden ermöglichen könnte."bio"bedeutet, dass sie biologische Schäden ermöglichen könnte."frontier_llm"bedeutet, dass sie die Entwicklung konkurrierender KI-Modelle unterstützen könnte."reasoning_extraction"bedeutet, dass sie das Modell auffordert, sein internes Reasoning im Antworttext wiederzugeben."general_harms"bedeutet, dass sie unter einen anderen Bereich der Nutzungsrichtlinien fällt. Siehe Ablehnungen, Fallback und Abrechnung.
Ablehnungen, Fallback und Abrechnung
Alles in Ablehnungen und Fallback gilt auch für Claude Sonnet 5.5. Eine abgelehnte Anfrage gibt HTTP 200 mit stop_reason: "refusal" und einem stop_details-Objekt zurück, das den Richtlinienbereich benennt. Behandle Ablehnungen und konfiguriere einen Fallback. Serverseitiger Fallback (fallbacks: "default", in der Beta, auf der Claude API) wiederholt Ablehnungen der Kategorien "cyber" und "frontier_llm" auf Claude Sonnet 5. Ablehnungen der Kategorien "bio", "reasoning_extraction" oder "general_harms" werden nicht wiederholt. Du kannst auch die SDK-Middleware oder eine eigene Wiederholungslogik verwenden. Ob eine Ablehnung, die vor jeglicher Ausgabe eintrifft, berechnet wird, hängt von ihrer Ablehnungskategorie ab, und sie zählt in jedem Fall gegen deine „rate limits" (Ratenlimits). Siehe Wie Ablehnungen abgerechnet werden.
Preise
Claude Sonnet 5.5 hat dieselben Preise wie Claude Sonnet 5, einschließlich der Tarife für Prompt-Caching und Batch-Verarbeitung. Die vollständige Liste, Informationen zur Datenresidenz und Tool-Preise findest du unter Preise.
Verfügbarkeit
Claude Sonnet 5.5 ist verfügbar auf:
- Claude API: für alle Kunden, als
claude-sonnet-5-5. - AWS: Claude in Amazon Bedrock, als
anthropic.claude-sonnet-5-5, und Claude Platform on AWS, alsclaude-sonnet-5-5. - Google Cloud: Claude on Google Cloud, als
claude-sonnet-5-5. - Microsoft Foundry: Claude in Microsoft Foundry, als
claude-sonnet-5-5.
Migration von Claude Sonnet 5
Aktualisiere deine Modell-ID:
model = "claude-sonnet-5" # Before
model = "claude-sonnet-5-5" # AfterPrüfe dann sechs Dinge:
- Wenn dein Code das Nachdenken mit
disabledabschaltet, sende stattdessenbetween_tools, bei Efforthighoder niedriger. - Ersetze die
tool_choice-Typenanyundtooldurchautoplus strikte Tool-Nutzung. - Halte Konversationen append-only. Eine Anfrage, die einen Thinking-Block von Claude Sonnet 5.5 nach einer Bearbeitung des früheren Verlaufs erneut sendet, kann einen 400-Fehler zurückgeben. Siehe Thinking-Blöcke sind an das Modell und die Konversation gebunden.
- Wenn du Computer Use über
computer_20251124auf der Claude API oder Google Cloud verwendest, stelle auf das Toolset um. - Wenn du das Advisor-Tool mit einem Advisor auf Basis von Claude Opus 4.8, Claude Opus 4.7 oder Claude Sonnet 5 verwendest, wechsle zu einem Advisor, den Claude Sonnet 5.5 akzeptiert.
- Wenn deine Oberfläche den Text zwischen Tool-Aufrufen anzeigt, setze
thinking.display, wenn du adaptives Nachdenken verwendest. Mitbetween_toolskommt der Text auch ohne diese Einstellung zurück. Siehe Text zwischen Tool-Aufrufen wird in Thinking-Blöcken zurückgegeben.
Der Migrationsleitfaden enthält Schritt-für-Schritt-Anleitungen für den Umstieg von Claude Sonnet 5 und früheren Modellen sowie die vollständige Checkliste.
Nächste Schritte
Vollständige Spezifikationen und Preise für alle aktuellen Claude-Modelle.
Übertrage Code von Claude Sonnet 5 und früheren Modellen auf Claude Sonnet 5.5.
Verhaltensunterschiede und Prompting-Muster speziell für Claude Sonnet 5.5.
Steuere, wie viele Token Claude beim Antworten verwendet, von low bis max.
Wie adaptives Nachdenken funktioniert und wie Thinking-Blöcke bewahrt werden.
Behandle stop_reason: "refusal" und wiederhole die Anfrage auf einem anderen Modell.
Was this page helpful?