Claude Platform Docs
Modelle & PreiseClaude Opus 5.5

Neuerungen in Claude Opus 5.5

Überblick über Breaking Changes, Funktionsunterstützung und Verhaltensunterschiede in Claude Opus 5.5.

Claude Opus 5.5 ist für lang laufendes agentisches Coding und Wissensarbeit konzipiert und kostet 4 $ / 20 $ USD pro Million Input-/Output-Token. Vier „Breaking Changes“ (inkompatible Änderungen) betreffen Code, der bereits auf Claude Opus 5 läuft: Denken kann nicht deaktiviert werden, erzwungene Tool-Nutzung gibt einen Fehler zurück, Thinking-Blöcke sind an das Modell und die Konversation gebunden, und auf der Claude API und Google Cloud wird das frühere Computer-Use-Tool computer_20251124 nicht akzeptiert. Die ersten drei gelten auch für Claude Fable 5.1. Eine weitere Änderung verändert die Form der Antwort, ohne dass eine Anfrage fehlschlägt: Text zwischen Tool-Aufrufen wird in thinking-Blöcken zurückgegeben, deren Text bei der Standardeinstellung von display leer ist. Eine Anwendung, die diesen Text als Fortschrittsmeldungen an ihre Nutzer streamt, bleibt zwischen Tool-Aufrufen stumm, bis sie einen display-Wert setzt, der den Text zurückgibt.

Neues Modell

ModellClaude API IDBeschreibung
Claude Opus 5.5Für lang laufendes agentisches Coding und Wissensarbeit

„Adaptive thinking“ (adaptives Denken) ist immer aktiv, und der Effort-Parameter steuert die Denktiefe; sein Standardwert bei diesem Modell ist medium. Informationen zum „context window“ (Kontextfenster), zu Ausgabelimits, zum Wissensstichtag und zu Preisen findest du auf der Modellseite von Claude Opus 5.5; alle aktuellen Modelle findest du in der Modellübersicht.

Breaking Changes

Denken kann nicht deaktiviert werden

Bei Claude Opus 5 ist „Thinking“ (Denken) standardmäßig aktiviert, und thinking: {"type": "disabled"} wird bei Effort high oder niedriger akzeptiert. Bei Claude Opus 5.5 ist Denken immer aktiv: Eine Anfrage, die thinking: {"type": "disabled"} oder ein manuelles Budget mit thinking: {"type": "enabled", "budget_tokens": N} setzt, gibt einen 400-Fehler invalid_request_error zurück. Lass das Feld thinking weg oder sende thinking: {"type": "adaptive"}, was gleichwertig ist. Es ist kein Beta-Header erforderlich.

Die Fehlermeldungen lauten:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
"thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

Der Effort-Parameter ist die Steuerung für Denktiefe, Latenz und Kosten: Senke ihn dort, wo du das Denken bisher deaktiviert hast; Optimierung von Kosten und Intelligenz enthält gemessene Ergebnisse zur Wahl einer Stufe. Da jede Antwort mit einem oder mehreren thinking-Blöcken beginnen kann (die bei der Standardeinstellung display: "omitted" mit einem leeren thinking-Feld zurückgegeben werden), wähle Inhaltsblöcke anhand ihres type-Felds statt anhand ihrer Position aus und gib thinking-Blöcke in Tool-Nutzungs-Schleifen unverändert zurück. Code, der bereits auf Claude Opus 5 mit aktiviertem Denken läuft, muss nicht geändert werden. Siehe Denken und das Vorher-Nachher-Beispiel im Migrationsleitfaden.

Erzwungene Tool-Nutzung wird nicht unterstützt

Claude Opus 5.5 unterstützt keine erzwungene „tool use“ (Tool-Nutzung). Ein auf {"type": "any"} oder {"type": "tool", "name": "..."} gesetztes tool_choice gibt einen 400-Fehler invalid_request_error zurück:

tool_choice: type "tool" and "any" are not supported for this model.

tool_choice: {"type": "auto"} (der Standard) und {"type": "none"} werden unterstützt, und dieselbe Validierung gilt für den Endpunkt zur Token-Zählung. Für schemakonformes JSON behalte tool_choice: {"type": "auto"} bei und setze strict: true mit strikter Tool-Nutzung, oder verlagere das Schema in strukturierte Ausgaben. Damit das Modell ein Tool aufruft, statt in Textform zu antworten, gib im Prompt an, wann das Tool anzuwenden ist. Der Migrationsleitfaden zeigt das Vorher-Nachher-Beispiel.

Thinking-Blöcke sind an das Modell und die Konversation gebunden

Jeder Thinking-Block hält fest, welches Modell ihn erzeugt hat, und jedes Modell liest seine eigenen Blöcke und nur die einiger anderer Modelle. Claude Opus 5.5 liest Thinking-Blöcke von Claude Opus 5 und früheren Opus-, Sonnet- und Haiku-Modellen, aber nicht von Claude Fable- oder Claude Mythos-Modellen. Auf der Claude API lesen Claude Fable 5.1 und Claude Mythos 5.1 Thinking-Blöcke von Claude Opus 5.5; kein anderes Modell tut dies. Eine Konversation, die von Claude Opus 5 zu Claude Opus 5.5 wechselt oder auf der Claude API von Claude Opus 5.5 zu Claude Fable 5.1 oder Claude Mythos 5.1 aufsteigt, behält ihr Reasoning. Eine Konversation, die von Claude Opus 5.5 zu einem anderen Modell als diesen beiden wechselt oder von einem Claude Fable- oder Claude Mythos-Modell zu Claude Opus 5.5 wechselt, führt die Turns nach dem Wechsel ohne das Reasoning des vorherigen Modells aus. Wenn eine Anfrage einen Block enthält, den das Zielmodell nicht lesen kann, verwirft die API ihn, bevor das Modell ihn sieht: Die Anfrage ist erfolgreich, und verworfene Blöcke werden nicht berechnet. Mit dem Beta-Header thinking-binding-controls-2026-08-01 wird das Verwerfen in einem input_transformations-Array auf oberster Ebene gemeldet. Siehe Modellwechsel mitten im Gespräch.

Die API prüft außerdem, ob sich etwas vor einem Thinking-Block von Claude Opus 5.5 (der system-Prompt, die tools oder eine frühere Nachricht) geändert hat, seit der Block erzeugt wurde. Wie bei Claude Fable 5.1 erzwingt sie diese Prüfung standardmäßig für Konten, die am oder nach dem 31. August 2026, 00:00 UTC, erstellt wurden, auf der Claude API und auf Cloud-Plattformen. Bei diesen Konten gibt eine Anfrage, die einen Block nach einer solchen Änderung erneut sendet, einen 400-Fehler zurück. Um die betroffenen Blöcke stattdessen zu verwerfen, sende den Beta-Header thinking-binding-controls-2026-08-01 und setze thinking.block_binding.prefix_mismatch_behavior auf "drop_block". Bei älteren Konten aktiviert das Setzen dieses Felds auf einen der beiden Werte die Prüfung für die Anfrage. Halte die Konversation append-only, damit sich die Frage gar nicht erst stellt: Ändere Anweisungen oder Tools mit Systemnachrichten mitten im Gespräch statt mit Bearbeitungen. Siehe Erhaltenes Denken und den Hinweis zu dieser Änderung im Migrationsleitfaden.

Das Computer-Use-Tool computer_20251124 wird auf der Claude API und Google Cloud nicht unterstützt

Claude Opus 5 akzeptiert Computer Use sowohl als Toolset computer_toolset_20260801 als auch, mit dem Beta-Header computer-use-2025-11-24, als früheres Tool computer_20251124. Auf der Claude API und Google Cloud unterstützt Claude Opus 5.5 nur das Toolset: Eine Anfrage, die ein computer_20251124-Tool deklariert, gibt einen 400-Fehler invalid_request_error zurück. Die Meldung nennt den abgelehnten Typ und listet dann nach Did you mean one of die Tool-Typen auf, die das Modell akzeptiert (darunter computer_toolset_20260801); sie beginnt so:

'claude-opus-5-5' does not support tool types: computer_20251124.

Um eine bestehende Integration auf der Claude API oder Google Cloud umzustellen, folge der Anleitung unter Von computer_20251124 migrieren: Entferne den Beta-Header, ersetze den tools-Eintrag durch {"type": "computer_toolset_20260801"} und passe deine Agent-Schleife für tool_use-Blöcke der Toolset-Mitglieder, Batch-Aktionen und toolset_name in Ergebnissen an. Auf Amazon Bedrock funktioniert das frühere Tool computer_20251124 mit Claude Opus 5.5 weiterhin wie mit Claude Opus 5, sodass dort keine Änderung nötig ist. Informationen zu anderen Plattformen findest du im Abschnitt Kompatibilität des Computer-Use-Tools. Integrationen, die bereits das Toolset verwenden, sowie das Browser-Use-Tool müssen nicht geändert werden. Der Migrationsleitfaden zeigt die Anfrage vorher und nachher.

Funktionsunterstützung

Claude Opus 5.5 unterstützt Effort pro Nachricht (Beta), Systemnachrichten mitten im Gespräch, Task-Budgets, „prompt caching“ (Prompt-Caching) mit einer minimalen cachebaren Prompt-Länge von 512 Token, Batch-Verarbeitung, die Files API, PDF-Unterstützung, Vision sowie serverseitige und clientseitige Tools. Auf der Claude API und Google Cloud erfordert Computer Use das Toolset computer_toolset_20260801 (siehe den Breaking Change). Informationen zur Modellverfügbarkeit findest du auf der Seite der jeweiligen Funktion.

Fast Mode

Fast Mode (Research Preview) ist für Claude Opus 5.5 nur auf der Claude API verfügbar; er ist nicht auf Amazon Bedrock, Claude Platform on AWS, Google Cloud oder Microsoft Foundry verfügbar. Setze speed: "fast" mit dem Beta-Header fast-mode-2026-02-01. Informationen zu Zugang, unterstützten Modellen und Preisen findest du unter Fast Mode.

Tools in einer Nachricht definieren (Beta)

Mit dem Beta-Header inline-tools-2026-09-15 kann ein tool_addition-Block in einer Systemnachricht mitten im Gespräch eine vollständige Tool-Definition statt einer Referenz enthalten. So kannst du mitten im Gespräch ein Tool hinzufügen, sein Schema ändern oder ein Server-Tool auf eine neuere Version umstellen, ohne tools zu bearbeiten und ohne den Prompt-Cache zu verlieren. Dies funktioniert bei jedem Modell, das Tool-Änderungen mitten im Gespräch unterstützt, einschließlich Claude Opus 5.5. Siehe Tools in einer Nachricht definieren.

Compaction auf Anfrage (Beta)

Mit dem Beta-Header compact-2026-09-04 gibt eine Anfrage, die den Parameter compaction auf oberster Ebene sendet, einen signierten compaction-Block zurück, der die gesamte Konversation zusammenfasst und den du anschließend anstelle der zusammengefassten Nachrichten als Erstes sendest. Compaction auf Anfrage ist bei den Modellen verfügbar, die „compaction“ (Komprimierung) unterstützen, einschließlich Claude Opus 5.5. Du entscheidest, wann komprimiert wird, die Anfrage kann im Hintergrund laufen, und die Thinking-Blöcke in den Turns, die du behältst, können nach dem Austausch gültig bleiben (unter den Bedingungen in Komprimierung und beibehaltenes Denken). Das ist bei Claude Opus 5.5 wichtig, weil seine Thinking-Blöcke an die Konversation gebunden sind. Informationen zur Plattformverfügbarkeit und zum vollständigen Anfrageablauf findest du unter Compaction auf Anfrage.

Verhaltensunterschiede

Claude Opus 5.5 unterscheidet sich von Claude Opus 5 in mehreren Punkten, die sich ohne jede Codeänderung bemerkbar machen. Zu jedem gibt es Hinweise in Prompting für Claude Opus 5.5:

  • Der Standard-Effort ist medium. Eine Anfrage, die effort weglässt, läuft mit medium; bei Claude Opus 5 lief sie mit high. Setze effort explizit und führe deinen Sweep erneut durch; siehe Effort kalibrieren.
  • Mehr Denken pro Turn bei einer gegebenen Effort-Stufe. Bei derselben Effort-Einstellung denkt das Modell tendenziell mehr pro Turn als Claude Opus 5, am stärksten bei xhigh und max. Führe deinen Effort-Sweep erneut durch, statt eine Einstellung zu übernehmen, und lass in max_tokens Platz für das Denken. Siehe Effort kalibrieren.
  • Text zwischen Tool-Aufrufen wird in Thinking-Blöcken zurückgegeben. Die kurzen Notizen, die das Modell zwischen Tool-Aufrufen schreibt, kommen als thinking-Blöcke mit Fortschrittsmeldungen statt als text-Blöcke an. Bei der Standardeinstellung display: "omitted" bleibt eine Anwendung, die sie an ihre Nutzer streamt, daher zwischen Tool-Aufrufen stumm, ohne dass ein Fehler auftritt. Der Migrationsleitfaden enthält die Lösung, um sie zu empfangen, und Fortschrittsmeldungen für Benutzer beschreibt, wie du mehr davon anforderst.
  • Mehr Schutzkategorien. Das Modell führt zusätzlich zum Cybersicherheits-Klassifikator einen Biologie-Sicherheitsklassifikator aus, und Anfragen, die es dazu drängen, sein internes Reasoning im Antworttext wiederzugeben, können mit der Kategorie reasoning_extraction abgelehnt werden. Siehe Ablehnungen und Fallback und Safeguard-Ablehnungen.
  • Präziseres Lesen von Diagrammen, Schaubildern und Screenshots. Das Modell liest Werte aus dichten Diagrammen und layoutabhängigen Darstellungen ohne Tools deutlich präziser ab, sodass promptseitige Vision-Workarounds, die für frühere Modelle entwickelt wurden, möglicherweise nicht mehr nötig sind; Bild-Tools erhöhen die Genauigkeit bei den dichtesten Eingaben dennoch. Siehe Tools für komplexe visuelle Eingaben.

Wenn deine Integration auf Claude Opus 5 mit deaktiviertem Denken lief, sieh dir Prompts, die für deaktiviertes Denken geschrieben wurden zusammen mit dem Breaking Change an. Informationen zu den Verbesserungen der Fähigkeiten bei agentischem Coding und Code-Review, Wissensarbeit, Kommunikation, visuellen Eingaben und Computer Use findest du unter Für das Prompting relevante Fähigkeiten.

Ablehnungen und Fallback

Claude Opus 5.5 wird mit Sicherheitsklassifikatoren ausgeliefert, und alles unter Ablehnungen und Fallback gilt. Eine abgelehnte Anfrage gibt HTTP 200 mit stop_reason: "refusal" und einem stop_details-Objekt zurück, das den Richtlinienbereich nennt. Behandle daher Ablehnungen und konfiguriere einen Fallback: Wiederhole die Anfrage auf einem anderen Modell mit serverseitigem Fallback (fallbacks: "default", in Beta, wiederholt die Anfrage auf dem Modell, das Anthropic für diese Kategorie empfiehlt), der SDK-Middleware oder deiner eigenen Wiederholungslogik.

Preise

Claude Opus 5.5 kostet 4 $ USD pro Million Input-Token und 20 $ USD pro Million Output-Token, weniger als die 5 $ und 25 $ von Claude Opus 5, mit 5-Minuten-Cache-Schreibvorgängen zu 5 $, 1-Stunden-Cache-Schreibvorgängen zu 8 $ und Cache-Lesevorgängen zu 0,20 $ pro Million Token (das 0,05-Fache des Basis-Inputpreises). Batch-Verarbeitung kostet die Hälfte: 2 $ und 10 $. Informationen zu Datenresidenz und Tool-Preisen findest du unter Preise.

Verfügbarkeit

Claude Opus 5.5 ist verfügbar auf:

Von Claude Opus 5 migrieren

Aktualisiere deine Modell-ID:

model = "claude-opus-5"  # Before
model = "claude-opus-5-5"  # After

Entferne anschließend alle Einstellungen thinking: {"type": "disabled"} oder thinking: {"type": "enabled", ...} und wähle stattdessen eine Effort-Stufe. Ersetze die tool_choice-Typen any und tool durch auto plus strikte Tool-Nutzung. Wenn du Computer Use über computer_20251124 auf der Claude API oder Google Cloud verwendest, stelle auf das Toolset um. Wenn deine Oberfläche den Text zwischen Tool-Aufrufen anzeigt, setze außerdem thinking.display; siehe Text zwischen Tool-Aufrufen wird in Thinking-Blöcken zurückgegeben. Schritt-für-Schritt-Anleitungen für die Migration von Claude Opus 5 und früheren Modellen sowie die vollständige Checkliste findest du im Migrationsleitfaden.

Nächste Schritte

Vollständige Spezifikationen und Preise für alle aktuellen Claude-Modelle.

Übertrage Code von Claude Opus 5 und früheren Modellen auf Claude Opus 5.5.

Verhaltensunterschiede und Prompting-Muster speziell für Claude Opus 5.5.

Steuere, wie viele Token Claude beim Antworten verwendet, von low bis max.

Wie adaptives Denken funktioniert und wie Thinking-Blöcke erhalten bleiben.

Behandle stop_reason: "refusal" und wiederhole die Anfrage auf einem anderen Modell.

Was this page helpful?