Claude Platform Docs
Modelle & PreiseClaude Haiku 5.5

Migrationsleitfaden für Claude Haiku 5.5

Wechsle mit diesem Migrationsleitfaden von Claude Haiku 4.5 zu Claude Haiku 5.5. Die Anleitung zur Aktivierung von Claude Haiku 5.5 umfasst die neue Modell-ID, jeden Breaking Change mit der Anfrage vorher und nachher sowie eine Migrations-Checkliste.

Dieser Leitfaden beschreibt, wie du Code, der Claude Haiku 4.5 aufruft, auf Claude Haiku 5.5 umstellst. Wenn du stattdessen auf ein Sonnet- oder Opus-Modell wechseln möchtest, siehe Zwischen Modellversionen upgraden. Wie lange Claude Haiku 4.5 verfügbar bleibt, erfährst du unter Modell-Abkündigungen.

Migrations-Checkliste

Jeder Punkt ist eine Änderung, die du in Code vornehmen musst, der Claude Haiku 4.5 aufruft.

  1. Ersetze die Modell-ID durch die Claude Haiku 5.5-ID für deine Plattform. Siehe Die Modell-ID von Claude Haiku 5.5 verwenden.
  2. Zähle deine Prompts neu und überprüfe max_tokens-Limits und Kostenschätzungen, da derselbe Text als mehr Token gezählt wird. Siehe Token neu zählen.
  3. Wenn deine Anfragen thinking: {"type": "enabled", "budget_tokens": N} senden, ändere thinking zu {"type": "adaptive"}. Siehe Nachdenken konfigurieren.
  4. Wenn dein Code den ersten Content-Block als Antwort liest, wähle Blöcke stattdessen anhand von type aus. Siehe Nachdenken konfigurieren.
  5. Entferne temperature, top_p und top_k aus deinen Anfragen. Siehe Sampling-Parameter entfernen.
  6. Wenn deine Anfragen messages mit einem Assistant-Turn beenden, den das Modell fortsetzen soll, beende sie stattdessen mit einem User-Turn. Siehe Assistant-Prefill ersetzen.
  7. Wenn du Computer Use auf der Claude API oder Google Cloud verwendest, wechsle von computer_20250124 zum Toolset computer_toolset_20260801. Siehe Computer Use auf das Toolset umstellen.
  8. Wenn du gespeicherte Konversationen über ein anderes Konto erneut abspielst, spiele jede über das Konto ab, das sie erzeugt hat. Siehe Thinking-Blöcke über das Konto abspielen, das sie erzeugt hat.
  9. Wenn dein Code system, tools oder frühere messages zwischen Anfragen in einer Konversation ändert und Thinking-Blöcke zurücksendet, halte die Konversation append-only. Siehe Frühere Turns unverändert lassen.
  10. Behandle stop_reason: "refusal". Claude Haiku 5.5 führt Sicherheitsklassifikatoren aus, die eine Anfrage ablehnen können, und es gibt keinen serverseitigen Fallback. Siehe Ablehnungen durch Schutzmechanismen.

Wenn deine Organisation eine Priority Tier-Zusage für Claude Haiku 4.5 hat, plane die Kapazität separat: Priority Tier wird auf Claude Haiku 5.5 nicht unterstützt.

Die Modell-ID von Claude Haiku 5.5 verwenden

Ersetze die Modell-ID von Claude Haiku 4.5 durch die Claude Haiku 5.5-ID für deine Plattform.

PlattformClaude Haiku 4.5Claude Haiku 5.5
Claude APIclaude-haiku-4-5-20251001 oder claude-haiku-4-5claude-haiku-5-5
Amazon Bedrockanthropic.claude-haiku-4-5anthropic.claude-haiku-5-5
Claude Platform on AWSclaude-haiku-4-5claude-haiku-5-5
Google Cloudclaude-haiku-4-5@20251001claude-haiku-5-5
Microsoft Foundryclaude-haiku-4-5claude-haiku-5-5

claude-haiku-5-5 ist eine feste Modell-ID ohne Datumssuffix und ohne separaten Alias.

Token neu zählen

Claude Haiku 5.5 verwendet denselben neueren „tokenizer" (Tokenisierer) wie Claude 4.7 und spätere Modelle. Wie bei allen Modellen, die diesen Tokenizer verwenden, erzeugt derselbe Eingabetext auf Claude Haiku 5.5 etwa 30 % mehr Token als auf Claude Haiku 4.5. Die genaue Zunahme hängt vom Inhalt ab. Anfragen, Antworten und Streaming-Events behalten dieselbe Struktur. Was sich ändert, ist alles, was du in Token misst oder budgetierst:

  • usage-Felder und Ergebnisse der Token-Zählung sind für denselben Text höher.
  • Eine bestimmte Anzahl von Token fasst weniger Text.
  • Ein für Claude Haiku 4.5 abgestimmtes max_tokens-Limit kann gleichwertige Ausgaben abschneiden.
  • Kostenschätzungen, die auf den Token-Zählungen von Claude Haiku 4.5 basieren, müssen mit den Zählungen und Preisen von Claude Haiku 5.5 neu berechnet werden.

Zähle deine Prompts mit model auf claude-haiku-5-5 gesetzt, anstatt auf Claude Haiku 4.5 gemessene Zählungen wiederzuverwenden.

Nachdenken konfigurieren

Claude Haiku 5.5 konfiguriert das Nachdenken anders als Claude Haiku 4.5. Ein thinking-Wert von {"type": "enabled", "budget_tokens": N} gibt einen 400-Fehler zurück, daher benötigt eine Anfrage, die ihn sendet, einen neuen thinking-Wert.

Vorher setzte eine Anfrage an Claude Haiku 4.5 thinking auf enabled mit einem Token-Budget:

{
  "model": "claude-haiku-4-5",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "..." }]
}

Nachher verwendet dieselbe Anfrage an Claude Haiku 5.5 „adaptive thinking" (adaptives Nachdenken). Der thinking-Wert ändert sich, und output_config.effort legt fest, wie viel das Modell nachdenkt:

{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Adaptives Nachdenken ist standardmäßig aktiviert, sodass eine Antwort mit einem oder mehreren thinking-Blöcken beginnen kann, auch wenn die Anfrage thinking nicht setzt. Lass thinking ungesetzt oder setze es auf {"type": "adaptive"}, und verwende Effort als Stellschraube: Wo Claude Haiku 4.5 ohne Nachdenken oder mit einem kleinen Budget lief, um Token zu sparen, wähle ein niedrigeres Effort-Level. Auf einem niedrigeren Level denkt das Modell weniger nach und kann das Nachdenken bei einfacheren Anfragen ganz überspringen. Hinweise zum Prompting findest du unter Effort zur Steuerung des Nachdenkens verwenden. Wähle Content-Blöcke anhand ihres type-Felds statt anhand ihrer Position aus, und gib thinking-Blöcke unverändert mit Tool-Ergebnissen zurück.

Thinking-Token zählen zu max_tokens, daher kann eine Anfrage mit einem kleinen max_tokens nach einem thinking-Block und vor jeglichem Text mit stop_reason: "max_tokens" stoppen. Wenn du für Claude Haiku 4.5 ein kleines max_tokens gesetzt hast, erhöhe es, um Raum für das Nachdenken zu lassen, oder wähle ein niedrigeres Effort-Level.

Standardmäßig gibt Claude Haiku 5.5 jeden thinking-Block mit einem leeren thinking-Feld und nur einer signature zurück, während Claude Haiku 4.5 zusammengefasstes Nachdenken zurückgab. Um zusammengefasstes Nachdenken zu erhalten, setze thinking: {"type": "adaptive", "display": "summarized"}.

Claude Haiku 5.5 akzeptiert ein erzwungenes tool_choice (any oder ein benanntes Tool), aber die Antwort beginnt mit dem Tool-Aufruf und enthält keinen thinking-Block. Damit das Modell nachdenken kann, bevor es ein Tool aufruft, verwende tool_choice: {"type": "auto"} und gib im Prompt an, wann das Tool verwendet werden soll.

Sampling-Parameter entfernen

Claude Haiku 4.5 akzeptiert temperature, top_p und top_k. Lass auf Claude Haiku 5.5 alle drei weg und verwende stattdessen Prompting, um das Verhalten des Modells zu steuern. Wenn eine Anfrage temperature enthält, muss der Wert 1 sein. Wenn sie top_p enthält, muss der Wert 0.99 sein, der Standardwert. Jeder andere temperature- oder top_p-Wert gibt einen 400-Fehler zurück, einschließlich eines top_p von 1. Dasselbe gilt für jeden top_k-Wert und für eine Anfrage, die sowohl temperature als auch top_p enthält.

Assistant-Prefill ersetzen

Ein „prefill" (Vorbefüllung) ist ein abschließender Assistant-Turn in messages, den das Modell fortsetzt. Claude Haiku 4.5 akzeptiert einen solchen, wenn das Nachdenken deaktiviert ist. Claude Haiku 5.5 lehnt ihn mit einem 400-Fehler ab, selbst wenn das Nachdenken deaktiviert ist. Beende messages mit einem User-Turn und ersetze jedes Prefill entsprechend seinem Zweck:

  • Ausgabeformat: Verwende strukturierte Ausgaben oder Tools mit Enum-Feldern für die Klassifizierung. Verwende bei Claude in Amazon Bedrock, das keine strukturierten Ausgaben unterstützt, Tools.
  • Präambeln: Bitte im System-Prompt um eine direkte Antwort.
  • Fortsetzungen: Verschiebe sie in die User-Nachricht, zum Beispiel „Deine vorherige Antwort wurde unterbrochen und endete mit [previous_response]. Fahre dort fort, wo du aufgehört hast."
  • Kontext-Erinnerungen: Füge sie in den User-Turn ein.

Computer Use auf das Toolset umstellen

Claude Haiku 4.5 unterstützt Computer Use über das Tool computer_20250124 mit dem Beta-Header computer-use-2025-01-24. Auf der Claude API und Google Cloud unterstützt Claude Haiku 5.5 Computer Use nur über das Toolset computer_toolset_20260801, und eine Anfrage, die computer_20250124 deklariert, gibt einen 400-Fehler zurück.

Um eine Integration umzustellen, entferne den Beta-Header computer-use-2025-01-24 und ersetze den tools-Eintrag durch {"type": "computer_toolset_20260801"}. Nimm dann die weiteren Änderungen an Anfrage und Agent-Loop aus Von computer_20251124 migrieren vor: Verzweige anhand von name und toolset_name jedes zugehörigen tool_use-Blocks statt anhand von input.action, behandle jeden solchen Block in einem Turn und gib toolset_name in den Ergebnissen zurück. Zoom ist im Toolset standardmäßig aktiviert; wenn deine Umgebung es nicht implementiert, füge "configs": {"zoom": {"enabled": false}} hinzu. Wenn du den Beta-Header fine-grained-tool-streaming-2025-05-14 sendest, entferne ihn. Zusammen mit einem Toolset-Eintrag gibt er einen 400-Fehler zurück. Für andere Plattformen siehe den Abschnitt Kompatibilität des Computer-Use-Tools.

Auf der Claude API und Google Cloud unterstützt Claude Haiku 5.5 außerdem das Browser-Use-Tool (browser_toolset_20260801) für Aufgaben innerhalb von Webseiten. Claude Haiku 4.5 unterstützt es nicht.

Thinking-Blöcke über das Konto abspielen, das sie erzeugt hat

Thinking-Blöcke von Claude Haiku 5.5 funktionieren nur in dem Konto, das sie erzeugt hat, oder in einem damit verknüpften Konto. Wenn ein anderes Konto einen dieser Blöcke sendet, verwirft die API den Block, bevor das Modell ihn sieht, und die Anfrage ist ohne diese Überlegungen erfolgreich. Dies betrifft Code, der Konversationen speichert und über ein anderes Konto erneut abspielt, zum Beispiel einen Dienst, der mehrere Kunden aus einem einzigen Konversationsspeicher bedient. Spiele jede Konversation über das Konto ab, das sie erzeugt hat. Siehe Thinking-Blöcke bleiben bei dem Konto, das sie erzeugt hat.

Frühere Turns unverändert lassen

Ein Thinking-Block von Claude Haiku 5.5 bleibt nur gültig, solange alles, was davor gesendet wurde, unverändert ist: Eine Anfrage, die einen Thinking-Block nach einer Änderung an system, tools oder früheren messages zurücksendet, gibt einen 400-Fehler zurück. Claude Haiku 4.5 führt diese Prüfung nicht durch. Halte Konversationen append-only. Bei Konten, die vor dem 31. August 2026, 00:00 UTC, erstellt wurden, tritt der Fehler nur bei Anfragen auf, die thinking.block_binding.prefix_mismatch_behavior setzen. Welche Änderungen den Fehler auslösen und was du stattdessen tun solltest, erfährst du unter Wer etwas ändern muss.

Was this page helpful?