Neuerungen in Claude Haiku 5.5
Überblick über neue Funktionen, Breaking Changes und Verhaltensänderungen in Claude Haiku 5.5, mit einem Link zum Leitfaden jeder Funktion und zum Migrationsleitfaden für Codeänderungen.
Claude Haiku 5.5 ist für latenzkritische Arbeit mit hohem Volumen wie Klassifizierung, Routing, Extraktion und Subagent-Aufgaben konzipiert. Es unterstützt „adaptive thinking" (adaptives Nachdenken) mit dem Effort-Parameter, ein „context window" (Kontextfenster) von 1M Token und bis zu 128k Ausgabe-Token. Es verwendet denselben neueren Tokenizer wie Claude 4.7 und spätere Modelle, sodass derselbe Text als etwa 30 % mehr Token gezählt wird als bei Claude Haiku 4.5. Seine „thinking blocks" (Thinking-Blöcke) funktionieren nur in dem Konto, das sie erzeugt hat, oder in einem damit verknüpften Konto.
Für Codeänderungen siehe den Migrationsleitfaden. Für Modell-IDs, Preise und Limits siehe die Übersicht zu Claude Haiku 5.5. Für Hinweise zum Prompting siehe Prompting für Claude Haiku 5.5.
Zusammenfassung der Änderungen gegenüber Claude Haiku 4.5
Jede Zeile nennt eine Änderung, ob sie neu, geändert oder ein Breaking Change ist, und was dein Code tun muss.
| Änderung | Typ | Erforderliche Maßnahme |
|---|---|---|
| Adaptives Nachdenken und Effort | Neu | Optional: Setze effort, um Antwortqualität gegen Geschwindigkeit und Kosten abzuwägen. |
| Größeres Kontextfenster und größere Ausgabe | Neu | Keine. Bestehende max_tokens-Werte bleiben gültig, aber Thinking-Token werden darauf angerechnet. |
| Browser-Use-Tool | Neu | Keine. Verfügbar in der Claude API und auf Google Cloud. |
| Sicherheitsklassifikatoren können eine Anfrage ablehnen | Neu | Behandle stop_reason: "refusal" in deinem Client. Serverseitiger Fallback ist nicht verfügbar. |
| Manuelles erweitertes Nachdenken gibt einen Fehler zurück | Breaking | Ersetze budget_tokens durch adaptives Nachdenken. |
| Nicht standardmäßige Sampling-Parameter geben einen Fehler zurück | Breaking | Lass temperature, top_p und top_k weg. |
| Prefill von Assistant-Nachrichten gibt einen Fehler zurück | Breaking | Beende messages mit einem User-Turn. |
| Computer Use benötigt das Toolset in der Claude API und auf Google Cloud | Breaking | Ersetze computer_20250124 durch computer_toolset_20260801. |
| Das Ändern früherer Turns macht Thinking-Blöcke ungültig | Breaking | Halte Konversationen append-only, wenn du Thinking-Blöcke zurücksendest. |
| Antworten können mit Thinking-Blöcken beginnen | Geändert | Wähle Content-Blöcke nach type aus, nicht nach Position. |
| Thinking-Text wird standardmäßig weggelassen | Geändert | Um zusammengefasstes Nachdenken zu erhalten, setze thinking.display auf "summarized". |
| Derselbe Text zählt als mehr Token | Geändert | Zähle Prompts neu und überprüfe max_tokens und Kostenschätzungen. |
| Wiedergabe von Thinking-Blöcken über Konten hinweg | Geändert | Wenn du gespeicherte Konversationen über ein anderes Konto wiedergibst, gib jede über das Konto wieder, das sie erzeugt hat. |
Neue Funktionen
Adaptives Nachdenken und Effort
Mit adaptivem Nachdenken entscheidet Claude Haiku 5.5, wann und wie viel es nachdenkt. Adaptives Nachdenken ist standardmäßig aktiviert. Du kannst das Nachdenken bei Effort high oder darunter zwar weiterhin mit thinking: {"type": "disabled"} deaktivieren, aber der bessere Weg, Antwortqualität gegen Geschwindigkeit und Kosten abzuwägen, ist die Verwendung des Effort-Parameters.
Größeres Kontextfenster und größere Ausgabe
Claude Haiku 5.5 hat ein Kontextfenster von 1M Token und gibt bis zu 128k Ausgabe-Token zurück, gegenüber 200k und 64k bei Claude Haiku 4.5. Bestehende max_tokens-Werte bleiben gültig, aber Thinking-Token werden auf max_tokens angerechnet, sodass ein kleines Limit nach einem thinking-Block und vor jeglichem Text stoppen kann. Siehe Nachdenken konfigurieren.
Verhaltensänderungen
Antworten können mit Thinking-Blöcken beginnen
Adaptives Nachdenken ist standardmäßig aktiviert, daher kann eine Antwort mit einem oder mehreren thinking-Blöcken beginnen, selbst wenn die Anfrage das Nachdenken nicht erwähnt. Code, der den ersten Content-Block als Antwort liest, muss Blöcke anhand ihres type-Felds auswählen. Siehe Nachdenken konfigurieren im Migrationsleitfaden.
Derselbe Text zählt als mehr Token
Claude Haiku 5.5 verwendet denselben neueren Tokenizer wie Claude 4.7 und spätere Modelle. Wie bei allen Modellen, die diesen Tokenizer verwenden, erzeugt derselbe Eingabetext bei Claude Haiku 5.5 etwa 30 % mehr Token als bei Claude Haiku 4.5. Die genaue Zunahme hängt vom Inhalt ab. Die Struktur von Anfragen und Antworten hängt nicht vom Tokenizer ab, aber alles, was du in Token misst oder budgetierst, ändert sich. Siehe Token neu zählen im Migrationsleitfaden.
Wiedergabe von Thinking-Blöcken über Konten hinweg
Thinking-Blöcke von Claude Haiku 5.5 funktionieren nur in dem Konto, das sie erzeugt hat, oder in einem damit verknüpften Konto. Dies ist nur relevant, wenn du Konversationen speicherst und sie über ein anderes Konto wiedergibst. Siehe Thinking-Blöcke über das Konto abspielen, das sie erzeugt hat.
Was this page helpful?