Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
Überblick
Claude Haiku 5.5 ist für latenzkritische Arbeit mit hohem Volumen wie Klassifizierung, Routing, Extraktion und Subagent-Aufgaben konzipiert. Es unterstützt „adaptive thinking" (adaptives Nachdenken) mit dem Effort-Parameter, ein „context window" (Kontextfenster) von 1M Token und bis zu 128k Ausgabe-Token. Es verwendet denselben neueren Tokenizer wie Claude 4.7 und spätere Modelle, sodass derselbe Text als etwa 30 % mehr Token gezählt wird als bei Claude Haiku 4.5. Seine „thinking blocks" (Thinking-Blöcke) funktionieren nur in dem Konto, das sie erzeugt hat, oder in einem damit verknüpften Konto.
Für Codeänderungen siehe den Migrationsleitfaden. Für Modell-IDs, Preise und Limits siehe die Übersicht zu Claude Haiku 5.5. Für Hinweise zum Prompting siehe Prompting für Claude Haiku 5.5.
Im Vergleich
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
Spezifikationen
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Gut zu wissen
- „Adaptive thinking" (adaptives Nachdenken) ist standardmäßig aktiviert. Steuere die Tiefe des Nachdenkens mit dem Effort-Parameter.
- Lass
temperature,top_pundtop_kweg, da ein vom Standard abweichender Wert für einen dieser Parameter einen 400-Fehler zurückgibt. - In der Message Batches API unterstützt Claude Haiku 5.5 mit dem Beta-Header
output-300k-2026-03-24bis zu 300k Ausgabe-Token. - Frage Limits und Fähigkeiten programmatisch mit der Models API ab.
Ressourcen
Verhaltensunterschiede und Prompting-Muster speziell für Claude Haiku 5.5.
Wähle ein Modell und eine Effort-Stufe, gestalte Prompts und streame die Ausgabe für schnellere Antworten.
Claude Haiku 5.5 entscheidet, wann und wie viel es nachdenkt. Steuere die Tiefe mit effort.
1M Token. Wie das Fenster gezählt und verwaltet wird.
Referenz
Der System-Prompt, den Claude Haiku 5.5 auf claude.ai und in den Claude-Apps verwendet.
Sicherheitsbewertungen und Bereitstellungsentscheidungen für Claude Haiku 5.5.
Vollständige Preisliste, einschließlich Batch-Rabatten und Preisen für Prompt-Caching.
Wie Modell-IDs, Aliase und fixierte Snapshots funktionieren.
Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.
Was this page helpful?