Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

Überblick

Claude Haiku 5.5 ist für latenzkritische Arbeit mit hohem Volumen wie Klassifizierung, Routing, Extraktion und Subagent-Aufgaben konzipiert. Es unterstützt „adaptive thinking" (adaptives Nachdenken) mit dem Effort-Parameter, ein „context window" (Kontextfenster) von 1M Token und bis zu 128k Ausgabe-Token. Es verwendet denselben neueren Tokenizer wie Claude 4.7 und spätere Modelle, sodass derselbe Text als etwa 30 % mehr Token gezählt wird als bei Claude Haiku 4.5. Seine „thinking blocks" (Thinking-Blöcke) funktionieren nur in dem Konto, das sie erzeugt hat, oder in einem damit verknüpften Konto.

Für Codeänderungen siehe den Migrationsleitfaden. Für Modell-IDs, Preise und Limits siehe die Übersicht zu Claude Haiku 5.5. Für Hinweise zum Prompting siehe Prompting für Claude Haiku 5.5.

Neuerungen in Claude Haiku 5.5

Im Vergleich

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

Spezifikationen

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

Gut zu wissen

  • „Adaptive thinking" (adaptives Nachdenken) ist standardmäßig aktiviert. Steuere die Tiefe des Nachdenkens mit dem Effort-Parameter.
  • Lass temperature, top_p und top_k weg, da ein vom Standard abweichender Wert für einen dieser Parameter einen 400-Fehler zurückgibt.
  • In der Message Batches API unterstützt Claude Haiku 5.5 mit dem Beta-Header output-300k-2026-03-24 bis zu 300k Ausgabe-Token.
  • Frage Limits und Fähigkeiten programmatisch mit der Models API ab.

Ressourcen

Verhaltensunterschiede und Prompting-Muster speziell für Claude Haiku 5.5.

Wähle ein Modell und eine Effort-Stufe, gestalte Prompts und streame die Ausgabe für schnellere Antworten.

Claude Haiku 5.5 entscheidet, wann und wie viel es nachdenkt. Steuere die Tiefe mit effort.

1M Token. Wie das Fenster gezählt und verwaltet wird.

Referenz

Der System-Prompt, den Claude Haiku 5.5 auf claude.ai und in den Claude-Apps verwendet.

Sicherheitsbewertungen und Bereitstellungsentscheidungen für Claude Haiku 5.5.

Vollständige Preisliste, einschließlich Batch-Rabatten und Preisen für Prompt-Caching.

Wie Modell-IDs, Aliase und fixierte Snapshots funktionieren.

Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.

Was this page helpful?