Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
Panoramica
Claude Haiku 5.5 è progettato per carichi di lavoro ad alto volume e sensibili alla "latency" (latenza), come classificazione, instradamento, estrazione e attività di subagenti. Supporta l'"adaptive thinking" (ragionamento adattivo) con il parametro effort, una "context window" (finestra di contesto) da 1M token e fino a 128k token di output. Utilizza lo stesso tokenizer più recente di Claude 4.7 e dei modelli successivi, quindi lo stesso testo corrisponde a circa il 30% di token in più rispetto a Claude Haiku 4.5. I suoi blocchi di ragionamento funzionano solo nell'account che li ha prodotti o in un account collegato a esso.
Per le modifiche al codice, consulta la guida alla migrazione. Per ID dei modelli, prezzi e limiti, consulta la panoramica di Claude Haiku 5.5. Per indicazioni sulla scrittura dei prompt, consulta Prompting per Claude Haiku 5.5.
Come si confronta
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
Specifiche
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Da sapere
- L'"adaptive thinking" (ragionamento adattivo) è attivo per impostazione predefinita. Controlla la profondità del ragionamento con il parametro effort.
- Ometti
temperature,top_petop_k, poiché un valore non predefinito per uno qualsiasi di essi restituisce un errore 400. - Sulla Message Batches API, Claude Haiku 5.5 supporta fino a 300k token di output con l'header beta
output-300k-2026-03-24. - Interroga limiti e capacità in modo programmatico con la Models API.
Risorse
Differenze comportamentali e schemi di prompting specifici per Claude Haiku 5.5.
Scegli un modello e un livello di effort, struttura i prompt e trasmetti l'output in streaming per risposte più rapide.
Claude Haiku 5.5 decide quando e quanto ragionare. Orienta la profondità con effort.
1M di token. Come la finestra viene conteggiata e gestita.
Riferimento
Il prompt di sistema che Claude Haiku 5.5 utilizza su claude.ai e nelle app Claude.
Valutazioni di sicurezza e decisioni di distribuzione per Claude Haiku 5.5.
Listino prezzi completo, inclusi gli sconti batch e le tariffe della cache dei prompt.
Come funzionano gli ID dei modelli, gli alias e gli snapshot fissati.
Stato del ciclo di vita e impegni di ritiro per ogni modello Claude.
Was this page helpful?