Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

Panoramica

Claude Haiku 5.5 è progettato per carichi di lavoro ad alto volume e sensibili alla "latency" (latenza), come classificazione, instradamento, estrazione e attività di subagenti. Supporta l'"adaptive thinking" (ragionamento adattivo) con il parametro effort, una "context window" (finestra di contesto) da 1M token e fino a 128k token di output. Utilizza lo stesso tokenizer più recente di Claude 4.7 e dei modelli successivi, quindi lo stesso testo corrisponde a circa il 30% di token in più rispetto a Claude Haiku 4.5. I suoi blocchi di ragionamento funzionano solo nell'account che li ha prodotti o in un account collegato a esso.

Per le modifiche al codice, consulta la guida alla migrazione. Per ID dei modelli, prezzi e limiti, consulta la panoramica di Claude Haiku 5.5. Per indicazioni sulla scrittura dei prompt, consulta Prompting per Claude Haiku 5.5.

Novità di Claude Haiku 5.5

Come si confronta

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

Specifiche

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

Da sapere

  • L'"adaptive thinking" (ragionamento adattivo) è attivo per impostazione predefinita. Controlla la profondità del ragionamento con il parametro effort.
  • Ometti temperature, top_p e top_k, poiché un valore non predefinito per uno qualsiasi di essi restituisce un errore 400.
  • Sulla Message Batches API, Claude Haiku 5.5 supporta fino a 300k token di output con l'header beta output-300k-2026-03-24.
  • Interroga limiti e capacità in modo programmatico con la Models API.

Risorse

Differenze comportamentali e schemi di prompting specifici per Claude Haiku 5.5.

Scegli un modello e un livello di effort, struttura i prompt e trasmetti l'output in streaming per risposte più rapide.

Claude Haiku 5.5 decide quando e quanto ragionare. Orienta la profondità con effort.

1M di token. Come la finestra viene conteggiata e gestita.

Riferimento

Il prompt di sistema che Claude Haiku 5.5 utilizza su claude.ai e nelle app Claude.

Valutazioni di sicurezza e decisioni di distribuzione per Claude Haiku 5.5.

Listino prezzi completo, inclusi gli sconti batch e le tariffe della cache dei prompt.

Come funzionano gli ID dei modelli, gli alias e gli snapshot fissati.

Stato del ciclo di vita e impegni di ritiro per ogni modello Claude.

Was this page helpful?