Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

Visão geral

O Claude Haiku 5.5 foi criado para trabalhos de alto volume e sensíveis à latência, como classificação, roteamento, extração e tarefas de subagentes. Ele oferece suporte a "adaptive thinking" (pensamento adaptativo) com o parâmetro "effort" (esforço), uma "context window" (janela de contexto) de 1M tokens e até 128k tokens de saída. Ele usa o mesmo tokenizador mais recente do Claude 4.7 e modelos posteriores, portanto o mesmo texto conta como aproximadamente 30% mais tokens do que no Claude Haiku 4.5. Seus blocos de pensamento funcionam apenas na conta que os produziu ou em uma conta vinculada a ela.

Para alterações de código, consulte o guia de migração. Para IDs de modelo, preços e limites, consulte a visão geral do Claude Haiku 5.5. Para orientações sobre prompts, consulte Prompting do Claude Haiku 5.5.

Novidades do Claude Haiku 5.5

Como ele se compara

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

Especificações

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

Bom saber

  • O "adaptive thinking" (pensamento adaptativo) está ativado por padrão. Controle a profundidade do pensamento com o parâmetro effort.
  • Omita temperature, top_p e top_k, pois um valor diferente do padrão para qualquer um deles retorna um erro 400.
  • Na Message Batches API, o Claude Haiku 5.5 suporta até 300k tokens de saída com o cabeçalho beta output-300k-2026-03-24.
  • Consulte limites e capacidades programaticamente com a Models API.

Recursos

Diferenças de comportamento e padrões de prompting específicos do Claude Haiku 5.5.

Escolha um modelo e um nível de esforço, estruture prompts e faça streaming da saída para respostas mais rápidas.

O Claude Haiku 5.5 decide quando e quanto pensar. Ajuste a profundidade com effort.

1M de tokens. Como a janela é contabilizada e gerenciada.

Referência

O prompt do sistema que o Claude Haiku 5.5 usa no claude.ai e nos aplicativos Claude.

Avaliações de segurança e decisões de implantação para o Claude Haiku 5.5.

Lista completa de preços, incluindo descontos em lote e tarifas de cache de prompt.

Como funcionam os IDs de modelo, aliases e snapshots fixados.

Status do ciclo de vida e compromissos de desativação para cada modelo Claude.

Was this page helpful?