Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
Visão geral
O Claude Haiku 5.5 foi criado para trabalhos de alto volume e sensíveis à latência, como classificação, roteamento, extração e tarefas de subagentes. Ele oferece suporte a "adaptive thinking" (pensamento adaptativo) com o parâmetro "effort" (esforço), uma "context window" (janela de contexto) de 1M tokens e até 128k tokens de saída. Ele usa o mesmo tokenizador mais recente do Claude 4.7 e modelos posteriores, portanto o mesmo texto conta como aproximadamente 30% mais tokens do que no Claude Haiku 4.5. Seus blocos de pensamento funcionam apenas na conta que os produziu ou em uma conta vinculada a ela.
Para alterações de código, consulte o guia de migração. Para IDs de modelo, preços e limites, consulte a visão geral do Claude Haiku 5.5. Para orientações sobre prompts, consulte Prompting do Claude Haiku 5.5.
Como ele se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
Especificações
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Bom saber
- O "adaptive thinking" (pensamento adaptativo) está ativado por padrão. Controle a profundidade do pensamento com o parâmetro effort.
- Omita
temperature,top_petop_k, pois um valor diferente do padrão para qualquer um deles retorna um erro 400. - Na Message Batches API, o Claude Haiku 5.5 suporta até 300k tokens de saída com o cabeçalho beta
output-300k-2026-03-24. - Consulte limites e capacidades programaticamente com a Models API.
Recursos
Diferenças de comportamento e padrões de prompting específicos do Claude Haiku 5.5.
Escolha um modelo e um nível de esforço, estruture prompts e faça streaming da saída para respostas mais rápidas.
O Claude Haiku 5.5 decide quando e quanto pensar. Ajuste a profundidade com effort.
1M de tokens. Como a janela é contabilizada e gerenciada.
Referência
O prompt do sistema que o Claude Haiku 5.5 usa no claude.ai e nos aplicativos Claude.
Avaliações de segurança e decisões de implantação para o Claude Haiku 5.5.
Lista completa de preços, incluindo descontos em lote e tarifas de cache de prompt.
Como funcionam os IDs de modelo, aliases e snapshots fixados.
Status do ciclo de vida e compromissos de desativação para cada modelo Claude.
Was this page helpful?