Claude Sonnet 5.5Latest
The best combination of speed and intelligence
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $2/ MTok
- Output pricing
- $10/ MTok
Visão geral
O Claude Sonnet 5.5 oferece a melhor combinação de velocidade e inteligência. Cinco "breaking changes" (mudanças incompatíveis) afetam código que já roda no Claude Sonnet 5:
- Desative o pensamento antecipado com
between_tools. - O uso forçado de ferramentas retorna um erro.
- Os blocos de pensamento estão vinculados ao modelo e à conversa.
- Na Claude API e no Google Cloud, a ferramenta de uso do computador anterior
computer_20251124não é aceita. - A ferramenta de consultor rejeita Claude Opus 4.8, Claude Opus 4.7 e Claude Sonnet 5 como consultores.
Mais uma mudança altera o formato da resposta sem fazer nenhuma requisição falhar: o texto entre chamadas de ferramentas volta em blocos thinking. Uma aplicação que faz streaming desse texto para seus usuários fica em silêncio entre as chamadas de ferramentas até definir um valor de display que retorne o texto, ou até desativar o pensamento antecipado com between_tools.
Como ele se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5This model | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Especificações
Model IDs
Pricing
- Input
- $2 / MTok
- Output
- $10 / MTok
- 5m cache write
- $2.50 / MTok
- 1h cache write
- $4 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Fast
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 28, 2026
- Retirement
- Not sooner than September 28, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Bom saber
- O "adaptive thinking" (pensamento adaptativo) está ativado por padrão. A configuração de pensamento mais baixa é
between_tools, que desativa o pensamento antecipado. Ela funciona com "effort" (esforço)highou inferior. Consulte Novidades no Claude Sonnet 5.5. - Definir
temperature,top_poutop_kcom um valor diferente do padrão retorna um erro 400. - O comprimento mínimo de prompt para "prompt caching" (cache de prompt) é de 512 tokens. Consulte Cache de prompt.
- Na Message Batches API, o Claude Sonnet 5.5 suporta até 300k tokens de saída com o cabeçalho beta
output-300k-2026-03-24. - Consulte limites e recursos programaticamente com a Models API.
Recursos
Diferenças de comportamento e padrões de prompt específicos do Claude Sonnet 5.5.
O controle para profundidade de pensamento, "latency" (latência) e custo. Escolha um nível para cada carga de trabalho.
Como o pensamento adaptativo funciona, quais configurações de pensamento cada modelo aceita e como os blocos de pensamento são preservados.
Referência
Lista completa de preços, incluindo descontos de lote e tarifas de cache de prompt.
Como funcionam os IDs de modelo, os aliases e os snapshots fixados.
Status do ciclo de vida e compromissos de desativação para cada modelo Claude.
Was this page helpful?