Claude Opus 5.5Latest
For long-running agentic coding and knowledge work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $4/ MTok
- Output pricing
- $20/ MTok
Visão geral
O Claude Opus 5.5 foi criado para codificação agêntica de longa duração e trabalho de conhecimento, com preço de $4 / $20 USD por milhão de tokens de entrada / saída. Quatro "breaking changes" (mudanças incompatíveis) afetam código que já roda no Claude Opus 5: o pensamento não pode ser desativado, o uso forçado de ferramentas retorna um erro, os blocos de pensamento estão vinculados ao modelo e à conversa e, na Claude API e no Google Cloud, a ferramenta anterior de "computer use" (uso de computador) computer_20251124 não é aceita. As três primeiras também se aplicam ao Claude Fable 5.1. Outra mudança altera o formato da resposta sem fazer nenhuma requisição falhar: o texto entre chamadas de ferramentas volta em blocos thinking, cujo texto fica vazio na configuração padrão de display. Uma aplicação que faz streaming desse texto para seus usuários como atualizações de progresso fica em silêncio entre as chamadas de ferramentas até definir um valor de display que retorne o texto.
Como ele se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5This model | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Especificações
Model IDs
- Claude API
Pricing
- Input
- $4 / MTok
- Output
- $20 / MTok
- 5m cache write
- $5 / MTok
- 1h cache write
- $8 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive (always on)
- Default effort
medium- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 22, 2026
- Retirement
- Not sooner than September 22, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Bom saber
- O "adaptive thinking" (pensamento adaptativo) está sempre ativado e não pode ser desativado. Controle a profundidade do pensamento com o parâmetro effort.
- Na Message Batches API, o Claude Opus 5.5 suporta até 300 mil tokens de saída com o cabeçalho beta
output-300k-2026-03-24. - O comprimento mínimo de prompt armazenável em cache é de 512 tokens. Consulte Cache de prompt.
- Consulte limites e capacidades programaticamente com a Models API.
Recursos
Diferenças de comportamento e padrões de prompt específicos do Claude Opus 5.5.
O controle da profundidade do pensamento, da "latency" (latência) e do custo. Escolha um nível por carga de trabalho.
Como o pensamento adaptativo funciona e como os blocos de pensamento são preservados.
Claude Opus 5.5 com menor latência na Claude API (prévia de pesquisa), com preço separado.
Referência
O prompt do sistema que o Claude Opus 5.5 usa no claude.ai e nos aplicativos Claude.
Avaliações de segurança e decisões de implantação para o Claude Opus 5.5.
Lista completa de preços, incluindo descontos em lote e tarifas de cache de prompt.
Como funcionam os IDs de modelo, aliases e snapshots fixados.
Status do ciclo de vida e compromissos de desativação para cada modelo Claude.
Was this page helpful?