Claude Opus 5Latest
For complex agentic coding and enterprise work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $5/ MTok
- Output pricing
- $25/ MTok
Visão geral
O Claude Opus 5 é uma melhoria de grande salto em relação ao Claude Opus 4.8, com os maiores ganhos em raciocínio profundo, tarefas agênticas e de longo horizonte, e escalonamento de computação em tempo de teste. Esta página resume tudo o que há de novo no Claude Opus 5, incluindo mudanças de ferramentas no meio da conversa e duas mudanças incompatíveis para código executado no Claude Opus 4.8: o pensamento está ativado por padrão, e o pensamento só pode ser desativado com esforço high ou inferior.
Como ele se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5This model | 1M | 128K | $5 / $25 | Moderate | Adaptive | high | May 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Especificações
Model IDs
- Claude API
Pricing
- Input
- $5 / MTok
- Output
- $25 / MTok
- 5m cache write
- $6.25 / MTok
- 1h cache write
- $10 / MTok
- Cache read
- $0.50 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- May 2026
- Training data cutoff
- May 2026
Availability
- Status
- Active (latest)
- Released
- July 24, 2026
- Retirement
- Not sooner than July 24, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft Foundry
Bom saber
- Na API Message Batches, o Claude Opus 5 suporta até 300 mil tokens de saída com o cabeçalho beta
output-300k-2026-03-24. - O comprimento mínimo de prompt armazenável em cache é de 512 tokens. Consulte Cache de prompt.
- Consulte limites e capacidades programaticamente com a API Models.
Recursos
Orientações de prompting específicas do modelo.
O "effort" (esforço) tem como padrão high no Claude Opus 5 e importa mais do que em modelos anteriores. Escolha um nível por carga de trabalho.
Ativado por padrão. Desativar o pensamento requer esforço high ou inferior.
Claude Opus 5 com menor latência na Claude API (prévia de pesquisa), com preço separado.
Referência
O prompt do sistema que o Claude Opus 5 usa no claude.ai e nos aplicativos Claude.
Avaliações de segurança e decisões de implantação para o Claude Opus 5.
Lista completa de preços, incluindo descontos em lote e tarifas de cache de prompt.
Como funcionam os IDs de modelo, aliases e snapshots fixados.
Status do ciclo de vida e compromissos de desativação para cada modelo Claude.
Was this page helpful?