Claude Platform Docs
Modelos e preçosModelos

Claude Opus 5Latest

For complex agentic coding and enterprise work

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$5/ MTok
Output pricing
$25/ MTok

Visão geral

O Claude Opus 5 é uma melhoria de grande salto em relação ao Claude Opus 4.8, com os maiores ganhos em raciocínio profundo, tarefas agênticas e de longo horizonte, e escalonamento de computação em tempo de teste. Esta página resume tudo o que há de novo no Claude Opus 5, incluindo mudanças de ferramentas no meio da conversa e duas mudanças incompatíveis para código executado no Claude Opus 4.8: o pensamento está ativado por padrão, e o pensamento só pode ser desativado com esforço high ou inferior.

O que há de novo no Claude Opus 5

Como ele se compara

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5This model1M128K$5 / $25ModerateAdaptivehighMay 2026
Claude Sonnet 51M128K$2 / $10FastAdaptivehighJan 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtendedFeb 2025

Especificações

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry

Pricing

Input
$5 / MTok
Output
$25 / MTok
5m cache write
$6.25 / MTok
1h cache write
$10 / MTok
Cache read
$0.50 / MTok
Batch API
50% discount on input and output
Full price list
Pricing

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Moderate
Input → output
Text and images → text
Reliable knowledge cutoff
May 2026
Training data cutoff
May 2026

Availability

Status
Active (latest)
Released
July 24, 2026
Retirement
Not sooner than July 24, 2027

Bom saber

  • Na API Message Batches, o Claude Opus 5 suporta até 300 mil tokens de saída com o cabeçalho beta output-300k-2026-03-24.
  • O comprimento mínimo de prompt armazenável em cache é de 512 tokens. Consulte Cache de prompt.
  • Consulte limites e capacidades programaticamente com a API Models.

Recursos

Orientações de prompting específicas do modelo.

O "effort" (esforço) tem como padrão high no Claude Opus 5 e importa mais do que em modelos anteriores. Escolha um nível por carga de trabalho.

Ativado por padrão. Desativar o pensamento requer esforço high ou inferior.

Claude Opus 5 com menor latência na Claude API (prévia de pesquisa), com preço separado.

Referência

O prompt do sistema que o Claude Opus 5 usa no claude.ai e nos aplicativos Claude.

Avaliações de segurança e decisões de implantação para o Claude Opus 5.

Lista completa de preços, incluindo descontos em lote e tarifas de cache de prompt.

Como funcionam os IDs de modelo, aliases e snapshots fixados.

Status do ciclo de vida e compromissos de desativação para cada modelo Claude.

Was this page helpful?