Claude Platform Docs
Modelos e preçosModelos

Claude Opus 5.5Latest

For long-running agentic coding and knowledge work

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$4/ MTok
Output pricing
$20/ MTok

Visão geral

O Claude Opus 5.5 foi criado para codificação agêntica de longa duração e trabalho de conhecimento, com preço de $4 / $20 USD por milhão de tokens de entrada / saída. Quatro "breaking changes" (mudanças incompatíveis) afetam código que já roda no Claude Opus 5: o pensamento não pode ser desativado, o uso forçado de ferramentas retorna um erro, os blocos de pensamento estão vinculados ao modelo e à conversa e, na Claude API e no Google Cloud, a ferramenta anterior de "computer use" (uso de computador) computer_20251124 não é aceita. As três primeiras também se aplicam ao Claude Fable 5.1. Outra mudança altera o formato da resposta sem fazer nenhuma requisição falhar: o texto entre chamadas de ferramentas volta em blocos thinking, cujo texto fica vazio na configuração padrão de display. Uma aplicação que faz streaming desse texto para seus usuários como atualizações de progresso fica em silêncio entre as chamadas de ferramentas até definir um valor de display que retorne o texto.

O que há de novo no Claude Opus 5.5

Como ele se compara

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.5This model1M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 51M128K$2 / $10FastAdaptivehighJan 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtendedFeb 2025

Especificações

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$4 / MTok
Output
$20 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output
Full price list
Pricing

Capabilities

Max output
128K tokens
Thinking
Adaptive (always on)
Comparative latency
Moderate
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 22, 2026
Retirement
Not sooner than September 22, 2027

Bom saber

  • O "adaptive thinking" (pensamento adaptativo) está sempre ativado e não pode ser desativado. Controle a profundidade do pensamento com o parâmetro effort.
  • Na Message Batches API, o Claude Opus 5.5 suporta até 300 mil tokens de saída com o cabeçalho beta output-300k-2026-03-24.
  • O comprimento mínimo de prompt armazenável em cache é de 512 tokens. Consulte Cache de prompt.
  • Consulte limites e capacidades programaticamente com a Models API.

Recursos

Diferenças de comportamento e padrões de prompt específicos do Claude Opus 5.5.

O controle da profundidade do pensamento, da "latency" (latência) e do custo. Escolha um nível por carga de trabalho.

Como o pensamento adaptativo funciona e como os blocos de pensamento são preservados.

Claude Opus 5.5 com menor latência na Claude API (prévia de pesquisa), com preço separado.

Referência

O prompt do sistema que o Claude Opus 5.5 usa no claude.ai e nos aplicativos Claude.

Avaliações de segurança e decisões de implantação para o Claude Opus 5.5.

Lista completa de preços, incluindo descontos em lote e tarifas de cache de prompt.

Como funcionam os IDs de modelo, aliases e snapshots fixados.

Status do ciclo de vida e compromissos de desativação para cada modelo Claude.

Was this page helpful?