Claude Platform Docs
Modelos e preçosClaude Opus 5.5

O que há de novo no Claude Opus 5.5

Visão geral das mudanças incompatíveis, do suporte a recursos e das diferenças de comportamento no Claude Opus 5.5.

O Claude Opus 5.5 foi criado para codificação agêntica de longa duração e trabalho de conhecimento, com preço de $4 / $20 USD por milhão de tokens de entrada / saída. Quatro "breaking changes" (mudanças incompatíveis) afetam código que já roda no Claude Opus 5: o pensamento não pode ser desativado, o uso forçado de ferramentas retorna um erro, os blocos de pensamento estão vinculados ao modelo e à conversa e, na Claude API e no Google Cloud, a ferramenta anterior de "computer use" (uso de computador) computer_20251124 não é aceita. As três primeiras também se aplicam ao Claude Fable 5.1. Outra mudança altera o formato da resposta sem fazer nenhuma requisição falhar: o texto entre chamadas de ferramentas volta em blocos thinking, cujo texto fica vazio na configuração padrão de display. Uma aplicação que faz streaming desse texto para seus usuários como atualizações de progresso fica em silêncio entre as chamadas de ferramentas até definir um valor de display que retorne o texto.

Novo modelo

ModeloID na Claude APIDescrição
Claude Opus 5.5Para codificação agêntica de longa duração e trabalho de conhecimento

O pensamento adaptativo está sempre ativado, e o parâmetro effort controla a profundidade do pensamento; seu padrão neste modelo é medium. Para a "context window" (janela de contexto), os limites de saída, a data de corte do conhecimento e os preços, consulte a página do modelo Claude Opus 5.5; para todos os modelos atuais, consulte a visão geral dos modelos.

Mudanças incompatíveis

O pensamento não pode ser desativado

No Claude Opus 5, o pensamento fica ativado por padrão e thinking: {"type": "disabled"} é aceito com esforço high ou inferior. No Claude Opus 5.5, o pensamento está sempre ativado: uma requisição que define thinking: {"type": "disabled"}, ou um orçamento manual com thinking: {"type": "enabled", "budget_tokens": N}, retorna um erro 400 invalid_request_error. Omita o campo thinking ou envie thinking: {"type": "adaptive"}, que é equivalente. Nenhum cabeçalho beta está envolvido.

As mensagens de erro são:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
"thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

O parâmetro effort é o controle da profundidade do pensamento, da "latency" (latência) e do custo: reduza-o onde você antes desativava o pensamento; Otimizando para custo e inteligência traz resultados medidos para escolher um nível. Como toda resposta pode começar com um ou mais blocos thinking (retornados com um campo thinking vazio no padrão display: "omitted"), selecione os blocos de conteúdo pelo campo type em vez de pela posição, e devolva os blocos thinking sem modificações em loops de "tool use" (uso de ferramentas). Código que já roda no Claude Opus 5 com o pensamento ativado não precisa de alterações. Consulte Pensamento e o antes e depois do guia de migração.

O uso forçado de ferramentas não é suportado

O Claude Opus 5.5 não suporta "forced tool use" (uso forçado de ferramentas). tool_choice definido como {"type": "any"} ou {"type": "tool", "name": "..."} retorna um erro 400 invalid_request_error:

tool_choice: type "tool" and "any" are not supported for this model.

tool_choice: {"type": "auto"} (o padrão) e {"type": "none"} são suportados, e a mesma validação se aplica ao endpoint de contagem de tokens. Para JSON válido segundo o schema, mantenha tool_choice: {"type": "auto"} e defina strict: true com o uso estrito de ferramentas, ou mova o schema para saídas estruturadas. Para fazer o modelo chamar uma ferramenta em vez de responder em texto, diga no prompt quando a ferramenta se aplica. O guia de migração mostra o antes e depois.

Os blocos de pensamento estão vinculados ao modelo e à conversa

Cada bloco de pensamento registra qual modelo o produziu, e cada modelo lê seus próprios blocos e apenas os de alguns outros modelos. O Claude Opus 5.5 lê blocos de pensamento do Claude Opus 5 e de modelos Opus, Sonnet e Haiku anteriores, mas não de modelos Claude Fable ou Claude Mythos. Na Claude API, o Claude Fable 5.1 e o Claude Mythos 5.1 leem blocos de pensamento do Claude Opus 5.5; nenhum outro modelo faz isso. Uma conversa que passa do Claude Opus 5 para o Claude Opus 5.5, ou do Claude Opus 5.5 para o Claude Fable 5.1 ou o Claude Mythos 5.1 na Claude API, mantém seu raciocínio. Uma conversa que passa do Claude Opus 5.5 para qualquer modelo além desses dois, ou que chega a ele vinda de um modelo Claude Fable ou Claude Mythos, executa os turnos após a troca sem o raciocínio do modelo anterior. Quando uma requisição contém um bloco que o modelo de destino não consegue ler, a API o descarta antes que o modelo o veja: a requisição é bem-sucedida, e os blocos descartados não são cobrados. Com o cabeçalho beta thinking-binding-controls-2026-08-01, o descarte é informado em um array input_transformations de nível superior. Consulte Trocar de modelo no meio da conversa.

A API também verifica se algo antes de um bloco de pensamento do Claude Opus 5.5 (o prompt system, as tools ou uma mensagem anterior) mudou desde que o bloco foi produzido. Assim como no Claude Fable 5.1, ela aplica essa verificação por padrão para contas criadas em ou após 31 de agosto de 2026, 00:00 UTC, na Claude API e nas plataformas de nuvem. Nessas contas, uma requisição que reenvia um bloco após uma mudança desse tipo retorna um erro 400. Para descartar os blocos afetados em vez disso, envie o cabeçalho beta thinking-binding-controls-2026-08-01 e defina thinking.block_binding.prefix_mismatch_behavior como "drop_block". Em contas mais antigas, definir esse campo com qualquer um dos valores ativa a verificação para a requisição. Mantenha a conversa apenas com acréscimos para que a questão nunca surja: altere instruções ou ferramentas com mensagens do sistema no meio da conversa em vez de edições. Consulte Pensamento preservado e a nota sobre essa mudança no guia de migração.

A ferramenta de uso de computador computer_20251124 não é suportada na Claude API e no Google Cloud

O Claude Opus 5 aceita o uso de computador tanto como o toolset computer_toolset_20260801 quanto, com o cabeçalho beta computer-use-2025-11-24, como a ferramenta anterior computer_20251124. Na Claude API e no Google Cloud, o Claude Opus 5.5 suporta apenas o toolset: uma requisição que declara uma ferramenta computer_20251124 retorna um erro 400 invalid_request_error. A mensagem nomeia o tipo rejeitado e, em seguida, lista os tipos de ferramenta que o modelo aceita (entre eles computer_toolset_20260801) após Did you mean one of; ela começa assim:

'claude-opus-5-5' does not support tool types: computer_20251124.

Para migrar uma integração existente na Claude API ou no Google Cloud, siga Migrar de computer_20251124: remova o cabeçalho beta, substitua a entrada em tools por {"type": "computer_toolset_20260801"} e atualize o loop do seu agente para blocos tool_use de membros, ações em lote e toolset_name nos resultados. No Amazon Bedrock, a ferramenta anterior computer_20251124 continua funcionando no Claude Opus 5.5 como funciona no Claude Opus 5, então nenhuma alteração é necessária lá. Para outras plataformas, consulte a seção Compatibilidade da ferramenta de uso de computador. Integrações que já usam o toolset, e a ferramenta de uso do navegador, não precisam de alterações. O guia de migração mostra a requisição antes e depois.

Suporte a recursos

O Claude Opus 5.5 suporta esforço por mensagem (beta), mensagens do sistema no meio da conversa, orçamentos de tarefa, "prompt caching" (cache de prompt) com um prompt mínimo armazenável em cache de 512 tokens, processamento em lote, a Files API, suporte a PDF, visão e ferramentas do lado do servidor e do lado do cliente. Na Claude API e no Google Cloud, o uso de computador exige o toolset computer_toolset_20260801 (consulte a mudança incompatível). Consulte a página de cada recurso para ver a disponibilidade por modelo.

Modo rápido

O modo rápido (prévia de pesquisa) está disponível para o Claude Opus 5.5 apenas na Claude API; ele não está disponível no Amazon Bedrock, no Claude Platform on AWS, no Google Cloud nem no Microsoft Foundry. Defina speed: "fast" com o cabeçalho beta fast-mode-2026-02-01. Consulte Modo rápido para acesso, modelos suportados e preços.

Definir ferramentas em uma mensagem (beta)

Com o cabeçalho beta inline-tools-2026-09-15, um bloco tool_addition em uma mensagem do sistema no meio da conversa pode conter uma definição completa de ferramenta em vez de uma referência, para que você possa adicionar uma ferramenta, alterar seu schema ou mover uma ferramenta de servidor para uma versão mais recente no meio da conversa sem editar tools e sem perder o cache de prompt. Isso funciona em todos os modelos que suportam alterações de ferramentas no meio da conversa, incluindo o Claude Opus 5.5. Consulte Definir ferramentas em uma mensagem.

Compactação sob demanda (beta)

Com o cabeçalho beta compact-2026-09-04, uma requisição que envia o parâmetro de nível superior compaction retorna um bloco compaction assinado que resume toda a conversa, o qual você então envia primeiro no lugar das mensagens resumidas. Ele está disponível nos modelos que suportam compactação, incluindo o Claude Opus 5.5. Você escolhe quando compactar, a requisição pode ser executada em segundo plano, e os blocos de pensamento nos turnos que você mantém podem continuar válidos após a substituição (nas condições descritas em Compactação e pensamento preservado), o que é importante no Claude Opus 5.5 porque seus blocos de pensamento estão vinculados à conversa. Consulte Compactação sob demanda para a disponibilidade por plataforma e o fluxo completo da requisição.

Diferenças de comportamento

O Claude Opus 5.5 difere do Claude Opus 5 de várias maneiras que aparecem sem nenhuma alteração de código. Cada uma tem orientações em Criando prompts para o Claude Opus 5.5:

  • O esforço padrão é medium. Uma requisição que omite effort é executada em medium; no Claude Opus 5, era executada em high. Defina effort explicitamente e execute novamente sua varredura; consulte Calibre o effort.
  • Mais pensamento por turno em um determinado nível de esforço. Com a mesma configuração de esforço, o modelo tende a pensar mais por turno do que o Claude Opus 5, principalmente em xhigh e max. Execute novamente sua varredura de esforço em vez de reaproveitar uma configuração, e deixe espaço em max_tokens para o pensamento. Consulte Calibre o effort.
  • O texto entre chamadas de ferramentas volta em blocos de pensamento. As notas curtas que o modelo escreve entre chamadas de ferramentas chegam como blocos thinking de atualização de progresso em vez de blocos text, então, no padrão display: "omitted", uma aplicação que faz streaming delas para seus usuários fica em silêncio entre as chamadas de ferramentas, sem nenhum erro. O guia de migração traz a correção para recebê-las, e Atualizações de progresso voltadas ao usuário explica como pedir mais delas.
  • Mais categorias de salvaguarda. O modelo executa um classificador de segurança de biologia além do de cibersegurança, e requisições que o pressionam a reproduzir seu raciocínio interno no texto da resposta podem ser recusadas com a categoria reasoning_extraction. Consulte Recusas e fallback e Recusas de salvaguardas.
  • Leitura mais precisa de gráficos, diagramas e capturas de tela. O modelo lê valores em gráficos densos e em elementos visuais dependentes de layout com muito mais precisão sem ferramentas, então soluções alternativas de visão no prompt criadas para modelos anteriores podem não ser mais necessárias; ferramentas de imagem ainda aumentam a precisão nas entradas mais densas. Consulte Ferramentas para entradas visuais complexas.

Se sua integração com o Claude Opus 5 era executada com o pensamento desativado, consulte Prompts escritos para pensamento desativado junto com a mudança incompatível. Para os ganhos de capacidade em codificação agêntica e revisão de código, trabalho de conhecimento, comunicação, entradas visuais e uso de computador, consulte Capacidades relevantes para prompts.

Recusas e fallback

O Claude Opus 5.5 vem com classificadores de segurança, e tudo em Recusas e fallback se aplica. Uma requisição recusada retorna HTTP 200 com stop_reason: "refusal" e um objeto stop_details que nomeia a área da política, então trate as recusas e configure o "fallback" (alternativa de contingência): tente novamente em outro modelo com o fallback do lado do servidor (fallbacks: "default", em beta, tenta novamente no modelo que a Anthropic recomenda para aquela categoria), o middleware do SDK ou sua própria lógica de nova tentativa.

Preços

O Claude Opus 5.5 custa $4 USD por milhão de tokens de entrada e $20 USD por milhão de tokens de saída, abaixo dos $5 e $25 do Claude Opus 5, com gravações em cache de 5 minutos a $5, gravações em cache de 1 hora a $8 e leituras de cache a $0,20 por milhão de tokens (0,05x o preço base de entrada). O processamento em lote custa metade do preço: $2 e $10. Consulte Preços para residência de dados e preços de ferramentas.

Disponibilidade

O Claude Opus 5.5 está disponível em:

Migrar do Claude Opus 5

Atualize o ID do seu modelo:

model = "claude-opus-5"  # Before
model = "claude-opus-5-5"  # After

Em seguida, remova quaisquer configurações thinking: {"type": "disabled"} ou thinking: {"type": "enabled", ...} e escolha um nível de esforço em vez disso. Substitua os tipos any e tool de tool_choice por auto mais o uso estrito de ferramentas. Se você usa a ferramenta de uso de computador por meio de computer_20251124 na Claude API ou no Google Cloud, migre para o toolset. Se sua interface exibe o texto entre chamadas de ferramentas, defina também thinking.display; consulte O texto entre chamadas de ferramentas é retornado em blocos de pensamento. Consulte o guia de migração para instruções passo a passo a partir do Claude Opus 5 e de modelos anteriores, além da lista de verificação completa.

Próximos passos

Especificações completas e preços de todos os modelos Claude atuais.

Migre código do Claude Opus 5 e de modelos anteriores para o Claude Opus 5.5.

Diferenças de comportamento e padrões de prompt específicos do Claude Opus 5.5.

Controle quantos tokens o Claude usa ao responder, de low a max.

Como o pensamento adaptativo funciona e como os blocos de pensamento são preservados.

Trate stop_reason: "refusal" e tente novamente em outro modelo.

Was this page helpful?