O que há de novo no Claude Opus 5
Visão geral dos novos recursos e mudanças de comportamento no Claude Opus 5.
O Claude Opus 5 é uma melhoria de grande salto em relação ao Claude Opus 4.8, com os maiores ganhos em raciocínio profundo, tarefas agênticas e de longo horizonte, e escalonamento de computação em tempo de teste. Esta página resume tudo o que há de novo no Claude Opus 5, incluindo mudanças de ferramentas no meio da conversa e duas mudanças incompatíveis para código executado no Claude Opus 4.8: o pensamento está ativado por padrão, e o pensamento só pode ser desativado com esforço high ou inferior.
Novo modelo
| Modelo | ID do modelo na API | Descrição |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Para codificação agêntica complexa e trabalho corporativo |
O Claude Opus 5 tem uma "context window" (janela de contexto) de 1M de tokens (1M de tokens é tanto o padrão quanto o máximo; não há variante de contexto menor), 128k de tokens máximos de saída e pensamento ativado por padrão. O Priority Tier não é suportado no Claude Opus 5.
Para preços e especificações completos, consulte a visão geral dos modelos.
Novos recursos
Mudanças de ferramentas no meio da conversa (beta)
Você pode adicionar ou remover ferramentas entre turnos de uma conversa preservando o cache de prompt, em vez de reenviar uma lista fixa de ferramentas durante toda a vida de uma sessão. As mudanças de ferramentas no meio da conversa estão em beta: inclua o cabeçalho beta mid-conversation-tool-changes-2026-07-01 em suas requisições. Consulte Mudanças de ferramentas no meio da conversa para uso.
Modo de fallbacks padrão
O parâmetro fallbacks suporta um novo modo "default", que aplica os modelos de fallback recomendados pela Anthropic por categoria de recusa, em vez de uma lista de modelos que você mesmo mantém. O parâmetro fallbacks inteiro está em beta. Use o cabeçalho beta server-side-fallback-2026-07-01, que suporta tanto o modo "default" quanto listas explícitas de modelos (o cabeçalho anterior server-side-fallback-2026-06-01 aceita apenas listas explícitas). Consulte Recusas e fallback.
Mínimo menor para cache de prompt
O comprimento mínimo de prompt armazenável em cache no Claude Opus 5 é de 512 tokens, abaixo dos 1.024 tokens no Claude Opus 4.8. Prompts que eram curtos demais para serem armazenados em cache no Claude Opus 4.8 agora podem criar entradas de cache sem alterações de código. Consulte "Prompt caching" (cache de prompt) para os mínimos por modelo.
Modo rápido
O "Fast mode" (modo rápido) (prévia de pesquisa) está disponível para o Claude Opus 5 apenas na Claude API; atualmente não está disponível no Amazon Bedrock, Claude Platform na AWS, Google Cloud ou Microsoft Foundry. O modo rápido para o Claude Opus 5 tem preço de $10 USD por milhão de tokens de entrada e $50 USD por milhão de tokens de saída. Consulte Modo rápido para acesso, modelos suportados e preços.
Mudanças de comportamento
Pensamento ativado por padrão
No Claude Opus 4.8, as requisições são executadas sem pensamento, a menos que você defina thinking: {"type": "adaptive"}. No Claude Opus 5, as mesmas requisições são executadas com "adaptive thinking" (pensamento adaptativo) ativado por padrão: o modelo decide quando e quanto pensar em cada turno, e o parâmetro effort é o controle da profundidade do pensamento. O valor transmitido não muda; thinking: {"type": "adaptive"} continua válido e equivalente ao padrão.
Esta é uma mudança incompatível para código que era executado sem pensamento no Claude Opus 4.8. Uma resposta pode começar com um ou mais blocos thinking antes do primeiro bloco text, retornados com um campo thinking vazio no padrão display: "omitted", portanto código que lê content[0].text ou trata o primeiro bloco de conteúdo transmitido por streaming como texto deve, em vez disso, selecionar blocos de conteúdo pelo campo type. Loops de uso de ferramentas devem devolver os blocos thinking completos e sem modificações junto com seus resultados de ferramentas; consulte Preservando blocos de pensamento.
Os tokens de pensamento são cobrados como tokens de saída e contam para max_tokens, um limite rígido sobre a saída total (pensamento mais texto de resposta), portanto revise max_tokens e refaça a linha de base de custo para cargas de trabalho que eram executadas sem pensamento no Claude Opus 4.8.
A API mantém a opção de desativar o pensamento, sujeita à restrição de esforço para desativá-lo.
O esforço importa mais
O Claude Opus 5 converte "effort" (esforço) adicional em melhores resultados de forma mais confiável do que qualquer modelo Opus anterior, portanto o nível de esforço que você escolhe tem mais peso. A escala completa está disponível: low, medium, high, xhigh e max, com max como o nível mais alto para o raciocínio mais profundo possível. Comece no padrão, high, e ajuste em qualquer direção com base em suas avaliações: reduza onde a qualidade se mantém para economizar tokens e latência, ou aumente para os trabalhos mais exigentes. Ao executar com esforço xhigh ou max, defina um max_tokens grande para que o modelo tenha espaço para pensar e agir entre subagentes e chamadas de ferramentas.
Esta requisição eleva o esforço ao máximo, max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)O pensamento está ativado por padrão no Claude Opus 5, portanto nenhum campo thinking é necessário.
Desativar o pensamento requer esforço high ou inferior
No Claude Opus 5, thinking: {"type": "disabled"} é aceito apenas quando o nível de esforço é high ou inferior. Definir thinking: {"type": "disabled"} com esforço xhigh ou max retorna um erro 400. Esta regra é aplicada em todas as requisições ao Claude Opus 5 e modelos posteriores. É uma mudança incompatível em relação ao Claude Opus 4.8, onde desativar o pensamento era independente do nível de esforço. Se suas requisições ao Claude Opus 4.8 desativam o pensamento com esforço xhigh ou max, mantenha o pensamento desativado e defina o esforço como high ou inferior, ou mantenha o nível de esforço e remova o campo thinking.
Com o pensamento desativado, o Claude Opus 5 pode ocasionalmente escrever uma chamada de ferramenta em sua saída de texto em vez de emitir um bloco tool_use, ou incluir tags XML internas em sua resposta visível. Sempre que possível, mantenha o pensamento ativado e controle o custo de tokens com níveis de esforço mais baixos; para integrações que precisam manter o pensamento desativado, consulte Executando com o pensamento desativado para mitigações via prompt.
Diferenças de comportamento do modelo
Além dessas mudanças na API, o Claude Opus 5 se comporta de forma diferente do Claude Opus 4.8 de maneiras que você pode notar sem alterar nenhum código. As respostas padrão voltadas ao usuário e os entregáveis escritos são mais longos. Em sessões agênticas, o modelo narra seu progresso ao usuário com mais frequência. Em frameworks multiagente, ele delega a subagentes com mais facilidade. Ele também verifica seu próprio trabalho sem que lhe seja pedido, portanto remova instruções de verificação herdadas de modelos anteriores ("inclua uma etapa final de verificação", "use um subagente para verificar"); elas causam verificação excessiva no Claude Opus 5. Para padrões de prompt que ajustam cada um desses comportamentos, consulte Criando prompts para o Claude Opus 5.
Melhorias de capacidade
Em comparação com o Claude Opus 4.8, o Claude Opus 5 é uma melhoria de grande salto em vez de incremental, e oferece inteligência de fronteira pela metade do custo do Claude Fable 5. Os maiores ganhos estão em:
- Raciocínio profundo, sustentando análises de múltiplas etapas ao longo de longas cadeias de problemas.
- Codificação agêntica e tarefas de longo horizonte, mantendo-se na tarefa ao longo de loops estendidos de uso de ferramentas e concluindo funcionalidades de múltiplos arquivos, refatorações maiores e trabalho de funcionalidades de ponta a ponta sem deixar stubs ou placeholders.
- Escalonamento de computação em tempo de teste, convertendo esforço adicional (até o nível
max) em melhores resultados. - Eficiência em níveis de esforço mais baixos, com esforço
lowemediumproduzindo alta qualidade com uma fração dos tokens e da latência das configurações mais altas. - Revisão de código e detecção de bugs, revelando bugs reais a uma alta taxa por passagem com poucos falsos positivos, e mantendo a precisão em níveis de esforço mais baixos.
- Visão, compreendendo gráficos, documentos e diagramas e replicando visuais de UI e frontend, com melhor desempenho quando recebe ferramentas para analisar, recortar e verificar seu trabalho iterativamente.
- Trabalho com contexto longo, com uma janela de contexto de 1M de tokens como padrão e máximo, e seguimento de instruções, chamada de ferramentas e raciocínio consistentes ao longo de toda a janela.
- Tarefas de escritório e documentos, gerando e editando planilhas complexas de múltiplas abas com fórmulas não triviais, e produzindo apresentações de slides bem estruturadas.
- Coordenação multiagente, executando equipes de subagentes com padrões eficazes de escritor-verificador e poucos casos de agentes sobrescrevendo o trabalho uns dos outros.
Para os padrões de prompt que extraem o máximo dessas capacidades, consulte Criando prompts para o Claude Opus 5.
Preços
O Claude Opus 5 tem preço de $5 USD por milhão de tokens de entrada e $25 USD por milhão de tokens de saída, sem alteração em relação ao Claude Opus 4.8. Como o pensamento está ativado por padrão e os tokens de pensamento são cobrados como tokens de saída, uma carga de trabalho que era executada sem pensamento no Claude Opus 4.8 pode produzir mais tokens de saída por requisição às mesmas taxas por token; consulte Controle de custos.
Consulte Preços para preços completos, incluindo taxas de processamento em lote, cache de prompt e modo rápido.
Disponibilidade
O Claude Opus 5 está disponível em:
- Claude API: disponível para todos os clientes, como
claude-opus-5. - AWS: disponível através do Claude no Amazon Bedrock, como
anthropic.claude-opus-5, e através da Claude Platform na AWS. No Amazon Bedrock, o Claude Opus 5 também é acessível através da APIInvokeModelembedrock-runtime, servida pela mesma infraestrutura; a integração Claude no Amazon Bedrock (legado) não o inclui em sua tabela de IDs de modelo versionados por ARN. - Google Cloud: disponível através do Claude no Google Cloud, como
claude-opus-5. - Microsoft Foundry: disponível através do Claude no Microsoft Foundry.
O Claude Opus 4.8 permanece disponível em todas essas plataformas.
Guia de migração
Para migrar do Claude Opus 4.8, atualize seu ID de modelo:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterEm seguida, revise as duas mudanças incompatíveis em Mudanças de comportamento: o pensamento está ativado por padrão (as respostas podem começar com blocos thinking, portanto selecione blocos de conteúdo por type), e desativar o pensamento com esforço xhigh ou max retorna um erro 400. Consulte o guia de migração para instruções passo a passo e a lista de verificação completa.
Próximos passos
Especificações e preços completos para todos os modelos Claude atuais.
Diferenças de comportamento e padrões de prompt específicos do Claude Opus 5.
Controle quantos tokens o Claude usa ao responder, de low a max.
Como o pensamento funciona quando está ativado por padrão, e quando pode ser desativado.
Dê ao Claude um orçamento de tokens consultivo para que ele regule o ritmo do seu trabalho.
Guia para migrar para os modelos Claude mais recentes a partir de versões anteriores do Claude.
Obtenha mais tokens de saída por segundo dos modelos Claude Opus a preços premium.
Was this page helpful?