Claude Platform Docs

Escolhendo o modelo certo

Escolher um modelo Claude significa equilibrar capacidades, velocidade e custo. Este guia aborda as perguntas a fazer, duas maneiras de escolher um modelo inicial e como testar a escolha.

Estabeleça critérios-chave

Ao escolher um modelo Claude, considere avaliar primeiro estes fatores:

  • Capacidades: De quais recursos ou capacidades específicas o modelo precisará para atender às suas necessidades?
  • Velocidade: Com que rapidez o modelo precisa responder em sua aplicação? Claude Opus 5.5, Claude Opus 5, e Claude Opus 4.8 suportam o fast mode (modo rápido, em prévia de pesquisa), que oferece velocidade de saída até 2,5x maior com preço premium.
  • Custo: Qual é o seu orçamento para uso em desenvolvimento e em produção?
  • Esforço: Vários modelos Claude suportam um effort parameter (parâmetro de esforço) que troca inteligência por "latency" (latência) e custo dentro de um único modelo. Ajustar o esforço costuma ser uma alavanca melhor do que trocar de modelo. No Claude Fable 5.1 e no Claude Opus 5, comece com o padrão (high) e ajuste para cima ou para baixo com base em suas "evals" (avaliações). No Claude Opus 5.5, o padrão é medium; comece por aí e ajuste da mesma forma. No Claude Opus 4.8 e no Claude Opus 4.7, o nível de esforço xhigh, entre high e max, é a melhor configuração para a maioria dos casos de uso de codificação e agênticos.

Escolha o melhor modelo para começar

Existem duas abordagens gerais que você pode usar para começar a testar qual modelo Claude funciona melhor para as suas necessidades.

Opção 1: Comece priorizando a eficiência

Para muitas aplicações, começar com um modelo mais rápido e econômico como o Claude Haiku 4.5 pode ser a abordagem ideal:

  1. Inicie a implementação com o Claude Haiku 4.5.
  2. Teste seu caso de uso minuciosamente.
  3. Avalie se o desempenho atende aos seus requisitos.
  4. Faça upgrade apenas se necessário para lacunas específicas de capacidade.

Essa abordagem permite iteração rápida, custos de desenvolvimento mais baixos e costuma ser suficiente para muitas aplicações comuns. Essa abordagem é melhor para:

  • Prototipagem e desenvolvimento iniciais
  • Aplicações com requisitos rígidos de "latency" (latência)
  • Implementações sensíveis a custo
  • Tarefas simples e de alto volume

Opção 2: Comece priorizando a capacidade

Para tarefas complexas em que inteligência e capacidades avançadas são fundamentais, você pode querer começar priorizando a capacidade: implemente com o ponto de partida mais forte para a sua tarefa e, depois, otimize para modelos mais eficientes ao longo do tempo:

  1. Implemente com o Claude Opus 5.5.
  2. Otimize seus prompts para este modelo.
  3. Avalie se o desempenho atende aos seus requisitos.
  4. Considere aumentar a eficiência reduzindo o esforço ou fazendo downgrade de modelos ao longo do tempo, com maior otimização do fluxo de trabalho.
  5. Se suas avaliações com esforço xhigh ou max ainda ficarem aquém em raciocínio exigente ou em trabalho agêntico de longo horizonte, passe para o Claude Fable 5.1.

Essa abordagem é melhor para:

  • Tarefas de raciocínio complexo
  • Aplicações científicas ou matemáticas
  • Tarefas que exigem compreensão com nuances
  • Aplicações em que a precisão supera as considerações de custo
  • Codificação avançada e trabalho agêntico de alta autonomia

O Claude Opus 5.5 (claude-opus-5-5) foi criado para codificação agêntica de longa duração e trabalho de conhecimento, com o adaptive thinking (pensamento adaptativo) sempre ativado. Se sua integração força o uso de ferramentas (tool_choice do tipo any ou tool), desativa o pensamento ou usa a ferramenta de uso de computador computer_20251124, consulte Mudanças incompatíveis antes de fazer a troca.

O Claude Fable 5.1 (claude-fable-5-1) é o modelo mais capaz da Anthropic aberto a todos os clientes. Ele amplia o Claude Fable 5 com codificação agêntica de longa duração, trabalho de conhecimento e pesquisa mais fortes, pelos mesmos preços de entrada e saída, com leituras de cache a um quarto do custo. O Claude Mythos 5.1 (claude-mythos-5-1) oferece as mesmas capacidades apenas para participantes do Project Glasswing. Ambos os modelos usam pensamento adaptativo sempre ativado. Consulte O que há de novo no Claude Fable 5.1 para mais detalhes.

Para "context windows" (janelas de contexto), limites de saída e preços, consulte a tabela de comparação de modelos.

Matriz de seleção de modelos

A maioria das cargas de trabalho começa com o Claude Opus 5.5.

Quando você precisa de...Considere começar com...Exemplos de casos de uso
A maior capacidade disponívelClaude Fable 5.1Sessões de agente que duram horas, pesquisa aprofundada em várias etapas, análise levada até um documento, planilha ou apresentação finalizados
Programação agêntica complexa e trabalho empresarialClaude Opus 5.5Agentes de programação autônomos que trabalham por várias horas, refatoração em larga escala, engenharia de sistemas complexos, fluxos de trabalho com uso intenso de visão, uso do computador
Velocidade e capacidade para cargas de trabalho cotidianas de programação, agentes e empresariaisClaude Sonnet 5.5Geração de código, análise de dados, criação de conteúdo, compreensão visual, uso de ferramentas agêntico
A menor latência e o menor preço, com "extended thinking" (pensamento estendido)Claude Haiku 4.5Aplicações em tempo real, processamento inteligente de alto volume, implantações sensíveis a custo que precisam de raciocínio forte, tarefas de subagentes

Decida se deve fazer upgrade ou trocar de modelo

Para determinar se você precisa fazer upgrade ou trocar de modelo, você deve:

  1. Criar testes de benchmark específicos para o seu caso de uso — ter um bom conjunto de avaliação é a etapa mais importante do processo.
  2. Testar com seus prompts e dados reais.
  3. Comparar o desempenho entre modelos quanto a:
    • Precisão das respostas
    • Qualidade das respostas
    • Tratamento de casos extremos
  4. Ponderar as compensações entre desempenho e custo.

Combine modelos

Estratégias multimodelo combinam um modelo de menor custo com um modelo de fronteira, de modo que a maioria dos tokens seja cobrada pela tarifa mais baixa. Os dois padrões comuns são um executor que escala decisões difíceis para um conselheiro e um orquestrador que delega o trabalho em massa a trabalhadores de menor custo. Consulte Otimizando para custo e inteligência para ver ambas as estratégias, exemplos medidos e opções de implementação.

Próximos passos

Veja especificações detalhadas e preços dos modelos Claude mais recentes

Criado para raciocínio exigente e trabalho agêntico de longo horizonte

O modelo Opus mais recente: mudanças incompatíveis, novos recursos e diferenças de comportamento

O modelo Sonnet mais recente: mudanças incompatíveis, novos recursos e diferenças de comportamento

Novos recursos e mudanças de comportamento no Claude Sonnet 5

Comece com sua primeira chamada de API

Was this page helpful?