Escolhendo o modelo certo
Escolher um modelo Claude significa equilibrar capacidades, velocidade e custo. Este guia aborda as perguntas a fazer, duas maneiras de escolher um modelo inicial e como testar a escolha.
Estabeleça critérios-chave
Ao escolher um modelo Claude, considere avaliar primeiro estes fatores:
- Capacidades: De quais recursos ou capacidades específicas o modelo precisará para atender às suas necessidades?
- Velocidade: Com que rapidez o modelo precisa responder em sua aplicação? Claude Opus 5.5, Claude Opus 5, e Claude Opus 4.8 suportam o fast mode (modo rápido, em prévia de pesquisa), que oferece velocidade de saída até 2,5x maior com preço premium.
- Custo: Qual é o seu orçamento para uso em desenvolvimento e em produção?
- Esforço: Vários modelos Claude suportam um effort parameter (parâmetro de esforço) que troca inteligência por "latency" (latência) e custo dentro de um único modelo. Ajustar o esforço costuma ser uma alavanca melhor do que trocar de modelo. No Claude Fable 5.1 e no Claude Opus 5, comece com o padrão (
high) e ajuste para cima ou para baixo com base em suas "evals" (avaliações). No Claude Opus 5.5, o padrão émedium; comece por aí e ajuste da mesma forma. No Claude Opus 4.8 e no Claude Opus 4.7, o nível de esforçoxhigh, entrehighemax, é a melhor configuração para a maioria dos casos de uso de codificação e agênticos.
Escolha o melhor modelo para começar
Existem duas abordagens gerais que você pode usar para começar a testar qual modelo Claude funciona melhor para as suas necessidades.
Opção 1: Comece priorizando a eficiência
Para muitas aplicações, começar com um modelo mais rápido e econômico como o Claude Haiku 4.5 pode ser a abordagem ideal:
- Inicie a implementação com o Claude Haiku 4.5.
- Teste seu caso de uso minuciosamente.
- Avalie se o desempenho atende aos seus requisitos.
- Faça upgrade apenas se necessário para lacunas específicas de capacidade.
Essa abordagem permite iteração rápida, custos de desenvolvimento mais baixos e costuma ser suficiente para muitas aplicações comuns. Essa abordagem é melhor para:
- Prototipagem e desenvolvimento iniciais
- Aplicações com requisitos rígidos de "latency" (latência)
- Implementações sensíveis a custo
- Tarefas simples e de alto volume
Opção 2: Comece priorizando a capacidade
Para tarefas complexas em que inteligência e capacidades avançadas são fundamentais, você pode querer começar priorizando a capacidade: implemente com o ponto de partida mais forte para a sua tarefa e, depois, otimize para modelos mais eficientes ao longo do tempo:
- Implemente com o Claude Opus 5.5.
- Otimize seus prompts para este modelo.
- Avalie se o desempenho atende aos seus requisitos.
- Considere aumentar a eficiência reduzindo o esforço ou fazendo downgrade de modelos ao longo do tempo, com maior otimização do fluxo de trabalho.
- Se suas avaliações com esforço
xhighoumaxainda ficarem aquém em raciocínio exigente ou em trabalho agêntico de longo horizonte, passe para o Claude Fable 5.1.
Essa abordagem é melhor para:
- Tarefas de raciocínio complexo
- Aplicações científicas ou matemáticas
- Tarefas que exigem compreensão com nuances
- Aplicações em que a precisão supera as considerações de custo
- Codificação avançada e trabalho agêntico de alta autonomia
O Claude Opus 5.5 (claude-opus-5-5) foi criado para codificação agêntica de longa duração e trabalho de conhecimento, com o adaptive thinking (pensamento adaptativo) sempre ativado. Se sua integração força o uso de ferramentas (tool_choice do tipo any ou tool), desativa o pensamento ou usa a ferramenta de uso de computador computer_20251124, consulte Mudanças incompatíveis antes de fazer a troca.
O Claude Fable 5.1 (claude-fable-5-1) é o modelo mais capaz da Anthropic aberto a todos os clientes. Ele amplia o Claude Fable 5 com codificação agêntica de longa duração, trabalho de conhecimento e pesquisa mais fortes, pelos mesmos preços de entrada e saída, com leituras de cache a um quarto do custo. O Claude Mythos 5.1 (claude-mythos-5-1) oferece as mesmas capacidades apenas para participantes do Project Glasswing. Ambos os modelos usam pensamento adaptativo sempre ativado. Consulte O que há de novo no Claude Fable 5.1 para mais detalhes.
Para "context windows" (janelas de contexto), limites de saída e preços, consulte a tabela de comparação de modelos.
Matriz de seleção de modelos
A maioria das cargas de trabalho começa com o Claude Opus 5.5.
| Quando você precisa de... | Considere começar com... | Exemplos de casos de uso |
|---|---|---|
| A maior capacidade disponível | Claude Fable 5.1 | Sessões de agente que duram horas, pesquisa aprofundada em várias etapas, análise levada até um documento, planilha ou apresentação finalizados |
| Programação agêntica complexa e trabalho empresarial | Claude Opus 5.5 | Agentes de programação autônomos que trabalham por várias horas, refatoração em larga escala, engenharia de sistemas complexos, fluxos de trabalho com uso intenso de visão, uso do computador |
| Velocidade e capacidade para cargas de trabalho cotidianas de programação, agentes e empresariais | Claude Sonnet 5.5 | Geração de código, análise de dados, criação de conteúdo, compreensão visual, uso de ferramentas agêntico |
| A menor latência e o menor preço, com "extended thinking" (pensamento estendido) | Claude Haiku 4.5 | Aplicações em tempo real, processamento inteligente de alto volume, implantações sensíveis a custo que precisam de raciocínio forte, tarefas de subagentes |
Decida se deve fazer upgrade ou trocar de modelo
Para determinar se você precisa fazer upgrade ou trocar de modelo, você deve:
- Criar testes de benchmark específicos para o seu caso de uso — ter um bom conjunto de avaliação é a etapa mais importante do processo.
- Testar com seus prompts e dados reais.
- Comparar o desempenho entre modelos quanto a:
- Precisão das respostas
- Qualidade das respostas
- Tratamento de casos extremos
- Ponderar as compensações entre desempenho e custo.
Combine modelos
Estratégias multimodelo combinam um modelo de menor custo com um modelo de fronteira, de modo que a maioria dos tokens seja cobrada pela tarifa mais baixa. Os dois padrões comuns são um executor que escala decisões difíceis para um conselheiro e um orquestrador que delega o trabalho em massa a trabalhadores de menor custo. Consulte Otimizando para custo e inteligência para ver ambas as estratégias, exemplos medidos e opções de implementação.
Próximos passos
Veja especificações detalhadas e preços dos modelos Claude mais recentes
Criado para raciocínio exigente e trabalho agêntico de longo horizonte
O modelo Opus mais recente: mudanças incompatíveis, novos recursos e diferenças de comportamento
O modelo Sonnet mais recente: mudanças incompatíveis, novos recursos e diferenças de comportamento
Novos recursos e mudanças de comportamento no Claude Sonnet 5
Comece com sua primeira chamada de API
Was this page helpful?