Prompting do Claude Sonnet 5
Diferenças comportamentais e padrões de prompting para o Claude Sonnet 5, abrangendo esforço, padrões de pensamento adaptativo, uso de ferramentas e migração a partir do Claude Sonnet 4.6.
Este guia aborda os padrões de prompting específicos do Claude Sonnet 5. Para as capacidades do modelo e mudanças na API, consulte O que há de novo no Claude Sonnet 5. Para técnicas que se aplicam a todos os modelos Claude atuais, consulte Melhores práticas de prompting.
O Claude Sonnet 5 tem pontos fortes particulares em tarefas de codificação e agênticas. Ele tem bom desempenho imediato com prompts existentes do Claude Sonnet 4.6. Os padrões neste guia abrangem os comportamentos que mais frequentemente exigem ajustes.
Comprimento da resposta e verbosidade
O Claude Sonnet 5 calibra o comprimento da resposta de acordo com a complexidade da tarefa, em vez de adotar por padrão uma verbosidade fixa. Isso geralmente significa respostas mais curtas em consultas simples e mais longas em análises abertas.
Se o seu produto depende de um determinado estilo ou verbosidade de saída, talvez você precise ajustar seus prompts. Como exemplo, para diminuir a verbosidade, você pode adicionar:
Provide concise, focused responses. Skip non-essential context, and keep examples minimal.Se você observar tipos específicos de verbosidade (como explicações excessivas), pode adicionar instruções adicionais ao seu prompt para evitá-los. Exemplos positivos mostrando como o Claude pode se comunicar com o nível apropriado de concisão tendem a ser mais eficazes do que exemplos negativos ou instruções que dizem ao modelo o que não fazer.
Calibrando o esforço e a profundidade do pensamento
O parâmetro effort (esforço) permite que você ajuste a inteligência do Claude em relação ao gasto de tokens, trocando capacidade por maior velocidade e custos mais baixos. No Claude Sonnet 5, o esforço tem como padrão high, o mesmo que no Claude Sonnet 4.6. Para as tarefas de codificação e agênticas mais difíceis, aumente o esforço para xhigh. Experimente outros níveis de esforço para ajustar ainda mais o uso de tokens e a inteligência:
max: Capacidade máxima absoluta, sem restrições ao gasto de tokens.xhigh: Esforço extra alto é a configuração recomendada para os casos de uso de codificação e agênticos mais difíceis.high: O padrão. Esta configuração equilibra o uso de tokens e a inteligência para a maioria dos casos de uso.medium: Bom para casos de uso sensíveis a custo que precisam reduzir o uso de tokens em troca de inteligência.low: Reserve para tarefas curtas e delimitadas e cargas de trabalho sensíveis à latência que não sejam sensíveis à inteligência.
Como um mapeamento aproximado entre modelos ao migrar: o Claude Sonnet 5 em medium é comparável em inteligência ao Claude Sonnet 4.6 em high, e o Claude Sonnet 5 em high é comparável ao Claude Sonnet 4.6 em max. Ao fazer benchmarks, compare pelo comprimento de pensamento observado em vez do nome do nível de esforço.
O Claude Sonnet 5 respeita os níveis de esforço rigorosamente, especialmente nos níveis mais baixos. Em low e medium, o modelo delimita seu trabalho ao que foi pedido, em vez de ir além. Isso é bom para latência e custo, mas em tarefas moderadamente complexas executadas com esforço low há algum risco de pensamento insuficiente.
Se você observar raciocínio superficial em problemas complexos, aumente o esforço para high ou xhigh em vez de contornar isso com prompts. Se você precisar manter o esforço em low por causa da latência, adicione orientações direcionadas:
This task involves multistep reasoning. Think carefully through the problem before responding.No Claude Sonnet 5, o adaptive thinking (pensamento adaptativo) está ativado por padrão. Requisições sem um campo thinking são executadas com pensamento adaptativo. Esta é uma mudança em relação ao Claude Sonnet 4.6, onde as mesmas requisições eram executadas sem pensamento. Para desativar o pensamento completamente, passe thinking: {type: "disabled"}. Como max_tokens é um limite rígido sobre a saída total (pensamento mais texto da resposta), revise-o para cargas de trabalho que eram executadas sem pensamento no Claude Sonnet 4.6. Se você usava anteriormente o pensamento desativado com o Claude Sonnet 4.6, experimente o pensamento ativado com níveis de esforço mais baixos no Claude Sonnet 5.
O comportamento de acionamento do pensamento adaptativo é direcionável. Se você perceber que o modelo emite blocos de pensamento com mais frequência do que gostaria, o que pode acontecer com prompts do sistema grandes ou complexos, adicione orientações para direcioná-lo. Como sempre, meça o efeito de quaisquer mudanças de prompting no desempenho. Exemplo:
Thinking adds latency and should only be used when it will meaningfully improve answer quality, typically for problems that require multistep reasoning. When in doubt, respond directly.Por outro lado, se você estiver executando cargas de trabalho difíceis em medium e observando pensamento insuficiente, a primeira alavanca é aumentar o esforço. Se você precisar de um controle mais fino, solicite isso diretamente no prompt.
O "extended thinking" (pensamento estendido) manual (thinking: {type: "enabled", budget_tokens: N}) não é suportado no Claude Sonnet 5 e retorna um erro 400. Ele foi descontinuado no Claude Sonnet 4.6 e agora foi removido. Use o pensamento adaptativo com o parâmetro effort em seu lugar.
Acionamento do uso de ferramentas
O Claude Sonnet 5 é mais agêntico do que o Claude Sonnet 4.6 por padrão e recorrerá a ferramentas e executará ciclos de autoverificação com mais prontidão. Com o pensamento desativado, o modelo tem menos probabilidade de recorrer a ferramentas ou considerar fazer buscas; se você depende de chamadas de ferramentas com o pensamento desativado, adicione um estímulo explícito no prompt do sistema. O esforço também é uma alavanca para o "tool use" (uso de ferramentas): as configurações de esforço high ou xhigh mostram substancialmente mais uso de ferramentas em busca agêntica e codificação. Para cenários em que você deseja mais uso de ferramentas, você também pode ajustar seu prompt para instruir explicitamente o modelo sobre quando e como usar suas ferramentas adequadamente. Por exemplo, se você perceber que o modelo não está usando suas ferramentas de busca na web, descreva claramente por que e como ele deveria usá-las.
Atualizações de progresso voltadas ao usuário
O Claude Sonnet 5 fornece atualizações regulares e de maior qualidade ao usuário ao longo de rastros agênticos longos. Se você adicionou estruturas auxiliares para forçar mensagens de status intermediárias ("Após cada 3 chamadas de ferramentas, resuma o progresso"), experimente removê-las. Se você perceber que o comprimento ou o conteúdo das atualizações voltadas ao usuário do Claude Sonnet 5 não estão bem calibrados para o seu caso de uso, descreva explicitamente no prompt como essas atualizações devem ser e forneça exemplos.
Seguimento de instruções mais literal
O Claude Sonnet 5 interpreta prompts de forma literal e explícita, particularmente em níveis de esforço mais baixos. Ele não generaliza silenciosamente uma instrução de um item para outro e não infere solicitações que você não fez. A vantagem desse literalismo é a precisão, e ele geralmente tem melhor desempenho em casos de uso de API com prompts cuidadosamente ajustados, extração estruturada e pipelines onde você deseja comportamento previsível. Se você precisar que o Claude aplique uma instrução de forma ampla, declare o escopo explicitamente (por exemplo, "Aplique esta formatação a todas as seções, não apenas à primeira").
Tom e estilo de escrita
Como acontece com qualquer novo modelo, o estilo de prosa em textos longos pode mudar. Se o seu produto depende de uma voz específica, reavalie os prompts de estilo em relação à nova linha de base.
Por exemplo, se a voz do seu produto for mais calorosa ou mais conversacional, adicione:
Use a warm, collaborative tone. Acknowledge the user's framing before answering.Se você dependia anteriormente de temperature para variedade estilística, observe que definir temperature, top_p ou top_k com um valor diferente do padrão retorna um erro 400 no Claude Sonnet 5. Essa restrição é nova para modelos da classe Sonnet. Remova esses parâmetros ao migrar e use instruções no prompt do sistema para orientar o tom e a variedade.
Padrões de design e frontend
O Claude Sonnet 5 pode se acomodar em um estilo visual padrão consistente em briefings abertos de frontend e design. Um estilo padrão da casa pode funcionar bem para alguns briefings, mas parecer inadequado para dashboards, ferramentas de desenvolvimento, fintech, saúde ou aplicativos corporativos.
Instruções genéricas ("não use essa cor", "deixe limpo e minimalista") tendem a deslocar o modelo para uma paleta fixa diferente em vez de produzir variedade. Duas abordagens funcionam de forma confiável:
1. Especifique uma alternativa concreta. O modelo segue especificações explícitas com precisão:
Design a desktop landing page for a supplement brand called AEFRM.
The visual direction should come from a cold monochrome atmosphere using pale silver-gray tones that gradually deepen into blue-gray and near-black, similar to a misted metallic surface.
The page should feel sharp and controlled, with a strong sense of structure and restraint.
Use this tonal system across the full page instead of introducing bright accent colors.
Use the uploaded image on the hero design in black and white.
The layout should be built with clear horizontal sections and a centered max-width container. Use 4px corner radius consistently across cards, buttons, inputs, and media frames. Margins should feel generous, with enough empty space around each section so the page breathes.
Typography should use a square, angular sans-serif with wider letter spacing than usual, especially in headings and navigation, so the text feels more engineered and less compressed. Headline text can be large and uppercase, while supporting copy remains short and sparse. The sub texts should be written with Alumni Sans SC in 4-6px like tiny little texts on corners bottom centre like that.
For the structure, start with a hero section containing a strong product statement, one short supporting paragraph, and a clean product placeholder or packshot frame. Below that, add a benefit grid with three or four blocks, then a formulation or ingredients section, and finally a cta.
Buttons should be flat and precise, with subtle hover changes using transition: all 160ms ease out where brightness and border contrast shift slightly rather than using dramatic motion.
Color palette should stay within this range:
#E9ECEC, #C9D2D4, #8C9A9E, #44545B, #11171B.2. Faça o modelo propor opções antes de construir. Isso quebra o padrão e dá controle aos usuários. Como temperature não é aceito no Claude Sonnet 5, essa abordagem é a maneira recomendada de produzir direções de design significativamente diferentes entre execuções. Exemplo de prompt:
Before building, propose 4 distinct visual directions tailored to this brief (each as: bg hex / accent hex / typeface, plus a one-line rationale). Ask the user to pick one, then implement only that direction.Para se afastar de padrões genéricos que os usuários chamam de estética "AI slop", você pode incluir uma diretiva curta no seu prompt do sistema. A skill frontend-design oferece um tratamento mais completo, mas este trecho funciona bem junto com as abordagens de variedade anteriores:
<frontend_aesthetics>
NEVER use generic AI-generated aesthetics like overused font families (Inter, Roboto, Arial, system fonts), cliched color schemes (particularly purple gradients on white or dark backgrounds), predictable layouts and component patterns, and cookie-cutter design that lacks context-specific character. Use unique fonts, cohesive colors and themes, and animations for effects and micro-interactions.
</frontend_aesthetics>Produtos de codificação interativos
O uso de tokens e o comportamento podem diferir entre agentes de codificação autônomos e assíncronos com um único turno do usuário e agentes de codificação interativos e síncronos com múltiplos turnos do usuário. Para maximizar tanto o desempenho quanto a eficiência de tokens em produtos de codificação, use esforço xhigh ou high, adicione recursos autônomos como um modo automático e reduza o número de interações humanas exigidas dos seus usuários.
Ao limitar o número de interações do usuário necessárias, é importante especificar a tarefa, a intenção e as restrições relevantes antecipadamente no primeiro turno humano. Fornecer descrições de tarefas bem especificadas, claras e precisas antecipadamente pode ajudar a maximizar a autonomia e a inteligência, minimizando o uso extra de tokens após os turnos do usuário. Em contraste, prompts ambíguos ou subespecificados transmitidos progressivamente ao longo de múltiplos turnos do usuário tendem a reduzir relativamente a eficiência de tokens e, às vezes, o desempenho.
Harnesses de revisão de código
Se o seu harness de revisão de código foi ajustado para um modelo anterior, você pode inicialmente observar um recall mais baixo no Claude Sonnet 5. Isso provavelmente é um efeito do harness, não uma regressão de capacidade. Quando um prompt de revisão diz coisas como "reporte apenas problemas de alta severidade", "seja conservador" ou "não seja minucioso demais", o Claude Sonnet 5 pode seguir essa instrução com mais fidelidade do que os modelos anteriores: ele pode investigar o código com a mesma profundidade, identificar os bugs e então não reportar descobertas que julgue estar abaixo do critério que você declarou. Isso pode se manifestar como o modelo fazendo a mesma profundidade de investigação, mas convertendo menos investigações em descobertas reportadas, especialmente em bugs de menor severidade. A precisão normalmente aumenta, mas o recall medido pode cair, mesmo que a capacidade subjacente do modelo de encontrar bugs tenha melhorado.
Algumas formulações de prompt recomendadas:
Report every issue you find, including ones you are uncertain about or consider low-severity. Do not filter for importance or confidence at this stage - a separate verification step will do that. Your goal here is coverage: it is better to surface a finding that later gets filtered out than to silently drop a real bug. For each finding, include your confidence level and an estimated severity so a downstream filter can rank them.Este prompt pode ser usado sem que haja de fato uma segunda etapa, mas mover a filtragem por confiança para fora da etapa de descoberta frequentemente ajuda. Se o seu harness tiver uma etapa separada de verificação, deduplicação ou classificação, diga explicitamente ao modelo que o trabalho dele na etapa de descoberta é cobertura, e não filtragem.
Se você quiser que o modelo faça autofiltragem em uma única passagem, seja concreto sobre onde está o critério em vez de usar termos qualitativos como "importante": por exemplo, "reporte quaisquer bugs que possam causar comportamento incorreto, uma falha de teste ou um resultado enganoso; omita apenas detalhes menores como preferências puramente de estilo ou nomenclatura."
Itere nos prompts em relação a um subconjunto das suas avaliações ou casos de teste para validar ganhos de recall ou de pontuação F1.
Uso de computador
O Claude Sonnet 5 suporta o conjunto de ferramentas computer_toolset_20260801 (na Claude API e no Google Cloud) e a versão anterior da ferramenta computer_20251124. Na Claude API e no Google Cloud, o Claude Sonnet 5 também suporta a ferramenta de uso do navegador (browser_toolset_20260801) para tarefas dentro de páginas web. A capacidade de "computer use" (uso do computador) funciona em diversas resoluções, até uma resolução máxima de 2576px / 3,75MP. Testes internos de uso do computador mostram que enviar imagens em 1080p oferece um bom equilíbrio entre desempenho e custo.
Para cargas de trabalho particularmente sensíveis a custo, 720p ou 1366×768 são opções de menor custo com bom desempenho. Realize seus próprios testes para encontrar as configurações ideais para o seu caso de uso; experimentar com as configurações de esforço também pode ajudar a ajustar o comportamento do modelo.
Was this page helpful?