Ce guide couvre les modèles de prompting spécifiques à Claude Opus 5. Pour les capacités du modèle et les changements d'API, consultez Nouveautés de Claude Opus 5. Pour les techniques qui s'appliquent à tous les modèles Claude actuels, consultez Bonnes pratiques de prompting.
Claude Opus 5 est conçu pour le codage agentique complexe et le travail en entreprise, avec des forces particulières dans les tâches agentiques à long terme. Il fonctionne bien dès le départ avec les prompts existants de Claude Opus 4.8. Les modèles suivants couvrent les comportements qui nécessitent le plus souvent un ajustement.
Pour les changements d'API lors de la migration depuis Claude Opus 4.8 (réflexion activée par défaut, et désactivation de la réflexion plafonnée à l'effort high), consultez le guide de migration.
Par rapport à Claude Opus 4.8, les améliorations les plus pertinentes pour le prompting sont :
low et medium produisent une qualité élevée pour une fraction des tokens et de la latence des niveaux supérieurs. Commencez avec la valeur par défaut (high) et ajustez en fonction de vos évaluations : utilisez low et medium généreusement comme contrôle principal du coût en tokens et du temps de réponse partout où la qualité se maintient, et passez à xhigh pour le codage exigeant et le travail agentique. Si vous avez repris les valeurs d'effort par défaut d'un modèle précédent, relancez un balayage d'effort sur vos propres évaluations. Consultez Effort pour les recommandations complètes.Les réponses par défaut destinées à l'utilisateur de Claude Opus 5 sont plus longues que celles des modèles Opus précédents. Le paramètre d'effort contrôle la quantité de réflexion du modèle plutôt que la quantité de ce qu'il dit : réduire l'effort peut réduire le volume de réflexion sans raccourcir de manière fiable la réponse visible. Pour contrôler la longueur des réponses, demandez-le explicitement dans le prompt.
Une courte instruction de concision est efficace. Par exemple, pour un produit multi-tours destiné à l'utilisateur :
Keep responses focused, brief, and concise. Keep disclaimers and caveats short, and spend most of the response on the main answer. When asked to explain something, give a high-level summary unless an in-depth explanation is specifically requested.Dans une invite système longue, associez l'instruction à un court rappel vers la fin du prompt :
<tone_preference>
Keep outputs reasonably concise.
</tone_preference>Claude Opus 5 narre volontiers pendant le travail agentique : il a tendance à annoncer ce qu'il est sur le point de faire, et sa sortie par message dans les sessions agentiques est souvent plus longue que celle des modèles précédents. Il bénéficie de directives explicites sur la manière de communiquer avec l'utilisateur pendant une tâche. Pour réduire la narration, décrivez la cadence et la forme que vous souhaitez :
Before your first tool call, say in one sentence what you're about to do. While working, give a brief update only when you find something important or change direction. When you finish, lead with the outcome: your first sentence should answer "what happened" or "what did you find," with supporting detail after it for readers who want it.Pour augmenter la narration, ou changer son style, le même levier s'applique dans l'autre direction : décrivez explicitement à quoi doivent ressembler les mises à jour et fournissez des exemples. Les exemples positifs du style de communication que vous souhaitez ont tendance à être plus efficaces que les instructions sur ce qu'il ne faut pas faire.
Indépendamment de la verbosité conversationnelle, les fichiers que Claude Opus 5 écrit sur disque (rapports, documents Markdown, résumés) sont souvent plus longs que sur les modèles précédents. Si votre produit inclut des documents rédigés par Claude, ajoutez un calibrage explicite de la longueur :
Match the length of written documents to what the task needs: cover the substance, but do not pad with filler sections, redundant summaries, or boilerplate.Claude Opus 5 vérifie son propre travail sans qu'on le lui demande. Si votre prompt contient des instructions de vérification explicites (« inclure une étape de vérification finale pour toute tâche non triviale », « utiliser un sous-agent pour vérifier »), supprimez-les : de telles instructions provoquent une sur-vérification sur Claude Opus 5, et leur suppression réduit les tokens gaspillés sans perte de qualité. Il en va de même pour l'échafaudage de harnais hérité qui ajoute des étapes de vérification séparées.
Claude Opus 5 peut également élargir la portée d'une tâche, en ajoutant des étapes qui n'ont pas été demandées ou en appliquant son propre jugement sur ce que la tâche devrait être. Pour les tâches restreintes, limitez explicitement la portée :
Deliver what was asked, at the scope intended. Make routine judgment calls yourself, and check in only when different readings of the request would lead to materially different work. If the request seems mistaken or a better approach exists, say so in a sentence and continue with the task as asked rather than quietly narrowing, widening, or transforming it. Finish the whole task, and stop short of actions that are clearly beyond what was asked.Claude Opus 5 délègue aux sous-agents plus volontiers que les modèles précédents. La délégation est rentable sur des pistes de travail véritablement indépendantes et de taille conséquente, mais elle multiplie les coûts et le temps lorsqu'elle est appliquée à de petites tâches. Si votre harnais prend en charge les sous-agents, donnez des directives explicites sur les scénarios qui justifient la délégation, ou définissez des plafonds déterministes sur le nombre d'agents pouvant être lancés. Par exemple :
Delegate to a subagent only for large tasks that are genuinely independent and parallelizable, such as a wide multi-file investigation. Do not delegate work you can finish yourself in a handful of tool calls, and do not use subagents to verify or double-check your own work. If one subagent can complete the task, use one rather than several, and keep spawn counts low.Claude Opus 5 détecte et corrige bien ses propres erreurs sans qu'on le lui demande. Évitez de demander des revérifications qu'il effectue déjà (« vérifiez deux fois votre réponse », « revérifiez avant de répondre ») ; comme les instructions de vérification, celles-ci se cumulent avec le comportement propre du modèle et ajoutent des coûts sans améliorer les résultats.
Le modèle narre également les corrections de ses déclarations antérieures plus que les modèles précédents, ce qui peut être indésirable dans les produits destinés aux utilisateurs. Pour limiter la narration des corrections aux corrections qui comptent :
Only correct an earlier statement when the error would change the user's code, conclusions, or decisions. State corrections plainly and briefly, then continue the task. For slips that change nothing for the user, make the fix and move on without noting it.Claude Opus 5 s'exécute avec la réflexion activée par défaut, et la réflexion ne peut être désactivée qu'à un effort high ou inférieur ; consultez le guide de migration. Avec la réflexion désactivée, deux artefacts peuvent occasionnellement apparaître dans la sortie visible du modèle. La principale atténuation pour les deux consiste à garder la réflexion activée et à contrôler le coût en tokens avec des niveaux d'effort inférieurs au lieu de désactiver la réflexion : pour la plupart des tâches, la réflexion activée à l'effort low donne de meilleurs résultats que la réflexion désactivée à un coût similaire.
Appels d'outils sous forme de texte. Avec la réflexion désactivée, le modèle écrit occasionnellement un appel d'outil dans son texte destiné à l'utilisateur au lieu d'émettre un bloc tool_use structuré. Le tour se termine normalement et l'appel ne s'exécute jamais, et dans les boucles agentiques, le texte divulgué reste dans l'historique de la conversation, de sorte que les tours ultérieurs sont également affectés. Cela est plus courant sur les charges de travail riches en outils comme la recherche.
Balises XML internes dans la sortie. Avec la réflexion désactivée, le modèle peut émettre des balises <thinking> ou d'autres balises XML internes dans sa réponse visible. Si votre invite système contient une règle demandant au modèle de ne pas réfléchir ou de ne pas raisonner, supprimez-la ; ce type d'instruction augmente la fuite de balises.
Pour les intégrations qui doivent garder la réflexion désactivée, une seule instruction combinée atténue les deux artefacts : elle donne au modèle la permission explicite de parler avant un appel d'outil, une alternative au fait de forcer un appel lorsqu'aucun outil ne convient, et une règle générale contre les balises internes :
When you use a tool, you may say a brief sentence first. If no tool can express what the user asked for, say so instead of guessing. Do not include internal or system XML tags in your response.Les instructions qui mentionnent les balises de réflexion par leur nom sont moins efficaces que la forme générale, évitez donc de les nommer spécifiquement.
Was this page helpful?