Nouveautés de Claude Opus 5
Aperçu des nouvelles fonctionnalités et des changements de comportement dans Claude Opus 5.
Claude Opus 5 représente une amélioration majeure par rapport à Claude Opus 4.8, avec les gains les plus importants en raisonnement approfondi, en tâches agentiques et à long horizon, et en mise à l'échelle du calcul au moment de l'inférence. Cette page résume toutes les nouveautés de Claude Opus 5, y compris les modifications d'outils en cours de conversation et deux changements non rétrocompatibles pour le code fonctionnant sur Claude Opus 4.8 : la réflexion est activée par défaut, et la réflexion ne peut être désactivée qu'à un niveau d'effort high ou inférieur.
Nouveau modèle
| Modèle | ID de modèle API | Description |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Pour le codage agentique complexe et le travail en entreprise |
Claude Opus 5 dispose d'une « context window » (fenêtre de contexte) de 1M de tokens (1M de tokens est à la fois la valeur par défaut et le maximum ; il n'existe pas de variante à contexte plus petit), de 128k tokens de sortie maximum, et de la réflexion activée par défaut. Le Priority Tier n'est pas pris en charge sur Claude Opus 5.
Pour la tarification et les spécifications complètes, consultez l'aperçu des modèles.
Nouvelles fonctionnalités
Modifications d'outils en cours de conversation (bêta)
Vous pouvez ajouter ou supprimer des outils entre les tours d'une conversation tout en préservant le cache de prompts, au lieu de renvoyer une liste d'outils fixe pendant toute la durée d'une session. Les modifications d'outils en cours de conversation sont en bêta : incluez l'en-tête bêta mid-conversation-tool-changes-2026-07-01 dans vos requêtes. Consultez Modifications d'outils en cours de conversation pour l'utilisation.
Mode de repli par défaut
Le paramètre fallbacks prend en charge un nouveau mode "default", qui applique les modèles de repli recommandés par Anthropic par catégorie de refus au lieu d'une liste de modèles que vous maintenez vous-même. L'ensemble du paramètre fallbacks est en bêta. Utilisez l'en-tête bêta server-side-fallback-2026-07-01, qui prend en charge à la fois le mode "default" et les listes de modèles explicites (l'en-tête antérieur server-side-fallback-2026-06-01 n'accepte que les listes explicites). Consultez Refus et repli.
Minimum de cache de prompts réduit
La longueur minimale de prompt pouvant être mise en cache sur Claude Opus 5 est de 512 tokens, contre 1 024 tokens sur Claude Opus 4.8. Les prompts qui étaient trop courts pour être mis en cache sur Claude Opus 4.8 peuvent désormais créer des entrées de cache sans aucune modification de code. Consultez « Prompt caching » (mise en cache des prompts) pour les minimums par modèle.
Mode rapide
Le mode rapide (aperçu de recherche) est disponible pour Claude Opus 5 uniquement sur l'API Claude ; il n'est actuellement pas disponible sur Amazon Bedrock, Claude Platform sur AWS, Google Cloud ou Microsoft Foundry. Le mode rapide pour Claude Opus 5 est tarifé à 10 $ USD par million de tokens d'entrée et 50 $ USD par million de tokens de sortie. Consultez Mode rapide pour l'accès, les modèles pris en charge et la tarification.
Changements de comportement
Réflexion activée par défaut
Sur Claude Opus 4.8, les requêtes s'exécutent sans réflexion à moins que vous ne définissiez thinking: {"type": "adaptive"}. Sur Claude Opus 5, les mêmes requêtes s'exécutent avec la réflexion adaptative activée par défaut : le modèle décide quand et dans quelle mesure réfléchir à chaque tour, et le paramètre effort est le contrôle de la profondeur de réflexion. La valeur transmise est inchangée ; thinking: {"type": "adaptive"} reste valide et équivalent à la valeur par défaut.
Il s'agit d'un changement non rétrocompatible pour le code qui s'exécutait sans réflexion sur Claude Opus 4.8. Une réponse peut commencer par un ou plusieurs blocs thinking avant le premier bloc text, renvoyés avec un champ thinking vide avec la valeur par défaut display: "omitted", de sorte que le code qui lit content[0].text ou traite le premier bloc de contenu diffusé en streaming comme du texte doit plutôt sélectionner les blocs de contenu par leur champ type. Les boucles d'utilisation d'outils doivent renvoyer les blocs thinking complets et non modifiés avec leurs résultats d'outils ; consultez Préservation des blocs de réflexion.
Les tokens de réflexion sont facturés comme des tokens de sortie et comptent dans max_tokens, une limite stricte sur la sortie totale (réflexion plus texte de réponse), donc réexaminez max_tokens et réévaluez le coût de référence pour les charges de travail qui s'exécutaient sans réflexion sur Claude Opus 4.8.
L'API conserve l'option de désactiver la réflexion, sous réserve de la restriction d'effort sur sa désactivation.
L'effort compte davantage
Claude Opus 5 convertit l'effort supplémentaire en meilleurs résultats de manière plus fiable que tout modèle Opus antérieur, de sorte que le niveau d'effort que vous choisissez a plus de poids. L'échelle complète est disponible : low, medium, high, xhigh et max, avec max comme niveau supérieur pour le raisonnement le plus approfondi possible. Commencez par la valeur par défaut, high, et ajustez dans l'une ou l'autre direction en fonction de vos évaluations : descendez là où la qualité se maintient pour économiser des tokens et de la latence, ou montez pour les travaux les plus exigeants. Lorsque vous exécutez à un effort xhigh ou max, définissez un max_tokens élevé afin que le modèle ait la marge nécessaire pour réfléchir et agir à travers les sous-agents et les appels d'outils.
Cette requête pousse l'effort jusqu'à max :
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)La réflexion est activée par défaut sur Claude Opus 5, donc aucun champ thinking n'est nécessaire.
La désactivation de la réflexion nécessite un effort high ou inférieur
Sur Claude Opus 5, thinking: {"type": "disabled"} n'est accepté que lorsque le niveau d'effort est high ou inférieur. Définir thinking: {"type": "disabled"} avec un effort xhigh ou max renvoie une erreur 400. Cette règle est appliquée à chaque requête vers Claude Opus 5 et les modèles ultérieurs. Il s'agit d'un changement non rétrocompatible par rapport à Claude Opus 4.8, où la désactivation de la réflexion était indépendante du niveau d'effort. Si vos requêtes Claude Opus 4.8 désactivent la réflexion à un effort xhigh ou max, soit conservez la réflexion désactivée et définissez l'effort sur high ou inférieur, soit conservez le niveau d'effort et supprimez le champ thinking.
Avec la réflexion désactivée, Claude Opus 5 peut occasionnellement écrire un appel d'outil dans sa sortie texte au lieu d'émettre un bloc tool_use, ou inclure des balises XML internes dans sa réponse visible. Dans la mesure du possible, gardez la réflexion activée et contrôlez le coût en tokens avec des niveaux d'effort inférieurs ; pour les intégrations qui doivent garder la réflexion désactivée, consultez Exécution avec la réflexion désactivée pour des atténuations par le prompting.
Différences de comportement du modèle
Au-delà de ces changements d'API, Claude Opus 5 se comporte différemment de Claude Opus 4.8 d'une manière que vous pourriez remarquer sans modifier aucun code. Les réponses par défaut destinées à l'utilisateur et les livrables écrits sont plus longs. Dans les sessions agentiques, le modèle relate plus souvent sa progression à l'utilisateur. Dans les frameworks multi-agents, il délègue plus volontiers aux sous-agents. Il vérifie également son propre travail sans qu'on le lui demande, donc supprimez les instructions de vérification héritées des modèles antérieurs (« inclure une étape de vérification finale », « utiliser un sous-agent pour vérifier ») ; elles provoquent une sur-vérification sur Claude Opus 5. Pour les modèles de prompting qui ajustent chacun de ces comportements, consultez Prompting de Claude Opus 5.
Améliorations des capacités
Par rapport à Claude Opus 4.8, Claude Opus 5 représente une amélioration majeure plutôt qu'incrémentale, et il offre une intelligence de pointe à la moitié du coût de Claude Fable 5. Les gains les plus importants concernent :
- Le raisonnement approfondi, en soutenant une analyse en plusieurs étapes sur de longues chaînes de problèmes.
- Le codage agentique et les tâches à long horizon, en restant concentré sur la tâche à travers des boucles d'utilisation d'outils prolongées et en réalisant des fonctionnalités multi-fichiers, des refactorisations plus importantes et des travaux de fonctionnalités de bout en bout sans laisser d'ébauches ni de placeholders.
- La mise à l'échelle du calcul au moment de l'inférence, en convertissant l'effort supplémentaire (jusqu'au niveau
max) en meilleurs résultats. - L'efficacité aux niveaux d'effort inférieurs, les niveaux d'effort
lowetmediumproduisant une qualité élevée pour une fraction des tokens et de la latence des réglages supérieurs. - La revue de code et la détection de bugs, en faisant apparaître de vrais bugs à un taux élevé par passe avec peu de faux positifs, et en restant précis aux niveaux d'effort inférieurs.
- La vision, en comprenant les graphiques, documents et diagrammes et en reproduisant les visuels d'interface utilisateur et de frontend, avec les meilleurs résultats lorsqu'on lui fournit des outils pour analyser, recadrer et vérifier son travail de manière itérative.
- Le travail sur contexte long, avec une fenêtre de contexte de 1M de tokens à la fois comme valeur par défaut et comme maximum, et un suivi des instructions, des appels d'outils et un raisonnement cohérents sur toute la fenêtre.
- Les tâches bureautiques et documentaires, en générant et modifiant des feuilles de calcul complexes à plusieurs feuilles avec des formules non triviales, et en produisant des présentations bien structurées.
- La coordination multi-agents, en dirigeant des équipes de sous-agents avec des modèles rédacteur-vérificateur efficaces et peu de cas où les agents écrasent le travail des autres.
Pour les modèles de prompting qui tirent le meilleur parti de ces capacités, consultez Prompting de Claude Opus 5.
Tarification
Claude Opus 5 est tarifé à 5 $ USD par million de tokens d'entrée et 25 $ USD par million de tokens de sortie, inchangé par rapport à Claude Opus 4.8. Comme la réflexion est activée par défaut et que les tokens de réflexion sont facturés comme des tokens de sortie, une charge de travail qui s'exécutait sans réflexion sur Claude Opus 4.8 peut produire plus de tokens de sortie par requête aux mêmes tarifs par token ; consultez Contrôle des coûts.
Consultez Tarification pour la tarification complète, y compris les tarifs du traitement par lots, de la mise en cache des prompts et du mode rapide.
Disponibilité
Claude Opus 5 est disponible sur :
- API Claude : disponible pour tous les clients, sous
claude-opus-5. - AWS : disponible via Claude dans Amazon Bedrock, sous
anthropic.claude-opus-5, et via Claude Platform sur AWS. Sur Amazon Bedrock, Claude Opus 5 est également accessible via l'APIInvokeModelsurbedrock-runtime, servie par la même infrastructure ; l'intégration Claude sur Amazon Bedrock (héritée) ne l'inclut pas dans son tableau d'ID de modèles versionnés par ARN. - Google Cloud : disponible via Claude sur Google Cloud, sous
claude-opus-5. - Microsoft Foundry : disponible via Claude dans Microsoft Foundry.
Claude Opus 4.8 reste disponible sur toutes ces plateformes.
Guide de migration
Pour migrer depuis Claude Opus 4.8, mettez à jour votre ID de modèle :
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterPassez ensuite en revue les deux changements non rétrocompatibles sous Changements de comportement : la réflexion est activée par défaut (les réponses peuvent commencer par des blocs thinking, donc sélectionnez les blocs de contenu par type), et la désactivation de la réflexion avec un effort xhigh ou max renvoie une erreur 400. Consultez le guide de migration pour des instructions étape par étape et la liste de contrôle complète.
Prochaines étapes
Spécifications et tarification complètes pour tous les modèles Claude actuels.
Différences de comportement et modèles de prompting spécifiques à Claude Opus 5.
Contrôlez le nombre de tokens que Claude utilise pour répondre, de low à max.
Comment fonctionne la réflexion lorsqu'elle est activée par défaut, et quand elle peut être désactivée.
Donnez à Claude un budget de tokens indicatif pour rythmer son travail.
Guide pour migrer vers les derniers modèles Claude depuis les versions précédentes de Claude.
Obtenez un débit de tokens de sortie par seconde plus élevé des modèles Claude Opus à un tarif premium.
Was this page helpful?