Nouveautés de Claude Opus 5.5
Aperçu des changements incompatibles, de la prise en charge des fonctionnalités et des différences de comportement dans Claude Opus 5.5.
Claude Opus 5.5 est conçu pour le codage agentique de longue durée et le travail intellectuel. Son prix est de 4 $ / 20 $ USD par million de tokens d'entrée / de sortie. Quatre « breaking changes » (changements incompatibles) affectent le code déjà exécuté sur Claude Opus 5 : la réflexion ne peut pas être désactivée, l'utilisation forcée d'outils renvoie une erreur, les blocs de réflexion sont liés au modèle et à la conversation et, sur l'API Claude et Google Cloud, l'ancien outil d'utilisation de l'ordinateur computer_20251124 n'est pas accepté. Les trois premiers s'appliquent également à Claude Fable 5.1. Un autre changement modifie la forme de la réponse sans faire échouer aucune requête : le texte entre les appels d'outils est renvoyé dans des blocs thinking, dont le texte est vide avec le paramètre display par défaut. Une application qui transmet ce texte en streaming à ses utilisateurs sous forme de mises à jour de progression devient silencieuse entre les appels d'outils tant qu'elle ne définit pas une valeur display qui renvoie le texte.
Nouveau modèle
| Modèle | ID de l'API Claude | Description |
|---|---|---|
| Claude Opus 5.5 | Pour le codage agentique de longue durée et le travail intellectuel |
L'« adaptive thinking » (réflexion adaptative) est toujours activée, et le paramètre d'effort contrôle la profondeur de la réflexion. Sa valeur par défaut sur ce modèle est medium. Pour la « context window » (fenêtre de contexte), les limites de sortie, la date limite des connaissances et les prix, consultez la page du modèle Claude Opus 5.5. Pour tous les modèles actuels, consultez la vue d'ensemble des modèles.
Changements incompatibles
La réflexion ne peut pas être désactivée
Sur Claude Opus 5, la réflexion est activée par défaut, et thinking: {"type": "disabled"} est accepté avec un effort high ou inférieur. Sur Claude Opus 5.5, la réflexion est toujours activée. Une requête qui définit thinking: {"type": "disabled"}, ou un budget manuel avec thinking: {"type": "enabled", "budget_tokens": N}, renvoie une erreur 400 invalid_request_error. Omettez le champ thinking, ou envoyez thinking: {"type": "adaptive"}, qui est équivalent. Aucun en-tête bêta n'est nécessaire.
Les messages d'erreur sont les suivants :
"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior."thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.Le paramètre d'effort permet de contrôler la profondeur de la réflexion, la latence et le coût. Réduisez-le là où vous désactiviez auparavant la réflexion. La page Optimiser le coût et l'intelligence présente des résultats mesurés pour vous aider à choisir un niveau. Chaque réponse peut commencer par un ou plusieurs blocs thinking, renvoyés avec un champ thinking vide avec la valeur par défaut display: "omitted". Sélectionnez donc les blocs de contenu par leur champ type plutôt que par leur position, et renvoyez les blocs thinking sans modification dans les boucles d'utilisation d'outils. Le code qui s'exécute déjà sur Claude Opus 5 avec la réflexion activée ne nécessite aucune modification. Consultez Réflexion et la section avant et après du guide de migration.
L'utilisation forcée d'outils n'est pas prise en charge
Claude Opus 5.5 ne prend pas en charge la « forced tool use » (utilisation forcée d'outils). Un tool_choice défini sur {"type": "any"} ou {"type": "tool", "name": "..."} renvoie une erreur 400 invalid_request_error :
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (la valeur par défaut) et {"type": "none"} sont pris en charge. La même validation s'applique au point de terminaison de comptage des tokens. Pour obtenir un JSON conforme au schéma, conservez tool_choice: {"type": "auto"} et définissez strict: true avec l'utilisation d'outils stricte, ou déplacez le schéma vers les sorties structurées. Pour que le modèle appelle un outil plutôt que de répondre par du texte, indiquez dans le prompt quand l'outil s'applique. Le guide de migration présente l'avant et après.
Les blocs de réflexion sont liés au modèle et à la conversation
Chaque bloc de réflexion enregistre le modèle qui l'a produit. Chaque modèle lit ses propres blocs, ainsi que ceux de certains autres modèles seulement. Claude Opus 5.5 lit les blocs de réflexion de Claude Opus 5 et des modèles Opus, Sonnet et Haiku antérieurs, mais pas ceux des modèles Claude Fable ou Claude Mythos. Sur l'API Claude, Claude Fable 5.1 et Claude Mythos 5.1 lisent les blocs de réflexion de Claude Opus 5.5, et aucun autre modèle ne le fait.
Une conversation conserve donc son raisonnement dans deux cas : lorsqu'elle passe de Claude Opus 5 à Claude Opus 5.5, ou lorsqu'elle passe de Claude Opus 5.5 à Claude Fable 5.1 ou Claude Mythos 5.1 sur l'API Claude. En revanche, une conversation qui passe de Claude Opus 5.5 à tout autre modèle, ou qui passe d'un modèle Claude Fable ou Claude Mythos à Claude Opus 5.5, exécute les tours suivant le changement sans le raisonnement du modèle précédent.
Lorsqu'une requête contient un bloc que le modèle cible ne peut pas lire, l'API le supprime avant que le modèle ne le voie. La requête réussit, et les blocs supprimés ne sont pas facturés. Avec l'en-tête bêta thinking-binding-controls-2026-08-01, la suppression est signalée dans un tableau input_transformations de premier niveau. Consultez Changer de modèle en cours de conversation.
L'API vérifie également si un élément précédant un bloc de réflexion de Claude Opus 5.5 a changé depuis la production du bloc : l'invite système system, les tools ou un message antérieur. Comme sur Claude Fable 5.1, elle applique cette vérification par défaut pour les comptes créés le 31 août 2026 à 00:00 UTC ou après, sur l'API Claude et sur les plateformes cloud. Sur ces comptes, une requête qui renvoie un bloc après un tel changement renvoie une erreur 400. Pour supprimer plutôt les blocs concernés, envoyez l'en-tête bêta thinking-binding-controls-2026-08-01 et définissez thinking.block_binding.prefix_mismatch_behavior sur "drop_block". Sur les comptes plus anciens, définir ce champ sur l'une ou l'autre valeur active ce comportement pour la requête.
Pour éviter complètement ce problème, faites en sorte que la conversation ne fasse que s'allonger, sans modification des éléments existants. Pour changer les instructions ou les outils, utilisez des messages système en cours de conversation plutôt que des modifications. Consultez Réflexion préservée et la note sur ce changement du guide de migration.
L'outil d'utilisation de l'ordinateur computer_20251124 n'est pas pris en charge sur l'API Claude et Google Cloud
Claude Opus 5 accepte l'utilisation de l'ordinateur sous deux formes : l'ensemble d'outils computer_toolset_20260801 et, avec l'en-tête bêta computer-use-2025-11-24, l'ancien outil computer_20251124. Sur l'API Claude et Google Cloud, Claude Opus 5.5 ne prend en charge que l'ensemble d'outils. Une requête qui déclare un outil computer_20251124 renvoie une erreur 400 invalid_request_error. Le message nomme le type rejeté, puis liste après Did you mean one of les types d'outils que le modèle accepte, dont computer_toolset_20260801. Il commence ainsi :
'claude-opus-5-5' does not support tool types: computer_20251124.Pour migrer une intégration existante sur l'API Claude ou Google Cloud, suivez Migrer depuis computer_20251124 :
- supprimez l'en-tête bêta ;
- remplacez l'entrée
toolspar{"type": "computer_toolset_20260801"}; - mettez à jour votre boucle d'agent pour gérer les blocs
tool_usemembres, les actions par lots ettoolset_namedans les résultats.
Sur Amazon Bedrock, l'ancien outil computer_20251124 continue de fonctionner sur Claude Opus 5.5 comme sur Claude Opus 5, et aucune modification n'y est donc nécessaire. Pour les autres plateformes, consultez la section Compatibilité de l'outil d'utilisation de l'ordinateur. Les intégrations qui utilisent déjà l'ensemble d'outils, ainsi que l'outil d'utilisation du navigateur, ne nécessitent aucune modification. Le guide de migration présente la requête avant et après.
Prise en charge des fonctionnalités
Claude Opus 5.5 prend en charge les fonctionnalités suivantes :
- l'effort par message (bêta) ;
- les messages système en cours de conversation ;
- les budgets de tâche ;
- la « prompt caching » (mise en cache des prompts), avec une longueur minimale de 512 tokens pour un prompt pouvant être mis en cache ;
- le traitement par lots ;
- l'API Files ;
- la prise en charge des PDF ;
- la vision ;
- les outils côté serveur et côté client.
Sur l'API Claude et Google Cloud, l'utilisation de l'ordinateur nécessite l'ensemble d'outils computer_toolset_20260801 (consultez le changement incompatible). Consultez la page de chaque fonctionnalité pour connaître la disponibilité selon les modèles.
Mode rapide
Le mode rapide (aperçu de recherche) est disponible pour Claude Opus 5.5 uniquement sur l'API Claude. Il n'est pas disponible sur Amazon Bedrock, Claude Platform on AWS, Google Cloud ou Microsoft Foundry. Définissez speed: "fast" avec l'en-tête bêta fast-mode-2026-02-01. Consultez Mode rapide pour l'accès, les modèles pris en charge et la tarification.
Définir des outils dans un message (bêta)
Avec l'en-tête bêta inline-tools-2026-09-15, un bloc tool_addition dans un message système en cours de conversation peut contenir une définition d'outil complète au lieu d'une référence. Vous pouvez ainsi, en cours de conversation, ajouter un outil, modifier son schéma ou faire passer un outil serveur à une version plus récente, sans modifier tools et sans perdre le cache de prompts. Cela fonctionne sur tous les modèles qui prennent en charge les modifications d'outils en cours de conversation, y compris Claude Opus 5.5. Consultez Définir des outils dans un message.
Compaction à la demande (bêta)
Avec l'en-tête bêta compact-2026-09-04, une requête qui envoie le paramètre compaction de premier niveau renvoie un bloc compaction signé qui résume l'ensemble de la conversation. Vous envoyez ensuite ce bloc en premier, à la place des messages résumés. Cette fonctionnalité est disponible sur les modèles qui prennent en charge la compaction, dont Claude Opus 5.5.
Vous choisissez le moment de la compaction, et la requête peut s'exécuter en arrière-plan. Les blocs de réflexion des tours que vous conservez peuvent rester valides après le remplacement, dans les conditions décrites dans Compaction et réflexion préservée. Ce point est important sur Claude Opus 5.5, car ses blocs de réflexion sont liés à la conversation. Consultez Compaction à la demande pour la disponibilité selon les plateformes et le déroulement complet de la requête.
Différences de comportement
Claude Opus 5.5 diffère de Claude Opus 5 sur plusieurs points qui apparaissent sans aucune modification du code. Chacun fait l'objet de recommandations dans Rédiger des prompts pour Claude Opus 5.5 :
- L'effort par défaut est
medium. Une requête qui ometefforts'exécute avecmedium, alors que sur Claude Opus 5 elle s'exécutait avechigh. Définissezeffortexplicitement et relancez votre balayage des niveaux d'effort. Consultez Calibrer l'effort. - Davantage de réflexion par tour à un niveau d'effort donné. Avec le même paramètre d'effort, le modèle a tendance à réfléchir davantage par tour que Claude Opus 5, surtout avec
xhighetmax. Relancez votre balayage des niveaux d'effort plutôt que de reprendre un paramètre existant, et prévoyez de la marge dansmax_tokenspour la réflexion. Consultez Calibrer l'effort. - Le texte entre les appels d'outils est renvoyé dans des blocs de réflexion. Les courtes notes que le modèle écrit entre les appels d'outils arrivent sous forme de blocs
thinkingde mise à jour de progression plutôt que de blocstext. Avec la valeur par défautdisplay: "omitted", une application qui les transmet en streaming à ses utilisateurs devient donc silencieuse entre les appels d'outils, sans aucune erreur. Le guide de migration explique comment les recevoir, et Mises à jour de progression destinées à l'utilisateur explique comment en demander davantage. - Davantage de catégories de protection. Le modèle exécute un classificateur de sécurité en biologie en plus de celui dédié à la cybersécurité. Les requêtes qui le poussent à reproduire son raisonnement interne dans le texte de la réponse peuvent être refusées avec la catégorie
reasoning_extraction. Consultez Refus et repli et Refus des mesures de protection. - Lecture plus précise des graphiques, diagrammes et captures d'écran. Sans outils, le modèle lit beaucoup plus précisément les valeurs des graphiques denses et des visuels dont le sens dépend de la mise en page. Les solutions de contournement pour la vision intégrées aux prompts des modèles antérieurs peuvent donc ne plus être nécessaires. Les outils d'image améliorent toutefois encore la précision sur les entrées les plus denses. Consultez Outils pour les entrées visuelles complexes.
Si votre intégration Claude Opus 5 s'exécutait avec la réflexion désactivée, consultez Prompts rédigés pour la réflexion désactivée ainsi que le changement incompatible. Le modèle progresse dans plusieurs domaines : codage agentique et revue de code, travail intellectuel, communication, entrées visuelles et utilisation de l'ordinateur. Pour ces améliorations, consultez Capacités pertinentes pour le prompting.
Refus et repli
Claude Opus 5.5 est livré avec des classificateurs de sécurité, et tout ce qui est décrit dans Refus et repli s'applique. Une requête refusée renvoie HTTP 200 avec stop_reason: "refusal" et un objet stop_details qui nomme le domaine de politique concerné. Gérez donc les refus et configurez un repli pour réessayer sur un autre modèle. Vous pouvez utiliser le repli côté serveur (fallbacks: "default", en bêta, qui réessaie sur le modèle recommandé par Anthropic pour cette catégorie), le middleware du SDK ou votre propre mécanisme de nouvelle tentative.
Tarification
Claude Opus 5.5 coûte 4 $ USD par million de tokens d'entrée et 20 $ USD par million de tokens de sortie, contre 5 $ et 25 $ pour Claude Opus 5. Les écritures en cache de 5 minutes coûtent 5 $, les écritures en cache d'une heure 8 $, et les lectures en cache 0,20 $ par million de tokens (0,05x le prix d'entrée de base). Le traitement par lots est à moitié prix : 2 $ et 10 $. Consultez Tarification pour la résidence des données et la tarification des outils.
Disponibilité
Claude Opus 5.5 est disponible sur :
- API Claude : pour tous les clients, sous l'identifiant
claude-opus-5-5. - AWS : Claude dans Amazon Bedrock, sous l'identifiant
anthropic.claude-opus-5-5, et Claude Platform on AWS, sous l'identifiantclaude-opus-5-5. - Google Cloud : Claude sur Google Cloud, sous l'identifiant
claude-opus-5-5. - Microsoft Foundry : Claude dans Microsoft Foundry, sous l'identifiant
claude-opus-5-5.
Migrer depuis Claude Opus 5
Mettez à jour votre ID de modèle :
model = "claude-opus-5" # Before
model = "claude-opus-5-5" # AfterEnsuite, effectuez les modifications suivantes :
- Supprimez tout paramètre
thinking: {"type": "disabled"}outhinking: {"type": "enabled", ...}et choisissez plutôt un niveau d'effort. - Remplacez les types
anyettooldetool_choiceparauto, associé à l'utilisation d'outils stricte. - Si vous utilisez l'utilisation de l'ordinateur via
computer_20251124sur l'API Claude ou Google Cloud, passez à l'ensemble d'outils. - Si votre interface affiche le texte entre les appels d'outils, définissez également
thinking.display. Consultez Le texte entre les appels d'outils est renvoyé dans des blocs de réflexion.
Consultez le guide de migration pour des instructions étape par étape depuis Claude Opus 5 et les modèles antérieurs, ainsi que pour la liste de contrôle complète.
Étapes suivantes
Spécifications complètes et tarification de tous les modèles Claude actuels.
Migrez votre code de Claude Opus 5 et des modèles antérieurs vers Claude Opus 5.5.
Différences de comportement et modèles de prompts propres à Claude Opus 5.5.
Contrôlez le nombre de tokens que Claude utilise pour répondre, de low à max.
Fonctionnement de la réflexion adaptative et préservation des blocs de réflexion.
Gérez stop_reason: "refusal" et réessayez sur un autre modèle.
Was this page helpful?