Claude Platform Docs
Modèles et tarifsClaude Sonnet 5.5

Nouveautés de Claude Sonnet 5.5

Ce qui change lorsque vous passez de Claude Sonnet 5 à Claude Sonnet 5.5 : changements incompatibles, fonctionnalités prises en charge, différences de comportement, tarification et disponibilité.

Claude Sonnet 5.5 offre la meilleure combinaison de vitesse et d'intelligence. Cinq « breaking changes » (changements incompatibles) affectent le code qui s'exécute déjà sur Claude Sonnet 5 :

Un autre changement modifie la forme de la réponse sans faire échouer aucune requête : le texte entre les appels d'outils est renvoyé dans des blocs thinking. Une application qui transmet ce texte en « streaming » (diffusion en continu) à ses utilisateurs devient silencieuse entre les appels d'outils jusqu'à ce qu'elle définisse une valeur display qui renvoie le texte, ou qu'elle désactive la réflexion préalable avec between_tools.

Nouveau modèle

ModèleID de l'API ClaudeDescription
Claude Sonnet 5.5La meilleure combinaison de vitesse et d'intelligence

L'« adaptive thinking » (réflexion adaptative) est activée par défaut, et le « effort parameter » (paramètre d'effort) contrôle la profondeur de la réflexion. Sa valeur par défaut sur l'API Claude est high. Le « tokenizer » (tokeniseur) est le même que celui de Claude Sonnet 5, de sorte qu'un même texte produit le même nombre de tokens. Pour la « context window » (fenêtre de contexte), les limites de sortie, la date limite des connaissances et les prix, consultez la page du modèle Claude Sonnet 5.5.

Pour tous les modèles actuels, consultez la vue d'ensemble des modèles.

Changements incompatibles

Désactiver la réflexion préalable avec between_tools

Pour désactiver la réflexion préalable sur Claude Sonnet 5.5, envoyez thinking: {"type": "between_tools"} au lieu de "disabled". Il s'agit du réglage de réflexion le plus bas sur ce modèle. Il est disponible sur toutes les plateformes qui proposent Claude Sonnet 5.5. Il ne nécessite aucun en-tête bêta. Les courtes mises à jour de progression que le modèle rédige entre les appels d'outils sont toujours renvoyées sous forme de blocs thinking avec leur texte de résumé. Renvoyez ces blocs sans modification avec le reste du tour de l'assistant. Un bloc de mise à jour de progression que vous renvoyez fournit au modèle la note complète qu'il a rédigée, et non le résumé. Si vos requêtes n'utilisent pas d'outils, la réponse ne contient que du texte, comme avec disabled sur Claude Sonnet 5.

Sur Claude Sonnet 5.5, une requête qui envoie thinking: {"type": "disabled"} renvoie une erreur 400 invalid_request_error dont le message renvoie vers between_tools.

between_tools est accepté avec un effort low, medium et high. Avec un effort xhigh ou max, une requête avec between_tools renvoie une erreur 400. Pour fonctionner en xhigh ou max, utilisez la réflexion adaptative : omettez le champ thinking ou envoyez thinking: {"type": "adaptive"}, ce qui est équivalent. Avec between_tools, l'effort ne peut pas changer en cours de conversation : un output_config.effort par message qui diffère du niveau en vigueur renvoie une erreur 400. Pour faire varier l'effort à chaque tour, utilisez la réflexion adaptative.

between_tools n'accepte aucun autre champ : display, budget_tokens ou block_binding envoyé avec lui renvoie une erreur 400. Les budgets de réflexion manuels (thinking: {"type": "enabled", "budget_tokens": N}) renvoient une erreur 400. Consultez Réflexion et la section avant et après du guide de migration.

L'utilisation forcée d'outils n'est pas prise en charge

Claude Sonnet 5.5 ne prend pas en charge la « forced tool use » (utilisation forcée d'outils). Un tool_choice défini sur {"type": "any"} ou {"type": "tool", "name": "..."} renvoie une erreur 400 invalid_request_error :

tool_choice: type "tool" and "any" are not supported for this model.

tool_choice: {"type": "auto"} (la valeur par défaut) et {"type": "none"} sont pris en charge. La même vérification s'applique au point de terminaison de comptage des tokens. Pour obtenir une entrée d'outil conforme au schéma, conservez tool_choice: {"type": "auto"} et définissez strict: true avec l'utilisation stricte d'outils, ou déplacez le schéma vers les sorties structurées. Pour que le modèle appelle un outil plutôt que de répondre par du texte, indiquez dans le prompt quand l'outil s'applique. Le guide de migration présente l'avant et après.

Les blocs de réflexion sont liés au modèle et à la conversation

Chaque « thinking block » (bloc de réflexion) enregistre le modèle qui l'a produit. Chaque modèle lit ses propres blocs et seulement les blocs de certains autres modèles. Claude Sonnet 5.5 lit les blocs de réflexion de Claude Sonnet 5, Claude Opus 4.8, Claude Haiku 4.5 et des modèles antérieurs, mais pas ceux de Claude Opus 5, Claude Opus 5.5 ni d'aucun modèle Claude Fable ou Claude Mythos. Aucun autre modèle ne lit les blocs de réflexion de Claude Sonnet 5.5.

Ainsi, une conversation qui passe de Claude Sonnet 5 à Claude Sonnet 5.5 conserve son raisonnement, et une conversation qui passe de Claude Sonnet 5.5 à n'importe quel autre modèle exécute les tours suivant le changement sans ce raisonnement. Lorsqu'une requête contient un bloc que le modèle cible ne peut pas lire, l'API le supprime avant que le modèle ne le voie : la requête réussit, et les blocs supprimés ne sont pas facturés. Avec l'en-tête bêta thinking-binding-controls-2026-08-01, la suppression est signalée dans un tableau input_transformations de premier niveau. Consultez Changer de modèle en cours de conversation.

L'API vérifie également si quelque chose situé avant un bloc de réflexion de Claude Sonnet 5.5 a changé depuis la production du bloc : le prompt system, les tools ou un message antérieur. Elle applique cette vérification par défaut pour les comptes créés le 31 août 2026 à 00:00 UTC ou après, sur l'API Claude, Amazon Bedrock et Google Cloud. Sur ces comptes, une requête qui rejoue un bloc après un tel changement renvoie une erreur 400. Pour supprimer plutôt les blocs concernés, envoyez l'en-tête bêta thinking-binding-controls-2026-08-01 et définissez thinking.block_binding.prefix_mismatch_behavior sur "drop_block". Sur les comptes plus anciens, définir ce champ sur l'une ou l'autre valeur active la vérification pour la requête. block_binding ne fonctionne qu'avec thinking: {"type": "adaptive"}. Avec between_tools, conservez un historique en ajout seul, ou retirez les blocs de réflexion à partir du tour modifié.

Conservez la conversation en ajout seul afin que la vérification n'échoue jamais : modifiez les instructions ou les outils avec des messages système en cours de conversation plutôt qu'avec des modifications. Consultez Réflexion préservée et la note sur ce changement du guide de migration.

L'outil d'utilisation de l'ordinateur computer_20251124 n'est pas pris en charge sur l'API Claude et Google Cloud

Sur l'API Claude et Google Cloud, Claude Sonnet 5.5 prend en charge la « computer use » (utilisation de l'ordinateur) uniquement via l'ensemble d'outils computer_toolset_20260801. Une requête qui déclare l'ancien outil computer_20251124 renvoie une erreur 400 invalid_request_error. Sur l'API Claude, le message nomme le type rejeté, puis liste les types d'outils que le modèle accepte. Il commence ainsi :

'claude-sonnet-5-5' does not support tool types: computer_20251124.

Sur Amazon Bedrock, Claude Sonnet 5.5 accepte l'ancien outil computer_20251124.

Pour migrer une intégration existante sur l'API Claude ou Google Cloud, suivez Migrer depuis computer_20251124, qui présente la requête avant et après. Supprimez l'en-tête bêta, remplacez l'entrée tools par {"type": "computer_toolset_20260801"}, et mettez à jour votre boucle d'agent pour les blocs tool_use des membres, les actions par lots et toolset_name dans les résultats. L'ensemble d'outils est disponible sur l'API Claude et Google Cloud. Pour les autres plateformes, consultez la section Compatibilité de l'outil d'utilisation de l'ordinateur. Les intégrations qui utilisent déjà l'ensemble d'outils, ainsi que l'outil d'utilisation du navigateur, ne nécessitent aucune modification.

Certaines associations de l'outil conseiller ne sont pas prises en charge

Avec l'« advisor tool » (outil conseiller) (bêta), un exécutant Claude Sonnet 5.5 nécessite Claude Mythos 5.1, Claude Fable 5.1, Claude Mythos 5, Claude Fable 5, Claude Opus 5.5 ou Claude Opus 5 comme conseiller, ou Claude Sonnet 5.5 lui-même. Les conseillers Claude Opus 4.8, Claude Opus 4.7 et Claude Sonnet 5 fonctionnent avec un exécutant Claude Sonnet 5, mais avec un exécutant Claude Sonnet 5.5, ils renvoient une erreur 400 invalid_request_error. Chaque conseiller accepté par Claude Sonnet 5.5 renvoie ses conseils chiffrés, sous forme de bloc advisor_redacted_result, de sorte que votre client ne peut pas lire le texte des conseils. Consultez les sections Compatibilité des modèles et Variantes de résultat de l'outil conseiller.

Fonctionnalités prises en charge

Claude Sonnet 5.5 prend en charge l'effort par message (bêta), les messages système en cours de conversation, les modifications d'outils en cours de conversation (bêta), la « prompt caching » (mise en cache des prompts) avec un prompt minimal pouvant être mis en cache de 512 tokens, le « batch processing » (traitement par lots), l'API Files, la prise en charge des PDF, la vision, ainsi que les outils côté serveur et côté client. L'effort par message, les messages système en cours de conversation et les modifications d'outils en cours de conversation ne sont pas disponibles sur Claude Sonnet 5, dont le prompt minimal pouvant être mis en cache est de 1 024 tokens. Sur l'API Claude et Google Cloud, l'utilisation de l'ordinateur nécessite l'ensemble d'outils computer_toolset_20260801 (consultez le changement incompatible). Consultez la page de chaque fonctionnalité pour connaître la disponibilité selon les modèles.

Compaction à la demande (bêta)

Avec l'en-tête bêta compact-2026-09-04, une requête qui envoie le paramètre compaction de premier niveau renvoie un bloc compaction signé qui résume l'ensemble de la conversation. Vous envoyez ensuite ce bloc en premier, à la place des messages résumés. Vous choisissez quand compacter, et les blocs de réflexion des tours que vous conservez peuvent rester valides après le remplacement, dans les conditions décrites dans Compaction et réflexion préservée. Cela est important sur Claude Sonnet 5.5, car ses blocs de réflexion sont liés à la conversation. Consultez Compaction à la demande pour la disponibilité selon les plateformes et le déroulement complet de la requête.

Définir des outils dans un message (bêta)

Avec l'en-tête bêta inline-tools-2026-09-15, un bloc tool_addition dans un message système en cours de conversation peut contenir une définition d'outil complète au lieu d'une référence. Vous pouvez ajouter un outil, modifier son schéma ou faire passer un outil serveur à une version plus récente en cours de conversation sans modifier tools et sans perdre le cache des prompts. Consultez Définir des outils dans un message.

Les blocs de réflexion restent liés au compte qui les a produits

Les blocs de réflexion produits par Claude Sonnet 5.5 ne fonctionnent que dans le compte qui les a produits, ou dans un compte qui lui est lié. Lorsqu'un autre compte envoie l'un de ces blocs, l'API supprime le bloc avant que le modèle ne le voie, et la requête réussit. Sur l'API Claude et Google Cloud, avec l'en-tête bêta thinking-binding-controls-2026-08-01, la réponse liste chaque bloc supprimé dans input_transformations avec reason: "organization_binding_mismatch". Les blocs des modèles antérieurs ne sont pas concernés. Consultez Réflexion préservée.

Différences de comportement

Claude Sonnet 5.5 diffère de Claude Sonnet 5 de plusieurs manières qui se manifestent sans aucune modification de code. Rédiger des prompts pour Claude Sonnet 5.5 fournit des conseils pour chacune d'elles :

  • Les niveaux d'effort sont recalibrés. Un niveau d'effort ne produit pas la même quantité de réflexion que sur Claude Sonnet 5. Relancez votre balayage des niveaux d'effort plutôt que de reprendre un réglage existant. Commencez à high, sauf si votre charge de travail est agentique ou sensible à la latence. Pour le codage agentique et l'utilisation d'outils en plusieurs étapes, commencez à medium pour les tâches bien spécifiées et passez à high pour les tâches plus difficiles ou plus longues. Pour le chat et les autres travaux sensibles à la latence, commencez à medium ou low.
  • Le texte entre les appels d'outils est renvoyé dans des blocs de réflexion. Entre les appels d'outils, les notes de plus d'une ou deux phrases sont renvoyées sous forme de blocs thinking de mise à jour de progression. Les remarques plus courtes restent du text. Avec la valeur par défaut display: "omitted", le texte des blocs de mise à jour de progression est vide, de sorte qu'une application qui transmet ces notes en streaming à ses utilisateurs devient silencieuse entre les appels d'outils, sans aucune erreur. Si vous désactivez la réflexion préalable avec between_tools, le texte est renvoyé. Le guide de migration explique comment le recevoir.
  • Catégories de protection. Les protections du modèle peuvent refuser une requête dans cinq catégories stop_details. "cyber" signifie que la requête pourrait faciliter un préjudice cybernétique. "bio" signifie qu'elle pourrait faciliter un préjudice biologique. "frontier_llm" signifie qu'elle pourrait contribuer au développement de modèles d'IA concurrents. "reasoning_extraction" signifie qu'elle demande au modèle de reproduire son raisonnement interne dans le texte de la réponse. "general_harms" signifie qu'elle relève d'un autre domaine de la politique d'utilisation. Consultez Refus, repli et facturation.

Refus, repli et facturation

Tout ce qui figure dans Refus et repli s'applique à Claude Sonnet 5.5. Une requête refusée renvoie HTTP 200 avec stop_reason: "refusal" et un objet stop_details qui nomme le domaine de politique concerné. Gérez les refus et configurez le repli. Le repli côté serveur (fallbacks: "default", en bêta, sur l'API Claude) relance les refus "cyber" et "frontier_llm" sur Claude Sonnet 5. Il ne relance pas les refus "bio", "reasoning_extraction" ou "general_harms". Vous pouvez également utiliser le middleware du SDK ou votre propre mécanisme de nouvelle tentative. La facturation d'un refus survenant avant toute sortie dépend de sa catégorie de refus, et il est décompté de vos limites de débit dans tous les cas. Consultez Comment les refus sont facturés.

Tarification

Claude Sonnet 5.5 a les mêmes prix que Claude Sonnet 5, y compris les tarifs de mise en cache des prompts et de traitement par lots. Consultez Tarification pour la liste complète, la résidence des données et la tarification des outils.

Disponibilité

Claude Sonnet 5.5 est disponible sur :

Migrer depuis Claude Sonnet 5

Mettez à jour votre ID de modèle :

model = "claude-sonnet-5"  # Before
model = "claude-sonnet-5-5"  # After

Vérifiez ensuite six points :

  1. Si votre code désactive la réflexion avec disabled, envoyez plutôt between_tools, avec un effort high ou inférieur.
  2. Remplacez les types tool_choice any et tool par auto associé à l'utilisation stricte d'outils.
  3. Conservez des conversations en ajout seul. Une requête qui rejoue un bloc de réflexion de Claude Sonnet 5.5 après une modification de l'historique antérieur peut renvoyer une erreur 400. Consultez Les blocs de réflexion sont liés au modèle et à la conversation.
  4. Si vous utilisez l'utilisation de l'ordinateur via computer_20251124 sur l'API Claude ou Google Cloud, passez à l'ensemble d'outils.
  5. Si vous utilisez l'outil conseiller avec un conseiller Claude Opus 4.8, Claude Opus 4.7 ou Claude Sonnet 5, passez à un conseiller accepté par Claude Sonnet 5.5.
  6. Si votre interface affiche le texte entre les appels d'outils, définissez thinking.display lorsque vous utilisez la réflexion adaptative. Avec between_tools, le texte est renvoyé sans ce réglage. Consultez Le texte entre les appels d'outils est renvoyé dans des blocs de réflexion.

Le guide de migration contient des instructions étape par étape depuis Claude Sonnet 5 et les modèles antérieurs, ainsi que la liste de vérification complète.

Étapes suivantes

Spécifications complètes et tarification de tous les modèles Claude actuels.

Migrez votre code de Claude Sonnet 5 et des modèles antérieurs vers Claude Sonnet 5.5.

Différences de comportement et modèles de prompts propres à Claude Sonnet 5.5.

Contrôlez le nombre de tokens que Claude utilise pour répondre, de low à max.

Fonctionnement de la réflexion adaptative et préservation des blocs de réflexion.

Gérez stop_reason: "refusal" et relancez la requête sur un autre modèle.

Was this page helpful?