Migrer vers Claude Sonnet 5
Migrez vers Claude Sonnet 5 depuis des modèles Claude antérieurs : identifiants de modèle, changements non rétrocompatibles et listes de contrôle de migration.
Claude Sonnet 5 offre la meilleure combinaison de vitesse et d'intelligence de la famille de modèles Claude. Il s'appuie sur Claude Sonnet 4.6.
Claude Sonnet 5 est une mise à niveau directe de Claude Sonnet 4.6, au tarif de 2 $ / 10 $ USD par million de tokens d'entrée/sortie ; consultez la page Tarification pour plus de détails. Il existe deux changements d'API non rétrocompatibles pour le code qui s'exécute déjà sur Claude Sonnet 4.6. Premièrement, l'« adaptive thinking » (réflexion adaptative) est activée par défaut et l'« extended thinking » (réflexion étendue) manuelle (thinking: {type: "enabled", budget_tokens: N}) renvoie une erreur 400 ; les requêtes qui s'exécutaient sans réflexion peuvent donc désormais renvoyer des blocs thinking avant le premier bloc text, et le code qui lit le contenu par position doit sélectionner les blocs de contenu par type. Consultez la page sur la réflexion adaptative. Deuxièmement, les paramètres d'échantillonnage (temperature, top_p, top_k) définis sur des valeurs autres que celles par défaut renvoient une erreur 400. Utilisez la réflexion adaptative avec le paramètre effort pour contrôler la profondeur de réflexion. Claude Sonnet 5 prend en charge le même ensemble de fonctionnalités que Claude Sonnet 4.6, notamment la « context window » (fenêtre de contexte) de 1 million de tokens, la réflexion adaptative, le « prompt caching » (mise en cache des prompts), le traitement par lots, l'API Files, la prise en charge des PDF, la vision et l'ensemble complet des outils côté serveur et côté client. Sur la Claude API et Google Cloud, Claude Sonnet 5 prend également en charge le « computer use » (utilisation de l'ordinateur) sous la forme de l'ensemble d'outils stable computer_toolset_20260801 ainsi que l'outil « browser use » (utilisation du navigateur) pour les tâches à l'intérieur de pages web, qu'aucun des deux Claude Sonnet 4.6 ne prend en charge ; les intégrations existantes sur la version antérieure computer_20251124 continuent de fonctionner sans modification sur les deux modèles. Pour mettre à niveau une intégration existante, consultez Migrer depuis computer_20251124. Le Priority Tier n'est pas disponible sur Claude Sonnet 5. Claude Sonnet 5 utilise également un nouveau « tokenizer » (tokeniseur).
Migrer vers Claude Sonnet 5 depuis Claude Sonnet 4.6
Mettre à jour le nom de votre modèle
# Migration vers Sonnet
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # AfterCe qui a changé
Les points 4 et 5 de la liste suivante sont des changements non rétrocompatibles. max_tokens reste une limite stricte sur la sortie totale (réflexion plus texte de réponse) ; réexaminez-la donc pour les charges de travail qui s'exécutaient sans réflexion sur Claude Sonnet 4.6.
-
Nouveau tokeniseur : Claude Sonnet 5 utilise un nouveau tokeniseur. Le même texte d'entrée produit environ 30 % de tokens de plus que sur Claude Sonnet 4.6. L'augmentation exacte dépend du contenu. Les requêtes, les réponses et les événements de streaming conservent la même forme, et aucune modification de code n'est requise, mais tout ce que vous mesurez ou budgétisez en tokens change : les champs
usageet les résultats du comptage de tokens pour le même texte sont plus élevés, la fenêtre de contexte de 1 million de tokens contient moins de texte, et une limitemax_tokensajustée pour Claude Sonnet 4.6 peut tronquer une sortie équivalente. La tarification par token est plus basse (2 $ / 10 $ USD contre 3 $ / 15 $ USD pour Claude Sonnet 4.6 par million de tokens d'entrée/sortie), mais le coût d'une requête équivalente ne diminue pas en proportion directe. Relancez le comptage de tokens sur Claude Sonnet 5 plutôt que de réutiliser des comptages mesurés sur des modèles antérieurs. -
128k tokens de sortie maximum (inchangé) : Claude Sonnet 5 prend en charge jusqu'à 128k tokens de sortie, comme Claude Sonnet 4.6. Les valeurs
max_tokensexistantes restent valides. Tenez compte du nouveau tokeniseur lorsque vous les dimensionnez. -
Préremplissage des messages de l'assistant (inchangé) : Le « prefilling » (préremplissage) du message de l'assistant renvoie une erreur
400sur Claude Sonnet 5, comme sur Claude Sonnet 4.6. Si vous avez supprimé le préremplissage lors de la migration vers Claude Sonnet 4.6, aucune modification supplémentaire n'est nécessaire. Utilisez plutôt les sorties structurées, des instructions dans l'invite système ououtput_config.format. -
Réflexion adaptative activée par défaut : Sur Claude Sonnet 4.6, les requêtes sans champ
thinkings'exécutent sans réflexion ; sur Claude Sonnet 5, les mêmes requêtes s'exécutent avec la réflexion adaptative. Pour désactiver la réflexion, passezthinking: {type: "disabled"}. La réflexion étendue manuelle (thinking: {type: "enabled", budget_tokens: N}) n'est pas prise en charge et renvoie une erreur 400. Utilisez le paramètre effort (highpar défaut) pour contrôler la profondeur de réflexion.Lorsque la réflexion est activée, une réponse peut commencer par un ou plusieurs blocs
thinkingavant le premier bloctext, renvoyés avec un champthinkingvide avec la valeur par défautdisplay: "omitted". Le code qui lit la réponse par position, commecontent[0].textou un gestionnaire de flux qui traite le premier bloc de contenu comme du texte, doit à la place sélectionner les blocs de contenu par leur champtype, et les boucles d'utilisation d'outils doivent renvoyer les blocsthinkingcomplets et non modifiés avec leurs résultats d'outils (consultez Préserver les blocs de réflexion). Les tokens de réflexion sont facturés comme des tokens de sortie même lorsque le texte de réflexion n'est pas renvoyé. Si vous utilisiez la réflexion sur Claude Sonnet 4.6 et affichez le texte de réflexion renvoyé, notez quethinking.displayavait pour valeur par défaut"summarized"sur ce modèle et a pour valeur par défaut"omitted"sur Claude Sonnet 5 ; définissezdisplay: "summarized", comme le fait l'exemple suivant, pour continuer à recevoir des résumés lisibles (consultez Contrôler l'affichage de la réflexion).client = anthropic.Anthropic() response = client.messages.create( model="claude-sonnet-5", max_tokens=16000, thinking={"type": "adaptive", "display": "summarized"}, output_config={"effort": "high"}, messages=[ { "role": "user", "content": "Are there an infinite number of prime numbers such that n mod 4 == 3?", } ], ) # La réponse contient des blocs de réflexion résumés et des blocs de texte for block in response.content: match block.type: case "thinking": print(f"\nThinking summary: {block.thinking}") case "text": print(f"\nResponse: {block.text}") -
Paramètres d'échantillonnage supprimés : Les paramètres d'échantillonnage (
temperature,top_p,top_k) définis sur une valeur autre que celle par défaut ne sont pas acceptés et renvoient une erreur 400. -
Garde-fous de cybersécurité : Claude Sonnet 5 est le premier modèle de niveau Sonnet doté de garde-fous de cybersécurité en temps réel. Les requêtes portant sur des sujets de cybersécurité interdits ou à haut risque peuvent être refusées. Les refus sont renvoyés sous la forme d'une réponse HTTP 200 réussie avec
stop_reason: "refusal", et non d'une erreur. Consultez Garde-fous cyber en temps réel sur Claude Opus et Sonnet pour savoir ce que les garde-fous bloquent et comment les travaux de sécurité légitimes peuvent postuler au Cyber Verification Program.
Liste de contrôle de migration
- Mettez à jour le nom du modèle de
claude-sonnet-4-6versclaude-sonnet-5. - Relancez le comptage de tokens sur Claude Sonnet 5. Le nouveau tokeniseur produit environ 30 % de tokens de plus pour le même texte, ce qui peut modifier le coût par requête même si la tarification par token est plus basse. L'augmentation exacte dépend du contenu et de la forme de la charge de travail.
- Réexaminez les limites
max_tokensdimensionnées au plus près de votre longueur de sortie attendue, et augmentez-les jusqu'au maximum de 128k (inchangé par rapport à Claude Sonnet 4.6) lorsque c'est utile. - Supprimez la configuration
thinking: {type: "enabled", budget_tokens: N}(renvoie une erreur 400). La réflexion adaptative est activée par défaut ; passez{type: "disabled"}pour la désactiver, ou utilisez le paramètre effort pour contrôler la profondeur. - Mettez à jour l'analyse des réponses qui lit le contenu par position, comme
content[0].text: lorsque la réflexion est activée, les blocsthinkingarrivent avant les blocstext. Sélectionnez plutôt les blocs de contenu partype, et renvoyez les blocsthinkingnon modifiés dans les boucles d'utilisation d'outils ; les blocs modifiés renvoient une erreur 400. - Vérifiez que tout code qui analyse le champ
thinkingle traite uniquement comme du texte d'affichage.thinking.displaya pour valeur par défaut"omitted"sur Claude Sonnet 5 (la valeur par défaut était"summarized"sur Claude Sonnet 4.6), de sorte que les blocs de réflexion arrivent avec un champthinkingvide ; définissezdisplay: "summarized"pour recevoir des résumés lisibles. Consultez Contrôler l'affichage de la réflexion. - Supprimez les paramètres
temperature,top_pettop_kdéfinis sur des valeurs autres que celles par défaut (ils renvoient une erreur 400 sur Claude Sonnet 5). - Ajoutez une gestion de
stop_reason: "refusal"si votre charge de travail peut toucher à des sujets de cybersécurité. - Réétablissez une référence de coût sur votre charge de travail typique avant le déploiement en production.
- Réexaminez
max_tokenspour les charges de travail qui s'exécutaient auparavant sans réflexion.
Migrer vers Claude Sonnet 5 depuis Claude Sonnet 4.5 et les modèles Sonnet antérieurs
Si vous migrez directement de Claude Sonnet 4.5 ou d'un modèle Sonnet antérieur vers Claude Sonnet 5, appliquez les changements de la section Migrer vers Claude Sonnet 5 depuis Claude Sonnet 4.6 ainsi que les changements de cette section.
Changements non rétrocompatibles
Lors d'une migration depuis Sonnet 4.5
-
Le préremplissage des messages de l'assistant n'est plus pris en charge
Le préremplissage des messages de l'assistant renvoie une erreur
400sur Claude Sonnet 4.6 et les modèles ultérieurs, y compris Claude Sonnet 5. Utilisez plutôt les sorties structurées, des instructions dans l'invite système ououtput_config.format.Cas d'usage courants du préremplissage et migrations :
-
Contrôler le formatage de la sortie (forcer une sortie JSON/YAML) : utilisez les sorties structurées ou des outils avec des champs enum pour les tâches de classification.
-
Éliminer les préambules (supprimer les formules du type « Voici... ») : ajoutez des instructions directes dans l'invite système : « Réponds directement sans préambule. Ne commence pas par des formules comme "Voici...", "D'après...", etc. »
-
Éviter les refus inappropriés : Claude est désormais bien meilleur pour refuser de manière appropriée. Un prompt clair dans le message utilisateur, sans préremplissage, devrait suffire.
-
Continuations (reprendre des réponses interrompues) : déplacez la continuation dans le message utilisateur : « Ta réponse précédente a été interrompue et s'est terminée par
[previous_response]. Continue là où tu t'es arrêté. » -
Hydratation du contexte / cohérence du rôle (rafraîchir le contexte dans les longues conversations) : injectez plutôt dans le tour de l'utilisateur ce qui était auparavant des rappels préremplis dans le message de l'assistant.
-
-
L'échappement JSON des paramètres d'outils peut différer
L'échappement des chaînes JSON dans les paramètres d'outils peut différer de celui des modèles précédents. Les analyseurs JSON standard gèrent cela automatiquement, mais une analyse personnalisée basée sur les chaînes peut nécessiter des mises à jour.
Changements relatifs à la réflexion étendue : Les configurations budget_tokens de Claude Sonnet 4.5 (thinking: {type: "enabled", budget_tokens: N}) ne sont pas prises en charge sur Claude Sonnet 5 et renvoient une erreur 400. La réflexion adaptative est activée par défaut, de sorte que la plupart des charges de travail n'ont besoin d'aucune configuration thinking ; utilisez le paramètre effort pour contrôler la profondeur de réflexion. Si vous exécutiez Claude Sonnet 4.5 sans réflexion étendue, passez thinking: {type: "disabled"} pour conserver ce comportement.
Lors d'une migration depuis Claude 3.x
-
Supprimer les paramètres d'échantillonnage
Les paramètres d'échantillonnage (
temperature,top_p,top_k) définis sur une valeur autre que celle par défaut renvoient une erreur 400 sur Claude Sonnet 5. Supprimez-les des requêtes et utilisez plutôt le prompting pour guider le comportement du modèle. -
Mettre à jour les versions des outils
Passez aux dernières versions des outils (
text_editor_20250728,code_execution_20260521). Supprimez tout code utilisant la commandeundo_edit. -
Gérer le motif d'arrêt
refusalMettez à jour votre application pour gérer les motifs d'arrêt
refusal. -
Mettre à jour vos prompts pour les changements de comportement
Les modèles Claude 4 ont un style de communication plus concis et direct. Consultez les bonnes pratiques de prompting pour des conseils d'optimisation.
Migrer vers Claude Sonnet 5 depuis Claude Haiku 4.5
Claude Haiku 4.5 et Claude Sonnet 5 diffèrent davantage au niveau de l'API que des modèles adjacents au sein d'une même classe : Claude Haiku 4.5 utilise la réflexion étendue manuelle (désactivée par défaut), une fenêtre de contexte de 200k tokens et jusqu'à 64k tokens de sortie, tandis que Claude Sonnet 5 s'exécute avec la réflexion adaptative activée par défaut, offre par défaut une fenêtre de contexte de 1 million de tokens et prend en charge jusqu'à 128k tokens de sortie.
Mettre à jour le nom de votre modèle
model = "claude-haiku-4-5-20251001" # Before
model = "claude-sonnet-5" # AfterCe qui a changé
-
Configuration de la réflexion : Claude Haiku 4.5 prend en charge la réflexion étendue manuelle (
thinking: {type: "enabled", budget_tokens: N}) et rejettethinking: {type: "adaptive"}. Sur Claude Sonnet 5, la prise en charge est inversée : la réflexion adaptative est activée par défaut, et la réflexion étendue manuelle renvoie une erreur 400. Supprimez les configurationsthinking: {type: "enabled", budget_tokens: N}et appuyez-vous sur la valeur par défaut, ou passezthinking: {type: "disabled"}pour désactiver la réflexion.budget_tokensn'a pas de remplacement direct ; utilisez le paramètre effort pour contrôler la profondeur de réflexion. Le paramètre effort n'est pas disponible sur Claude Haiku 4.5 et a pour valeur par défauthighsur Claude Sonnet 5.La forme de la réponse change pour les deux types de requêtes Claude Haiku 4.5. Les requêtes qui s'exécutaient sans réflexion étendue peuvent désormais renvoyer un ou plusieurs blocs
thinkingavant le premier bloctext; le code qui lit la réponse par position, commecontent[0].text, doit donc à la place sélectionner les blocs de contenu par leur champtype, et les boucles d'utilisation d'outils doivent renvoyer les blocsthinkingcomplets et non modifiés avec leurs résultats d'outils (consultez Préserver les blocs de réflexion). Les requêtes qui utilisaient la réflexion étendue continuent de recevoir des blocsthinking, maisthinking.displaya pour valeur par défaut"omitted"sur Claude Sonnet 5 plutôt que"summarized", de sorte que ces blocs arrivent avec un champthinkingvide ; définissezdisplay: "summarized"pour continuer à recevoir des résumés lisibles (consultez Contrôler l'affichage de la réflexion). Les tokens de réflexion sont facturés comme des tokens de sortie même lorsque le texte de réflexion n'est pas renvoyé. -
Paramètres d'échantillonnage supprimés :
temperatureettop_pfonctionnent sur Claude Haiku 4.5 (un seul à la fois, pas les deux). Sur Claude Sonnet 5, définirtemperature,top_poutop_ksur une valeur autre que celle par défaut renvoie une erreur 400. Supprimez ces paramètres et utilisez le prompting pour guider le comportement du modèle. -
Préremplissage de l'assistant supprimé : Le préremplissage du message de l'assistant fonctionne sur Claude Haiku 4.5 mais renvoie une erreur 400 sur Claude Sonnet 5. Utilisez plutôt les sorties structurées, des instructions dans l'invite système ou
output_config.format. -
Fenêtre de contexte et sortie plus grandes : Claude Sonnet 5 offre par défaut une fenêtre de contexte de 1 million de tokens, contre 200k tokens sur Claude Haiku 4.5, et prend en charge jusqu'à 128k tokens de sortie, contre 64k. Claude Sonnet 5 utilise également un tokeniseur différent ; relancez donc le comptage de tokens plutôt que de réutiliser des comptages mesurés sur Claude Haiku 4.5.
-
Tarification : Claude Haiku 4.5 est au tarif de 1 $ / 5 $ USD par million de tokens d'entrée/sortie. Claude Sonnet 5 est au tarif de 2 $ / 10 $ USD par million de tokens d'entrée/sortie. Consultez la tarification de Claude.
-
Garde-fous de cybersécurité : Claude Sonnet 5 dispose de garde-fous de cybersécurité en temps réel. Les requêtes portant sur des sujets de cybersécurité interdits ou à haut risque peuvent être refusées, et renvoyées sous la forme d'une réponse HTTP 200 réussie avec
stop_reason: "refusal". Consultez Garde-fous cyber en temps réel sur Claude Opus et Sonnet pour savoir ce que les garde-fous bloquent et comment les travaux de sécurité légitimes peuvent postuler au Cyber Verification Program.
Liste de contrôle de migration
- Mettez à jour le nom du modèle de
claude-haiku-4-5-20251001(ou l'aliasclaude-haiku-4-5) versclaude-sonnet-5. - Supprimez la configuration
thinking: {type: "enabled", budget_tokens: N}(renvoie une erreur 400). La réflexion adaptative est activée par défaut ; passezthinking: {type: "disabled"}pour conserver le comportement sans réflexion, et réexaminezmax_tokenspour les charges de travail qui s'exécutaient sans réflexion. - Mettez à jour l'analyse des réponses qui lit le contenu par position, comme
content[0].text: lorsque la réflexion est activée, les blocsthinkingarrivent avant les blocstext. Sélectionnez plutôt les blocs de contenu partype, et renvoyez les blocsthinkingnon modifiés dans les boucles d'utilisation d'outils ; les blocs modifiés renvoient une erreur 400. - Si votre interface utilisateur affiche le contenu de réflexion, définissez
display: "summarized".thinking.displaya pour valeur par défaut"omitted"sur Claude Sonnet 5, de sorte que les blocs de réflexion arrivent sinon avec un champthinkingvide. Consultez Contrôler l'affichage de la réflexion. - Utilisez le paramètre effort (
highpar défaut) pour contrôler la profondeur de réflexion et la dépense en tokens ; il n'est pas disponible sur Claude Haiku 4.5, donc aucun réglage existant n'est reporté. - Supprimez les réglages
temperatureettop_p(les valeurs autres que celles par défaut renvoient une erreur 400 sur Claude Sonnet 5). - Supprimez tout préremplissage de message de l'assistant (il renvoie une erreur 400 sur Claude Sonnet 5).
- Relancez le comptage de tokens sur Claude Sonnet 5, et réexaminez les limites
max_tokens, que vous pouvez augmenter jusqu'au maximum de 128k. - Ajoutez une gestion de
stop_reason: "refusal"si votre charge de travail peut toucher à des sujets de cybersécurité. - Réétablissez une référence de coût sur votre charge de travail typique avant le déploiement en production ; la tarification par token diffère.
Was this page helpful?