Claude Platform Docs
Modèles et tarifsClaude Sonnet 5

Nouveautés de Claude Sonnet 5

Aperçu des nouvelles fonctionnalités et des changements de comportement dans Claude Sonnet 5.

Claude Sonnet 5 est la nouvelle génération de la famille de modèles Sonnet d'Anthropic. Il s'agit d'une mise à niveau directe de Claude Sonnet 4.6 avec trois changements de comportement : l'adaptive thinking (réflexion adaptative) est activée par défaut, l'« extended thinking » (réflexion étendue) manuelle renvoie désormais une erreur 400 (elle était dépréciée sur Claude Sonnet 4.6), et le réglage des paramètres d'échantillonnage (temperature, top_p, top_k) sur des valeurs autres que celles par défaut renvoie une erreur 400. Cette page résume toutes les nouveautés au lancement, y compris un nouveau tokenizer.

Nouveau modèle

ModèleID de modèle APIDescription
Claude Sonnet 5claude-sonnet-5La meilleure combinaison de vitesse et d'intelligence

Claude Sonnet 5 prend en charge par défaut la « context window » (fenêtre de contexte) de 1M de tokens (1M de tokens est à la fois la valeur par défaut et le maximum ; il n'existe pas de variante avec un contexte plus petit), 128k tokens de sortie maximum, la réflexion adaptative, ainsi que le même ensemble d'outils et de fonctionnalités de plateforme que Claude Sonnet 4.6, à l'exception de Priority Tier, qui n'est pas disponible sur Claude Sonnet 5. Sur la Claude API et Google Cloud, Claude Sonnet 5 prend également en charge l'outil d'utilisation du navigateur et la version stable computer_toolset_20260801 de l'outil d'utilisation de l'ordinateur, qu'aucun des deux n'est pris en charge par Claude Sonnet 4.6 ; la version antérieure computer_20251124 est toujours acceptée sur les deux modèles. Pour mettre à niveau une intégration existante, consultez Migrer depuis computer_20251124.

Pour la tarification et les spécifications complètes, consultez la vue d'ensemble des modèles.

Changements de comportement

Réflexion adaptative activée par défaut

Sur Claude Sonnet 4.6, les requêtes sans champ thinking s'exécutent sans réflexion. Sur Claude Sonnet 5, les mêmes requêtes s'exécutent avec la réflexion adaptative. Pour désactiver la réflexion, passez thinking: {type: "disabled"}. Comme max_tokens est une limite stricte sur la sortie totale (réflexion plus texte de réponse), réexaminez-la pour les charges de travail qui s'exécutaient sans réflexion sur Claude Sonnet 4.6.

Paramètres d'échantillonnage non acceptés

Le réglage de temperature, top_p ou top_k sur une valeur autre que celle par défaut renvoie une erreur 400. Supprimez ces paramètres lors de la migration ; la valeur par défaut (ou l'omission du paramètre) est acceptée. Utilisez des instructions dans l'invite système pour guider le comportement du modèle. Ceci est nouveau pour les modèles de classe Sonnet ; la même contrainte avait été introduite précédemment sur Claude Opus 4.7.

Réflexion étendue manuelle supprimée

La réflexion étendue manuelle (thinking: {type: "enabled", budget_tokens: N}) était dépréciée sur Claude Sonnet 4.6 ; sur Claude Sonnet 5, elle est supprimée et renvoie une erreur 400, comme sur Claude Opus 4.8 et Claude Opus 4.7. Utilisez plutôt la réflexion adaptative avec le paramètre effort.

# Non pris en charge sur Claude Sonnet 5 (renvoie une erreur 400)
thinking = {"type": "enabled", "budget_tokens": 32000}

# Utilisez ceci à la place
thinking = {"type": "adaptive"}

Nouveau tokenizer

Claude Sonnet 5 utilise un nouveau tokenizer. Le même texte d'entrée produit environ 30 % de tokens en plus que sur Claude Sonnet 4.6. L'augmentation exacte dépend du contenu. Il ne s'agit pas d'un changement d'API : les requêtes, les réponses et les événements de streaming conservent la même forme, et aucune modification de code n'est requise.

Ce changement affecte tout ce que vous mesurez ou budgétisez en tokens :

  • Décomptes de tokens : les champs usage et les résultats du comptage de tokens pour le même texte sont plus élevés que sur Claude Sonnet 4.6. Ne réutilisez pas les décomptes mesurés sur des modèles antérieurs ; recomptez avec Claude Sonnet 5.
  • Capacité de la fenêtre de contexte en termes de texte : la fenêtre de contexte est de 1M de tokens, mais chaque token couvre en moyenne moins de texte, de sorte que la même fenêtre contient moins de texte que sur Claude Sonnet 4.6.
  • Budgets max_tokens : une limite de sortie ajustée pour Claude Sonnet 4.6 peut tronquer une sortie équivalente sur Claude Sonnet 5. Réexaminez les limites dimensionnées au plus près de la longueur de sortie attendue.
  • Coût par requête : la tarification par token est inférieure à celle de Claude Sonnet 4.6 (voir Tarification), mais comme le même texte produit davantage de tokens, le coût d'une requête équivalente ne diminue pas en proportion directe.

Contraintes d'API héritées de Claude Sonnet 4.6

Préremplissage du message de l'assistant non pris en charge

Le préremplissage du message de l'assistant renvoie une erreur 400, comme sur Claude Sonnet 4.6. Utilisez plutôt les sorties structurées, des instructions dans l'invite système ou output_config.format.

Améliorations des capacités

Claude Sonnet 5 constitue une amélioration des capacités par rapport à Claude Sonnet 4.6, à un prix inférieur. C'est également une option pour les charges de travail qui nécessitent plus de capacités que celles offertes par Claude Sonnet 4.6, sans passer à un modèle de classe Opus.

Les gains les plus importants par rapport à Claude Sonnet 4.6 concernent le codage et les tâches agentiques. Pour les résultats de benchmarks, consultez le Transparency Hub d'Anthropic.

Garde-fous de cybersécurité

Claude Sonnet 5 est le premier modèle de niveau Sonnet doté de garde-fous de cybersécurité en temps réel. Les requêtes portant sur des sujets de cybersécurité interdits ou à haut risque peuvent être refusées. Les refus sont renvoyés sous la forme d'une réponse HTTP 200 réussie avec stop_reason: "refusal", et non d'une erreur. Consultez Garde-fous cyber en temps réel sur Claude Opus et Sonnet pour savoir ce que bloquent les garde-fous et comment les travaux de sécurité légitimes peuvent postuler au Cyber Verification Program.

Tarification

Claude Sonnet 5 est tarifé à 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie, soit une tarification par token inférieure aux 3 $ / 15 $ de Claude Sonnet 4.6. Comme le nouveau tokenizer produit environ 30 % de tokens en plus pour le même texte, le coût d'une requête équivalente ne diminue pas en proportion directe des prix par token par rapport à Claude Sonnet 4.6. La différence exacte dépend du contenu et de la forme de la charge de travail.

Consultez la page Tarification pour la tarification complète, y compris les tarifs du traitement par lots et de la mise en cache des prompts.

Disponibilité

Au lancement, Claude Sonnet 5 est disponible sur :

Claude Sonnet 5 prend en charge la rétention zéro des données pour les organisations disposant d'accords ZDR.

Guide de migration

Claude Sonnet 5 est un remplacement direct de Claude Sonnet 4.6. Mettez à jour votre ID de modèle :

model = "claude-sonnet-4-6"  # Before
model = "claude-sonnet-5"  # After

Passez ensuite en revue les points suivants :

  1. Budgets et décomptes de tokens : le nouveau tokenizer produit environ 30 % de tokens en plus pour le même texte. L'augmentation exacte dépend du contenu et de la forme de la charge de travail. Recomptez vos prompts avec le comptage de tokens, et réexaminez les limites max_tokens dimensionnées au plus près de la longueur de sortie attendue.
  2. Réflexion étendue : si vous définissez encore budget_tokens, migrez vers la réflexion adaptative. La réflexion étendue manuelle (thinking: {type: "enabled"}) n'est pas prise en charge et renvoie une erreur 400.
  3. Paramètres d'échantillonnage : les requêtes qui définissent des paramètres d'échantillonnage (temperature, top_p, top_k) sur une valeur autre que celle par défaut renvoient une erreur 400 ; supprimez-les lors de la migration. Les définitions d'outils et les formes de réponse sont inchangées, et le préremplissage du message de l'assistant n'était déjà pas pris en charge sur Claude Sonnet 4.6.

Consultez Migrer vers Claude Sonnet 5 depuis Claude Sonnet 4.6 pour plus de détails.

Étapes suivantes

Spécifications et tarification complètes pour tous les modèles Claude actuels.

Mesurez vos prompts avec le nouveau tokenizer avant de migrer.

Le mode de réflexion activée recommandé sur Claude Sonnet 5.

Fonctionnement de la fenêtre de contexte de 1M de tokens.

Tarification complète, y compris les tarifs du traitement par lots et de la mise en cache des prompts.

Was this page helpful?