Claude Platform Docs
Modèles et tarifsClaude Sonnet 5.5

Migrer vers Claude Sonnet 5.5

Migrez votre code vers Claude Sonnet 5.5 depuis Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5, Claude Sonnet 4, Claude 3.7 Sonnet ou Claude Haiku 4.5 : paramètres qui renvoient des erreurs, changements liés à la réflexion et liste de vérification pour chaque modèle de départ.

Ce guide répertorie les modifications de code nécessaires pour passer à Claude Sonnet 5.5 depuis Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5, Claude Sonnet 4, Claude 3.7 Sonnet ou Claude Haiku 4.5. Lisez les deux premières sections, puis poursuivez jusqu'à la section correspondant à votre modèle actuel. La liste de vérification de migration répertorie chaque modification par modèle de départ.

Claude Sonnet 5.5 a les mêmes tarifs que Claude Sonnet 5. Consultez Tarifs de Claude. Pour sa « context window » (fenêtre de contexte) et ses limites de sortie, consultez la page du modèle Claude Sonnet 5.5. Pour les fonctionnalités et le prompting, consultez Nouveautés de Claude Sonnet 5.5 et Rédiger des prompts pour Claude Sonnet 5.5.

Envoyer une requête à Claude Sonnet 5.5

Cette requête fonctionne telle quelle sur Claude Sonnet 5.5. Elle définit un niveau d'effort, et les onglets des SDK lisent la réponse par type de bloc. Elle omet cinq paramètres qui renvoient une erreur 400 : les budgets de réflexion, les paramètres d'échantillonnage, le préremplissage de l'assistant, le choix d'outil forcé et thinking: {"type": "disabled"}.

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=4096,
    messages=[
        {
            "role": "user",
            "content": "Analyze the trade-offs between microservices and monolithic architectures",
        }
    ],
    output_config={"effort": "medium"},
)

print(f"Stop reason: {response.stop_reason}")
for block in response.content:
    if block.type == "text":
        print(block.text)

La réflexion s'exécute par défaut

Sur Claude Sonnet 5.5, une requête sans champ thinking s'exécute avec l'« adaptive thinking » (réflexion adaptative), tout comme thinking: {"type": "adaptive"}. Sur Claude Sonnet 4.6 et les modèles antérieurs, ainsi que sur Claude Haiku 4.5, cette requête s'exécutait sans réflexion. Pour continuer à fonctionner sans réflexion préalable, consultez Désactiver la réflexion préalable.

ModèleRéflexion sans champ thinkingValeurs thinking.type acceptéesdisplay par défaut
Claude Sonnet 5.5Activée"adaptive", "between_tools""omitted"
Claude Sonnet 5Activée"adaptive", "disabled""omitted"
Claude Sonnet 4.6Désactivée"adaptive", "disabled", "enabled" (déprécié)"summarized"
Claude Sonnet 4.5 et Claude Haiku 4.5Désactivée"disabled", "enabled""summarized"

Gérer la réflexion dans les réponses

Le code qui s'exécutait sans réflexion nécessite les trois éléments suivants. Le code provenant de Claude Sonnet 5 intègre probablement déjà les deux premiers.

  • Lisez les blocs de contenu par type. Une réponse peut commencer par des blocs thinking, de sorte que le code qui lit content[0].text ne fonctionne plus.
  • Renvoyez les blocs thinking sans modification dans les boucles d'utilisation d'outils, y compris les blocs vides. Consultez Préserver les blocs de réflexion.
  • Réexaminez max_tokens. Il couvre la réflexion et le texte, et les tokens de réflexion sont facturés comme des tokens de sortie. Consultez Contrôle des coûts.

Le texte de réflexion est omis par défaut. Les blocs thinking arrivent avec un champ thinking vide et une signature. Pour obtenir des résumés lisibles, définissez display: "summarized", la valeur par défaut sur Claude Sonnet 4.6 et les modèles antérieurs, ainsi que sur Claude Haiku 4.5. Consultez Contrôler l'affichage de la réflexion.

Désactiver la réflexion préalable

Pour désactiver la réflexion préalable sur Claude Sonnet 5.5, envoyez thinking: {"type": "between_tools"}. C'est le paramètre de réflexion le plus bas. Ses mises à jour de progression entre les appels d'outils sont toujours renvoyées sous forme de blocs thinking avec leur texte de résumé. Sans outils, la réponse ne contient que du texte. Claude Sonnet 5 désactive plutôt la réflexion avec thinking: {"type": "disabled"}, et les modèles antérieurs s'exécutent sans réflexion par défaut. Sur Claude Sonnet 5.5, disabled renvoie une erreur 400 invalid_request_error :

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

between_tools fonctionne sur toutes les plateformes qui proposent Claude Sonnet 5.5, sans en-tête bêta. Il est accepté aux niveaux d'effort low, medium et high. Aux niveaux xhigh ou max, il renvoie une erreur 400. Pour utiliser ces niveaux, utilisez la réflexion adaptative : omettez le champ thinking ou envoyez thinking: {"type": "adaptive"}. between_tools n'accepte aucun autre champ : display, budget_tokens ou block_binding envoyé avec lui renvoie une erreur 400. Avec le repli côté serveur, une requête between_tools qui se replie sur Claude Sonnet 5 s'y exécute avec thinking: {"type": "disabled"}.

Avec between_tools, l'effort ne peut pas changer en cours de conversation : un output_config.effort par message qui diffère du niveau en vigueur renvoie une erreur 400. Pour faire varier l'effort à chaque tour, utilisez la réflexion adaptative. Pour des conseils de prompting, consultez Fonctionner sans réflexion préalable.

Dans les versions de SDK qui ne définissent pas between_tools, les exemples Python et TypeScript échouent à la vérification de types. Mettez à jour le SDK, ou transmettez la valeur en JSON brut, comme le font les exemples C#, Go et Java.

Avant (Claude Sonnet 5) :

client.messages.create(
    model="claude-sonnet-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    output_config={"effort": "xhigh"},
    messages=[{"role": "user", "content": "..."}],
)

Après (Claude Sonnet 5.5) :

client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=16000,
    thinking={"type": "between_tools"},
    output_config={"effort": "high"},
    messages=[{"role": "user", "content": "..."}],
)

Liste de vérification de migration par modèle de départ

Parcourez les groupes dans l'ordre et arrêtez-vous après celui qui mentionne votre modèle. Sur Claude Haiku 4.5, appliquez tous les groupes sauf « Claude Sonnet 4 ou antérieur », en terminant par « Claude Haiku 4.5 uniquement ».

Tous les modèles de départ

Claude Sonnet 4.6 ou antérieur

Claude Sonnet 4.5 ou antérieur

  • Remplacez les préremplissages de l'assistant.
  • Analysez l'entrée des appels d'outils avec un analyseur JSON standard.
  • Sur Amazon Bedrock, migrez l'utilisation de l'ordinateur de computer_20250124 vers computer_20251124.
  • Définissez output_config.effort explicitement.
  • Supprimez tout en-tête bêta lié à la fenêtre de contexte.
  • Supprimez interleaved-thinking-2025-05-14, et remplacez fine-grained-tool-streaming-2025-05-14 par eager_input_streaming.
  • Déplacez output_format vers output_config.format.

Claude Sonnet 4 ou antérieur

  • Mettez à jour les versions des outils vers text_editor_20250728 et code_execution_20260521.
  • Gérez les raisons d'arrêt refusal et model_context_window_exceeded.
  • Vérifiez la présence de sauts de ligne finaux dans les paramètres de type chaîne des outils.
  • Supprimez token-efficient-tools-2025-02-19 et output-128k-2025-02-19.
  • Révisez vos prompts.

Claude Haiku 4.5 uniquement

  • Remplacez claude-haiku-4-5-20251001 ou son alias.
  • Réétablissez votre référence de coût avec le prix par token plus élevé.
  • Révisez les prompts qui étaient trop courts pour être mis en cache sur Claude Haiku 4.5.

Migrer vers Claude Sonnet 5.5 depuis Claude Sonnet 5

Tous les modèles de départ nécessitent les modifications de cette section. Remplacez votre identifiant de modèle par claude-sonnet-5-5, qui n'a pas de suffixe de date. Sur les autres plateformes, utilisez l'identifiant indiqué sous Disponibilité.

L'utilisation forcée d'outils n'est pas prise en charge

Tous les modèles antérieurs mentionnés sur cette page acceptent un tool_choice de type any ou tool. Claude Sonnet 5.5 rejette les deux avec une erreur 400, y compris sur le point de terminaison de comptage des tokens :

tool_choice: type "tool" and "any" are not supported for this model.

Envoyez tool_choice: {"type": "auto"}, et marquez l'outil avec strict: true afin que son entrée corresponde au schéma. Le modèle peut alors répondre sans appeler l'outil ; indiquez donc dans le prompt quand l'utiliser. L'utilisation stricte d'outils prend en charge un sous-ensemble de JSON Schema et nécessite additionalProperties: false sur chaque objet. Consultez Limitations de JSON Schema. Sur Amazon Bedrock, les sorties structurées, qui incluent l'utilisation stricte d'outils, ne sont pas disponibles pour Claude Sonnet 5.5. Sur cette plateforme, envoyez auto sans strict, indiquez dans le prompt quand appeler l'outil, et validez l'entrée de l'outil dans votre code.

Avant (Claude Sonnet 5) :

client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    tools=tools,
    tool_choice={"type": "tool", "name": "get_weather"},
    messages=[{"role": "user", "content": "What's the weather in Paris?"}],
)

Après (Claude Sonnet 5.5) :

client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=1024,
    # utilisation d'outils stricte : chaque appel respecte le input_schema de l'outil.
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[
        {
            "role": "user",
            "content": "What's the weather in Paris? Use the get_weather tool.",
        }
    ],
)

L'exemple marque comme strict chaque outil de la liste. Une requête peut comporter au maximum 20 outils stricts, et les entrées de toolset MCP, d'utilisation de l'ordinateur et d'utilisation du navigateur n'acceptent pas strict. Dans une liste d'outils plus longue, ne marquez que les outils qui en ont besoin.

Les blocs de réflexion sont liés au modèle et à la conversation

Claude Sonnet 5.5 lit les blocs de réflexion de Claude Sonnet 5, Claude Opus 4.8, Claude Haiku 4.5 et des modèles antérieurs. Il ne lit pas les blocs de Claude Opus 5, Claude Opus 5.5, ni d'aucun modèle Claude Fable ou Claude Mythos. L'API supprime les blocs que le modèle ne peut pas lire. La requête renvoie tout de même 200, et les blocs supprimés ne sont pas facturés. Consultez Changer de modèle en cours de conversation.

Chaque bloc de réflexion de Claude Sonnet 5.5 est également signé sur la conversation qui le précède. Pour les comptes créés le 31 août 2026 à 00:00 UTC ou après, l'API applique cette règle par défaut, sur l'API Claude, Amazon Bedrock et Google Cloud. Sur ces comptes, une requête qui rejoue un bloc après une modification de l'historique antérieur renvoie une erreur 400. Conservez des conversations en ajout seul (append-only), et modifiez les instructions ou les outils à l'aide de messages système en cours de conversation. Les blocs de réflexion produits par Claude Sonnet 5.5 ne fonctionnent que dans le compte qui les a produits, ou dans un compte qui lui est lié. Consultez Réflexion préservée.

L'utilisation de l'ordinateur nécessite le toolset sur l'API Claude et Google Cloud

Sur l'API Claude et Google Cloud, Claude Sonnet 5.5 ne prend en charge l'utilisation de l'ordinateur que via le « toolset » (ensemble d'outils) computer_toolset_20260801. Sur ces plateformes, computer_20251124 renvoie une erreur 400. Claude Sonnet 5.5 n'accepte computer_20250124 sur aucune plateforme. Repérez la version que vous envoyez aujourd'hui :

Version envoyée aujourd'huiModèles de départ qui l'envoientÀ envoyer sur l'API Claude et Google CloudÀ envoyer sur Amazon Bedrock
computer_20251124Claude Sonnet 5, Claude Sonnet 4.6computer_toolset_20260801computer_20251124
computer_20250124Claude Sonnet 4.5, Claude Haiku 4.5, Claude Sonnet 4computer_toolset_20260801computer_20251124

Si vous envoyez l'en-tête bêta fine-grained-tool-streaming-2025-05-14, supprimez-le lorsque vous passez au toolset. Associé à une entrée de toolset, il renvoie une erreur 400. Définissez plutôt eager_input_streaming: true sur chaque outil qui en a besoin.

Le code qui envoie déjà le toolset ne nécessite aucune modification. Migrer depuis computer_20251124 répertorie les modifications à apporter à la requête et à la boucle d'agent. Pour les autres plateformes, consultez Compatibilité.

L'advisor tool accepte moins de conseillers

Avec l'« advisor tool » (outil conseiller), un exécuteur Claude Sonnet 5.5 nécessite l'un de ces conseillers : Claude Opus 5, Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5, Claude Fable 5.1, Claude Mythos 5 ou Claude Mythos 5.1. Les conseillers Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 et Claude Sonnet 4.6 renvoient une erreur 400. Le conseil est renvoyé chiffré sous forme de bloc advisor_redacted_result, de sorte que son texte n'est pas lisible dans la réponse. Consultez Compatibilité des modèles.

Le texte entre les appels d'outils est renvoyé dans des blocs de réflexion

Sur Claude Sonnet 5.5, les notes de plus d'une ou deux phrases que le modèle rédige entre les appels d'outils sont renvoyées sous forme de blocs thinking de mise à jour de progression, vides avec le display par défaut. Les remarques plus courtes restent du text. Sur Claude Sonnet 5 et les modèles antérieurs, tout le texte entre les appels d'outils est renvoyé sous forme de blocs text. Aucune requête n'échoue, mais une interface qui affiche ces notes devient silencieuse.

Avec la réflexion adaptative, définissez display sur "updates" (bêta, en-tête thinking-display-updates-2026-08-18) pour obtenir uniquement les mises à jour, ou sur "summarized" pour les obtenir mêlées au raisonnement. Affichez chaque bloc thinking non vide avant le bloc tool_use qui le suit. Avec between_tools, le texte est renvoyé sans display. Consultez Mises à jour de progression destinées à l'utilisateur.

Classificateurs de sécurité et repli

Claude Sonnet 5.5 refuse dans davantage de catégories que Claude Sonnet 5. Un refus renvoie stop_reason: "refusal", et son stop_details peut indiquer l'une de ces catégories :

  • "cyber" : la requête pourrait permettre des dommages informatiques, comme le développement de logiciels malveillants ou d'exploits.
  • "bio" : la requête pourrait permettre des dommages biologiques, comme des méthodes de laboratoire dangereuses.
  • "frontier_llm" : la requête pourrait contribuer au développement de modèles d'IA concurrents.
  • "reasoning_extraction" : la requête demande au modèle de reproduire son raisonnement interne dans le texte de la réponse.
  • "general_harms" : la requête relève d'un autre domaine de la politique d'utilisation. Un travail bénin peut également déclencher cette catégorie.

Le repli côté serveur (fallbacks: "default", bêta, API Claude uniquement) relance les refus "cyber" et "frontier_llm" sur Claude Sonnet 5. Il ne relance pas les refus "bio", "reasoning_extraction" ou "general_harms". Consultez Refus et repli et Facturation des refus.

Les protections de cybersécurité en temps réel sont nouvelles pour le code provenant de Claude Sonnet 4.6, Claude Sonnet 4.5 et Claude Haiku 4.5. Pour un travail de sécurité légitime, postulez au Cyber Verification Program.

Autres changements

  • « Prompt caching » (mise en cache des prompts) : le prompt minimal pouvant être mis en cache est de 512 tokens, contre 1 024 sur Claude Sonnet 5, Claude Sonnet 4.6 et Claude Sonnet 4.5. Consultez Mise en cache des prompts.
  • Nouvelles fonctionnalités : pour les messages système en cours de conversation, les modifications d'outils en cours de conversation et l'effort par message, consultez Nouveautés de Claude Sonnet 5.5. Avec between_tools, l'effort ne peut pas changer en cours de conversation.

Relancez votre balayage des niveaux d'effort. Claude Sonnet 5.5 dispose de cinq niveaux d'effort : low, medium, high, xhigh et max. La valeur par défaut sur l'API Claude est high. Les niveaux ont été recalibrés, de sorte qu'un niveau ne produit pas la même quantité de réflexion que sur Claude Sonnet 5. Commencez à high, sauf si votre charge de travail est agentique ou sensible à la « latency » (latence). Pour le codage agentique et l'utilisation d'outils en plusieurs étapes, commencez à medium pour les tâches bien spécifiées et passez à high pour les tâches plus difficiles ou plus longues. Pour le chat et les autres travaux sensibles à la latence, commencez à medium ou low. Définissez le niveau dans output_config.effort. Consultez Niveaux d'effort recommandés pour Claude Sonnet 5.5. Réévaluez ensuite les instructions de prompt propres au modèle à l'aide de Rédiger des prompts pour Claude Sonnet 5.5.

Migrer vers Claude Sonnet 5.5 depuis Claude Sonnet 4.6 et les modèles Sonnet antérieurs

Appliquez d'abord toutes les sections précédentes, en remplaçant claude-sonnet-4-6. Effectuez ensuite ces modifications. Sur Claude Sonnet 4.5 ou antérieur, poursuivez avec les sous-sections qui suivent.

Changements incompatibles

La réflexion s'exécute sur les requêtes qui l'omettaient. Consultez La réflexion s'exécute par défaut et Désactiver la réflexion préalable.

Les budgets de réflexion renvoient une erreur. Claude Sonnet 4.6 accepte thinking: {"type": "enabled", "budget_tokens": N} en tant que paramètre déprécié. Claude Sonnet 4.5 et Claude Haiku 4.5 l'utilisent pour toute réflexion. Claude Sonnet 5.5 renvoie une erreur 400 :

"thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

Supprimez le budget et définissez un niveau d'effort. Il n'existe pas de correspondance fixe entre un budget et un niveau d'effort ; exécutez donc vos évaluations à deux ou trois niveaux.

Avant (Claude Sonnet 4.6) :

client.messages.create(
    model="claude-sonnet-4-6",
    max_tokens=16000,
    thinking={"type": "enabled", "budget_tokens": 10000},
    messages=[{"role": "user", "content": "..."}],
)

Après (Claude Sonnet 5.5) :

client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=16000,
    thinking={"type": "adaptive"},
    output_config={"effort": "high"},  # or "max", "xhigh", "medium", "low"
    messages=[{"role": "user", "content": "..."}],
)

Les paramètres d'échantillonnage renvoient une erreur. Claude Sonnet 4.6 et les modèles antérieurs, ainsi que Claude Haiku 4.5, acceptent temperature, top_p et top_k. Sur Claude Sonnet 5.5, une valeur non par défaut renvoie une erreur 400. Supprimez-les.

Le texte de réflexion est omis par défaut. Consultez Gérer la réflexion dans les réponses.

Autres changements

  • Environ 30 % de tokens en plus : Claude Sonnet 5.5 utilise le tokenizer de Claude Sonnet 5. Par rapport à Claude Sonnet 4.6, Claude Sonnet 4.5 et Claude Haiku 4.5, le même texte produit environ 30 % de tokens en plus, selon le contenu. Recomptez avec le comptage des tokens, et réexaminez max_tokens et les coûts.
  • Effort : xhigh est nouveau, et les niveaux ont été recalibrés. Consultez Modifications recommandées.
  • Images : Claude Sonnet 5.5 utilise le niveau d'images haute résolution, jusqu'à 2576 pixels sur le bord le plus long et 4 784 tokens visuels par image. Claude Sonnet 4.6, Claude Sonnet 4.5 et Claude Haiku 4.5 s'arrêtent à 1568 pixels et 1 568 tokens. Une image de 2000×1500 coûte environ 2,5 fois plus de tokens sur Claude Sonnet 5.5. Consultez Résolution et coût en tokens.

Migrer depuis Claude Sonnet 4.5 ou antérieur

Sur Claude Sonnet 4.5, Claude Sonnet 4 ou Claude 3.7 Sonnet, appliquez d'abord toutes les sections précédentes, puis ces modifications.

Le préremplissage renvoie une erreur. Claude Sonnet 5.5 rejette un dernier tour d'assistant prérempli avec une erreur 400, comme le font Claude Sonnet 4.6 et Claude Sonnet 5. Claude Sonnet 4.5, Claude Haiku 4.5 et les modèles plus anciens l'acceptent. L'erreur indique :

This model does not support assistant message prefill. The conversation must end with a user message.

Remplacez chaque préremplissage en fonction de son objectif :

  • Format de sortie : utilisez les sorties structurées, ou des outils avec des champs enum pour la classification.
  • Préambules : demandez une réponse directe dans l'invite système.
  • Refus indésirables : des instructions claires dans le message utilisateur suffisent généralement.
  • Continuations : déplacez-les dans le message utilisateur, par exemple « Your previous response was interrupted and ended with [previous_response]. Continue from where you left off. »
  • Rappels de contexte : placez-les dans le tour de l'utilisateur.

Échappement de l'entrée des outils. L'échappement dans les arguments des appels d'outils peut différer. Analysez input avec un analyseur JSON standard.

Utilisation de l'ordinateur. Claude Sonnet 5.5 n'accepte pas computer_20250124. Consultez le tableau de l'utilisation de l'ordinateur.

Effort. Claude Sonnet 4.5 n'a pas de paramètre d'effort. Définissez un niveau d'effort explicitement, comme le décrit Modifications recommandées.

Contexte et sortie. Claude Sonnet 5.5 dispose d'une fenêtre de contexte plus grande, sans en-tête bêta, et d'une limite de sortie plus élevée. Consultez la page du modèle. Supprimez tout en-tête bêta lié à la fenêtre de contexte.

En-têtes bêta. Supprimez interleaved-thinking-2025-05-14, car la réflexion adaptative s'entrelace automatiquement. Remplacez fine-grained-tool-streaming-2025-05-14 par eager_input_streaming: true sur chaque outil qui en a besoin. Cet en-tête renvoie une erreur 400 lorsqu'il est associé à une entrée de toolset d'utilisation de l'ordinateur ou d'utilisation du navigateur. Consultez Streaming d'outils à granularité fine.

Sorties structurées. Le paramètre output_format est déprécié et sera supprimé à l'avenir. Pour l'utiliser malgré tout, ajoutez l'en-tête bêta structured-outputs-2025-11-13. Sans celui-ci, l'API renvoie une erreur 400. Utilisez plutôt output_config.format.

Migrer depuis Claude Sonnet 4 ou antérieur

Claude Sonnet 4 est retiré sur l'API Claude et reste disponible sur Amazon Bedrock et Google Cloud. Claude 3.7 Sonnet est retiré. Depuis l'un ou l'autre de ces modèles, appliquez d'abord toutes les sections précédentes, puis ces modifications :

  • Versions des outils : utilisez text_editor_20250728, avec le nom d'outil str_replace_based_edit_tool et sans commande undo_edit. Utilisez code_execution_20260521. Consultez l'outil d'édition de texte et l'outil d'exécution de code.
  • Raisons d'arrêt : gérez refusal. Claude 4.5 et les modèles ultérieurs s'arrêtent également avec model_context_window_exceeded lorsque la limite de la fenêtre de contexte est atteinte. Consultez Gérer les raisons d'arrêt.
  • Sauts de ligne finaux : Claude 4.5 et les modèles ultérieurs les conservent dans les paramètres de type chaîne des appels d'outils.
  • En-têtes bêta hérités : supprimez token-efficient-tools-2025-02-19 et output-128k-2025-02-19.
  • Prompts : révisez-les à l'aide des bonnes pratiques de prompting.

Migrer vers Claude Sonnet 5.5 depuis Claude Haiku 4.5

Appliquez d'abord toutes les sections jusqu'à Migrer depuis Claude Sonnet 4.5 ou antérieur incluse, en ignorant la sous-section Claude Sonnet 4. Effectuez ensuite ces modifications :

  • Identifiant du modèle : remplacez claude-haiku-4-5-20251001, ou l'alias claude-haiku-4-5, par claude-sonnet-5-5.
  • Coût : le prix par token est plus élevé, et le même texte produit davantage de tokens. Recomptez les tokens et réétablissez votre référence de coût. Consultez Tarifs de Claude.
  • Mise en cache des prompts : le prompt minimal pouvant être mis en cache passe de 4 096 tokens au minimum de Claude Sonnet 5.5.
  • Réflexion entrelacée : la réflexion adaptative s'exécute automatiquement entre les appels d'outils, sans en-tête bêta.
  • Routage : Claude Sonnet 5.5 lit les blocs de réflexion de Claude Haiku 4.5. Une conversation qui passe au modèle supérieur conserve son raisonnement. Une conversation qui redescend vers Claude Haiku 4.5 perd les blocs de Claude Sonnet 5.5.

Was this page helpful?