Claude Platform Docs
Modèles et tarifsClaude Haiku 5.5

Nouveautés de Claude Haiku 5.5

Présentation des nouvelles fonctionnalités, des changements incompatibles et des changements de comportement de Claude Haiku 5.5, avec un lien vers le guide de chaque fonctionnalité et vers le guide de migration pour les modifications de code.

Claude Haiku 5.5 est conçu pour les tâches à fort volume et sensibles à la « latency » (latence), telles que la classification, le routage, l'extraction et les tâches de sous-agents. Il prend en charge l'« adaptive thinking » (réflexion adaptative) avec le paramètre effort, une « context window » (fenêtre de contexte) de 1M de tokens et jusqu'à 128k tokens de sortie. Il utilise le même tokenizer plus récent que Claude 4.7 et les modèles ultérieurs, de sorte qu'un même texte compte environ 30 % de tokens de plus que sur Claude Haiku 4.5. Ses blocs de réflexion ne fonctionnent que dans le compte qui les a produits, ou dans un compte qui lui est lié.

Pour les modifications de code, consultez le guide de migration. Pour les identifiants de modèle, la tarification et les limites, consultez la présentation de Claude Haiku 5.5. Pour des conseils sur les prompts, consultez Rédiger des prompts pour Claude Haiku 5.5.

Résumé des changements par rapport à Claude Haiku 4.5

Chaque ligne nomme un changement, indique s'il est nouveau, modifié ou incompatible, et précise ce que votre code doit faire.

ChangementTypeAction requise
Réflexion adaptative et effortNouveauFacultatif : définissez effort pour arbitrer entre la qualité des réponses d'une part, et la vitesse et le coût d'autre part.
Fenêtre de contexte et sortie plus grandesNouveauAucune. Les valeurs max_tokens existantes restent valides, mais les tokens de réflexion sont comptabilisés dans celles-ci.
Outil d'utilisation du navigateurNouveauAucune. Disponible sur l'API Claude et Google Cloud.
Les classificateurs de sécurité peuvent refuser une requêteNouveauGérez stop_reason: "refusal" dans votre client. Le repli côté serveur n'est pas disponible.
La réflexion étendue manuelle renvoie une erreurIncompatibleRemplacez budget_tokens par la réflexion adaptative.
Les paramètres d'échantillonnage non par défaut renvoient une erreurIncompatibleOmettez temperature, top_p et top_k.
Le préremplissage des messages de l'assistant renvoie une erreurIncompatibleTerminez messages par un tour de l'utilisateur.
L'utilisation de l'ordinateur nécessite l'ensemble d'outils sur l'API Claude et Google CloudIncompatibleRemplacez computer_20250124 par computer_toolset_20260801.
La modification des tours précédents invalide les blocs de réflexionIncompatibleConservez des conversations en ajout seul si vous renvoyez les blocs de réflexion.
Les réponses peuvent commencer par des blocs de réflexionModifiéSélectionnez les blocs de contenu par type, et non par position.
Le texte de réflexion est omis par défautModifiéPour recevoir une réflexion résumée, définissez thinking.display sur "summarized".
Un même texte compte davantage de tokensModifiéRecomptez vos prompts et revoyez max_tokens ainsi que vos estimations de coûts.
Rejouer des blocs de réflexion entre comptesModifiéSi vous rejouez des conversations stockées via un autre compte, rejouez chacune d'elles via le compte qui l'a produite.

Nouvelles fonctionnalités

Réflexion adaptative et effort

Avec la réflexion adaptative, Claude Haiku 5.5 décide quand réfléchir et dans quelle mesure. La réflexion adaptative est activée par défaut. Bien que vous puissiez toujours désactiver la réflexion avec thinking: {"type": "disabled"} à un effort high ou inférieur, la meilleure façon d'arbitrer entre la qualité des réponses d'une part, et la vitesse et le coût d'autre part, consiste à utiliser le paramètre effort.

Fenêtre de contexte et sortie plus grandes

Claude Haiku 5.5 dispose d'une fenêtre de contexte de 1M de tokens et renvoie jusqu'à 128k tokens de sortie, contre 200k et 64k sur Claude Haiku 4.5. Les valeurs max_tokens existantes restent valides, mais les tokens de réflexion sont comptabilisés dans max_tokens, de sorte qu'une limite faible peut interrompre la réponse après un bloc thinking et avant tout texte. Consultez Configurer la réflexion.

Changements de comportement

Les réponses peuvent commencer par des blocs de réflexion

La réflexion adaptative étant activée par défaut, une réponse peut commencer par un ou plusieurs blocs thinking même lorsque la requête ne mentionne pas la réflexion. Le code qui lit le premier bloc de contenu comme étant la réponse doit sélectionner les blocs selon leur champ type. Consultez Configurer la réflexion dans le guide de migration.

Un même texte compte davantage de tokens

Claude Haiku 5.5 utilise le même tokenizer plus récent que Claude 4.7 et les modèles ultérieurs. Comme pour tous les modèles qui utilisent ce tokenizer, un même texte d'entrée produit environ 30 % de tokens de plus sur Claude Haiku 5.5 que sur Claude Haiku 4.5. L'augmentation exacte dépend du contenu. La structure des requêtes et des réponses ne dépend pas du tokenizer, mais tout ce que vous mesurez ou budgétez en tokens change. Consultez Recompter les tokens dans le guide de migration.

Rejouer des blocs de réflexion entre comptes

Les blocs de réflexion de Claude Haiku 5.5 ne fonctionnent que dans le compte qui les a produits, ou dans un compte qui lui est lié. Cela n'a d'importance que si vous stockez des conversations et les rejouez via un autre compte. Consultez Rejouer les blocs de réflexion via le compte qui les a produits.

Was this page helpful?