Nouveautés de Claude Haiku 5.5
Présentation des nouvelles fonctionnalités, des changements incompatibles et des changements de comportement de Claude Haiku 5.5, avec un lien vers le guide de chaque fonctionnalité et vers le guide de migration pour les modifications de code.
Claude Haiku 5.5 est conçu pour les tâches à fort volume et sensibles à la « latency » (latence), telles que la classification, le routage, l'extraction et les tâches de sous-agents. Il prend en charge l'« adaptive thinking » (réflexion adaptative) avec le paramètre effort, une « context window » (fenêtre de contexte) de 1M de tokens et jusqu'à 128k tokens de sortie. Il utilise le même tokenizer plus récent que Claude 4.7 et les modèles ultérieurs, de sorte qu'un même texte compte environ 30 % de tokens de plus que sur Claude Haiku 4.5. Ses blocs de réflexion ne fonctionnent que dans le compte qui les a produits, ou dans un compte qui lui est lié.
Pour les modifications de code, consultez le guide de migration. Pour les identifiants de modèle, la tarification et les limites, consultez la présentation de Claude Haiku 5.5. Pour des conseils sur les prompts, consultez Rédiger des prompts pour Claude Haiku 5.5.
Résumé des changements par rapport à Claude Haiku 4.5
Chaque ligne nomme un changement, indique s'il est nouveau, modifié ou incompatible, et précise ce que votre code doit faire.
| Changement | Type | Action requise |
|---|---|---|
| Réflexion adaptative et effort | Nouveau | Facultatif : définissez effort pour arbitrer entre la qualité des réponses d'une part, et la vitesse et le coût d'autre part. |
| Fenêtre de contexte et sortie plus grandes | Nouveau | Aucune. Les valeurs max_tokens existantes restent valides, mais les tokens de réflexion sont comptabilisés dans celles-ci. |
| Outil d'utilisation du navigateur | Nouveau | Aucune. Disponible sur l'API Claude et Google Cloud. |
| Les classificateurs de sécurité peuvent refuser une requête | Nouveau | Gérez stop_reason: "refusal" dans votre client. Le repli côté serveur n'est pas disponible. |
| La réflexion étendue manuelle renvoie une erreur | Incompatible | Remplacez budget_tokens par la réflexion adaptative. |
| Les paramètres d'échantillonnage non par défaut renvoient une erreur | Incompatible | Omettez temperature, top_p et top_k. |
| Le préremplissage des messages de l'assistant renvoie une erreur | Incompatible | Terminez messages par un tour de l'utilisateur. |
| L'utilisation de l'ordinateur nécessite l'ensemble d'outils sur l'API Claude et Google Cloud | Incompatible | Remplacez computer_20250124 par computer_toolset_20260801. |
| La modification des tours précédents invalide les blocs de réflexion | Incompatible | Conservez des conversations en ajout seul si vous renvoyez les blocs de réflexion. |
| Les réponses peuvent commencer par des blocs de réflexion | Modifié | Sélectionnez les blocs de contenu par type, et non par position. |
| Le texte de réflexion est omis par défaut | Modifié | Pour recevoir une réflexion résumée, définissez thinking.display sur "summarized". |
| Un même texte compte davantage de tokens | Modifié | Recomptez vos prompts et revoyez max_tokens ainsi que vos estimations de coûts. |
| Rejouer des blocs de réflexion entre comptes | Modifié | Si vous rejouez des conversations stockées via un autre compte, rejouez chacune d'elles via le compte qui l'a produite. |
Nouvelles fonctionnalités
Réflexion adaptative et effort
Avec la réflexion adaptative, Claude Haiku 5.5 décide quand réfléchir et dans quelle mesure. La réflexion adaptative est activée par défaut. Bien que vous puissiez toujours désactiver la réflexion avec thinking: {"type": "disabled"} à un effort high ou inférieur, la meilleure façon d'arbitrer entre la qualité des réponses d'une part, et la vitesse et le coût d'autre part, consiste à utiliser le paramètre effort.
Fenêtre de contexte et sortie plus grandes
Claude Haiku 5.5 dispose d'une fenêtre de contexte de 1M de tokens et renvoie jusqu'à 128k tokens de sortie, contre 200k et 64k sur Claude Haiku 4.5. Les valeurs max_tokens existantes restent valides, mais les tokens de réflexion sont comptabilisés dans max_tokens, de sorte qu'une limite faible peut interrompre la réponse après un bloc thinking et avant tout texte. Consultez Configurer la réflexion.
Changements de comportement
Les réponses peuvent commencer par des blocs de réflexion
La réflexion adaptative étant activée par défaut, une réponse peut commencer par un ou plusieurs blocs thinking même lorsque la requête ne mentionne pas la réflexion. Le code qui lit le premier bloc de contenu comme étant la réponse doit sélectionner les blocs selon leur champ type. Consultez Configurer la réflexion dans le guide de migration.
Un même texte compte davantage de tokens
Claude Haiku 5.5 utilise le même tokenizer plus récent que Claude 4.7 et les modèles ultérieurs. Comme pour tous les modèles qui utilisent ce tokenizer, un même texte d'entrée produit environ 30 % de tokens de plus sur Claude Haiku 5.5 que sur Claude Haiku 4.5. L'augmentation exacte dépend du contenu. La structure des requêtes et des réponses ne dépend pas du tokenizer, mais tout ce que vous mesurez ou budgétez en tokens change. Consultez Recompter les tokens dans le guide de migration.
Rejouer des blocs de réflexion entre comptes
Les blocs de réflexion de Claude Haiku 5.5 ne fonctionnent que dans le compte qui les a produits, ou dans un compte qui lui est lié. Cela n'a d'importance que si vous stockez des conversations et les rejouez via un autre compte. Consultez Rejouer les blocs de réflexion via le compte qui les a produits.
Was this page helpful?