Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

Vue d'ensemble

Claude Haiku 5.5 est conçu pour les tâches à fort volume et sensibles à la « latency » (latence), telles que la classification, le routage, l'extraction et les tâches de sous-agents. Il prend en charge l'« adaptive thinking » (réflexion adaptative) avec le paramètre effort, une « context window » (fenêtre de contexte) de 1M de tokens et jusqu'à 128k tokens de sortie. Il utilise le même tokenizer plus récent que Claude 4.7 et les modèles ultérieurs, de sorte qu'un même texte compte environ 30 % de tokens de plus que sur Claude Haiku 4.5. Ses blocs de réflexion ne fonctionnent que dans le compte qui les a produits, ou dans un compte qui lui est lié.

Pour les modifications de code, consultez le guide de migration. Pour les identifiants de modèle, la tarification et les limites, consultez la présentation de Claude Haiku 5.5. Pour des conseils sur les prompts, consultez Rédiger des prompts pour Claude Haiku 5.5.

Nouveautés de Claude Haiku 5.5

Comparaison

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

Spécifications

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

Bon à savoir

  • L'« adaptive thinking » (réflexion adaptative) est activée par défaut. Contrôlez la profondeur de réflexion avec le paramètre effort.
  • Omettez temperature, top_p et top_k, car une valeur autre que celle par défaut pour l'un d'entre eux renvoie une erreur 400.
  • Sur l'API Message Batches, Claude Haiku 5.5 prend en charge jusqu'à 300k « output tokens » (tokens de sortie) avec l'en-tête bêta output-300k-2026-03-24.
  • Interrogez les limites et les capacités de manière programmatique avec l'API Models.

Ressources

Différences de comportement et modèles de prompts propres à Claude Haiku 5.5.

Choisissez un modèle et un niveau d'effort, structurez vos prompts et utilisez le streaming de la sortie pour obtenir des réponses plus rapides.

Claude Haiku 5.5 décide quand réfléchir et dans quelle mesure. Orientez la profondeur avec effort.

1M de tokens. Comment la fenêtre est comptabilisée et gérée.

Référence

L'invite système utilisée par Claude Haiku 5.5 sur claude.ai et dans les applications Claude.

Évaluations de sécurité et décisions de déploiement pour Claude Haiku 5.5.

Liste complète des prix, y compris les remises sur les lots et les tarifs de mise en cache des prompts.

Fonctionnement des identifiants de modèle, des alias et des instantanés épinglés.

Statut du cycle de vie et engagements de retrait pour chaque modèle Claude.

Was this page helpful?