Claude Sonnet 5.5Latest
The best combination of speed and intelligence
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $2/ MTok
- Output pricing
- $10/ MTok
Vue d'ensemble
Claude Sonnet 5.5 offre la meilleure combinaison de vitesse et d'intelligence. Cinq « breaking changes » (changements incompatibles) affectent le code qui s'exécute déjà sur Claude Sonnet 5 :
- Désactivez la réflexion préalable avec
between_tools. - L'utilisation forcée d'outils renvoie une erreur.
- Les blocs de réflexion sont liés au modèle et à la conversation.
- Sur l'API Claude et Google Cloud, l'ancien outil d'utilisation de l'ordinateur
computer_20251124n'est pas accepté. - L'outil conseiller rejette Claude Opus 4.8, Claude Opus 4.7 et Claude Sonnet 5 en tant que conseillers.
Un autre changement modifie la forme de la réponse sans faire échouer aucune requête : le texte entre les appels d'outils est renvoyé dans des blocs thinking. Une application qui transmet ce texte en « streaming » (diffusion en continu) à ses utilisateurs devient silencieuse entre les appels d'outils jusqu'à ce qu'elle définisse une valeur display qui renvoie le texte, ou qu'elle désactive la réflexion préalable avec between_tools.
Comparaison
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5This model | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Spécifications
Model IDs
Pricing
- Input
- $2 / MTok
- Output
- $10 / MTok
- 5m cache write
- $2.50 / MTok
- 1h cache write
- $4 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Fast
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 28, 2026
- Retirement
- Not sooner than September 28, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Bon à savoir
- L'« adaptive thinking » (réflexion adaptative) est activée par défaut. Le paramètre de réflexion le plus bas est
between_tools, qui désactive la réflexion préalable. Il fonctionne avec un niveau d'efforthighou inférieur. Consultez Nouveautés de Claude Sonnet 5.5. - Définir
temperature,top_poutop_ksur une valeur autre que celle par défaut renvoie une erreur 400. - La longueur minimale d'un prompt pouvant être mis en cache est de 512 tokens. Consultez « Prompt caching » (mise en cache des prompts).
- Sur la Message Batches API, Claude Sonnet 5.5 prend en charge jusqu'à 300k tokens de sortie avec le « beta header » (en-tête bêta)
output-300k-2026-03-24. - Interrogez les limites et les capacités par programmation avec la Models API.
Ressources
Différences de comportement et modèles de prompts propres à Claude Sonnet 5.5.
Le contrôle de la profondeur de réflexion, de la « latency » (latence) et du coût. Choisissez un niveau par charge de travail.
Fonctionnement de la réflexion adaptative, paramètres de réflexion acceptés par chaque modèle et conservation des blocs de réflexion.
Référence
Liste complète des prix, y compris les remises sur les lots et les tarifs de mise en cache des prompts.
Fonctionnement des identifiants de modèle, des alias et des instantanés épinglés.
Statut du cycle de vie et engagements de retrait pour chaque modèle Claude.
Was this page helpful?