Claude Opus 5.5Latest
For long-running agentic coding and knowledge work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $4/ MTok
- Output pricing
- $20/ MTok
Vue d'ensemble
Claude Opus 5.5 est conçu pour le codage agentique de longue durée et le travail intellectuel. Son prix est de 4 $ / 20 $ USD par million de tokens d'entrée / de sortie. Quatre « breaking changes » (changements incompatibles) affectent le code déjà exécuté sur Claude Opus 5 : la réflexion ne peut pas être désactivée, l'utilisation forcée d'outils renvoie une erreur, les blocs de réflexion sont liés au modèle et à la conversation et, sur l'API Claude et Google Cloud, l'ancien outil d'utilisation de l'ordinateur computer_20251124 n'est pas accepté. Les trois premiers s'appliquent également à Claude Fable 5.1. Un autre changement modifie la forme de la réponse sans faire échouer aucune requête : le texte entre les appels d'outils est renvoyé dans des blocs thinking, dont le texte est vide avec le paramètre display par défaut. Une application qui transmet ce texte en streaming à ses utilisateurs sous forme de mises à jour de progression devient silencieuse entre les appels d'outils tant qu'elle ne définit pas une valeur display qui renvoie le texte.
Comparaison
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5This model | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Spécifications
Model IDs
- Claude API
Pricing
- Input
- $4 / MTok
- Output
- $20 / MTok
- 5m cache write
- $5 / MTok
- 1h cache write
- $8 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive (always on)
- Default effort
medium- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 22, 2026
- Retirement
- Not sooner than September 22, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Bon à savoir
- La réflexion adaptative est toujours activée et ne peut pas être désactivée. Contrôlez la profondeur de réflexion avec le paramètre effort.
- Sur l'API Message Batches, Claude Opus 5.5 prend en charge jusqu'à 300 000 tokens de sortie avec l'en-tête bêta
output-300k-2026-03-24. - La longueur minimale d'un prompt pouvant être mis en cache est de 512 tokens. Consultez Mise en cache des prompts.
- Interrogez les limites et les capacités par programmation avec l'API Models.
Ressources
Différences de comportement et modèles de prompting propres à Claude Opus 5.5.
Le paramètre qui contrôle la profondeur de réflexion, la latence et le coût. Choisissez un niveau par charge de travail.
Fonctionnement de la réflexion adaptative et préservation des blocs de réflexion.
Claude Opus 5.5 à latence réduite sur l'API Claude (aperçu de recherche), facturé séparément.
Référence
L'invite système que Claude Opus 5.5 utilise sur claude.ai et dans les applications Claude.
Évaluations de sécurité et décisions de déploiement pour Claude Opus 5.5.
Liste complète des prix, y compris les remises sur les traitements par lots et les tarifs de mise en cache des prompts.
Fonctionnement des identifiants de modèle, des alias et des instantanés épinglés.
Statut du cycle de vie et engagements de retrait pour chaque modèle Claude.
Was this page helpful?