Claude Opus 5Latest
For complex agentic coding and enterprise work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $5/ MTok
- Output pricing
- $25/ MTok
Vue d'ensemble
Claude Opus 5 représente une amélioration majeure par rapport à Claude Opus 4.8, avec les gains les plus importants en raisonnement approfondi, en tâches agentiques et à long horizon, et en mise à l'échelle du calcul au moment de l'inférence. Cette page résume toutes les nouveautés de Claude Opus 5, y compris les modifications d'outils en cours de conversation et deux changements non rétrocompatibles pour le code fonctionnant sur Claude Opus 4.8 : la réflexion est activée par défaut, et la réflexion ne peut être désactivée qu'à un niveau d'effort high ou inférieur.
Comparaison
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5This model | 1M | 128K | $5 / $25 | Moderate | Adaptive | high | May 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Spécifications
Model IDs
- Claude API
Pricing
- Input
- $5 / MTok
- Output
- $25 / MTok
- 5m cache write
- $6.25 / MTok
- 1h cache write
- $10 / MTok
- Cache read
- $0.50 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- May 2026
- Training data cutoff
- May 2026
Availability
- Status
- Active (latest)
- Released
- July 24, 2026
- Retirement
- Not sooner than July 24, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft Foundry
Bon à savoir
- Sur l'API Message Batches, Claude Opus 5 prend en charge jusqu'à 300 000 tokens de sortie avec l'en-tête bêta
output-300k-2026-03-24. - La longueur minimale d'un prompt pouvant être mis en cache est de 512 tokens. Consultez Mise en cache des prompts.
- Interrogez les limites et les capacités par programmation avec l'API Models.
Ressources
Conseils de prompting spécifiques au modèle.
L'effort est défini par défaut sur high pour Claude Opus 5 et compte davantage que sur les modèles précédents. Choisissez un niveau par charge de travail.
Activée par défaut. La désactivation de la réflexion nécessite un effort high ou inférieur.
Claude Opus 5 à latence réduite sur l'API Claude (aperçu de recherche), tarifé séparément.
Référence
L'invite système que Claude Opus 5 utilise sur claude.ai et dans les applications Claude.
Évaluations de sécurité et décisions de déploiement pour Claude Opus 5.
Liste complète des prix, y compris les remises sur les lots et les tarifs de mise en cache des prompts.
Fonctionnement des identifiants de modèle, des alias et des instantanés épinglés.
Statut du cycle de vie et engagements de retrait pour chaque modèle Claude.
Was this page helpful?