Claude Platform Docs
Modèles et tarifsModèles

Claude Opus 5Latest

For complex agentic coding and enterprise work

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$5/ MTok
Output pricing
$25/ MTok

Vue d'ensemble

Claude Opus 5 représente une amélioration majeure par rapport à Claude Opus 4.8, avec les gains les plus importants en raisonnement approfondi, en tâches agentiques et à long horizon, et en mise à l'échelle du calcul au moment de l'inférence. Cette page résume toutes les nouveautés de Claude Opus 5, y compris les modifications d'outils en cours de conversation et deux changements non rétrocompatibles pour le code fonctionnant sur Claude Opus 4.8 : la réflexion est activée par défaut, et la réflexion ne peut être désactivée qu'à un niveau d'effort high ou inférieur.

Nouveautés de Claude Opus 5

Comparaison

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5This model1M128K$5 / $25ModerateAdaptivehighMay 2026
Claude Sonnet 51M128K$2 / $10FastAdaptivehighJan 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtendedFeb 2025

Spécifications

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry

Pricing

Input
$5 / MTok
Output
$25 / MTok
5m cache write
$6.25 / MTok
1h cache write
$10 / MTok
Cache read
$0.50 / MTok
Batch API
50% discount on input and output
Full price list
Pricing

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Moderate
Input → output
Text and images → text
Reliable knowledge cutoff
May 2026
Training data cutoff
May 2026

Availability

Status
Active (latest)
Released
July 24, 2026
Retirement
Not sooner than July 24, 2027

Bon à savoir

  • Sur l'API Message Batches, Claude Opus 5 prend en charge jusqu'à 300 000 tokens de sortie avec l'en-tête bêta output-300k-2026-03-24.
  • La longueur minimale d'un prompt pouvant être mis en cache est de 512 tokens. Consultez Mise en cache des prompts.
  • Interrogez les limites et les capacités par programmation avec l'API Models.

Ressources

Conseils de prompting spécifiques au modèle.

L'effort est défini par défaut sur high pour Claude Opus 5 et compte davantage que sur les modèles précédents. Choisissez un niveau par charge de travail.

Activée par défaut. La désactivation de la réflexion nécessite un effort high ou inférieur.

Claude Opus 5 à latence réduite sur l'API Claude (aperçu de recherche), tarifé séparément.

Référence

L'invite système que Claude Opus 5 utilise sur claude.ai et dans les applications Claude.

Évaluations de sécurité et décisions de déploiement pour Claude Opus 5.

Liste complète des prix, y compris les remises sur les lots et les tarifs de mise en cache des prompts.

Fonctionnement des identifiants de modèle, des alias et des instantanés épinglés.

Statut du cycle de vie et engagements de retrait pour chaque modèle Claude.

Was this page helpful?