Claude Opus 5Latest
For complex agentic coding and enterprise work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $5/ MTok
- Output pricing
- $25/ MTok
Descripción general
Claude Opus 5 es una mejora radical con respecto a Claude Opus 4.8, con los mayores avances en razonamiento profundo, tareas agénticas y de largo horizonte, y escalado de cómputo en tiempo de prueba. Esta página resume todas las novedades de Claude Opus 5, incluidos los cambios de herramientas a mitad de conversación y dos cambios incompatibles para el código que se ejecuta en Claude Opus 4.8: el pensamiento está activado de forma predeterminada, y el pensamiento solo se puede desactivar con un esfuerzo high o inferior.
Cómo se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5This model | 1M | 128K | $5 / $25 | Moderate | Adaptive | high | May 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Especificaciones
Model IDs
- Claude API
Pricing
- Input
- $5 / MTok
- Output
- $25 / MTok
- 5m cache write
- $6.25 / MTok
- 1h cache write
- $10 / MTok
- Cache read
- $0.50 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- May 2026
- Training data cutoff
- May 2026
Availability
- Status
- Active (latest)
- Released
- July 24, 2026
- Retirement
- Not sooner than July 24, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft Foundry
Es bueno saber
- En la API de Message Batches, Claude Opus 5 admite hasta 300k tokens de salida con el encabezado beta
output-300k-2026-03-24. - La longitud mínima de prompt que se puede almacenar en caché es de 512 tokens. Consulta Almacenamiento en caché de prompts.
- Consulta los límites y capacidades de forma programática con la API de Models.
Recursos
Guía de prompting específica del modelo.
El "effort" (esfuerzo) tiene como valor predeterminado high en Claude Opus 5 e importa más que en modelos anteriores. Elige un nivel según la carga de trabajo.
Activado de forma predeterminada. Desactivar el pensamiento requiere un esfuerzo high o inferior.
Claude Opus 5 con menor latencia en la Claude API (vista previa de investigación), con precio por separado.
Referencia
La indicación del sistema que Claude Opus 5 usa en claude.ai y en las aplicaciones de Claude.
Evaluaciones de seguridad y decisiones de despliegue para Claude Opus 5.
Lista completa de precios, incluidos los descuentos por lotes y las tarifas de almacenamiento en caché de prompts.
Cómo funcionan los IDs de modelo, los alias y los snapshots fijados.
Estado del ciclo de vida y compromisos de retiro para cada modelo de Claude.
Was this page helpful?