Claude Opus 5.5Latest
For long-running agentic coding and knowledge work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $4/ MTok
- Output pricing
- $20/ MTok
Descripción general
Claude Opus 5.5 está diseñado para "agentic coding" (programación agéntica) de larga duración y trabajo de conocimiento, con un precio de $4 / $20 USD por millón de tokens de entrada / salida. Cuatro "breaking changes" (cambios incompatibles) afectan al código que ya se ejecuta en Claude Opus 5: el pensamiento no se puede desactivar, el uso forzado de herramientas devuelve un error, los bloques de pensamiento están vinculados al modelo y a la conversación y, en la API de Claude y Google Cloud, no se acepta la herramienta de uso de computadora anterior computer_20251124. Los tres primeros también se aplican a Claude Fable 5.1. Otro cambio altera la forma de la respuesta sin que falle ninguna solicitud: el texto entre llamadas a herramientas se devuelve en bloques thinking cuyo texto está vacío con la configuración predeterminada de display. Una aplicación que hace streaming de ese texto a sus usuarios como actualizaciones de progreso se queda en silencio entre llamadas a herramientas hasta que establece un valor de display que devuelva el texto.
Cómo se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5This model | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Especificaciones
Model IDs
- Claude API
Pricing
- Input
- $4 / MTok
- Output
- $20 / MTok
- 5m cache write
- $5 / MTok
- 1h cache write
- $8 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive (always on)
- Default effort
medium- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 22, 2026
- Retirement
- Not sooner than September 22, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Es bueno saber
- El "adaptive thinking" (pensamiento adaptativo) siempre está activado y no se puede desactivar. Controla la profundidad del pensamiento con el parámetro de esfuerzo.
- En la API de Message Batches, Claude Opus 5.5 admite hasta 300k tokens de salida con el "beta header" (encabezado beta)
output-300k-2026-03-24. - La longitud mínima de prompt que se puede almacenar en caché es de 512 tokens. Consulta Almacenamiento en caché de prompts.
- Consulta los límites y las capacidades de forma programática con la API de Models.
Recursos
Diferencias de comportamiento y patrones de prompting específicos de Claude Opus 5.5.
El control de la profundidad del pensamiento, la latencia y el costo. Elige un nivel para cada carga de trabajo.
Cómo funciona el pensamiento adaptativo y cómo se conservan los bloques de pensamiento.
Claude Opus 5.5 con menor latencia en la Claude API (vista previa de investigación), con precio por separado.
Referencia
La indicación del sistema que Claude Opus 5.5 usa en claude.ai y en las aplicaciones de Claude.
Evaluaciones de seguridad y decisiones de despliegue para Claude Opus 5.5.
Lista completa de precios, incluidos los descuentos por lotes y las tarifas de almacenamiento en caché de prompts.
Cómo funcionan los IDs de modelo, los alias y los snapshots fijados.
Estado del ciclo de vida y compromisos de retiro para cada modelo de Claude.
Was this page helpful?