Claude Platform Docs
Modelos y preciosModelos

Claude Opus 5.5Latest

For long-running agentic coding and knowledge work

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$4/ MTok
Output pricing
$20/ MTok

Descripción general

Claude Opus 5.5 está diseñado para "agentic coding" (programación agéntica) de larga duración y trabajo de conocimiento, con un precio de $4 / $20 USD por millón de tokens de entrada / salida. Cuatro "breaking changes" (cambios incompatibles) afectan al código que ya se ejecuta en Claude Opus 5: el pensamiento no se puede desactivar, el uso forzado de herramientas devuelve un error, los bloques de pensamiento están vinculados al modelo y a la conversación y, en la API de Claude y Google Cloud, no se acepta la herramienta de uso de computadora anterior computer_20251124. Los tres primeros también se aplican a Claude Fable 5.1. Otro cambio altera la forma de la respuesta sin que falle ninguna solicitud: el texto entre llamadas a herramientas se devuelve en bloques thinking cuyo texto está vacío con la configuración predeterminada de display. Una aplicación que hace streaming de ese texto a sus usuarios como actualizaciones de progreso se queda en silencio entre llamadas a herramientas hasta que establece un valor de display que devuelva el texto.

Novedades de Claude Opus 5.5

Cómo se compara

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.5This model1M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 51M128K$2 / $10FastAdaptivehighJan 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtendedFeb 2025

Especificaciones

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$4 / MTok
Output
$20 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output
Full price list
Pricing

Capabilities

Max output
128K tokens
Thinking
Adaptive (always on)
Comparative latency
Moderate
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 22, 2026
Retirement
Not sooner than September 22, 2027

Es bueno saber

  • El "adaptive thinking" (pensamiento adaptativo) siempre está activado y no se puede desactivar. Controla la profundidad del pensamiento con el parámetro de esfuerzo.
  • En la API de Message Batches, Claude Opus 5.5 admite hasta 300k tokens de salida con el "beta header" (encabezado beta) output-300k-2026-03-24.
  • La longitud mínima de prompt que se puede almacenar en caché es de 512 tokens. Consulta Almacenamiento en caché de prompts.
  • Consulta los límites y las capacidades de forma programática con la API de Models.

Recursos

Diferencias de comportamiento y patrones de prompting específicos de Claude Opus 5.5.

El control de la profundidad del pensamiento, la latencia y el costo. Elige un nivel para cada carga de trabajo.

Cómo funciona el pensamiento adaptativo y cómo se conservan los bloques de pensamiento.

Claude Opus 5.5 con menor latencia en la Claude API (vista previa de investigación), con precio por separado.

Referencia

La indicación del sistema que Claude Opus 5.5 usa en claude.ai y en las aplicaciones de Claude.

Evaluaciones de seguridad y decisiones de despliegue para Claude Opus 5.5.

Lista completa de precios, incluidos los descuentos por lotes y las tarifas de almacenamiento en caché de prompts.

Cómo funcionan los IDs de modelo, los alias y los snapshots fijados.

Estado del ciclo de vida y compromisos de retiro para cada modelo de Claude.

Was this page helpful?