Claude Platform Docs
Modelos y preciosModelos

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

Descripción general

Claude Sonnet 5.5 ofrece la mejor combinación de velocidad e inteligencia. Cinco "breaking changes" (cambios incompatibles) afectan al código que ya se ejecuta en Claude Sonnet 5:

Un cambio más altera la forma de la respuesta sin que falle ninguna solicitud: el texto entre llamadas a herramientas se devuelve en bloques thinking. Una aplicación que hace streaming de ese texto a sus usuarios se queda en silencio entre llamadas a herramientas hasta que establece un valor de display que devuelva el texto, o desactiva el pensamiento previo con between_tools.

Novedades de Claude Sonnet 5.5

Cómo se compara

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

Especificaciones

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

Conviene saber

  • El "adaptive thinking" (pensamiento adaptativo) está activado de forma predeterminada. La configuración de pensamiento más baja es between_tools, que desactiva el pensamiento inicial. Funciona con un "effort" (esfuerzo) de high o inferior. Consulta Novedades de Claude Sonnet 5.5.
  • Establecer temperature, top_p o top_k en un valor distinto del predeterminado devuelve un error 400.
  • La longitud mínima de prompt que se puede almacenar en caché es de 512 tokens. Consulta Almacenamiento en caché de prompts.
  • En la API de Message Batches, Claude Sonnet 5.5 admite hasta 300k tokens de salida con el encabezado beta output-300k-2026-03-24.
  • Consulta los límites y las capacidades de forma programática con la API de Models.

Recursos

Diferencias de comportamiento y patrones de prompts específicos de Claude Sonnet 5.5.

El control de la profundidad del pensamiento, la latencia y el costo. Elige un nivel para cada carga de trabajo.

Cómo funciona el pensamiento adaptativo, qué configuraciones de pensamiento acepta cada modelo y cómo se conservan los bloques de pensamiento.

Referencia

Lista completa de precios, incluidos los descuentos por lotes y las tarifas de almacenamiento en caché de prompts.

Cómo funcionan los IDs de modelo, los alias y las instantáneas fijadas.

Estado del ciclo de vida y compromisos de retiro para cada modelo de Claude.

Was this page helpful?