Claude Sonnet 5.5Latest
The best combination of speed and intelligence
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $2/ MTok
- Output pricing
- $10/ MTok
Descripción general
Claude Sonnet 5.5 ofrece la mejor combinación de velocidad e inteligencia. Cinco "breaking changes" (cambios incompatibles) afectan al código que ya se ejecuta en Claude Sonnet 5:
- Desactiva el pensamiento previo con
between_tools. - El uso forzado de herramientas devuelve un error.
- Los bloques de pensamiento están vinculados al modelo y a la conversación.
- En la API de Claude y Google Cloud, no se acepta la herramienta anterior de uso de computadora
computer_20251124. - La herramienta de asesor rechaza a Claude Opus 4.8, Claude Opus 4.7 y Claude Sonnet 5 como asesores.
Un cambio más altera la forma de la respuesta sin que falle ninguna solicitud: el texto entre llamadas a herramientas se devuelve en bloques thinking. Una aplicación que hace streaming de ese texto a sus usuarios se queda en silencio entre llamadas a herramientas hasta que establece un valor de display que devuelva el texto, o desactiva el pensamiento previo con between_tools.
Cómo se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5This model | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Especificaciones
Model IDs
Pricing
- Input
- $2 / MTok
- Output
- $10 / MTok
- 5m cache write
- $2.50 / MTok
- 1h cache write
- $4 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Fast
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 28, 2026
- Retirement
- Not sooner than September 28, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Conviene saber
- El "adaptive thinking" (pensamiento adaptativo) está activado de forma predeterminada. La configuración de pensamiento más baja es
between_tools, que desactiva el pensamiento inicial. Funciona con un "effort" (esfuerzo) dehigho inferior. Consulta Novedades de Claude Sonnet 5.5. - Establecer
temperature,top_potop_ken un valor distinto del predeterminado devuelve un error 400. - La longitud mínima de prompt que se puede almacenar en caché es de 512 tokens. Consulta Almacenamiento en caché de prompts.
- En la API de Message Batches, Claude Sonnet 5.5 admite hasta 300k tokens de salida con el encabezado beta
output-300k-2026-03-24. - Consulta los límites y las capacidades de forma programática con la API de Models.
Recursos
Diferencias de comportamiento y patrones de prompts específicos de Claude Sonnet 5.5.
El control de la profundidad del pensamiento, la latencia y el costo. Elige un nivel para cada carga de trabajo.
Cómo funciona el pensamiento adaptativo, qué configuraciones de pensamiento acepta cada modelo y cómo se conservan los bloques de pensamiento.
Referencia
Lista completa de precios, incluidos los descuentos por lotes y las tarifas de almacenamiento en caché de prompts.
Cómo funcionan los IDs de modelo, los alias y las instantáneas fijadas.
Estado del ciclo de vida y compromisos de retiro para cada modelo de Claude.
Was this page helpful?