Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
Descripción general
Claude Haiku 5.5 está diseñado para trabajo de alto volumen y sensible a la latencia, como clasificación, enrutamiento, extracción y tareas de subagentes. Admite pensamiento adaptativo con el parámetro effort, una "context window" (ventana de contexto) de 1M tokens y hasta 128k tokens de salida. Usa el mismo tokenizador más reciente que Claude 4.7 y los modelos posteriores, por lo que el mismo texto cuenta como aproximadamente un 30% más de tokens que en Claude Haiku 4.5. Sus bloques de pensamiento funcionan solo en la cuenta que los produjo o en una cuenta vinculada a ella.
Para los cambios de código, consulta la guía de migración. Para los ID de modelo, los precios y los límites, consulta la descripción general de Claude Haiku 5.5. Para obtener orientación sobre prompts, consulta Cómo escribir prompts para Claude Haiku 5.5.
Cómo se compara
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
Especificaciones
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Es bueno saber
- El "adaptive thinking" (pensamiento adaptativo) está activado de forma predeterminada. Controla la profundidad del pensamiento con el parámetro effort.
- Omite
temperature,top_pytop_k, ya que un valor no predeterminado en cualquiera de ellos devuelve un error 400. - En la API de Message Batches, Claude Haiku 5.5 admite hasta 300k tokens de salida con el encabezado beta
output-300k-2026-03-24. - Consulta los límites y las capacidades de forma programática con la API de Models.
Recursos
Diferencias de comportamiento y patrones de prompts específicos de Claude Haiku 5.5.
Elige un modelo y un nivel de esfuerzo, da forma a los prompts y haz streaming de la salida para obtener respuestas más rápidas.
Claude Haiku 5.5 decide cuándo y cuánto pensar. Orienta la profundidad con effort.
1M tokens. Cómo se cuenta y se gestiona la ventana.
Referencia
La indicación del sistema que Claude Haiku 5.5 usa en claude.ai y en las aplicaciones de Claude.
Evaluaciones de seguridad y decisiones de despliegue para Claude Haiku 5.5.
Lista completa de precios, incluidos los descuentos por lotes y las tarifas de almacenamiento en caché de prompts.
Cómo funcionan los IDs de modelo, los alias y las instantáneas fijadas.
Estado del ciclo de vida y compromisos de retiro para cada modelo de Claude.
Was this page helpful?