Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

Descripción general

Claude Haiku 5.5 está diseñado para trabajo de alto volumen y sensible a la latencia, como clasificación, enrutamiento, extracción y tareas de subagentes. Admite pensamiento adaptativo con el parámetro effort, una "context window" (ventana de contexto) de 1M tokens y hasta 128k tokens de salida. Usa el mismo tokenizador más reciente que Claude 4.7 y los modelos posteriores, por lo que el mismo texto cuenta como aproximadamente un 30% más de tokens que en Claude Haiku 4.5. Sus bloques de pensamiento funcionan solo en la cuenta que los produjo o en una cuenta vinculada a ella.

Para los cambios de código, consulta la guía de migración. Para los ID de modelo, los precios y los límites, consulta la descripción general de Claude Haiku 5.5. Para obtener orientación sobre prompts, consulta Cómo escribir prompts para Claude Haiku 5.5.

Novedades de Claude Haiku 5.5

Cómo se compara

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

Especificaciones

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

Es bueno saber

  • El "adaptive thinking" (pensamiento adaptativo) está activado de forma predeterminada. Controla la profundidad del pensamiento con el parámetro effort.
  • Omite temperature, top_p y top_k, ya que un valor no predeterminado en cualquiera de ellos devuelve un error 400.
  • En la API de Message Batches, Claude Haiku 5.5 admite hasta 300k tokens de salida con el encabezado beta output-300k-2026-03-24.
  • Consulta los límites y las capacidades de forma programática con la API de Models.

Recursos

Diferencias de comportamiento y patrones de prompts específicos de Claude Haiku 5.5.

Elige un modelo y un nivel de esfuerzo, da forma a los prompts y haz streaming de la salida para obtener respuestas más rápidas.

Claude Haiku 5.5 decide cuándo y cuánto pensar. Orienta la profundidad con effort.

1M tokens. Cómo se cuenta y se gestiona la ventana.

Referencia

La indicación del sistema que Claude Haiku 5.5 usa en claude.ai y en las aplicaciones de Claude.

Evaluaciones de seguridad y decisiones de despliegue para Claude Haiku 5.5.

Lista completa de precios, incluidos los descuentos por lotes y las tarifas de almacenamiento en caché de prompts.

Cómo funcionan los IDs de modelo, los alias y las instantáneas fijadas.

Estado del ciclo de vida y compromisos de retiro para cada modelo de Claude.

Was this page helpful?