Claude Platform Docs
Modelos y preciosClaude Haiku 5.5

Novedades de Claude Haiku 5.5

Descripción general de las nuevas capacidades, los cambios incompatibles y los cambios de comportamiento en Claude Haiku 5.5, con un enlace a la guía de cada función y a la guía de migración para los cambios de código.

Claude Haiku 5.5 está diseñado para trabajo de alto volumen y sensible a la latencia, como clasificación, enrutamiento, extracción y tareas de subagentes. Admite pensamiento adaptativo con el parámetro effort, una "context window" (ventana de contexto) de 1M tokens y hasta 128k tokens de salida. Usa el mismo tokenizador más reciente que Claude 4.7 y los modelos posteriores, por lo que el mismo texto cuenta como aproximadamente un 30% más de tokens que en Claude Haiku 4.5. Sus bloques de pensamiento funcionan solo en la cuenta que los produjo o en una cuenta vinculada a ella.

Para los cambios de código, consulta la guía de migración. Para los ID de modelo, los precios y los límites, consulta la descripción general de Claude Haiku 5.5. Para obtener orientación sobre prompts, consulta Cómo escribir prompts para Claude Haiku 5.5.

Resumen de cambios respecto a Claude Haiku 4.5

Cada fila nombra un cambio, indica si es nuevo, modificado o incompatible, y qué debe hacer tu código.

CambioTipoAcción necesaria
Pensamiento adaptativo y effortNuevoOpcional: establece effort para equilibrar la calidad de la respuesta frente a la velocidad y el costo.
Ventana de contexto y salida más grandesNuevoNinguna. Los valores existentes de max_tokens siguen siendo válidos, pero los tokens de pensamiento cuentan para ellos.
Herramienta de uso del navegadorNuevoNinguna. Disponible en la Claude API y Google Cloud.
Los clasificadores de seguridad pueden rechazar una solicitudNuevoGestiona stop_reason: "refusal" en tu cliente. El fallback del lado del servidor no está disponible.
El pensamiento extendido manual devuelve un errorIncompatibleReemplaza budget_tokens con pensamiento adaptativo.
Los parámetros de muestreo no predeterminados devuelven un errorIncompatibleOmite temperature, top_p y top_k.
El prefill de mensajes del asistente devuelve un errorIncompatibleTermina messages con un turno del usuario.
El uso de computadora requiere el conjunto de herramientas en la Claude API y Google CloudIncompatibleReemplaza computer_20250124 con computer_toolset_20260801.
Cambiar turnos anteriores invalida los bloques de pensamientoIncompatibleMantén las conversaciones solo de anexado si devuelves bloques de pensamiento.
Las respuestas pueden comenzar con bloques de pensamientoModificadoSelecciona los bloques de contenido por type, no por posición.
El texto del pensamiento se omite de forma predeterminadaModificadoPara recibir el pensamiento resumido, establece thinking.display en "summarized".
El mismo texto cuenta como más tokensModificadoVuelve a contar los prompts y revisa max_tokens y las estimaciones de costo.
Reproducir bloques de pensamiento entre cuentasModificadoSi reproduces conversaciones almacenadas a través de una cuenta diferente, reproduce cada una a través de la cuenta que la produjo.

Nuevas capacidades

Pensamiento adaptativo y effort

Con el pensamiento adaptativo, Claude Haiku 5.5 decide cuándo y cuánto pensar. El pensamiento adaptativo está activado de forma predeterminada. Aunque todavía puedes desactivar el pensamiento con thinking: {"type": "disabled"} con effort high o inferior, la mejor manera de equilibrar la calidad de la respuesta frente a la velocidad y el costo es usar el parámetro effort.

Ventana de contexto y salida más grandes

Claude Haiku 5.5 tiene una ventana de contexto de 1M tokens y devuelve hasta 128k tokens de salida, frente a 200k y 64k en Claude Haiku 4.5. Los valores existentes de max_tokens siguen siendo válidos, pero los tokens de pensamiento cuentan para max_tokens, por lo que un límite pequeño puede detenerse después de un bloque thinking y antes de cualquier texto. Consulta Configura el pensamiento.

Cambios de comportamiento

Las respuestas pueden comenzar con bloques de pensamiento

El pensamiento adaptativo está activado de forma predeterminada, por lo que una respuesta puede comenzar con uno o más bloques thinking incluso cuando la solicitud no menciona el pensamiento. El código que lee el primer bloque de contenido como la respuesta necesita seleccionar los bloques por su campo type. Consulta Configura el pensamiento en la guía de migración.

El mismo texto cuenta como más tokens

Claude Haiku 5.5 usa el mismo tokenizador más reciente que Claude 4.7 y los modelos posteriores. Como ocurre con todos los modelos que usan este tokenizador, el mismo texto de entrada produce aproximadamente un 30% más de tokens en Claude Haiku 5.5 que en Claude Haiku 4.5. El aumento exacto depende del contenido. La forma de las solicitudes y respuestas no depende del tokenizador, pero cambia todo lo que midas o presupuestes en tokens. Consulta Vuelve a contar los tokens en la guía de migración.

Reproducir bloques de pensamiento entre cuentas

Los bloques de pensamiento de Claude Haiku 5.5 funcionan solo en la cuenta que los produjo o en una cuenta vinculada a ella. Esto solo importa si almacenas conversaciones y las reproduces a través de una cuenta diferente. Consulta Reproduce los bloques de pensamiento a través de la cuenta que los produjo.

Was this page helpful?