Novedades de Claude Sonnet 5.5
Qué cambia al pasar de Claude Sonnet 5 a Claude Sonnet 5.5: cambios incompatibles, compatibilidad de funciones, diferencias de comportamiento, precios y disponibilidad.
Claude Sonnet 5.5 ofrece la mejor combinación de velocidad e inteligencia. Cinco "breaking changes" (cambios incompatibles) afectan al código que ya se ejecuta en Claude Sonnet 5:
- Desactiva el pensamiento previo con
between_tools. - El uso forzado de herramientas devuelve un error.
- Los bloques de pensamiento están vinculados al modelo y a la conversación.
- En la API de Claude y Google Cloud, no se acepta la herramienta anterior de uso de computadora
computer_20251124. - La herramienta de asesor rechaza a Claude Opus 4.8, Claude Opus 4.7 y Claude Sonnet 5 como asesores.
Un cambio más altera la forma de la respuesta sin que falle ninguna solicitud: el texto entre llamadas a herramientas se devuelve en bloques thinking. Una aplicación que hace streaming de ese texto a sus usuarios se queda en silencio entre llamadas a herramientas hasta que establece un valor de display que devuelva el texto, o desactiva el pensamiento previo con between_tools.
Nuevo modelo
| Modelo | ID de la API de Claude | Descripción |
|---|---|---|
| Claude Sonnet 5.5 | La mejor combinación de velocidad e inteligencia |
El "adaptive thinking" (pensamiento adaptativo) está activado de forma predeterminada, y el "effort parameter" (parámetro de esfuerzo) controla la profundidad del pensamiento. Su valor predeterminado en la API de Claude es high. El "tokenizer" (tokenizador) es el mismo que el de Claude Sonnet 5, por lo que el mismo texto produce los mismos recuentos de tokens. Para conocer la "context window" (ventana de contexto), los límites de salida, la fecha de corte de conocimiento y los precios, consulta la página del modelo Claude Sonnet 5.5.
Para ver todos los modelos actuales, consulta la descripción general de los modelos.
Cambios incompatibles
Desactiva el pensamiento previo con between_tools
Para desactivar el "up-front thinking" (pensamiento previo) en Claude Sonnet 5.5, envía thinking: {"type": "between_tools"} en lugar de "disabled". Es la configuración de pensamiento más baja en este modelo. Está disponible en todas las plataformas que ofrecen Claude Sonnet 5.5. No necesita ningún encabezado beta. Las breves "progress updates" (actualizaciones de progreso) que el modelo escribe entre llamadas a herramientas se siguen devolviendo como bloques thinking con su texto de resumen. Devuelve esos bloques sin cambios junto con el resto del turno del asistente. Un bloque de actualización de progreso que devuelves le proporciona al modelo la nota completa que escribió, no el resumen. Si tus solicitudes no usan herramientas, la respuesta contiene solo texto, como ocurre con disabled en Claude Sonnet 5.
En Claude Sonnet 5.5, una solicitud que envía thinking: {"type": "disabled"} devuelve un error 400 invalid_request_error cuyo mensaje remite a between_tools.
between_tools se acepta con esfuerzo low, medium y high. Con esfuerzo xhigh o max, una solicitud con between_tools devuelve un error 400. Para ejecutar con xhigh o max, usa el pensamiento adaptativo: omite el campo thinking o envía thinking: {"type": "adaptive"}, que es equivalente. Con between_tools, el esfuerzo no puede cambiar a mitad de la conversación: un output_config.effort por mensaje que difiera del nivel vigente devuelve un error 400. Para variar el esfuerzo en cada turno, usa el pensamiento adaptativo.
between_tools no admite ningún otro campo: enviar display, budget_tokens o block_binding junto con él devuelve un error 400. Los presupuestos de pensamiento manuales (thinking: {"type": "enabled", "budget_tokens": N}) devuelven un error 400. Consulta Pensamiento y el antes y después de la guía de migración.
El uso forzado de herramientas no es compatible
Claude Sonnet 5.5 no admite el "forced tool use" (uso forzado de herramientas). Establecer tool_choice en {"type": "any"} o {"type": "tool", "name": "..."} devuelve un error 400 invalid_request_error:
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (el valor predeterminado) y {"type": "none"} son compatibles. La misma comprobación se aplica al endpoint de conteo de tokens. Para obtener una entrada de herramienta válida según el esquema, mantén tool_choice: {"type": "auto"} y establece strict: true con el uso estricto de herramientas, o traslada el esquema a salidas estructuradas. Para que el modelo llame a una herramienta en lugar de responder con texto, indica en el prompt cuándo se aplica la herramienta. La guía de migración muestra el antes y después.
Los bloques de pensamiento están vinculados al modelo y a la conversación
Cada "thinking block" (bloque de pensamiento) registra qué modelo lo produjo. Cada modelo lee sus propios bloques y solo los bloques de algunos otros modelos. Claude Sonnet 5.5 lee bloques de pensamiento de Claude Sonnet 5, Claude Opus 4.8, Claude Haiku 4.5 y modelos anteriores, pero no de Claude Opus 5, Claude Opus 5.5 ni de ningún modelo Claude Fable o Claude Mythos. Ningún otro modelo lee los bloques de pensamiento de Claude Sonnet 5.5.
Así, una conversación que pasa de Claude Sonnet 5 a Claude Sonnet 5.5 conserva su razonamiento, y una que pasa de Claude Sonnet 5.5 a cualquier otro modelo ejecuta los turnos posteriores al cambio sin él. Cuando una solicitud incluye un bloque que el modelo de destino no puede leer, la API lo descarta antes de que el modelo lo vea: la solicitud se completa correctamente y los bloques descartados no se facturan. Con el encabezado beta thinking-binding-controls-2026-08-01, el descarte se informa en un array input_transformations de nivel superior. Consulta Cambiar de modelo a mitad de la conversación.
La API también comprueba si algo anterior a un bloque de pensamiento de Claude Sonnet 5.5 ha cambiado desde que se produjo el bloque: la indicación del sistema system, las tools o un mensaje anterior. Aplica esa comprobación de forma predeterminada para las cuentas creadas a partir del 31 de agosto de 2026, 00:00 UTC, en la API de Claude, Amazon Bedrock y Google Cloud. En esas cuentas, una solicitud que reenvía un bloque después de un cambio de ese tipo devuelve un error 400. Para descartar en su lugar los bloques afectados, envía el encabezado beta thinking-binding-controls-2026-08-01 y establece thinking.block_binding.prefix_mismatch_behavior en "drop_block". En las cuentas más antiguas, establecer ese campo en cualquiera de los dos valores activa la comprobación para la solicitud. block_binding solo funciona con thinking: {"type": "adaptive"}. Con between_tools, mantén el historial en modo de solo anexar, o elimina los bloques de pensamiento a partir del turno editado.
Mantén la conversación en modo de solo anexar para que la comprobación nunca falle: cambia las instrucciones o las herramientas con mensajes del sistema a mitad de la conversación en lugar de con ediciones. Consulta Pensamiento preservado y la nota sobre este cambio de la guía de migración.
La herramienta de uso de computadora computer_20251124 no es compatible en la API de Claude y Google Cloud
En la API de Claude y Google Cloud, Claude Sonnet 5.5 admite el "computer use" (uso de computadora) solo a través del conjunto de herramientas computer_toolset_20260801. Una solicitud que declara la herramienta anterior computer_20251124 devuelve un error 400 invalid_request_error. En la API de Claude, el mensaje nombra el tipo rechazado y luego enumera los tipos de herramientas que el modelo sí acepta. Comienza así:
'claude-sonnet-5-5' does not support tool types: computer_20251124.En Amazon Bedrock, Claude Sonnet 5.5 acepta la herramienta anterior computer_20251124.
Para migrar una integración existente en la API de Claude o Google Cloud, sigue Migrar desde computer_20251124, que muestra la solicitud antes y después. Elimina el encabezado beta, reemplaza la entrada de tools por {"type": "computer_toolset_20260801"} y actualiza tu bucle de agente para los bloques tool_use de los miembros, las acciones por lotes y toolset_name en los resultados. El conjunto de herramientas está disponible en la API de Claude y Google Cloud. Para otras plataformas, consulta la sección Compatibilidad de la herramienta de uso de computadora. Las integraciones que ya usan el conjunto de herramientas, y la herramienta de uso del navegador, no necesitan cambios.
Algunas combinaciones de la herramienta de asesor no son compatibles
Con la "advisor tool" (herramienta de asesor) (beta), un ejecutor Claude Sonnet 5.5 necesita como asesor a Claude Mythos 5.1, Claude Fable 5.1, Claude Mythos 5, Claude Fable 5, Claude Opus 5.5 o Claude Opus 5, o al propio Claude Sonnet 5.5. Los asesores Claude Opus 4.8, Claude Opus 4.7 y Claude Sonnet 5 funcionan con un ejecutor Claude Sonnet 5, pero con un ejecutor Claude Sonnet 5.5 devuelven un error 400 invalid_request_error. Todos los asesores que Claude Sonnet 5.5 acepta devuelven su consejo cifrado, como un bloque advisor_redacted_result, por lo que tu cliente no puede leer el texto del consejo. Consulta Compatibilidad de modelos y Variantes de resultado de la herramienta de asesor.
Compatibilidad de funciones
Claude Sonnet 5.5 admite el esfuerzo por mensaje (beta), los mensajes del sistema a mitad de la conversación, los cambios de herramientas a mitad de la conversación (beta), el "prompt caching" (almacenamiento en caché de prompts) con un prompt mínimo almacenable en caché de 512 tokens, el procesamiento por lotes, la Files API, la compatibilidad con PDF, la visión y las herramientas del lado del servidor y del lado del cliente. El esfuerzo por mensaje, los mensajes del sistema a mitad de la conversación y los cambios de herramientas a mitad de la conversación no están disponibles en Claude Sonnet 5, cuyo prompt mínimo almacenable en caché es de 1,024 tokens. En la API de Claude y Google Cloud, el uso de computadora requiere el conjunto de herramientas computer_toolset_20260801 (consulta el cambio incompatible). Consulta la página de cada función para conocer la disponibilidad por modelo.
Compactación bajo demanda (beta)
Con el encabezado beta compact-2026-09-04, una solicitud que envía el parámetro compaction de nivel superior devuelve un bloque compaction firmado que resume toda la conversación. Luego envías ese bloque en primer lugar, en sustitución de los mensajes resumidos. Tú eliges cuándo compactar, y los bloques de pensamiento de los turnos que conservas pueden seguir siendo válidos después del reemplazo, bajo las condiciones descritas en Compactación y pensamiento preservado. Esto es importante en Claude Sonnet 5.5 porque sus bloques de pensamiento están vinculados a la conversación. Consulta Compactación bajo demanda para conocer la disponibilidad por plataforma y el flujo completo de la solicitud.
Definir herramientas en un mensaje (beta)
Con el encabezado beta inline-tools-2026-09-15, un bloque tool_addition en un mensaje del sistema a mitad de la conversación puede contener una definición completa de herramienta en lugar de una referencia. Puedes agregar una herramienta, cambiar su esquema o pasar una herramienta del servidor a una versión más reciente a mitad de la conversación sin editar tools y sin perder la caché de prompts. Consulta Definir herramientas en un mensaje.
Los bloques de pensamiento permanecen en la cuenta que los produjo
Los bloques de pensamiento que produce Claude Sonnet 5.5 solo funcionan en la cuenta que los produjo, o en una cuenta vinculada a ella. Cuando otra cuenta envía uno de estos bloques, la API descarta el bloque antes de que el modelo lo vea, y la solicitud se completa correctamente. En la API de Claude y Google Cloud, con el encabezado beta thinking-binding-controls-2026-08-01, la respuesta enumera cada bloque descartado en input_transformations con reason: "organization_binding_mismatch". Los bloques de modelos anteriores no se ven afectados. Consulta Pensamiento preservado.
Diferencias de comportamiento
Claude Sonnet 5.5 difiere de Claude Sonnet 5 en varios aspectos que se manifiestan sin ningún cambio de código. Cómo escribir prompts para Claude Sonnet 5.5 ofrece orientación para cada uno:
- Los niveles de esfuerzo se han recalibrado. Un nivel de esfuerzo no produce la misma cantidad de pensamiento que en Claude Sonnet 5. Vuelve a ejecutar tu barrido de esfuerzo en lugar de trasladar una configuración. Comienza con
higha menos que tu carga de trabajo sea agéntica o sensible a la latencia. Para la programación agéntica y el uso de herramientas en varios pasos, comienza conmediumpara tareas bien especificadas y pasa ahighpara las más difíciles o largas. Para chat y otros trabajos sensibles a la latencia, comienza conmediumolow. - El texto entre llamadas a herramientas se devuelve en bloques de pensamiento. Entre llamadas a herramientas, las notas de más de una o dos oraciones se devuelven como bloques
thinkingde actualización de progreso. Los comentarios más breves siguen siendotext. Con el valor predeterminadodisplay: "omitted", el texto de los bloques de actualización de progreso está vacío, por lo que una aplicación que hace streaming de esas notas a sus usuarios se queda en silencio entre llamadas a herramientas, sin ningún error. Si desactivas el pensamiento previo conbetween_tools, el texto se devuelve. La guía de migración muestra cómo recibirlo. - Categorías de salvaguardas. Las salvaguardas del modelo pueden rechazar una solicitud en cinco categorías de
stop_details."cyber"significa que la solicitud podría facilitar daños cibernéticos."bio"significa que podría facilitar daños biológicos."frontier_llm"significa que podría ayudar al desarrollo de modelos de IA competidores."reasoning_extraction"significa que pide al modelo que reproduzca su razonamiento interno en el texto de la respuesta."general_harms"significa que corresponde a otra área de la política de uso. Consulta Rechazos, respaldo y facturación.
Rechazos, respaldo y facturación
Todo lo descrito en Rechazos y respaldo se aplica a Claude Sonnet 5.5. Una solicitud rechazada devuelve HTTP 200 con stop_reason: "refusal" y un objeto stop_details que nombra el área de la política. Gestiona los rechazos y configura el respaldo. El respaldo del lado del servidor (fallbacks: "default", en beta, en la API de Claude) reintenta en Claude Sonnet 5 los rechazos "cyber" y "frontier_llm". No reintenta los rechazos "bio", "reasoning_extraction" ni "general_harms". También puedes usar el middleware del SDK o tu propio mecanismo de reintento. Que un rechazo que llega antes de cualquier salida se facture o no depende de su categoría de rechazo, y en cualquier caso cuenta para tus límites de velocidad. Consulta Cómo se facturan los rechazos.
Precios
Claude Sonnet 5.5 tiene los mismos precios que Claude Sonnet 5, incluidas las tarifas de almacenamiento en caché de prompts y de procesamiento por lotes. Consulta Precios para ver la lista completa, la residencia de datos y los precios de las herramientas.
Disponibilidad
Claude Sonnet 5.5 está disponible en:
- API de Claude: todos los clientes, como
claude-sonnet-5-5. - AWS: Claude en Amazon Bedrock, como
anthropic.claude-sonnet-5-5, y Claude Platform en AWS, comoclaude-sonnet-5-5. - Google Cloud: Claude en Google Cloud, como
claude-sonnet-5-5. - Microsoft Foundry: Claude en Microsoft Foundry, como
claude-sonnet-5-5.
Migrar desde Claude Sonnet 5
Actualiza el ID de tu modelo:
model = "claude-sonnet-5" # Before
model = "claude-sonnet-5-5" # AfterLuego revisa seis cosas:
- Si tu código desactiva el pensamiento con
disabled, envíabetween_toolsen su lugar, con esfuerzohigho inferior. - Reemplaza los tipos
anyytooldetool_choiceporautojunto con el uso estricto de herramientas. - Mantén las conversaciones en modo de solo anexar. Una solicitud que reenvía un bloque de pensamiento de Claude Sonnet 5.5 después de una edición del historial anterior puede devolver un error 400. Consulta Los bloques de pensamiento están vinculados al modelo y a la conversación.
- Si usas el uso de computadora a través de
computer_20251124en la API de Claude o Google Cloud, migra al conjunto de herramientas. - Si usas la herramienta de asesor con un asesor Claude Opus 4.8, Claude Opus 4.7 o Claude Sonnet 5, cambia a un asesor que Claude Sonnet 5.5 acepte.
- Si tu interfaz muestra el texto entre llamadas a herramientas, establece
thinking.displaycuando uses el pensamiento adaptativo. Conbetween_tools, el texto se devuelve sin él. Consulta El texto entre llamadas a herramientas se devuelve en bloques de pensamiento.
La guía de migración incluye instrucciones paso a paso desde Claude Sonnet 5 y modelos anteriores, y la lista de verificación completa.
Próximos pasos
Especificaciones completas y precios de todos los modelos Claude actuales.
Migra código de Claude Sonnet 5 y modelos anteriores a Claude Sonnet 5.5.
Diferencias de comportamiento y patrones de prompts específicos de Claude Sonnet 5.5.
Controla cuántos tokens usa Claude al responder, desde low hasta max.
Cómo funciona el pensamiento adaptativo y cómo se preservan los bloques de pensamiento.
Gestiona stop_reason: "refusal" y reintenta en otro modelo.
Was this page helpful?