Claude Platform Docs
Modelos y preciosClaude Sonnet 5

Novedades de Claude Sonnet 5

Resumen de las nuevas funciones y cambios de comportamiento en Claude Sonnet 5.

Claude Sonnet 5 es la próxima generación de la familia de modelos Sonnet de Anthropic. Es una actualización directa para Claude Sonnet 4.6 con tres cambios de comportamiento: el pensamiento adaptativo está activado de forma predeterminada, el pensamiento extendido manual ahora devuelve un error 400 (fue obsoleto en Claude Sonnet 4.6), y establecer parámetros de muestreo (temperature, top_p, top_k) en valores no predeterminados devuelve un error 400. Esta página resume todo lo nuevo en el lanzamiento, incluido un nuevo tokenizador.

Nuevo modelo

ModeloID del modelo de APIDescripción
Claude Sonnet 5claude-sonnet-5La mejor combinación de velocidad e inteligencia

Claude Sonnet 5 admite la ventana de contexto de 1M de tokens de forma predeterminada (1M de tokens es tanto el valor predeterminado como el máximo; no hay una variante de contexto más pequeña), 128k de tokens de salida máximos, pensamiento adaptativo, y el mismo conjunto de herramientas y funciones de plataforma que Claude Sonnet 4.6, excepto Priority Tier, que no está disponible en Claude Sonnet 5. En la API de Claude y Google Cloud, Claude Sonnet 5 también admite la herramienta de uso del navegador y la versión estable computer_toolset_20260801 de la herramienta de uso del ordenador, ninguna de las cuales admite Claude Sonnet 4.6; la versión anterior computer_20251124 todavía se acepta en ambos modelos. Para actualizar una integración existente, consulta Migrar desde computer_20251124.

Para obtener precios y especificaciones completas, consulta la descripción general de modelos.

Cambios de comportamiento

Pensamiento adaptativo activado de forma predeterminada

En Claude Sonnet 4.6, las solicitudes sin un campo thinking se ejecutan sin pensamiento. En Claude Sonnet 5, las mismas solicitudes se ejecutan con pensamiento adaptativo. Para desactivar el pensamiento, pasa thinking: {type: "disabled"}. Debido a que max_tokens es un límite estricto sobre la salida total (pensamiento más texto de respuesta), revísalo para las cargas de trabajo que se ejecutaban sin pensamiento en Claude Sonnet 4.6.

Parámetros de muestreo no aceptados

Establecer temperature, top_p o top_k en un valor no predeterminado devuelve un error 400. Elimina estos parámetros al migrar; se acepta el valor predeterminado (u omitir el parámetro). Usa instrucciones de la indicación del sistema para guiar el comportamiento del modelo. Esto es nuevo para los modelos de clase Sonnet; la misma restricción se introdujo anteriormente en Claude Opus 4.7.

Pensamiento extendido manual eliminado

El pensamiento extendido manual (thinking: {type: "enabled", budget_tokens: N}) fue obsoleto en Claude Sonnet 4.6; en Claude Sonnet 5 se elimina y devuelve un error 400, igual que en Claude Opus 4.8 y Claude Opus 4.7. Usa el pensamiento adaptativo con el parámetro de esfuerzo en su lugar.

# No compatible con Claude Sonnet 5 (devuelve 400)
thinking = {"type": "enabled", "budget_tokens": 32000}

# Usa esto en su lugar
thinking = {"type": "adaptive"}

Nuevo tokenizador

Claude Sonnet 5 usa un nuevo tokenizador. El mismo texto de entrada produce aproximadamente un 30% más de tokens que en Claude Sonnet 4.6. El aumento exacto depende del contenido. Esto no es un cambio de API: las solicitudes, respuestas y eventos de streaming mantienen la misma forma, y no se requieren cambios de código.

El cambio afecta a todo lo que midas o presupuestes en tokens:

  • Recuentos de tokens: los campos usage y los resultados del recuento de tokens para el mismo texto son más altos que en Claude Sonnet 4.6. No reutilices los recuentos medidos con modelos anteriores; vuelve a contar con Claude Sonnet 5.
  • Capacidad de la ventana de contexto en términos de texto: la ventana de contexto es de 1M de tokens, pero cada token cubre menos texto en promedio, por lo que la misma ventana contiene menos texto que en Claude Sonnet 4.6.
  • Presupuestos de max_tokens: un límite de salida ajustado para Claude Sonnet 4.6 puede truncar una salida equivalente en Claude Sonnet 5. Revisa los límites dimensionados cerca de la longitud de salida esperada.
  • Costo por solicitud: el precio por token es más bajo que el de Claude Sonnet 4.6 (consulta Precios), pero debido a que el mismo texto produce más tokens, el costo de una solicitud equivalente no disminuye en proporción directa.

Restricciones de API heredadas de Claude Sonnet 4.6

Prellenado de mensajes del asistente no admitido

El prellenado del mensaje del asistente devuelve un error 400, sin cambios respecto a Claude Sonnet 4.6. Usa salidas estructuradas, instrucciones de la indicación del sistema, o output_config.format en su lugar.

Mejoras de capacidad

Claude Sonnet 5 es una actualización de capacidad sobre Claude Sonnet 4.6 a un precio más bajo. También es una opción para cargas de trabajo que necesitan más capacidad de la que proporciona Claude Sonnet 4.6 sin pasar a un modelo de clase Opus.

Las mayores ganancias sobre Claude Sonnet 4.6 están en tareas de codificación y agénticas. Para ver los resultados de los benchmarks, consulta el Transparency Hub de Anthropic.

Salvaguardas de ciberseguridad

Claude Sonnet 5 es el primer modelo de nivel Sonnet con salvaguardas de ciberseguridad en tiempo real. Las solicitudes que involucran temas de ciberseguridad prohibidos o de alto riesgo pueden ser rechazadas. Los rechazos se devuelven como una respuesta HTTP 200 exitosa con stop_reason: "refusal", no como un error. Consulta Salvaguardas cibernéticas en tiempo real en Claude Opus y Sonnet para saber qué bloquean las salvaguardas y cómo el trabajo de seguridad legítimo puede aplicar al Cyber Verification Program.

Precios

Claude Sonnet 5 tiene un precio de $2 por millón de tokens de entrada y $10 por millón de tokens de salida, un precio por token más bajo que el de $3/$15 de Claude Sonnet 4.6. Debido a que el nuevo tokenizador produce aproximadamente un 30% más de tokens para el mismo texto, el costo de una solicitud equivalente no disminuye en proporción directa a los precios por token al compararlo con Claude Sonnet 4.6. La diferencia exacta depende del contenido y la forma de la carga de trabajo.

Consulta Precios para obtener precios completos, incluidas las tarifas de procesamiento por lotes y almacenamiento en caché de prompts.

Disponibilidad

En el lanzamiento, Claude Sonnet 5 está disponible en:

Claude Sonnet 5 admite retención cero de datos para organizaciones con acuerdos ZDR.

Guía de migración

Claude Sonnet 5 es un reemplazo directo para Claude Sonnet 4.6. Actualiza tu ID de modelo:

model = "claude-sonnet-4-6"  # Before
model = "claude-sonnet-5"  # After

Luego revisa lo siguiente:

  1. Presupuestos y recuentos de tokens: el nuevo tokenizador produce aproximadamente un 30% más de tokens para el mismo texto. El aumento exacto depende del contenido y la forma de la carga de trabajo. Vuelve a contar las indicaciones con el recuento de tokens, y revisa los límites de max_tokens dimensionados cerca de la longitud de salida esperada.
  2. Pensamiento extendido: si todavía estableces budget_tokens, migra al pensamiento adaptativo. El pensamiento extendido manual (thinking: {type: "enabled"}) no es compatible y devuelve un error 400.
  3. Parámetros de muestreo: las solicitudes que establecen parámetros de muestreo (temperature, top_p, top_k) en un valor no predeterminado devuelven un error 400; elimínalos al migrar. Las definiciones de herramientas y las formas de respuesta no han cambiado, y el prellenado de mensajes del asistente ya no era compatible en Claude Sonnet 4.6.

Consulta Migrar a Claude Sonnet 5 desde Claude Sonnet 4.6 para obtener más detalles.

Próximos pasos

Especificaciones y precios completos para todos los modelos actuales de Claude.

Mide tus indicaciones con el nuevo tokenizador antes de migrar.

El modo de pensamiento activado recomendado en Claude Sonnet 5.

Cómo funciona la ventana de contexto de 1M de tokens.

Precios completos, incluidas las tarifas de procesamiento por lotes y almacenamiento en caché de prompts.

Was this page helpful?