Claude Platform Docs
Modelos y preciosClaude Opus 5

Novedades en Claude Opus 5

Descripción general de las nuevas funciones y cambios de comportamiento en Claude Opus 5.

Claude Opus 5 es una mejora radical con respecto a Claude Opus 4.8, con los mayores avances en razonamiento profundo, tareas agénticas y de largo horizonte, y escalado de cómputo en tiempo de prueba. Esta página resume todas las novedades de Claude Opus 5, incluidos los cambios de herramientas a mitad de conversación y dos cambios incompatibles para el código que se ejecuta en Claude Opus 4.8: el pensamiento está activado de forma predeterminada, y el pensamiento solo se puede desactivar con un esfuerzo high o inferior.

Nuevo modelo

ModeloID del modelo en la APIDescripción
Claude Opus 5claude-opus-5Para codificación agéntica compleja y trabajo empresarial

Claude Opus 5 tiene una "context window" (ventana de contexto) de 1M de tokens (1M de tokens es tanto el valor predeterminado como el máximo; no existe una variante de contexto más pequeña), 128k tokens de salida máximos y pensamiento activado de forma predeterminada. Priority Tier no es compatible con Claude Opus 5.

Para ver los precios y especificaciones completos, consulta la descripción general de modelos.

Nuevas funciones

Cambios de herramientas a mitad de conversación (beta)

Puedes agregar o quitar herramientas entre turnos de una conversación conservando la caché de prompts, en lugar de reenviar una lista fija de herramientas durante toda la vida de una sesión. Los cambios de herramientas a mitad de conversación están en beta: incluye el encabezado beta mid-conversation-tool-changes-2026-07-01 en tus solicitudes. Consulta Cambios de herramientas a mitad de conversación para ver su uso.

Modo de fallbacks predeterminado

El parámetro fallbacks admite un nuevo modo "default", que aplica los modelos de respaldo recomendados por Anthropic según la categoría de rechazo, en lugar de una lista de modelos que mantengas tú mismo. Todo el parámetro fallbacks está en beta. Usa el encabezado beta server-side-fallback-2026-07-01, que admite tanto el modo "default" como listas explícitas de modelos (el encabezado anterior server-side-fallback-2026-06-01 solo acepta listas explícitas). Consulta Rechazos y respaldo.

Mínimo de caché de prompts más bajo

La longitud mínima de prompt que se puede almacenar en caché en Claude Opus 5 es de 512 tokens, frente a los 1,024 tokens de Claude Opus 4.8. Los prompts que eran demasiado cortos para almacenarse en caché en Claude Opus 4.8 ahora pueden crear entradas de caché sin cambios en el código. Consulta "Prompt caching" (almacenamiento en caché de prompts) para ver los mínimos por modelo.

Modo rápido

El modo rápido (vista previa de investigación) está disponible para Claude Opus 5 únicamente en la Claude API; actualmente no está disponible en Amazon Bedrock, Claude Platform en AWS, Google Cloud ni Microsoft Foundry. El modo rápido para Claude Opus 5 tiene un precio de $10 USD por millón de tokens de entrada y $50 USD por millón de tokens de salida. Consulta Modo rápido para ver el acceso, los modelos compatibles y los precios.

Cambios de comportamiento

Pensamiento activado de forma predeterminada

En Claude Opus 4.8, las solicitudes se ejecutan sin pensamiento a menos que establezcas thinking: {"type": "adaptive"}. En Claude Opus 5, las mismas solicitudes se ejecutan con pensamiento adaptativo activado de forma predeterminada: el modelo decide cuándo y cuánto pensar en cada turno, y el parámetro effort es el control de la profundidad del pensamiento. El valor en el protocolo no cambia; thinking: {"type": "adaptive"} sigue siendo válido y equivalente al valor predeterminado.

Este es un cambio incompatible para el código que se ejecutaba sin pensamiento en Claude Opus 4.8. Una respuesta puede comenzar con uno o más bloques thinking antes del primer bloque text, devueltos con un campo thinking vacío con el valor predeterminado display: "omitted", por lo que el código que lee content[0].text o trata el primer bloque de contenido transmitido por streaming como texto debe, en su lugar, seleccionar los bloques de contenido por su campo type. Los bucles de uso de herramientas deben devolver los bloques thinking completos y sin modificar junto con sus resultados de herramientas; consulta Conservar los bloques de pensamiento.

Los tokens de pensamiento se facturan como tokens de salida y cuentan para max_tokens, un límite estricto sobre la salida total (pensamiento más texto de respuesta), así que revisa max_tokens y vuelve a establecer la línea base de costos para las cargas de trabajo que se ejecutaban sin pensamiento en Claude Opus 4.8.

La API mantiene la opción de desactivar el pensamiento, sujeta a la restricción de esfuerzo para desactivarlo.

El esfuerzo importa más

Claude Opus 5 convierte el esfuerzo adicional en mejores resultados de forma más confiable que cualquier modelo Opus anterior, por lo que el nivel de esfuerzo que elijas tiene más peso. La escala completa está disponible: low, medium, high, xhigh y max, con max como el nivel superior para el razonamiento más profundo posible. Comienza en el valor predeterminado, high, y ajusta en cualquier dirección según tus evaluaciones: baja donde la calidad se mantenga para ahorrar tokens y latencia, o sube para el trabajo más exigente. Cuando ejecutes con esfuerzo xhigh o max, establece un max_tokens grande para que el modelo tenga espacio para pensar y actuar a través de subagentes y llamadas a herramientas.

Esta solicitud sube el esfuerzo al máximo, hasta max:

client = anthropic.Anthropic()

with client.messages.stream(
    model="claude-opus-5",
    max_tokens=64000,
    output_config={"effort": "max"},
    messages=[
        {
            "role": "user",
            "content": "Explain why the sum of two even numbers is always even.",
        }
    ],
) as stream:
    response = stream.get_final_message()

print(response)

El pensamiento está activado de forma predeterminada en Claude Opus 5, por lo que no se necesita el campo thinking.

Desactivar el pensamiento requiere un esfuerzo high o inferior

En Claude Opus 5, thinking: {"type": "disabled"} solo se acepta cuando el nivel de esfuerzo es high o inferior. Establecer thinking: {"type": "disabled"} con esfuerzo xhigh o max devuelve un error 400. Esta regla se aplica en cada solicitud a Claude Opus 5 y modelos posteriores. Es un cambio incompatible con respecto a Claude Opus 4.8, donde desactivar el pensamiento era independiente del nivel de esfuerzo. Si tus solicitudes de Claude Opus 4.8 desactivan el pensamiento con esfuerzo xhigh o max, mantén el pensamiento desactivado y establece el esfuerzo en high o inferior, o bien mantén el nivel de esfuerzo y elimina el campo thinking.

Con el pensamiento desactivado, Claude Opus 5 puede ocasionalmente escribir una llamada a herramienta en su salida de texto en lugar de emitir un bloque tool_use, o incluir etiquetas XML internas en su respuesta visible. Siempre que sea posible, mantén el pensamiento activado y controla el costo de tokens con niveles de esfuerzo más bajos; para las integraciones que deban mantener el pensamiento desactivado, consulta Ejecutar con el pensamiento desactivado para ver mitigaciones mediante prompts.

Diferencias de comportamiento del modelo

Más allá de estos cambios en la API, Claude Opus 5 se comporta de manera diferente a Claude Opus 4.8 en formas que podrías notar sin cambiar ningún código. Las respuestas predeterminadas dirigidas al usuario y los entregables escritos son más largos. En sesiones agénticas, el modelo narra su progreso al usuario con más frecuencia. En frameworks multiagente, delega en subagentes con más facilidad. También verifica su propio trabajo sin que se le indique, así que elimina las instrucciones de verificación heredadas de modelos anteriores ("incluye un paso final de verificación", "usa un subagente para verificar"); provocan una verificación excesiva en Claude Opus 5. Para ver patrones de prompts que ajustan cada uno de estos comportamientos, consulta Prompts para Claude Opus 5.

Mejoras de capacidades

En comparación con Claude Opus 4.8, Claude Opus 5 es una mejora radical en lugar de incremental, y ofrece inteligencia de frontera a la mitad del costo de Claude Fable 5. Los mayores avances están en:

  • Razonamiento profundo, sosteniendo análisis de múltiples pasos a lo largo de cadenas de problemas largas.
  • Codificación agéntica y tareas de largo horizonte, manteniéndose en la tarea a lo largo de bucles extendidos de uso de herramientas y completando funciones de múltiples archivos, refactorizaciones más grandes y trabajo de funciones de extremo a extremo sin dejar stubs ni marcadores de posición.
  • Escalado de cómputo en tiempo de prueba, convirtiendo el esfuerzo adicional (hasta el nivel max) en mejores resultados.
  • Eficiencia en niveles de esfuerzo más bajos, con esfuerzo low y medium produciendo una calidad sólida con una fracción de los tokens y la latencia de las configuraciones más altas.
  • Revisión de código y detección de errores, sacando a la luz errores reales a una tasa alta por pasada con pocos falsos positivos, y manteniendo la precisión en niveles de esfuerzo más bajos.
  • Visión, comprendiendo gráficos, documentos y diagramas y replicando elementos visuales de UI y frontend, con mejores resultados cuando se le dan herramientas para analizar, recortar y verificar su trabajo de forma iterativa.
  • Trabajo de contexto largo, con una ventana de contexto de 1M de tokens como valor predeterminado y máximo, y seguimiento de instrucciones, llamadas a herramientas y razonamiento consistentes a lo largo de toda la ventana.
  • Tareas de oficina y documentos, generando y editando hojas de cálculo complejas de múltiples hojas con fórmulas no triviales, y produciendo presentaciones de diapositivas bien estructuradas.
  • Coordinación multiagente, ejecutando equipos de subagentes con patrones eficaces de escritor-verificador y pocos casos de agentes que sobrescriban el trabajo de otros.

Para ver los patrones de prompts que sacan el máximo provecho de estas capacidades, consulta Prompts para Claude Opus 5.

Precios

Claude Opus 5 tiene un precio de $5 USD por millón de tokens de entrada y $25 USD por millón de tokens de salida, sin cambios con respecto a Claude Opus 4.8. Dado que el pensamiento está activado de forma predeterminada y los tokens de pensamiento se facturan como tokens de salida, una carga de trabajo que se ejecutaba sin pensamiento en Claude Opus 4.8 puede producir más tokens de salida por solicitud con las mismas tarifas por token; consulta Control de costos.

Consulta Precios para ver los precios completos, incluidas las tarifas de procesamiento por lotes, almacenamiento en caché de prompts y modo rápido.

Disponibilidad

Claude Opus 5 está disponible en:

Claude Opus 4.8 sigue disponible en todas estas plataformas.

Guía de migración

Para migrar desde Claude Opus 4.8, actualiza tu ID de modelo:

model = "claude-opus-4-8"  # Before
model = "claude-opus-5"  # After

Luego revisa los dos cambios incompatibles en Cambios de comportamiento: el pensamiento está activado de forma predeterminada (las respuestas pueden comenzar con bloques thinking, así que selecciona los bloques de contenido por type), y desactivar el pensamiento con esfuerzo xhigh o max devuelve un error 400. Consulta la guía de migración para ver instrucciones paso a paso y la lista de verificación completa.

Próximos pasos

Especificaciones y precios completos de todos los modelos Claude actuales.

Diferencias de comportamiento y patrones de prompts específicos de Claude Opus 5.

Controla cuántos tokens usa Claude al responder, de low a max.

Cómo funciona el pensamiento cuando está activado de forma predeterminada y cuándo se puede desactivar.

Dale a Claude un presupuesto de tokens orientativo para que regule el ritmo de su trabajo.

Guía para migrar a los modelos Claude más recientes desde versiones anteriores de Claude.

Obtén más tokens de salida por segundo de los modelos Claude Opus con precios premium.

Was this page helpful?