Claude Platform Docs
Documentation

Migración a Claude Mythos 5 y Claude Fable 5

Migra a Claude Mythos 5 y Claude Fable 5 desde Claude Mythos Preview, Claude Opus 5 o Claude Opus 4.8: IDs de modelo, cambios en la API y listas de verificación de migración.

Claude Fable 5 está diseñado para razonamiento exigente y trabajo agéntico de largo horizonte. Claude Fable 5.1 se basa en él. Claude Fable 5 está disponible en la Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry. Claude Mythos 5 comparte las mismas capacidades y se ofrece únicamente a clientes aprobados en Project Glasswing.

La configuración base compartida por claude-fable-5 y claude-mythos-5:

  • Pensamiento: El pensamiento adaptativo está siempre activado. El modelo determina cuándo y cuánto pensar en cada solicitud, y no se requiere ninguna configuración de thinking. Tanto thinking: {type: "disabled"} como el "extended thinking" (pensamiento extendido) manual (thinking: {type: "enabled", budget_tokens: N}) devuelven un error 400.
  • Prefill: Prellenar el mensaje del asistente devuelve un error 400. Usa instrucciones en la "system prompt" (indicación del sistema) en su lugar.
  • Ventana de contexto y salida: Una "context window" (ventana de contexto) de 1M de tokens por defecto, y hasta 128k tokens de salida por solicitud.
  • Precios: $10 USD por millón de tokens de entrada y $50 USD por millón de tokens de salida. Consulta Precios de Claude.
  • Retención de datos: Ambos modelos requieren retención de datos de 30 días y no están disponibles bajo acuerdos de retención cero de datos (ZDR) a menos que Anthropic lo autorice expresamente. Ambos están designados como Covered Models. En la Claude API, una solicitud a Claude Fable 5 desde una organización cuya configuración de retención de datos no cumple este requisito devuelve un error 400 invalid_request_error. Las organizaciones con un acuerdo ZDR deben contactar a su equipo de cuenta de Anthropic para analizar la configuración de retención de datos, o configurar la retención de datos por espacio de trabajo. Consulta Requisitos de retención de datos específicos por modelo para obtener detalles por plataforma.

Dónde difieren los dos modelos:

  • Disponibilidad: Claude Fable 5 no requiere aprobación de acceso. Claude Mythos 5 está disponible únicamente para clientes aprobados en Project Glasswing.
  • Clasificadores de seguridad: Claude Fable 5 ejecuta clasificadores de seguridad que pueden rechazar solicitudes con stop_reason: "refusal". Claude Mythos 5 no incluye estos clasificadores. Consulta Rechazos y fallback.
  • Priority Tier: Priority Tier es compatible con Claude Fable 5 pero no con Claude Mythos 5.

Migración a Claude Mythos 5 y Claude Fable 5 desde Claude Mythos Preview

Claude Mythos 5 es el sucesor con acceso restringido de Claude Mythos Preview, la vista previa de investigación solo por invitación. Claude Fable 5 ofrece las mismas capacidades y no requiere aprobación de acceso. Los cambios en esta sección se aplican por igual a ambos destinos.

La migración es en su mayor parte directa. Claude Mythos 5 y Claude Fable 5 usan la misma Messages API y los mismos patrones de "tool use" (uso de herramientas) que Claude Mythos Preview, y los conteos de tokens prácticamente no cambian porque los tres modelos usan el mismo tokenizador. Los cambios clave a verificar son las funciones que ya no están disponibles (enumeradas en la siguiente sección) y la salida de pensamiento. Si migras a Claude Fable 5, planifica también los rechazos de los clasificadores de seguridad, que Claude Mythos Preview y Claude Mythos 5 no tienen; consulta Rechazos y fallback.

Para el cronograma de retiro de Claude Mythos Preview, consulta Deprecaciones de modelos.

Actualiza el nombre de tu modelo

model = "claude-mythos-preview"  # Before
model = "claude-mythos-5"  # After

# O bien, para el modelo con las mismas capacidades y sin requisito de aprobación de acceso:
model = "claude-fable-5"  # After

Funciones no disponibles en Claude Mythos 5 y Claude Fable 5

  1. Pensamiento extendido y presupuestos de tokens de pensamiento: El pensamiento extendido manual (thinking: {type: "enabled", budget_tokens: N}) no es compatible con claude-mythos-5 ni claude-fable-5 y devuelve un error 400. El pensamiento adaptativo está siempre activado: el modelo determina cuándo y cuánto pensar en cada solicitud, y no se requiere ninguna configuración de thinking. thinking: {type: "disabled"} devuelve un error. budget_tokens no tiene un reemplazo directo: el pensamiento es adaptativo, y el parámetro effort es un control separado a nivel de salida, no un presupuesto de pensamiento.

    Antes (Claude Mythos Preview):

    client.messages.create(
        model="claude-mythos-preview",
        max_tokens=16000,
        thinking={"type": "enabled", "budget_tokens": 10000},
        messages=[{"role": "user", "content": "..."}],
    )

    Después (Claude Mythos 5):

    client.messages.create(
        model="claude-mythos-5",
        max_tokens=16000,
        messages=[{"role": "user", "content": "..."}],
    )

    El cambio para Claude Fable 5 es idéntico, con claude-fable-5 como nombre del modelo.

  2. Prefill del asistente: Prellenar el mensaje del asistente no es compatible con claude-mythos-5 ni claude-fable-5 y devuelve un error 400, igual que en Claude Mythos Preview. Usa instrucciones en la indicación del sistema en su lugar.

  3. Salida de pensamiento: En claude-mythos-5 y claude-fable-5, la cadena de pensamiento sin procesar nunca se devuelve, pero los bloques de pensamiento aún contienen texto resumido legible cuando thinking.display se establece en summarized. Devuelve los bloques de pensamiento sin cambios al continuar una conversación en el mismo modelo. Consulta Salida de pensamiento en los modelos Claude Fable y Claude Mythos.

Conteo de tokens y facturación

claude-mythos-5 y claude-fable-5 usan el mismo tokenizador que claude-mythos-preview (el tokenizador introducido con Claude Opus 4.7). Los conteos de tokens prácticamente no cambian al migrar desde claude-mythos-preview. En comparación con los modelos anteriores a Claude Opus 4.7, el mismo contenido puede tokenizarse en aproximadamente un 30% más de tokens, variando según el contenido y la forma de la carga de trabajo.

/v1/messages/count_tokens devuelve valores prácticamente sin cambios para claude-mythos-5 y claude-fable-5 en comparación con claude-mythos-preview. Vuelve a establecer la línea base de costo y latencia en tus propias cargas de trabajo.

Lista de verificación de migración

  • Actualiza el nombre del modelo de claude-mythos-preview a claude-mythos-5, o a claude-fable-5, que ofrece las mismas capacidades y no requiere aprobación de acceso.
  • Elimina la configuración de pensamiento extendido manual (thinking: {type: "enabled", budget_tokens: N}). El pensamiento adaptativo está siempre activado y no se requiere ningún campo thinking.
  • Elimina cualquier configuración thinking: {type: "disabled"}. Desactivar el pensamiento devuelve un error en claude-mythos-5 y claude-fable-5.
  • Elimina budget_tokens. No tiene un reemplazo directo: el pensamiento es adaptativo, y el parámetro effort es un control independiente a nivel de salida, no un presupuesto de pensamiento.
  • Verifica que cualquier código que analice el campo thinking lo trate solo como texto para mostrar y devuelva los bloques de pensamiento sin cambios al continuar en el mismo modelo. thinking.display tiene como valor predeterminado "omitted" en claude-mythos-5 y claude-fable-5, igual que en Claude Mythos Preview. Configura display: "summarized" para recibir resúmenes legibles. Consulta Salida de pensamiento en los modelos Claude Fable y Claude Mythos.
  • Si reproduces el historial de conversación en un modelo anterior, elimina primero los bloques thinking y redacted_thinking de los turnos previos del asistente. Los bloques de pensamiento de claude-fable-5 y claude-mythos-5 solo pueden ser leídos por el modelo que los produjo o por uno más reciente: los modelos anteriores los ignoran silenciosamente, mientras que Claude Fable 5.1 y Claude Mythos 5.1 los leen, así que consérvalos cuando traslades una conversación a esos modelos (consulta Cambiar de modelo a mitad de la conversación). Eliminarlos mantiene las solicitudes a modelos anteriores mínimas y uniformes.
  • Si migras a Claude Fable 5, gestiona stop_reason: "refusal" y lee el campo stop_details.category. Claude Fable 5 ejecuta clasificadores de seguridad que Claude Mythos Preview y Claude Mythos 5 no tienen. Consulta Rechazos y fallback.
  • Vuelve a establecer la línea base de recuentos de tokens y costos en tus propias cargas de trabajo. Los recuentos de tokens se mantienen prácticamente sin cambios al migrar desde claude-mythos-preview.

Migración a Claude Mythos 5 y Claude Fable 5 desde Claude Opus 5

Claude Fable 5 y Claude Mythos 5 usan la misma Messages API y los mismos patrones de uso de herramientas que Claude Opus 5, con la misma ventana de contexto de 1M de tokens por defecto y los mismos 128k tokens máximos de salida. Las restricciones de prefill y de parámetros de muestreo, y el comportamiento de visualización del pensamiento, se mantienen sin cambios desde Claude Opus 5. Los cambios a verificar son el pensamiento siempre activado, los precios, Priority Tier y la retención de datos.

Actualiza el nombre de tu modelo

model = "claude-opus-5"  # Before
model = "claude-fable-5"  # After

# O, para el modelo de Project Glasswing con las mismas capacidades:
model = "claude-mythos-5"  # After

Qué cambió

  1. El pensamiento ya no se puede desactivar: En Claude Opus 5, el pensamiento está activado por defecto y se puede desactivar con thinking: {type: "disabled"} en un nivel de effort de high o inferior. En claude-fable-5 y claude-mythos-5, el pensamiento adaptativo está siempre activado, y thinking: {type: "disabled"} devuelve un error 400 en cualquier nivel de effort. Elimina la configuración thinking: {type: "disabled"} y usa niveles de effort más bajos para controlar el gasto de tokens en su lugar.

    Si tus solicitudes a Claude Opus 5 desactivaban el pensamiento, la forma de la respuesta cambia: una respuesta puede comenzar con uno o más bloques thinking antes del primer bloque text, devueltos con un campo thinking vacío en el valor predeterminado display: "omitted" (el mismo valor predeterminado que Claude Opus 5). El código que lee la respuesta por posición, como content[0].text o un manejador de stream que trata el primer bloque de contenido como texto, debe seleccionar los bloques de contenido por su campo type en su lugar, y los bucles de uso de herramientas deben devolver los bloques thinking completos y sin modificar junto con sus resultados de herramientas. La API rechaza los bloques de pensamiento editados, reordenados o parcialmente eliminados con un error 400 (consulta Preservación de bloques de pensamiento). Los tokens de pensamiento se facturan como tokens de salida incluso cuando el texto de pensamiento no se devuelve.

  2. Precios: Claude Fable 5 y Claude Mythos 5 tienen un precio de $10 USD por millón de tokens de entrada y $50 USD por millón de tokens de salida, en comparación con $5 USD y $25 USD para Claude Opus 5. Consulta Precios de Claude.

  3. Priority Tier: Priority Tier no es compatible con Claude Opus 5, por lo que ningún tráfico existente se ve afectado. Si tu organización tiene un compromiso de Priority Tier, Claude Fable 5 lo admite; Claude Mythos 5 no.

  4. Retención de datos: Claude Fable 5 y Claude Mythos 5 requieren retención de datos de 30 días y no están disponibles bajo acuerdos de retención cero de datos (ZDR) a menos que Anthropic lo autorice expresamente. Ambos están designados como Covered Models. Consulta Requisitos de retención de datos específicos por modelo.

Lista de verificación de migración

  • Actualiza el nombre del modelo de claude-opus-5 a claude-fable-5 (o claude-mythos-5).
  • Elimina cualquier configuración thinking: {type: "disabled"}; devuelve un error 400 en claude-fable-5 y claude-mythos-5. Usa niveles de effort más bajos para controlar el gasto de tokens en su lugar, y revisa max_tokens para las cargas de trabajo que se ejecutaban con el pensamiento desactivado en Claude Opus 5.
  • Si esas cargas de trabajo leen el contenido por posición, como content[0].text, actualízalas para seleccionar los bloques de contenido por type: los bloques thinking ahora llegan antes de los bloques text. Devuelve los bloques thinking completos y sin modificar en los bucles de uso de herramientas; los bloques modificados devuelven un error 400.
  • Si tu organización tiene un acuerdo de retención cero de datos (ZDR), confirma la elegibilidad antes de migrar: estos modelos no están disponibles bajo ZDR a menos que Anthropic lo autorice expresamente. Consulta Requisitos de retención de datos específicos por modelo.
  • Vuelve a establecer la línea base de costo en tus propias cargas de trabajo. Los conteos de tokens prácticamente no cambian; el precio por token difiere, y las cargas de trabajo que se ejecutaban con el pensamiento desactivado ahora producen tokens de pensamiento, que se facturan como tokens de salida.

Migración a Claude Mythos 5 y Claude Fable 5 desde Claude Opus 4.8

La migración es en su mayor parte directa. Claude Fable 5 y Claude Mythos 5 usan la misma Messages API y los mismos patrones de uso de herramientas que Claude Opus 4.8, con la misma ventana de contexto de 1M de tokens por defecto y los mismos 128k tokens máximos de salida. Los conteos de tokens prácticamente no cambian porque los modelos usan el mismo tokenizador. Los cambios clave a verificar son el pensamiento adaptativo siempre activado, la salida de pensamiento, los rechazos de los clasificadores de seguridad (solo Claude Fable 5) y los precios.

Actualiza el nombre de tu modelo

model = "claude-opus-4-8"  # Before
model = "claude-fable-5"  # After

# O, para el modelo de Project Glasswing con las mismas capacidades:
model = "claude-mythos-5"  # After

Qué cambió

Los elementos de esta sección describen las diferencias de API y de comportamiento que vale la pena verificar después de cambiar el ID del modelo. Excepto donde se indique, se aplican por igual a claude-fable-5 y claude-mythos-5.

  1. El pensamiento adaptativo está siempre activado: El pensamiento adaptativo es el único modo de pensamiento en claude-fable-5 y claude-mythos-5. El modelo determina cuándo y cuánto pensar en cada solicitud, y no se requiere ninguna configuración de thinking. thinking: {type: "disabled"} devuelve un error. Usa el parámetro effort para controlar la profundidad del pensamiento.

    El cambio de comportamiento a verificar: en Claude Opus 4.8, las solicitudes sin un campo thinking se ejecutan sin pensamiento; en claude-fable-5 y claude-mythos-5, esas mismas solicitudes se ejecutan con pensamiento adaptativo. max_tokens sigue siendo un límite estricto sobre la salida total, pensamiento más texto de respuesta, así que revísalo para las cargas de trabajo que se ejecutaban sin pensamiento en Claude Opus 4.8. Consulta Control de costos. Las respuestas también pueden comenzar con uno o más bloques thinking antes del primer bloque text, por lo que el código que lee la respuesta por posición (por ejemplo, content[0].text, o un manejador de stream que trata el primer bloque de contenido como texto) debe seleccionar los bloques de contenido por su campo type en su lugar. Los tokens de pensamiento se facturan como tokens de salida incluso cuando el texto de pensamiento no se te devuelve, por lo que una carga de trabajo que se ejecutaba sin pensamiento en Claude Opus 4.8 produce más tokens de salida por solicitud, además de la diferencia de precio por token.

    Si ejecutas un bucle de uso de herramientas, devuelve a la API los bloques thinking de cada respuesta del asistente completos y sin modificar cuando devuelvas los resultados de herramientas, incluidos los bloques cuyo campo thinking esté vacío. Reenvía el mensaje del asistente tal como lo recibiste en lugar de filtrar sus bloques de contenido por tipo o reconstruirlo: la API rechaza los bloques de pensamiento editados, reordenados o parcialmente eliminados con un error 400. Consulta Preservación de bloques de pensamiento.

    Antes (Claude Opus 4.8):

    client.messages.create(
        model="claude-opus-4-8",
        max_tokens=16000,
        thinking={"type": "adaptive"},
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Después (Claude Fable 5):

    client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    El cambio para Claude Mythos 5 es idéntico, con claude-mythos-5 como nombre del modelo.

  2. Pensamiento extendido y presupuestos de pensamiento (sin cambios): El pensamiento extendido manual (thinking: {type: "enabled", budget_tokens: N}) no es compatible con claude-fable-5 ni claude-mythos-5 y devuelve un error 400, igual que en Claude Opus 4.8. budget_tokens no tiene un reemplazo directo: el pensamiento es adaptativo, y el parámetro effort es un control separado a nivel de salida, no un presupuesto de pensamiento.

  3. Prefill del asistente (sin cambios): Prellenar el mensaje del asistente no es compatible con claude-fable-5 ni claude-mythos-5 y devuelve un error 400, igual que en Claude Opus 4.8. Usa instrucciones en la indicación del sistema en su lugar.

  4. Salida de pensamiento: En claude-fable-5 y claude-mythos-5, la cadena de pensamiento sin procesar nunca se devuelve, pero los bloques de pensamiento aún contienen texto resumido legible cuando thinking.display se establece en summarized. Devuelve los bloques de pensamiento sin cambios al continuar una conversación en el mismo modelo. Consulta Salida de pensamiento en los modelos Claude Fable y Claude Mythos.

  5. Clasificadores de seguridad y el motivo de parada refusal (solo Claude Fable 5): claude-fable-5 ejecuta clasificadores de seguridad sobre las solicitudes y durante la generación de respuestas. Claude Mythos 5 no incluye estos clasificadores. Cuando un clasificador rechaza una solicitud, la Messages API devuelve stop_reason: "refusal" como una respuesta HTTP 200 exitosa, no como un error. El campo stop_details.category informa qué clasificador se activó, con categorías como "cyber", "bio" y "reasoning_extraction", o null cuando el rechazo no corresponde a ninguna categoría con nombre. Consulta la tabla de categorías de rechazo para ver el conjunto completo.

    No se te facturan los tokens de entrada de una solicitud rechazada antes de que se genere cualquier salida. Cuando un clasificador se activa a mitad del stream, se facturan la entrada y la salida ya transmitida por streaming; descarta la salida parcial.

    Para volver a ejecutar automáticamente las solicitudes rechazadas en otro modelo, pasa el parámetro opcional fallbacks, que está en beta en la Claude API. El parámetro no está disponible en la Message Batches API ni en Amazon Bedrock, Google Cloud y Microsoft Foundry; en esas tres plataformas, ejecuta el reintento del lado del cliente o usa el middleware de fallback ante rechazos del SDK. Consulta Rechazos y fallback.

  6. Comienza con effort high: El valor predeterminado del parámetro effort sigue siendo high. En Claude Opus 4.8, la recomendación para programación y trabajo de alta autonomía es establecer xhigh explícitamente. En claude-fable-5 y claude-mythos-5, usa high como valor predeterminado para la mayoría de las tareas y reserva xhigh para las cargas de trabajo más sensibles a la capacidad. Los ajustes de effort más bajos siguen funcionando bien y a menudo superan el rendimiento de xhigh en modelos anteriores. Reduce el effort si una tarea se completa pero tarda más de lo necesario. Consulta Prompting de Claude Fable 5.

  7. Mínimo más bajo para el almacenamiento en caché de prompts: La longitud mínima de prompt almacenable en caché en claude-fable-5 y claude-mythos-5 es de 512 tokens, inferior a los 1,024 tokens de Claude Opus 4.8. Los prompts que eran demasiado cortos para almacenarse en caché en Claude Opus 4.8 ahora pueden crear entradas de caché, sin necesidad de cambios en el código. Consulta "Prompt caching" (almacenamiento en caché de prompts) para ver los mínimos por modelo.

Lista de verificación de migración

  • Si tu organización tiene un acuerdo de retención cero de datos (ZDR), confirma la elegibilidad antes de migrar. claude-fable-5 y claude-mythos-5 requieren una retención de datos de 30 días y no están disponibles bajo ZDR a menos que Anthropic lo autorice expresamente. En la Claude API, las solicitudes a claude-fable-5 que no cumplen este requisito devuelven un error 400 invalid_request_error. Claude Opus 4.8 está disponible bajo ZDR. Consulta Requisitos de retención de datos específicos del modelo.
  • Actualiza el nombre del modelo de claude-opus-4-8 a claude-fable-5 (o claude-mythos-5).
  • Elimina cualquier configuración thinking: {type: "disabled"}. Desactivar el pensamiento devuelve un error en claude-fable-5 y claude-mythos-5, y las solicitudes sin un campo thinking se ejecutan con pensamiento adaptativo.
  • Actualiza el análisis de respuestas que lee el contenido por posición, como content[0].text: con el pensamiento adaptativo siempre activado, los bloques thinking llegan antes que los bloques text. Selecciona los bloques de contenido por type en su lugar, y devuelve los bloques thinking completos y sin modificar en los bucles de uso de herramientas; los bloques modificados devuelven un error 400. Consulta Preservar los bloques de pensamiento.
  • Si eliminaste el pensamiento extendido manual y los prefills del asistente durante migraciones anteriores, no es necesario hacer nada: ambos siguen sin ser compatibles con claude-fable-5 y claude-mythos-5.
  • Verifica que cualquier código que analice el campo thinking lo trate solo como texto para mostrar y devuelva los bloques de pensamiento sin cambios al continuar en el mismo modelo. thinking.display tiene como valor predeterminado "omitted" en claude-fable-5 y claude-mythos-5, igual que en Claude Opus 4.8. Configura display: "summarized" para recibir resúmenes legibles. Consulta Salida de pensamiento en los modelos Claude Fable y Claude Mythos.
  • Si reproduces el historial de conversación en un modelo anterior, elimina primero los bloques thinking y redacted_thinking de los turnos previos del asistente. Los bloques de pensamiento de claude-fable-5 y claude-mythos-5 solo pueden ser leídos por el modelo que los produjo o por uno más reciente: los modelos anteriores los ignoran silenciosamente, mientras que Claude Fable 5.1 y Claude Mythos 5.1 los leen, así que consérvalos cuando traslades una conversación a esos modelos (consulta Cambiar de modelo a mitad de la conversación). Eliminarlos mantiene las solicitudes a modelos anteriores mínimas y uniformes. La excepción es el canje de un crédito de fallback, que requiere que el cuerpo de la solicitud se reenvíe según las reglas exactas de esa función.
  • Si migras a Claude Fable 5, gestiona stop_reason: "refusal" y lee el campo stop_details.category. Para volver a ejecutar automáticamente las solicitudes rechazadas en otro modelo, considera el parámetro opcional fallbacks (beta). Consulta Rechazos y fallback.
  • Vuelve a evaluar tu configuración de effort. Comienza con high para la mayoría de las tareas, incluidas las cargas de trabajo que se ejecutaban con xhigh en Claude Opus 4.8.
  • Vuelve a establecer la línea base de costo y latencia en tus propias cargas de trabajo. Los recuentos de tokens se mantienen prácticamente sin cambios al migrar desde claude-opus-4-8; el precio por token es diferente, y los tokens de pensamiento se facturan como tokens de salida, por lo que las cargas de trabajo que se ejecutaban sin pensamiento producen más tokens de salida por solicitud.

Was this page helpful?