Migra a Claude Mythos 5 y Claude Fable 5 desde Claude Mythos Preview, Claude Opus 5 o Claude Opus 4.8: IDs de modelo, cambios en la API y listas de verificación de migración.
Claude Fable 5 es el modelo más capaz de Anthropic lanzado de forma general, disponible en la API de Claude, Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry. Claude Mythos 5 comparte las mismas capacidades y se ofrece únicamente a clientes aprobados en Project Glasswing.
La configuración base compartida por claude-fable-5 y claude-mythos-5:
thinking. Tanto thinking: {type: "disabled"} como el "extended thinking" (pensamiento extendido) manual (thinking: {type: "enabled", budget_tokens: N}) devuelven un error 400.invalid_request_error. Las organizaciones con un acuerdo ZDR deben contactar a su equipo de cuenta de Anthropic para analizar la configuración de retención de datos. Alternativamente, puedes configurar la retención de datos por espacio de trabajo. Consulta Requisitos de retención de datos específicos por modelo para detalles por plataforma.
Dónde divergen los dos modelos:
stop_reason: "refusal". Claude Mythos 5 no incluye estos clasificadores. Consulta Rechazos y fallback.Claude Mythos 5 es el sucesor con acceso restringido de Claude Mythos Preview, la vista previa de investigación solo por invitación. Claude Fable 5 ofrece las mismas capacidades y no requiere aprobación de acceso. Los cambios en esta sección se aplican por igual a ambos destinos.
La migración es en su mayor parte directa. Claude Mythos 5 y Claude Fable 5 usan la misma Messages API y los mismos patrones de "tool use" (uso de herramientas) que Claude Mythos Preview, y los conteos de tokens prácticamente no cambian porque los tres modelos usan el mismo tokenizador. Los cambios clave a verificar son las funciones que ya no están disponibles (enumeradas en la siguiente sección) y la salida de pensamiento. Si migras a Claude Fable 5, planifica también los rechazos de los clasificadores de seguridad, que Claude Mythos Preview y Claude Mythos 5 no tienen; consulta Rechazos y fallback.
Para el cronograma de retiro de Claude Mythos Preview, consulta Deprecaciones de modelos.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# O bien, para el modelo con las mismas capacidades y sin requisito de aprobación de acceso:
model = "claude-fable-5" # AfterPensamiento extendido y presupuestos de tokens de pensamiento: El pensamiento extendido manual (thinking: {type: "enabled", budget_tokens: N}) no es compatible con claude-mythos-5 ni claude-fable-5 y devuelve un error 400. El pensamiento adaptativo está siempre activado: el modelo determina cuándo y cuánto pensar en cada solicitud, y no se requiere ninguna configuración de thinking. thinking: {type: "disabled"} devuelve un error. budget_tokens no tiene un reemplazo directo: el pensamiento es adaptativo, y el parámetro effort es un control separado a nivel de salida, no un presupuesto de pensamiento.
Antes (Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)Después (Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)El cambio para Claude Fable 5 es idéntico, con claude-fable-5 como nombre del modelo.
Prefill del asistente: Prellenar el mensaje del asistente no es compatible con claude-mythos-5 ni claude-fable-5 y devuelve un error 400, igual que en Claude Mythos Preview. Usa instrucciones en la indicación del sistema en su lugar.
Salida de pensamiento: En claude-mythos-5 y claude-fable-5, la cadena de pensamiento en bruto nunca se devuelve, pero los bloques de pensamiento aún contienen texto resumido legible cuando thinking.display se establece en summarized. Devuelve los bloques de pensamiento sin cambios al continuar una conversación en el mismo modelo. Consulta Salida de pensamiento en Claude Fable 5 y Claude Mythos 5.
claude-mythos-5 y claude-fable-5 usan el mismo tokenizador que claude-mythos-preview (el tokenizador introducido con Claude Opus 4.7). Los conteos de tokens prácticamente no cambian al migrar desde claude-mythos-preview. En comparación con los modelos anteriores a Claude Opus 4.7, el mismo contenido puede tokenizarse en aproximadamente un 30% más de tokens, variando según el contenido y la forma de la carga de trabajo.
/v1/messages/count_tokens devuelve valores prácticamente sin cambios para claude-mythos-5 y claude-fable-5 en comparación con claude-mythos-preview. Vuelve a establecer la línea base de costo y latencia en tus propias cargas de trabajo.
claude-mythos-preview a claude-mythos-5, o a claude-fable-5, que ofrece las mismas capacidades y no requiere aprobación de acceso.thinking: {type: "enabled", budget_tokens: N}). El pensamiento adaptativo está siempre activado, y no se requiere ningún campo thinking.thinking: {type: "disabled"}. Desactivar el pensamiento devuelve un error en claude-mythos-5 y claude-fable-5.budget_tokens. No tiene un reemplazo directo: el pensamiento es adaptativo, y el parámetro effort es un control separado a nivel de salida, no un presupuesto de pensamiento.thinking lo trate únicamente como texto de visualización y devuelva los bloques de pensamiento sin cambios al continuar en el mismo modelo. thinking.display tiene como valor predeterminado "omitted" en claude-mythos-5 y claude-fable-5, igual que en Claude Mythos Preview; establece display: "summarized" para recibir resúmenes legibles. Consulta Salida de pensamiento en Claude Fable 5 y Claude Mythos 5.
thinking y redacted_thinking de los turnos previos del asistente. Los bloques de pensamiento de claude-mythos-5 y claude-fable-5 están vinculados al modelo que los produjo, y los modelos distintos de Claude Fable 5 y Claude Mythos 5 los ignoran silenciosamente. Eliminarlos mantiene las solicitudes entre modelos mínimas y uniformes.
stop_reason: "refusal" y lee el campo stop_details.category. Claude Fable 5 ejecuta clasificadores de seguridad que Claude Mythos Preview y Claude Mythos 5 no tienen. Consulta Rechazos y fallback.claude-mythos-preview.Claude Fable 5 y Claude Mythos 5 usan la misma Messages API y los mismos patrones de uso de herramientas que Claude Opus 5, con la misma ventana de contexto de 1M de tokens por defecto y los mismos 128k tokens máximos de salida. Las restricciones de prefill y de parámetros de muestreo, y el comportamiento de visualización del pensamiento, se mantienen sin cambios desde Claude Opus 5. Los cambios a verificar son el pensamiento siempre activado, los precios, Priority Tier y la retención de datos.
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# O, para el modelo de Project Glasswing con las mismas capacidades:
model = "claude-mythos-5" # AfterEl pensamiento ya no se puede desactivar: En Claude Opus 5, el pensamiento está activado por defecto y puede desactivarse con thinking: {type: "disabled"} en un nivel de effort de high o inferior. En claude-fable-5 y claude-mythos-5, el pensamiento adaptativo está siempre activado, y thinking: {type: "disabled"} devuelve un error 400 en cualquier nivel de effort. Elimina la configuración thinking: {type: "disabled"} y usa niveles de effort más bajos para controlar el gasto de tokens en su lugar.
Si tus solicitudes a Claude Opus 5 desactivaban el pensamiento, la forma de la respuesta cambia: una respuesta puede comenzar con uno o más bloques thinking antes del primer bloque text, devueltos con un campo thinking vacío en el valor predeterminado display: "omitted" (el mismo valor predeterminado que Claude Opus 5). El código que lee la respuesta por posición, como content[0].text o un manejador de stream que trata el primer bloque de contenido como texto, debe seleccionar los bloques de contenido por su campo type en su lugar, y los bucles de uso de herramientas deben devolver los bloques thinking completos y sin modificar junto con sus resultados de herramientas. La API rechaza los bloques de pensamiento editados, reordenados o parcialmente eliminados con un error 400 (consulta Preservación de bloques de pensamiento). Los tokens de pensamiento se facturan como tokens de salida incluso cuando el texto de pensamiento no se devuelve.
Precios: Claude Fable 5 y Claude Mythos 5 tienen un precio de $10 USD por millón de tokens de entrada y $50 USD por millón de tokens de salida, en comparación con $5 USD y $25 USD para Claude Opus 5. Consulta Precios de Claude.
Priority Tier: Priority Tier no es compatible con Claude Opus 5, por lo que ningún tráfico existente se ve afectado. Si tu organización tiene un compromiso de Priority Tier, Claude Fable 5 lo admite; Claude Mythos 5 no.
Retención de datos: Claude Fable 5 y Claude Mythos 5 requieren retención de datos de 30 días y no están disponibles bajo acuerdos de retención cero de datos (ZDR); ambos están designados como Covered Models. Consulta Requisitos de retención de datos específicos por modelo.
claude-opus-5 a claude-fable-5 (o claude-mythos-5).thinking: {type: "disabled"}; devuelve un error 400 en claude-fable-5 y claude-mythos-5. Usa niveles de effort más bajos para controlar el gasto de tokens en su lugar, y revisa max_tokens para las cargas de trabajo que se ejecutaban con el pensamiento desactivado en Claude Opus 5.content[0].text, actualízalas para seleccionar los bloques de contenido por type: los bloques thinking ahora llegan antes de los bloques text. Devuelve los bloques thinking completos y sin modificar en los bucles de uso de herramientas; los bloques modificados devuelven un error 400.La migración es en su mayor parte directa. Claude Fable 5 y Claude Mythos 5 usan la misma Messages API y los mismos patrones de uso de herramientas que Claude Opus 4.8, con la misma ventana de contexto de 1M de tokens por defecto y los mismos 128k tokens máximos de salida. Los conteos de tokens prácticamente no cambian porque los modelos usan el mismo tokenizador. Los cambios clave a verificar son el pensamiento adaptativo siempre activado, la salida de pensamiento, los rechazos de los clasificadores de seguridad (solo Claude Fable 5) y los precios.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# O, para el modelo de Project Glasswing con las mismas capacidades:
model = "claude-mythos-5" # AfterLos elementos de esta sección describen las diferencias de API y de comportamiento que vale la pena verificar después de cambiar el ID del modelo. Salvo donde se indique, se aplican por igual a claude-fable-5 y claude-mythos-5.
El pensamiento adaptativo está siempre activado: El pensamiento adaptativo es el único modo de pensamiento en claude-fable-5 y claude-mythos-5. El modelo determina cuándo y cuánto pensar en cada solicitud, y no se requiere ninguna configuración de thinking. thinking: {type: "disabled"} devuelve un error. Usa el parámetro effort para controlar la profundidad del pensamiento.
El cambio de comportamiento a verificar: en Claude Opus 4.8, las solicitudes sin un campo thinking se ejecutan sin pensamiento; en claude-fable-5 y claude-mythos-5, esas mismas solicitudes se ejecutan con pensamiento adaptativo. max_tokens sigue siendo un límite estricto sobre la salida total, pensamiento más texto de respuesta, así que revísalo para las cargas de trabajo que se ejecutaban sin pensamiento en Claude Opus 4.8. Consulta Control de costos. Las respuestas también pueden comenzar con uno o más bloques thinking antes del primer bloque text, por lo que el código que lee la respuesta por posición (por ejemplo, content[0].text, o un manejador de stream que trata el primer bloque de contenido como texto) debe seleccionar los bloques de contenido por su campo type en su lugar. Los tokens de pensamiento se facturan como tokens de salida incluso cuando el texto de pensamiento no se te devuelve, por lo que una carga de trabajo que se ejecutaba sin pensamiento en Claude Opus 4.8 produce más tokens de salida por solicitud, además de la diferencia de precio por token.
Si ejecutas un bucle de uso de herramientas, devuelve a la API los bloques thinking de cada respuesta del asistente completos y sin modificar cuando devuelvas los resultados de herramientas, incluidos los bloques cuyo campo thinking esté vacío. Reenvía el mensaje del asistente tal como lo recibiste en lugar de filtrar sus bloques de contenido por tipo o reconstruirlo: la API rechaza los bloques de pensamiento editados, reordenados o parcialmente eliminados con un error 400. Consulta Preservación de bloques de pensamiento.
Antes (Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Después (Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)El cambio para Claude Mythos 5 es idéntico, con claude-mythos-5 como nombre del modelo.
Pensamiento extendido y presupuestos de pensamiento (sin cambios): El pensamiento extendido manual (thinking: {type: "enabled", budget_tokens: N}) no es compatible con claude-fable-5 ni claude-mythos-5 y devuelve un error 400, igual que en Claude Opus 4.8. budget_tokens no tiene un reemplazo directo: el pensamiento es adaptativo, y el parámetro effort es un control separado a nivel de salida, no un presupuesto de pensamiento.
Prefill del asistente (sin cambios): Prellenar el mensaje del asistente no es compatible con claude-fable-5 ni claude-mythos-5 y devuelve un error 400, igual que en Claude Opus 4.8. Usa instrucciones en la indicación del sistema en su lugar.
Salida de pensamiento: En claude-fable-5 y claude-mythos-5, la cadena de pensamiento en bruto nunca se devuelve, pero los bloques de pensamiento aún contienen texto resumido legible cuando thinking.display se establece en summarized. Devuelve los bloques de pensamiento sin cambios al continuar una conversación en el mismo modelo. Consulta Salida de pensamiento en Claude Fable 5 y Claude Mythos 5.
Clasificadores de seguridad y el motivo de parada refusal (solo Claude Fable 5): claude-fable-5 ejecuta clasificadores de seguridad sobre las solicitudes y durante la generación de respuestas. Claude Mythos 5 no incluye estos clasificadores. Cuando un clasificador rechaza una solicitud, la Messages API devuelve stop_reason: "refusal" como una respuesta HTTP 200 exitosa, no como un error. El campo stop_details.category informa qué clasificador se activó, con categorías como "cyber", "bio" y "reasoning_extraction", o null cuando el rechazo no corresponde a ninguna categoría con nombre. Consulta la tabla de categorías de rechazo para el conjunto completo.
No se te facturan los tokens de entrada de una solicitud rechazada antes de que se genere cualquier salida. Cuando un clasificador se activa a mitad del stream, se facturan la entrada y la salida ya transmitida por streaming; descarta la salida parcial.
Para volver a ejecutar automáticamente las solicitudes rechazadas en otro modelo, pasa el parámetro opcional fallbacks, que está en beta en la API de Claude. El parámetro no está disponible en la Message Batches API ni en Amazon Bedrock, Google Cloud y Microsoft Foundry; en esas tres plataformas, ejecuta el reintento del lado del cliente o usa el middleware de refusal-fallback del SDK. Consulta Rechazos y fallback.
Comienza con effort high: El valor predeterminado del parámetro effort sigue siendo high. En Claude Opus 4.8, la recomendación para programación y trabajo de alta autonomía es establecer xhigh explícitamente. En claude-fable-5 y claude-mythos-5, usa high como valor predeterminado para la mayoría de las tareas y reserva xhigh para las cargas de trabajo más sensibles a la capacidad. Los ajustes de effort más bajos siguen funcionando bien y a menudo superan el rendimiento de xhigh en modelos anteriores. Reduce el effort si una tarea se completa pero tarda más de lo necesario. Consulta Prompting de Claude Fable 5.
Mínimo más bajo para el almacenamiento en caché de prompts: La longitud mínima de prompt almacenable en caché en claude-fable-5 y claude-mythos-5 es de 512 tokens, menor que los 1,024 tokens de Claude Opus 4.8. Los prompts que eran demasiado cortos para almacenarse en caché en Claude Opus 4.8 ahora pueden crear entradas de caché, sin necesidad de cambios en el código. Consulta "Prompt caching" (almacenamiento en caché de prompts) para los mínimos por modelo.
claude-fable-5 y claude-mythos-5 requieren retención de datos de 30 días; en la API de Claude, las solicitudes a claude-fable-5 que no cumplen este requisito devuelven un error 400 invalid_request_error. Claude Opus 4.8 sigue disponible bajo ZDR. Consulta Requisitos de retención de datos específicos por modelo.
claude-opus-4-8 a claude-fable-5 (o claude-mythos-5).thinking: {type: "disabled"}. Desactivar el pensamiento devuelve un error en claude-fable-5 y claude-mythos-5, y las solicitudes sin un campo thinking se ejecutan con pensamiento adaptativo.content[0].text: con el pensamiento adaptativo siempre activado, los bloques thinking llegan antes de los bloques text. Selecciona los bloques de contenido por type en su lugar, y devuelve los bloques thinking completos y sin modificar en los bucles de uso de herramientas; los bloques modificados devuelven un error 400. Consulta Preservación de bloques de pensamiento.claude-fable-5 y claude-mythos-5.thinking lo trate únicamente como texto de visualización y devuelva los bloques de pensamiento sin cambios al continuar en el mismo modelo. thinking.display tiene como valor predeterminado "omitted" en claude-fable-5 y claude-mythos-5, igual que en Claude Opus 4.8; establece display: "summarized" para recibir resúmenes legibles. Consulta Salida de pensamiento en Claude Fable 5 y Claude Mythos 5.
thinking y redacted_thinking de los turnos previos del asistente. Los bloques de pensamiento de claude-fable-5 y claude-mythos-5 están vinculados al modelo que los produjo, y los modelos distintos de Claude Fable 5 y Claude Mythos 5 los ignoran silenciosamente. Eliminarlos mantiene las solicitudes entre modelos mínimas y uniformes. La excepción es canjear un crédito de fallback, que requiere que el cuerpo de la solicitud se reenvíe bajo las reglas exactas de esa función.
stop_reason: "refusal" y lee el campo stop_details.category. Para volver a ejecutar automáticamente las solicitudes rechazadas en otro modelo, considera el parámetro opcional fallbacks (beta). Consulta Rechazos y fallback.effort. Comienza con high para la mayoría de las tareas, incluidas las cargas de trabajo que se ejecutaban con xhigh en Claude Opus 4.8.claude-opus-4-8; el precio por token difiere, y los tokens de pensamiento se facturan como tokens de salida, por lo que las cargas de trabajo que se ejecutaban sin pensamiento producen más tokens de salida por solicitud.Was this page helpful?