Novedades en Claude Fable 5.1
Descripción general de las nuevas funciones, cambios incompatibles y mejoras de capacidades en Claude Fable 5.1 y Claude Mythos 5.1.
Claude Fable 5.1 amplía Claude Fable 5 con los mismos precios de entrada y salida, con lecturas de caché a una cuarta parte del costo, y ofrece una codificación agéntica de larga duración más sólida, investigación de varios pasos y trabajo con documentos, hojas de cálculo y diapositivas. Para la mayoría de las cargas de trabajo, comienza con Claude Opus 5 (consulta Cómo elegir un modelo). Usa Claude Fable 5.1 para razonamiento exigente y trabajo agéntico de horizonte largo, o cuando tus evaluaciones en Claude Opus 5 con mayor esfuerzo aún no sean suficientes. Claude Mythos 5.1 ofrece las mismas capacidades únicamente a los participantes de Project Glasswing.
Si ya llamas a Claude Fable 5, tres cambios son incompatibles: el uso forzado de herramientas devuelve un error, los modelos anteriores no pueden leer sus bloques de pensamiento y editar turnos anteriores invalida los bloques de pensamiento. Cinco son aditivos: esfuerzo por mensaje (beta), mensajes del sistema con alcance de turno (beta), actualizaciones de progreso legibles entre llamadas a herramientas (display: "updates", beta), un precio de lectura de caché más bajo y procedencia del contenido.
Modelos
| Modelo | ID de Claude API | Descripción | Disponibilidad |
|---|---|---|---|
| Claude Fable 5.1 | Sucesor de Claude Fable 5, para codificación agéntica de larga duración, trabajo de conocimiento e investigación | Todos los clientes, en la Claude API y plataformas asociadas | |
| Claude Mythos 5.1 | Las mismas capacidades que Claude Fable 5.1. Sucesor de Claude Mythos 5. | Solo participantes de Project Glasswing |
Claude Fable 5.1 y Claude Mythos 5.1 comparten especificaciones y precios:
- Ventana de contexto y salida: una "context window" (ventana de contexto) de 1M de tokens (predeterminada y máxima) con precios estándar por token en toda la ventana, y 128k tokens de salida máximos.
- Pensamiento: el pensamiento adaptativo está siempre activado. Usa el parámetro effort para controlar la profundidad del pensamiento.
- Precios: los mismos que Claude Fable 5, excepto por un precio de lectura de caché más bajo.
- Tokenizador: el mismo que Claude Fable 5 (introducido con Claude Opus 4.7). En comparación con modelos anteriores a Claude Opus 4.7, el mismo texto produce aproximadamente un 30% más de tokens. Consulta Conteo de tokens.
Para ver todos los modelos actuales, consulta la descripción general de modelos.
Cambios incompatibles
El uso forzado de herramientas no es compatible
Claude Fable 5.1 y Claude Mythos 5.1 no admiten el "tool use" (uso de herramientas) forzado. tool_choice establecido en {"type": "any"} o {"type": "tool", "name": "..."} devuelve un error 400 invalid_request_error:
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (el valor predeterminado) y {"type": "none"} no cambian. La misma validación se aplica al endpoint de conteo de tokens.
El pensamiento está siempre activado en estos modelos, y una llamada forzada a una herramienta lo omitiría. En su lugar, el modelo escribiría su razonamiento en los argumentos de la herramienta, lo que reduce la calidad de los argumentos. Para obtener JSON válido según el esquema, mantén tool_choice: {"type": "auto"} y establece strict: true con el uso estricto de herramientas, o traslada el esquema a salidas estructuradas. Para que el modelo llame a una herramienta en lugar de responder con texto, indica en el prompt cuándo aplica la herramienta (por ejemplo, "Usa la herramienta get_weather para responder"). Claude Fable 5.1 sigue las instrucciones explícitas sobre herramientas de forma confiable.
Los modelos anteriores no pueden leer los bloques de pensamiento de Claude Fable 5.1
Cada bloque de pensamiento registra qué modelo lo produjo, y se conserva en una sola dirección: Claude Fable 5.1 lee los bloques de pensamiento de modelos anteriores, y ningún modelo anterior lee los de Claude Fable 5.1. Una conversación que pasa a Claude Fable 5.1 (desde Claude Opus 5, Claude Fable 5 o cualquier modelo Claude anterior) conserva su razonamiento. Una conversación que pasa de Claude Fable 5.1 a cualquiera de esos modelos lo pierde en los turnos que se ejecutan allí.
Cuando una solicitud incluye un bloque que el modelo de destino no puede leer (por ejemplo, si un enrutador o un mecanismo de respaldo cambia de modelo a mitad de la conversación), la API descarta el bloque antes de que el modelo lo vea. Los bloques descartados no cuentan para input_tokens y no se facturan. Con el encabezado beta thinking-binding-controls-2026-08-01, el descarte se informa en un arreglo input_transformations de nivel superior. Sin él, el descarte es silencioso. Consulta Cambiar de modelo a mitad de la conversación.
Editar turnos anteriores invalida los bloques de pensamiento
Modificar cualquier cosa antes de un bloque de pensamiento de Claude Fable 5.1 (la indicación del sistema system, las tools o un mensaje anterior) produce un error en la siguiente solicitud, o hace que el bloque se descarte si optas por ello. Claude Mythos 5.1 no ejecuta esta verificación. Claude Code, claude.ai, Claude Managed Agents y el Claude Agent SDK mantienen ese prefijo intacto por ti. Si tu código construye el arreglo messages por sí mismo, revísalo antes de migrar: Pensamiento preservado explica la verificación y cada corrección. La verificación se aplica a las cuentas nuevas creadas a partir del 31 de agosto de 2026. Para las cuentas creadas antes, la API registra la discrepancia pero solo actúa sobre ella cuando la solicitud establece thinking.block_binding.prefix_mismatch_behavior.
Estos patrones invalidan todos los bloques de pensamiento posteriores:
- Editar, reordenar o eliminar un turno anterior mientras se conservan los posteriores.
- Inyectar texto por solicitud en un turno anterior (un recordatorio o una línea de estado) que eliminas en la siguiente solicitud.
- Reconstruir la indicación del sistema
systemde nivel superior o el arreglotoolsentre solicitudes de la misma conversación. - Una URL de imagen o documento que sirve bytes diferentes en una solicitud posterior (la verificación cubre los bytes, no la URL, por lo que una URL firmada rotativa para el mismo archivo está bien).
Estos mantienen válidos los bloques posteriores: eliminar una secuencia inicial de bloques de pensamiento (los más antiguos primero), dejar que la compactación del lado del servidor o la edición de contexto recorten el historial, mover los marcadores cache_control y cambiar effort entre solicitudes. Eliminar un bloque de pensamiento de cualquier lugar que no sea el inicio de la secuencia invalida todos los bloques de pensamiento posteriores a él.
Donde se aplica la verificación, una solicitud que reenvía un bloque invalidado se rechaza con un 400 cuyo mensaje dice The block is bound to a different conversation. Para descartar el bloque y continuar en su lugar, envía el encabezado beta thinking-binding-controls-2026-08-01 con thinking.block_binding.prefix_mismatch_behavior: "drop_block". El descarte se informa en input_transformations con reason: "prefix_binding_mismatch".
Para mantener el pensamiento válido a lo largo de una sesión larga, trata la conversación como "append-only" (solo anexado). Agrega instrucciones con un mensaje del sistema a mitad de la conversación (con alcance de turno si solo debe aplicarse a un turno) y cambia las herramientas con cambios de herramientas a mitad de la conversación en lugar de editar system o tools. Recorta el contexto con la edición de contexto o la compactación del lado del servidor, que no cuentan como ediciones. Estos patrones también mantienen activa la "prompt cache" (caché de prompts). Para averiguar si tu integración edita el historial, ejecuta una sesión con prefix_mismatch_behavior: "drop_block" y registra input_transformations: la guía de migración incluye la verificación de tres pasos. Consulta Mantener el prefijo sin cambios para ver las reglas completas.
Nuevas funciones
Cambiar el esfuerzo a mitad de conversación (beta)
En Claude Fable 5.1 puedes cambiar el nivel de esfuerzo a mitad de la conversación sin invalidar la caché de prompts. Auméntalo para un paso difícil y redúcelo para los rutinarios. El esfuerzo por mensaje está en beta: incluye el encabezado beta mid-conversation-output-config-2026-07-01. Claude Fable 5.1, Claude Mythos 5.1 y Claude Opus 5 lo admiten en la Claude API y en Google Cloud.
client = anthropic.Anthropic()
response = client.beta.messages.create(
model="claude-fable-5-1",
max_tokens=4096,
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
},
{
"role": "assistant",
"content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
},
# Mensaje del sistema solo con effort (esfuerzo): el nuevo nivel se aplica desde el siguiente turno del usuario.
{"role": "system", "content": [], "output_config": {"effort": "low"}},
{"role": "user", "content": "Summarize the plan in one sentence."},
],
betas=["mid-conversation-output-config-2026-07-01"],
)
for block in response.content:
if block.type == "text":
print(block.text)Consulta Esfuerzo por mensaje para obtener más detalles.
Mensajes del sistema con alcance de turno (beta)
Un mensaje del sistema a mitad de conversación puede limitarse a un solo turno. Establece clear_at: "next_user_message" en un mensaje con role: "system" y su texto tendrá la autoridad de una indicación del sistema durante el turno actual, y luego dejará de renderizarse una vez que exista un mensaje user posterior. El mensaje permanece en messages y lo sigues enviando de vuelta textualmente, por lo que nada anterior en la conversación cambia. La caché de prompts sigue coincidiendo, los bloques de pensamiento posteriores siguen siendo válidos y un mensaje borrado no cuesta tokens de entrada. Úsalo para recordatorios por turno en un bucle de herramientas ("revisa tu bandeja de entrada antes de ejecutar más código", "el usuario no puede ver la salida de esa herramienta") en lugar de inyectar texto en el historial y eliminarlo en la siguiente solicitud. Los mensajes del sistema con alcance de turno están en beta: incluye el encabezado beta mid-conversation-system-clear-at-2026-08-21. Consulta Mensajes del sistema con alcance de turno.
{
"role": "system",
"clear_at": "next_user_message",
"content": "Results have landed in your inbox. Check it before running more code."
}Actualizaciones de progreso entre llamadas a herramientas (beta)
Al igual que Claude Fable 5, Claude Fable 5.1 escribe breves actualizaciones de progreso entre llamadas a herramientas sobre lo que encontró y lo que hará a continuación, aunque en menor cantidad (consulta Cambios respecto a Claude Fable 5). Cada actualización llega como su propio bloque thinking inmediatamente antes de la llamada a la herramienta. Con el valor predeterminado de thinking.display de "omitted", esos bloques regresan vacíos, igual que el razonamiento, por lo que un turno agéntico largo puede parecer silencioso para tus usuarios. Lo nuevo es la opción display: "updates": establécela con el encabezado beta thinking-display-updates-2026-08-18 para recibir las actualizaciones de progreso como texto mientras el razonamiento permanece oculto. Cualquier bloque thinking con texto no vacío es entonces una línea de estado que puedes mostrar al usuario. "summarized" también las devuelve, mezcladas con el razonamiento resumido. Consulta Actualizaciones de progreso entre llamadas a herramientas.
Procedencia del contenido
El texto generado por Claude Fable 5.1 y Claude Mythos 5.1 lleva el "watermark" (marca de agua) textual estadístico de Anthropic en todas las plataformas donde el modelo está disponible. Los archivos de imagen, video y audio compatibles que produce Claude (por ejemplo, a través de la herramienta de ejecución de código) llevan Content Credentials de C2PA firmadas cuando los recuperas mediante la Files API en la Claude API.
La marca de agua no cambia el significado, la calidad ni la legibilidad de la salida. No agrega tokens ni caracteres ocultos, no contiene información sobre ti ni tu organización y no requiere cambios en tus solicitudes o respuestas. Para más contexto, consulta Cómo Claude marca el contenido generado por IA y Cómo funciona la marca de agua de texto de Claude.
Diferencias de comportamiento
Cambios respecto a Claude Fable 5
Claude Fable 5.1 difiere de Claude Fable 5 en varios aspectos que aparecen sin ningún cambio de código. Cada uno tiene una solución mediante prompts en Prompting para Claude Fable 5.1:
- Las llamadas a herramientas en paralelo son más variables. Claude Fable 5.1 puede emitir una llamada a herramienta por turno donde Claude Fable 5 agrupaba varias. Esto aparece en bucles de agente largos donde las siguientes lecturas independientes solo están implícitas: agentes de codificación personalizados, entornos de bash y editor, uso de computadora. Los turnos adicionales cuestan tokens, viajes de ida y vuelta y tiempo real, pero no reducen la calidad de las respuestas. Las solicitudes que nombran varias cosas que obtener siguen ejecutándose en paralelo. Agrega la instrucción de agrupación de una línea de Agrupa llamadas a herramientas independientes en bucles de agente.
- Menos actualizaciones de progreso durante ejecuciones largas de herramientas. El modelo escribe menos texto orientado al usuario entre llamadas a herramientas, especialmente con mayor esfuerzo. Establece
thinking.displayen"updates"(beta) para recibir las actualizaciones de progreso que sí escribe, y elimina cualquier línea del prompt que le indique reservar los hallazgos para la respuesta final. Si tu interfaz depende de la narración, pide explícitamente una línea de apertura, actualizaciones periódicas y un resumen de cierre. Consulta Pide actualizaciones de progreso orientadas al usuario. - Responde de memoria con más frecuencia con esfuerzo
low. En el nivel de esfuerzo más bajo, el modelo llama a una herramienta de búsqueda o recuperación con menos frecuencia. Aumenta el esfuerzo para los turnos que necesitan información actualizada, incluso a mitad de conversación, o agrega el recordatorio de verificación de Activación de búsqueda con esfuerzo bajo. - Prosa más densa en algunos lugares. En algunos casos su prosa es más densa que la de Claude Fable 5, con oraciones más largas y menos saltos de párrafo. Consulta Densidad de escritura.
- Menos formato en el chat. El modelo usa negritas, encabezados y listas menos que los modelos Claude anteriores, por lo que las reglas contra el formato escritas para esos modelos pueden suprimir la estructura que el contenido necesita. Consulta Formato en el chat.
- Citas sin marcar en los resúmenes. Al resumir documentos, es más probable que el modelo reproduzca pasajes de la fuente sin marcarlos como citas. Consulta Citar fuentes recuperadas.
- Reescrituras de archivos completos para cambios pequeños. Al editar archivos de texto, es más probable que el modelo reescriba el archivo completo en lugar de hacer una edición específica. El resultado suele ser el mismo, pero la reescritura cuesta más tokens de salida y tiempo. Consulta Prefiere ediciones específicas en lugar de reescrituras de archivos completos.
Sin cambios respecto a Claude Fable 5
Estos comportamientos de la Messages API se mantienen sin cambios desde Claude Fable 5:
- El pensamiento adaptativo está siempre activado.
thinking: {"type": "enabled"}conbudget_tokensythinking: {"type": "disabled"}devuelven ambos un error 400. Omitethinkingo envía{"type": "adaptive"}. thinking.displaytiene como valor predeterminado"omitted"."summarized"está disponible, y la cadena de pensamiento sin procesar nunca se devuelve.- El razonamiento entre llamadas a herramientas aparece en bloques de pensamiento en lugar de texto, y el pensamiento intercalado es automático sin encabezado beta.
- Prellenar la respuesta del asistente devuelve un error 400.
- Los valores no predeterminados de
temperature,top_potop_kdevuelven un error 400. - La longitud mínima de prompt almacenable en caché es de 512 tokens.
- Se admiten los mensajes del sistema a mitad de conversación y los cambios de herramientas.
Mejoras de capacidades
Claude Fable 5.1 mejora respecto a Claude Fable 5, y la diferencia es mayor en los niveles de esfuerzo más altos. Las mejoras se concentran en seis áreas:
- Codificación agéntica en sesiones largas, incluidas funciones de varios archivos, grandes refactorizaciones y migraciones, depuración y revisión de código en sesiones que duran horas.
- Trabajo de conocimiento con documentos, hojas de cálculo y diapositivas, llevando un análisis desde una primera pregunta hasta un documento terminado, una hoja de cálculo con fórmulas activas o una presentación de diapositivas creada desde una página en blanco.
- Investigación y búsqueda, con mayor precisión en investigación web de varios pasos y tareas de investigación profunda que dan seguimiento a lo que encuentran.
- Visión, leyendo gráficos densos, documentos regulatorios y tablas anidadas en PDF, incluso con herramientas de recorte y zoom en gráficos.
- Trabajo de contexto largo, razonando y conectando detalles a lo largo de toda la ventana de contexto de 1M de tokens.
- Uso de computadora, operando un navegador y aplicaciones de escritorio de forma más confiable y recuperándose de pasos fallidos.
El rendimiento multilingüe está a la par con Claude Fable 5.
Rechazos, respaldo y facturación
Claude Fable 5.1 incluye clasificadores de seguridad que cubren las mismas categorías de stop_details que Claude Fable 5, y todo lo indicado en Rechazos y respaldo aplica. Puede devolver stop_reason: "refusal", así que maneja los rechazos y configura el respaldo.
- Rechazos: una solicitud rechazada devuelve HTTP 200 con
stop_reason: "refusal"y un objetostop_detailsque nombra el área de política que se activó. - Respaldo: reintenta una solicitud rechazada en otro modelo con el respaldo del lado del servidor, el middleware del SDK o tu propio reintento.
fallbacks: "default"(beta) reintenta una solicitud rechazada en el modelo que Anthropic recomienda para esa categoría. Los destinos de respaldo permitidos para Claude Fable 5.1 son Claude Opus 4.8 y Claude Opus 5. - Facturación: no se te factura por un rechazo que llega antes de cualquier salida y, para Claude Fable 5.1, el crédito de respaldo reembolsa el costo de caché de prompts de cambiar de modelo.
Precios
Claude Fable 5.1 y Claude Mythos 5.1 tienen el mismo precio que Claude Fable 5, excepto por las lecturas de caché (precios en USD):
| Entrada base | Escrituras en caché de 5m | Escrituras en caché de 1h | Lecturas de caché | Salida |
|---|---|---|---|---|
| $10 / MTok | $12.50 / MTok | $20 / MTok | $0.25 / MTok | $50 / MTok |
Las lecturas de caché (aciertos y actualizaciones) cuestan 0.025 veces el precio de entrada base en estos modelos, en comparación con 0.1 en otros modelos Claude. Las sesiones agénticas largas que vuelven a leer un prefijo en caché pagan una cuarta parte de la tarifa de Claude Fable 5. Las escrituras en caché y la longitud mínima de prompt almacenable en caché de 512 tokens no cambian.
El procesamiento por lotes cuesta $5 USD por millón de tokens de entrada y $25 USD por millón de tokens de salida. Consulta Precios para ver los precios de residencia de datos y de herramientas.
Disponibilidad
Claude Fable 5.1 está disponible en:
- Claude API: todos los clientes, como
claude-fable-5-1. - AWS: Claude en Amazon Bedrock, como
anthropic.claude-fable-5-1, y Claude Platform en AWS, comoclaude-fable-5-1. - Google Cloud: Claude en Google Cloud, como
claude-fable-5-1. - Microsoft Foundry: Claude en Microsoft Foundry, en infraestructura de Anthropic.
Claude Mythos 5.1 se ofrece únicamente a clientes aprobados en Project Glasswing. Para obtener acceso, contacta a tu equipo de cuenta de Anthropic, AWS o Google Cloud.
Claude Fable 5.1 y Claude Mythos 5.1 tienen una retención de datos de 30 días y no están disponibles con retención de datos cero a menos que Anthropic lo autorice expresamente. Ambos son Modelos Cubiertos, al igual que Claude Fable 5 y Claude Mythos 5. Consulta Requisitos de retención de datos específicos del modelo.
Migrar desde Claude Fable 5
Para migrar desde Claude Fable 5, actualiza tu ID de modelo:
model = "claude-fable-5" # Before
model = "claude-fable-5-1" # AfterLuego revisa estos puntos:
- Elimina cualquier
tool_choicede tipoanyotool. Traslada la validación del esquema al uso estricto de herramientas contool_choice: {"type": "auto"}o a salidas estructuradas. - Devuelve los bloques de pensamiento sin cambios y mantén el historial como de solo anexado. Si tu código construye el arreglo
messagespor su cuenta, ejecuta la verificación de edición del historial: traslada a mensajes del sistema con alcance de turno los recordatorios por turno que ahora inyectas y eliminas, traslada los cambios desystemytoolsa mensajes del sistema a mitad de la conversación, recorta el contexto del lado del servidor o quita los bloques de pensamiento de los turnos que conservas a través de un resumen del lado del cliente. Después, elige un valor deprefix_mismatch_behaviorpara producción y supervisainput_transformations. - Vuelve a ajustar el esfuerzo a partir del valor predeterminado (
high) y considera cambiarlo a mitad de la conversación en lugar de mantener un solo nivel durante toda la sesión. - En los bucles de agente, fíjate si aparece una sola llamada a herramienta por turno donde Claude Fable 5 agrupaba varias, y agrega la nota por turno de Prompting para Claude Fable 5.1.
- Vuelve a ejecutar tus evaluaciones. El manejo de rechazos, el respaldo, el crédito de respaldo y el tokenizador no cambian. Las lecturas de caché cuestan menos (consulta Precios), y el comportamiento predeterminado difiere en los aspectos enumerados en Cambios respecto a Claude Fable 5.
Consulta la guía de migración para obtener instrucciones paso a paso, incluso desde Claude Opus 5 y modelos anteriores.
Próximos pasos
Especificaciones y precios de todos los modelos Claude actuales.
Migración desde Claude Fable 5, Claude Opus 5 y modelos anteriores.
Patrones de prompting específicos de Claude Fable 5.1.
Was this page helpful?