Migrez vers Claude Mythos 5 et Claude Fable 5 depuis Claude Mythos Preview, Claude Opus 5 ou Claude Opus 4.8 : identifiants de modèle, modifications de l'API et listes de contrôle de migration.
Claude Fable 5 est le modèle largement diffusé le plus performant d'Anthropic, disponible sur la Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud et Microsoft Foundry. Claude Mythos 5 partage les mêmes capacités et n'est proposé qu'aux clients approuvés dans le cadre de Project Glasswing.
Les paramètres de base partagés par claude-fable-5 et claude-mythos-5 :
thinking n'est requise. thinking: {type: "disabled"} et la réflexion étendue manuelle (thinking: {type: "enabled", budget_tokens: N}) renvoient tous deux une erreur 400.invalid_request_error. Les organisations disposant d'un accord ZDR doivent contacter leur équipe de compte Anthropic pour discuter de la configuration de conservation des données. Vous pouvez également configurer la conservation des données par espace de travail. Consultez les exigences de conservation des données propres à chaque modèle pour les détails par plateforme.
Là où les deux modèles divergent :
stop_reason: "refusal". Claude Mythos 5 n'inclut pas ces classificateurs. Consultez Refus et repli.Claude Mythos 5 est le successeur à accès restreint de Claude Mythos Preview, l'aperçu de recherche accessible uniquement sur invitation. Claude Fable 5 offre les mêmes capacités et ne nécessite pas d'approbation d'accès. Les modifications décrites dans cette section s'appliquent de la même manière aux deux cibles.
La migration est en grande partie directe. Claude Mythos 5 et Claude Fable 5 utilisent la même API Messages et les mêmes modèles de « tool use » (utilisation d'outils) que Claude Mythos Preview, et les décomptes de tokens sont à peu près inchangés car les trois modèles utilisent le même tokenizer. Les principaux changements à vérifier sont les fonctionnalités qui ne sont plus disponibles (énumérées dans la section suivante) et la sortie de réflexion. Si vous migrez vers Claude Fable 5, prévoyez également les refus des classificateurs de sécurité, que Claude Mythos Preview et Claude Mythos 5 n'ont pas ; consultez Refus et repli.
Pour le calendrier de retrait de Claude Mythos Preview, consultez Dépréciations de modèles.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Ou, pour le modèle aux mêmes capacités sans exigence d'approbation d'accès :
model = "claude-fable-5" # AfterRéflexion étendue et budgets de tokens de réflexion : La réflexion étendue manuelle (thinking: {type: "enabled", budget_tokens: N}) n'est pas prise en charge sur claude-mythos-5 ni sur claude-fable-5 et renvoie une erreur 400. La réflexion adaptative est toujours activée : le modèle détermine quand et dans quelle mesure réfléchir pour chaque requête, et aucune configuration thinking n'est requise. thinking: {type: "disabled"} renvoie une erreur. budget_tokens n'a pas de remplacement direct : la réflexion est adaptative, et le paramètre effort est un contrôle distinct au niveau de la sortie, et non un budget de réflexion.
Avant (Claude Mythos Preview) :
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)Après (Claude Mythos 5) :
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)La modification pour Claude Fable 5 est identique, avec claude-fable-5 comme nom de modèle.
Préremplissage de l'assistant : Le préremplissage du message de l'assistant n'est pas pris en charge sur claude-mythos-5 ni sur claude-fable-5 et renvoie une erreur 400, comme sur Claude Mythos Preview. Utilisez plutôt des instructions dans l'invite système.
Sortie de réflexion : Sur claude-mythos-5 et claude-fable-5, la chaîne de pensée brute n'est jamais renvoyée, mais les blocs de réflexion contiennent toujours un texte résumé lisible lorsque thinking.display est défini sur summarized. Renvoyez les blocs de réflexion inchangés lorsque vous poursuivez une conversation sur le même modèle. Consultez Sortie de réflexion sur Claude Fable 5 et Claude Mythos 5.
claude-mythos-5 et claude-fable-5 utilisent le même tokenizer que claude-mythos-preview (le tokenizer introduit avec Claude Opus 4.7). Les décomptes de tokens sont à peu près inchangés lors de la migration depuis claude-mythos-preview. Par rapport aux modèles antérieurs à Claude Opus 4.7, le même contenu peut être tokenisé en environ 30 % de tokens supplémentaires, selon le contenu et la forme de la charge de travail.
/v1/messages/count_tokens renvoie des valeurs à peu près inchangées pour claude-mythos-5 et claude-fable-5 par rapport à claude-mythos-preview. Réétablissez vos références de coût et de latence sur vos propres charges de travail.
claude-mythos-preview vers claude-mythos-5, ou vers claude-fable-5, qui offre les mêmes capacités et ne nécessite pas d'approbation d'accès.thinking: {type: "enabled", budget_tokens: N}). La réflexion adaptative est toujours activée, et aucun champ thinking n'est requis.thinking: {type: "disabled"}. La désactivation de la réflexion renvoie une erreur sur claude-mythos-5 et claude-fable-5.budget_tokens. Il n'a pas de remplacement direct : la réflexion est adaptative, et le paramètre effort est un contrôle distinct au niveau de la sortie, et non un budget de réflexion.thinking le traite uniquement comme du texte d'affichage et renvoie les blocs de réflexion inchangés lors de la poursuite sur le même modèle. thinking.display a pour valeur par défaut "omitted" sur claude-mythos-5 et claude-fable-5, comme sur Claude Mythos Preview ; définissez display: "summarized" pour recevoir des résumés lisibles. Consultez Sortie de réflexion sur Claude Fable 5 et Claude Mythos 5.
thinking et redacted_thinking des tours précédents de l'assistant. Les blocs de réflexion de claude-mythos-5 et claude-fable-5 sont liés au modèle qui les a produits, et les modèles autres que Claude Fable 5 et Claude Mythos 5 les ignorent silencieusement. Leur suppression permet de garder les requêtes inter-modèles minimales et uniformes.
stop_reason: "refusal" et lisez le champ stop_details.category. Claude Fable 5 exécute des classificateurs de sécurité que Claude Mythos Preview et Claude Mythos 5 n'ont pas. Consultez Refus et repli.claude-mythos-preview.Claude Fable 5 et Claude Mythos 5 utilisent la même API Messages et les mêmes modèles d'utilisation d'outils que Claude Opus 5, avec la même fenêtre de contexte de 1 million de tokens par défaut et le même maximum de 128 000 tokens de sortie. Les restrictions relatives au préremplissage et aux paramètres d'échantillonnage, ainsi que le comportement d'affichage de la réflexion, sont repris de Claude Opus 5 sans changement. Les changements à vérifier sont la réflexion toujours activée, la tarification, le Priority Tier et la conservation des données.
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Ou, pour le modèle Project Glasswing avec les mêmes capacités :
model = "claude-mythos-5" # AfterLa réflexion ne peut plus être désactivée : Sur Claude Opus 5, la réflexion est activée par défaut et peut être désactivée avec thinking: {type: "disabled"} à un niveau d'effort de high ou inférieur. Sur claude-fable-5 et claude-mythos-5, la réflexion adaptative est toujours activée, et thinking: {type: "disabled"} renvoie une erreur 400 à n'importe quel niveau d'effort. Supprimez la configuration thinking: {type: "disabled"} et utilisez plutôt des niveaux d'effort inférieurs pour contrôler la dépense en tokens.
Si vos requêtes Claude Opus 5 désactivaient la réflexion, la forme de la réponse change : une réponse peut commencer par un ou plusieurs blocs thinking avant le premier bloc text, renvoyés avec un champ thinking vide avec la valeur par défaut display: "omitted" (la même valeur par défaut que Claude Opus 5). Le code qui lit la réponse par position, comme content[0].text ou un gestionnaire de flux qui traite le premier bloc de contenu comme du texte, doit plutôt sélectionner les blocs de contenu par leur champ type, et les boucles d'utilisation d'outils doivent renvoyer les blocs thinking complets et non modifiés avec leurs résultats d'outils. L'API rejette les blocs de réflexion modifiés, réordonnés ou partiellement supprimés avec une erreur 400 (consultez Préserver les blocs de réflexion). Les tokens de réflexion sont facturés comme des tokens de sortie même lorsque le texte de réflexion n'est pas renvoyé.
Tarification : Claude Fable 5 et Claude Mythos 5 sont facturés 10 $ USD par million de tokens d'entrée et 50 $ USD par million de tokens de sortie, contre 5 $ USD et 25 $ USD pour Claude Opus 5. Consultez la tarification de Claude.
Priority Tier : Le Priority Tier n'est pas pris en charge sur Claude Opus 5, donc aucun trafic existant n'est affecté. Si votre organisation dispose d'un engagement Priority Tier, Claude Fable 5 le prend en charge ; Claude Mythos 5 ne le prend pas en charge.
Conservation des données : Claude Fable 5 et Claude Mythos 5 exigent une conservation des données de 30 jours et ne sont pas disponibles dans le cadre d'accords de conservation zéro des données (ZDR) ; les deux sont désignés comme Covered Models. Consultez les exigences de conservation des données propres à chaque modèle.
claude-opus-5 vers claude-fable-5 (ou claude-mythos-5).thinking: {type: "disabled"} ; elle renvoie une erreur 400 sur claude-fable-5 et claude-mythos-5. Utilisez plutôt des niveaux d'effort inférieurs pour contrôler la dépense en tokens, et réexaminez max_tokens pour les charges de travail qui s'exécutaient avec la réflexion désactivée sur Claude Opus 5.content[0].text, mettez-les à jour pour sélectionner les blocs de contenu par type : les blocs thinking arrivent désormais avant les blocs text. Renvoyez les blocs thinking complets et non modifiés dans les boucles d'utilisation d'outils ; les blocs modifiés renvoient une erreur 400.La migration est en grande partie directe. Claude Fable 5 et Claude Mythos 5 utilisent la même API Messages et les mêmes modèles d'utilisation d'outils que Claude Opus 4.8, avec la même fenêtre de contexte de 1 million de tokens par défaut et le même maximum de 128 000 tokens de sortie. Les décomptes de tokens sont à peu près inchangés car les modèles utilisent le même tokenizer. Les principaux changements à vérifier sont la réflexion adaptative toujours activée, la sortie de réflexion, les refus des classificateurs de sécurité (Claude Fable 5 uniquement) et la tarification.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Ou, pour le modèle Project Glasswing avec les mêmes capacités :
model = "claude-mythos-5" # AfterLes éléments de cette section décrivent les différences d'API et de comportement qu'il convient de vérifier après avoir remplacé l'identifiant du modèle. Sauf indication contraire, ils s'appliquent de la même manière à claude-fable-5 et claude-mythos-5.
La réflexion adaptative est toujours activée : La réflexion adaptative est le seul mode de réflexion sur claude-fable-5 et claude-mythos-5. Le modèle détermine quand et dans quelle mesure réfléchir pour chaque requête, et aucune configuration thinking n'est requise. thinking: {type: "disabled"} renvoie une erreur. Utilisez le paramètre effort pour contrôler la profondeur de réflexion.
Le changement de comportement à vérifier : sur Claude Opus 4.8, les requêtes sans champ thinking s'exécutent sans réflexion ; sur claude-fable-5 et claude-mythos-5, ces mêmes requêtes s'exécutent avec la réflexion adaptative. max_tokens reste une limite stricte sur la sortie totale, réflexion plus texte de réponse, donc réexaminez-le pour les charges de travail qui s'exécutaient sans réflexion sur Claude Opus 4.8. Consultez Contrôle des coûts. Les réponses peuvent également commencer par un ou plusieurs blocs thinking avant le premier bloc text, de sorte que le code qui lit la réponse par position (par exemple, content[0].text, ou un gestionnaire de flux qui traite le premier bloc de contenu comme du texte) doit plutôt sélectionner les blocs de contenu par leur champ type. Les tokens de réflexion sont facturés comme des tokens de sortie même lorsque le texte de réflexion ne vous est pas renvoyé, de sorte qu'une charge de travail qui s'exécutait sans réflexion sur Claude Opus 4.8 produit davantage de tokens de sortie par requête, en plus de la différence de prix par token.
Si vous exécutez une boucle d'utilisation d'outils, renvoyez à l'API les blocs thinking de chaque réponse de l'assistant complets et non modifiés lorsque vous retournez les résultats d'outils, y compris les blocs dont le champ thinking est vide. Renvoyez le message de l'assistant tel que reçu plutôt que de filtrer ses blocs de contenu par type ou de le reconstruire : l'API rejette les blocs de réflexion modifiés, réordonnés ou partiellement supprimés avec une erreur 400. Consultez Préserver les blocs de réflexion.
Avant (Claude Opus 4.8) :
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Après (Claude Fable 5) :
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)La modification pour Claude Mythos 5 est identique, avec claude-mythos-5 comme nom de modèle.
Réflexion étendue et budgets de réflexion (inchangé) : La réflexion étendue manuelle (thinking: {type: "enabled", budget_tokens: N}) n'est pas prise en charge sur claude-fable-5 ni sur claude-mythos-5 et renvoie une erreur 400, comme sur Claude Opus 4.8. budget_tokens n'a pas de remplacement direct : la réflexion est adaptative, et le paramètre effort est un contrôle distinct au niveau de la sortie, et non un budget de réflexion.
Préremplissage de l'assistant (inchangé) : Le préremplissage du message de l'assistant n'est pas pris en charge sur claude-fable-5 ni sur claude-mythos-5 et renvoie une erreur 400, comme sur Claude Opus 4.8. Utilisez plutôt des instructions dans l'invite système.
Sortie de réflexion : Sur claude-fable-5 et claude-mythos-5, la chaîne de pensée brute n'est jamais renvoyée, mais les blocs de réflexion contiennent toujours un texte résumé lisible lorsque thinking.display est défini sur summarized. Renvoyez les blocs de réflexion inchangés lorsque vous poursuivez une conversation sur le même modèle. Consultez Sortie de réflexion sur Claude Fable 5 et Claude Mythos 5.
Classificateurs de sécurité et motif d'arrêt refusal (Claude Fable 5 uniquement) : claude-fable-5 exécute des classificateurs de sécurité sur les requêtes et pendant la génération des réponses. Claude Mythos 5 n'inclut pas ces classificateurs. Lorsqu'un classificateur refuse une requête, l'API Messages renvoie stop_reason: "refusal" sous forme de réponse HTTP 200 réussie, et non d'erreur. Le champ stop_details.category indique quel classificateur s'est déclenché, avec des catégories telles que "cyber", "bio" et "reasoning_extraction", ou null lorsque le refus ne correspond à aucune catégorie nommée. Consultez le tableau des catégories de refus pour l'ensemble complet.
Les tokens d'entrée d'une requête refusée avant toute génération de sortie ne vous sont pas facturés. Lorsqu'un classificateur se déclenche en cours de flux, l'entrée et la sortie déjà diffusée en streaming sont facturées ; ignorez la sortie partielle.
Pour réexécuter automatiquement les requêtes refusées sur un autre modèle, transmettez le paramètre optionnel fallbacks, qui est en bêta sur la Claude API. Ce paramètre n'est pas disponible sur l'API Message Batches ni sur Amazon Bedrock, Google Cloud et Microsoft Foundry ; sur ces trois plateformes, effectuez la nouvelle tentative côté client ou utilisez le middleware de repli sur refus du SDK. Consultez Refus et repli.
Commencez au niveau d'effort high : La valeur par défaut du paramètre effort reste high. Sur Claude Opus 4.8, la recommandation pour le codage et le travail à forte autonomie est de définir explicitement xhigh. Sur claude-fable-5 et claude-mythos-5, utilisez high par défaut pour la plupart des tâches et réservez xhigh aux charges de travail les plus sensibles aux capacités. Les réglages d'effort inférieurs restent performants et dépassent souvent les performances de xhigh sur les modèles précédents. Réduisez l'effort si une tâche aboutit mais prend plus de temps que nécessaire. Consultez Prompting de Claude Fable 5.
Minimum de mise en cache des prompts réduit : La longueur minimale de prompt pouvant être mise en cache sur claude-fable-5 et claude-mythos-5 est de 512 tokens, inférieure aux 1 024 tokens sur Claude Opus 4.8. Les prompts qui étaient trop courts pour être mis en cache sur Claude Opus 4.8 peuvent désormais créer des entrées de cache, sans aucune modification de code requise. Consultez « Prompt caching » (mise en cache des prompts) pour les minimums par modèle.
claude-fable-5 et claude-mythos-5 exigent une conservation des données de 30 jours ; sur la Claude API, les requêtes vers claude-fable-5 qui ne satisfont pas à cette exigence renvoient une erreur 400 invalid_request_error. Claude Opus 4.8 reste disponible sous ZDR. Consultez les exigences de conservation des données propres à chaque modèle.
claude-opus-4-8 vers claude-fable-5 (ou claude-mythos-5).thinking: {type: "disabled"}. La désactivation de la réflexion renvoie une erreur sur claude-fable-5 et claude-mythos-5, et les requêtes sans champ thinking s'exécutent avec la réflexion adaptative.content[0].text : avec la réflexion adaptative toujours activée, les blocs thinking arrivent avant les blocs text. Sélectionnez plutôt les blocs de contenu par type, et renvoyez les blocs thinking complets et non modifiés dans les boucles d'utilisation d'outils ; les blocs modifiés renvoient une erreur 400. Consultez Préserver les blocs de réflexion.claude-fable-5 et claude-mythos-5.thinking le traite uniquement comme du texte d'affichage et renvoie les blocs de réflexion inchangés lors de la poursuite sur le même modèle. thinking.display a pour valeur par défaut "omitted" sur claude-fable-5 et claude-mythos-5, comme sur Claude Opus 4.8 ; définissez display: "summarized" pour recevoir des résumés lisibles. Consultez Sortie de réflexion sur Claude Fable 5 et Claude Mythos 5.
thinking et redacted_thinking des tours précédents de l'assistant. Les blocs de réflexion de claude-fable-5 et claude-mythos-5 sont liés au modèle qui les a produits, et les modèles autres que Claude Fable 5 et Claude Mythos 5 les ignorent silencieusement. Leur suppression permet de garder les requêtes inter-modèles minimales et uniformes. L'exception est l'utilisation d'un crédit de repli, qui exige que le corps de la requête soit renvoyé selon les règles exactes de cette fonctionnalité.
stop_reason: "refusal" et lisez le champ stop_details.category. Pour réexécuter automatiquement les requêtes refusées sur un autre modèle, envisagez le paramètre optionnel fallbacks (bêta). Consultez Refus et repli.effort. Commencez à high pour la plupart des tâches, y compris les charges de travail qui s'exécutaient à xhigh sur Claude Opus 4.8.claude-opus-4-8 ; la tarification par token diffère, et les tokens de réflexion sont facturés comme des tokens de sortie, de sorte que les charges de travail qui s'exécutaient sans réflexion produisent davantage de tokens de sortie par requête.Was this page helpful?