Claude Platform Docs
Modèles et tarifsClaude Fable 5.1

Nouveautés de Claude Fable 5.1

Aperçu des nouvelles fonctionnalités, des changements incompatibles et des améliorations de capacités de Claude Fable 5.1 et Claude Mythos 5.1.

Claude Fable 5.1 prolonge Claude Fable 5 aux mêmes prix d'entrée et de sortie, avec des lectures en cache quatre fois moins chères. Il apporte un codage agentique de longue durée plus solide, une meilleure recherche en plusieurs étapes et un travail plus performant sur les documents, les feuilles de calcul et les diapositives. Pour la plupart des charges de travail, commencez par Claude Opus 5 (consultez Choisir un modèle). Utilisez Claude Fable 5.1 pour le raisonnement exigeant et le travail agentique à long horizon, ou lorsque vos évaluations sur Claude Opus 5 avec un effort plus élevé restent insuffisantes. Claude Mythos 5.1 offre les mêmes capacités, uniquement aux participants de Project Glasswing.

Si vous appelez déjà Claude Fable 5, trois changements sont des « breaking changes » (changements incompatibles) :

Cinq changements sont des ajouts :

Modèles

ModèleID de l'API ClaudeDescriptionDisponibilité
Claude Fable 5.1Successeur de Claude Fable 5, pour le codage agentique de longue durée, le travail intellectuel et la rechercheTous les clients, sur l'API Claude et les plateformes partenaires
Claude Mythos 5.1Mêmes capacités que Claude Fable 5.1. Successeur de Claude Mythos 5.Participants de Project Glasswing uniquement

Claude Fable 5.1 et Claude Mythos 5.1 partagent les mêmes spécifications et la même tarification :

Pour tous les modèles actuels, consultez la vue d'ensemble des modèles.

Changements incompatibles

L'utilisation forcée d'outils n'est pas prise en charge

Claude Fable 5.1 et Claude Mythos 5.1 ne prennent pas en charge la « forced tool use » (utilisation forcée d'outils). Un tool_choice défini sur {"type": "any"} ou {"type": "tool", "name": "..."} renvoie une erreur 400 invalid_request_error :

tool_choice: type "tool" and "any" are not supported for this model.

tool_choice: {"type": "auto"} (la valeur par défaut) et {"type": "none"} restent inchangés. La même validation s'applique au point de terminaison de comptage des tokens.

La réflexion est toujours activée pour ces modèles, et un appel d'outil forcé la contournerait. Le modèle écrirait alors son raisonnement dans les arguments de l'outil, ce qui dégrade la qualité des arguments.

  • Pour obtenir un JSON conforme au schéma : conservez tool_choice: {"type": "auto"} et définissez strict: true avec l'utilisation stricte d'outils, ou déplacez le schéma vers les sorties structurées.
  • Pour que le modèle appelle un outil plutôt que de répondre en texte : indiquez dans le prompt quand l'outil s'applique (par exemple, « Utilisez l'outil get_weather pour répondre »). Claude Fable 5.1 suit de manière fiable les instructions explicites concernant les outils.

Les modèles antérieurs ne peuvent pas lire les blocs de réflexion de Claude Fable 5.1

Chaque « thinking block » (bloc de réflexion) enregistre le modèle qui l'a produit, et il n'est conservé que dans un seul sens. Claude Fable 5.1 lit les blocs de réflexion des modèles antérieurs, mais aucun modèle antérieur ne lit ceux de Claude Fable 5.1.

  • Vers Claude Fable 5.1 : une conversation qui passe à Claude Fable 5.1 (depuis Claude Opus 5, Claude Fable 5 ou tout modèle Claude antérieur) conserve son raisonnement.
  • Depuis Claude Fable 5.1 : une conversation qui passe de Claude Fable 5.1 à l'un de ces modèles perd ce raisonnement pour les tours exécutés sur ce modèle.

Une requête peut contenir un bloc que le modèle cible ne peut pas lire, par exemple lorsqu'un routeur ou un mécanisme de repli change de modèle en cours de conversation. Dans ce cas, l'API supprime le bloc avant que le modèle ne le voie. Les blocs supprimés ne sont pas comptabilisés dans input_tokens et ne sont pas facturés. Avec l'en-tête bêta thinking-binding-controls-2026-08-01, la suppression est signalée dans un tableau input_transformations de premier niveau. Sans cet en-tête, la suppression est silencieuse. Consultez Changer de modèle en cours de conversation.

La modification des tours précédents invalide les blocs de réflexion

Toute modification de ce qui précède un bloc de réflexion de Claude Fable 5.1 (l'invite système system, les tools ou un message antérieur) provoque une erreur lors de la requête suivante. Si vous l'activez, le bloc est supprimé à la place. Claude Mythos 5.1 n'effectue pas cette vérification.

Claude Code, claude.ai, Claude Managed Agents et le Claude Agent SDK préservent ce préfixe pour vous. Si votre code construit lui-même le tableau messages, vérifiez-le avant de migrer : Réflexion préservée détaille la vérification et chaque correctif.

La vérification est appliquée aux nouveaux comptes créés à partir du 31 août 2026. Pour les comptes créés avant cette date, l'API enregistre la non-concordance, mais n'agit que si la requête définit thinking.block_binding.prefix_mismatch_behavior.

Ces pratiques invalident tous les blocs de réflexion ultérieurs :

  • Modifier, réordonner ou supprimer un tour antérieur tout en conservant les suivants.
  • Injecter dans un tour antérieur un texte propre à la requête (un rappel ou une ligne d'état) que vous supprimez à la requête suivante.
  • Reconstruire l'invite système system de premier niveau ou le tableau tools entre deux requêtes d'une même conversation.
  • Utiliser une URL d'image ou de document qui renvoie des octets différents lors d'une requête ultérieure. La vérification porte sur les octets et non sur l'URL : une URL signée renouvelée pour le même fichier ne pose donc pas de problème.

Ces pratiques préservent la validité des blocs ultérieurs :

  • Supprimer une série initiale de blocs de réflexion, en commençant par les plus anciens.
  • Laisser la compaction côté serveur ou l'édition de contexte réduire l'historique.
  • Déplacer les marqueurs cache_control.
  • Modifier effort entre les requêtes.

En revanche, supprimer un bloc de réflexion ailleurs qu'au début de la série invalide tous les blocs de réflexion qui le suivent.

Lorsque la vérification est appliquée, une requête qui renvoie un bloc invalidé est rejetée avec une erreur 400 dont le message indique The block is bound to a different conversation. Pour supprimer le bloc et continuer, envoyez l'en-tête bêta thinking-binding-controls-2026-08-01 avec thinking.block_binding.prefix_mismatch_behavior: "drop_block". La suppression est alors signalée dans input_transformations avec reason: "prefix_binding_mismatch".

Pour que la réflexion reste valide tout au long d'une longue session, traitez la conversation comme un historique en ajout seul :

Ces pratiques maintiennent également le cache de prompts actif.

Pour savoir si votre intégration modifie l'historique, exécutez une session avec prefix_mismatch_behavior: "drop_block" et journalisez input_transformations. Le guide de migration présente la vérification en trois étapes. Consultez Conserver le préfixe inchangé pour l'ensemble des règles.

Nouvelles fonctionnalités

Modifier l'effort en cours de conversation (bêta)

Sur Claude Fable 5.1, vous pouvez modifier le niveau d'effort en cours de conversation sans invalider le cache de prompts. Augmentez-le pour une étape difficile et réduisez-le pour les étapes courantes.

L'effort par message est en bêta : incluez l'en-tête bêta mid-conversation-output-config-2026-07-01. Claude Fable 5.1, Claude Mythos 5.1 et Claude Opus 5 le prennent en charge sur l'API Claude et Google Cloud.

client = anthropic.Anthropic()

response = client.beta.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    output_config={"effort": "high"},
    messages=[
        {
            "role": "user",
            "content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
        },
        {
            "role": "assistant",
            "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
        },
        # Message système ne modifiant que l'effort : le nouveau niveau s'applique dès le prochain tour de l'utilisateur.
        {"role": "system", "content": [], "output_config": {"effort": "low"}},
        {"role": "user", "content": "Summarize the plan in one sentence."},
    ],
    betas=["mid-conversation-output-config-2026-07-01"],
)

for block in response.content:
    if block.type == "text":
        print(block.text)

Consultez Effort par message pour plus de détails.

Messages système limités à un tour (bêta)

Un message système en cours de conversation peut être limité à un seul tour. Définissez clear_at: "next_user_message" sur un message role: "system". Son texte a alors l'autorité d'une invite système pour le tour en cours, puis cesse d'être rendu dès qu'un message user ultérieur existe.

Le message reste dans messages et vous continuez à le renvoyer tel quel, de sorte que rien ne change dans la partie antérieure de la conversation. Cela présente plusieurs avantages :

Utilisez-le pour les rappels propres à un tour dans une boucle d'outils (« vérifiez votre boîte de réception avant d'exécuter davantage de code », « l'utilisateur ne peut pas voir cette sortie d'outil »). Cela évite d'injecter du texte dans l'historique puis de le supprimer à la requête suivante.

Les messages système limités à un tour sont en bêta : incluez l'en-tête bêta mid-conversation-system-clear-at-2026-08-21. Consultez Messages système limités à un tour.

{
  "role": "system",
  "clear_at": "next_user_message",
  "content": "Results have landed in your inbox. Check it before running more code."
}

Mises à jour de progression entre les appels d'outils (bêta)

Comme Claude Fable 5, Claude Fable 5.1 rédige de courtes mises à jour de progression entre les appels d'outils, sur ce qu'il a trouvé et ce qu'il va faire ensuite. Il en rédige toutefois moins (consultez Changements par rapport à Claude Fable 5). Chaque mise à jour arrive dans son propre bloc thinking, juste avant l'appel d'outil.

Avec la valeur par défaut "omitted" de thinking.display, ces blocs sont renvoyés vides, comme le raisonnement. Un long tour agentique peut donc sembler silencieux pour vos utilisateurs.

La nouveauté est l'option display: "updates". Définissez-la avec l'en-tête bêta thinking-display-updates-2026-08-18 pour recevoir les mises à jour de progression sous forme de texte, tandis que le raisonnement reste masqué. Tout bloc thinking contenant du texte non vide est alors une ligne d'état que vous pouvez afficher à l'utilisateur. "summarized" renvoie également ces mises à jour, mêlées au raisonnement résumé. Consultez Mises à jour de progression entre les appels d'outils.

Provenance du contenu

Le texte généré par Claude Fable 5.1 et Claude Mythos 5.1 porte le « watermark » (filigrane) textuel statistique d'Anthropic sur toutes les plateformes où le modèle est disponible.

Les fichiers image, vidéo et audio pris en charge que Claude produit (par exemple via l'outil d'exécution de code) portent des Content Credentials C2PA signés. C'est le cas lorsque vous les récupérez via la Files API sur l'API Claude.

Le filigrane ne modifie ni le sens, ni la qualité, ni la lisibilité de la sortie. Il n'ajoute aucun token ni caractère caché et ne contient aucune information sur vous ou votre organisation. Il ne nécessite aucune modification de vos requêtes ou réponses. Pour en savoir plus, consultez How Claude marks AI-generated content et How Claude's text watermark works.

Différences de comportement

Changements par rapport à Claude Fable 5

Claude Fable 5.1 diffère de Claude Fable 5 sur plusieurs points qui apparaissent sans aucune modification de code. Chacun dispose d'un correctif de prompt dans Rédiger des prompts pour Claude Fable 5.1 :

  • Les appels d'outils parallèles sont plus variables. Claude Fable 5.1 peut émettre un seul appel d'outil par tour là où Claude Fable 5 en regroupait plusieurs.
    • Cela se produit dans les longues boucles d'agent où les lectures indépendantes suivantes ne sont qu'implicites : agents de codage personnalisés, environnements bash et éditeur, utilisation de l'ordinateur.
    • Les tours supplémentaires coûtent des tokens, des allers-retours et du temps réel, mais ne réduisent pas la qualité des réponses.
    • Les requêtes qui nomment plusieurs éléments à récupérer s'exécutent toujours en parallèle.
    • Ajoutez l'instruction de regroupement d'une ligne présentée dans Regrouper les appels d'outils indépendants dans les boucles d'agent.
  • Moins de mises à jour de progression pendant les longues exécutions d'outils. Le modèle rédige moins de texte destiné à l'utilisateur entre les appels d'outils, en particulier avec un effort plus élevé.
  • Réponses de mémoire plus fréquentes avec l'effort low. Au niveau d'effort le plus bas, le modèle appelle moins souvent un outil de recherche ou de récupération. Augmentez l'effort pour les tours qui nécessitent des informations récentes, y compris en cours de conversation. Vous pouvez aussi ajouter l'incitation à la vérification présentée dans Déclenchement de la recherche avec un effort faible.
  • Une prose plus dense par endroits. Dans certains cas, sa prose est plus dense que celle de Claude Fable 5, avec des phrases plus longues et moins de sauts de paragraphe. Consultez Densité de l'écriture.
  • Moins de mise en forme dans le chat. Le modèle utilise moins le gras, les titres et les listes que les modèles Claude antérieurs. Les règles anti-mise en forme rédigées pour ces modèles peuvent donc supprimer une structure dont le contenu a besoin. Consultez Mise en forme dans le chat.
  • Citations non signalées dans les résumés. Lorsqu'il résume des documents, le modèle est plus susceptible de reproduire des passages de la source sans les signaler comme des citations. Consultez Citer les sources récupérées.
  • Réécriture de fichiers entiers pour de petites modifications. Lorsqu'il modifie des fichiers texte, le modèle est plus susceptible de réécrire le fichier entier que d'effectuer une modification ciblée. Le résultat est généralement le même, mais la réécriture coûte davantage de tokens de sortie et de temps. Consultez Privilégier les modifications ciblées plutôt que la réécriture de fichiers entiers.

Inchangé par rapport à Claude Fable 5

Ces comportements de la Messages API sont repris de Claude Fable 5 sans modification :

  • La réflexion adaptative est toujours activée. thinking: {"type": "enabled"} avec budget_tokens et thinking: {"type": "disabled"} renvoient tous deux une erreur 400. Omettez thinking ou envoyez {"type": "adaptive"}.
  • thinking.display vaut "omitted" par défaut. "summarized" est disponible, et la chaîne de pensée brute n'est jamais renvoyée.
  • Le raisonnement entre les appels d'outils apparaît dans des blocs de réflexion plutôt que dans du texte. La réflexion entrelacée est automatique, sans en-tête bêta.
  • Le préremplissage de la réponse de l'assistant renvoie une erreur 400.
  • Les valeurs non par défaut de temperature, top_p ou top_k renvoient une erreur 400.
  • La longueur minimale d'un prompt pouvant être mis en cache est de 512 tokens.
  • Les messages système en cours de conversation et les modifications d'outils sont pris en charge.

Améliorations des capacités

Claude Fable 5.1 améliore Claude Fable 5, et l'écart est le plus marqué aux niveaux d'effort les plus élevés. Les gains se concentrent dans six domaines :

  • Codage agentique sur de longues sessions, notamment les fonctionnalités multi-fichiers, les refactorisations et migrations d'envergure, le débogage et la revue de code, sur des sessions qui durent des heures.
  • Travail intellectuel sur des documents, des feuilles de calcul et des diapositives, en menant une analyse d'une première question jusqu'à un document finalisé, une feuille de calcul avec des formules dynamiques ou une présentation construite à partir d'une page blanche.
  • Recherche, avec une précision accrue sur la recherche web en plusieurs étapes et sur les tâches de recherche approfondie qui approfondissent ce qu'elles trouvent.
  • Vision, avec la lecture de graphiques denses, de documents réglementaires et de tableaux imbriqués dans des PDF, y compris avec des outils de recadrage et de zoom sur les graphiques.
  • Travail sur contexte long, en raisonnant sur des détails et en les reliant à travers l'ensemble de la fenêtre de contexte de 1M de tokens.
  • Utilisation de l'ordinateur, en pilotant un navigateur et des applications de bureau de manière plus fiable et en se rétablissant après des étapes échouées.

Les performances multilingues sont équivalentes à celles de Claude Fable 5.

Refus, repli et facturation

Claude Fable 5.1 inclut des classificateurs de sécurité couvrant les mêmes catégories stop_details que Claude Fable 5, et tout le contenu de Refus et repli s'applique. Il peut renvoyer stop_reason: "refusal" : gérez donc les refus et configurez le « fallback » (repli).

  • Refus : une requête refusée renvoie HTTP 200 avec stop_reason: "refusal" et un objet stop_details qui nomme le domaine de politique déclenché.

  • Repli : relancez une requête refusée sur un autre modèle de l'une des manières suivantes :

    fallbacks: "default" (bêta) relance une requête refusée sur le modèle recommandé par Anthropic pour cette catégorie. Les cibles de repli autorisées pour Claude Fable 5.1 sont Claude Opus 4.8 et Claude Opus 5.

  • Facturation : un refus qui survient avant toute sortie ne vous est pas facturé. Pour Claude Fable 5.1, le crédit de repli rembourse le coût du cache de prompts lié au changement de modèle.

Tarification

Claude Fable 5.1 et Claude Mythos 5.1 ont la même tarification que Claude Fable 5, à l'exception des lectures en cache (prix en USD) :

Entrée de baseÉcritures en cache 5 minÉcritures en cache 1 hLectures en cacheSortie
10 $ / MTok12,50 $ / MTok20 $ / MTok0,25 $ / MTok50 $ / MTok

Sur ces modèles, les lectures en cache (succès et rafraîchissements) coûtent 0,025 fois le prix d'entrée de base, contre 0,1 sur les autres modèles Claude. Les longues sessions agentiques qui relisent un préfixe mis en cache paient donc le quart du tarif de Claude Fable 5. Les écritures en cache et la longueur minimale de 512 tokens pour un prompt pouvant être mis en cache restent inchangées.

Le traitement par lots coûte 5 $ USD par million de tokens d'entrée et 25 $ USD par million de tokens de sortie. Consultez Tarification pour la résidence des données et la tarification des outils.

Disponibilité

Claude Fable 5.1 est disponible sur :

Claude Mythos 5.1 est proposé uniquement aux clients approuvés de Project Glasswing. Pour y accéder, contactez votre équipe de compte Anthropic, AWS ou Google Cloud.

Claude Fable 5.1 et Claude Mythos 5.1 sont soumis à une « data retention » (conservation des données) de 30 jours. Ils ne sont pas disponibles en conservation zéro des données, sauf autorisation expresse d'Anthropic. Tous deux sont des Covered Models, comme Claude Fable 5 et Claude Mythos 5. Consultez Exigences de conservation des données propres aux modèles.

Migrer depuis Claude Fable 5

Pour migrer depuis Claude Fable 5, mettez à jour l'ID de votre modèle :

model = "claude-fable-5"  # Before
model = "claude-fable-5-1"  # After

Vérifiez ensuite les points suivants :

  1. Supprimez tout tool_choice de type any ou tool. Déplacez l'application du schéma vers l'utilisation stricte d'outils avec tool_choice: {"type": "auto"}, ou vers les sorties structurées.
  2. Renvoyez les blocs de réflexion sans modification et conservez un historique en ajout seul. Si votre code construit lui-même le tableau messages, exécutez la vérification de modification de l'historique, puis :
    • déplacez les rappels par tour que vous injectez puis supprimez actuellement vers des messages système limités à un tour ;
    • déplacez les modifications de system et de tools vers des messages système en cours de conversation ;
    • réduisez le contexte côté serveur, ou retirez les blocs de réflexion des tours que vous reportez dans un résumé côté client ;
    • choisissez un prefix_mismatch_behavior pour la production et surveillez input_transformations.
  3. Réajustez l'effort à partir de la valeur par défaut (high). Envisagez de le modifier en cours de conversation plutôt que de conserver un seul niveau pendant toute la session.
  4. Dans les boucles d'agent, surveillez les tours comportant un seul appel d'outil là où Claude Fable 5 en regroupait plusieurs. Ajoutez la note par tour présentée dans Rédiger des prompts pour Claude Fable 5.1.
  5. Relancez vos évaluations.
    • La gestion des refus, le repli, le crédit de repli et le tokenizer sont repris sans modification.
    • Les lectures en cache coûtent moins cher (consultez Tarification).
    • Le comportement par défaut diffère sur les points énumérés dans Changements par rapport à Claude Fable 5.

Consultez le guide de migration pour des instructions détaillées, y compris pour migrer depuis Claude Opus 5 et les modèles antérieurs.

Étapes suivantes

Spécifications et tarification de chaque modèle Claude actuel.

Migrer depuis Claude Fable 5, Claude Opus 5 et les modèles antérieurs.

Modèles de prompts propres à Claude Fable 5.1.

Was this page helpful?