Claude Platform Docs

Choisir le bon modèle

Choisir un modèle Claude implique de trouver un équilibre entre capacités, vitesse et coût. Ce guide présente les questions à se poser, deux façons de choisir un modèle de départ et la manière de tester ce choix.

Établir les critères clés

Lorsque vous choisissez un modèle Claude, commencez par évaluer les facteurs suivants :

  • Capacités : De quelles fonctionnalités ou capacités spécifiques le modèle devra-t-il disposer pour répondre à vos besoins ?
  • Vitesse : À quelle vitesse le modèle doit-il répondre dans votre application ? Claude Opus 5.5, Claude Opus 5, et Claude Opus 4.8 prennent en charge le « fast mode » (mode rapide) (aperçu de recherche), qui offre une vitesse de sortie jusqu'à 2,5 fois supérieure à un tarif premium.
  • Coût : Quel est votre budget pour le développement et pour l'utilisation en production ?
  • Effort : Plusieurs modèles Claude prennent en charge un « effort parameter » (paramètre d'effort) qui permet d'arbitrer entre l'intelligence d'une part et la « latency » (latence) et le coût d'autre part, au sein d'un même modèle. Ajuster l'effort est souvent un meilleur levier que de changer de modèle. Sur Claude Fable 5.1 et Claude Opus 5, commencez avec la valeur par défaut (high) et ajustez-la à la hausse ou à la baisse en fonction de vos évaluations. Sur Claude Opus 5.5, la valeur par défaut est medium ; commencez par celle-ci et ajustez-la de la même manière. Sur Claude Opus 4.8 et Claude Opus 4.7, le niveau d'effort xhigh, situé entre high et max, est le meilleur réglage pour la plupart des cas d'usage de codage et agentiques.

Choisir le meilleur modèle pour commencer

Il existe deux approches générales que vous pouvez utiliser pour commencer à tester quel modèle Claude convient le mieux à vos besoins.

Option 1 : Commencer par l'efficacité

Pour de nombreuses applications, commencer avec un modèle plus rapide et plus économique comme Claude Haiku 4.5 peut être l'approche optimale :

  1. Commencez l'implémentation avec Claude Haiku 4.5.
  2. Testez votre cas d'usage de manière approfondie.
  3. Évaluez si les performances répondent à vos exigences.
  4. Passez à un modèle supérieur uniquement si nécessaire pour combler des lacunes de capacités spécifiques.

Cette approche permet une itération rapide, des coûts de développement réduits, et elle est souvent suffisante pour de nombreuses applications courantes. Cette approche est idéale pour :

  • Le prototypage initial et le développement
  • Les applications ayant des exigences strictes en matière de latence
  • Les implémentations sensibles aux coûts
  • Les tâches simples à fort volume

Option 2 : Commencer par les capacités

Pour les tâches complexes où l'intelligence et les capacités avancées sont primordiales, vous pouvez commencer par les capacités : implémentez avec le point de départ le plus puissant pour votre tâche, puis optimisez vers des modèles plus efficaces par la suite :

  1. Implémentez avec Claude Opus 5.5.
  2. Optimisez vos prompts pour ce modèle.
  3. Évaluez si les performances répondent à vos exigences.
  4. Envisagez d'améliorer l'efficacité en réduisant l'effort ou en passant à des modèles inférieurs au fil du temps, à mesure que vous optimisez votre flux de travail.
  5. Si vos évaluations avec un effort xhigh ou max restent insuffisantes pour un raisonnement exigeant ou un travail agentique de longue durée, passez à Claude Fable 5.1.

Cette approche est idéale pour :

  • Les tâches de raisonnement complexes
  • Les applications scientifiques ou mathématiques
  • Les tâches nécessitant une compréhension nuancée
  • Les applications où la précision prime sur les considérations de coût
  • Le codage avancé et le travail agentique à forte autonomie

Claude Opus 5.5 (claude-opus-5-5) est conçu pour le codage agentique de longue durée et le travail intellectuel, avec la réflexion adaptative (« adaptive thinking ») toujours activée. Si votre intégration force l'utilisation d'outils (tool_choice de type any ou tool), désactive la réflexion ou utilise l'outil d'utilisation de l'ordinateur computer_20251124, consultez les Changements incompatibles avant de migrer.

Claude Fable 5.1 (claude-fable-5-1) est le modèle d'Anthropic le plus performant ouvert à tous les clients. Il étend Claude Fable 5 avec des capacités renforcées en codage agentique de longue durée, en travail intellectuel et en recherche, aux mêmes prix d'entrée et de sortie, avec des lectures du cache à un quart du coût. Claude Mythos 5.1 (claude-mythos-5-1) offre les mêmes capacités, uniquement aux participants de Project Glasswing. Les deux modèles utilisent la réflexion adaptative toujours activée. Consultez Nouveautés de Claude Fable 5.1 pour plus de détails.

Pour les « context windows » (fenêtres de contexte), les limites de sortie et les prix, consultez le tableau comparatif des modèles.

Matrice de sélection des modèles

La plupart des charges de travail commencent avec Claude Opus 5.5.

Lorsque vous avez besoin de...Envisagez de commencer avec...Exemples de cas d'usage
La capacité la plus élevée disponibleClaude Fable 5.1Sessions d'agent qui durent des heures, recherche approfondie en plusieurs étapes, analyse menée jusqu'à un document, une feuille de calcul ou une présentation finalisés
Codage agentique complexe et travail en entrepriseClaude Opus 5.5Agents de codage autonomes fonctionnant pendant plusieurs heures, refactorisation à grande échelle, ingénierie de systèmes complexes, flux de travail fortement axés sur la vision, utilisation de l'ordinateur
Vitesse et capacité pour les charges de travail quotidiennes de codage, d'agents et d'entrepriseClaude Sonnet 5Génération de code, analyse de données, création de contenu, compréhension visuelle, utilisation d'outils agentique
La latence et le prix les plus bas, avec l'« extended thinking » (réflexion étendue)Claude Haiku 4.5Applications en temps réel, traitement intelligent à volume élevé, déploiements sensibles aux coûts nécessitant un raisonnement solide, tâches de sous-agents

Décider de passer à un modèle supérieur ou de changer de modèle

Pour déterminer si vous devez passer à un modèle supérieur ou changer de modèle, vous devriez :

  1. Créer des tests de référence spécifiques à votre cas d'usage — disposer d'un bon jeu d'évaluation est l'étape la plus importante du processus.
  2. Tester avec vos prompts et données réels.
  3. Comparer les performances entre les modèles pour :
    • La précision des réponses
    • La qualité des réponses
    • La gestion des cas limites
  4. Peser les compromis entre performances et coût.

Combiner les modèles

Les stratégies multi-modèles associent un modèle moins coûteux à un modèle de pointe afin que la plupart des tokens soient facturés au tarif le plus bas. Les deux schémas courants sont un exécuteur qui fait remonter les décisions difficiles à un conseiller, et un orchestrateur qui délègue le travail de masse à des exécutants moins coûteux. Consultez Optimiser le coût et l'intelligence pour découvrir les deux stratégies, des exemples mesurés et les options d'implémentation.

Prochaines étapes

Consultez les spécifications détaillées et les tarifs des derniers modèles Claude

Conçu pour le raisonnement exigeant et le travail agentique de longue durée

Le dernier modèle Opus : changements incompatibles, nouvelles fonctionnalités et différences de comportement

Pour les charges de travail quotidiennes qui équilibrent vitesse et capacités

Lancez-vous avec votre premier appel API

Was this page helpful?