Claude Platform Docs
Modèles et tarifsCycle de vie et référence

Tarification

Découvrez la structure tarifaire d'Anthropic pour les modèles et les fonctionnalités

Cette page fournit des informations tarifaires détaillées sur les modèles et les fonctionnalités d'Anthropic. Tous les prix sont en USD.

Pour obtenir les informations tarifaires les plus récentes, consultez claude.com/pricing.

Tarification des modèles

Le tableau suivant présente la tarification de tous les modèles Claude :

ModelBase tokensPrompt caching
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$10 /
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$4 / MTok
$20 / MTok
$5 / MTok
$8 / MTok
/ MTok
Claude Sonnet 5The best combination of speed and intelligence
/ MTok
/ MTok
$2.50 / MTok
$4 / MTok
$0.20 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$1 / MTok
$5 / MTok
$1.25 / MTok
$2 / MTok
$0.10 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
Claude Opus 4.1
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
Claude Opus 4
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Sonnet 4
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Haiku 3.5
$0.80 / MTok
$4 / MTok
$1 / MTok
$1.60 / MTok
$0.08 / MTok
Additional notes
All other models use the standard 0.1x multiplier.
Claude 4.7 and later models and Claude Mythos Preview use a newer tokenizer that contributes to their improved performance on a wide range of tasks. This tokenizer produces approximately 30% more tokens for the same text. The exact increase depends on the content and workload shape. Claude Sonnet 4.6 and earlier models use the previous tokenizer.

Tarification des plateformes cloud

Cette section couvre les plateformes cloud exploitées par des partenaires, où le fournisseur cloud vous facture. Pour les plateformes cloud exploitées par Anthropic et facturées via une marketplace, consultez Tarification de Claude Platform on AWS et Tarification de Claude dans Microsoft Foundry.

Les modèles Claude sont disponibles sur Amazon Bedrock et Google Cloud. Pour la tarification officielle, consultez :

Tarification de Claude Platform on AWS

Claude Platform on AWS est facturé via AWS Marketplace à l'aide de « Claude Consumption Units » (unités de consommation Claude), ou CCU. Anthropic valorise votre consommation de tokens en USD aux tarifs standard par modèle et par fonctionnalité, applique toute remise négociée, convertit le résultat en CCU au taux de 0,01 $ par CCU, et transmet la quantité de CCU à AWS Marketplace toutes les heures. Votre facture AWS affiche une seule ligne CCU.

ConceptDétails
Unité de facturationClaude Consumption Unit ()
Prix du CCU0,01 $ par CCU (fixe ; les remises s'appliquent lors de la conversion des tokens en CCU, et non au prix du CCU)
ConversionConsommation de tokens valorisée en USD aux tarifs standard par modèle et par fonctionnalité (identiques à la tarification de la Claude API), puis convertie en CCU au taux de 0,01 $ par CCU
Fréquence de facturationMesure horaire transmise à AWS Marketplace ; factures mensuelles
Modèle de paiementPaiement à terme échu uniquement (postpayé) ; aucun crédit prépayé
RemisesAppliquées sous forme d'un nombre réduit de CCU mesurés
TaxesMesure hors taxes ; AWS Marketplace gère les taxes
Visibilité des coûtsVentilation en temps réel dans la Claude Console (accessible via la console AWS) ; AWS Cost Explorer affiche les CCU agrégés

Géographie d'inférence

Pour les modèles Claude 4.6 et ultérieurs, l'utilisation de inference_geo: "us" applique un multiplicateur de prix de 1,1x. inference_geo: "global" (par défaut) utilise la tarification standard. Consultez Résidence des données pour plus de détails.

Offres privées

Lorsque vous vous inscrivez sur la page de service Claude Platform on AWS de la console AWS, celle-ci recherche toute offre privée associée à votre compte et vous invite à l'accepter dans AWS Marketplace. Contactez votre représentant de compte Anthropic pour connaître les conditions des offres privées.

Tarification de Claude dans Microsoft Foundry

Claude dans Microsoft Foundry est facturé via Azure Marketplace à l'aide de Claude Consumption Units (CCU). Anthropic valorise votre consommation de tokens en USD aux tarifs standard par modèle et par fonctionnalité, applique toute remise négociée, convertit le résultat en CCU au taux de 0,01 $ par CCU, et transmet la quantité de CCU à Azure Marketplace toutes les heures. Votre facture Azure affiche une seule ligne CCU.

ConceptDétails
Unité de facturationClaude Consumption Unit ()
Prix du CCU0,01 $ par CCU (fixe ; les remises s'appliquent lors de la conversion des tokens en CCU, et non au prix du CCU)
ConversionConsommation de tokens valorisée en USD aux tarifs standard par modèle et par fonctionnalité (identiques à la tarification de la Claude API), puis convertie en CCU au taux de 0,01 $ par CCU
Fréquence de facturationMesure horaire transmise à Azure Marketplace ; factures mensuelles
Modèle de paiementPaiement à terme échu uniquement (postpayé) ; aucun crédit prépayé
RemisesAppliquées sous forme d'un nombre réduit de CCU mesurés
TaxesMesure hors taxes ; Azure Marketplace gère les taxes
Visibilité des coûtsAzure Cost Management affiche les CCU agrégés

Géographie d'inférence

Les déploiements hébergés sur Azure peuvent utiliser le type de déploiement US Data Zone Standard, qui maintient l'inférence aux États-Unis. Cela équivaut à inference_geo: "us" sur la Claude API et applique le même multiplicateur de prix de 1,1x. Consultez Résidence des données pour plus de détails.

Tarification spécifique aux fonctionnalités

Mise en cache des prompts

Le « prompt caching » (mise en cache des prompts) réduit les coûts et la latence en réutilisant des portions précédemment traitées de votre prompt entre les appels API. Au lieu de retraiter la même invite système volumineuse, le même document ou le même historique de conversation à chaque requête, l'API lit depuis le cache à une fraction du prix d'entrée standard.

Il existe deux façons d'activer la mise en cache des prompts :

  • Mise en cache automatique : ajoutez un seul champ cache_control au niveau supérieur de votre requête. Le système gère automatiquement les points de rupture du cache à mesure que les conversations s'allongent. C'est le point de départ recommandé pour la plupart des cas d'usage.
  • Points de rupture de cache explicites : placez cache_control directement sur des blocs de contenu individuels pour un contrôle précis de ce qui est mis en cache.

La mise en cache des prompts utilise les multiplicateurs de prix suivants par rapport aux tarifs de base des tokens d'entrée :

Opération de cacheMultiplicateurDurée
Écriture en cache de 5 minutes1,25x le prix d'entrée de baseCache valide pendant 5 minutes
Écriture en cache de 1 heure2x le prix d'entrée de baseCache valide pendant 1 heure
Lecture du cache (succès)0,1x le prix d'entrée de base (0,025x sur Claude Fable 5.1 et Claude Mythos 5.1 ; 0,05x sur Claude Opus 5.5)Même durée que l'écriture précédente

Les tokens d'écriture en cache sont facturés lorsque le contenu est stocké pour la première fois. Les tokens de lecture du cache sont facturés lorsqu'une requête ultérieure récupère le contenu mis en cache. Un accès réussi au cache coûte 10 % du prix d'entrée standard, ce qui signifie que la mise en cache devient rentable après une lecture du cache pour la durée de 5 minutes (écriture à 1,25x), ou après deux lectures du cache pour la durée de 1 heure (écriture à 2x). Sur Claude Fable 5.1 et Claude Mythos 5.1, un accès réussi au cache coûte 2,5 % du prix d'entrée standard (0,25 $ USD par million de tokens). Sur Claude Opus 5.5, un accès réussi au cache coûte 5 % du prix d'entrée standard (0,20 $ USD par million de tokens).

Ces multiplicateurs se cumulent avec les autres modificateurs de prix, notamment la remise de l'API Batch et la résidence des données.

Pour les détails d'implémentation, les modèles pris en charge et des exemples de code, consultez Mise en cache des prompts.

Tarification de la résidence des données

Pour les modèles Claude 4.6 et ultérieurs, spécifier une inférence limitée aux États-Unis via le paramètre inference_geo entraîne un multiplicateur de 1,1x sur toutes les catégories de tarification des tokens, y compris les tokens d'entrée, les tokens de sortie, les écritures en cache et les lectures du cache. Le routage global (par défaut) utilise la tarification standard.

Cela s'applique à la Claude API (première partie) et à Claude Platform on AWS. Sur Claude dans Microsoft Foundry, le même multiplicateur de 1,1x s'applique aux déploiements qui utilisent le type de déploiement US Data Zone Standard (consultez Géographie d'inférence). Les plateformes exploitées par des partenaires (Bedrock et Google Cloud) disposent d'une tarification régionale indépendante. Consultez Bedrock et Google Cloud pour plus de détails. Les modèles antérieurs ne prennent pas en charge le paramètre inference_geo et utilisent toujours la tarification standard ; les requêtes qui incluent ce paramètre sur ces modèles renvoient une erreur 400.

Pour plus d'informations, consultez Résidence des données.

Tarification du mode rapide

Le mode rapide, en aperçu de recherche, offre une sortie nettement plus rapide pour Claude Opus 5.5, Claude Opus 5, et Claude Opus 4.8 à un tarif premium. La tarification du mode rapide s'applique à l'ensemble de la « context window » (fenêtre de contexte), y compris aux requêtes de plus de 200 000 tokens d'entrée. Le mode rapide est disponible uniquement sur la Claude API (première partie) ; il n'est pas disponible sur Claude Platform on AWS ni sur les plateformes cloud exploitées par des partenaires.

ModèleEntréeSortie
Claude Opus 5.58 $ / MTok40 $ / MTok
Claude Opus 5 / Claude Opus 4.810 $ / MTok50 $ / MTok

Le mode rapide n'est pas disponible sur Claude Opus 4.7 (les requêtes avec speed: "fast" renvoient une erreur) ni sur Claude Opus 4.6 (les requêtes s'exécutent à la vitesse standard et sont facturées aux tarifs standard). Consultez Mode rapide.

La tarification du mode rapide se cumule avec les autres modificateurs de prix :

Le mode rapide n'est pas disponible avec l'API Batch.

Pour plus d'informations, consultez Mode rapide.

Traitement par lots

L'API Batch permet le traitement asynchrone de grands volumes de requêtes avec une remise de 50 % sur les tokens d'entrée et de sortie.

ModelBatch tokens
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$5 /
$25 / MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$2 / MTok
$10 / MTok
Claude Sonnet 5The best combination of speed and intelligence
$1 / MTok
$5 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$0.50 / MTok
$2.50 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
Claude Opus 4.1
$7.50 / MTok
$37.50 / MTok
Claude Opus 4
$7.50 / MTok
$37.50 / MTok
$1.50 / MTok
$7.50 / MTok
$1.50 / MTok
$7.50 / MTok
Claude Sonnet 4
$1.50 / MTok
$7.50 / MTok
Claude Haiku 3.5
$0.40 / MTok
$2 / MTok

Pour plus d'informations sur le traitement par lots, consultez Traitement par lots.

Tarification du contexte long

Les modèles Claude 4.6 et ultérieurs ainsi que Claude Mythos Preview incluent l'intégralité de la fenêtre de contexte de 1 million de tokens à la tarification standard. (Une requête de 900 000 tokens est facturée au même tarif par token qu'une requête de 9 000 tokens.) Les remises liées à la mise en cache des prompts et au traitement par lots s'appliquent aux taux standard sur l'ensemble de la fenêtre de contexte.

Tarification de l'utilisation d'outils

Les requêtes de « tool use » (utilisation d'outils) sont facturées en fonction de :

  1. Le nombre total de tokens d'entrée envoyés au modèle (y compris dans le paramètre tools)
  2. Le nombre de tokens de sortie générés
  3. Pour les outils côté serveur, une tarification supplémentaire basée sur l'usage (par exemple, la recherche web est facturée par recherche effectuée)

Les outils côté client sont facturés de la même manière que toute autre requête à l'API Claude, tandis que les outils côté serveur peuvent entraîner des frais supplémentaires en fonction de leur usage spécifique.

Les tokens supplémentaires liés à l'utilisation d'outils proviennent de :

  • Le paramètre tools dans les requêtes API (noms, descriptions et schémas des outils)
  • Les blocs de contenu tool_use dans les requêtes et réponses API
  • Les blocs de contenu tool_result dans les requêtes API

Lorsque vous utilisez tools, l'API inclut également automatiquement une « system prompt » (invite système) spéciale pour le modèle, qui active l'utilisation d'outils. Le nombre de tokens d'utilisation d'outils requis pour chaque modèle est indiqué dans le tableau suivant (hors tokens supplémentaires mentionnés précédemment). Notez que le tableau suppose qu'au moins 1 outil est fourni. Si aucun tools n'est fourni, alors un choix d'outil de none utilise 0 token d'invite système supplémentaire.

ModelTool use system prompt tokens
NameToken count
Claude Opus 5.5For long-running agentic coding and knowledge work
auto, none
286 tokens
Claude Sonnet 5The best combination of speed and intelligence
auto, none
354 tokens
any, tool
474 tokens
Claude Haiku 4.5The fastest model with near-frontier intelligence
auto, none
496 tokens
any, tool
588 tokens
auto, none
286 tokens
any, tool
406 tokens
auto, none
290 tokens
any, tool
410 tokens
auto, none
675 tokens
any, tool
804 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Opus 4.1
auto, none
313 tokens
any, tool
315 tokens
Claude Opus 4
auto, none
313 tokens
any, tool
315 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Sonnet 4
auto, none
313 tokens
any, tool
315 tokens
Claude Haiku 3.5
auto, none
264 tokens
any, tool
355 tokens

Ces nombres de tokens sont ajoutés à vos tokens d'entrée et de sortie habituels pour calculer le coût total d'une requête.

Pour les prix actuels par modèle, reportez-vous à la section tarification des modèles.

Pour plus d'informations sur l'implémentation de l'utilisation d'outils et les bonnes pratiques, consultez Utilisation d'outils.

Tarification des outils spécifiques

Outil Bash

La définition de l'outil bash ajoute les tokens d'entrée suivants à votre requête. Cela s'ajoute à l'invite système d'utilisation d'outils propre à chaque modèle, qui s'applique dès qu'un outil est présent.

ModèleTokens d'entrée supplémentaires
Claude Opus 5, Claude Opus 4.8 et Claude Opus 4.7325 tokens
Claude Opus 4.6, Claude Sonnet 4.6 et versions antérieures244 tokens

Des tokens supplémentaires sont consommés par :

  • Les sorties de commandes (stdout/stderr)
  • Les messages d'erreur
  • Les contenus de fichiers volumineux

Consultez la tarification de l'utilisation d'outils pour les détails tarifaires complets.

Outil d'exécution de code

L'exécution de code est gratuite lorsqu'elle est utilisée avec la recherche web ou la récupération web. Lorsque web_search_20260209 (ou une version ultérieure) ou web_fetch_20260209 (ou une version ultérieure) est inclus dans votre requête API, aucun frais supplémentaire n'est facturé pour les appels à l'outil d'exécution de code au-delà des coûts standard des tokens d'entrée et de sortie.

Lorsqu'elle est utilisée sans ces outils, l'exécution de code est facturée selon le temps d'exécution, suivi séparément de l'utilisation des tokens :

  • Le temps d'exécution est d'un minimum de 5 minutes.
  • Chaque organisation reçoit 1 550 heures gratuites d'utilisation par mois.
  • L'utilisation supplémentaire au-delà de 1 550 heures est facturée à 0,05 $ USD par heure, par conteneur.
  • Si des fichiers sont inclus dans la requête, le temps d'exécution est facturé même si l'outil n'est pas appelé, car les fichiers sont préchargés dans le conteneur.

L'utilisation de l'exécution de code est suivie dans la réponse :

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 239,
    "server_tool_use": {
      "code_execution_requests": 1
    }
  }
}

Outil d'édition de texte

L'outil d'édition de texte utilise la même structure tarifaire que les autres outils utilisés avec Claude. Il suit la tarification standard des tokens d'entrée et de sortie en fonction du modèle Claude que vous utilisez.

En plus des tokens de base, les tokens d'entrée supplémentaires suivants sont nécessaires pour l'outil d'édition de texte :

OutilTokens d'entrée supplémentaires
text_editor_20250429 (Claude 4.x)700 tokens

Consultez la tarification de l'utilisation d'outils pour les détails tarifaires complets.

Outil de recherche web

L'utilisation de la recherche web est facturée en plus de l'utilisation des tokens :

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 6039,
    "cache_read_input_tokens": 7123,
    "cache_creation_input_tokens": 7345,
    "server_tool_use": {
      "web_search_requests": 1
    }
  }
}

La recherche web est disponible sur la Claude API pour 10 $ par 1 000 recherches, plus les coûts standard des tokens pour le contenu généré par la recherche. Les résultats de recherche web récupérés tout au long d'une conversation sont comptés comme tokens d'entrée, aussi bien dans les itérations de recherche exécutées au cours d'un seul tour que dans les tours de conversation suivants.

Chaque recherche web compte comme une utilisation, quel que soit le nombre de résultats renvoyés. Si une erreur se produit pendant la recherche web, celle-ci ne sera pas facturée.

Outil de récupération web

L'utilisation de la récupération web (web fetch) n'entraîne aucun frais supplémentaire au-delà des coûts standard en tokens :

{
  "usage": {
    "input_tokens": 25039,
    "output_tokens": 931,
    "cache_read_input_tokens": 0,
    "cache_creation_input_tokens": 0,
    "server_tool_use": {
      "web_fetch_requests": 1
    }
  }
}

L'outil de récupération web est disponible sur la Claude API sans coût supplémentaire. Vous ne payez que les coûts standard en tokens pour le contenu récupéré qui devient partie intégrante du contexte de votre conversation.

Pour vous protéger contre la récupération involontaire de contenus volumineux qui consommeraient un nombre excessif de tokens, utilisez le paramètre max_content_tokens afin de définir des limites appropriées en fonction de votre cas d'utilisation et de vos considérations budgétaires.

Exemple d'utilisation de tokens pour un contenu typique :

  • Page web moyenne (10 kB) : ~2 500 tokens
  • Grande page de documentation (100 kB) : ~25 000 tokens
  • Article de recherche au format PDF (500 kB) : ~125 000 tokens

Outil d'utilisation de l'ordinateur

L'utilisation de l'ordinateur suit la tarification standard de l'utilisation d'outils. Lors de l'utilisation de l'outil d'utilisation de l'ordinateur :

Surcharge liée à la définition du toolset : Déclarer computer_toolset_20260801 avec ses membres par défaut ajoute environ 4 500 tokens d'entrée à une requête (environ 4 520 sur Claude Fable 5, Claude Mythos 5, Claude Opus 5 et Claude Opus 4.8, et environ 4 590 sur Claude Sonnet 5), ce qui couvre les définitions des outils membres et le « system prompt » (invite système) de l'utilisation d'outils. Désactiver zoom avec configs supprime environ 410 de ces tokens. Le décompte exact pour une requête est indiqué dans le champ usage de la réponse, et vous pouvez l'estimer à l'avance avec le point de terminaison de comptage des tokens.

Versions antérieures de l'outil : Les chiffres suivants s'appliquent aux versions d'outil computer_20251124 et computer_20250124, et non à computer_toolset_20260801 :

  • Surcharge de l'invite système : 466 à 499 tokens ajoutés à l'invite système
  • Définition de l'outil : environ 735 tokens d'entrée par définition d'outil (mesuré avec computer_20250124)

Consommation de tokens supplémentaire :

  • Captures d'écran et images de zoom renvoyées dans les résultats d'outils, facturées comme entrée d'image (voir la tarification de la vision)
  • Résultats d'exécution des outils renvoyés à Claude

Outil d'utilisation du navigateur

Le « browser use » (utilisation du navigateur) suit la tarification standard de l'utilisation d'outils. Lorsque vous utilisez l'outil d'utilisation du navigateur :

Surcoût lié à la définition du jeu d'outils : déclarer browser_toolset_20260801 avec ses membres par défaut ajoute environ 6 600 tokens d'entrée à une requête (environ 6 610 sur Claude Fable 5, Claude Mythos 5, Claude Opus 5 et Claude Opus 4.8, et environ 6 670 sur Claude Sonnet 5), ce qui couvre les définitions des outils membres et l'invite système d'utilisation d'outils. L'activation des quatre membres optionnels ajoute environ 880 tokens, et la désactivation de membres avec configs réduit ce nombre. Le nombre exact pour une requête est indiqué dans le champ usage de la réponse, et vous pouvez l'estimer à l'avance avec le point de terminaison de comptage des tokens.

Consommation de tokens supplémentaire :

  • Les captures d'écran et les images de zoom renvoyées dans les résultats d'outils, facturées comme entrée d'image (voir la tarification de la vision)
  • Les résultats d'outils textuels renvoyés à Claude, tels que les arbres d'accessibilité, le texte des pages et les entrées de console ou de réseau

Tarification de Claude Managed Agents

Claude Managed Agents est facturé selon deux dimensions : les tokens et la durée d'exécution des sessions.

Tokens

Tous les tokens consommés par une session Claude Managed Agents sont facturés aux tarifs indiqués dans Tarification des modèles. Les multiplicateurs de mise en cache des prompts s'appliquent de manière identique. Une recherche web déclenchée au sein d'une session entraîne le tarif standard de 10 $ pour 1 000 recherches. Sur Claude Platform on AWS, les frais de tokens et de durée d'exécution des sessions sont convertis en Claude Consumption Units au taux standard. La tarification premium du mode rapide s'applique lorsque le paramètre model.speed d'un agent est défini sur "fast".

Le multiplicateur de résidence des données s'applique également : lorsque le paramètre model.inference_geo d'un agent est fixé à "us", les tokens consommés par les sessions exécutant cet agent sont facturés à 1,1x les tarifs standard, soit le même multiplicateur que celui qui s'applique à l'inférence limitée aux États-Unis sur l'API Messages.

Les modificateurs suivants de l'API Messages ne s'appliquent pas aux sessions Claude Managed Agents :

ModificateurPourquoi il ne s'applique pas
Remise de l'API BatchLes sessions sont avec état et interactives. Il n'existe pas de mode par lots.
Tarification des plateformes cloudNon disponible sur les plateformes cloud exploitées par des partenaires.

Durée d'exécution des sessions

SKUTarifMesure
Durée d'exécution de session0,08 $ par heure de sessionDurée du statut running

La durée d'exécution est mesurée à la milliseconde et ne s'accumule que lorsque le statut de la session est running. Le temps passé en statut idle (en attente de votre prochain message ou d'une confirmation d'outil), rescheduling ou terminated n'est pas comptabilisé dans la durée d'exécution.

Exemple détaillé

Une session de codage d'une heure utilisant Claude Opus 5 qui consomme 50 000 tokens d'entrée et 15 000 tokens de sortie :

LigneCalculCoût
Tokens d'entrée50 000 × 5 $ / 1 000 0000,25 $
Tokens de sortie15 000 × 25 $ / 1 000 0000,375 $
Durée d'exécution de session1,0 heure × 0,08 $0,08 $
Total0,705 $

Si la mise en cache des prompts est active et que 40 000 des tokens d'entrée sont des lectures du cache :

LigneCalculCoût
Tokens d'entrée non mis en cache10 000 × 5 $ / 1 000 0000,05 $
Tokens de lecture du cache40 000 × 5 $ × 0,1 / 1 000 0000,02 $
Tokens de sortie15 000 × 25 $ / 1 000 0000,375 $
Durée d'exécution de session1,0 heure × 0,08 $0,08 $
Total0,525 $

Pour une présentation détaillée de ce calcul, consultez le guide de l'agent de support client.

Considérations tarifaires supplémentaires

Stratégies d'optimisation des coûts

Lorsque vous créez des agents avec Claude :

  1. Utilisez les modèles appropriés : choisissez Haiku pour les tâches simples, Sonnet pour la plupart des charges de travail de production, et Opus pour les raisonnements les plus complexes
  2. Mettez en œuvre la mise en cache des prompts : réduisez les coûts pour le contexte répété
  3. Regroupez les opérations par lots : utilisez l'API Batch pour les tâches non urgentes
  4. Surveillez les schémas d'utilisation : suivez la consommation de tokens pour identifier les opportunités d'optimisation

Limites de débit

Les « rate limits » (limites de débit) varient selon le niveau d'utilisation et déterminent le nombre de requêtes que vous pouvez effectuer :

  • Niveau Start : limites d'entrée de gamme pour démarrer
  • Niveau Build : limites accrues pour les applications en croissance
  • Niveau Scale : limites standard les plus élevées pour les charges de travail de production

Pour des informations détaillées sur les limites de débit, consultez Limites de débit.

Pour des limites au-delà du niveau Scale ou des accords tarifaires personnalisés, contactez l'équipe commerciale.

Remises sur volume

Des remises sur volume peuvent être disponibles pour les utilisateurs à fort volume. Elles sont négociées au cas par cas.

Tarification entreprise

Pour les clients entreprise ayant des besoins spécifiques :

  • Limites de débit personnalisées
  • Remises sur volume
  • Support dédié
  • Conditions personnalisées

Contactez l'équipe commerciale à l'adresse sales@anthropic.com ou via la Claude Console pour discuter des options de tarification entreprise.

Facturation et paiement

  • La facturation est basée sur l'utilisation mensuelle réelle
  • Tous les paiements sont en USD
  • Options de paiement par carte de crédit et sur facture disponibles
  • Suivi de l'utilisation disponible dans la Claude Console

Foire aux questions

Comment l'utilisation des tokens est-elle calculée ?

Les tokens sont des fragments de texte que les modèles traitent. À titre d'estimation approximative, 1 token correspond à environ 4 caractères ou 0,75 mot en anglais. Le décompte exact varie selon la langue et le type de contenu.

Existe-t-il des niveaux gratuits ou des essais ?

Les nouveaux utilisateurs reçoivent une petite quantité de crédits gratuits pour tester l'API. Contactez l'équipe commerciale pour obtenir des informations sur les essais prolongés destinés à l'évaluation en entreprise.

Comment les remises se cumulent-elles ?

Les remises de l'API Batch et de la mise en cache des prompts peuvent être combinées. Par exemple, l'utilisation conjointe des deux fonctionnalités permet des économies significatives par rapport aux appels API standard. Consultez la tarification de la mise en cache des prompts pour comprendre comment les multiplicateurs interagissent.

Quels modes de paiement sont acceptés ?

Les principales cartes de crédit sont acceptées pour les comptes standard. Les clients entreprise peuvent convenir d'une facturation et d'autres modes de paiement.

Pour toute question supplémentaire concernant la tarification, contactez support@anthropic.com.

Was this page helpful?