Claude Platform Docs
AdministrationSurveillance

API Rate Limits

Interrogez par programmation les limites de débit API de votre organisation avec l'API Rate Limits.

L'API Rate Limits fournit un accès programmatique aux « rate limits » (limites de débit) configurées pour votre organisation et ses espaces de travail. Il s'agit des mêmes informations que celles affichées sur la page Limites de débit de la Claude Console.

Utilisez cette API pour :

  • Garder les passerelles et les proxys synchronisés : lisez vos limites actuelles au démarrage et selon un calendrier, au lieu de coder en dur des valeurs qui dérivent lorsqu'Anthropic les ajuste.
  • Alimenter les alertes internes : comparez les données d'utilisation de l'API Usage and Cost à vos limites configurées.
  • Auditer la configuration des espaces de travail : vérifiez que les surcharges des espaces de travail correspondent à ce qu'attend votre automatisation de provisionnement.

Les exemples SDK et CLI de cette page construisent le client par défaut, qui lit la clé API Admin depuis la variable d'environnement ANTHROPIC_API_KEY. Les SDK exposent ces points de terminaison sous client.beta.organization.rate_limits et client.beta.organization.workspaces.rate_limits ; les méthodes de liste Python, TypeScript, C#, Go et Java renvoient un itérateur qui suit next_page pour vous, tandis que les exemples PHP, Ruby et curl lisent une seule page.

Démarrage rapide

Listez les limites de débit configurées pour votre organisation :

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Limites de débit de l'organisation

Le point de terminaison /v1/organizations/rate_limits renvoie les limites de débit appliquées au niveau de l'organisation pour l'API Messages et ses ressources associées. Les limites des autres produits, tels que Claude Managed Agents, ne sont pas incluses.

Concepts clés

  • Groupes de limites de débit : chaque entrée de la réponse représente un groupe de limites de débit. Les limites de débit des modèles sont regroupées de sorte que plusieurs versions de modèles partagent un même ensemble de limites, et d'autres groupes couvrent des ressources telles que l'API Message Batches, l'API Files, l'API Token Counting, les compétences d'agent et l'outil de recherche web.
  • group_type : identifie la catégorie de limites couverte par l'entrée. Consultez Filtrage par type de groupe pour la liste des valeurs.
  • Liste models : pour les entrées model_group, le champ models liste chaque ID de modèle et alias qui est comptabilisé dans les limites de ce groupe. Utilisez cette liste pour déterminer à quel groupe appartient n'importe quelle chaîne de modèle. Pour les autres types de groupes, models vaut null.
  • Liste limits : chaque groupe comporte une liste de paires {type, value}. Le champ type identifie le limiteur (tel que requests_per_minute, input_tokens_per_minute ou output_tokens_per_minute) et value est la limite configurée. Consultez Limites de débit pour savoir comment chaque limiteur est mesuré et appliqué.

Pour le détail complet des paramètres et les schémas de réponse, consultez la référence de l'API Organization Rate Limits.

Lister toutes les limites de débit de l'organisation

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "batch",
      "models": null,
      "limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
    }
  ],
  "next_page": null
}

Rechercher les limites d'un modèle spécifique

Passez n'importe quel ID de modèle ou alias comme paramètre de requête model pour ne renvoyer que l'entrée qui le contient :

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Si la chaîne de modèle ne correspond à aucun groupe, le point de terminaison renvoie une erreur 404. Le paramètre model n'est pris en charge que sur le point de terminaison de l'organisation ; le point de terminaison de l'espace de travail ne l'accepte pas.

Limites de débit des espaces de travail

Le point de terminaison /v1/organizations/workspaces/{workspace_id}/rate_limits renvoie les surcharges de limites de débit configurées pour un seul espace de travail.

La réponse n'inclut que les surcharges ; tout ce qui en est absent est donc hérité de l'organisation :

  • Un groupe absent de data n'a aucune surcharge d'espace de travail. L'espace de travail hérite des limites au niveau de l'organisation pour ce groupe (il n'est pas illimité).
  • Au sein d'un groupe présent, un type de limiteur absent de limits[] n'a pas de surcharge d'espace de travail pour ce limiteur. L'espace de travail hérite de la valeur de l'organisation pour celui-ci.
  • Pour chaque limiteur présent, org_limit est la valeur au niveau de l'organisation pour le même limiteur, ou null si l'organisation n'a pas de limite configurée pour ce type de limiteur.

Pour le détail complet des paramètres et les schémas de réponse, consultez la référence de l'API Workspace Rate Limits.

client = anthropic.Anthropic()

rate_limits = client.beta.organization.workspaces.rate_limits.list(
    "wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    },
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    }
  ],
  "next_page": null
}

Filtrage par type de groupe

Les deux points de terminaison acceptent un paramètre de requête optionnel group_type qui restreint la réponse à une seule catégorie :

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(group_type="batch")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Les valeurs valides sont model_group, batch, token_count, files, skills et web_search.

Pagination

Les deux points de terminaison acceptent un paramètre de requête page et renvoient un champ next_page. Les réponses tiennent actuellement toujours sur une seule page, donc next_page vaut null. Bouclez sur next_page afin que votre client pagine correctement, sans modification, lorsque la réponse s'agrandira.

Foire aux questions

Quelles chaînes de modèle apparaissent dans la liste models ?

Chaque ID de modèle et alias comptabilisé dans le groupe, y compris les ID datés (tels que claude-sonnet-4-5-20250929) et les alias non datés (tels que claude-sonnet-4-5). Recherchez n'importe quelle chaîne de modèle que vous passez à l'API Messages et vous la trouverez dans exactement une entrée model_group.

Que signifie l'absence d'un groupe dans la réponse de l'espace de travail ?

L'espace de travail n'a pas de surcharge pour ce groupe et hérite de la limite au niveau de l'organisation. Interrogez le point de terminaison de l'organisation pour voir les valeurs héritées.

Puis-je mettre à jour les limites de débit avec cette API ?

Non. Pour définir les limites de débit d'un espace de travail, ouvrez l'espace de travail dans la Claude Console et utilisez l'onglet Rate limits.

Voir aussi

Was this page helpful?