Claude Platform Docs
AdministraçãoMonitoramento

API de Limites de Taxa

Consulte programaticamente os limites de taxa da API da sua organização com a API de Limites de Taxa.

A API de Limites de Taxa (Rate Limits API) fornece acesso programático aos "rate limits" (limites de taxa) configurados para sua organização e seus workspaces. Estas são as mesmas informações exibidas na página Limites de taxa no Claude Console.

Use esta API para:

  • Manter gateways e proxies sincronizados: Leia seus limites atuais na inicialização e de forma agendada, em vez de fixar no código valores que ficam desatualizados quando a Anthropic os ajusta.
  • Alimentar alertas internos: Compare os dados de uso da API de Uso e Custo com seus limites configurados.
  • Auditar a configuração de workspaces: Verifique se as substituições (overrides) de workspace correspondem ao que sua automação de provisionamento espera.

Os exemplos de SDK e CLI nesta página constroem o cliente padrão, que lê a chave de API de Admin da variável de ambiente ANTHROPIC_API_KEY. Os SDKs expõem esses endpoints como client.beta.organization.rate_limits e client.beta.organization.workspaces.rate_limits; os métodos de listagem em Python, TypeScript, C#, Go e Java retornam um iterador que segue next_page para você, enquanto os exemplos em PHP, Ruby e curl leem uma página.

Início rápido

Liste os limites de taxa configurados para sua organização:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Limites de taxa da organização

O endpoint /v1/organizations/rate_limits retorna os limites de taxa aplicados no nível da organização para a Messages API e seus recursos de suporte. Limites para outros produtos, como o Claude Managed Agents, não estão incluídos.

Conceitos principais

  • Grupos de limites de taxa: Cada entrada na resposta representa um grupo de limites de taxa. Os limites de taxa de modelos são agrupados de forma que várias versões de modelo compartilhem um único conjunto de limites, e outros grupos cobrem recursos como a Message Batches API, a Files API, a Token Counting API, agent skills e a ferramenta de busca na web.
  • group_type: Identifica qual categoria de limites a entrada cobre. Consulte Filtrando por tipo de grupo para a lista de valores.
  • Lista models: Para entradas model_group, o campo models lista todos os IDs e aliases de modelo que contam para os limites daquele grupo. Use essa lista para descobrir a qual grupo qualquer string de modelo pertence. Para outros tipos de grupo, models é null.
  • Lista limits: Cada grupo contém uma lista de pares {type, value}. O campo type identifica o limitador (como requests_per_minute, input_tokens_per_minute ou output_tokens_per_minute) e value é o limite configurado. Consulte Limites de taxa para saber como cada limitador é medido e aplicado.

Para detalhes completos dos parâmetros e esquemas de resposta, consulte a referência da API de Limites de Taxa da Organização.

Listar todos os limites de taxa da organização

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "batch",
      "models": null,
      "limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
    }
  ],
  "next_page": null
}

Consultar os limites de um modelo específico

Passe qualquer ID ou alias de modelo como o parâmetro de consulta model para retornar apenas a entrada que o contém:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Se a string de modelo não corresponder a nenhum grupo, o endpoint retorna um erro 404. O parâmetro model é suportado apenas no endpoint da organização; o endpoint de workspace não o aceita.

Limites de taxa de workspace

O endpoint /v1/organizations/workspaces/{workspace_id}/rate_limits retorna as substituições de limites de taxa configuradas para um único workspace.

A resposta inclui apenas substituições, portanto tudo o que estiver ausente dela é herdado da organização:

  • Um grupo ausente de data não tem nenhuma substituição de workspace. O workspace herda os limites no nível da organização para aquele grupo (ele não é ilimitado).
  • Dentro de um grupo presente, um tipo de limitador ausente de limits[] não tem substituição de workspace para aquele limitador. O workspace herda o valor da organização para ele.
  • Para cada limitador presente, org_limit é o valor no nível da organização para o mesmo limitador, ou null se a organização não tiver um limite configurado para aquele tipo de limitador.

Para detalhes completos dos parâmetros e esquemas de resposta, consulte a referência da API de Limites de Taxa de Workspace.

client = anthropic.Anthropic()

rate_limits = client.beta.organization.workspaces.rate_limits.list(
    "wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    },
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    }
  ],
  "next_page": null
}

Filtrando por tipo de grupo

Ambos os endpoints aceitam um parâmetro de consulta opcional group_type que restringe a resposta a uma única categoria:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(group_type="batch")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Os valores válidos são model_group, batch, token_count, files, skills e web_search.

Paginação

Ambos os endpoints aceitam um parâmetro de consulta page e retornam um campo next_page. Atualmente, as respostas são sempre uma única página, portanto next_page é null. Faça um loop em next_page para que seu cliente pagine corretamente, sem alterações, quando a resposta crescer.

Perguntas frequentes

Quais strings de modelo aparecem na lista models?

Todos os IDs e aliases de modelo que contam para o grupo, incluindo IDs com data (como claude-sonnet-4-5-20250929) e aliases sem data (como claude-sonnet-4-5). Consulte qualquer string de modelo que você passa para a Messages API e você a encontrará em exatamente uma entrada model_group.

O que significa se um grupo estiver ausente da resposta de workspace?

O workspace não tem substituição para aquele grupo e herda o limite no nível da organização. Consulte o endpoint da organização para ver os valores herdados.

Posso atualizar limites de taxa com esta API?

Não. Para definir limites de taxa de workspace, abra o workspace no Claude Console e use a aba Rate limits.

Veja também

Was this page helpful?