Claude Platform Docs
АдминистрированиеМониторинг

Rate Limits API

Программно запрашивайте ограничения скорости API вашей организации с помощью Rate Limits API.

Rate Limits API предоставляет программный доступ к «rate limits» (ограничениям скорости), настроенным для вашей организации и её рабочих пространств. Это та же информация, которая отображается на странице Rate limits в Claude Console.

Используйте этот API, чтобы:

  • Поддерживать синхронизацию шлюзов и прокси: считывайте текущие ограничения при запуске и по расписанию вместо жёсткого кодирования значений, которые устаревают, когда Anthropic их корректирует.
  • Обеспечивать работу внутренних оповещений: сравнивайте данные об использовании из Usage and Cost API с настроенными у вас ограничениями.
  • Проводить аудит конфигурации рабочих пространств: проверяйте, что переопределения рабочих пространств соответствуют тому, что ожидает ваша автоматизация подготовки ресурсов.

Примеры SDK и CLI на этой странице создают клиент по умолчанию, который считывает ключ Admin API из переменной окружения ANTHROPIC_API_KEY. SDK предоставляют эти конечные точки как client.beta.organization.rate_limits и client.beta.organization.workspaces.rate_limits; методы list в Python, TypeScript, C#, Go и Java возвращают итератор, который следует по next_page за вас, тогда как примеры на PHP, Ruby и curl считывают одну страницу.

Быстрый старт

Выведите список ограничений скорости, настроенных для вашей организации:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Ограничения скорости организации

Конечная точка /v1/organizations/rate_limits возвращает ограничения скорости, применяемые на уровне организации для Messages API и его вспомогательных ресурсов. Ограничения для других продуктов, таких как Claude Managed Agents, не включены.

Ключевые понятия

  • Группы ограничений скорости: каждая запись в ответе представляет одну группу ограничений скорости. Ограничения скорости моделей сгруппированы так, что несколько версий моделей используют единый набор ограничений, а другие группы охватывают такие ресурсы, как Message Batches API, Files API, Token Counting API, навыки агентов и инструмент веб-поиска.
  • group_type: определяет, какую категорию ограничений охватывает запись. Список значений см. в разделе Фильтрация по типу группы.
  • Список models: для записей model_group поле models перечисляет все идентификаторы и псевдонимы моделей, которые учитываются в ограничениях этой группы. Используйте этот список, чтобы определить, к какой группе относится любая строка модели. Для других типов групп models равно null.
  • Список limits: каждая группа содержит список пар {type, value}. Поле type определяет ограничитель (например, requests_per_minute, input_tokens_per_minute или output_tokens_per_minute), а value — настроенное ограничение. О том, как измеряется и применяется каждый ограничитель, см. в разделе Ограничения скорости.

Полные сведения о параметрах и схемы ответов см. в справочнике Organization Rate Limits API.

Вывод списка всех ограничений скорости организации

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "batch",
      "models": null,
      "limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
    }
  ],
  "next_page": null
}

Поиск ограничений для конкретной модели

Передайте любой идентификатор или псевдоним модели в качестве параметра запроса model, чтобы вернуть только ту запись, которая его содержит:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Если строка модели не соответствует ни одной группе, конечная точка возвращает ошибку 404. Параметр model поддерживается только на конечной точке организации; конечная точка рабочего пространства его не принимает.

Ограничения скорости рабочего пространства

Конечная точка /v1/organizations/workspaces/{workspace_id}/rate_limits возвращает переопределения ограничений скорости, настроенные для одного рабочего пространства.

Ответ включает только переопределения, поэтому всё, что в нём отсутствует, наследуется от организации:

  • Группа, отсутствующая в data, вообще не имеет переопределения на уровне рабочего пространства. Рабочее пространство наследует ограничения уровня организации для этой группы (оно не является неограниченным).
  • Внутри присутствующей группы тип ограничителя, отсутствующий в limits[], не имеет переопределения на уровне рабочего пространства для этого ограничителя. Рабочее пространство наследует для него значение организации.
  • Для каждого присутствующего ограничителя org_limit — это значение уровня организации для того же ограничителя или null, если у организации нет настроенного ограничения для этого типа ограничителя.

Полные сведения о параметрах и схемы ответов см. в справочнике Workspace Rate Limits API.

client = anthropic.Anthropic()

rate_limits = client.beta.organization.workspaces.rate_limits.list(
    "wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    },
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    }
  ],
  "next_page": null
}

Фильтрация по типу группы

Обе конечные точки принимают необязательный параметр запроса group_type, который ограничивает ответ одной категорией:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(group_type="batch")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

Допустимые значения: model_group, batch, token_count, files, skills и web_search.

Пагинация

Обе конечные точки принимают параметр запроса page и возвращают поле next_page. В настоящее время ответы всегда состоят из одной страницы, поэтому next_page равно null. Выполняйте цикл по next_page, чтобы ваш клиент корректно выполнял пагинацию без изменений, когда ответ увеличится.

Часто задаваемые вопросы

Какие строки моделей появляются в списке models?

Все идентификаторы и псевдонимы моделей, которые учитываются в группе, включая датированные идентификаторы (например, claude-sonnet-4-5-20250929) и недатированные псевдонимы (например, claude-sonnet-4-5). Найдите любую строку модели, которую вы передаёте в Messages API, и вы обнаружите её ровно в одной записи model_group.

Что означает отсутствие группы в ответе рабочего пространства?

У рабочего пространства нет переопределения для этой группы, и оно наследует ограничение уровня организации. Запросите конечную точку организации, чтобы увидеть наследуемые значения.

Могу ли я обновлять ограничения скорости с помощью этого API?

Нет. Чтобы задать ограничения скорости рабочего пространства, откройте рабочее пространство в Claude Console и используйте вкладку Rate limits.

См. также

Was this page helpful?