Rate Limits API
Программно запрашивайте ограничения скорости API вашей организации с помощью Rate Limits API.
Rate Limits API предоставляет программный доступ к «rate limits» (ограничениям скорости), настроенным для вашей организации и её рабочих пространств. Это та же информация, которая отображается на странице Rate limits в Claude Console.
Используйте этот API, чтобы:
- Поддерживать синхронизацию шлюзов и прокси: считывайте текущие ограничения при запуске и по расписанию вместо жёсткого кодирования значений, которые устаревают, когда Anthropic их корректирует.
- Обеспечивать работу внутренних оповещений: сравнивайте данные об использовании из Usage and Cost API с настроенными у вас ограничениями.
- Проводить аудит конфигурации рабочих пространств: проверяйте, что переопределения рабочих пространств соответствуют тому, что ожидает ваша автоматизация подготовки ресурсов.
Примеры SDK и CLI на этой странице создают клиент по умолчанию, который считывает ключ Admin API из переменной окружения ANTHROPIC_API_KEY. SDK предоставляют эти конечные точки как client.beta.organization.rate_limits и client.beta.organization.workspaces.rate_limits; методы list в Python, TypeScript, C#, Go и Java возвращают итератор, который следует по next_page за вас, тогда как примеры на PHP, Ruby и curl считывают одну страницу.
Быстрый старт
Выведите список ограничений скорости, настроенных для вашей организации:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Ограничения скорости организации
Конечная точка /v1/organizations/rate_limits возвращает ограничения скорости, применяемые на уровне организации для Messages API и его вспомогательных ресурсов. Ограничения для других продуктов, таких как Claude Managed Agents, не включены.
Ключевые понятия
- Группы ограничений скорости: каждая запись в ответе представляет одну группу ограничений скорости. Ограничения скорости моделей сгруппированы так, что несколько версий моделей используют единый набор ограничений, а другие группы охватывают такие ресурсы, как Message Batches API, Files API, Token Counting API, навыки агентов и инструмент веб-поиска.
group_type: определяет, какую категорию ограничений охватывает запись. Список значений см. в разделе Фильтрация по типу группы.- Список
models: для записейmodel_groupполеmodelsперечисляет все идентификаторы и псевдонимы моделей, которые учитываются в ограничениях этой группы. Используйте этот список, чтобы определить, к какой группе относится любая строка модели. Для других типов группmodelsравноnull. - Список
limits: каждая группа содержит список пар{type, value}. Полеtypeопределяет ограничитель (например,requests_per_minute,input_tokens_per_minuteилиoutput_tokens_per_minute), аvalue— настроенное ограничение. О том, как измеряется и применяется каждый ограничитель, см. в разделе Ограничения скорости.
Полные сведения о параметрах и схемы ответов см. в справочнике Organization Rate Limits API.
Вывод списка всех ограничений скорости организации
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "batch",
"models": null,
"limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
}
],
"next_page": null
}Поиск ограничений для конкретной модели
Передайте любой идентификатор или псевдоним модели в качестве параметра запроса model, чтобы вернуть только ту запись, которая его содержит:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Если строка модели не соответствует ни одной группе, конечная точка возвращает ошибку 404. Параметр model поддерживается только на конечной точке организации; конечная точка рабочего пространства его не принимает.
Ограничения скорости рабочего пространства
Конечная точка /v1/organizations/workspaces/{workspace_id}/rate_limits возвращает переопределения ограничений скорости, настроенные для одного рабочего пространства.
Ответ включает только переопределения, поэтому всё, что в нём отсутствует, наследуется от организации:
- Группа, отсутствующая в
data, вообще не имеет переопределения на уровне рабочего пространства. Рабочее пространство наследует ограничения уровня организации для этой группы (оно не является неограниченным). - Внутри присутствующей группы тип ограничителя, отсутствующий в
limits[], не имеет переопределения на уровне рабочего пространства для этого ограничителя. Рабочее пространство наследует для него значение организации. - Для каждого присутствующего ограничителя
org_limit— это значение уровня организации для того же ограничителя илиnull, если у организации нет настроенного ограничения для этого типа ограничителя.
Полные сведения о параметрах и схемы ответов см. в справочнике Workspace Rate Limits API.
client = anthropic.Anthropic()
rate_limits = client.beta.organization.workspaces.rate_limits.list(
"wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
},
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
}
],
"next_page": null
}Фильтрация по типу группы
Обе конечные точки принимают необязательный параметр запроса group_type, который ограничивает ответ одной категорией:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(group_type="batch")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Допустимые значения: model_group, batch, token_count, files, skills и web_search.
Пагинация
Обе конечные точки принимают параметр запроса page и возвращают поле next_page. В настоящее время ответы всегда состоят из одной страницы, поэтому next_page равно null. Выполняйте цикл по next_page, чтобы ваш клиент корректно выполнял пагинацию без изменений, когда ответ увеличится.
Часто задаваемые вопросы
Какие строки моделей появляются в списке models?
Все идентификаторы и псевдонимы моделей, которые учитываются в группе, включая датированные идентификаторы (например, claude-sonnet-4-5-20250929) и недатированные псевдонимы (например, claude-sonnet-4-5). Найдите любую строку модели, которую вы передаёте в Messages API, и вы обнаружите её ровно в одной записи model_group.
Что означает отсутствие группы в ответе рабочего пространства?
У рабочего пространства нет переопределения для этой группы, и оно наследует ограничение уровня организации. Запросите конечную точку организации, чтобы увидеть наследуемые значения.
Могу ли я обновлять ограничения скорости с помощью этого API?
Нет. Чтобы задать ограничения скорости рабочего пространства, откройте рабочее пространство в Claude Console и используйте вкладку Rate limits.
См. также
Was this page helpful?