API de límites de velocidad
Consulta programáticamente los límites de velocidad de la API de tu organización con la API de límites de velocidad.
La "Rate Limits API" (API de límites de velocidad) proporciona acceso programático a los "rate limits" (límites de velocidad) configurados para tu organización y sus espacios de trabajo. Esta es la misma información que se muestra en la página Límites de velocidad en la Claude Console.
Usa esta API para:
- Mantener sincronizados los gateways y proxies: Lee tus límites actuales al iniciar y de forma programada, en lugar de codificar valores fijos que se desactualizan cuando Anthropic los ajusta.
- Impulsar alertas internas: Compara los datos de uso de la API de uso y costos con tus límites configurados.
- Auditar la configuración de los espacios de trabajo: Verifica que las anulaciones de los espacios de trabajo coincidan con lo que espera tu automatización de aprovisionamiento.
Los ejemplos del SDK y la CLI en esta página construyen el cliente predeterminado, que lee la clave de API de administrador desde la variable de entorno ANTHROPIC_API_KEY. Los SDK exponen estos endpoints como client.beta.organization.rate_limits y client.beta.organization.workspaces.rate_limits; los métodos de listado de Python, TypeScript, C#, Go y Java devuelven un iterador que sigue next_page por ti, mientras que los ejemplos de PHP, Ruby y curl leen una sola página.
Inicio rápido
Lista los límites de velocidad configurados para tu organización:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Límites de velocidad de la organización
El endpoint /v1/organizations/rate_limits devuelve los límites de velocidad aplicados a nivel de organización para la API de Messages y sus recursos de soporte. No se incluyen los límites de otros productos, como Claude Managed Agents.
Conceptos clave
- Grupos de límites de velocidad: Cada entrada en la respuesta representa un grupo de límites de velocidad. Los límites de velocidad de los modelos se agrupan de modo que varias versiones de modelos comparten un único conjunto de límites, y otros grupos cubren recursos como la API de Message Batches, la API de Files, la API de Token Counting, las habilidades de agentes y la herramienta de búsqueda web.
group_type: Identifica qué categoría de límites cubre la entrada. Consulta Filtrado por tipo de grupo para ver la lista de valores.- Lista
models: Para las entradasmodel_group, el campomodelsenumera cada ID de modelo y alias que cuenta contra los límites de ese grupo. Usa esta lista para buscar a qué grupo pertenece cualquier cadena de modelo. Para otros tipos de grupo,modelsesnull. - Lista
limits: Cada grupo contiene una lista de pares{type, value}. El campotypeidentifica el limitador (comorequests_per_minute,input_tokens_per_minuteuoutput_tokens_per_minute) yvaluees el límite configurado. Consulta Límites de velocidad para saber cómo se mide y aplica cada limitador.
Para obtener los detalles completos de los parámetros y los esquemas de respuesta, consulta la referencia de la API de límites de velocidad de la organización.
Listar todos los límites de velocidad de la organización
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "batch",
"models": null,
"limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
}
],
"next_page": null
}Buscar los límites de un modelo específico
Pasa cualquier ID de modelo o alias como el parámetro de consulta model para devolver solo la entrada que lo contiene:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Si la cadena de modelo no coincide con ningún grupo, el endpoint devuelve un error 404. El parámetro model solo se admite en el endpoint de la organización; el endpoint de espacios de trabajo no lo acepta.
Límites de velocidad de los espacios de trabajo
El endpoint /v1/organizations/workspaces/{workspace_id}/rate_limits devuelve las anulaciones de límites de velocidad configuradas para un único espacio de trabajo.
La respuesta solo incluye anulaciones, por lo que todo lo que falte en ella se hereda de la organización:
- Un grupo que está ausente de
datano tiene ninguna anulación de espacio de trabajo. El espacio de trabajo hereda los límites a nivel de organización para ese grupo (no es ilimitado). - Dentro de un grupo que está presente, un tipo de limitador que está ausente de
limits[]no tiene anulación de espacio de trabajo para ese limitador. El espacio de trabajo hereda el valor de la organización para él. - Para cada limitador que está presente,
org_limites el valor a nivel de organización para el mismo limitador, onullsi la organización no tiene un límite configurado para ese tipo de limitador.
Para obtener los detalles completos de los parámetros y los esquemas de respuesta, consulta la referencia de la API de límites de velocidad de espacios de trabajo.
client = anthropic.Anthropic()
rate_limits = client.beta.organization.workspaces.rate_limits.list(
"wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
},
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
}
],
"next_page": null
}Filtrado por tipo de grupo
Ambos endpoints aceptan un parámetro de consulta opcional group_type que restringe la respuesta a una sola categoría:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(group_type="batch")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Los valores válidos son model_group, batch, token_count, files, skills y web_search.
Paginación
Ambos endpoints aceptan un parámetro de consulta page y devuelven un campo next_page. Actualmente, las respuestas son siempre de una sola página, por lo que next_page es null. Itera sobre next_page para que tu cliente pagine correctamente sin cambios cuando la respuesta crezca.
Preguntas frecuentes
¿Qué cadenas de modelo aparecen en la lista models?
Cada ID de modelo y alias que cuenta contra el grupo, incluidos los ID con fecha (como claude-sonnet-4-5-20250929) y los alias sin fecha (como claude-sonnet-4-5). Busca cualquier cadena de modelo que pases a la API de Messages y la encontrarás en exactamente una entrada model_group.
¿Qué significa que falte un grupo en la respuesta del espacio de trabajo?
El espacio de trabajo no tiene ninguna anulación para ese grupo y hereda el límite a nivel de organización. Consulta el endpoint de la organización para ver los valores heredados.
¿Puedo actualizar los límites de velocidad con esta API?
No. Para establecer los límites de velocidad de un espacio de trabajo, abre el espacio de trabajo en la Claude Console y usa la pestaña Rate limits (Límites de velocidad).
Ver también
Was this page helpful?