Rate Limits API
Interroga programmaticamente i limiti di velocità API della tua organizzazione con la Rate Limits API.
La Rate Limits API fornisce accesso programmatico ai limiti di velocità configurati per la tua organizzazione e i suoi workspace. Queste sono le stesse informazioni mostrate nella pagina Rate limits nella Claude Console.
Usa questa API per:
- Mantenere sincronizzati gateway e proxy: Leggi i tuoi limiti attuali all'avvio e secondo una pianificazione invece di codificare valori fissi che si disallineano quando Anthropic li modifica.
- Alimentare gli avvisi interni: Confronta i dati di utilizzo dalla Usage and Cost API con i tuoi limiti configurati.
- Verificare la configurazione dei workspace: Verifica che le sovrascritture dei workspace corrispondano a ciò che la tua automazione di provisioning si aspetta.
Gli esempi SDK e CLI in questa pagina costruiscono il client predefinito, che legge la chiave Admin API dalla variabile d'ambiente ANTHROPIC_API_KEY. Gli SDK espongono questi endpoint come client.beta.organization.rate_limits e client.beta.organization.workspaces.rate_limits; i metodi list di Python, TypeScript, C#, Go e Java restituiscono un iteratore che segue next_page per te, mentre gli esempi PHP, Ruby e curl leggono una singola pagina.
Quick start
Elenca i limiti di velocità configurati per la tua organizzazione:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Limiti di velocità dell'organizzazione
L'endpoint /v1/organizations/rate_limits restituisce i limiti di velocità applicati a livello di organizzazione per la Messages API e le sue risorse di supporto. I limiti per altri prodotti, come i Claude Managed Agents, non sono inclusi.
Concetti chiave
- Gruppi di limiti di velocità: Ogni voce nella risposta rappresenta un gruppo di limiti di velocità. I limiti di velocità dei modelli sono raggruppati in modo che diverse versioni di modelli condividano un unico insieme di limiti, e altri gruppi coprono risorse come la Message Batches API, la Files API, la Token Counting API, le agent skills e lo strumento di ricerca web.
group_type: Identifica quale categoria di limiti copre la voce. Consulta Filtraggio per tipo di gruppo per l'elenco dei valori.- Elenco
models: Per le vocimodel_group, il campomodelselenca ogni ID modello e alias che conta verso i limiti di quel gruppo. Usa questo elenco per cercare sotto quale gruppo ricade una qualsiasi stringa di modello. Per altri tipi di gruppo,modelsènull. - Elenco
limits: Ogni gruppo porta un elenco di coppie{type, value}. Il campotypeidentifica il limitatore (comerequests_per_minute,input_tokens_per_minuteooutput_tokens_per_minute) evalueè il limite configurato. Consulta Rate limits per come ogni limitatore viene misurato e applicato.
Per i dettagli completi dei parametri e gli schemi di risposta, consulta il riferimento Organization Rate Limits API.
Elenca tutti i limiti di velocità dell'organizzazione
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "batch",
"models": null,
"limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
}
],
"next_page": null
}Cerca i limiti per un modello specifico
Passa qualsiasi ID modello o alias come parametro di query model per restituire solo la voce che lo contiene:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")Se la stringa del modello non corrisponde a nessun gruppo, l'endpoint restituisce un errore 404. Il parametro model è supportato solo sull'endpoint dell'organizzazione; l'endpoint del workspace non lo accetta.
Limiti di velocità del workspace
L'endpoint /v1/organizations/workspaces/{workspace_id}/rate_limits restituisce le sovrascritture dei limiti di velocità configurate per un singolo workspace.
La risposta include solo le sovrascritture, quindi tutto ciò che manca da essa viene ereditato dall'organizzazione:
- Un gruppo assente da
datanon ha alcuna sovrascrittura del workspace. Il workspace eredita i limiti a livello di organizzazione per quel gruppo (non è illimitato). - All'interno di un gruppo presente, un tipo di limitatore assente da
limits[]non ha alcuna sovrascrittura del workspace per quel limitatore. Il workspace eredita il valore dell'organizzazione per esso. - Per ogni limitatore presente,
org_limitè il valore a livello di organizzazione per lo stesso limitatore, onullse l'organizzazione non ha un limite configurato per quel tipo di limitatore.
Per i dettagli completi dei parametri e gli schemi di risposta, consulta il riferimento Workspace Rate Limits API.
client = anthropic.Anthropic()
rate_limits = client.beta.organization.workspaces.rate_limits.list(
"wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
},
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
}
],
"next_page": null
}Filtraggio per tipo di gruppo
Entrambi gli endpoint accettano un parametro di query opzionale group_type che limita la risposta a una singola categoria:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(group_type="batch")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")I valori validi sono model_group, batch, token_count, files, skills e web_search.
Paginazione
Entrambi gli endpoint accettano un parametro di query page e restituiscono un campo next_page. Le risposte sono attualmente sempre una singola pagina, quindi next_page è null. Esegui un ciclo su next_page in modo che il tuo client pagini correttamente senza modifiche quando la risposta cresce.
Domande frequenti
Quali stringhe di modello appaiono nell'elenco models?
Ogni ID modello e alias che conta verso il gruppo, inclusi gli ID datati (come claude-sonnet-4-5-20250929) e gli alias non datati (come claude-sonnet-4-5). Cerca qualsiasi stringa di modello che passi alla Messages API e la troverai in esattamente una voce model_group.
Cosa significa se un gruppo manca dalla risposta del workspace?
Il workspace non ha alcuna sovrascrittura per quel gruppo ed eredita il limite a livello di organizzazione. Interroga l'endpoint dell'organizzazione per vedere i valori ereditati.
Posso aggiornare i limiti di velocità con questa API?
No. Per impostare i limiti di velocità del workspace, apri il workspace nella Claude Console e usa la scheda Rate limits.
Vedi anche
Was this page helpful?