Rate Limits API
使用 Rate Limits API 以程式化方式查詢您組織的 API 速率限制。
Rate Limits API 提供程式化存取方式,讓您讀取為您的組織及其工作區所設定的「rate limits」(速率限制)。這與 Claude Console 中速率限制頁面所顯示的資訊相同。
使用此 API 可以:
- 讓閘道與代理伺服器保持同步: 在啟動時及依排程讀取您目前的限制,而非將數值寫死在程式中,以免在 Anthropic 調整限制時產生偏差。
- 驅動內部警示: 將 Usage and Cost API 的使用量資料與您設定的限制進行比較。
- 稽核工作區設定: 驗證工作區覆寫值是否符合您的佈建自動化流程所預期的內容。
本頁的 SDK 與 CLI 範例會建構預設用戶端,該用戶端會從 ANTHROPIC_API_KEY 環境變數讀取 Admin API 金鑰。SDK 將這些端點公開為 client.beta.organization.rate_limits 與 client.beta.organization.workspaces.rate_limits;Python、TypeScript、C#、Go 與 Java 的 list 方法會回傳一個自動為您追蹤 next_page 的迭代器,而 PHP、Ruby 與 curl 範例則只讀取單一頁面。
快速開始
列出為您的組織所設定的速率限制:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")組織速率限制
/v1/organizations/rate_limits 端點會回傳在組織層級套用於 Messages API 及其支援資源的速率限制。其他產品(例如 Claude Managed Agents)的限制不包含在內。
關鍵概念
- 速率限制群組: 回應中的每個項目代表一個速率限制群組。模型速率限制會被分組,使多個模型版本共用同一組限制;其他群組則涵蓋 Message Batches API、Files API、Token Counting API、agent skills 以及網頁搜尋工具等資源。
group_type: 識別該項目涵蓋哪一類限制。請參閱依群組類型篩選以取得值的清單。models清單: 對於model_group項目,models欄位會列出計入該群組限制的每個模型 ID 與別名。使用此清單可查詢任何模型字串屬於哪個群組。對於其他群組類型,models為null。limits清單: 每個群組都帶有一份{type, value}配對清單。type欄位識別限制器(例如requests_per_minute、input_tokens_per_minute或output_tokens_per_minute),而value則是所設定的限制值。請參閱速率限制以了解每個限制器的計量與執行方式。
如需完整的參數詳細資訊與回應結構描述,請參閱 Organization Rate Limits API 參考文件。
列出所有組織速率限制
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list()
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 4000 },
{ "type": "input_tokens_per_minute", "value": 10000000 },
{ "type": "output_tokens_per_minute", "value": 800000 }
]
},
{
"type": "rate_limit",
"group_type": "batch",
"models": null,
"limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
}
],
"next_page": null
}查詢特定模型的限制
將任何模型 ID 或別名作為 model 查詢參數傳入,即可僅回傳包含該模型的項目:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")如果模型字串不符合任何群組,端點會回傳 404 錯誤。model 參數僅在組織端點上受支援;工作區端點不接受此參數。
工作區速率限制
/v1/organizations/workspaces/{workspace_id}/rate_limits 端點會回傳為單一工作區所設定的速率限制覆寫值。
回應僅包含覆寫值,因此回應中缺少的任何內容皆繼承自組織:
- 未出現在
data中的群組完全沒有工作區覆寫值。該工作區會繼承該群組的組織層級限制(並非無限制)。 - 在有出現的群組中,未出現在
limits[]中的限制器類型沒有該限制器的工作區覆寫值。該工作區會繼承其組織值。 - 對於每個有出現的限制器,
org_limit是同一限制器的組織層級值;若組織未針對該限制器類型設定限制,則為null。
如需完整的參數詳細資訊與回應結構描述,請參閱 Workspace Rate Limits API 參考文件。
client = anthropic.Anthropic()
rate_limits = client.beta.organization.workspaces.rate_limits.list(
"wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}"){
"data": [
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": ["claude-opus-5"],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
},
{
"type": "workspace_rate_limit",
"group_type": "model_group",
"models": [
"claude-opus-4-5",
"claude-opus-4-5-20251101",
"claude-opus-4-6",
"claude-opus-4-7",
"claude-opus-4-8"
],
"limits": [
{ "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
{ "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
]
}
],
"next_page": null
}依群組類型篩選
兩個端點皆接受選用的 group_type 查詢參數,可將回應限制為單一類別:
client = anthropic.Anthropic()
rate_limits = client.beta.organization.rate_limits.list(group_type="batch")
for group in rate_limits:
models = f" ({', '.join(group.models)})" if group.models else ""
print(f"{group.group_type}{models}")
for limit in group.limits:
print(f" {limit.type}: {limit.value}")有效值為 model_group、batch、token_count、files、skills 與 web_search。
分頁
兩個端點皆接受 page 查詢參數並回傳 next_page 欄位。目前回應一律為單一頁面,因此 next_page 為 null。請以 next_page 進行迴圈,如此當回應內容增加時,您的用戶端無需修改即可正確分頁。
常見問題
哪些模型字串會出現在 models 清單中?
計入該群組的每個模型 ID 與別名,包括帶日期的 ID(例如 claude-sonnet-4-5-20250929)與不帶日期的別名(例如 claude-sonnet-4-5)。查詢您傳給 Messages API 的任何模型字串,您都會在恰好一個 model_group 項目中找到它。
如果工作區回應中缺少某個群組,代表什麼意思?
該工作區沒有該群組的覆寫值,並繼承組織層級的限制。請查詢組織端點以查看繼承的值。
我可以使用此 API 更新速率限制嗎?
不行。若要設定工作區速率限制,請在 Claude Console 中開啟該工作區,並使用速率限制分頁。
另請參閱
Was this page helpful?