Claude Platform Docs
管理監控

Rate Limits API

使用 Rate Limits API 以程式化方式查詢您組織的 API 速率限制。

Rate Limits API 提供程式化存取方式,讓您讀取為您的組織及其工作區所設定的「rate limits」(速率限制)。這與 Claude Console 中速率限制頁面所顯示的資訊相同。

使用此 API 可以:

  • 讓閘道與代理伺服器保持同步: 在啟動時及依排程讀取您目前的限制,而非將數值寫死在程式中,以免在 Anthropic 調整限制時產生偏差。
  • 驅動內部警示:Usage and Cost API 的使用量資料與您設定的限制進行比較。
  • 稽核工作區設定: 驗證工作區覆寫值是否符合您的佈建自動化流程所預期的內容。

本頁的 SDK 與 CLI 範例會建構預設用戶端,該用戶端會從 ANTHROPIC_API_KEY 環境變數讀取 Admin API 金鑰。SDK 將這些端點公開為 client.beta.organization.rate_limitsclient.beta.organization.workspaces.rate_limits;Python、TypeScript、C#、Go 與 Java 的 list 方法會回傳一個自動為您追蹤 next_page 的迭代器,而 PHP、Ruby 與 curl 範例則只讀取單一頁面。

快速開始

列出為您的組織所設定的速率限制:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

組織速率限制

/v1/organizations/rate_limits 端點會回傳在組織層級套用於 Messages API 及其支援資源的速率限制。其他產品(例如 Claude Managed Agents)的限制不包含在內。

關鍵概念

  • 速率限制群組: 回應中的每個項目代表一個速率限制群組。模型速率限制會被分組,使多個模型版本共用同一組限制;其他群組則涵蓋 Message Batches API、Files API、Token Counting API、agent skills 以及網頁搜尋工具等資源。
  • group_type 識別該項目涵蓋哪一類限制。請參閱依群組類型篩選以取得值的清單。
  • models 清單: 對於 model_group 項目,models 欄位會列出計入該群組限制的每個模型 ID 與別名。使用此清單可查詢任何模型字串屬於哪個群組。對於其他群組類型,modelsnull
  • limits 清單: 每個群組都帶有一份 {type, value} 配對清單。type 欄位識別限制器(例如 requests_per_minuteinput_tokens_per_minuteoutput_tokens_per_minute),而 value 則是所設定的限制值。請參閱速率限制以了解每個限制器的計量與執行方式。

如需完整的參數詳細資訊與回應結構描述,請參閱 Organization Rate Limits API 參考文件

列出所有組織速率限制

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list()

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 4000 },
        { "type": "input_tokens_per_minute", "value": 10000000 },
        { "type": "output_tokens_per_minute", "value": 800000 }
      ]
    },
    {
      "type": "rate_limit",
      "group_type": "batch",
      "models": null,
      "limits": [{ "type": "enqueued_batch_requests", "value": 500000 }]
    }
  ],
  "next_page": null
}

查詢特定模型的限制

將任何模型 ID 或別名作為 model 查詢參數傳入,即可僅回傳包含該模型的項目:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(model="claude-opus-5")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

如果模型字串不符合任何群組,端點會回傳 404 錯誤。model 參數僅在組織端點上受支援;工作區端點不接受此參數。

工作區速率限制

/v1/organizations/workspaces/{workspace_id}/rate_limits 端點會回傳為單一工作區所設定的速率限制覆寫值。

回應僅包含覆寫值,因此回應中缺少的任何內容皆繼承自組織:

  • 未出現在 data 中的群組完全沒有工作區覆寫值。該工作區會繼承該群組的組織層級限制(並非無限制)。
  • 在有出現的群組中,未出現在 limits[] 中的限制器類型沒有該限制器的工作區覆寫值。該工作區會繼承其組織值。
  • 對於每個有出現的限制器,org_limit 是同一限制器的組織層級值;若組織未針對該限制器類型設定限制,則為 null

如需完整的參數詳細資訊與回應結構描述,請參閱 Workspace Rate Limits API 參考文件

client = anthropic.Anthropic()

rate_limits = client.beta.organization.workspaces.rate_limits.list(
    "wrkspc_01JwQvzr7rXLA5AGx3HKfFUJ"
)

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")
{
  "data": [
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": ["claude-opus-5"],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    },
    {
      "type": "workspace_rate_limit",
      "group_type": "model_group",
      "models": [
        "claude-opus-4-5",
        "claude-opus-4-5-20251101",
        "claude-opus-4-6",
        "claude-opus-4-7",
        "claude-opus-4-8"
      ],
      "limits": [
        { "type": "requests_per_minute", "value": 1000, "org_limit": 4000 },
        { "type": "input_tokens_per_minute", "value": 500000, "org_limit": 10000000 }
      ]
    }
  ],
  "next_page": null
}

依群組類型篩選

兩個端點皆接受選用的 group_type 查詢參數,可將回應限制為單一類別:

client = anthropic.Anthropic()

rate_limits = client.beta.organization.rate_limits.list(group_type="batch")

for group in rate_limits:
    models = f" ({', '.join(group.models)})" if group.models else ""
    print(f"{group.group_type}{models}")
    for limit in group.limits:
        print(f"  {limit.type}: {limit.value}")

有效值為 model_groupbatchtoken_countfilesskillsweb_search

分頁

兩個端點皆接受 page 查詢參數並回傳 next_page 欄位。目前回應一律為單一頁面,因此 next_pagenull。請以 next_page 進行迴圈,如此當回應內容增加時,您的用戶端無需修改即可正確分頁。

常見問題

哪些模型字串會出現在 models 清單中?

計入該群組的每個模型 ID 與別名,包括帶日期的 ID(例如 claude-sonnet-4-5-20250929)與不帶日期的別名(例如 claude-sonnet-4-5)。查詢您傳給 Messages API 的任何模型字串,您都會在恰好一個 model_group 項目中找到它。

如果工作區回應中缺少某個群組,代表什麼意思?

該工作區沒有該群組的覆寫值,並繼承組織層級的限制。請查詢組織端點以查看繼承的值。

我可以使用此 API 更新速率限制嗎?

不行。若要設定工作區速率限制,請在 Claude Console 中開啟該工作區,並使用速率限制分頁。

另請參閱

Was this page helpful?