Claude Platform Docs
模型與定價生命週期與參考

定價

了解 Anthropic 針對模型與功能的定價結構

本頁提供 Anthropic 模型與功能的詳細定價資訊。所有價格均以美元(USD)計價。

如需最新的定價資訊,請造訪 claude.com/pricing。

模型定價

下表顯示所有 Claude 模型的定價:

ModelBase tokensPrompt caching
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$10 /
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$4 / MTok
$20 / MTok
$5 / MTok
$8 / MTok
/ MTok
Claude Sonnet 5The best combination of speed and intelligence
/ MTok
/ MTok
$2.50 / MTok
$4 / MTok
$0.20 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$1 / MTok
$5 / MTok
$1.25 / MTok
$2 / MTok
$0.10 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
Claude Opus 4.1
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
Claude Opus 4
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Sonnet 4
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Haiku 3.5
$0.80 / MTok
$4 / MTok
$1 / MTok
$1.60 / MTok
$0.08 / MTok
Additional notes
All other models use the standard 0.1x multiplier.
Claude 4.7 and later models and Claude Mythos Preview use a newer tokenizer that contributes to their improved performance on a wide range of tasks. This tokenizer produces approximately 30% more tokens for the same text. The exact increase depends on the content and workload shape. Claude Sonnet 4.6 and earlier models use the previous tokenizer.

雲端平台定價

本節涵蓋由合作夥伴營運的雲端平台,由雲端供應商向您開立帳單。如需透過市集計費、由 Anthropic 營運的雲端平台,請參閱 Claude Platform on AWS 定價與 Claude in Microsoft Foundry 定價。

Claude 模型可於 Amazon Bedrock 與 Google Cloud 上使用。如需官方定價,請造訪:

Claude Platform on AWS 定價

Claude Platform on AWS 透過 AWS Marketplace 以 Claude Consumption Units(Claude 消費單位),即 CCU 計費。Anthropic 會依各模型、各功能的標準費率以美元計算您的 token 用量,套用任何議定的折扣,再以每 CCU $0.01 的比率將結果換算為 CCU,並每小時向 AWS Marketplace 回報 CCU 數量。您的 AWS 帳單會顯示單一 CCU 明細項目。

概念詳細資訊
計費單位Claude Consumption Unit()
CCU 價格每 CCU $0.01(固定;折扣套用於 token 換算為 CCU 的階段,而非 CCU 價格本身)
換算方式token 用量依照各模型、各功能的標準費率以美元計算(與 Claude API 定價相同),再以每 CCU $0.01 換算為 CCU
計費週期每小時向 AWS Marketplace 計量;每月開立發票
付款模式僅限後付(postpaid);不提供預付額度
折扣以減少計量的 CCU 數量方式套用
稅金以稅前金額計量;由 AWS Marketplace 處理稅金
成本可見性在 Claude Console 中提供即時明細(透過 AWS Console 存取);AWS Cost Explorer 顯示彙總的 CCU

推論地理位置

對於 Claude 4.6 及更新的模型,使用 inference_geo: "us" 會套用 1.1 倍的定價倍率。inference_geo: "global"(預設)使用標準定價。詳情請參閱資料駐留。

私人優惠

當您在 AWS Console 的 Claude Platform on AWS 服務頁面註冊時,AWS Console 會查詢與您帳戶相關聯的任何私人優惠(private offer),並提示您在 AWS Marketplace 中接受。如需私人優惠條款,請聯絡您的 Anthropic 客戶代表。

Claude in Microsoft Foundry 定價

Claude in Microsoft Foundry 透過 Azure Marketplace 以 Claude Consumption Units(CCU)計費。Anthropic 會依各模型、各功能的標準費率以美元計算您的 token 用量,套用任何議定的折扣,再以每 CCU $0.01 的比率將結果換算為 CCU,並每小時向 Azure Marketplace 回報 CCU 數量。您的 Azure 帳單會顯示單一 CCU 明細項目。

概念詳細資訊
計費單位Claude Consumption Unit()
CCU 價格每 CCU $0.01(固定;折扣套用於 token 換算為 CCU 的階段,而非 CCU 價格本身)
換算方式token 用量依照各模型、各功能的標準費率以美元計算(與 Claude API 定價相同),再以每 CCU $0.01 換算為 CCU
計費週期每小時向 Azure Marketplace 計量;每月開立發票
付款模式僅限後付(postpaid);不提供預付額度
折扣以減少計量的 CCU 數量方式套用
稅金以稅前金額計量;由 Azure Marketplace 處理稅金
成本可見性Azure Cost Management 顯示彙總的 CCU

推論地理位置

託管於 Azure 的部署可使用 US Data Zone Standard 部署類型,將推論保留在美國境內。這等同於 Claude API 上的 inference_geo: "us",並套用相同的 1.1 倍定價倍率。詳情請參閱資料駐留。

功能專屬定價

提示快取

提示快取透過在多次 API 呼叫之間重複使用先前已處理的提示部分,來降低成本與 latency(延遲)。API 不必在每次請求時重新處理相同的大型系統提示、文件或對話歷史,而是以標準輸入價格的一小部分從快取中讀取。

啟用提示快取有兩種方式:

  • 自動快取:在請求的最上層加入單一 cache_control 欄位。系統會隨著對話增長自動管理快取斷點。這是大多數使用情境的建議起點。
  • 明確快取斷點:將 cache_control 直接放在個別內容區塊上,以精細控制確切要快取的內容。

提示快取使用以下相對於基本輸入 token 費率的定價倍率:

快取操作倍率持續時間
5 分鐘快取寫入1.25 倍基本輸入價格快取有效 5 分鐘
1 小時快取寫入2 倍基本輸入價格快取有效 1 小時
快取讀取(命中)0.1 倍基本輸入價格(Claude Fable 5.1 與 Claude Mythos 5.1 為 0.025 倍;Claude Opus 5.5 為 0.05 倍)與先前寫入的持續時間相同

快取寫入 token 會在內容首次儲存時計費。快取讀取 token 會在後續請求擷取快取內容時計費。快取命中的費用為標準輸入價格的 10%,這表示對於 5 分鐘的持續時間(1.25 倍寫入),快取在一次快取讀取後即可回本;對於 1 小時的持續時間(2 倍寫入),則在兩次快取讀取後回本。在 Claude Fable 5.1 與 Claude Mythos 5.1 上,快取命中的費用為標準輸入價格的 2.5%(每百萬 token 0.25 美元)。在 Claude Opus 5.5 上,快取命中的費用為標準輸入價格的 5%(每百萬 token 0.20 美元)。

這些倍率可與其他定價修正項疊加,包括 Batch API 折扣與資料駐留。

如需實作細節、支援的模型與程式碼範例,請參閱提示快取。

資料駐留定價

對於 Claude 4.6 及更新的模型,透過 inference_geo 參數指定僅限美國推論,會對所有 token 定價類別套用 1.1 倍的倍率,包括輸入 token、輸出 token、快取寫入與快取讀取。全球路由(預設)使用標準定價。

此規則適用於 Claude API(第一方)與 Claude Platform on AWS。在 Claude in Microsoft Foundry 上,相同的 1.1 倍倍率適用於使用 US Data Zone Standard 部署類型的部署(請參閱推論地理位置)。由合作夥伴營運的平台(Bedrock 與 Google Cloud)有獨立的區域定價。詳情請參閱 Bedrock 與 Google Cloud。較早的模型不支援 inference_geo 參數,且一律使用標準定價;在這些模型上包含該參數的請求會回傳 400 錯誤。

如需更多資訊,請參閱資料駐留。

快速模式定價

「Fast mode」(快速模式)目前為研究預覽,以溢價定價為 Claude Opus 5.5、Claude Opus 5、以及 Claude Opus 4.8 提供顯著更快的輸出。快速模式定價適用於整個「context window」(上下文視窗),包括超過 200k 輸入 token 的請求。快速模式僅在 Claude API(第一方)上提供;不適用於 Claude Platform on AWS 或由合作夥伴營運的雲端平台。

模型輸入輸出
Claude Opus 5.5$8 / MTok$40 / MTok
Claude Opus 5 / Claude Opus 4.8$10 / MTok$50 / MTok

快速模式不適用於 Claude Opus 4.7(帶有 speed: "fast" 的請求會回傳錯誤)或 Claude Opus 4.6(請求以標準速度執行並以標準費率計費)。請參閱快速模式。

快速模式定價可與其他定價修正項疊加:

快速模式無法與 Batch API 搭配使用。

如需更多資訊,請參閱快速模式。

批次處理

Batch API 允許以非同步方式處理大量請求,輸入與輸出 token 均享有 50% 折扣。

ModelBatch tokens
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$5 /
$25 / MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$2 / MTok
$10 / MTok
Claude Sonnet 5The best combination of speed and intelligence
$1 / MTok
$5 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$0.50 / MTok
$2.50 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
Claude Opus 4.1
$7.50 / MTok
$37.50 / MTok
Claude Opus 4
$7.50 / MTok
$37.50 / MTok
$1.50 / MTok
$7.50 / MTok
$1.50 / MTok
$7.50 / MTok
Claude Sonnet 4
$1.50 / MTok
$7.50 / MTok
Claude Haiku 3.5
$0.40 / MTok
$2 / MTok

如需更多關於批次處理的資訊,請參閱批次處理。

長上下文定價

Claude 4.6 及更新的模型以及 Claude Mythos Preview 以標準定價包含完整的 1M token 上下文視窗。(900k token 的請求與 9k token 的請求以相同的每 token 費率計費。)提示快取與批次處理折扣在整個上下文視窗中以標準費率套用。

工具使用定價

工具使用(tool use)請求的計價依據如下:

  1. 傳送至模型的輸入 token 總數(包括 tools 參數中的內容)
  2. 產生的輸出 token 數量
  3. 對於伺服器端工具,另有依使用量計算的額外費用(例如,網頁搜尋依每次執行的搜尋計費)

用戶端工具的計價方式與任何其他 Claude API 請求相同,但伺服器端工具可能會依其特定使用情況產生額外費用。

工具使用所產生的額外 token 來自:

  • API 請求中的 tools 參數(工具名稱、描述與結構描述)
  • API 請求與回應中的 tool_use 內容區塊
  • API 請求中的 tool_result 內容區塊

當您使用 tools 時,API 也會自動為模型加入一段特殊的系統提示(system prompt),以啟用工具使用功能。下表列出了每個模型所需的工具使用 token 數量(不包括前述的額外 token)。請注意,此表假設至少提供了 1 個工具。若未提供任何 tools,則工具選擇為 none 時會使用 0 個額外的系統提示 token。

ModelTool use system prompt tokens
NameToken count
Claude Opus 5.5For long-running agentic coding and knowledge work
auto, none
286 tokens
Claude Sonnet 5The best combination of speed and intelligence
auto, none
354 tokens
any, tool
474 tokens
Claude Haiku 4.5The fastest model with near-frontier intelligence
auto, none
496 tokens
any, tool
588 tokens
auto, none
286 tokens
any, tool
406 tokens
auto, none
290 tokens
any, tool
410 tokens
auto, none
675 tokens
any, tool
804 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Opus 4.1
auto, none
313 tokens
any, tool
315 tokens
Claude Opus 4
auto, none
313 tokens
any, tool
315 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Sonnet 4
auto, none
313 tokens
any, tool
315 tokens
Claude Haiku 3.5
auto, none
264 tokens
any, tool
355 tokens

這些 token 數量會加到您一般的輸入與輸出 token 中,以計算請求的總費用。

如需目前各模型的價格,請參閱模型定價一節。

如需更多關於工具使用實作與最佳實務的資訊,請參閱工具使用。

特定工具定價

Bash 工具

bash 工具定義會為您的請求增加以下輸入 token。這是在每個模型的工具使用系統提示之外額外增加的,只要存在任何工具,該系統提示便會適用。

模型額外輸入 token
Claude Opus 5、Claude Opus 4.8 與 Claude Opus 4.7325 個 token
Claude Opus 4.6、Claude Sonnet 4.6 及更早版本244 個 token

以下項目會消耗額外的 token:

  • 指令輸出(stdout/stderr)
  • 錯誤訊息
  • 大型檔案內容

請參閱工具使用定價以了解完整的定價細節。

程式碼執行工具

與網頁搜尋或網頁擷取搭配使用時,程式碼執行是免費的。 當您的 API 請求中包含 web_search_20260209(或更新版本)或 web_fetch_20260209(或更新版本)時,除了標準的輸入與輸出 token 費用之外,程式碼執行工具呼叫不會產生額外費用。

若未搭配這些工具使用,程式碼執行將依執行時間計費,並與 token 用量分開追蹤:

  • 執行時間最少以 5 分鐘計算
  • 每個組織每月可獲得 1,550 小時的免費用量
  • 超過 1,550 小時的額外用量,將以每個容器每小時 $0.05 美元計費
  • 若請求中包含檔案,即使未呼叫該工具,仍會依執行時間計費,因為檔案會預先載入至容器中

程式碼執行用量會在回應中追蹤:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 239,
    "server_tool_use": {
      "code_execution_requests": 1
    }
  }
}

文字編輯器工具

文字編輯器工具採用與其他搭配 Claude 使用的工具相同的定價結構。它依據您所使用的 Claude 模型,遵循標準的輸入與輸出 token 定價。

除了基本 token 之外,文字編輯器工具還需要以下額外的輸入 token:

工具額外輸入 token
text_editor_20250429 (Claude 4.x)700 個 token

請參閱工具使用定價以了解完整的定價細節。

網頁搜尋工具

除了 token 用量之外,網頁搜尋的使用也會另外計費:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 6039,
    "cache_read_input_tokens": 7123,
    "cache_creation_input_tokens": 7345,
    "server_tool_use": {
      "web_search_requests": 1
    }
  }
}

網頁搜尋在 Claude API 上的價格為每 1,000 次搜尋 $10 美元,另加搜尋所產生內容的標準 token 費用。在整個對話過程中擷取的網頁搜尋結果會計為 input tokens(輸入 token),包括在單一回合中執行的搜尋迭代,以及後續的對話回合。

每次網頁搜尋計為一次使用,無論回傳的結果數量多寡。若網頁搜尋過程中發生錯誤,該次網頁搜尋將不會計費。

網頁擷取工具

Web fetch(網頁擷取)的使用除標準 token 費用外沒有額外收費:

{
  "usage": {
    "input_tokens": 25039,
    "output_tokens": 931,
    "cache_read_input_tokens": 0,
    "cache_creation_input_tokens": 0,
    "server_tool_use": {
      "web_fetch_requests": 1
    }
  }
}

Web fetch 工具可在 Claude API 上使用,無需額外費用。您只需為成為對話上下文一部分的擷取內容支付標準 token 費用。

為防止無意間擷取會消耗過多 token 的大型內容,請使用 max_content_tokens 參數,根據您的使用情境與預算考量設定適當的限制。

典型內容的 token 使用量範例:

  • 一般網頁(10 kB):約 2,500 個 token
  • 大型文件頁面(100 kB):約 25,000 個 token
  • 研究論文 PDF(500 kB):約 125,000 個 token

電腦使用工具

電腦使用遵循標準的工具使用定價。使用電腦使用工具時:

工具集定義開銷: 宣告 computer_toolset_20260801 及其預設成員會為請求增加約 4,500 個輸入 token(在 Claude Fable 5、Claude Mythos 5、Claude Opus 5 和 Claude Opus 4.8 上約為 4,520 個,在 Claude Sonnet 5 上約為 4,590 個),其中涵蓋成員工具定義以及工具使用系統提示。使用 configs 停用 zoom 可移除其中約 410 個 token。請求的確切數量會在回應的 usage 中回報,您也可以透過 token 計數端點事先估算。

較早的工具版本: 以下數字適用於 computer_20251124 和 computer_20250124 工具版本,不適用於 computer_toolset_20260801:

  • 系統提示開銷:系統提示中增加 466–499 個 token
  • 工具定義:每個工具定義約 735 個輸入 token(以 computer_20250124 測量)

額外的 token 消耗:

  • 工具結果中回傳的螢幕截圖和縮放影像,以影像輸入計費(請參閱視覺定價)
  • 回傳給 Claude 的工具執行結果

瀏覽器使用工具

瀏覽器使用遵循標準的工具使用定價。使用瀏覽器使用工具時:

工具集定義開銷: 宣告 browser_toolset_20260801 及其預設成員會為請求增加約 6,600 個輸入 token(在 Claude Fable 5、Claude Mythos 5、Claude Opus 5 和 Claude Opus 4.8 上約為 6,610 個,在 Claude Sonnet 5 上約為 6,670 個),其中涵蓋成員工具定義以及工具使用系統提示。啟用全部四個選用成員會增加約 880 個 token,而使用 configs 停用成員則會減少數量。請求的確切數量會在回應的 usage 中回報,您也可以透過 token 計數端點事先估算。

額外的 token 消耗:

  • 工具結果中回傳的螢幕截圖與縮放影像,以影像輸入計費(請參閱視覺定價)
  • 回傳給 Claude 的文字工具結果,例如無障礙樹(accessibility tree)、頁面文字,以及主控台或網路項目

Claude Managed Agents 定價

Claude Managed Agents 依兩個維度計費:token 與工作階段執行時間。

Token

Claude Managed Agents 工作階段所消耗的所有 token 均依模型定價中所示的費率計費。提示快取倍率以相同方式套用。在工作階段內觸發的網頁搜尋會產生標準的每 1,000 次搜尋 $10 費用。在 Claude Platform on AWS 上,工作階段的 token 與執行時間費用會以標準比率換算為 Claude Consumption Units。當代理的 model.speed 設為 "fast" 時,會套用快速模式加價定價。

資料駐留倍率同樣適用:當代理的 model.inference_geo 固定為 "us" 時,執行該代理的工作階段所消耗的 token 會以標準費率的 1.1 倍計費,與 Messages API 上僅限美國推論所套用的倍率相同。

以下 Messages API 修正項不適用於 Claude Managed Agents 工作階段:

修正項不適用的原因
Batch API 折扣工作階段具有狀態且為互動式。沒有批次模式。
雲端平台定價不適用於由合作夥伴營運的雲端平台。

工作階段執行時間

SKU費率計量方式
工作階段執行時間每工作階段小時 $0.08running 狀態持續時間

執行時間以毫秒為單位計量,且僅在工作階段狀態為 running 時累計。處於 idle(等待您的下一則訊息或工具確認)、rescheduling 或 terminated 的時間不計入執行時間。

計算範例

一個使用 Claude Opus 5、消耗 50,000 個輸入 token 與 15,000 個輸出 token 的一小時程式開發工作階段:

明細項目計算方式費用
輸入 token50,000 × $5 / 1,000,000$0.25
輸出 token15,000 × $25 / 1,000,000$0.375
工作階段執行時間1.0 小時 × $0.08$0.08
總計$0.705

若提示快取已啟用,且其中 40,000 個輸入 token 為快取讀取:

明細項目計算方式費用
未快取的輸入 token10,000 × $5 / 1,000,000$0.05
快取讀取 token40,000 × $5 × 0.1 / 1,000,000$0.02
輸出 token15,000 × $25 / 1,000,000$0.375
工作階段執行時間1.0 小時 × $0.08$0.08
總計$0.525

如需此計算的詳細逐步說明,請參閱客服代理指南。

其他定價考量

成本最佳化策略

使用 Claude 建構代理時:

  1. 使用合適的模型:簡單任務選擇 Haiku,大多數正式環境工作負載選擇 Sonnet,最複雜的推理則選擇 Opus
  2. 實作提示快取:降低重複上下文的成本
  3. 批次作業:對於不具時效性的任務使用 Batch API
  4. 監控使用模式:追蹤 token 消耗量以找出最佳化機會

速率限制

速率限制依使用層級而異,並影響您可發出的請求數量:

  • Start 層級:適合入門的基礎限制
  • Build 層級:為成長中的應用程式提供更高的限制
  • Scale 層級:為正式環境工作負載提供最高的標準限制

如需詳細的速率限制資訊,請參閱速率限制。

如需超出 Scale 層級的限制或客製化定價方案,請聯絡銷售團隊。

大量折扣

高用量使用者可能享有大量折扣。這些折扣依個案協商。

企業定價

針對有特定需求的企業客戶:

  • 客製化速率限制
  • 大量折扣
  • 專屬支援
  • 客製化條款

請透過 sales@anthropic.com 或 Claude Console 聯絡銷售團隊,以討論企業定價選項。

帳務與付款

  • 依每月實際用量計費
  • 所有付款均以美元計價
  • 提供信用卡與開立發票選項
  • 可於 Claude Console 中追蹤用量

常見問題

token 用量如何計算?

token 是模型所處理的文字片段。粗略估計,1 個 token 約等於 4 個字元或 0.75 個英文單字。確切數量依語言與內容類型而異。

是否有免費層級或試用?

新使用者會獲得少量免費額度以測試 API。如需企業評估用的延長試用資訊,請聯絡銷售團隊。

折扣如何疊加?

Batch API 與提示快取折扣可以合併使用。例如,同時使用這兩項功能相較於標準 API 呼叫可大幅節省成本。請參閱提示快取定價以了解各倍率如何交互作用。

接受哪些付款方式?

標準帳戶接受主要信用卡。企業客戶可安排開立發票及其他付款方式。

如有其他關於定價的問題,請聯絡 support@anthropic.com。

Was this page helpful?