定價
了解 Anthropic 針對模型與功能的定價結構
本頁提供 Anthropic 模型與功能的詳細定價資訊。所有價格均以美元(USD)計價。
如需最新的定價資訊,請造訪 claude.com/pricing。
模型定價
下表顯示所有 Claude 模型的定價:
| Model | Base tokens | Prompt caching | |||
|---|---|---|---|---|---|
| Name | Input | Output | |||
Claude Fable 5.1For demanding reasoning and long-horizon agentic work | $10 / | $50 / MTok | $12.50 / MTok | $20 / MTok | / MTok |
Claude Opus 5.5For long-running agentic coding and knowledge work | $4 / MTok | $20 / MTok | $5 / MTok | $8 / MTok | / MTok |
Claude Sonnet 5The best combination of speed and intelligence | / MTok | / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok |
Claude Haiku 4.5The fastest model with near-frontier intelligence | $1 / MTok | $5 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok |
$10 / MTok | $50 / MTok | $12.50 / MTok | $20 / MTok | / MTok | |
$10 / MTok | $50 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | |
$10 / MTok | $50 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
Claude Opus 4.1 | $15 / MTok | $75 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok |
Claude Opus 4 | $15 / MTok | $75 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok |
$3 / MTok | $15 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | |
$3 / MTok | $15 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | |
Claude Sonnet 4 | $3 / MTok | $15 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok |
Claude Haiku 3.5 | $0.80 / MTok | $4 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok |
雲端平台定價
本節涵蓋由合作夥伴營運的雲端平台,由雲端供應商向您開立帳單。如需透過市集計費、由 Anthropic 營運的雲端平台,請參閱 Claude Platform on AWS 定價與 Claude in Microsoft Foundry 定價。
Claude 模型可於 Amazon Bedrock 與 Google Cloud 上使用。如需官方定價,請造訪:
Claude Platform on AWS 定價
Claude Platform on AWS 透過 AWS Marketplace 以 Claude Consumption Units(Claude 消費單位),即 CCU 計費。Anthropic 會依各模型、各功能的標準費率以美元計算您的 token 用量,套用任何議定的折扣,再以每 CCU $0.01 的比率將結果換算為 CCU,並每小時向 AWS Marketplace 回報 CCU 數量。您的 AWS 帳單會顯示單一 CCU 明細項目。
| 概念 | 詳細資訊 |
|---|---|
| 計費單位 | Claude Consumption Unit() |
| CCU 價格 | 每 CCU $0.01(固定;折扣套用於 token 換算為 CCU 的階段,而非 CCU 價格本身) |
| 換算方式 | token 用量依照各模型、各功能的標準費率以美元計算(與 Claude API 定價相同),再以每 CCU $0.01 換算為 CCU |
| 計費週期 | 每小時向 AWS Marketplace 計量;每月開立發票 |
| 付款模式 | 僅限後付(postpaid);不提供預付額度 |
| 折扣 | 以減少計量的 CCU 數量方式套用 |
| 稅金 | 以稅前金額計量;由 AWS Marketplace 處理稅金 |
| 成本可見性 | 在 Claude Console 中提供即時明細(透過 AWS Console 存取);AWS Cost Explorer 顯示彙總的 CCU |
推論地理位置
對於 Claude 4.6 及更新的模型,使用 inference_geo: "us" 會套用 1.1 倍的定價倍率。inference_geo: "global"(預設)使用標準定價。詳情請參閱資料駐留。
私人優惠
當您在 AWS Console 的 Claude Platform on AWS 服務頁面註冊時,AWS Console 會查詢與您帳戶相關聯的任何私人優惠(private offer),並提示您在 AWS Marketplace 中接受。如需私人優惠條款,請聯絡您的 Anthropic 客戶代表。
Claude in Microsoft Foundry 定價
Claude in Microsoft Foundry 透過 Azure Marketplace 以 Claude Consumption Units(CCU)計費。Anthropic 會依各模型、各功能的標準費率以美元計算您的 token 用量,套用任何議定的折扣,再以每 CCU $0.01 的比率將結果換算為 CCU,並每小時向 Azure Marketplace 回報 CCU 數量。您的 Azure 帳單會顯示單一 CCU 明細項目。
| 概念 | 詳細資訊 |
|---|---|
| 計費單位 | Claude Consumption Unit() |
| CCU 價格 | 每 CCU $0.01(固定;折扣套用於 token 換算為 CCU 的階段,而非 CCU 價格本身) |
| 換算方式 | token 用量依照各模型、各功能的標準費率以美元計算(與 Claude API 定價相同),再以每 CCU $0.01 換算為 CCU |
| 計費週期 | 每小時向 Azure Marketplace 計量;每月開立發票 |
| 付款模式 | 僅限後付(postpaid);不提供預付額度 |
| 折扣 | 以減少計量的 CCU 數量方式套用 |
| 稅金 | 以稅前金額計量;由 Azure Marketplace 處理稅金 |
| 成本可見性 | Azure Cost Management 顯示彙總的 CCU |
推論地理位置
託管於 Azure 的部署可使用 US Data Zone Standard 部署類型,將推論保留在美國境內。這等同於 Claude API 上的 inference_geo: "us",並套用相同的 1.1 倍定價倍率。詳情請參閱資料駐留。
功能專屬定價
提示快取
提示快取透過在多次 API 呼叫之間重複使用先前已處理的提示部分,來降低成本與 latency(延遲)。API 不必在每次請求時重新處理相同的大型系統提示、文件或對話歷史,而是以標準輸入價格的一小部分從快取中讀取。
啟用提示快取有兩種方式:
- 自動快取:在請求的最上層加入單一
cache_control欄位。系統會隨著對話增長自動管理快取斷點。這是大多數使用情境的建議起點。 - 明確快取斷點:將
cache_control直接放在個別內容區塊上,以精細控制確切要快取的內容。
提示快取使用以下相對於基本輸入 token 費率的定價倍率:
| 快取操作 | 倍率 | 持續時間 |
|---|---|---|
| 5 分鐘快取寫入 | 1.25 倍基本輸入價格 | 快取有效 5 分鐘 |
| 1 小時快取寫入 | 2 倍基本輸入價格 | 快取有效 1 小時 |
| 快取讀取(命中) | 0.1 倍基本輸入價格(Claude Fable 5.1 與 Claude Mythos 5.1 為 0.025 倍;Claude Opus 5.5 為 0.05 倍) | 與先前寫入的持續時間相同 |
快取寫入 token 會在內容首次儲存時計費。快取讀取 token 會在後續請求擷取快取內容時計費。快取命中的費用為標準輸入價格的 10%,這表示對於 5 分鐘的持續時間(1.25 倍寫入),快取在一次快取讀取後即可回本;對於 1 小時的持續時間(2 倍寫入),則在兩次快取讀取後回本。在 Claude Fable 5.1 與 Claude Mythos 5.1 上,快取命中的費用為標準輸入價格的 2.5%(每百萬 token 0.25 美元)。在 Claude Opus 5.5 上,快取命中的費用為標準輸入價格的 5%(每百萬 token 0.20 美元)。
這些倍率可與其他定價修正項疊加,包括 Batch API 折扣與資料駐留。
如需實作細節、支援的模型與程式碼範例,請參閱提示快取。
資料駐留定價
對於 Claude 4.6 及更新的模型,透過 inference_geo 參數指定僅限美國推論,會對所有 token 定價類別套用 1.1 倍的倍率,包括輸入 token、輸出 token、快取寫入與快取讀取。全球路由(預設)使用標準定價。
此規則適用於 Claude API(第一方)與 Claude Platform on AWS。在 Claude in Microsoft Foundry 上,相同的 1.1 倍倍率適用於使用 US Data Zone Standard 部署類型的部署(請參閱推論地理位置)。由合作夥伴營運的平台(Bedrock 與 Google Cloud)有獨立的區域定價。詳情請參閱 Bedrock 與 Google Cloud。較早的模型不支援 inference_geo 參數,且一律使用標準定價;在這些模型上包含該參數的請求會回傳 400 錯誤。
如需更多資訊,請參閱資料駐留。
快速模式定價
「Fast mode」(快速模式)目前為研究預覽,以溢價定價為 Claude Opus 5.5、Claude Opus 5、以及 Claude Opus 4.8 提供顯著更快的輸出。快速模式定價適用於整個「context window」(上下文視窗),包括超過 200k 輸入 token 的請求。快速模式僅在 Claude API(第一方)上提供;不適用於 Claude Platform on AWS 或由合作夥伴營運的雲端平台。
| 模型 | 輸入 | 輸出 |
|---|---|---|
| Claude Opus 5.5 | $8 / MTok | $40 / MTok |
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
快速模式不適用於 Claude Opus 4.7(帶有 speed: "fast" 的請求會回傳錯誤)或 Claude Opus 4.6(請求以標準速度執行並以標準費率計費)。請參閱快速模式。
快速模式定價可與其他定價修正項疊加:
快速模式無法與 Batch API 搭配使用。
如需更多資訊,請參閱快速模式。
批次處理
Batch API 允許以非同步方式處理大量請求,輸入與輸出 token 均享有 50% 折扣。
| Model | Batch tokens | |
|---|---|---|
| Name | Input | Output |
Claude Fable 5.1For demanding reasoning and long-horizon agentic work | $5 / | $25 / MTok |
Claude Opus 5.5For long-running agentic coding and knowledge work | $2 / MTok | $10 / MTok |
Claude Sonnet 5The best combination of speed and intelligence | $1 / MTok | $5 / MTok |
Claude Haiku 4.5The fastest model with near-frontier intelligence | $0.50 / MTok | $2.50 / MTok |
$5 / MTok | $25 / MTok | |
$5 / MTok | $25 / MTok | |
$5 / MTok | $25 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
Claude Opus 4.1 | $7.50 / MTok | $37.50 / MTok |
Claude Opus 4 | $7.50 / MTok | $37.50 / MTok |
$1.50 / MTok | $7.50 / MTok | |
$1.50 / MTok | $7.50 / MTok | |
Claude Sonnet 4 | $1.50 / MTok | $7.50 / MTok |
Claude Haiku 3.5 | $0.40 / MTok | $2 / MTok |
如需更多關於批次處理的資訊,請參閱批次處理。
長上下文定價
Claude 4.6 及更新的模型以及 Claude Mythos Preview 以標準定價包含完整的 1M token 上下文視窗。(900k token 的請求與 9k token 的請求以相同的每 token 費率計費。)提示快取與批次處理折扣在整個上下文視窗中以標準費率套用。
工具使用定價
工具使用(tool use)請求的計價依據如下:
- 傳送至模型的輸入 token 總數(包括
tools參數中的內容) - 產生的輸出 token 數量
- 對於伺服器端工具,另有依使用量計算的額外費用(例如,網頁搜尋依每次執行的搜尋計費)
用戶端工具的計價方式與任何其他 Claude API 請求相同,但伺服器端工具可能會依其特定使用情況產生額外費用。
工具使用所產生的額外 token 來自:
- API 請求中的
tools參數(工具名稱、描述與結構描述) - API 請求與回應中的
tool_use內容區塊 - API 請求中的
tool_result內容區塊
當您使用 tools 時,API 也會自動為模型加入一段特殊的系統提示(system prompt),以啟用工具使用功能。下表列出了每個模型所需的工具使用 token 數量(不包括前述的額外 token)。請注意,此表假設至少提供了 1 個工具。若未提供任何 tools,則工具選擇為 none 時會使用 0 個額外的系統提示 token。
| Model | Tool use system prompt tokens | |
|---|---|---|
| Name | Token count | |
Claude Opus 5.5For long-running agentic coding and knowledge work | auto, none | 286 tokens |
Claude Sonnet 5The best combination of speed and intelligence | auto, none | 354 tokens |
any, tool | 474 tokens | |
Claude Haiku 4.5The fastest model with near-frontier intelligence | auto, none | 496 tokens |
any, tool | 588 tokens | |
auto, none | 286 tokens | |
any, tool | 406 tokens | |
auto, none | 290 tokens | |
any, tool | 410 tokens | |
auto, none | 675 tokens | |
any, tool | 804 tokens | |
auto, none | 497 tokens | |
any, tool | 589 tokens | |
auto, none | 496 tokens | |
any, tool | 588 tokens | |
Claude Opus 4.1 | auto, none | 313 tokens |
any, tool | 315 tokens | |
Claude Opus 4 | auto, none | 313 tokens |
any, tool | 315 tokens | |
auto, none | 497 tokens | |
any, tool | 589 tokens | |
auto, none | 496 tokens | |
any, tool | 588 tokens | |
Claude Sonnet 4 | auto, none | 313 tokens |
any, tool | 315 tokens | |
Claude Haiku 3.5 | auto, none | 264 tokens |
any, tool | 355 tokens | |
這些 token 數量會加到您一般的輸入與輸出 token 中,以計算請求的總費用。
如需目前各模型的價格,請參閱模型定價一節。
如需更多關於工具使用實作與最佳實務的資訊,請參閱工具使用。
特定工具定價
Bash 工具
bash 工具定義會為您的請求增加以下輸入 token。這是在每個模型的工具使用系統提示之外額外增加的,只要存在任何工具,該系統提示便會適用。
| 模型 | 額外輸入 token |
|---|---|
| Claude Opus 5、Claude Opus 4.8 與 Claude Opus 4.7 | 325 個 token |
| Claude Opus 4.6、Claude Sonnet 4.6 及更早版本 | 244 個 token |
以下項目會消耗額外的 token:
- 指令輸出(stdout/stderr)
- 錯誤訊息
- 大型檔案內容
請參閱工具使用定價以了解完整的定價細節。
程式碼執行工具
與網頁搜尋或網頁擷取搭配使用時,程式碼執行是免費的。 當您的 API 請求中包含 web_search_20260209(或更新版本)或 web_fetch_20260209(或更新版本)時,除了標準的輸入與輸出 token 費用之外,程式碼執行工具呼叫不會產生額外費用。
若未搭配這些工具使用,程式碼執行將依執行時間計費,並與 token 用量分開追蹤:
- 執行時間最少以 5 分鐘計算
- 每個組織每月可獲得 1,550 小時的免費用量
- 超過 1,550 小時的額外用量,將以每個容器每小時 $0.05 美元計費
- 若請求中包含檔案,即使未呼叫該工具,仍會依執行時間計費,因為檔案會預先載入至容器中
程式碼執行用量會在回應中追蹤:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}文字編輯器工具
文字編輯器工具採用與其他搭配 Claude 使用的工具相同的定價結構。它依據您所使用的 Claude 模型,遵循標準的輸入與輸出 token 定價。
除了基本 token 之外,文字編輯器工具還需要以下額外的輸入 token:
| 工具 | 額外輸入 token |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 個 token |
請參閱工具使用定價以了解完整的定價細節。
網頁搜尋工具
除了 token 用量之外,網頁搜尋的使用也會另外計費:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}網頁搜尋在 Claude API 上的價格為每 1,000 次搜尋 $10 美元,另加搜尋所產生內容的標準 token 費用。在整個對話過程中擷取的網頁搜尋結果會計為 input tokens(輸入 token),包括在單一回合中執行的搜尋迭代,以及後續的對話回合。
每次網頁搜尋計為一次使用,無論回傳的結果數量多寡。若網頁搜尋過程中發生錯誤,該次網頁搜尋將不會計費。
網頁擷取工具
Web fetch(網頁擷取)的使用除標準 token 費用外沒有額外收費:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}Web fetch 工具可在 Claude API 上使用,無需額外費用。您只需為成為對話上下文一部分的擷取內容支付標準 token 費用。
為防止無意間擷取會消耗過多 token 的大型內容,請使用 max_content_tokens 參數,根據您的使用情境與預算考量設定適當的限制。
典型內容的 token 使用量範例:
- 一般網頁(10 kB):約 2,500 個 token
- 大型文件頁面(100 kB):約 25,000 個 token
- 研究論文 PDF(500 kB):約 125,000 個 token
電腦使用工具
電腦使用遵循標準的工具使用定價。使用電腦使用工具時:
工具集定義開銷: 宣告 computer_toolset_20260801 及其預設成員會為請求增加約 4,500 個輸入 token(在 Claude Fable 5、Claude Mythos 5、Claude Opus 5 和 Claude Opus 4.8 上約為 4,520 個,在 Claude Sonnet 5 上約為 4,590 個),其中涵蓋成員工具定義以及工具使用系統提示。使用 configs 停用 zoom 可移除其中約 410 個 token。請求的確切數量會在回應的 usage 中回報,您也可以透過 token 計數端點事先估算。
較早的工具版本: 以下數字適用於 computer_20251124 和 computer_20250124 工具版本,不適用於 computer_toolset_20260801:
- 系統提示開銷:系統提示中增加 466–499 個 token
- 工具定義:每個工具定義約 735 個輸入 token(以
computer_20250124測量)
額外的 token 消耗:
- 工具結果中回傳的螢幕截圖和縮放影像,以影像輸入計費(請參閱視覺定價)
- 回傳給 Claude 的工具執行結果
瀏覽器使用工具
瀏覽器使用遵循標準的工具使用定價。使用瀏覽器使用工具時:
工具集定義開銷: 宣告 browser_toolset_20260801 及其預設成員會為請求增加約 6,600 個輸入 token(在 Claude Fable 5、Claude Mythos 5、Claude Opus 5 和 Claude Opus 4.8 上約為 6,610 個,在 Claude Sonnet 5 上約為 6,670 個),其中涵蓋成員工具定義以及工具使用系統提示。啟用全部四個選用成員會增加約 880 個 token,而使用 configs 停用成員則會減少數量。請求的確切數量會在回應的 usage 中回報,您也可以透過 token 計數端點事先估算。
額外的 token 消耗:
- 工具結果中回傳的螢幕截圖與縮放影像,以影像輸入計費(請參閱視覺定價)
- 回傳給 Claude 的文字工具結果,例如無障礙樹(accessibility tree)、頁面文字,以及主控台或網路項目
Claude Managed Agents 定價
Claude Managed Agents 依兩個維度計費:token 與工作階段執行時間。
Token
Claude Managed Agents 工作階段所消耗的所有 token 均依模型定價中所示的費率計費。提示快取倍率以相同方式套用。在工作階段內觸發的網頁搜尋會產生標準的每 1,000 次搜尋 $10 費用。在 Claude Platform on AWS 上,工作階段的 token 與執行時間費用會以標準比率換算為 Claude Consumption Units。當代理的 model.speed 設為 "fast" 時,會套用快速模式加價定價。
資料駐留倍率同樣適用:當代理的 model.inference_geo 固定為 "us" 時,執行該代理的工作階段所消耗的 token 會以標準費率的 1.1 倍計費,與 Messages API 上僅限美國推論所套用的倍率相同。
以下 Messages API 修正項不適用於 Claude Managed Agents 工作階段:
| 修正項 | 不適用的原因 |
|---|---|
| Batch API 折扣 | 工作階段具有狀態且為互動式。沒有批次模式。 |
| 雲端平台定價 | 不適用於由合作夥伴營運的雲端平台。 |
工作階段執行時間
| SKU | 費率 | 計量方式 |
|---|---|---|
| 工作階段執行時間 | 每工作階段小時 $0.08 | running 狀態持續時間 |
執行時間以毫秒為單位計量,且僅在工作階段狀態為 running 時累計。處於 idle(等待您的下一則訊息或工具確認)、rescheduling 或 terminated 的時間不計入執行時間。
計算範例
一個使用 Claude Opus 5、消耗 50,000 個輸入 token 與 15,000 個輸出 token 的一小時程式開發工作階段:
| 明細項目 | 計算方式 | 費用 |
|---|---|---|
| 輸入 token | 50,000 × $5 / 1,000,000 | $0.25 |
| 輸出 token | 15,000 × $25 / 1,000,000 | $0.375 |
| 工作階段執行時間 | 1.0 小時 × $0.08 | $0.08 |
| 總計 | $0.705 |
若提示快取已啟用,且其中 40,000 個輸入 token 為快取讀取:
| 明細項目 | 計算方式 | 費用 |
|---|---|---|
| 未快取的輸入 token | 10,000 × $5 / 1,000,000 | $0.05 |
| 快取讀取 token | 40,000 × $5 × 0.1 / 1,000,000 | $0.02 |
| 輸出 token | 15,000 × $25 / 1,000,000 | $0.375 |
| 工作階段執行時間 | 1.0 小時 × $0.08 | $0.08 |
| 總計 | $0.525 |
如需此計算的詳細逐步說明,請參閱客服代理指南。
其他定價考量
成本最佳化策略
使用 Claude 建構代理時:
- 使用合適的模型:簡單任務選擇 Haiku,大多數正式環境工作負載選擇 Sonnet,最複雜的推理則選擇 Opus
- 實作提示快取:降低重複上下文的成本
- 批次作業:對於不具時效性的任務使用 Batch API
- 監控使用模式:追蹤 token 消耗量以找出最佳化機會
速率限制
速率限制依使用層級而異,並影響您可發出的請求數量:
- Start 層級:適合入門的基礎限制
- Build 層級:為成長中的應用程式提供更高的限制
- Scale 層級:為正式環境工作負載提供最高的標準限制
如需詳細的速率限制資訊,請參閱速率限制。
如需超出 Scale 層級的限制或客製化定價方案,請聯絡銷售團隊。
大量折扣
高用量使用者可能享有大量折扣。這些折扣依個案協商。
企業定價
針對有特定需求的企業客戶:
- 客製化速率限制
- 大量折扣
- 專屬支援
- 客製化條款
請透過 sales@anthropic.com 或 Claude Console 聯絡銷售團隊,以討論企業定價選項。
帳務與付款
- 依每月實際用量計費
- 所有付款均以美元計價
- 提供信用卡與開立發票選項
- 可於 Claude Console 中追蹤用量
常見問題
token 用量如何計算?
token 是模型所處理的文字片段。粗略估計,1 個 token 約等於 4 個字元或 0.75 個英文單字。確切數量依語言與內容類型而異。
是否有免費層級或試用?
新使用者會獲得少量免費額度以測試 API。如需企業評估用的延長試用資訊,請聯絡銷售團隊。
折扣如何疊加?
Batch API 與提示快取折扣可以合併使用。例如,同時使用這兩項功能相較於標準 API 呼叫可大幅節省成本。請參閱提示快取定價以了解各倍率如何交互作用。
接受哪些付款方式?
標準帳戶接受主要信用卡。企業客戶可安排開立發票及其他付款方式。
如有其他關於定價的問題,請聯絡 support@anthropic.com。
Was this page helpful?