Claude Platform Docs
模型與定價Claude Sonnet 5

Claude Sonnet 5 的新功能

Claude Sonnet 5 新功能與行為變更概覽。

Claude Sonnet 5 是 Anthropic Sonnet 模型家族的下一代產品。它是 Claude Sonnet 4.6 的直接替換升級版本,具有三項行為變更:adaptive thinking(自適應思考)預設為開啟;手動「extended thinking」(擴展思考)現在會回傳 400 錯誤(它在 Claude Sonnet 4.6 上已被棄用);將取樣參數(temperaturetop_ptop_k)設為非預設值會回傳 400 錯誤。本頁彙整了發布時的所有新內容,包括新的 tokenizer(分詞器)。

新模型

模型API 模型 ID說明
Claude Sonnet 5claude-sonnet-5速度與智慧的最佳組合

Claude Sonnet 5 預設支援 1M token 上下文視窗(1M tokens 既是預設值也是最大值;沒有較小的上下文變體)、128k 最大輸出 tokens、自適應思考,以及與 Claude Sonnet 4.6 相同的工具與平台功能集,但 Priority Tier 除外,該功能在 Claude Sonnet 5 上不可用。在 Claude API 與 Google Cloud 上,Claude Sonnet 5 也支援 browser use tool(瀏覽器使用工具)以及 computer use tool(電腦使用工具)的穩定版本 computer_toolset_20260801,這兩者 Claude Sonnet 4.6 皆不支援;較早的 computer_20251124 版本在兩個模型上仍可接受。若要升級現有整合,請參閱computer_20251124 遷移

完整定價與規格請參閱模型概覽

行為變更

自適應思考預設開啟

在 Claude Sonnet 4.6 上,不含 thinking 欄位的請求會在不思考的情況下執行。在 Claude Sonnet 5 上,相同的請求會以自適應思考執行。若要關閉思考,請傳入 thinking: {type: "disabled"}。由於 max_tokens 是總輸出(思考加上回應文字)的硬性上限,對於在 Claude Sonnet 4.6 上不使用思考執行的工作負載,請重新檢視此設定。

不接受取樣參數

temperaturetop_ptop_k 設為非預設值會回傳 400 錯誤。遷移時請移除這些參數;預設值(或省略該參數)是可接受的。請使用系統提示指令來引導模型行為。這對 Sonnet 等級的模型而言是新的限制;相同的限制先前已在 Claude Opus 4.7 上引入。

移除手動擴展思考

手動擴展思考(thinking: {type: "enabled", budget_tokens: N})在 Claude Sonnet 4.6 上已被棄用;在 Claude Sonnet 5 上它已被移除並會回傳 400 錯誤,與 Claude Opus 4.8 和 Claude Opus 4.7 相同。請改用搭配 effort 參數的自適應思考。

# Claude Sonnet 5 不支援(會回傳 400)
thinking = {"type": "enabled", "budget_tokens": 32000}

# 請改用此方式
thinking = {"type": "adaptive"}

新的 tokenizer

Claude Sonnet 5 使用新的 tokenizer。相同的輸入文字所產生的 tokens 比在 Claude Sonnet 4.6 上多約 30%。確切的增幅取決於內容。這並非 API 變更:請求、回應與串流事件維持相同的結構,無需修改任何程式碼。

此變更會影響您以 tokens 衡量或編列預算的任何項目:

  • **Token 計數:**相同文字的 usage 欄位與 token counting(token 計數)結果會比在 Claude Sonnet 4.6 上更高。請勿重複使用針對較早模型所測得的計數;請針對 Claude Sonnet 5 重新計數。
  • **以文字量衡量的上下文視窗容量:**上下文視窗為 1M tokens,但每個 token 平均涵蓋的文字較少,因此相同的視窗所能容納的文字比 Claude Sonnet 4.6 少。
  • **max_tokens 預算:**針對 Claude Sonnet 4.6 調校的輸出上限,在 Claude Sonnet 5 上可能會截斷等量的輸出。請重新檢視設定值接近您預期輸出長度的上限。
  • **每次請求成本:**每 token 定價低於 Claude Sonnet 4.6(請參閱定價),但由於相同文字會產生更多 tokens,等效請求的成本並不會按相同比例直接下降。

沿襲自 Claude Sonnet 4.6 的 API 限制

不支援助理訊息預填

預填助理訊息會回傳 400 錯誤,與 Claude Sonnet 4.6 相同。請改用 structured outputs(結構化輸出)、系統提示指令或 output_config.format

能力提升

Claude Sonnet 5 是相較於 Claude Sonnet 4.6 的能力升級版本,且價格更低。對於需要比 Claude Sonnet 4.6 更強能力、但又不想改用 Opus 等級模型的工作負載而言,它也是一個選項。

相較於 Claude Sonnet 4.6,最大的進步在於程式編寫與代理任務。基準測試結果請參閱 Anthropic 的 Transparency Hub

網路安全防護措施

Claude Sonnet 5 是第一個具備即時網路安全防護措施的 Sonnet 等級模型。涉及禁止或高風險網路安全主題的請求可能會被拒絕。拒絕會以成功的 HTTP 200 回應並帶有 stop_reason: "refusal" 的形式回傳,而非錯誤。關於防護措施會阻擋哪些內容,以及合法的安全工作如何申請 Cyber Verification Program,請參閱 Claude Opus 與 Sonnet 上的即時網路安全防護措施

定價

Claude Sonnet 5 的定價為每百萬輸入 tokens $2、每百萬輸出 tokens $10,每 token 定價低於 Claude Sonnet 4.6 的 $3/$15。由於新的 tokenizer 對相同文字會產生多約 30% 的 tokens,與 Claude Sonnet 4.6 相比時,等效請求的成本並不會按每 token 價格的比例直接下降。確切的差異取決於內容與工作負載型態。

完整定價(包括批次處理與提示快取費率)請參閱定價

可用性

發布時,Claude Sonnet 5 可於下列平台使用:

Claude Sonnet 5 為簽有 ZDR 協議的組織支援 zero data retention(零資料保留)。

遷移指南

Claude Sonnet 5 是 Claude Sonnet 4.6 的直接替換版本。請更新您的模型 ID:

model = "claude-sonnet-4-6"  # Before
model = "claude-sonnet-5"  # After

接著請檢視下列事項:

  1. Token 預算與計數:新的 tokenizer 對相同文字會產生多約 30% 的 tokens。確切的增幅取決於內容與工作負載型態。請使用 token 計數重新計算提示,並重新檢視設定值接近您預期輸出長度的 max_tokens 上限。
  2. **擴展思考:**如果您仍在設定 budget_tokens,請遷移至自適應思考。手動擴展思考(thinking: {type: "enabled"})不受支援,並會回傳 400 錯誤。
  3. **取樣參數:**將取樣參數(temperaturetop_ptop_k)設為非預設值的請求會回傳 400 錯誤;遷移時請將其移除。工具定義與回應結構維持不變,而助理訊息預填在 Claude Sonnet 4.6 上原本就已不受支援。

詳情請參閱從 Claude Sonnet 4.6 遷移至 Claude Sonnet 5

後續步驟

所有現行 Claude 模型的完整規格與定價。

在遷移之前,先以新的 tokenizer 衡量您的提示。

Claude Sonnet 5 上建議使用的思考開啟模式。

1M token 上下文視窗的運作方式。

完整定價,包括批次處理與提示快取費率。

Was this page helpful?