Claude Opus 5 的新功能
Claude Opus 5 新功能與行為變更概覽。
Claude Opus 5 相較於 Claude Opus 4.8 是一次跨越式的改進,在深度推理、代理式與長時程任務,以及測試時運算擴展方面的提升最為顯著。本頁彙整了 Claude Opus 5 的所有新內容,包括對話中途工具變更,以及兩項會影響在 Claude Opus 4.8 上執行之程式碼的重大變更:思考預設為開啟,且僅能在 effort 為 high 或以下時停用思考。
新模型
| 模型 | API 模型 ID | 說明 |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | 適用於複雜的代理式程式開發與企業工作 |
Claude Opus 5 具備 1M token 的「context window」(上下文視窗)(1M tokens 同時是預設值與最大值;沒有較小的上下文變體)、128k 最大輸出 tokens,以及預設開啟的思考。Claude Opus 5 不支援 Priority Tier。
如需完整的定價與規格,請參閱模型概覽。
新功能
對話中途工具變更(beta)
您可以在對話的各輪之間新增或移除工具,同時保留提示快取,而不必在整個工作階段期間重複傳送固定的工具清單。對話中途工具變更目前為 beta 版:請在您的請求中加入 mid-conversation-tool-changes-2026-07-01 beta 標頭。使用方式請參閱對話中途工具變更。
預設 fallbacks 模式
fallbacks 參數支援新的 "default" 模式,會依拒絕類別套用 Anthropic 建議的備援模型,而非由您自行維護的模型清單。整個 fallbacks 參數目前為 beta 版。請使用 server-side-fallback-2026-07-01 beta 標頭,它同時支援 "default" 模式與明確的模型清單(較早的 server-side-fallback-2026-06-01 標頭僅接受明確清單)。請參閱拒絕與備援。
更低的提示快取下限
Claude Opus 5 上可快取的最小提示長度為 512 tokens,低於 Claude Opus 4.8 的 1,024 tokens。在 Claude Opus 4.8 上因過短而無法快取的提示,現在無需修改任何程式碼即可建立快取項目。各模型的下限請參閱「prompt caching」(提示快取)。
快速模式
快速模式(研究預覽)僅在 Claude API 上提供給 Claude Opus 5;目前尚未在 Amazon Bedrock、Claude Platform on AWS、Google Cloud 或 Microsoft Foundry 上提供。Claude Opus 5 的快速模式定價為每百萬輸入 tokens 10 美元、每百萬輸出 tokens 50 美元。存取方式、支援的模型與定價請參閱快速模式。
行為變更
思考預設為開啟
在 Claude Opus 4.8 上,除非您設定 thinking: {"type": "adaptive"},否則請求會在不思考的情況下執行。在 Claude Opus 5 上,相同的請求預設會以自適應思考執行:模型會在每一輪自行決定何時思考以及思考多少,而 effort 參數則是控制思考深度的手段。傳輸值並未改變;thinking: {"type": "adaptive"} 仍然有效,且等同於預設值。
對於在 Claude Opus 4.8 上不使用思考執行的程式碼而言,這是一項重大變更。回應可能會在第一個 text 區塊之前以一個或多個 thinking 區塊開頭,且在預設的 display: "omitted" 下會以空的 thinking 欄位回傳,因此讀取 content[0].text 或將第一個串流內容區塊視為文字的程式碼,必須改為依 type 欄位選取內容區塊。工具使用迴圈必須將 thinking 區塊連同其工具結果完整且未經修改地傳回;請參閱保留思考區塊。
思考 tokens 會以輸出 tokens 計費,並計入 max_tokens——這是總輸出(思考加上回應文字)的硬性上限,因此對於在 Claude Opus 4.8 上不使用思考執行的工作負載,請重新檢視 max_tokens 並重新建立成本基準。
API 保留了停用思考的選項,但須遵守停用思考的 effort 限制。
Effort 更加重要
Claude Opus 5 比任何先前的 Opus 模型都更可靠地將額外的 effort 轉化為更好的結果,因此您選擇的 effort 等級影響更大。完整的階梯皆可使用:low、medium、high、xhigh 與 max,其中 max 是最高層級,可進行最深入的推理。請從預設值 high 開始,並根據您的評估結果向任一方向調整:在品質維持不變的情況下調低以節省 tokens 與延遲,或針對最嚴苛的工作調高。以 xhigh 或 max effort 執行時,請設定較大的 max_tokens,讓模型有足夠空間在子代理與工具呼叫之間進行思考與行動。
以下請求將 effort 一路調高至 max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)思考在 Claude Opus 5 上預設為開啟,因此不需要 thinking 欄位。
停用思考需要 effort 為 high 或以下
在 Claude Opus 5 上,僅當 effort 等級為 high 或以下時才接受 thinking: {"type": "disabled"}。在 effort 為 xhigh 或 max 時設定 thinking: {"type": "disabled"} 會回傳 400 錯誤。此規則會對 Claude Opus 5 及後續模型的每個請求強制執行。這是相對於 Claude Opus 4.8 的重大變更,在 Claude Opus 4.8 上停用思考與 effort 等級無關。如果您的 Claude Opus 4.8 請求在 effort 為 xhigh 或 max 時停用思考,請保持停用思考並將 effort 設為 high 或以下,或保留 effort 等級並移除 thinking 欄位。
在停用思考的情況下,Claude Opus 5 偶爾可能會將工具呼叫寫入其文字輸出中,而非發出 tool_use 區塊,或在其可見回應中包含內部 XML 標籤。請盡可能保持思考開啟,並以較低的 effort 等級控制 token 成本;對於必須保持停用思考的整合,請參閱在停用思考的情況下執行以了解提示層面的緩解方法。
模型行為差異
除了這些 API 變更之外,Claude Opus 5 的行為也與 Claude Opus 4.8 有所不同,即使您不修改任何程式碼也可能會注意到。預設的面向使用者回應與書面交付成果篇幅更長。在代理式工作階段中,模型會更頻繁地向使用者敘述其進度。在多代理框架中,它更樂於委派給子代理。它也會在未被要求的情況下驗證自己的工作,因此請移除從先前模型沿用下來的驗證指示(「加入最終驗證步驟」、「使用子代理進行驗證」);這些指示會導致 Claude Opus 5 過度驗證。如需調整上述各項行為的提示模式,請參閱提示 Claude Opus 5。
能力提升
與 Claude Opus 4.8 相比,Claude Opus 5 是一次跨越式而非漸進式的改進,並以 Claude Fable 5 一半的成本提供前沿智慧。提升最大的領域包括:
- 深度推理,能在長問題鏈中持續進行多步驟分析。
- 代理式程式開發與長時程任務,能在長時間的工具使用迴圈中保持專注於任務,並完成多檔案功能、較大規模的重構以及端到端的功能開發,而不留下空殼或佔位符。
- 測試時運算擴展,能將額外的 effort(最高至
max等級)轉化為更好的結果。 - 較低 effort 等級下的效率,
low與mediumeffort 能以較高設定一小部分的 tokens 與延遲產出優異的品質。 - 程式碼審查與找錯,每次審查都能以高比率找出真正的錯誤且誤報極少,並在較低 effort 等級下仍保持準確。
- 視覺,能理解圖表、文件與示意圖,並重現 UI 與前端視覺效果;在獲得可反覆分析、裁切與驗證其工作的工具時表現最佳。
- 長上下文工作,具備 1M token 上下文視窗作為預設值與最大值,並在整個視窗範圍內維持一致的指令遵循、工具呼叫與推理能力。
- 辦公與文件任務,能產生並編輯包含非簡單公式的複雜多工作表試算表,並製作結構良好的簡報。
- 多代理協調,能以有效的撰寫者—驗證者模式運作子代理團隊,且代理彼此覆寫工作的情況極少。
如需能充分發揮這些能力的提示模式,請參閱提示 Claude Opus 5。
定價
Claude Opus 5 的定價為每百萬輸入 tokens 5 美元、每百萬輸出 tokens 25 美元,與 Claude Opus 4.8 相同。由於思考預設為開啟,且思考 tokens 以輸出 tokens 計費,在 Claude Opus 4.8 上不使用思考執行的工作負載,在相同的每 token 費率下,每個請求可能會產生更多輸出 tokens;請參閱成本控制。
完整定價(包括批次處理、提示快取與快速模式費率)請參閱定價。
可用性
Claude Opus 5 可於以下平台使用:
- Claude API: 以
claude-opus-5提供給所有客戶。 - AWS: 透過 Claude in Amazon Bedrock 以
anthropic.claude-opus-5提供,並透過 Claude Platform on AWS 提供。在 Amazon Bedrock 上,Claude Opus 5 也可透過bedrock-runtime上的InvokeModelAPI 存取,由相同的基礎設施提供服務;Claude on Amazon Bedrock(舊版)整合並未將其納入其 ARN 版本化模型 ID 表中。 - Google Cloud: 透過 Claude on Google Cloud 以
claude-opus-5提供。 - Microsoft Foundry: 透過 Claude in Microsoft Foundry 提供。
Claude Opus 4.8 在上述所有平台上仍然可用。
遷移指南
若要從 Claude Opus 4.8 遷移,請更新您的模型 ID:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # After接著請檢視行為變更下的兩項重大變更:思考預設為開啟(回應可能以 thinking 區塊開頭,因此請依 type 選取內容區塊),以及在 effort 為 xhigh 或 max 時停用思考會回傳 400 錯誤。逐步說明與完整檢查清單請參閱遷移指南。
後續步驟
Was this page helpful?