Claude Platform Docs
模型與定價Claude Opus 5

Claude Opus 5 的新功能

Claude Opus 5 新功能與行為變更概覽。

Claude Opus 5 相較於 Claude Opus 4.8 是一次跨越式的改進,在深度推理、代理式與長時程任務,以及測試時運算擴展方面的提升最為顯著。本頁彙整了 Claude Opus 5 的所有新內容,包括對話中途工具變更,以及兩項會影響在 Claude Opus 4.8 上執行之程式碼的重大變更:思考預設為開啟,且僅能在 effort 為 high 或以下時停用思考。

新模型

模型API 模型 ID說明
Claude Opus 5claude-opus-5適用於複雜的代理式程式開發與企業工作

Claude Opus 5 具備 1M token 的「context window」(上下文視窗)(1M tokens 同時是預設值與最大值;沒有較小的上下文變體)、128k 最大輸出 tokens,以及預設開啟的思考。Claude Opus 5 不支援 Priority Tier

如需完整的定價與規格,請參閱模型概覽

新功能

對話中途工具變更(beta)

您可以在對話的各輪之間新增或移除工具,同時保留提示快取,而不必在整個工作階段期間重複傳送固定的工具清單。對話中途工具變更目前為 beta 版:請在您的請求中加入 mid-conversation-tool-changes-2026-07-01 beta 標頭。使用方式請參閱對話中途工具變更

預設 fallbacks 模式

fallbacks 參數支援新的 "default" 模式,會依拒絕類別套用 Anthropic 建議的備援模型,而非由您自行維護的模型清單。整個 fallbacks 參數目前為 beta 版。請使用 server-side-fallback-2026-07-01 beta 標頭,它同時支援 "default" 模式與明確的模型清單(較早的 server-side-fallback-2026-06-01 標頭僅接受明確清單)。請參閱拒絕與備援

更低的提示快取下限

Claude Opus 5 上可快取的最小提示長度為 512 tokens,低於 Claude Opus 4.8 的 1,024 tokens。在 Claude Opus 4.8 上因過短而無法快取的提示,現在無需修改任何程式碼即可建立快取項目。各模型的下限請參閱「prompt caching」(提示快取)

快速模式

快速模式(研究預覽)僅在 Claude API 上提供給 Claude Opus 5;目前尚未在 Amazon Bedrock、Claude Platform on AWS、Google Cloud 或 Microsoft Foundry 上提供。Claude Opus 5 的快速模式定價為每百萬輸入 tokens 10 美元、每百萬輸出 tokens 50 美元。存取方式、支援的模型與定價請參閱快速模式

行為變更

思考預設為開啟

在 Claude Opus 4.8 上,除非您設定 thinking: {"type": "adaptive"},否則請求會在不思考的情況下執行。在 Claude Opus 5 上,相同的請求預設會以自適應思考執行:模型會在每一輪自行決定何時思考以及思考多少,而 effort 參數則是控制思考深度的手段。傳輸值並未改變;thinking: {"type": "adaptive"} 仍然有效,且等同於預設值。

對於在 Claude Opus 4.8 上不使用思考執行的程式碼而言,這是一項重大變更。回應可能會在第一個 text 區塊之前以一個或多個 thinking 區塊開頭,且在預設的 display: "omitted" 下會以空的 thinking 欄位回傳,因此讀取 content[0].text 或將第一個串流內容區塊視為文字的程式碼,必須改為依 type 欄位選取內容區塊。工具使用迴圈必須將 thinking 區塊連同其工具結果完整且未經修改地傳回;請參閱保留思考區塊

思考 tokens 會以輸出 tokens 計費,並計入 max_tokens——這是總輸出(思考加上回應文字)的硬性上限,因此對於在 Claude Opus 4.8 上不使用思考執行的工作負載,請重新檢視 max_tokens 並重新建立成本基準。

API 保留了停用思考的選項,但須遵守停用思考的 effort 限制

Effort 更加重要

Claude Opus 5 比任何先前的 Opus 模型都更可靠地將額外的 effort 轉化為更好的結果,因此您選擇的 effort 等級影響更大。完整的階梯皆可使用:lowmediumhighxhighmax,其中 max 是最高層級,可進行最深入的推理。請從預設值 high 開始,並根據您的評估結果向任一方向調整:在品質維持不變的情況下調低以節省 tokens 與延遲,或針對最嚴苛的工作調高。以 xhighmax effort 執行時,請設定較大的 max_tokens,讓模型有足夠空間在子代理與工具呼叫之間進行思考與行動。

以下請求將 effort 一路調高至 max

client = anthropic.Anthropic()

with client.messages.stream(
    model="claude-opus-5",
    max_tokens=64000,
    output_config={"effort": "max"},
    messages=[
        {
            "role": "user",
            "content": "Explain why the sum of two even numbers is always even.",
        }
    ],
) as stream:
    response = stream.get_final_message()

print(response)

思考在 Claude Opus 5 上預設為開啟,因此不需要 thinking 欄位。

停用思考需要 effort 為 high 或以下

在 Claude Opus 5 上,僅當 effort 等級為 high 或以下時才接受 thinking: {"type": "disabled"}。在 effort 為 xhighmax 時設定 thinking: {"type": "disabled"} 會回傳 400 錯誤。此規則會對 Claude Opus 5 及後續模型的每個請求強制執行。這是相對於 Claude Opus 4.8 的重大變更,在 Claude Opus 4.8 上停用思考與 effort 等級無關。如果您的 Claude Opus 4.8 請求在 effort 為 xhighmax 時停用思考,請保持停用思考並將 effort 設為 high 或以下,或保留 effort 等級並移除 thinking 欄位。

在停用思考的情況下,Claude Opus 5 偶爾可能會將工具呼叫寫入其文字輸出中,而非發出 tool_use 區塊,或在其可見回應中包含內部 XML 標籤。請盡可能保持思考開啟,並以較低的 effort 等級控制 token 成本;對於必須保持停用思考的整合,請參閱在停用思考的情況下執行以了解提示層面的緩解方法。

模型行為差異

除了這些 API 變更之外,Claude Opus 5 的行為也與 Claude Opus 4.8 有所不同,即使您不修改任何程式碼也可能會注意到。預設的面向使用者回應與書面交付成果篇幅更長。在代理式工作階段中,模型會更頻繁地向使用者敘述其進度。在多代理框架中,它更樂於委派給子代理。它也會在未被要求的情況下驗證自己的工作,因此請移除從先前模型沿用下來的驗證指示(「加入最終驗證步驟」、「使用子代理進行驗證」);這些指示會導致 Claude Opus 5 過度驗證。如需調整上述各項行為的提示模式,請參閱提示 Claude Opus 5

能力提升

與 Claude Opus 4.8 相比,Claude Opus 5 是一次跨越式而非漸進式的改進,並以 Claude Fable 5 一半的成本提供前沿智慧。提升最大的領域包括:

  • 深度推理,能在長問題鏈中持續進行多步驟分析。
  • 代理式程式開發與長時程任務,能在長時間的工具使用迴圈中保持專注於任務,並完成多檔案功能、較大規模的重構以及端到端的功能開發,而不留下空殼或佔位符。
  • 測試時運算擴展,能將額外的 effort(最高至 max 等級)轉化為更好的結果。
  • 較低 effort 等級下的效率lowmedium effort 能以較高設定一小部分的 tokens 與延遲產出優異的品質。
  • 程式碼審查與找錯,每次審查都能以高比率找出真正的錯誤且誤報極少,並在較低 effort 等級下仍保持準確。
  • 視覺,能理解圖表、文件與示意圖,並重現 UI 與前端視覺效果;在獲得可反覆分析、裁切與驗證其工作的工具時表現最佳。
  • 長上下文工作,具備 1M token 上下文視窗作為預設值與最大值,並在整個視窗範圍內維持一致的指令遵循、工具呼叫與推理能力。
  • 辦公與文件任務,能產生並編輯包含非簡單公式的複雜多工作表試算表,並製作結構良好的簡報。
  • 多代理協調,能以有效的撰寫者—驗證者模式運作子代理團隊,且代理彼此覆寫工作的情況極少。

如需能充分發揮這些能力的提示模式,請參閱提示 Claude Opus 5

定價

Claude Opus 5 的定價為每百萬輸入 tokens 5 美元、每百萬輸出 tokens 25 美元,與 Claude Opus 4.8 相同。由於思考預設為開啟,且思考 tokens 以輸出 tokens 計費,在 Claude Opus 4.8 上不使用思考執行的工作負載,在相同的每 token 費率下,每個請求可能會產生更多輸出 tokens;請參閱成本控制

完整定價(包括批次處理、提示快取與快速模式費率)請參閱定價

可用性

Claude Opus 5 可於以下平台使用:

Claude Opus 4.8 在上述所有平台上仍然可用。

遷移指南

若要從 Claude Opus 4.8 遷移,請更新您的模型 ID:

model = "claude-opus-4-8"  # Before
model = "claude-opus-5"  # After

接著請檢視行為變更下的兩項重大變更:思考預設為開啟(回應可能以 thinking 區塊開頭,因此請依 type 選取內容區塊),以及在 effort 為 xhighmax 時停用思考會回傳 400 錯誤。逐步說明與完整檢查清單請參閱遷移指南

後續步驟

所有現行 Claude 模型的完整規格與定價。

Claude Opus 5 特有的行為差異與提示模式。

控制 Claude 回應時使用多少 tokens,從 low 到 max。

思考在預設開啟時如何運作,以及何時可以停用。

為 Claude 提供建議性的 token 預算,讓其據以調整工作節奏。

從先前的 Claude 版本遷移至最新 Claude 模型的指南。

以進階定價從 Claude Opus 模型獲得更高的每秒輸出 tokens。

Was this page helpful?