Claude Platform Docs

選擇合適的模型

選擇 Claude 模型意味著在能力、速度與成本之間取得平衡。本指南涵蓋應該提出的問題、兩種挑選起始模型的方法,以及如何測試您的選擇。

建立關鍵標準

選擇 Claude 模型時,建議您先評估以下因素:

  • 能力: 您需要模型具備哪些特定功能或能力,才能滿足您的需求?
  • 速度: 在您的應用程式中,模型需要多快做出回應?Claude Opus 5.5、Claude Opus 5, 以及 Claude Opus 4.8 支援 「fast mode」(快速模式)(研究預覽版),能以較高的定價提供最高 2.5 倍的輸出速度。
  • 成本: 您在開發和正式環境使用上的預算是多少?
  • Effort: 多個 Claude 模型支援 「effort」(投入程度)參數,可在單一模型內以智慧程度換取「latency」(延遲)和成本上的優勢。調整 effort 通常比切換模型更有效。在 Claude Fable 5.1 和 Claude Opus 5 上,請從預設值(high)開始,並根據您的評估結果向上或向下調整。在 Claude Opus 5.5 上,預設值為 medium;請從該值開始,並以相同方式調整。在 Claude Opus 4.8 和 Claude Opus 4.7 上,介於 high 和 max 之間的 xhigh effort 等級,是大多數程式開發和「agentic」(代理式)使用情境的最佳設定。

選擇最佳的起始模型

您可以使用兩種一般方法來開始測試哪個 Claude 模型最符合您的需求。

選項 1:以效率優先開始

對於許多應用程式而言,從更快速、更具成本效益的模型(例如 Claude Haiku 4.5)開始可能是最佳方法:

  1. 使用 Claude Haiku 4.5 開始實作。
  2. 徹底測試您的使用情境。
  3. 評估效能是否符合您的需求。
  4. 僅在有特定能力缺口時才升級。

這種方法可實現快速迭代、較低的開發成本,而且通常足以應付許多常見的應用程式。此方法最適合:

  • 初期原型設計與開發
  • 對延遲有嚴格要求的應用程式
  • 對成本敏感的實作
  • 大量且單純的任務

選項 2:以能力優先開始

對於智慧程度與進階能力至關重要的複雜任務,您可能會希望以能力優先開始:先以最適合您任務的最強起點進行實作,之後再逐步優化為更有效率的模型:

  1. 使用 Claude Opus 5.5 進行實作。
  2. 針對此模型最佳化您的提示。
  3. 評估效能是否符合您的需求。
  4. 隨著工作流程進一步最佳化,考慮透過降低 effort 或逐步降級模型來提升效率。
  5. 如果您在 xhigh 或 max effort 下的評估結果,在高要求的推理或長時程代理式工作上仍然不足,請改用 Claude Fable 5.1。

此方法最適合:

  • 複雜的推理任務
  • 科學或數學應用
  • 需要細膩理解的任務
  • 準確性重於成本考量的應用程式
  • 進階程式開發與高自主性的代理式工作

Claude Opus 5.5(claude-opus-5-5)專為長時間執行的代理式程式開發和知識工作而打造,並始終啟用「adaptive thinking」(自適應思考)。如果您的整合會強制「tool use」(工具使用)(tool_choice 的類型為 any 或 tool)、關閉思考功能,或使用 computer_20251124 電腦使用工具,請在切換前參閱重大變更。

Claude Fable 5.1(claude-fable-5-1)是 Anthropic 廣泛發布的模型中能力最強的一款。它在 Claude Fable 5 的基礎上,以相同的輸入與輸出價格提供更強的長時間執行代理式程式開發、知識工作與研究能力,且快取讀取成本僅為四分之一。Claude Mythos 5.1(claude-mythos-5-1)僅向 Project Glasswing 參與者提供相同的能力。這兩個模型皆使用常時啟用的 adaptive thinking(自適應思考)。詳情請參閱 Claude Fable 5.1 的新功能。

關於「context window」(上下文視窗)、輸出限制和價格,請參閱模型比較表。

模型選擇矩陣

大多數工作負載都從 Claude Opus 5.5 開始。

當您需要……考慮從以下模型開始……範例使用情境
目前可用的最高能力Claude Fable 5.1執行數小時的代理工作階段、多步驟深度研究、一路完成至成品文件、試算表或簡報的分析
複雜的代理式程式開發與企業工作Claude Opus 5.5執行數小時的自主程式開發代理、大規模重構、複雜系統工程、大量依賴視覺的工作流程、電腦使用
兼顧速度與能力的日常程式開發、代理與企業工作負載Claude Sonnet 5程式碼生成、資料分析、內容創作、視覺理解、代理式工具使用
最低的延遲和價格,並具備「extended thinking」(擴展思考)Claude Haiku 4.5即時應用程式、大量智慧處理、需要強大推理能力且對成本敏感的部署、子代理任務

決定是否升級或更換模型

若要判斷您是否需要升級或更換模型,您應該:

  1. 針對您的使用情境建立基準測試——擁有良好的評估集是整個流程中最重要的一步。
  2. 使用您實際的提示與資料進行測試。
  3. 比較各模型在以下方面的效能:
    • 回應的準確性
    • 回應品質
    • 邊界情況的處理
  4. 權衡效能與成本的取捨。

組合模型

多模型策略將較低成本的模型與前沿模型搭配使用,使大多數 token 以較低費率計費。兩種常見模式為:將困難決策上呈給顧問模型的執行者,以及將大量工作委派給較低成本工作者的協調者。關於這兩種策略、實測範例與實作選項,請參閱針對成本與智慧程度進行優化。

後續步驟

查看最新 Claude 模型的詳細規格和定價

專為高要求的推理和長時程代理式工作而打造

最新的 Opus 模型:重大變更、新功能和行為差異

適用於兼顧速度與能力的日常工作負載

開始進行您的第一次 API 呼叫

Was this page helpful?