遷移至 Claude Mythos 5 與 Claude Fable 5
從 Claude Mythos Preview、Claude Opus 5 或 Claude Opus 4.8 遷移至 Claude Mythos 5 與 Claude Fable 5:模型 ID、API 變更與遷移檢查清單。
Claude Fable 5 專為高要求的推理與長時程代理式工作而打造。Claude Fable 5.1 在其基礎上進一步發展。Claude Fable 5 可於 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 以及 Microsoft Foundry 上使用。Claude Mythos 5 具備相同的能力,僅提供給 Project Glasswing 中經核准的客戶。
claude-fable-5 與 claude-mythos-5 共用的基準設定:
- 思考:Adaptive thinking(自適應思考)始終開啟。模型會自行決定每個請求何時思考以及思考多少,無需任何
thinking設定。thinking: {type: "disabled"}與手動 extended thinking(擴展思考,thinking: {type: "enabled", budget_tokens: N})皆會回傳 400 錯誤。 - 預填: 預填 assistant 訊息會回傳 400 錯誤。請改用 system prompt(系統提示)指令。
- 上下文視窗與輸出: 預設為 1M token 的 context window(上下文視窗),每個請求最多可輸出 128k token。
- 定價: 每百萬輸入 token 10 美元,每百萬輸出 token 50 美元。請參閱 Claude 定價。
- 資料保留: 兩個模型皆要求 30 天資料保留,除非經 Anthropic 明確授權,否則不適用於「zero data retention」(零資料保留),即 ZDR 安排。兩者皆被指定為 Covered Models。在 Claude API 上,若組織的資料保留設定不符合此要求,對 Claude Fable 5 的請求會回傳 400
invalid_request_error。具有 ZDR 安排的組織應聯繫其 Anthropic 客戶團隊討論資料保留設定,或依工作區個別設定資料保留。各平台詳情請參閱特定模型的資料保留要求。
兩個模型的差異之處:
- 可用性: Claude Fable 5 不需要存取核准。Claude Mythos 5 僅提供給 Project Glasswing 中經核准的客戶。
- 安全分類器: Claude Fable 5 會執行安全分類器,可能以
stop_reason: "refusal"拒絕請求。Claude Mythos 5 不包含這些分類器。請參閱拒絕與備援。 - Priority Tier:Priority Tier 在 Claude Fable 5 上受支援,但在 Claude Mythos 5 上不受支援。
從 Claude Mythos Preview 遷移至 Claude Mythos 5 與 Claude Fable 5
Claude Mythos 5 是 Claude Mythos Preview(僅限受邀的研究預覽版)的存取受限後繼版本。Claude Fable 5 提供相同的能力,且不需要存取核准。本節中的變更同樣適用於這兩個目標模型。
遷移大致上可直接替換。Claude Mythos 5 與 Claude Fable 5 使用與 Claude Mythos Preview 相同的 Messages API 以及相同的 tool use(工具使用)模式,且由於三個模型使用相同的 tokenizer,token 數量大致不變。需要檢查的主要變更是不再提供的功能(列於下一節)以及思考輸出。若您遷移至 Claude Fable 5,也請為安全分類器拒絕做好規劃,這是 Claude Mythos Preview 與 Claude Mythos 5 所沒有的;請參閱拒絕與備援。
關於 Claude Mythos Preview 的退役時程,請參閱模型棄用。
更新您的模型名稱
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# 或者,使用具備相同功能且無需存取核准的模型:
model = "claude-fable-5" # AfterClaude Mythos 5 與 Claude Fable 5 上不提供的功能
-
擴展思考與思考 token 預算: 手動擴展思考(
thinking: {type: "enabled", budget_tokens: N})在claude-mythos-5或claude-fable-5上不受支援,會回傳 400 錯誤。自適應思考始終開啟:模型會自行決定每個請求何時思考以及思考多少,無需任何thinking設定。thinking: {type: "disabled"}會回傳錯誤。budget_tokens沒有直接的替代方案:思考是自適應的,而 effort 參數是獨立的輸出層級控制,並非思考預算。之前(Claude Mythos Preview):
client.messages.create( model="claude-mythos-preview", max_tokens=16000, thinking={"type": "enabled", "budget_tokens": 10000}, messages=[{"role": "user", "content": "..."}], )之後(Claude Mythos 5):
client.messages.create( model="claude-mythos-5", max_tokens=16000, messages=[{"role": "user", "content": "..."}], )Claude Fable 5 的變更完全相同,只需將模型名稱改為
claude-fable-5。 -
Assistant 預填: 預填 assistant 訊息在
claude-mythos-5或claude-fable-5上不受支援,會回傳 400 錯誤,與 Claude Mythos Preview 相同。請改用系統提示指令。 -
**思考輸出:**在
claude-mythos-5與claude-fable-5上,原始思維鏈永遠不會回傳,但當thinking.display設為summarized時,thinking 區塊仍會包含可讀的摘要文字。在同一模型上延續對話時,請原封不動地傳回 thinking 區塊。請參閱 Claude Fable 與 Claude Mythos 模型上的思考輸出。
Token 計數與計費
claude-mythos-5 與 claude-fable-5 使用與 claude-mythos-preview 相同的 tokenizer(即隨 Claude Opus 4.7 引入的 tokenizer)。從 claude-mythos-preview 遷移時,token 數量大致不變。與 Claude Opus 4.7 之前的模型相比,相同內容的 token 數量可能多出約 30%,實際情況依內容與工作負載型態而異。
/v1/messages/count_tokens 對 claude-mythos-5 與 claude-fable-5 回傳的值與 claude-mythos-preview 相比大致不變。請在您自己的工作負載上重新建立成本與延遲基準。
遷移檢查清單
- 將模型名稱從
claude-mythos-preview更新為claude-mythos-5,或更新為claude-fable-5,後者提供相同的能力且不需要存取核准。 - 移除手動擴展思考設定(
thinking: {type: "enabled", budget_tokens: N})。自適應思考始終開啟,無需thinking欄位。 - 移除任何
thinking: {type: "disabled"}設定。在claude-mythos-5與claude-fable-5上停用思考會回傳錯誤。 - 移除
budget_tokens。它沒有直接的替代方案:思考是自適應的,而effort參數是獨立的輸出層級控制,並非思考預算。 - 確認任何解析
thinking欄位的程式碼僅將其視為顯示文字,並在同一模型上延續對話時原封不動地傳回 thinking 區塊。thinking.display在claude-mythos-5與claude-fable-5上預設為"omitted",與 Claude Mythos Preview 相同。設定display: "summarized"以接收可讀的摘要。請參閱 Claude Fable 與 Claude Mythos 模型上的思考輸出。 - 若您在較早的模型上重播對話歷史,請先從先前的 assistant 回合中移除
thinking與redacted_thinking區塊。來自claude-fable-5與claude-mythos-5的 thinking 區塊僅能由產生它們的模型或更新的模型讀取:較早的模型會靜默忽略它們,而 Claude Fable 5.1 與 Claude Mythos 5.1 可讀取它們,因此當您將對話升級至這些模型時請保留它們(請參閱保留的思考)。移除這些區塊可讓對較早模型的請求保持精簡且一致。 - 若您遷移至 Claude Fable 5,請處理
stop_reason: "refusal"並讀取stop_details.category欄位。Claude Fable 5 會執行 Claude Mythos Preview 與 Claude Mythos 5 所沒有的安全分類器。請參閱拒絕與備援。 - 在您自己的工作負載上重新建立 token 數量與成本基準。從
claude-mythos-preview遷移時,token 數量大致不變。
從 Claude Opus 5 遷移至 Claude Mythos 5 與 Claude Fable 5
Claude Fable 5 與 Claude Mythos 5 使用與 Claude Opus 5 相同的 Messages API 以及相同的工具使用模式,預設具有相同的 1M token 上下文視窗以及相同的 128k 最大輸出 token。預填與取樣參數限制,以及思考顯示行為,皆從 Claude Opus 5 原樣沿用。需要檢查的變更為始終開啟的思考、定價、Priority Tier 與資料保留。
更新您的模型名稱
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# 或者,使用具備相同功能的 Project Glasswing 模型:
model = "claude-mythos-5" # After變更內容
-
思考無法再停用: 在 Claude Opus 5 上,思考預設開啟,且可在 effort 等級為
high或以下時以thinking: {type: "disabled"}關閉。在claude-fable-5與claude-mythos-5上,自適應思考始終開啟,且thinking: {type: "disabled"}在任何 effort 等級下皆會回傳 400 錯誤。請移除thinking: {type: "disabled"}設定,並改用較低的 effort 等級來控制 token 花費。若您的 Claude Opus 5 請求停用了思考,回應的結構會改變:回應可能在第一個
text區塊之前以一個或多個thinking區塊開頭,在預設的display: "omitted"(與 Claude Opus 5 相同的預設值)下,這些區塊會以空的thinking欄位回傳。依位置讀取回覆的程式碼(例如content[0].text,或將第一個內容區塊視為文字的串流處理器)必須改為依type欄位選取內容區塊,且工具使用迴圈必須將thinking區塊連同工具結果完整且未經修改地傳回。API 會以 400 錯誤拒絕經編輯、重新排序或部分刪除的 thinking 區塊(請參閱保留 thinking 區塊)。即使思考文字未回傳,思考 token 仍會以輸出 token 計費。 -
定價: Claude Fable 5 與 Claude Mythos 5 的定價為每百萬輸入 token 10 美元、每百萬輸出 token 50 美元,相較之下 Claude Opus 5 為 5 美元與 25 美元。請參閱 Claude 定價。
-
Priority Tier:Priority Tier 在 Claude Opus 5 上不受支援,因此現有流量不受影響。若您的組織有 Priority Tier 承諾,Claude Fable 5 支援它;Claude Mythos 5 則不支援。
-
**資料保留:**Claude Fable 5 與 Claude Mythos 5 要求 30 天資料保留,除非經 Anthropic 明確授權,否則不適用於零資料保留(ZDR)安排。兩者皆被指定為 Covered Models。請參閱特定模型的資料保留要求。
遷移檢查清單
- 將模型名稱從
claude-opus-5更新為claude-fable-5(或claude-mythos-5)。 - 移除任何
thinking: {type: "disabled"}設定;它在claude-fable-5與claude-mythos-5上會回傳 400 錯誤。請改用較低的 effort 等級來控制 token 花費,並針對在 Claude Opus 5 上停用思考執行的工作負載重新檢視max_tokens。 - 若這些工作負載依位置讀取內容(例如
content[0].text),請將其更新為依type選取內容區塊:thinking區塊現在會在text區塊之前到達。在工具使用迴圈中請完整且未經修改地傳回thinking區塊;經修改的區塊會回傳 400 錯誤。 - 若您的組織有零資料保留(ZDR)安排,請在遷移前確認資格:除非經 Anthropic 明確授權,否則這些模型不適用於 ZDR。請參閱特定模型的資料保留要求。
- 在您自己的工作負載上重新建立成本基準。Token 數量大致不變;每 token 定價不同,且先前停用思考執行的工作負載現在會產生思考 token,這些 token 以輸出 token 計費。
從 Claude Opus 4.8 遷移至 Claude Mythos 5 與 Claude Fable 5
遷移大致上可直接替換。Claude Fable 5 與 Claude Mythos 5 使用與 Claude Opus 4.8 相同的 Messages API 以及相同的工具使用模式,預設具有相同的 1M token 上下文視窗以及相同的 128k 最大輸出 token。由於這些模型使用相同的 tokenizer,token 數量大致不變。需要檢查的主要變更為始終開啟的自適應思考、思考輸出、安全分類器拒絕(僅 Claude Fable 5)以及定價。
更新您的模型名稱
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# 或者,使用具備相同功能的 Project Glasswing 模型:
model = "claude-mythos-5" # After變更內容
本節中的項目說明在您替換模型 ID 後值得檢查的 API 與行為差異。除另有註明外,它們同樣適用於 claude-fable-5 與 claude-mythos-5。
-
自適應思考始終開啟:自適應思考是
claude-fable-5與claude-mythos-5上唯一的思考模式。模型會自行決定每個請求何時思考以及思考多少,無需任何thinking設定。thinking: {type: "disabled"}會回傳錯誤。請使用 effort 參數來控制思考深度。需要檢查的行為變更:在 Claude Opus 4.8 上,沒有
thinking欄位的請求會在不思考的情況下執行;在claude-fable-5與claude-mythos-5上,相同的請求會以自適應思考執行。max_tokens仍是總輸出(思考加上回應文字)的硬性上限,因此請針對在 Claude Opus 4.8 上不思考執行的工作負載重新檢視它。請參閱成本控制。回應也可能在第一個text區塊之前以一個或多個thinking區塊開頭,因此依位置讀取回覆的程式碼(例如content[0].text,或將第一個內容區塊視為文字的串流處理器)必須改為依type欄位選取內容區塊。即使思考文字未回傳給您,思考 token 仍會以輸出 token 計費,因此在 Claude Opus 4.8 上不思考執行的工作負載,除了每 token 價格差異之外,每個請求還會產生更多輸出 token。若您執行工具使用迴圈,請在回傳工具結果時,將每個 assistant 回應中的
thinking區塊完整且未經修改地傳回 API,包括thinking欄位為空的區塊。請原樣回傳收到的 assistant 訊息,而非依類型篩選其內容區塊或重新建構它:API 會以 400 錯誤拒絕經編輯、重新排序或部分刪除的 thinking 區塊。請參閱保留 thinking 區塊。之前(Claude Opus 4.8):
client.messages.create( model="claude-opus-4-8", max_tokens=16000, thinking={"type": "adaptive"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )之後(Claude Fable 5):
client.messages.create( model="claude-fable-5", max_tokens=16000, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )Claude Mythos 5 的變更完全相同,只需將模型名稱改為
claude-mythos-5。 -
擴展思考與思考預算(未變更): 手動擴展思考(
thinking: {type: "enabled", budget_tokens: N})在claude-fable-5或claude-mythos-5上不受支援,會回傳 400 錯誤,與 Claude Opus 4.8 相同。budget_tokens沒有直接的替代方案:思考是自適應的,而 effort 參數是獨立的輸出層級控制,並非思考預算。 -
Assistant 預填(未變更): 預填 assistant 訊息在
claude-fable-5或claude-mythos-5上不受支援,會回傳 400 錯誤,與 Claude Opus 4.8 相同。請改用系統提示指令。 -
**思考輸出:**在
claude-fable-5與claude-mythos-5上,原始思維鏈永遠不會回傳,但當thinking.display設為summarized時,thinking 區塊仍會包含可讀的摘要文字。在同一模型上延續對話時,請原封不動地傳回 thinking 區塊。請參閱 Claude Fable 與 Claude Mythos 模型上的思考輸出。 -
安全分類器與
refusal停止原因(僅 Claude Fable 5):claude-fable-5會對請求以及在回應生成期間執行安全分類器。Claude Mythos 5 不包含這些分類器。當分類器拒絕請求時,Messages API 會以成功的 HTTP 200 回應回傳stop_reason: "refusal",而非錯誤。stop_details.category欄位會回報觸發的是哪個分類器,類別包括"cyber"、"bio"與"reasoning_extraction"等,或在拒絕未對應到任何具名類別時為null。完整清單請參閱拒絕類別表。對於在產生任何輸出之前即被拒絕的請求,您不會被收取輸入 token 費用。當分類器在串流中途觸發時,輸入與已串流的輸出會被計費;請捨棄部分輸出。
若要自動在其他模型上重新執行被拒絕的請求,請傳入選用的
fallbacks參數,該參數在 Claude API 上處於 beta 階段。此參數不適用於 Message Batches API,也不適用於 Amazon Bedrock、Google Cloud 與 Microsoft Foundry;在這三個平台上,請在用戶端執行重試,或使用 SDK 的拒絕備援中介軟體。請參閱拒絕與備援。 -
從
higheffort 開始:effort 參數的預設值仍為high。在 Claude Opus 4.8 上,對於程式設計與高自主性工作的建議是明確設定xhigh。在claude-fable-5與claude-mythos-5上,請將high作為大多數任務的預設值,並將xhigh保留給對能力最敏感的工作負載。較低的 effort 設定仍表現良好,且通常超越先前模型在xhigh下的表現。若任務能完成但耗時超過必要,請降低 effort。請參閱提示 Claude Fable 5。 -
較低的提示快取最小長度:
claude-fable-5與claude-mythos-5上可快取的最小提示長度為 512 token,低於 Claude Opus 4.8 上的 1,024 token。在 Claude Opus 4.8 上因過短而無法快取的提示現在可以建立快取項目,無需變更程式碼。各模型的最小值請參閱 prompt caching(提示快取)。
遷移檢查清單
- 若您的組織有零資料保留(ZDR)安排,請在遷移前確認資格。
claude-fable-5與claude-mythos-5要求 30 天資料保留,除非經 Anthropic 明確授權,否則不適用於 ZDR。在 Claude API 上,對claude-fable-5不符合此要求的請求會回傳 400invalid_request_error。Claude Opus 4.8 可在 ZDR 下使用。請參閱特定模型的資料保留要求。 - 將模型名稱從
claude-opus-4-8更新為claude-fable-5(或claude-mythos-5)。 - 移除任何
thinking: {type: "disabled"}設定。在claude-fable-5與claude-mythos-5上停用思考會回傳錯誤,且沒有thinking欄位的請求會以自適應思考執行。 - 更新依位置讀取內容的回應解析程式碼(例如
content[0].text):由於自適應思考始終開啟,thinking區塊會在text區塊之前到達。請改為依type選取內容區塊,並在工具使用迴圈中完整且未經修改地傳回thinking區塊;經修改的區塊會回傳 400 錯誤。請參閱保留 thinking 區塊。 - 若您在先前的遷移中已移除手動擴展思考與 assistant 預填,則無需採取任何動作:兩者在
claude-fable-5與claude-mythos-5上仍不受支援。 - 確認任何解析
thinking欄位的程式碼僅將其視為顯示文字,並在同一模型上延續對話時原封不動地傳回 thinking 區塊。thinking.display在claude-fable-5與claude-mythos-5上預設為"omitted",與 Claude Opus 4.8 相同。設定display: "summarized"以接收可讀的摘要。請參閱 Claude Fable 與 Claude Mythos 模型上的思考輸出。 - 若您在較早的模型上重播對話歷史,請先從先前的 assistant 回合中移除
thinking與redacted_thinking區塊。來自claude-fable-5與claude-mythos-5的 thinking 區塊僅能由產生它們的模型或更新的模型讀取:較早的模型會靜默忽略它們,而 Claude Fable 5.1 與 Claude Mythos 5.1 可讀取它們,因此當您將對話升級至這些模型時請保留它們(請參閱保留的思考)。移除這些區塊可讓對較早模型的請求保持精簡且一致。例外情況是兌換備援額度,這需要依該功能的確切規則回傳請求主體。 - 若您遷移至 Claude Fable 5,請處理
stop_reason: "refusal"並讀取stop_details.category欄位。若要自動在其他模型上重新執行被拒絕的請求,請考慮使用選用的fallbacks參數(beta)。請參閱拒絕與備援。 - 重新評估您的
effort設定。對於大多數任務請從high開始,包括在 Claude Opus 4.8 上以xhigh執行的工作負載。 - 在您自己的工作負載上重新建立成本與延遲基準。從
claude-opus-4-8遷移時,token 數量大致不變;每 token 定價不同,且思考 token 以輸出 token 計費,因此先前不思考執行的工作負載每個請求會產生更多輸出 token。
Was this page helpful?