從 Claude Mythos Preview、Claude Opus 5 或 Claude Opus 4.8 遷移至 Claude Mythos 5 與 Claude Fable 5:模型 ID、API 變更與遷移檢查清單。
Claude Fable 5 是 Anthropic 廣泛發布的模型中能力最強者,可於 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 以及 Microsoft Foundry 上使用。Claude Mythos 5 具備相同的能力,僅提供給 Project Glasswing 中經核准的客戶。
claude-fable-5 與 claude-mythos-5 共用的基準設定:
thinking 設定。thinking: {type: "disabled"} 與手動 extended thinking(擴展思考,thinking: {type: "enabled", budget_tokens: N})皆會回傳 400 錯誤。invalid_request_error。具有 ZDR 安排的組織應聯繫其 Anthropic 客戶團隊討論資料保留設定。或者,您也可以依工作區個別設定資料保留。各平台詳情請參閱特定模型的資料保留要求。
兩個模型的差異之處:
stop_reason: "refusal" 拒絕請求。Claude Mythos 5 不包含這些分類器。請參閱拒絕與備援。Claude Mythos 5 是 Claude Mythos Preview(僅限受邀的研究預覽版)的存取受限後繼版本。Claude Fable 5 提供相同的能力,且不需要存取核准。本節中的變更同樣適用於這兩個目標模型。
遷移大致上可直接替換。Claude Mythos 5 與 Claude Fable 5 使用與 Claude Mythos Preview 相同的 Messages API 以及相同的 tool use(工具使用)模式,且由於三個模型使用相同的 tokenizer,token 數量大致不變。需要檢查的主要變更是不再提供的功能(列於下一節)以及思考輸出。若您遷移至 Claude Fable 5,也請為安全分類器拒絕做好規劃,這是 Claude Mythos Preview 與 Claude Mythos 5 所沒有的;請參閱拒絕與備援。
關於 Claude Mythos Preview 的退役時程,請參閱模型棄用。
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# 或者,使用具備相同功能且無需存取核准的模型:
model = "claude-fable-5" # After擴展思考與思考 token 預算: 手動擴展思考(thinking: {type: "enabled", budget_tokens: N})在 claude-mythos-5 或 claude-fable-5 上不受支援,會回傳 400 錯誤。自適應思考始終開啟:模型會自行決定每個請求何時思考以及思考多少,無需任何 thinking 設定。thinking: {type: "disabled"} 會回傳錯誤。budget_tokens 沒有直接的替代方案:思考是自適應的,而 effort 參數是獨立的輸出層級控制,並非思考預算。
之前(Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)之後(Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)Claude Fable 5 的變更完全相同,只需將模型名稱改為 claude-fable-5。
Assistant 預填: 預填 assistant 訊息在 claude-mythos-5 或 claude-fable-5 上不受支援,會回傳 400 錯誤,與 Claude Mythos Preview 相同。請改用系統提示指令。
思考輸出:在 claude-mythos-5 與 claude-fable-5 上,原始思維鏈永遠不會回傳,但當 thinking.display 設為 summarized 時,thinking 區塊仍會包含可讀的摘要文字。在同一模型上延續對話時,請原封不動地傳回 thinking 區塊。請參閱 Claude Fable 5 與 Claude Mythos 5 上的思考輸出。
claude-mythos-5 與 claude-fable-5 使用與 claude-mythos-preview 相同的 tokenizer(即隨 Claude Opus 4.7 引入的 tokenizer)。從 claude-mythos-preview 遷移時,token 數量大致不變。與 Claude Opus 4.7 之前的模型相比,相同內容的 token 數量可能多出約 30%,實際情況依內容與工作負載型態而異。
/v1/messages/count_tokens 對 claude-mythos-5 與 claude-fable-5 回傳的值與 claude-mythos-preview 相比大致不變。請在您自己的工作負載上重新建立成本與延遲基準。
claude-mythos-preview 更新為 claude-mythos-5,或更新為 claude-fable-5,後者提供相同的能力且不需要存取核准。thinking: {type: "enabled", budget_tokens: N})。自適應思考始終開啟,無需 thinking 欄位。thinking: {type: "disabled"} 設定。在 claude-mythos-5 與 claude-fable-5 上停用思考會回傳錯誤。budget_tokens。它沒有直接的替代方案:思考是自適應的,而 effort 參數是獨立的輸出層級控制,並非思考預算。thinking 欄位的程式碼僅將其視為顯示文字,並在同一模型上延續對話時原封不動地傳回 thinking 區塊。thinking.display 在 claude-mythos-5 與 claude-fable-5 上預設為 "omitted",與 Claude Mythos Preview 相同;設定 display: "summarized" 以接收可讀的摘要。請參閱 Claude Fable 5 與 Claude Mythos 5 上的思考輸出。
thinking 與 redacted_thinking 區塊。來自 claude-mythos-5 與 claude-fable-5 的 thinking 區塊與產生它們的模型綁定,Claude Fable 5 與 Claude Mythos 5 以外的模型會靜默忽略它們。移除這些區塊可讓跨模型請求保持精簡且一致。
stop_reason: "refusal" 並讀取 stop_details.category 欄位。Claude Fable 5 會執行 Claude Mythos Preview 與 Claude Mythos 5 所沒有的安全分類器。請參閱拒絕與備援。claude-mythos-preview 遷移時,token 數量大致不變。Claude Fable 5 與 Claude Mythos 5 使用與 Claude Opus 5 相同的 Messages API 以及相同的工具使用模式,預設具有相同的 1M token 上下文視窗以及相同的 128k 最大輸出 token。預填與取樣參數限制,以及思考顯示行為,皆從 Claude Opus 5 原樣沿用。需要檢查的變更為始終開啟的思考、定價、Priority Tier 與資料保留。
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# 或者,使用具備相同功能的 Project Glasswing 模型:
model = "claude-mythos-5" # After思考無法再停用: 在 Claude Opus 5 上,思考預設開啟,且可在 effort 等級為 high 或以下時以 thinking: {type: "disabled"} 關閉。在 claude-fable-5 與 claude-mythos-5 上,自適應思考始終開啟,且 thinking: {type: "disabled"} 在任何 effort 等級下皆會回傳 400 錯誤。請移除 thinking: {type: "disabled"} 設定,並改用較低的 effort 等級來控制 token 花費。
若您的 Claude Opus 5 請求停用了思考,回應的結構會改變:回應可能在第一個 text 區塊之前以一個或多個 thinking 區塊開頭,在預設的 display: "omitted"(與 Claude Opus 5 相同的預設值)下,這些區塊會以空的 thinking 欄位回傳。依位置讀取回覆的程式碼(例如 content[0].text,或將第一個內容區塊視為文字的串流處理器)必須改為依 type 欄位選取內容區塊,且工具使用迴圈必須將 thinking 區塊連同工具結果完整且未經修改地傳回。API 會以 400 錯誤拒絕經編輯、重新排序或部分刪除的 thinking 區塊(請參閱保留 thinking 區塊)。即使思考文字未回傳,思考 token 仍會以輸出 token 計費。
定價: Claude Fable 5 與 Claude Mythos 5 的定價為每百萬輸入 token 10 美元、每百萬輸出 token 50 美元,相較之下 Claude Opus 5 為 5 美元與 25 美元。請參閱 Claude 定價。
Priority Tier:Priority Tier 在 Claude Opus 5 上不受支援,因此現有流量不受影響。若您的組織有 Priority Tier 承諾,Claude Fable 5 支援它;Claude Mythos 5 則不支援。
資料保留:Claude Fable 5 與 Claude Mythos 5 要求 30 天資料保留,不適用於零資料保留(ZDR)安排;兩者皆被指定為 Covered Models。請參閱特定模型的資料保留要求。
claude-opus-5 更新為 claude-fable-5(或 claude-mythos-5)。thinking: {type: "disabled"} 設定;它在 claude-fable-5 與 claude-mythos-5 上會回傳 400 錯誤。請改用較低的 effort 等級來控制 token 花費,並針對在 Claude Opus 5 上停用思考執行的工作負載重新檢視 max_tokens。content[0].text),請將其更新為依 type 選取內容區塊:thinking 區塊現在會在 text 區塊之前到達。在工具使用迴圈中請完整且未經修改地傳回 thinking 區塊;經修改的區塊會回傳 400 錯誤。遷移大致上可直接替換。Claude Fable 5 與 Claude Mythos 5 使用與 Claude Opus 4.8 相同的 Messages API 以及相同的工具使用模式,預設具有相同的 1M token 上下文視窗以及相同的 128k 最大輸出 token。由於這些模型使用相同的 tokenizer,token 數量大致不變。需要檢查的主要變更為始終開啟的自適應思考、思考輸出、安全分類器拒絕(僅 Claude Fable 5)以及定價。
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# 或者,使用具備相同功能的 Project Glasswing 模型:
model = "claude-mythos-5" # After本節中的項目說明在您替換模型 ID 後值得檢查的 API 與行為差異。除另有註明外,它們同樣適用於 claude-fable-5 與 claude-mythos-5。
自適應思考始終開啟:自適應思考是 claude-fable-5 與 claude-mythos-5 上唯一的思考模式。模型會自行決定每個請求何時思考以及思考多少,無需任何 thinking 設定。thinking: {type: "disabled"} 會回傳錯誤。請使用 effort 參數來控制思考深度。
需要檢查的行為變更:在 Claude Opus 4.8 上,沒有 thinking 欄位的請求會在不思考的情況下執行;在 claude-fable-5 與 claude-mythos-5 上,相同的請求會以自適應思考執行。max_tokens 仍是總輸出(思考加上回應文字)的硬性上限,因此請針對在 Claude Opus 4.8 上不思考執行的工作負載重新檢視它。請參閱成本控制。回應也可能在第一個 text 區塊之前以一個或多個 thinking 區塊開頭,因此依位置讀取回覆的程式碼(例如 content[0].text,或將第一個內容區塊視為文字的串流處理器)必須改為依 type 欄位選取內容區塊。即使思考文字未回傳給您,思考 token 仍會以輸出 token 計費,因此在 Claude Opus 4.8 上不思考執行的工作負載,除了每 token 價格差異之外,每個請求還會產生更多輸出 token。
若您執行工具使用迴圈,請在回傳工具結果時,將每個 assistant 回應中的 thinking 區塊完整且未經修改地傳回 API,包括 thinking 欄位為空的區塊。請原樣回傳收到的 assistant 訊息,而非依類型篩選其內容區塊或重新建構它:API 會以 400 錯誤拒絕經編輯、重新排序或部分刪除的 thinking 區塊。請參閱保留 thinking 區塊。
之前(Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)之後(Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Claude Mythos 5 的變更完全相同,只需將模型名稱改為 claude-mythos-5。
擴展思考與思考預算(未變更): 手動擴展思考(thinking: {type: "enabled", budget_tokens: N})在 claude-fable-5 或 claude-mythos-5 上不受支援,會回傳 400 錯誤,與 Claude Opus 4.8 相同。budget_tokens 沒有直接的替代方案:思考是自適應的,而 effort 參數是獨立的輸出層級控制,並非思考預算。
Assistant 預填(未變更): 預填 assistant 訊息在 claude-fable-5 或 claude-mythos-5 上不受支援,會回傳 400 錯誤,與 Claude Opus 4.8 相同。請改用系統提示指令。
思考輸出:在 claude-fable-5 與 claude-mythos-5 上,原始思維鏈永遠不會回傳,但當 thinking.display 設為 summarized 時,thinking 區塊仍會包含可讀的摘要文字。在同一模型上延續對話時,請原封不動地傳回 thinking 區塊。請參閱 Claude Fable 5 與 Claude Mythos 5 上的思考輸出。
安全分類器與 refusal 停止原因(僅 Claude Fable 5):claude-fable-5 會對請求以及在回應生成期間執行安全分類器。Claude Mythos 5 不包含這些分類器。當分類器拒絕請求時,Messages API 會以成功的 HTTP 200 回應回傳 stop_reason: "refusal",而非錯誤。stop_details.category 欄位會回報觸發的是哪個分類器,類別包括 "cyber"、"bio" 與 "reasoning_extraction" 等,或在拒絕未對應到任何具名類別時為 null。完整清單請參閱拒絕類別表。
對於在產生任何輸出之前即被拒絕的請求,您不會被收取輸入 token 費用。當分類器在串流中途觸發時,輸入與已串流的輸出會被計費;請捨棄部分輸出。
若要自動在其他模型上重新執行被拒絕的請求,請傳入選用的 fallbacks 參數,該參數在 Claude API 上處於 beta 階段。此參數不適用於 Message Batches API,也不適用於 Amazon Bedrock、Google Cloud 與 Microsoft Foundry;在這三個平台上,請在用戶端執行重試,或使用 SDK 的拒絕備援中介軟體。請參閱拒絕與備援。
從 high effort 開始:effort 參數的預設值仍為 high。在 Claude Opus 4.8 上,對於程式設計與高自主性工作的建議是明確設定 xhigh。在 claude-fable-5 與 claude-mythos-5 上,請將 high 作為大多數任務的預設值,並將 xhigh 保留給對能力最敏感的工作負載。較低的 effort 設定仍表現良好,且通常超越先前模型在 xhigh 下的表現。若任務能完成但耗時超過必要,請降低 effort。請參閱提示 Claude Fable 5。
較低的提示快取最小長度:claude-fable-5 與 claude-mythos-5 上可快取的最小提示長度為 512 token,低於 Claude Opus 4.8 上的 1,024 token。在 Claude Opus 4.8 上因過短而無法快取的提示現在可以建立快取項目,無需變更程式碼。各模型的最小值請參閱 prompt caching(提示快取)。
claude-fable-5 與 claude-mythos-5 要求 30 天資料保留;在 Claude API 上,對 claude-fable-5 不符合此要求的請求會回傳 400 invalid_request_error。Claude Opus 4.8 仍可在 ZDR 下使用。請參閱特定模型的資料保留要求。
claude-opus-4-8 更新為 claude-fable-5(或 claude-mythos-5)。thinking: {type: "disabled"} 設定。在 claude-fable-5 與 claude-mythos-5 上停用思考會回傳錯誤,且沒有 thinking 欄位的請求會以自適應思考執行。content[0].text):由於自適應思考始終開啟,thinking 區塊會在 text 區塊之前到達。請改為依 type 選取內容區塊,並在工具使用迴圈中完整且未經修改地傳回 thinking 區塊;經修改的區塊會回傳 400 錯誤。請參閱保留 thinking 區塊。claude-fable-5 與 claude-mythos-5 上仍不受支援。thinking 欄位的程式碼僅將其視為顯示文字,並在同一模型上延續對話時原封不動地傳回 thinking 區塊。thinking.display 在 claude-fable-5 與 claude-mythos-5 上預設為 "omitted",與 Claude Opus 4.8 相同;設定 display: "summarized" 以接收可讀的摘要。請參閱 Claude Fable 5 與 Claude Mythos 5 上的思考輸出。
thinking 與 redacted_thinking 區塊。來自 claude-fable-5 與 claude-mythos-5 的 thinking 區塊與產生它們的模型綁定,Claude Fable 5 與 Claude Mythos 5 以外的模型會靜默忽略它們。移除這些區塊可讓跨模型請求保持精簡且一致。例外情況是兌換備援額度,這需要依該功能的確切規則回傳請求主體。
stop_reason: "refusal" 並讀取 stop_details.category 欄位。若要自動在其他模型上重新執行被拒絕的請求,請考慮使用選用的 fallbacks 參數(beta)。請參閱拒絕與備援。effort 設定。對於大多數任務請從 high 開始,包括在 Claude Opus 4.8 上以 xhigh 執行的工作負載。claude-opus-4-8 遷移時,token 數量大致不變;每 token 定價不同,且思考 token 以輸出 token 計費,因此先前不思考執行的工作負載每個請求會產生更多輸出 token。Was this page helpful?