Anthropic 雙發 Fable 5 與 Mythos 5:護欄觸發 fallback 機制上線,安全攔截正式變成 API 路由設計題
Anthropic 在同一天推出兩個共用能力基礎的模型:Claude Fable 5 強化安全護欄,Claude Mythos 5 則是明確「不帶安全分類器」的對應版本。
Anthropic 在同一天推出兩個共用能力基礎的模型:Claude Fable 5 強化安全護欄,Claude Mythos 5 則是明確「不帶安全分類器」的對應版本。Fable 5 配套了新 API 機制:護欄觸發拒答時,系統主動通知呼叫方,並支援設定自動 fallback 到另一個模型。安全攔截從過去的模型內部行為,正式變成開發者在 runtime 必須主動設計的路由問題。
Simon Willison 在發布當日連續投入約 5.5 小時實測,形容 Fable 5「感覺很大」,他說的「感覺很大」涵蓋速度慢、成本高,還有知識深度的表現。他以相同提示詞分別測試 Fable 5 與 Opus 4.8,要求按時間倒序列出自己的所有開源專案:Opus 4.8 回應以大量「無法可靠、全面且附有日期的清單」免責聲明開頭,根據 Willison 的對比測試,Fable 5 表現明顯更直接。兩個新模型共用 1 百萬 token context window、最大輸出 128,000 token,知識截止日期為 2026 年 1 月。定價為每百萬 input token $10、output token $50,是 Claude Opus 4.5、4.6、4.7、4.8 的兩倍,且更長的 context 不額外計費。Fable 5 的官方升級指南比 Opus 4.8 當時薄了不少,推測破壞性 API 變更有限。
這套雙模型設計有幾個值得拆解的含義。第一,Mythos 5 以明確的「無分類器」標籤上市,Anthropic 把「哪個版本護欄更寬鬆」直接做成產品選項,不需要開發者自己摸索。第二,Fable 5 護欄觸發頻率高到必須為此設計通知加 fallback 的路由協議,工程團隊接 API 時需要在系統設計層預先規劃:哪些請求類型會被攔截、fallback 後行為差異是否可接受,不能只靠 prompt 調整。第三,兩倍於 Opus 的定價加上更嚴格護欄,目前看來 Fable 5 更適合合規要求高的企業部署場景,Mythos 5 則給需要更大彈性的開發者保留了空間。安全性正在從模型特性,變成一個架構層的決策點。


