Fable 5 帶鐐重返:Anthropic 拉 Amazon、Microsoft、Google 起草越獄嚴重度框架
Anthropic 宣布 Claude Fable 5 將自 7 月 2 日起重新向全球恢復部署。

Anthropic 宣布 Claude Fable 5 將自 7 月 2 日起重新向全球恢復部署。不過,這次回歸並非完全復原,而是搭配一套全新的安全分類器一同上線。只要請求被判定涉及網路安全等高風險領域,即使只是程式撰寫、漏洞分析或除錯等正常工作,也可能被自動降級,由 Claude Opus 4.8 回應,而非直接使用 Fable 5。
這套安全機制的推出,直接源自 Anthropic 與美國政府近期的一系列協商。除了重新部署模型外,Anthropic 也宣布將透過 Project Glasswing,與 Amazon、Microsoft、Google 等合作夥伴共同制定 AI 越獄(Jailbreak)嚴重度框架,希望建立一套產業共同遵循的越獄事件分級標準,以及模型供應商面對不同等級事件時的應對原則,並公開邀請其他 AI 公司加入。
另一方面,美國政府機構未來將可在模型正式發布前取得預先存取權,進行安全評估;雙方也建立越獄案例與濫用資訊的共享機制,並投入聯合研究資源。Anthropic 表示,未來數週仍會持續調整分類器,以降低誤判,讓系統更能區分正常開發工作與真正具有惡意的請求。

值得注意的是,Fable 5 雖然重新回歸,但僅會在 7 月 7 日前提供訂閱用戶有限額度的使用權限;7 月 7 日之後,將改為透過 Usage Credits 按量付費使用,而不是直接納入 Pro、Max、Team 等訂閱方案。這並非 API Only,而是整個 Claude 生態都改採額外購買額度的模式。

對工程師與 AI 開發團隊而言,這起事件最大的意義在於:前沿模型的可及性,未來不再只是 API 價格或 Rate Limit 的問題,Classifier 本身將成為新的能力邊界。只要模型判定你的請求疑似涉及網路安全,就有可能被自動降級至 Opus 4.8,即使請求本身完全合法。
更值得持續觀察的是 AI 越獄嚴重度框架 的發展。如果 Amazon、Microsoft、Google 等主要模型供應商最終形成共識,這套分級機制很可能逐漸演變成整個 AI 產業的事實標準,決定未來各家模型在什麼條件下需要自動降低能力、限制回覆,甚至拒絕服務。目前這些分類器的實際表現與誤判率仍只有 Anthropic 官方說法,實際影響仍有待未來數週觀察。對於高度依賴 Fable 5 前沿能力的開發團隊而言,Classifier 的行為,現在也必須納入模型選型的重要考量。
