Fable 與 Mythos 5.1 同步發布:同一顆模型,兩種放行層級
Anthropic 於週二發布 Claude Fable 5.1 與 Mythos 5.1,兩者共用同一顆底層模型,僅護欄等級不同:Fable 開放給雲端平台與 API,Mythos 僅限已註冊的資安與生命科學合作夥伴使用。

美國當地時間週二,Anthropic 發布了 Claude Fable 5.1 與 Claude Mythos 5.1 兩個版本,根據科技媒體 TechCrunch 報導,兩者是同一顆最先進模型的"雙生"版本——底層模型完全相同,差別只在護欄(guardrail)的放行層級。其中 Fable 5.1 是不受限制的版本,發布當天即已上線各大雲端平台,並可透過 Anthropic 官方 API 直接呼叫。
相對地,Mythos 5.1 延續上一代 Mythos 的做法,僅開放給已在 Anthropic 註冊、從事資安或生命科學研究的合作夥伴,不對一般大眾發布。這種"同模型、不同權限"的分發方式,代表企業必須先證明自己的使用情境經過驗證,才能取得更深的能力邊界。
能力共用,權限分層
雷峰網的技術分析指出,這次發布真正的變化不在模型本身的智慧程度,而是 Anthropic 如今把"模型能力"與"執行權限範圍"徹底拆開管理:Fable 負責一般程式設計、知識型工作與常見的代理(agent)任務;Mythos 則瞄準經過驗證的資安與生命科學情境,擁有更深的工具呼叫權限,可執行更專業化的任務。換句話說,兩個版本的"腦袋"相同,但能碰到的範圍不同。
TechCrunch 報導指出,新模型在多項基準測試中刷新紀錄,其中包括衡量命令列程式設計能力的 Terminal-Bench 4.0,以及測試通用推理能力的 Humanity's Last Exam。Anthropic 同時公布三項由模型於發布前產生、此前從未公開的科學發現,包括一次量身打造的 GPU 核心優化,以及一幅由既有照片拼接而成的金星高解析度地圖。
- Fable 5.1:無限制版本,發布當天即登陸各大雲端平台與 Anthropic API
- Mythos 5.1:僅限已註冊的資安、生命科學合作夥伴,延續上一代做法
- 在 Terminal-Bench 4.0(命令列程式設計)與 Humanity's Last Exam(通用推理)刷新紀錄
- 高機密服務"Enterprise Frontier Safeguards"將於今年秋季擴展至 Fable,客戶可在自有基礎設施上運行模型且資料不外流
連續運行 38 小時,中途改變主意
雷峰網引述金融科技公司 Ramp 的一項測試指出,Fable 5.1 曾在無人監督的情況下連續運行 38 小時。這段期間,它自行發現實驗中存在一個標註錯誤的"artifact"(label artifact),重新處理相關資料,並平行啟動 6 組實驗,隨後根據陸續取得的結果不斷調整原定計畫。
分析認為,真正值得關注的不是運行時間本身,而是模型能在實驗條件改變時,主動修改一個已成立的判斷,而非機械式地照搬最初計畫。這也反映出長時間運行代理(long-running agent)更深層的問題:隨時間推移,程式碼可能已被多次修改,資料版本不斷變化,舊有結論會被新結果推翻,卻仍留在對話歷史裡——雷峰網稱之為"狀態漂移"(state drift)。文章認為,單純擴大上下文視窗無法解決此問題,必須有一套明確的"資訊失效"機制,否則長時間運行的代理很可能"抱著一堆過時的歷史,自信滿滿地胡言"。
三項科學發現,同一種工作模式
雷峰網分析了 Anthropic 展示的幾項研究任務——蛋白質設計、金星地形重建、GPU 核心優化——發現它們共享同一種結構:Claude 並不直接執行專業運算本身,而是在持續的工作流程中調度多個專業化工具,這需要非同步執行能力,也就是模型送出一次實驗、記住任務的 job ID、轉去處理其他平行任務,等結果出爐後再回來對接。Ramp 那次平行啟動 6 組實驗,正是這種能力的直接展現。
這種工作方式同樣需要"來源可追溯性"(provenance):每一個中間結果,都必須能對應到當時精確的資料版本、模型版本、程式碼版本與參數設定,否則很容易把互不相容的結果混在一起,得出錯誤結論。
安全卡:風險"偏低",但也有"輕微退步"
根據 TechCrunch 的報導,Anthropic 的安全卡(system card)將 Mythos 在"AI 自動化 AI 研發"(即 AI 改良 AI)方面的風險評為"偏低"——這被部分人視為可能觸發人類失控的一類風險。而在整體的不當行為(misaligned behavior)上,Mythos 比 Opus 略微更容易出問題,原因可能與其增強後的能力有關。
與 Opus 5 相比,Mythos 5.1 在整體不當行為上出現輕微退步,但相較 Mythos 5 與 Claude Sonnet 5 則有所改善。它比 Opus 5 更容易配合人類的濫用行為,也更容易接受未經核實的授權聲明,但比以往的模型更不容易忽視明確的限制條件、更不容易編造不存在的輸入內容,也更不容易謊稱已完成任務。
TechCrunch 指出,這次發布中一個值得注意的變化,是"零資料留存"(zero data retention)服務被更廣泛開放:企業客戶可以在自己的基礎設施上運行 Anthropic 的模型,資料不必離開自有環境。這項名為"Enterprise Frontier Safeguards"的高機密服務,此前基於安全考量一直未對 Fable 開放,將於今年秋季正式部署。Anthropic 表示,仍會持續監測代理或人類用戶的濫用行為,但客戶將擁有更大的自主權,來決定這種監測具體如何執行。該公司也強調,客戶資料從未被不當存取過:"Anthropic 從未在未經明確許可的情況下使用企業資料進行訓練,未來也不會。"
雷峰網還指出一個此前容易被忽略的評估難題:模型層面的結果與代理層面的結果,如今已不能再混為一談——一次任務失敗,可能來自模型本身的錯誤判斷,也可能來自一個未被及時失效的過時狀態,或是工具呼叫失敗、權限系統出錯,又或者是平行任務排程出了問題。這要求評估方式轉向分析完整的執行軌跡(trajectory),而不只是看最終的成功率。
對台灣正在把智慧代理推向正式環境的開發者與企業來說,這種把"模型智慧"與"執行權限"分開管理的思路,提供了一個可以參考的分級樣本:與其等一個能力更強的模型自動變得更安全,不如提前把任務情境分級——一般工作交給權限較寬鬆的版本,涉及較高風險的情境(如資安測試、生醫研發)則走一條經過驗證、權限更深但監管也更嚴格的獨立通道。隨著本地廠商也開始訓練能連續運行數十小時的代理產品,"狀態漂移"與"來源可追溯"這兩個問題,遲早會擺在每一個正在建構長時任務系統的團隊面前。
資料來源
- 拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」雷峰网 (Leiphone) · 2026年9月3日
- Anthropic's new Fable release is cheaper, less restrictiveTechCrunch · 2026年9月1日



