Claude Fable 5.1上線:避險基金說它抓出「四年沒人解開的當機」,分身Mythos還重繪了金星地圖

對沖基金Millennium說:這隻AI抓到了四、五年沒人解釋的當機
Anthropic在2026年9月1日發布Claude Fable 5.1與Claude Mythos 5.1。兩者其實是同一顆模型,差別只在安全防護層級:Fable 5.1一般用戶就能用,Mythos 5.1則只開放給通過信任審查的專業機構。發布公告裡最讓人印象深刻的一句話,來自對沖基金Millennium——他們說這個模型找到了「一個團隊裡沒有任何人能解釋長達四到五年的當機問題」。
科學任務的準確率,直接翻了一倍以上
跑分數字也支撐了這個說法。在Terminal-Bench-Science 0.1(模擬真實科學研究流程的測試)上,新模型拿下52.6%,前一代Fable 5只有24.7%,等於直接翻倍還多。程式撰寫方面,Terminal-Bench 4.0上Mythos 5.1拿到60.9%,前代是42.0%。知識工作能力指標GDPval-AA v2則從1723分進步到1853分。跨領域推理測試Humanity’s Last Exam(搭配工具使用)進步幅度就溫和許多,從63.8%微升到65.0%——不是每一項指標都翻倍成長,但至少說明這次升級不是只挑漂亮數字放大宣傳。
其他早期用戶怎麼說
量化交易公司Jane Street表示,Fable 5.1「解決的程式問題比Fable 5或Opus 5都多,在交易直覺判斷上達到業界最先進水準」。專做AI工程師的新創Cognition(旗下產品Devin)則直接表態:「上線當天就把原本跑在Opus 5上的流量全部切過來」。資料庫公司MongoDB則說團隊用它「大約三天就做出一個複雜的原型」,而且「驗證迴圈很扎實」。合約審閱工具Crosby的評分則從47.9分進步到57.0分;瀏覽器自動化任務的完成率達到82%。
用得多、算得快,但單價沒漲
Anthropic這次沒有調漲基礎單價:輸入還是每百萬token 10美元、輸出50美元。真正變動的是快取讀取費用——從每百萬token 1美元砍到0.25美元,等於便宜了75%。官方估計一般工作負載大概能省下25%成本,高度依賴agent操作的任務甚至可以省到45%。
Mythos版本:畫出金星地圖、設計蛋白質
限量開放的Mythos 5.1,展示的則是更硬核的科研能力。在分子設計測試中,它設計出的分子結合力比競賽對手高出10倍,在12個蛋白質標靶上達到50%命中率——一般水準大約只有10%到15%。它還拿三十年前的NASA舊資料,重新算出金星的高解析度地形圖,把解析度從原本的10到20公里,提升到2到3公里,高度精確度也提升了25%。在計算生物學上,它把七套深度學習模型的運算效率最多優化了2.5倍,讓全基因組分析的GPU成本降低30%到60%。
安全機制也跟著升級
隨著能力變強,Anthropic也同步加強了防護:資安任務的誤判率降低60%,而且新模型現在能反過來用於防禦——主動找出軟體漏洞而不是被拿來攻擊;生物領域的安全防護也調整得更精準,減少誤擋正常查詢。企業版還會在2026年秋天推出「Enterprise Frontier Safeguards」,讓客戶資料完全留在自己的雲端環境裡。針對網路安全與生命科學這兩個高風險領域,Anthropic分別設立了獨立的審查機制,Mythos 5.1目前僅限美國機構申請,且需要與政府單位協調。另外新增的防蒸餾機制,讓新用戶無法一邊保留Claude的完整思考紀錄、一邊手動竄改先前的對話內容——這是針對「拿Claude的推理過程去訓練自己模型」這種做法設下的技術門檻。這些模型也已經簽署歐盟AI法案的行為準則(2026年7月),輸出內容帶有不可見浮水印,並開放偵測API給主管機關、執法單位、媒體、事實查核組織與研究者使用。
想用的話,去哪裡找
Fable 5.1目前已經上架Claude.ai、Claude Code、Claude Enterprise、Claude Platform,以及AWS、Google Cloud、Microsoft Azure等雲端平台,開發者可以透過API模型代號claude-fable-5-1直接呼叫。Mythos 5.1則因為安全審查門檻較高,目前僅限美國機構申請,且需要與政府單位協調才能取得存取權限。



