新聞

Anthropic周二(9/1)發表新一代旗艦模型Claude Fable 5.1與Mythos 5.1。在提升性能與優化成本之外,Anthropic首度對一般使用者放寬安全護欄,開放Fable 5.1用於發掘軟體漏洞,但依然禁止開發攻擊程式。

Fable與Mythos採用完全相同的基礎模型,核心差異在於安全防護等級。Mythos僅提供給特定機構使用,Fable則面向所有一般用戶。兩者皆支援100萬token上下文,單次輸出上限達12.8萬token。

在基礎能力上,Fable 5.1較上一代大幅提升,科學研究基準翻倍至52.6%,業務流程自動化提升至31.4%。在程式設計基準(Terminal-Bench 4.0)上,Fable 5.1與Mythos 5.1雖為同一模型,分數卻分別是55.8%與60.9%;Anthropic說明,這是因為Fable 5.1測試時安全護欄仍會介入、部分任務改由Opus系列代答,因而拉低了實測分數,Mythos 5.1則是在解除護欄的狀態下測出真實能力。此外,因規範要求,兩款模型也首度內建不可見浮水印,以符合歐盟AI法案。

在成本上,Fable 5.1的快取讀取費用大降75%,使典型工作負載成本降低25%、代理式任務更省45%,並另外導入防蒸餾機制。合規方面,企業客戶可透過新推出的EFS方案,取得等同零數據保留的隱私保護,將於今秋起分階段開放。

安全功能則因定位不同而分道揚鑣。Fable 5.1首度開放用於發現原始碼中的軟體漏洞,讓開發者與研究人員能藉助AI找出程式碼中的弱點,網路安全誤報也同步減少約60%。不過Anthropic畫下明確紅線,Fable 5.1雖然可以發現漏洞,但依然嚴禁用於開發攻擊程式、執行滲透測試或進行二進位制漏洞掃描。

至於Mythos 5.1則具備更強的網路安全能力,在解除防護的測試中,於ExploitBench、OSS-Fuzz、Firefox 147、ExploitGym等多項資安基準上均明顯超越Opus 5,是Anthropic目前發布過資安能力最強的模型;該模型透過Cyber Verification Program(CVP)與Life Sciences Verification Program(LSVP)兩項信任存取計畫提供,分別開放給經審核的資安防禦者與生命科學研究者使用,目前僅限美國機構申請。