新聞

Anthropic周二(6/30)宣布,美國政府已解除對Claude Fable 5的出口管制,Claude Fable 5將自7月1日起重新開放全球用戶存取;至於Claude Mythos 5,則已於6月26日獲美國政府核准,先恢復部分美國組織使用,Anthropic仍將與政府協調,逐步擴大Glasswing計畫合作夥伴的存取權限。

Claude Mythos為Anthropic針對高階資安防禦任務所開發的模型,最早於今年4月以Claude Mythos Preview形式推出,透過Glasswing計畫(Project Glasswing)提供少數資安防禦者及關鍵基礎設施供應商使用。Anthropic在6月9日同步發表Claude Fable 5與Claude Mythos 5,兩者採用相同的底層模型,但Fable 5加入安全防護機制並對外開放;Mythos 5則解除部分安全限制,依舊僅提供參與Glasswing計畫的受信任合作夥伴使用。

不過,根據路透社(Reuters)及Axios等美國媒體報導,Amazon研究人員曾向美國政府通報Claude Fable 5的安全疑慮,引發白宮與美國商務部關切。美國政府隨後於6月12日針對Claude Fable 5與Claude Mythos 5實施出口管制,要求限制外籍人士存取這兩款模型。由於Anthropic當時無法即時驗證所有使用者國籍,因而直接暫停Fable 5與Mythos 5的所有存取權限。

Anthropic本周解釋,Amazon研究人員所提出的方法,是透過特定提示繞過Claude Fable 5的資安安全分類器,使模型辨識部分軟體漏洞,並在個別案例中產生漏洞利用方式的示範程式碼。然而,該方法並未取得Claude Mythos 5層級的高階資安能力,而是Claude Fable 5安全分類器的「邊界案例」(Edge Case),亦即僅在特定情境下才能繞過部分安全防護,而非普遍存在的漏洞。

Anthropic指出,就算是Claude Opus 4.8、GPT-5.5及Kimi K2.7等模型也能完成類似任務,因此Amazon提出的方法並未讓Fable 5具備Claude Mythos 5等級能力。儘管如此,Anthropic仍已更新Fable 5的安全分類器,以降低相關風險。

此次事件也促使Anthropic決定與Amazon、Google、Microsoft及Glasswing計畫合作夥伴共同建立AI越獄評估框架(AI Jailbreak Evaluations),以作為未來評估模型安全事件的共同標準。該公司認為,目前業界對於AI越獄的定義與嚴重程度缺乏一致標準,容易因個別案例而產生不同解讀,因此希望建立更客觀、可重複驗證的評估機制。

Anthropic表示,新的評估框架將檢視越獄手法是否真正提升模型能力,而不只是繞過部分安全防護,並評估其攻擊價值、重現穩定性及現實危害,避免模型部署或存取決策僅取決於單一漏洞通報。

自7月1日起,Claude Fable 5將重新開放全球用戶透過Claude Platform、Claude.ai、Claude Code及Claude Cowork存取,AWS、Google Cloud及Microsoft Foundry上的服務也會儘快恢復。至於Claude Mythos 5,則仍限Glasswing計畫的受信任合作夥伴使用,Anthropic將持續與美國政府協調擴大存取範圍。