新聞

The Information本周引述消息人士報導,Meta的AI模型在近日的測試中入侵了其他公司的系統並修改設定。

這是OpenAI、Anthropic之後,最新一家AI大廠傳出AI模型逾越原有限制入侵其他公司系統。

Meta對路透社證實此事。和Anthropic之前自我揭露的案例類似,Meta表示,這是因為合作廠商Irregular的測試環境配置錯誤,使模型意外得以連上網際網路而連上其他公司網域。後者存在已知漏洞,讓模型得以存取其系統。

Meta並未說明發生問題的是哪個模型,不過The Information報導,Meta是在測試Muse Spark ​1.1時,模型入侵一家不知名公司的系統,並且修改了內部環境設定。

Irregular也對路透社表示,Meta模型事件並未有模型逃逸出沙箱,或是濫用零時差漏洞等嚴重行為。Meta和Irregular表示正在調查此事。Irregular說正在準備關於事件解決和安全網路測試的白皮書。

OpenAI和Anthropic都在近日模型測試時發生令人不安的行為。除了更早之前OpenAI模型入侵Hugging Face一事外,在英國政府評估AI模型能力與風險的研究組織AI安全研究所(UK AI Security Institute,AISI)測試中,Anthropic Claude Mythos對GitHub進行供應鏈攻擊、並對專案維護者發動社交工程及精準釣魚、還會上傳有惡意程式碼的臭蟲報告,還有欺騙行為。OpenAI GPT-5.6 Sol則在進行Irregular提供的CTF (Capture the Flag)評估中,也誤擊了真實公司的網域。