新聞

Anthropic本周公布了AI濫用威脅報告,揭露各界濫用其模型Claude的各種型態,從網路攻擊、資訊操弄、AI輔助監控、開發傳統武器、生物濫用、詐騙與詐欺,以及非法蒸餾等,並直接點名7家中國AI實驗室的非法蒸餾行為,包括阿里巴巴的Qwen、月之暗面(Moonshot)、DeepSeek、智譜(Z.ai)、小米、商湯及MiniMax等。

帳戶自去年3月以來開始不定期發布濫用其Claude模型的調查報告,上一次是2025年11月,這是第四次的調查報告。Anthropic系統會於背景自動執行各種分類器,以監控特定類行的有害行為,一旦觸發便會展開調查,而非人工翻閱對話內容,確認涉案後便會封鎖帳戶,強化防護機制,部署額外監控,並與合作夥伴分享情報。

今年2月,Anthropic已公開指控包括DeepSeek在內的中國 AI業者以大量的詐欺帳戶來蒸餾Claude能力,然而,報告顯示,即使在被Anthropic發現並封鎖帳戶之後,這些AI業者並未停止攻擊。

蒸餾指的是用一個較大且能力較強的模式針對一批輸入產生回應,再以這些對話去訓練較小的模型,而所謂的非法蒸餾則是未經原模型所有人授權,大量萃取某個模型能力的作法。

其中,Qwen在5~7月間利用逾3,500個詐欺帳戶與Claude進行超過1.5億次的對話,單日峰值近300萬次;同樣在5~7月間,月之暗面亦動用逾5,300個詐欺帳戶與Claude進行2,300萬次的對話,在一個10天的期間,月之暗面甚至把近30萬個本來應該是要詢問自家Kimi模型的客戶請求,偷偷轉發給了Claude,最後再以Kimi的角色回答。

DeepSeek也在14天內與Claude進行了1,210萬次對話;智譜是在10天透過逾270個詐欺帳戶與Claude進行77萬次對話,小米是在20天內以1,500個帳戶與Claude進行40萬次對話;而商湯則是向第三方資料商購買對話紀錄。

MiniMax則是自己成立了一家空殼公司,以新公司名義代理Claude及ChatGPT服務,而且只代理這兩個模型,藉以蒐集用戶跟模型的對話以訓練自家模型。

由於Anthropic封鎖了來自中國地區的存取,於是這些中國AI業者只能透過各種管道存取,包括透過假身分或被盜的信用卡/API金鑰大量開立新帳號,採用商用VPN或代理伺服器服務,盜用合法客戶的API金鑰,透過第三方的模型路由服務,或是透過境外公司繞道等。當Anthropic察覺異常活動量或是時區與連線地區不符等訊號時,便會採取行動識別背後組織並採取行動。