Anthropic的Claude Code技術主管Thariq Shihipar周三(7/1)透露,Anthropic今日(7/2)將自Claude Code移除一項針對中國市場的實驗性防禦機制。該機制近日遭揭露會暗中偵測中國時區、網域及AI實驗室,並透過隱寫術(Steganography)將結果藏在系統提示詞中回傳,以防範未授權轉售與模型蒸餾(Distillation),但因缺乏透明度引發開發者信任危機。
根據一名Reddit用戶LegitMichel777的描述,他藉由逆向工程在Anthropic於4月2日發布的Claude Code 2.1.91版本中發現,會在使用者改以Proxy或Gateway連線時,透過系統提示詞中的日期格式及Unicode字元差異,暗中傳遞環境資訊。
此一內建於Claude Code的機制主要偵測使用者是否改用Proxy或Gateway、主機時區是否為中國,以及Proxy/Gateway網域是否位於特定清單中,包括DeepSeek、Moonshot、MiniMax、智譜、百川、或是零一萬物等中國AI實驗室。倘若符合條件,Claude Code便會秘密修改發送給模型的系統提示(System Prompt),例如將日期格式從2026-06-30改為2026/06/30;或者將"Today's date is"裡的撇號(')替換成肉眼難察、但機器可識別的特殊Unicode字元(如’、ʼ、ʹ)。
LegitMichel777認為,Anthropic在原始碼中針對該機制進行XOR加密混淆,且未於更新日誌中披露,屬於侵犯隱私的間諜軟體行為,也破壞了開發者的信任。
這篇兩天前才張貼的Reddit文章旋即引來大量留言,有些人認為這只是常規的遙測及智慧財產權的保護,以預防中國業者蒸餾Claude模型,也有人認同LegitMichel777的看法,覺得Anthropic故意混淆程式碼,利用隱寫術修改提示詞,而且不公開說明的作法的確值得商榷。
也有中國開發者抗議,稱他付費訂閱,也對開源社群有所貢獻,亦未執行蒸餾行為,卻因為時區而被當作二等公民防範。
事實上,在Anthropic Claude的地區支援頁面上,就沒有中國、香港、澳門、北韓、伊朗及俄羅斯等國家或地區。
其實Anthropic在今年2月就曾發表文章,指控中國3大AI實驗室針對Claude發動大規模的蒸餾攻擊,包括DeepSeek、Moonshot與MiniMax,總計利用約2.4萬個虛假的帳號,產生超過1,600萬次的對話,繞過區域限制,以非法榨取Claude的核心能力來訓練自己的模型。
其中,創立於2021年、甫於2026年1月在香港交易所掛牌上市的MiniMax(名之夢)為中國最受矚目的AI獨角獸之一,它與Claude進行超過1,300萬次對話,鎖定自動化編碼、工具調用及編排功能,而且可在Anthropic推出新模型的24小時內轉移近一半的流量,瘋狂抓取最新模型的能力。
Anthropic並未揭露在偵測到這些假帳號之後的作法,但業界的共同作法大抵是封鎖這些違反服務條款的帳號,或是攔截與降級流量。
在Anthropic的作法遭到炎上之後,技術主管Shihipar出面坦承,這是一個在今年3月啟動的實驗,以防止帳號遭到未授權轉售商的濫用,以及防範模型被拿去蒸餾;不過之後團隊已經有了更強大、更有效的防禦機制,本來就打算要關閉該作法,已經合併程式碼變更,將會在隔天的改版更新中撤銷該機制。
Comments (0)