Anthropic執行長Dario Amodei發文澄清,Anthropic從未主張全面禁止開放權重模型,並認為不具危險能力的開放權重模型,可為企業、開發者與研究人員帶來價值。不過,面對能力較強模型可能帶來的風險,Anthropic仍主張限制中國取得高階晶片、打擊工業規模模型蒸餾,並要求具足夠能力的開放與封閉模型接受安全測試。
該說明回應近期美國開放權重模型政策爭議,Dario Amodei表示,有報導指部分美國官員考慮禁止美國企業使用中國開放權重模型,多家科技公司因而聯名支持開放權重,也有人質疑Anthropic希望藉由禁令保護自身業務。他認為,全面禁令無法處理主要國安風險,因為最危險的模型可能由威權政府祕密訓練,僅供軍事、情報或監控用途,是否公開權重及是否由美國企業採用,並非關鍵。
Dario Amodei也指出,開放權重模型在網路攻擊、生物攻擊及模型對齊方面,可能比封閉模型帶來更高風險。權重一旦釋出,模型提供者便難以持續監控用途、更新防護措施或撤回已流通副本,不過禁止合法美國企業使用,也無法阻止惡意行為者取得或部署模型。
Anthropic提出的第一項措施,是限制中國取得高階AI晶片與晶片製造設備,並加強取締走私及規避出口管制的管道。Dario Amodei認為,先進模型仍高度依賴運算資源,限制高階晶片供應,比依模型是否開放權重實施禁令更直接。
第二項措施是打擊工業規模模型蒸餾。蒸餾可利用能力較強模型的輸出訓練其他模型,所需運算資源低於從頭訓練。Anthropic認為,大規模蒸餾可能協助中國在晶片受限下,縮小與美國先進模型的能力差距,因此應透過政策與商業措施加以遏止,模型服務業者也可偵測並停用相關帳號,而非禁止所有開放權重模型。
第三項措施則是對具足夠能力的模型實施發布前安全測試,評估網路、生物及對齊風險,不因模型來源國家或採開放、封閉權重而有不同標準。Dario Amodei主張,開放權重是否提高風險,以及相關風險能否降低,應由實際測試判定,而非預先認定,而且測試若要有效,也需要各國共同採行。
Comments (0)