Anthropic上周五(8/7)宣布,自本周五(8/14)起,將把自動模式(Auto Mode)設為Claude Code Pro、Max及Team方案新工作階段的預設權限模式。Enterprise、Claude API及各雲端平臺目前仍須自行啟用,預計未來一個月才會變更。
Claude Code是Anthropic開發的AI程式代理人,2025年5月正式開放使用,可在終端機、整合開發環境(IDE)及桌面應用程式中執行。它提供3種權限模式,包括執行命令前詢問使用者的人工核准模式、直接執行命令的略過權限檢查模式,以及由AI分類器判斷是否放行的自動模式,原本預設採用的是人工核准模式。
Anthropic表示,頻繁詢問容易造成「權限疲勞」。Claude Code使用者核准了97%的權限提示,顯示許多人可能未仔細檢查便直接同意;另有62%的使用者曾使用略過權限檢查模式,或設定執行Bash命令時不再詢問。
Anthropic委託研究機構招募1,053名測試者使用Claude Code寫程式,研究人員再將每人收到的其中一次正常權限提示,替換成明顯危險的命令,觀察測試者是否仍會同意執行。結果只有13.6%的測試者拒絕危險命令,同樣的命令交由自動模式判斷時,則有89%遭到攔截。隨著工作階段拉長,人工攔截率更由約17%降至5%,自動模式則維持穩定。
自動模式也可減少任務因等待核准而中斷。根據Anthropic的統計,在Team與Enterprise方案中,使用自動模式者提交的PR數量約高出25%。
為提高安全性,Anthropic透過內部及第三方紅隊測試改進分類器。英國AI安全公司Apollo Research以模擬攻擊找出分類器的弱點後,Anthropic加入程式碼庫是否公開、Git狀態及資料處理規則等判斷資訊。Apollo再以Anthropic事前未看過的另一批攻擊測試,結果兩批測試的整體漏判率由12%降至7%。
實際運作時,一般操作可直接執行,高風險操作則會遭攔截;資料外洩等行為屬強制拒絕項目。系統也會檢查破壞性Git命令、程式碼推送目的地及外部內容中的提示詞注入。不過,Anthropic坦言分類器仍可能誤判,高風險操作仍應由使用者親自審查。
Comments (0)