Anthropic周二(9/22)推出新一代旗艦AI模型Claude Opus 5.5,為Claude 5.5系列首款模型,不只效能與成本有所改善,在一項新的安全評估中,試圖突破限制邊界的行為也較Opus 5及Claude Mythos 5.1減少約85%。
Anthropic表示,Opus 5.5是執行長Dario Amodei日前呼籲業界放慢前沿AI發展速度後,該公司推出的首款模型。除了在發布前交由METR及Frontier Design等外部機構測試,也接受Anthropic目前最完整的自動化行為稽核(Automated Behavioral Audit),這項測試涵蓋近2,000種模擬情境,用來檢驗模型可能出現的失準行為,Opus 5.5的測試結果優於Anthropic先前所有模型。
其中,Anthropic新增測試模型是否企圖跨越限制邊界的評估,結果顯示,Opus 5.5試圖規避限制的次數,比Opus 5或Claude Mythos 5.1減少約85%,仍出現的越界嘗試均屬低嚴重程度,且模型會自行回報。Opus 5.5在偏誤或動機性推理、試圖逃離沙箱,以及發現自己處於模擬環境後採取有害行動等行為上也有所改善。不過,Anthropic指出,Opus 5.5在測試中有時會察覺自己正在接受評估,因此結果未必能完全反映模型在真實環境中的行為。
在效能上,Anthropic公布的測試顯示,Opus 5.5與OpenAI的GPT-6 Astra互有勝負。在代理式程式開發測試Terminal-Bench 4.0中,Opus 5.5取得66.4%,高於Astra的57.9%;FrontierCode則為54.4%,略高於Astra的53.3%。知識工作測試GDPval-AA v2.1中,Opus 5.5取得1846 Elo,也高於Astra的1542。
不過,Astra在部分測試仍領先Opus 5.5,包括商業工作流程AutomationBench取得41.4%,高於Opus 5.5的40%;代理式科學研究Terminal-Bench-Science則為64.6%,高於Opus 5.5的58.7%。Opus 5.5典型工作負載成本則較Opus 5降低40%,輸出速度提高超過30%,每百萬個輸入及輸出token價格分別為4美元及20美元。
Claude Opus 5.5目前已在Claude所有平臺上推出,Anthropic也提高Pro、Max、Team及部分Enterprise方案的Claude使用額度,讓用戶在原本每5小時的額度周期內可使用更多Claude,並提供訂閱用戶一次可自行選擇時間使用的額度重置機會。Claude Sonnet 5.5及Claude Haiku 5.5則將在未來幾周推出。
Comments (0)