新聞

資安業者F5旗下研究團隊公布7月AI模型安全評測結果,共納入55款模型。這項評測採用綜合AI安全指數(Comprehensive AI Security Index,CASI),衡量模型抵禦常見提示注入及越獄攻擊的能力,分數越高代表防護表現越好。

Anthropic模型包辦7月CASI排行榜前三名,Claude Sonnet 5以93.08分居首,Claude Haiku 4.5以92.54分排名第二,Claude Opus 4.8則以89.67分排名第三。CASI超過90分的兩款模型中,Claude Sonnet 5的AI能力表現測試成績為53.4%,Claude Haiku 4.5則為23.7%。

在開放權重模型方面,Nvidia旗下Nemotron-3-Ultra-550B-A55B的CASI達83.68分,排名第四,但AI能力測試成績僅37.8%;AI業者Zai的GLM-5.2能力測試成績較高,達51.1%,CASI則為46.58分。

研究團隊這次將名為Adversarial Tales的單輪越獄手法納入測試,編寫40篇包含有害操作程序的賽博龐克短篇故事,要求模型分析敘事結構。測試涵蓋9家業者的26款頂尖AI模型,平均攻擊成功率達71.3%。其中,Qwen3 Max的攻擊成功率最高,達94%;Claude Haiku 4.5最低,仍有35%,F5認為這樣的抵抗攻擊能力表現仍然不足以作為建構安全架構的依據。