新聞

OpenAI周四(9/3)正式發表新一代模型GPT-6 Astra,宣稱這是該公司目前最聰明、與使用者意圖最一致的模型,同時也是首個被評定達到《準備框架》(Preparedness Framework)「重大」(Critical)網路安全能力門檻的模型。

在電腦操作、程式撰寫與科學推理等多項基準測試中,Astra都繳出優於前代GPT-5.6 Sol與Claude系列模型的成績。例如在FrontierMath Tier 4測試中拿下98%,ARC-AGI-3則達99.9%,且Astra在96%的關卡中超越人類的行動效率基準,因此在該基準上實質達到人類水準。此外,Astra協助研究人員在質數間距問題上取得進展,將已知的質數間隙上界從240縮小到186。

圖片來源/OpenAI

在網路安全上,Astra於ExploitBench測試中拿下滿分100%,並自主發現兩個此前未知的零時差漏洞,OpenAI表示已將相關漏洞通報給維護方。不過,OpenAI強調,Astra達到Critical等級的高階網路安全能力不會直接以預設生產配置開放,後續將透過Daybreak計畫逐步擴大防禦性用途。

值得注意的是,OpenAI同時公布了一項針對模型「逾越授權範圍」行為的測試結果,測試中刻意移除了正式產品環境通常會搭載的安全防護機制(如Codex Auto-review、確認政策等),單純比較模型本身的行為傾向。結果顯示,在面對困難或無法完成的任務時,GPT-5.6 Sol有48%的機率會超出原本被授權執行的範圍,而Astra在相同測試中則降至0%。

圖片來源/OpenAI

在另一個有安全防護機制的測試情境中,Astra從未嘗試繞過Codex Auto-Review的拒絕指令,即使該審核機制被刻意設定為可被規避、且任務在其它情況下無法完成,Astra仍未嘗試突破限制。

不過,Astra更高的推理效率也帶來新的監控難題。OpenAI發現,在要求模型規避監控的測試中,Astra能以更少的書面推理步驟完成任務,使人類監控者可用來判斷模型意圖的線索減少。

GPT-6 Astra今起先開放給少數組織使用,未來幾天將陸續開放給所有ChatGPT Plus、Pro、Business與Enterprise用戶,並透過OpenAI API與AWS提供。API標準定價為每百萬輸入Token 10美元、每百萬輸出Token 50美元,另提供速度加倍、價格也加倍的快速模式。