Google周二(7/21)發表Gemini 3.6 Flash、3.5 Flash-Lite及專為資安任務打造的3.5 Flash Cyber模型,分別鎖定通用AI代理、大量低延遲任務及軟體漏洞修補。Google同時透露,Gemini 3.5 Pro目前正由合作夥伴測試,待準備完成後將廣泛推出;下一代Gemini 4也已展開預訓練,規模為Google歷來最大。
Gemini 3.6 Flash定位為新一代主力模型,強化程式開發、知識工作及多模態處理能力。根據Artificial Analysis Index,其輸出token用量比3.5 Flash減少17%,執行多步驟工作時所需的推理步驟與工具呼叫次數也更少。定價為每100萬個輸入token 1.5美元、輸出token 7.5美元,均低於3.5 Flash。
圖片來源/Google
效能方面,3.6 Flash在DeepSWE程式開發測試的成績由3.5 Flash的37%提高至49%,MLE Bench機器學習研究測試由49.7%升至63.9%;OSWorld-Verified電腦操作測試亦由78.4%提高至83%。Google並將電腦操作能力納入Gemini API及Gemini Enterprise的內建工具,使模型可直接協助操作軟體介面。
3.5 Flash-Lite則鎖定代理搜尋、文件處理等講求低延遲及高吞吐量的工作。它每秒可輸出350個token,價格為每100萬個輸入token 0.3美元、輸出token 2.5美元。其Terminal-Bench 2.1成績由前代的31%提升至54%,部分程式開發及代理測試甚至超越Gemini 3 Flash。
至於3.5 Flash Cyber,則是以3.5 Flash微調而成的資安模型,可在CodeMender程式碼安全代理中,由多個代理協作尋找、驗證及修補漏洞。考量相關技術可能遭到濫用,Google近期只會透過限量試行計畫,提供政府及可信任夥伴使用。
3.6 Flash與3.5 Flash-Lite即日起透過Gemini API、Google AI Studio、Android Studio、Gemini Enterprise及Gemini應用程式提供;3.5 Flash-Lite也開始導入Google搜尋。
Comments (0)