阿里巴巴週一(8/3)發布新一代旗艦AI模型Qwen3.8-Max,總參數量達2.4兆,是目前規模最大、能力最強的Qwen模型。該模型現已透過千問AI平臺及阿里雲百鍊提供API服務,並將於下週開放模型權重,成為Qwen系列首款開放權重的Max等級旗艦模型。
Qwen3.8-Max以Qwen3.5架構為基礎,採用稀疏混合專家(Mixture of Experts,MoE)架構及混合注意力機制。模型雖有2.4兆個參數,但每次處理任務僅啟用950億個參數,可在維持大型模型能力的同時,降低運算成本與延遲。它支援文字、圖片、文件及影片等多模態輸入,主要強化程式開發、工作協作、科學研究與長時間任務能力。
阿里巴巴公布的測試顯示,Qwen3.8-Max在Terminal Bench 2.1程式開發測試取得86.6分,低於GPT-5.6 Sol的88.8分,但高於前代Qwen3.7-Max的74.5分;在評估AI重現研究論文能力的PaperBench取得93分,則超越GPT-5.6 Sol、Claude Opus 4.8及Fable 5。不過,各模型採用的測試框架及設定不盡相同,成績無法直接比較。
在阿里巴巴展示的案例中,Qwen3.8-Max曾連續自主運作約16天,從零建立可依據使用者意見、測試及執行紀錄持續改進的程式代理人框架,期間完成265次程式碼提交及127項拉取請求。它也曾花費約125小時重現一篇AI訓練研究論文,執行33輪GPU訓練後,再自行提出並測試18種改良方法,使AIME24數學測試成績較原論文方法提高2.7分。
阿里巴巴表示,開放權重後,開發者將能自行部署及調整Qwen3.8-Max。不過,由於模型總規模達2.4兆參數,實際部署仍需大量運算及儲存資源,阿里巴巴尚未公布權重採用的授權條款與硬體需求。
Comments (0)