新聞

中國AI業者Z.ai 8月26日發布GLM-5.3-Flash,並證實近日在OpenRouter與OpenCode以匿名身分提供的Ox Alpha模型,就是新模型發布前的測試版本。測試期間,OpenRouter並未公開實際模型供應商,Z.ai如今也揭露,Ox Alpha所有推論流量都由採用中國AI晶片的大型叢集處理。

以OpenRouter為例,使用者雖知道資料會交給匿名供應商,卻無法得知對方身分與來源,也凸顯匿名模型在資料用途、處理方與處理地點等資訊揭露上的治理問題。

GLM-5.3-Flash是GLM-5系列首款原生多模態模型,總參數達3,200億,每個詞元(token)約啟用180億個參數,可處理文字、影像等不同資料。Z.ai發布前先以Ox Alpha名稱在OpenRouter與OpenCode匿名測試,模型很快吸引大量使用。OpenRouter截至8月24日的程式設計模型排行顯示,Ox Alpha處理的詞元達10.3兆,占程式設計模型同期使用量30.9%,排名第一。Z.ai表示,匿名測試是為了透過實際使用蒐集回饋。

Ox Alpha當時在OpenRouter被列為匿名模型,使用者看不到實際開發商名稱與來源。OpenRouter負責將輸入內容轉送給模型供應商處理,其匿名模型計畫使用條款也明定,不會向使用者揭露供應商身分。

不過,OpenRouter對這些資料後續用途的公開說明存在落差,Ox Alpha模型頁面寫明,使用者提示詞與模型回覆會由供應商保留,但不會用於訓練,OpenRouter當時在官方X貼文也做出相同說明。

另一方面,匿名模型計畫的使用條款則寫明,使用者內容可提供給供應商,用於模型訓練、評估與改進。使用者看到的Ox Alpha模型專屬說明稱不做訓練,但接受的Stealth Program通用條款卻授權更廣泛的資料用途。

Z.ai此次進一步說明,Ox Alpha測試期間使用數萬顆中國自行開發的AI加速器提供服務,並針對長篇內容與多模態資料調整推論系統。官方宣稱,在相同硬體上經過最佳化後,端到端服務效能較最初版本提高3倍,每個詞元的處理成本可接近主流Nvidia GPU。

Z.ai並未說明Ox Alpha測試期間使用的運算叢集位於哪些國家或地區,Z.ai隱私政策與API資料處理附約指出,其服務一般由新加坡提供,相關集團公司與指定服務商通常位於新加坡,個人資料與API客戶資料也一般在新加坡處理。不過,這些文件適用於Z.ai自有服務與API,不能據此確認Ox Alpha透過OpenRouter與OpenCode測試時的實際資料處理地點。

GLM-5.3-Flash目前已正式提供使用,模型權重也已公開於Hugging Face。