新聞

Nvidia於周一(8/24)舉行的Hot Chips大會上宣布,專為AI代理(Agentic AI)打造的Vera CPU已獲SpaceXAI採用,將部署於Grok基礎設施與Starmind AI衛星;同時量產Groq 3 LPX推理晶片,提供每秒3,400個token的極速生成,由Nebius率先導入。這兩款晶片皆為Vera Rubin平臺核心,全面加速Agentic AI部署。

Nvidia指出,隨著AI從單純回答問題進階到能自主執行任務的Agentic AI時代,硬體架構必須全面革新。為此,Nvidia推出下一代資料中心架構Vera Rubin平臺,將過去由單一GPU包辦的運算重新分工。在這個平臺中,Vera CPU扮演「邏輯指揮官」,專門處理寫程式、調用外部工具與流程編排;Groq 3 LPX則充當「極速引擎」,負責以超高速度產出文字與指令。兩者高度協同,徹底解除AI代理在執行多步驟複雜任務時的延遲瓶頸。

其中,獲SpaceXAI採用的Nvidia Vera CPU是業界首款專為AI代理設計的處理器。不同於傳統專注於矩陣計算的GPU,Vera CPU具備88個自研Olympus核心與高達1.2TB/s的記憶體頻寬,任務完成速度比傳統x86 CPU快上1.8倍。SpaceXAI表示,在訓練與運行Grok模型時,Vera CPU能接管寫程式、資料過濾及多模組編排等繁重作業,讓GPU得以100%發揮其運算潛能,大幅提升整體AI資料中心的每瓦特效能比。

此外,SpaceXAI與Nvidia的合作並不侷限於地表資料中心。隨著SpaceXAI將其Grok基礎設施擴建至吉瓦(GW)級規模,雙方進一步宣布將Vera Rubin NVL72機架級系統推向太空軌道。SpaceXAI準備打造第一代Starmind AI衛星,利用此一高度整合的Nvidia架構解決軌道環境下嚴苛的散熱、功耗與頻寬限制,創下AI代理基礎設施從地表大型工廠延伸至太空運算平臺的首例。

除了Vera CPU的商業進展外,Nvidia在Hot Chips大會上也宣布專為極速推理打造的Groq 3 LPX晶片正式進入量產階段。Nvidia於2025年底支付約200億美元取得Groq非獨家技術授權,並延攬其核心團隊,將Groq領先的LPU極速推理架構整合至Vera Rubin平臺。

作為Vera Rubin平臺的擴充模組,Groq 3 LPX在Artificial Analysis基準測試中,運行開源代理模型Gemma 4 31B(於10萬token長上下文環境)創下每秒3,400個輸出token的紀錄。其專為低延遲設計的架構,能將AI代理撰寫程式碼等任務的回應時間縮短4倍,讓過往需耗時數小時的複雜工程在數分鐘內完成。

歐洲AI雲端巨頭Nebius成為全球首家採用Groq 3 LPX的業者,並整合至其Nebius Token Factory服務,支援開發者的極速推理能力。此外,Groq也在自家GroqCloud服務中整合Groq 3 LPX,成為首批部署業者。Nvidia執行長黃仁勳強調,推理是AI成長的引擎,Groq 3 LPX將透過Vera Rubin平臺提供前所未有的極速token生成能力,重新定義AI工廠的生產效率與使用者體驗。

整體而言,Nvidia藉由Groq 3 LPX的極速推理與Vera CPU的深度採用,完成下一代Vera Rubin平臺的核心布局,等於宣告AI運算邁入自動化代理的新時代。