OpenAI與博通(Broadcom)周三(6/24)共同發表首款自研AI推論晶片Jalapeño,加入Google、AWS及微軟等科技業者自研AI晶片布局。OpenAI預計於2026年底開始部署Jalapeño。
Jalapeño是OpenAI首款自研AI推論晶片,也是其Intelligence Processor產品線的第一代產品,名稱取自墨西哥辣椒。不同於Nvidia的GPU同時支援AI訓練與推論,Jalapeño專為大型語言模型推論設計。由於AI模型完成訓練後,每次回應使用者都需執行推論,使得業者近年紛紛投入自研推論晶片,以降低對Nvidia的依賴。
OpenAI表示,Jalapeño是依據其模型、核心運算(Kernel)、推論服務系統(Serving System)及產品需求,從零開始設計,並由博通負責晶片實作、高速網路及量產,Celestica負責電路板、機櫃與系統整合。目前工程樣品已可執行GPT-5.3-Codex-Spark等工作負載。
此外,Jalapeño從初步設計到完成晶片定版(tape-out)僅歷時9個月,除了博通協助完成晶片實作外,也利用OpenAI模型協助部分晶片設計與最佳化流程,這可能是高效能ASIC迄今最快的開發周期。初步測試顯示,Jalapeño的每瓦效能優於目前最先進產品,其架構藉由降低資料搬移、平衡運算、記憶體與網路資源,提高硬體使用效率,完整效能測試結果將在數月後公布。
OpenAI指出,Jalapeño是該公司完整技術堆疊(full-stack)策略的一環,除了開發AI模型與產品外,也開始自行設計晶片、記憶體、網路及部署系統等底層基礎設施,希望藉由整合各層技術,提高模型執行效率。
Comments (0)