Image with no description

去年8月,Nvidia正式推出新一代PCIe資料中心GPU產品RTX Pro 6000 Blackwell Server Edition(BSE),今年當所有人關注下一代Rubin架構GPU,3月GTC大會期間,Nvidia竟悄悄發表GPU記憶體容量較少、運算效能較低的款式,名為RTX Pro Blackwell 4500 BSE,應是為了供應更多企業資料中心與邊緣運算平臺的AI基礎架構建置需求,而且Nvidia在3月底釋出的vGPU軟體第20版,也正式支援這款機型

Image with no description

相較於其他RTX Pro Blackwell的GPU,RTX Pro 4500 BSE內建32 GB容量的GDDR7記憶體,同樣採用第五代Tensor核心與第四代RT核心,熱設計功耗僅為165瓦(高於RTX Pro 4000 Blackwell及以下款式),產品外觀也更精簡,只需要單張介面卡插槽(多數均需雙槽,RTX Pro 4000 Blackwell例外)。

比起上一代資料中心入門級GPU產品L4,在小型語言模型(SLM)如Nvidia Nemotron Nano AI 9B的推論處理上,RTX Pro Blackwell 4500 BSE效能可達到10倍;若用在基於Nvidia Cosmos Reason 2模型的影片摘要處理,搭配電腦視覺AI平臺Nvidia Metropolis時,運算效能提升至4倍。

對照僅搭配CPU的傳統伺服器,用於電腦視覺AI應用系統時,RTX Pro Blackwell 4500 BSE效能領先的幅度達到100倍;用於向量資料庫系統時,則是有50倍的效能差距;用於執行內建加速處理框架Nvidia cuDF的Apache Spark,資料查詢效能速度提升至5倍,若以10 TB資料處理為基準,搭配RTX Pro Blackwell 4500 BSE的伺服器,總體持有成本只需要純CPU伺服器的十分之一。

Image with no description Image with no description

縱觀市面上的伺服器廠商,目前有意搭配RTX Pro Blackwell 4500 BSE的機型,包括永擎4UXGM-GNR2 CX8華碩ESC8000A-E13P和碩AS205-2T1雲達QuantaEdge EGN77C-2U

Cisco表示,UCS M8系列伺服器將整合RTX Pro Blackwell 4500 BSE,包括UCS C845a M8、UCS C240 M8、UCS C245 M8、UCS X系列的X580p GPU PCIe節點、Unified Edge的UCS XE150c M8節點。

Supermicro則是針對RTX Pro Blackwell Server Edition設置專屬網頁,列出多款支援這兩款GPU的產品,涵蓋1U到5U尺寸的伺服器,單臺設備最多可搭配8張GPU。

Image with no description

在此同時,也有工業電腦廠商宣布,將搭配RTX Pro Blackwell 4500 BSE的機型,像是立瑞(Lanner Electronics)EAI-I730

若根據Nvidia合格系統目錄,技嘉XV23-ZU0-AAJ1與XV24-SU0-AAJ1是首批列入支援RTX Pro Blackwell 4500 BSE的伺服器產品。技嘉表示,之所以能在第一時間取得認證,主要得益於他們與Nvidia長期且緊密的合作,研發團隊在產品設計初期即同步對齊平臺規格與Nvidia的測試要求,完成首波且目前唯一的認證。

關於上述機型是否比照RTX Pro伺服器平臺,內建ConnectX SmartNIC交換器,技嘉表示,這兩款系統架構上採用直連設計,未使用第三方PCIe交換器架構。

Image with no description

在公有雲平臺方面,也有幾家廠商率先表態,AWS表示將是首批供應搭配RTX Pro 4500 BSE雲端運算服務的業者,除了今年1月正式上線搭配RTX Pro 6000 BSE的G7e,很快將推出搭配RTX Pro 4500 BSE的執行個體。Akamai在GTC 2026大會透露Akamai Inference Cloud將可選用RTX Pro 4500 BSE,並公開用於多種工作負載的效能表現。

Image with no description Image with no description

產品資訊

Nvidia RTX Pro 4500 Server Edition
●原廠:Nvidia
●建議售價:廠商未提供
●外形:單槽,全高全長(長10.5吋高4.4吋)
●GPU架構:Blackwell
●CUDA處理核心數量:10,496個
●Tensor核心數量:廠商未公開(第五代Tensor核心)
●RT核心數量:82個(第四代RT核心)
●內建記憶體容量:32 GB GDDR7
●記憶體頻寬:800 GB/s
●連接介面:PCIe 5.0 x16
●支援NVLink:否
●單精度FP32運算效能:51 TFLOPS
●RT核心效能:154 TFLOPS
●AI運算效能(FP4):1.6 PFLOPS
●視訊處理引擎:3個NVENC(第9代)、3個NVDEC(第6代)
●多執行個體GPU(MIG):2個16 GB記憶體
●耗電量:165瓦

【註:規格與價格由廠商提供,因時有異動,正確資訊請洽廠商】