Vera Rubin每瓦可產出的詞元數較GB200 NVL72提升10倍
NVIDIA這次分享 Vera Rubin最新效能的重點包含:CoreWeave初步以DeepSeek-R1進行測試的結果顯示,Vera Rubin每瓦可產出的詞元數較GB200 NVL72提升10倍。在3個月內,NVIDIA軟體將GB200每百萬瓦的輸送量最高提升4倍,背後涵蓋25萬種配置,以及累計140萬GPU小時的測試。
相較 x86包括代理型AI效能最高提升1.9倍
另外,Vera相較x86帶來顯著效能提升,包括代理型 AI效能最高提升1.9倍、延遲表現最高改善6倍,且在特定基準測試中,效能幾乎是AMD EPYC Turin的2倍。極致協同設計將電力與冷卻效率最大化,在相同電力預算下可部署多達40%的GPU,而採用攝氏45度閉環冷卻系統,每百萬瓦每年約可節省400萬加侖用水。
NVLink 6的模擬解碼輸送量最高提升 2.3倍
NVIDIA網路技術的效能大幅超越一般乙太網路,NVLink 6的模擬解碼輸送量最高提升2.3倍;Spectrum-X 則提供高出1.6倍的RDMA頻寬、將交換器數量減少1.7倍、提升5倍光學能源效率,並帶來高出10倍的可靠性。
Vera Rubin的部署已涵蓋 30個國家、逾 350個據點的 300家合作夥伴
NVIDIA揭露Vera Rubin的部署由成熟的全球生態系提供支援,已涵蓋30個國家、逾350個據點的 300家合作夥伴,包括OpenAI、CoreWeave、Google Cloud、Microsoft Azure、Meta、Mistral、OCI、戴爾科技集團等業者皆正部署相關系統。
節省組裝時間與用水
NVIDIA經過三代機架級協同設計,打造出托盤內沒有任何纜線、風扇或軟管Vera Rubin NVL72系統,讓運算托盤組裝時間從數小時縮短至1分鐘。
攝氏45度的液冷進水溫度設計,使系統能夠在無需冷卻機的情況下,直接採用乾式冷卻運作。對於新建的AI工廠而言,這種高溫乾式冷卻技術搭配閉迴路液冷系統,每部署1百萬瓦,每年可節省數百萬加侖用水。



