輝達近期公佈了其面向“千兆級AI工廠”的Vera Rubin平台最新部署進展,顯示該平台正在全球範圍內獲得主要雲服務商的採用。CoreWeave、谷歌雲、微軟Azure和甲骨文雲等已開始部署Vera Rubin NVL72系統,標誌著輝達下一代AI基礎設施方案進入規模化落地階段。
根據輝達披露的測試資料,CoreWeave對Vera Rubin NVL72與上一代Grace Blackwell NVL72進行了對比,結果顯示新平台在每兆瓦電力消耗下可實現10倍的Token吞吐量提升。這一指標直接指向AI推理與訓練任務中的能效比,對於大規模部署AI工作負載的雲服務商而言,意味著在相同電力成本下可獲得顯著更高的算力產出。
Vera Rubin平台整合了多項輝達最新元件,包括Vera CPU、Rubin GPU、NVLink 6互連技術、ConnectX-9 SuperNIC智慧網絡卡、BlueField-4 DPU資料處理單元以及Spectrum-6交換系統。這種從計算、網路到資料處理的垂直整合設計,旨在系統性提升AI訓練和推理效率,同時降低基礎設施的總體擁有成本。
從部署規模來看,輝達表示Vera Rubin已覆蓋全球350多個工廠節點,遍佈30個國家。這一數字反映出該平台正在從早期測試向廣泛商用過渡,其核心目標是通過提升能源利用效率來降低AI基礎設施的整體成本。在當前AI算力需求持續膨脹、資料中心電力供應趨緊的背景下,能效指標的突破對產業鏈上下游均有牽動效應——雲服務商可最佳化運營成本,AI模型開發商則可能獲得更經濟的訓練與推理資源。