英伟达近期公布了其面向“千兆级AI工厂”的Vera Rubin平台最新部署进展,显示该平台正在全球范围内获得主要云服务商的采用。CoreWeave谷歌云微软Azure甲骨文云等已开始部署Vera Rubin NVL72系统,标志着英伟达下一代AI基础设施方案进入规模化落地阶段。

根据英伟达披露的测试数据,CoreWeave对Vera Rubin NVL72与上一代Grace Blackwell NVL72进行了对比,结果显示新平台在每兆瓦电力消耗下可实现10倍的Token吞吐量提升。这一指标直接指向AI推理与训练任务中的能效比,对于大规模部署AI工作负载的云服务商而言,意味着在相同电力成本下可获得显著更高的算力产出。

Vera Rubin平台整合了多项英伟达最新组件,包括Vera CPURubin GPUNVLink 6互连技术、ConnectX-9 SuperNIC智能网卡、BlueField-4 DPU数据处理单元以及Spectrum-6交换系统。这种从计算、网络到数据处理的垂直整合设计,旨在系统性提升AI训练和推理效率,同时降低基础设施的总体拥有成本。

从部署规模来看,英伟达表示Vera Rubin已覆盖全球350多个工厂节点,遍布30个国家。这一数字反映出该平台正在从早期测试向广泛商用过渡,其核心目标是通过提升能源利用效率来降低AI基础设施的整体成本。在当前AI算力需求持续膨胀、数据中心电力供应趋紧的背景下,能效指标的突破对产业链上下游均有牵动效应——云服务商可优化运营成本,AI模型开发商则可能获得更经济的训练与推理资源。