英伟达正在加速其 CPU 战略的落地。公司副总裁、CUDA 发明者 Ian Buck 近日透露,英伟达已出货“数十万台”Grace 独立服务器。这一数字与此前披露的累计超 250 万颗 Grace CPU 出货量相呼应,显示出英伟达在 CPU 领域的部署规模正在快速扩大。今年 2 月,英伟达还宣布与 Meta 合作部署独立 Grace 服务器,进一步验证了其 CPU 产品的实际应用场景。
这一动向的背景是智能体 AI 工作负载正在改变数据中心的硬件配比。传统上,一个 CPU 可能搭配多达 8 个 GPU,但在智能体 AI 场景下,这一比例正趋向 1:1。这种变化使得 CPU 在数据中心中的角色重新变得关键,也为英伟达提供了进入 CPU 市场的战略窗口。Ian Buck 表示,Grace 服务器并非用于运行 Web 服务器或传统的低成本云工作负载,而是部署在后台数据密集型操作中,例如数据处理。
英伟达的新一代 CPU Vera 正是为智能体 AI 量身打造。与 Grace 采用 72 个标准 Arm Neoverse V2 核心不同,Vera 使用了英伟达首款自研核心架构 Olympus,并集成了升级版的可扩展一致性互联架构。Vera 采用 88 核单片设计,将全部核心置于单一硅片上,这与 AMD、Intel 近年来转向的芯片组设计截然不同。Ian Buck 解释,Vera 之所以没有追求 128 核,是因为将大量芯片面积用于互联架构,实现了 3.4 TB/s 的核心间带宽,确保每个核心能以全速访问所有缓存和内存控制器,无冲突。此外,通过 LPDDR5X 接口,Vera 可提供最高 1.2 TB/s 的聚合内存带宽。
不过,Vera 的独特架构也意味着取舍。目前数据中心大部分工作负载仍是超大规模云厂商已构建的“传统”任务,即便 AI 基础设施需求旺盛,这一格局在未来几年内不太可能改变。Ian Buck 承认这一权衡,并反问竞争对手能否构建同样丰富的互联架构。他此前在 GTC 大会上明确表示,“世界不会被一种 CPU SKU 所服务,这也不是我们的意图。”
英伟达对数据中心 CPU 市场的野心远超当前股价所反映的预期。公司认为 CPU 代表着一个 2000 亿美元的总可寻址市场机会,这一预测远高于行业普遍估计的 1200 亿美元(近期部分预测已上调至 1700 亿美元)。摩根士丹利今年 4 月估算,智能体 AI 可能为数据中心 CPU 市场额外增加 600 亿美元。
目前,Vera 已与英伟达下一代 AI 基础设施(包括 Rubin GPU、ConnectX-9 网卡、SpectrumX 以太网交换机等组件)一同进入量产。英伟达表示,单个 Vera Rubin NVL72 机架包含约 130 万个组件,全球有超过 300 家合作伙伴参与制造。在最近一次访问英伟达总部时,媒体已看到 Vera Rubin NVL72 机架实际运行 OpenAI 工作负载。