英伟达副总裁 Ian Buck 近日在 AWS 西雅图总部,亲手将首台 Vera CPU 服务器和 Vera Rubin GPU 交给 AWS 高管,标志着 Vera 开始规模出货。此前,Buck 已向 Oracle Cloud Infrastructure 和三家领先 AI 实验室——Anthropic、OpenAI 和 SpaceXAI——交付了 Vera CPU 系统。AWS 是 Vera 快速铺开的最新一站,也是英伟达与 AWS 长达 16 年合作的最新成果。双方本周宣布扩大合作,计划新增 200 万块英伟达 GPU,并推动基于 Vera CPU 的基础设施落地 AWS。
Vera 是英伟达首款定制 CPU,专为智能体 AI 设计。英伟达认为,智能体 AI 正在创造 AI 工厂中的“CPU 时刻”——模型从“回答”转向“行动”,对 CPU 的需求激增。AI 智能体并非仅靠 GPU 运行,每个智能体沙箱、每次工具调用、每个编排层、每次长上下文检索,都是 CPU 工作。Vera 配备 88 个英伟达自研 Olympus 核心,内存带宽达 1.2TB/s,在智能体 AI 工作负载下每核性能最高提升 1.8 倍。
在 AWS 交付现场,Buck 与 AWS EC2 副总裁 Willem Visser、EC2 硬件工程副总裁 Supreeth Sheshadri 会面,讨论了 Vera 和 Vera Rubin 将为 AWS 客户带来的价值。AWS 是继 Oracle 之后又一家获得 Vera 的云厂商。此前,Oracle Cloud Infrastructure 已率先在超大规模部署 Vera,计划从 2026 年开始部署数十万颗 Vera CPU。OCI 产品管理负责人 Karan Batta 表示,智能体 AI 需要大规模持续性能,Vera 的架构专为高吞吐推理设计,能提供所需的效率、密度和占用空间。
在 AI 实验室方面,Vera 的交付也引发关注。Anthropic 计算负责人 James Bradbury 表示,扩展计算是模型增长的重要加速器,很高兴看到 Vera 成为解决智能体工作负载的生态中有前景的部分。OpenAI 计算基础设施负责人 Sachin Katti 在 Mission Bay 总部接收了服务器。SpaceXAI 则在 Palo Alto 办公室评估 Vera 用于强化学习和基于智能体的模拟流水线。
Vera 是英伟达“极限协同设计”战略的一部分,与 Rubin GPU、BlueField-4 DPU、Spectrum-X 和 MGX 机架架构协同。除了独立 CPU 系统,Vera 还是 Vera Rubin NVL72 的主处理器,通过第二代 NVLink 与 Rubin GPU 配对。英伟达强调,Vera 的设计初衷是应对智能体 AI 带来的并发、实时任务压力,传统以核心密度为中心的设计难以满足这种需求。
随着 AWS 和 Oracle 等主要云厂商开始采用 Vera,智能体 AI 的算力基础设施正在从“GPU 中心”转向“CPU+GPU 协同”。对于 AI 产业投资者而言,Vera 的规模交付意味着英伟达正在将 CPU 纳入其 AI 工厂叙事,可能影响云厂商的资本开支方向和 AI 推理成本结构。不过,Vera 的实际性能表现和生态接受度仍需时间验证。