輝達副總裁 Ian Buck 近日在 AWS 西雅圖總部,親手將首台 Vera CPU 伺服器和 Vera Rubin GPU 交給 AWS 高管,標誌著 Vera 開始規模出貨。此前,Buck 已向 Oracle Cloud Infrastructure 和三家領先 AI 實驗室——Anthropic、OpenAI 和 SpaceXAI——交付了 Vera CPU 系統。AWS 是 Vera 快速鋪開的最新一站,也是輝達與 AWS 長達 16 年合作的最新成果。雙方本週宣佈擴大合作,計劃新增 200 萬塊輝達 GPU,並推動基於 Vera CPU 的基礎設施落地 AWS。

Vera 是輝達首款定製 CPU,專為智慧體 AI 設計。輝達認為,智慧體 AI 正在創造 AI 工廠中的“CPU 時刻”——模型從“回答”轉向“行動”,對 CPU 的需求激增。AI 智慧體並非僅靠 GPU 執行,每個智慧體沙箱、每次工具呼叫、每個編排層、每次長上下文檢索,都是 CPU 工作。Vera 配備 88 個輝達自研 Olympus 核心,記憶體頻寬達 1.2TB/s,在智慧體 AI 工作負載下每核效能最高提升 1.8 倍。

在 AWS 交付現場,Buck 與 AWS EC2 副總裁 Willem Visser、EC2 硬體工程副總裁 Supreeth Sheshadri 會面,討論了 Vera 和 Vera Rubin 將為 AWS 客戶帶來的價值。AWS 是繼 Oracle 之後又一家獲得 Vera 的雲廠商。此前,Oracle Cloud Infrastructure 已率先在超大規模部署 Vera,計劃從 2026 年開始部署數十萬顆 Vera CPU。OCI 產品管理負責人 Karan Batta 表示,智慧體 AI 需要大規模持續效能,Vera 的架構專為高吞吐推理設計,能提供所需的效率、密度和佔用空間。

在 AI 實驗室方面,Vera 的交付也引發關注。Anthropic 計算負責人 James Bradbury 表示,擴充套件計算是模型增長的重要加速器,很高興看到 Vera 成為解決智慧體工作負載的生態中有前景的部分。OpenAI 計算基礎設施負責人 Sachin Katti 在 Mission Bay 總部接收了伺服器。SpaceXAI 則在 Palo Alto 辦公室評估 Vera 用於強化學習和基於智慧體的模擬流水線。

Vera 是輝達“極限協同設計”戰略的一部分,與 Rubin GPU、BlueField-4 DPU、Spectrum-X 和 MGX 機架架構協同。除了獨立 CPU 系統,Vera 還是 Vera Rubin NVL72 的主處理器,通過第二代 NVLink 與 Rubin GPU 配對。輝達強調,Vera 的設計初衷是應對智慧體 AI 帶來的併發、即時任務壓力,傳統以核心密度為中心的設計難以滿足這種需求。

隨著 AWS 和 Oracle 等主要雲廠商開始採用 Vera,智慧體 AI 的算力基礎設施正在從“GPU 中心”轉向“CPU+GPU 協同”。對於 AI 產業投資者而言,Vera 的規模交付意味著輝達正在將 CPU 納入其 AI 工廠敘事,可能影響雲廠商的資本開支方向和 AI 推理成本結構。不過,Vera 的實際效能表現和生態接受度仍需時間驗證。