輝達本週一釋出了大量關於其下一代伺服器 CPU Vera 以及配套 Rubin GPU 的技術細節,其中最引人注目的是 Vera 的完整架構白皮書和首批 SPEC CPU 2026 基準測試成績。這是自今年初 GTC 大會亮相以來,外界對 Vera 最深入的一次瞭解。

Vera 是輝達多年來自主設計的首款 CPU 核心架構,基於 Arm 指令集,內部代號為 Olympus。與上一代 Grace CPU 相比,Vera 的核心數從 72 個提升至 88 個,並引入了空間多執行緒技術,使執行緒數達到 176 個。每個核心擁有 2MB L2 快取,晶片共享 164MB 統一 L3 快取,均較 Grace 大幅增加。記憶體方面,Vera 支援最高 1.5TB LPDDR5X 記憶體,頻寬達 1.2TB/s,是 Grace 的兩倍以上。此外,Vera 還升級了 NVLink-C2C 互連,頻寬翻倍至 1.8TB/s,並支援 PCIe Gen6 / CXL 3.1

在微架構層面,Olympus 核心採用了 10 寬度解碼器,指令獲取單元每週期可向解碼佇列送入最多 16 條指令(每條 64 位),佇列容量為 48 條指令。L1 指令快取為 64KB(4 路組相聯),是 AMD Zen 5 的兩倍。輝達此前曾強調其神經分支預測器每週期可預測 2 條分支且準確率極高,但本次白皮書未進一步披露細節。

伴隨架構細節,輝達首次公佈了 Vera 在 SPEC CPU 2026 基準測試中的成績。該測試是行業標準 CPU 效能評估套件,涵蓋整數與浮點運算。雖然具體分數未在摘要中列出,但測試結果清晰展示了 Vera 在特定負載下的優勢——例如高頻寬記憶體帶來的吞吐量提升——同時也暴露了其在某些傳統計算場景下的不足。分析人士指出,Vera 並非要在所有維度上與 Intel Xeon 或 AMD EPYC 全面競爭,而是瞄準 AI 伺服器中 CPU 與 GPU 緊密耦合的細分市場。

Vera 的釋出標誌著輝達在伺服器 CPU 市場的野心進一步升級。此前 Grace 主要作為 GPU 的輔助處理器,而 Vera 則被定位為可獨立承擔通用計算任務的伺服器 CPU。不過,該市場已有 Intel、AMD 以及多家 Arm 架構廠商(如 Ampere Computing)的激烈競爭,輝達仍需在生態與效能上證明自己。

本週也是伺服器硬體行業的密集釋出期:Intel 即將公佈財報,AMD 的年度 AI 活動“Advancing AI”也將在舊金山舉行。輝達選擇在此時放出 Vera 的深度資訊,顯然意在搶佔話題熱度,併為後續的 Rubin 平台鋪路。