AMD 在 7 月釋出 EPYC「Venice」伺服器 CPU 後,於上週五進一步公佈了這代產品的詳細效能資料。核心結論沒有變化:AMD 仍聲稱一款 96 核高頻 Venice 晶片在 SPEC CPU 2026 整數速率(intrate)測試中,比輝達 88 核 Vera 快約 20%;同時首次披露了 256 核旗艦型號的對比結果。
根據 AMD 釋出的白皮書,256 核的 EPYC 9996 在 SPEC CPU 2026 intrate 總吞吐測試中,比英特爾 Xeon 6980P 快 2.37 倍,比輝達 Vera 快 2.24 倍。白皮書還澄清了此前代號模糊的 9006 即 256 核旗艦。代際對比同樣醒目:9996 比上一代 192 核的 EPYC 9965 快約 78%。
不過,這些數字的測試條件存在若干差異,需要讀者審慎對待。AMD 在對比 Vera 時混用了不同來源的資料,部分測試使用了不同大版本的 GNU 編譯器套件(GCC)。在 SPEC CPU 2026 intrate 的細分項中,AMD 將 9996 從 256 核降配到 96 核進行測試,且未說明功耗預算;而 AMD 最初公佈 SPEC 資料時,96 核型號與 256 核型號共享 600W 功耗上限,但 96 核高頻 Venice SKU 的實際上限為 500W。更關鍵的是編譯器差異:AMD 使用 GCC 16.1,而輝達在 Vera 白皮書中使用的是 GCC 15.2。GCC 16 因最佳化更充分而編譯更慢,但生成的二進位制檔案執行更快,具體幅度取決於編譯標誌與軟體環境。用兩個不同編譯器版本對比基準測試並非最佳實踐。
在記憶體頻寬測試中,AMD 引用了 Phoronix 對 Vera 的初始受控測試資料。AMD 同樣將 9996 從 256 核降配到 96 核並給予 600W 功耗預算,結果顯示其領先約 18%,單核效能領先約 8%。值得注意的是,Vera 在 Phoronix 最初的 Stream 測試中曾大幅領先競爭對手,因此這一反超頗具分量。
除 Vera 之外,AMD 還展示了雲工作負載(資料庫、Java、加密)的表現,代際提升依然突出——AMD 上一代晶片在這些負載中已處於領先。這些測試由 AMD 自行執行,而非依賴第三方資料,但 Graviton5 的結果來自 AWS 雲實例。在 HPC 工作負載中,AMD 進一步擴大了對英特爾旗艦 Granite Rapids-AP 的領先優勢;英特爾下一代資料中心 CPU 代號 Diamond Rapids,預計明年釋出。
最後是「代理式 AI 工作負載效能」部分,使用了 NGINX、TPCx-AI 工具包、FAISS、TPC-H 和 TPC-C,以及多角色代理回放等實際基準。AMD 表示 TPC-H 和 TPC-C 的結果是從這些基準衍生而來,因此不能與已釋出的結果直接比較。
從產業視角看,伺服器 CPU 是 AI 資料中心的基礎算力單元,AMD 與輝達在這一領域的正面交鋒正在升溫。輝達憑藉 GPU 主導 AI 訓練與推理,並推出 Vera CPU 向伺服器處理器市場延伸;AMD 則以 EPYC 系列守住並擴大在通用計算與 HPC 的份額。此次跑分公佈,是 AMD 在輝達切入其腹地後的一次主動回應。
但基準測試的參考價值有限。峰值效能只是伺服器部署的考量因素之一,實際表現還取決於軟體棧、編譯方式與工作負載型別。AMD 此次白皮書中代際提升的對比,比與競品的對比更具說服力。對關注 AI 算力產業鏈的讀者而言,這組資料提供了觀察兩家公司在資料中心 CPU 側競爭態勢的視窗,但測試配置的差異意味著結論不宜過度外推。