AI 推理晶片公司 d-Matrix 宣佈,將採用輝達NVLink Fusion 技術,把其下一代 Raptor XPU 接入輝達的 AI 基礎設施平台。按照方案,Raptor 會通過 NVLink 縱向擴充套件(scale-up)網路和 Spectrum-X 橫向擴充套件(scale-out)網路,接入輝達 MGX 機架架構以及更廣泛的輝達 AI 平台。d-Matrix 由此成為 NVLink Fusion 生態中不斷擴大的合作伙伴之一。

NVLink Fusion 的定位,是讓第三方定製 XPU 和 CPU 能夠接入輝達的縱向擴充套件網路、MGX 機架架構以及完整的 AI 工廠平台,覆蓋計算、網路、儲存、安全、供電、冷卻和軟體。對 XPU 廠商而言,自研晶片只是第一步,真正困難的是把它規模化部署——從採購晶片、整合高速介面、驗證縱向擴充套件網路方案,到設計並認證機架架構,每一步都會增加時間、成本和風險。NVLink Fusion 的思路,是讓晶片公司跳過從零搭建機架級基礎設施的環節,直接接入輝達已經驗證、且在全球範圍部署的 AI 工廠平台。

d-Matrix 聯合創始人兼 CEO Sid Sheth 在新聞釋出會上表示,推理需求正在快速上升,但資本、時間和能源都是有限的;藉助 NVLink Fusion 和 MGX,d-Matrix 可以把 Raptor XPU 整合進一個已廣泛部署的液冷架構,為客戶提供更快、風險更低的部署與擴充套件路徑,用於承載超低延遲推理。

從技術指標看,輝達給出的參考是:相比現成乙太網路方案,NVLink Fusion 的 XPU 間延遲低至其三分之一,資料包速率高 10 倍,並通過第六代 NVLink 實現每 XPU 3 TB/s 的全互聯頻寬。它支援 Arm、x86 和 RISC-V 等主要 CPU 架構,並與輝達 GPU 並行使用。

在具體整合上,d-Matrix 計劃用 NVLink 把其 XPU 連線成單一的高頻寬、低延遲縱向擴充套件域,其機架還可以與輝達基於 GPU 的系統(如 Vera Rubin NVL72)協同,用於解耦式推理。d-Matrix 還計劃整合輝達 Vera CPUConnectX-9 SuperNICBlueField-4 DPU 以及 Spectrum-X 乙太網路。輝達稱,這些技術與 NVLink、MGX 一起,為 d-Matrix 提供了在靈活統一的 AI 工廠中、與輝達系統並行部署專用推理的可靠基礎。

輝達強調其 AI 工廠平台是「縱向整合、橫向開放」的:平台本身包含 Vera Rubin NVL72、Groq 3 LPX、Vera CPU 機架、Vera BlueField-4 STX 儲存和 Spectrum-6 SPX 乙太網路等元件,設計目標是可完全通用替換,執行各類 AI 工作負載、模型和模型架構,並追求每瓦效能與每 token 成本的最優。NVLink Fusion 則把這種開放性延伸到 XPU 和 CPU,讓晶片公司專注處理器創新,同時藉助輝達基礎設施把產品部署到 AI 工廠規模。

對產業而言,這一合作的意義在於機架標準的收斂。通過統一到通用機架,資料中心可以一次建成、同時支援 GPU、CPU 和 XPU,而不必為每種處理器單獨設計機架架構。d-Matrix 加入的 NVLink Fusion 夥伴名單已包括 AWS、Arm、英特爾、富士通、SiFive、Alchip、Astera Labs、GUC、Marvell、聯發科、三星、Cadence、Synopsys、Ayar Labs 和 Lightmatter。對輝達來說,這是在擴大其互連與機架生態的覆蓋面;對 d-Matrix 這類專用推理晶片廠商來說,則是用更短時間、更低風險進入規模化部署的路徑。