AI 推理芯片公司 d-Matrix 宣布,将采用英伟达的 NVLink Fusion 技术,把其下一代 Raptor XPU 接入英伟达的 AI 基础设施平台。按照方案,Raptor 会通过 NVLink 纵向扩展(scale-up)网络和 Spectrum-X 横向扩展(scale-out)网络,接入英伟达 MGX 机架架构以及更广泛的英伟达 AI 平台。d-Matrix 由此成为 NVLink Fusion 生态中不断扩大的合作伙伴之一。
NVLink Fusion 的定位,是让第三方定制 XPU 和 CPU 能够接入英伟达的纵向扩展网络、MGX 机架架构以及完整的 AI 工厂平台,覆盖计算、网络、存储、安全、供电、冷却和软件。对 XPU 厂商而言,自研芯片只是第一步,真正困难的是把它规模化部署——从采购芯片、集成高速接口、验证纵向扩展网络方案,到设计并认证机架架构,每一步都会增加时间、成本和风险。NVLink Fusion 的思路,是让芯片公司跳过从零搭建机架级基础设施的环节,直接接入英伟达已经验证、且在全球范围部署的 AI 工厂平台。
d-Matrix 联合创始人兼 CEO Sid Sheth 在新闻发布会上表示,推理需求正在快速上升,但资本、时间和能源都是有限的;借助 NVLink Fusion 和 MGX,d-Matrix 可以把 Raptor XPU 集成进一个已广泛部署的液冷架构,为客户提供更快、风险更低的部署与扩展路径,用于承载超低延迟推理。
从技术指标看,英伟达给出的参考是:相比现成以太网方案,NVLink Fusion 的 XPU 间延迟低至其三分之一,数据包速率高 10 倍,并通过第六代 NVLink 实现每 XPU 3 TB/s 的全互联带宽。它支持 Arm、x86 和 RISC-V 等主要 CPU 架构,并与英伟达 GPU 并行使用。
在具体集成上,d-Matrix 计划用 NVLink 把其 XPU 连接成单一的高带宽、低延迟纵向扩展域,其机架还可以与英伟达基于 GPU 的系统(如 Vera Rubin NVL72)协同,用于解耦式推理。d-Matrix 还计划集成英伟达 Vera CPU、ConnectX-9 SuperNIC、BlueField-4 DPU 以及 Spectrum-X 以太网。英伟达称,这些技术与 NVLink、MGX 一起,为 d-Matrix 提供了在灵活统一的 AI 工厂中、与英伟达系统并行部署专用推理的可靠基础。
英伟达强调其 AI 工厂平台是「纵向整合、横向开放」的:平台本身包含 Vera Rubin NVL72、Groq 3 LPX、Vera CPU 机架、Vera BlueField-4 STX 存储和 Spectrum-6 SPX 以太网等组件,设计目标是可完全通用替换,运行各类 AI 工作负载、模型和模型架构,并追求每瓦性能与每 token 成本的最优。NVLink Fusion 则把这种开放性延伸到 XPU 和 CPU,让芯片公司专注处理器创新,同时借助英伟达基础设施把产品部署到 AI 工厂规模。
对产业而言,这一合作的意义在于机架标准的收敛。通过统一到通用机架,数据中心可以一次建成、同时支持 GPU、CPU 和 XPU,而不必为每种处理器单独设计机架架构。d-Matrix 加入的 NVLink Fusion 伙伴名单已包括 AWS、Arm、英特尔、富士通、SiFive、Alchip、Astera Labs、GUC、Marvell、联发科、三星、Cadence、Synopsys、Ayar Labs 和 Lightmatter。对英伟达来说,这是在扩大其互连与机架生态的覆盖面;对 d-Matrix 这类专用推理芯片厂商来说,则是用更短时间、更低风险进入规模化部署的路径。