英伟达(Nvidia)于8月24日宣布,其低延迟AI推理系统Groq 3 LPX已进入全面生产阶段,并将在2026年底前正式上线。Nebius将成为首个采用该系统的AI云客户,通过其Nebius Token Factory平台提供算力服务。这一生产公告距离英伟达与芯片设计公司Groq Inc签署200亿美元授权协议仅过去八个月,标志着这笔巨额交易从签约到落地的高效推进。
去年12月24日,英伟达与专注于AI推理低延迟芯片的Groq签署了非排他性授权协议。作为交易的一部分,英伟达聘请了Groq创始人兼CEOJonathan Ross、总裁Sunny Madra以及大部分工程团队,但并未整体收购Groq,该公司仍保持独立运营。据报道,英伟达为此支付了200亿美元现金。
Groq 3 LPX在英伟达的GTC大会上首次亮相,其液冷机架包含256个语言处理单元(LPU),并集成于英伟达的Vera Rubin平台。英伟达的GPU负责AI训练和大上下文预填充任务,而LPX则专注于加速对速度要求极高的推理任务。Groq的设计采用片上内存等架构,使其在推理场景中表现突出,但在训练等其他任务上存在局限。即便在推理领域,LPX与英伟达旗舰芯片协同工作效果最佳,因此英伟达将其定位为GPU机架的补充,而非替代品。
LPX可与英伟达新的Vera Rubin芯片搭配使用,且客户无需更改其CUDA工作流程——CUDA是AI行业标准的软件基础层,也是英伟达长期主导市场的关键因素。英伟达估计,LPX与Vera Rubin组合的系统在处理推理工作负载时,每兆瓦功耗的吞吐量可提升35倍。在当前电力供应成为行业最紧迫约束的背景下,能效优势显得尤为重要。
从签约到宣布全面投产,英伟达在不到三个季度内完成了硬件整合,将潜在威胁转化为自身资产,展现了极高的执行效率。随着行业重心从训练向推理转移,这一布局被视为英伟达抢占先机的关键举措。据Motley Fool Research数据,英伟达数据中心业务在上一财季(Q1)实现752亿美元营收,预计在8月26日财报中这一数字将接近920亿美元。尽管LPX新收入短期内可能不会带来大幅增长,但长期来看,这或将成为英伟达发展历程中的重要节点。
市场分析人士认为,英伟达此举不仅巩固了其在AI芯片领域的领导地位,也为应对未来推理需求激增做好了准备。随着AI应用场景的不断拓展,推理效率与能效将成为竞争焦点,英伟达通过整合Groq技术,有望在下一阶段竞争中保持优势。