輝達(Nvidia)於8月24日宣佈,其低延遲AI推理系統Groq 3 LPX已進入全面生產階段,並將在2026年底前正式上線。Nebius將成為首個採用該系統的AI雲客戶,通過其Nebius Token Factory平台提供算力服務。這一生產公告距離輝達與晶片設計公司Groq Inc簽署200億美元授權協議僅過去八個月,標誌著這筆鉅額交易從簽約到落地的高效推進。

去年12月24日,輝達與專注於AI推理低延遲晶片的Groq簽署了非排他性授權協議。作為交易的一部分,輝達聘請了Groq創始人兼CEOJonathan Ross、總裁Sunny Madra以及大部分工程團隊,但並未整體收購Groq,該公司仍保持獨立運營。據報道,輝達為此支付了200億美元現金。

Groq 3 LPX在輝達的GTC大會上首次亮相,其液冷機架包含256個語言處理單元(LPU),並集成於輝達的Vera Rubin平台。輝達的GPU負責AI訓練和大上下文預填充任務,而LPX則專注於加速對速度要求極高的推理任務。Groq的設計採用片上記憶體等架構,使其在推理場景中表現突出,但在訓練等其他任務上存在侷限。即便在推理領域,LPX與輝達旗艦晶片協同工作效果最佳,因此輝達將其定位為GPU機架的補充,而非替代品。

LPX可與輝達新的Vera Rubin晶片搭配使用,且客戶無需更改其CUDA工作流程——CUDA是AI行業標準的軟體基礎層,也是輝達長期主導市場的關鍵因素。輝達估計,LPX與Vera Rubin組合的系統在處理推理工作負載時,每兆瓦功耗的吞吐量可提升35倍。在當前電力供應成為行業最緊迫約束的背景下,能效優勢顯得尤為重要。

從簽約到宣佈全面投產,輝達在不到三個季度內完成了硬體整合,將潛在威脅轉化為自身資產,展現了極高的執行效率。隨著行業重心從訓練向推理轉移,這一佈局被視為輝達搶佔先機的關鍵舉措。據Motley Fool Research資料,輝達資料中心業務在上一財季(Q1)實現752億美元營收,預計在8月26日財報中這一數字將接近920億美元。儘管LPX新收入短期內可能不會帶來大幅增長,但長期來看,這或將成為輝達發展歷程中的重要節點。

市場分析人士認為,輝達此舉不僅鞏固了其在AI晶片領域的領導地位,也為應對未來推理需求激增做好了準備。隨著AI應用場景的不斷拓展,推理效率與能效將成為競爭焦點,輝達通過整合Groq技術,有望在下一階段競爭中保持優勢。