輝達投資的 Reflection AI 正式釋出其首個前沿開放權重模型 Beam。這家成立兩年的公司稱,Beam 在高階推理基準上可對標中國領先的開放模型,而推理成本顯著更低——這一說法若被驗證,可能給西方打造 DeepSeek、Qwen、Z.ai 之外替代方案的競賽再添熱度。該釋出也印證了 Axios 上週末關於 Reflection 即將上線的報道。

據公司週一釋出的長篇部落格,Beam 是一個純文本的混合專家(MoE)模型,通過高算力強化學習訓練,主打推理、程式設計與智慧體任務,官方稱其 token 成本與推理時間算力僅為競爭對手的「一小部分」。具體規格上,Beam 總引數 5010 億、啟用引數 230 億,預訓練資料量 23.8 萬億 token,上下文視窗達 100 萬 token。作為對比,Z.ai 的 GLM 5.2 總引數約 7440 億、啟用引數約 400 億。

Reflection 的效能主張尚未獲得獨立驗證。按其說法,Beam 在高階推理基準上與 Z.ai 的 GLM-5.2 得分相當,並優於當前領先的西方開放模型,同時使用的推理算力少 3-4 倍。公司將其定位為面向企業、公共部門和開發者的「主力模型」。

從競爭格局看,Reflection 同時把矛頭對準三類對手:Anthropic、OpenAI 等閉源實驗室;DeepSeek、Qwen、Z.ai 等中國開放模型;以及 Mistral、Meta、Cohere 等西方玩家。其在美國最直接的對手可能是 Mira Murati 的 Thinking Machines Lab 於 7 月釋出的開放模型 Inkling。Reflection 自己的基準顯示,在雙方都報告結果的四項程式設計測試中 Beam 得分更高,但需注意 Inkling 是多模態模型,而 Beam 為純文本。

Reflection 由兩位前 Google DeepMind 研究員於 2024 年創立,據 PitchBook 資料已從輝達、紅杉資本、Lightspeed Venture Partners 等投資方募資約 47 億美元,上一輪融資對應 250 億美元的投前估值。公司還在鎖定算力這一訓練前沿模型的關鍵資源:今年夏天,它與 SpaceX 和 Nebius 簽署了合計價值超過 70 億美元的協議,以確保在 2029 年前獲得輝達 GB300 晶片的使用權。

Beam 及後續模型瞄準的是企業和主權國家客戶。其賣點是打造「AI 工廠」——讓機構用自身專有資料訓練 Reflection 的模型,從而構建本地化、定製化的 AI 系統。輝達 CEO 黃仁勳長期推崇「AI 工廠」理念,並推動強化開放 AI 生態,這一願景同樣有利於輝達,因為這類系統將由輝達 GPU 驅動。Axios 報道稱,對沖基金和交易公司也對搭建此類系統表現出興趣。Reflection 已開始在韓國與新世界集團(Shinsegae Group)測試主權 AI 工廠合作模式。

公司表示,將在本月釋出 Beam 的權重與完整技術細節,上線時將通過超大規模雲廠商和新型雲服務商分發,並整合到多個開源庫中。TechCrunch 就更多資訊聯絡 Reflection,截至發稿未獲回覆。