英伟达投资的 Reflection AI 正式发布其首个前沿开放权重模型 Beam。这家成立两年的公司称,Beam 在高级推理基准上可对标中国领先的开放模型,而推理成本显著更低——这一说法若被验证,可能给西方打造 DeepSeek、Qwen、Z.ai 之外替代方案的竞赛再添热度。该发布也印证了 Axios 上周末关于 Reflection 即将上线的报道。
据公司周一发布的长篇博客,Beam 是一个纯文本的混合专家(MoE)模型,通过高算力强化学习训练,主打推理、编程与智能体任务,官方称其 token 成本与推理时间算力仅为竞争对手的「一小部分」。具体规格上,Beam 总参数 5010 亿、激活参数 230 亿,预训练数据量 23.8 万亿 token,上下文窗口达 100 万 token。作为对比,Z.ai 的 GLM 5.2 总参数约 7440 亿、激活参数约 400 亿。
Reflection 的性能主张尚未获得独立验证。按其说法,Beam 在高级推理基准上与 Z.ai 的 GLM-5.2 得分相当,并优于当前领先的西方开放模型,同时使用的推理算力少 3-4 倍。公司将其定位为面向企业、公共部门和开发者的「主力模型」。
从竞争格局看,Reflection 同时把矛头对准三类对手:Anthropic、OpenAI 等闭源实验室;DeepSeek、Qwen、Z.ai 等中国开放模型;以及 Mistral、Meta、Cohere 等西方玩家。其在美国最直接的对手可能是 Mira Murati 的 Thinking Machines Lab 于 7 月发布的开放模型 Inkling。Reflection 自己的基准显示,在双方都报告结果的四项编程测试中 Beam 得分更高,但需注意 Inkling 是多模态模型,而 Beam 为纯文本。
Reflection 由两位前 Google DeepMind 研究员于 2024 年创立,据 PitchBook 数据已从英伟达、红杉资本、Lightspeed Venture Partners 等投资方募资约 47 亿美元,上一轮融资对应 250 亿美元的投前估值。公司还在锁定算力这一训练前沿模型的关键资源:今年夏天,它与 SpaceX 和 Nebius 签署了合计价值超过 70 亿美元的协议,以确保在 2029 年前获得英伟达 GB300 芯片的使用权。
Beam 及后续模型瞄准的是企业和主权国家客户。其卖点是打造「AI 工厂」——让机构用自身专有数据训练 Reflection 的模型,从而构建本地化、定制化的 AI 系统。英伟达 CEO 黄仁勋长期推崇「AI 工厂」理念,并推动强化开放 AI 生态,这一愿景同样有利于英伟达,因为这类系统将由英伟达 GPU 驱动。Axios 报道称,对冲基金和交易公司也对搭建此类系统表现出兴趣。Reflection 已开始在韩国与新世界集团(Shinsegae Group)测试主权 AI 工厂合作模式。
公司表示,将在本月发布 Beam 的权重与完整技术细节,上线时将通过超大规模云厂商和新型云服务商分发,并集成到多个开源库中。TechCrunch 就更多信息联系 Reflection,截至发稿未获回复。