最新一期开源模型盘点(第23期)出炉,本期亮点颇多,包括 Thinking Machines 的首个模型 Inkling、腾讯的 Hy3、Poolside 的 Laguna S2.1、DeepSeek-V4-Flash-0731 以及月之暗面的 Kimi K3。文章指出,尽管此前许多观察者预测 AI 实验室将走向整合,但现实是更多公司正在投入数亿至数十亿美元训练强模型,并越来越多地选择开源发布。

文章认为,市场对 token 的需求极高,且随着模型效率提升和用例拓展,需求还将增长。那些曾被预测需要整合的实验室,如今发现构建 token 机器是通往价值的可行路径。以 Thinking Machines 为例,该公司于 2025 年 2 月宣布成立时,很少有人将其视为开源模型公司,但现在其开源微调服务年收入达数亿美元,并发布了美国最强的开源权重模型,领先于英伟达的 Nemotron 和 Arcee 的 Trilogy。

另一方面,中国实验室持续发力,小米等新进入者也在 AI 经济中积累影响力。文章认为,与其预测整合,不如预测开源模型的持续采用,并思考其角色。Kimi K3 等收入分成许可能持续多久?开源模型能占据多少市场份额?我们正进入决定性时代。

本期精选模型包括:

Inkling(Thinking Machines):975B-A41B 多模态 MoE,支持文本、图像、音频输入,输出文本。虽非同类最强,但适合作为微调基础,公司还提供商业服务 Tinker。另有 276B-A12B 小版本,竞争力强。

Hy3(腾讯):295B-A21B MoE,全面超越前代。最大变化是许可协议从自定义限制性许可改为 Apache 2.0。该模型还证明了一个 50 年历史的数学问题。

Laguna-S-2.1(Poolside):118B-A8B MoE,可运行于 DGX Spark,采用 OpenMDW 许可(类似 Apache 2.0 但更适配 AI 模型)。Poolside 连续三个月上榜,透明度高。

DeepSeek-V4-Flash-0731(DeepSeek):在 OpenAI 将其最小模型降价 80% 后一天发布,在帕累托前沿上击败 Luna。更大模型尚未更新,性能待观察。

Kimi-K3(月之暗面):近期最大的开源模型发布,采用非商业许可,推理和微调提供商需签订商业协议。有分析认为,此类许可可能为未来美国政府针对与中国 AI 公司有业务往来的美国实体采取行动提供依据。

其他模型包括:美团 LongCat-2.0(1.6T 参数,完全在昇腾 910 上训练,是首个非华为、非玩具级完全使用中国加速器训练的模型)、Poolside Laguna-XS-2.1、韩国 Motif 的 Motif-3-Beta、瑞士 AI 的 Apertus-v1.5-70B 以及 AMD 的 Instella-MoE-16B-A3B-Think。