最新一期開源模型盤點(第23期)出爐,本期亮點頗多,包括 Thinking Machines 的首個模型 Inkling、騰訊的 Hy3、Poolside 的 Laguna S2.1、DeepSeek-V4-Flash-0731 以及月之暗面的 Kimi K3。文章指出,儘管此前許多觀察者預測 AI 實驗室將走向整合,但現實是更多公司正在投入數億至數十億美元訓練強模型,並越來越多地選擇開源釋出。

文章認為,市場對 token 的需求極高,且隨著模型效率提升和用例拓展,需求還將增長。那些曾被預測需要整合的實驗室,如今發現構建 token 機器是通往價值的可行路徑。以 Thinking Machines 為例,該公司於 2025 年 2 月宣佈成立時,很少有人將其視為開源模型公司,但現在其開源微調服務年收入達數億美元,併發布了美國最強的開源權重模型,領先於輝達的 Nemotron 和 Arcee 的 Trilogy。

另一方面,中國實驗室持續發力,小米等新進入者也在 AI 經濟中積累影響力。文章認為,與其預測整合,不如預測開源模型的持續採用,並思考其角色。Kimi K3 等收入分成許可能持續多久?開源模型能佔據多少市場份額?我們正進入決定性時代。

本期精選模型包括:

Inkling(Thinking Machines):975B-A41B 多模態 MoE,支援文本、影像、音訊輸入,輸出文本。雖非同類最強,但適合作為微調基礎,公司還提供商業服務 Tinker。另有 276B-A12B 小版本,競爭力強。

Hy3(騰訊):295B-A21B MoE,全面超越前代。最大變化是許可協議從自定義限制性許可改為 Apache 2.0。該模型還證明了一個 50 年曆史的數學問題。

Laguna-S-2.1(Poolside):118B-A8B MoE,可運行於 DGX Spark,採用 OpenMDW 許可(類似 Apache 2.0 但更適配 AI 模型)。Poolside 連續三個月上榜,透明度高。

DeepSeek-V4-Flash-0731(DeepSeek):在 OpenAI 將其最小模型降價 80% 後一天釋出,在帕累託前沿上擊敗 Luna。更大模型尚未更新,效能待觀察。

Kimi-K3(月之暗面):近期最大的開源模型釋出,採用非商業許可,推理和微調提供商需簽訂商業協議。有分析認為,此類許可可能為未來美國政府針對與中國 AI 公司有業務往來的美國實體採取行動提供依據。

其他模型包括:美團 LongCat-2.0(1.6T 引數,完全在昇騰 910 上訓練,是首個非華為、非玩具級完全使用中國加速器訓練的模型)、Poolside Laguna-XS-2.1、韓國 Motif 的 Motif-3-Beta、瑞士 AI 的 Apertus-v1.5-70B 以及 AMD 的 Instella-MoE-16B-A3B-Think。