智慧經濟30人論壇AGI測評中心釋出最新一期《AGI市場觀察》,覆蓋2026年9月12日至18日這一週。報告以OpenRouter的詞元消耗資料、各廠商官方披露價格以及Arena基準測評為依據,對國產大語言模型進行周度量化追蹤,觀察維度包括用量、份額、集中度、價格與價效比。
本期最突出的變化來自深度求索。該公司於9月10日下調了DeepSeek V4 Flash和DeepSeek V4.1 Flash的定價,其中V4.1 Flash的周用量隨後增長483.62%,排名從第9位躍升至第2位。這一案例直觀展示了價格調整對模型呼叫量的短期彈性。
從絕對用量看,週期內詞元用量突破10萬億tokens的模型全部屬於輕量級(Flash或類Flash)產品。具體包括:DeepSeek V4 Flash(14.59萬億)、DeepSeek V4.1 Flash(12.93萬億)、騰訊Hy4 preview(12.01萬億)以及智譜AI GLM 5.3 Flash(11.62萬億)。輕量級模型在用量榜上佔據主導,與其面向高頻、低成本呼叫場景的定位相符。
份額方面,上述四款模型同處中國大模型詞元用量份額的“第一梯隊”:DeepSeek V4 Flash為18.88%,V4.1 Flash為16.73%,騰訊Hy4 preview為15.54%,智譜AI GLM 5.3 Flash為15.04%。四者合計約佔66%。頭部集聚態勢未變,前三位模型貢獻了近一半的用量份額,前五位合計佔比超過四分之三。
價格與價效比維度,當期Top15大模型每百萬tokens的最高價與最低價相差38.75元,與上期持平。其中最低為小米MiMo-V2.5(1.25元),最高為月之暗面Kimi K3(40元)。在基準任務成本上,騰訊Hy3最低,低至0.308元/基準任務,其後依次為DeepSeek V4.1 Flash、MiniMax M3和GLM 5.3 Flash,同處“經濟好用”區間。
本期榜單還出現新面孔:上海創智學院Nex-N2.5 Pro和阿里巴巴Qwen3.8 Flash首次躋身Top 15,顯示國產模型競爭格局仍在動態變化。
公開資訊顯示,智慧經濟30人論壇由中國(深圳)綜合開發研究院等機構聯合發起,匯聚人工智慧與數字經濟領域的專家學者及企業家,推動智庫交流與合作。該系列報告以周為單位追蹤國產模型用量與價格,為觀察模型廠商競爭態勢與AI應用層需求變化提供了高頻資料視窗。