智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》,覆盖2026年9月12日至18日这一周。报告以OpenRouter的词元消耗数据、各厂商官方披露价格以及Arena基准测评为依据,对国产大语言模型进行周度量化追踪,观察维度包括用量、份额、集中度、价格与性价比。

本期最突出的变化来自深度求索。该公司于9月10日下调了DeepSeek V4 FlashDeepSeek V4.1 Flash的定价,其中V4.1 Flash的周用量随后增长483.62%,排名从第9位跃升至第2位。这一案例直观展示了价格调整对模型调用量的短期弹性。

从绝对用量看,周期内词元用量突破10万亿tokens的模型全部属于轻量级(Flash或类Flash)产品。具体包括:DeepSeek V4 Flash(14.59万亿)、DeepSeek V4.1 Flash(12.93万亿)、腾讯Hy4 preview(12.01万亿)以及智谱AI GLM 5.3 Flash(11.62万亿)。轻量级模型在用量榜上占据主导,与其面向高频、低成本调用场景的定位相符。

份额方面,上述四款模型同处中国大模型词元用量份额的“第一梯队”:DeepSeek V4 Flash为18.88%,V4.1 Flash为16.73%,腾讯Hy4 preview为15.54%,智谱AI GLM 5.3 Flash为15.04%。四者合计约占66%。头部集聚态势未变,前三位模型贡献了近一半的用量份额,前五位合计占比超过四分之三。

价格与性价比维度,当期Top15大模型每百万tokens的最高价与最低价相差38.75元,与上期持平。其中最低为小米MiMo-V2.5(1.25元),最高为月之暗面Kimi K3(40元)。在基准任务成本上,腾讯Hy3最低,低至0.308元/基准任务,其后依次为DeepSeek V4.1 Flash、MiniMax M3和GLM 5.3 Flash,同处“经济好用”区间。

本期榜单还出现新面孔:上海创智学院Nex-N2.5 Pro阿里巴巴Qwen3.8 Flash首次跻身Top 15,显示国产模型竞争格局仍在动态变化。

公开信息显示,智能经济30人论坛由中国(深圳)综合开发研究院等机构联合发起,汇聚人工智能与数字经济领域的专家学者及企业家,推动智库交流与合作。该系列报告以周为单位追踪国产模型用量与价格,为观察模型厂商竞争态势与AI应用层需求变化提供了高频数据窗口。