智谱AI近期动作频频,先是宣布其GLM Coding Plan老套餐将停止自动续订,并给予老用户两个月新套餐补偿,随后于9月2日正式入驻天猫开设官方旗舰店,上架该编程套餐。个人版Lite月付118元、Pro月付538元、Max月付1078元,分别对应不同积分额度。产品基于GLM-5.3,并适配ZCode、Claude Code、Codex等20余款主流Agent。这标志着AI使用额度开始像手机流量一样被直接购买,进入电商货架。
然而,更值得关注的是AI行业出现的反常识变化:Token越来越便宜,但AI公司却越来越在意用户消耗的Token量。过去几个月,Kimi曾因算力压力暂停C端新用户订阅,阿里云也调整了其Coding Plan,腾讯云则上调了部分混元模型价格。这些动作表明,AI公司正从单纯的价格竞争转向对Token消耗量的精细管理。
智谱自身披露,随着模型架构和推理基础设施优化,其单位Token推理成本较年初下降80%,并已实现10万级国产芯片规模化低成本推理。但Token消耗速度增长更快,一枚Token背后是模型推理所消耗的计算资源,包括GPU、高带宽内存、网络、存储以及数据中心的电力和散热。当模型从简单聊天转向复杂任务执行,Token消耗量呈指数级增长。
智谱最新半年报显示,2026年上半年营收9.54亿元,同比增长399.7%,其中MaaS开放平台及API业务收入达8.25亿元,同比增长2735.7%,占总收入86.5%,而去年同期该比例仅为15.2%。本地化部署收入占比则从84.8%降至13.5%。一年时间,智谱的商业模式几乎完成换挡,从卖模型转向卖调用。
值得注意的是,智谱并非简单降价换规模,其Token调用量较年初增长超40倍,API平均售价提升约101%,单位Token推理成本下降80%,MaaS业务毛利率提升至24.6%。成本下降、收入增长、用户用量增加,平均售价反而提升,这表明AI商业化可能正摆脱最初的价格战。
智谱管理层将商业模式概括为“卖模型→卖调用→卖订阅→卖端到端任务结果”,这对应AI商业化的四个阶段。从Chatbot模式到Agent模式,再到Multi-Agent,Token需求不断膨胀。2026年第一季度,全球每周Token使用量暴增250%至22.7万亿,OpenAI平台Token调用量从2025年10月的每分钟约60亿次飙升至2026年3月底的150亿次,不足半年暴增150%。摩根士丹利报告指出,顶尖大语言模型正经历“非线性的能力跃升”,AI爆炸式增长正碰上系统性的供应瓶颈。
这背后是经济学中的“杰文斯悖论”:资源使用效率提高、单位成本下降后,人们反而可能大量增加使用。Token越便宜,用户越敢让AI干更多事;AI越聪明,用户越愿意把复杂任务交给它,形成消耗增长飞轮。智谱董事会秘书肖磊在财报电话会上表示,相较收入增速,收入构成的切换更值得关注。董事长刘德兵则指出,单点榜单领先很快会被追平,真正重要的是谁能持续用更低成本交付更高智能。
未来趋势可能是基础Token越来越便宜,但高级智能越来越贵。单Token价格下降不等于AI使用成本下降,因为模型越强,用户让它做的事情越复杂。智谱半年报中的一句话点明核心:“模型每完成一次能力跃迁,客户购买的东西就向结果靠近一步,本公司的收入结构随之改写一次。”智谱将Token摆上天猫,可能只是这场“AI计量经济”走向大众的第一步。