智譜AI近期動作頻頻,先是宣佈其GLM Coding Plan老套餐將停止自動續訂,並給予老使用者兩個月新套餐補償,隨後於9月2日正式入駐天貓開設官方旗艦店,上架該程式設計套餐。個人版Lite月付118元、Pro月付538元、Max月付1078元,分別對應不同積分額度。產品基於GLM-5.3,並適配ZCode、Claude Code、Codex等20餘款主流Agent。這標誌著AI使用額度開始像手機流量一樣被直接購買,進入電商貨架。
然而,更值得關注的是AI行業出現的反常識變化:Token越來越便宜,但AI公司卻越來越在意使用者消耗的Token量。過去幾個月,Kimi曾因算力壓力暫停C端新使用者訂閱,阿里雲也調整了其Coding Plan,騰訊雲則上調了部分混元模型價格。這些動作表明,AI公司正從單純的價格競爭轉向對Token消耗量的精細管理。
智譜自身披露,隨著模型架構和推理基礎設施最佳化,其單位Token推理成本較年初下降80%,並已實現10萬級國產晶片規模化低成本推理。但Token消耗速度增長更快,一枚Token背後是模型推理所消耗的計算資源,包括GPU、高頻寬記憶體、網路、儲存以及資料中心的電力和散熱。當模型從簡單聊天轉向複雜任務執行,Token消耗量呈指數級增長。
智譜最新半年報顯示,2026年上半年營收9.54億元,同比增長399.7%,其中MaaS開放平台及API業務收入達8.25億元,同比增長2735.7%,佔總收入86.5%,而去年同期該比例僅為15.2%。本地化部署收入佔比則從84.8%降至13.5%。一年時間,智譜的商業模式幾乎完成換擋,從賣模型轉向賣呼叫。
值得注意的是,智譜並非簡單降價換規模,其Token呼叫量較年初增長超40倍,API平均售價提升約101%,單位Token推理成本下降80%,MaaS業務毛利率提升至24.6%。成本下降、收入增長、使用者用量增加,平均售價反而提升,這表明AI商業化可能正擺脫最初的價格戰。
智譜管理層將商業模式概括為“賣模型→賣呼叫→賣訂閱→賣端到端任務結果”,這對應AI商業化的四個階段。從Chatbot模式到Agent模式,再到Multi-Agent,Token需求不斷膨脹。2026年第一季度,全球每週Token使用量暴增250%至22.7萬億,OpenAI平台Token呼叫量從2025年10月的每分鐘約60億次飆升至2026年3月底的150億次,不足半年暴增150%。摩根士丹利報告指出,頂尖大語言模型正經歷“非線性的能力躍升”,AI爆炸式增長正碰上系統性的供應瓶頸。
這背後是經濟學中的“傑文斯悖論”:資源使用效率提高、單位成本下降後,人們反而可能大量增加使用。Token越便宜,使用者越敢讓AI幹更多事;AI越聰明,使用者越願意把複雜任務交給它,形成消耗增長飛輪。智譜董事會秘書肖磊在財報電話會上表示,相較收入增速,收入構成的切換更值得關注。董事長劉德兵則指出,單點榜單領先很快會被追平,真正重要的是誰能持續用更低成本交付更高智慧。
未來趨勢可能是基礎Token越來越便宜,但高階智慧越來越貴。單Token價格下降不等於AI使用成本下降,因為模型越強,使用者讓它做的事情越複雜。智譜半年報中的一句話點明核心:“模型每完成一次能力躍遷,客戶購買的東西就向結果靠近一步,本公司的收入結構隨之改寫一次。”智譜將Token擺上天貓,可能只是這場“AI計量經濟”走向大眾的第一步。