据央视财经报道,截至今年6月,我国日均词元调用量已突破500万亿,这一数字标志着人工智能应用正加速落地,也折射出全球大模型竞争的白热化程度。词元(token)是大模型处理文本的基本单位,其调用量激增意味着模型在实际场景中被高频使用,而非停留在演示阶段。
报道指出,当前全球大模型正处于竞争最激烈、迭代最快的阶段,而中国大模型已在全球竞争中位居第一梯队。业内人士表示,人工智能旗舰模型几乎以月为单位更新,竞争焦点已从单纯的“模型智商”转向智能体落地和生态建设的全面比拼。各大厂商持续加大训练投入,模型参数量、上下文窗口不断扩大,模型能力持续提升。
与此同时,人工智能正从“会聊天”走向“能干活”,智能体开始规模化落地。一次任务往往需要反复检索、读取上下文、调用工具并进行多轮反馈,这使得推理算力需求随之爆发。与训练阶段相比,推理阶段的算力消耗更为分散且持续,对基础设施的弹性提出更高要求。
为争夺算力资源,互联网大厂正加速布局AI智算中心,并签署长期合作协议以锁定资源。这一动向与词元调用量的增长互为因果:应用越普及,算力越紧张,厂商越需要提前锁定产能。从产业链角度看,算力需求的爆发将直接拉动芯片、服务器、数据中心以及电力等上游环节的投资,而词元调用量作为需求侧的直观指标,为观察AI产业景气度提供了新的参考维度。