据路透报道,智谱于9月11日启动新一轮融资,方案包括约20亿美元的股票配售和30亿美元的可转换债券发行,合计规模达50亿美元,折合人民币超过350亿元。这距离智谱上一次从资本市场拿钱仅过去两个月——今年7月,智谱刚通过配售募集约40亿美元;再往前,公司于今年1月登陆港交所。上市不到一年便连续两次再融资,智谱从资本市场获取资金的节奏明显加快。
募集资金的去向指向同一个方向。根据披露,本轮资金将用于研发、算力资源及相关基础设施、业务扩张、战略投资和潜在并购等;7月那笔40亿美元的用途中,算力、研发和人才同样占据主要位置。一家已经上市的大模型公司仍如此密集地融资,折射出大模型正在变成一门越来越“重”的生意,最直接的变化发生在算力层面。
今年7月,有消息称智谱已建成一座1GW级数据中心并开始部分投入运营,主要用于GLM系列模型研发,且全部采用国产AI芯片。此外,智谱还运营着多个万卡计算集群,并被曝收购异构算力软件公司中科加禾、与国内芯片公司讨论定制AI芯片。几乎同一时间,DeepSeek也开始关注基础设施并重金投入:今年以来在内蒙古乌兰察布招聘数据中心高级交付经理、运维工程师及IDC设计规划工程师;7月底又有消息称其计划在乌兰察布增加1GW规模算力,并从外部租赁额外算力。
从租算力、买算力,到自己盖数据中心,模型公司的角色正在发生变化——它们开始从算力的使用者,变成算力基础设施的建设者。这一转变背后是竞争规则的迁移。2023年“百模大战”初期,模型公司最要紧的是证明自己能把模型训练出来,参数规模、Benchmark、用了多少张GPU、能力能否追上GPT-4,都是当时的竞争指标;算力虽重要,但更多是服务于模型训练的生产资料。
到了2026年,供需关系已经改变。头部模型之间的竞争演变为持续迭代,预训练之后还有后训练、强化学习和推理,模型更新周期不断缩短,后训练成为多数厂商的主场。更关键的是,Agent成为新的竞争场景后,模型不再只是生成答案,而要持续调用工具、运行任务、消耗Token。模型公司需要考虑的问题,也从“训练下一代模型需要多少张卡”,变成未来几年能否获得持续、稳定且足够便宜的算力。这正是智谱和DeepSeek亲自下场建设基础设施的原因:算力正从可按需采购的成本,变成需要提前锁定的战略资源。谁能更早控制芯片、集群、数据中心、电力乃至软件调度,谁就能更稳定地决定训练节奏,并压低长期训练与推理成本。
海外市场把这场竞赛推得更远。国际清算银行近期披露,2025年至2026年全球最大的五家科技公司在AI上的投资预计超过1万亿美元;到2030年,全球AI相关投资规模可能从目前约5000亿美元增长至4万亿美元。Anthropic正在筹备规模可能达到1000亿美元的IPO,并已承诺在AWS投入1000亿美元,同时持续寻找新的芯片和算力供应商;OpenAI、Meta和Google也在把资金投向数据中心、GPU、自研芯片和能源。
由此,大模型公司的竞争不再只是比拼谁的模型更强,而是谁有能力长期支撑一个最前沿模型。这构成了行业的第二道门槛:第一轮竞争淘汰了无法持续迭代模型的公司,如今智谱、DeepSeek、Kimi、MiniMax等少数玩家已证明自己能留在牌桌上;下一轮竞争要证明的则是能否获得足够算力、稳定运行大规模集群、把不同国产芯片组织起来、降低训练和推理成本,以及有没有足够多的钱持续投入这一切。模型、人才、资本和基础设施缺一不可,智谱此次募集的50亿美元,很大一部分正是投向下一场战争的门票。