7 月 19 日,上海,世界人工智能大会。两天前,月之暗面刚用 2.8 万亿参数的 Kimi K3 刷新「史上最大开放模型」纪录[6],全球半导体股应声抖了一轮。所有人都在等阿里的回牌,等到的东西比预想的更重:通义团队端出 Qwen3.8 Max 预览版,2.4 万亿参数,官方内部评测给它的位置是——综合能力仅次于 Anthropic 的 Fable 5[1]

然后是真正让同行倒吸一口气的那句话:正式版将于近期发布,并开源完整权重[2]

自评全球第二强的模型,标价为零。权重一旦放出,任何对手都能下载、蒸馏、改造、商用。按闭源实验室的商业常识,这等于把镇店之宝搬到大街上任人拓印。谜面就摆在这里:阿里图什么?

答案不在技术里,在生意里。开源在这一步不是姿态,是武器:把模型层修成一条免费公路,闭源对手赖以为生的 API 溢价就会塌陷;而路修好之后,钱在收费站收——订阅、云算力、资本市场,全是阿里坐着的位置。同一周里,中国两张最强的开放模型牌,自研的 Qwen3.8 与被投的 Kimi K3,都通向同一家公司。模型层越不值钱,收租的位置就越值钱。

标价为零的第二名

先把谜面钉牢。Qwen3.8 Max 是 Qwen 系列迄今块头最大的多模态旗舰,文本、图像、视频、文档都吃[4];官方称它在代码工程和专业办公场景表现突出[2]。发布场合选在世界人工智能大会,时间卡在 Kimi K3 发布之后第二天——牌桌上的座次感,谁都看得出来[4]

同一天,阿里云把商业动作也摆上了台面:Token Plan 个人版订阅上线,限时折扣下分三档,Lite 39 元/月、Standard 139 元/月、Pro 499 元/月(原价 60、180、600 元),团队版席位从每月 150 元到 1398 元,订阅用户可以抢先调用 Qwen3.8-Max-Preview[2][3]

一边收着订阅费,一边承诺把模型本体免费送出去。这两个动作摆在同一天,本身就是谜面的一部分。还有一处悬空:截至预览版上线,基准测试表、模型卡、开源许可证都没露面——「仅次于 Fable 5」暂时只是内部评测的自我排位[4]。谜没有变小,反而更大了:连成绩单都还没交的模型,凭什么先把「送出去」写进承诺?

把几种顺手的解释一个个摆上来,再一个个划掉。

不是打不过,才把桌子掀了

最流行的解释:开源是追赶者的武器,打不过闭源霸主,索性免费放血,换生态、换人心。这个解释在阿里自己的历史上就站不住。

2024 年 6 月阿里发布 Qwen2 时,9 月只开放了部分模型权重,最先进的留在手里[13];2025 年 4 月的 Qwen3 系列训练于 36 万亿 token、119 种语言,其中参数超 1 万亿的 Qwen3-Max 一直是专有模型、只通过 API 售卖[13]。弱的时候藏着掖着,强的时候反而摊开——方向和「打不过才开」正好相反。

而中国前沿模型这一周的成色,也不缺第三方佐证。Kimi K3 在 Arena 前端代码竞技榜以 1679 分登顶,成为首个在该榜单夺冠的中国模型;再往前,Kimi K2.7 是 Anthropic 内部安全测试中唯一达标上榜的中国模型。差距当然还在:据 The Decoder,K3 在 FrontierMath 第四档高难数学上的准确率只有约 39%,远低于 OpenAI 与 Anthropic 模型近 90% 的水平——尖端推理这座山还没翻过去。但恰恰是这一点反过来堵死了「败退开源」的解释:真要掩饰差距,更该闭源收门票,靠信息不对称把价定高;把权重摊开,等于请全世界拿放大镜来量你。这是有底气者的动作,不是败退者的。

也不是为了刷声量

第二种解释:开源承诺是免费的广告。这个解释解释不了成本,也解释不了同一周的另一个动作。

刷声量,预览版加一句「仅次于 Fable 5」已经足够——发布当天全网刷屏,什么权重都不用放。而真放权重的代价是实打实的:Hugging Face 上 Qwen 的开源变体已超过 20 万个[13],连微软都拿 Qwen2.5-7B 当基座训练自己的安全对齐模型——朋友能拿去用,对手同样能拿去蒸馏、微调、二次包装。声量不需要付这种成本。

更盖不住的是同一周的配套动作:阿里旗下平头哥宣布把真武 AI 芯片的软件栈 T-Head SAIL 全面开源,给开发者一个 CUDA 之外的替代,主流 AI 框架七天内可完成适配(据 TechNews 科技新报)。为了热搜,没有人会把芯片的软件底座也送出去。从模型权重到芯片软件栈一起开,这是体系,不是营销。

更不是慈善

第三种解释最省事:中国公司信仰开放。可是账本不信仰任何东西。

Token Plan 的三档订阅费就是同一天收的[2];Qwen3-Max 此前一直闭源收 API 钱[13];再往前数,此前两代 Max 级旗舰都停在闭源[4]。从 2023 年 4 月通义千问 beta 上线算起[13],哪一代开、哪一代不开,全是逐案决策,不是教义。2022 年 Hugging Face 在中国受限后,阿里专门建了 ModelScope 平台承接开源分发[13]——开源在这家公司的账上,从头到尾记在「渠道建设」科目下。截至 2025 年初,阿里已放出超过 100 个开放权重模型、累计下载超 4000 万次[13],但开源线与旗舰线一直分池而治:2026 年 2 月的 Qwen3.5 说开就开,Max 从来不放[13]。做了十几年生意的公司,哪个池子开闸、哪个池子锁死,每一笔都是算过的。这一次的反常在于:承诺第一次把旗舰池也划进了公地。

三种解释划掉了。剩下的那个,得从「谁在为模型付钱」这件事本身说起。

谜底:公路免费,收费站收租

闭源实验室的商业模式建立在一个前提上:前沿智能是稀缺品,稀缺品可以收溢价。开源旗舰模型攻击的正是这个前提——当「接近最强」的权重可以免费下载,付费 API 的定价权就开始漏气。

漏气已经不是推演,是报表。OpenRouter 的数据显示,美国公司在该平台上处理的 Token 中,经中国模型处理的比例近期达到约 58%,创下纪录;这一比例自 1 月中旬以来翻了三倍,3 月首次超过美国模型——而 2025 年初,中国模型占比还不足 10%,美国模型约占 80%[7]Databricks CEO Ali Ghodsi 对 CNBC 说,公司在托管 Kimi 这样的开源模型,GPU 都不够用了[11];这家公司还把工程师的默认编程模型换成了中国开源的 GLM 5.2,理由是比 Anthropic 的 Opus 省约 34% 的成本[12];Coinbase 把 Kimi K2.7 设为工程师默认模型后,AI 账单减半。公地不是理念,公地已经在被踩出路来。

那么钱在哪里?看阿里在公路旁边修了什么。

第一个收费站是订阅。Token Plan 按 Credits 计费,模型免费不等于服务免费——权重是公地,托管、调度、工具链、抢先体验是私产[2][3]。第二个收费站是云,也是最重的一个。2.4 万亿参数的权重放在网上人人可取,可有能力把它跑起来的机构屈指可数——同量级的 Kimi K3,推理部署起步就要 64 颗芯片组成的扩展域。开源大模型每一次被认真使用,几乎都对应一笔算力账单,而阿里云是 Gartner 口径下中国及亚太最大的云服务商,运营 29 个区域、87 个可用区;2025 年 2 月,阿里官宣未来三年至少投入 3800 亿元人民币(约 530 亿美元)建云和 AI 基础设施,超过它此前十年在这上面花的总和;官宣那一刻,阿里云 AI 相关产品收入已经连续六个季度保持三位数增长[5]。公路旁边的收费站,地基早就打了,而且已经开始收钱。Kimi K3 发布 48 小时请求量逼近集群极限、被迫暂停 C 端新用户订阅[10]——开放模型的胜利,最直接的形态就是算力不够用。

第三个收费站是分发。阿里已确认通义千问将集成进苹果中国区的 Apple Intelligence,覆盖 iOS、iPadOS、macOS 和 visionOS[8],据钛媒体,千问在国行苹果 AI 中主导约 65% 的任务;荣耀的 RobotPhone 用千问打底,一汽基于千问自研的汽车行业大模型入驻了阿里云百炼平台,Qwen 应用自身已有 2.34 亿用户,并已接入阿里系的外卖服务,淘宝、飞猪在排队。第四个收费站在资本市场:苹果消息公布当天,阿里 ADR 盘前涨约 4%——对一家市值约 2800 亿美元的公司[15],叙事从「电商折价股」换轨到「AI 基础设施」,每一格都是真金白银。

这套拳,阿里二十年前打过一遍。当年 eBay 在中国靠交易收费,淘宝宣布开店免费,把集市修成公地,然后在流量和广告上把钱收了回来。今天模型层扮演的,就是当年「开店费」的角色:对手靠它活,阿里把它归零。

两张牌,一只手

看懂这步棋,同一周的另一件事才显出分量。Kimi K3 走的是几乎相反的变现路:模型开源,API 却定价与 Anthropic 的 Sonnet 相当,是中国主流模型中最高的——把模型本身卖出溢价的路线,与阿里「送模型、收租金」的路线正好是一枚硬币的两面。

但硬币无论落在哪一面,都落在同一只手里。2024 年 2 月,阿里领投月之暗面 10 亿美元融资,当时获得 36% 的股份[14]。两年多过去,月之暗面新一轮融资投前估值已到 315 亿美元,年度经常性收入突破 3 亿美元、API 占比超七成,并已向投资人发出上市议案,最快 6 个月内完成港股 IPO[9]。自研的 Qwen3.8 赢,阿里收订阅和云;被投的 K3 赢,阿里的股权在港交所变现。摩根士丹利说中国大模型正在规模、性能、定价三个维度同步追赶[6]——追赶的两支先头部队,资本关系上都连着杭州。这才是「双旗舰」的真正含义:不是一家公司发了两个模型,是一个资本结构押了两条路线。

承诺兑现之前

阳谋要成立,还差几步,每一步都不虚。

第一步是承诺本身。预览版没有放出权重,措辞是「正式版将于近期发布并开源」[2]——没有日期,没有许可证。此前两代 Max 旗舰都停在了闭源[4],承诺与兑现之间,隔着一次真正的上传。第二步是成绩单。「仅次于 Fable 5」出自内部评测,基准表和模型卡都还没交[4];在第三方把它量完之前,「全球第二」是一句需要抵押物的话。

第三步在牌桌之外。美中经济与安全审查委员会的报告已经把中国开源模型定性为克服算力限制、扩展数据管理能力的关键路径——被写进这种报告的能力,往往离被针对不远。而脱钩是双向的:7 月 10 日起,阿里以发现检测中国用户的隐藏代码为由,禁止员工使用 Anthropic 的 Claude Code,强制改用自研的 Qoder。据 Yahoo Finance,自 6 月 22 日以来全球半导体市值已蒸发约 3.3 万亿美元,市场已经把开放模型当成系统性变量在重新定价,公地的修路人自己也站在震区里。

最后一步,是这盘棋真正的赌注:公路免费的前提,是收费站真能收到钱。订阅要留得住被免费权重养刁的用户,阿里云要接得住全世界跑 2.4 万亿参数的流量——K3 上线两天就把集群挤到极限的那一幕[10],既是这个赌注的最好广告,也是它的压力测试。权重上传的那一天,模型层才正式变成公地;而租收不收得上来,要看之后的每一张算力账单。