2026 年 7 月 21 日,一份正在北京起草的清单被金融时报捅了出来:中国商务部找来国内主要 AI 与芯片企业,商谈把「限制模型权重下载」「限制训练数据出境」乃至「限制台积电为华为、阿里、字节代工先进芯片」写进下一版出口管制目录[12]

三年前,这样的文件全世界只有华盛顿在写。

而催生这份清单的,是这样一个七月:月之暗面的 Kimi K3 以 2.8 万亿参数登顶 Code Arena、综合能力排进全球前三;阿里发布 2.4 万亿参数的 Qwen3.8 Max 预览版,自称仅次于 Claude Fable 5,并承诺开放权重;智谱的 1GW 数据中心部分投运,芯片全部国产;曙光 8000 十万卡超集群在 WAIC 亮相,上线首周应用满载。K3 发布后 72 小时,美股 AI 板块蒸发约 4700 亿美元[14]。大洋对岸,财长贝森特仍把一个数字挂在嘴边——美国占全球 AI 算力的份额已经从三成多爬进五成多,几年之内会到七成到八成[13]

财长在算份额,市场在算损失,北京在写条文。芯片管制满三年,账该合在一起算了。

结论先行

「管制有没有用」不该由「中国有没有造出好模型」来裁决——那是个立场题。它是一笔可以核算的账:逐项去看管制买到了多少时间、付掉了多少利息。核算的结果是,训练前沿模型这一栏几乎没买到时间;「便宜地大规模跑」这一栏确实买到过一两年,且正在被抹平;而利息记了三笔——英伟达的中国收入、一条被逼着长成的国产替代链、以及管制的语法本身被对手学走。

一张三年的流水账

这套管制从来不是一道墙,是一场不断打补丁的追逐。把补丁按时间摊开,账本的骨架就出来了。

2022 年 10 月 7 日,美国商务部出台首轮管制,A100、H100 被挡在门外[1]。规则用了两道并联的门槛:算力要够高,芯片间互联带宽还要达到 600 GB/s——后者恰好是 A100 的 NVLink 带宽[2]。门槛写得如此精确,绕行的路线也就画好了:一个月后,英伟达推出压线合规的 A800,随后又有降带宽的 H800[1]。特供卡在中国卖了近一年。

2023 年 1 月,美国拉上日本、荷兰,把设备端也圈了进来[1]。同年 10 月 17 日,规则换成「总处理性能+性能密度」两项指标,专门堵住「用一堆小芯片凑出大算力」的路——A800、H800 应声出局[3]。英伟达再退一步,2023 年底推出更弱的 H20,到 2025 年它成了中国市场最主要的 AI 芯片[1]

2024 年 12 月 2 日,第三轮加码落地:HBM 高带宽内存被纳入管制,140 家中国实体一次性进清单[10]。一个多月后,卸任前一周的拜登政府抛出雄心最大的一份文件——「AI 扩散框架」,要给先进芯片、乃至大型闭源模型的权重设置全球许可证体系,把全世界分成三个圈层[11]。这份规则没能活到生效那天:2025 年 5 月 13 日,特朗普政府宣布废除,商务部给出的理由是它「过度官僚」、会「扼杀美国创新」[11]。管制不只在和中国的绕行赛跑,也在和华盛顿自己的换届赛跑。

2025 年 4 月 9 日,H20 也被要求出口许可证,英伟达预告至多 55 亿美元减值[5],当季实际计提 45 亿美元[6]。三个月后风向再转:2025 年 7 月华盛顿放行 H20,英伟达随即向台积电追订 30 万颗[1];放行的代价,是把对华销售收入的 15% 交给美国政府——特朗普原本要 20%,黄仁勋把它谈到了 15%[9]。一款被总统称为「过时」的芯片,就此成了美国财政的一个税源。

真正让这张流水账变形的是最后一段。中国网信办要求大型企业停购 H20、转向国产供应商[15];2026 年初,获准有限出口的 H200 干脆被中国海关阻在关外,供应商一度暂停生产[1];5 月特朗普访华,阿里、腾讯、字节等 10 家企业获批采购,7 月美国商务部官员在众议院听证会上确认:实际交付量「微不足道」[1]。三年追逐的收梢不是华盛顿收紧了手,而是北京先挂了电话。

时间账第一栏:训练,几乎空白

先算最重的一栏。管制的第一目标是让中国训不出前沿模型,这一栏买到的时间,用三组事实就能量出来。

第一组是漏斗。管制生效前,梁文锋已为幻方囤下 1 万块 A100[15];管制生效后,特供卡接力供货——A800、H800 卖到 2023 年 10 月,H20 卖到 2025 年 4 月,又在当年 7 月回场。把日历摊平了看,三年里对华「全面断供」的窗口只有 2025 年 4 月到 7 月那约三个月。其余时间,门上始终留着一道缝,区别只在缝的宽窄。

第二组是效率。DeepSeek 用 2048 块降级版 H800、约 560 万美元的训练成本,做出了轰动全球的 R1[15]。这件事的含义常被读反:它不是「管制没拦住中国」,而是「管制把中国逼进了一条更省的路」——混合专家、低精度运算、通信与计算重叠,这些原本属于「穷人的工程学」的手艺,被逼成了整整一代中国模型的默认配置。到 2026 年 6 月,美团用 5 万余颗国产芯片训出 1.6 万亿参数模型,全程未碰英伟达 GPU

第三组是结果。2026 年 7 月,K3 与 Qwen3.8 Max 前后脚把中国开放权重模型送进全球前三——距首轮管制落地 45 个月。若管制的标尺是「让中国造不出好模型」,这一栏的入账约等于零。

把话说满之前,反方的账也要记。战略与国际研究中心(CSIS)早在 R1 时就提醒:中国模型的辉煌仍架在美国硬件上[4]——R1 用的是英伟达特供卡,K3 的血统里同样少不了囤下的算力。K3 在 FrontierMath 最难一档的准确率约 39%,对面 OpenAIAnthropic 的模型接近 90%——「前三」不等于「并肩」。这些都成立。但它们恰恰支持同一个结论:管制没能锁死训练,只是把追赶的成本转嫁给了追赶者的工程师。

时间账第二栏:真正买到的,在「便宜地大规模跑」

有一栏,华盛顿确实买到了东西,只是不在多数人盯着的地方。

训一个模型是冲刺,把它便宜、稳定地端给几亿人是马拉松——后者才是先进芯片真正难以替代的地方。这一栏的证据都很具体:DeepSeek 被鼓励改用昇腾训练,试过之后因稳定性、互联速度和软件问题退回英伟达,最终折中为「训练用英伟达、推理用华为」[15];R2 一再延期,官方归因里就有芯片问题[15];K3 发布仅两天,单日调用量冲到约 1420 亿 token,GPU 见顶,月之暗面被迫暂停 C 端新用户订阅。模型可以登顶,算力马上告急——这就是管制真实咬合的齿痕,按这些事件之间的距离估,它买到的时间以一两年计。

只是这一栏的余额也在肉眼可见地缩水。K3 这种 2.8 万亿参数的庞然大物,推理部署需要至少 64 颗芯片组成的扩展域——恰恰是这种「堆系统而非堆单卡」的需求,落在了国产阵营最近补齐的那块板上:曙光 8000 上线首周日均处理作业超 15 万个,智谱在实体清单上建成了全国产芯片的 1GW 数据中心,国家超算互联网直接上线了 K3 的 API 服务、接口兼容 OpenAI 与 Anthropic 的规范——国产算力平台,跑国产开源旗舰。而成本端的水位差已经翻了方向:Databricks 在自家数百万行代码库上实测,GLM-5.2 追平 Claude Opus 4.8,每任务成本 1.28 美元对 1.94 美元。至于单卡显存、万卡互联、软件生态那几道墙,仍然真实存在,但那是另一篇的题目——此处只需记一笔:墙还在,翻墙的梯子一年比一年密。

利息账:三笔,都记在华盛顿名下

买时间要付息。这三年的利息单,至少三笔。

第一笔是英伟达。 2025 年 5 月的 Computex,黄仁勋当着媒体把话说尽:管制把英伟达在中国的份额从 95% 压到 50%,「总的来说,出口管制是一次失败」[7]。半年后,他确认这个数字已经归零[8]——2026 财年第二季度,对华 H20 销售为零,此后的业绩指引干脆不再把对华 H20 出货计算在内[6]。附着其上的还有一串隐性成本:为堵转运,英伟达把亚洲获授权客户砍掉超过一半、建起白名单;新加坡的走私案查封了 4200 万美元的豪宅,台湾检方为约 50 台走私服务器羁押了超微电脑的高管。三年管制最稳定扩张的部门,是合规部门。英伟达甚至开始向中国云厂商推销不在管制清单上的 Vera CPU——芯片进不去,就卖芯片旁边的东西。

第二笔是被养成的对手。 这套剧本有个原型:2019 年 5 月华为被列入实体清单,随后的故事是鸿蒙、是 2023 年底完全国内生产的麒麟 9000S、是宣布量产昇腾 910C 并拿 CANN 生态对标 CUDA。此后清单越拉越长——2019 年中科曙光、2021 年七家超算实体、2022 年底寒武纪、2023 年 10 月摩尔线程——而清单上的公司一家接一家活成了产业:壁仞被制裁后拿到广州政府背景的 2.8 亿美元融资承诺,2026 年 1 月登陆港交所;阿里平头哥把自家芯片软件栈整体开源,明说要给开发者一个 CUDA 之外的选项;DeepSeek 完成约 74 亿美元融资、估值约 500 亿美元,创中国 AI 私募融资纪录,转身去自研推理芯片。摩根士丹利给这条曲线标了刻度:中国 AI 芯片自给率从 2020 年的 10% 升到 2025 年的 41%,2030 年预计 86%。这笔利息的定性,不必外人代劳,黄仁勋自己说过——当地公司非常有才华也非常坚决,「出口管制给了他们精神、能量和政府支持去加速发展」[7]

第三笔最隐蔽:管制的对象正在失焦。 出口管制的前提,是被管的东西装在集装箱里、过海关、可清点。可 2026 年的前沿竞争品是开放权重——K3 的完整权重定于 7 月 27 日放出,全世界任何人都能下载;Hugging Face 上仅 Qwen 一系的变体就超过 20 万个。华盛顿不是没动过管权重的念头:夭折的「AI 扩散框架」里,就写着对大型闭源模型权重的许可要求[11]——可即便那份规则活了下来,它管的也只是闭源;权重一旦开放,「对华」这个定语就没了着力点。微软在评估把 Copilot 的底层换成 K3,账面上最多能省 6 亿美元推理成本;一个免费的中国模型智能水平逼近美国的付费旗舰,据报道已让特朗普政府的 AI 团队内部起了分歧。管住芯片,管不住权重——抽刀断水,刀再快也留不下切口。

终局镜像:语法被学走了

回到开头那份清单。华盛顿一侧的措辞还在变硬:贝森特已放话,若发现中国 AI 模型窃取美国技术,将实施制裁;奥特曼计划赴华盛顿汇报新模型,美国官员正在起草数周内完成的 AI 安全审查框架。管制的工具箱仍在加深。

变化发生在另一侧。据金融时报报道,北京讨论中的清单——限制模型权重下载、限制训练数据出境、限制高通与台积电为华为、阿里、字节制造基于其设计的先进芯片、限制外资收购战略性 AI 公司——大部分提案尚未定案[12]。但条文成不成其次,文体本身已经说明了一切:管制先进算力的流向、把代工产能当成地缘筹码、用出口许可给技术画国界——这套语法,2022 年 10 月 7 日之前只有一个作者。

三年前,华盛顿赌的是时间:用断供换一段独跑的窗口期。三年后合账,训练一栏近乎空白,系统工程一栏的余额正在流失,利息倒是笔笔到账——丢掉的市场、养成的对手、失焦的管制对象。而最后一笔进账最能说明这场赌局的走向:被管制的一方没有推翻这套规则,它开始起草自己的版本。一项政策最彻底的失败是被无视,最微妙的成功是被模仿——芯片管制两样都占了一点,只是模仿它的,恰恰是它要拦住的人。