今年初,谷歌AI负责人Jeff Dean在播客中提及一个当时仅在技术圈内流传的概念——蒸馏(Distillation)。五个月后,这个词已从硅谷蔓延至华盛顿,成为科技界与立法者激烈辩论的焦点,核心在于它是否构成国家安全威胁,以及是否让中国在AI竞赛中快速追赶美国。
蒸馏技术本质上是指利用一个先进AI模型的输出(如聊天机器人的回答或工作成果)来训练另一个模型。这种做法存在争议,因为它可能让开发者通过简单复制那些投入数亿甚至数十亿美元研发顶尖模型的公司成果,快速打造出有竞争力的产品。AI安全公司SecurityPal创始人Pukar Hamal比喻道:“这就像有人去上课、读课本、认真做作业,然后另一个学生说‘我没做,能抄你的吗?’”
争议在上周急剧升温。中国AI实验室月之暗面(Moonshot AI) 发布了开源权重模型Kimi K3,用户发现其性能可与Anthropic和OpenAI的最佳商用模型媲美。与美国公司销售专有模型访问权不同,月之暗面等中国实验室提供可下载、修改和任意运行的开源权重模型。白宫顾问Michael Kratsios在X平台上公开指责:“我们有信息表明,月之暗面蒸馏了Anthropic的Fable模型用于开发K3。他们为此开发了复杂的内部平台,大规模蒸馏美国模型,并快速切换多种访问方式以规避检测。”
然而,科技巨头们的反应出人意料。上周五,英伟达、微软、Meta、Palantir 等20多家公司联合发布公开信,敦促政策制定者避免过早限制开源权重AI模型,以免扼杀竞争或把创新推向海外。信中指出:“蒸馏,即利用一个模型的输出来帮助训练或改进另一个模型,是一种广泛使用的模型改进、演进和验证技术。”Box CEO Aaron Levie作为签署方之一表示:“总体趋势是,无论创新来自美国、中国还是其他地方,更多的创新意味着更多的AI进步,并且会朝着更低成本、更高效率的方向发展。”
乔治城大学安全与新兴技术中心研究员Colin Shea-Blymyer认为,美国政府正在试图明确立场:“政府可能认为,中国和俄罗斯公司利用美国模型的输出来提升自身性能,从而获得了不公平优势。”
但并非所有公司都持相同立场。Anthropic 估值接近1万亿美元并计划近期上市,其立场截然不同。今年2月,Anthropic曾指控中国的DeepSeek、月之暗面和MiniMax 通过约2.4万个虚假账户、生成1600万次交互,对其Claude模型进行工业级蒸馏。Anthropic表示:“美国公司构建了防止国家和非国家行为者利用AI开发生物武器或进行恶意网络活动的系统。阻止这种行为需要行业、政策制定者和全球AI社区的快速协调行动。”OpenAI和Anthropic已在服务条款中明确禁止蒸馏行为。
Info-Tech Research Group研究总监Shashi Bellamkonda指出,尽管当前讨论聚焦于中国的开源权重模型,但许多公司自身也在使用蒸馏技术。例如,英伟达 在其Llama Nemotron系列模型的训练过程中就采用了蒸馏,相关研究论文对此有详细说明。他认为:“蒸馏是一种合法且非常有价值的技术,用于在大型模型输出基础上训练更小、更便宜的模型,并且一直在被实践。”
蒸馏技术的争议折射出AI产业的核心矛盾:一方面,它降低了模型开发门槛,加速了创新扩散;另一方面,它可能削弱投入巨资研发前沿模型公司的商业回报与竞争优势。对于投资者而言,这一辩论的结果将直接影响开源与闭源模型的监管走向、中美AI竞争格局,以及整个产业链的估值逻辑。