Anthropic 两位强化学习方向的技术负责人 Nicholas Marwell 与 Sholto Douglas 在一档播客中,系统谈到了 AGI 时间表、AI 编程的演进、开源与监管立场,以及他们为何反对模型蒸馏。这场对话发布一个多月后,Anthropic 披露的 IPO 申报文件让其中的判断有了更具体的注脚。
文件显示,2025 年 Anthropic 营收接近 46 亿美元,同比增长约 12 倍,但经营亏损仍超过 80 亿美元;公司已为未来的云、算力和基础设施签下至少 5180 亿美元的长期承诺。若上市顺利,其估值最高可能超过 2 万亿美元。融资与采购也开始相互缠绕:Broadcom 同意向 Anthropic 提供最高 420 亿美元贷款融资用于基础设施支出,而 Anthropic 承诺未来 5 年投入 1252 亿美元租用 TPU 算力。
这种「收入数十亿、承诺数千亿」的结构,对应 Marwell 在访谈中给出的内部逻辑:每增加一个边际单位的智能,其创造的经济价值可能比前一个单位呈指数级增长。他用编程场景解释这一判断——Tab 自动补全已几乎不值钱,随后出现了智能体式编程,再往后可能是能独立完成软件工程工作的 AI,最终延伸到数学发现、生命科学乃至疾病治疗。旧能力会迅速商品化,但只要智能前沿继续移动,最前沿的那一点能力反而可能越来越昂贵。
两位技术负责人对 AGI 的时间判断相当激进。他们认为未来几年就可能出现能力达到或超过所有人类的模型,能够完成人类在电脑上可完成的所有事情,并在机器人技术足够先进后延伸到物理世界。Douglas 以自身经历描述变化速度:18 个月前他还在逐行手写代码,加入 Anthropic 几个月后转为「指导模型」写代码,如今已可让模型独立完成一两天的工作并真正推进项目,感觉像多了一个初级团队成员。Marwell 则补充,模型开发此前主要是让 AI 完成人类本就擅长的任务,而近期数学领域的部分结果开始显示,模型能把不同的人类想法组合起来,形成此前未出现过的新思路。
在更近期的风险上,两人列出失业、生物安全与网络安全三类担忧,并认为这些并非遥远未来。Douglas 判断,网络安全与生物领域目前攻击方占优,但未来两年网络安全可能转为防御占优——因为可以提前用足够强的智能攻击自己的系统、补上漏洞。
关于开源,Marwell 表示个人非常支持开源,自己当年学习机器学习就受益于开源模型,但认为风险会越来越大,因此主张设定阈值,决定社会整体愿意释放多强的能力,封闭模型与开源模型应满足同样的安全门槛。
在中美 AI 竞赛问题上,Douglas 的表述相当直接:在任何可接受的情形下,都不会出现「美国放慢、中国继续前进」的结果;任何真正的放缓方案都必须是完全协调的,且各方都值得信任,基本不存在美国单独放慢的情形。
两人反对蒸馏的理由则与商业模式直接相关。他们认为蒸馏只能复制当前前沿,无法把研发推进到下一代;进入下一代前沿需要巨额前期资本投入,未来一次训练运行的成本可能是 100 亿、1000 亿甚至 1 万亿美元。如果他人能以很小成本复制成果并在一两周内推出复制品,复制方在经济上反而更有优势,因为它不必承担那笔巨大的研发成本。
这也回到 IPO 文件呈现的另一重矛盾:Anthropic 一边向资本市场描绘 AI 比工业化、电力和互联网更深刻的经济变革,一边在风险提示中警告先进 AI 可能带来灾难性甚至生存性风险,包括模型抗拒关闭、隐藏信息等难以预料的自主行为。Marwell 对此的回应是,稍微落后于前沿的一侧会不断商品化,但真正的领先边缘价值反而会越来越大。
访谈最后,两人把目标描述为把原本可能需要数百年的技术进步压缩到未来一二十年完成,最终进入一个几乎所有东西的成本都压缩到能源成本的后稀缺世界。这一愿景能否支撑起 2 万亿美元级别的估值,仍取决于前沿能力能否持续领先、以及数千亿美元算力承诺能否转化为对应的收入。