Anthropic 周一宣布,其一个尚未发布的模型在数学领域最著名的未解难题之一——黎曼猜想上取得了显著进展,将猜想成立解的下界大幅提高。尽管并未完全证明该猜想,但这一成果展示了AI在数学发现上的潜力,可能重新引发关于当代AI能否产生新科学思想的讨论。
黎曼猜想提出已超过150年,是关于素数分布规律的核心猜想,目前悬赏100万美元征求解法,但至今无人领奖。Anthropic 的模型并未解决这一难题,但通过一种特别的方式取得了进展:一位缺乏数学训练的员工提示模型“真正尝试”证明该猜想,随后模型自主协调任务,运行了一天半。
据 Anthropic 介绍,该模型共测试了650种不同的解题思路,协调了60个子代理,总花费达3100万美元。其中,两个子代理负责提出关键数学思想,13个为这些思想贡献了想法,30个尝试但未能提出新思路,13个负责验证论证正确性,最后两个协助撰写初始论文。这一结果已由 Anthropic 的两位内部数学家确认,并使用开源证明助手 Lean 进行了形式化验证。
这是大语言模型在数学领域一系列突破中的最新进展。今年已有多个 Erdős 问题被AI模型解决,更强大的模型带来了更亮眼的结果。OpenAI 近期发布了其内部“Astra”模型证明的十项重大成果,Anthropic 的另一项工作则反驳了长期存在的 Jacobian 猜想。
这些成果在数学界引发了兴奋与担忧。今年6月,一群知名数学家签署公开声明,担心AI可能削弱该领域的核心价值——特别是真正的数学证明应“归功于特定作者,他们为发现负责并承担正确性责任”的标准。然而,数学界对如何应对新技术仍存在分歧。
菲尔兹奖得主 Timothy Gowers 在回应声明的博客文章中质疑,AI的影响可能以更复杂、更积极的方式改变数学。他写道:“如果我们到达一个数学定理不再与数学家关联的世界,也许这并不比星星不以天文学家命名、大多没有名字更成问题。”
这一事件对AI产业投资者而言,意义在于它展示了AI在科研发现上的实际能力,可能影响对AI模型价值的评估。尽管模型运行成本高昂(3100万美元),但若能持续产出数学成果,或推动AI在科学发现中的应用,将拓展AI的商业与学术价值。同时,数学界的争议也提示,AI介入科研可能引发伦理与规范问题,值得关注。