Anthropic 週一宣佈,其一個尚未釋出的模型在數學領域最著名的未解難題之一——黎曼猜想上取得了顯著進展,將猜想成立解的下界大幅提高。儘管並未完全證明該猜想,但這一成果展示了AI在數學發現上的潛力,可能重新引發關於當代AI能否產生新科學思想的討論。

黎曼猜想提出已超過150年,是關於素數分佈規律的核心猜想,目前懸賞100萬美元徵求解法,但至今無人領獎。Anthropic 的模型並未解決這一難題,但通過一種特別的方式取得了進展:一位缺乏數學訓練的員工提示模型“真正嘗試”證明該猜想,隨後模型自主協調任務,運行了一天半。

據 Anthropic 介紹,該模型共測試了650種不同的解題思路,協調了60個子代理,總花費達3100萬美元。其中,兩個子代理負責提出關鍵數學思想,13個為這些思想貢獻了想法,30個嘗試但未能提出新思路,13個負責驗證論證正確性,最後兩個協助撰寫初始論文。這一結果已由 Anthropic 的兩位內部數學家確認,並使用開源證明助手 Lean 進行了形式化驗證。

這是大語言模型在數學領域一系列突破中的最新進展。今年已有多個 Erdős 問題被AI模型解決,更強大的模型帶來了更亮眼的結果。OpenAI 近期釋出了其內部“Astra”模型證明的十項重大成果,Anthropic 的另一項工作則反駁了長期存在的 Jacobian 猜想。

這些成果在數學界引發了興奮與擔憂。今年6月,一群知名數學家簽署公開宣告,擔心AI可能削弱該領域的核心價值——特別是真正的數學證明應“歸功於特定作者,他們為發現負責並承擔正確性責任”的標準。然而,數學界對如何應對新技術仍存在分歧。

菲爾茲獎得主 Timothy Gowers 在回應宣告的部落格文章中質疑,AI的影響可能以更復雜、更積極的方式改變數學。他寫道:“如果我們到達一個數學定理不再與數學家關聯的世界,也許這並不比星星不以天文學家命名、大多沒有名字更成問題。”

這一事件對AI產業投資者而言,意義在於它展示了AI在科研發現上的實際能力,可能影響對AI模型價值的評估。儘管模型執行成本高昂(3100萬美元),但若能持續產出數學成果,或推動AI在科學發現中的應用,將拓展AI的商業與學術價值。同時,數學界的爭議也提示,AI介入科研可能引發倫理與規範問題,值得關注。