xAI 旗下模型 Grok 4.5 Medium 在一次非正式的內部討論中,僅用 8 分鐘 便推翻了困擾數學界約 30 年 的圖論猜想,引發科技與投資圈廣泛關注。xAI 創始人 埃隆·馬斯克 在社交平台 X 上點贊並轉發相關帖子,評論稱“Grok 4.5 剛剛解決了一個懸而未決約 30 年的圖論猜想”。

事件起源於使用者 Dmitry Rybin 於 23 日在 X 平台釋出的一篇帖子。他表示,Dinitz-Garg-Goemans 猜想 已被證偽——該圖論問題懸而未決長達約 30 年。據其描述,相關發現藉助 AI 完成,帖子附有具體的圖論反例資料。

隨後,據 賈斯汀·孫(Justin Sun) 在 X 平台釋出的帖子披露,團隊將 Rybin 的原始帖子分享至內部 Slack 頻道 後,Capy——一個執行在 Grok 4.5 Medium 之上的 AI——主動嘗試求解,並在 8 分鐘內找到了一個新穎的反例,從而推翻了該猜想。這一過程的非計劃性使其格外引人注目:AI 並非在受控的研究環境中被專門部署於該問題,而是在一次隨機的團隊討論中自主“介入”,並獨立完成了推理與驗證。

Dinitz-Garg-Goemans 猜想屬於圖論領域,核心涉及 分數流(fractional flow)不可分割流(unsplittable flow) 之間的代價關係。根據 Rybin 的描述,被找到的反例圖具有分數流代價 58,而任何容量違反不超過 15 的不可分割流,其代價至少為 60——這一差距直接否定了該猜想的成立。該猜想自提出以來懸而未決約 30 年,屬於組合最佳化與網路流領域的經典開放問題。

值得關注的是,Rybin 本人在其帖子中提及,上述發現最初是通過與 GPT-5 的對話完成的,並附上了相關聊天記錄連結。而賈斯汀·孫隨後展示了 Grok 4.5 Medium 同樣獨立完成了這一推翻過程。這意味著,在同一數學難題上,OpenAI 的 GPT-5 與 xAI 的 Grok 4.5 在短時間內相繼給出有效解答,直觀呈現出當前頂尖 AI 模型在數學推理能力上的競爭態勢,也為市場評估兩家公司技術實力提供了新的參照維度。

這一事件迅速引發市場對 AI 前沿能力的關注。Grok 4.5 Medium 版本以非正式渠道完成這一突破,尤其值得注意的是,這並非一次精心設計的基準測試,而是在團隊 Slack 頻道的日常討論中偶然觸發,進一步凸顯當前頂級 AI 模型在數學推理方面的實際落地能力。