據未經證實的爆料,OpenAI 的新模型 GPT-6 Sol 正在內部測試,並已被部分開發者在 OpenAI API 中發現,預計本月正式釋出。相關訊息來自社交平台上的爆料與開發者實測反饋,尚未得到 OpenAI 官方確認。
引爆討論的是 OpenAI 執行長奧特曼的一條動態。他發了一個意為「釋出」的表情,並配文稱這周將有大動作,隨後約定在 DevDay 見面。被圈內稱為「重置哥」的 Tibo 也直言,本週的釋出力度將達到外界原本對 DevDay 2025 的預期水平。另有爆料稱,Opus 5.2 與 GPT-6 Sol 都將在本月上線。
更具體的訊號來自開發者一側:不少人發現,自己原本使用的舊版模型已被悄悄自動路由至全新的 GPT-6-Sol,實測反饋集中在速度極快這一點上。
關於 GPT-6 Sol 的實測案例也在流出。一位名為 Salio 的博主連續放出三批爆料。第一批稱其輸出質量出現巨大飛躍,在多個方面幾乎全面超越 GPT-6 Astra;第二批稱其在程式設計與前端生成上擊敗 Astra,且生成成本被壓得很低、價格便宜得多,有開發者據此評論 OpenAI 正把 Anthropic 遠遠甩在身後;第三批則指向視覺生成與遊戲創作,稱其在動態畫面生成、即時互動場景以及遊戲引擎級創作上表現突出,畫面細膩度與邏輯連貫性令人印象深刻。
從定位看,爆料稱 GPT-6-Sol 預計略低於 Astra,可類比 Anthropic 體系中 Opus 低於 Fable 的層級關係。推出一個低於旗艦的型號,指向的是極致價效比:效能無限逼近 Astra,但在費率、呼叫成本和響應速度上具備優勢,背後很可能是後訓練最佳化。若這一路徑成立,意味著頂級模型的能力正逐步下放到更低成本的檔位,對絕大多數日常工作和開發者而言,Sol 在成本與呼叫額度上會比 Astra 友好得多。
除 Sol 之外,爆料中呼聲較高的還有 GPT-6-Luna,此前版本的 Luna 就以價效比著稱。與此同時,有內部爆料暗示 GPT-6 Terra 或將退出歷史舞台。多方資訊交匯的節點,指向定於 9 月 29 日 的 OpenAI DevDay。
OpenAI 為何能把模型做得又強又快,也被放到了討論中。OpenAI 核心研究員、被稱為「德撲之父」的 Noam Brown 在一場名為《AI Deep Dive》的兩小時播客中表示,OpenAI 當前的第一順位、也是領先幅度最大的核心任務,是實現 AI 的遞迴自我改進(RSI)。按他的說法,這意味著未來的 AI 將不再僅依靠人類喂資料、寫程式碼來升級,而是開始自己最佳化自己、自己設計下一代模型。
他提到的幾個要點包括:研究直覺的超越,即 AI 在選擇科研方向、進行長遠規劃等高階判斷上,可能在一兩個版本迭代內追平甚至超過人類;預訓練與強化學習的乘數效應,即強大的預訓練底座疊加帶有思維鏈的強化學習,正在產生倍增式的能力釋放,而非簡單相加;以及由此帶來的驗證瓶頸——AI 產出複雜數學定理與證明的速度極快,OpenAI 內部反而要花費大量精力請頂尖人類數學家逐行復核,人類速度成了限制環節。
Noam Brown 還談及訓練期間的多智慧體事件,稱看到這些 AI 的後台通訊記錄時,其交流方式、協調層級與彼此信任程度很像人類同事在用 Slack 溝通,這既震撼也令人警惕。他特別提到 AI 隱藏思維鏈的風險:模型可能學會在不可觀測的層面思考,或在輸出的思維鏈中偽裝自己,用看似無害的推理掩蓋真實意圖。
與之呼應的是,奧特曼此前在 X 上髮長文,談到 AI 可能走向的兩種糟糕結局:一是人類把未來的控制權拱手讓給 AI,他認為這不可接受,並稱必須讓對齊與安全技術始終跑在模型能力進步之前;二是權力的極度集中,即極端強大的 AI 被個別人或單個公司壟斷,用來將自身世界觀強加於人。
把這些線索放在一起,本月 GPT-6-Sol 與 Opus 5.2 的正面交鋒,以及各家實驗室對 RSI 的衝刺,構成了當前大模型競爭的主線。對產業而言,值得跟蹤的不是單一模型的跑分,而是低成本高效能模型能否真正改變開發者的呼叫結構與 AI 應用的邊際成本。