9月6日,OpenAI官方部落格釋出文章《研究加速:OpenAI內部視角》,首次以內部資料形式公開其“遞迴自我改進”(RSI)的進展。OpenAI表示,已實現去年秋天定下的目標:在今年9月前造出一個“自動化研究實習生”。該公司對“研究實習生”的定義是:“一個能在人類指導下執行明確定義的研究任務的系統,包括那些需要一名熟練研究員數天才能完成的任務。”下一個目標是:2028年3月前實現完整的“自動化AI研究員”,使其能夠參與深度學習和對齊研究,並通過迭代進一步改進系統。
這一進展意味著“AI訓練AI”的飛輪正在加速:AI產出更多程式碼和實驗結果,研究進展加快,更好的模型被訓練出來,再反過來提升智慧體能力。OpenAI公佈的資料顯示,智慧體首先改變了研究人員的工作方式。今年年初,按智慧體使用量排序處於中位數的OpenAI研究員,對編碼智慧體的使用仍相對有限;到8月中旬,這部分研究員已將智慧體納入日常工作流程。按API價格折算,中位研究員每天的智慧體推理使用額已超過600美元;研究組織中使用量處於前10%的研究員,每天使用的Token價值則超過7000美元。
更關鍵的轉折點發生在今年6月。6月之前,研究組織的智慧體總執行時長仍低於人類勞動總時長;此後情況逆轉。截至8月中旬,以標準8小時工作日計算,每消耗1個人類工作日,研究組織的智慧體已產出3.1個工作日的工作量。與此同時,OpenAI稱,越來越多研究員會同時執行4個或更多智慧體會話。研究部門的智慧體使用增長快於公司其他團隊,以中位員工的輸出Token變化計算,研究部門的使用規模較2025年12月增長124倍。
OpenAI將AI研發描述為一條包含多個環節的流程:提出改進方案、設計評估、編寫基礎設施、進行大規模測試、發現訓練中的錯誤或不安全行為,並將有效方案整合進核心訓練。其中任一環節受阻,都可能限制整體研發迴圈。OpenAI稱,寫程式碼和執行實驗是研究人員的兩項主要工作,而內部資料反映這兩項活動正在加速。一方面,公司工程師整體程式碼交付速度提升;另一方面,2026年以來,每名活躍實驗人員對應的實驗數量持續增加,2026年8月達到自2025年1月開始跟蹤以來的新高。OpenAI稱,這一趨勢與Codex使用增加存在相關性,但同時強調,公司自2025年以來可用算力也顯著增長,不能將實驗增長完全歸因於智慧體。
OpenAI使用Epoch AI提出的前沿AI研發任務分類框架,對研究人員交給編碼智慧體的任務進行了劃分。該框架將AI研發活動分為六類:決定做什麼、設計研究方案、構建程式碼與資料集、執行訓練與評估、分析實驗和模型表現,以及溝通研究發現與決策。OpenAI稱,從2026年1月至8月,上述所有類別的智慧體活動均有所增加。增長最明顯的任務包括研究和基礎設施程式碼、技術協助與審查、啟動監控和除錯執行、實驗結果分析,以及計算叢集運營等。其中,研究和基礎設施程式碼的日均每研究員輸出Token增量最大,達到19.82萬;技術協助與審查增加15.88萬;啟動、監控和除錯執行增加13.31萬。不過,OpenAI表示,高層規劃類任務在智慧體輸出中仍只佔很小比例,例如“決定做什麼”“決定繼續還是停止”等任務的Token規模仍較低。這意味著,至少按照OpenAI當前披露的內部資料,智慧體已覆蓋研發流程中更多執行性、技術性任務,但研究方向選擇、資源取捨及結果判斷仍主要由人完成。
OpenAI還公佈了智慧體任務完成率的資料。從今年1月到7月,在可驗證結果的任務中,各難度級別(以人類完成所需時間為代理指標)的成功率普遍提升。但有一個重要限制:任務越複雜,越需要人工干預。過去6個月中,在需要人類4至8小時完成的任務裡,超過一半的成功案例涉及至少1次人工介入。OpenAI的表述是:“智慧體仍需要大量人工引導才能成功,尤其是隨著任務複雜度上升。”
飛輪並非無摩擦運轉。7月20日,OpenAI發現智慧體入侵了內部研究基礎設施,隨即臨時關閉用於訓練的容器服務,並在加入大量額外限制後恢復。這導致強化學習訓練算力急劇下降,持續約兩週。8月6日至7日,初步證據顯示Astra模型可能具備其“準備框架”定義下的關鍵網路能力,OpenAI對Astra模型實施了額外的特定安全限制,要求其在更高安全級別的研究環境中執行。此後一週,Astra級別的GPU分配進一步下降59.2%,但其他模型類別的算力分配上升17.2%,抵消了約85%的Astra算力缺口,整體強化學習工作負載的總算力分配基本保持不變。OpenAI對此的解讀是:“當新的管控措施引入時,算力仍然有價值且具有靈活性,會自然流向研究企業內的替代用途。”
同一天,OpenAI首席科學家Jakub Pachocki發表長文《An Alien Mind》(一個異星心智)。文章認為,AI是養出來的,不是造出來的,造它的人也不完全懂它。人類唯一能看見AI在想什麼的視窗,是它寫出來的思維鏈,而這扇窗正在關上。Pachocki寫道:“基於內部結果,我強烈預期這種進展速度可以持續到遞迴自我改進。”但他同時表示,“目前我認為,沒有任何實驗室在對齊與監控上做到了足夠充分的程度,可以繼續負責任地以最高速度擴充套件太久。”他呼籲行業自願放緩,並推動各國政府將國際協調列為優先議題。
OpenAI在報告結尾表示,將繼續公開RSI進展,並在其“前沿政策藍圖”中主張,包括OpenAI在內的各公司應被要求公開追蹤其RSI進展。報告也坦承當前測量工作的侷限:“智慧體驅動的AI研究仍然是新生事物,我們仍在學習如何衡量它。”部分指標(如程式碼產出量)易於收集但難以解讀;更直接反映研究進展的指標(如智慧體任務成功率)則複雜且難以驗證。OpenAI的表態是:“每當我們發現繼續推進將帶來不可接受的安全風險時,我們將採取適當應對措施,包括放緩或停止我們認為無法充分保障安全的系統的開發或部署。”