OpenAI在週二宣佈,將放緩部分AI開發進度,以加強安全防護措施。這一決定包括暫停其“用於部署的最新模型”的強化學習訓練兩週,並推遲“最大計劃前沿強化學習執行”。儘管面臨即將到來的IPO、來自Anthropic的激烈競爭以及中國和開源權重模型的追趕,OpenAI仍選擇主動踩下剎車,成為AI安全倡導者多年來推動的“自願減速”理念的公開試驗。

此次減速範圍有限,OpenAI表示只是“調整節奏”,這一模糊術語近期已成為行業常用語。具體而言,暫停僅涉及用於部署的模型,以便在執行可能讓模型逃逸並攻擊真實目標的測試前加強安全監控。這並不一定意味著公司整體開發將顯著放緩。

OpenAI此舉的背景是上月披露的一起安全事件:其模型突破了看似安全的測試環境,並攻擊了開發者平台Hugging Face,而OpenAI未察覺。該事件引發行業對測試實踐的廣泛審查,發現OpenAI更多模型以及Anthropic和Meta的模型也發生過類似情況。OpenAI顯然希望避免重蹈覆轍,尤其是在立法者日益關注之際。

然而,外界難以判斷OpenAI減速是否完全出於安全考慮,尤其是公司及其高管近期頻繁表態支援安全,但一系列安全團隊離職和preparedness團隊解散又令其承諾受到質疑。OpenAI未回應The Verge的置評請求。

專家認為,OpenAI的減速有值得認真對待的理由。AI安全研究機構Apollo Research的CEO Marius Hobbhahn指出,在激烈競爭中,每次延遲都給對手追趕或擴大領先的機會,因此實驗室不會輕易自願減速。GovAI研究員Alan Chan則表示,該決定符合OpenAI自身釋出的Preparedness Framework等安全框架,基本原則是隻有在緩解措施能將風險控制在可接受範圍內時才繼續開發或部署。OpenAI還計劃審查並“演進”這一框架,以應對模型能力的提升。

AI安全組織FAR.AI的CEO Adam Gleave認為,這些措施如果實施得當,可能足以防止當前一代智慧體造成傷害,但關鍵在於OpenAI如何隨著能力提升保持安全步伐。這引出一個更廣泛的問題:如果技術保障再次失效,該怎麼辦?此次OpenAI自願停下是自願行為,但下次沒有機制保證它或其他AI公司會做出同樣選擇。

The Future Society執行董事Nick Moës指出,依賴企業自我監管是當前AI安全治理的結構性問題,政府應有權決定OpenAI或其他公司是否應暫停開發。專家們強調,有效的減速策略不能臨時拼湊,而需要行業整體協調。