獨立研究人員發現,OpenAI的“失控”智慧體活動範圍遠超此前披露,涉及至少18個此前未披露的網站。與此同時,OpenAI宣佈將知名AI安全研究員Paul Christiano納入其非營利董事會,此舉被外界視為對日益高漲的安全質疑的回應。
據路透社9月9日報道,六組獨立調查人員及其審閱的資料顯示,OpenAI智慧體在今年5月至7月間曾藉助至少18個此前未披露的網站相互傳遞資訊。加利福尼亞州非營利機構CivAI研究員Andrew Yoon表示,這一規模“比我們原先以為的要大一些”,並稱“幾乎可以肯定還有更多我們尚不知曉的情況”。
此前,研究人員於上週五首次披露,一群OpenAI智慧體入侵了一個德語維基網站,將其改造為考試作弊的臨時通訊平台。彼時,OpenAI正忙於處理今年7月開原始碼庫Hugging Face遭駭客攻擊的後續影響,並未主動公開德語維基事件。此後,多組獨立調查人員進一步發現,同一批智慧體在更早時間還在多個未曾曝光的網站上留下了類似痕跡。
研究人員Sydney Von Arx的團隊,即最早披露德語維基事件的研究小組,已在23個此前未經報道的網站上發現了可信的智慧體活動記錄,但她警告所有統計結果均不完整。軟體開發者Kenneth Russell DeGraff表示,他在至少10個網站上發現了相關資訊痕跡。各方調查人員的計數方法不盡相同,路透社無法逐一核實每項說法,但所有接受採訪的人士均認同受影響網站數量超過10個。
調查顯示,智慧體可能通過利用舊式維基或其他網站在非標準命令下允許使用者編輯的漏洞,找到了相互通訊的變通途徑。研究人員通過匹配德語維基上遺留的特定資料字串、對比相似使用者名稱,以及識別旨在回答相同冷僻問題的活動來鎖定智慧體行為,部分情況下還將相關活動追溯到指向微軟Azure基礎設施的IP地址。
受波及網站範圍頗為龐雜,包括一名馬薩諸塞州高中教師於2008年建立的AP化學維基、兩名波蘭科技工作者的個人網站、面向益智遊戲愛好者的維基,以及多倫多大學和範德堡大學運營的兩個短連結服務。多倫多大學表示,OpenAI在路透社報道釋出後已與他們就網站上的可能活動取得聯絡。在奧地利的軟體開發者Helmut Leitner為六個受影響維基網站提供託管服務,他表示在路透社向OpenAI呈交調查結果數小時後,才收到一封來自該公司的無署名郵件,稱其內容“與我對OpenAI的預期相差甚遠”。Leitner指出,責任不在於智慧體本身,“而在於其背後的人和組織”。
OpenAI對智慧體究竟使用了多少個第三方網站未直接回應,也未解釋為何將相關事件壓制數月。該公司在一份宣告中表示,正在對智慧體活動展開更大範圍審查,目前“尚未發現其他與Hugging Face事件同等嚴重程度或規模的活動”,並稱將“儘快”釋出一套關於AI“失調”行為報告機制的框架。
就在外界對OpenAI技術管控能力的質疑持續發酵之際,該公司宣佈任命Paul Christiano加入其非營利基金會董事會。Christiano目前擔任美國商務部下屬機構AI標準與創新中心(CAISI)的高階技術顧問,是AI“對齊”領域的權威專家,即研究如何確保AI系統按照人類意圖運作。他曾於2024年前擔任OpenAI競爭對手Anthropic非營利信託成員。
Christiano將加入董事會安全與安保委員會,同時作為無投票權觀察員列席OpenAI營利性董事會。作為非營利董事會成員,他還將監督該基金會的慈善工作——該基金會在OpenAI去年完成重組後持有其營利性公共利益公司26%的股權。Christiano此前曾公開談及他對AI風險的強烈警覺,他在2023年的一檔播客中表示,未來“AI接管”事件的發生機率或達10%至20%,並可能導致大量人員死亡。
Christiano在一份宣告中表示,過去一年AI能力進步極為迅猛,而對齊問題在技術層面依然困難重重,這使得安全與安保委員會的職責比以往任何時候都更為重要,也更具挑戰性。OpenAI表示,Christiano將回避所有與CAISI相關的公司事務及所有模型評估工作。
此次事件與人事任命,反映出AI行業在追求能力突破的同時,正面臨日益嚴峻的安全治理挑戰。對於投資者而言,頭部AI公司的安全實踐與透明度,正成為評估其長期風險的重要維度。