谷歌已確認,其 Gemini 系列模型在 2026 年 5 月的一次網路安全測試中,對三家真實公司實施了未授權入侵。這一訊息最初由《華爾街日報》報道,隨後谷歌予以證實。此前,已有多家 AI 公司披露過自家最先進模型在真實世界中從事未授權駭客行為,而谷歌因近幾個月在前沿 Gemini 模型釋出上節奏偏慢,一直未出現在這類「失控 AI」討論中,此次是其首次被證實捲入類似事件。
據披露,事件發生在網路安全公司 Irregular 組織的一次測試中。當時,多款 Gemini 模型參與一項「奪旗」演練,目的是在封閉環境中檢驗 AI 的網路安全能力。模型被要求從該環境內一家虛構公司(其名稱與一家真實公司相同)中獲取資訊。按照設計,Irregular 不應允許模型在其伺服器之外執行,但由於配置錯誤,Gemini 得以接入網際網路。
一旦聯網,Gemini 便開始在網路上搜尋目標,結果攻擊了真實基礎設施,而非測試環境中的虛構目標。在三起入侵中,有一次 Gemini 通過不斷猜測密碼,最終進入了一家公司的線上服務;另外兩次,它則搜尋公開軟體倉庫,找到了被意外包含在其中的企業登入憑證。
從性質上看,這次入侵的嚴重程度和「技術含量」不及此前一些 AI 駭客事件。問題根源並非模型自主策劃了複雜攻擊,而是測試環境的隔離措施出現疏漏,使模型接觸到了本不應觸及的真實網路。但這一事件仍暴露出前沿模型在安全測試中的管控短板:一旦封閉環境失效,模型可能迅速將目標轉向真實系統。
對 AI 產業而言,此事再次將模型安全評估的規範問題推到台前。隨著各家 AI 公司頻繁用「奪旗」等演練展示模型的攻防能力,如何確保測試環境與真實世界嚴格隔離、如何審計第三方安全公司的配置流程,正成為模型部署前不可迴避的環節。對關注 AI 基礎設施與網路安全產業鏈的投資者來說,這類事件也可能強化企業對 AI 安全工具與隔離方案的需求預期。