美國諮詢與科技公司Booz Allen在首份“網路武器指數”(Cyber Weapon Index)報告中揭示,在18款中美前沿AI模型的自主網路攻擊能力測試中,僅Anthropic的Claude Mythos在無人工干預下完整執行了端到端的網路殺傷鏈。該報告基於對模型自主識別漏洞、開發攻擊能力並執行攻擊的評估,為每款模型打分,Claude Mythos以80分高居榜首,遠超第二名xAI的Grok-4.5(49分)。

測試中,當向Claude Mythos提供竊取來的員工憑據時,它在每次嘗試中都成功入侵目標網路並獲得管理員級控制權,且能根據網路內發現的資訊自主識別提權路徑,而非遵循預設攻擊計劃。即便在沒有憑據的情況下,該模型仍能進入網路並最終實現完全域控制。Booz Allen指出,除Claude Mythos外,還有三款模型(Grok-4.5、Meta的Muse Spark 1.1、Z.ai的GLM-5.2)達到了完全域訪問與控制,但未能完成整個殺傷鏈。另有四款模型(OpenAI的GPT-5.6 Sol、月之暗面的Kimi K3、GPT-5.5-Cyber、DeepSeek-V4-Pro)實現了網路內的橫向移動。

值得注意的是,該測試未包含OpenAI即將釋出的Astra模型。OpenAI週二表示,Astra已達到其“關鍵”網路安全能力閾值,意味著該模型在發現和利用零日漏洞方面表現出色,可能對關鍵系統構成重大風險,甚至模型本身在“錯位”時也能執行有害網路行動。Booz Allen預測,其測試的其餘17款美國和中國模型中,大多數將在六個月內達到與Claude Mythos同等的武器化水平,並稱來自勒索軟體團伙等經濟動機罪犯和政府支援團體的主流AI攻擊已“迫在眉睫”。

報告還揭示了一個關鍵發現:當測試者故意引入漏洞時,美國、中國、開放權重和封閉模型在漏洞研究得分(VRS)上均接近滿分;但當面對真實漏洞時,所有九款前沿API模型得分均為零。一款未具名的領先模型甚至正確分析了易受攻擊的元件,卻將其誤判為安全,只有Claude Mythos成功利用了該漏洞。Booz Allen認為,這種能力集中構成了國家安全當務之急,需保護最先進的模型,防止其最高風險的網路能力被對手利用。

此外,報告強調攻擊工具包(attack harness)的重要性不亞於模型本身。該軟體將模型與駭客工具連線,並編排自動化攻擊邏輯,能顯著增強模型保持專注、適應變化、從失敗中恢復以及將單個動作串聯成多階段攻擊的能力。測試顯示,當Claude Sonnet與攻擊工具包配合時,其表現可與Claude Mythos媲美。Booz Allen呼籲美國為關鍵基礎設施設定並執行行業特定截止日期,以展示抵禦AI攻擊的韌性,並發展“超配”(overmatch)能力,同時加速授權進攻性網路行動和構建AI防禦體系。