中國AI公司智譜(Zhipu)上週釋出新模型GLM-5.3,聲稱其漏洞發現能力可與美國頂尖模型相媲美。根據公司公告,GLM-5.3在CyberGym基準測試中擊敗了Anthropic的Fable 5和OpenAI的GPT-5.6 Sol,該基準用於評估模型解決真實世界網路安全挑戰的能力。

智譜在公告中表示:“隨著我們擴大後訓練規模,網路能力的發展速度超出預期。GLM-5.3在漏洞發現方面達到了CyberGym的最先進水平,其提升在利用鏈的更高階段最為顯著。”公司補充稱,該模型“不僅僅是更好地識別孤立缺陷:它開始跨多個利用階段進行推理,形成完整利用鏈的連貫計劃。”

智譜稱,已與中國公司合作在真實程式碼庫上測試該模型,在269個專案中發現了2436個漏洞,其中包括1097箇中高危問題。這些發現涉及系統核心、作業系統、瀏覽器引擎、開源基礎設施、Web應用和網路協議。公告稱:“許多漏洞多年來甚至幾十年來一直未被注意,最古老的漏洞可追溯至約40年前。”

然而,GLM-5.3在其他安全和編碼基準上表現遜於西方模型。儘管如此,該模型具備高度漏洞發現能力,表明中國在滲透對手軟體方面並不落後,且這一能力在Anthropic的Mythos模型首次亮相後迅速得到發展。美國曾因擁有Anthropic而享有的優勢因此消散。

這一進展對AI安全領域具有深遠影響。漏洞發現是網路安全的關鍵環節,AI模型在此領域的進步可能改變攻防雙方的力量平衡。智譜的快速追趕表明,中國AI公司在特定技術能力上正加速縮小與美國領先者的差距,這可能影響全球AI競爭格局。

對於投資者而言,這一事件凸顯了中國AI公司在安全領域的潛力,可能對相關產業鏈公司產生影響,包括網路安全服務商、AI基礎設施提供商以及依賴AI安全能力的下游企業。然而,模型在漏洞發現上的優勢是否轉化為商業成功,仍需觀察。