中国AI公司智谱(Zhipu)上周发布新模型GLM-5.3,声称其漏洞发现能力可与美国顶尖模型相媲美。根据公司公告,GLM-5.3在CyberGym基准测试中击败了Anthropic的Fable 5和OpenAI的GPT-5.6 Sol,该基准用于评估模型解决真实世界网络安全挑战的能力。

智谱在公告中表示:“随着我们扩大后训练规模,网络能力的发展速度超出预期。GLM-5.3在漏洞发现方面达到了CyberGym的最先进水平,其提升在利用链的更高阶段最为显著。”公司补充称,该模型“不仅仅是更好地识别孤立缺陷:它开始跨多个利用阶段进行推理,形成完整利用链的连贯计划。”

智谱称,已与中国公司合作在真实代码库上测试该模型,在269个项目中发现了2436个漏洞,其中包括1097个中高危问题。这些发现涉及系统内核、操作系统、浏览器引擎、开源基础设施、Web应用和网络协议。公告称:“许多漏洞多年来甚至几十年来一直未被注意,最古老的漏洞可追溯至约40年前。”

然而,GLM-5.3在其他安全和编码基准上表现逊于西方模型。尽管如此,该模型具备高度漏洞发现能力,表明中国在渗透对手软件方面并不落后,且这一能力在Anthropic的Mythos模型首次亮相后迅速得到发展。美国曾因拥有Anthropic而享有的优势因此消散。

这一进展对AI安全领域具有深远影响。漏洞发现是网络安全的关键环节,AI模型在此领域的进步可能改变攻防双方的力量平衡。智谱的快速追赶表明,中国AI公司在特定技术能力上正加速缩小与美国领先者的差距,这可能影响全球AI竞争格局。

对于投资者而言,这一事件凸显了中国AI公司在安全领域的潜力,可能对相关产业链公司产生影响,包括网络安全服务商、AI基础设施提供商以及依赖AI安全能力的下游企业。然而,模型在漏洞发现上的优势是否转化为商业成功,仍需观察。