智谱AI(Z.ai)的GLM-5.3模型在Artificial Analysis智能指数中取得60分,与Kimi K3并列开源模型榜首,并领先前代GLM-5.2七分。这一成绩使GLM-5.3在开源模型阵营中处于领先地位,并接近西方前沿模型的水平。
据Artificial Analysis的评测,GLM-5.3的最大进步体现在智能体(agentic)任务上。在GDPval-AA v2基准测试中,其Elo评分从1,524跃升至1,770,提升246点,排名第二,仅次于Claude Opus 5(1,855分)。这表明该模型在复杂任务执行和工具调用等能力上有了显著增强。
在成本方面,GLM-5.3的定价为每任务0.68美元,是前代GLM-5.2(0.44美元)的1.5倍,但比Kimi K3(0.84美元)便宜19%。这一价格策略使GLM-5.3在提供高性能的同时,仍保持对竞争对手的成本优势。
GLM-5.3已通过Z.ai的API提供访问。然而,Z.ai将开源权重的发布推迟了约两周。公司表示,由于GLM-5.3在检测安全漏洞方面表现出色,因此需要先加强安全控制,并限制对特定安全合作伙伴的完全访问。这一举措反映了AI模型在安全性与开放性之间的权衡。
GLM-5.3的发布是智谱AI在开源模型领域的重要进展。此前,GLM系列模型已在中文和英文任务上表现出色,而此次在智能体任务上的突破,进一步巩固了其在开源模型中的竞争力。对于AI开发者而言,GLM-5.3的API访问和即将开放的开源权重,提供了更多选择,尤其是在成本和性能的平衡上。
从产业角度看,GLM-5.3的登顶意味着开源模型与闭源模型之间的性能差距正在缩小。尽管Claude Opus 5在智能体任务上仍领先,但GLM-5.3的追赶速度表明,开源社区正在快速进步。此外,其价格优势可能对闭源模型的定价策略构成压力,推动整个AI模型市场的成本下降。
不过,开源权重的延迟发布也引发了一些关注。安全考量固然重要,但社区对开源模型的期待往往在于透明性和可定制性。智谱AI在安全与开放之间的平衡策略,可能会影响开发者对其生态的采用意愿。
总体而言,GLM-5.3的评测表现和定价策略,使其成为开源AI模型领域的有力竞争者。随着开源权重的即将发布,其实际应用效果和社区反馈将值得进一步观察。