智譜AI(Z.ai)的GLM-5.3模型在Artificial Analysis智慧指數中取得60分,與Kimi K3並列開源模型榜首,並領先前代GLM-5.2七分。這一成績使GLM-5.3在開源模型陣營中處於領先地位,並接近西方前沿模型的水平。

據Artificial Analysis的評測,GLM-5.3的最大進步體現在智慧體(agentic)任務上。在GDPval-AA v2基準測試中,其Elo評分從1,524躍升至1,770,提升246點,排名第二,僅次於Claude Opus 5(1,855分)。這表明該模型在複雜任務執行和工具呼叫等能力上有了顯著增強。

在成本方面,GLM-5.3的定價為每任務0.68美元,是前代GLM-5.2(0.44美元)的1.5倍,但比Kimi K3(0.84美元)便宜19%。這一價格策略使GLM-5.3在提供高效能的同時,仍保持對競爭對手的成本優勢。

GLM-5.3已通過Z.ai的API提供訪問。然而,Z.ai將開源權重的釋出推遲了約兩週。公司表示,由於GLM-5.3在檢測安全漏洞方面表現出色,因此需要先加強安全控制,並限制對特定安全合作伙伴的完全訪問。這一舉措反映了AI模型在安全性與開放性之間的權衡。

GLM-5.3的釋出是智譜AI在開源模型領域的重要進展。此前,GLM系列模型已在中文和英文任務上表現出色,而此次在智慧體任務上的突破,進一步鞏固了其在開源模型中的競爭力。對於AI開發者而言,GLM-5.3的API訪問和即將開放的開源權重,提供了更多選擇,尤其是在成本和效能的平衡上。

從產業角度看,GLM-5.3的登頂意味著開源模型與閉源模型之間的效能差距正在縮小。儘管Claude Opus 5在智慧體任務上仍領先,但GLM-5.3的追趕速度表明,開源社群正在快速進步。此外,其價格優勢可能對閉源模型的定價策略構成壓力,推動整個AI模型市場的成本下降。

不過,開源權重的延遲釋出也引發了一些關注。安全考量固然重要,但社群對開源模型的期待往往在於透明性和可定製性。智譜AI在安全與開放之間的平衡策略,可能會影響開發者對其生態的採用意願。

總體而言,GLM-5.3的評測表現和定價策略,使其成為開源AI模型領域的有力競爭者。隨著開源權重的即將釋出,其實際應用效果和社群反饋將值得進一步觀察。