8月6日,Artificial Analysis发布最新一期智能体能力(Agentic Index)排行榜,阿里通义千问团队推出的Qwen3.8-Max以55.4分的成绩超越Claude Opus5和GPT5.6,位列全球第一。这是中国模型首次在该榜单登顶,此前中国模型的最好成绩是Kimi K3的50.1分。
智能体能力(Agentic Index)衡量的是AI模型调用工具、自主解决复杂问题的潜力,是AI从聊天机器人走向实际业务场景的关键能力。该领域长期被Claude、GPT等海外模型垄断,此次阿里Qwen3.8-Max的登顶,标志着中国模型在AI落地能力上取得重要突破。
Artificial Analysis是业内知名的AI模型评测机构,其榜单常被开发者与企业选型时参考。此次排名变化,或将对AI应用层的技术选型产生一定影响,也可能带动市场对国产模型在复杂任务处理上的关注。不过,榜单分数仅代表特定评测维度下的表现,实际应用效果还需结合具体场景验证。