8月6日,Artificial Analysis釋出最新一期智慧體能力(Agentic Index)排行榜,阿里通義千問團隊推出的Qwen3.8-Max55.4分的成績超越Claude Opus5GPT5.6,位列全球第一。這是中國模型首次在該榜單登頂,此前中國模型的最好成績是Kimi K350.1分

智慧體能力(Agentic Index)衡量的是AI模型呼叫工具、自主解決複雜問題的潛力,是AI從聊天機器人走向實際業務場景的關鍵能力。該領域長期被Claude、GPT等海外模型壟斷,此次阿里Qwen3.8-Max的登頂,標誌著中國模型在AI落地能力上取得重要突破。

Artificial Analysis是業內知名的AI模型評測機構,其榜單常被開發者與企業選型時參考。此次排名變化,或將對AI應用層的技術選型產生一定影響,也可能帶動市場對國產模型在複雜任務處理上的關注。不過,榜單分數僅代表特定評測維度下的表現,實際應用效果還需結合具體場景驗證。