xAI 於 9 月 21 日釋出 Grok 4.7,稱這是其迄今能力最強的模型,主要面向程式設計與知識工作場景。據公司介紹,該模型基於更大的基礎模型構建,採用更長的強化學習訓練,並針對自我驗證輸出做了最佳化。

定價是 Grok 4.7 最突出的賣點:每百萬輸入 token 收費 2 美元,每百萬輸出 token 收費 6 美元。這一價位更接近中國模型,而非西方前沿模型,低價背後可能反映了其效能定位。

在獨立評測機構 Artificial Analysis 的智慧指數(v4.3.2)上,Grok 4.7 綜合十項基準測試僅得 46 分,處於中游水平。相比之下,Claude Fable 5.1GPT-6 各以 53 分領先。評測還顯示,Grok 4.7 兩個最高推理檔位的表現大致相同。

差距在智慧體程式設計任務上進一步拉大。在 Terminal-Bench 4.0 測試中,Grok 4.7 僅取得 26% 的成績,而 GPT-6 Astra 達到 60%Claude Fable 5.155%。即便是價格更低的 DeepSeek V4.1 Flash,也以 27% 略微超過 Grok 4.7。

目前 Grok 4.7 可通過 Grok API、Cursor 以及 Grok Build 使用。

從產業視角看,xAI 此次延續了以低價換取開發者採用的策略。在模型層競爭日趨激烈的背景下,前沿能力與推理成本之間的取捨成為關鍵變數。Grok 4.7 的定價使其對成本敏感的開發者和企業具有吸引力,但基準測試顯示其在複雜程式設計與智慧體任務上仍落後於頭部模型。對於關注 AI 產業鏈的投資者而言,這既反映了 xAI 在模型能力上的追趕壓力,也提示低價策略能否轉化為實際使用量,仍需觀察其在開發者生態中的落地情況。