xAI 于 9 月 21 日发布 Grok 4.7,称这是其迄今能力最强的模型,主要面向编程与知识工作场景。据公司介绍,该模型基于更大的基础模型构建,采用更长的强化学习训练,并针对自我验证输出做了优化。

定价是 Grok 4.7 最突出的卖点:每百万输入 token 收费 2 美元,每百万输出 token 收费 6 美元。这一价位更接近中国模型,而非西方前沿模型,低价背后可能反映了其性能定位。

在独立评测机构 Artificial Analysis 的智能指数(v4.3.2)上,Grok 4.7 综合十项基准测试仅得 46 分,处于中游水平。相比之下,Claude Fable 5.1GPT-6 各以 53 分领先。评测还显示,Grok 4.7 两个最高推理档位的表现大致相同。

差距在智能体编程任务上进一步拉大。在 Terminal-Bench 4.0 测试中,Grok 4.7 仅取得 26% 的成绩,而 GPT-6 Astra 达到 60%Claude Fable 5.155%。即便是价格更低的 DeepSeek V4.1 Flash,也以 27% 略微超过 Grok 4.7。

目前 Grok 4.7 可通过 Grok API、Cursor 以及 Grok Build 使用。

从产业视角看,xAI 此次延续了以低价换取开发者采用的策略。在模型层竞争日趋激烈的背景下,前沿能力与推理成本之间的取舍成为关键变量。Grok 4.7 的定价使其对成本敏感的开发者和企业具有吸引力,但基准测试显示其在复杂编程与智能体任务上仍落后于头部模型。对于关注 AI 产业链的投资者而言,这既反映了 xAI 在模型能力上的追赶压力,也提示低价策略能否转化为实际使用量,仍需观察其在开发者生态中的落地情况。