xAI 于 8 月 8 日发布 Imagine Image 2.0,作为 Grok 的新图像生成器,在 Arena 基准测试中排名第二,仅次于 OpenAI 的 GPT-Image-2。该模型已在 grok.com/imagine 以及 Grok 的 iOS 和 Android 应用中上线,API 访问即将推出。
据 xAI 介绍,Imagine 2.0 旨在以精细的准确性遵循指令,在复杂视觉中保持排版和布局清晰,并在多次生成中保持一致。在截至 2026 年 8 月 7 日的 Arena 排行榜中,该模型的快速“低”变体在全球两个类别中均排名第二。它在 Image Edit Arena 中取得 1439 的 Elo 评分,落后于 OpenAI 的 GPT-Image-2(1463 分);在 Text-to-Image Arena 中得分 1320,同样落后于 GPT-Image-2(1380 分)。xAI 的 Reve 2.1、Meta 的 Muse-Image、阿里巴巴的 Qwen-Image-3.0-Pro、谷歌的 Gemini 以及字节跳动的 SeedDream 均排在更后位置。新模型在测试中也大幅超越了其前代的“Quality”变体。
Imagine Image 2.0 配备多项编辑功能。其中“Magic Wand”工具仅修改图像的选定区域,分割功能允许用户选择精确区域,背景移除工具可导出透明背景的主体。Multi-Ref Editing 允许用户将最多五张输入图像合并到一次生成中。“Smart Resize”可将现有图像转换为任意宽高比,模型会自动填充额外空间。
xAI 还添加了模板,将常见图像工作流捆绑为预配置起点,类别涵盖照片编辑、产品摄影、营销材料、设计工具、游戏资产和流媒体表情符号。此外,xAI 展示了一项功能,可分别生成角色、地点和道具,同时保持所有图像的视觉风格一致。该公司将其定位为迈向完整视频制作工作流的垫脚石。
此次发布表明 xAI 在图像生成领域正与 OpenAI 展开直接竞争,其 Arena 排名紧随 GPT-Image-2,显示其模型能力已接近行业领先水平。编辑工具和模板的加入,瞄准了实际创意工作流,可能吸引专业用户。对于 AI 产业投资者而言,xAI 的快速迭代可能加剧多模态模型市场的竞争,影响相关芯片、基础设施和模型层的投资格局。