xAI 於 8 月 8 日釋出 Imagine Image 2.0,作為 Grok 的新影像生成器,在 Arena 基準測試中排名第二,僅次於 OpenAI 的 GPT-Image-2。該模型已在 grok.com/imagine 以及 Grok 的 iOS 和 Android 應用中上線,API 訪問即將推出。
據 xAI 介紹,Imagine 2.0 旨在以精細的準確性遵循指令,在複雜視覺中保持排版和佈局清晰,並在多次生成中保持一致。在截至 2026 年 8 月 7 日的 Arena 排行榜中,該模型的快速“低”變體在全球兩個類別中均排名第二。它在 Image Edit Arena 中取得 1439 的 Elo 評分,落後於 OpenAI 的 GPT-Image-2(1463 分);在 Text-to-Image Arena 中得分 1320,同樣落後於 GPT-Image-2(1380 分)。xAI 的 Reve 2.1、Meta 的 Muse-Image、阿里巴巴的 Qwen-Image-3.0-Pro、谷歌的 Gemini 以及字節跳動的 SeedDream 均排在更後位置。新模型在測試中也大幅超越了其前代的“Quality”變體。
Imagine Image 2.0 配備多項編輯功能。其中“Magic Wand”工具僅修改影像的選定區域,分割功能允許使用者選擇精確區域,背景移除工具可匯出透明背景的主體。Multi-Ref Editing 允許使用者將最多五張輸入影像合併到一次生成中。“Smart Resize”可將現有影像轉換為任意寬高比,模型會自動填充額外空間。
xAI 還添加了模板,將常見影像工作流捆綁為預配置起點,類別涵蓋照片編輯、產品攝影、營銷材料、設計工具、遊戲資產和流媒體表情符號。此外,xAI 展示了一項功能,可分別生成角色、地點和道具,同時保持所有影像的視覺風格一致。該公司將其定位為邁向完整影片製作工作流的墊腳石。
此次釋出表明 xAI 在影像生成領域正與 OpenAI 展開直接競爭,其 Arena 排名緊隨 GPT-Image-2,顯示其模型能力已接近行業領先水平。編輯工具和模板的加入,瞄準了實際創意工作流,可能吸引專業使用者。對於 AI 產業投資者而言,xAI 的快速迭代可能加劇多模態模型市場的競爭,影響相關晶片、基礎設施和模型層的投資格局。