Grok Imagine Image 2.0 双榜登上竞技场第二
xAI 最新图像模型首次进入 Arena 榜单,在文生图与图像编辑两个榜单同时位列第二,仅次于 OpenAI 的 GPT-Image-2。
榜单成绩
众包模型对比平台 Arena 于 UTC 时间 8 日凌晨公布了 xAI 最新图像模型的排名。以更快的 “Low” 档位参评的 Grok Imagine Image 2.0,在文生图(Text-to-Image)榜单以 1320 分首次登榜即位列第二,次于 OpenAI GPT-Image-2 的 1380 分;在图像编辑(Image Edit)榜单同样排名第二,得 1439 分,对手为 1463 分——相比上一代 Grok Imagine Image Quality 的第七名,是一次明显跃升。在文生图榜单上排在这一新模型之后的依次是:Reve AI 的 Reve 2.1(1302 分)、Meta 的 Muse-Image(1283 分)、谷歌的 Gemini 3.1 Flash Image(1263 分)、阿里的 Qwen-Image-3.0-Pro(1258 分)与字节跳动的 Seedream 5.0 Pro(1257 分)。xAI 的分数目前仍属初步结果,票数约 2700,而榜首已积累近 7 万票。
模型本体
xAI 在前一日将 Image 2.0 作为 Grok Imagine 的“质量模式”正式上线,可在 grok.com/imagine 及其 iOS、安卓应用中使用,API 尚未开放,官方称“即将推出”。xAI 的说法是,该模型能严格遵循细节指令,像设计师那样规划字体排印与版面结构,让信息密集的复合画面中的小字也保持清晰可读。
此次发布交付的不只是一个生成器,还包括一整套编辑工具:只改动用户指定区域的“魔术棒”、基于分割的精确选区、可导出透明背景的抠图、单次生成最多接受五张参考图的多参考编辑,以及用于画幅转换的 Smart Resize。模板则把修图、产品摄影、营销素材和游戏美术等工作流打包。xAI 还强调跨多次生成保持角色、场景与道具一致的能力,并把它定位为后续视频生成能力的铺垫。
为何重要
今年以来,人类偏好类图像榜单长期由 OpenAI 的图像模型领跑,Reve AI 以及来自中国的 Qwen-Image-3.0-Pro 等模型自下方紧逼。xAI 用更便宜的推理档位在生成与编辑两条赛道同时拿到第二,文生图与榜首相差约 60 分、编辑相差 24 分。但对专业用户来说问题在分发:模型目前只存在于 Grok 的消费级应用里、没有 API,与已经接入各类第三方平台的通义、字节图像视频模型不同,暂时进不了真正的生产级创作管线。这个排名能否转化为实际使用量,取决于 API 开放的速度。