⚡ 猫叔的AI资讯雷达
AIGC模型

Grok Imagine Image 2.0 双榜空降第二,随后在文生图榜退居第三

SpaceXAI 最新图像模型首次上榜即在文生图与图像编辑两个榜单位列第二;至 8 月 11 日,它在文生图榜已被微软 MAI-Image-2.6 挤到第三,图像编辑榜仍保持第二。

榜单成绩

众包模型对比平台 Arena 于 UTC 时间 8 日凌晨公布了 SpaceXAI(原 xAI,今年 7 月并入 SpaceX 后完成更名)最新图像模型的排名。以更快的 “Low” 档位参评的 Grok Imagine Image 2.0,在文生图(Text-to-Image)榜单以 1320 分首次登榜即位列第二,次于 OpenAI GPT-Image-2 的 1380 分;在图像编辑(Image Edit)榜单同样排名第二,得 1439 分,对手为 1463 分——相比上一代 Grok Imagine Image Quality 在该榜单的第七名,是一次明显跃升,而后者在文生图榜单上位列第 14。

其中一个名次已经发生变化。截至 8 月 11 日,该模型在文生图榜以 1316 分排在第三,被微软 AI 于 10 日上榜的 MAI-Image-2.6 预览版(1336 分)挤下;榜首仍是 GPT-Image-2,1381 分。排在这一 SpaceXAI 模型之后的依次是:Reve AI 的 Reve 2.1(1302 分)、Meta 的 Muse-Image(1282 分)、Reve AI 上一代的 Reve 2.0(1270 分)、谷歌的 Gemini 3.1 Flash Image(1264 分)、字节跳动的 Seedream 5.0 Pro(1258 分)与阿里的 Qwen-Image-3.0-Pro(1257 分)。图像编辑榜上它仍保持第二,1439 分对 1463 分。两项分数都还属初步结果:文生图票数约 2700,榜首已积累约 7 万票;图像编辑票数约 5900,榜首约 18.4 万票。随着投票累积,名次仍在变动。

模型本体

SpaceXAI 于 8 月 7 日将 Image 2.0 作为 Grok Imagine 的“质量模式”正式上线,可在 grok.com/imagine 及其 iOS、安卓应用中使用。官方 API 尚未开放,公司称“即将推出”,但未给出时间、模型 ID 或价格。目前开发者只能通过第三方接入:该模型的预览版已上线 Vercel 的 AI Gateway。官方的说法是,该模型能严格遵循细节指令,像设计师那样规划字体排印与版面结构,让信息密集的复合画面中的小字也保持清晰可读。

此次发布交付的不只是一个生成器,还包括一整套编辑工具:只改动用户指定区域的“魔术棒”、基于分割的精确选区、可导出透明背景的抠图、单次生成最多接受五张参考图的多参考编辑,以及用于画幅转换的 Smart Resize。模板则把修图、产品摄影、营销素材和游戏美术等工作流打包。官方还强调跨多次生成保持角色、场景与道具一致的能力,并把它定位为后续视频生成能力的铺垫。

为何重要

今年以来,人类偏好类图像榜单长期由 OpenAI 的图像模型领跑,Reve AI、微软以及来自中国的 Qwen-Image-3.0-Pro 等模型自下方紧逼。SpaceXAI 上线时用更便宜的推理档位在两张榜单同时拿到第二,但三天之内文生图的顺序就再次改写:它与榜首相差约 65 分,并落到微软最新预览版之后,编辑榜上 24 分的差距则依旧。对专业用户来说问题在分发:没有官方 API,开发者接入仅限 Vercel 网关上的预览版,模型主要还是活在 Grok 的消费级应用里;与已经广泛接入第三方平台的通义、字节图像视频模型不同,它才刚开始触及真正的生产级创作管线。这个排名能否转化为实际使用量,取决于 API 开放的速度。

信源