MAI-Image-2.6 首次上榜即拿下文生图竞技场第二
微软 AI 新版图像模型以 1336 分空降 Arena 文生图榜第二,上一代 2.5 仅排第十,与榜首 GPT Image 2 相差 45 分。
Arena 于 8 月 10 日表示,微软 AI 最新文生图模型 MAI-Image-2.6 以 1336 分首次上榜即位列文生图排行榜第二,而上一代 MAI-Image-2.5 目前排在第十。
具体数字
与榜首的差距现为 45 分,第一名是 GPT Image 2(Medium)。Arena 称该模型在所有评分类别上都有提升,其中三维成像与建模一项进步最猛,从第六直接升到第一,卡通与插画类同样有改善。Arena 已在 Image Arena 中开放该模型的公众投票,使排名可以接受持续的人类偏好数据检验,而非停留在发布时的快照。
同一系列相邻两个版本之间跨八个位次,在这张榜的头部并不常见。微软自研图像模型 2025 年 10 月以 MAI-Image-1 上榜时排第九,2026 年 3 月的 MAI-Image-2 冲到第三,随后陷入停滞——5 月发布的 2.5 首次上榜排第三,之后随竞品迭代而下滑。第二名是该系列迄今最高排位。
背景
人类偏好榜噪声不小,风格讨喜的权重不亚于画质本身,早期 Elo 分数通常会随投票量累积而漂移。但文生图头部格局已稳定数月,由 OpenAI 的 GPT Image 2 与谷歌 Imagen 系列主导,微软、Black Forest Labs 与 Midjourney 在其下互换位置。45 分的差距已足够小,下一轮发布就可能改写顺序。
为何重要
微软的图像生成主要经 Copilot、Bing Image Creator 与 Azure API 分发,而非一个独立创作 App,因此这一水准的模型会以默认选项的身份触达异常广泛的用户,无需用户主动挑选。微软同时是 OpenAI 模型最大的商业分发渠道——用自研权重把与 GPT Image 2 的差距压到这个程度,正好加强了它在依赖关系最显眼那一环上的话语权。