MAI-Image-2.6 的主视觉标题卡片,这是微软在 Arena 上排名第二的文生图模型,显示 Arena 评分 1,336、排名第 2,以及相较 MAI-Image-2.5 的 +79 Elo 提升。
Guides & Insights

MAI-Image-2.6:微软新晋排名第二的图像模型在API上线前于Arena首次亮相

作者

Jim Song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Microsoft的MAI-Image-2.6刚刚成为Arena排行榜上评分第二高的文生图模型——尽管仍没有公开API。该模型于2026年8月10日发布,以1,336分的Arena分数排名第二,仅次于GPT Image 2 Medium(1,381分),领先于Grok Imagine Image 2.0(1,316分)、Meta的Muse Image和Nano Banana Pro。它的前身,MAI-Image-2.5,排名第十。

引人注目的地方在于背景,而不仅仅是排名。排在第二位的条目名称就叫“mai-image-2.6-preview”,在该快照中获得了约 3,500 票。它一口气上升了八个名次,相比 MAI-Image-2.5 提升了 +79 Elo;微软承诺“很快”提供 API 和 Foundry 访问权限,早期报道指向下周。因此,这成为迄今最有力的独立信号,表明微软自研图像项目已经缩小了与 OpenAI 的差距——而你们大多数人仍然无法通过 API 调用它。

关键数字

Arena 文生图排名: 第 2 名 — 得分 1,336±11,初步,约 3,488 票

与第 1 名(GPT Image 2 Medium)的差距: 45 Elo

领先于第3名(Grok Imagine Image 2.0): 20 Elo

超越 MAI-Image-2.5:整体 +79 Elo,文本渲染 +91 Elo

前代模型的位置: MAI-Image-2.5 排名第10(1,256)

可用性: Arena 现已可用;MAI Playground 本周晚些时候推出;APIs/Foundry 预计下周推出

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

MAI-Image-2.6 是什么

MAI-Image-2.6 是微软内部图像生成系列中的最新模型,由穆斯塔法·苏莱曼领导的 Microsoft AI 团队打造。该系列发展迅速:MAI-Image-1 是基础,MAI-Image-2(2026年3月)实现了照片级真实感和文字渲染的飞跃,MAI-Image-2.5(2026年6月)新增专业级输出和编辑功能,并成为 Bing 图像创建器、PowerPoint 和 OneDrive 的内置引擎,MAI-Image-2.5-Pro(2026年7月)增加了 8K 高级档位——而 2.6 现在在其前代发布约六周后正式登场。

节奏与模型本身同样重要。微软以六到八周的周期发布图像改进,这更接近前沿实验室发布文本模型的节奏,而非图像市场历来移动的方式。一旦这种节奏产生复利效应,就表现为在 Arena 榜单上第二名的首秀。

Arena的结果,请仔细阅读

Arena(即更名后的LMArena)通过盲测人类偏好来对图像模型排名:投票者会看到由同一提示词生成的两张图像,并选出更胜一筹的那张。这使其成为衡量人们真实偏好的独立标准,而非厂商自办的基准测试——这正是第二名首次亮相便颇具分量的原因。也正因如此,这个数字需要谨慎解读:1,336分的成绩仅是初步结果,基于约3,500票得出,而排名第一的模型获得了超过70,000票;此外,该条目标注为"preview"。早期投票阶段的Elo分数会继续变动;应将趋势方向视为可靠,而将具体分数视为临时性数据。

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

提升集中在哪些领域,比总数字更有看点。Arena 将 MAI-Image-2.6 评为 {{1}}3D 成像与建模第一(从第六名上升){{/1}}、{{2}}卡通/动漫/奇幻第二(从第八名上升){{/2}}、{{3}}产品、品牌与商业设计(从第七名上升){{/3}}、{{4}}文字渲染(从第八名上升,Elo 提升 +91){{/4}}以及 {{5}}艺术(从第四名上升){{/5}}。微软表示,它在每一个评测类别中都有所提升。这种覆盖范围——{{6}}商业设计、3D、文字和艺术{{/6}}——是通用图像模型的标志,而非单一领域的专长。

实际上有什么新内容(供应商报告的)

在能力方面,微软自己对MAI-Image-2.6的描述是:

• 更强的文本渲染、人像和 3D 图像

• 在商品、品牌和影视用例中,实现更精致、更商业化和更照片级逼真的输出

• 在单次生成中处理多个参考图像

• 更丰富的依据 — 更好地遵循提示中的具体细节

• 对推理、格式和分辨率拥有更强的控制

这些全都是供应商报告的结果,尚未被独立复现。目前唯一的独立证据是 Arena 排名的跃升——这确实是独立数据,但仍属初步结果。在 API 开放、第三方能够运行受控评估之前,应将能力列表视为微软的单方面声称,而将排行榜视为实际参考信号。

当你真正能使用它时

该模型今天已上线可供测试,但仅限通过 Arena。微软表示,MAI Playground 将于本周晚些时候获得该模型,API 访问权限以及 Microsoft Foundry 则“即将推出”——早期报道指向下周。值得关注的实际信号是:当 MAI-Image-2.5 成为 Bing 图像创建器中的默认选项,并推广到 PowerPoint 和 OneDrive 时,意味着微软认为它已具备生产环境安全性。类似的 2.6 版本推广到这些应用表面,将是预览标签被移除的信号。

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

可能需要多少费用

2.6 的价格尚未公布。锚点是该系列的其他产品,全部由供应商报告:

• MAI-Image-2.5:每百万文本输入 tokens 5 美元,图像输入 8 美元,图像输出 47 美元

• MAI-Image-2.5-Flash:$1.75 / $1.75 / $19.50 — 高用量档位

• MAI-Image-2.5-Pro(2026年7月):$5 / $8 / $106 — 8K输出,96.8%文本渲染准确率

这是微软已售图像输出费率中最便宜与最贵之间五倍的差距,因此2.6的生产成本将取决于它被归入哪个档位。按照2.5每百万输出令牌47美元的费率,一张消耗约一千个输出令牌的图像成本接近五美分——但微软并未公布每张图像的令牌消耗量,所以请将其视为算术估算,而非官方报价。

定价也是路由层在API开放后证明自身价值的地方。在OrcaRouter上,微软收取的任何费用均以0%加价直接转传——即供应商标价,分文不加——因此发布折扣或后续降价会在公布当天就体现在你的账单上。无需重新谈判,也无需第二份合同;该模型会与其他所有内容一样出现在同一个密钥上。

这让图像模型竞赛何去何从

Arena 文生图排行榜目前的榜首:GPT Image 2 (Medium) 以 1,381 分居首,MAI-Image-2.6 1,336 分,Grok Imagine Image 2.0 1,316 分,Reve 2.1 1,302 分,Meta 的 Muse Image 1,282 分。前五名模型的 Elo 分差仅在 100 左右。过去将领先者与其他模型拉开差距的质量鸿沟,如今已缩小到“最佳图像模型”不再是一个有意义的问题——真正的问题是编辑、接地性、速度和价格。

微软的赌注远比任何单一榜单的桂冠更为宏大:一套自研模型栈,涵盖图像、语音、代码与推理,并通过Copilot、Bing和Office分发。Arena排名是功绩证明;分发才是真正的产品。

如何在不赌上生产环境的情况下试用它

Arena 预览是免费的——如果你想要原始信号,今天就对它进行生成测试。一旦 API 开放,采用一个带有“初步”评分的新模型的明智做法是将一部分流量路由到它,并保留你经过验证的模型作为后备。这正是路由层为之而生的故障模式:在 OrcaRouter 上,一旦 MAI-Image-2.6 在上游提供商处托管,你就可以将一个端点指向它,并让自动故障转移捕捉 3000 票排行榜评级无法看到的边缘情况。一个 API 密钥,200+ 个模型,提供商价格直通。

接下来看什么

• MAI-Image-2.6 是否会出现在图像编辑排行榜上 — MAI-Image-2.5 已经是一个强大的编辑器,而 2.6 的编辑评分尚未公布

• API 价格及其所属的层级

• Bing Image Creator 和 Copilot 是否会将默认值从 2.5 改为 2.6

• API开放后的独立基准测试

• "预览"标签是否会被移除——这是微软自信到足以将其推向市场的信号

常见问题

MAI-Image-2.6 何时可以通过 API 使用?

还没有。它目前以预览版形式出现在 Arena 上;微软表示 API 和 Foundry 的访问权限“即将推出”,早期报道指向下周。尚未公布确定的日期或价格。

它与GPT Image 2 Medium有多接近?

在当前 Arena 快照上相差 45 Elo——这已经足够接近,第 2 名与第 1 名之间的差距处于投票流能够影响的范围之内,而且前五名模型的差距都在大约 100 Elo 以内。

竞技场排名第二可靠吗?

这是一项独立的、盲测的人类偏好结果,而这正是它的意义所在——但它仅是初步结果(约 3,500 票),且依附于预览版本。相信方向,而非具体数字。

总而言之:MAI-Image-2.6 是第一个真正跻身前沿讨论行列的微软图像模型,而且它比 API 更早问世。如果定价能落在接近 Flash 层级的区间,它将成为今年图像生成领域最具看点的性价比之选之一。API 的开放越早越好——而一旦开放,价格和编辑得分将告诉你,No. 2 究竟是初次登场,还是已到平台期。

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube