
MAI-Image-2.6:微软新晋排名第二的图像模型在API上线前于Arena首次亮相
- meta新Meta: Muse Spark 1.22026-08-0557智能72代码
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
- grokxAI: Grok 4.52026-07-0856智能72代码
- tencentTencent: Hy32026-07-0642智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72代码
- klingKling: Kling 3.0 Turbo2026-06-1757智能52代码57数学
Microsoft的MAI-Image-2.6刚刚成为Arena排行榜上评分第二高的文生图模型——尽管仍没有公开API。该模型于2026年8月10日发布,以1,336分的Arena分数排名第二,仅次于GPT Image 2 Medium(1,381分),领先于Grok Imagine Image 2.0(1,316分)、Meta的Muse Image和Nano Banana Pro。它的前身,MAI-Image-2.5,排名第十。
引人注目的地方在于背景,而不仅仅是排名。排在第二位的条目名称就叫“mai-image-2.6-preview”,在该快照中获得了约 3,500 票。它一口气上升了八个名次,相比 MAI-Image-2.5 提升了 +79 Elo;微软承诺“很快”提供 API 和 Foundry 访问权限,早期报道指向下周。因此,这成为迄今最有力的独立信号,表明微软自研图像项目已经缩小了与 OpenAI 的差距——而你们大多数人仍然无法通过 API 调用它。
关键数字
• Arena 文生图排名: 第 2 名 — 得分 1,336±11,初步,约 3,488 票
• 与第 1 名(GPT Image 2 Medium)的差距: 45 Elo
• 领先于第3名(Grok Imagine Image 2.0): 20 Elo
• 超越 MAI-Image-2.5:整体 +79 Elo,文本渲染 +91 Elo
• 前代模型的位置: MAI-Image-2.5 排名第10(1,256)
• 可用性: Arena 现已可用;MAI Playground 本周晚些时候推出;APIs/Foundry 预计下周推出

MAI-Image-2.6 是什么
MAI-Image-2.6 是微软内部图像生成系列中的最新模型,由穆斯塔法·苏莱曼领导的 Microsoft AI 团队打造。该系列发展迅速:MAI-Image-1 是基础,MAI-Image-2(2026年3月)实现了照片级真实感和文字渲染的飞跃,MAI-Image-2.5(2026年6月)新增专业级输出和编辑功能,并成为 Bing 图像创建器、PowerPoint 和 OneDrive 的内置引擎,MAI-Image-2.5-Pro(2026年7月)增加了 8K 高级档位——而 2.6 现在在其前代发布约六周后正式登场。
节奏与模型本身同样重要。微软以六到八周的周期发布图像改进,这更接近前沿实验室发布文本模型的节奏,而非图像市场历来移动的方式。一旦这种节奏产生复利效应,就表现为在 Arena 榜单上第二名的首秀。
Arena的结果,请仔细阅读
Arena(即更名后的LMArena)通过盲测人类偏好来对图像模型排名:投票者会看到由同一提示词生成的两张图像,并选出更胜一筹的那张。这使其成为衡量人们真实偏好的独立标准,而非厂商自办的基准测试——这正是第二名首次亮相便颇具分量的原因。也正因如此,这个数字需要谨慎解读:1,336分的成绩仅是初步结果,基于约3,500票得出,而排名第一的模型获得了超过70,000票;此外,该条目标注为"preview"。早期投票阶段的Elo分数会继续变动;应将趋势方向视为可靠,而将具体分数视为临时性数据。

提升集中在哪些领域,比总数字更有看点。Arena 将 MAI-Image-2.6 评为 {{1}}3D 成像与建模第一(从第六名上升){{/1}}、{{2}}卡通/动漫/奇幻第二(从第八名上升){{/2}}、{{3}}产品、品牌与商业设计(从第七名上升){{/3}}、{{4}}文字渲染(从第八名上升,Elo 提升 +91){{/4}}以及 {{5}}艺术(从第四名上升){{/5}}。微软表示,它在每一个评测类别中都有所提升。这种覆盖范围——{{6}}商业设计、3D、文字和艺术{{/6}}——是通用图像模型的标志,而非单一领域的专长。
实际上有什么新内容(供应商报告的)
在能力方面,微软自己对MAI-Image-2.6的描述是:
• 更强的文本渲染、人像和 3D 图像
• 在商品、品牌和影视用例中,实现更精致、更商业化和更照片级逼真的输出
• 在单次生成中处理多个参考图像
• 更丰富的依据 — 更好地遵循提示中的具体细节
• 对推理、格式和分辨率拥有更强的控制
这些全都是供应商报告的结果,尚未被独立复现。目前唯一的独立证据是 Arena 排名的跃升——这确实是独立数据,但仍属初步结果。在 API 开放、第三方能够运行受控评估之前,应将能力列表视为微软的单方面声称,而将排行榜视为实际参考信号。
当你真正能使用它时
该模型今天已上线可供测试,但仅限通过 Arena。微软表示,MAI Playground 将于本周晚些时候获得该模型,API 访问权限以及 Microsoft Foundry 则“即将推出”——早期报道指向下周。值得关注的实际信号是:当 MAI-Image-2.5 成为 Bing 图像创建器中的默认选项,并推广到 PowerPoint 和 OneDrive 时,意味着微软认为它已具备生产环境安全性。类似的 2.6 版本推广到这些应用表面,将是预览标签被移除的信号。

可能需要多少费用
2.6 的价格尚未公布。锚点是该系列的其他产品,全部由供应商报告:
• MAI-Image-2.5:每百万文本输入 tokens 5 美元,图像输入 8 美元,图像输出 47 美元
• MAI-Image-2.5-Flash:$1.75 / $1.75 / $19.50 — 高用量档位
• MAI-Image-2.5-Pro(2026年7月):$5 / $8 / $106 — 8K输出,96.8%文本渲染准确率
这是微软已售图像输出费率中最便宜与最贵之间五倍的差距,因此2.6的生产成本将取决于它被归入哪个档位。按照2.5每百万输出令牌47美元的费率,一张消耗约一千个输出令牌的图像成本接近五美分——但微软并未公布每张图像的令牌消耗量,所以请将其视为算术估算,而非官方报价。
定价也是路由层在API开放后证明自身价值的地方。在OrcaRouter上,微软收取的任何费用均以0%加价直接转传——即供应商标价,分文不加——因此发布折扣或后续降价会在公布当天就体现在你的账单上。无需重新谈判,也无需第二份合同;该模型会与其他所有内容一样出现在同一个密钥上。
这让图像模型竞赛何去何从
Arena 文生图排行榜目前的榜首:GPT Image 2 (Medium) 以 1,381 分居首,MAI-Image-2.6 1,336 分,Grok Imagine Image 2.0 1,316 分,Reve 2.1 1,302 分,Meta 的 Muse Image 1,282 分。前五名模型的 Elo 分差仅在 100 左右。过去将领先者与其他模型拉开差距的质量鸿沟,如今已缩小到“最佳图像模型”不再是一个有意义的问题——真正的问题是编辑、接地性、速度和价格。
微软的赌注远比任何单一榜单的桂冠更为宏大:一套自研模型栈,涵盖图像、语音、代码与推理,并通过Copilot、Bing和Office分发。Arena排名是功绩证明;分发才是真正的产品。
如何在不赌上生产环境的情况下试用它
Arena 预览是免费的——如果你想要原始信号,今天就对它进行生成测试。一旦 API 开放,采用一个带有“初步”评分的新模型的明智做法是将一部分流量路由到它,并保留你经过验证的模型作为后备。这正是路由层为之而生的故障模式:在 OrcaRouter 上,一旦 MAI-Image-2.6 在上游提供商处托管,你就可以将一个端点指向它,并让自动故障转移捕捉 3000 票排行榜评级无法看到的边缘情况。一个 API 密钥,200+ 个模型,提供商价格直通。
接下来看什么
• MAI-Image-2.6 是否会出现在图像编辑排行榜上 — MAI-Image-2.5 已经是一个强大的编辑器,而 2.6 的编辑评分尚未公布
• API 价格及其所属的层级
• Bing Image Creator 和 Copilot 是否会将默认值从 2.5 改为 2.6
• API开放后的独立基准测试
• "预览"标签是否会被移除——这是微软自信到足以将其推向市场的信号
常见问题
MAI-Image-2.6 何时可以通过 API 使用?
还没有。它目前以预览版形式出现在 Arena 上;微软表示 API 和 Foundry 的访问权限“即将推出”,早期报道指向下周。尚未公布确定的日期或价格。
它与GPT Image 2 Medium有多接近?
在当前 Arena 快照上相差 45 Elo——这已经足够接近,第 2 名与第 1 名之间的差距处于投票流能够影响的范围之内,而且前五名模型的差距都在大约 100 Elo 以内。
竞技场排名第二可靠吗?
这是一项独立的、盲测的人类偏好结果,而这正是它的意义所在——但它仅是初步结果(约 3,500 票),且依附于预览版本。相信方向,而非具体数字。
总而言之:MAI-Image-2.6 是第一个真正跻身前沿讨论行列的微软图像模型,而且它比 API 更早问世。如果定价能落在接近 Flash 层级的区间,它将成为今年图像生成领域最具看点的性价比之选之一。API 的开放越早越好——而一旦开放,价格和编辑得分将告诉你,No. 2 究竟是初次登场,还是已到平台期。
