用于对比“GPT-Image-2.5 vs MAI-Image-2.6 Preview”的英雄标题卡片,副标题为“买不到的编辑领导者 vs 你能买到的新秀”,展示左侧圆角卡片,标注为“GPT-Image-2.5 · 可购买 — 9月8日GA,API已上线”,带钥匙图标;右侧圆角卡片标注为“MAI-Image-2.6 Preview · 邀请制 — AA 图像编辑 #1”,带挂锁图标,上方还有一个小奖杯;右下角为OrcaRouter标志。
Guides & Insights

GPT-Image-2.5 对比 MAI-Image-2.6 预览版:买不到的编辑领航者 vs 触手可及的新秀

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

2026年9月是这样一个月份:一年中首次出现两个最有趣的图像模型都是全新发布的,而你只能调用其中一个。9月8日,OpenAI 正式发布了 GPT-Image-2.5——即 ChatGPT Images 2.5 引擎,通过 API 以 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst 两种形式销售——任何拥有 OpenAI 密钥的人都可以立即调用它。而微软的 MAI-Image-2.6 Preview 目前位居独立图像编辑排行榜榜首,自8月19日起一直在私人预览阶段,邀请名额通过 MAI Playground 和 Microsoft Foundry 发放,至今仍没有公开定价。那个编辑能力最强的模型并不对外出售。你能实际买到的新模型,除了其开发者之外,还没有任何人给它评过分。这就是本次对比所处的图像模型市场那奇特的格局。

值得先说明一次,以便读者正确理解下文:这两款模型的所有性能声明均来自厂商自报,未经独立复现;下文的所有排名均来自独立的人类偏好评测平台——Artificial Analysis 和 LMArena——这两个平台既不受 OpenAI 控制,也不受 Microsoft 控制。GPT-Image-2.5 尚无独立评分:发布后 24 小时内未出现在任何榜单上。MAI-Image-2.6 Preview 则评分充足,因为它已以预览形式开放测试三周。

独立董事会现在到底在说什么

在 Artificial Analysis 的图像编辑排行榜上,MAI-Image-2.6 在 2026 年 9 月快照中占据榜首,以微弱优势领先 GPT Image 2 (high),Meta Muse Image 和 Nano Banana 2 紧随其后。这个第一名的位置并非某次快照的偶然——它于 8 月底从微软自家的 MAI-Image-2.5-Pro 手中夺得头名,并在排行榜重建后一直保持。在单独的文生图排行榜上,情况有所不同:GPT Image 2 (high)——也就是 GPT-Image-2.5 计划取代的模型——位列第一,MAI-Image-2.6 排名第二。在 LMArena 的单图编辑排行榜上,该预览模型攀升至第二或第三位,仅次于 GPT Image 2 (medium),其中在文字渲染以及产品/品牌/商业设计方面进步最大。

注意事项与排名本身同样重要。这些票选针对的是{{1}}“预览”版{{/1}},微软表示,其在{{2}}正式发布{{/2}}时销售的版本可能与测试者所评判的版本有所不同。一个发布仅三周的模型的投票数远低于现有模型,因此Elo分数噪声较大。此外,两个榜单采用不同的评分标准和不同的投票群体——{{3}}MAI-Image-2.6{{/3}}在{{4}}AA编辑榜上排名第一,而在LMArena上仅排第二或第三{{/4}}是正常现象,并非矛盾。

受限的领跑者:MAI-Image-2.6 Preview 究竟是什么

MAI-Image-2.6 Preview 是微软AI的统一图像模型——一个既能进行文生图又能进行图像编辑的系统——由穆斯塔法·苏莱曼的微软AI组织构建,并于2026年8月19日在MAI Playground和Microsoft Foundry上以私人预览形式发布。名称中的“Preview”名副其实:访问需要邀请,没有公开定价,也无法通过普通API密钥购买该模型。其姊妹模型MAI-Image-2.6-Flash是速度更快的变体,也出现在主模型正下方的AA板上,于9月发布。

尽管有这道门槛,这个预览仍值得关注,因为独立信号与微软的说法指向同一方向。微软表示,MAI-Image-2.6 专为编辑精度和文本渲染而打造;竞技场数据尤其支持文本渲染的说法——相比 MAI-Image-2.5,最大的一项改进就是文本渲染,在 LMArena 上提升了 43 分。“登顶编辑排行榜”与“你还不能向微软付费购买它”之间的落差,正是这场对局的全部张力所在。

A two-column comparison scoreboard for 'GPT-Image-2.5 vs MAI-Image-2.6 Preview': GPT-Image-2.5 rows read Status GA, Sept 8 2026 / Access OpenAI API, Flare + Sunburst / Price $8 in · $30 out per M tokens / Editing evidence OpenAI-reported, no AA entry / T2I evidence OpenAI-reported, no AA entry / Positioning fast default + precision endpoint; MAI-Image-2.6 Preview rows read Status private preview, Aug 19 / Access invite-only, Foundry + MAI Playground / Price no public card, AA lists $38.9 / 1k / Editing evidence AA #1, Sept 2026 / T2I evidence AA #2 behind GPT Image 2 / Positioning unified T2I + edit, Flash sibling; footer 'Independent figures per Artificial Analysis Sept 2026; model claims vendor-reported.'; the OrcaRouter logo is bottom-right.

可购买的新来者:GPT-Image-2.5 声称什么

GPT-Image-2.5 是 OpenAI 对微软 MAI-Image-2.6 所瞄准的同一问题的回应:既能生成、也能编辑的图像模型。OpenAI 自身的框架将该模型拆分为两个端点——GPT-Image-2.5 Flare,快速默认版本,OpenAI 称其生成速度比 GPT-Image-2 快最多 50%;以及 GPT-Image-2.5 Sunburst,它以速度换取更精确的编辑控制,面向生产级创意工作。对于编辑能力比较而言,真正重要的指标包括:参考保真度(主体在风格和场景变化下仍保持可辨识)、只改动被要求部分的多轮编辑,以及不再扭曲中文字符的文本渲染。

GPT-Image-2.5 目前还没有的,正是 MAI-Image-2.6 Preview 所具备的一点:一个独立的版本号。其前代 GPT Image 2 (high) 仍位居 AA 文生图排行榜榜首,并在编辑榜上排名第二。因此,OpenAI 的新模型必须先证明自己能击败前代,之后才谈得上可信地挑战那个在编辑方面排在其前代之上的模型。OpenAI 报告称,Manus 的第三方测试测得生成速度快 2–4 倍,且透明背景输出有所改善;但速度从来都不是这场对决的争议维度——编辑质量才是。而在编辑质量这个维度上,目前关于 2.5 的唯一证据,只有 OpenAI 自己的说法。

两者在决定购买的关键维度上如何比较

状态 — GPT-Image-2.5:正式可用,2026年9月8日。MAI-Image-2.6 Preview:私有预览,自8月19日起需邀请。

访问 — GPT-Image-2.5:任何 OpenAI API 密钥,两个端点。MAI-Image-2.6 预览版:MAI Playground 与 Microsoft Foundry(需邀请),无公开自助 API。

价格 — GPT-Image-2.5:每百万图像输入令牌 8 美元 / 每百万图像输出令牌 30 美元(与 GPT-Image-2 的定价表相同);单张图像成本未公布。MAI-Image-2.6 Preview:无公开价格表;Artificial Analysis 列出的预览版价格约为每 1,000 张图像 38.9 美元。

编辑证据 — GPT-Image-2.5:仅由 OpenAI 自行报告;截至 9 月 9 日无独立排行榜条目。MAI-Image-2.6 Preview:AA 图像编辑排行榜排名第 1(2026 年 9 月快照);LMArena 单图编辑排名第 2–3。

文生图证据 — GPT-Image-2.5:无独立评测。MAI-Image-2.6 预览版:AA 文生图排名第 2,仅次于 GPT Image 2(高)。

产品形态——GPT-Image-2.5:一个快速端点和一个精准端点,按任务选择。MAI-Image-2.6 Preview:一个统一模型,外加一个更快的 MAI-Image-2.6-Flash 姊妹模型。

Both models have a {{1}}"preview"-grade honesty problem in opposite directions{{/1}}: OpenAI sells a GA model with zero independent validation, and Microsoft has independent validation for a model you cannot buy.

谁该行动,谁该等待

如果你是能够获得邀请的 Microsoft Foundry 或 MAI Playground 客户,MAI-Image-2.6 Preview 是独立榜单上得分最高的编辑模型,你现在就应该用你自己的编辑工作负载来测试它——这正是预览的全部意义。其他所有人则面临一个没有完美选项的现实抉择。GPT-Image-2.5 是当今唯一真正全新、并且你现在就能调用的旗舰图像模型;对于编辑密集型生产场景,押注 OpenAI 的过往记录是合理的选择——但这终究是一场赌注,而且你按 token 计量付费,OpenAI 却尚未公布一张图像到底要花多少钱。对于需要独立验证的团队,稳妥的做法是把 GPT Image 2 (high)——久经考验的前代产品,在文生图上仍排第一、在编辑上排第二,并且可通过 OrcaRouter 以供应商列表价、无任何加价获取——作为生产基线,同时拿 GPT-Image-2.5 与它进行并排对比测试,并在 MAI-Image-2.6 开放的第一时间重新查看榜单。截至 2026 年 9 月 9 日,GPT-Image-2.5 和 MAI-Image-2.6 Preview 均不在 OrcaRouter 的目录中,所以无论走哪条路,你目前都得持有两家供应商的密钥。

Screenshot of the Artificial Analysis image-editing leaderboard captured September 9 2026: MAI-Image-2.6 is ranked first at Elo 1,122, with GPT Image 2 (high) second at 1,117, Meta Muse Image third at 1,105, MAI-Image-2.6-Flash fourth and Nano Banana 2 fifth; API pricing per 1,000 images is shown for each row.

{{1}}近期的信号很简单。{{/1}}{{2}}关注 MAI-Image-2.6 是否在票数增长的同时保住其编辑榜第一的位置,以及微软是否会公布定价——这将把“你买不到它”变成“这就是它的实际价格”。{{/2}}{{3}}关注 GPT-Image-2.5 是否出现在 AA 排行榜上,以及它相对 GPT Image 2 (high) 的排名位置:{{/3}}{{4}}如果 OpenAI 的新模型在独立编辑投票中无法击败自家的前代产品,那么“编辑榜首”的说法就毫无意义。{{/4}}{{5}}在这两件事之一发生之前,诚实的总结是:你买不到的最佳独立评分编辑模型,正在与你买得到的最佳新模型对决——而能够一锤定音的记分榜上,却没有 GPT-Image-2.5 的名字。{{/5}}

Screenshot of the Artificial Analysis text-to-image leaderboard captured September 9 2026: GPT Image 2 (high) is ranked first at Elo 1,178 and MAI-Image-2.6 is ranked second at 1,149, with Reve 2.1, Nano Banana 2 and Meta Muse Image behind; GPT-Image-2.5 has no entry.