
GPT-Image-2.5 对比 MAI-Image-2.6 预览版:买不到的编辑领航者 vs 触手可及的新秀
- openai新OpenAI: GPT-6 Astra2026-09-0455智能77代码
- google新Google: Gemini 3.8 Flash2026-09-0247智能76代码
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0247智能72代码
- anthropic新Anthropic: Claude Fable 5.12026-09-0157智能82代码
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-ai新Z.ai: GLM 5.3 Flash2026-08-2646智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1849智能75代码
- obsidianQwen3.8 27B2026-08-1541智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242智能69代码
- grokSpaceXAI: Grok 4.62026-08-1251智能77代码
- metaMeta: Muse Spark 1.22026-08-0547智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0347智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2140智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128智能49代码
2026年9月是这样一个月份:一年中首次出现两个最有趣的图像模型都是全新发布的,而你只能调用其中一个。9月8日,OpenAI 正式发布了 GPT-Image-2.5——即 ChatGPT Images 2.5 引擎,通过 API 以 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst 两种形式销售——任何拥有 OpenAI 密钥的人都可以立即调用它。而微软的 MAI-Image-2.6 Preview 目前位居独立图像编辑排行榜榜首,自8月19日起一直在私人预览阶段,邀请名额通过 MAI Playground 和 Microsoft Foundry 发放,至今仍没有公开定价。那个编辑能力最强的模型并不对外出售。你能实际买到的新模型,除了其开发者之外,还没有任何人给它评过分。这就是本次对比所处的图像模型市场那奇特的格局。
值得先说明一次,以便读者正确理解下文:这两款模型的所有性能声明均来自厂商自报,未经独立复现;下文的所有排名均来自独立的人类偏好评测平台——Artificial Analysis 和 LMArena——这两个平台既不受 OpenAI 控制,也不受 Microsoft 控制。GPT-Image-2.5 尚无独立评分:发布后 24 小时内未出现在任何榜单上。MAI-Image-2.6 Preview 则评分充足,因为它已以预览形式开放测试三周。
独立董事会现在到底在说什么
在 Artificial Analysis 的图像编辑排行榜上,MAI-Image-2.6 在 2026 年 9 月快照中占据榜首,以微弱优势领先 GPT Image 2 (high),Meta Muse Image 和 Nano Banana 2 紧随其后。这个第一名的位置并非某次快照的偶然——它于 8 月底从微软自家的 MAI-Image-2.5-Pro 手中夺得头名,并在排行榜重建后一直保持。在单独的文生图排行榜上,情况有所不同:GPT Image 2 (high)——也就是 GPT-Image-2.5 计划取代的模型——位列第一,MAI-Image-2.6 排名第二。在 LMArena 的单图编辑排行榜上,该预览模型攀升至第二或第三位,仅次于 GPT Image 2 (medium),其中在文字渲染以及产品/品牌/商业设计方面进步最大。
注意事项与排名本身同样重要。这些票选针对的是{{1}}“预览”版{{/1}},微软表示,其在{{2}}正式发布{{/2}}时销售的版本可能与测试者所评判的版本有所不同。一个发布仅三周的模型的投票数远低于现有模型,因此Elo分数噪声较大。此外,两个榜单采用不同的评分标准和不同的投票群体——{{3}}MAI-Image-2.6{{/3}}在{{4}}AA编辑榜上排名第一,而在LMArena上仅排第二或第三{{/4}}是正常现象,并非矛盾。
受限的领跑者:MAI-Image-2.6 Preview 究竟是什么
MAI-Image-2.6 Preview 是微软AI的统一图像模型——一个既能进行文生图又能进行图像编辑的系统——由穆斯塔法·苏莱曼的微软AI组织构建,并于2026年8月19日在MAI Playground和Microsoft Foundry上以私人预览形式发布。名称中的“Preview”名副其实:访问需要邀请,没有公开定价,也无法通过普通API密钥购买该模型。其姊妹模型MAI-Image-2.6-Flash是速度更快的变体,也出现在主模型正下方的AA板上,于9月发布。
尽管有这道门槛,这个预览仍值得关注,因为独立信号与微软的说法指向同一方向。微软表示,MAI-Image-2.6 专为编辑精度和文本渲染而打造;竞技场数据尤其支持文本渲染的说法——相比 MAI-Image-2.5,最大的一项改进就是文本渲染,在 LMArena 上提升了 43 分。“登顶编辑排行榜”与“你还不能向微软付费购买它”之间的落差,正是这场对局的全部张力所在。

可购买的新来者:GPT-Image-2.5 声称什么
GPT-Image-2.5 是 OpenAI 对微软 MAI-Image-2.6 所瞄准的同一问题的回应:既能生成、也能编辑的图像模型。OpenAI 自身的框架将该模型拆分为两个端点——GPT-Image-2.5 Flare,快速默认版本,OpenAI 称其生成速度比 GPT-Image-2 快最多 50%;以及 GPT-Image-2.5 Sunburst,它以速度换取更精确的编辑控制,面向生产级创意工作。对于编辑能力比较而言,真正重要的指标包括:参考保真度(主体在风格和场景变化下仍保持可辨识)、只改动被要求部分的多轮编辑,以及不再扭曲中文字符的文本渲染。
GPT-Image-2.5 目前还没有的,正是 MAI-Image-2.6 Preview 所具备的一点:一个独立的版本号。其前代 GPT Image 2 (high) 仍位居 AA 文生图排行榜榜首,并在编辑榜上排名第二。因此,OpenAI 的新模型必须先证明自己能击败前代,之后才谈得上可信地挑战那个在编辑方面排在其前代之上的模型。OpenAI 报告称,Manus 的第三方测试测得生成速度快 2–4 倍,且透明背景输出有所改善;但速度从来都不是这场对决的争议维度——编辑质量才是。而在编辑质量这个维度上,目前关于 2.5 的唯一证据,只有 OpenAI 自己的说法。
两者在决定购买的关键维度上如何比较
• 状态 — GPT-Image-2.5:正式可用,2026年9月8日。MAI-Image-2.6 Preview:私有预览,自8月19日起需邀请。
• 访问 — GPT-Image-2.5:任何 OpenAI API 密钥,两个端点。MAI-Image-2.6 预览版:MAI Playground 与 Microsoft Foundry(需邀请),无公开自助 API。
• 价格 — GPT-Image-2.5:每百万图像输入令牌 8 美元 / 每百万图像输出令牌 30 美元(与 GPT-Image-2 的定价表相同);单张图像成本未公布。MAI-Image-2.6 Preview:无公开价格表;Artificial Analysis 列出的预览版价格约为每 1,000 张图像 38.9 美元。
• 编辑证据 — GPT-Image-2.5:仅由 OpenAI 自行报告;截至 9 月 9 日无独立排行榜条目。MAI-Image-2.6 Preview:AA 图像编辑排行榜排名第 1(2026 年 9 月快照);LMArena 单图编辑排名第 2–3。
• 文生图证据 — GPT-Image-2.5:无独立评测。MAI-Image-2.6 预览版:AA 文生图排名第 2,仅次于 GPT Image 2(高)。
• 产品形态——GPT-Image-2.5:一个快速端点和一个精准端点,按任务选择。MAI-Image-2.6 Preview:一个统一模型,外加一个更快的 MAI-Image-2.6-Flash 姊妹模型。
Both models have a {{1}}"preview"-grade honesty problem in opposite directions{{/1}}: OpenAI sells a GA model with zero independent validation, and Microsoft has independent validation for a model you cannot buy.
谁该行动,谁该等待
如果你是能够获得邀请的 Microsoft Foundry 或 MAI Playground 客户,MAI-Image-2.6 Preview 是独立榜单上得分最高的编辑模型,你现在就应该用你自己的编辑工作负载来测试它——这正是预览的全部意义。其他所有人则面临一个没有完美选项的现实抉择。GPT-Image-2.5 是当今唯一真正全新、并且你现在就能调用的旗舰图像模型;对于编辑密集型生产场景,押注 OpenAI 的过往记录是合理的选择——但这终究是一场赌注,而且你按 token 计量付费,OpenAI 却尚未公布一张图像到底要花多少钱。对于需要独立验证的团队,稳妥的做法是把 GPT Image 2 (high)——久经考验的前代产品,在文生图上仍排第一、在编辑上排第二,并且可通过 OrcaRouter 以供应商列表价、无任何加价获取——作为生产基线,同时拿 GPT-Image-2.5 与它进行并排对比测试,并在 MAI-Image-2.6 开放的第一时间重新查看榜单。截至 2026 年 9 月 9 日,GPT-Image-2.5 和 MAI-Image-2.6 Preview 均不在 OrcaRouter 的目录中,所以无论走哪条路,你目前都得持有两家供应商的密钥。

{{1}}近期的信号很简单。{{/1}}{{2}}关注 MAI-Image-2.6 是否在票数增长的同时保住其编辑榜第一的位置,以及微软是否会公布定价——这将把“你买不到它”变成“这就是它的实际价格”。{{/2}}{{3}}关注 GPT-Image-2.5 是否出现在 AA 排行榜上,以及它相对 GPT Image 2 (high) 的排名位置:{{/3}}{{4}}如果 OpenAI 的新模型在独立编辑投票中无法击败自家的前代产品,那么“编辑榜首”的说法就毫无意义。{{/4}}{{5}}在这两件事之一发生之前,诚实的总结是:你买不到的最佳独立评分编辑模型,正在与你买得到的最佳新模型对决——而能够一锤定音的记分榜上,却没有 GPT-Image-2.5 的名字。{{/5}}

