
Ideogram 4 对比 MAI Image 2.6 Preview:专才对阵平台
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 217 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 111 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 982 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 43 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
Ideogram 4.5只为做一件事而存在:反复编辑同一张图像,而不让它劣化。MAI Image 2.6 Preview——微软 AI 的旗舰图像模型——则是为了同时胜任一切而生:生成、借助多张参考图进行编辑、让提示词扎根于实时网络内容,以及自行选择宽高比;而且自 2026 年 9 月 4 日起,它就已可通过 Microsoft Foundry 以公开预览形式调用。把两者并排放在一起,数字指向一个方向,产品形态却指向另一个方向。Ideogram 赢在它当初被造出来要做的那件事上;微软则几乎赢下其他所有维度,包括那些决定一支团队能否真正将其部署落地的维度。
每一个是什么
Ideogram 4.5 于 2026 年 9 月 30 日正式上线,覆盖 Ideogram 应用、其自有 API、MCP 集成及其应用集合,以及合作平台。它支持四种渲染速度的生成与编辑,原生以 2K 输出,并在 4,016 × 6,016 的源图(2420 万像素)上演示了局部编辑,且无需降采样。厂商声称,反复多次处理不再发生漂移:边缘保持原位,纹理得以保留,编辑后的裁切区域能无缝拼回原图。权重未公开。
MAI Image 2.6 是 Microsoft AI 最强的图像模型,也是一条产品谱系的巅峰之作,这条谱系包括 MAI-Image-1、2026 年 3 月的 MAI-Image-2、6 月的 MAI-Image-2.5、7 月的 MAI-Image-2.5-Pro,以及其间推出的 MAI-Image-2-Efficient。它于 2026 年 8 月首次亮相 Arena 排行榜,位列第 2,2026 年 9 月 4 日,微软将其引入 Microsoft Foundry 和 MAI Playground 的公开预览版,同时推出面向高吞吐量工作负载的全新 MAI-Image-2.6-Flash。其标称能力十分广泛:可融合多张图像中的人物、产品、风格与场景的多参考编辑、网络接地、动态宽高比,以及最高 1.5K 分辨率的输出。它同样是闭源的,且仅在微软云上运行。

阵容
• 访问 — 公开应用、API 和 MCP 集成自 2026 年 9 月 30 日起提供,而 Microsoft Foundry 和 MAI Playground 中的公开预览版则自 2026 年 9 月 4 日起提供。
• 价格——低档每张图片 0.03 美元,中档 0.06 美元,高档 0.22 美元,供应商费率表上明确列出,而微软的新闻稿中则未公布费率表;定价信息藏在 Foundry 模型卡之后,而各独立排行榜将该模型列为每 1,000 张图片 38.90 美元。
• 文本到图像得分——基于 2,278 个样本,以 1,013 Elo 排名第 34;相比之下,基于 9,410 个样本为 1,161 Elo,发布于 2026 年 8 月。
• 编辑得分——基于 2,459 个样本,以 1,064 Elo 排名第 23,每 1,000 张图像 $220.00;相比之下,基于 15,684 个样本,以 1,137 Elo 排名第 3,每 1,000 张 $38.90。
• 输出 — 原生 2K,编辑操作在 4,016 × 6,016 分辨率下演示,相比之下,根据微软的规格说明,分辨率最高可达 1.5K。
• 能力形态——一边是单一突出优势(多轮编辑保真度),另一边是广泛能力组合:多参考编辑、Web 接地、动态宽高比,以及更快的 Flash 同级模型。

同样的板,同样的面板,可差距一点也不小
这是一次罕见的对决,能够进行清晰的比较,因为两个模型都位于 Artificial Analysis 上,其数据行由同一个评审小组和同一个投票池测量得出。
文生图:MAI-Image-2.6 在 9,410 个样本上取得 1,161 Elo,对比 Ideogram 4.5(High)在 2,278 个样本上取得的 1,013 Elo。这是在四倍样本量下领先 148 Elo,而价格一栏显示每千张图片 $38.90 对 $100.00。
图像编辑:MAI-Image-2.6 基于 15,684 个样本取得 1,137 Elo,对比基于 2,459 个样本取得 1,064 Elo 的 Ideogram 4.5(High),按独立换算,每千次分别为 $38.90 与 $220.00。
微软自己9月4日的帖子声称,在该榜单上拿下了文本到图像第2名和图像编辑第1名,两者均标注为“截至2026年9月4日”。一个月后再看,文本到图像的位次依然成立,而图像编辑的宣称则不再成立:GPT Image 2.5 Sunburst于9月登场,以1,182 Elo在该榜单上位居第一,MAI-Image-2.6以1,137分位列第三。这并不是在贬低该模型——在一个每周都有新模型发布的市场上,任何“今日第一”的说法都会如此,也正是本文为每个排名都附上日期的原因。

重要的差别不在于分数
如果董事会决定了这件事,那就结束了。他们没有这么做,原因有两个。
第一点是,这两个榜单都没有衡量 Ideogram 真正的主张。编辑竞技场向投票者展示的是一张源图像和两个单指令结果;它们从不向投票者展示一个序列中的第十次编辑与第一次编辑的对比,而这正是 Ideogram 打造 4.5 所要防止的漂移。73 分的编辑差距告诉你,MAI Image 2.6 在单次编辑中更受青睐。它无法告诉你大文件上第十轮编辑的表现,而第十轮恰恰是目录制作团队、标牌更换或照片修复真正依赖的东西。
第二个是可用性形态。预览版与正式产品不是一回事。Foundry 公共预览版是用于评估和内部工具的理想归宿,而微软并未对其附加正式发布(general availability)条款——没有可用性承诺,没有弃用通知,没有吞吐量保证。微软的模型也只能通过微软自家的云和 playground 访问,因此当预览端点被限流时,没有第二个提供商可以退而求其次。Ideogram 4.5 按公布的层级发布,并附有可纳入预算的价目表,而 Ideogram 自家的 API 是一项承诺,而非预览版。
然后是价格走向,这对较新的模型来说确实令人不安。在微软没有公布价目表的情况下,唯一可比的数字就是各排行榜的换算价:MAI-Image-2.6 为每千次 38.90 美元,而 Ideogram 4.5 的文生图为 100.00 美元、编辑为 220.00 美元。一个在两个排行榜上都得分更高、换算价格又更低的模型,根本不难推销——它就是默认之选。
每一样东西真正赢得其位置的地方
当你的工作流程中代价高昂的环节是修复已获批准的作品,而不是创作新作品时,就该选择 Ideogram 4.5:为产品目录制作配色变体、为整场营销活动翻译标识、修复受损照片而不重绘其中幸存的部分。24.2 兆像素的演示和保留边缘的宣称正是针对这一点,而且没有任何竞争模型能以可比的证据做出这样的宣称。在投入之前,先用你最坏情况的序列测试它;供应商之外的任何人都尚未复现这一宣称。
当你需要集成的广度和速度时,请选择 MAI Image 2.6。使用多张源图像进行多参考编辑、网络依据以及动态宽高比,已经能覆盖大多数制作需求,无需在流程中再引入第二个模型;而 MAI-Image-2.6-Flash 则面向高用量层级——微软自己的数据是比 GPT-Image-2-Medium 快 2.8 倍,该数据来自 1024 × 1024 下每分钟 100 次请求的内部负载测试,由厂商报告且未经复现。如果你的团队已经深度使用 Azure,集成成本几乎为零,而这可能比 2400 万像素的编辑保真度更重要。
如果你在运营真正的内容业务,那就两个都要。用一个平台模型负责生成和产量,用一个专精模型负责必须像素级精准的环节,再立一条规矩,明确哪一步归谁管。错误在于把这当成一笔单次采购。
当两个端点具有不同保证时的路由
这场对比里的任何一项都不在 OrcaRouter 的目录中。Ideogram 4.5 可通过厂商自己的 API 以及若干第三方平台获取;MAI Image 2.6 Preview 则只能通过 Microsoft Foundry 和 MAI Playground 访问。我们的图像产品线是另一回事——Google 的 Gemini 3.1 Flash Image 和 Imagen 4 标识符、OpenAI 的 GPT-Image 系列模型——说我们能路由其中任何一个,都经不起一次核查。
在这里,路由层真正的价值在于这两种可用性承诺之间的不对称。没有 SLA 的预览端点,恰恰是自动故障转移物有所值的地方:调用会落到一个可用的备选方案上,而不是在凌晨两点抛出异常,而且你是在日志里发现,而不是在支持工单里。按提供商标价按调用计费,不额外加价意味着供应商降价或预览版首次公布的价格,会在生效当天就出现在你的账单上——当你正在做的对比在编辑这一项上是 2.6 倍差距时,这一点很重要。如果你想在不签两份合同的情况下把预览版和专用方案做 A/B 测试,用一个密钥是最便宜的做法。
现在该做什么
如果你今天要选一个模型,诚实的答案是:更好的模型同时也是更便宜的那个,而且还是只能在预览版中获取的那个。如果你能接受在 Microsoft 的云和预览条款下使用,就选 MAI Image 2.6;如果你需要一份可以预测的价目表、第一方 API,或特定的编辑保真度行为,并且接受为此支付大约相当于折算后编辑费率两倍半的费用,就选 Ideogram 4.5。
两件事就能定论。第一件是 {{1}}保真度基准测试{{/1}}:同一张图像、十次连续编辑、测量出的偏差。在有人做这件事之前,让 {{2}}Ideogram 4.5{{/2}} 有趣的特性是 {{3}}而{{/3}}让 {{4}}MAI Image 2.6{{/4}} 有趣的特性是 {{5}}经过测量的{{/5}}。第二件是 {{6}}Microsoft{{/6}} 将 {{7}}MAI Image 2.6{{/7}} 从 {{8}}预览版{{/8}} 推进到 {{9}}正式可用{{/9}},并公布 {{10}}价目表{{/10}};这消除了对 {{11}}平台战略{{/11}} 的最后一个实际异议,并使 {{12}}专用模型论点{{/12}} 完全取决于 {{13}}漂移{{/13}}。
