Ideogram 4.5 与 Grok Imagine Image 2.0 的主视觉标题卡,文字为“价格高 3.7 倍,编辑能力 Elo 低 43”,并带有若干标签:“Ideogram 4.5 — 编辑排名第 23,Elo 1,064”、“Grok Imagine Image 2.0 — 编辑排名第 10,Elo 1,107”、“Ideogram 每 1,000 次编辑 220 美元”、“Grok Imagine 每 1,000 次 60 美元”。OrcaRouter 标志合成在右下角。
Guides & Insights

Ideogram 4.5 vs Grok Imagine Image 2.0:相同的价格问题,截然相反的答案

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

一句话对比:在 Artificial Analysis 的编辑排行榜上,Grok Imagine Image 2.0以 1,107 Elo 排名第 10,定价为每 1,000 张图片 60 美元。Ideogram 4.5在同一榜单的换算中,以 1,064 Elo 排名第 23,定价为每 1,000 张图片 220 美元。价格便宜了 3.7 倍,Elo 领先 43 分。在文生图排行榜上,这种模式再次出现——Grok Imagine Image 2.0 为 1,155,而 Ideogram 4.5 为 1,014;价格为 60 美元对 100 美元。

这两款模型都出自认定编辑就是前沿方向的实验室,且都是编辑优先的产品。两者均于今年发布——Grok 在 2026 年 8 月 7 日,Ideogram 4.5 在 2026 年 9 月 30 日。而它们对同一个问题给出了方向相反的答案:xAI 构建的是一个编辑环境,配有一整套面向用户的工具,而 Ideogram 构建的则是一个编辑引擎,针对单一特性做了优化。搞清楚这两种形态哪一种更适合你的工作,比 Elo 分差更有用,但 Elo 分差确实存在,而且它只朝一个方向倾斜。

构成其框架的四个数字

• 文生图 — Grok Imagine Image 2.0 167 个中排名第 4,Elo 得分 1,155 ± 11(6,879 票,2026 年 8 月),每 1,000 张图片收费 $60.00。Ideogram 4.5 排名第 34,Elo 得分 1,014 ± 11(2,247 票,2026 年 9 月),每 1,000 张收费 $100.00。

• 图像编辑 — Grok Imagine Image 2.0 第 10 名,Elo 为 1,107 ± 9(7,308 票),每 1,000 次 60.00 美元。Ideogram 4.5 第 23 名,Elo 为 1,064 ± 11(2,382 票),每 1,000 次 220.00 美元。

编辑这一项决定了这场较量的胜负,因为两款模型主要都是以编辑器定位来销售的。43 分的 Elo 差距、互不重叠的置信区间,再加上高出 3.7 倍的价格,这绝不是一个含糊的结果。这并不意味着 Ideogram 4.5 是个糟糕的模型。它的意思是:在市场唯一可用的独立评测标准上,更便宜的那款模型生成的编辑结果,被盲测评审组更频繁地选中。

关于这些数据,有两点事务性说明。榜单将 Grok Imagine Image 2.0 的创建者列为 SpaceXAI,这是 xAI 在其数据中的显示方式——这是榜单的标签,并非错误。而 Ideogram 4.5 的数据行已有两周之久,样本量约为 Grok 的三分之一,因此其 ±11 区间是最宽泛的那类估计;差距是真实的,但随着票数累积,位次可能略有变动。

引擎和环境

分数的意义不如每件产品的形态重要,而这些形态确实各不相同。

• Ideogram 4.5 — 一台引擎。两种操作:生成与精准编辑,四种渲染速度,原生 2K,以及一项招牌特性:编辑会保留边界,因此裁剪出的部分被拼回 4,016 × 6,016 的原图后依然完好,无需重新渲染画面的其余区域。你给出指令,它负责像素。

• Grok Imagine Image 2.0 —— 一个环境。用于区域选择性编辑的魔棒、用于对精确区域重新着色或替换的分割功能、背景移除、多参考输入(消费级应用中最多五张图片,API 中为三张)、可将一张图片重新构图成九种宽高比的智能调整尺寸,以及用于产品摄影、头像照、电商、游戏素材和营销海报的模板。

读完那两份清单,定价就不再显得奇怪了。Ideogram 收取的是针对单一操作的保真保证费用。xAI 则是为一套工具集收取统一费率。如果你的工作是“把这条精确指令应用到 2400 万像素文件的这个精确区域,并让其余部分保持逐位一致”,那么 Ideogram 的方案更具体。如果你的工作是“让这张产品图在九种格式下都行得通,并替换背景”,那这套工具集已经能覆盖,而且花费更低。

Screenshot of the Artificial Analysis Image Editing leaderboard (AA-Image-Editing v2.0) showing Grok Imagine Image 2.0 at rank 10 with 1,107 Elo from 7,308 samples at $60.0 per 1,000 images, with Ideogram 4.5 (High) visible lower at rank 23 with 1,064 Elo from 2,382 samples at $220.0 per 1,000 alongside rows for MAI-Image-2.6, MAI-Image-2.6-Flash and MAI-Image-2.5-Pro.

这一主张,两个董事会都不检验。

Ideogram 4.5 的具体承诺是:反复编辑不再产生漂移——不会出现像素偏移、色彩蔓延,也不会在多轮操作中累积伪影。其发布页面恰好展示了这一点,演示中还将 Grok 的同代兄弟模型与其他模型一同列为对比对象。

没有任何排行榜衡量这一点。编辑竞技场向投票者展示一张源图、一条指令和两个结果。投票者无法看到第四轮悄悄柔化了某些文字,或是把一张脸挪动了两毫米,因为第四轮并不在屏幕上。多轮保真度对这种方法是不可见的。

因此,公正的解读虽然范围有限,却确实成立:在两家厂商实际主打的特性上——即按单次编辑来评判的编辑质量——Grok Imagine Image 2.0 凭借更多证据领先,而且成本低四分之三。而在只有 Ideogram 声称具备的特性上——即跨序列的保真度——两个模型都没有公开的衡量数据,唯一获得数据的方法就是自己运行测试。

这种不对称值得直白点明,因为人们很容易把记分板解读为已成定论的裁决,也很容易把 Ideogram 的发布页解读为反驳。这两种解读都不成立。记分板衡量的东西与那项主张相近,却并非同一回事;发布页则断言了该主张,却没有第三方可以核查的证据。

BFL 风格的多轮编辑会让你付出什么代价

如果漂移是你的瓶颈,这笔账根本谈不上接近持平。Ideogram 4.5 在发布时公布的分销商价目表上,Low 档每张图 0.03 美元,Medium 档 0.06 美元,High 档 0.22 美元。那个漂移演示——2400 万像素源图、保留编辑边界——属于 High 档负载。在一张图上进行十轮编辑序列,在你还没判断它是否奏效之前,就要花掉 2.20 美元的 Ideogram 额度。

Grok Imagine Image 2.0 每 1,000 张收费 60 美元,也就是每张 0.06 美元。同一张图像跑十轮就是 60 美分,而如果第十轮已经发生漂移,你损失的钱还不到用 Ideogram 跑到同样令人失望结果所花费用的三分之一——或者,更实用地说,你可以用同样的预算在五倍数量的图像上做实验,来查明漂移在你的流水线中是否真的是个问题。

这就是反对一开始就用 Ideogram 来处理你尚未衡量的保真度问题的实际理由。先运行低成本的实验;只为廉价工具明显失败的图像购买专用引擎。

Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.Comparison scoreboard for Ideogram 4.5 and Grok Imagine Image 2.0. Left column 'Ideogram 4.5': live Sep 30 2026, editing rank 23 at 1,064 Elo, text-to-image rank 34 at 1,014 Elo, $220 per 1,000 edits, four rendering speeds, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'Grok Imagine Image 2.0': live Aug 7 2026, editing rank 10 at 1,107 Elo, text-to-image rank 4 at 1,155 Elo, $60 per 1,000, editing toolset with Magic Wand, segmentation, background removal, Smart Resize and templates, multi-reference input up to 5 images. A footer reads 'All figures per Artificial Analysis, October 2026; price figures are the board's per-1,000-image conversion.'

可用性的问题

在正在比较的版本中,这两个模型都不在 OrcaRouter 上。我们的目录收录了 xAI 较早的图像模型,grok/grok-imagine-image,每次调用 $0.20——那是上一代,不是 2.0 版本,也不是上面讨论的那一行。Ideogram 根本不在我们的目录中。这里的比较是在两个托管产品之间进行的,它们分别通过各自厂商的 API 访问,并且在这两种情况下,也通过第三方平台访问。

我们的 OpenAI 图像产品线是说明相反情况的一个有用例子。GPT-Image-2 的价格为每百万输入 token 8 美元、每百万输出 token 30 美元,这正是 OpenAI 自己的标价——零加价,供应商费率原样传递。当目录中的某家供应商降价时,这一降价当天就会在我们这边生效,无需重新谈判——正是这一特性,让路由层在图像任务中有了存在的价值。本文介绍的模型还不在那个列表上,所以诚实的说法就是:它们今天在这里还无法路由。

无论哪一种先出现,评估方式都不变,而且成本很低:把一小部分流量指向新的标识符,让在用版本充当自动故障转移,然后让新模型在真实图像上、而非在演示样片中赢得自己的一席之地。与两张图片的并排对比相比,这是检验漂移论断在实质上更优的方式。

该选哪一个

如果你想要一个统一费率,涵盖生成、编辑及配套工具集,并且你的图片大小不超过一个浏览器标签页所能容纳的范围,那就选择 Grok Imagine Image 2.0。它在生成方面位居全球第四,在编辑方面位列第十,在两个榜单上都比周围所有选项更便宜,而且它基于近 7,000 票获得的 1,155 Elo 参考分是一个稳定的数值,而不是两周前的数值。

如果你的交付物是印刷分辨率或源分辨率,并且真正破坏你工作流的是第十次编辑毁掉了第一次,那就选择 Ideogram 4.5。这是一个真实的问题,而 4.5 是唯一直接解决它的已发布产品。入场前要知道,你为一个没人独立测量过的特性支付了约 Grok 费率的 3.7 倍,而且它不是在卖的那个特性——原始编辑偏好——目前在 xAI 的有利方向上获得 43 Elo 分。

决胜办法在两种情况下都是同一个测试,而且只需一个下午:一张图片,十次编辑,对比第一轮和第十轮之间未改动区域的差异。先在便宜的模型上运行它。如果它稳住了,你就省下了一份专家服务合同。如果它崩了,你现在就确切知道 Ideogram 4.5 适合处理哪些图像——而且你有前后对比来证明这 0.22 美元花得合理。