
Ideogram 4.5 发布精准编辑,告别漂移
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 262 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- xAISpaceXAI: Grok 4.62026-08-1244智能77代码
Ideogram 4.5于2026年9月30日发布,它只带来一个承诺,并用一段演示作为佐证:对同一张图片进行第二次、第三次、第十次编辑,它都不会崩坏。Ideogram 自家的产品页面称其为“最精准的编辑模型”,而这个标题之下的说法相当具体——通常每次对图像的处理都会引入像素偏移、色彩变化和纹理伪影,而4.5“减少了这种漂移,在多轮编辑中保留细节”。这就是它的全部卖点。它没有附带新的头条基准测试成绩,没有炫耀任何排行榜桂冠,也没有试图论证自己是世界上最好的图像生成器。Ideogram 卖的是一种行为表现,而有趣的问题是:这种行为表现是否值回入场价。
这不是一次免费升级。Ideogram 4.5 是一个闭源、托管式模型,按积分计费,价格比与它并列的那一代模型贵得多,而它目前唯一获得的独立评分也只让它处在中游。解读这次发布的正确方式,是把它看作一次专业向采购:如果你的瓶颈是在大文件上反复进行局部编辑,那它正是为你而来;如果你想要的是单条提示词生成最好看的图像,那它并不适合。
宣布了什么,以及何时宣布
Ideogram 于 2026 年 9 月 30 日在其模型页面上发布了 4.5,并于同日开始在其自有产品、开发者 API、MCP 集成及其应用集合中提供服务。该公司没有为其单独发布上线博客文章——不像 Ideogram 4.0 在 6 月获得了技术文章和新闻稿——因此模型页面本身是主要来源。公告和后续报道都在 9 月 30 日发布,且都与该页面一致。发布时关于分发渠道提到了三点。该模型可在 Ideogram 自有应用内使用。它可在 Ideogram 的 API 上使用。并且可通过合作伙伴服务使用——这些第三方平台已经在转售早期的 Ideogram 模型。该公司没有点名这些平台,但 4.0 的模式依然成立:上一代模型既直接提供服务,也在一组图像基础设施平台上提供服务,而 4.5 在发布后的数小时内就出现在这些相同的平台上。发布报道附加的一条说明还提到,团队计划很快发布该模型的开放权重;这是一种意图声明,而非已交付的产物,9 月 30 日或之后都没有发布任何东西。
该能力,已定价
这里有两个商业上重要的因素:你能做什么,以及每张图片的成本是多少。
• 生成 — 提示词转图像,最基础的操作。
• 精准编辑——这正是该模型存在的意义。在现有图像上进行局部修改,保留周边像素,而非重新合成。
• 四种速度Turbo、Balanced、Quality 和 High。费用取决于你选择的设置,而不是你选择的分辨率。
• 原生 2K 输出——在最高设置下长边可达 2,048 像素,单张图片的价格卡正是按此标准报价的。
• 以原始分辨率编辑——这是其核心工程亮点。Ideogram 展示了在 4,016 × 6,016 的源图像(2420 万像素)上直接进行编辑,而无需先将其降采样,因此编辑后的裁剪区域可以重新拼回原图,并且仍能经受住特写查看或大幅面印刷的考验。
• 费用 — 在发布时出现的经销商费率卡上,Low 档为每张图像 $0.03,Medium 档为 $0.06,High 档为 $0.22;同样的 $0.22 上限也独立出现在 Artificial Analysis 针对 2K High 配置的价格栏中。Ideogram 自己的 API 定价页面位于一个客户端渲染的表格之后,而该表格在文本抓取中不会渲染,因此,每张图像的价格阶梯才是应引用的数字,供应商页面则是确认它的地方。
那 $0.22 大约是 Low 设置的七倍,约为 Medium 的三倍半。这一差距之所以重要,是因为该模型的卖点——在大图像上进行精确的局部编辑——恰恰就是你会在 High 设置下、对大型文件反复运行的那类工作负载。它是这款产品最昂贵的一项操作。

那个独立评分,虽说也就那么回事。
Artificial Analysis 在发布周将 Ideogram 4.5 (High) 加入其两个图像榜单,而这些结果值得精确陈述,因为它们与营销宣传相悖。
文生图 — 在 167 个模型中排名第 34,Elo 为 1,014,共获得 2,247 票,价格为每 1,000 张图像 100.00 美元。这与前沿水平相差甚远:GPT Image 2.5 Sunburst(max)以 1,197 分领跑,Grok Imagine Image 2.0 为 1,155 分,微软的 MAI-Image-2.6 为 1,150 分。它也只是勉强领先于 6 月发布的 Ideogram 4.0,后者得分为 1,011。
• 图像编辑 — 以 1,064 Elo、2,382 票排名第 23,按榜单自身的换算为每 1,000 张图像 220.00 美元。该榜单的领先者是 GPT Image 2.5 Sunburst(1,182)、GPT Image 2.5 Flare(1,162)和 MAI-Image-2.6(1,137)。

这两个数字都是独立的——盲测人类偏好,没有厂商参与——但两者都还为时过早。2,247 和 2,382 票是在领先者拥有 12,000 到 18,000 票的排行榜上的小样本,这就是为什么置信区间是 ±11,而不是顶部几行显示的 ±8。把名次视为暂定的;把区间视为真实的。这些数字不会告诉你任何关于漂移的信息,因为两个竞技场都不要求投票者将序列中的第十次编辑与第一次进行评判。Ideogram 实际提出的那个主张,正是还没有人测量过的那一个。
为什么“无漂移”是一个比看上去更难的断言
编辑模型有一种不那么光鲜的失败模式,任何用过它们的人都认得。你只要求改一处——换个包的颜色,缩短一行文字——模型却把整个画面重新合成一遍。输出里百分之九十九没问题。剩下的那部分却和你原本拥有的东西不一样,而这种偏差会累积。经过三轮处理,人脸会漂移几毫米。颗粒和光照会变化。第一遍还清晰锐利的文字,到第四遍就变模糊了。一个需要十次小修改的工作流程,最终就有了十次丢掉你本想保留之物的机会,这也是为什么严肃的修图仍然在 Photoshop 里进行,而不是在聊天框里。
Ideogram 给出的答案,是关于编辑边界的一项主张。该公司称,这个模型“会保留编辑后裁剪图的边缘,因此你可以将其无缝拼接回原图”。这一点,再加上 2420 万像素的演示,构成了此次宣传的实质:不是更好的品味,而是更好的保真度。它也是让该模型在其所针对的工作流中有用的特性——为产品目录制作配色变体、在整个营销活动中翻译标牌、修复受损照片而不重绘尚存的部分。
值得注意的是,Black Forest Labs 早在 7 月就将同样的特性列入了 Flux 3 图像层级的路线图:“非破坏性编辑——保留纹理、颗粒、光照和背景,使多轮编辑不会降质。”该层级至今仍没有公开端点。Ideogram 并非唯一一家认为这是难题的实验室;它是今天唯一交付答案的那家。它的答案是否成立,是排行榜无法裁定、演示视频也无法裁定的问题。唯一诚实的结论,来自把你自己的图像跑过十轮并对比输出差异。

如果你是构建者,这适合哪里
Ideogram 4.5 已上线该产品自家的 API 以及各合作方平台。它并不在 OrcaRouter 的目录中——我们目前的图像产品线用的是 OpenAI 的 GPT-Image-1.5、GPT-Image-2 和 GPT-Image-2.5 标识符、xAI 的 Grok Imagine 图像模型,以及 Google 的 Imagen 4 系列,Ideogram 并不在其中。说它不是这样,那就属于十秒钟就会被查证推翻的那类说法。
在这种情况下,路由层确实能给你的是:一种无需做出承诺就能评估某个专用模型的方法。对 4.5 来说,真正重要的比较不是与排行榜榜首比,因为排行榜衡量的是另一回事——而是与你当前用于多轮编辑的任何东西比。在两者上运行相同的十轮编辑序列,对比输出,并按每张编辑后图像的美元成本而非每张生成图像的美元成本来计算差异。这个实验用一个密钥就能低成本运行,且具备 按调用计费和自动故障转移,而它是唯一能验证 4.5 实际所声称内容的实验。
看什么
三项待决事项,按其对情况可能产生的影响程度排序。
首先,关于漂移的说法需要一项独立测试。如果有人发布一项多轮保真度基准测试——同一张图像,十次连续编辑,测量出的偏差——那才是应该决定这次购买的数字,而目前,任何编辑器都不存在这个数字。
其次,是关于开放权重的说明。Ideogram 4.0 的权重是真正开放的:代码仓库公开,模型合集发布在 Hugging Face 上,公司还为其配了许可页面。如果 4.5 也照此办理,那么对任何自行运行推理的人来说,经济账就完全变了,而“计划中”的措辞也会变成一次发布,而非一句承诺。如果 4.5 不这样做,那么闭源 API 就是唯一的途径。
第三,得分。4.5 在竞技场中的排名记录已有两周,每条各有几千票。如果随着样本扩大,这个编辑排名上升,那就说明该模型正因针对其价格的抗议性投票而被低估。如果它停留在第 23 名左右,那么以每 1,000 次 220 美元的价格提供中游的编辑质量,在这个市场上就很难卖得动:在该榜单上,它上面的两个模型价格大致相同,而它下面的那个只要 60 美元。
这次发布是真实的,有确定日期、价格,也可直接调用——这些都已尘埃落定。尚未确定的是,Ideogram 所打造的这个具体东西,是否正是你需要的那一个;而弄清这一点的唯一办法,就是把你自己的最坏情况编辑序列丢进去跑一遍,然后看看第十轮的结果。
