用于 Ideogram 4.5 与 Flux 3 的主视觉标题卡,将“Ideogram 4.5 —— 2026 年 9 月 30 日上线,编辑排名第 23”与“Flux 3 Image —— 无端点、无模型 ID、无价格”进行对比,并将 FLUX.2 系列列为当前可调用的 BFL 图像生成。OrcaRouter 标志合成在右下角。
Guides & Insights

Ideogram 4.5 对比 Flux 3:已发布产品对阵未模态化形态

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

Ideogram 4.5 和 Flux 3 是最近两项共享同一核心论点前沿图像发布,而其中只有一项是你能真正调用的东西。Ideogram 4.5 于 2026 年 9 月 30 日上线,是一款精确编辑模型,其立足点是一个具体主张:反复编辑不会让图像质量持续退化。Flux 3 是 Black Forest Labs 的统一多模态基础模型,于 2026 年 7 月 23 日发布,并为其图像层级许下了同样的特性——非破坏性编辑,在多轮操作中保留纹理、颗粒感与光照。十周之后,Flux 3 Image 依然没有公开端点、没有模型标识符,也没有价格表。BFL 从这一系列中真正交付出来的,是视频模型和一个机器人动作模型。

所以,这种对比诚实的表述方式不是“哪个更好”,而是“一个是明码标价、拥有独立评分的产品,另一个则是一份承诺,而它的截止期限早已过去”。以下内容将把两者区分开来。

你今天可以呼叫的对象

• Ideogram 4.5 — 自 2026 年 9 月 30 日起在 Ideogram 自有应用和 API 以及合作平台上正式上线。支持两种操作——生成与精确编辑——并提供四种渲染速度。在 Artificial Analysis 的文生图榜单(167 个中排名第 34,Elo 1,014)和编辑榜单(排名第 23,Elo 1,064)上均有独立条目。

• Flux 3 Image——无公开端点。Black Forest Labs 自家的文档推荐将 FLUX.2 用于文生图和图像编辑,并且说得毫不含糊:“FLUX.2 是推荐的文生图生成模型”;在编辑方面,“对于新项目,我们推荐使用支持多参考、输出最高可达 4MP 的 FLUX.2。”该公司的 Flux 3 相关内容属于视频和动作领域。

• Flux 3 Video — 自 2026 年 8 月 4 日起正式可用,并于 9 月 10 日扩展支持 2K 和 4K 输出模式。按输出时长每秒计费:高清为 $0.17/秒,超高清文生视频升至 $0.80/秒,超高清视频转视频为 $0.95/秒。

• Flux 3 Action — 一个已发布的 7B 开放权重世界动作模型,配备完整的文档,内容涵盖微调、SO-101 机械臂实战配方,以及无人机控制与游戏操作的示例。

• 可调用的 BFL 图像产品线 —— FLUX.2 的五个规格:[pro]、[max]、[flex]、[dev] 和 [klein]。这是上一代产品,也是 BFL 自己为生产级图像工作所指向的选择。

Flux 3 发布时公布的五种模态中,已有三种上线。与 Ideogram 4.5 竞争的那一种尚未推出,而 BFL 在此期间正将自家客户引导至它的上一代。这是这场对比中最具决定性的事实。

两次发布实际上都在提出的主张

两家公司推销的是同一项技术特性,而它并非画质,而是耐用性。

图像编辑器有一种典型的失败模式:你要求做一个小改动,模型就会重新渲染整个画面。大部分输出会保留下来。其余部分则不会,而且这种差异会随着每一次迭代不断累积——人脸偏移、颗粒变化、文字变糊、光线漂移。任何在聊天界面中做过十轮修改的人,都见过这种情况发生。

Ideogram 4.5 给出的答案,是在编辑边界上做工程。其页面称,该模型“会保留已编辑裁剪区域的边缘,因此你可以把它无缝拼回原图”,并在一个 4,016 × 6,016 的源文件——2420 万像素——上做了演示,且编辑前并未先进行降采样。它宣传的是保真度得以保留,而不是品味得到提升。

Flux 3 的答案,正如七月路线图所规划的那样,形态如出一辙:“非破坏性编辑——保留纹理、颗粒、光照和背景,使多轮编辑不会劣化。”它出现在图像层级的特性列表中。图像层级尚未推出,因此这一说法从未被 Black Forest Labs 之外的任何人检验过。

这一点值得停下来想一想。两个实验室各自独立得出结论:漂移才是那个难题。一个已经交付了缓解方案,并给它定了价。另一个只是描述了缓解方案,还没有把模型放到任何客户面前。如果你今天就要做选择,那你是在一个已经跑通的答案和一个还停留在预期中的答案之间做选择。

Screenshot of the Artificial Analysis Text to Image leaderboard (AA-Image-T2I v2.0) showing Ideogram 4.5 (High) at rank 34 with 1,014 Elo from 2,247 samples at $100.0 per 1,000 images, below FLUX.2 [flex] and FLUX.2 [max], with no Flux 3 row anywhere on the board.Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.

记分牌能说明什么,不能说明什么

Artificial Analysis 为文生图和编辑都运营盲测人类偏好竞技场,Ideogram 4.5 在两者中均有参赛条目。以下数据取自 2026 年 10 月初的榜单:

文生图 — 34领先者是 GPT Image 2.5 Sunburst(max),Elo 为 1,197。Ideogram 自家 6 月发布的 4.0 得分为 1,011,因此该榜上的代际提升约为 3 Elo。

• 图像编辑 — 第 23 名,Elo 为 1,064 ± 11,共 2,382 票,按该榜单的换算为每 1,000 张图像 220.00 美元。领先的是 GPT Image 2.5 Sunburst(1,182)和 GPT Image 2.5 Flare(1,162)。

• Flux 3 — 在两者中均未出现。之所以没有对应条目,是因为不存在可供测试的端点。文生图榜单上的 Flux 条目全部是 FLUX.2:[flex] 为 1,028,[max] 为 1,021,[pro] 为 1,004,[dev] 为 1,000;而在编辑榜单上,[klein] 9B 为 1,013。

这两个数字还需附带两点说明。Ideogram 4.5 的排名数据既新又单薄——只有几千票,而领先者手握 12,000 至 18,000 票——这正是其区间为 ±11 而非 ±8 的原因。而且,这两个榜单都没有就漂移问题询问投票者。Ideogram 所推销的特性在单次偏好测试中根本不可见,因此编辑类排名第 23 位测的是与这一主张相近的东西,而非该主张本身。

价格端,问题正是从这里开始。

• Ideogram 4.5——发布时公布的经销商价目表显示,Low 档每张图像 $0.03,Medium 档 $0.06,High 档 $0.22;同一 $0.22 的上限也出现在 Artificial Analysis 针对 2K High 配置给出的每 1,000 张 $220.00 这一数字中。成本随渲染速度设置而变化。

• Flux 3 Image —— 没有任何已发布内容,因为根本不存在。BFL 唯一的 Flux 3 定价是按秒计费的视频价格:HD 文本转视频 $0.17/秒,2K 为 $0.40/秒,4K 为 $0.80/秒,视频转视频在同一档位下分别为 $0.65/秒和 $0.95/秒。

• 可调用的替代方案——同一排行榜上的 FLUX.2 图像价格从 [dev] 的每 1,000 次 $12.00,到 [pro] 的 $30.00,再到 [max] 的 $70.00。如果你要在两个真实存在的选项之间做选择,这就是你会拿来与 Ideogram 4.5 对比的那条线,而按原始的每美元 Elo 计算,Ideogram 4.5 并不胜出:每 1,000 次 $100 对应 1,014 Elo,而 FLUX.2 [flex] 是 $60 对应 1,028。

这才是对整场对比的诚实表述。面对 BFL 实际提供的模型,Ideogram 4.5 既不是更强的生成器,也不更便宜。它是一个不同的产品,做了 FLUX.2 并未作为主打宣传的一件事,而其定价只有在那一件事正是你的瓶颈时才说得通。

Comparison scoreboard for Ideogram 4.5 and Flux 3. Left column 'Ideogram 4.5': live September 30 2026, editing rank 23 at 1,064 Elo, text-to-image rank 34 at 1,014 Elo, $0.03 to $0.22 per image, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'Flux 3 Image': no public endpoint, no model ID, no price, not on either leaderboard, non-destructive editing only roadmapped, callable alternative is FLUX.2. A footer reads 'Ideogram figures per Artificial Analysis; Flux 3 image status checked October 1, 2026.'

解读十周的空白期

7月23日的公告称,图像访问将在“早期访问阶段之后”开放,公司还表示早期访问将在“接下来的几周内”开启。现在是10月1日。在此期间,BFL 已将 Flux 3 Video 推向全面可用,将其扩展到 2K 和 4K,新增了用于视频生成的 MCP 服务器,发布了智能体技能,将视频续写上限设为 15 秒,为积分添加了自动充值,并发布了一个独立的开放权重动作模型。

那是一家在稳步交付产品的公司——只不过不是图像那一半。说得通的解读是,这是优先级排序,而不是遇到了麻烦:统一的多模态模型是个排序问题,视频是值得优先打出的差异化优势,而图像层级则是 BFL 已有在位产品(FLUX.2)的模态,推新会蚕食它。当前文档中“我们推荐将 FLUX.2 用于文生图”的自然解读是,图像层级还在等待轮到自己。

对买家而言,这意味着什么其实很简单。如果你今天就需要一款带有漂移宣称的编辑工具,那么 Ideogram 4.5 是两家实验室中唯一已交付的答案,而在展示该宣称所用的设置下,价格为每张图像 0.22 美元。如果你需要的是最强的原始生成器,那么这两者都不是合适的比较对象——竞技场上的领先者是 OpenAI 的 2.5 双雄,而在性价比一端则是 FLUX.2 [flex],每 1,000 张 60 美元。

在不押注于此的情况下进行评估

大多数团队实际面临的决定并不是“这两者中选哪一个”,因为只有一个。而是“对于一个已经能生成图像的技术栈来说,专门针对编辑场景,Ideogram 4.5 是否值得加入。”

这个测试成本很低,而且是唯一能验证该说法的测试:拿十张你当前流程处理得很差的图像,对每一张都用 Ideogram 4.5 跑同一套多轮编辑序列,然后把第一轮和第十轮做差异对比。测量发散程度。要按每次完成的编辑来计价,而不是按生成的图像计价,因为在大型源图上使用 High 档时,每一轮你都要付 0.22 美元。如果发散程度小到可以省去手动修复步骤,那么单靠这个工作流,该模型就已经回本了;如果不行,那么竞技场评分就是在告诉你真相:这个模型就其实际表现而言太贵了。

在你已在使用的模型旁边跑那项实验,正是需要路由层、而非再做一次直接集成的理由——一个端点、一把密钥就覆盖现有供应商和新进入者,按调用次数计费,不在其上额外加价,还有自动故障转移,这样一次专用模型的试用就不会拖垮生产路径。这是一种风险更低的方式,用来回答一个没有任何排行榜会替你回答的问题。

这将如何收场

Ideogram 4.5 是一次真实的发布,有真实的价格,也有一个至今无人能够证伪的说法。Flux 3 Image 是一个真实的路线图项目,但尚未发布,而且自其公布以来的十周里,除了那一个模态之外,每个模态都有已交付的工作。在图像质量上比较它们,就是在拿一个产品和一个计划作比较。

真正值得关注的不是下一份 Flux 3 发布说明——而是 BFL 是否会给图像层级附上一个端点、一个标识符和一个费率。如果会,这就会成为两家诊断出同一个问题的实验室之间一场真正的正面交锋。如果不会,Ideogram 4.5 便是针对多轮编辑漂移唯一已交付的答案,而它位居中游的竞技场排名,也会继续显得像一个不该用来评判它的数字。