
Ideogram 4.5 против GPT Image 2.5: Ideogram сам затеял этот бой
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 261 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 216 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- xAISpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Большинство сравнений моделей собирают те, кто их пишет. Это сравнение собралIdeogram. Стартовая страница Ideogram 4.5, работающая с 30 сентября 2026 года, показывает демонстрацию редактирования бок о бок и называет своих противников в подписи: «те же правки в Ideogram 4.5 в сравнении с GPT Image 2.5 Sunburst, Nano Banana Pro и Nano Banana 2». Затем она делает заявление о том, что увидит зритель, — «результаты GPT Image и Nano Banana становятся непригодными уже после нескольких правок, тогда как Ideogram 4.5 остаётся чистым правка за правкой».
Это на удивление прямолинейно. Когда вендор сам выбирает эталон для сравнения и заранее сообщает вам результат, к этому стоит отнестись серьёзно в одном смысле и скептически — в другом. GPT Image 2.5— сильнейшее решение в независимых таблицах в обеих категориях изображений, так что это подходящий противник. И это релиз с двумя идентификаторами — Flare и Sunburst, оба вышли 8 сентября 2026 года — с публичными оценками арены, которых Ideogram 4.5 на данный момент не достигает. Интересный вопрос не в том, кто побеждает на арене. А в том, измеряет ли заявление Ideogram то, что арена не измеряет.
Каковы именно позиции обеих моделей
• Ideogram 4.5 — выпущена 30 сентября 2026 года. Модель точного редактирования; генерация плюс редактирование на четырёх скоростях рендеринга; нативное разрешение 2K; редактирование продемонстрировано при исходном разрешении до 4 016 × 6 016 (24,2 МП). Генерация изображений по тексту — 34-е место из 167 с 1 014 ± 11 Elo (2 247 голосов); редактирование изображений — 23-е место с 1 064 ± 11 Elo (2 382 голоса). $0,03–$0,22 за изображение в зависимости от настройки скорости.
• GPT Image 2.5 Sunburst — выпущена 8 сентября 2026 года как ориентированная в первую очередь на точность часть раздельного обновления имиджевых моделей OpenAI, идентификатор API gpt-image-2.5-sunburst. Генерация изображений по тексту — № 1 с 1 197 ± 9 Elo (14 023 голоса); редактирование изображений — № 1 с 1 182 ± 8 Elo (17 899 голосов). Цена — $210,70 за 1 000 изображений по курсу пересчёта рейтинга.
• GPT Image 2.5 Flare — быстрая половина того же релиза, идентификатор gpt-image-2.5-flare. № 2 в обоих рейтингах: 1 190 текст-в-изображение, 1 162 редактирование. Те же $210,70 за 1 000.
Поставьте два числа по редактированию рядом — и разрыв составит 118 пунктов Elo: 1 182 против 1 064 — при доверительных интервалах ±8 и ±11. Интервалы не пересекаются. На табло, которое измеряет предпочтение при однократном редактировании, побеждает Sunburst, и побеждает, имея за собой примерно в семь с половиной раз больше голосов.
Что таблица лидеров измеряет, а что — нет
Это та часть, от которой зависит, выдержит ли утверждение Ideogram столкновение с доказательствами.
Арена редактирования Artificial Analysis — это слепое попарное сравнение человеческих предпочтений: голосующие видят одно и то же исходное изображение и одну и ту же инструкцию, получают два отредактированных результата без меток и выбирают лучший. Это сильный метод для ответа на вопрос «какой из этих двух результатов больше похож на то, что требовалось в инструкции».
Она не может измерить то, что рекламирует Ideogram. Голосующий, оценивающий одну правку, не может увидеть, изменила ли модель незаметно обои, сдвинула ли лицо на два миллиметра или заново отрендерила зерно по остальной части кадра. Недостаток, который Ideogram заявляет, что исправляет, становится заметен только на последовательности — четвёртый ход, седьмой ход, десятый ход, — а ни одна мейнстримная арена не показывает последовательности голосующим. Оценка в 1 064 Elo говорит, что отдельные правки Ideogram хороши. Она совсем ничего не говорит о том, остаются ли они хорошими.
Для Ideogram это работает в обе стороны, и честная версия такова: таблица лидеров не подтверждает утверждение о дрейфе и также не опровергает его. Что она действительно опровергает — так это неявное более сильное утверждение, которое читатель мог бы вынести со страницы запуска: что 4.5 — лучший редактор, и точка. По сравнению с таблицей лидеров он является редактором с более низким рейтингом, причём с отрывом, превышающим его планки погрешностей.

Что делает каждый из них, чего не делает другой
• Редактирование в исходном разрешении — отличительное инженерное утверждение Ideogram 4.5. На его странице показано редактирование, применённое к исходному изображению 4 016 × 6 016 без понижения разрешения, с обещанием, что граница редактирования сохраняется достаточно хорошо, чтобы сшить вырезанный фрагмент обратно в оригинал. Для печатной работы это разница между готовым результатом и компромиссом.
• Широта набора параметров — у GPT Image 2.5. OpenAI добавила xhigh и max в линейку качества и сделала прозрачный фон полноценным параметром: background задаётся как transparent, opaque или auto, а вывод — в PNG или WebP. Прозрачный вывод был пробелом в GPT Image 2 и стал одной из главных возможностей пары 2.5.
• Скоростная полоса — Flare существует специально для того, чтобы быть быстрым выбором по умолчанию. OpenAI заявляет о снижении задержки до 50% по сравнению с предыдущим поколением; Sunburst намеренно медленнее и нацелен на правки, которые должны выдержать придирчивую проверку.
• Структура цены — Ideogram тарифицирует за изображение в зависимости от скорости рендеринга ($0,03–$0,22). OpenAI тарифицирует по токенам по той же тарифной сетке, что и GPT Image 2 — $8 за миллион входных токенов изображения, $30 за миллион выходных токенов изображения — поэтому независимый пересчёт на одно изображение даёт около $0,21 для высококачественного 1024 × 1024.
Ценовые линии пересекаются в неудобном месте. На низкой и средней настройках Ideogram 4.5 цена за изображение значительно ниже, чем у пары OpenAI. На высокой настройке — той, где живёт демонстрация дрейфа и где вы бы запускали 24-мегапиксельный исходник — эти двое близки к одному и тому же значению. Сравнение, которое большинство покупателей фактически проведут, — это высококачественный Ideogram 4.5 против высококачественного Sunburst, и в этом сравнении цены примерно равны, при отставании в 118 пунктов Elo по таблице измерений.
Что ж, это нормально, если утверждение о дрейфе верно. В этом вся ставка.


Разница в доступности, которую никто не рекламирует
Одна практическая асимметрия работает в противоположную от турнирной таблицы сторону. Два идентификатора GPT Image 2.5 новее, чем всё, что есть в каталоге OrcaRouter, — наша линейка OpenAI для изображений сегодня представлена GPT-Image-1.5 по цене $8/$32 за миллион токенов и GPT-Image-2 по $8/$30, обе по прайс-листовой цене провайдера без наценки, добавленной сверху. Пара 2.5 появилась в тарифной сетке OpenAI по той же цене $8/$30, что и GPT-Image-2, а значит, как только они станут доступны для маршрутизации, они попадут по той же сквозной цене, а не по новой, и вопрос стоимости между ними сводится к эффективности токенов, а не к тому, к какому поставщику вы обращаетесь.
Ideogram 4.5 доступна в собственном API Ideogram и на партнёрских платформах. В нашем каталоге её нет. Для сравнения это важно довольно прозаичным образом: одна из этих двух моделей — готовая замена для клиента, совместимого с OpenAI, а другая — новая интеграция. Если вы уже обращаетесь к GPT-Image-2 через эндпоинт в стиле OpenAI, цена попытки попробовать Sunburst — смена идентификатора модели; цена попытки попробовать Ideogram 4.5 — второй контракт и второй клиент, ещё до того, как вы вообще перейдёте к оценке качества.
Слой маршрутизации не устраняет это различие — он лишь убирает обвязку со стороны, которая уже совместима, и позволяет направить часть трафика на нового участника, не привязывая к нему производственный путь. Аварийное переключение здесь важнее, чем обычно, потому что то, что вы бы тестировали, — это модель, чьё ключевое утверждение не имеет независимой проверки, а размеры выборок составляют одну пятую от выборок её конкурента.
Как это уладить
Не проводите это сравнение на отдельных изображениях. Это метод арены, и это не тот инструмент — он скажет вам, что побеждает Sunburst, о чём вы и так уже знали.
Прогоните это на последовательностях. Возьмите пять или десять изображений из своих собственных работ, составьте одну и ту же цепочку из шести или восьми последовательных правок и выполните идентичную цепочку на Ideogram 4.5 (High) и на Sunburst (max). Затем сравните первый шаг с восьмым для каждой модели в тех областях, которые вы никогда не просили модель трогать. Посчитайте пиксели, которые изменились. Это число — расхождение в неизменённых областях на протяжении последовательности — именно то, по чему Ideogram заявляет о победе, и, насколько мне известно, никто не публикует его ни для одной из моделей.
Затем рассчитайте стоимость обоих прогонов в расчёте на одну завершённую последовательность. В этот момент у вас будет ответ, который стоит больше, чем 118 Elo, потому что он будет о ваших изображениях, а не о мнении панели голосующих.
Что на самом деле представляет собой этот матчап
Ideogram 4.5 не стала участвовать в конкурсе, который выигрывает в таблицах лидеров, и, похоже, знает об этом — поэтому на странице запуска демонстрируется поведение, а не выводится ранг. Демонстрируемое поведение достаточно реально, чтобы его стоило протестировать, и достаточно конкретно, чтобы его можно было опровергнуть: либо повторные правки согласуются между собой, либо нет, а тест из десяти итераций на ваших собственных файлах решает это за полдня.
Разумная интерпретация сегодня такова: GPT Image 2.5 Sunburst — лучший редактор по единственной существующей независимой метрике, с отрывом за пределами погрешности и с гораздо большим объёмом доказательств, стоящих за этой цифрой, — а Ideogram 4.5 продаёт более узкое, неизмеренное свойство по цене, которая ниже при низких настройках и примерно равна при той настройке, от которой зависит его заявление. Если многоходовая точность — ваше узкое место в продакшене, тест дёшев, и модель его заслуживает. Если нет — лидерборд уже ответил.
