Титульная карточка для Ideogram 4.5 против GPT Image 2.5 с текстом «разрыв в 97 Elo при редактировании — и вендор назвал соперника», с чипами для «Ideogram 4.5 — доступно с 30 сентября 2026», «GPT Image 2.5 Sunburst — доступно с 8 сентября 2026», «Ideogram 4.5 — Elo за редактирование 1 064», «Sunburst — Elo за редактирование 1 182». Логотип OrcaRouter скомпонован в правом нижнем углу.
Guides & Insights

Ideogram 4.5 против GPT Image 2.5: Ideogram сам затеял этот бой

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Большинство сравнений моделей собирают те, кто их пишет. Это сравнение собралIdeogram. Стартовая страница Ideogram 4.5, работающая с 30 сентября 2026 года, показывает демонстрацию редактирования бок о бок и называет своих противников в подписи: «те же правки в Ideogram 4.5 в сравнении с GPT Image 2.5 Sunburst, Nano Banana Pro и Nano Banana 2». Затем она делает заявление о том, что увидит зритель, — «результаты GPT Image и Nano Banana становятся непригодными уже после нескольких правок, тогда как Ideogram 4.5 остаётся чистым правка за правкой».

Это на удивление прямолинейно. Когда вендор сам выбирает эталон для сравнения и заранее сообщает вам результат, к этому стоит отнестись серьёзно в одном смысле и скептически — в другом. GPT Image 2.5— сильнейшее решение в независимых таблицах в обеих категориях изображений, так что это подходящий противник. И это релиз с двумя идентификаторами — Flare и Sunburst, оба вышли 8 сентября 2026 года — с публичными оценками арены, которых Ideogram 4.5 на данный момент не достигает. Интересный вопрос не в том, кто побеждает на арене. А в том, измеряет ли заявление Ideogram то, что арена не измеряет.

Каковы именно позиции обеих моделей

• Ideogram 4.5 — выпущена 30 сентября 2026 года. Модель точного редактирования; генерация плюс редактирование на четырёх скоростях рендеринга; нативное разрешение 2K; редактирование продемонстрировано при исходном разрешении до 4 016 × 6 016 (24,2 МП). Генерация изображений по тексту — 34-е место из 167 с 1 014 ± 11 Elo (2 247 голосов); редактирование изображений — 23-е место с 1 064 ± 11 Elo (2 382 голоса). $0,03–$0,22 за изображение в зависимости от настройки скорости.

• GPT Image 2.5 Sunburst — выпущена 8 сентября 2026 года как ориентированная в первую очередь на точность часть раздельного обновления имиджевых моделей OpenAI, идентификатор API gpt-image-2.5-sunburst. Генерация изображений по тексту — № 1 с 1 197 ± 9 Elo (14 023 голоса); редактирование изображений — № 1 с 1 182 ± 8 Elo (17 899 голосов). Цена — $210,70 за 1 000 изображений по курсу пересчёта рейтинга.

• GPT Image 2.5 Flare — быстрая половина того же релиза, идентификатор gpt-image-2.5-flare. № 2 в обоих рейтингах: 1 190 текст-в-изображение, 1 162 редактирование. Те же $210,70 за 1 000.

Поставьте два числа по редактированию рядом — и разрыв составит 118 пунктов Elo: 1 182 против 1 064 — при доверительных интервалах ±8 и ±11. Интервалы не пересекаются. На табло, которое измеряет предпочтение при однократном редактировании, побеждает Sunburst, и побеждает, имея за собой примерно в семь с половиной раз больше голосов.

Что таблица лидеров измеряет, а что — нет

Это та часть, от которой зависит, выдержит ли утверждение Ideogram столкновение с доказательствами.

Арена редактирования Artificial Analysis — это слепое попарное сравнение человеческих предпочтений: голосующие видят одно и то же исходное изображение и одну и ту же инструкцию, получают два отредактированных результата без меток и выбирают лучший. Это сильный метод для ответа на вопрос «какой из этих двух результатов больше похож на то, что требовалось в инструкции».

Она не может измерить то, что рекламирует Ideogram. Голосующий, оценивающий одну правку, не может увидеть, изменила ли модель незаметно обои, сдвинула ли лицо на два миллиметра или заново отрендерила зерно по остальной части кадра. Недостаток, который Ideogram заявляет, что исправляет, становится заметен только на последовательности — четвёртый ход, седьмой ход, десятый ход, — а ни одна мейнстримная арена не показывает последовательности голосующим. Оценка в 1 064 Elo говорит, что отдельные правки Ideogram хороши. Она совсем ничего не говорит о том, остаются ли они хорошими.

Для Ideogram это работает в обе стороны, и честная версия такова: таблица лидеров не подтверждает утверждение о дрейфе и также не опровергает его. Что она действительно опровергает — так это неявное более сильное утверждение, которое читатель мог бы вынести со страницы запуска: что 4.5 — лучший редактор, и точка. По сравнению с таблицей лидеров он является редактором с более низким рейтингом, причём с отрывом, превышающим его планки погрешностей.

Screenshot of the Ideogram 4.5 model page showing the model-comparison section headed 'Compare models across multi-turn edits', with a side-by-side video widget captioned to show the same edits applied to Ideogram 4.5 alongside GPT Image 2.5 Sunburst, Nano Banana Pro and Nano Banana 2

Что делает каждый из них, чего не делает другой

• Редактирование в исходном разрешении — отличительное инженерное утверждение Ideogram 4.5. На его странице показано редактирование, применённое к исходному изображению 4 016 × 6 016 без понижения разрешения, с обещанием, что граница редактирования сохраняется достаточно хорошо, чтобы сшить вырезанный фрагмент обратно в оригинал. Для печатной работы это разница между готовым результатом и компромиссом.

• Широта набора параметров — у GPT Image 2.5. OpenAI добавила xhigh и max в линейку качества и сделала прозрачный фон полноценным параметром: background задаётся как transparent, opaque или auto, а вывод — в PNG или WebP. Прозрачный вывод был пробелом в GPT Image 2 и стал одной из главных возможностей пары 2.5.

• Скоростная полоса — Flare существует специально для того, чтобы быть быстрым выбором по умолчанию. OpenAI заявляет о снижении задержки до 50% по сравнению с предыдущим поколением; Sunburst намеренно медленнее и нацелен на правки, которые должны выдержать придирчивую проверку.

• Структура цены — Ideogram тарифицирует за изображение в зависимости от скорости рендеринга ($0,03–$0,22). OpenAI тарифицирует по токенам по той же тарифной сетке, что и GPT Image 2 — $8 за миллион входных токенов изображения, $30 за миллион выходных токенов изображения — поэтому независимый пересчёт на одно изображение даёт около $0,21 для высококачественного 1024 × 1024.

Ценовые линии пересекаются в неудобном месте. На низкой и средней настройках Ideogram 4.5 цена за изображение значительно ниже, чем у пары OpenAI. На высокой настройке — той, где живёт демонстрация дрейфа и где вы бы запускали 24-мегапиксельный исходник — эти двое близки к одному и тому же значению. Сравнение, которое большинство покупателей фактически проведут, — это высококачественный Ideogram 4.5 против высококачественного Sunburst, и в этом сравнении цены примерно равны, при отставании в 118 пунктов Elo по таблице измерений.

Что ж, это нормально, если утверждение о дрейфе верно. В этом вся ставка.

Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.Comparison scoreboard for Ideogram 4.5 and GPT Image 2.5 Sunburst. Left column 'Ideogram 4.5': live Sep 30 2026, editing rank 23 at 1,064 Elo from 2,382 votes, text-to-image rank 34 at 1,014 Elo, $0.03 to $0.22 per image, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'GPT Image 2.5 Sunburst': live Sep 8 2026, editing rank 1 at 1,182 Elo from 17,899 votes, text-to-image rank 1 at 1,197 Elo, $210.70 per 1,000 images, transparent background output, quality ladder through max. A footer reads 'All leaderboard figures per Artificial Analysis, October 2026; price conversions are the board's own.'

Разница в доступности, которую никто не рекламирует

Одна практическая асимметрия работает в противоположную от турнирной таблицы сторону. Два идентификатора GPT Image 2.5 новее, чем всё, что есть в каталоге OrcaRouter, — наша линейка OpenAI для изображений сегодня представлена GPT-Image-1.5 по цене $8/$32 за миллион токенов и GPT-Image-2 по $8/$30, обе по прайс-листовой цене провайдера без наценки, добавленной сверху. Пара 2.5 появилась в тарифной сетке OpenAI по той же цене $8/$30, что и GPT-Image-2, а значит, как только они станут доступны для маршрутизации, они попадут по той же сквозной цене, а не по новой, и вопрос стоимости между ними сводится к эффективности токенов, а не к тому, к какому поставщику вы обращаетесь.

Ideogram 4.5 доступна в собственном API Ideogram и на партнёрских платформах. В нашем каталоге её нет. Для сравнения это важно довольно прозаичным образом: одна из этих двух моделей — готовая замена для клиента, совместимого с OpenAI, а другая — новая интеграция. Если вы уже обращаетесь к GPT-Image-2 через эндпоинт в стиле OpenAI, цена попытки попробовать Sunburst — смена идентификатора модели; цена попытки попробовать Ideogram 4.5 — второй контракт и второй клиент, ещё до того, как вы вообще перейдёте к оценке качества.

Слой маршрутизации не устраняет это различие — он лишь убирает обвязку со стороны, которая уже совместима, и позволяет направить часть трафика на нового участника, не привязывая к нему производственный путь. Аварийное переключение здесь важнее, чем обычно, потому что то, что вы бы тестировали, — это модель, чьё ключевое утверждение не имеет независимой проверки, а размеры выборок составляют одну пятую от выборок её конкурента.

Как это уладить

Не проводите это сравнение на отдельных изображениях. Это метод арены, и это не тот инструмент — он скажет вам, что побеждает Sunburst, о чём вы и так уже знали.

Прогоните это на последовательностях. Возьмите пять или десять изображений из своих собственных работ, составьте одну и ту же цепочку из шести или восьми последовательных правок и выполните идентичную цепочку на Ideogram 4.5 (High) и на Sunburst (max). Затем сравните первый шаг с восьмым для каждой модели в тех областях, которые вы никогда не просили модель трогать. Посчитайте пиксели, которые изменились. Это число — расхождение в неизменённых областях на протяжении последовательности — именно то, по чему Ideogram заявляет о победе, и, насколько мне известно, никто не публикует его ни для одной из моделей.

Затем рассчитайте стоимость обоих прогонов в расчёте на одну завершённую последовательность. В этот момент у вас будет ответ, который стоит больше, чем 118 Elo, потому что он будет о ваших изображениях, а не о мнении панели голосующих.

Что на самом деле представляет собой этот матчап

Ideogram 4.5 не стала участвовать в конкурсе, который выигрывает в таблицах лидеров, и, похоже, знает об этом — поэтому на странице запуска демонстрируется поведение, а не выводится ранг. Демонстрируемое поведение достаточно реально, чтобы его стоило протестировать, и достаточно конкретно, чтобы его можно было опровергнуть: либо повторные правки согласуются между собой, либо нет, а тест из десяти итераций на ваших собственных файлах решает это за полдня.

Разумная интерпретация сегодня такова: GPT Image 2.5 Sunburst — лучший редактор по единственной существующей независимой метрике, с отрывом за пределами погрешности и с гораздо большим объёмом доказательств, стоящих за этой цифрой, — а Ideogram 4.5 продаёт более узкое, неизмеренное свойство по цене, которая ниже при низких настройках и примерно равна при той настройке, от которой зависит его заявление. Если многоходовая точность — ваше узкое место в продакшене, тест дёшев, и модель его заслуживает. Если нет — лидерборд уже ответил.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube