Заглавная карточка для Grok Imagine Image 2.0 с текстом 'Grok Imagine Image 2.0 — #2 в text-to-image Arena, точное редактирование, теперь доступно в приложениях Grok' с подписью 'Анонсировано 7 августа 2026 года xAI' и плоской иконкой редактирования в виде фоторамки с ручкой.
Guides & Insights

Grok Imagine Image 2.0: №4 в Artificial Analysis — за треть цены

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Grok Imagine Image 2.0 оказался на 4-м месте в рейтинге Text to Image Leaderboard от Artificial Analysis, и важное число — не сама позиция, а цена рядом с ней. Модель находится на 1 153,66 Elo, уступая трём позициям: GPT Image 2.5 Flare (max), GPT Image 2.5 Sunburst (max) и GPT Image 2 (high). Она опережает модели всех остальных лабораторий, включая MAI-Image-2.6 от Microsoft и модель Nano Banana 2. Таким образом, модель становится самым высокорейтинговым генератором изображений за пределами этой тройки и самым дешёвым в этой четвёрке с большим отрывом: Artificial Analysis оценивает её в $60 за 1 000 изображений против примерно $211 для трёх позиций выше. Сама модель — от 7 августа 2026 года; изменилось то, где её ставит независимый рейтинг, и то, как это влияет на формулировку «№2 в мире», которую производитель использовал на запуске.

Что на самом деле измеряет 4-е место

Text to Image Leaderboard от Artificial Analysis — это слепая арена человеческих предпочтений: голосующие видят результаты по одному и тому же запросу без названий моделей и выбирают лучший, а полученный Elo публикуется независимо от любого вендора. Позиция Grok Imagine Image 2.0 указана как №4 с 1 153,66 Elo и 95-процентным доверительным интервалом от 1 141,66 до 1 165,66. Ни одна из этих цифр не исходит от xAI. (Одна организационная деталь, которую стоит знать, когда вы смотрите на таблицу: Artificial Analysis указывает создателя модели как SpaceXAI.)

Ценовая половина истории — более интересная половина. На той же странице качество откладывается против цены с линией Парето, отмечающей модели, которые приносят больше всего Elo на доллар, и, согласно опубликованным самой таблицей лидеров цифрам, Grok Imagine Image 2.0 — модель с наивысшим баллом, цена которой менее $100 за 1000 изображений. Следующая за ней по качеству модель, GPT Image 2 (high), стоит $211 за 1000 — примерно в три с половиной раза дороже за приблизительно 17 дополнительных Elo. Это утверждение о соотношении цены и производительности, а не утверждение о том, что это лучшая модель, и именно эту версию истории действительно подтверждают независимые данные.

Позиция на переднем крае реальна, но узка, и об этом стоит сказать прямо. MAI-Image-2.6 от Microsoft находится на одну строчку ниже — $38.90 за 1 000, а Muse Image от Meta — $10 за 1 000 при 1 111 Elo. Интервалы Elo в этой таблице составляют около ±12 пунктов, поэтому #4 и #5 — с разницей в 6.5 Elo — попадают в пределы погрешностей друг друга. Воспринимайте это место как «первая пятёрка», а не как устоявшуюся позицию.

Подъём на 14 позиций — это разрыв с уровнем, на смену которому пришёл Grok Imagine Image 2.0. Предыдущий уровень качества xAI, grok-imagine-image-quality, занимает 18-е место в том же рейтинге с 1 043,21 Elo, а оригинальная grok-imagine-image — 29-е место с 1 017,86. Это примерно 110 Elo и 14 позиций рейтинга между моделью, которую xAI теперь указывает в документации как свою модель по умолчанию для изображений, и той, на смену которой она приходит.

Как сейчас обстоят дела с утверждением «мир №2»

На момент запуска xAI ссылалась на второе место в обоих рейтингах Arena — по генерации изображений из текста и по редактированию изображений — с результатом примерно 1 320 Elo и пометкой Preliminary. Это были цифры, которые xAI подчёркивала в своём собственном анонсе, а не независимая оценка, которую она заказала, — и с тех пор они изменились: снимок от 10 августа поставил модель на 3-е место с 1 316 Elo, позади MAI-Image-2.6 и GPT Image 2. Второе место в редактировании изображений по-прежнему остаётся собственной ссылкой xAI.

Artificial Analysis — это другой рейтинг с другой методикой и другой аудиторией голосующих, и теперь он ставит модель на #4. Эти два рейтинга на самом деле не противоречат друг другу — они по-разному замеряют человеческие предпочтения, и оба являются снимками рейтингов, которые меняются от недели к неделе. Честный итог шести недель независимого рейтингования таков: Grok Imagine Image 2.0 стабильно входит в топ-5 и так и не стал тем #2, о котором объявила xAI.

Что на самом деле поставляет Grok Imagine Image 2.0

xAI позиционирует Grok Imagine Image 2.0 как среду для редактирования, а не как очередной генератор, работающий по принципу одного запроса. Набор функций:

Magic Wand — правки на уровне области, не затрагивающие остальную часть кадра

Сегментация — точное выделение областей для цветокоррекции, замены или настройки

Удаление фона — экспорт объекта с прозрачным фоном

Ввод нескольких изображений — до пяти исходных изображений на одну правку; в документации xAI теперь указано пять, тогда как на момент запуска API допускал только три

Smart Resize — перекомпоновывает одно изображение в 9 соотношений сторон (от вертикального 1:2 до горизонтального 2:1), создавая новое содержимое кадра вместо кадрирования

Шаблоны — готовые сценарии для предметной фотосъёмки, портретных снимков, товарных карточек для e-commerce, игровых ассетов и маркетинговых постеров

API предоставляет настройки, которые потребительское приложение не отображает: соотношение сторон — включая 21:9 и 5:2, оба появившиеся в версии 2.0 — разрешение (1K по умолчанию, 2K опционально) и параметр качества со значениями low, medium или auto. На стороне потребителей модель поставляется как Quality Mode по умолчанию на grok.com/imagine, iOS и Android, а с 13 августа она также указана на платформе Runway, где присоединилась к моделям изображений и видео, которые Runway уже размещает. Эта запись в каталоге — заявление вендора и партнёра, а не независимая оценка, но она стала первым признаком стороннего распространения после запуска.

При рендеринге заголовочного текста xAI утверждает, что модель «планирует типографику и макет так, как это сделал бы дизайнер», сохраняя плотные многосоставные композиции нетронутыми и четко отображая мелкий текст. Она также сохраняет идентичность объекта и настройки при многошаговых итеративных правках.

Что показал первый независимый тест

Сравнение из шести промптов с одним сидом и без отбора лучших результатов с gpt-image-2 показало чёткое разделение, и ничто в новом месте в рейтинге этого не опровергает.

Grok побеждает:фотореализм и сохранение идентичности. Анатомия кистей рук на портрете была корректной: детализация кожи на уровне пор, подповерхностное рассеивание, естественный блик в глазах и контровой свет. В задаче на геометрический поворот на 45 градусов Grok удерживал идентичность лица выше порога ArcFace 0.5, тогда как gpt-image-2 отклонялся сильнее.

Grok проигрывает: критически важным для продакшена областям. На запрос заголовка для постера фильма на упрощённом китайском он выдал иероглифы традиционного китайского — это называют «жёстким дисквалификатором» для пайплайнов локализации и публикации. Запрос на стилистическое слияние в стиле акварели вернул фотореалистичное изображение лишь с лёгкой обработкой под живописную текстуру — «дисквалификация на уровне категории». Локальные правки выполнили все три запроса, но не сохранили вид из окна и неверно закрепили блик.

Сводка: Grok Imagine Image 2.0 «лидирует по фотореализму и сохранению идентичности, но отстаёт по надёжности редактирования, многоязычному тексту и истинному переносу стиля». Таблица лидеров усредняет предпочтения по тысячам слепых сравнений; она не может сказать, правильно ли модель отобразит ваш заголовок на китайском. Один тест с шестью промптами — тоже не совокупность доказательств, но из этих двух конкретный провал — более действенный сигнал для команды, выпускающей локализованные материалы.

API и математика ценообразования

Ситуация для разработчиков изменилась с момента запуска. grok-imagine-image-2.0 теперь является моделью, которую xAI документирует для генерации изображений, редактирования одного изображения и редактирования нескольких изображений, и именно её собственная страница моделей xAI рекомендует для работы с изображениями. Строка «доступ к API для разработчиков скоро появится» времён запуска исчезла со страниц моделей и цен поставщика.

• grok-imagine-image-2.0: от $0,04 за изображение, стоимость рассчитывается по фактически предоставленному качеству

• grok-imagine-image (1.0): 0,02 $ за изображение, на это не влияет указанное ниже изменение

• grok-imagine-image-quality: $0,05 за изображение, выводится из эксплуатации 2 ноября 2026 г.

Качество — это рычаг, влияющий на стоимость. Auto — значение по умолчанию, когда параметр не указан, — сейчас использует low для генерации и medium для редактирования, поэтому запрос на генерацию тарифицируется по низкому тарифу, а редактирование — по среднему. Фиксация low или medium делает счёт предсказуемым, а не зависящим от того, какой путь выберет сервис.

В последнем пункте указан крайний срок. В руководстве xAI по миграции сказано, что slug grok-imagine-image-quality выводится из эксплуатации 2 ноября 2026 года после 60-дневного уведомления, начавшегося 2 сентября. С этой даты slug продолжает разрешаться, но запросы обслуживаются через grok-imagine-image-2.0 с параметром quality, установленным в low, — это редирект для совместимости, а не полное отключение. Поскольку уровень low на $0,01 за изображение дешевле старого уровня quality при каждом разрешении, команды, которые ничего не меняют, увидят снижение цены и незаметное изменение качества результата. Осознанная миграция — с указанием grok-imagine-image-2.0 и фиксацией quality там, где важна стабильность результата, — это тот вариант, который вам нужен. Эта дата и поведение при редиректе взяты из собственной документации xAI — заявлено поставщиком, а не проверено независимо.

По сравнению с вариантами OpenAI это сравнение — в такой же степени разница в ценовой модели, как и разница в цене. gpt-image-2 имеет токенную цену — $8 за миллион входных токенов изображений и $30 за миллион выходных токенов изображений по опубликованным тарифам OpenAI — поэтому стоимость за изображение колеблется в зависимости от разрешения и детализации. Репрезентативная цифра Artificial Analysis в $211 за 1000 изображений для GPT Image 2 (high) против $60 у Grok — это тот самый разброс, выраженный одним числом. Фиксированная цена за изображение гораздо легче прогнозируется при масштабировании, и именно поэтому модель, занимающая четвёртое место, вообще заслуживает внимания.

Пробуем это, не рискуя всем пайплайном

Разумная реакция на Grok Imagine Image 2.0 по-прежнему такая: «попробуйте, но пока не связывайте себя обязательствами». Его позиция находится внутри перекрывающихся доверительных интервалов, одно независимое тестирование выявило реальные слабые места в локализованном тексте и переносе стиля, а xAI в ноябре выводит из обращения слаг под ним. Это как раз тот случай, когда нужна маршрутизация, а не прописывание прямой интеграции.

В OrcaRouter grok-imagine-image — модель генерации изображений от xAI в нашем каталоге — работает на том же OpenAI-совместимом эндпоинте, что и gpt-image-2, поэтому переключение между моделями изображений xAI и OpenAI — это всего лишь смена строки с названием модели: никакого второго договора, никакого нового SDK. OrcaRouter передаёт списочные цены провайдеров без наценки, поэтому снижение цены вендором вступает в силу здесь в тот же день, а автоматический фейловер может направлять ошибки, ограничения по частоте запросов или отказы к резервной модели, а не в ваш продакшн-контур. Одна честная оговорка, оставшаяся неизменной с момента исходного обзора: новейший уровень качества xAI — это отдельная позиция, отличная от модели Grok для изображений, уже присутствующей в нашем каталоге, поэтому проверяйте актуальный список моделей, а не исходите из предположения, что тот или иной вариант Grok доступен для маршрутизации сегодня.

Что посмотреть дальше

1. Миграция 2 ноября.Перейдут ли команды на grok-imagine-image-2.0 явно или же незаметно соскользнут на редирект с его низкокачественным значением по умолчанию — это самая крупная ошибка, которую xAI всё ещё может допустить с этой моделью, а редирект делает эту ошибку невидимой, если только вы не читаете поле model в своих ответах.

2. Удержится ли позиция №4. Разрыв с MAI-Image-2.6 составляет 6,5 Elo при интервалах ±12 пунктов, поэтому ещё несколько тысяч голосов могут изменить порядок в таблице в любую сторону. Прирост в 110 Elo относительно предыдущего уровня выглядит устойчивым; а вот точное место — нет.

3. Насколько полно потребительская поверхность охвачена API. Генерация, редактирование и редактирование нескольких изображений документированы. Шаблоны и именованный рабочий процесс Smart Resize остаются функциями приложения, и именно в этом разрыве и живёт оставшаяся оговорка «только для потребителей».

Итог: Grok Imagine Image 2.0 — это реальная, capable-модель, которая теперь независимо заняла 4-е место в рейтинге Text to Image Leaderboard от Artificial Analysis, став лучшей не-OpenAI моделью в нём, примерно на 110 Elo опередив уровень, который она заменила, и находится на границе цена-качество этого рейтинга при $60 за 1 000 изображений против примерно $211 у моделей OpenAI, стоящих непосредственно выше. Формулировка «второе место в мире» всегда была лишь стартовым снимком xAI, а независимые рейтинги никогда этого в точности не утверждали. Две её самые явные независимые слабости — соответствие для упрощённого китайского и надёжность переноса стиля — приходятся на функции, которые команды чаще всего требуют от API для изображений. Сразу протестируйте её для фотореалистичной работы с сохранением идентичности; повремените с ней для пайплайнов, которые выпускают локализованный текст или стилизованные ассеты, а если вы уже обращаетесь к выводимому из эксплуатации quality slug, перейдите до 2 ноября.