
Grok Imagine Image 2.0: №4 в Artificial Analysis — за треть цены
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok Imagine Image 2.0 оказался на 4-м месте в рейтинге Text to Image Leaderboard от Artificial Analysis, и важное число — не сама позиция, а цена рядом с ней. Модель находится на 1 153,66 Elo, уступая трём позициям: GPT Image 2.5 Flare (max), GPT Image 2.5 Sunburst (max) и GPT Image 2 (high). Она опережает модели всех остальных лабораторий, включая MAI-Image-2.6 от Microsoft и модель Nano Banana 2. Таким образом, модель становится самым высокорейтинговым генератором изображений за пределами этой тройки и самым дешёвым в этой четвёрке с большим отрывом: Artificial Analysis оценивает её в $60 за 1 000 изображений против примерно $211 для трёх позиций выше. Сама модель — от 7 августа 2026 года; изменилось то, где её ставит независимый рейтинг, и то, как это влияет на формулировку «№2 в мире», которую производитель использовал на запуске.
Что на самом деле измеряет 4-е место
Text to Image Leaderboard от Artificial Analysis — это слепая арена человеческих предпочтений: голосующие видят результаты по одному и тому же запросу без названий моделей и выбирают лучший, а полученный Elo публикуется независимо от любого вендора. Позиция Grok Imagine Image 2.0 указана как №4 с 1 153,66 Elo и 95-процентным доверительным интервалом от 1 141,66 до 1 165,66. Ни одна из этих цифр не исходит от xAI. (Одна организационная деталь, которую стоит знать, когда вы смотрите на таблицу: Artificial Analysis указывает создателя модели как SpaceXAI.)
Ценовая половина истории — более интересная половина. На той же странице качество откладывается против цены с линией Парето, отмечающей модели, которые приносят больше всего Elo на доллар, и, согласно опубликованным самой таблицей лидеров цифрам, Grok Imagine Image 2.0 — модель с наивысшим баллом, цена которой менее $100 за 1000 изображений. Следующая за ней по качеству модель, GPT Image 2 (high), стоит $211 за 1000 — примерно в три с половиной раза дороже за приблизительно 17 дополнительных Elo. Это утверждение о соотношении цены и производительности, а не утверждение о том, что это лучшая модель, и именно эту версию истории действительно подтверждают независимые данные.
Позиция на переднем крае реальна, но узка, и об этом стоит сказать прямо. MAI-Image-2.6 от Microsoft находится на одну строчку ниже — $38.90 за 1 000, а Muse Image от Meta — $10 за 1 000 при 1 111 Elo. Интервалы Elo в этой таблице составляют около ±12 пунктов, поэтому #4 и #5 — с разницей в 6.5 Elo — попадают в пределы погрешностей друг друга. Воспринимайте это место как «первая пятёрка», а не как устоявшуюся позицию.
Подъём на 14 позиций — это разрыв с уровнем, на смену которому пришёл Grok Imagine Image 2.0. Предыдущий уровень качества xAI, grok-imagine-image-quality, занимает 18-е место в том же рейтинге с 1 043,21 Elo, а оригинальная grok-imagine-image — 29-е место с 1 017,86. Это примерно 110 Elo и 14 позиций рейтинга между моделью, которую xAI теперь указывает в документации как свою модель по умолчанию для изображений, и той, на смену которой она приходит.
Как сейчас обстоят дела с утверждением «мир №2»
На момент запуска xAI ссылалась на второе место в обоих рейтингах Arena — по генерации изображений из текста и по редактированию изображений — с результатом примерно 1 320 Elo и пометкой Preliminary. Это были цифры, которые xAI подчёркивала в своём собственном анонсе, а не независимая оценка, которую она заказала, — и с тех пор они изменились: снимок от 10 августа поставил модель на 3-е место с 1 316 Elo, позади MAI-Image-2.6 и GPT Image 2. Второе место в редактировании изображений по-прежнему остаётся собственной ссылкой xAI.
Artificial Analysis — это другой рейтинг с другой методикой и другой аудиторией голосующих, и теперь он ставит модель на #4. Эти два рейтинга на самом деле не противоречат друг другу — они по-разному замеряют человеческие предпочтения, и оба являются снимками рейтингов, которые меняются от недели к неделе. Честный итог шести недель независимого рейтингования таков: Grok Imagine Image 2.0 стабильно входит в топ-5 и так и не стал тем #2, о котором объявила xAI.
Что на самом деле поставляет Grok Imagine Image 2.0
xAI позиционирует Grok Imagine Image 2.0 как среду для редактирования, а не как очередной генератор, работающий по принципу одного запроса. Набор функций:
• Magic Wand — правки на уровне области, не затрагивающие остальную часть кадра
• Сегментация — точное выделение областей для цветокоррекции, замены или настройки
• Удаление фона — экспорт объекта с прозрачным фоном
• Ввод нескольких изображений — до пяти исходных изображений на одну правку; в документации xAI теперь указано пять, тогда как на момент запуска API допускал только три
• Smart Resize — перекомпоновывает одно изображение в 9 соотношений сторон (от вертикального 1:2 до горизонтального 2:1), создавая новое содержимое кадра вместо кадрирования
• Шаблоны — готовые сценарии для предметной фотосъёмки, портретных снимков, товарных карточек для e-commerce, игровых ассетов и маркетинговых постеров
API предоставляет настройки, которые потребительское приложение не отображает: соотношение сторон — включая 21:9 и 5:2, оба появившиеся в версии 2.0 — разрешение (1K по умолчанию, 2K опционально) и параметр качества со значениями low, medium или auto. На стороне потребителей модель поставляется как Quality Mode по умолчанию на grok.com/imagine, iOS и Android, а с 13 августа она также указана на платформе Runway, где присоединилась к моделям изображений и видео, которые Runway уже размещает. Эта запись в каталоге — заявление вендора и партнёра, а не независимая оценка, но она стала первым признаком стороннего распространения после запуска.
При рендеринге заголовочного текста xAI утверждает, что модель «планирует типографику и макет так, как это сделал бы дизайнер», сохраняя плотные многосоставные композиции нетронутыми и четко отображая мелкий текст. Она также сохраняет идентичность объекта и настройки при многошаговых итеративных правках.
Что показал первый независимый тест
Сравнение из шести промптов с одним сидом и без отбора лучших результатов с gpt-image-2 показало чёткое разделение, и ничто в новом месте в рейтинге этого не опровергает.
Grok побеждает:фотореализм и сохранение идентичности. Анатомия кистей рук на портрете была корректной: детализация кожи на уровне пор, подповерхностное рассеивание, естественный блик в глазах и контровой свет. В задаче на геометрический поворот на 45 градусов Grok удерживал идентичность лица выше порога ArcFace 0.5, тогда как gpt-image-2 отклонялся сильнее.
Grok проигрывает: критически важным для продакшена областям. На запрос заголовка для постера фильма на упрощённом китайском он выдал иероглифы традиционного китайского — это называют «жёстким дисквалификатором» для пайплайнов локализации и публикации. Запрос на стилистическое слияние в стиле акварели вернул фотореалистичное изображение лишь с лёгкой обработкой под живописную текстуру — «дисквалификация на уровне категории». Локальные правки выполнили все три запроса, но не сохранили вид из окна и неверно закрепили блик.
Сводка: Grok Imagine Image 2.0 «лидирует по фотореализму и сохранению идентичности, но отстаёт по надёжности редактирования, многоязычному тексту и истинному переносу стиля». Таблица лидеров усредняет предпочтения по тысячам слепых сравнений; она не может сказать, правильно ли модель отобразит ваш заголовок на китайском. Один тест с шестью промптами — тоже не совокупность доказательств, но из этих двух конкретный провал — более действенный сигнал для команды, выпускающей локализованные материалы.
API и математика ценообразования
Ситуация для разработчиков изменилась с момента запуска. grok-imagine-image-2.0 теперь является моделью, которую xAI документирует для генерации изображений, редактирования одного изображения и редактирования нескольких изображений, и именно её собственная страница моделей xAI рекомендует для работы с изображениями. Строка «доступ к API для разработчиков скоро появится» времён запуска исчезла со страниц моделей и цен поставщика.
• grok-imagine-image-2.0: от $0,04 за изображение, стоимость рассчитывается по фактически предоставленному качеству
• grok-imagine-image (1.0): 0,02 $ за изображение, на это не влияет указанное ниже изменение
• grok-imagine-image-quality: $0,05 за изображение, выводится из эксплуатации 2 ноября 2026 г.
Качество — это рычаг, влияющий на стоимость. Auto — значение по умолчанию, когда параметр не указан, — сейчас использует low для генерации и medium для редактирования, поэтому запрос на генерацию тарифицируется по низкому тарифу, а редактирование — по среднему. Фиксация low или medium делает счёт предсказуемым, а не зависящим от того, какой путь выберет сервис.
В последнем пункте указан крайний срок. В руководстве xAI по миграции сказано, что slug grok-imagine-image-quality выводится из эксплуатации 2 ноября 2026 года после 60-дневного уведомления, начавшегося 2 сентября. С этой даты slug продолжает разрешаться, но запросы обслуживаются через grok-imagine-image-2.0 с параметром quality, установленным в low, — это редирект для совместимости, а не полное отключение. Поскольку уровень low на $0,01 за изображение дешевле старого уровня quality при каждом разрешении, команды, которые ничего не меняют, увидят снижение цены и незаметное изменение качества результата. Осознанная миграция — с указанием grok-imagine-image-2.0 и фиксацией quality там, где важна стабильность результата, — это тот вариант, который вам нужен. Эта дата и поведение при редиректе взяты из собственной документации xAI — заявлено поставщиком, а не проверено независимо.
По сравнению с вариантами OpenAI это сравнение — в такой же степени разница в ценовой модели, как и разница в цене. gpt-image-2 имеет токенную цену — $8 за миллион входных токенов изображений и $30 за миллион выходных токенов изображений по опубликованным тарифам OpenAI — поэтому стоимость за изображение колеблется в зависимости от разрешения и детализации. Репрезентативная цифра Artificial Analysis в $211 за 1000 изображений для GPT Image 2 (high) против $60 у Grok — это тот самый разброс, выраженный одним числом. Фиксированная цена за изображение гораздо легче прогнозируется при масштабировании, и именно поэтому модель, занимающая четвёртое место, вообще заслуживает внимания.
Пробуем это, не рискуя всем пайплайном
Разумная реакция на Grok Imagine Image 2.0 по-прежнему такая: «попробуйте, но пока не связывайте себя обязательствами». Его позиция находится внутри перекрывающихся доверительных интервалов, одно независимое тестирование выявило реальные слабые места в локализованном тексте и переносе стиля, а xAI в ноябре выводит из обращения слаг под ним. Это как раз тот случай, когда нужна маршрутизация, а не прописывание прямой интеграции.
В OrcaRouter grok-imagine-image — модель генерации изображений от xAI в нашем каталоге — работает на том же OpenAI-совместимом эндпоинте, что и gpt-image-2, поэтому переключение между моделями изображений xAI и OpenAI — это всего лишь смена строки с названием модели: никакого второго договора, никакого нового SDK. OrcaRouter передаёт списочные цены провайдеров без наценки, поэтому снижение цены вендором вступает в силу здесь в тот же день, а автоматический фейловер может направлять ошибки, ограничения по частоте запросов или отказы к резервной модели, а не в ваш продакшн-контур. Одна честная оговорка, оставшаяся неизменной с момента исходного обзора: новейший уровень качества xAI — это отдельная позиция, отличная от модели Grok для изображений, уже присутствующей в нашем каталоге, поэтому проверяйте актуальный список моделей, а не исходите из предположения, что тот или иной вариант Grok доступен для маршрутизации сегодня.
Что посмотреть дальше
1. Миграция 2 ноября.Перейдут ли команды на grok-imagine-image-2.0 явно или же незаметно соскользнут на редирект с его низкокачественным значением по умолчанию — это самая крупная ошибка, которую xAI всё ещё может допустить с этой моделью, а редирект делает эту ошибку невидимой, если только вы не читаете поле model в своих ответах.
2. Удержится ли позиция №4. Разрыв с MAI-Image-2.6 составляет 6,5 Elo при интервалах ±12 пунктов, поэтому ещё несколько тысяч голосов могут изменить порядок в таблице в любую сторону. Прирост в 110 Elo относительно предыдущего уровня выглядит устойчивым; а вот точное место — нет.
3. Насколько полно потребительская поверхность охвачена API. Генерация, редактирование и редактирование нескольких изображений документированы. Шаблоны и именованный рабочий процесс Smart Resize остаются функциями приложения, и именно в этом разрыве и живёт оставшаяся оговорка «только для потребителей».
Итог: Grok Imagine Image 2.0 — это реальная, capable-модель, которая теперь независимо заняла 4-е место в рейтинге Text to Image Leaderboard от Artificial Analysis, став лучшей не-OpenAI моделью в нём, примерно на 110 Elo опередив уровень, который она заменила, и находится на границе цена-качество этого рейтинга при $60 за 1 000 изображений против примерно $211 у моделей OpenAI, стоящих непосредственно выше. Формулировка «второе место в мире» всегда была лишь стартовым снимком xAI, а независимые рейтинги никогда этого в точности не утверждали. Две её самые явные независимые слабости — соответствие для упрощённого китайского и надёжность переноса стиля — приходятся на функции, которые команды чаще всего требуют от API для изображений. Сразу протестируйте её для фотореалистичной работы с сохранением идентичности; повремените с ней для пайплайнов, которые выпускают локализованный текст или стилизованные ассеты, а если вы уже обращаетесь к выводимому из эксплуатации quality slug, перейдите до 2 ноября.
