
Vidu Q4 Preview против Grok Imagine Video: модель, которая возглавляла арену в январе, сейчас на девятом месте
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Три числа описывают это противостояние, и ни одно из них не является технической спецификацией. В рейтинге image-to-video от Artificial Analysis Vidu Q4 Previewзанимает третье место с результатом 1 179, и позади него 5 543 голоса. Grok Imagine Video 1.5на девятом месте с 1 098. Январская сборка Grok Imagine Video 2026 года, всё ещё указанная в списке и всё ещё вызываемая под своим именем, занимает четырнадцатое место с 1 072 — а две позиции Grok стоят $8,40 и $4,20 за минуту соответственно, то есть более новая обходится ровно вдвое дороже за двадцать шесть дополнительных пунктов Elo.
Vidu Q4 Preview — это одна сборка, выпущенная 7 октября 2026 года компанией Shengshu Technology в качестве первого публичного превью перед полной моделью Q4, в двух режимах: Image-to-Video и Reference-to-Video. Grok Imagine Video — это семейство как минимум из трёх позиций на двух таблицах лидеров. По сути, это сравнение о том, что происходит с позицией в таблице лидеров за девять месяцев, и релиз Vidu — это то, что появилось, чтобы подкрепить этот тезис.
Две сборки одной и той же модели, разница — двадцать шесть пунктов Эло.
Artificial Analysis, прочитано 8 октября 2026 г., звук сохранён, таблица image-to-video (AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3-е место, 1 179 ±10, 5 543 сэмпла, окт. 2026, $7,20/мин
• Grok Imagine Video 1.5 — 9-е место, 1 098 ±8, 5 267 образцов, май 2026, 8,40 $/мин
• grok-imagine-video — 14-е место, 1 072 ±7, 14 371 образец, янв. 2026, $4,20/мин
А в категории «текст-в-видео» (AA-Video-T2V v2.0) — отдельная таблица с собственной шкалой:
• Grok Imagine Video 1.5 — 11-е, 1 045 ±9, 4 056 образцов, май 2026, $15.00/мин
• Grok Imagine Video 1.5 Lite — 17–18-е, 993 ±10, 5 715 образцов, авг. 2026, $8,40/мин
• Vidu Q4 Preview — отсутствует
Из первого блока бросаются в глаза две вещи. Январская сборка Grok Imagine Video набирает больше голосов, чем любая другая модель в этом сравнении, — 14 371, почти втрое больше, чем 5 543 у Vidu Q4 Preview, и почти втрое больше, чем у сборки 1.5. Когда модель вышла в январе как лидер арены, именно так выглядит количество семплов в октябре: сообщество активно за неё голосовало, а затем остановилось. Оценка стабильна и хорошо подтверждена измерениями, но уже не близка к вершине.
Второе — это инверсия цен. Grok Imagine Video 1.5 стоит вдвое дороже за минуту, чем его январский предшественник, и опережает его на двадцать шесть Elo. Двадцать шесть Elo — это как раз чуть за пределами двух интервалов вместе взятых — ±8 и ±7, — так что улучшение, вероятно, реально, но такой разрыв возникает скорее при смене поколения, чем при новой архитектуре, а продают его по двойной цене. Тем временем Vidu Q4 Preview на восемьдесят один Elo выше сборки 1.5 и стоит ниже неё — $7,20 против $8,40. Это более свежая модель, которая превосходит старую по обеим осям; так и должно быть, и такое редко происходит так чисто.
Третья странность находится между таблицами. Тот же Grok Imagine Video 1.5, который стоит $8,40 за минуту при преобразовании изображения в видео, стоит $15,00 за минуту при преобразовании текста в видео, где он также получает более низкую оценку по шкале другой таблицы. Если вы планируете рабочую нагрузку с Grok, выбираемая вами входная модальность изменяет тариф примерно на восемьдесят процентов.

Что Grok Imagine Video на самом деле даёт вам
Это неплохая модель, и этот материал не собирается делать вид, что это не так. Две вещи, которые она делает, а Vidu Q4 Preview — нет:
Он принимает текстовые промпты. На странице продукта Vidu Q4 Preview перечислены ровно два режима — Image-to-Video и Reference-to-Video — а его API документирует /ent/v2/img2video и /ent/v2/reference2video и больше ничего. Эндпоинта text-to-video не существует. Grok Imagine Video 1.5 и его Lite-версия — обе модели присутствуют в категории text-to-video, так что если ваш пайплайн начинается с текстового промпта, одна из этих двух моделей доступна вам, а другая — просто нет.
У него есть дешёвый тариф. В рейтинге image-to-video январская сборка стоит $4,20 за минуту против $7,20 у Vidu Q4 Preview в том же рейтинге; тариф Lite за $8,40 находится в text-to-video — отдельном рейтинге с собственной шкалой. Если вы генерируете большой объём и готовы принять оценку уровня пятого места, бюджетный сегмент семейства Grok — самый дешёвый вариант в этой статье: январская сборка за $4,20 набирает 1 072 Elo, что на 107 ниже Vidu Q4 Preview, но при этом на $3,00 за минуту дешевле.

Что даёт вам Vidu Q4 Preview
Сторона Vidu в этом — более сильная модель генерации по общей для них оси и куда более внушительный бюджет референсов.
• Разрешение — Vidu Q4 Preview до 4K при 10-битном цвете (2K и 4K) против Grok Imagine Video, для которого 4K не задокументировано на этих форумах
• Длина клипа — Vidu Q4 Preview: 3–16 с для Image-to-Video и 1–16 с для Reference-to-Video, в отличие от Grok Imagine Video, где эти данные не опубликованы с той же степенью детализации
• Референсные входные данные — Vidu Q4 Preview: до 15 референсных изображений и до 3 референсных аудиоклипов, тогда как для Grok Imagine Video это не опубликовано на таком уровне
• Аудио по умолчанию — эндпоинт преобразования изображения в видео в Vidu Q4 Preview содержит audio — параметр, значение которого по умолчанию — true, поэтому звук приходит вместе с картинкой, если его не отключить
• Преобразование текста в видео — отсутствует, и это единственный пункт в этом списке, который идёт в обратную сторону.
Каждый показатель Vidu выше — собственный показатель вендора, и читать его следует именно так. Единственный в этой статье, который измеряется независимо, — это Elo, и по нему Vidu Q4 Preview опережает Grok Imagine Video 1.5 на восемьдесят один пункт, имея на тысячу голосов меньше. Восемьдесят один пункт Elo примерно в пять раз превышает совокупную ширину. Это реальный разрыв на сегодня, и он датирован октябрём 2026 года, а значит, это разрыв, относящийся к другому моменту, нежели тот, в котором находятся оценки Grok.

Является ли превью-сборка честным противником?
Позиционирование Shengshu необычно прямое: Vidu Q4 Preview вышел раньше полной модели Q4, чтобы создатели могли использовать его в реальных проектах и помочь сформировать финальный релиз. Цены описываются как промоакционные. Итоговая стоимость, поддерживаемые разрешения, доступность функций и условия использования могут различаться в зависимости от тарифа и региона. В документации API рядом с правильным viduq4-previerw присутствует алиас с опечаткой viduq4-preview — именно такие детали обычно вычищают в готовом продукте и обычно оставляют в предварительной версии.
Итак, восемьдесят один балл Elo был получен сборкой, которую сам её поставщик называет не финальной, по цене, которую сам её поставщик называет промо-акционной. Оба этих обстоятельства играют в пользу Vidu — модель, вероятно, улучшится, а цена, вероятно, вырастет, — но они также означают, что ни одна из этих цифр не является обязательством. Всем, кто составляет бюджет по этой странице, следует планировать, что ставка изменится на релизе Q4, и при этом перечитывать таблицу лидеров, а не место в рейтинге.
Если проблема в том, что предварительная сборка обновляется каждые несколько недель, то именно для этого и существует автоматическое переключение при сбое: одна конечная точка, совместимая с OpenAI, для более чем 200 моделей, с передачей прайс-листовых цен провайдеров без наценки, так что окончание действия промо-тарифа — это изменение одной строки в счёте, а не пересмотр условий, а ставший недоступным маршрут автоматически пропускается, вместо того чтобы обрушить запрос. Скажем честно про охват — Vidu Q4 Preview не является маршрутом OrcaRouter, как и Grok Imagine Video. Видеомодели, которые мы всё же обслуживаем, включая MiniMax H3, работают на том же ключе и той же конечной точке, что и текстовые модели.
Узкий ответ
Если вы хотите лучший результат преобразования изображения в видео, и на входе у вас кадр, Vidu Q4 Preview опережает текущую сборку Grok Imagine Video на восемьдесят один Elo при более низкой измеренной цене, и в пользу Grok нет сильных аргументов, кроме минимальной цены. Если вам нужно самое дешёвое, что набирает достойные оценки, январская сборка Grok Imagine Video за $4.20 с 1,072 Elo по результатам 14,371 голоса — это хорошо измеренный, с хорошей базой голосов, намеренно дешёвый вариант, а у Vidu нет ничего по этой цене. Если на входе у вас предложение, семейство Grok — единственное из двух семейств, представленных здесь.
Что могло бы это изменить: полный релиз Vidu Q4, который может добавить режимы или сократить разрыв в цене; и AA-Video-I2V v2.0, анонсированный как грядущий с новой таксономией и новым пулом голосов, — он сбросил бы все цифры на этой странице, а не скорректировал их. Пока не вышло ни то, ни другое, стоит помнить позицию, о которой говорят размеры выборок: 5 543 голоса Vidu — однодневной давности, 14 371 у январской сборки Grok — девятидневной давности, а таблица лидеров — это снимок, а не неизменный рейтинг.
