
Vidu Q4 Preview против Alibaba Wan 2.7: два режима против четырёх и одна таблица лидеров, где это действительно важно
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Вот всё сравнение в одной строке: Vidu Q4 Preview обыгрывает Alibaba Wan 2.7 на 102 Elo в рейтинге Artificial Analysis по преобразованию изображения в видео и не может быть заявлен против него в категориях текст-в-видео или редактирование видео, потому что Vidu Q4 Preview не поддерживает ни то, ни другое.
Обе модели вышли в 2026 году, и обе генерируют видео со звуком. Vidu Q4 Preview появилась 7 октября 2026 года от Shengshu Technology как первое публичное превью перед полной моделью Q4, в двух режимах — Image-to-Video и Reference-to-Video. Alibaba Wan 2.7 вышел в апреле 2026 года как набор из четырёх вариантов: text-to-video, image-to-video, reference-to-video и video edit, с оплатой за секунду сгенерированного видео. Так что решающий фактор на большинстве страниц сравнения — оценка — существует только по одной из осей, и честный способ судить эти две модели — начать с вопроса, какие оси вам действительно нужны.
Табло, на котором пробелы оставлены видимыми
Artificial Analysis ведёт три отдельные таблицы лидеров по видео. У каждой своя шкала Elo и свой пул голосов, поэтому оценка из одной не переносится в другую. Данные по состоянию на 8 октября 2026 года, снова с сохранённым звуком:
• Изображение в видео (AA-Video-I2V v1.0) — Vidu Q4 Preview 3-е место, 1 179 ±10, 5 543 образцов, окт. 2026, $7,20/мин; Alibaba Wan 2.7 13-е место, 1 077 ±8, 4 571 образцов, апр. 2026, $9,00/мин
• Генерация видео по тексту (AA-Video-T2V v2.0) — Vidu Q4 Preview отсутствует; Wan2.7-260612 13–14-е, 1 030 ±9, 5 571 пример, июнь 2026, $9,00/мин
• Редактирование видео (AA-Video-Editing v1.1) — Vidu Q4 Preview отсутствует; Wan 2.7 — 7-е место, 1 074, 20 021 образец, апрель 2026 г., $16,90/мин
Из этой таблицы следуют две вещи. Wan 2.7 — более универсальная из двух с большим отрывом: это единственная из них, оценённая во всех трёх рейтингах, и её запись по редактированию имеет наибольшее количество голосов среди всех оценок Wan 2.7 где-либо, двадцать тысяч образцов. И на единственной оси, где они пересекаются, Vidu Q4 Preview выигрывает с преимуществом в 102 Elo, что примерно в пять раз больше ширины доверительного интервала любой из моделей.
Разрыв в 102 пункта — это не маленький результат. Для сравнения: весь разброс по первой шестёрке в рейтинге image-to-video составляет 21 Эло. Vidu Q4 Preview опережает Wan 2.7 в image-to-video не на чуть-чуть; это другой уровень, и при этом он стоит на $1.80 за минуту меньше, а также является более новой моделью. Если вы работаете с image-to-video, выбор очевиден, и независимая таблица лидеров — причина этой очевидности.

Там, где Wan 2.7 — единственный из двух, который отображается
В собственной документации Wan 2.7 названы две области, всё ещё требующие доработки: качество звука и точность текста на экране. Это оценка вендора, а не обозревателя, и её стоит учитывать при любом сравнении, ведь обе модели делают одно и то же громкое заявление — нативный звук, генерируемый вместе с изображением, а не прикручиваемый после.
Разница в том, что происходит по умолчанию. Эндпоинт преобразования изображения в видео у Vidu Q4 Preview содержит audio — параметр, который по умолчанию имеет значение true: вы получаете звук, если не отключите его, и именно отключение позволяет получить беззвучный клип. Wan 2.7 не документирует такой же переключатель в том же месте. Если беззвучный вывод важен для вашего пайплайна — а он важен для всего, что вы планируете отдельно озвучивать или дублировать на другой язык, — эта асимметрия меняет то, как будет выглядеть ваш первый проход интеграции.
На доске редактирования седьмое место Wan 2.7 с результатом 1 074 из 20 021 образца — это самый сильный отдельный результат, который любая из двух моделей показывает на любой доске по числу голосов. Двадцать тысяч голосов — это измерение, за которым стоит реальный вес, и на этой доске нет ни одной модели Vidu, с которой можно было бы сравнить этот результат. Если ваша работа — это изменение тайминга или стиля существующих видеоматериалов, а не создание новых кадров, то Wan 2.7 — единственная из двух, которая подходит.

Пробел в спецификации на стороне генерации
Там, где они пересекаются, эти двое различаются почти по каждому параметру, и различия эти несимметричны в пользу Вана.
• Максимальное разрешение — Vidu Q4 Preview 4K (2K и 4K при 10-битном цвете) против Wan 2.7 до 1080p
Максимальная длина клипа — Vidu Q4 Preview 16 с (изображение → видео 3–16 с, референс → видео 1–16 с) против Wan 2.7 до 15 с
• Референсные изображения — Vidu Q4 Preview: до 15 в одной конфигурации, тогда как Wan 2.7 — до десяти ассетов
• Референсное аудио — Vidu Q4 Preview: до 3 клипов для согласованности голоса, тогда как Alibaba не опубликовала это в таких же подробностях.
• Охват задач — Vidu Q4 Preview: два режима (изображение-в-видео, референс-в-видео) против Wan 2.7: четыре варианта (добавлены текст-в-видео и редактирование видео)
• Опубликованная прайсовая ставка — Vidu Q4 Preview от $0,014/с по промоакции; на независимом табло измерено $7,20/мин против Wan 2.7 — $0,10–$0,15/с в зависимости от варианта, измерено $9,00/мин
Строка о разрешении — та, которую стоит взвешивать особенно тщательно. Вывод 4K при 10 битах — это реальная разница в готовом результате для всех, кто выполняет финишную обработку для экрана или большого дисплея, и это не функция, которую Wan 2.7 предлагает в каком-либо из вариантов. Но 4K — это также то, где посекундная цена обычно перестаёт выглядеть как заявленный минимум, а в собственных материалах Vidu к запуску есть оговорка, что окончательная цена, поддерживаемые разрешения, доступность функций и условия использования зависят от тарифа и региона.

Какой именно, по нагрузке?
Если вы анимируете статичные изображения — товарные снимки, референсные кадры персонажей, раскадровки — Vidu Q4 Preview является лучшей моделью согласно единственным доступным независимым данным, при более низком измеренном тарифе. Это очевидный случай.
Если вам нужен один контракт, охватывающий преобразование текста в видео, изображения в видео и редактирование, Wan 2.7 — единственная из двух, которая отвечает этому требованию, и делает это с результатом в редактировании на седьмом месте, основанным на самом большом количестве голосов, которое есть у любой из этих моделей. Консолидация на одном поставщике — это реальное преимущество, и это сравнение не делает вид, что это не так.
Если вам нужно и то, и другое, стоимость работы с двумя поставщиками — это обычно не лицензия, а вторая интеграция, второй ключ, второй набор правил повторных попыток и вторая схема, которую нужно поддерживать в актуальном состоянии. OrcaRouter сводит всё это на нет: одна конечная точка, совместимая с OpenAI, для более чем 200 моделей, отпускные цены провайдеров передаются как есть, без наценки, и автоматическое переключение между провайдерами при сбое. Что касается именно видео, мы предоставляем MiniMax H3 — модель, которая сейчас занимает первое и второе места в приведённом выше рейтинге image-to-video — и её можно вызывать через ту же конечную точку и с тем же ключом, что и текстовые модели. Ни Vidu Q4 Preview, ни Alibaba Wan 2.7 сегодня не являются маршрутами OrcaRouter, и эту страницу не следует воспринимать как утверждение об обратном; что мы можем сделать — так это оставить остальную часть рабочей нагрузки на одной интеграции, чтобы эксперимент с видео был отдельной статьёй расходов, а не целым проектом.
Что могло бы это изменить?
Vidu Q4 Preview — это предварительная версия. Цены на неё промо-акционные, сборка опережает полный релиз Q4 — по собственному признанию вендора, — а в документации API до сих пор рядом с правильным указан псевдоним модели с опечаткой. Важны два исхода: если полный релиз Q4 добавит преобразование текста в видео, оси схлопнутся, и это станет прямым сравнением по трём лидербордам вместо одного; если нет, разделение останется как есть, и выбор будет определяться исключительно характером рабочей нагрузки.
С другой стороны, примеры Wan 2.7 на лидерборде для задачи «изображение — видео» на пять месяцев старше, чем у Vidu, и их примерно на тысячу меньше. Оба интервала сузятся. Ранг ни одной из моделей не следует считать фиксированным после даты, напечатанной рядом с ним.
Узкий ответ: у них ровно одна общая конкурентная ось, Vidu Q4 Preview явно лидирует по ней при более низкой измеренной ставке, а Wan 2.7 побеждает по умолчанию везде, где Vidu не конкурирует. Широкий ответ: двухрежимная модель предварительного просмотра и набор из четырёх вариантов на самом деле не являются альтернативами друг другу — они альтернативы для разных задач, и полезная часть этого сравнения в том, чтобы понять, какая задача у вас.
