
HiDream-O1-Video-1.0 дебютирует на шестом месте в Artificial Analysis — а его публичный API гораздо меньше, чем его запуск
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 за 1 млн токенов · 73 tok/s
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 115 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 359 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
HiDream-O1-Video-1.0занимает шестое место в таблице лидеров Artificial Analysis Image-to-Video с показателем Elo 1 175 по 3 231 голосам при цене $5,80 за минуту сгенерированного видео. Это позиция, которую объявил его создатель, — за исключением того, что в пресс-релизе HiDream от 17 сентября 2026 года говорилось о четвёртом месте. Оба числа верны: в релизе цитируется позиция на день объявления, а с тех пор таблица изменилась. Если читать 10 октября 2026 года с включённым аудиофильтром, HiDream V1 находится позади MiniMax H3 Max, MiniMax H3, Vidu Q4 Preview, Omni Flash и Dreamina Seedance 2.0 720p, именно в таком порядке.
Более интересная история — не место в рейтинге. А то, что HiDream-O1-Video-1.0 был анонсирован как модель, которая принимает текст, изображения и видео и возвращает видео в 1080p длительностью от пяти до двадцати секунд с нативно синхронизированным звуком, — и что то, что вы действительно можете вызвать сегодня, принимает ровно одно референсное изображение и необязательный текстовый промпт, и ничего больше. Оба этих утверждения задокументированы. Разрыв между ними — это то, что стоит знать, прежде чем строить на этой модели.
Доска, прочитанная правильно.
Artificial Analysis ведёт свои видеолидерборды по уровням, каждый из которых имеет собственную шкалу Elo и собственный пул голосов, поэтому оценка не переносится между ними. В AA-Video-I2V v1.0 с сохранённым аудио разрыв между первой шестёркой составляет двадцать пунктов Elo, а доверительные интервалы имеют ширину от семи до десяти пунктов. Эта первая шестёрка по состоянию на 10 октября 2026 года:
• MiniMax H3 Max — 1 195 ±9 по 5 894 образцам, август 2026 г., $4,80/мин
• MiniMax H3 — 1 181 ±8 на 7 284 образцах, июль 2026 г., 7,80 $/мин
• Vidu Q4 Preview — 1 179 ±10 на 5 543 образцах, октябрь 2026, $5,04/мин
• Gemini Omni Flash — 1 178 ±7 на 12 327 образцах, май 2026 г., 6,00 $/мин
• Dreamina Seedance 2.0 720p — 1 176 ±7 из 15 721 образца, март 2026 г., $9,07/мин
• HiDream-O1-Video-1.0 — 1 175 ±10 на 3 231 образце, август 2026 г., 5,80 $/мин
Если читать эти интервалы как группу, честный вывод таков: позиции с первой по шестую — статистически один и тот же спор с очень длинным хвостом ничьих. Разрыв, который не находится внутри шума, — это разрыв между HiDream V1 и остальными участниками: седьмое место, Wan 3.0 от Alibaba, — 1 164, на одиннадцать пунктов и целый интервал ниже шестого места, и почти на триста голосов опережает его. Собственная выборка HiDream — самая маленькая в этой шестёрке, а значит, её интервал — один из самых широких, а позиция — наименее устойчивая.

Два заявления Artificial Analysis о самой таблице стоит учитывать в дальнейшем. Она фиксирует лишь одну модель, добавленную за последние 30 дней, и сообщает, что AA-Video-I2V v2.0 появится, согласованная с таксономией AA-Video-T2V v2.0 и с 1080p на всём протяжении. Это важно для модели, чьи заявления на запуске касаются 1080p, а также текстового и видеокондиционирования: таблица, на которой она дебютирует, явно переходная, и её замена меняет то, что измеряется.
Там, где модели нет
HiDream-O1-Video-1.0 присутствует ровно в одной таблице лидеров Artificial Analysis по видео. Его нет в AA-Video-T2V v2.0 — таблице «текст-в-видео» — и в таблице редактирования видео. Я проверял обе 10 октября 2026 года — Wan 3.0 лидирует в «текст-в-видео» с 1 156 и в редактировании видео с 1 157, FLUX 3 занимает шестое место в «текст-в-видео» с 1 128, а HiDream не появляется ни в одном из этих рейтингов.
Это отсутствие — скорее сигнал, чем дисквалификация. Модель, которая принимает на вход только референсное изображение, не может участвовать в голосовании по преобразованию текста в видео, а та, что умеет только анимировать, не может попасть в сравнение по редактированию. Практическое следствие состоит в том, что не существует независимых измерений того, как HiDream V1 выполняет преобразование текста в видео или редактирование видео, а это ровно два из трёх режимов ввода, заявленных в анонсе его запуска.
Две даты и девяносто дней между ними
Есть загвоздка с датировкой, и любой, кто цитирует эти числа, должен обращаться с ними осторожно. Artificial Analysis фиксирует дату выпуска HiDream-O1-Video-1.0 как 28 августа 2026 года, а дату его появления на табло — 10 сентября 2026 года. Собственное объявление HiDream о запуске датировано 17 сентября. Сторонние упоминания модели, появившиеся с тех пор, описывают её как опубликованную 15 сентября и проверенную 17 сентября.
То, что описывает этот паттерн — это модель, которая попала в конвейер оценки раньше, чем дошла до пресс-релиза — вполне нормально, и это означает, что дата выпуска на доске — более ранняя из двух, а не ошибка. Это не описывает модель, анонсированную в марте, которую снова анонсируют в августе, что является режимом отказа, на котором этот блог уже обжигался раньше. HiDream-O1-Video-1.0 действительно новая: сама инфраструктура таблицы лидеров относит её появление к последним двум месяцам.
Что утверждает запуск и кто это говорит
История архитектуры исходит от HiDream и не была независимо воспроизведена. По словам производителя: HiDream-O1-Video-1.0 — HiDream V1, или HD-V1 — совместно моделирует текст, видео и аудио в рамках одного процесса генерации, а не генерирует изображение и добавляет звук после, так что движение губ, окружающий звук и физическое действие имеют общую временную шкалу. Длительность планируется, а не фиксируется, при этом модель выбирает продолжительность от пяти до двадцати секунд исходя из описываемого события. Физическое поведение — гравитация, столкновение, инерция, деформация, затухание света — встраивается при обучении в качестве ограничения генерации. Дообучение использует диффузионное обучение с подкреплением с опорой на мультимодальную модель вознаграждения, согласованную с человеческим восприятием. Генерация проходит в три этапа, которые компания описывает как: сначала планирование, затем совместная генерация, и наконец выравнивание.
HiDream позиционирует модель внутри портфеля из четырёх семейств, построенного на общей унифицированной трансформерной основе, — HiDream-O1-Image, HiDream-O1-Video, HiDream-O1-World и HiDream-O1-Embodied — и ссылается на прежние места родственных моделей в бенчмарках, включая второе место HiDream-O1-Image 1.5 в глобальном рейтинге генерации изображений по тексту от Artificial Analysis и первое место HiDream-O1-World на WBench. Это данные вендора о других моделях семейства, приведённые здесь без независимого подтверждения. Корпоративные материалы компании также описывают технологический стек фундаментальных моделей объёмом «более 200 миллиардов» параметров; это заявление уровня платформы, а не спецификация HiDream-O1-Video-1.0, и ни один источник не публикует число параметров для этого чекпоинта. Открытые веса для него не выпускались.

Что на самом деле можно назвать
Здесь документация необычно ясна, и она уже, чем анонс. HiDream предоставляет модель через HiHarness, свою MaaS-платформу. Конечная точка видео — это POST-запрос на /api/maas/gw/v1/videos/generations с идентификатором модели HiDream-O1-Video-1.0. Требуемый ввод — ровно одно референсное изображение: публичный URL или Base64 без префикса data-URL, размером от 40 КБ до 20 МБ. Текстовый промпт необязателен и по умолчанию пуст. Генерация асинхронна: вы отправляете запрос, получаете task_id, и опрашиваете /api/maas/gw/v1/videos/generations/results до тех пор, пока result.status не покажет 1.
Три упущения в этой схеме заслуживают того, чтобы назвать их явно, потому что каждое из них — это возможность, которую рекламирует стартовый релиз.
• Референсное видео — в перечне модели видео указано; в документированном варианте поля для него нет.
• Явное разрешение — в анонсе заявлено 1080p; в документированном запросе селектор разрешения отсутствует, и вместо этого результат сохраняет соотношение сторон эталонного изображения.
• Управление аудио — в анонсе утверждается наличие нативного синхронизированного аудио; документированный запрос не содержит ни аудиовхода, ни параметра генерации аудио.
Что схема всё же предоставляет — это force_10s, логическое значение, по умолчанию равное false. Если оставить его false, модель сама выбирает длительность. Если задать true, вы получите десять секунд. Числового поля длительности нет, поэтому заявленный диапазон от пяти до двадцати секунд — это утверждение на уровне модели, которым публичная поверхность запроса не позволяет управлять, кроме как выбором одного из двух режимов.

В этом контракте ответа есть одна деталь реализации, которая больно ударит по интеграции, написанной методом подбора шаблонов под другие видео API. result.status = 1 означает, что все подзадачи достигли терминального состояния — но не то, что генерация завершилась успешно. Всё равно нужно прочитать sub_task_results[].task_status, где 1 — успех, 3 — ошибка генерации, а 4 — ошибка проверки безопасности. Клиент, который считает терминальное состояние успешным, вернёт вам URL видео, которого не существует.
Цена в контексте
При цене $5,80 за минуту, которую фиксирует Artificial Analysis, HiDream V1 занимает среднюю ценовую позицию в своём сегменте, а не относится к дешёвым. В первой шестёрке рейтинга он дешевле, чем MiniMax H3 ($7,80) и Dreamina Seedance 2.0 ($9,07), и дороже, чем MiniMax H3 Max и Vidu Q4 Preview. В сравнении с моделями, с которыми его будут сравнивать чаще всего, разброс шире: Google Veo 3.1 стоит $24,00 за минуту, Kling 3.0 1080p Pro — $20,16, Alibaba Wan 2.7 — $9,00 и Wan 3.0 — $12,00, тогда как Grok Imagine Video 1.5 находится на уровне $8,40.
Эти поминутные тарифы нельзя напрямую сравнивать, потому что то, что именно означает минута выходных данных — при каком разрешении и с каким звуком — как раз и остаётся не указанным в документации API для этой модели. Воспринимайте это число как отправную точку для собственных расчётов, а не как тарифную сетку.
Пробовать непроверенный путь, не ставя на него весь пайплайн
Аргумент в пользу осторожности здесь не в том, что модель плоха. А в том, что сервисная поверхность эпохи preview — один тип входных данных, один переключатель длительности, флаг завершения с двумя состояниями — неподходящее место, чтобы жёстко прописывать продакшн-путь. HiDream-O1-Video-1.0 — это не модель, которую мы обслуживаем в OrcaRouter сегодня, поэтому ничто ниже не является утверждением о её хостинге: место, где наш продукт действительно помогает, — по другую сторону решения, там, где вы хотите протестировать новый видеомаршрут против уже используемого и иметь возможность в любой момент от него отказаться. Единый OpenAI-совместимый эндпоинт для более чем 200 моделей, автоматическое переключение при сбое, чтобы маршрут, который тихо начинает сбоить, не оказался тем маршрутом, который вы выпускаете, цены из прайс-листов провайдеров, передаваемые без наценки, и DSL маршрутизации, позволяющий сравнивать две модели в рамках одного запроса, а не двух интеграций. Ничто из этого не требует именно модели HiDream.
Что изменило бы эту часть?
Три события изменили бы картину — в порядке убывания вероятности.
Во-первых, более широкий контракт обслуживания. Если HiHarness добавит поле для референсного видео, выбор разрешения или документированные элементы управления аудио, разрыв между анонсом и API сократится, и утверждения о 1080p и text-to-video станут проверяемыми. Это изменение документации, а не модели, и оно может выйти в любую неделю.
Во-вторых, таблица AA-Video-I2V v2.0. Artificial Analysis сообщила, что она появится, приведённая в соответствие с таксономией T2V v2.0 и полностью на 1080p. Таблица, ограниченная только 1080p, стала бы первой независимой средой, в которой заявление HiDream V1 о разрешении хоть что-то значит — и если модель по-прежнему нельзя будет включить в таблицу текст-в-видео в рамках новой таксономии, её отсутствие там станет содержательным выводом, а не артефактом старых категорий.
В-третьих, объём выборки. 3 231 голос — это реальное измерение, и к тому же недавнее: самое малое по объёму в первой шестёрке. Интервал сейчас ±10 и будет сужаться в ту сторону, в которую его подтолкнут избиратели. Любой, кто цитирует «шестое место» как установленный факт, должен указывать дату, когда он это прочитал, потому что шестое место — это одна из позиций в ничьей между шестью.
Вопрос, который стоит сохранить, не в том, конкурентоспособна ли HiDream-O1-Video-1.0 — на единственном лидерборде, где её можно измерить, она явно конкурентоспособна, и при оправданной цене за минуту. Вопрос в том, окажется ли модель, которая в конечном итоге дойдёт до широкого API, той самой, что была анонсирована. Судя по текущей документации, это всё ещё два разных продукта.
HiDream-O1-Video-1.0 не входит в число маршрутов, которые мы обслуживаем сегодня, но аналогичная поверхность стоит за более чем 200 моделями с провайдерскими ценами из прайс-листа, передаваемыми без наценки.
