
Tavus Griffin против MiniMax H3: дуплексная диалоговая модель встречает выпущенный видеогенератор
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 223 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Tavus Griffin и MiniMax H3 оба выводят на экран движущегося говорящего человека, но если отвлечься от этого первого впечатления, они едва ли относятся к одной категории продуктов. Griffin — это Human Interaction Model — система «видео-в-видео», созданная для ведения двустороннего разговора в реальном времени, анонсированная Tavus в октябре 2026 года и в настоящее время доступная лишь избранной группе ранних тестировщиков. MiniMax H3 — омнимодальный генератор видео: вы задаёте ему промпт и, опционально, референсы в виде изображения, видео и аудио, а он возвращает готовый клип. Один оценивают за закрытыми дверями; другой уже несколько месяцев доступен для скачивания, лицензирования и оплаты. Именно это различие — а не разрешение или частота кадров — определяет, кому из них место в вашем стеке.
Что каждый из них на самом деле из себя представляет
Griffin — это попытка Tavus создать модель, которая ведёт себя как участник, а не как рендерер. Компания описывает её как первую Human Interaction Model, и опубликованная ею архитектура делит задачу на две части: Continuous Conversational Modeling, которая решает, что персона должна делать в каждый момент времени, и Audio-Visual Generation, которая передаёт потоком соответствующие друг другу речь и лицо. Что принципиально важно, она полнодуплексная: она смотрит и слушает, пока говорит, поэтому её можно перебить, она может реагировать в середине реплики и не ждёт чёткого сигнала окончания хода, прежде чем ответить. По формулировке самой Tavus, предыдущие системы учились генерировать лица; Griffin был создан, чтобы учиться разговорному поведению у людей.
MiniMax H3 — это поколение Hailuo 3, выпущенное 31 июля 2026 года и открытое 3 августа 2026 года под лицензией MiniMax H3 Community License; варианты H3-Base-FL2VA и H3-Base-Ref2VA опубликованы в открытом доступе. Он обрабатывает текстовые, графические, видео- и аудиореференсы как единый контекст и возвращает клип длительностью от 4 до 15 секунд в 768P или 2K с нативным стереозвуком, сгенерированный с помощью трёхэтапного конвейера (H3-Context-IR, затем H3-Base при 768p, затем H3-Regenerate-2K). Это генератор с необычно широким набором входных данных и по-настоящему разрешительной лицензией — всё то, чем Griffin на данный момент не является.
Характеристики, бок о бок

Почему «duplex» — это интересное слово
О каждом генераторе видео, включая H3, судят по тому, как выглядит готовый клип. О Griffin судят по тому, что клип показать не может: что происходит в течение 200 миллисекунд после того, как вы его прерываете. Именно на эту проблему указывает фрейминг Human Interaction Model, и именно поэтому ключевые показатели Tavus являются поведенческими, а не визуальными.
Самая цитируемая цифра — 48% людей поверили, что Griffin — реальный человек, после минутного видеозвонка — 26 из 54 участников — против 2,4% у предыдущего стека Tavus из Phoenix-4.5, Sparrow-2 и Raven-1, который убедил 1 из 41. Tavus также сообщает, что люди, которых не удалось убедить, обычно начинали подозревать в течение первых 20 секунд; это более полезная деталь, чем заголовок: это значит, что иллюзия либо держится с самого начала, либо рушится в самом начале.
Второй набор цифр взят из бенчмарка VideoFDB от NVIDIA, оценка по которому проводилась в сентябре 2026 года, где, по словам Tavus, Griffin занял первое место в независимом тесте ИИ для общения лицом к лицу. Что касается генерации, Griffin набрал 3,83 против 2,80 у сильнейшего из заявленных базовых вариантов (конфигурация Gemini 2.5 плюс Anam) при человеческом ориентире 3,92 и показателе выполнения задач 62,8%. Что касается восприятия, он набрал 3,73 против 3,44 у MiniCPM-o 4.5, 3,17 у Gemini 2.5 Flash Native и 2,97 у ориентированной только на аудио конфигурации OpenAI gpt-realtime, при человеческом ориентире 4,20 и показателе выполнения задач 73,8%, среди пятнадцати оценённых моделей. Tavus также утверждает, что Griffin опережает следующую лучшую систему на 37% по реакции в моменте. Это цифры, заявленные производителем и опирающиеся на созданный NVIDIA бенчмарк, и их следует воспринимать именно так — но именно точки сравнения с человеком стоит запомнить, потому что 3,83 против человеческих 3,92 — это гораздо меньший разрыв, чем исторически демонстрировала генерация видео.
Что вы можете купить сегодня
Здесь две модели вообще перестают быть сопоставимыми.
MiniMax H3 — это продукт. Он размещён в облаке, оплата взимается за каждую секунду сгенерированного результата, а его открытые варианты лежат на хабе моделей и ждут загрузки. Если вам нужен пятнадцатисекундный клип в 2K со стереозвуком, изображающий то, чего не существует, вы можете получить его уже сегодня днём, и вы можете запустить веса самостоятельно, если предпочитаете не арендовать их.
Tavus Griffin — не продукт. Tavus прямо указывает в описании Griffin, что Griffin-Lite, исследовательский предпросмотр, уже сегодня доступен избранной группе ранних тестировщиков, что после этого последует более широкий выпуск более мощной модели и что Griffin пока не представлен на платформе Tavus и появится только после того, как компания проработает способ его безопасного выпуска. Это необычная для вендора откровенность относительно собственного самого громкого результата, и она важна для планирования: вы не можете включить Griffin в дорожную карту продукта как зависимость и не можете назначить на него цену, потому что её не существует.
Так что честный вопрос планирования — не «что лучше», а «какой из них существует на том уровне, который мне нужен».

Где применяется OrcaRouter
MiniMax H3 есть в нашем каталоге. Страница модели находится по адресу minimax/minimax-h3, и тарификация соответствует той, что устанавливает провайдер: $0,08 за секунду сгенерированного результата в 768P и $0,13 за секунду в 2K. OrcaRouter транслирует прайс-листовые цены провайдеров с наценкой 0%, поэтому изменение цены MiniMax появляется в нашей карточке в тот же день, когда о нём объявлено, а не в следующем расчётном цикле. Griffin в каталоге отсутствует и не появится, пока Tavus не выпустит его для клиентов — мы не размещаем модель, которую не можем обслуживать, а исследовательский предпросмотр, доступный лишь избранным тестировщикам, — не то, что роутер может маршрутизировать.
Практическое следствие таково: одну из этих двух моделей от вашего приложения отделяет всего одна строка кода, а вторая — это научная статья с номером телефона. Если вы уже маршрутизируете несколько видеомоделей и языковых моделей, посекундная тарификация в H3 также делает этот маршрут таким, который стоит поставить за автоматическим переключением при сбое: запрос, попавший к перегруженному провайдеру, повторяется у работоспособного вместо того, чтобы вернуть тайм-аут, а DSL маршрутизации позволяет закрепить задачи 2K за конкретным провайдером, тогда как черновики 768P могут уходить туда, где мощности дешевле. Слияние моделей — ещё один рычаг, который стоит здесь упомянуть: посекундная цена H3 достаточно низка, чтобы потратить текстовую модель на переписывание и перекройку промпта перед генерацией — это часто дешевле, чем потерянные секунды из-за неудачной первой попытки.

Где сравнение может перевернуться
Три вещи изменили бы это сравнение, и только три.
Во-первых, если Tavus выведет Griffin на коммерческий API с опубликованным тарифом, вся эта «разговор против клипа»рамка превратится в настоящее решение о покупке, а не о планировании, и показатель в 48% для общения лицом к лицу начнёт напрямую конкурировать с качеством генеративного результата. Во-вторых, если история H3 с работой в реальном времени улучшится — а MiniMax выпускает продукты весьма агрессивно, — генератор с посекундной оплатой, способный работать в потоковом режиме, притупит главное преимущество Griffin. В-третьих, если NVIDIA или другая нейтральная сторона заново прогонит VideoFDB, включив туда H3 или его преемника, утверждение, что Griffin первым достиг уровня ИИ для общения лицом к лицу, перестанет быть нефальсифицируемым. Tavus заявляет, что рассчитывает выпустить Griffin очень скоро после устранения опасений по поводу безопасности; эта фраза — и есть весь график.
Итог
MiniMax H3 и Tavus Griffin сейчас не соперники, потому что только один из них можно купить. H3 — это выпущенный, с открытыми весами, посекундный омнимодальный генератор с опубликованной ценой и окном вывода от 4 до 15 секунд; Griffin — это дуплексная диалоговая модель с лучшими из всех опубликованных показателями в сценариях лицом к лицу, без API, без цены и с явным заявлением самого вендора о том, что клиенты пока не могут ею пользоваться. Если вам нужна генерация видео сегодня, ответ — H3, и это можно измерить в центах за секунду. Если вам нужно лицо в реальном времени, которое можно перебивать, следите за Tavus — но сначала создайте остальную часть продукта, потому что дата выпуска — это фраза, а не дата.
