Hero-карточка для «Tavus Griffin vs Google Veo 3.1» с тремя чипами: «Veo 3.1 — SynthID на каждом кадре», «Griffin — 48% участников живого исследования обмануты» и «Veo 3.1 Standard — от $0.40 в секунду», над шестью строками: Происхождение Griffin: не опубликовано; Происхождение Veo: SynthID плюс C2PA; Цена Griffin: не опубликована; Цена Veo: $0.40 в секунду; Статус Griffin: исследовательский предпросмотр; Статус Veo: общедоступно. Футер: «Тарифы Veo 3.1 — это цены из прайс-листа Google Gemini API; Griffin — исследовательский предпросмотр без указания цен.»
Guides & Insights

Tavus Griffin против Google Veo 3.1: один помечает водяными знаками каждый кадр, другой обманул 48% зала

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Поставьте Tavus Griffin и Google Veo 3.1 рядом, и обычное сравнение — цена за секунду, Elo, длина клипа — мгновенно рассыпается, потому что только у одного из них есть цена и только один оценивается по чему-либо, что покупатель может проверить. Но под этим лежит настоящая ось, и это не качество. Ответ Google на синтетические медиа — сделать их обнаруживаемыми: каждый результат Veo 3.1 несёт SynthID, невидимый водяной знак, вписанный в пиксели кадр за кадром и в аудиоспектр, плюс C2PA Content Credentials, фиксирующие происхождение файла, а Google встроил детектор в приложение Gemini, чтобы пользователь мог спросить, создал ли этот клип Google AI. Заявленная причина, по которой Tavus Griffin существует в предпросмотре, а не как продукт, — зеркальное отражение: в собственном живом исследовании Tavus 26 из 54 участников завершили минутный видеозвонок, веря, что их собеседник — реальный человек, против 1 из 41 на предыдущем стеке компании, и Tavus говорит, что придерживает модель, пока не разберётся, как раскрывать, чем она является. Один из этих поставщиков продаёт обнаружение. Другой сейчас является причиной, по которой обнаружение имеет значение, и знает это.

Два продукта, построенных на противоположных допущениях

Veo 3.1 — это генератор клипов с намеренно узким диапазоном. В API Google Gemini он создаёт за один проход 4, 6 или 8 секунд при 24 кадрах в секунду, изначально в 720p, а 1080p и 4K появляются благодаря этапу апскейлинга, добавленному в обновлении января 2026 года. Продление добавляет семь секунд за проход и может повторяться до двадцати раз, что даёт теоретический потолок около 148 секунд, но на вход должен подаваться созданный в Veo клип длительностью не более 141 секунды в 720p в формате 16:9 или 9:16, а восьмисекундная длительность обязательна для продления, для ввода референсного изображения и для всего, что выше 720p. Нельзя создать четырёхсекундный клип в 1080p. На выходе получается файл, которым вы владеете, с водяным знаком и прикреплённой подписанной записью о происхождении.

Griffin не создаёт файл. Он ведёт разговор. Движок непрерывного разговорного моделирования принимает аудио и видео и с интервалами менее секунды заново оценивает обмен репликами, решая, промолчать, подать сигнал, поддакнуть или взять слово, а также выдаёт управляющие параметры выразительности, которые совместно управляют потоковым генератором речи и потоковым генератором видео. Генератор видео создаёт видео 720p фрагментами по 320 мс, по одному латенту за раз, с частотой 25 кадров в секунду, на основе одной эталонной фотографии, и воспроизводит каждый фрагмент по мере его декодирования. У клипа нет длительности, потому что нет и клипа; есть сессия, которая продолжается, пока кто-то не перестанет говорить.

Это различие определяет почти каждый другой пункт в этом сравнении. Диапазон Veo 3.1 — это набор ограничений, под которые производственный конвейер может планировать: списки планов по восемь секунд, механизм расширения для более длинных дублей, фиксированные 24 кадра в секунду, известная лестница разрешений. Вывод Griffin вообще невозможно заранее раскадровать, потому что то, что он отрисовывает, зависит от того, что человек сделает дальше.

Сколько стоит Veo 3.1 на каждом тарифном уровне

Опубликованные тарифы Google для Gemini API включают аудио и рассчитываются за секунду выходных данных, и ни на одном уровне Veo 3.1 нет бесплатного тарифа. Аудио нельзя отключить в этом API — оно создаётся при каждом запросе — и это важно, потому что сторонние источники описывают тарифную сетку Vertex AI, где видео без звука стоит примерно вдвое меньше, чем тариф с включённым аудио. В собственной документации Google этот переключатель не описан. Если тариф без звука важен для вашего счёта, проверяйте его по собственному биллингу Vertex, а не по странице сравнения, включая эту.

• Veo 3.1 Standard — $0.40/с при 720p и 1080p, $0.60/с при 4K.

• Veo 3.1 Fast — $0.10/с при 720p, $0.12/с при 1080p, $0.30/с при 4K.

• Veo 3.1 Lite — $0,05/с при 720p, $0,08/с при 1080p, без уровня 4K.

Если применить правило восьми секунд к этим тарифам, стоимость одной попытки — это то, что креативная команда реально закладывает в бюджет: 32 цента за восьмисекундный дубль 1080p на тарифе Standard, 80 центов за четырёхсекундный при том же разрешении, потому что минимальный порог в восемь секунд не действует ниже 720p, и 4,80 доллара за один восьмисекундный дубль в 4K. Именно над последней цифрой стоит задуматься, потому что поиск одного пригодного 4K-кадра за четыре попытки стоит чуть меньше двадцати долларов, а требование восьми секунд означает, что вы не можете протестировать идею вдвое короче за вдвое меньшую цену.

У Griffin нет цены, нет бесплатного тарифа и вообще нет никакого прайс-листа. Griffin-Lite доступен отдельным доверенным тестировщикам в качестве исследовательского предпросмотра по форме запроса, он отсутствует на платформе Tavus, и в анонсе прямо указано, что в настоящее время он не будет доступен для использования клиентами. Заключительная фраза Tavus на странице гласит, что Griffin появится, как только компания разберётся, как безопасно его выпустить. В каждом утверждении этой статьи, где эти два продукта сравниваются по чему-либо, хоть отдалённо напоминающему решение о покупке, в половине, касающейся Griffin, есть пробел, и никакие объёмы исследований его не заполнят.

Что на самом деле измеряют два табло

Две модели оценивались с помощью разных инструментов по той же причине, по которой их трудно оценить друг относительно друга.

Veo 3.1 живёт на видеоарене Artificial Analysis, где Elo основан на слепых попарных предпочтениях людей по коротким клипам. Читайте 2 октября 2026 года в рейтинге преобразования текста в видео со звуком:

• Veo 3.1 — 18–21-е место, Elo 968 (±11) при 2 857 голосах, $24,00/мин.

• Veo 3.1 Fast — 18–21-е, Elo 961 (±10) по итогам 3 595 голосов, $7.20/мин.

• Veo 3.1 Lite — 21–24-е места, Elo 949 (±11) по итогам 2 762 голосов, $4,80/мин. • Veo 3.1 в режиме «изображение в видео» (со звуком) — 11-е место из 34, Elo 1 082 по итогам 7 049 голосов, $24,00/мин. Это его лучшее место в любой таблице и позиция с наибольшим числом голосов.

Из этого следуют два вывода. Все три уровня отстоят друг от друга в пределах девятнадцати пунктов Elo, а их доверительные интервалы пересекаются, так что вчетверо более высокая цена за секунду у стандартного уровня не покупает измеримого слепого предпочтения. А собственная более новая линейка Google Gemini Omni Flash обходит все уровни Veo 3.1 на той же таблице — 7–8-е место с Elo 1 117 по итогам 7 801 голоса и $9,12/мин, впереди всех трёх уровней, при том что стоит за минуту от четверти до одной пятой от их цены, — и это вопрос, который должен задать себе каждый покупатель Veo 3.1, и эта статья не то место, где на него отвечать.

Показатели Griffin взяты из VideoFDB от NVIDIA — бенчмарка для полнодуплексного аудиовизуального разговора, который NVIDIA создала и независимо оценила в сентябре 2026 года. Griffin-Lite набрал 3,83 из 5 на треке генерации против человеческого эталона 3,92 и 2,80 у следующей по результату опубликованной системы, а также 3,73 на треке восприятия против человеческого эталона 4,20. Tavus также сообщает о 0,43 секунды истинной задержки от аудио к видео для генератора в сравнении с четырьмя опубликованными потоковыми диффузионными базовыми моделями на H100, описывая её как вдвое меньшую, чем у следующей самой быстрой.

Ни один из наборов не переносится. Рейтинг Elo, полученный по голосованию о предпочтениях на коротких клипах, ничего не говорит о том, можно ли прервать модель; оценка судьи по рубрике за разговор ничего не говорит о том, правильно ли выглядит клип в 4K. И оговорки действуют в обе стороны: разрыв между Griffin и человеческим эталоном в 0,09 балла достаточно мал для пятибалльной рубрики, оцениваемой языковой моделью, чтобы «близко к человеку» было честной интерпретацией, а часть его преимущества в восприятии измеряется в сравнении с системами, работающими вообще без видеовхода.

A screenshot of the middle of Artificial Analysis's text-to-video-with-audio board, captured 2 October 2026, covering rows eleven to twenty-four: grok-imagine-video-1.5 at Elo 1,046, HappyHorse-1.1 at 1,045, Wan2.7-260612 at 1,032 with 4,645 votes and $9.00/min, HappyHorse-1.0 at 1,026, Kling 3.0 Omni 1080p Pro at 1,018, Kling 3.0 1080p Pro at 1,000 with 4,844 votes, PixVerse V6 at 987, Veo 3.1 at 968 with 2,857 votes and $24.00/min, Veo 3.1 Fast at 961 with 3,595 votes and $7.20/min, MAGI-2 Preview (0912) at 960, LTX-2.5 Fast at 950, Veo 3.1 Lite at 949 with 2,762 votes and $4.80/min, LTX-2.5 Pro at 944 and Vidu Q3 Pro at 941.

Происхождение — вот в чём реальное отличие продукта.

Для бизнеса с какими-либо обязательствами по раскрытию информации это единственный раздел, который имеет значение, и остальные даже близко не стоят.

Вывод Veo 3.1 несёт SynthID покадрово в пикселях и в аудиоспектре, спроектированный так, чтобы переживать сжатие, изменение размера, обрезку и запись с экрана, а также C2PA Content Credentials, записывающие происхождение файла и историю правок и совместимые с реализациями Adobe и Microsoft. Google внедрила обнаружение в приложение Gemini, так что пользователь может загрузить видео и спросить, создала ли его Google AI, при этом система обнаружения сообщает, какой фрагмент аудио- или видеодорожки несёт метку. Ограничение реально и о нём стоит заявить: этот детектор распознаёт только модели Google. Ничего из того, что есть у Alibaba или Kuaishou, не сравнимо, и у Tavus тоже ничего.

A screenshot of Google DeepMind's SynthID page, captured 2 October 2026: the Google DeepMind wordmark, the "SynthID" heading, the strapline "A tool to watermark and identify content generated through AI", the section tabs Overview / How it works / Hands-on, the heading "What is SynthID?", and a "Build with Gemini" panel with a Try Gemini link.

Tavus не опубликовала ни водяной знак, ни детектор, ни конвейер контентных удостоверений для Griffin. А опубликовала она причину, по которой он ей необходим. Исследование личного общения на удивление прямо описывает режим отказа: более половины участников заявили, что мысль о возможном ИИ даже не приходила им в голову во время разговора, почти все из этой группы пришли к выводу, что их собеседник — настоящий, а те, кто всё же заподозрил неладное, как правило, догадывались в первые двадцать секунд. Уверенность тех, кто поверил, составляла в среднем 79%, а у сомневающихся — 81%. Это модель, чья обманчивость — не побочный эффект качества генерации, а само качество генерации.

Ответ Tavus содержится в анонсе, а не в сноске: те же свойства, которые делают Human Interaction Models мощными интерфейсами для естественного общения, позволяют им обмануть человека, заставив его поверить, что это не ИИ; для безопасного выпуска требуются дополнительные процедуры выравнивания и безопасности, и компания работает над функциями безопасного раскрытия информации и с организациями, занимающимися безопасностью ИИ. Именно поэтому существует это ограничение. Griffin-Lite в настоящее время не будет доступен для использования клиентами.

Корпоративные условия, которые Google предлагает, а Tavus — нет

Veo 3.1 предоставляется через Vertex AI с региональной инфраструктурой, IAM и корпоративными контрактными условиями, которые из этого следуют, а Google ограничивает действия модели в зависимости от юрисдикции: через параметр генерации людей ЕС, Великобритания, Швейцария и MENA разрешают только взрослых субъектов, тогда как другие регионы могут разрешать всех. Это документированный, учитывающий регионы набор политик, и для покупателя из регулируемой сферы он может перевесить позицию в рейтинге.

У этой конфигурации есть своя цена. Идентификаторы моделей Veo 3.1 в API Gemini всё ещё остаются preview-идентификаторами — veo-3.1-generate-preview и родственные ему идентификаторы — тогда как SKU в Vertex использует обозначение общей доступности, а сторонние отчёты оценивают квоту preview примерно в одну пятую от производственной квоты. Google вывела из эксплуатации старые SKU Veo 3.0 30 июня 2026 года, что показывает, как обрабатывается смена поколений, и это стоит закладывать в цену всего, что построено на preview-идентификаторе. Потребительский сегмент также действительно ограничен: Flow требует подписки Google AI Pro или Ultra и заблокирован в ЕС, Великобритании, Индии, Индонезии, материковом Китае и России, при этом обходной путь через VPN не предлагается.

У Griffin нет условий предоставления услуг, которые можно прочитать, потому что нет самого сервиса. Доступ — это форма запроса и исследовательский предпросмотр. Tavus заявила, что работает с организациями по безопасности над оценками и хочет, чтобы люди участвовали в них, что представляет собой исследовательскую позицию, а не коммерческую.

Получение любого из них

Veo 3.1 доступен через Gemini API, Vertex AI, Google AI Studio и Flow, а также через приложение Gemini — только в 720p. За пределами Китая получить ключ для него с большим отрывом проще, чем для второго из двух, что идёт вразрез с приведённым выше аргументом о качестве и является главной причиной, по которой это сравнение остаётся интересным, несмотря на цифры.

Доступ к Griffin можно получить, подав запрос на доступ и будучи отобранным в качестве доверенного тестировщика. Это и есть весь путь закупки.

Там, где роутер действительно помогает в пайплайне Veo, — это рядом с видеомоделью, а не внутри неё. Текстовые модели Google — Gemini 3.5 Flash, Gemini 3.1 Pro Preview, Gemini 3.6 Flash и остальные из этой линейки — присутствуют в каталоге OrcaRouter и вызываются через тот же OpenAI-совместимый эндпоинт, что и ещё 200+ других моделей по прайс-листовой цене провайдера с наценкой 0%. Списки кадров, расширение промптов, генерация подписей, заметки о непрерывности между восьмисекундными сегментами и резюмирование ревью — всё это текстовая работа, и именно на этом уровне возможность поставить дешёвую модель на массовый прогон, а передовую — на финальный, обходится изменением конфигурации, а не миграцией. Сам Veo 3.1 мы не маршрутизируем, как и Griffin; об этом стоит сказать прямо, а не позволять подобному абзацу подразумевать обратное.

Какой именно, честно?

• Выбирайте Veo 3.1, когда результат должен иметь прослеживаемую цепочку происхождения, когда покупатель подпадает под регулирование, когда распространение должно осуществляться в виде файла с прикреплёнными учётными данными или когда требование 4K не подлежит обсуждению. Закладывайте минимальную продолжительность в восемь секунд в каждую модель затрат и проверяйте жизненный цикл preview-ID, прежде чем строить на нём клиентский путь.

• Не выбирайте Griffin, потому что вы не можете. Запросите доступ, если ваш вопрос в том, способен ли человек отличить ИИ от человека во время минутного звонка, или если вам нужно знать, куда движется слой взаимодействия, прежде чем привязывать дорожную карту к слою клипов.

• Следите за детектором, а не за демонстрацией. Если Tavus опубликует механизм раскрытия, который выдержит непринуждённую беседу, разрыв между этими двумя поставщиками значительно сократится. Если нет, Griffin — это результат, который стоит упоминать, а Veo 3.1 остаётся единственным из этих двух, кого можно предъявить команде по комплаенсу.

A two-column scoreboard titled "Tavus Griffin vs Google Veo 3.1 — the scoreboard". Left column "Tavus Griffin": Provenance: none published; Price: none published; Clip length: no clip - a session; Resolution: 720p at 25 fps; Loop: full duplex; Status: research preview. Right column "Google Veo 3.1": Provenance: SynthID plus C2PA; Price: $0.40 per second; Clip length: 4, 6 or 8 seconds; Resolution: 720p native; Loop: one generation; Status: generally available. Footer: "Veo 3.1 per Google's Gemini API pricing, 2 October 2026."