
Tavus Griffin vs Google Veo 3.1: de een voorziet elk frame van een watermerk, de ander misleidde 48% van een zaal
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 223 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Zet Tavus Griffin en Google Veo 3.1 naast elkaar en de conventionele vergelijking — prijs per seconde, Elo, cliplengte — valt onmiddellijk uiteen, want slechts één van de twee heeft een prijs en slechts één van de twee wordt gescoord op iets wat een koper kan opzoeken. Maar daaronder ligt een echte dimensie, en het is niet kwaliteit. Het antwoord van Google op synthetische media is ze detecteerbaar maken: elke Veo 3.1-output draagt SynthID, een onzichtbaar watermerk dat frame voor frame in de pixels wordt geschreven en in het audiospectrum, plus C2PA Content Credentials die de herkomst van het bestand vastleggen, en Google heeft een detector in de Gemini-app uitgebracht zodat een gebruiker kan vragen of Google AI een clip heeft gemaakt. De opgegeven reden waarom Tavus Griffin in preview bestaat in plaats van als product, is het spiegelbeeld: in Tavus' eigen live onderzoek rondden 26 van de 54 deelnemers een videogesprek van één minuut af in de overtuiging dat hun gesprekspartner een echt persoon was, tegenover 1 van 41 op de vorige stack van het bedrijf, en Tavus zegt het model tegen te houden totdat het heeft uitgewerkt hoe het moet onthullen wat het is. Een van deze leveranciers verkoopt detectie. De ander is op dit moment de reden waarom detectie ertoe doet, en weet dat.
Twee producten gebouwd op tegenovergestelde aannames
Veo 3.1 is een clipgenerator met een bewust nauw bereik. Op de Gemini API van Google produceert hij per generatie 4, 6 of 8 seconden bij 24 fps, native op 720p, waarbij 1080p en 4K beschikbaar komen via een opschalingsstap die is toegevoegd in een update van januari 2026. Extensie voegt zeven seconden per generatie toe en kan tot twintig keer worden herhaald, voor een theoretisch plafond van ongeveer 148 seconden, maar de invoer moet een door Veo gegenereerde clip van maximaal 141 seconden op 720p in 16:9 of 9:16 zijn, en de lengte van acht seconden is verplicht voor extensie, voor invoer met referentieafbeelding en voor alles boven 720p. Je kunt geen 1080p-clip van vier seconden maken. De output is een bestand dat je bezit, voorzien van een watermerk, met een ondertekende herkomstregistratie bijgevoegd.
Griffin produceert geen bestand. Het voert een gesprek. Een Continuous Conversational Modeling-engine krijgt audio en video binnen en herbeoordeelt de uitwisseling met tussenpozen van minder dan een seconde: hij kiest of hij stil blijft, een signaal geeft, een backchannel laat horen of de beurt neemt, en zendt expressieve besturingselementen uit die een streaming spraakgenerator en een streaming videogenerator samen aansturen. De videogenerator produceert 720p in brokken van 320 ms, één latent per keer, met 25 fps op basis van één referentiefoto, en speelt elke brok af terwijl hij decodeert. Er is geen cliplengte omdat er geen clip is; er is een sessie die doorgaat totdat iemand stopt met praten.
Dat onderscheid bepaalt bijna elke andere regel in deze vergelijking. De envelop van Veo 3.1 is een reeks beperkingen waar een productiepijplijn omheen kan plannen — shotlijsten van acht seconden, een verlengingsladder voor langere takes, een vaste 24 fps, een bekende resolutieladder. De output van Griffin is helemaal niet vooraf te storyboarden, omdat wat het rendert afhangt van wat de persoon vervolgens doet.
Wat Veo 3.1 kost, per abonnementsniveau
De door Google gepubliceerde tarieven voor de Gemini API zijn inclusief audio, per seconde uitvoer, en er is op geen enkel Veo 3.1-niveau een gratis optie. Audio kan op die API niet worden uitgeschakeld — deze wordt bij elk verzoek gegenereerd — wat van belang is omdat bronnen van derden een tariefkaart voor Vertex AI beschrijven waarbij stille video ongeveer de helft kost van het audio-inclusieve bedrag. De eigen documentatie van Google maakt die schakelaar niet openbaar. Als een stiltetarief van belang is voor uw rekening, controleer dit dan aan de hand van uw eigen Vertex-facturering in plaats van een vergelijkingspagina, inclusief deze.
• Veo 3.1 Standard — $0,40/s bij 720p en 1080p, $0,60/s bij 4K.
• Veo 3.1 Fast — $0,10/s bij 720p, $0,12/s bij 1080p, $0,30/s bij 4K.
• Veo 3.1 Lite — $0,05/s bij 720p, $0,08/s bij 1080p, zonder 4K-niveau.
Leg de achtsecondenregel naast die tarieven, en de kosten per poging zijn wat een creatief team daadwerkelijk begroot: 32 cent voor een achtsecondenopname van 1080p op Standard, 80 cent voor een van vier seconden op dezelfde resolutie omdat de ondergrens van acht seconden niet geldt bij resoluties onder 720p, en $4,80 voor één enkele 4K-opname van acht seconden. Dat laatste getal is het getal om even bij stil te staan, want vier pogingen om één bruikbare 4K-opname te vinden komen net onder de twintig dollar uit, en de eis van acht seconden betekent dat je het idee niet op de halve lengte voor de halve prijs kunt testen.
Griffin heeft geen prijs, geen gratis niveau en geen enkele vorm van tariefkaart. Griffin-Lite is beschikbaar voor een selecte groep vertrouwde testers als onderzoekspreview via een aanvraagformulier, staat niet op het Tavus-platform, en in de aankondiging staat expliciet dat het op dit moment niet beschikbaar zal zijn voor klantgebruik. De slotregel van Tavus op de pagina is dat Griffin er zal komen zodra het bedrijf heeft uitgewerkt hoe het veilig kan worden uitgebracht. Elke bewering in dit artikel waarin de twee worden vergeleken op iets dat op een aankoopbeslissing lijkt, heeft een gat in Griffins helft ervan, en geen enkele hoeveelheid onderzoek vult dat.
Wat de twee scoreborden daadwerkelijk meten
De twee modellen zijn door verschillende instrumenten geëvalueerd om dezelfde reden dat ze moeilijk tegen elkaar te prijzen zijn.
Veo 3.1 staat op de videoarena van Artificial Analysis, waar Elo voortkomt uit blinde paarsgewijze menselijke voorkeur voor korte clips. Lees op 2 oktober 2026 op de tekst-naar-video-ranglijst met audio:
• Veo 3.1 — 18–21, Elo 968 (±11) over 2.857 stemmen, $24,00/min.
• Veo 3.1 Fast — 18e–21e, Elo 961 (±10) bij 3.595 stemmen, $7,20/min.
• Veo 3.1 Lite — 21e–24e, Elo 949 (±11) met 2.762 stemmen, $4,80/min. • Veo 3.1 in image-to-video (met audio) — 11e van 34, Elo 1.082 met 7.049 stemmen, $24,00/min. Zijn beste notering op welke ranglijst dan ook, en degene met de meeste stemmen erachter.
Daaruit volgen twee dingen. Alle drie de tiers liggen binnen negentien Elo-punten van elkaar, met overlappende betrouwbaarheidsintervallen, dus de vier keer hogere prijs per seconde van de standaard-tier levert geen meetbare blinde voorkeur op. En Googles eigen nieuwere Gemini Omni Flash-lijn overtreft elke Veo 3.1-tier op hetzelfde scorebord — 7e–8e met Elo 1.117 over 7.801 stemmen en $9,12/min, vóór alle drie de tiers, terwijl het tussen een kwart en een vijfde zoveel per minuut kost — wat een vraag is die elke Veo 3.1-koper zich zou moeten stellen, en een vraag die dit artikel niet beoogt te beantwoorden.
De cijfers van Griffin komen van NVIDIA's VideoFDB, een benchmark voor full-duplex audiovisuele gesprekken die NVIDIA in september 2026 heeft gebouwd en onafhankelijk heeft beoordeeld. Griffin-Lite scoorde 3,83 van de 5 op de generatietrack tegen een menselijke referentie van 3,92 en 2,80 voor het op een na hoogst gepubliceerde systeem, en 3,73 op de perceptietrack tegen een menselijke referentie van 4,20. Tavus rapporteert ook 0,43 seconden werkelijke audio-naar-video-latentie voor de generator tegen vier gepubliceerde baselines voor streamingdiffusie op H100's, en beschrijft dit als de helft van de op een na snelste.
Geen van beide sets is overdraagbaar. Een Elo-score uit voorkeursstemming op korte clips zegt niets over of een model onderbroken kan worden; een rubricscore van een beoordelaar op een gesprek zegt niets over of een clip er goed uitziet in 4K. En de kanttekeningen gelden in beide richtingen: het gat van 0,09 punt tussen Griffin en de menselijke referentie is op een door een taalmodel beoordeelde rubric van vijf punten klein genoeg dat "dicht bij menselijk" de eerlijke lezing is, en een deel van zijn voorsprong op het gebied van waarneming wordt gemeten ten opzichte van systemen die helemaal geen video-invoer gebruiken.

Provenance, het echte productverschil
Voor een bedrijf met enige openbaarmakingsverplichting is dit het enige onderdeel dat ertoe doet, en geen enkel ander onderdeel komt zelfs maar in de buurt.
De output van Veo 3.1 draagt SynthID frame voor frame in de pixels en in het audiospectrum, ontworpen om compressie, formaatwijziging, bijsnijden en schermopname te overleven, en C2PA Content Credentials die de herkomst van bestanden en de bewerkingsgeschiedenis vastleggen, interoperabel met de implementaties van Adobe en Microsoft. Google heeft detectie in de Gemini-app uitgebracht, zodat een gebruiker een video kan uploaden en kan vragen of Google AI deze heeft gemaakt, waarbij de detectie rapporteert welk gedeelte van de audio- of videotrack de markering droeg. De beperking is reëel en het vermelden waard: die detector herkent alleen de modellen van Google. Niets uit het aanbod van Alibaba of Kuaishou is vergelijkbaar, en niets van Tavus evenmin.

Tavus heeft voor Griffin geen watermerk, geen detector en geen content-credentials-pipeline gepubliceerd. Wat het wél heeft gepubliceerd, is de reden waarom het er een nodig heeft. De face-to-face-studie is ongewoon direct over de faalmodus: meer dan de helft van de deelnemers zei dat de mogelijkheid dat er een AI in het spel was niet bij hen was opgekomen tijdens het gesprek, bijna iedereen in die groep concludeerde dat hun gesprekspartner echt was, en de mensen die wél vermoedens hadden, hadden het doorgaans binnen de eerste twintig seconden door. Degenen die geloofden waren gemiddeld 79% zeker en twijfelaars 81%. Dat is een model waarvan het misleidende karakter geen neveneffect van de generatiekwaliteit is — het ís de generatiekwaliteit.
Tavus' reactie staat in de aankondiging in plaats van in een voetnoot: dezelfde eigenschappen die Human Interaction Models tot krachtige interfaces voor natuurlijke communicatie maken, stellen hen in staat een mens te misleiden tot de overtuiging dat het geen AI is; er zijn verdere alignment- en veiligheidsprocedures nodig voor een veilige release, en het bedrijf werkt aan veilige onthullingsfuncties en met organisaties die AI-veiligheid aanpakken. Daarom bestaat de gate. Griffin-Lite zal op dit moment niet beschikbaar zijn voor gebruik door klanten.
De enterprisevoorwaarden die Google biedt en Tavus niet
Veo 3.1 wordt geleverd via Vertex AI, met de bijbehorende regionale infrastructuur, IAM en het enterprisecontractoppervlak dat dat met zich meebrengt, en Google beperkt wat het model doet per jurisdictie: via een parameter voor persoonsgeneratie staan de EU, het VK, Zwitserland en MENA alleen volwassen subjecten toe, terwijl andere regio's alles kunnen toestaan. Dat is een gedocumenteerd, regiobewust beleidsoppervlak, en voor een gereguleerde koper kan dat zwaarder wegen dan een positie op een ranglijst.
Aan de vorm ervan hangt een prijskaartje. De model-ID's van Veo 3.1 op de Gemini API zijn nog steeds preview-ID's — veo-3.1-generate-preview en zijn verwanten — terwijl de Vertex-SKU naamgeving voor algemene beschikbaarheid draagt, en rapporten van derden schatten het preview-quotum op ongeveer een vijfde van het productiequotum. Google heeft de oudere Veo 3.0-SKU's op 30 juni 2026 buiten gebruik gesteld, wat aangeeft hoe met generatiewisselingen wordt omgegaan en wat je moet meerekenen in de prijs van alles wat op een preview-ID is gebouwd. Het consumentenaanbod is ook echt beperkt: Flow vereist een Google AI Pro- of Ultra-abonnement en is geblokkeerd in de EU, het VK, India, Indonesië, het vasteland van China en Rusland, zonder dat er een VPN-omweg wordt geboden.
Griffin heeft geen servicevoorwaarden om te lezen, want er is geen dienst. Toegang is een aanvraagformulier en een onderzoekspreview. Tavus heeft gezegd met veiligheidsorganisaties aan evaluaties te werken en wil dat mensen eraan deelnemen, wat eerder een onderzoeks- dan een commerciële houding is.
Een van beide krijgen
Veo 3.1 is bereikbaar via de Gemini API, Vertex AI, Google AI Studio en Flow, en via de Gemini-app alleen in 720p. Buiten China is het veruit het gemakkelijkst van de twee om een sleutel voor te bemachtigen, wat indruist tegen het bovenstaande kwaliteitsargument en de voornaamste reden is dat deze vergelijking ondanks de cijfers interessant blijft.
Griffin is bereikbaar door een toegangsverzoek in te dienen en geselecteerd te worden als vertrouwde tester. Dat is het volledige inkooptraject.
Waar een router echt van pas komt in een Veo-pipeline, is naast het videomodel in plaats van erin. De Google-tekstmodellen — Gemini 3.5 Flash, Gemini 3.1 Pro Preview, Gemini 3.6 Flash en de rest van de reeks — staan in de OrcaRouter-catalogus en zijn aanroepbaar via hetzelfde OpenAI-compatibele endpoint als 200+ andere modellen tegen de lijstprijs van de provider, met 0% opslag erbovenop. Shotlijsten, promptuitbreiding, het genereren van bijschriften, continuïteitsnotities tussen segmenten van acht seconden en het samenvatten van beoordelingen zijn allemaal tekstwerk, en dat is de laag waar het kunnen inzetten van een goedkoop model voor een bulkronde en een frontier-model voor de laatste ronde een configuratiewijziging vereist in plaats van een migratie. Veo 3.1 zelf routeren we niet, en Griffin evenmin; het is de moeite waard dat expliciet te vermelden in plaats van een alinea als deze de indruk te laten wekken dat het anders is.
Welke, serieus
• Kies Veo 3.1 wanneer het op te leveren resultaat een herkomstspoor nodig heeft, wanneer de koper gereguleerd is, wanneer distributie een bestand met bijgevoegde inloggegevens moet zijn, of wanneer 4K niet onderhandelbaar is. Houd in elk kostenmodel rekening met de ondergrens van acht seconden, en controleer de levenscyclus van de preview-ID voordat je daarop een klantgerichte route bouwt.
• Kies niet voor Griffin, want dat kun je niet. Vraag toegang aan als je vraag is of iemand in een gesprek van één minuut een AI van een mens kan onderscheiden, of als je moet weten waar de interactielaag naartoe gaat voordat je een roadmap voor de clip-laag vastlegt.
• Let op de detector, niet op de demo. Als Tavus een openbaarmakingsmechanisme publiceert dat een informeel gesprek doorstaat, wordt de kloof tussen deze twee leveranciers aanzienlijk kleiner. Als dat niet gebeurt, is Griffin een resultaat dat het vermelden waard is en blijft Veo 3.1 de enige van de twee die je voor een compliance-team kunt zetten.

