Een hero-kaart voor "Tavus Griffin vs HeyGen Video 1" met drie chips met de tekst "HeyGen Video — $0,01 per seconde", "Griffin — geen prijs, vraag toegang aan" en "HeyGen Video — 5 tot 15 seconden bij 768p", boven zes rijen: HeyGen gelanceerd: 30 september 2026; Griffin aangekondigd: 1 oktober 2026; HeyGen-prijs: $0,01 per seconde; Griffin-prijs: niet gepubliceerd; HeyGen-uitvoer: clips van 5 tot 15 seconden; Griffin-uitvoer: een live sessie. Voettekst: "HeyGen Video gelanceerd op 30 september 2026; Griffin werd aangekondigd op 1 oktober 2026 als preview."
Guides & Insights

Tavus Griffin vs HeyGen Video 1: Zesendertig uur uit elkaar, en slechts één is te koop

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Twee lanceringen kwamen binnen zesendertig uur van elkaar uit in dezelfde hoek van de markt, en de kalender is het meest interessante aan de combinatie. HeyGen Video ging live op 30 september 2026 voor $ 0,01 per seconde tot en met oktober, getuned op basis van MiniMax H3 en uitgebracht onder de identifier heygen-video-1. Tavus Griffin werd aangekondigd op 1 oktober 2026 met een live face-to-face-onderzoek waarin 26 van de 54 deelnemers geloofden dat hun gesprekspartner een echt persoon was, en het is alleen beschikbaar voor een selecte groep vertrouwde testers achter een aanvraagformulier, zonder identifier, zonder endpoint en zonder prijs. Beide draaien om het genereren van een overtuigende mens. De eerlijke reden om Tavus Griffin en HeyGen Video 1 te vergelijken is niet dat een koper tussen hen zou kiezen — vandaag is slechts één van hen te koop — maar dat het verschil verklaart waarvoor elk is gebouwd, en wat een seconde gegenereerde mens werkelijk waard is.

De een verkoopt een clip, de ander verkoopt een gesprek.

HeyGen Video is een generalistisch videomodel dat toevallig ongewoon goed is in mensen. Het accepteert een prompt, of een prompt plus een afbeelding, of een prompt plus maximaal negen referentieafbeeldingen, drie referentievideo's en drie referentie-audioclips, en levert een clip van 5 tot 15 seconden lang op 480p of 768p, 24 fps, met AAC-audio op 32 kHz stereo met gegenereerde dialoog, omgevingsgeluid en effecten. Drie modi dekken de conditionering — text_to_video, image_to_video en reference_to_video, de standaardmodus — en de volgorde in de lijst wordt het label dat je in de prompt aanspreekt, dus de eerste vermelding van reference_images is <Picture 1>. Onbekende velden in het verzoek worden geweigerd in plaats van genegeerd, en een seed is een unsigned 32-bits integer die een opname herhaalbaar maakt wanneer je die vasthoudt en één clausule tegelijk wijzigt. Het is een productietool met een deterministische enveloppe.

Griffin keert bijna al die eigenschappen om. Het genereert 720p in chunks van 320 ms bij 25 fps op basis van één referentiefoto en speelt elke chunk af terwijl die wordt gedecodeerd, dus er valt geen cliplengte op te geven en er is geen bestand om terug te geven. Een Continuous Conversational Modeling-engine verwerkt audio en video en herbeoordeelt de uitwisseling met subseconde-intervallen, en kiest tussen zwijgen, een signaal geven, backchannelen of de beurt nemen; de expressieve regelaars ervan sturen parallel een streaming spraakgenerator en een streaming videogenerator aan. Een beslissing die midden in een zin wordt genomen, komt binnen dezelfde mini-beurt tot uiting in de stem en het gezicht. Je schrijft geen prompt; je praat ertegen, en het reageert op een pauze, een afgewende blik of een onderbreking.

Daarom zijn de twee geen vervangers, ook al genereren beide een mens. Aan HeyGen Video wordt gevraagd hoe een beschreven moment eruitziet. Aan Griffin wordt gevraagd wat er daarna zou moeten gebeuren.

Wat elke seconde kost, op degene waar je seconden kunt kopen

De introductieprijs van HeyGen Video is $0,01 per seconde tot en met oktober, en HeyGens eigen tekst beschrijft dat als 50% korting op een standaardprijs van $0,02. De kostengrafiek op dezelfde pagina, met als voetnoot dat dit de lijstprijs per seconde bij 768p met audio is vóór introductiepromoties, zet het op $0,03. Dat is een verschil van 50% tussen de tekst en de grafiek op het eigen introductiemateriaal van een leverancier, en totdat HeyGen een API-prijzenpagina publiceert, is de veilige interpretatie dat $0,01 bevestigd is omdat die live is, en dat het bedrag na oktober ergens tussen $0,02 en $0,03 ligt.

Reken het eens door voor duizend seconden — honderd clips van tien seconden — de eenheid waarin een bulkteam echt denkt:

• HeyGen Video in oktober — $10 tegen $0,01 per seconde.

• HeyGen Video na oktober — $20 tegen $0,02, of $30 tegen $0,03 volgens de grafiek.

• MiniMax H3, het basismodel waarop het is afgestemd — $80 tegen MiniMax' adviesprijs van $0,08 per seconde.

• Kling 3.0 Pro — $168 voor $0,168 per seconde.

• Veo 3.1 — $400 tegen $0,40 per seconde.

De reden dat rekenwerk de hoofdmoot van HeyGen's lancering is, is het wegwerppercentage. Teams die social cutdowns, advertentievarianten en productloops maken, genereren veel meer dan ze uitleveren, en bij een dubbeltje per poging van tien seconden krijgt de economie van het weggooien van kandidaten een heel andere vorm. Het addertje onder het gras is het plafond: 768p bij 24 fps is geen 2K-leveringsformaat, en MiniMax H3 bereikt 2K via een aparte regeneratiemodule op MiniMax' eigen gehoste API voor $0,13 per seconde, zonder equivalent op HeyGen Video. Als je leveringsdoel boven 768p ligt, is de goedkope seconde niet de seconde die je nodig hebt.

De kolom van Griffin in die lijst is leeg, en niet op een veelbelovende manier. Tavus heeft geen tarief gepubliceerd, omdat Griffin-Lite een preview in onderzoeksfase is waarvan de eigen aankondiging zegt dat het op dit moment niet beschikbaar zal zijn voor klantgebruik en niet op het Tavus-platform staat. Bij een duizend-secondenmodel valt er niets in te vullen. Iedereen die een getal voor Griffin noemt, verzint het.

De kwaliteitscijfers, en wie beoordeelt

Geen van deze modellen heeft een onafhankelijke score, wat het waard is om vooraf te vermelden, omdat beide leveranciers grafieken hebben.

Die van HeyGen is een Elo-tabel met HeyGen Video genormaliseerd naar 1000, dan Dreamina Seedance 2.0 op 955, de H3 Max-familie die uiteenloopt van 952 tot 860, Kling 3.0 Pro op 857 en Veo 3.1 op 744. De voetnoot doet het meeste werk: de scores komen uit een interne evaluatieset van Artificial Analysis Arena-query's met 4.800 stemmen, en de eigen score van HeyGen is genormaliseerd naar 1000 voor eenvoudiger vergelijking. Een leverancier die zichzelf naar de top van zijn eigen grafiek normaliseert, is een presentatiekeuze, geen bewijs dat hij vooroploopt. De relatieve afstand daaronder is het informatieve deel.

Nuttiger is de rechtstreekse vergelijking, de enige plek waar HeyGen zich meet met iets dat het niet zelf heeft gebouwd. HeyGen zegt dat blinde testers in 55,8% van de vergelijkingen de voorkeur gaven aan zijn model boven de in de grafiek opgenomen H3 Max post-train, op basis van 650 stemmen, met een bereik van 49–62%. Dat bereik is het eerlijke detail: aan de onderkant schommelt het rond 50%, dus volgens de cijfers van de leverancier zelf is de voorkeur boven die rivaal niet duidelijk te onderscheiden van ruis. De uitsplitsing per as is gemengd op een manier die leest als een specifiek faalprofiel — 65% op trouw blijven aan de bronafbeelding en 66% op timing, tegenover 43% op consistentie en 45% op muziek.

De cijfers van Griffin komen van een instrument dat door iemand anders is gebouwd, en dat is het verschil dat ertoe doet. VideoFDB van NVIDIA is een benchmark voor full-duplex audiovisuele conversatie, beoordeeld op twee sporen, en NVIDIA heeft hem gebouwd en voert de evaluatie uit met zijn eigen beoordelaar aan de hand van een gepubliceerde rubric. Griffin-Lite scoorde 3,83 van de 5 op generatie tegenover een menselijke referentie van 3,92, en 2,80 voor het op een na hoogst gepubliceerde systeem, en 3,73 op perceptie tegenover een menselijke referentie van 4,20. Tavus rapporteert ook 0,43 seconde werkelijke audio-naar-video-latentie voor de generator, tegenover vier gepubliceerde streaming-diffusiebasislijnen op H100's. De kanttekeningen gelden nog steeds — een verschil van 0,09 punt met de menselijke referentie op een door een taalmodel beoordeelde rubric met vijf punten is "dichtbij", niet "gelijk", en een deel van de voorsprong op perceptie wordt gemeten tegen systemen die zonder video-invoer draaien — maar de beoordelaar is niet de leverancier.

• Onafhankelijke kwaliteitsscores — geen van beide heeft er een. HeyGen Video staat per 2 oktober 2026 op geen van de drie videoboards van Artificial Analysis, en Griffin ook niet. Griffin misschien wel nooit: paarsgewijze preferentiestemming over korte clips kan een live gesprek niet beoordelen.

Dezelfde leaderboards bevatten wél het basismodel. MiniMax H3 staat 4e op tekst-naar-video (met audio) met een Elo van 1.139 en 2e op afbeelding-naar-video met 1.181, beide tegen $4,80/min — dus HeyGens post-train concurreert op een substraat dat een onafhankelijke arena al nabij de top waardeert, wat het sterkste argument in zijn voordeel is dat HeyGen zelf niet heeft gepubliceerd.

A screenshot of the top of Artificial Analysis's text-to-video-with-audio board, captured 2 October 2026: Wan 3.0 first at Elo 1,157 and $12.00/min, Utopai X (based on MiniMax H3) second at 1,150, Dreamina Seedance 2.5 third at 1,144, MiniMax H3 (768p) fourth at Elo 1,139 with 7,496 votes and $4.80/min, MiniMax H3 Max (based on MiniMax H3) fifth at 1,134 with 5,510 votes, and FLUX 3 sixth at 1,127, with release months and per-minute API pricing columns visible.

Beide zijn goedkoop of niet te beprijzen om dezelfde reden.

Het structurele feit onder beide lanceringen is dat het maken van een overtuigende mens goedkoop is geworden, en geen van beide bedrijven ontleent zijn kostenvoordeel aan wat het verkoopt.

HeyGen Video is een post-training van MiniMax H3, dat MiniMax uitbracht met gewichten die beschikbaar zijn onder zijn eigen communitylicentie. Daardoor werd H3 een substraat waarin andere bedrijven zich kunnen specialiseren en dat ze kunnen doorverkopen, en HeyGen is het tweede product dat dit binnen vijf weken doet voor een andere verticale markt — bedrijfsvideo's, productdemo's, trainingen, woningrondleidingen. Dat patroon is de reden waarom HeyGen lager kan prijzen dan de basis: het draagt niet de kosten van het basismodel, en de basis is een release met open gewichten van iemand anders.

Griffin is de tegenovergestelde weddenschap. Tavus bouwde het hele systeem — de codec, de streaming spraakgenerator, de streaming videogenerator, het conversationele model — rond de interactie zelf, en destilleerde in drie fasen een grote bidirectionele diffusie-teacher tot een autoregressieve generator met enkele stappen, zodat lange rollouts niet afdrijven. Dat is duur onderzoek zonder een open basis om op te staan, en het is een aannemelijk deel van de reden waarom de release is afgeschermd: er zit geen goedkoop substraat onder om te amortiseren.

Beide bedrijven komen ook, vanuit verschillende richtingen, op hetzelfde ongemakkelijke punt uit. In HeyGen's eigen documentatie staat waar het model het slechtst in is, wat zeldzaam is en de moeite waard om te lezen: lange tekst op het scherm, zachte organische bewegingen zoals bloemblaadjes, papier en haar, en close-up handwerk zoals het in elkaar zetten of bedienen van apparatuur. Het is het beste in korte, afgebakende shots — één onderwerp, één plek, één actie, een stilstaande of nauwelijks bewegende camera. Griffins beperking is geen lijst met faalmodi, maar een onopgelost veiligheidsprobleem: Tavus stelt ronduit dat de eigenschappen die een model voor menselijke interactie een betere interface maken, het ook beter maken in iemand ervan overtuigen dat die met een mens praat, en dat het de preview achterhoudt terwijl het mechanismen voor openbaarmaking bouwt.

Wat een koper vandaag daadwerkelijk kan doen

HeyGen Video is nu aanroepbaar.POST /v3/models/videos met een x-api-key-header, alleen op betaalde API-sleutels, met downloadlinks die ondertekend zijn en verlopen — dus polling ververst ze — en callbacks die één keer per taak worden geprobeerd, wat HeyGen zelf zegt te behandelen als een latentie-optimalisatie in plaats van een garantie. Als je het deze maand test, is de promotionele seconde van $0,01 live, is het uitvoerplafond 768p, en is de prompt-versterkingsmodus een echte hefboom voor kosten: standaard turbo, quality voor een langere pass, uitgeschakeld om je tekst ongewijzigd door te sturen.

Griffin is niet aanroepbaar. Toegang is een aanvraagformulier en een onderzoekspreview. Er is geen sleutel, geen identificatie, geen endpoint en geen SLA, en de enige gepubliceerde verklaring over de beschikbaarheid is dat die beschikbaar komt zodra Tavus heeft uitgewerkt hoe Griffin veilig kan worden uitgebracht.

Eén ding dat beide gemeen hebben, is dat geen van beide een model is dat een router je kan helpen bereiken, en in het geval van Griffin is dat een categorisch probleem en niet een tijdelijk probleem — een realtime full-duplexsessie is geen request-response-aanroep. Waar een router wel mee helpt in beide pipelines, is de laag rond de video. Promptuitbreiding, de inventaris van referentieafbeeldingen, shotbeschrijvingen, het genereren van ondertitels en het samenvatten van beoordelingen zijn allemaal tekstdoorverzoeken, en die van OpenAI, Google en de rest staan in de OrcaRouter-catalogus achter één OpenAI-compatibel endpoint met 200+ modellen op dezelfde sleutel, tegen de lijstprijs van de provider, met 0% markup toegevoegd, zodat een prijswijziging van een leverancier dezelfde dag nog live is. Wat het videomodel zelf betreft, is er één nuttig feit: MiniMax H3 — de basis waar HeyGen Video op is afgestemd, en het model waarvan de prijs per seconde door HeyGen's $0,01 wordt onderboden — wordt hier gerouteerd als minimax/minimax-h3 voor $0,08 per seconde, met 2K voor $0,13. HeyGen Video zelf staat niet in onze catalogus en Griffin ook niet; beide worden aangeboden via de API's van hun eigen leveranciers en verschillende platformen van derden.

A screenshot of OrcaRouter's own model page for MiniMax-H3, captured 2 October 2026, showing the model id minimax/minimax-h3 labelled "text + image + video + audio", an Output type of video, a p50 time-to-first-token of 375 ms, and the OrcaRouter navigation and pricing panels alongside.

Welke, en voor wie?

• Gebruik HeyGen Video als het eindproduct bestaat uit korte, afgebakende, persoonsgerichte beelden met ingebouwd geluid en je kunt leven met 768p bij 24 fps. Begroot het tarief van na oktober op ergens tussen $0,02 en $0,03 per seconde in plaats van het promotionele dubbeltje, en test lange tekst op het scherm en handwerk in close-up voordat je er een workflow aan vastlegt, want HeyGen heeft je al gezegd dat dat de plekken zijn waar het misgaat.

• Baseer je planning niet op Griffin. Vraag toegang aan als je vraag is of iemand tijdens een gesprek van één minuut een gegenereerde mens van een echte kan onderscheiden, of als je moet zien waar een real-time interactielaag naartoe gaat voordat je een roadmap vastlegt voor gerenderde clips.

• Let op de openbaarmakingskwestie, want dat is het enige dat beide partijen in beweging zal brengen. De klanten van HeyGen Video hebben een eenvoudig antwoord beschikbaar — het model is een post-train van een open-weights-basis en de output is een bestand met een bekende herkomst — terwijl Tavus een model achterhoudt, juist omdat het er nog geen heeft. Welk bedrijf dan ook het betere openbaarmakingsmechanisme publiceert, zal het waardevollere probleem hebben opgelost.

A two-column scoreboard titled "Tavus Griffin vs HeyGen Video 1 — the scoreboard". Left column "Tavus Griffin": Status: research preview; Price: none published; Output: live session; Resolution: 720p at 25 fps; Clip length: none - a session; Independent score: none. Right column "HeyGen Video 1": Status: live 30 September 2026; Price: $0.01 per second; Output: video file; Resolution: 768p at 24 fps; Clip length: 5 to 15 seconds; Independent score: none yet. Footer: "HeyGen price per HeyGen's launch page, October 2026. Neither has an independent score."