Hero-titelkaart voor 'Tavus Griffin vs MiniMax H3' met als ondertitel 'Een duplex conversationeel model ontmoet een uitgebrachte videogenerator', boven vier chips: Tavus Griffin onderzoekspreview, alleen voor testers; MiniMax H3 open gewichten, uitgebracht; MiniMax H3 $0,08/s bij 768P; Griffin: geen API, geen prijs.
Guides & Insights

Tavus Griffin vs MiniMax H3: Een duplex conversatiemodel ontmoet een uitgebrachte videogenerator

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Tavus Griffin en MiniMax H3 zetten allebei een bewegend, sprekend mens op het scherm, en voorbij die eerste indruk behoren ze nauwelijks tot dezelfde productcategorie. Griffin is een Human Interaction Model — een video-naar-video-systeem dat is gebouwd om in realtime een tweerichtingsgesprek te voeren, aangekondigd door Tavus in oktober 2026 en momenteel beperkt tot een selecte groep vroege testers. MiniMax H3 is een omnimodale videogenerator: je geeft hem een prompt plus optionele referenties naar beeld, video en audio en hij levert een voltooide clip terug. De een wordt achter gesloten deuren geëvalueerd; de ander is al maanden downloadbaar, licentieerbaar en factureerbaar. Dat verschil — niet de resolutie of de framesnelheid — bepaalt welke van de twee in je stack thuishoort.

Wat elk ervan eigenlijk is

Griffin is Tavus' poging om een model te bouwen dat zich gedraagt als een deelnemer in plaats van als een renderer. Het bedrijf beschrijft het als het eerste Human Interaction Model, en de architectuur die het publiceerde splitst de taak in tweeën: Continuous Conversational Modeling, dat van moment tot moment bepaalt wat de persona zou moeten doen, en Audio-Visual Generation, dat de spraak en het bijpassende gezicht streamt. Cruciaal is dat het full duplex is — het kijkt en luistert terwijl het spreekt, zodat het onderbroken kan worden, midden in een uiting kan reageren en niet wacht op een schoon einde-van-beurt-signaal voordat het antwoordt. Tavus' eigen framing is dat eerdere systemen leerden gezichten te genereren; Griffin is gebouwd om conversatiegedrag van mensen te leren.

MiniMax H3 is de Hailuo 3-generatie, uitgebracht op 31 juli 2026 en op 3 augustus 2026 als open source vrijgegeven onder de MiniMax H3 Community License, met de varianten H3-Base-FL2VA en H3-Base-Ref2VA openbaar gepubliceerd. Het leest tekst-, beeld-, video- en audioreferenties als één uniforme context en levert een clip van 4 tot 15 seconden in 768P of 2K met native stereo-audio, gegenereerd via een pipeline in drie fasen (eerst H3-Context-IR, dan H3-Base op 768p, dan H3-Regenerate-2K). Het is een generator met een ongewoon breed invoeroppervlak en een werkelijk permissieve licentie — alles wat Griffin momenteel niet is.

De specificaties, naast elkaar

Two-card board titled 'One Is a Product'. Left card, MiniMax H3: omni-modal video generator, Hailuo 3 generation; released 31 July 2026 with open weights on 3 August 2026; 4 to 15 seconds at 768P or 2K with native stereo audio; text, image, video and audio inputs in one context; $0.08 per second at 768P and $0.13 at 2K; hosted and billable today. Right card, Tavus Griffin: duplex Human Interaction Model, video to video; announced October 2026 as a research preview; 720p at 25 fps in 320-millisecond chunks; the live participant's video and audio as input; no published price; selected testers only, not for customer use.

Waarom "duplex" het interessante woord is

Elke videogenerator, H3 inbegrepen, wordt beoordeeld op hoe een clip eruitziet als die eenmaal klaar is. Griffin wordt beoordeeld op iets wat een clip niet kan laten zien: wat er gebeurt in de 200 milliseconden nadat je hem onderbreekt. Dat is het probleem waar de Human Interaction Model-framing op wijst, en het is de reden waarom de belangrijkste cijfers van Tavus gedragsmatig zijn in plaats van visueel.

Het meest geciteerde cijfer is dat 48% van de mensen geloofde dat Griffin een echt persoon was na een videogesprek van één minuut — 26 van de 54 deelnemers — tegenover 2,4% voor Tavus' eerdere stack van Phoenix-4.5, Sparrow-2 en Raven-1, die 1 van 41 haalde. Tavus meldt ook dat mensen die niet overtuigd waren, doorgaans binnen de eerste 20 seconden argwaan kregen, wat een nuttiger detail is dan de kop: het betekent dat de illusie het ofwel vroeg houdt ofwel vroeg instort.

De tweede reeks cijfers komt uit de VideoFDB-benchmark van NVIDIA, gescoord in september 2026, waar Tavus zegt dat Griffin de eerste plaats behaalde in een onafhankelijke test van face-to-face-AI. Aan de generatiekant scoorde Griffin 3,83 tegenover 2,80 voor de sterkste gerapporteerde baseline (een Gemini 2.5 plus Anam-configuratie), met een menselijke referentie van 3,92 en een taakobjectiefscore van 62,8%. Aan de perceptiekant scoorde Griffin 3,73 tegenover 3,44 voor MiniCPM-o 4.5, 3,17 voor Gemini 2.5 Flash Native en 2,97 voor een OpenAI gpt-realtime-configuratie met alleen audio, tegenover een menselijke referentie van 4,20 en een taakobjectiefscore van 73,8%, over vijftien geëvalueerde modellen. Tavus beweert ook dat Griffin 37% voorloopt op het op een na beste systeem als het gaat om reageren op het moment zelf. Dit zijn door de leverancier gerapporteerde cijfers die steunen op een benchmark die NVIDIA heeft gebouwd, en zo moeten ze ook worden gelezen — maar het zijn de menselijke vergelijkingspunten die het waard zijn om te onthouden, want een 3,83 tegenover een menselijke score van 3,92 is een veel kleinere kloof dan videogeneratie historisch heeft laten zien.

Wat je vandaag kunt kopen

Hier zijn de twee modellen helemaal niet meer met elkaar te vergelijken.

MiniMax H3 is een product. Het wordt gehost, de prijs wordt per seconde gegenereerde output berekend, en de open varianten staan op een modelhub klaar om te worden gedownload. Als je een clip van vijftien seconden, 2K, met stereo-audio wilt van iets dat niet bestaat, kun je er vanmiddag al een hebben, en je kunt de gewichten zelf draaien als je ze liever niet huurt.

Tavus Griffin is geen product. Tavus is expliciet in de Griffin-beschrijving dat Griffin-Lite, de research preview, vandaag beschikbaar is voor een selecte groep vroege testers, dat een bredere release van een krachtiger model zal volgen, en dat Griffin nog niet op het Tavus-platform staat en pas zal komen zodra het bedrijf heeft uitgewerkt hoe het veilig kan worden uitgebracht. Dat is een ongebruikelijke mate van openhartigheid van een leverancier over zijn eigen meest opvallende resultaat, en het is belangrijk voor de planning: je kunt Griffin niet als afhankelijkheid in een productroadmap opnemen, en je kunt er geen prijs op plakken, want die is er niet.

Dus de eerlijke planningsvraag is niet "wat is beter", maar "welke ervan bestaat op de laag die ik nodig heb".

Screenshot of Artificial Analysis's 'AA-Video-T2V v2.0' leaderboard, the Overall board for text-to-video, captured 2 October 2026: Wan 3.0 first at Elo 1,157, Utopai X (based on MiniMax H3) second at 1,150, Dreamina Seedance 2.5 third at 1,144, MiniMax H3 (768p) fourth at 1,139 and MiniMax H3 Max fifth at 1,134, with samples, release month and per-minute API pricing columns. The board lists MiniMax H3 and MiniMax H3 Max fourth and fifth with audio, though the with-audio filter itself is not applied in this capture.

Waar OrcaRouter past

MiniMax H3 staat in onze catalogus. De modelpagina staat op minimax/minimax-h3, en de facturering verloopt zoals de provider factureert: $0,08 per seconde gegenereerde output bij 768P en $0,13 per seconde bij 2K. OrcaRouter geeft de lijstprijzen van de provider door tegen 0% opslag, dus een prijswijziging van MiniMax verschijnt dezelfde dag dat die wordt aangekondigd op onze kaart, in plaats van bij de volgende factuurcyclus. Griffin staat niet in de catalogus en zal daar pas in staan zodra Tavus het aan klanten levert — we hosten geen model dat we niet kunnen bedienen, en een research preview die beperkt is tot geselecteerde testers is niet iets waar een router naartoe kan routeren.

De praktische consequentie is dat een van deze twee modellen op één regel code afstand staat van je applicatie en het andere een onderzoekspaper met een telefoonnummer is. Als je al meerdere video- en taalmodellen routeert, maakt de per-seconde-facturering op H3 het ook het soort route dat de moeite waard is om achter automatische failover: een verzoek dat bij een verzadigde provider terechtkomt, wordt opnieuw geprobeerd bij een gezonde provider in plaats van een time-out te tonen, en een routing-DSL laat je 2K-taken aan een specifieke provider vastpinnen, terwijl 768P-concepten terechtkomen waar de capaciteit het goedkoopst is. Modelfusie is de andere hefboom die hier het vermelden waard is — de per-seconde-prijs van H3 is laag genoeg dat het inzetten van een tekstmodel om een prompt te herschrijven en opnieuw te knippen vóór generatie vaak goedkoper is dan de verspilde seconden van een slechte eerste poging.

Screenshot of the OrcaRouter model page for MiniMax-H3, showing the model id minimax/minimax-h3, the description 'omni-modal video generation model (the Hailuo 3 generation), released July 31, 2026', a price of $0.08 per second, p50 time to first token of 375 ms and p95 of 416 ms over seven days.

Waar de vergelijking zou kunnen omslaan

Drie dingen zouden deze vergelijking veranderen, en slechts drie.

Ten eerste, als Tavus Griffin op een commerciële API zet met een gepubliceerd tarief, wordt het hele "gesprek versus clip"-kader een echte koopbeslissing in plaats van een planningsbeslissing, en begint het face-to-face-cijfer van 48% direct te concurreren met de kwaliteit van generatieve output. Ten tweede, als het realtimeverhaal van H3 verbetert — en MiniMax brengt agressief uit — zou een generator die per seconde werkt en kan streamen Griffins kernvoordeel afzwakken. Ten derde, als NVIDIA of een andere neutrale partij VideoFDB opnieuw uitvoert met H3 of zijn opvolger erin opgenomen, is de bewering dat Griffin de eerste is in face-to-face-AI niet langer onweerlegbaar. Tavus zegt dat het verwacht Griffin zeer binnenkort uit te brengen nadat de veiligheidskwesties zijn aangepakt; die zin is de hele tijdlijn.

Kortom

MiniMax H3 en Tavus Griffin zijn momenteel geen rivalen, want slechts één van hen is te koop. H3 is een uitgebrachte, open-weight omni-modale generator met een prijs per seconde en een gepubliceerde prijs en een uitvoervenster van 4 tot 15 seconden; Griffin is een duplex conversationeel model met de beste face-to-face-cijfers die iemand heeft gepubliceerd, geen API, geen prijs, en een expliciete verklaring van zijn eigen leverancier dat klanten het nog niet kunnen gebruiken. Als je vandaag videogeneratie nodig hebt, is H3 het antwoord en het is meetbaar in centen per seconde. Als je een real-time gezicht nodig hebt dat onderbroken kan worden, let dan op Tavus — maar bouw eerst de rest van het product, want de releasedatum is een zin, geen datum.