
Tavus Griffin vs MiniMax H3: Een duplex conversatiemodel ontmoet een uitgebrachte videogenerator
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 223 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Tavus Griffin en MiniMax H3 zetten allebei een bewegend, sprekend mens op het scherm, en voorbij die eerste indruk behoren ze nauwelijks tot dezelfde productcategorie. Griffin is een Human Interaction Model — een video-naar-video-systeem dat is gebouwd om in realtime een tweerichtingsgesprek te voeren, aangekondigd door Tavus in oktober 2026 en momenteel beperkt tot een selecte groep vroege testers. MiniMax H3 is een omnimodale videogenerator: je geeft hem een prompt plus optionele referenties naar beeld, video en audio en hij levert een voltooide clip terug. De een wordt achter gesloten deuren geëvalueerd; de ander is al maanden downloadbaar, licentieerbaar en factureerbaar. Dat verschil — niet de resolutie of de framesnelheid — bepaalt welke van de twee in je stack thuishoort.
Wat elk ervan eigenlijk is
Griffin is Tavus' poging om een model te bouwen dat zich gedraagt als een deelnemer in plaats van als een renderer. Het bedrijf beschrijft het als het eerste Human Interaction Model, en de architectuur die het publiceerde splitst de taak in tweeën: Continuous Conversational Modeling, dat van moment tot moment bepaalt wat de persona zou moeten doen, en Audio-Visual Generation, dat de spraak en het bijpassende gezicht streamt. Cruciaal is dat het full duplex is — het kijkt en luistert terwijl het spreekt, zodat het onderbroken kan worden, midden in een uiting kan reageren en niet wacht op een schoon einde-van-beurt-signaal voordat het antwoordt. Tavus' eigen framing is dat eerdere systemen leerden gezichten te genereren; Griffin is gebouwd om conversatiegedrag van mensen te leren.
MiniMax H3 is de Hailuo 3-generatie, uitgebracht op 31 juli 2026 en op 3 augustus 2026 als open source vrijgegeven onder de MiniMax H3 Community License, met de varianten H3-Base-FL2VA en H3-Base-Ref2VA openbaar gepubliceerd. Het leest tekst-, beeld-, video- en audioreferenties als één uniforme context en levert een clip van 4 tot 15 seconden in 768P of 2K met native stereo-audio, gegenereerd via een pipeline in drie fasen (eerst H3-Context-IR, dan H3-Base op 768p, dan H3-Regenerate-2K). Het is een generator met een ongewoon breed invoeroppervlak en een werkelijk permissieve licentie — alles wat Griffin momenteel niet is.
De specificaties, naast elkaar

Waarom "duplex" het interessante woord is
Elke videogenerator, H3 inbegrepen, wordt beoordeeld op hoe een clip eruitziet als die eenmaal klaar is. Griffin wordt beoordeeld op iets wat een clip niet kan laten zien: wat er gebeurt in de 200 milliseconden nadat je hem onderbreekt. Dat is het probleem waar de Human Interaction Model-framing op wijst, en het is de reden waarom de belangrijkste cijfers van Tavus gedragsmatig zijn in plaats van visueel.
Het meest geciteerde cijfer is dat 48% van de mensen geloofde dat Griffin een echt persoon was na een videogesprek van één minuut — 26 van de 54 deelnemers — tegenover 2,4% voor Tavus' eerdere stack van Phoenix-4.5, Sparrow-2 en Raven-1, die 1 van 41 haalde. Tavus meldt ook dat mensen die niet overtuigd waren, doorgaans binnen de eerste 20 seconden argwaan kregen, wat een nuttiger detail is dan de kop: het betekent dat de illusie het ofwel vroeg houdt ofwel vroeg instort.
De tweede reeks cijfers komt uit de VideoFDB-benchmark van NVIDIA, gescoord in september 2026, waar Tavus zegt dat Griffin de eerste plaats behaalde in een onafhankelijke test van face-to-face-AI. Aan de generatiekant scoorde Griffin 3,83 tegenover 2,80 voor de sterkste gerapporteerde baseline (een Gemini 2.5 plus Anam-configuratie), met een menselijke referentie van 3,92 en een taakobjectiefscore van 62,8%. Aan de perceptiekant scoorde Griffin 3,73 tegenover 3,44 voor MiniCPM-o 4.5, 3,17 voor Gemini 2.5 Flash Native en 2,97 voor een OpenAI gpt-realtime-configuratie met alleen audio, tegenover een menselijke referentie van 4,20 en een taakobjectiefscore van 73,8%, over vijftien geëvalueerde modellen. Tavus beweert ook dat Griffin 37% voorloopt op het op een na beste systeem als het gaat om reageren op het moment zelf. Dit zijn door de leverancier gerapporteerde cijfers die steunen op een benchmark die NVIDIA heeft gebouwd, en zo moeten ze ook worden gelezen — maar het zijn de menselijke vergelijkingspunten die het waard zijn om te onthouden, want een 3,83 tegenover een menselijke score van 3,92 is een veel kleinere kloof dan videogeneratie historisch heeft laten zien.
Wat je vandaag kunt kopen
Hier zijn de twee modellen helemaal niet meer met elkaar te vergelijken.
MiniMax H3 is een product. Het wordt gehost, de prijs wordt per seconde gegenereerde output berekend, en de open varianten staan op een modelhub klaar om te worden gedownload. Als je een clip van vijftien seconden, 2K, met stereo-audio wilt van iets dat niet bestaat, kun je er vanmiddag al een hebben, en je kunt de gewichten zelf draaien als je ze liever niet huurt.
Tavus Griffin is geen product. Tavus is expliciet in de Griffin-beschrijving dat Griffin-Lite, de research preview, vandaag beschikbaar is voor een selecte groep vroege testers, dat een bredere release van een krachtiger model zal volgen, en dat Griffin nog niet op het Tavus-platform staat en pas zal komen zodra het bedrijf heeft uitgewerkt hoe het veilig kan worden uitgebracht. Dat is een ongebruikelijke mate van openhartigheid van een leverancier over zijn eigen meest opvallende resultaat, en het is belangrijk voor de planning: je kunt Griffin niet als afhankelijkheid in een productroadmap opnemen, en je kunt er geen prijs op plakken, want die is er niet.
Dus de eerlijke planningsvraag is niet "wat is beter", maar "welke ervan bestaat op de laag die ik nodig heb".

Waar OrcaRouter past
MiniMax H3 staat in onze catalogus. De modelpagina staat op minimax/minimax-h3, en de facturering verloopt zoals de provider factureert: $0,08 per seconde gegenereerde output bij 768P en $0,13 per seconde bij 2K. OrcaRouter geeft de lijstprijzen van de provider door tegen 0% opslag, dus een prijswijziging van MiniMax verschijnt dezelfde dag dat die wordt aangekondigd op onze kaart, in plaats van bij de volgende factuurcyclus. Griffin staat niet in de catalogus en zal daar pas in staan zodra Tavus het aan klanten levert — we hosten geen model dat we niet kunnen bedienen, en een research preview die beperkt is tot geselecteerde testers is niet iets waar een router naartoe kan routeren.
De praktische consequentie is dat een van deze twee modellen op één regel code afstand staat van je applicatie en het andere een onderzoekspaper met een telefoonnummer is. Als je al meerdere video- en taalmodellen routeert, maakt de per-seconde-facturering op H3 het ook het soort route dat de moeite waard is om achter automatische failover: een verzoek dat bij een verzadigde provider terechtkomt, wordt opnieuw geprobeerd bij een gezonde provider in plaats van een time-out te tonen, en een routing-DSL laat je 2K-taken aan een specifieke provider vastpinnen, terwijl 768P-concepten terechtkomen waar de capaciteit het goedkoopst is. Modelfusie is de andere hefboom die hier het vermelden waard is — de per-seconde-prijs van H3 is laag genoeg dat het inzetten van een tekstmodel om een prompt te herschrijven en opnieuw te knippen vóór generatie vaak goedkoper is dan de verspilde seconden van een slechte eerste poging.

Waar de vergelijking zou kunnen omslaan
Drie dingen zouden deze vergelijking veranderen, en slechts drie.
Ten eerste, als Tavus Griffin op een commerciële API zet met een gepubliceerd tarief, wordt het hele "gesprek versus clip"-kader een echte koopbeslissing in plaats van een planningsbeslissing, en begint het face-to-face-cijfer van 48% direct te concurreren met de kwaliteit van generatieve output. Ten tweede, als het realtimeverhaal van H3 verbetert — en MiniMax brengt agressief uit — zou een generator die per seconde werkt en kan streamen Griffins kernvoordeel afzwakken. Ten derde, als NVIDIA of een andere neutrale partij VideoFDB opnieuw uitvoert met H3 of zijn opvolger erin opgenomen, is de bewering dat Griffin de eerste is in face-to-face-AI niet langer onweerlegbaar. Tavus zegt dat het verwacht Griffin zeer binnenkort uit te brengen nadat de veiligheidskwesties zijn aangepakt; die zin is de hele tijdlijn.
Kortom
MiniMax H3 en Tavus Griffin zijn momenteel geen rivalen, want slechts één van hen is te koop. H3 is een uitgebrachte, open-weight omni-modale generator met een prijs per seconde en een gepubliceerde prijs en een uitvoervenster van 4 tot 15 seconden; Griffin is een duplex conversationeel model met de beste face-to-face-cijfers die iemand heeft gepubliceerd, geen API, geen prijs, en een expliciete verklaring van zijn eigen leverancier dat klanten het nog niet kunnen gebruiken. Als je vandaag videogeneratie nodig hebt, is H3 het antwoord en het is meetbaar in centen per seconde. Als je een real-time gezicht nodig hebt dat onderbroken kan worden, let dan op Tavus — maar bouw eerst de rest van het product, want de releasedatum is een zin, geen datum.
