
Gemini 3.8 Live vs GPT-Live-1: full-duplex versus het model dat denkt terwijl het praat
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0240Intelligentie72Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligentie69Coderen
Ongeveer twee maanden lang werd de discussie beslecht door de architectuur. GPT-Live-1 is echt full-duplex — het luistert terwijl het spreekt, produceert backchannels zoals "mhmm" en "begrepen", en beslist meerdere keren per seconde of het moet praten of de beurt moet laten. Gemini 3.8 Live, aangekondigd op 15 september 2026, is een beurtgebaseerd model. Binnen het oude kader maakte dat de vergelijking gemakkelijk, en nu is dat de verkeerde manier om het te lezen.
Wat veranderd is, is niet dat Google full-duplex heeft geëvenaard. Het is dat Google het ding heeft geleverd waarvoor full-duplex werd gebruikt om te compenseren: een spraakmodel dat een gesprek kan voeren terwijl op de achtergrond een taak met meerdere stappen loopt, en een tweede variant die hardop redeneert terwijl hij werkt. Het architecturale verschil is reëel. Het is alleen niet langer de as die de aankoop bepaalt.
Twee manieren om een gesprek gaande te houden
De full-duplex-inzet is dat gesprekskwaliteit het product is. GPT-Live-1 verwerkt audio-invoer en audio-uitvoer continu en synchroon binnen één enkel model, in plaats van spraak-naar-tekst aan een taalmodel en vervolgens aan tekst-naar-spraak te koppelen. Dat elimineert het informatieverlies tussen de fasen, en het levert het gedrag op dat mensen daadwerkelijk opmerken: je kunt midden in een antwoord onderbreken en het past zich aan; het ziet een pauze of achtergrondgeluid niet aan voor het einde van je beurt; het blijft stil totdat het wordt aangesproken.
De op beurten gebaseerde weddenschap die Gemini 3.8 Live aangaat, is dat het gesprek een steiger voor werk is. De functies ervan zijn erop gericht de sessie productief te houden in plaats van het ritme natuurlijk te houden: verwerking van visuele invoer bijna in realtime, automatische overgang tussen 97 ondersteunde talen midden in een gesprek, en uitvoering van tools en API's op de achtergrond die een verzoek bevestigt en blijft praten terwijl de aanroep wordt voltooid.
Beide modellen weigeren de verbinding met je te verbreken terwijl ze nadenken. Ze weigeren het alleen op een andere manier. GPT-Live-1 doet dat door de audiostream nooit te stoppen. Google doet dat door tijdens het werk te blijven praten.

Wat de index eigenlijk zegt
Artificial Analysis onderhoudt een Speech to Speech Index — een gewogen composiet van spraakredenering, agentische prestaties, arena-voorkeur en taaksuccespercentage. Lees het bord dat op 16 september 2026 is vastgelegd zorgvuldig, want de kop verbergt de structuur:
• Gemini 3.8 Live Extended Thinking — 82.6 (eerste)
• GPT-Live-1 (Astra-backend, gemiddelde inspanning) — 81.5
• Grok Voice Think Fast 2.0 High — 81,3
• GPT-Live-1 (Sol-backend, lage inspanning) — 80.1
• Gemini 3.8 Live — 76.0
• GPT-Realtime-2.1 High — 73,9
• Gemini 3.1 Flash Live High — 71.5
Uit die ordening volgen drie dingen. Ten eerste heeft Google de toppositie, maar wel met de dure variant, niet met de variant die de meeste mensen zullen inzetten. Ten tweede komt GPT-Live-1 twee keer voor, omdat Artificial Analysis het hele systeem beoordeelt in plaats van de spraakfront-end — en het verschil van 1,4 punt tussen zijn twee configuraties is zeven keer groter dan het verschil van 0,2 punt tussen de eerste en tweede plaats. Ten derde staat het model uit de titel van deze vergelijking, Gemini 3.8 Live, op de vijfde plaats, onder beide configuraties van GPT-Live-1.
Als je appels met appels vergelijkt — de standaardversie tegen de standaardversie — wint GPT-Live-1 deze confrontatie op de samengestelde index, en het scheelt nogal wat. De 82,6 is van Gemini 3.8 Live Extended Thinking, een ander product tegen een andere prijs met een andere uitrol.

Waar GPT-Live-1 nog steeds voorloopt
Full-duplex is geen marketingonderscheid, en de uitsplitsing van de benchmark laat zien waar het zich omzet in een echt voordeel:
• Agentische prestaties — GPT-Live-1 loopt op τ-Voice overtuigend voor met 67,9% tegenover 56,5% van Grok. Google heeft voor Gemini 3.8 Live geen vergelijkbaar τ-Voice-cijfer gepubliceerd, alleen 68,6% voor de Extended Thinking-variant.
• Gespreksdynamiek — full-duplex beurtwisseling blijft de benchmark voor natuurlijkheid, en beurtgebaseerde modellen hebben daar historisch op achtergelopen.
• Delegatiediepte — GPT-Live-1 draagt moeilijke queries over aan een frontier-tekstmodel, waarbij zowel GPT-5.5 als GPT-6 Astra als backends gedocumenteerd zijn, en biedt selectors voor reasoning-inspanning.
• Bronvermelding — spraaktranscripten van ChatGPT bevatten citatielinks, wat bij spraakinteracties in het algemeen ongewoon blijft.
Het tegenwicht is dat GPT-Live-1 achterblijft op het gebied van pure spraakredenering: 90,1% op Big Bench Audio tegenover 97,2% van Grok. En het opvallende latentiecijfer van 0,798 seconden op Full Duplex Bench is een andere meting dan de tijd tot de eerste audio van de API, die 1,24–1,34 seconden bedraagt.
Waar Gemini 3.8 Live vooroploopt
De voordelen van Google gaan minder over het gesprek en meer over wat de sessie kan doen:
• Visie, vandaag — Gemini ondersteunt al een tijdje camera-invoer en schermdelen. GPT-Live-1 werd gelanceerd zonder video of schermdelen, waarbij OpenAI zei dat die eraan komen en wees op de oudere Advanced Voice Mode als overbrugging. Gemini 3.8 Live voegt daar bovenop bijna realtime verwerking van visuele invoer aan toe.
• Taaldekking — 97 ondersteunde talen met automatisch wisselen midden in een gesprek, tegenover een veel beperkter aanbod aan de kant van OpenAI.
• Kosten — het aangekondigde tarief bedraagt $ 0,005 per minuut audio-invoer en $ 0,018 per minuut audio-uitvoer. GPT-Live-1 wordt gefactureerd tegen $ 0,05 per spraakminuut voor alleen de front-end, met een volledig gemeten kostprijs van ongeveer $ 4,47–$ 5,83 per uur wanneer back-endtokens worden meegerekend.
• Een tweede laag die hardop redeneert — Gemini 3.8 Live Extended Thinking vertelt de voortgang met aanwijzingen zoals "Laat me dat even checken…", wat een ander antwoord op het stilteprobleem is dan full-duplex.
De kostenvergelijking die ertoe doet
De front-endtarieven lijken een rout — $0,018 versus $0,05 per minuut — en de cijfers per uur zijn nog schrijnender. De grafiek van Artificial Analysis voor de kosten per uur aan invoeraudio zet Gemini 3.8 Live op $1,50 per uur, tegenover $4,14 voor GPT-Realtime-2 High en $10,75 voor GPT-Realtime-2.1 High. Grok Voice Think Fast 2.0 staat op $4,80.
Het addertje onder het gras is dat geen van beide getallen de werkelijke rekening is. De $0,05 per minuut van GPT-Live-1 dekt alleen de spraakfront-end; het backend-tekstmodel dat het daadwerkelijke redeneerwerk doet, wordt apart gefactureerd, en zo wordt een geadverteerde $0,05 per minuut in totaal $4,47–$5,83 per uur. Gemini 3.8 Live heeft dezelfde structurele opzet — het uitvoeren van tools op de achtergrond is werk voor het tekstmodel — en Google heeft niet gepubliceerd wat dat kost.
De eerlijke lezing is dus dat Gemini 3.8 Live aan de voorkant met een ruime marge goedkoper is, en dat de alles-inbegrepen vergelijking voor beide onbekend is totdat je je eigen werklast meet. Dat is geen uitvlucht; het is de werkelijke stand van de informatie.
De laag waaraan zij beiden delegeren
Dit is het structurele feit dat deze confrontatie minder een lock-in-beslissing maakt dan het lijkt. Beide modellen delegeren. GPT-Live-1 stuurt moeilijke queries per ontwerp door naar een backend-tekstmodel, en uitvoering van tools op de achtergrond aan de Gemini-kant komt neer op gewone modelaanroepen. In beide gevallen is de spraakfront-end een dunne laag bovenop een tekstmodel dat het redeneerwerk doet — en die tekstlaag is waar de variatie in je kosten zit en waar overstappen goedkoop is.
OrcaRouter biedt 190 modellen achter één sleutel tegen de lijstprijs van de provider, zonder opslag, dus een prijsverlaging upstream komt bij ons dezelfde dag aan in plaats van bij de volgende contractverlenging. Voor een spraakstack zijn de twee eigenschappen die ertoe doen dat het delegatiedoel kan worden omgewisseld tijdens liveverkeer zonder de spraakintegratie aan te raken, en dat automatische failover een gesprek in leven houdt wanneer een backend een fout geeft of een time-out krijgt. Eén verduidelijking, want het is gemakkelijk om iets anders te suggereren: we hosten de spraakeindpunten van Gemini 3.8 Live of GPT-Live-1 niet — die komen van de eigen API's van de leveranciers. De tekstmodellen waaraan zij werk uitbesteden, staan over het algemeen op de router.

Hoe te kiezen
Kies GPT-Live-1 als gesprekskwaliteit het product is — natuurlijke afhandeling van onderbrekingen, backchannels, en het gevoel dat je met iets praat in plaats van het te bedienen — en als je de all-in kosten kunt dragen, die aanzienlijk hoger zijn dan het geadverteerde tarief doet vermoeden. Let op: de API is pas sinds september 2026 beschikbaar, dus de tooling van derden eromheen is nog jong.
Kies Gemini 3.8 Liveals je nu vision nodig hebt, als je meer dan een paar dozijn talen nodig hebt, of als de kosten per minuut bepalend zijn voor je model. Accepteer dat je de standaardlaag koopt, die op de samengestelde index de vijfde plaats inneemt in plaats van de eerste, en dat de 82,6 die iedereen zal citeren bij de Extended Thinking-variant hoort.
Kies Gemini 3.8 Live Extended Thinking als het redeneervermogen het punt is en je de huidige koploper in de index wilt — maar controleer eerst de uitrol, want het distributiepad via Gemini Live, Docs, Gmail en Keep is breder dan dat van het standaardmodel en de beschikbaarheid voor het bedrijfsleven is nog steeds private preview.
Waar het komende kwartaal op moet worden gelet, is of full-duplex een slotgracht blijft. Beurtgebaseerde modellen dichten de gesprekskloof via een andere route — door de audio bezet te houden met gesproken tekst terwijl er werk plaatsvindt — en als dat standhoudt onder echt verkeer, zal het architectonische onderscheid dat deze categorie een jaar lang heeft gedefinieerd, niet langer het punt zijn waar kopers naar vragen.
Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
