
Eleven v4 vs Gemini 3.1 Flash TTS: een verschil van 116 punten, en het goedkopere Google-model
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 982 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 197 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
Als je vandaag op zoek gaat naar de stem van Google, zul je bij de verkeerde uitkomen. Google Gemini 3.1 Flash TTS staat op rang 11 op Artificial Analysis' Provider Voice Arena met een Elo van 1.203 over 3.512 verschijningen, tegen $18,31 per miljoen tekens. ElevenLabs Eleven v4, uitgebracht op 28 september 2026, staat op rang 1 met een Elo van 1.319 over 1.674 verschijningen, tegen $80,00 per miljoen. Dat lijkt een gat van 116 punten tegenover een goedkopere uitdager — tot je beseft dat Googles eigen Gemini 3.8 Flash TTS derde staat op dezelfde ranglijst met 1.267 en een lagere genormaliseerde prijs van $16,49. De echte wedstrijd is niet degene die de kop van de confrontatie doet vermoeden, en de reden is een releasedatum.
Een van deze is achttien maanden nieuwer dan hij lijkt.
Gemini 3.1 Flash TTS heeft op de ranglijst een releasedatum van 15 april 2026. Voor Eleven v4 is dat 28 september 2026. Dat is vijf en een halve maand, wat in spraaksynthese geen generatie is, maar wel lang genoeg dat Google al een opvolger heeft uitgebracht: Gemini 3.8 Flash TTS en Gemini 3.8 Flash-Lite TTS werden beide op 23 september 2026 algemeen beschikbaar, vijf dagen vóór Eleven v4, en beide staan hoger dan 3.1 op dezelfde ranglijst. Gemini 3.8 Flash-Lite TTS staat zesde met 1.241 en $11,03 per miljoen.

Dus de eerlijke vergelijking heeft drie punten, niet twee, en de ordening op prijs is het interessante deel:
• Rang 1, ElevenLabs Eleven v4 — Elo 1.319, $80,00 per miljoen tekens, 1.674 vermeldingen, ±19 interval
• Rang 3, Google Gemini 3.8 Flash TTS — Elo 1.267, $16,49 per miljoen tekens, uitgebracht op 23 september 2026
• Rang 6, Google Gemini 3.8 Flash-Lite TTS — Elo 1.241, $11,03 per miljoen tekens, uitgebracht op 23 september 2026
• Rang 11, Google Gemini 3.1 Flash TTS — Elo 1.203, $ 18,31 per miljoen tekens, uitgebracht op 15 april 2026, 3.512 verschijningen, ±12 interval
Let op wat de intervallen met die ordening doen. Gemini 3.1 Flash TTS schat 1.203 met een interval van ±12, dus de werkelijke waarde ligt ergens rond 1.191 tot 1.215. Eleven v4 schat 1.319 met een interval van ±19 — ruwweg 1.300 tot 1.338. De twee bereiken raken elkaar niet, en de kloof ertussen is meer dan honderd punten breed. Zuiverder krijg je een voorkeursbord niet.

Waarom de steekproefaantallen meer uitmaken dan de rangen
Gemini 3.1 Flash TTS heeft 3.512 verschijningen achter zijn schatting; Eleven v4 heeft er 1.674, omdat het één dag oud is op deze ranglijst. De schatting van een nieuwer model draagt meer onzekerheid per steekproef, en het interval van ±19 weerspiegelt dat. Als je het soort koper bent dat wacht tot een getal zich stabiliseert, is de vuistregel dat de rangorde die boven de intervalbreedte uitstijgt, het deel is waarop je kunt handelen. Hier doorstaat de rangschikking zijn foutmarges ruimschoots in beide richtingen — vóór 3.8 Flash TTS en achter niemand in deze vergelijking.
De arena telt ook arenastemmen: acht voor Eleven v4, zeven voor Gemini 3.1 Flash TTS. Dat is het aantal verschillende leveranciersstemmen dat in de blindtests is gebruikt, en het is een ruwe indicator voor hoeveel standaardcast een leverancier meebrengt. De eerste plaats van Eleven v4 is verdiend met acht stemmen, wat betekent dat de overwinning niet één gelukkige verteller is.
De capaciteitsverschillen die de Elo niet inprijst
De boards meten voorkeur, niet functiedekking. Vier verschillen zijn bepalend voor echte projecten en geen ervan komt voor in een Elo.
• Scriptrichting — Eleven v4 documenteert inline audiotags ([lacht], [fluistert], [boos gezegd met Frans accent]) en prompts in natuurlijke taal voor de voordracht; Google's 3.1 generation documenteert stemkeuze en prompting, maar niet een equivalente tag-syntaxis voor uitvoeringsaanwijzingen.
• Spraakcreatie — de Gemini 3.8-generatie voegde stemontwerp op basis van een geschreven beschrijving toe, plus stemreplicatie op basis van een fragment van 30 seconden, met watermerking en herkomstmetadata op de uitvoer. Gemini 3.1 Flash TTS dateert van vóór dat en wordt geleverd met een kant-en-klare stemmenset.
• Klonen op basis van echte audio — Eleven v4's Instant Voice Cloning werkt met tien seconden audio, met daarboven een professionele tier. Google's replicatiepad in de 3.8-generatie vraagt om 30 seconden en voegt toestemmingsverificatie toe. Verschillende drempels, verschillende toestemmingsmechanismen.
• Invoerlimiet per verzoek — Eleven v4 documenteert 10.000 tekens. Google factureert zijn TTS-modellen in tokens in plaats van in tekens, dus er is geen één-op-één vergelijkbare limiet per verzoek op tekens om te vergelijken, en de twee maatstaven moeten niet naast elkaar worden gelegd alsof ze vergelijkbaar zijn.
Dat laatste punt is het punt waarop inkoopspreadsheets struikelen. ElevenLabs hanteert een prijs per 1.000 tekens. Google hanteert een prijs per miljoen tokens, in en uit. Artificial Analysis normaliseert beide naar een as per miljoen tekens — daar komen de $80,00 en $18,31 vandaan — maar de normalisatie is de omrekening van het leaderboard, niet de factuur van een van beide leveranciers. Gebruik het om te rangschikken, niet om te voorspellen.

Wat de Eleven v4-tariefkaart doet met deze vergelijking
Twee weken lang is de bovenstaande prijsvergelijking onjuist in het voordeel van ElevenLabs, en daarna is ze onjuist in het nadeel. Op de API-prijzenpagina van ElevenLabs staat Eleven v4 vermeld voor $0,022 per 1.000 tekens tegenover een opgegeven lijstprijs van $0,08, met het label 72% korting tot 12 oktober. Eleven v4 Turbo staat vermeld voor $0,011 tegenover $0,04. Na 12 oktober verdwijnt het promotiebedrag en wordt het bordtarief van $80,00 per miljoen het tarief dat je daadwerkelijk betaalt.
Doe de rekensom voor een maand van vijf miljoen tekens. Eleven v4 kost $110 tijdens de actieperiode en $400 erna. Gemini 3.1 Flash TTS komt, tegen de normalisatie van $18,31 van het bestuur, uit op ongeveer $92 voor dezelfde maand — goedkoper dan de promotie en ongeveer vier keer goedkoper dan het lijsttarief. Een team dat in september benchmarkt en in november uitbrengt, zal de beslissing hebben genomen op basis van een cijfer dat niet meer bestaat.
Waar routing past, en waar niet
Geen van deze twee modellen staat in de OrcaRouter-catalogus. Er is hier geen ElevenLabs-endpoint en geen Google TTS-endpoint om aan te roepen, en het eerlijke antwoord op "hoe bereik ik ze via jou" is dat je dat niet doet: Eleven v4 bereik je via de API van ElevenLabs, en Gemini 3.1 Flash TTS via die van Google. Iets anders beweren zou neerkomen op het verzinnen van een integratie.
Waar één enkele sleutel goed voor is in een vergelijking als deze, is de beslissing zelf. Als je een endpoint van $400 per maand afweegt tegen een van $92 per maand, hangt het antwoord af van je eigen scripts, je eigen talen en je eigen listeners — en om dat antwoord te krijgen moet je beide aanroepen via hetzelfde codepad met dezelfde requestvorm, in plaats van twee leveranciersintegraties op te zetten om één test te draaien. OrcaRouter dekt die laag: meer dan 200 modellen achter één sleutel, waarbij de lijstprijzen van leveranciers worden doorgegeven tegen 0% opslag, zodat een prijswijziging van een leverancier meteen ingaat op de dag dat die van kracht wordt, plus automatische failover als een upstream halverwege de evaluatie verslechtert.
Wie moet welke kiezen
Kies Eleven v4 wanneer de stem het product is. Het leidt het klassement met 116 punten, met een schoner interval dan het model eronder; het is de enige van de twee met een gedocumenteerde inline tag-syntaxis voor uitvoeringsaanwijzingen, en de drempel voor cloning is tien seconden in plaats van dertig. De premie is reëel — vier keer de genormaliseerde prijs op de lijst — en daarmee koop je de top van het klassement.
Kies Gemini 3.1 Flash TTS alleen als je er al aan vastzit. Het is een vijf maanden oud model uit de previewgeneratie met een lagere score en een hogere genormaliseerde prijs dan de eigen septemberrelease van Google, en de enige reden om het te houden is inertie in een bestaande integratie. Als je die inertie hebt, levert migreren binnen de Google-stack naar 3.8 Flash TTS je 64 Elo-punten en een lagere genormaliseerde prijs op, zonder van leverancier te wisselen — wat een zeldzaam geval is waarin de upgrade ook de goedkopere optie is.
Voor alle anderen is de actuele vraag Eleven v4 tegenover Gemini 3.8 Flash TTS, en het antwoord is een echte afweging in plaats van een rangschikking: 52 Elo-punten en de tag-syntaxis tegenover ongeveer een vijfde van de kosten per teken. Draai beide op dezelfde scripts na 12 oktober, wanneer de ElevenLabs-actie voorbij is en het prijsverschil het verschil is dat je daadwerkelijk zult betalen.
