
HeyGen Voice vs ElevenLabs: Een nieuwe nummer 1 op het gebied van gekloonde stemmen, en de leverancier die nog altijd het bord beheerst
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 112 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 51 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 404 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
HeyGen Voice veroverde op 9 oktober 2026 de eerste plaats op de Controlled Voice-arena van Artificial Analysis met 1.202 Elo, en het model dat HeyGen Voice van die plek verdrong, was een ElevenLabs-tier: Eleven v4 Turbo, nu derde met 1.167. Dat is de kop, en die klopt. Het is ook een veel kleinere bewering dan het klinkt, want de modellen van dezelfde leverancier staan tweede, derde, vierde, elfde en vijftiende op diezelfde gecontroleerde ranglijst, en Eleven v4 Turbo blijft eerste op de veel grotere Provider Voices-arena met 1.328 Elo — 126 punten voorsprong op HeyGen Voice, dat daar helemaal niet in de ranglijst staat. Eén engine won één ranglijst. De leverancier heeft de categorie nog steeds in handen.
Dezelfde leverancier is nu goed voor vijf van de top vijftien.
De gecontroleerde ranglijst houdt de stem constant — acht gekloonde referentiestemmen, vier Amerikaanse en vier Britse — zodat elke inzending wordt beoordeeld op hoe de engine omgaat met een stem die hij niet zelf kon kiezen. Die ranglijst luidt nu als volgt: HeyGen Voice 1.202, Qwen-Audio-3.1-TTS-Plus 1.186, Eleven v4 Turbo 1.167, Eleven v4 1.160, Sonic 3.6 1.143, Realtime TTS-2 1.143. Verder naar beneden staat Eleven v3 op 1.072 en v3 Conversational op 1.056.
Vijf van de top vijftien vermeldingen in dat veld hebben dezelfde leveranciersnaam. De rivaal met het allerbeste model op de ranglijst heeft er vijf goede, verspreid over twee generaties, in twee prijsklassen, plus een gespreksvariant die een volstrekt ander product is. Zo ziet een gevestigde speler eruit van binnenuit een leiderspositie op een ranglijst, en dat is de reden dat een #1-debuut een kop waard is, niet een migratieplan.
Wat de ElevenLabs-modellen eigenlijk zijn
Eleven v4 Turbo wordt in de eigen documentatie van de leverancier beschreven als het state-of-the-art model voor realtime spraaksynthese, aanbevolen voor supportmedewerkers, AI-assistenten en interactieve personages, en is bereikbaar via de Text to Dialogue-websocket onder de modelidentificatie eleven_v4_turbo. ElevenLabs noemt een mediane inferentielatentie van ongeveer 100 ms — door de leverancier gerapporteerd, en de voetnoot op dezelfde pagina sluit applicatie- en netwerklatentie uit van dat cijfer, dus het is een getal voor de model-engine, geen round-trip-belofte.
Taaldekking voor de v4-familie is met afstand de breedste in deze vergelijking: {{1}}90+ talen{{/1}}, van Afrikaans en Arabisch tot Kantonees, Hindi, Japans, Mandarijn en Zoeloe. {{2}}HeyGens eigen documentatie vermeldt 300+ vooraf gebouwde stemmen in "tientallen talen" zonder een aantal te publiceren{{/2}}, wat een andere manier is om een catalogus te beschrijven en niet direct vergelijkbaar is met een cijfer voor het aantal talen.
Dan is er nog het deel dat helemaal niet op een ranglijst voorkomt: de stemmenbibliotheek, de stabiliteits- en gelijkenisregelaars, afstemming per aanvraag, en een decennium aan integratieoppervlak. Een modelvergelijking is geen platformvergelijking, en de ElevenLabs-inzending concurreert op beide.

Het scorebord
• Elo voor gecontroleerde stem — HeyGen Voice: 1.202 (#1). Eleven v4 Turbo: 1.167 (#3). Eleven v4: 1.160 (#4).
• Provider Voices Elo — Eleven v4 Turbo: 1.328 (#1 van 96). HeyGen Voice: niet gerangschikt.
• Gepubliceerde prijs per 1 miljoen tekens — Eleven v4 Turbo: $40,00. Eleven v4: $80,00. HeyGen Voice: $30,00 op basis van de eigen omrekening van het arena van HeyGen's creditprijzen; HeyGen publiceert zelf geen stemtarief.
• Opgegeven latentie — Eleven v4 Turbo: ~100 ms mediane inferentie, exclusief applicatie- en netwerklatentie (door leverancier gerapporteerd). HeyGen Voice: geen cijfer gepubliceerd.
• Taaldekking — ElevenLabs v4-familie: 90+ talen (leveranciersdocumentatie). HeyGen Voice: "tientallen talen", aantal niet gepubliceerd.
• Modellen in de gecontroleerde top vijftien — ElevenLabs: vijf niveaus. HeyGen: één.

Het gat tussen de twee planken is het interessante getal.
Eleven v4 Turbo staat 161 punten voor op HeyGen Voice op de Provider Voices-ranglijst en 35 punten achter op de gecontroleerde ranglijst. Beide getallen komen van dezelfde site, dezelfde methode met blinde luisteraars en dezelfde periode. Wat hen onderscheidt, is de stem.
Op de providerranglijst levert elke leverancier zijn eigen native stemmen, dus een bedrijf dat jaren heeft gestoken in het opbouwen en samenstellen van een stemmenbibliotheek mag zijn beste stemmen inzetten. Op de gecontroleerde ranglijst verdwijnt dat voordeel — de engine moet een gekloonde stem renderen die hij niet heeft geselecteerd. De verschuiving van 196 punten tussen de twee resultaten is in feite een meting van hoeveel van de positie van ElevenLabs voortkomt uit de stemmen in plaats van uit de engine. Het is een groot deel. Het is ook niet nul: 1.167 staat nog steeds op de derde plaats van de tweeënveertig.
Voor een koper komt dat neer op een concrete vraag. Als je een stem kiest uit de bibliotheek van een leverancier, is de provider-ranglijst jouw ranglijst, en de positie van ElevenLabs daarin is onbetwist. Als je een specifieke spreker kloont, is de gecontroleerde ranglijst jouw ranglijst, en die heeft deze week een nieuwe naam bovenaan.
De kosten van de gevestigde partij zijn niet veranderd.
Eleven v4 Turbo kost $40 per miljoen tekens op de API van de leverancier, en de oudere Eleven v4 kost $80 — het dubbele, voor een model dat zeven Elo-punten lager scoort op het gecontroleerde leaderboard. Die spreiding binnen één leverancier is het waard om even bij stil te staan: twee modellen van één bedrijf, 2× in prijs uiteen, drie plaatsen uit elkaar in de ranglijst.
HeyGens kant van de prijsvergelijking bestaat, maar niet in een vorm die HeyGen heeft gepubliceerd. De arena vermeldt het als $30,00 per miljoen tekens — tien dollar onder het ElevenLabs-niveau dat het verdrong, en 62% van de $80 van de oudere Eleven v4 — maar dat cijfer is een omrekening van Artificial Analysis, niet een leveranciersopgave: de openbare prijspagina van HeyGen verkoopt credits (600 voor $29/maand, 1.000 voor $49, 1.500 voor $149) en documenteert dat het verbruik varieert per model, duur en complexiteit, zonder een stemtarief te vermelden. Dus de uitdager met de betere score voor gekloonde stemmen is een kwart onder de gevestigde partij geprijsd, op basis van een getal dat de gevestigde partij niet hoefde af te leiden.

Waar elke kant daadwerkelijk wint
Kies ElevenLabs wanneer breedte de beperking is. Meer dan negentig talen, vijf gerangschikte niveaus op de gecontroleerde ranglijst, een volwassen stemmenbibliotheek, en een conversationele variant geprijsd op $50 per miljoen tekens die de gecontroleerde ranglijst als vijftiende plaatst — die combinatie is elders moeilijk samen te stellen, en het is de reden waarom de voorsprong van de leverancier het verlies van de nummer 1-positie overleefde.
Test HeyGen Voice wanneer de beperking gelijkheid is. Eén spreker, duizenden regels, een kloon die elke keer als die spreker moet klinken — dat is precies de workload die de gecontroleerde arena modelleert, en HeyGen Voice is momenteel de engine die daarin de hoogste score behaalt. Het professional-clone-traject dat is getraind op ruim twintig minuten audio is het relevante product voor die taak, niet de instant clone op basis van één opname.
Vat de 1.202 niet op als bewijs dat HeyGen Voice ElevenLabs in het algemeen verslaat. Het verslaat één ElevenLabs-niveau op één ranglijst. Drie andere niveaus liggen binnen 42 punten ervan, en de koploper van de andere ranglijst staat 126 punten voor.
Een uitdager testen zonder migratie
De kostenasymmetrie hier is het nuttige deel: een stemwissel is goedkoop om te bouwen en direct hoorbaar als het misgaat, en de gevestigde aanbieder tegen $40 per miljoen tekens is een dure zaak om te laten draaien op verkeer dat de uitdager beter aankan. De manier om dat op te lossen is beide achter één integratie te draaien en je eigen audio te laten beslissen — OrcaRouter zet beide op één API-sleutel tegen de lijstprijs van de provider, zonder markup, zodat een tariefwijziging van een leverancier aan de bron wordt weerspiegeld in plaats van bij contractverlenging, en automatische failover betekent dat een spraakverzoek dat mislukt, doorvalt naar de andere engine in plaats van stil te vallen. Voor een eerste ronde kun je verkeer meer gewicht geven aan de engine die je oor verkiest op een kleine fixture, en met de routing-DSL kun je één engine aanhouden voor vooraf gegenereerde narratie en de andere voor interactieve beurten, zonder een tweede clientbibliotheek.
Wat zou dit verhaal veranderen?
Als HeyGen Voice de Provider Voices-arena zou betreden, zou ons dat vertellen of een voorsprong bij gekloonde stemmen zich vertaalt naar concurrerende native stemmen — de test die ElevenLabs doorstaat met 1.328. Een stemtarief op de eigen prijspagina van HeyGen zou de afgeleide $30,00 van de arena omzetten in rekenwerk dat je kunt narekenen. En nog een maand aan stemmen zou laten zien of 16 Elo boven Qwen-Audio-3.1-TTS-Plus een stabiele ordening is of een momentopname. Elk van de drie zou de aanbeveling kunnen veranderen; geen van de drie heeft zich tot nu toe voorgedaan, en de eerlijke samenvatting totdat ze dat wel doen, is dat HeyGen Voice het gecontroleerde scorebord won en ElevenLabs nog steeds de categorie domineert.
