
Eleven v4 voert de Voice Arena aan: wat het nieuwe vlaggenschip van ElevenLabs écht heeft gewonnen
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 983 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 196 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
ElevenLabs Eleven v4verscheen op 28 september en schoot meteen naar de top van de Provider Voice Arena van Artificial Analysis met een Elo van 1.319 — 43 punten voorsprong op Cartesia Sonic 3.6 met 1.276 en 52 punten op Google Gemini 3.8 Flash TTS met 1.267. Het is op datzelfde bord met $80,00 per miljoen tekens ook het duurste model in de top tien. En in de tweede arena — degene die is opgebouwd uit gekloonde stemmen in plaats van de eigen stemmenset van elke leverancier — wint het helemaal niet: het eindigt als tweede, achter een model dat een kwart van dat bedrag kost. Beide zijn waar, en het nuttige deel van deze lancering is uitzoeken welke van de twee op jouw gebruiksscenario van toepassing is.
Wat er daadwerkelijk op 28 september is uitgeleverd
ElevenLabs bracht twee modellen naar algemene beschikbaarheid, niet één. ElevenLabs Eleven v4 is het vlaggenschip-synthesemodel — het bedrijf noemt het zijn meest emotievolle, en in de documentatie staat een invoerlimiet van 10.000 tekens per verzoek en een taaldekking van meer dan 90. ElevenLabs Eleven v4 Turbo is het broertje met lage latentie: dezelfde meer dan 90 talen, een limiet van 10.000 tekens, en ondersteuning voor de inline audiotags waarmee je een voordrachtsaanwijzing in het script zelf kunt schrijven — een lach, een fluistering, een zoem op de lijn. Beide zijn vanaf dag één live op de agent-, creative- en API-oppervlakken van het bedrijf, wat een snellere uitrol is dan de v3-generatie kreeg.
De aankondigingspagina is waar de functielijst staat en, opvallend genoeg, niet de prijzen. ElevenLabs beschrijft een nieuwe architectuur, een betere verwerking van toon, tempo en karakter, betrouwbaardere dialogen met meerdere sprekers met een stabiele sprekersidentiteit, verbeterde IPA-foneeminvoer, en instant stemklonen gemaakt op basis van tien seconden audio, naast de bestaande professionele kloonlaag. Het enige getal erop is een claim over luisteraars: de leverancier zegt dat blinde vergelijkingen in ongeveer driekwart van de gevallen de voorkeur gaven aan v4. Dat is een cijfer van de leverancier, niet gereproduceerd, en het moet worden gelezen naast de cijfers op het bord hieronder, niet in plaats van die cijfers.
Waar de prijsstelling werkelijk staat — de API-prijsstellingspagina — is het belangrijkere document, en dat wordt verderop behandeld. Korte versie: deze lancering is geen prijsverhoging.
Twee besturen, twee verschillende antwoorden
Artificial Analysis runt twee spraakarena's en ze zijn geen variaties op elkaar. Provider Voice laat luisteraars de eigen stemmen van elke leverancier vergelijken. Controlled Voice kloont dezelfde acht stemmen — vier uit de VS, vier uit het VK — voor elke deelnemer, zodat de spreker constant wordt gehouden en alleen het model varieert. Een model met een uitstekende standaardstemmencast kan de eerste winnen en de tweede verliezen. Eleven v4 doet precies dat.
• Provider Voice, Eleven v4 — rang 1, Elo 1.319, $80,00 per miljoen tekens, 1.674 samples, acht arena-stemmen, september 2026
• Provider Voice, Cartesia Sonic 3.6 — rang 2, Elo 1.276, $49,00
• Aanbieder stem, Google Gemini 3.8 Flash TTS — rang 3, Elo 1.267, $16,50
• Provider Voice, het vorige vlaggenschip ElevenLabs Eleven v3 — rang 18, Elo 1.169, $100,00
• Gecontroleerde stem, Alibaba Qwen-Audio-3.1-TTS-Plus — rang 1, Elo 1.178
• Controlled Voice, Eleven v4 — rang 2, Elo 1.157, $ 80,00
• Controlled Voice, Cartesia Sonic 3.6 — rang 4, Elo 1.138
• Controlled Voice, ElevenLabs Eleven v3 — rang 7, Elo 1.073
• Gecontroleerde stem, Google Gemini 3.8 Flash TTS — rang 13, Elo 1.048
• Beste open-weights-inzending op Provider Voice — Breeze TTS 2, Elo 1.206, $ 34,00

De lineage-sprong is het belangrijkste nieuws voor iedereen die al op ElevenLabs zit: tegenover zijn eigen voorganger op hetzelfde leaderboard wint Eleven v4 150 Elo-punten onder Provider Voice en 84 onder Controlled Voice. Dat is een generatiesprong, geen tuningronde, en de verbetering is groter op het leaderboard waar de leverancier de stemmen mag kiezen — wat de eerlijke manier is om te zeggen dat de nieuwe standaardcast echt deel uitmaakt van de winst.

Het uitspraakbord waar we geen nummer op kunnen zetten
Artificial Analysis heeft wél een sectie Pronunciation Robustness, en het is de moeite waard om die goed te behandelen, want de ranking die de ronde doet beschrijft Eleven v4 terwijl het scorebord het aandeel gemarkeerde woorden meet waarvan beoordelaars vonden dat ze correct werden uitgesproken, met maximaal drie beoordelaars per clip, en de prompts worden exact verzonden zoals ze zijn geschreven — geen uitbreiding van getallen, geen tekstnormalisatie. Het is opgedeeld in subcategorieën, en het doel van het ontwerp is dat een model dat stilletjes "Dr." of "$4.50" herschrijft voordat het spreekt, opzettelijk slecht scoort.
Wat de ranglijst niet publiceert, in de weergave die we konden lezen, is een citeerbare numerieke score per model. Er is daar dus geen getal om voor Eleven v4 te citeren, en de Elo van 1.319 hoort bij arena-voorkeur — hoe luisteraars de stem waardeerden — niet bij uitspraaknauwkeurigheid. Als je de twee door elkaar haalt, dan is dat de verwarring. De verdedigbare bewering van deze lancering is degene met cijfers eraan vast: eerste op Provider Voice met 1.319, tweede op Controlled Voice met 1.157.
De introductiekorting is het echte nieuws voor je factuur.
ElevenLabs heeft de nieuwe modellen van een nieuwe prijs voorzien op het moment dat het ze uitbracht, en de korting is groot genoeg om op zichzelf al een aankoopbeslissing te veranderen. Op de API-prijzenpagina staat Eleven v4 vermeld voor $0,022 per duizend tekens, tegenover een opgegeven lijstprijs van $0,08 — een verlaging van 72% — en Eleven v4 Turbo staat vermeld voor $0,011 tegenover $0,04. Voor beide geldt hetzelfde venster: de promotie loopt tot 12 oktober. Daarna worden de prijzen teruggedraaid, en de v4-prijs na terugdraaiing is het dubbele van wat de eigen v3 van ElevenLabs vandaag kost, namelijk $0,08. Ga uit van het bedrag na de promotie, niet van het promotiebedrag.
De prijsherziening verschuift ook de positie van v4 ten opzichte van het veld op tekenniveau, wat de arena-normalisatie al laat zien op $80,00 per miljoen. Sonic 3.6 staat daar op $49,00, Breeze TTS 2 op $34,00, Qwen-Audio-3.0-TTS-Plus op $19,30 en Gemini 3.8 Flash TTS op $16,50. Op het promotietarief onderbiedt Eleven v4 met $22 per miljoen Sonic 3.6 ronduit. Op het lijsttarief is het met ruime marge de duurste stem in het overzicht. Wie een budget voor Q1 opstelt, moet naar het tweede getal kijken.

Een doorgerekende maand maakt het prijsverschil concreet. Bij vijf miljoen tekens — een middelgroot product dat ongeveer honderd uur spraak voorleest — kost Eleven v4 tijdens het venster $110. Bij de teruggedraaide prijs van $0,08 kost het $400. Sonic 3.6 kost $245. Gemini 3.8 Flash TTS kost $82,50. Dezelfde maand op ElevenLabs' eigen v3 kost ook $400, wat het merkwaardige gegeven onder deze lancering is: de komende twee weken is het nieuwe vlaggenschip goedkoper dan het model dat het vervangt, en op de dag dat het venster sluit, is het niet langer goedkoper en wordt het louter beter.
De latentieclaim is door de leverancier opgegeven en afhankelijk van de tier.
ElevenLabs publiceert latentiecijfers per tier, niet per modelfamilie, en het zijn metingen die het bedrijf zelf heeft gedaan in plaats van iets onafhankelijks. Voor Eleven v4 Turbo wordt ongeveer 100 ms mediane inferentie en ongeveer 150 ms mediane tijd tot de eerste spraak opgegeven, gemeten in september 2026. Voor Eleven v3 Conversational wordt ongeveer 280 ms opgegeven, en voor de oudere Flash- en Turbo-tiers ongeveer 75 ms. De documentatie publiceert geen equivalent cijfer voor Eleven v4 zelf, de tier die je zou willen hebben als je een realtime agent bouwt en een specsheet leest in plaats van te testen.
Cartesia claimt een latentie van minder dan 90 ms voor Sonic en beschrijft het als nummer één voor natuurlijkheid, met stemklonen op basis van tien seconden audio, aangepaste uitspraakwoordenboeken en een compliancepakket dat HIPAA, SOC 2 Type 2, GDPR en PCI dekt. Dat zijn de eigen claims van de leverancier op diens eigen productpagina — dezelfde categorie bewijs als de latency-tiernummers van ElevenLabs, en niet uitwisselbaar met de arena-Elo. De twee leveranciers zijn alleen direct vergelijkbaar op de leaderboards.
Wat dit voor jou betekent, en hoe je het kunt uitproberen
Als je een stem kiest voor een product waarbij de standaardcast is wat je gebruikers horen, dan is het Provider Voice-resultaat het resultaat dat ertoe doet, en Eleven v4 heeft het net gewonnen, met twee weken korting erbij. Als je de stem van een specifiek persoon kloont en elk kandidaatmodel wordt gevraagd dezelfde acht sprekers te reproduceren, dan is het Controlled Voice-bord het bord dat ertoe doet en staat Eleven v4 tweede — 21 Elo achter de leider en, tegen listprijs, meer dan vier keer de kosten per teken. Geen van beide resultaten is fout; het zijn antwoorden op verschillende vragen, en de tweede is de vraag die de meeste productie-stemkloningsprojecten feitelijk stellen.
OrcaRouter host geen ElevenLabs, Cartesia of een van de andere leveranciers op deze overzichten, dus er is hier niets dat via ons kan worden aangeroepen en we zullen niet het tegendeel suggereren. Wat we wél bieden is de omliggende infrastructuur als je spraakstack uiteindelijk meerdere providers omvat: één API-sleutel voor meer dan 200 modellen, met de lijstprijzen van providers doorgegeven tegen 0% opslag, dus een prijsverlaging van een leverancier — inclusief een promotieperiode zoals deze — is bij ons dezelfde dag live in plaats van bij de volgende factuurcyclus. Waar een spraakpad productiekritisch is, schakelt automatische failover over naar een gezonde upstream wanneer een ervan verslechtert, wat de praktische manier is om een gloednieuw endpoint te testen zonder er een release op te vergokken.
De datum om in je agenda te zetten is 12 oktober. Dan houdt Eleven v4 op de goedkoopste goede stem op de ranglijst te zijn en wordt die de duurste, en elke vergelijking die deze week is geschreven en $22 per miljoen noemt zonder dat erbij te zeggen, is een vergelijking die je over drie weken opnieuw moet maken.
