Een herokaart voor 'ElevenLabs Eleven v4 vs ElevenLabs Eleven v3' met twee gestapelde kaarten: ElevenLabs Eleven v4 met Elo 1.319, rang 1 en $80,00 per 1 miljoen tekens; ElevenLabs Eleven v3 met Elo 1.169, rang 18 en $100,00 per 1 miljoen tekens; met als bijschrift 'dezelfde tariefkaart, 150 Elo uit elkaar'. Voettekst: 'Provider Voice Arena, volgens Artificial Analysis, sept. 2026.' Het OrcaRouter-logo staat in de rechteronderhoek.
Guides & Insights

Eleven v4 vs de rest van ElevenLabs: Zou je van Eleven v3 moeten migreren?

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Als je al op ElevenLabs Eleven v3 zit, luidt het antwoord ja voor alles wat een luisteraar hoort en nee voor de twee dingen die ElevenLabs ongewijzigd heeft gelaten. ElevenLabs Eleven v4 behaalt 150 Elo-punten meer dan zijn eigen voorganger op de Provider Voice Arena van Artificial Analysis — 1.319 tegen 1.169 — en 84 punten op het Controlled Voice-board, waar voor iedereen dezelfde acht gekloonde stemmen worden gebruikt. Het heeft ook een tekenlimiet die tweemaal zo hoog is als die van v3 en ongeveer een verdubbeling van het taalbereik. Wat het niet verandert, is je contract, je stemklonen of de tierstructuur op basis waarvan je wordt gefactureerd, en daarom is deze migratie goedkoper dan de meeste en toch de moeite waard om gefaseerd uit te voeren in plaats van alles in één keer.

A two-column scoreboard for ElevenLabs Eleven v4 and ElevenLabs Eleven v3. Eleven v4: Provider Voice rank 1 Elo 1,319; Controlled Voice rank 2 Elo 1,157; $80.00 per 1M chars; $0.022 per 1K until Oct 12; 10,000-character cap; 90-plus languages. Eleven v3: Provider Voice rank 18 Elo 1,169; Controlled Voice rank 7 Elo 1,073; $100.00 per 1M chars; $0.08 per 1K; 5,000-character cap; 70-plus languages. Footer: 'Elo and board prices per Artificial Analysis; rate card and caps vendor-documented.'

Het scorebord binnen de familie

Dit is geen leverancier-tegen-leverancier-vergelijking, dus de prijsnormalisatie op de arenaborden werkt anders dan gebruikelijk: beide modellen factureren per teken, volgens dezelfde tariefkaart, vanaf hetzelfde account. De sterke en zwakke punten hieronder worden afgemeten aan verwante modellen in plaats van concurrenten.

Provider Voice Arena — ElevenLabs Eleven v4 staat op de 1e plaats, met een Elo van 1.319, tegenover ElevenLabs Eleven v3 op de 18e plaats, met een Elo van 1.169. Een verschil van 150 punten.

• Controlled Voice Arena, gematchte gekloonde stemmen — Eleven v4 rang 2, Elo 1.157 vs Eleven v3 rang 7, Elo 1.073. Een verschil van 84 punten.

• Arena-prijsnormalisatie — Eleven v $80,00 per persoon vs Eleven v3 $100,00. Het nieuwe vlaggenschip is de goedkoopste van de twee op de pen.

• Tarievenkaart leverancier — Eleven v4 $0,022 per duizend tekens als actieprijs, $0,08 na 12 oktober; Eleven v3 $0,08. Identiek op de lijstprijs, halve prijs tijdens de actieperiode.

• Maximale invoer per verzoek — Eleven v4 10.000 tekens vs Eleven v3 5.000. Precies het dubbele.

• Taaldekking — Eleven v4 90-plus vs Eleven v3 70-plus.

• Voordrachtsinstructies — Eleven v4 documenteert inline-audiotags en IPA-foneeminvoer; Eleven v3 documenteert geen van beide op zijn modelpagina.

• Latentie, door de leverancier opgegeven — Eleven v3 Conversational ongeveer 280 ms; Eleven v4 Turbo ongeveer 150 ms mediaan tot eerste spraak. Verschillende niveaus, verschillende tests.

• Stemklonen — ongewijzigd. Bestaande instant- en professionele klonen blijven behouden.

• Abonnementsniveaus — ongewijzigd. Gratis 10.000 tekens, Starter $6, Creator $22, Pro $99, Scale $299, Business $990.

• Migratiepad: Eleven v4 en Eleven v4 Turbo zijn beide live in de API, agent- en creative-oppervlakken; de oudere Turbo-identifiers zijn verouderd.

Lees de prijsrij twee keer. Het ongebruikelijke feit aan deze lancering is dat het nieuwe model goedkoper is dan het model dat het vervangt, op hetzelfde bord, tegen lijstprijs, zonder toegepaste promotie — $80 per miljoen tegenover $100. Het promotietarief vergroot dat in plaats van het te creëren. Een migratie die de kwaliteit met 150 Elo verhoogt en de kosten per teken verlaagt, is niet de afweging die de meeste teams verwachten te maken.

Migratiechecklist, in de volgorde die ertoe doet.

Verplaats eerst het pad voor audiokwaliteit, want daar zit de winst en daar zou een regressie voor je gebruikers eerder duidelijk zijn dan voor jou.

• Proefbeluister de stemmen die je daadwerkelijk uitlevert. Provider Voice is een gemiddelde over een arena-stemset; jouw merkstem zit daar niet in. Het gat van 150 punten is een reden om te proefbeluisteren, niet een vervanging daarvan, en het gat van 84 punten van het cloned-voice-board is de nauwkeuriger schatting van hoe een op klonen gebaseerd product zal aanvoelen.

• Controleer je tekenbudgetten opnieuw. De limiet van 10.000 tekens is het dubbele van die van v3, dus scripts die je voorheen opsplitste, passen nu mogelijk in één aanvraag. Dat verandert het aantal aanvragen, de retrylogica en de naadkwaliteit van samengevoegde uitvoer — en het is de wijziging die het meest waarschijnlijk code breekt die uitging van een limiet van 5.000.

• Test de naad. ElevenLabs documenteert specifiek betrouwbaardere request stitching in v4. Als je lange content op v3 opsplitste, voer dezelfde content dan in één aanroep opnieuw door v4 en vergelijk, in plaats van aan te nemen dat de splitsing nog steeds nodig is.

• Test je uitspraakgevallen opnieuw met de nieuwe foneemondersteuning. Lexicons die voor v3 zijn gebouwd, moeten opnieuw worden gevalideerd in plaats van te worden vertrouwd; verbeterde IPA-verwerking kan betekenen dat een eerder correcte override nu anders interacteert met de eigen gok van het model.

• Laat je kloonbibliotheek met rust. Klonen worden meegenomen; opnieuw uploaden is niet nodig en opnieuw klonen kan ertoe leiden dat je een stem verliest die je gebruikers herkennen.

• Houd v3 Conversational voorlopig daar waar je het gebruikt. Het is een conversationeel niveau in plaats van een synthesemodel, het staat nog steeds gedocumenteerd op ongeveer 280 ms, en er is geen gepubliceerd v4-equivalent. Als je agent ervan afhankelijk is, is v4 geen gelijkwaardige vervanging voor die plek — v4 Turbo is het v4-label met lagere latentie, en het latentieniveau ervan wordt anders opgegeven.

A screenshot of ElevenLabs' model documentation, captured in English, listing the text-to-speech cards: Eleven v4 with exceptional voice cloning, 90+ languages supported, a 10,000 character limit and support for natural multi-speaker dialogue; Eleven v4 Turbo with ultra-low latency near 100 ms median inference and audio tags for fine-grained control; Eleven v3 with 70+ languages and a 5,000 character limit; and Eleven v3 Conversational, Eleven Multilingual v2 and Eleven Flash v2.5 below them.

Wat er daadwerkelijk beter wordt, en wat niet

De winst concentreert zich op drie plekken. Emotioneel bereik en tempo staan op de eerste plaats — dat is wat het Provider Voice-board meet, en dat is ook wat de eigen aankondiging van de leverancier benadrukt, samen met de bewering dat blinde vergelijkingen in ongeveer driekwart van de gevallen de voorkeur gaven aan v4. Beschouw dat cijfer als door de leverancier opgegeven en niet gereproduceerd; de arena-boards vormen de onafhankelijke helft van hetzelfde verhaal, en ze zijn het eens over de richting.

A screenshot of the Artificial Analysis Controlled Voice Arena leaderboard, captured in English, showing Alibaba Qwen-Audio-3.1-TTS-Plus first at Elo 1,178, ElevenLabs Eleven v4 second at Elo 1,157, Cartesia Sonic 3.6 fourth at Elo 1,138 and ElevenLabs Eleven v3 seventh at Elo 1,073 on the board where the same eight cloned voices are used for every entrant.

Dialoog met meerdere sprekers en een stabiele sprekersidentiteit is het tweede. Als je content met twee sprekers op v3 hebt uitgeleverd en inspanningen hebt geleverd om sprekerbleed of -drift in een lang script op te lossen, dan is dat een werklast waarin de verbetering structureel is in plaats van cosmetisch, en het is er een die het Elo-getal slechts gedeeltelijk weergeeft.

Inline voordrachtsaanwijzingen zijn de derde — een zucht of een fluistering direct in het script schrijven. Op v3 betekende dat een tweede take, een upstream-prompt of nabewerking. Op v4 Turbo is het een regel in de tekst die je al hebt.

Wat niet beter wordt, is het onderdeel waarvan teams vaak aannemen dat het verbetert met een nieuw vlaggenschip: latentie. ElevenLabs publiceert geen latentiecijfer voor Eleven v4 zelf, alleen voor v4 Turbo: ongeveer 100 ms mediane inferentie en ongeveer 150 ms mediane tijd tot eerste spraak, gemeten in september 2026. Voor de conversationele tier van Eleven v3 wordt ongeveer 280 ms genoemd, maar het is een andere tier met een andere functie. Als je architectuur is gebouwd rond een hard latentiebudget, is de eerlijke positie dat v4 Turbo de kandidaat is en dat je het zelf moet meten, omdat de tiernamen niet eenduidig te koppelen zijn en de cijfers van de leverancier niet één-op-één vergelijkbaar zijn.

Het venster van twee weken, en wat daarna gebeurt

De promotietarieven lopen tot 12 oktober. Tot dan kost Eleven v4 $0,022 per duizend tekens en Eleven v4 Turbo $0,011, tegen de vermelde lijsttarieven van respectievelijk $0,08 en $0,04. Na het actievenster keert v4 terug naar precies wat v3 vandaag kost — $0,08 — en v4 Turbo naar de helft van het tarief van v3.

Een uitgewerkt maandscenario met vijf miljoen tekens: v3 kost $400. v4 kost tijdens de actieperiode $110 en daarna weer $400. v4 Turbo kost tijdens de actieperiode $55 en daarna $200. De interessante migratie is dus waarschijnlijk die naar Turbo, want het is de enige optie op deze tariefkaart die na het einde van de promotie goedkoper blijft dan v3, en de audio-tagondersteuning die v3 mist, zit daar.

De praktische zet is om het kwaliteitswerk nu te doen terwijl de prijs een bonus is, en de prijsbeslissing te nemen op basis van de cijfers van na 12 oktober. Elke vergelijking die $22 per miljoen voor Eleven v4 noemt zonder een bijbehorende deadline, beschrijft een tarief dat over twee weken verloopt.

De omschakeling gefaseerd invoeren zonder de release eraan op te hangen

OrcaRouter host geen ElevenLabs, dus er is niets in deze migratie dat we voor je kunnen verplaatsen — de wijziging gebeurt op je ElevenLabs-account. Wat wij wel regelen, is de laag rond een stack die niet van één leverancier afkomstig is. Als je spraakpad een van meerdere modellen achter één endpoint is, leveren we meer dan 200 modellen via één API-sleutel, waarbij de lijstprijzen van de providers tegen 0% markup worden doorgegeven, wat betekent dat een prijsherziening door een provider — zoals deze — dezelfde dag aan onze kant landt als bij hen, zonder een tweede contract of een aanpassing van de integratie.

Waar het spraakpad klantgericht is en niet mag wegvallen, leidt automatische failover om een gedegradeerde upstream heen in plaats van de oproep te laten mislukken. Dat is de vorm die een migratie als deze zou moeten aannemen: laat v4 achter hetzelfde endpoint draaien als de zittende aanbieder, verschuif een deel van het verkeer, en laat de routeringslaag de fallback vasthouden terwijl je erachter komt of de 150 Elo-punten in je eigen audio opduiken.

De beslissing, in één alinea.

Migreer als een luisteraar je output hoort en je nog steeds op v3 zit — de kwaliteitskloof is de grootste sprong tussen opeenvolgende generaties die ElevenLabs op deze forums heeft gepubliceerd, de karakterlimiet verdubbelt, de talenlijst verdubbelt en de adviesprijs is lager. Voer de migratie in fasen uit, begin met je meest gebruikte stem in plaats van je meest complexe script, en baseer je budget op de cijfers van 12 oktober in plaats van die van deze week. Blijf alleen op v3 als je integratie een andere invoerlimiet niet kan verwerken, of als v3 Conversational cruciaal is in een agent en je v4 Turbo nog niet hebt afgezet tegen je eigen latentiebudget. Dat zijn de twee gevallen waarin geduld minder kost dan een overhaaste overstap.