
Eleven v4 vs resten av ElevenLabs: Bör du migrera bort från Eleven v3?
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 982 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 195 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Om du redan använder ElevenLabs Eleven v3, är svaret ja för allt en lyssnare hör och nej för de två saker som ElevenLabs lämnade oförändrade. ElevenLabs Eleven v4 får 150 Elo-poäng mer än sin egen föregångare på Artificial Analysis Provider Voice Arena – 1 319 mot 1 169 – och 84 poäng på Controlled Voice-tavlan, där samma åtta klonade röster används för alla. Den har också en teckengräns som är dubbelt så hög som v3:s och ungefär dubbelt så stor språktäckning. Det som inte ändras är ditt avtal, dina röstkloner eller den nivåstruktur du faktureras mot, vilket är anledningen till att den här migreringen är billigare än de flesta och fortfarande värd att göra i etapper i stället för allt på en gång.

Den intrafamiljära resultattavlan
Det här är inte en jämförelse mellan leverantörer, så prisnormaliseringen på arenatavlorna fungerar annorlunda än vanligt: båda modellerna fakturerar per tecken, enligt samma prislista, från samma konto. Styrkorna och svagheterna nedan mäts mot syskonmodeller snarare än mot konkurrenter.
• Provider Voice Arena — ElevenLabs Eleven v4 plats 1, Elo 1 319 mot ElevenLabs Eleven v3 plats 18, Elo 1 169. En skillnad på 150 poäng.
• Controlled Voice Arena, matchade klonade röster – Eleven v4 rang 2, Elo 1 157 mot Eleven v3 rang 7, Elo 1 073. En skillnad på 84 poäng.
• Prisnormalisering i Arena — Eleven v4 $80.00 per miljon tecken mot Eleven v3 $100.00. Det nya flaggskeppet är det billigare av de två på resultattavlan.
• Leverantörens prislista — Eleven v4 $0,022 per tusen tecken till kampanjpris, $0,08 efter 12 oktober; Eleven v3 $0,08. Identiska i listpris, halva priset under kampanjperioden.
• Maxgräns för indata per begäran – Eleven v4 10 000 tecken mot Eleven v3 5 000. Exakt dubbelt.
• Språktäckning – Eleven v4 över 90 mot Eleven v3 över 70.
• Leveransdirektiv — Eleven v4 dokumenterar inline-ljudtaggar och IPA-fonemindata; Eleven v3 dokumenterar inget av dem på sin modellsida.
• Latens, enligt leverantören — Eleven v3 Conversational cirka 280 ms; Eleven v4 Turbo cirka 150 ms i median till första tal. Olika nivåer, olika tester.
• Röstkloner — oförändrade. Befintliga omedelbara och professionella kloner följer med.
• Plannivåer – oförändrade. Free 10 000 tecken, Starter $6, Creator $22, Pro $99, Scale $299, Business $990.
• Migreringsväg — Eleven v4 och Eleven v4 Turbo är båda live i API:et samt i agent- och kreativa ytor; de äldre Turbo-identifierarna är föråldrade.
Läs prisraden två gånger. Det ovanliga med den här lanseringen är att den nya modellen är billigare än den den ersätter, på samma tavla, till listpris, utan att någon kampanj tillämpas — $80 per miljon mot $100. Kampanjpriset vidgar det snarare än skapar det. En migrering som höjer kvaliteten med 150 Elo och sänker kostnaden per tecken är inte den avvägning som de flesta team förväntar sig att göra.
Migreringschecklista, i den ordning som spelar roll
Flytta ljudkvalitetsvägen först, för det är där vinsten finns och där en regression skulle vara uppenbar för dina användare innan den är uppenbar för dig.
• Provlyssna rösterna du faktiskt levererar. Provider Voice är ett genomsnitt över en arena-röstuppsättning; din varumärkesröst finns inte med i den. Gapet på 150 punkter är en anledning att provlyssna, inte en ersättning för provlyssning, och 84-punktsgapet på tavlan för klonade röster är den uppskattning som ligger närmast hur en klonbaserad produkt kommer att kännas.
• Kontrollera dina teckenbudgetar igen. Gränsen på 10 000 tecken är dubbelt så hög som v3:s, så skript som du tidigare delade upp kan nu få plats i en enda begäran. Det ändrar antalet begäranden, återförsökslogiken och skarvkvaliteten i sammanfogad utdata – och det är den ändring som med störst sannolikhet bryter kod som antog en gräns på 5 000.
• Testa skarven. ElevenLabs dokumenterar specifikt en mer tillförlitlig sammanfogning av anrop i v4. Om du delade upp långt innehåll vid v3 bör du köra samma innehåll genom v4 i ett enda anrop igen och jämföra, i stället för att anta att uppdelningen fortfarande är nödvändig.
• Återtesta dina uttalsfall med det nya fonemstödet. Lexikon byggda för v3 bör valideras på nytt snarare än att litas på; förbättrad IPA-hantering kan innebära att en tidigare korrekt överstyrning nu interagerar annorlunda med modellens egen gissning.
Låt ditt klonbibliotek vara. Kloner följer med; du behöver inte ladda upp igen, och att klona om riskerar att förlora en röst som dina användare känner igen.
• Behåll v3 Conversational där du använder den, tills vidare. Det är en konversationsnivå snarare än en syntesmodell, den är fortfarande dokumenterad till cirka 280 ms, och den har ingen publicerad v4-motsvarighet. Om din agent är beroende av den är v4 inte en likvärdig ersättning för den platsen – v4 Turbo är v4-beteckningen med lägre latens, och dess latensnivå anges på ett annat sätt.

Vad blir faktiskt bättre, och vad blir inte det
Förbättringarna klustrar på tre ställen. Känslomässigt register och tempo är det första – det är vad Provider Voice-tavlan mäter, och det är också vad leverantörens eget tillkännagivande betonar, tillsammans med ett påstående att blinda jämförelser föredrog v4 i ungefär tre fjärdedelar av fallen. Betrakta den siffran som leverantörsuppgiven och inte reproducerad; arena-tavlorna är den oberoende halvan av samma berättelse, och de är överens om riktningen.

Dialogen med flera talare och stabil talaridentitet är den andra. Om du har släppt tvåtalarinnehåll på v3 och lagt tid på att åtgärda talarläckage eller drift genom ett långt manus, är det en arbetsbelastning där förbättringen är strukturell snarare än kosmetisk, och det är en sådan som Elo-siffran bara delvis fångar.
Inline-framförandedirektiv är det tredje – att skriva in en suck eller en viskning direkt i manuset. I v3 innebar det en andra tagning, en uppströms prompt eller efterbearbetning. I v4 Turbo är det en rad i texten du redan har.
Det som inte blir bättre är den del som team ofta antar förbättras med ett nytt flaggskepp: latens. ElevenLabs publicerar ingen latenssiffra för Eleven v4 i sig, endast för v4 Turbo med ungefär 100 ms medianinferens och cirka 150 ms median tid till första tal, mätt i september 2026. Eleven v3:s konversationella nivå anges till omkring 280 ms men är en annan nivå som utför en annan uppgift. Om din arkitektur är byggd kring en hård latensbudget är ståndpunkten att v4 Turbo är kandidaten och att du bör mäta den själv, eftersom nivånamnen inte mappar entydigt och leverantörens siffror inte är jämförbara.
Tvåveckorsfönstret, och vad som händer
Kampanjprissättningen gäller till och med den 12 oktober. Fram till dess kostar Eleven v4 $0.022 per tusen tecken och Eleven v4 Turbo $0.011, mot angivna listpriser på $0.08 respektive $0.04. Efter kampanjperioden återgår v4 till exakt vad v3 kostar idag – $0.08 – och v4 Turbo återgår till hälften av v3:s pris.
En arbetad månad vid fem miljoner tecken: v3 kostar $400. v4 under kampanjperioden kostar $110 och kostar därefter $400 igen. v4 Turbo kostar $55 under kampanjperioden och $200 därefter. Så den intressanta migreringen är rimligen den till Turbo, eftersom det är det enda alternativet på den här prislistan som förblir billigare än v3 efter att kampanjen slutar, och stödet för ljudtaggar som v3 saknar finns där.
Det praktiska draget är att göra kvalitetsarbetet nu medan priset är en bonus, och att fatta prisbeslutet utifrån siffrorna efter den 12 oktober. Varje jämförelse som anger $22 per miljon för Eleven v4 utan en kopplad tidsfrist beskriver en taxa som löper ut inom två veckor.
Förbereda bytet utan att satsa releasen på det
OrcaRouter hostar inte ElevenLabs, så det finns inget i den här migreringen som vi kan flytta åt dig – ändringen sker på ditt ElevenLabs-konto. Det vi hanterar är lagret runt en stack som inte kommer från en enda leverantör. Om din talväg är en av flera modeller bakom en enda slutpunkt, tillhandahåller vi över 200 modeller via en enda API-nyckel, med leverantörernas listpriser vidarebefordrade med 0 % påslag, vilket innebär att en leverantörs prisändring – som den här – landar hos oss samma dag som den landar hos dem, utan ett andra avtal eller en integrationsändring.
När röstvägen är kundvänd och inte får tappas, dirigerar automatisk failover runt en försämrad uppström i stället för att låta samtalet misslyckas. Det är den form en migrering som denna bör ha: kör v4 bakom samma slutpunkt som den befintliga lösningen, flytta en del av trafiken och låt routningslagret hålla fallbacken medan du tar reda på om de 150 Elo-poängen dyker upp i ditt eget ljud.
Beslutet, i ett stycke.
Migrera om en lyssnare hör din utdata och du fortfarande är på v3 — kvalitetsgapet är det största enskilda generationshoppet som ElevenLabs har publicerat på dessa resultattavlor, teckengränsen fördubblas, språklistan fördubblas och listpriset är lägre. Genomför migreringen i etapper, börja med din mest trafikerade röst i stället för ditt mest komplexa skript, och planera budgeten utifrån siffrorna för den 12 oktober i stället för den här veckans. Stanna kvar på v3 endast om din integration inte kan absorbera en annan indatagräns, eller om v3 Conversational är bärande i en agent och du ännu inte har mätt v4 Turbo mot din egen latensbudget. Det är de två fallen där tålamod kostar mindre än ett förhastat byte.
