
Eleven v4 vs OpenAI TTS-1 HD: Två års drift i en enda tavla
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 982 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 197 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
OpenAI TTS-1 HD har ett releasedatum den 6 november 2023. ElevenLabs Eleven v4 har ett releasedatum den 28 september 2026. På Artificial Analysis' Provider Voice Arena skiljer dessa två datum 216 Elo-poäng åt – TTS-1 HD ligger på plats 35 med 1 104 över 3 500 framträdanden till $30,00 per miljon tecken, medan Eleven v4 ligger på plats 1 med 1 319 över 1 674 framträdanden till $80,00. Båda siffrorna har snäva intervall, ±12 och ±19, så ordningen är inte ifrågasatt. Den intressanta frågan är inte vilken modell som är bättre, för det avgjordes innan den här artikeln fanns. Det är varför en slutpunkt från 2023 fortfarande har 3 500 framträdanden på en resultattavla där en fem dagar gammal modell har 1 674, och vad det säger dig om den migrering du ombeds att överväga.
Resultattavlan, och den enda rad där OpenAI vinner
Fem dimensioner avgör den här matchningen, och båda sidorna av var och en är värda att läsas sida vid sida.
• Blind preferens, leverantörsröster — Eleven v4 rank 1, Elo 1 319 (±19, 1 674 framträdanden) vs TTS-1 HD rank 35, Elo 1 104 (±12, 3 500 framträdanden). En 216-poängsskillnad som överlever felstaplarna.
• Listpris, per miljon tecken — Eleven v4 80,00 $ vs TTS-1 HD 30,00 $. OpenAI är 62 % billigare enligt listpris, och ännu billigare under ElevenLabs-kampanjen.
• Röster — Eleven v4 dokumenterar omedelbar kloning från tio sekunders ljud plus en professionell kloningsnivå; TTS-1 HD levereras med en fast uppsättning röster, nio för tts-1-familjen i OpenAI:s egen dokumentation (alloy, ash, coral, echo, fable, onyx, nova, sage, shimmer) och ingen kloning.
• Framföranderegi — Eleven v4 dokumenterar inline-ljudtaggar och regiprompter i naturligt språk; TTS-1 HD tar emot vanlig text, och OpenAIs parameter för styrbara instruktioner tillhör dess nyare TTS-modell snarare än denna.
• Utgivningsdatum — Eleven v4 28 september 2026 vs TTS-1 HD 6 november 2023.

Priset är den rad där OpenAI vinner, och det är en större vinst än det ser ut, eftersom ElevenLabs kampanj är tillfällig. Med $0,022 per 1 000 tecken kostar Eleven v4 $22 per miljon fram till den 12 oktober – billigare än TTS-1 HD rakt av. Efter den 12 oktober kostar den $80 per miljon mot OpenAIs $30, och stannar där.
Varför en modell från 2023 har dubbelt så många sampel
Det numret är det mest användbara på den här resultattavlan, och det är lätt att läsa fel. Arena-framträdanden ackumuleras i takt med trafiken, och trafiken ackumuleras genom integrationer som byggdes en gång och aldrig återbesöktes. TTS-1 HD har 3 500 framträdanden bakom sig eftersom det har varit standardslutpunkten för tal för varje team som redan anropar OpenAI för chat completions: samma nyckel, samma SDK, samma faktureringsrad, ytterligare ett anrop. Inget i den meningen handlar om röstkvalitet, och underskottet på 216 poäng stoppade det inte.

Så här ser migreringsskuld ut på en rankingtavla. Det är inte en signal om att den äldre modellen är konkurrenskraftig; det är en signal om att byta kostar något, och att ett stort antal team har beslutat att det där något är värt mer än 216 Elo-poäng. Det är en legitim slutsats för en uppläsning av aviseringar och en dålig sådan för en produkt där rösten är det kunden hör.
Argumentet för att stanna på TTS-1 HD
Tre saker gör det försvarbart, och ingen av dem är kvalitet.
Determinism kommer först. En fast uppsättning på nio röster ger konsekvent resultat mellan versioner på ett sätt som en kloningspipeline inte gör, och konsekvent resultat är vad man vill ha i en nyttoväg där ingen lyssnar efter konstnärlighet. Det finns ingen klon som kan drifta, inget referensprov att spela in på nytt och ingen samtyckesartefakt att underhålla.
Integrationskostnaden är den andra, och det är den som arenan inte kan prissätta. Att lägga till en andra röstleverantör innebär ett nytt konto, en ny prislista, ett nytt felmod och en ny sak att övervaka. För ett team som redan är inne i OpenAI-stacken är det verklig ingenjörstid, och 216 Elo-poäng betalar inte för det.
Lågvolym är den tredje. Vid 30 dollar per miljon tecken är en liten produkts hela månatliga röstnota ett avrundningsfel, och det finns inget att optimera. Det här är regimen där det billiga svaret och det lata svaret är samma svar, och det är okej.
Argumentet för att flytta och motargumentet till det
Byt när rösten är kundvänd. Tio sekunders kloning, inbyggd regianvisning, över 90 språk och en inmatningsgräns på 10 000 tecken per begäran är inte kosmetiska skillnader jämfört med en fast uppsättning på nio röster från 2023, och arenans 216-poängsgap är den komprimerade versionen av ett mycket större kapacitetsgap. Om du bygger en agent, en varumärkt assistent eller något där en lyssnare bildar sig en uppfattning om din produkt i den första meningen, är den äldre slutpunkten fel standard.
Motargumentet är att "flytta till Eleven v4" inte är den enda flytten. OpenAI har sedan dess släppt en nyare TTS-modell med en styrbar instruktionsparameter, och Googles Gemini 3.8 Flash TTS ligger trea på samma lista med 1 267 och ett normaliserat pris på 16,49 dollar per miljon — en ökning med 163 poäng jämfört med TTS-1 HD till ungefär halva priset på listan. Om din begränsning är att stanna hos din nuvarande leverantör, är det den billigare uppgraderingen. Om den är att stanna i ditt nuvarande moln, är det den enda.
Var OrcaRouter faktiskt befinner sig i den här jämförelsen
This is the rare article in this series where we host one of the two models, so let us be precise about which. openai/tts-1-hd is live in the OrcaRouter catalogue at OpenAI's list rate passed through at 0% markup: $30 per million, model ID openai/tts-1-hd, served on the OpenAI-compatible endpoint at https://api.orcarouter.ai/v1 with a POST /v1/audio/speech route and the voice, speed and response_format parameters. Our own page reports a median latency of 2,461 ms and a 95th percentile of 4,769 ms, which is the honest reason not to put it in front of a live conversation — that is a batch-shaped number, not an agent-shaped one.

ElevenLabs Eleven v4 finns inte i vår katalog, och det finns inget att anropa via oss: den nås via ElevenLabs eget API till ElevenLabs egen prislista. Vad en enda nyckel förändrar är migrationens form. Om anledningen till att du inte har testat den nya ledande modellen är att det innebär en andra leverantörsintegration, är kostnaden för att ta reda på det ett enda API-anrop mot en nyckel du redan har, i stället för en upphandlingscykel. Leverantörers listpriser förs vidare med 0 % påslag, så en leverantörs prisändring — inklusive ElevenLabs återgång den 12 oktober — är live hos oss samma dag som den sker, och automatisk redundansväxling innebär att en röstväg under utvärdering inte behöver bli ett produktionsberoende medan du bestämmer dig.
Aritmetiken som borde avgöra det
Fem miljoner tecken per månad, vilket är en medelstor produkt och ungefär 100 timmars tal. TTS-1 HD kostar 150 $. Eleven v4 kostar 110 $ under kampanjperioden och 400 $ efter den 12 oktober. Gemini 3.8 Flash TTS kostar, enligt styrelsens normalisering, omkring 82,50 $.
Läs tillbaka de fyra siffrorna, och beslutet faller ut glasklart. Under tidsfönstret är den nyaste och högst rankade modellen på tavlan också den näst billigaste – billigare än 2023-slutpunkten som den slår med 216 Elo-poäng. Efter den 12 oktober är den det dyraste alternativet på listan med en faktor på nästan fem. Inget hos modellerna ändras det datumet; endast fakturan gör det.
Så: om du utvärderar den här månaden, utvärdera med kampanjpriset och skriv listpriset i affärscaset. Om du lanserar nästa kvartal, planera utifrån $0.08 per 1 000 tecken och behandla varje jämförelse som anger $0.022 som ett dokument med ett utgångsdatum tryckt på sig. Och om du använder TTS-1 HD och det ärliga skälet är integrationsinertia, är det användbara första steget inte en migreringsplan – det är ett enda A/B-test på dina egna skript, prissatt till den taxa du faktiskt kommer att betala i november.
