Een gegenereerde herokaart voor ElevenLabs Eleven v4 vs OpenAI TTS-1 HD met twee scorekaarten: Eleven v4 op Elo 1.319, rang 1 en $80,00 per 1 miljoen tekens; OpenAI TTS-1 HD op Elo 1.104, rang 35 en $30,00 per 1 miljoen tekens; met als bijschrift '216 Elo-punten, en beide endpoints verwerken nog steeds verkeer'. Voettekst: 'Provider Voice Arena, volgens Artificial Analysis, september 2026.' Het OrcaRouter-logo staat in de rechteronderhoek.
Guides & Insights

Eleven v4 vs OpenAI TTS-1 HD: Twee jaar drift in één overzicht

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

OpenAI TTS-1 HD heeft een releasedatum van 6 november 2023. ElevenLabs Eleven v4 heeft een releasedatum van 28 september 2026. Op Artificial Analysis' Provider Voice Arena liggen die twee datums 216 Elo-punten uit elkaar — TTS-1 HD staat op plaats 35 met 1.104 in 3.500 verschijningen tegen $30,00 per miljoen tekens, terwijl Eleven v4 op plaats 1 staat met 1.319 in 1.674 verschijningen tegen $80,00. Beide cijfers hebben krappe intervallen, ±12 en ±19, dus de rangorde staat niet ter discussie. De interessante vraag is niet welk model beter is, want dat was al beslecht voordat dit artikel bestond. Het is waarom een eindpunt uit 2023 nog steeds 3.500 verschijningen heeft op een ranglijst waarop een vijf dagen oud model 1.674 verschijningen heeft, en wat dat je vertelt over de migratie die je wordt gevraagd te overwegen.

Het scorebord, en de enige rij waar OpenAI wint

Vijf dimensies bepalen deze confrontatie, en beide kanten van elk zijn het waard om naast elkaar te lezen.

• Blinde voorkeur, leveranciersstemmen — Eleven v4 rang 1, Elo 1.319 (±19, 1.674 deelnames) vs TTS-1 HD rang 35, Elo 1.104 (±12, 3.500 deelnames). Een verschil van 216 punten dat de foutbalken overleeft.

• Prijs op het bord, per miljoen tekens — Eleven v4 $80,00 vs TTS-1 HD $30,00. OpenAI is 62% goedkoper tegen lijstprijs, en nog goedkoper tijdens de ElevenLabs-promotie.

• Stemmen — Eleven v4 documenteert directe cloning op basis van tien seconden audio plus een professionele clone-tier; TTS-1 HD levert een vaste stemmenset, negen voor de tts-1-familie in OpenAI's eigen documentatie (alloy, ash, coral, echo, fable, onyx, nova, sage, shimmer) en geen cloning.

• Voordrachtsaanwijzingen — Eleven v4 documenteert inline audiotags en stuurprompts in natuurlijke taal; TTS-1 HD accepteert platte tekst, en OpenAI's steerable-instructions-parameter hoort bij zijn nieuwere TTS-model en niet bij dit.

• Releasedatum — Eleven v4 28 september 2026 vs TTS-1 HD 6 november 2023.

A generated scoreboard comparing ElevenLabs Eleven v4 and OpenAI TTS-1 HD across six dimensions: Provider Voice rank and Elo (1 / 1,319 against 35 / 1,104), samples (1,674 with an interval of plus or minus 19 against 3,500 with plus or minus 12), board price ($80.00 against $30.00 per 1M characters), rate card ($0.022 per 1K characters until October 12 against $30.00 per 1M at list), voices (cloning from 10 s of audio plus a professional tier against nine fixed presets) and direction (inline audio tags against plain text only). Footer: 'Ranks, Elo and board prices per Artificial Analysis; voice set, list price and capabilities vendor-documented.' The OrcaRouter logo sits in the bottom-right corner.

Prijs is de rij die OpenAI wint, en het is een grotere overwinning dan het lijkt, want de promotie van ElevenLabs is tijdelijk. Bij $0,022 per 1.000 tekens kost Eleven v4 $22 per miljoen tot 12 oktober — ronduit goedkoper dan TTS-1 HD. Na 12 oktober kost het $80 per miljoen tegenover de $30 van OpenAI, en dat blijft zo.

Waarom een model uit 2023 het dubbele aantal samples heeft

Dat getal is het nuttigste dat op deze ranglijst staat, en het is makkelijk verkeerd te lezen. Arena-vermeldingen nemen toe met het verkeer, en het verkeer neemt toe met integraties die één keer zijn gebouwd en nooit meer zijn herzien. TTS-1 HD heeft 3.500 vermeldingen achter zich omdat het het standaard spraakeindpunt is geweest voor elk team dat OpenAI al aanroept voor chat completions: dezelfde sleutel, dezelfde SDK, dezelfde factuurregel, één aanroep extra. Niets in die zin gaat over stemkwaliteit, en de achterstand van 216 punten heeft het niet tegengehouden.

A screenshot of Artificial Analysis' TTS-1 HD model page, titled TTS-1 HD Quality Elo, Speed & Price Analysis, credited to OpenAI and the OpenAI TTS family with an Elo of 1,103.83. The Provider Voice Arena Preference Elo bar chart runs from Eleven v4 at 1,319 at the left through Gemini 3.8 Flash TTS, Simba 3.2, Eleven v3 and Gemini 3.8 Flash-Lite TTS to TTS-1 HD at 1,104 at the right, with the model selector reading '28 of 96 models'.

Dit is hoe migratieschuld eruitziet op een ranglijst. Het is geen signaal dat het oudere model concurrerend is; het is een signaal dat overstappen iets kost, en dat een groot aantal teams heeft besloten dat dat iets meer waard is dan 216 Elo-punten. Dat is een legitieme conclusie voor een notificatie-overzicht en een slechte voor een product waar de stem is wat de klant hoort.

Waarom je bij TTS-1 HD moet blijven

Drie dingen houden het verdedigbaar, en geen ervan is kwaliteit.

Determinisme staat voorop. Een vaste set van negen stemmen levert consistente output over versies heen, op een manier waarop een kloonpijplijn dat niet doet, en consistente output is precies wat je wilt in een utility-pad waar niemand op artisticiteit zit te wachten. Er is geen kloon die kan afdrijven, geen referentiemonster om opnieuw op te nemen, en geen toestemmingsartefact om te onderhouden.

De integratiekosten zijn de tweede, en dat is degene die de arena niet kan beprijzen. Een tweede spraakleverancier toevoegen betekent een nieuw account, een nieuwe tariefkaart, een nieuwe faalmodus en iets nieuws om te monitoren. Voor een team dat al in de OpenAI-stack zit, is dat echte engineeringtijd, en 216 Elo-punten betalen daar niet voor.

Laagsegmentvolume is het derde. Bij $30 per miljoen tekens is de volledige maandelijkse rekening van een klein product een afrondingsfout, en valt er niets te optimaliseren. Dit is het regime waarin het goedkope antwoord en het juiste antwoord hetzelfde antwoord zijn, en dat is prima.

Het pleidooi voor verhuizen, en het tegenargument daartegen

Stap over wanneer de stem voor klanten bestemd is. Klonen in tien seconden, inline regieaanwijzingen, meer dan 90 talen en een invoerlimiet van 10.000 tekens per verzoek zijn geen cosmetische verschillen tegenover een vaste set van negen stemmen uit 2023, en de kloof van 216 punten in de arena is de gecomprimeerde versie van een veel grotere capaciteitskloof. Als je een agent, een assistent met je merk of iets bouwt waarbij een luisteraar zich binnen de eerste zin een mening over je product vormt, is het oudere endpoint de verkeerde standaardkeuze.

Het tegenargument is dat "overstappen naar Eleven v4" niet de enige zet is. OpenAI heeft sindsdien een nieuwer TTS-model uitgebracht met een stuurbare instructieparameter, en Google's Gemini 3.8 Flash TTS staat derde op dezelfde ranglijst met 1.267 en een genormaliseerde $16,49 per miljoen — een winst van 163 punten ten opzichte van TTS-1 HD tegen ongeveer de helft van de prijs op de ranglijst. Als je beperking is dat je bij je huidige leverancier blijft, is dat de goedkopere upgrade. Als het gaat om binnen je huidige cloud blijven, is het de enige.

Waar OrcaRouter eigenlijk staat in deze vergelijking

This is the rare article in this series where we host one of the two models, so let us be precise about which. openai/tts-1-hd is live in the OrcaRouter catalogue at OpenAI's list rate passed through at 0% markup: $30 per million, model ID openai/tts-1-hd, served on the OpenAI-compatible endpoint at https://api.orcarouter.ai/v1 with a POST /v1/audio/speech route and the voice, speed and response_format parameters. Our own page reports a median latency of 2,461 ms and a 95th percentile of 4,769 ms, which is the honest reason not to put it in front of a live conversation — that is a batch-shaped number, not an agent-shaped one.

A screenshot of the OrcaRouter model page for openai/tts-1-hd. The header shows the model ID openai/tts-1-hd with Audio and JSON tags, the description 'OpenAI's high-definition text-to-speech model, accessed via OrcaRouter's API at $30 per 1M tokens (zero markup)', and the endpoint /v1/audio/speech. Stat tiles read $30.00 per 1M characters, p50 TTFT 2.46 s, p95 TTFT 4.77 s and traffic of 1.5K characters over 7 days. Supported parameters are response_format, speed and voice, the OpenAI-compatible base URL is https://api.orcarouter.ai/v1, and the pricing panel states 'This model is not billed per token. The rate above is the unit it actually meters, and it is what settlement charges.'

ElevenLabs Eleven v4 staat niet in onze catalogus en er is niets dat via ons loopt: het is bereikbaar via de eigen API van ElevenLabs tegen het eigen tarief van ElevenLabs. Wat één sleutel verandert, is de vorm van de migratie. Als de reden dat je de nieuwe koploper niet hebt getest is dat het een tweede leveranciersintegratie betekent, dan kost het uitzoeken daarvan één API-call met een sleutel die je al hebt in plaats van een inkooptraject. Lijstprijzen van leveranciers worden doorgegeven met 0% opslag, dus een prijswijziging van een leverancier — inclusief de terugdraaiing van ElevenLabs op 12 oktober — is bij ons live op de dag dat die plaatsvindt, en automatische failover betekent dat een spraakpad dat wordt geëvalueerd geen productieafhankelijkheid hoeft te worden terwijl je besluit.

De berekening die de doorslag zou moeten geven

Vijf miljoen tekens per maand, wat een middelgroot product is en ongeveer 100 uur spraak. TTS-1 HD kost $150. Eleven v4 kost $110 tijdens de promotieperiode en $400 na 12 oktober. Gemini 3.8 Flash TTS kost, bij de normalisatie van de board, ongeveer $82,50.

Lees die vier getallen terug en de beslissing valt helder uiteen. Tijdens het venster is het nieuwste en best gerangschikte model op de ranglijst ook het op één na goedkoopste — goedkoper dan het 2023-eindpunt dat het met 216 Elo-punten verslaat. Na 12 oktober is het de duurste optie op de lijst, met een factor van bijna vijf. Op die datum verandert er niets aan de modellen; alleen de factuur verandert.

Dus: als je deze maand evalueert, evalueer dan met het promotietarief en schrijf het lijsttarief in de businesscase. Als je volgend kwartaal uitlevert, reken dan vanaf $0,08 per 1.000 tekens en behandel elke vergelijking die $0,022 noemt als een document met een vervaldatum erop gedrukt. En als je op TTS-1 HD zit en de eerlijke reden integratie-inertie is, is de nuttige eerste stap geen migratieplan — het is één A/B-test op je eigen scripts, geprijsd tegen het tarief dat je in november daadwerkelijk zult betalen.