
Eleven v4 vs. OpenAI TTS-1 HD: Zwei Jahre Drift in einem Board
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 982 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 197 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
OpenAI TTS-1 HD hat ein Veröffentlichungsdatum vom 6. November 2023. ElevenLabs Eleven v4 hat eines vom 28. September 2026. Auf der Provider Voice Arena von Artificial Analysis liegen diese beiden Daten 216 Elo-Punkte auseinander — TTS-1 HD liegt auf Rang 35 mit 1.104 bei 3.500 Auftritten zu 30,00 $ pro Million Zeichen, während Eleven v4 auf Rang 1 mit 1.319 bei 1.674 Auftritten zu 80,00 $ liegt. Beide Werte haben enge Intervalle, ±12 und ±19, sodass die Rangfolge außer Zweifel steht. Die interessante Frage ist nicht, welches Modell besser ist, denn das wurde geklärt, bevor es diesen Artikel gab. Sie ist, warum ein 2023er Endpunkt noch 3.500 Auftritte auf einem Board hat, auf dem ein fünf Tage altes Modell 1.674 hat, und was das über die Migration aussagt, die Sie in Betracht ziehen sollen.
Die Rangliste – und die eine Zeile, in der OpenAI gewinnt
Über dieses Aufeinandertreffen entscheiden fünf Dimensionen, und beide Seiten jeder einzelnen sind es wert, nebeneinander gelesen zu werden.
• Blinde Präferenz, Anbieterstimmen — Eleven v4 Rang 1, Elo 1.319 (±19, 1.674 Auftritte) vs. TTS-1 HD Rang 35, Elo 1.104 (±12, 3.500 Auftritte). Ein Abstand von 216 Punkten, der die Fehlerbalken übersteht.
• Listenpreis pro Million Zeichen — Eleven v4 80,00 $ vs. TTS-1 HD 30,00 $. OpenAI ist laut Liste um 62 % günstiger und während der ElevenLabs-Aktion noch günstiger.
• Stimmen — Eleven v4 dokumentiert sofortiges Klonen aus zehn Sekunden Audio plus eine professionelle Klon-Stufe; TTS-1 HD bietet ein festes Stimmen-Set, neun für die tts-1-Familie in OpenAIs eigener Dokumentation (alloy, ash, coral, echo, fable, onyx, nova, sage, shimmer), und kein Klonen.
• Performance-Regie — Eleven v4 dokumentiert Inline-Audio-Tags und natürlichsprachliche Regieanweisungen; TTS-1 HD nimmt reinen Text entgegen, und OpenAIs Parameter für steuerbare Anweisungen gehört zu dessen neuerem TTS-Modell und nicht zu diesem.
• Veröffentlichungsdatum — Eleven v4 28. September 2026 vs. TTS-1 HD 6. November 2023.

Der Preis ist die Zeile, in der OpenAI gewinnt, und es ist ein größerer Sieg, als es aussieht, weil die ElevenLabs-Aktion befristet ist. Bei 0,022 US-Dollar pro 1.000 Zeichen kostet Eleven v4 bis zum 12. Oktober 22 US-Dollar pro Million – schlichtweg günstiger als TTS-1 HD. Nach dem 12. Oktober kostet es 80 US-Dollar pro Million gegenüber den 30 US-Dollar von OpenAI und bleibt auf diesem Niveau.
Warum ein 2023er-Modell die doppelte Stichprobenanzahl hat
Diese Zahl ist das Nützlichste auf diesem Board, und sie ist leicht falsch zu lesen. Arena-Auftritte summieren sich mit Traffic, und Traffic summiert sich durch Integrationen, die einmal gebaut und nie wieder angefasst wurden. TTS-1 HD hat 3.500 Auftritte hinter sich, weil es der Standard-Sprach-Endpunkt für jedes Team war, das OpenAI bereits für Chat-Completions aufrief: derselbe Schlüssel, dasselbe SDK, dieselbe Abrechnungszeile, ein weiterer Aufruf. Nichts in diesem Satz dreht sich um Sprachqualität, und der 216-Punkte-Rückstand hat es nicht aufgehalten.

So sieht Migrationsschuld auf einer Rangliste aus. Es ist kein Signal dafür, dass das ältere Modell wettbewerbsfähig ist; es ist ein Signal dafür, dass ein Wechsel etwas kostet und dass eine große Zahl von Teams entschieden hat, dass dieses Etwas mehr wert ist als 216 Elo-Punkte. Das ist eine legitime Schlussfolgerung für eine Benachrichtigungsanzeige und eine schlechte für ein Produkt, bei dem die Stimme das ist, was der Kunde hört.
Das Plädoyer dafür, bei TTS-1 HD zu bleiben
Drei Dinge machen es verteidigbar, und keines davon ist Qualität.
Der Determinismus steht an erster Stelle. Ein festes Set von neun Stimmen erzeugt über Versionen hinweg konsistente Ausgaben – anders als eine Klon-Pipeline –, und konsistente Ausgaben sind genau das, was man in einem Utility-Pfad will, in dem niemand auf Kunstfertigkeit achtet. Es gibt keinen Klon, der abdriften könnte, kein Referenzsample, das neu aufgenommen werden müsste, und kein Einwilligungsartefakt, das gepflegt werden müsste.
Die Integrationskosten sind der zweite Punkt, und sie sind derjenige, den die Arena nicht bepreisen kann. Einen zweiten Sprachanbieter hinzuzufügen bedeutet ein neues Konto, eine neue Preisliste, eine neue Ausfallart und einen neuen Punkt, der überwacht werden muss. Für ein Team, das bereits im OpenAI-Stack arbeitet, ist das echte Engineering-Zeit, und 216 Elo-Punkte wiegen das nicht auf.
Low-End-Volumen ist das dritte. Bei 30 $ pro Million Zeichen ist die gesamte monatliche Sprachrechnung eines kleinen Produkts ein Rundungsfehler, und es gibt nichts zu optimieren. Das ist das Regime, in dem die billige Antwort und die faule Antwort dieselbe Antwort sind, und das ist in Ordnung.
Das Plädoyer für einen Umzug und das Gegenargument dazu
Wechseln Sie, wenn die Stimme für Kunden gedacht ist. Zehn-Sekunden-Klonen, Inline-Performance-Steuerung, über 90 Sprachen und eine Eingabeobergrenze von 10.000 Zeichen pro Anfrage sind keine kosmetischen Unterschiede gegenüber einem festen Satz von neun Stimmen aus dem Jahr 2023, und der 216-Punkte-Abstand der Arena ist die komprimierte Version einer viel größeren Fähigkeitslücke. Wenn Sie einen Agenten, einen Marken-Assistenten oder irgendetwas entwickeln, bei dem ein Zuhörer sich schon beim ersten Satz eine Meinung über Ihr Produkt bildet, ist der ältere Endpunkt die falsche Standardeinstellung.
Das Gegenargument lautet, dass „der Wechsel zu Eleven v4“ nicht die einzige Option ist. OpenAI hat seitdem ein neueres TTS-Modell mit einem steuerbaren Instruktionsparameter veröffentlicht, und Googles Gemini 3.8 Flash TTS belegt auf demselben Board mit 1.267 und normalisierten 16,49 $ pro Million den dritten Platz – ein Zugewinn von 163 Punkten gegenüber TTS-1 HD bei ungefähr der Hälfte des Board-Preises. Wenn Ihre Vorgabe darin besteht, bei Ihrem aktuellen Anbieter zu bleiben, ist das das günstigere Upgrade. Wenn sie darin besteht, in Ihrer aktuellen Cloud zu bleiben, ist es die einzige.
Wo OrcaRouter in diesem Vergleich tatsächlich steht
This is the rare article in this series where we host one of the two models, so let us be precise about which. openai/tts-1-hd is live in the OrcaRouter catalogue at OpenAI's list rate passed through at 0% markup: $30 per million, model ID openai/tts-1-hd, served on the OpenAI-compatible endpoint at https://api.orcarouter.ai/v1 with a POST /v1/audio/speech route and the voice, speed and response_format parameters. Our own page reports a median latency of 2,461 ms and a 95th percentile of 4,769 ms, which is the honest reason not to put it in front of a live conversation — that is a batch-shaped number, not an agent-shaped one.

ElevenLabs Eleven v4 ist nicht in unserem Katalog, und es gibt nichts, was über uns aufgerufen werden könnte: Es wird über die eigene API von ElevenLabs nach ElevenLabs' eigener Preisliste erreicht. Was ein einziger Key ändert, ist die Form der Migration. Wenn der Grund, warum Sie den neuen Marktführer nicht getestet haben, darin liegt, dass er eine zweite Anbieterintegration bedeutet, dann kostet das Herausfinden einen API-Aufruf mit einem Key, den Sie bereits besitzen, statt einen Beschaffungszyklus. Anbieter-Listenpreise werden mit 0 % Aufschlag durchgereicht, sodass eine Preisanpassung eines Anbieters — einschließlich der Rückumstellung von ElevenLabs am 12. Oktober — an dem Tag, an dem sie erfolgt, auf unserer Seite live ist, und automatisches Failover bedeutet, dass ein Sprachpfad, der gerade evaluiert wird, nicht zu einer Produktionsabhängigkeit werden muss, während Sie sich entscheiden.
Die Arithmetik, die es klären sollte
Fünf Millionen Zeichen pro Monat, was einem mittelgroßen Produkt und etwa 100 Stunden Sprache entspricht. TTS-1 HD kostet 150 $. Eleven v4 kostet 110 $ während des Aktionszeitraums und 400 $ nach dem 12. Oktober. Gemini 3.8 Flash TTS kostet nach der Normalisierung durch das Board etwa 82,50 $.
Lies diese vier Zahlen noch einmal, und die Entscheidung fällt eindeutig aus. Während des Zeitfensters ist das neueste und am besten platzierte Modell auf der Rangliste zugleich das zweitgünstigste – günstiger als der 2023-Endpunkt, den es um 216 Elo-Punkte schlägt. Nach dem 12. Oktober ist es die teuerste Option auf der Liste – und das um fast das Fünffache. An diesem Datum ändert sich an den Modellen nichts; nur die Rechnung ändert sich.
Also: Wenn Sie diesen Monat evaluieren, evaluieren Sie mit dem Aktionspreis und schreiben Sie den Listenpreis in den Business Case. Wenn Sie im nächsten Quartal ausliefern, kalkulieren Sie mit $0,08 pro 1.000 Zeichen und behandeln Sie jeden Vergleich, der $0,022 nennt, wie ein Dokument mit aufgedrucktem Ablaufdatum. Und wenn Sie TTS-1 HD nutzen und der ehrliche Grund Integrationsträgheit ist, ist der nützliche erste Schritt kein Migrationsplan – sondern ein einzelner A/B-Test mit Ihren eigenen Skripten, kalkuliert mit dem Preis, den Sie im November tatsächlich zahlen werden.
