Eine Hero-Karte für „ElevenLabs Eleven v4 vs ElevenLabs Eleven v3" mit zwei gestapelten Karten: ElevenLabs Eleven v4 bei Elo 1.319, Rang 1 und 80,00 $ pro 1 Mio. Zeichen; ElevenLabs Eleven v3 bei Elo 1.169, Rang 18 und 100,00 $ pro 1 Mio. Zeichen; mit der Bildunterschrift „gleiche Tarifkarte, 150 Elo Unterschied". Fußzeile: „Provider Voice Arena, laut Artificial Analysis, Sept. 2026." Das OrcaRouter-Logo befindet sich in der unteren rechten Ecke.
Guides & Insights

Eleven v4 vs. der Rest von ElevenLabs: Sollten Sie von Eleven v3 weg migrieren?

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Wenn Sie bereits auf ElevenLabs Eleven v3 sind, lautet die Antwort ja für alles, was ein Zuhörer hört, und nein für die beiden Dinge, die ElevenLabs unverändert gelassen hat. ElevenLabs Eleven v4 gewinnt 150 Elo-Punkte gegenüber seinem eigenen Vorgänger in der Provider Voice Arena von Artificial Analysis – 1.319 gegenüber 1.169 – und 84 Punkte im Controlled Voice Board, wo für alle dieselben acht geklonten Stimmen verwendet werden. Es bietet außerdem ein Zeichenlimit, das doppelt so hoch ist wie das von v3, und eine ungefähr doppelt so große Sprachabdeckung. Was es nicht ändert, sind Ihr Vertrag, Ihre Stimmklone oder die Tarifstruktur, nach der Sie abgerechnet werden, weshalb diese Migration günstiger ist als die meisten und es sich dennoch lohnt, sie schrittweise statt alles auf einmal durchzuführen.

A two-column scoreboard for ElevenLabs Eleven v4 and ElevenLabs Eleven v3. Eleven v4: Provider Voice rank 1 Elo 1,319; Controlled Voice rank 2 Elo 1,157; $80.00 per 1M chars; $0.022 per 1K until Oct 12; 10,000-character cap; 90-plus languages. Eleven v3: Provider Voice rank 18 Elo 1,169; Controlled Voice rank 7 Elo 1,073; $100.00 per 1M chars; $0.08 per 1K; 5,000-character cap; 70-plus languages. Footer: 'Elo and board prices per Artificial Analysis; rate card and caps vendor-documented.'

Die familieninterne Rangliste

Dies ist kein Vergleich zwischen Anbietern, daher verhält sich die Preisnormalisierung auf den Arena-Boards anders als üblich: Beide Modelle rechnen pro Zeichen ab, nach derselben Preisliste, über dasselbe Konto. Die Stärken und Schwächen unten werden an Geschwistermodellen statt an Wettbewerbern gemessen.

• Provider Voice Arena — ElevenLabs Eleven v4 Rang 1, Elo 1.319 gegen ElevenLabs Eleven v3 Rang 18, Elo 1.169. Ein Abstand von 150 Punkten.

• Kontrollierte Voice Arena, abgeglichene geklonte Stimmen — Eleven v4 Platz 2, Elo 1.157 vs. Eleven v3 Platz 7, Elo 1.073. Eine Lücke von 84 Punkten.

• Arena-Preisnormalisierung — Eleven v4 80,00 $ pro Million Zeichen gegenüber Eleven v3 100,00 $. Das neue Flaggschiff ist das günstigere der beiden auf der Rangliste.

• Anbieter-Preisliste — Eleven v4 0,022 $ pro tausend Zeichen als Aktionspreis, 0,08 $ nach dem 12. Oktober; Eleven v3 0,08 $. Zum Listenpreis identisch, während des Zeitfensters zum halben Preis.

• Maximale Eingabelänge pro Anfrage — Eleven v4 10.000 Zeichen vs. Eleven v3 5.000. Genau doppelt.

• Sprachabdeckung — Eleven v4 über 90 vs. Eleven v3 über 70.

• Vortragsanweisungen — Eleven v4 dokumentiert Inline-Audio-Tags und IPA-Phonemeingabe; Eleven v3 dokumentiert beides nicht auf seiner Modellseite.

• Latenz, vom Anbieter angegeben — Eleven v3 Conversational etwa 280 ms; Eleven v4 Turbo etwa 150 ms Median bis zur ersten Sprachausgabe. Unterschiedliche Stufen, unterschiedliche Tests.

• Voice-Clones – unverändert. Bestehende Instant- und professionelle Klone werden übernommen.

• Tarifstufen — unverändert. Free 10.000 Zeichen, Starter 6 $, Creator 22 $, Pro 99 $, Scale 299 $, Business 990 $.

• Migrationspfad — Eleven v4 und Eleven v4 Turbo sind beide in der API sowie in den Agent- und Creative-Oberflächen live; die älteren Turbo-Identifier sind veraltet.

Lesen Sie die Preiszeile zweimal. Die ungewöhnliche Tatsache an diesem Start ist, dass das neue Modell günstiger ist als das, das es ersetzt, auf demselben Board, zum Listenpreis, ohne angewendete Aktion — 80 $ pro Million gegenüber 100 $. Der Aktionspreis vergrößert das eher, als dass er es erzeugt. Eine Migration, die die Qualität um 150 Elo erhöht und die Kosten pro Zeichen senkt, ist nicht der Trade-off, den die meisten Teams erwarten.

Migrations-Checkliste, in der Reihenfolge, die zählt

Verschiebe den Audioqualitätspfad an die erste Stelle, denn dort liegt der Gewinn, und dort würde eine Regression deinen Nutzern eher auffallen als dir.

• Höre die Stimmen probe, die du tatsächlich auslieferst. Provider Voice ist ein Durchschnitt über ein Arena-Stimmen-Set; deine Markenstimme ist nicht darin enthalten. Die 150-Punkte-Lücke ist ein Grund fürs Probehören, kein Ersatz dafür, und die 84-Punkte-Lücke des Cloned-Voice-Boards ist die genauere Schätzung dafür, wie sich ein klonbasiertes Produkt anfühlen wird.

• Überprüfen Sie Ihre Zeichenbudgets erneut. Die Obergrenze von 10.000 Zeichen ist doppelt so hoch wie die von v3, sodass Skripte, die Sie zuvor aufgeteilt haben, jetzt möglicherweise in eine einzige Anfrage passen. Das verändert die Anzahl der Anfragen, die Wiederholungslogik und die Nahtqualität zusammengesetzter Ausgaben – und es ist die Änderung, die am wahrscheinlichsten Code bricht, der eine Obergrenze von 5.000 vorausgesetzt hat.

• Testen Sie die Nahtstelle. ElevenLabs dokumentiert ausdrücklich ein zuverlässigeres Zusammenfügen von Anfragen in v4. Wenn Sie bei v3 Langform-Inhalte aufgeteilt haben, lassen Sie denselben Inhalt in einem einzigen Aufruf durch v4 erneut laufen und vergleichen Sie, anstatt anzunehmen, dass die Aufteilung weiterhin nötig ist.

• Testen Sie Ihre Aussprachefälle mit der neuen Phonemunterstützung erneut. Für v3 erstellte Lexika sollten erneut validiert werden, statt ihnen zu vertrauen; eine verbesserte IPA-Verarbeitung kann dazu führen, dass eine zuvor korrekte Überschreibung nun anders mit der eigenen Vermutung des Modells interagiert.

• Lassen Sie Ihre Klon-Bibliothek in Ruhe. Klone bleiben erhalten; ein erneutes Hochladen ist nicht nötig, und erneutes Klonen riskiert, eine Stimme zu verlieren, die Ihre Nutzer wiedererkennen.

• Behalten Sie v3 Conversational vorerst dort bei, wo Sie es verwenden. Es ist eher eine Konversationsstufe als ein Synthesemodell, es ist weiterhin mit etwa 280 ms dokumentiert und es hat kein veröffentlichtes v4-Äquivalent. Wenn Ihr Agent darauf angewiesen ist, ist v4 kein gleichwertiger Ersatz für diesen Slot – v4 Turbo ist die v4-Bezeichnung mit geringerer Latenz, und seine Latenzstufe wird anders angegeben.

A screenshot of ElevenLabs' model documentation, captured in English, listing the text-to-speech cards: Eleven v4 with exceptional voice cloning, 90+ languages supported, a 10,000 character limit and support for natural multi-speaker dialogue; Eleven v4 Turbo with ultra-low latency near 100 ms median inference and audio tags for fine-grained control; Eleven v3 with 70+ languages and a 5,000 character limit; and Eleven v3 Conversational, Eleven Multilingual v2 and Eleven Flash v2.5 below them.

Was tatsächlich besser wird und was nicht

Die Verbesserungen konzentrieren sich auf drei Bereiche. Emotionale Bandbreite und Tempo stehen an erster Stelle — das ist es, was das Provider Voice Board misst, und es ist auch das, was die eigene Ankündigung des Anbieters hervorhebt, zusammen mit der Behauptung, dass Blindvergleiche v4 in rund drei Vierteln der Fälle bevorzugten. Betrachten Sie diese Zahl als vom Anbieter angegeben und nicht reproduziert; die Arena-Boards sind die unabhängige Hälfte derselben Geschichte, und sie stimmen in der Richtung überein.

A screenshot of the Artificial Analysis Controlled Voice Arena leaderboard, captured in English, showing Alibaba Qwen-Audio-3.1-TTS-Plus first at Elo 1,178, ElevenLabs Eleven v4 second at Elo 1,157, Cartesia Sonic 3.6 fourth at Elo 1,138 and ElevenLabs Eleven v3 seventh at Elo 1,073 on the board where the same eight cloned voices are used for every entrant.

Mehrsprecher-Dialog mit stabiler Sprecheridentität ist der zweite Punkt. Wenn Sie auf v3 Zwei-Personen-Inhalte veröffentlicht und Aufwand darauf verwendet haben, Sprecher-Übersprechen oder Drift über ein langes Skript hinweg zu beheben, dann ist das eine Arbeitslast, bei der die Verbesserung strukturell statt kosmetisch ist, und eine, die die Elo-Zahl nur teilweise erfasst.

Inline-Sprechanweisungen sind die dritte – einen Seufzer oder ein Flüstern direkt ins Skript zu schreiben. Bei v3 bedeutete das einen zweiten Take, einen vorgelagerten Prompt oder Nachbearbeitung. Bei v4 Turbo ist es eine Zeile in dem Text, den Sie bereits haben.

Was sich nicht verbessert, ist der Teil, von dem Teams oft annehmen, dass er sich mit einem neuen Flaggschiff verbessert: die Latenz. ElevenLabs veröffentlicht keine Latenzzahl für Eleven v4 selbst, nur für v4 Turbo mit ungefähr 100 ms mittlerer Inferenz und etwa 150 ms mittlerer Zeit bis zur ersten Sprachausgabe, gemessen im September 2026. Die Konversationsstufe von Eleven v3 wird mit etwa 280 ms angegeben, ist aber eine andere Stufe, die eine andere Aufgabe erfüllt. Wenn Ihre Architektur auf ein hartes Latenzbudget ausgelegt ist, ist die ehrliche Position, dass v4 Turbo der Kandidat ist und Sie ihn selbst messen sollten, weil die Stufennamen nicht sauber zuzuordnen sind und die Anbieterzahlen nicht direkt vergleichbar sind.

Das Zwei-Wochen-Fenster und was danach passiert

Die Aktionspreise gelten bis zum 12. Oktober. Bis dahin kostet Eleven v4 0,022 $ pro tausend Zeichen und Eleven v4 Turbo 0,011 $, gegenüber angegebenen Listenpreisen von 0,08 $ bzw. 0,04 $. Nach Ablauf des Aktionszeitraums kostet v4 wieder genau so viel wie v3 heute – 0,08 $ – und v4 Turbo wieder die Hälfte des v3-Tarifs.

Ein durchgerechneter Monat bei fünf Millionen Zeichen: v3 kostet 400 $. v4 kostet während des Aktionszeitraums 110 $ und danach wieder 400 $. v4 Turbo kostet während des Aktionszeitraums 55 $ und danach 200 $. Die interessante Migration ist also wohl die auf Turbo, denn sie ist die einzige Option auf dieser Tarifkarte, die nach Ende der Aktion günstiger als v3 bleibt, und die Audio-Tag-Unterstützung, die v3 fehlt, gibt es dort.

Der praktische Schritt ist, die Qualitätsarbeit jetzt zu erledigen, solange der Preis ein Bonus ist, und die Preisentscheidung anhand der Zahlen nach dem 12. Oktober zu treffen. Jeder Vergleich, der 22 US-Dollar pro Million für Eleven v4 nennt, ohne eine Frist anzugeben, beschreibt einen Tarif, der in zwei Wochen ausläuft.

Den Wechsel vorbereiten, ohne das Release darauf zu verwetten

OrcaRouter hostet ElevenLabs nicht, daher gibt es in dieser Migration nichts, das wir für Sie verschieben könnten – die Änderung findet in Ihrem ElevenLabs-Konto statt. Was wir übernehmen, ist die Ebene rund um einen Stack, der nicht auf einen einzigen Anbieter beschränkt ist. Wenn Ihr Sprachpfad eines von mehreren Modellen hinter einem einzigen Endpunkt ist, stellen wir über 200 Modelle über einen einzigen API-Schlüssel bereit und reichen die Listenpreise der Anbieter mit 0 % Aufschlag durch, was bedeutet, dass eine Preisänderung eines Anbieters – wie diese hier – bei uns am selben Tag ankommt, an dem sie bei ihm ankommt, ohne einen zweiten Vertrag oder eine Änderung an der Integration.

Wenn der Sprachpfad kundengerichtet ist und nicht ausfallen darf, leitet automatisches Failover um eine beeinträchtigte Upstream-Komponente herum, statt den Anruf fehlschlagen zu lassen. So sollte eine Migration wie diese ablaufen: v4 hinter demselben Endpunkt wie das bestehende System betreiben, einen Teil des Datenverkehrs verlagern und die Routing-Schicht das Fallback halten lassen, während Sie herausfinden, ob die 150 Elo-Punkte in Ihrem eigenen Audio auftauchen.

Die Entscheidung, in einem Absatz

Migriere, wenn ein Zuhörer deine Ausgabe hört und du noch auf v3 bist — die Qualitätslücke ist der größte Ein-Generationen-Sprung, den ElevenLabs auf diesen Boards veröffentlicht hat, das Zeichenlimit verdoppelt sich, die Sprachenliste verdoppelt sich, und der Listenpreis ist niedriger. Führe die Migration in Etappen durch, beginne mit deiner Voice mit dem höchsten Traffic statt mit deinem komplexesten Skript, und plane dein Budget auf Basis der Zahlen vom 12. Oktober statt auf Basis der dieswöchigen. Bleib nur dann auf v3, wenn deine Integration ein anderes Eingabelimit nicht verkraften kann oder wenn v3 Conversational in einem Agenten eine tragende Rolle spielt und du v4 Turbo noch nicht gegen dein eigenes Latenzbudget gemessen hast. Das sind die beiden Fälle, in denen Geduld weniger kostet als ein überstürzter Wechsel.