
Eleven v4 kontra reszta ElevenLabs: Czy powinieneś odejść od Eleven v3?
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 982 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 195 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
Jeśli już korzystasz z ElevenLabs Eleven v3, odpowiedź brzmi „tak” dla wszystkiego, co słyszy słuchacz, i „nie” dla dwóch rzeczy, które ElevenLabs pozostawił bez zmian. ElevenLabs Eleven v4zyskuje 150 punktów Elo względem swojego poprzednika w Provider Voice Arena Artificial Analysis — 1 319 wobec 1 169 — oraz 84 punkty w zestawieniu Controlled Voice, w którym dla wszystkich używa się tych samych ośmiu sklonowanych głosów. Ma też dwukrotnie wyższy limit znaków niż v3 i mniej więcej dwukrotnie większe pokrycie językowe. To, czego nie zmienia, to Twoja umowa, Twoje sklonowane głosy ani struktura poziomów, według której wystawiane są faktury — dlatego ta migracja jest tańsza niż większość, a mimo to warto przeprowadzić ją etapami, a nie wszystko naraz.

Wewnątrzrodzinna tablica wyników
To nie jest porównanie dostawcy z dostawcą, więc normalizacja cen na tablicach rankingowych areny działa inaczej niż zwykle: oba modele naliczają opłaty za znak, według tego samego cennika, z tego samego konta. Mocne i słabe strony poniżej są mierzone względem modeli siostrzanych, a nie konkurentów.
• Provider Voice Arena — ElevenLabs Eleven v4 1. miejsce, Elo 1 319 vs ElevenLabs Eleven v3 18. miejsce, Elo 1 169. Różnica 150 punktów.
• Kontrolowana Voice Arena, dopasowane sklonowane głosy — Eleven v4 na 2. miejscu, Elo 1157 vs Eleven v3 na 7. miejscu, Elo 1073. Różnica 84 punktów.
• Normalizacja cen w Arena — Eleven v4 80,00 USD za milion znaków vs Eleven v3 100,00 USD. Nowy flagowy model jest tańszym z tych dwóch na tablicy.
• Cennik stawek dostawcy — Eleven v4: 0,022 USD za tysiąc znaków w promocji, 0,08 USD po 12 października; Eleven v3: 0,08 USD. Identyczne w cenniku, w okresie promocyjnym o połowę taniej.
• Limit danych wejściowych na żądanie — Eleven v4 10 000 znaków vs Eleven v3 5 000. Dokładnie dwa razy więcej.
• Obsługa języków — Eleven v4 ponad 90 vs Eleven v3 ponad 70.
• Wytyczne dotyczące sposobu mówienia — Eleven v4 dokumentuje wbudowane znaczniki audio i wprowadzanie fonemów IPA; Eleven v3 nie dokumentuje żadnego z nich na swojej stronie modelu.
• Opóźnienie deklarowane przez dostawcę — Eleven v3 Conversational około 280 ms; Eleven v4 Turbo około 150 ms (mediana) do pierwszego dźwięku mowy. Różne poziomy, różne testy.
• Klony głosu — bez zmian. Istniejące klony natychmiastowe i profesjonalne zostaną zachowane.
• Poziomy planów — bez zmian. Darmowy 10 000 znaków, Starter $6, Creator $22, Pro $99, Scale $299, Business $990.
• Ścieżka migracji — Eleven v4 i Eleven v4 Turbo są już dostępne w API oraz w interfejsach agentowym i kreatywnym; starsze identyfikatory Turbo są przestarzałe.
Przeczytaj dwukrotnie wiersz z ceną. Niezwykły fakt dotyczący tej premiery polega na tym, że nowy model jest tańszy od tego, który zastępuje, na tej samej tablicy cen, według ceny katalogowej, bez zastosowanej promocji — 80 USD za milion wobec 100 USD. Stawka promocyjna powiększa tę różnicę, a nie ją tworzy. Migracja, która podnosi jakość o 150 Elo i obniża koszt na znak, nie jest wymianą, jakiej większość zespołów spodziewa się dokonywać.
Lista kontrolna migracji, w kolejności, która ma znaczenie
Najpierw zajmij się ścieżką jakości dźwięku, bo właśnie tam jest zysk i tam regresja byłaby oczywista dla twoich użytkowników, zanim stałaby się oczywista dla ciebie.
• Przesłuchaj głosy, które faktycznie dostarczasz. Provider Voice to średnia z zestawu głosów areny; głosu Twojej marki w nim nie ma. Luka 150 punktów to powód, by przeprowadzić przesłuchanie, a nie jego zamiennik, a 84-punktowa luka na tablicy głosów klonowanych to bliższe oszacowanie tego, jak będzie odbierany produkt oparty na klonowaniu.
• Sprawdź ponownie swoje budżety znaków. Limit 10 000 znaków jest dwukrotnie większy niż w v3, więc skrypty, które wcześniej dzieliłeś, mogą teraz zmieścić się w jednym żądaniu. To zmienia liczbę żądań, logikę ponowień i jakość łączeń scalonego wyniku — a to zmiana, która najprawdopodobniej zepsuje kod zakładający limit 5 000.
• Przetestuj styk. ElevenLabs w szczególności dokumentuje bardziej niezawodne łączenie żądań w v4. Jeśli dzieliłeś treści długoformatowe w v3, ponownie przepuść te same treści przez v4 w jednym wywołaniu i porównaj, zamiast zakładać, że podział nadal jest konieczny.
• Ponownie przetestuj swoje przypadki wymowy z nową obsługą fonemów. Leksykony zbudowane dla v3 należy ponownie zweryfikować, a nie ufać im; ulepszona obsługa IPA może oznaczać, że wcześniej poprawne nadpisanie współdziała teraz inaczej z własnym domysłem modelu.
• Zostaw swoją bibliotekę klonów w spokoju. Klony przechodzą dalej; ponowne przesyłanie nie jest potrzebne, a ponowne klonowanie grozi utratą głosu, który rozpoznają Twoi użytkownicy.
• Na razie pozostaw v3 Conversational tam, gdzie go używasz. To warstwa konwersacyjna, a nie model syntezy; wciąż jest udokumentowana na około 280 ms i nie ma opublikowanego odpowiednika w v4. Jeśli Twój agent od niej zależy, v4 nie jest zamiennikiem jeden do jednego w tym miejscu — v4 Turbo to etykieta v4 o niższych opóźnieniach, a jej poziom opóźnień podaje się inaczej.

Co tak naprawdę się poprawia, a co nie
Poprawa skupia się w trzech miejscach. Zakres emocjonalny i tempo są pierwsze — to właśnie mierzy ranking Provider Voice, a także podkreśla to własne ogłoszenie dostawcy, wraz z twierdzeniem, że w porównaniach w ciemno preferowano v4 w około trzech czwartych przypadków. Traktuj tę liczbę jako deklarowaną przez dostawcę i nieodtworzoną; rankingi arena są niezależną połową tej samej historii i zgadzają się co do kierunku.

Drugi to dialog z wieloma mówcami przy zachowaniu stabilnej tożsamości mówcy. Jeśli wdrożyłeś treści z dwoma mówcami na v3 i poświęciłeś czas na naprawianie przenikania głosów lub dryfu w długim skrypcie, to zadanie, w którym poprawa ma charakter strukturalny, a nie kosmetyczny — i takie, które liczba Elo tylko częściowo oddaje.
Trzecią metodą są wbudowane dyrektywy dotyczące sposobu wypowiedzi — zapisanie westchnienia lub szeptu bezpośrednio w skrypcie. W v3 oznaczało to drugie nagranie, prompt na wcześniejszym etapie albo przetwarzanie końcowe. W v4 Turbo to linia w tekście, który już masz.
To, co się nie poprawia, to część, którą zespoły często zakładają, że poprawi się wraz z nowym flagowcem: opóźnienie. ElevenLabs nie publikuje żadnej wartości opóźnienia dla samego Eleven v4, tylko dla v4 Turbo – około 100 ms mediany wnioskowania i około 150 ms mediany czasu do pierwszego dźwięku mowy, mierzonych we wrześniu 2026 r. Poziom konwersacyjny Eleven v3 jest podawany jako około 280 ms, ale to inny poziom wykonujący inne zadanie. Jeśli twoja architektura jest zbudowana wokół sztywnego budżetu opóźnień, uczciwe stanowisko jest takie, że kandydatem jest v4 Turbo i powinieneś zmierzyć go samodzielnie, ponieważ nazwy poziomów nie przekładają się w prosty sposób, a liczby dostawcy nie są bezpośrednio porównywalne.
Dwutygodniowe okno i co dzieje się później
Cena promocyjna obowiązuje do 12 października. Do tego czasu Eleven v4 kosztuje 0,022 USD za tysiąc znaków, a Eleven v4 Turbo 0,011 USD, wobec podanych cen katalogowych wynoszących odpowiednio 0,08 USD i 0,04 USD. Po tym okresie v4 powróci dokładnie do ceny, jaką v3 kosztuje dzisiaj — 0,08 USD — a v4 Turbo powróci do połowy stawki v3.
Przykładowy miesiąc przy pięciu milionach znaków: v3 kosztuje 400 USD. v4 w okresie promocyjnym kosztuje 110 USD, a później znowu 400 USD. v4 Turbo kosztuje 55 USD w okresie promocyjnym i 200 USD później. Tak więc interesującą migracją jest prawdopodobnie migracja na Turbo, ponieważ to jedyna opcja w tym cenniku, która po zakończeniu promocji pozostaje tańsza niż v3, a to tam znajduje się obsługa tagów audio, której brakuje w v3.
Praktycznym posunięciem jest wykonanie pracy nad jakością teraz, gdy cena jest dodatkowym atutem, oraz podjęcie decyzji cenowej na podstawie danych po 12 października. Każde porównanie, które podaje 22 USD za milion dla Eleven v4 bez podanego terminu, opisuje stawkę wygasającą za dwa tygodnie.
Przygotowanie przełączenia bez ryzykowania wydania
OrcaRouter nie hostuje ElevenLabs, więc w tej migracji nie ma nic, co moglibyśmy za Ciebie przenieść — zmiana zachodzi na Twoim koncie ElevenLabs. Zajmujemy się natomiast warstwą wokół stosu, który nie pochodzi od jednego dostawcy. Jeśli Twoja ścieżka mowy to jeden z kilku modeli za jednym punktem końcowym, udostępniamy ponad 200 modeli przez jeden klucz API, z cenami z cenników dostawców przekazywanymi dalej z 0% marżą, co oznacza, że zmiana cennika przez dostawcę — taka jak ta — trafia po naszej stronie tego samego dnia, co po ich stronie, bez drugiej umowy czy zmiany integracji.
Tam, gdzie ścieżka głosowa obsługuje klientów i nie może zostać przerwana, automatyczne przełączanie awaryjne omija zdegradowany upstream, zamiast zrywać połączenie. Taki właśnie kształt powinna przyjąć migracja tego typu: uruchom v4 za tym samym punktem końcowym co obecne rozwiązanie, przenieś część ruchu i pozwól warstwie routingu utrzymywać mechanizm awaryjny, dopóki nie przekonasz się, czy w twoim własnym audio pojawi się 150 punktów Elo.
Decyzja w jednym akapicie.
Przeprowadź migrację, jeśli słuchacz słyszy Twoje wyjście, a Ty wciąż korzystasz z v3 — luka jakościowa to największy skok między pojedynczymi generacjami, jaki ElevenLabs opublikował na tych forach, limit znaków podwaja się, lista języków podwaja się, a cena katalogowa jest niższa. Przeprowadź migrację etapami, zacznij od najczęściej używanego głosu, a nie od najbardziej złożonego skryptu, i zaplanuj budżet na podstawie liczb z 12 października, a nie z tego tygodnia. Pozostań przy v3 tylko wtedy, gdy Twoja integracja nie może przyjąć innego limitu danych wejściowych albo gdy v3 Conversational ma kluczowe znaczenie w agencie i nie zmierzyłeś jeszcze v4 Turbo względem własnego budżetu opóźnień. To dwa przypadki, w których cierpliwość kosztuje mniej niż pochopne przejście.
