Главная карточка для «ElevenLabs Eleven v4 vs ElevenLabs Eleven v3» с двумя карточками, расположенными друг над другом: ElevenLabs Eleven v4 с Elo 1,319, рангом 1 и ценой $80.00 за 1 млн символов; ElevenLabs Eleven v3 с Elo 1,169, рангом 18 и ценой $100.00 за 1 млн символов; с подписью «та же тарифная карта, разница 150 Elo». Нижний колонтитул: «Provider Voice Arena, по данным Artificial Analysis, сентябрь 2026 г.» Логотип OrcaRouter расположен в правом нижнем углу.
Guides & Insights

Eleven v4 против остальных продуктов ElevenLabs: стоит ли переходить с Eleven v3?

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Если вы уже используете ElevenLabs Eleven v3, то ответ — да для всего, что слышит слушатель, и нет для двух вещей, которые ElevenLabs оставила без изменений. ElevenLabs Eleven v4 набирает на 150 баллов Elo больше, чем его собственный предшественник, в Provider Voice Arena от Artificial Analysis — 1,319 против 1,169 — и на 84 балла больше в таблице Controlled Voice, где для всех используются одни и те же восемь клонированных голосов. Он также имеет вдвое больший лимит символов, чем у v3, и примерно вдвое больший языковой охват. Что он не меняет — это ваш контракт, ваши клоны голоса или структуру тарифных уровней, по которой вам выставляют счёт; именно поэтому эта миграция дешевле большинства и всё же стоит того, чтобы проводить её поэтапно, а не за один раз.

A two-column scoreboard for ElevenLabs Eleven v4 and ElevenLabs Eleven v3. Eleven v4: Provider Voice rank 1 Elo 1,319; Controlled Voice rank 2 Elo 1,157; $80.00 per 1M chars; $0.022 per 1K until Oct 12; 10,000-character cap; 90-plus languages. Eleven v3: Provider Voice rank 18 Elo 1,169; Controlled Voice rank 7 Elo 1,073; $100.00 per 1M chars; $0.08 per 1K; 5,000-character cap; 70-plus languages. Footer: 'Elo and board prices per Artificial Analysis; rate card and caps vendor-documented.'

Внутрисемейное табло

Это не сравнение вендоров между собой, поэтому нормализация цен на табло арены работает иначе, чем обычно: обе модели тарифицируются посимвольно по одной и той же тарифной сетке и с одного и того же аккаунта. Сильные и слабые стороны ниже оцениваются в сравнении с моделями-собратьями, а не с конкурентами.

• Provider Voice Arena — ElevenLabs Eleven v4 на 1-м месте с Elo 1 319 против ElevenLabs Eleven v3 на 18-м месте с Elo 1 169. Разрыв в 150 пунктов.

• Controlled Voice Arena, сопоставленные клонированные голоса — Eleven v4, ранг 2, Elo 1,157 против Eleven v3, ранг 7, Elo 1,073. Разрыв в 84 пункта.

• Нормализация цен в Arena — Eleven v4: $80.00 за миллион символов против Eleven v3 — $100.00. Новый флагман — более дешёвый из двух на табло.

• Тарифная сетка поставщика — Eleven v4: $0,022 за тысячу символов по акции, $0,08 после 12 октября; Eleven v3: $0,08. По прайс-листу они одинаковые, а в течение акционного периода — половинная цена.

• Ограничение ввода на запрос — Eleven v4 10 000 символов против Eleven v3 5 000. Ровно вдвое.

• Языковой охват — Eleven v4 90+ против Eleven v3 70+.

• Директивы подачи — Eleven v4 документирует встроенные аудиотеги и ввод фонем IPA; Eleven v3 не документирует ни того, ни другого на странице своей модели.

• Задержка, заявленная производителем — Eleven v3 Conversational около 280 мс; Eleven v4 Turbo — около 150 мс медианного времени до первого звука. Разные уровни, разные тесты.

• Голосовые клоны — без изменений. Существующие мгновенные и профессиональные клоны переносятся.

• Тарифные планы — без изменений. Free — 10 000 символов, Starter — $6, Creator — $22, Pro — $99, Scale — $299, Business — $990.

• Путь миграции — Eleven v4 и Eleven v4 Turbo уже доступны в API, а также в интерфейсах агента и креативных решений; старые идентификаторы Turbo объявлены устаревшими.

Перечитайте строку с ценой дважды. Необычный факт об этом запуске в том, что новая модель дешевле той, которую она заменяет, на той же плате, по прайс-листу, без применения промоакции — $80 за миллион против $100. Промо-тариф лишь расширяет этот разрыв, а не создаёт его. Миграция, которая повышает качество на 150 Elo и снижает стоимость за символ, — это не тот размен, на который большинство команд рассчитывает.

Чек-лист миграции, в порядке, который имеет значение

Сначала перенесите путь аудиокачества, потому что именно там кроется выигрыш и именно там регрессия станет очевидна вашим пользователям раньше, чем вам самим.

• Прослушивайте те голоса, которые вы действительно выпускаете. Provider Voice — это среднее по набору голосов арены; голоса вашего бренда в него не входят. Разрыв в 150 пунктов — это причина провести прослушивание, а не замена ему, а разрыв в 84 пункта в таблице клонированных голосов — более точная оценка того, каким будет на ощупь продукт на основе клонирования.

• Перепроверьте лимиты символов. Ограничение в 10 000 символов вдвое превышает лимит v3, поэтому скрипты, которые вы ранее разбивали, теперь могут уместиться в один запрос. Это меняет количество запросов, логику повторных попыток и качество стыков при склейке выходных данных — и это изменение с наибольшей вероятностью сломает код, который рассчитывал на лимит в 5 000 символов.

• Проверьте стык. В ElevenLabs отдельно указано, что в v4 сшивание запросов работает надёжнее. Если вы разбивали длинноформатный контент на части в v3, прогоните тот же контент через v4 одним вызовом и сравните, а не предполагайте, что разбиение всё ещё необходимо.

• Перепроверьте свои случаи произношения с новой поддержкой фонем. Лексиконы, созданные для v3, следует заново проверить, а не полагаться на них; улучшенная обработка IPA может означать, что ранее корректное переопределение теперь иначе взаимодействует с собственным предположением модели.

• Не трогайте свою библиотеку клонов. Клоны сохраняются; повторная загрузка не требуется, а повторное клонирование рискует привести к потере голоса, который узнают ваши пользователи.

• Пока что оставьте v3 Conversational там, где вы его используете. Это разговорный уровень, а не модель синтеза; в документации для него по-прежнему указано около 280 мс, и у него нет опубликованного аналога в v4. Если ваш агент зависит от него, v4 не является равноценной заменой для этого слота — v4 Turbo — это обозначение v4 с меньшей задержкой, и его уровень задержки указывается иначе.

A screenshot of ElevenLabs' model documentation, captured in English, listing the text-to-speech cards: Eleven v4 with exceptional voice cloning, 90+ languages supported, a 10,000 character limit and support for natural multi-speaker dialogue; Eleven v4 Turbo with ultra-low latency near 100 ms median inference and audio tags for fine-grained control; Eleven v3 with 70+ languages and a 5,000 character limit; and Eleven v3 Conversational, Eleven Multilingual v2 and Eleven Flash v2.5 below them.

Что на самом деле становится лучше, а что — нет

Улучшения сосредоточены в трёх местах. Эмоциональный диапазон и темп — это первое: именно это измеряет табло Provider Voice, и именно на это делает акцент и собственное объявление вендора, вместе с утверждением, что в слепых сравнениях v4 предпочитали примерно в трёх четвертях случаев. Считайте эту цифру заявленной вендором и невоспроизведённой; борды арены — независимая половина той же истории, и они согласуются по направлению.

A screenshot of the Artificial Analysis Controlled Voice Arena leaderboard, captured in English, showing Alibaba Qwen-Audio-3.1-TTS-Plus first at Elo 1,178, ElevenLabs Eleven v4 second at Elo 1,157, Cartesia Sonic 3.6 fourth at Elo 1,138 and ElevenLabs Eleven v3 seventh at Elo 1,073 on the board where the same eight cloned voices are used for every entrant.

Многоголосый диалог со стабильной идентификацией говорящего — это второй. Если вы выпускали на v3 контент с двумя участниками и тратили усилия на исправление перетекания голоса или дрейфа говорящего на протяжении длинного сценария, это та нагрузка, где улучшение носит структурный, а не косметический характер, и это улучшение показатель Elo отражает лишь частично.

Инлайн-директивы подачи — это третий способ: написать вздох или шёпот прямо в сценарии. В v3 это означало второй дубль, дополнительный промпт на предыдущем этапе или постобработку. В v4 Turbo это строка в тексте, который у вас уже есть.

Что не улучшается, так это та часть, которая, как часто предполагают команды, улучшается с новым флагманом: задержка. ElevenLabs не публикует показатель задержки для самого Eleven v4, только для v4 Turbo — примерно 100 мс медианного инференса и около 150 мс медианного времени до первого звука речи, измеренных в сентябре 2026 года. Для разговорного уровня Eleven v3 указывается около 280 мс, но это другой уровень, выполняющий другую задачу. Если ваша архитектура строится вокруг жёсткого бюджета задержки, честная позиция такова: кандидат — v4 Turbo, и вам следует измерить его самостоятельно, потому что названия уровней не соотносятся однозначно, а цифры поставщика не сопоставимы напрямую.

Двухнедельное окно — и что происходит после

Акционное ценообразование действует до 12 октября. До этого времени Eleven v4 стоит $0.022 за тысячу символов, а Eleven v4 Turbo — $0.011, тогда как заявленные прайсовые ставки составляют $0.08 и $0.04 соответственно. После окончания акции v4 возвращается ровно к сегодняшней стоимости v3 — $0.08, — а v4 Turbo — к половине ставки v3.

Расчётный месяц при пяти миллионах символов: v3 стоит $400. v4 в течение промо-периода стоит $110, а после него — снова $400. v4 Turbo стоит $55 в течение промо-периода и $200 после него. Так что интересная миграция, пожалуй, — это переход на Turbo: это единственный вариант в этой тарифной сетке, который остаётся дешевле v3 после окончания промоакции, и именно там есть поддержка аудиотегов, которой нет у v3.

Практичный шаг — сделать качественную работу сейчас, пока цена является бонусом, а решение о ценообразовании принимать по цифрам после 12 октября. Любое сравнение, где приводится $22 за миллион для Eleven v4 без указания срока, описывает тариф, срок действия которого истекает через две недели.

Поэтапное переключение без риска для релиза

OrcaRouter не размещает ElevenLabs, поэтому в этой миграции нет ничего, что мы могли бы перенести за вас — изменение происходит в вашем аккаунте ElevenLabs. А вот за что отвечаем мы — это слой вокруг стека, который не ограничивается одним поставщиком. Если ваш речевой тракт — одна из нескольких моделей за одним эндпоинтом, мы предоставляем более 200 моделей через единый ключ API, а цены провайдеров из прайс-листов передаются с наценкой 0%, а значит, изменение цен поставщиком — как в этом случае — оказывается на нашей стороне в тот же день, что и у них, без второго договора и без изменений интеграции.

Там, где голосовой канал обращён к клиенту и не может обрываться, автоматическое переключение при отказе направляет трафик в обход деградировавшего апстрима вместо сбоя вызова. Именно так и должна выглядеть подобная миграция: запустить v4 за тем же эндпоинтом, что и текущее решение, перевести часть трафика и позволить слою маршрутизации удерживать резервный маршрут, пока вы выясняете, проявятся ли 150 пунктов Elo в вашем собственном аудио.

Решение, в одном абзаце

Переходите, если слушатель слышит ваш аудиовыход, а вы всё ещё на v3 — разрыв в качестве — самый крупный скачок за одно поколение, который ElevenLabs публиковал на этих форумах, лимит символов удваивается, список языков удваивается, а цена по прайс-листу ниже. Выполняйте миграцию поэтапно, начните с голоса с наибольшим трафиком, а не с самого сложного скрипта, и планируйте бюджет по цифрам от 12 октября, а не по цифрам этой недели. Оставайтесь на v3 только если ваша интеграция не может принять другой лимит входных данных или если v3 Conversational несёт критическую нагрузку в агенте, а вы ещё не измерили v4 Turbo относительно собственного бюджета задержки. Это два случая, когда терпение обходится дешевле, чем поспешное переключение.