
Eleven v4 vs. o Resto da ElevenLabs: Você Deveria Migrar do Eleven v3?
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 982 tok/s
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 195 tok/s
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Se você já está no ElevenLabs Eleven v3, a resposta é sim para tudo o que um ouvinte escuta e não para as duas coisas que a ElevenLabs manteve inalteradas. ElevenLabs Eleven v4 ganha 150 pontos Elo em relação ao seu próprio antecessor no Provider Voice Arena da Artificial Analysis — 1.319 contra 1.169 — e 84 pontos no quadro Controlled Voice, em que as mesmas oito vozes clonadas são usadas para todos. Ele também traz um limite de caracteres duas vezes maior que o da v3 e aproximadamente o dobro da cobertura de idiomas. O que ele não muda é o seu contrato, os seus clones de voz ou a estrutura de planos sobre a qual você é faturado, e é por isso que esta migração é mais barata do que a maioria e ainda assim vale a pena ser feita de forma escalonada, em vez de toda de uma só vez.

O placar intrafamiliar
Isto não é uma comparação entre fornecedores, por isso a normalização de preços nos placares da arena comporta-se de forma diferente do habitual: ambos os modelos cobram por caractere, com a mesma tabela de preços, a partir da mesma conta. Os pontos fortes e fracos abaixo são avaliados em relação a modelos irmãos, e não a concorrentes.
• Provider Voice Arena — ElevenLabs Eleven v4 em 1º lugar, Elo 1.319 vs. ElevenLabs Eleven v3 em 18º lugar, Elo 1.169. Uma diferença de 150 pontos.
• Controlled Voice Arena, vozes clonadas emparelhadas — Eleven v4 2º lugar, Elo 1.157 vs Eleven v3 7º lugar, Elo 1.073. Uma diferença de 84 pontos.
• Normalização de preços da Arena — Eleven v4 $80.00 por milhão de caracteres vs. Eleven v3 $100.00. O novo carro-chefe é o mais barato dos dois na tabela.
• Tabela de preços do fornecedor — Eleven v4 $0,022 por mil caracteres em promoção, $0,08 após 12 de outubro; Eleven v3 $0,08. Idêntico no preço de tabela, metade do preço durante o período.
• Limite de entrada por solicitação — Eleven v4 10.000 caracteres vs Eleven v3 5.000. Exatamente o dobro.
• Cobertura de idiomas — Eleven v4 com mais de 90 vs Eleven v3 com mais de 70.
• Diretrizes de entrega — os documentos do Eleven v4 abordam tags de áudio inline e entrada de fonemas IPA; os do Eleven v3 não documentam nenhum dos dois em sua página de modelo.
• Latência, declarada pelo fornecedor — Eleven v3 Conversational cerca de 280 ms; Eleven v4 Turbo cerca de 150 ms de mediana até a primeira fala. Níveis diferentes, testes diferentes.
• Clones de voz — inalterados. Os clones instantâneos e profissionais existentes são mantidos.
• Níveis de plano — inalterados. Gratuito 10.000 caracteres, Starter $6, Creator $22, Pro $99, Scale $299, Business $990.
• Caminho de migração — Eleven v4 e Eleven v4 Turbo já estão disponíveis na API e nas superfícies de agente e criação; os identificadores Turbo mais antigos estão obsoletos.
Leia a linha de preço duas vezes. O fato incomum deste lançamento é que o novo modelo é mais barato do que aquele que ele substitui, no mesmo quadro de preços, pelo preço de tabela, sem promoção aplicada — US$ 80 por milhão contra US$ 100. A tarifa promocional amplia essa diferença, em vez de criá-la. Uma migração que aumenta a qualidade em 150 Elo e reduz o custo por caractere não é a troca que a maioria das equipes espera fazer.
Lista de verificação de migração, na ordem que importa
Mova o caminho da qualidade de áudio primeiro, porque é aí que está o ganho e onde uma regressão seria óbvia para os seus usuários antes de ser óbvia para você.
• Audicione as vozes que você realmente entrega. Provider Voice é uma média sobre um conjunto de vozes de arena; a voz da sua marca não está nele. A diferença de 150 pontos é um motivo para audicionar, não um substituto para isso, e a diferença de 84 pontos do painel de vozes clonadas é a estimativa mais próxima do que um produto baseado em clone vai transmitir.
• Verifique novamente seus orçamentos de caracteres. O limite de 10.000 caracteres duplica o da v3, então scripts que você dividia antes podem agora caber em uma única requisição. Isso muda as contagens de requisições, a lógica de novas tentativas e a qualidade das emendas da saída montada — e é a mudança com maior probabilidade de quebrar código que assumia um limite de 5.000.
• Teste a emenda. A ElevenLabs documenta especificamente uma costura de requisições mais confiável na v4. Se você estava dividindo conteúdo de formato longo na v3, execute novamente o mesmo conteúdo na v4 em uma única chamada e compare, em vez de presumir que a divisão ainda é necessária.
• Teste novamente seus casos de pronúncia com o novo suporte a fonemas. Léxicos criados para a v3 devem ser revalidados em vez de considerados confiáveis; um tratamento aprimorado de IPA pode fazer com que uma substituição antes correta agora interaja de forma diferente com a estimativa do próprio modelo.
• Não mexa na sua biblioteca de clones. Os clones permanecem; não é necessário reenviar, e reclonar pode fazer você perder uma voz que seus usuários reconhecem.
• Mantenha o v3 Conversational onde você o usa, por enquanto. Ele é uma camada conversacional, e não um modelo de síntese, ainda está documentado em cerca de 280 ms, e não tem equivalente v4 publicado. Se o seu agente depende dele, o v4 não é um substituto equivalente para essa posição — o v4 Turbo é o rótulo v4 de menor latência, e sua faixa de latência é declarada de forma diferente.

O que realmente melhora, e o que não
Os ganhos concentram-se em três pontos. A amplitude emocional e o ritmo vêm em primeiro lugar — é isso que o painel Provider Voice está a medir, e é também o que o anúncio do próprio fornecedor enfatiza, a par da afirmação de que comparações cegas preferiram o v4 em cerca de três quartos dos casos. Trate esse número como declarado pelo fornecedor e não reproduzido; os painéis da arena são a metade independente da mesma história e concordam quanto à direção.

O diálogo com vários falantes e identidade de falante estável é o segundo. Se você já lançou conteúdo de dois falantes na v3 e dedicou esforço para corrigir vazamento ou desvio de falante ao longo de um roteiro longo, essa é uma carga de trabalho em que a melhoria é estrutural, e não cosmética, e que o número Elo só captura parcialmente.
Diretivas de entrega inline são a terceira — escrever um suspiro ou um sussurro diretamente no roteiro. No v3, isso significava uma segunda tomada, um prompt upstream ou pós-processamento. No v4 Turbo, é uma linha no texto que você já tem.
O que não melhora é a parte que as equipes costumam presumir que melhora com um novo carro-chefe: a latência. A ElevenLabs não publica nenhum número de latência para o próprio Eleven v4, apenas para o v4 Turbo, com cerca de 100 ms de inferência mediana e aproximadamente 150 ms de tempo mediano até a primeira fala, medidos em setembro de 2026. O nível conversacional do Eleven v3 é citado em torno de 280 ms, mas é um nível diferente fazendo um trabalho diferente. Se sua arquitetura é construída em torno de um orçamento rígido de latência, a posição honesta é que o v4 Turbo é o candidato e você deve medi-lo por conta própria, porque os nomes dos níveis não se mapeiam de forma clara e os números do fornecedor não são comparáveis.
A janela de duas semanas, e o que acontece depois
O preço promocional vigora até 12 de outubro. Até então, o Eleven v4 custa US$ 0,022 por mil caracteres e o Eleven v4 Turbo custa US$ 0,011, em comparação com as tarifas de tabela divulgadas de US$ 0,08 e US$ 0,04, respectivamente. Após esse período, o v4 volta a exatamente o que o v3 custa hoje — US$ 0,08 — e o v4 Turbo volta à metade da tarifa do v3.
Um mês de trabalho com cinco milhões de caracteres: o v3 custa $400. O v4 durante a janela custa $110 e depois custa $400 novamente. O v4 Turbo custa $55 durante a janela e $200 depois. Portanto, pode-se argumentar que a migração interessante é a do Turbo, porque é a única opção nesta tabela de preços que permanece mais barata do que o v3 depois que a promoção termina, e o suporte a tags de áudio de que o v3 carece está aí.
O movimento prático é fazer o trabalho de qualidade agora, enquanto o preço é um bônus, e tomar a decisão de precificação com base nos números posteriores a 12 de outubro. Qualquer comparação que cite US$ 22 por milhão para o Eleven v4 sem um prazo associado está descrevendo uma tarifa que expira em duas semanas.
Preparar a mudança por etapas sem apostar o lançamento nela
O OrcaRouter não hospeda a ElevenLabs, então não há nada nesta migração que possamos mover para você — a mudança acontece na sua conta da ElevenLabs. O que nós fazemos é cuidar da camada em torno de uma stack que não é de fornecedor único. Se o seu fluxo de fala for um entre vários modelos por trás de um único endpoint, nós disponibilizamos mais de 200 modelos por meio de uma única chave de API, com os preços de tabela dos provedores repassados com 0% de markup, o que significa que um reajuste de preços de um fornecedor — como este — chega do nosso lado no mesmo dia em que chega do lado deles, sem um segundo contrato ou uma alteração de integração.
Quando o caminho de voz é voltado ao cliente e não pode sofrer queda, o failover automático contorna um upstream degradado em vez de fazer a chamada falhar. Esse é o formato que uma migração como esta deve ter: executar o v4 atrás do mesmo endpoint da solução atual, mover uma fatia do tráfego e deixar a camada de roteamento manter o fallback enquanto você descobre se os 150 pontos de Elo aparecem no seu próprio áudio.
A decisão, em um parágrafo
Migre se um ouvinte ouvir sua saída e você ainda estiver na v3 — a diferença de qualidade é o maior salto de uma única geração que a ElevenLabs já publicou nesses fóruns, o limite de caracteres dobra, a lista de idiomas dobra e o preço de tabela é menor. Faça a migração em etapas, comece pela sua voz com mais tráfego, e não pelo seu script mais complexo, e planeje seu orçamento com base nos números de 12 de outubro, e não nos desta semana. Fique na v3 apenas se sua integração não conseguir absorver um limite de entrada diferente, ou se o v3 Conversational for essencial em um agente e você ainda não tiver medido o v4 Turbo em relação ao seu próprio orçamento de latência. Esses são os dois casos em que a paciência custa menos do que uma troca apressada.
