
Eleven v4 frente al resto de ElevenLabs: ¿Deberías migrar desde Eleven v3?
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 982 tok/s
- openaiNUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- openaiNUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- anthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- grokNUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 195 tok/s
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
Si ya estás en ElevenLabs Eleven v3, la respuesta es sí para todo lo que un oyente escucha y no para las dos cosas que ElevenLabs mantuvo sin cambios. ElevenLabs Eleven v4 gana 150 puntos Elo sobre su propio predecesor en el Provider Voice Arena de Artificial Analysis —1.319 frente a 1.169— y 84 puntos en el panel Controlled Voice, donde se usan las mismas ocho voces clonadas para todos. También tiene un límite de caracteres del doble que la v3 y aproximadamente el doble de cobertura de idiomas. Lo que no cambia es tu contrato, tus clones de voz ni la estructura de niveles sobre la que se te factura, y por eso esta migración es más barata que la mayoría y aun así vale la pena hacerla por etapas en lugar de toda de una vez.

El marcador intrafamiliar
Esta no es una comparación entre proveedores, así que la normalización de precios en los tableros de la arena se comporta de forma distinta a lo habitual: ambos modelos facturan por carácter, con la misma tarifa, desde la misma cuenta. Las fortalezas y debilidades que aparecen a continuación se miden contra modelos hermanos, no contra competidores.
• Arena de voz de proveedores — ElevenLabs Eleven v4, puesto 1, Elo 1.319 vs. ElevenLabs Eleven v3, puesto 18, Elo 1.169. Una diferencia de 150 puntos.
• Controlled Voice Arena, voces clonadas emparejadas — Eleven v4 puesto 2, Elo 1.157 vs Eleven v3 puesto 7, Elo 1.073. Una diferencia de 84 puntos.
• Normalización de precios de Arena — Eleven v4 $80.00 por millón de caracteres frente a Eleven v3 $100.00. El nuevo modelo insignia es el más barato de los dos en la tabla.
• Tarifa del proveedor — Eleven v4 $0.022 por cada mil caracteres en promoción, $0.08 después del 12 de octubre; Eleven v3 $0.08. Idénticas a precio de lista, a mitad de precio durante el periodo promocional.
• Límite de entrada por solicitud — Eleven v4 10.000 caracteres frente a Eleven v3 5.000. Exactamente el doble.
• Cobertura de idiomas — Eleven v4 más de 90 frente a Eleven v3 más de 70.
• Directivas de locución — Eleven v4 documenta etiquetas de audio insertadas y entrada de fonemas IPA; Eleven v3 no documenta ninguna de las dos cosas en su página de modelo.
• Latencia, según el proveedor — Eleven v3 Conversational, unos 280 ms; Eleven v4 Turbo, unos 150 ms de mediana hasta la primera locución. Diferentes niveles, diferentes pruebas.
• Clones de voz — sin cambios. Los clones instantáneos y profesionales existentes se conservan.
• Niveles de plan — sin cambios. Gratis 10.000 caracteres, Starter $6, Creator $22, Pro $99, Scale $299, Business $990.
• Ruta de migración — Eleven v4 y Eleven v4 Turbo ya están disponibles en la API y en las superficies de agentes y creativas; los identificadores antiguos de Turbo están obsoletos.
Lee la fila de precios dos veces. El hecho inusual de este lanzamiento es que el nuevo modelo es más barato que el que reemplaza, en la misma tabla, a precio de lista, sin promoción aplicada: $80 por millón frente a $100. La tarifa promocional amplía esa diferencia en lugar de crearla. Una migración que aumenta la calidad en 150 Elo y reduce el costo por carácter no es el intercambio que la mayoría de los equipos espera estar haciendo.
Lista de verificación de migración, en el orden que importa
Mueve primero la ruta de calidad de audio, porque ahí es donde está la ganancia y donde una regresión sería obvia para tus usuarios antes de que lo sea para ti.
• Haz una audición de las voces que realmente pones en producción. Provider Voice es un promedio sobre un conjunto de voces de arena; tu voz de marca no está en él. La brecha de 150 puntos es una razón para hacer una audición, no un sustituto de ella, y la brecha de 84 puntos de la tabla de voces clonadas es la estimación más cercana de cómo se sentirá un producto basado en clones.
• Vuelve a revisar tus presupuestos de caracteres. El límite de 10.000 caracteres duplica el de v3, así que los scripts que antes dividías ahora podrían caber en una sola solicitud. Eso cambia los recuentos de solicitudes, la lógica de reintentos y la calidad de las costuras del resultado ensamblado, y es el cambio con más probabilidades de romper código que asumía un límite de 5.000.
• Prueba la unión. ElevenLabs documenta específicamente una unión de solicitudes más fiable en v4. Si dividías contenido de formato largo en v3, vuelve a ejecutar el mismo contenido a través de v4 en una sola llamada y compáralo, en lugar de asumir que la división sigue siendo necesaria.
• Vuelve a probar tus casos de pronunciación con el nuevo soporte de fonemas. Los léxicos creados para la v3 deberían revalidarse en lugar de confiar en ellos; el manejo mejorado de IPA puede significar que una anulación antes correcta ahora interactúe de manera diferente con la conjetura del propio modelo.
• Deja tu biblioteca de clones como está. Los clones se conservan; no hace falta volver a subirlos, y volver a clonar corre el riesgo de perder una voz que tus usuarios reconocen.
• De momento, conserva v3 Conversational donde lo uses. Es un nivel conversacional más que un modelo conversacional, sigue documentado en unos 280 ms y no tiene equivalente en v4. Si dependes de él, v4 no es un sustituto equivalente para esa función: v4 Turbo es la etiqueta de v4 con menor latencia, y su nivel de latencia se expresa de otra manera.

Qué mejora realmente, y qué no
Las mejoras se concentran en tres puntos. El rango emocional y el ritmo son el primero — eso es lo que mide el panel Provider Voice, y también es lo que destaca el propio anuncio del proveedor, junto con la afirmación de que las comparaciones a ciegas prefirieron v4 en aproximadamente tres cuartas partes de los casos. Considera esa cifra como declarada por el proveedor y no reproducida; los paneles de arena son la mitad independiente de la misma historia, y coinciden en la dirección.

El diálogo con múltiples hablantes y una identidad de hablante estable es el segundo. Si has lanzado contenido de dos interlocutores en v3 y has dedicado esfuerzo a corregir el sangrado o la deriva de hablante a lo largo de un guion largo, esa es una carga de trabajo donde la mejora es estructural en lugar de cosmética, y es una que el número Elo solo captura parcialmente.
Las directivas de locución en línea son la tercera: escribir un suspiro o un susurro directamente en el guion. En v3, eso implicaba una segunda toma, un prompt en una etapa anterior o posprocesamiento. En v4 Turbo, es una línea en el texto que ya tienes.
Lo que no mejora es la parte que los equipos suelen asumir que mejora con un nuevo buque insignia: la latencia. ElevenLabs no publica ninguna cifra de latencia para Eleven v4 en sí, solo para v4 Turbo, con una inferencia mediana de aproximadamente 100 ms y un tiempo mediano hasta el primer audio de unos 150 ms, medidos en septiembre de 2026. El nivel conversacional de Eleven v3 se cita en torno a 280 ms, pero es un nivel distinto que desempeña una función distinta. Si tu arquitectura está construida en torno a un presupuesto de latencia estricto, la postura honesta es que v4 Turbo es el candidato y deberías medirlo tú mismo, porque los nombres de los niveles no se corresponden de manera clara y las cifras del proveedor no son comparables en igualdad de condiciones.
La ventana de dos semanas, y lo que sucede después
El precio promocional estará vigente hasta el 12 de octubre. Hasta entonces, Eleven v4 cuesta $0.022 por mil caracteres y Eleven v4 Turbo cuesta $0.011, frente a las tarifas de lista indicadas de $0.08 y $0.04, respectivamente. Después de ese periodo, v4 vuelve exactamente a lo que cuesta v3 hoy —$0.08— y v4 Turbo vuelve a la mitad de la tarifa de v3.
Un mes de ejemplo con cinco millones de caracteres: v3 cuesta $400. v4 durante la ventana cuesta $110 y después vuelve a costar $400. v4 Turbo cuesta $55 durante la ventana y $200 después. Así que la migración interesante es, posiblemente, la de Turbo, porque es la única opción de esta tarifa que sigue siendo más barata que v3 después de que termine la promoción, y allí reside el soporte de audio-tags que v3 no tiene.
La medida práctica es hacer el trabajo de calidad ahora, mientras el precio es un plus, y tomar la decisión de precios con las cifras posteriores al 12 de octubre. Cualquier comparación que cite $22 por millón para Eleven v4 sin una fecha límite adjunta describe una tarifa que vence en dos semanas.
Preparar el cambio por etapas sin jugarse el lanzamiento en ello.
OrcaRouter no aloja ElevenLabs, así que no hay nada en esta migración que podamos mover por ti: el cambio ocurre en tu cuenta de ElevenLabs. Lo que sí gestionamos es la capa que rodea a una infraestructura que no depende de un único proveedor. Si tu ruta de voz es uno de varios modelos detrás de un mismo endpoint, ofrecemos más de 200 modelos a través de una sola clave de API, con los precios de lista del proveedor transferidos con un 0 % de margen, lo que significa que un cambio de precios de un proveedor —como este— llega a nuestro lado el mismo día que llega al suyo, sin un segundo contrato ni un cambio en la integración.
Cuando la ruta de voz está orientada al cliente y no puede caerse, la conmutación por error automática rodea un upstream degradado en lugar de hacer que la llamada falle. Esa es la forma que debería tener una migración como esta: ejecutar v4 detrás del mismo endpoint que el sistema actual, desviar una porción del tráfico y dejar que la capa de enrutamiento mantenga el respaldo mientras compruebas si los 150 puntos Elo aparecen en tu propio audio.
La decisión, en un párrafo.
Migra si un oyente escucha tu salida y tú sigues en v3 — la brecha de calidad es el mayor salto de una sola generación que ElevenLabs ha publicado en estos tableros, el límite de caracteres se duplica, la lista de idiomas se duplica y el precio de lista es más bajo. Haz la migración por etapas, empieza con tu voz de mayor tráfico en lugar de tu guion más complejo, y planifica tu presupuesto con las cifras del 12 de octubre en lugar de las de esta semana. Quédate en v3 solo si tu integración no puede absorber un límite de entrada distinto, o si v3 Conversational es crítico en un agente y aún no has medido v4 Turbo frente a tu propio presupuesto de latencia. Esos son los dos casos en los que la paciencia cuesta menos que un cambio precipitado.
