
Eleven v4 vs il resto di ElevenLabs: dovresti migrare da Eleven v3?
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 982 tok/s
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 195 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
Se sei già su ElevenLabs Eleven v3, la risposta è sì per tutto ciò che un ascoltatore sente e no per le due cose che ElevenLabs ha mantenuto invariate. ElevenLabs Eleven v4 guadagna 150 punti Elo rispetto al suo predecessore su Provider Voice Arena di Artificial Analysis — 1.319 contro 1.169 — e 84 punti sulla classifica Controlled Voice, dove le stesse otto voci clonate vengono usate per tutti. Porta inoltre un limite di caratteri doppio rispetto a v3 e una copertura linguistica all'incirca doppia. Ciò che non cambia è il tuo contratto, le tue voci clonate o la struttura a livelli in base alla quale vieni fatturato, motivo per cui questa migrazione è più economica di molte altre e vale comunque la pena farla in modo graduale anziché tutta in una volta.

Il tabellone dei punteggi intrafamiliare
Questa non è una comparazione tra fornitori, quindi la normalizzazione dei prezzi sulle board dell'arena si comporta diversamente dal solito: entrambi i modelli fatturano per carattere, sullo stesso listino, dallo stesso account. I punti di forza e di debolezza di seguito sono misurati rispetto a modelli fratelli anziché a concorrenti.
• Provider Voice Arena — ElevenLabs Eleven v4 al 1º posto, Elo 1.319 vs ElevenLabs Eleven v3 al 18º posto, Elo 1.169. Un divario di 150 punti.
• Controlled Voice Arena, voci clonate appaiate — Eleven v4 al 2º posto, Elo 1.157 contro Eleven v3 al 7º posto, Elo 1.073. Un divario di 84 punti.
• Normalizzazione dei prezzi di Arena — Eleven v4 80,00 $ per milione di caratteri contro Eleven v3 100,00 $. Il nuovo flagship è il più economico dei due in classifica.
• Tariffario del fornitore — Eleven v4 $0,022 per mille caratteri in promozione, $0,08 dopo il 12 ottobre; Eleven v3 $0,08. Identici a listino, metà prezzo durante la finestra.
• Limite di input per richiesta — Eleven v4 10.000 caratteri vs Eleven v3 5.000. Esattamente il doppio.
• Copertura linguistica — Eleven v4 oltre 90 vs Eleven v3 oltre 70.
• Direttive di resa — Eleven v4 documenta tag audio inline e input di fonemi IPA; Eleven v3 non documenta nessuno dei due nella sua pagina del modello.
• Latenza, dichiarata dal fornitore — Eleven v3 Conversational circa 280 ms; Eleven v4 Turbo circa 150 ms come mediana al primo parlato. Livelli diversi, test diversi.
• Cloni vocali — invariati. I cloni istantanei e professionali esistenti vengono mantenuti.
• Livelli dei piani — invariati. Free 10.000 caratteri, Starter 6 $, Creator 22 $, Pro 99 $, Scale 299 $, Business 990 $.
• Percorso di migrazione — Eleven v4 ed Eleven v4 Turbo sono entrambi attivi nell'API, nelle superfici agent e creative; i vecchi identificatori Turbo sono deprecati.
Leggi due volte la riga dei prezzi. Il fatto insolito di questo lancio è che il nuovo modello costa meno di quello che sostituisce, sullo stesso tabellone, a prezzo di listino, senza promozioni applicate — 80 $ per milione contro 100 $. La tariffa promozionale amplia quel divario anziché crearlo. Una migrazione che aumenta la qualità di 150 Elo e riduce il costo per carattere non è il compromesso che la maggior parte dei team si aspetta di fare.
Checklist di migrazione, nell'ordine che conta
Sposta per primo il percorso della qualità audio, perché è lì che si trova il guadagno e dove una regressione sarebbe evidente ai tuoi utenti prima di esserlo a te.
• Provate le voci che effettivamente rilasciate. Provider Voice è una media su un set di voci dell'arena; la vostra voce di marca non ne fa parte. Il divario di 150 punti è un motivo per fare una prova, non un sostituto della prova, e il divario di 84 punti della classifica delle voci clonate è la stima più vicina a ciò che si percepirà con un prodotto basato su cloni.
• Ricontrolla i tuoi budget di caratteri. Il limite di 10.000 caratteri raddoppia quello di v3, quindi gli script che prima suddividevi ora potrebbero stare in una sola richiesta. Questo cambia il numero di richieste, la logica di retry e la qualità delle giunzioni dell'output ricucito — ed è il cambiamento che più probabilmente romperà il codice che dava per scontato un limite di 5.000.
• Testa la giuntura. ElevenLabs documenta specificamente uno stitching delle richieste più affidabile nella v4. Se suddividevi contenuti long-form con la v3, rielabora gli stessi contenuti con la v4 in un'unica chiamata e confronta, invece di dare per scontato che la suddivisione sia ancora necessaria.
• Riesegui il test dei tuoi casi di pronuncia con il nuovo supporto per i fonemi. I lessici creati per v3 dovrebbero essere rivalidati anziché considerati affidabili; una gestione migliorata dell'IPA può significare che un override precedentemente corretto ora interagisce diversamente con l'ipotesi del modello stesso.
• Lascia in pace la tua libreria di cloni. I cloni vengono trasferiti; non serve ricaricarli e rifare la clonazione rischia di far perdere una voce che i tuoi utenti riconoscono.
• Mantieni v3 Conversational dove lo usi, per ora. È un livello conversazionale piuttosto che un modello di sintesi, è ancora documentato a circa 280 ms, e non ha un equivalente v4 pubblicato. Se il tuo agente dipende da esso, v4 non è una sostituzione equivalente per quello slot — v4 Turbo è l'etichetta v4 a latenza inferiore, e la sua fascia di latenza è indicata diversamente.

Cosa migliora davvero, e cosa no
I miglioramenti si concentrano in tre punti. La gamma emotiva e il ritmo sono il primo — è ciò che misura la classifica Provider Voice, ed è anche ciò che sottolinea l'annuncio del fornitore stesso, insieme all'affermazione che confronti alla cieca hanno preferito v4 in circa tre quarti dei casi. Considera quel dato come dichiarato dal fornitore e non replicato; le classifiche dell'arena sono la metà indipendente della stessa storia, e concordano sulla direzione.

Il dialogo multi-parlante con identità stabile dei parlanti è il secondo. Se hai pubblicato contenuti a due voci su v3 e hai speso sforzi per correggere la tracimazione o la deriva dei parlanti lungo un lungo copione, quello è un carico di lavoro in cui il miglioramento è strutturale anziché cosmetico, ed è un carico che il numero Elo cattura solo parzialmente.
Le direttive di resa inline sono la terza — scrivere un sospiro o un sussurro direttamente nel copione. Su v3 significava una seconda take, un prompt a monte o una post-elaborazione. Su v4 Turbo è una riga nel testo che hai già.
Ciò che non migliora è la parte che i team spesso presumono migliori con un nuovo flagship: la latenza. ElevenLabs non pubblica alcun dato di latenza per Eleven v4 stesso, solo per v4 Turbo a circa 100 ms di inferenza mediana e circa 150 ms di tempo mediano al primo parlato, misurati a settembre 2026. Il tier conversazionale di Eleven v3 è indicato intorno ai 280 ms, ma è un tier diverso che svolge un compito diverso. Se la tua architettura è costruita attorno a un budget di latenza rigido, la posizione onesta è che v4 Turbo è il candidato e dovresti misurarlo tu stesso, perché i nomi dei tier non mappano in modo pulito e i numeri del fornitore non sono omogenei.
La finestra di due settimane, e cosa succede dopo
La tariffa promozionale è valida fino al 12 ottobre. Fino ad allora Eleven v4 costa $0,022 per mille caratteri ed Eleven v4 Turbo costa $0,011, rispetto alle tariffe di listino dichiarate di $0,08 e $0,04 rispettivamente. Al termine del periodo promozionale, v4 torna esattamente a quanto costa oggi v3 — $0,08 — e v4 Turbo torna alla metà della tariffa di v3.
Un mese di lavoro a cinque milioni di caratteri: v3 costa 400 $. v4 durante la finestra costa 110 $ e successivamente torna a costare 400 $. v4 Turbo costa 55 $ durante la finestra e 200 $ dopo. Quindi la migrazione interessante è probabilmente quella verso Turbo, perché è l'unica opzione su questo listino che rimane più economica di v3 dopo la fine della promozione, e il supporto ai tag audio che manca a v3 si trova lì.
La mossa pratica è fare ora il lavoro di qualità mentre il prezzo è un bonus, e prendere la decisione sul prezzo in base ai numeri successivi al 12 ottobre. Qualsiasi confronto che citi 22 $ al milione per Eleven v4 senza una scadenza associata descrive una tariffa che scade tra due settimane.
Preparare il passaggio senza far dipendere il rilascio da esso
OrcaRouter non ospita ElevenLabs, quindi non c'è nulla in questa migrazione che possiamo spostare per te — la modifica avviene sul tuo account ElevenLabs. Quello che gestiamo è il livello attorno a uno stack che non è di un singolo fornitore. Se il tuo percorso vocale è uno di diversi modelli dietro un unico endpoint, serviamo oltre 200 modelli tramite una singola chiave API con i prezzi di listino dei fornitori trasferiti allo 0% di markup, il che significa che una variazione di prezzo da parte di un fornitore — come questa — arriva dalla nostra parte lo stesso giorno in cui arriva dalla loro, senza un secondo contratto né una modifica all'integrazione.
Laddove il percorso vocale è rivolto al cliente e non può subire interruzioni, il failover automatico aggira un upstream degradato invece di far fallire la chiamata. Questa è la forma che dovrebbe assumere una migrazione come questa: eseguire v4 dietro lo stesso endpoint della soluzione attuale, spostare una fetta di traffico e lasciare che il livello di routing mantenga il fallback mentre scopri se i 150 punti Elo compaiono nel tuo audio.
La decisione, in un paragrafo.
Migra se un ascoltatore sente il tuo output e sei ancora su v3 — il divario di qualità è il più grande salto di una singola generazione che ElevenLabs abbia pubblicato su questi forum, il limite di caratteri raddoppia, l'elenco delle lingue raddoppia e il prezzo di listino è inferiore. Fai la migrazione per fasi, inizia dalla voce con il maggior traffico invece che dallo script più complesso, e pianifica il budget sui numeri del 12 ottobre invece che su quelli di questa settimana. Resta su v3 solo se la tua integrazione non può assorbire un limite di input diverso, oppure se v3 Conversational è un componente portante in un agente e non hai ancora misurato v4 Turbo rispetto al tuo budget di latenza. Questi sono i due casi in cui la pazienza costa meno di un cambio affrettato.
