
Eleven v4 vs Gemini 3.1 Flash TTS: un divario di 116 punti, e il modello Google più economico
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 982 tok/s
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 197 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
Se oggi cerchi la voce di Google, finirai su quella sbagliata. Google Gemini 3.1 Flash TTS è elencato all'11º posto nella Provider Voice Arena di Artificial Analysis con un Elo di 1.203 su 3.512 apparizioni, a 18,31 $ per milione di caratteri. ElevenLabs Eleven v4, pubblicato il 28 settembre 2026, occupa il 1º posto con un Elo di 1.319 su 1.674 apparizioni, a 80,00 $ per milione. Sembra un divario di 116 punti contro uno sfidante più economico — finché non si nota che il Gemini 3.8 Flash TTS di Google è terzo nella stessa classifica con 1.267 e un prezzo normalizzato più basso, 16,49 $. La vera sfida non è quella che il confronto del titolo lascia intendere, e il motivo è una data di pubblicazione.
Uno di questi è diciotto mesi più recente di quanto sembri.
Gemini 3.1 Flash TTS riporta una data di rilascio del 15 aprile 2026 sulla classifica. Eleven v4 riporta il 28 settembre 2026. Si tratta di cinque mesi e mezzo, che non è una generazione nella sintesi vocale, ma è abbastanza lungo perché Google abbia già rilasciato un successore: Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS sono entrambi passati alla disponibilità generale il 23 settembre 2026, cinque giorni prima di Eleven v4, ed entrambi sono classificati al di sopra di 3.1 nella stessa classifica. Gemini 3.8 Flash-Lite TTS si piazza sesto con 1.241 e 11,03 $ per milione.

Quindi il confronto onesto ha tre punti, non due, e l'ordinamento per prezzo è la parte interessante:
• Posizione 1, ElevenLabs Eleven v4 — Elo 1.319, 80,00 $ per milione di caratteri, 1.674 presenze, intervallo ±19
• Posizione 3, Google Gemini 3.8 Flash TTS — Elo 1.267, $16,49 per milione di caratteri, rilasciato il 23 settembre 2026
• 6° posto, Google Gemini 3.8 Flash-Lite TTS — Elo 1.241, $11,03 per milione di caratteri, rilasciato il 23 settembre 2026
• 11º posto, Google Gemini 3.1 Flash TTS — Elo 1.203, 18,31 $ per milione di caratteri, rilasciato il 15 aprile 2026, 3.512 apparizioni, intervallo ±12
Nota l'effetto che gli intervalli hanno su quell'ordinamento. Gemini 3.1 Flash TTS stima 1.203 con un intervallo di ±12, quindi il suo valore reale si colloca all'incirca tra 1.191 e 1.215. Eleven v4 stima 1.319 con un intervallo di ±19 — all'incirca da 1.300 a 1.338. I due intervalli non si toccano, e il divario tra loro è largo più di cento punti. È quanto di più netto si possa ottenere da una classifica di preferenze.

Perché i conteggi campionari contano più dei ranghi
Gemini 3.1 Flash TTS ha 3.512 apparizioni alle spalle della sua stima; Eleven v4 ne ha 1.674, perché su questa classifica ha un giorno di vita. La stima di un modello più recente comporta più incertezza per campione, e l'intervallo ±19 lo riflette. Se siete il tipo di acquirente che aspetta che un numero si assesti, la regola pratica è che l'ordinamento al di sopra dell'ampiezza dell'intervallo è la parte su cui potete agire. Qui la classifica sopravvive comodamente alle sue barre di errore in entrambe le direzioni — davanti a 3.8 Flash TTS e dietro a nessuno in questo confronto.
L'arena conta anche le voci dell'arena: otto per Eleven v4, sette per Gemini 3.1 Flash TTS. È il numero di voci distinte dei fornitori usate nei test in cieco, e rappresenta una rozza approssimazione di quanto ampio sia il cast predefinito che un fornitore mette a disposizione. Il primo posto di Eleven v4 è stato conquistato con otto voci, il che significa che la vittoria non è merito di un singolo narratore fortunato.
Le differenze di capacità che l'Elo non prezza
Le classifiche misurano la preferenza, non la copertura delle funzionalità. Quattro differenze determinano i progetti reali e nessuna di esse compare in un Elo.
• Direzione del copione — Eleven v4 documenta tag audio inline ([laughs], [whispers], [said angrily in French accent]) e prompt di resa in linguaggio naturale; la generazione 3.1 di Google documenta la scelta della voce e il prompting, ma non una sintassi di tag equivalente per la direzione della performance.
• Creazione vocale — la generazione Gemini 3.8 ha aggiunto il voice design da una descrizione scritta e la replica vocale da un campione di 30 secondi, con watermarking e metadati di provenienza sull'output. Gemini 3.1 Flash TTS è precedente e offre un set di voci predefinite.
• Clonazione da audio reale — l'Instant Voice Cloning di Eleven v4 funziona con dieci secondi di audio, con un livello professionale al di sopra. Il percorso di replica di Google nella generazione 3.8 richiede 30 secondi e aggiunge la verifica del consenso. Standard diversi, meccanismi di consenso diversi.
• Limite di input per richiesta — Eleven v4 documenta 10.000 caratteri. Google fattura i suoi modelli TTS in token anziché in caratteri, quindi non esiste un limite di caratteri per richiesta confrontabile su base omogenea, e le due unità di misura non dovrebbero essere poste fianco a fianco come se lo fossero.
Quel ultimo punto è quello che mette in difficoltà i fogli di calcolo del procurement. ElevenLabs indica un prezzo per 1.000 caratteri. Google indica un prezzo per milione di token, in entrata e in uscita. Artificial Analysis normalizza entrambi su un asse per milione di caratteri — è da lì che derivano gli $80,00 e $18,31 — ma la normalizzazione è la conversione del board, non la fattura di nessuno dei due fornitori. Usala per classificare, non per prevedere.

Che effetto ha il listino prezzi di Eleven v4 su questo confronto
Per due settimane il confronto dei prezzi sopra riportato è errato a favore di ElevenLabs, poi è errato a suo sfavore. Nella pagina dei prezzi dell'API di ElevenLabs, Eleven v4 è indicato a $0,022 per 1.000 caratteri contro un prezzo di listino dichiarato di $0,08, con l'indicazione di uno sconto del 72% fino al 12 ottobre. Eleven v4 Turbo è indicato a $0,011 contro $0,04. Dopo il 12 ottobre il numero promozionale scompare e la cifra di $80,00 per milione riportata nella tabella diventa la tariffa che si paga effettivamente.
Fai i calcoli su un mese da cinque milioni di caratteri. Eleven v4 costa $110 durante la finestra e $400 dopo. Gemini 3.1 Flash TTS, alla normalizzazione di $18.31 della board, arriva a circa $92 per lo stesso mese — meno caro della promozione e circa quattro volte meno caro della tariffa di listino. Un team che esegue benchmark a settembre e rilascia a novembre avrà preso la decisione basandosi su una cifra che non esiste più.
Dove il routing è appropriato, e dove non lo è
Nessuno di questi due modelli è nel catalogo OrcaRouter. Qui non c'è alcun endpoint ElevenLabs né alcun endpoint Google TTS da chiamare, e la risposta onesta a «come posso raggiungerli tramite te» è che non li raggiungi: Eleven v4 si raggiunge tramite l'API di ElevenLabs, e Gemini 3.1 Flash TTS tramite quella di Google. Dire qualsiasi altra cosa significherebbe inventare un'integrazione.
Ciò per cui una singola chiave è utile in un confronto come questo è la decisione stessa. Se stai soppesando un endpoint da 400 $ al mese rispetto a uno da 92 $ al mese, la risposta dipende dai tuoi script, dai tuoi linguaggi e dai tuoi listener — e ottenere quella risposta significa chiamare entrambi dallo stesso percorso di codice con la stessa forma di richiesta, anziché predisporre due integrazioni di fornitori per eseguire un singolo test. OrcaRouter copre quel livello: oltre 200 modelli dietro un'unica chiave, con i prezzi di listino dei fornitori trasferiti a 0% di markup, così una variazione di prezzo di un fornitore si riflette il giorno stesso in cui entra in vigore, più failover automatico se un upstream peggiora a metà valutazione.
Chi dovrebbe scegliere cosa
Scegli Eleven v4 quando la voce è il prodotto. È in testa alla classifica con 116 punti di vantaggio e un intervallo più pulito rispetto al modello che segue, è l'unico dei due ad avere una sintassi di tag inline documentata per orientare le prestazioni, e la sua soglia di clonazione è di dieci secondi anziché trenta. Il sovrapprezzo è reale — quattro volte il prezzo normalizzato a listino — e compra la vetta della classifica.
Scegli Gemini 3.1 Flash TTS solo se sei già deciso ad adottarlo. È un modello di generazione preview vecchio di cinque mesi, con un punteggio inferiore e un prezzo normalizzato più alto rispetto alla release di settembre di Google, e l'unico motivo per mantenerlo è l'inerzia in un'integrazione esistente. Se hai questa inerzia, migrare all'interno dello stack Google a 3.8 Flash TTS ti fa guadagnare 64 punti Elo e un prezzo normalizzato più basso senza cambiare fornitore — un caso raro in cui l'upgrade è anche l'opzione più economica.
Per tutti gli altri, la domanda aperta è Eleven v4 contro Gemini 3.8 Flash TTS, e la risposta è un vero trade-off più che una classifica: 52 punti Elo e la sintassi dei tag a fronte di circa un quinto del costo per carattere. Esegui entrambi sugli stessi script dopo il 12 ottobre, quando la promozione ElevenLabs non ci sarà più e il divario di prezzo sarà quello che pagherai effettivamente.
