
Eleven v4 vs le reste d'ElevenLabs : devriez-vous migrer depuis Eleven v3 ?
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 982 tok/s
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 195 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
Si vous êtes déjà sur ElevenLabs Eleven v3, la réponse est oui pour tout ce qu’un auditeur entend et non pour les deux choses qu’ElevenLabs a gardées inchangées. ElevenLabs Eleven v4 gagne 150 points Elo par rapport à son propre prédécesseur sur Provider Voice Arena d’Artificial Analysis — 1 319 contre 1 169 — et 84 points sur le classement Controlled Voice, où les mêmes huit voix clonées sont utilisées pour tout le monde. Il propose aussi une limite de caractères deux fois supérieure à celle de la v3 et une couverture linguistique environ deux fois plus large. Ce qu’il ne change pas, c’est votre contrat, vos clones vocaux, ou la structure de paliers sur laquelle vous êtes facturé, c’est pourquoi cette migration est moins coûteuse que la plupart et mérite quand même d’être faite par étapes plutôt que d’un seul coup.

Le tableau des scores intrafamilial
Il ne s'agit pas d'une comparaison entre fournisseurs, c'est pourquoi la normalisation des prix sur les tableaux de l'arène se comporte différemment de d'habitude : les deux modèles facturent au caractère, sur la même grille tarifaire, depuis le même compte. Les forces et faiblesses ci-dessous sont mesurées par rapport à leurs homologues plutôt qu'à des concurrents.
• Provider Voice Arena — ElevenLabs Eleven v4 classé 1er, Elo 1 319 contre ElevenLabs Eleven v3 classé 18e, Elo 1 169. Un écart de 150 points.
• Controlled Voice Arena, voix clonées appariées — Eleven v4 au 2e rang, Elo 1 157 contre Eleven v3 au 7e rang, Elo 1 073. Un écart de 84 points.
• Normalisation des prix de l'Arena — Eleven v4 80,00 $ par million de caractères contre Eleven v3 100,00 $. Le nouveau fleuron est le moins cher des deux au classement.
• Grille tarifaire du fournisseur — Eleven v4 : 0,022 $ par millier de caractères en promotion, 0,08 $ après le 12 octobre ; Eleven v3 : 0,08 $. Identiques au prix catalogue, à moitié prix pendant la fenêtre.
• Limite d’entrée par requête — Eleven v4 10 000 caractères contre Eleven v3 5 000. Exactement le double.
• Couverture linguistique — Eleven v4 plus de 90 vs Eleven v3 plus de 70.
• Directives de livraison — Eleven v4 documente les balises audio intégrées et la saisie de phonèmes IPA ; Eleven v3 ne documente ni l’une ni l’autre sur sa page de modèle.
• Latence, annoncée par le fournisseur — Eleven v3 Conversational environ 280 ms ; Eleven v4 Turbo environ 150 ms en médiane jusqu’à la première parole. Des niveaux différents, des tests différents.
• Clones vocaux — inchangés. Les clones instantanés et professionnels existants sont conservés.
Niveaux de forfait — inchangés. Free : 10 000 caractères, Starter : 6 $, Creator : 22 $, Pro : 99 $, Scale : 299 $, Business : 990 $.
• Parcours de migration — Eleven v4 et Eleven v4 Turbo sont tous deux actifs dans l'API et les surfaces agent et créative ; les anciens identifiants Turbo sont obsolètes.
Lisez la ligne de prix deux fois. Le fait inhabituel de ce lancement est que le nouveau modèle est moins cher que celui qu'il remplace, sur la même grille, au tarif catalogue, sans promotion appliquée — 80 $ par million contre 100 $. Le tarif promotionnel élargit cet écart plutôt que de le créer. Une migration qui augmente la qualité de 150 Elo et réduit le coût par caractère n'est pas le compromis que la plupart des équipes s'attendent à faire.
Liste de contrôle de migration, dans l'ordre qui compte
Déplacez d’abord le chemin de qualité audio, car c’est là que se trouve le gain et où une régression serait évidente pour vos utilisateurs avant de l’être pour vous.
• Auditionnez les voix que vous déployez réellement. Provider Voice est une moyenne sur un ensemble de voix d’arène ; votre voix de marque n’en fait pas partie. L’écart de 150 points est une raison de faire une audition, pas un substitut à celle-ci, et l’écart de 84 points du tableau des voix clonées est l’estimation la plus proche de ce que l’on ressentira avec un produit basé sur le clonage.
• Revérifiez vos budgets de caractères. Le plafond de 10 000 caractères double celui de la v3, donc des scripts que vous divisiez auparavant peuvent désormais tenir dans une seule requête. Cela modifie le nombre de requêtes, la logique de réessai et la qualité des jointures du résultat assemblé — et c’est le changement le plus susceptible de casser du code qui supposait un plafond de 5 000.
• Testez la jointure. ElevenLabs documente spécifiquement un assemblage des requêtes plus fiable dans la v4. Si vous découpiez du contenu long format avec la v3, relancez le même contenu via la v4 en un seul appel et comparez, plutôt que de supposer que le découpage est toujours nécessaire.
• Re-testez vos cas de prononciation avec le nouveau support des phonèmes. Les lexiques conçus pour la v3 doivent être revalidés plutôt que considérés comme fiables ; une meilleure prise en charge de l'IPA peut faire qu'une substitution auparavant correcte interagit désormais différemment avec l'estimation du modèle lui-même.
• Laissez votre bibliothèque de clones telle quelle. Les clones sont conservés ; il n'est pas nécessaire de les recharger et un nouveau clonage risque de vous faire perdre une voix que vos utilisateurs reconnaissent.
• Pour l’instant, continuez d’utiliser v3 Conversational là où vous l’utilisez. Il s’agit d’un palier conversationnel plutôt que d’un modèle de synthèse, il est toujours documenté à environ 280 ms, et il n’a pas d’équivalent v4 publié. Si votre agent en dépend, v4 n’est pas un remplacement à l’identique pour ce créneau — v4 Turbo est l’étiquette v4 à plus faible latence, et son palier de latence est indiqué différemment.

Ce qui s’améliore réellement, et ce qui ne s’améliore pas
Les gains se concentrent à trois endroits. L’étendue émotionnelle et le rythme sont les premiers — c’est ce que mesure le tableau Provider Voice, et c’est aussi ce que met en avant l’annonce du fournisseur lui-même, accompagnée de l’affirmation selon laquelle des comparaisons à l’aveugle ont préféré v4 dans environ trois quarts des cas. Considérez ce chiffre comme déclaré par le fournisseur et non reproduit ; les tableaux de l’arène constituent la moitié indépendante de la même histoire, et ils concordent sur la direction.

Le dialogue multi-interlocuteurs avec une identité de locuteur stable arrive en deuxième. Si vous avez livré du contenu à deux voix sur v3 et consacré des efforts à corriger la contamination ou la dérive de locuteur sur un long script, il s'agit d'une charge de travail où l'amélioration est structurelle plutôt que cosmétique, et c'est une charge de travail que le chiffre Elo ne capture que partiellement.
Les directives de jeu intégrées sont la troisième — écrire un soupir ou un murmure directement dans le script. Sur v3, cela signifiait une seconde prise, un prompt en amont ou un post-traitement. Sur v4 Turbo, c'est une ligne dans le texte que vous avez déjà.
Ce qui ne s'améliore pas, c'est la partie que les équipes supposent souvent s'améliorer avec un nouveau modèle phare : la latence. ElevenLabs ne publie aucun chiffre de latence pour Eleven v4 lui-même, seulement pour v4 Turbo, à environ 100 ms d'inférence médiane et environ 150 ms de délai médian avant la première parole, mesurés en septembre 2026. Le palier conversationnel d'Eleven v3 est annoncé autour de 280 ms, mais il s'agit d'un palier différent qui fait un travail différent. Si votre architecture est construite autour d'un budget de latence strict, la position honnête est que v4 Turbo est le candidat et que vous devez le mesurer vous-même, car les noms de paliers ne correspondent pas clairement et les chiffres du fournisseur ne sont pas comparables.
La fenêtre de deux semaines, et ce qui se passe ensuite
La tarification promotionnelle est en vigueur jusqu'au 12 octobre. D'ici là, Eleven v4 est à 0,022 $ les mille caractères et Eleven v4 Turbo à 0,011 $, contre des tarifs catalogue annoncés de 0,08 $ et 0,04 $ respectivement. Passé ce délai, v4 revient exactement au prix de v3 aujourd'hui — 0,08 $ — et v4 Turbo revient à la moitié du tarif de v3.
Un mois de travail à cinq millions de caractères : v3 coûte 400 $. v4 pendant la fenêtre coûte 110 $ et, ensuite, coûte de nouveau 400 $. v4 Turbo coûte 55 $ pendant la fenêtre et 200 $ ensuite. La migration intéressante est donc sans doute celle vers Turbo, car c'est la seule option de cette grille tarifaire qui reste moins chère que v3 une fois la promotion terminée, et c'est là que se trouve la prise en charge des balises audio qui manque à v3.
La démarche pragmatique consiste à faire le travail de qualité dès maintenant, le prix n’étant qu’un bonus, et à prendre la décision tarifaire sur la base des chiffres d’après le 12 octobre. Toute comparaison qui cite 22 $ par million pour Eleven v4 sans date limite associée décrit un tarif qui expire dans quinze jours.
Préparer le basculement sans faire dépendre la publication de celui-ci.
OrcaRouter n'héberge pas ElevenLabs, donc il n'y a rien dans cette migration que nous puissions déplacer pour vous — le changement s'opère sur votre compte ElevenLabs. Ce que nous gérons, c'est la couche autour d'une stack qui n'est pas mono-fournisseur. Si votre chaîne vocale fait partie de plusieurs modèles derrière un seul endpoint, nous servons plus de 200 modèles via une seule clé API, avec les prix catalogue des fournisseurs répercutés à 0 % de marge, ce qui signifie qu'une révision tarifaire d'un fournisseur — comme celle-ci — se répercute de notre côté le jour même où elle se répercute chez eux, sans second contrat ni modification de l'intégration.
Là où le chemin vocal est exposé au client et ne peut pas être interrompu, le basculement automatique contourne un amont dégradé au lieu de faire échouer l’appel. Voilà la forme que devrait prendre une migration comme celle-ci : exécuter v4 derrière le même point de terminaison que la solution en place, déplacer une partie du trafic et laisser la couche de routage assurer le repli pendant que vous vérifiez si les 150 points Elo se manifestent dans votre propre audio.
La décision, en un paragraphe.
Migrez si un auditeur entend votre sortie et que vous êtes encore sur v3 — l'écart de qualité est le plus grand bond d'une génération à l'autre qu'ElevenLabs ait publié sur ces forums, le plafond de caractères double, la liste des langues double, et le prix catalogue est plus bas. Faites la migration par étapes, commencez par votre voix au trafic le plus élevé plutôt que par votre script le plus complexe, et planifiez votre budget sur les chiffres du 12 octobre plutôt que sur ceux de cette semaine. Ne restez sur v3 que si votre intégration ne peut pas absorber un plafond d'entrée différent, ou si v3 Conversational est porteur dans un agent et que vous n'avez pas encore mesuré v4 Turbo par rapport à votre propre budget de latence. Ce sont les deux cas où la patience coûte moins cher qu'une bascule précipitée.
