『ElevenLabs Eleven v4 vs ElevenLabs Eleven v3』のヒーローカード。2枚のカードを縦に重ねて構成:ElevenLabs Eleven v4 は Elo 1,319、1位、100万文字あたり $80.00。ElevenLabs Eleven v3 は Elo 1,169、18位、100万文字あたり $100.00。キャプションは「同じ料金表、Elo差は150」。フッター:「Provider Voice Arena、Artificial Analysis 調べ、2026年9月」。OrcaRouter のロゴは右下に配置。
Guides & Insights

Eleven v4 対 ElevenLabs のその他:Eleven v3 から移行すべきか?

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

をすでに利用しているならElevenLabs Eleven v3、リスナーが耳にするものすべてについては「はい」、ElevenLabsが据え置いた2つのことについては「いいえ」が答えです。ElevenLabs Eleven v4は、Artificial AnalysisのProvider Voice Arenaで自身の前身より150 Eloポイント上回り(1,319対1,169)、同じ8つのクローン音声を全員に使うControlled Voiceボードでも84ポイント上回ります。また、文字数制限はv3の2倍で、言語カバレッジもほぼ2倍です。変わらないのは、契約、音声クローン、そして請求の基準となる階層構造であり、だからこそこの移行はほとんどの移行より安く済み、それでも一度にすべてではなく段階的に行う価値があります。

A two-column scoreboard for ElevenLabs Eleven v4 and ElevenLabs Eleven v3. Eleven v4: Provider Voice rank 1 Elo 1,319; Controlled Voice rank 2 Elo 1,157; $80.00 per 1M chars; $0.022 per 1K until Oct 12; 10,000-character cap; 90-plus languages. Eleven v3: Provider Voice rank 18 Elo 1,169; Controlled Voice rank 7 Elo 1,073; $100.00 per 1M chars; $0.08 per 1K; 5,000-character cap; 70-plus languages. Footer: 'Elo and board prices per Artificial Analysis; rate card and caps vendor-documented.'

家族内のスコアボード

これはベンダー同士の比較ではないため、アリーナボード上での価格正規化は通常とは異なる挙動をします。両モデルとも同じ料金表に基づき、同じアカウントから文字単位で課金されます。以下に挙げる強みと弱みは、競合他社ではなく兄弟モデルと比較して評価したものです。

• Provider Voice Arena — ElevenLabs Eleven v4 は1位、Elo 1,319 対 ElevenLabs Eleven v3 は18位、Elo 1,169。150ポイント差。

• Controlled Voice Arena、マッチさせたクローン音声 — Eleven v4はランク2、Elo 1,157対Eleven v3はランク7、Elo 1,073。84ポイントの差。

• Arena価格の正規化 — Eleven v4 は100万文字あたり$80.00、Eleven v3 は$100.00。新しいフラッグシップは、ボード上で2つのうち安い方です。

• ベンダー料金表 — Eleven v4 は1,000文字あたり0.022ドル(プロモーション)、10月12日以降は0.08ドル。Eleven v3 は0.08ドル。定価では同一で、プロモーション期間中は半額。

• リクエストあたりの入力上限 — Eleven v4 は10,000文字、Eleven v3 は5,000文字。ちょうど2倍です。

• 言語対応 — Eleven v4 は90以上、Eleven v3 は70以上。

• デリバリーディレクティブ — Eleven v4 はインライン音声タグと IPA 音素入力を記載しています;Eleven v3 のモデルページにはどちらも記載されていません。

• レイテンシー、ベンダー公称値 — Eleven v3 Conversational は約 280 ms、Eleven v4 Turbo は最初の発話までの中央値が約 150 ms。異なるティア、異なるテスト。

• 音声クローン — 変更なし。既存のインスタントクローンとプロフェッショナルクローンはそのまま引き継がれます。

• プラン構成 — 変更なし。Free 10,000文字、Standard $6、Creator $22、Pro $99、Scale $299。

• 移行パス — Eleven v4 と Eleven v4 Turbo はどちらも API、エージェント、クリエイティブの各サーフェスで利用可能です。旧 Turbo 識別子は非推奨となっています。

価格の行を二度読んでほしい。このローンチで異例なのは、新しいモデルが、同じ料金表で、定価で、プロモーションも適用されずに、それが置き換えるモデルより安いことだ——100万あたり80ドル対100ドル。プロモーション価格はその差を生み出しているのではなく、むしろ広げている。品質を150 Elo高め、文字あたりのコストを下げる移行は、ほとんどのチームが想定しているトレードオフではない。

移行チェックリスト、重要な順に

まず音声品質のパスを先に移してください。そこにこそ利得があり、リグレッションはあなたにとって明らかになるより先に、ユーザーにとって明らかになる場所だからです。

• 実際に出荷する音声を試聴してください。Provider Voice はアリーナ音声セット全体の平均であり、あなたのブランドボイスはそこに含まれていません。150ポイントの差は試聴する理由であって、その代わりにはなりません。また、クローン音声リーダーボードの84ポイント差のほうが、クローンベースの製品がどんな感触になるかをより近く推定したものです。

• 文字数上限を再確認してください。10,000 文字の上限は v3 の2倍なので、分割したスクリプトが1回のリクエストに収まる場合があります。これにより、リクエスト数、再試行ロジック、結合された出力の継ぎ目の品質が変わります。また、5,000 文字の上限を前提としていたコードを壊す可能性が最も高い変更でもあります。

• 継ぎ目をテストする。ElevenLabsは特にv4において、より信頼性の高いリクエストスティッチングについて文書化しています。v3で長文コンテンツを分割していたなら、分割が依然として必要だと決めつけるのではなく、同じコンテンツをv4で1回の呼び出しで再実行して比較してください。

• 新しい音素サポートを使って、発音のケースを再テストしてください。v3向けに構築されたレキシコンは信頼するのではなく再検証すべきです。IPAの扱いが改善されたことで、以前は正しかった上書きが、モデル自身の推測と異なる形で相互作用する可能性があります。

• クローンライブラリはそのままにしておいてください。クローンは保持されます。再アップロードは不要で、再クローン作成はユーザーが認識している声を失うリスクがあります。

• 今のところ、v3 Conversational は使用している箇所でそのまま使ってください。これは合成モデルではなく会話用のティアであり、依然として約 280 ms と記載されていて、公開されている v4 の同等品はありません。エージェントがこれに依存している場合、v4 はその枠に対する同等の代替品ではありません — v4 Turbo は低レイテンシの v4 ラベルで、そのレイテンシ階層は異なる形で示されています。

A screenshot of ElevenLabs' model documentation, captured in English, listing the text-to-speech cards: Eleven v4 with exceptional voice cloning, 90+ languages supported, a 10,000 character limit and support for natural multi-speaker dialogue; Eleven v4 Turbo with ultra-low latency near 100 ms median inference and audio tags for fine-grained control; Eleven v3 with 70+ languages and a 5,000 character limit; and Eleven v3 Conversational, Eleven Multilingual v2 and Eleven Flash v2.5 below them.

実際に何が良くなり、何が良くならないのか

改善分は三つの領域に集中している。第一は感情の幅とテンポだ。それはProvider Voiceボードが測定しているものであり、ベンダー自身の発表が強調しているものでもあり、さらにブラインド比較で約4分の3のケースでv4が好まれたという主張も伴っている。この数値はベンダーが述べたもので再現されていないものとして扱え。アリーナボードは同じ話の独立した半面であり、方向性については一致している。

A screenshot of the Artificial Analysis Controlled Voice Arena leaderboard, captured in English, showing Alibaba Qwen-Audio-3.1-TTS-Plus first at Elo 1,178, ElevenLabs Eleven v4 second at Elo 1,157, Cartesia Sonic 3.6 fourth at Elo 1,138 and ElevenLabs Eleven v3 seventh at Elo 1,073 on the board where the same eight cloned voices are used for every entrant.

安定した話者アイデンティティを保つマルチスピーカー対話が2番目です。v3で2話者コンテンツをリリースし、長い台本にわたる話者の混入やドリフトの修正に労力を費やした経験があるなら、それは改善が見た目ではなく構造的なものとなるワークロードであり、Eloの数値が部分的にしか捉えていないものです。

インラインのデリバリー指示は3つ目です — ため息やささやきを台本に直接書き込むこと。v3では、それは別テイク、上流のプロンプト、または後処理を意味していました。v4 Turboでは、すでに手元にあるテキストの一行です。

改善しないのは、新しいフラッグシップで良くなるとチームがしばしば思い込む部分、つまりレイテンシーだ。ElevenLabs は Eleven v4 自体についてはレイテンシーの数値を公表しておらず、v4 Turbo についてのみ、2026年9月測定で、中央値で推論約100 ms、最初の音声までの中央値約150 msとしている。Eleven v3 の会話ティアは約280 msと引用されているが、これは別のティアで別の役割を担っている。あなたのアーキテクチャが厳しいレイテンシー予算を前提に組まれているなら、正直なところ、候補は v4 Turbo であり、自分で測定すべきだ。なぜなら、ティア名はきれいに対応せず、ベンダーの数値は同一条件の比較にはならないからだ。

2週間の猶予期間、そしてその後に起こること

プロモーション価格は10月12日まで適用されます。それまでは、Eleven v4 は1,000文字あたり0.022ドル、Eleven v4 Turbo は0.011ドルで、公表されている定価はそれぞれ0.08ドルと0.04ドルです。期間終了後、v4 は現在の v3 と同じ料金、すなわち0.08ドルに戻り、v4 Turbo は v3 の半額に戻ります。

500万文字での1か月の実稼働分だと、v3は400ドルです。v4はキャンペーン期間中は110ドル、終了後は再び400ドルです。v4 Turboは期間中55ドル、終了後は200ドルです。つまり、興味深い移行先はおそらくTurboです。この料金表でプロモーション終了後もv3より安いままでいられる唯一の選択肢であり、v3に欠けているオーディオタグ対応がそこにあるからです。

実務的な動きは、今のうちに品質の仕事を進めて、価格はボーナスとして扱い、価格の決定は10月12日以降の数字に基づいて行うことだ。Eleven v4について期限を添えずに100万あたり22ドルと引用する比較は、2週間で失効する料率を説明しているにすぎない。

リリースをそれに賭けることなく、切り替えを段階的に導入する

OrcaRouterはElevenLabsをホストしていないため、この移行で弊社がお客様に代わって移せるものは何もありません——変更はお客様のElevenLabsアカウント側で行われます。弊社が担うのは、単一ベンダーではないスタックを囲むレイヤーです。お客様の音声パスが1つのエンドポイントの背後にある複数モデルのうちの1つであるなら、弊社は単一のAPIキーを通じて200以上のモデルを提供し、プロバイダーの定価を0%のマークアップでそのまま反映します。つまり、今回のようなベンダーの価格改定は、2つ目の契約や統合の変更なしに、ベンダー側と同じ日に弊社側にも反映されるということです。

音声経路が顧客接点であり、切断が許されない場合、自動フェイルオーバーが、通話を失敗させるのではなく、劣化した上流を迂回します。これが、このような移行が取るべき形です。すなわち、既存のものと同じエンドポイントの背後で v4 を稼働させ、トラフィックの一部を移し、150 Elo ポイントが自分の音声で現れるかどうかを確認する間、ルーティング層にフォールバックを維持させるのです。

決定、1つの段落で

リスナーがあなたの出力を聴いているのに、あなたがまだv3を使っているなら、移行してください — 品質の差は、ElevenLabsがこれらの掲示板で公開してきた中で単一世代としては最大の飛躍であり、文字数上限は2倍になり、言語リストは2倍になり、定価は下がっています。移行は段階的に行い、最も複雑なスクリプトからではなく、最もトラフィックの多いボイスから始め、予算は今週の数字ではなく10月12日の数字で計画してください。v3のままにとどまるのは、あなたの統合が異なる入力上限を吸収できない場合、またはv3 Conversationalがエージェントで基幹的な役割を担っていて、独自のレイテンシ予算に対してv4 Turboをまだ測定していない場合だけです。これらは、性急な切り替えよりも辛抱する方がコストが低い2つのケースです。