
Eleven v4 対 Sesame Preview:これはあなたが思っているような比較ではない
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 982 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 197 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
を検索するとElevenLabs Eleven v4対Sesame Preview、それらを喜んで表にまとめてくれるページが大量に出てくる。そのほとんどは、製品をベンチマークと、デモと比較しているもので、表はそのページで最も役に立たないものだ。Eleven v4 は、API、料金表、公開されているアリーナ順位を備えた一般提供中の音声合成モデルである。Sesame Preview は、リンクをタップすると応答する無料の消費者向け音声アシスタントだ。両者は同じ購入のための2つの選択肢ではない。そして、この記事の正直な版が扱うのは、あなたが実際にどちらを欲しいのかということだ——なぜなら、その答えは、どちらのベンダーのマーケティングページも尋ねていない問いにかかっているからである。

Eleven v4とは実際に何なのか
ElevenLabsは9月28日、Eleven v4とEleven v4 Turboを本番エンドポイントとして提供開始した。Eleven v4は90以上の言語、1リクエストあたり10,000文字の上限、話者アイデンティティが安定したマルチスピーカー対話、インラインの話し方指示、改善されたIPA音素対応、10秒の音声からのインスタントボイスクローニングを備える。Artificial AnalysisのProvider Voice ArenaではElo 1,319で1位となり、推定の基盤となる1,674件のサンプルを伴い、Controlled Voiceボードでは1,157で2位となっている。API料金表では、10月12日に終了するプロモーション中は1,000文字あたり0.022ドルと記載され、その後は0.08ドルに戻る——これは以前のElevenLabs Eleven v3が採用していたのと同じ料金である。
その段落はどの部分も検証できる。モデル識別子があり、文書化された入力上限があり、公開された文字あたりの価格があり、旧Turboティアに関する非推奨の注記があり、信頼区間付きの独立したリーダーボード項目がある。購入できるモデルとは、こういうものだ。

Sesame Previewとは実際には何なのか
Sesame Previewは消費者向けのデモンストレーションです。企業自身のサイトを通じてアクセスする音声アシスタントで、Maya、Miles、Simone、Charlieという少数の名付けられたペルソナ、セッションをまたいで保持される会話記憶、ウェブ検索、ノートとリマインダー、通話後の要約を備えています。無料です。サインイン済みのセッションは約30分、ゲストセッションは約5分です。対応は英語のみです。そしてSesameは、タスクを実行しないと明言しています。デモの狙いは会話の質感にあり、会議を予約してくれるエージェントではありません。
この比較で重要なのは、欠けているものだ。モデル識別子も、エンドポイントも、料金表も、設計の基準にできる入力上限もなければ、本番モデルの発表日もない。Sesameが公開している研究ラインは別物だ——4Kコンテキストのオープンウェイト会話音声モデルであり——それはPreviewであなたが話しかけるシステムと同じではない。つまり、どの比較表でも「Sesame Preview」と名付けられているものは統合できない製品であり、ダウンロードできるものはその製品ではない。
なぜ彼らはスコアボードを共有できないのか
Artificial Analysis の controlled-voice arena は、この分野で中立な測定に最も近いものだが、Sesame Preview はそこに掲載されていない。プロバイダー音声ボードにも載っていない。Elo も、投票数も、価格正規化もなく、それを作り出す方法もない。なぜなら、リーダーボードには呼び出し可能なエンドポイントと単位あたりの価格が必要だが、Sesame Preview にはどちらもないからだ。
だから、この2つを並べた表を作っている時点で、そのSesame列は製品ツアーで埋めているだけだ。「自然さ」をめぐって、100万文字あたり80ドルのエンドポイントと無料のWebデモを比べるのは比較ではない。それはEloの形をした穴が空いたカテゴリー錯誤だ。もしあるページがその対決で勝者を主張しているなら、その主張の根拠をでっち上げている。
正直に言えるのは、それぞれが何を目指しているかだ。Eleven v4 は、スクリプトをパフォーマンスに変えるために最適化されている。大規模に、API を通じて、毎回同じ声で。Sesame Preview は、ブラウザのタブで一度だけ、見知らぬ人に誰かと話しているように感じさせるために最適化されている。
比較が現実になる唯一の場所
検索の根底には本当の問いがあり、それはオープンウェイトに関するものだ。もしあなたが本当に求めているのが、自分でダウンロードして実行できる音声モデルなら、どちらのベンダーのフラッグシップも答えではない。ElevenLabsのスタックはクローズドであり、実行できるSesameのシステムは4Kコンテキストの研究モデルであって、アシスタントではない。
その仕事で役立つ基準はアリーナのボード上にある。Breeze TTS 2 は Provider Voice で最高順位のオープンウェイト項目で、Elo 1,206、100万文字あたり$34.00、そのボードの92件中16件がオープンウェイトモデルだ。これは Eleven v4 に113ポイント差をつけられ、Qwen3 TTS 系列の944と930を大きく上回っている。自分のハードウェアで動かす必要があるプロジェクトなら、価値ある比較は Eleven v4 対 Breeze TTS 2 であり、ブラウザのデモとの比較ではない。そしてそこには現実的なトレードオフがある。Elo のおよそ100ポイントとオーディオタグのワークフローを諦め、その代わりにスタック全体の制御を得る。

それぞれが何のためのものかに基づいて選ぶこと
• 音声を発する製品を構築しているなら — Eleven v4 が、API 経由で、料金表ベースで利用できます。Sesame Preview に関しては統合できるものが何もないため、この判断には含まれません。
• 誰かに音声AIがどんな感じかを体感してもらうための会話デモが欲しいなら — Sesame Preview です。しかも無料で、それこそがその最大の理由です。
• ベンダーを選定する前に感情表現の幅を評価しているなら、ベンダー音声ボードでのEleven v4のElo 1,319と、クローン音声ボードでの1,157が読むべき数値です。ただし、後者はクローンされたブランド音声製品を表す数値であるという注意点があります。
• 英語以外の言語の音声が必要な場合 — Eleven v4 は 90 以上の言語を文書化しています。Sesame Preview は英語のみで、そう明記されています。
• モデルに実際に何かをやらせたいなら——この対決では、どちらも該当しません。Sesame Preview は意図的にタスクを実行せず、Eleven v4 は自分のスタックを周囲に必要とする合成エンジンです。
• ローカルで実行する必要があるなら — どちらでもありません。Breeze TTS 2 がオープンウェイトの基準点です。
• コストが決め手なら——Eleven v4 は10月12日まで1,000文字あたり0.022ドル、それ以降は0.08ドルで、Sesame Preview は購入できる製品ではないため無料です。無料のデモはより安い選択肢ではありません。それは別のカテゴリーなのです。
両者に共通する唯一の点は、日付の問題だ。Eleven v4 のプロモーション価格は10月12日に終了し、これによりコストはほぼ4倍に変わる。Sesame は製品モデルについて日付を一切示していない。これは別種の不確実性だ——Preview は来月には置き換えられているかもしれないし、1年間まったく変わらないままかもしれず、誰もスケジュールしていないローンチを前提に計画を立てる方法はない。
スタックが複数の音声ベンダーにまたがることになった場合
OrcaRouterはElevenLabsもSesameもホストしていないため、本記事には当社経由で呼び出せるものはなく、そうであるかのように示唆することもありません。当社が扱うのは、すでにマルチベンダー化されたスタックの上位層です。1つのAPIキーで200以上のモデルにアクセスでき、プロバイダーの定価が0%のマークアップでそのまま適用されます。そのため上流の価格変更は——今回のローンチのプロモーション期間がまさにその実例ですが——次回の請求書ではなく当日に当社側へ反映されます。音声経路が顧客接点となる場合、ある上流が劣化すると自動フェイルオーバーがトラフィックを健全な上流へ切り替えます。これにより、リリースを賭けずに実際のトラフィックで新しいエンドポイントを試聴・検証できます。
要点
Eleven v4は、購入でき、測定でき、頼りにできるモデルであり、現在、2週間限定の値下げでベンダー音声ボードの首位に立っている。Sesame Previewは、会話の感触を試す無料の実験で、英語のみ、30分までの上限があり、その上に何かを構築できるものではない。両者が同じ検索結果に現れる理由は、どちらも音声AIで、どちらも新しいからであり、どちらかが他方の代替だからではない。
もしそれを選ぶためにここに来たのなら、役に立つ捉え直しはこれです。あなたは音声モデルを選んでいるのではありません。製品を出荷するのか、デモを試すのかを決めているのであり、そのどちらか一方の決定にだけ料金表が付いています。もし製品の方なら、Eleven v4 の数字を読み、10月13日にもう一度読み直してください。その日、プロモーション料金が失効し、一覧に載る他のすべてのベンダーとの比較が変わります。
