
Eleven v4 與 ElevenLabs 其他模型相比:你該從 Eleven v3 遷移嗎?
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 982 tok/s
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 195 tok/s
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
如果你已經在使用ElevenLabs Eleven v3,那麼凡是聽眾聽得到的,答案都是「可以」;而 ElevenLabs 維持不變的兩件事,答案則是「不行」。ElevenLabs Eleven v4在 Artificial Analysis 的 Provider Voice Arena 上,比自己的前代多出 150 Elo 分——1,319 對 1,169——並在 Controlled Voice 排行榜上多出 84 分,該榜單對所有人都使用相同的八個複製語音。它也具備 v3 兩倍的字元上限,以及約兩倍的語言涵蓋範圍。它不會改變的是你的合約、你的語音複製,或你被計費所依據的方案層級結構,這就是為什麼這次遷移比大多數都便宜,但仍值得以分階段的方式進行,而不是一次全部完成。

家族內部的計分板
這不是供應商之間的比較,因此競技場排行榜上的價格標準化運作方式與往常不同:兩個模型都按字元計費,使用同一份費率表,並來自同一個帳戶。以下這些優缺點是相對於同系列模型而非競爭對手來衡量。
• Provider Voice Arena — ElevenLabs Eleven v4 排名第 1,Elo 1,319,對上 ElevenLabs Eleven v3 排名第 18,Elo 1,169。差距 150 分。
• 受控語音競技場,配對的克隆語音 — Eleven v4 排名第 2,Elo 1,157 對上 Eleven v3 排名第 7,Elo 1,073。差距 84 分。
• Arena 價格正規化 — Eleven v4 每百萬字元 $80.00,對比 Eleven v3 $100.00。新旗艦是榜上兩者中較便宜的一個。
• 供應商費率表 —— Eleven v4 每千字元 $0.022 為促銷價,10 月 12 日後為 $0.08;Eleven v3 為 $0.08。定價相同,優惠期間半價。
• 每次請求的輸入上限 — Eleven v4 10,000 個字元,對比 Eleven v3 5,000 個。正好是兩倍。
• 語言覆蓋範圍 — Eleven v4 超過 90 種,Eleven v3 超過 70 種。
• 語音表達指令 — Eleven v4 記載了內嵌音訊標籤與 IPA 音素輸入;Eleven v3 在其模型頁面上則兩者皆未記載。
• 延遲,廠商聲稱 — Eleven v3 Conversational 約 280 毫秒;Eleven v4 Turbo 首次語音的中位數約 150 毫秒。不同等級,不同測試。
• 語音複製 — 維持不變。現有的即時與專業複製皆會保留。
• 方案等級 — 維持不變。免費方案 10,000 字元,Starter $6,Creator $22,Pro $99,Scale $299,Business $990。
• 遷移路徑 — Eleven v4 與 Eleven v4 Turbo 均已在 API、代理與創意介面上線;較舊的 Turbo 識別碼已棄用。
把價格那一列讀兩遍。這次發布的不尋常之處在於,新模型比它所取代的舊模型更便宜,而且是在同一張價目表上、以定價計算、未套用任何促銷——每百萬 $80 對上 $100。促銷價只是把這個差距拉大,而不是創造出這個差距。一場能讓品質提升 150 Elo、並降低每字元成本的遷移,並不是大多數團隊預期會做的取捨。
遷移檢查清單,按真正重要的順序排列
先把音訊品質路徑移過去,因為收益就在那裡,而且一旦發生迴歸,你的使用者會比你先明顯察覺到。
• 試聽你實際推出的那些語音。Provider Voice 是在某個 arena 語音集上取平均;你的品牌語音並不在其中。這 150 分的差距是去試聽的理由,而不是試聽的替代品;而複製語音排行榜上的 84 分差距,才更貼近以複製語音為基礎的產品會帶來的感受。
• 重新檢查你的字元預算。10,000 字元上限是 v3 的兩倍,因此你先前拆分的指令碼現在可能可以放進單一請求中。那會改變請求次數、重試邏輯,以及拼接輸出的接縫品質——而這是最可能破壞假設上限為 5,000 的程式碼的變更。
• 測試接縫。ElevenLabs 特別記載了 v4 中更可靠的請求拼接。如果你在 v3 時分割長篇內容,請在單次呼叫中將相同內容透過 v4 重新執行並比較,而不是假設分割仍然必要。
• 使用新的音素支援,重新測試你的發音案例。為 v3 建立的詞典應重新驗證,而非直接信任;改良後的 IPA 處理方式可能意味著,先前正確的覆寫設定現在會以不同方式與模型自身的猜測互動。
• 不要動你的複製語音庫。複製語音會保留;不需要重新上傳,重新複製可能會失去使用者認得的聲音。
• 目前,請在你使用 v3 Conversational 的地方繼續保留它。它是對話層級,而不是合成模型;文件中仍記載約為 280 毫秒,而且沒有已發布的 v4 對等版本。如果你的代理程式依賴它,v4 並不是該位置的對等替代品——v4 Turbo 是延遲較低的 v4 標籤,而它的延遲層級標示方式不同。

實際上什麼會真正變好,而什麼不會
這些提升集中在三個地方。情緒範圍與節奏是第一個——這正是 Provider Voice 排行榜所衡量的,也是廠商自家公告所強調的,還附帶一項說法:在盲測比較中,約四分之三的情況偏好 v4。請把那個數字視為廠商所述且未經重現;競技場排行榜是同一件事中的獨立一半,而它們在方向上一致。

具備穩定說話者身分的多說話者對話是第二項。如果你曾在 v3 上發布雙人對話內容,並花費心力修正長篇腳本中的說話者串音或漂移,那就是一種改善屬於結構性而非表面性的工作負載,而這也是 Elo 數字只能部分捕捉到的一項。
行內語氣指示是第三種——直接把嘆息或低語寫進腳本裡。在 v3 上,那意味著要重錄一次、使用上游提示,或進行後製處理。在 v4 Turbo 上,它就只是你手邊文字裡的一行。
不會變好的,是團隊往往以為會隨著新旗艦而改善的那個部分:延遲。ElevenLabs 並未公布 Eleven v4 本身的延遲數據,只公布了 v4 Turbo 的數據,其推論中位數約為 100 毫秒,首次語音時間中位數約為 150 毫秒,測量時間為 2026 年 9 月。Eleven v3 的對話層級據稱約為 280 毫秒,但那是不同層級、做的是不同的事。如果你的架構是圍繞著嚴格的延遲預算打造的,誠實的立場是:v4 Turbo 才是候選者,而你應該自行測量,因為層級名稱無法清楚對應,而供應商提供的數字也並非同基準比較。
兩週的窗口期,以及之後會發生什麼
優惠價格持續到 10 月 12 日。在此之前,Eleven v4 為每千個字元 $0.022,而 Eleven v4 Turbo 為 $0.011,對照公告的定價分別為 $0.08 和 $0.04。優惠期過後,v4 將恢復到與 v3 今日價格完全相同——$0.08——而 v4 Turbo 則恢復到 v3 費率的一半。
以五百萬字元計算的試算月份:v3 的費用是 400 美元。v4 在優惠期間的費用是 110 美元,之後又會回到 400 美元。v4 Turbo 在優惠期間的費用是 55 美元,之後則是 200 美元。因此,有意思的遷移選項可以說是 Turbo,因為它是這份費率表上唯一在促銷結束後仍比 v3 便宜的選項,而 v3 所欠缺的音訊標籤支援也就在那裡。
務實的做法是趁價格還算額外紅利時,先把品質工作做好,並根據十月十二日之後的數字來決定定價。任何引用 Eleven v4 每百萬 $22、卻未附上期限的比較,描述的都是兩週後就會到期的費率。
分階段進行切換,而不讓發佈成敗取決於它
OrcaRouter 並未託管 ElevenLabs,所以這次移轉中沒有我們能替你搬移的項目——變更是在你的 ElevenLabs 帳戶上發生。我們負責處理的是圍繞非單一供應商技術堆疊的那一層。如果你的語音路徑是單一端點後方數個模型的其中一個,我們提供200 多種模型,透過單一 API 金鑰,供應商牌價以 0% 加價原樣傳遞,這表示供應商重新定價——就像這次——會在他們那邊生效的同一天落到我們這邊,無須另簽合約或變更整合。
當語音路徑面向客戶且不能掉話時,自動容錯移轉會繞過降級的上游,而不是讓通話失敗。這類移轉應該採取的樣貌是:讓 v4 在與現行系統相同的端點後方運行,轉移一部分流量,並讓路由層保留備援,同時讓你確認那 150 分的 Elo 分數是否會出現在你自己的音訊中。
這個決定,用一段話來說明。
如果聽眾會聽到你的輸出,而你仍停留在 v3,那就該遷移——這個品質差距是 ElevenLabs 在這些討論區上公布過、單一世代最大的躍進,字元上限加倍,語言清單加倍,而且定價更低。分階段進行遷移,從你流量最高的語音開始,而不是你最複雜的腳本,並以 10 月 12 日的數字來規劃預算,而不是本週的。只有在你的整合無法吸收不同的輸入上限,或者 v3 Conversational 在某個 agent 中扮演關鍵角色、而你尚未依據自己的延遲預算衡量 v4 Turbo 時,才繼續留在 v3。這兩種情況下,耐心等待的代價都低於倉促切換。
