
Eleven v4 يتصدّر Voice Arena: ما الذي فاز به فعليًا المنتج الرائد الجديد من ElevenLabs
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 983 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 196 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
ElevenLabs Eleven v4 وصل في 28 سبتمبر وذهب مباشرة إلى قمة Provider Voice Arena من Artificial Analysis بتصنيف Elo قدره 1,319 — متقدمًا بـ 43 نقطة على Cartesia Sonic 3.6 عند 1,276 و52 نقطة على Google Gemini 3.8 Flash TTS عند 1,267. وهو أيضًا، بسعر 80.00 دولارًا لكل مليون حرف على نفس اللوحة، أغلى طراز في العشرة الأوائل. وعلى الساحة الثانية — تلك المبنية من أصوات مستنسخة بدلاً من مجموعة أصوات كل بائع — لا يفوز على الإطلاق: يحتل المركز الثاني، خلف طراز يكلف ربع هذا المبلغ. كلا الأمرين صحيح، والجزء المفيد من هذا الإطلاق هو معرفة أي منهما ينطبق على حالة الاستخدام الخاصة بك.
ما الذي صدر فعليًا في 28 سبتمبر
أطلقت ElevenLabs نموذجين في الإتاحة العامة، لا نموذجًا واحدًا. ElevenLabs Eleven v4 هو نموذج التوليف الرائد — تصفه الشركة بأنه الأكثر تعبيرًا عن المشاعر، وتحدد وثائقه الحد الأقصى للإدخال عند 10,000 حرف لكل طلب وتغطية اللغات عند أكثر من 90 لغة. ElevenLabs Eleven v4 Turbo هو النظير منخفض الكمون: اللغات نفسها التي تزيد على 90 لغة، وحد أقصى قدره 10,000 حرف، ودعم لوسوم الصوت المضمّنة التي تتيح لك كتابة توجيه أدائي في النص نفسه — ضحكة، أو همسة، أو أزيز على الخط. كلاهما متاح عبر واجهات الوكيل والإبداع وAPI الخاصة بالشركة منذ اليوم الأول، وهو طرح أسرع مما حصل عليه جيل v3.
صفحة الإعلان هي المكان الذي توجد فيه قائمة الميزات، واللافت أنها ليست مكان التسعير. تصف ElevenLabs بنية جديدة، وتعاملًا أفضل مع النبرة والإيقاع والشخصية، وحوارًا متعدد المتحدثين أكثر موثوقية مع هوية مستقرة للمتحدث، وإدخالًا محسّنًا للفونيمات IPA، واستنساخات صوتية فورية مبنية من عشر ثوانٍ من الصوت إلى جانب فئة الاستنساخ الاحترافية الحالية. الرقم الوحيد الموجود عليها هو ادعاء بشأن المستمعين: تقول الشركة إن المقارنات العمياء فضّلت v4 في نحو ثلاثة أرباع الحالات. هذا رقم صادر عن الجهة المورّدة، لم يُعَد إنتاجه، وينبغي أن يُقرأ إلى جانب أرقام لوحة النتائج أدناه لا بدلًا منها.
حيث يوجد التسعير فعليًا — صفحة تسعير واجهة برمجة التطبيقات — هو المستند الأكثر أهمية، وهو مُغطّى أدناه. باختصار: هذا الإطلاق ليس زيادة في السعر.
مجلسان، إجابتان مختلفتان
تدير Artificial Analysis ساحتين للكلام، وهما ليستا مجرد شكلين مختلفين للشيء نفسه. في Provider Voice، يطلب من المستمعين مقارنة الأصوات الخاصة بكل مزوّد. أما Controlled Voice فتستنسخ الأصوات الثمانية نفسها — أربعة أمريكية وأربعة بريطانية — لكل مشارك، بحيث يبقى المتحدث ثابتًا ولا يتغير سوى النموذج. قد يفوز نموذج يمتلك تشكيلة أصوات افتراضية ممتازة في الساحة الأولى ويخسر في الثانية. وهذا بالضبط ما يفعله Eleven v4.
• صوت المزوّد، Eleven v4 — المرتبة 1، إيلو 1,319، 80.00 دولار لكل مليون حرف، 1,674 عينة، ثمانية أصوات في الساحة، سبتمبر 2026
• صوت المزوّد، Cartesia Sonic 3.6 — المرتبة 2، Elo 1,276، 49.00 دولار
• صوت المزوّد، Google Gemini 3.8 Flash TTS — المرتبة 3، إيلو 1,267، 16.50 دولارًا
• صوت المزوّد، الطراز الرائد السابق ElevenLabs Eleven v3 — المرتبة 18، إيلو 1,169، 100.00 دولار
• الصوت المُتحكَّم فيه، Alibaba Qwen-Audio-3.1-TTS-Plus — المرتبة 1، إيلو 1,178
• Controlled Voice، Eleven v4 — المرتبة 2، Elo 1,157، 80.00 دولار
• صوت مُتحكَّم به، Cartesia Sonic 3.6 — المرتبة 4، تقييم Elo 1,138
• الصوت المتحكَّم فيه، ElevenLabs Eleven v3 — المرتبة 7، إيلو 1,073
• صوت متحكَّم فيه، Google Gemini 3.8 Flash TTS — المرتبة 13، إيلو 1,048
• أفضل إدخال مفتوح الأوزان على Provider Voice — Breeze TTS 2، إيلو 1,206، 34.00 دولاراً

قفزة السلالة هي الخبر الأبرز لأي شخص يستخدم ElevenLabs بالفعل: في مواجهة سابقه على اللوحة نفسها، يكسب Eleven v4 ما مقداره 150 نقطة Elo في Provider Voice و84 في Controlled Voice. هذه نقلة جيلية، وليست مجرد جولة ضبط وتحسين، والتحسن أكبر على اللوحة التي يختار فيها المورّد الأصوات — وهو ما يعني بصراحة أن طاقمه الافتراضي الجديد جزء حقيقي من هذا المكسب.

لوحة النطق التي لا يمكننا إعطاؤها رقمًا
يدير Artificial Analysis بالفعل قسم Pronunciation Robustness، ويستحق وصفًا دقيقًا لأن ملخّص التصنيف المتداول يصف Eleven v4 بأنه يتصدّره. تقيس لوحة التقييم نسبة النطاقات المظللة التي حكم المراجعون بأنها نُطقت بشكل صحيح، مع ما يصل إلى ثلاثة مراجعين لكل مقطع، وتُرسَل المطالبات كما كُتبت تمامًا — دون توسيع للأرقام، ودون تطبيع للنص. وهو مقسَّم إلى فئات فرعية، والغاية من هذا التصميم أن النموذج الذي يعيد كتابة "Dr." أو "$4.50" بصمت قبل أن ينطق يُقيَّم بشكل سيئ عن قصد.
ما لا تنشره لوحة الصدارة، في العرض الذي أمكننا قراءته، هو نتيجة رقمية قابلة للاستشهاد لكل نموذج. لذلك لا يوجد رقم يمكن اقتباسه لـ Eleven v4 هناك، كما أن Elo البالغ 1,319 يخص تفضيل الساحة — أي مدى إعجاب المستمعين بالصوت — لا دقة النطق. وإذا رأيت الاثنين مخلوطين، فهذا هو الخلط. أما الادعاء القابل للدفاع من هذا الإطلاق فهو المقرون بالأرقام: المركز الأول في Provider Voice عند 1,319، والمركز الثاني في Controlled Voice عند 1,157.
خصم الإطلاق هو الخبر الحقيقي لفاتورتك
أعادت ElevenLabs تسعير الطرازات الجديدة في الوقت نفسه الذي أصدرتها فيه، والخصم كبير بما يكفي لتغيير قرار الشراء بمفرده. في صفحة أسعار API، يُدرج Eleven v4 بسعر 0.022 دولار لكل ألف حرف مقابل السعر المعلن البالغ 0.08 دولار — انخفاض بنسبة 72% — ويُدرج Eleven v4 Turbo بسعر 0.011 دولار مقابل 0.04 دولار. ينطبق على كليهما نفس الإطار الزمني: يستمر العرض الترويجي حتى 12 أكتوبر. بعد ذلك، تعود الأرقام، وسعر v4 بعد العودة يبلغ ضعف ما يكلفه v3 الخاص بـ ElevenLabs اليوم عند 0.08 دولار. خطط انطلاقًا من السعر بعد العرض الترويجي، وليس السعر الترويجي.
تؤدي إعادة التسعير أيضًا إلى تغيير موقع v4 مقابل المنافسين على أساس كل حرف، وهو ما يُظهره تطبيع الساحة بالفعل عند $80.00 لكل مليون. ويبلغ Sonic 3.6 هناك $49.00، وBreeze TTS 2 يبلغ $34.00، وQwen-Audio-3.0-TTS-Plus يبلغ $19.30، وGemini 3.8 Flash TTS يبلغ $16.50. وبالسعر الترويجي، فإن Eleven v4 عند $22 لكل مليون يقلّ عن سعر Sonic 3.6 بشكل مباشر. وبسعر القائمة، فهو أغلى صوت في القائمة بفارق كبير. أي شخص يعدّ ميزانية للربع الأول يجب أن ينظر إلى الرقم الثاني.

شهر استخدام فعلي يجعل الفارق ملموسًا. عند خمسة ملايين حرف — منتج متوسط الحجم يقرأ نحو مئة ساعة من الكلام — تكلفة Eleven v4 خلال النافذة 110 دولارات. وعند سعر 0.08 دولار المعاد إليه، تبلغ التكلفة 400 دولار. وتكلفة Sonic 3.6 هي 245 دولارًا. وتكلفة Gemini 3.8 Flash TTS هي 82.50 دولارًا. ويكلف الشهر نفسه على v3 الخاص بـ ElevenLabs أيضًا 400 دولار، وهذه هي الحقيقة الغريبة الكامنة وراء هذا الإطلاق: خلال الأسبوعين القادمين، يكون الطراز الرائد الجديد أرخص من النموذج الذي يحل محله، وفي اليوم الذي تُغلق فيه النافذة يتوقف عن كونه أرخص ويصبح أفضل فحسب.
ادعاء زمن الاستجابة مُصرَّح به من المورّد ويعتمد على الفئة
تنشر ElevenLabs أرقام الكمون لكل فئة، وليس لكل عائلة طرازات، وهي قياسات أجرتها الشركة بدلًا من أي شيء مستقل. تُذكر Eleven v4 Turbo بنحو 100 مللي ثانية لوسيط الاستدلال، وحوالي 150 مللي ثانية لوسيط زمن الوصول إلى أول كلام، مقيسة في سبتمبر 2026. وتُذكر Eleven v3 Conversational بنحو 280 مللي ثانية، وفئتا Flash وTurbo الأقدم بنحو 75 مللي ثانية. ولا تنشر الوثائق رقمًا مكافئًا لـ Eleven v4 نفسه، وهي الفئة التي قد ترغب فيها إذا كنت تبني وكيلًا في الوقت الحقيقي وتقرأ ورقة مواصفات بدلًا من الاختبار.
تدّعي Cartesia زمن وصول أقل من 90 مللي ثانية لـ Sonic وتصفه بأنه يحتل المرتبة الأولى في الطبيعية، مع استنساخ الصوت من عشر ثوانٍ من الصوت، وقواميس نطق مخصصة، ومجموعة امتثال تغطي HIPAA وSOC 2 Type 2 وGDPR وPCI. هذه ادعاءات البائع نفسه على صفحة منتجه الخاصة — وهي من نفس فئة الأدلة التي تمثلها أرقام فئات زمن وصول ElevenLabs، ولا يمكن تبادلها مع تصنيف Elo في الساحة. إن الموضع الوحيد الذي يكون فيه البائعان قابلين للمقارنة المباشرة هو فقط على لوحات التصنيف.
ما الذي يعنيه هذا بالنسبة لك، وكيف يمكنك تجربته
إذا كنت تختار صوتًا لمنتج حيث تكون التشكيلة الافتراضية هي ما يسمعه مستخدموك، فإن نتيجة Provider Voice هي التي تهم، وقد حصدها للتوّ Eleven v4، مع خصم مرفق لمدة أسبوعين. وإذا كنت تستنسخ صوت شخص معيّن ويُطلب من كل نموذج مرشح إعادة إنتاج نفس المتحدثين الثمانية، فإن لوحة Controlled Voice هي التي تهم، و Eleven v4 في المرتبة الثانية — متأخرًا بـ 21 Elo عن المتصدر، وبسعر القائمة، أكثر من أربعة أضعاف التكلفة لكل حرف. لا نتيجة منهما خاطئة؛ فهما إجابتان لسؤالين مختلفين، والثانية هي السؤال الذي يطرحه معظم أعمال استنساخ الصوت الإنتاجية فعليًا.
لا تستضيف OrcaRouter شركة ElevenLabs أو Cartesia أو أيًا من الموردين الآخرين على هذه اللوحات، لذا لا يوجد هنا أي شيء يمكن استدعاؤه من خلالنا، ولن نوحي بخلاف ذلك. ما نقدمه هو البنية التحتية المحيطة إذا انتهى مكدس الصوت لديك إلى الامتداد عبر عدة موردين: مفتاح API واحد عبر أكثر من 200 نموذج، مع تمرير أسعار القائمة لدى الموردين كما هي بهامش ربح 0%، لذا فإن أي تخفيض في أسعار أحد الموردين — بما في ذلك نافذة ترويجية مثل هذه — يصبح ساريًا لدينا في اليوم نفسه بدلًا من دورة الفاتورة التالية. وحيث يكون مسار الصوت بالغ الأهمية للإنتاج، يقوم التبديل التلقائي عند الفشل بالتبديل إلى مصدر أعلى سليم عندما يتدهور أحدها، وهي الطريقة العملية لاختبار نقطة نهاية جديدة تمامًا دون المجازفة بإصدار كامل عليها.
التاريخ الذي ينبغي تدوينه هو 12 أكتوبر. عند ذلك التاريخ يتوقف Eleven v4 عن كونه أرخص صوت جيد على الساحة ويصبح الأغلى، وأي مقارنة تُكتب هذا الأسبوع وتستشهد بـ 22 دولارًا لكل مليون دون أن تذكر ذلك هي مقارنة ينبغي أن تعيد إجراءها بعد ثلاثة أسابيع.
