![بطاقة رئيسية مُولَّدة لـ ElevenLabs Eleven v4 بجزأين: على اليسار، كتلة نصية تعرض وسومًا صوتية مضمّنة مثل [laughs] و[whispers] و[said angrily in French accent]؛ وعلى اليمين، لوحة تعرض المرتبة 1، وElo 1,319، و$80.00 لكل مليون حرف، و1,674 ظهورًا في Provider Voice Arena التابعة لـ Artificial Analysis، مع تذييل ينص على: «ترتيب Provider Voice، وElo، والسعر وفقًا لـ Artificial Analysis، سبتمبر 2026؛ صيغة الوسوم وزمن الاستجابة موثّقان من المورّد.» ويقع شعار OrcaRouter في الزاوية اليمنى السفلية.](https://cms.orcarouter.ai/api/media/file/1-1462.png)
وسوم الصوت في Eleven v4 واستنساخات العشر ثوانٍ: ما الذي يتغيّر في خط أنابيبك
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 982 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 197 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
الشيء الأكثر تأثيرًا في ElevenLabs Eleven v4 ليس هو تقييم Elo الخاص به. بل إن النموذج يقرأ التوجيهات المكتوبة في النص — [ضحكات]، [همسات]، [تنهدات]، [قال بغضب بلكنة فرنسية]، وحتى [مطر خفيف] — وأن ElevenLabs Eleven v4 Turbo، النموذج الشقيق منخفض الكمون الذي طُرح في اليوم نفسه، يتبع الوسوم نفسها بزمن وسيط لأول كلام يقدّره المزوّد بنحو 150 مللي ثانية. أصبح كلاهما متاحًا للعموم في 28 سبتمبر 2026. منصة Provider Voice Arena التابعة لـ Artificial Analysis لديها بالفعل Eleven v4 في المرتبة الأولى بتقييم Elo قدره 1,319 عبر 1,674 ظهورًا، بسعر مدرج قدره 80.00 دولارًا لكل مليون حرف. التصنيف هو الخبر الرئيسي. أما صيغة التوجيه والاستنساخ خلال عشر ثوانٍ فهما الجزء الذي يغيّر ما عليك بناؤه.
![A generated four-card summary of what ElevenLabs Eleven v4 changed in the pipeline: a Script direction card listing [laughs], [whispers], [sighs], [said angrily in French accent] and natural-language delivery prompts; a Sound and scene card listing [light rain], [phone buzzing], multi-speaker dialogue with turn-level context and IPA phonemes for custom pronunciations; a Voice creation card listing Instant Voice Cloning from 10 s of audio, a Professional Voice Cloning tier above it, and 90-plus languages with a 10,000-character cap; and a Two endpoints card describing Eleven v4 as the most emotive, highest-quality model against Eleven v4 Turbo at about 100 ms median inference and about 150 ms to first speech. Footer: 'Tag syntax, cloning bar, language count, character cap and Turbo latency are vendor-documented; no independent score is quoted on this card.' The OrcaRouter logo sits in the bottom-right corner.](https://cms.orcarouter.ai/api/media/file/2-1397.png)
نموذجان، إطلاق واحد، مهام مختلفة
أطلقت ElevenLabs نقطتي نهاية في 28 سبتمبر 2026، وهما ليسا نفس المنتج مع تبديل السرعة. ElevenLabs Eleven v4 هو النموذج التعبيري: أكثر من 90 لغة، حد أقصى 10,000 حرف لكل طلب، دعم محسّن للأبجدية الصوتية الدولية للنطق المخصص، وحوار متعدد المتحدثين تقول الشركة إنه يحافظ على هوية المتحدث عبر المشهد. ElevenLabs Eleven v4 Turbo يحتفظ بأكثر من 90 لغة وحد أقصى 10,000 حرف لكنه مُصمم للوكلاء — يذكر الإعلان وسيط زمن استدلال يبلغ حوالي 100 مللي ثانية ووسيط وقت حتى أول كلام يبلغ حوالي 150 مللي ثانية، قاسته ElevenLabs في سبتمبر 2026.

السؤال التفاعلي — هل النموذج الرائد سريع بما يكفي لوكيل هاتفي — لا يوجد له جواب منشور. تقدم ElevenLabs أرقام زمن الوصول الخاصة بـ Turbo، وليس الخاصة بـ Eleven v4 نفسه، وهما نقطتا نهاية مختلفتان وليسا نموذجًا واحدًا تحت اسمين. إذا كانت ميزانية وكيلك 200 مللي ثانية حتى أول صوت، فإن Turbo هو نقطة النهاية في التوثيق، أما النموذج الرائد فليس كذلك.
الوسوم واجهة حقيقية، وتبعية حقيقية
الوسوم الصوتية المضمنة ليست جديدة في تركيب الكلام، لكن التغيير المفيد هنا هو دقة الالتزام. يذكر الإعلان أن Eleven v4 يتبع الوسوم الصوتية ومطالبات التوجيه باللغة الطبيعية بدقة أكبر من النماذج السابقة، وأن هذه هي الطريقة التي توجّه بها ضحكة، أو همسة، أو إلقاءً بلكنة محددة دون تحرير الصوت لاحقًا.
تترتب على ذلك ثلاث نتائج عملية، وهي تهم أكثر من مقاطع العروض التوضيحية:
• يتحوّل سكربتك إلى مُخرَج مُقولب، لا إلى سلسلة نصية. الوسم رمز في خط أنابيب المحتوى لديك: يحتاج إلى تهريب إذا مرّ نص غير موثوق به عبره، ويحتاج إلى أن يصمد عبر نظام إدارة المحتوى لديك، وطبقة الترجمة، ومراجعة الفروقات. المترجم الذي يُسقط [يهمس] قد غيّر عرضًا، بصمت.
• الالتزام بالوسوم هو ادعاء من المورّد مقترن بإصدار معيّن. والادعاء بأن هذا الجيل يتّبع الوسوم أفضل من الجيل السابق هو ادعاء خاص بـ ElevenLabs، واختبرته ElevenLabs بنفسها، ولن ينطبق بالشكل نفسه عبر اللغات. تحقّق من ذلك على نصوصك وبيئاتك المحلية قبل أن تبني عليه دليل أسلوب.
• Sound-effect tags like [light rain] or [phone buzzing] move a little of the work of audio post-production into the text prompt. That is a cost shift worth measuring: if a tag replaces a foley pass, it is cheap; if it replaces nothing and only adds variance, it is a new failure mode in your QA.
عشر ثوانٍ هو الرقم الذي يغيّر التهيئة.
يلتقط Instant Voice Cloning في هذا الإصدار صوتًا عالي الدقة من عشر ثوانٍ من التسجيل الصوتي، مع بقاء مستوى الاستنساخ الاحترافي متاحًا أعلى منه. عشر ثوانٍ قصيرة بما يكفي لاختصار خطوة من سير العمل: يمكن إتمام التقاط الموافقة ورفع العيّنة وأول عملية تركيب في جلسة واحدة، على هاتف، من دون استوديو.
مشكلة الموافقة لا تتقلص مع العينة. بل تزداد، لأن العتبة اللازمة لإنتاج نسخة صوتية مقنعة قد انخفضت إلى مقطع يمكن لأي شخص تسجيله. إذا كنت تستنسخ أصواتًا لا تملكها، فإن مسألة الامتثال أصبحت الآن مسؤوليتك بالكامل للإجابة عنها قبل استدعاء الـ API — فالنموذج سيفعل ما تطلبه. عامل رقم العشر ثوانٍ كحدّ تشغيلي، لا كتصريح إذن.
ما تكلفته بينما النافذة مفتوحة
أعادت ElevenLabs تحديد أسعارها عند الإطلاق، والسعر الترويجي هو السعر الظاهر على الصفحة اليوم. في جدول أسعار API، يظهر Eleven v4 بسعر 0.022 دولار لكل 1000 حرف مقابل سعر قائمة معلن قدره 0.08 دولار، وEleven v4 Turbo بسعر 0.011 دولار مقابل 0.04 دولار. ويحمل كلاهما التسمية نفسها: خصم 72% حتى 12 أكتوبر. وتُسعّر الصفحة نفسها الطراز الرائد السابق، Eleven v3، عند 0.08 دولار لكل 1000 حرف.
• سعر اللوحة على الساحة، لكل مليون حرف — Eleven v4 $80.00، وهو الأعلى ضمن العشرة الأوائل في تلك اللوحة.
• قائمة أسعار المورّد، لكل ألف حرف — 0.022 دولار حتى 12 أكتوبر، ثم 0.08 دولار.
• ما يعنيه ذلك عمليًا — شهر كثيف النصوص من خمسة ملايين حرف يكلّف $110 خلال النافذة و$400 بعدها، على نفس نقطة النهاية وباستخدام نفس الكود.

أي شخص يضع ميزانية للربع الأول استنادًا إلى الرقم الموجود على الصفحة اليوم، فإنه يضع ميزانية استنادًا إلى رقم تنتهي صلاحيته خلال أسبوعين. استخدم $0.08.
أين يثبت الراوتر مكانته في إطلاق كهذا
لا تستضيف OrcaRouter خدمة ElevenLabs، لذا لا يوجد شيء في هذا الإطلاق يمكن استدعاؤه من خلالنا، ولن نلمّح إلى خلاف ذلك — فالمكان الذي يمكنك من خلاله استدعاء Eleven v4 هو API الخاصة بـ ElevenLabs. إن ما يكون المفتاح الواحد مفيدًا له حقًا في الأسبوعين اللذين يليان الإطلاق هو المقارنة. إذا كنت تقرر ما إذا كان النموذج الرائد الجديد يتفوق على ما تشغّله بالفعل، فأنت تريد إجراء اختبار A/B بين الاثنين على سكربتاتك الخاصة بدلًا من لوحة الصدارة، والقيام بذلك عبر مورّدين اثنين يعني حسابين وعلاقتي فوترة ومساري تكامل قبل أن تحصل على إجابة.
هذه هي الحالة التي نتعامل معها: مفتاح API واحد عبر أكثر من 200 نموذج مع أسعار قائمة المزودين التي تُمرر بـهامش ربح 0%، لذا فإن تغيير سعر المورد — بما في ذلك نافذة ترويجية بتاريخ انتهاء — يصبح ساريًا من جانبنا في اليوم نفسه بدلاً من دورة الفاتورة التالية. وحيث يكون مسار الصوت موجهًا للعملاء، التحويل التلقائي عند الفشل ينقل حركة المرور إلى مصدر أعلى سليم عندما يتدهور أحد نقاط النهاية، وهذه هي الطريقة التي تجرب بها نموذجًا جديدًا تمامًا دون المراهنة بإصدار كامل عليه.
ما الذي يجب اختباره أولًا، وما الذي يجب تجاهله
ثلاثة اختبارات ستخبرك أكثر من أي ترتيب. أولًا، شغّل أطول نص واقعي لديك ضمن سقف 10,000 حرف ولاحظ أين تقع مواضع الوصل — فالسقف لكل طلب، والحوار متعدد المتحدثين هو الميزة الأكثر عرضة للانقسام بسببه. ثانيًا، ضع خمس جمل من عندك تحتوي على وسوم في كل من v4 وv4 Turbo، واستمع إلى انحراف الالتزام بين نقطة النهاية التعبيرية ونقطة النهاية منخفضة زمن الوصول؛ فهما نموذجان منفصلان، وقد لا يتحقق وسم ينجح على أحدهما بالطريقة نفسها على الآخر. ثالثًا، احسب سعر حجم الأحرف الشهري الفعلي على أساس 0.08 دولار بدلًا من 0.022 دولار، لأن هذا هو الرقم الذي سيسير عليه ربعك القادم.
رقم التفضيل الأعمى البالغ ~75% في الإعلان هو قياس خاص بمورّد، ولن نغسله لنحوّله إلى أي شيء آخر. الرقم المستقل في هذا الإطلاق هو ذاك الموجود على اللوحة: المركز الأول عند 1,319 Elo في 1,674 ظهورًا، مع فاصل يبلغ نحو ±19 نقطة حوله. هذه نتيجة قوية على لوحة حقيقية. وهي ليست مواصفة، ولن تخبرك ما إذا كانت صيغة الوسوم لديك تنجو من مرور ترجمة.
