
Eleven v4 מול Qwen Audio 3.1: הקול הזול ביותר על הלוח ניצח
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 982 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 197 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
על הלוח שבו כל מתחרה מקבל את אותן שמונה קולות משובטים, Alibaba Qwen-Audio-3.1-TTS-Plus סיים ראשון ב-Elo 1,178 ו-ElevenLabs Eleven v4 סיים שני ב-1,157. המודל שניצח עולה $19.30 למיליון תווים באותו לוח. המודל שהגיע שני עולה $80.00. זהו פער איכות של 21 נקודות ופער מחיר של פי ארבעה שמצביעים בכיוונים מנוגדים, וזו התוצאה המעניינת ביותר בכל שבוע ההשקה — מעניינת יותר מהמקום הראשון ש-ElevenLabs תפסה בזירה האחרת, כי בזירה ההיא הסדר שגרתי והמנצח הוא הקול היקר ביותר בעשירייה הראשונה.
שני הלוחות אינם ניתנים להחלפה, והסיבה שההתמודדות הזו מתפרשת כפי שהיא טמונה כולה בשאלה באיזה מהם אתה מסתכל. ב-Provider Voice המאזינים שופטים את הקולות של כל ספק. Controlled Voice משכפל עבור כל מודל את אותם שמונה קולות — ארבעה אמריקאיים, ארבעה בריטיים — כך שאף אחד לא יכול לנצח בזכות מערך הקולות המוגדר כברירת מחדל שלו. ElevenLabs מנצחת בראשון בפער של 61 נקודות. Alibaba מנצחת בשני בפער של 21. אף אחד מהלוחות אינו שגוי, והשני הוא זה שמנבא מוצר שישוחרר עם קול מותג משוכפל.

לוח התוצאות של הקול המבוקר, במלואו
• העדפה עיוורת, קלונים מותאמים — Qwen-Audio-3.1-TTS-Plus דירוג 1, Elo 1,178, $19.30 למיליון תווים לעומת Eleven v4 דירוג 2, Elo 1,157, $80.00.
• העדפה עיוורת, הקולות של כל ספק — Eleven v4 במקום הראשון, Elo 1,319 לעומת Qwen-Audio-3.0-TTS-Plus במקום הרביעי, Elo 1,258. פער של 61 נקודות בכיוון ההפוך.
• מחיר, נורמליזציית ארנה — Qwen $19.30 לעומת Eleven v4 $80.00. Qwen זול ב-76%.
• מחיר, מחירון ספק — Eleven v4 $0.022 לאלף תווים במחיר מבצע, ו-$0.08 לאחר 12 באוקטובר. את המחירון של Qwen Audio 3.1 עצמו לא הצלחנו לקרוא, ולכן נרמול הארנה הוא המחיר היחיד שאפשר להשוות לפיו.
• גרסה בכל לוח — 3.1 ב-Controlled Voice, 3.0 ב-Provider Voice. אלו דגמים שונים והלוחות אינם ניתנים להחלפה.
• הרשומה של 3.0 ב-Controlled Voice — דירוג 5, Elo 1,124, אותו מחיר של $19.30. גרסת 3.1 שווה 54 Elo יותר מקודמתה במחיר זהה.
• הדורות המוקדמים יותר של Qwen ב-Provider Voice — Qwen3 TTS Flash דירוג 79, Elo 944; Qwen3 TTS דירוג 82, Elo 930.
• ספינת הדגל הקודמת של ElevenLabs עצמה ב-Controlled Voice — Eleven v3 במקום ה-7, Elo 1,073.
• בדיקת שפיות של תרשים עמודות מקובצות — הפיזור השמונה-כיווני מדירוג 1 עד דירוג 10 ב-Controlled Voice הוא 121 Elo. היתרון של 21 נקודות של Qwen על Eleven v4 הוא פחות מחמישית מטווח כל התחום, וזהו קנה המידה הנכון להחזיק בו.

שתי שורות שם עושות את רוב העבודה. הראשונה היא ההשוואה בין 3.0 ל-3.1: Alibaba הזיזה 54 Elo בעדכון גרסה אחד בלי לשנות את המחיר בכלל. זהו קצב מהיר יותר מהמהלך של ElevenLabs מ-v3 ל-v4, שהניב 84 נקודות, וזה אומר שסדר הדירוג הספציפי במאמר הזה הוא תמונת מצב ששני הספקים משנים אותה כל העת.
השני הוא הפער הכולל של 121 נקודות. פער של 21 נקודות בלוח שהטווח השימושי שלו הוא כ-120 נקודות הוא הבדל אמיתי אך צנוע — בערך באותו סדר גודל כמו הפער בין 3.1 של Qwen עצמה ל-3.0 שלה. אם מקרה השימוש שלך נמצא בשפה שאף אחד מהמודלים לא כוונן מולה, המרווח הזה נמצא היטב בטווח שכמה תסריטי בדיקה קשים יכולים להפוך על פיו.
בעיית הגרסה שאיש לא מסמן
התוצאה שמסתובבת בשם "Eleven v4 הוא השני ב-Controlled Voice" מדויקת אך חלקית, וההשמטה חשובה לכל מי שמתכנן על סמך זה. המודל שיושב מעל Eleven v4 בלוח הזה הוא מהדורת 3.1 של Alibaba. הרשומה של Qwen בלוח Provider Voice, לעומת זאת, היא מהדורת 3.0 — מודל 3.1 אינו מופיע בשורות העליונות של הלוח הזה כפי שאנו קוראים אותו. אז שתי הכותרות — "Eleven v4 הוא מספר אחד" ו-"Eleven v4 הוא מספר שתיים" — הן הצהרות על שני מודלים שונים של Qwen בשתי משימות שונות, וגרסת Qwen שניצחה אותו בלוח אחד אינה אותה גרסת Qwen שהוא ניצח בלוח האחר.
זו לא מלכודת שמכוונת לספק כזה או אחר; זו סיבה שלא לתת אמון בכל סיכום בן משפט אחד של שבוע כזה. אם אתם בוחרים בין שתי המערכות האלה, ההשוואה שאתם רוצים היא 3.1 מול v4 על הקול המשובט שלכם, בשפה שלכם, ואף אחד מהספקים לא פרסם אותה.
מה אנחנו יכולים ולא יכולים לומר על Qwen Audio 3.1
כנות לגבי ראיות שווה כאן יותר מטבלת מפרטים מלאה, אז הנה הגבול של מה שהמאמר הזה נשען עליו. מהלוחות של הארנה יש לנו, עבור Qwen-Audio-3.1-TTS-Plus: ציון Elo לקול מבוקר של 1,178, נרמול מחיר של 19.30 דולר למיליון תווים, והעובדה שזו המהדורה הנוכחית בסדרה שהגרסה הקודמת שלה קיבלה 54 נקודות פחות באותו מחיר.
אין לנו, ולא ננחש: את כיסוי השפות שלו, את זמן התגובה שלו, את תקרת הקלט לכל בקשה, אם הוא תומך בהנחיות הגשה מוטבעות, אם הוא מציע שיבוט קול מעבר לשמונת הקולות של הארנה, או על מה הוא מחייב לפי כרטיס התעריפים שלו. כל אלה מתועדים עבור Eleven v4 — יותר מ-90 שפות, תקרה של 10,000 תווים, תגי אודיו, שיבוטים מיידיים של עשר שניות, תמיכה בפונמות IPA — והיעדרם בצד של Qwen הוא פער במה שניתן לקרוא באופן ציבורי, לא פגיעה במודל. החלטת רכישה שתתקבל על סמך המאמר הזה בלבד תהיה החלטה שתתקבל על סמך שני מספרים.

ניגוד אחד בכל זאת שורד את המגבלה הזו, מפני ששני הצדדים מצוינים מטעם הספק או ששניהם מצוינים מטעם הלוח. במחיר, נרמול הלוח הוא המכנה המשותף והוא מעדיף את Qwen ב-76%. באיכות, כאשר הדוברים מותאמים, אותו לוח מעדיף את Qwen ב-21 Elo. שתי השורות האלה ניתנות להשוואה. כל השאר כאן אינו כזה, והמאמר לא יעמיד פנים אחרת.
מדוע דירקטוריון נשלט צריך לשאת משקל רב מהרגיל
רוב השוואות הקול מתחילות כברירת מחדל ממה שטבלת הדירוג מציבה בראש: המודל שאתה כבר אוהב. בהתמודדות הזו יש סיבה עקרונית להעדיף את Controlled Voice, והיא ספציפית ולא כללית.
Alibaba ו-ElevenLabs מתחרות עם נכסים שונים בתכלית. היתרון של ElevenLabs הוא ספריית קולות שנבנתה במשך שנים של ליהוק מוקפד; זה של Alibaba הוא ארגון מחקר שמשחרר גרסאות מודל בקצב מהיר. לוח שמאפשר לכל מתחרה להביא את הקולות שלו מודד את הספרייה באותה מידה שהוא מודד את הסינתיסייזר, ובלוח הזה ElevenLabs מנצחת ב-61 נקודות. אם מסירים את הספריות — אותם שמונה דוברים משובטים לכולם — היתרון עובר לידיים אחרות. אם הקול שהמשתמשים שלך שומעים הוא שיבוט של אדם מסוים, אתה לא קונה את הספרייה של ElevenLabs, ולכן הלוח המבוקר הוא זה שמתאר את הרכישה שלך. אם אתה בוחר מתפריט של קולות מדף, ההפך הוא הנכון, והמרווח של 61 נקודות של Eleven v4 הוא המספר שקובע.
יש סיבה שנייה, פחות נוחה, לתת משקל לתוצאה המבוקרת. לוח דירוג של קולות ספקים מתגמל הרכב קולי ייחודי כברירת מחדל, והרכב קולי ייחודי יכול להיות מפלג באופנים ש-Elo ממוצע מסתיר — מה שמאזין אחד תופס כבעל אופי, מאזין אחר תופס כמאולץ. לוח דירוג של קולות משובטים עם דוברים תואמים מסיר את המשתנה הזה לחלוטין, מה שהופך אותו למדידה הניתנת יותר לשחזור מבין השתיים.
הרצת כל אחד מהם, ומה שאנחנו למעשה מנתבים
OrcaRouter לא מארח את המודלים הקוליים של ElevenLabs וגם לא את אלו של Alibaba. אף אחד מהספקים אינו בקטלוג שלנו, ולכן אין דרך לקרוא לאף אחד מהם דרכנו, והמאמר הזה לא ירמוז אחרת — יש לפנות ל-API של הספק עצמו ולכמה פלטפורמות צד-שלישי עבור שניהם.
מה שכן אנחנו מכסים הוא השכבה שמעל. אם מחסנית הדיבור שלך היא צומת אחד בצנרת גדולה יותר, אנחנו מגישים למעלה מ-200 מודלים מאחורי מפתח API יחיד, כאשר מחירי המחירון של הספקים מועברים הלאה בתוספת של 0%, כך ששינוי מחיר אצל כל גורם במעלה הזרם — כולל חלון המבצע של ElevenLabs ומחיר המחירון הגדול בהרבה שבא אחריו ב-12 באוקטובר — בא לידי ביטוי אצלנו ביום שבו הוא קורה, ולא במחזור החיוב הבא. עבור החלטה שתלויה ביחס מחירים של פי 4, התזמון הזה הוא ההבדל בין השוואה שמזדקנת היטב לבין כזו שנראית שגויה בתוך שלושה שבועות.
ובמקרים שבהם נתיב הקול אינו יכול ליפול, מעבר אוטומטי לגיבוי מעביר תעבורה לרכיב תקין במעלה הזרם במקום להכשיל את הבקשה. בהתמודדות כה צמודה באיכות וכה חד־צדדית במחיר, הארכיטקטורה ההגיונית היא שני המודלים מאחורי נקודת קצה אחת, כשהניתוב קובע את החלוקה — ולא בחירה קבועה שנעשתה על סמך תמונת מצב של טבלת דירוג ששני הספקים יבטלו בתוך רבעון.
פסק הדין, ותאריך תפוגתו
בחר ב-Qwen-Audio-3.1-TTS-Plus אם אתה משכפל קול ומקפיד על עלות. הוא הראשון בטבלה שמחזיקה את הדוברים קבועים, מחירו כרבע מהמחיר, והקו שלו נע מהר יותר — 54 Elo בצעד גרסה אחד בקצב ללא שינוי מרמז שהגרסה הבאה היא הימור טוב יותר מהגרסה הנוכחית על הנייר.
בחר ב-Eleven v4 אם המשתמשים שלך שומעים קולות סטנדרטיים, אם אתה צריך כיסוי בשפות שאתה יכול לאמת לפני ההשקה, או אם מערך התכונות המתועד — תגיות אודיו, שליטה בפונמות, בקשות של 10,000 תווים, שיבוטים של עשר שניות — עושה עבודה במוצר שלך שאותה לוחות הארנה לא מודדים. היתרון שלו של 61 נקודות בלוח קולות הספק אינו דבר של מה בכך, ושתי התכונות שאתה יכול לכתוב אל תוך תסריט הן יכולות, לא ציונים.
קבע תאריך סקירה. Alibaba רשמה תזוזה של 54 Elo בעדכון גרסה במחזור הזה ו-ElevenLabs רשמה תזוזה של 84 לאורך דור שלם, והתעריף המבצעי של Eleven v4 יפוג ב-12 באוקטובר. יהיה מה שתאמר ההשוואה הזו היום, שתי העובדות שסביר ביותר שיהפכו אותה — שחרור של 3.2 ומחיר שהוחזר — שתיהן יגיעו לפני סוף הרבעון.
