כרטיס ראשי עבור 'ElevenLabs Eleven v4 נגד Cartesia Sonic 3.6' עם שני כרטיסי ניקוד: ElevenLabs Eleven v4 ב-Elo 1,319, דירוג 1 ו-$80.00 ל-1M תווים; Cartesia Sonic 3.6 ב-Elo 1,276, דירוג 2 ו-$49.00 ל-1M תווים; עם הכיתוב '43 נקודות Elo מול קול זול ב-39%'. כותרת תחתונה: 'Provider Voice Arena, לפי Artificial Analysis, ספטמבר 2026.' הלוגו של OrcaRouter ממוקם בפינה הימנית התחתונה.
Guides & Insights

Eleven v4 מול Cartesia Sonic 3.6: פער Elo של 43 נקודות לעומת קול שזול יותר ב-39%

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ElevenLabs Eleven v4 נמצא גבוה ב-43 נקודות Elo מעל Cartesia Sonic 3.6 ב-Provider Voice Arena של Artificial Analysis — 1,319 מול 1,276 — והוא מנצח גם בלוח Controlled Voice, במקום השני לעומת המקום הרביעי של Sonic 3.6. הוא מפסיד במחיר בפער עצום בכיוון ההפוך: $80.00 למיליון תווים לעומת $49.00, ובערך פי תשעה מהתעריף לתו בכרטיסי התעריפים של הספקים עצמם במהלך חלון ההשקה. זהו מפגש נדיר שבו לוח התוצאות ברור אך ההחלטה עדיין לא, כי שני המודלים לא ממש מתחרים על אותה עבודה.

A two-column scoreboard for ElevenLabs Eleven v4 and Cartesia Sonic 3.6. Eleven v4: Provider Voice rank 1 Elo 1,319; Controlled Voice rank 2 Elo 1,157; $80.00 per 1M chars; $0.022 per 1K until Oct 12; 90-plus languages; latency not stated for v4. Sonic 3.6: Provider Voice rank 2 Elo 1,276; Controlled Voice rank 4 Elo 1,138; $49.00 per 1M chars; $0.049 per 1K; 44 languages; sub-90 ms. Footer: 'Elo and board prices per Artificial Analysis; rate cards and specs vendor-reported.'

מהו כל מודל, בפסקה אחת לכל אחד

ElevenLabs Eleven v4 הושק ב-28 בספטמבר כמודל סינתזת הדיבור המוביל של החברה, לצד Eleven v4 Turbo. התיעוד מעניק לו יותר מ-90 שפות, תקרת קלט של 10,000 תווים לבקשה, דיאלוג רב-דוברים עם זהות דוברת יציבה, תמיכה משופרת בפונמות IPA, והנחיות מוטמעות שמאפשרות לכתוב את אופן ההגשה ישירות לתוך התסריט. שיבוט קול מתבצע מ-10 שניות של אודיו לשיבוטים מיידיים, עם מסלול מקצועי מעל זה.

Cartesia Sonic 3.6 הוא הגרסה הנוכחית של קו דגמים ש-Cartesia ממקמת על בסיס מהירות וטבעיות. עמוד המוצר שלה מכנה אותו המודל המהיר והטבעי ביותר להמרת טקסט לדיבור, וטוען לזמן השהיה של מתחת ל-90 מילישניות, לפעולה רב-לשונית ילידית ב-44 שפות, לשיבוט קול מעשר שניות של אודיו, למילוני הגייה מותאמים אישית, ולמערך תאימות הכולל את HIPAA, SOC 2 Type 2, GDPR ו-PCI. שני הספקים מפרסמים נתוני השהיה עבור המודלים שלהם; אף אחד מהמערכים לא אומת באופן בלתי תלוי, והם אינם נמדדים באותו אופן.

לוח התוצאות, ממד אחר ממד

• העדפה עיוורת, הקולות של כל ספק — Eleven v4 במקום הראשון, Elo 1,319 לעומת Sonic 3.6 במקום השני, Elo 1,276. פער של 43 נקודות.

• העדפה עיוורת, קולות משובטים מותאמים — Eleven v4 במקום ה-2, Elo 1,157 לעומת Sonic 3.6 במקום ה-4, Elo 1,138. פער של 19 נקודות, צר יותר מזה של הראשון.

• נרמול מחירי Arena, למיליון תווים — Eleven v4‏ $80.00 לעומת Sonic 3.6‏ $49.00. Sonic זול ב-39% לפי המכנה המשותף של הלוח.

• מחירון ספק, לכל אלף תווים — Eleven v4 ב-$0.022 במבצע, $0.08 לאחר 12 באוקטובר, לעומת Sonic 3.6 ב-$0.049. Sonic זול יותר ב-39% לאחר תום המבצע.

• כיסוי שפות, מתועד על ידי הספק — Eleven v4 90 פלוס לעומת Sonic 3.6 44. בערך פי שניים.

• מגבלת קלט לכל בקשה — Eleven v4 ‏10,000 תווים לעומת Sonic 3.6 שלא מצוין בעמוד המוצר שלו.

• השהיה, לפי הצהרת הספק — Eleven v4 Turbo כ-150 מ״ש חציוני עד לדיבור הראשון לעומת Sonic 3.6 מתחת ל-90 מ״ש. שוב, בדיקות שונות.

• שיבוט קול — שניהם מעשר שניות של אודיו, שניהם עם דרג מקצועי גבוה יותר.

• בקרות ספירה — Eleven v4 מתעד קלט פונמות IPA ורמת שיבוט מקצועית; Sonic 3.6 מתעד מילוני הגייה מותאמים אישית.

• מצב תאימות — Sonic 3.6 מציין HIPAA, ‏SOC 2 Type 2, ‏GDPR ו-PCI. ElevenLabs מצהירה על עמידתה בדרישות בנפרד מדף המודל ואינה מציבה רשימה תואמת לצד v4.

A screenshot of the Artificial Analysis Provider Voice Arena leaderboard, captured in English, showing ElevenLabs Eleven v4 first at Elo 1,319 with $80.0 per 1M chars, Cartesia Sonic 3.6 second at Elo 1,276 with $49.0, and Google Gemini 3.8 Flash TTS third at Elo 1,267 with $16.5, each with its sample count, confidence interval, arena voice count and release month.

שתיים מהשורות האלה הן אלה שמכריעות פרויקטים אמיתיים. פער ה-Elo הוא 43 נקודות בלוח הקולות של הספק ו-19 בלוח הקולות המשוכפלים — הפער של Sonic נסגר ביותר ממחצית כשהדוברים נשמרים קבועים. זהו סימן ההיכר של מודל שהכיוונון שלו תחרותי וקאסט הקולות המוגדר כברירת מחדל שלו אינו, והוא אומר לך שהבעיה של Sonic בהתמודדות הזו היא בהצגה ולא באיכות הסינתזה.

למה פער המחירים קטן ממה שהוא נראה

השוואת התעריפים הכותרתית מטעה בשני הכיוונים. ה-$0.022 לאלף תווים של Eleven v4 הוא נתון מבצעי עם תאריך תפוגה של 12 באוקטובר; הנתון שנשאר בתום החלון הוא $0.08, וזה גבוה ביותר מ-60% מהמחירון של Sonic 3.6. אבל נרמול הזירה לא מתחשב במבצע: הוא מתמחר את המודלים לפי תעריפי המחירון שלהם ומגיע ל-$80.00 לעומת $49.00, וזו ההשוואה שתישאר נכונה גם בנובמבר.

ישנו סיבוך שני. Cartesia אינה מפרסמת תעריף לפי תו בעמוד המוצר שלה, ולכן נתון $0.049 מגיע מנרמול הארנה ולא מהספק, וייתכן ששני מדי החיוב לא יתאמו בדיוק — הנרמול מניח הנחות לגבי אופן החיוב של ספק. התייחסו לסדר כאל אמין ולאחוזים המדויקים כאל משוערים.

חודש עבודה של חמישה מיליון תווים: Eleven v4 בתעריף המבצעי עולה 110 דולר, ו-400 דולר אחרי 12 באוקטובר. Sonic 3.6 עולה 245 דולר. לכן בשבועיים הקרובים Eleven v4 עולה פחות מחצי מהעלות של Sonic, ואחרי כן הוא יקר ב-63% יותר. כל מי שכותב השוואת רכש היום ומפרסם אותה בחודש הבא יקבל את זה הפוך, אלא אם כן יציין באיזה תעריף השתמש.

הקטע שבו Sonic 3.6 היא התשובה הנכונה

ישנם עומסי עבודה קוליים בסביבת ייצור שבהם לוחות הארנה אינם מודדים את מה שבאמת חשוב, ו-Sonic 3.6 נבנה עבורם.

סוכנים שיחתיים בזמן אמת הם המקרה הברור ביותר. השהיה של פחות מ-90 ms אינה מספר שיווקי בסוכן טלפוני; היא ההבדל בין הפרעה שמרגישה מטופלת לבין תחושה של שיחה שנפלה, ו-ElevenLabs אינה מפרסמת נתון מקביל עבור Eleven v4 עצמו — אלא רק עבור שכבת Turbo, עם חציון של כ-150 ms עד לדיבור הראשון. אם תקציב הסוקטים של הסוכן שלך מצומצם, ייתכן ש-43 נקודות ה-Elo שוות לך פחות מהמילישניות, ובדיקת ה-barge-in שלך תכריע זאת מהר יותר מכל לוח דירוג.

פריסה תחת רגולציה היא השנייה. Cartesia מציינת HIPAA, ‏SOC 2 Type 2, ‏GDPR ו-PCI בעמוד המוצר. רשימת עמידה ברגולציה אינה Elo ואין להחליף אותה באחת; אם סוקר מתחום הבריאות או התשלומים נמצא במסלול השחרור שלכם, השורה הזו בלוח התוצאות גוברת על תשע האחרות.

A screenshot of Cartesia's Sonic product page, captured in English, headed 'Sonic: The fastest and most natural text to speech model' with the claim 'Ranked #1 for naturalness, sub-90ms latency, and natively multilingual across 44 languages', a 'Try Sonic-3.6' button, an 'American English / Jacqueline' voice picker over a support-call sample, a 'Ranked #1 in Speech Arena leaderboard & Speech to Text leaderboard by Artificial Analysis' panel, and a 'Built for Voice Agents' tab strip spanning Naturalness, Reliability, Speed, Scalability, Multilingual, Consistency and Cost.

הגייה דטרמיניסטית היא השלישית, והיא עדינה יותר. קלט פונמות IPA המתועד של Eleven v4 הוא יתרון, אבל מילוני ההגייה המותאמים אישית של Sonic 3.6 הם תהליך העבודה שצוותים עם אוצר מילים גדול של שמות מוצרים בדרך כלל כבר בנו. הסבת מילון היא עבודה אמיתית; למודל שצורך את התוצר שברשותך יש יתרון התחלתי.

כאשר Eleven v4 הוא פשוט המודל הטוב יותר

עם כל האמור, הלוחות כן מודדים משהו, ו-Eleven v4 ניצח בשניהם. ב-Provider Voice הוא מוביל על Sonic 3.6 ב-43 נקודות, עם 1,674 דגימות מאחורי האומדן, והדגל-הספינה הקודם — ElevenLabs Eleven v3 עם 1,169 — נמצא 107 נקודות מאחורי Sonic 3.6, מה שאומר ש-ElevenLabs סגר פער אמיתי בדור אחד במקום להגן על יתרון.

ספירת השפות היא הניצחון החד-משמעי השני. יותר מ-90 מול 44 זה בערך כפול, ולמוצר שמשוחרר מעבר לאנגלית ולקומץ שפות אירופיות, זו שאלה של כיסוי ולא של איכות — ייתכן של-Sonic 3.6 אין בכלל קול עבור חלק מהלוקאלים שלך. והטיפול בדיאלוג עם מספר דוברים יחד עם הנחיות הגשה מוטמעות הם הבדל יכולות אמיתי: כתיבת צחוק לתוך התסריט היא תהליך עבודה ש-Sonic 3.6 אינו מתעד, ולשחזר את האפקט הזה במודל שאין בו זאת משמעו עיבוד בדיעבד או טייק נוסף, מה שעולה יותר ממה שפער ה-Elo מרמז.

להריץ אחד מהם, ואת החלק שאיננו יכולים לעזור בו

OrcaRouter אינו מארח אף אחד מהמודלים הללו. ElevenLabs ו-Cartesia אינם בקטלוג שלנו, כך שאין שום דבר בהשוואה הזו שניתן לקרוא לו דרכנו, והתשובה הכנה לשאלה "איך אני משיג את זה ב-OrcaRouter" היא שאינך יכול — אתה פונה לספק. מה שכן נמצא בטיפולנו הוא המקרה שבו ערימת דיבור סופית משתרעת על פני כמה ספקים ולא ספק אחד: מפתח API יחיד על פני יותר מ-200 מודלים, כאשר מחירי המחירון של הספקים מועברים הלאה בתוספת של 0% כך ששינוי מחיר מצד ספק נכנס לתוקף אצלנו באותו יום שבו הוא נכנס לתוקף. עבור החלטה שתלויה בשאלה אם אתה משלם 110 דולר או 400 דולר עבור אותה כמות תווים בחודש, לתזמון הזה יש משמעות לא קטנה.

כאשר נתיב קולי חשוף ללקוחות ואינו יכול ליפול, מעבר אוטומטי לגיבוי מעביר תעבורה למעלה זרם תקין כאשר אחד מתדרדר. זהו הדפוס שהופך חלון מבצעים של שבועיים לראוי לניצול: ניתן להפנות את הייצור למודל הזול יותר לשבועיים מבלי לשכתב את האינטגרציה, ולחזור כאשר התעריף שב לקדמותו.

מי צריך לעבור, ומי צריך לחכות

עברו ל-Eleven v4 אם המוצר שלכם נשפט לפי איך שהוא נשמע, אם אתם משיקים ביותר משני תריסרים של שפות, או אם המשתמשים שלכם שומעים את הקול שהספק בחר עבורם — הקבוצה האחרונה היא בדיוק זו שמועצת Provider Voice מייצגת, והפער שם הוא הגדול ביותר מבין כל השורות.

הישאר על Sonic 3.6 אם אתה מריץ שיחה בזמן אמת תחת תקציב השהיה, אם בודק ציות מאשר את הסטאק שלך, או אם יש לך מילון הגייה שאינך יכול להרשות לעצמך לבנות מחדש. בשלוש השורות האלה Sonic לא בפיגור; זו האפשרות היחידה עם תשובה שפורסמה.

רגע, בכל אחד מהמקרים, אם ההחלטה שלך תלויה במחיר. בעוד שבועיים המחירון של Eleven v4 משתנה בכמעט פי ארבעה, וזה של Sonic 3.6 לא, והשוואה שנכתבת היום תיראה שגויה עד אמצע אוקטובר. סדר ה-Elo עדיין יחזיק. הכסף לא.