
HeyGen Voice מופיע לראשונה במקום #1 ב-Controlled Voice TTS Arena — ומביס את Qwen ואת ElevenLabs בקולות משוכפלים
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 112 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 51 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 404 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
ב-9 באוקטובר 2026, Artificial Analysis הוסיפה את HeyGen Voice לזירת ה-Controlled Voice שלה, והמודל עלה היישר לראשה. HeyGen Voice — המודל הראשון להמרת טקסט לדיבור של HeyGen שנבחן בלוח — קיבל דירוג Elo של 1,202, לפני Qwen-Audio-3.1-TTS-Plus עם 1,186 ו-Eleven v4 Turbo של ElevenLabs עם 1,167. Cartesia Sonic 3.6, שמוביל את לוח Provider Voices הפתוח של האתר, נמצא כאן במקום החמישי עם 1,143. זוהי תוצאה אמיתית בלוח דירוג שנבנה כדי להסיר את המשתנה המבלבל הגדול ביותר בהערכת קול, והיא גם תוצאה בעלת משמעות מאוד ספציפית שקל לפרש יתר על המידה: HeyGen Voice הוא הקול הטוב ביותר בזירה הזו על שמונה קולות ייחוס משובטים, אך עדיין לא אלוף מדוד של הלוח, שעליו תשעים ושישה מודלים.
מה מודד לוח ה־Controlled Voice, ולמה זה חשוב
Artificial Analysis מפעילה שני לוחות דיבור, והם עונים על שאלות שונות. זירת Provider Voices מאפשרת לכל ספק לספק את הקולות המקוריים שלו — קולות ההדגמה המלוטשים שחברה בוחרת כדי לייצג את עצמה — ומדרגת מודלים לפי עד כמה הם נשמעים טוב. לוח הדירוג שלה רחב ומבוסס: תשעים ושישה רשומות, כאשר Eleven v4 Turbo בראש עם 1,328 Elo ו-Cartesia Sonic 3.6 במקום הרביעי עם 1,280.
זירת Controlled Voice עושה משהו צר יותר, ולמי שמוציא מוצר לשוק, שימושי יותר. כל מודל בה מייצר דיבור מאותם שמונה קולות משובטים — ארבעה אמריקאיים, ארבעה בריטיים — כך שההשוואה אינה "למי יש קול שיווקי נחמד יותר" אלא "כיצד כל מנוע מתמודד עם אותו קול, אותו טקסט ואותם תנאי הקלטה". זה הדבר הקרוב ביותר שיש לתעשייה לבדיקת מנוע בתנאים זהים ולא לסרטון הדגמה, וזה הלוח שחשוב אם אתם מתכננים לשבט קול ולמסור אותו למודל TTS.
HeyGen Voice מוביל בו כעת. הפער הוא 16 אלו מעל Qwen-Audio-3.1-TTS-Plus ו-35 מעל Eleven v4 Turbo, עם רווח סמך מדווח של 95% של בערך 1,185 עד 1,219 בנתון של HeyGen. שישה־עשר אלו הוא פער אמיתי אך לא תהום — בלוח כה צפוף, זה ההבדל בין מקום ראשון לשני, ולא בין שמיש לבלתי שמיש.

כאשר HeyGen Voice עדיין לא מדורג
הצד הכנה של תוצאה זו הוא ש-HeyGen Voice אינו מופיע בלוח Provider Voices כלל, והיעדרותו אינה אות לגבי איכות. Artificial Analysis מציינת שמודלים יכולים להיות מושמטים בגלל שאין להם עדיין מספיק הצבעות. מודל בן ימים ספורים, עם זירה אחת בעלת ציון שונה מאחוריו, פשוט לא צבר את נפח המאזינים העיוורים שהלוח הגדול יותר דורש.
אז הקריאה הנכונה ב-10 באוקטובר 2026 היא: HeyGen Voice הוא הקול המדורג במקום הראשון בהשוואת הקולות המשובטים המבוקרת, וכמות לא ידועה מול השדה הרחב יותר. כל מי שמצטט "מודל ה-TTS הטוב בעולם" על סמך המספר הזה מצטט טבלת דירוג קטנה יותר מכפי שהמשפט מרמז.

שני המספרים שמאחורי ה-Elo
• Elo של קול מבוקר — HeyGen Voice: 1,202 (רווח סמך של 95% בערך 1,185–1,219). Qwen-Audio-3.1-TTS-Plus: 1,186. Eleven v4 Turbo: 1,167.
• דירוג Elo לקולות ספקים — HeyGen Voice: לא רשום (אין מספיק הצבעות). Eleven v4: 1,328 במקום #4. Sonic 3.6: 1,280 במקום #4.
• דירוג בשדה המבוקר — HeyGen Voice: #1 מתוך 42 רשומות מדורגות (#42 הוא OpenVoice v2 עם 812).
• מחיר על בסיס הזירה — HeyGen Voice: $30.00 לכל מיליון תווים, המרת הזירה עצמה של תמחור הקרדיטים של HeyGen. Qwen-Audio-3.1-TTS-Plus: $19.30 לכל מיליון תווים. Eleven v4 Turbo: $40.00 לכל מיליון תווים.
• עוגן Elo — OpenAudio S1 היא נקודת הייחוס הקבועה ב-1,000, ולכן HeyGen Voice נמצא 202 נקודות מעל העוגן.
• מי עוד נמצא בחמישייה המובילה — Eleven v4 עם 1,160 ו-Sonic 3.6 עם 1,143 משלימים את החמישייה המובילה אחרי המובילים.

מה HeyGen באמת שחררה
המנוע שמאחורי הערך הוא ה-TTS הפנימי של HeyGen, הנחשף ב-API v3 של החברה.GET /v3/voices היא קריאה שמקבלת מסנן engine שערכיו כוללים orca — מנוע הקול של HeyGen עצמה — לצד starfish ומעבר ישיר לקולות של ElevenLabs. רינדור הדיבור עובר דרך POST /v3/voices/speech; כיוונון לפי בקשה חושף מהירות מ-0.5 עד 1.5 וגובה צליל מ-−50 עד +50 חצאי טונים, עם רמז locale בתקן BCP-47.
הקטלוג מוצג ככולל למעלה מ-300 קולות מוכנים מראש בעשרות שפות. קולות מותאמים אישית מגיעים בשלושה סוגים: עיצוב טקסט-לקול שמייצר עד שלוש אפשרויות מדורגות מתיאור שאורכו מוגבל ל-1,000 תווים, שיבוט מיידי מהקלטה בודדת, ושיבוט מקצועי שאומן על עשרים דקות או יותר של אודיו. זה האחרון הוא החלק שטבלת המובילים Controlled Voice למעשה מעמידה במבחן עומס — שמונת קולות הייחוס האלה הם שיבוטים, ואיכות השיבוט היא המקום שבו מנועי TTS נבדלים.
בתיעוד מוזכרים גם מנועים כניתנים לבחירה לפי קול, מה שאומר ש-HeyGen לא מחייבת אותך להשתמש במודל שלה: אפשר לנתב למנוע קול של צד שלישי דרך ה-API שלה במקום שבו תעדיף אחד כזה. זהו ספק שמגדר את המודל של עצמו, וכדאי לדעת זאת כשאתה קורא טענה על „קול #1” ביחס ל-HeyGen.
מה זה משנה עבור כל מי שבוחר קול
שלוש השלכות מעשיות נובעות מהגעה של תוצאה בקול מבוקר, ואף אחת מהן אינה "להחליף את הכול".
ראשית, אם מקרה השימוש שלכם הוא קול מותג משובט — דובר אחד, שורות רבות — זהו כעת הלוח שעליכם לקרוא, ו-HeyGen Voice הוא המודל שיש לבדוק תחילה. לוח דירוג שבו הקול נשאר קבוע מודד את הדבר שבאמת תעשו.
שנית, אם מקרה השימוש שלך הוא קאסט רחב של דמויות שנשמעות כמו דוברי שפת אם בשפות שהשיבוט שלך אינו מכסה, לוח Provider Voices ותשעים וששת הערכים שבו הם עדיין ההתייחסות הרלוונטית, ול-HeyGen Voice עדיין אין דירוג שם. שום דבר בתוצאה של קול משובט לא מספר לך כיצד המנוע מתמודד עם מאה קולות שונים.
שלישית, למחיר יש כעת מספר, אבל לא כזה שהספק פרסם. הזירה מפרטת את HeyGen Voice ב-$30.00 למיליון תווים, המרה של Artificial Analysis של מערכת קרדיטים שהדף של HeyGen עצמו לעולם אינו מתרגם לתעריף קולי. זה מציב את המוביל החדש מתחת ל-$40.00 של Eleven v4 Turbo ומעל ל-$19.30 של דרג Qwen — מחיר מאמצע הטבלה המשויך לציון של מקום ראשון, ואחד שנגזר ולא מצוטט.
שאלת הניתוב
לבחירת קול יש תכונה שלמרבית בחירות המודל אין: הכשל נשמע למשתמש הקצה בתוך הברה. זה הופך את המעבר לזול לבדיקה ויקר לטעות בו בפרודקשן. הרצת מנוע חדש מאחורי אותו ממשק כמו של המנוע הקיים — משטח API אחד, מפתח אחד, מחיר מחירון של הספק מועבר הלאה ולא מתומחר בתוספת, עם failover אוטומטי לספק קול שני כשבקשה נכשלת — היא הדרך לקבל תשובה אמיתית על האודיו שלך במקום תשובה של טבלת Elo על שמונה קולות ייחוס. שכבת הניתוב של OrcaRouter קיימת בדיוק לצורת החלטה כזו: הצב את המתחרה על חלק מהתעבורה, שמור על המנוע הקיים חם, ותן ל-failover לכסות את החלון שבו המודל החדש אינו מוכח. לוח המובילים אומר לך היכן להסתכל. הוא לא יכול לומר לך איך התסריט שלך נשמע.
מה לצפות בהמשך
שני מספרים יכריעו את הסיפור הזה. הראשון הוא האם HeyGen Voice יצבור מספיק הצבעות כדי להיכנס ללוח Provider Voices, והיכן הוא יעמוד מול 1,328 של Eleven v4 Turbo — מודל שמוביל את הלוח הזה ובכל זאת מפגר בזירה המבוקרת, וזה בדיוק הפער ששני הלוחות נועדו לחשוף. השני הוא האם HeyGen מפרסם תעריף קולי משל עצמו, כך שאפשר יהיה לבדוק את ה-$30.00 שהזירה הסיקה מול מספר של ספק, במקום להסיק אותו מקרדיטים. עד ששניהם יתקיימו, בכורה במקום #1 בלוח המבוקר היא טענה חזקה לגבי איכות של קול משובט — ושאלה פתוחה לגבי כל השאר.
