
Breeze TTS 2: מנהיג ה-TTS החדש עם משקלים פתוחים ב-1,215 Elo
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 523 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 187 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
Breeze TTS 2 הוא כיום מודל טקסט‑לדיבור בעל המשקלים הפתוחים המדורג ראשון ב‑Provider Voices Speech Arena של Artificial Analysis, עם 1,215 Elo — בפער של 90 נקודות מעל המוביל הקודם במשקלים פתוחים, Fish Audio S2 Pro, ומדורג במקום ה‑6 הכללי מתוך יותר מ‑100 מערכות מדורגות. רישום זה הוא האישור העצמאי הראשון לטענת BreezeBlue מאז שהשיקה את המודל באמצע אוגוסט 2026: שמודל קולי בן שבועיים מחברה של כ‑15 איש יכול לשבת בחזית מערכות טקסט‑לדיבור המסחריות. המשקלים הפתוחים עלו ל‑Hugging Face ב‑25 באוגוסט 2026; תוצאת הזירה הגיעה תוך יום. ומה שיהיה בסופו של דבר, Breeze TTS 2 אינו עוד הבטחת ספק — יש לו Elo שאומר זאת.
מה באמת קרה, לפי הסדר
ציר הזמן חשוב כאן, כי הוא מסביר מדוע פוסט "לוח מובילים למשקלים פתוחים" מגיע מחברה שרוב האנשים לא שמעו עליה לפני שלושה שבועות. BreezeBlue נוסדה על ידי יאנג בין, לשעבר שותף טכני מייסד של אחת ממעבדות הבינה המלאכותית המובילות בסין, בסבב סיד של 6 מיליון דולר בהובלת Yuanjing Capital ו-Redpoint China. המודל עבר דרך שלוש אבני דרך נראות לעין:
• 7 באוגוסט 2026 — BreezeBlue פרסמה ב-Hugging Face חבילת אמות מידה משלה לטקסט-לדיבור, להערכת עיצוב קול, בימוי קול והשהיה.
• 16–17 באוגוסט 2026 — החברה הכריזה רשמית על Breeze TTS 2 כמודל קול דגל בזמן אמת למדיה אינטראקטיבית, ופתחה API מתארח במחיר של 34 דולר למיליון תווים.
• 25 באוגוסט 2026 — משקלי המודל וקוד ההסקה של PyTorch שוחררו כקוד פתוח ב-Hugging Face תחת השם BreezeBlue/Breeze-TTS-2, מודל עם 3B פרמטרים ברישיון למחקר ולא לשימוש מסחרי.
דירוג ה-Artificial Analysis Provider Voices היה זמין בתוך ימים ספורים מהשחרור של המשקלים הפתוחים. מכיוון שהזירה מדרגת מודלים בהאזנה עיוורת זה לצד זה, ה-1,215 Elo אינו מדד שבריזבלו הריצה על עצמה — הוא שיקול הדעת המצטבר של מאזינים שהשוו דגימות אמיתיות, וזה בדיוק מה שחסר ביותר למודל כה צעיר.
לוח התוצאות

• דירוג Arena — #6 בסך הכל ב-Provider Voices; #1 בקרב כל המודלים עם המשקלים הפתוחים, לפני Fish Audio S2 Pro (1,125 Elo).
• Elo — 1,215, עם רווח בר-סמך של 95% שהוא בערך ±17 (Artificial Analysis, נכון לסוף אוגוסט 2026).
• שפות — 50, לפי BreezeBlue; כרטיס המודל מתויג כאנגלית וסינית.
• מחיר — 34 דולר למיליון תווים בנקודת הקצה שמארח BreezeBlue; המשקלים הפתוחים זמינים להורדה בחינם אך כוללים רישיון לא-מסחרי.
• מהירות — ~45 תווים לשנייה במדידות של Artificial Analysis — איטי יותר מכמה מתחרים, מה שחשוב למשימות ארוכות.
• השהיה — השהיית סטרימינג של פחות מ-40 מילישניות, לפי BreezeBlue (כפי שהצהיר הספק, לא נמדד באופן עצמאי).

מה בעצם Breeze TTS 2 עושה אחרת
ה-Elo מקבל את הכותרת, אבל הטענה על המוצר מעניינת יותר מהציון. Breeze TTS 2 בנוי סביב שני רעיונות שרוב מודלי הטקסט-לדיבור מתייחסים אליהם כמחשבה שנייה: עיצוב קול ובימוי קול. עיצוב קול הוא zero-shot וללא דוגמת ייחוס — אתה מתאר קול בשפה טבעית ("קריין חם, באמצע שנות ה-40, עם מבטא דרומי קל ושנינות יבשה") והמודל מייצר את הקול הזה ללא הקלטת אולפן או קטע ייחוס. בימוי קול מפריד בין גוון הקול של הדובר לבין כוונת ההגשה, כך שתוכל לגרום לשורה להישמע סרקסטית, לחושה או ממהרת, בלי שהמודל יחליק לדמות אחרת. BreezeBlue אומר שזהותו של אותו דובר נשמרת במעבר, ומדד ביצועי בימוי הקול שלו מדווח על דמיון דובר של 0.67 SPK_SIM (דיווח ספק).
שתי היכולות הללו מצביעות על השוק המיועד של Breeze TTS 2. חומרי העיתונות מפורשים: דמויות משחקי וידאו, בני לוויה דיגיטליים, סיפור נרטיבי, דרמה משודרת וסטרימרים וירטואליים — אודיו ארוך-פורמט, מונחה-תפקידים ורב-דמויות, לא סתם עוד API לנראציה. החברה משווקת ספריית קולות נלווית בשם Voice Galaxy הכוללת יותר מ-15,000 קולות דמויות שיצרו הקהילה והאולפנים, וריל ההדגמה של BreezeBlue הוא דרמת רדיו מעריצים רבת-דמויות שנמשכת למעלה מעשר דקות. במדדים שפרסמה בעצמה (מדווח על ידי הספק, ללא שכפול), Breeze TTS 2 טוען למקום הראשון במדד Voice Design לטקסט-לדיבור, עם ציון Role Fit של 78.02 לעומת 72.78 עבור MiMo-V2.5-TTS, וציון משולב של 4.25 ב-Voice Direction.
כוכבית הרישיון
לפני שהביטוי "open weights" עושה יותר מדי עבודה שיווקית, קראו את כרטיס המודל. Breeze TTS 2 הוא 3B פרמטרים, safetensors, F32/BF16, והקוד המקור הוא Apache 2.0 — אבל המשקלים, המודלים הנגזרים והפלטים באירוח עצמי מורשים לשימוש מחקרי ולא-מסחרי בלבד, תחת breezeblue-research-and-non-commercial-license. כלומר, "open weights" כאן אינו "חופשי למוצר שלך." אירוח עצמי מסחרי אינו מותר לפי הרישיון כפי שהוא מנוסח; המסלול המסחרי הוא ה-API המאוחסן במחיר של $34 למיליון תווים. זו אותה מתכונת כמו כמה מהדורות פתוחות אחרות של 2026 — ניתנות לבדיקה ולאירוח עצמי למחקר, אבל השימוש שמייצר הכנסות שמור לנקודת הקצה של הספק עצמו.
למה ראוטר חשוב למודל כל כך צעיר
הסיכון הכנה עם Breeze TTS 2 כרגע אינו איכות — אלא גיל. המודל פעיל כבר עשרה ימים, והמשקלים — יומיים. אף צוות הפקה לא צריך להמר על צינור קול על מודל כה צעיר בלי דרך לנטוש אותו, וזה בדיוק מצב הכשל ששכבת ניתוב קיימת כדי לספוג. אם תבחנו את Breeze TTS 2 דרך שער שמתייחס לנקודת הקצה של הספק כאל מסלול אחד בין רבים, תקבלו את המוביל ב-Elo היום, מעבר אוטומטי לספק חלופי כאשר ה-API אינו תקין, ושינוי בשורה אחת אם מודל בן שבוע מראה רגרסיה. זוהי אותה משמעת ש-DSL הניתוב מיישם על כל מודל: הרכיבו אותו עם חלופות, שמרו על ממשק יציב, ותנו למודל להוכיח את עצמו לפני שתהפכו אותו לעמוד תווך. אף אחד מהמודלים בסדרה זו אינו מנותב עדיין ב-OrcaRouter עצמו, לכן העצה הכנה היא לחבר את Breeze TTS 2 לכל שער שאתם כבר מריצים — ולהשאיר את הספק הנוכחי שלכם פעיל לצידו בעוד מדד ה-Elo מתבגר ונעשה מהימן יותר.
מה לצפות בהמשך
ספק הקולות #1-משקלים פתוחים הוא הסיפור של היום, אבל זו הזירה החלשה יותר מבין השתיים עבור המודל הזה. בזירת הקולות המבוקרים של Artificial Analysis, שבה כל המודלים מושווים על אותם קולות ייחוס קבועים, Breeze TTS 2 מדורג במקום ה-#3 מבין המודלים עם משקלים פתוחים עם 1,002 נקודות Elo, מאחורי Voxtral של Mistral עם 1,010 — ובמקום ה-#16 בסך הכול מתוך 39. הפער בין הציון שלו בקולות ספק (1,215, #1 פתוח) לציון שלו בקולות מבוקרים (1,002, #3 פתוח) ראוי למעקב: הוא מרמז שהיתרון של Breeze TTS 2 מרוכז בקולות שהוא מעצב לעצמו, וזו בדיוק טענת המוצר, וזו גם בדיוק הטענה שבenchmark בלתי תלוי צריך להמשיך ללחוץ עליה. שימו לב האם ה-Elo בקולות מבוקרים נסגר לכיוון המספר של קולות הספק, האם הרישיון המסחרי מתהדק או מתרופף, והכי חשוב — האם מישהו משחזר את מדדי עיצוב הקולות וכיוון הקולות מחוץ לסוויטה הפרטית של BreezeBlue.
למודל שלא היה קיים לפני חודש, Breeze TTS 2 כבר זכה בדבר השימושי ביותר שמודל טקסט-לדיבור יכול לזכות בו: ציון עצמאי שתואם לשיווק. האם הוא יהפוך לקול ברירת מחדל למוצרים אינטראקטיביים תלוי פחות בעדכון ה-Elo הבא ויותר באופן שבו הרישיון וסיפור האירוח העצמי יתפתחו — אבל נכון לשבוע הזה, לטקסט-לדיבור במשקלים פתוחים יש מנהיג חדש, והוא בן שבועיים.

