
Qwen3.8-LiveTranslate לעומת Gemini 3.5 Live Translate: אחד מספק מספר, האחר מספק מפה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
שני מודלי התרגום הדיבוריים בזמן אמת המובילים חלוקים בדעתם לגבי מה שהם מוכנים להימדד עליו, ואי-ההסכמה הזו מועילה יותר מכל השוואת מפרטים. Qwen3.8-LiveTranslate, שיצא ב-19 בספטמבר 2026, מוביל בנתון קשה אחד: השהיה ממוצעת של 2.3 שניות, לעומת 2.8 בדור הקודם. Gemini 3.5 Live Translate, מודל הדיבור-אל-דיבור של הספק שהוכרז ביוני 2026 ועדיין נושא מזהה מודל בתצוגה מקדימה, מוביל בטווח הכיסוי — יותר מ-70 שפות, זיהוי אוטומטי, החלפה באמצע השיחה, ואינטגרציה באפליקציות Translate ו-Meet של הספק. חברה אחת פרסמה נתון השהיה שאפשר להעמיד אותה מולו. האחרת פרסמה מספר שפות. אם אתם בוחרים בין השניים, ההבנה מדוע אלו הם סוגים שונים של הבטחות חשובה יותר מאשר איזו רשימה ארוכה יותר.
שתי ארכיטקטורות שמסכימות על המטרה ולא על שום דבר אחר
שני המודלים קיימים כדי להרוג את אותה ההתנהגות: המתרגם מבוסס התורות שממתין שתסיים משפט לפני שהוא אומר משהו. ההשהיה הזו היא מה שגורם לפרשנות מכונה להרגיש כמו פרשנות מכונה.
Qwen3.8-LiveTranslate מגיעה לשם עם ארכיטקטורת Interleave על שלד Hybrid MoE, המחולקת למודול Thinker שמקפל אודיו, וידאו, טקסט מקור ותרגום לרצף סיבתי אחד, ולמודול Talker שמסנתז מחדש את התרגום בגוון הקולי של הדובר המקורי. הטענה היא שכיווץ זיהוי, תרגום וסינתזה לרצף אחד מסיר את השהיה והאובדן הסמנטי שצינור תלת-שלבי משלם עליהם בכל גבול בין מודולים.
Gemini 3.5 Live Translate נוקט באותה עמדה מקצה לקצה מהכיוון השני: הוא בנוי על Gemini 3 Pro כמודל אודיו-לאודיו נייטיבי, וזורם ברציפות דרך Gemini Live API במקום לבצע מפל בדיד של ASR → MT → TTS. בפועל מחזיקים WebSocket דו-כיווני מתמשך, דוחפים מעלה מקטעי אודיו של 100 ms, ומושכים מטה מקטעי אודיו מתורגמים. אף אחד מהמודלים לא עושה את הדבר הישן. שניהם עושים כעת את הדבר החדש. ההבדלים כולם בפרטים מסדר שני.
השוואת זמן האחזור אינה תיקו כפי שהיא נראית.
Google מתארת את Gemini 3.5 Live Translate כמי שנשאר "כמה שניות מאחורי" הדובר. היא לא פרסמה נתון LAAL, או כל מדד השהיה אחר בעל שם ובר-שחזור, עבור המודל. Qwen פרסמה 2.3 שניות והגדירה מה זה אומר.
חוסר הסימטריה הזה נשטח באופן שגרתי לכדי "שניהם בסביבות שתיים עד שלוש שניות". הפרשנות הזו אינה נתמכת בשום דבר שאמרה מי משתי החברות. הניסוח של גוגל מתיישב עם 2 שניות ומתיישב עם 4; החברה פשוט סירבה להיות מוצמדת. ההשוואה שאפשר למעשה לערוך היום היא:
• מדד השהיה שפורסם — Qwen3.8-LiveTranslate: LAAL 2.3 שנ׳, לפי דיווח הספק. Gemini 3.5 Live Translate: לא פורסם.
• מדידת השהיה בלתי תלויה — לא זה ולא זה, באף אחד מהמודלים. אף צד שלישי לא פרסם השוואה ישירה.
המסקנה הכנה היא שבכל הנוגע לשהיה, Qwen הציגה טענה הניתנת להפרכה ו-Google הציגה טענה מעורפלת. זוהי נקודה לזכות Qwen בכל הנוגע לשקיפות, ואפס נקודות בדיוק לזכותה בכל הנוגע לביצועים, עד שמישהו ימדוד את שניהם. אם השהיה היא הגורם המכריע בפריסה שלך, מצב הראיות הנוכחי אינו תומך בהחלטת רכישה באף אחד מהכיוונים.

60 שפות לעומת יותר מ-70 זה לוח התוצאות הלא נכון.
ספירות השפות מצוטטות כל העת והן מטעות בשני הכיוונים.
Qwen3.8-LiveTranslate מזהה 60 שפות מקור ומפיק פלט מדובר ב-29 מהן. Gemini 3.5 Live Translate תומך ביותר מ-70 שפות עם זיהוי אוטומטי, וב�Google Meet זה מתרחב ליותר מ-2,000 צירופי שפות, כאשר התקרה הקודמת הייתה תרגום מבוסס אנגלית בחמש שפות.
קרא בעיון את המספר השני לפני שאתה מתייחס אליו כאל ניצחון משולש. הנתון של יותר מ-2,000 של גוגל סופר זוגות סדורים — כל שפת מקור מוצלבת עם כל שפת יעד — שזהו מדד לגיטימי ושימושי באמת לכיסוי, אך אינו ניתן להשוואה לספירה של שפה בודדת. והרשימה של גוגל, אף שהיא רחבה יותר, מוטה במידה רבה לעבר שפות עם אוכלוסיות דוברים גדולות: אפריקאנס, ערבית, בנגלית, הולנדית, אנגלית, צרפתית, גרמנית, הינדי, אינדונזית, איטלקית, יפנית, קוריאנית, מלאית, פרסית, פולנית, פורטוגזית, רוסית, ספרדית, סווהילית, טמילית, טלוגו, תאית, טורקית, אוקראינית, אורדו, וייטנאמית, זולו. 29 שפות הפלט המדובר של Qwen צרות אף יותר, ואף אחת מהרשימות של הספקים אינה מהווה תשובה רצינית לזנב הארוך — הניבים האזוריים והשפות בעלות המשאבים הנמוכים שבהם כלי תרגום נכשלו היסטורית בצורה הקשה ביותר. שתי החברות אומרות שהן עובדות על זה. אף אחת מהן לא שחררה זאת.
היכן ששני הדברים באמת נבדלים: החדר מלא האנשים
המקום היחיד שבו המודלים מציעים הבטחות שונות באמת הוא הטיפול בריבוי דוברים, וזהו ההבדל שסביר ביותר להכריע בפריסה אמיתית.
Qwen3.8-LiveTranslate מספק דיאריזציה של דוברים בזמן אמת: כל משפט מיוחס לדובר עם הגעתו, ושכפול הקול מתואר כיציב לאורך החלפות תורות. Qwen מדווחת בעצמה על שיעור שגיאה של 9.7% בדיאריזציה בסט הבדיקה הארוך שלה עם ריבוי דוברים, לעומת 30.6% עבור Seed LiveInterpret 2.0 — השוואת ספק בהערכה שהספק מריץ, ולכן יש להתייחס לכך כאל טענה עם מספר מצורף ולא כתוצאה. המודל גם מפיק טקסט מקור ותרגום על אותו ציר זמן, וזה מה שמאפשר כתוביות דו-לשוניות מסונכרנות בלי מעבר יישור נפרד.
Gemini 3.5 Live Translate שמה דגש הפוך. החוזק המתועד שלה הוא שימור פרוזודיה — שמירה על גובה הצליל, הקצב, האינטונציה והרגיסטר הרגשי של הדובר, כך שהקול המתורגם נושא את התחושה של המקור. החולשות המתועדות שלה הן בדיוק במקום שבו דיאריזציה הייתה עוזרת: שיבוט קול לא עקבי שיכול לסטות לאחר הפסקות ארוכות או לנחות על המין הלא נכון, ניהול תורות דיבור חלש ללא אות ברור לסוף משפט, קושי עם מבטאים חזקים ועם זוגות שפות קרובות כמו ספרדית ופורטוגזית, וטיפול לא מושלם ברעשי רקע. בנוסף, Google מגבילה מפגשי אודיו טהורים ל-15 דקות אלא אם כן הוארך, ומטביעה כל זרם אודיו שנוצר עם סימן מים SynthID שלא ניתן להסירו כרגע.
• ייחוס רב-דוברים — Qwen: דיאריזציה בזמן אמת, DER מדווח של 9.7%. Gemini: חילופי תורות חלשים מתועדים, ללא הצהרה על דיאריזציה.
• נאמנות קולית — Qwen: שחזור גוון המקור באמצעות מודול Talker. Gemini: שימור הפרוזודיה, גובה הצליל והקצב; תועדה סחיפת שיבוט.
• פלט דו-לשוני — Qwen: מקור ותרגום נפלטים על אותו ציר זמן. Gemini: תמלול קלט ופלט אופציונלי, מוגדר לכל סשן.
• סימון מים — Qwen: לא צוין. Gemini: SynthID על כל אודיו שנוצר, אין נתיב להסרה.
• אורך הסשן — Qwen: לא צוין. Gemini: הגבלה של 15 דקות בסשנים של אודיו בלבד.
• סוגי קלט — Qwen: אודיו ותמונה. Gemini: אודיו בלבד, ללא קלט טקסט.

מה העלות של הפעלה בפועל של כל אחד מהם
Qwen3.8-LiveTranslate מתומחר לפי מיליון טוקנים באמצעות WebSocket Realtime API. באזור סינגפור: $7.50 קלט אודיו, $0.55 קלט תמונה, $20.00 פלט טקסט, $30.00 פלט אודיו. בבייג'ינג: ¥40 / ¥3.3 / ¥100 / ¥160 למיליון — בערך $5.65 / $0.47 / $14.13 / $22.61. ההקשר שלו הוא 53,248 טוקנים, ומגבלת הקצב היא 10 בקשות בדקה ו-100,000 טוקנים בדקה בשני האזורים.
תקרת 10 ה-RPM הזו היא המספר המשמעותי ביותר בכרטיס התעריפים. התנאים המסחריים של Gemini 3.5 Live Translate אינם מפורסמים באותו אופן, וזה כשלעצמו אות לגבי בגרות: גוגל מפיצה אותו דרך Live API ו-AI Studio בתצוגה מקדימה ציבורית, Google Meet בתצוגה מקדימה פרטית עבור לקוחות Workspace נבחרים, ואפליקציית Translate ב-Android וב-iOS. תמחור תצוגה מקדימה ומגבלות קצב בתצוגה מקדימה כפופים לשינוי ללא הודעה מוקדמת, וגוגל לא התחייבה לתאריך GA.
אז השוואת העלויות כרגע היא בין מודל עם מחיר מפורסם ותקרת מקביליות קשיחה, לבין מודל בלי מחיר מפורסם ותקרה לא מוגדרת. אם אתם צריכים למדל את כלכלת היחידה ברבעון הזה, רק אחד מאלה ניתן לתקצוב.

מה שבדיקה עצמאית תצטרך להראות
כל מה שלמעלה מבוסס על ההודעות של שני הספקים עצמם, מכיוון שאיש לא הריץ את המודלים האלה זה מול זה. תוצאה שבאמת תכריע בהתמודדות הזו דורשת ארבעה דברים, ואף אחד מהם עדיין לא קיים:
• LAAL נמדד באותה צורה בשני המודלים, על אותו אודיו, באותם זוגות שפות — לא ניתן להשוות את הנתון של 2.3 s של Qwen לשום דבר שגוגל סירבה לציין.
• שיעור שגיאת דיאריזציה על מאגר משותף מרובה-דוברים, ולא על סט ה-Omnilingua-MSpeaker של Qwen.
• יציבות שיבוט קול לאורך מפגשים ארוכים — וזה בדיוק התחום שבו התיעוד של Gemini עצמו מצביע על סחיפה, enquanto Qwen מציגה את הטענה החזקה ביותר שלה.
• התנהגות במגבלות המקביליוּת — האם 10 ה-RPM של Qwen מחזיקים מעמד תחת עומס פגישות אמיתי, והאם מכסות התצוגה המוקדמת של Gemini ישרדו את המפגש עם סביבת הייצור.
עד שמבחן זה יתקיים, העמדה הניתנת להגנה היא צרה: Qwen פרסמה יותר והבטיחה דברים ספציפיים יותר; ל-Google יש כיסוי שפות רחב יותר וטביעת רגל הפצתית שאף מודל מבוסס API בלבד לא יכול להשתוות אליה.
איזה אחד לבחור?
בחר לפי צורת הבעיה שלך, לא לפי לוח התוצאות, כי לוח התוצאות עדיין אינו מהימן.
אם עומס העבודה שלכם הוא רב-משתתפים ולייחוס יש חשיבות — תמלול פגישות, פאנל, אולם בית משפט, כל דבר שבו הידיעה מי אמר משפט מתורגם היא חלק מהערך — Qwen3.8-LiveTranslate הוא היחיד מבין השניים שמצהיר על היכולת הזו, וחולשת חילוף התורות המתועדת של Gemini מצביעה לאותו כיוון. אם עומס העבודה שלכם הוא רב-לשוני, פונה לצרכנים, וכבר נמצא בתוך המערכת האקולוגית של Google, אזי למעלה מ-70 השפות של Gemini 3.5 Live Translate והנוכחות שלו באפליקציית Translate וב-Meet הם יתרונות שאף מתחרה מבוסס-API בלבד לא משתווה להם בהפצה.
אם אתם בונים מוצר ולא קונים דמו, שימו לב ששניהם מומחים צרים. אף אחד מהם לא מריץ לולאת סוכנים, אף אחד מהם לא מסכם, ו-Qwen3.8-LiveTranslate מציין במפורש שאין תמיכה בקריאה לפונקציות, אין פלט מובנה, אין מטמון הקשר ואין כיוונון עדין. המתרגם הוא חזית הצינור שלכם, לא כולו. OrcaRouter אינו המקום לקרוא לאף אחד משני מודלי התרגום היום — אף אחד מהם אינו בקטלוג שלנו, ואנחנו מעדיפים לומר זאת מאשר לרמוז אחרת. מה שכן אנחנו מספקים הוא החצי של המחסנית שצורך את התמלול: מפתח אחד ליותר מ-200 מודלים במחיר המחירון של הספק, עם אפס תוספת מחיר, כך שאפשר להחליף את המסכם, את אוכף המונחים או את הסוכן במורד הזרם שקורא את התמלול הזה, או לבצע failover, בלי לגעת בחוזה של ספק שני.
התחתית של זה
Qwen3.8-LiveTranslate ו-Gemini 3.5 Live Translate קרובים מספיק ביסודות עד כדי כך שהשיווק הפך לגורם המבדיל: האחד פרסם נתון השהיה ומחירון, האחר פרסם מפת שפות ואקוסיסטם. אף אחד מהם לא העמיד את עצמו למבחן בלתי תלוי. הגרסה של העימות הזה ששווה לקרוא היא זו שתיכתב אחרי שמישהו יריץ את שניהם על אותו אודיו — ולאור הקצב שבו הקטגוריה הזו מתקדמת, ייתכן שזה לא רחוק.
השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
