כרטיס כותרת ראשי עבור Gemini 3.8 Live מול GPT-Live-1 עם הקיקר 'OrcaRouter · מכ"ם מודלים — ראש בראש' וכותרת המשנה 'דופלקס מלא מול מבוסס תורות - הוויכוח הארכיטקטוני, קריאה חוזרת.' שני כרטיסים מציגים 'Gemini 3.8 Live — מבוסס תורות, ראייה היום, 97 שפות, דקות זולות יותר' ו-'GPT-Live-1 — דופלקס מלא, ערוצי משנה, מאציל לבקאנד מתקדם', עם צ'יפים עבור אינדקס 76.0 מול 81.5, $0.018 מול $0.05 לדקה, ווידאו בקרוב ב-OpenAI. הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Gemini 3.8 Live לעומת GPT-Live-1: דופלקס מלא לעומת המודל שחושב תוך כדי דיבור

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

במשך כחודשיים בערך, הוויכוח הוכרע על ידי הארכיטקטורה. GPT-Live-1הוא באמת דופלקס מלא — הוא מקשיב תוך כדי דיבור, משמיע תגובות קצרות כמו "מהמ" ו"הבנתי", ומחליט כמה פעמים בשנייה אם לדבר או לוותר על התור. Gemini 3.8 Live, שהוכרז ב-15 בספטמבר 2026, הוא מודל מבוסס תורות. לפי המסגור הישן, זה הפך את ההשוואה לקלה, ועכשיו זו הדרך הלא נכונה לקרוא אותה.

מה שהשתנה הוא לא ש-Google השיגה דופלקס מלא. אלא ש-Google שחררה את הדבר שעבורו השתמשו בדופלקס מלא כפיצוי: מודל קולי שמסוגל לנהל שיחה בזמן שמשימה רבת-שלבים רצה ברקע, וגרסה שנייה שמנמקת בקול רם בזמן שהיא עובדת. ההבדל הארכיטקטוני אמיתי. הוא פשוט כבר לא הציר שמכריע את הרכישה.

שתי דרכים לשמור על שיחה בחיים

ההימור של דופלקס מלא הוא שאיכות השיחה היא המוצר. GPT-Live-1 מעבד אודיו קלט ופלט ברציפות ובאופן סינכרוני בתוך מודל יחיד, במקום לשרשר המרת דיבור לטקסט אל תוך מודל שפה ואל תוך המרת טקסט לדיבור. זה מבטל את אובדן המידע בין השלבים, ומייצר את ההתנהגות שאנשים באמת שמים לב אליה: אפשר לקטוע אותו באמצע התשובה והוא מסתגל; הוא לא מתבלבל בין הפסקה או רעש רקע לבין סוף התור שלך; הוא נשאר שקט עד שפונים אליו.

ההימור מבוסס התורות ש-Gemini 3.8 Live מהמר עליו הוא שהשיחה היא פיגום לעבודה. התכונות שלו נועדו לשמור על הסשן פרודוקטיבי ולא על קצב טבעי: עיבוד קלט חזותי כמעט בזמן אמת, מעבר אוטומטי בין 97 שפות נתמכות באמצע השיחה, והרצת כלים ו-API ברקע שמאשרת קבלת בקשה וממשיכה לדבר עד להשלמת הקריאה.

שני המודלים מסרבים לנתק אותך בזמן שהם חושבים. הם פשוט מסרבים בדרכים שונות. GPT-Live-1 עושה זאת בכך שלעולם לא מפסיק את זרם האודיו. גוגל עושה זאת בכך שהיא מדברת תוך כדי העבודה.

A two-column scoreboard comparing Gemini 3.8 Live and GPT-Live-1. Index score 76.0 vs 81.5; architecture turn-based vs full-duplex; video and screen available today vs not at launch; agentic tau-Voice not published vs 67.9%; languages 97 vs a narrower set; voice price $0.005 in and $0.018 out per minute vs $0.05 per minute plus backend tokens. Footer reads 'Index figures per Artificial Analysis, Sep 16 2026; GPT-Live-1 all-in measured at $4.47-$5.83 per hour.' The OrcaRouter logo is composited in the bottom-right corner.

מה שהמדד בעצם אומר

Artificial Analysis מתחזקת מדד Speech to Speech — הרכב משוקלל של הסקת דיבור, ביצועים אג'נטיים, העדפת זירה ושיעור הצלחה במשימות. קראו בעיון את הלוח שתועד ב-16 בספטמבר 2026, משום שהכותרת מסתירה את המבנה:

Gemini 3.8 Live Extended Thinking — 82.6 (ראשון)

• GPT-Live-1 (צד שרת Astra, מאמץ בינוני) — 81.5

Grok Voice Think Fast 2.0 High — 81.3

• GPT-Live-1 (בקאנד Sol, מאמץ נמוך) — 80.1

Gemini 3.8 Live — 76.0

• GPT-Realtime-2.1 High — 73.9

• Gemini 3.1 Flash Live High — 71.5

שלושה דברים נובעים מהסדר הזה. ראשית, ל-Google יש את המקום הראשון, אבל יש לה אותו עם הגרסה היקרה, לא זו שרוב האנשים יפרסו. שנית, GPT-Live-1 מופיע פעמיים, מפני ש-Artificial Analysis מדרגת את המערכת כולה ולא את הפרונט-אנד הקולי — והפער של 1.4 נקודות בין שתי התצורות שלו גדול פי שבעה מהפער של 0.2 נקודות בין המקום הראשון לשני. שלישית, המודל שבכותרת ההתמודדות הזו, Gemini 3.8 Live, נמצא במקום החמישי, מתחת לשתי התצורות של GPT-Live-1.

אם אתם משווים באופן שקול — את המסלול הסטנדרטי מול המסלול הסטנדרטי — GPT-Live-1 מנצח בעימות הזה במדד המשולב, וזה לא צמוד. ה-82.6 שייך ל-Gemini 3.8 Live Extended Thinking, שהוא מוצר אחר במחיר אחר עם פריסה אחרת.

Screenshot of the Artificial Analysis Speech to Speech leaderboard page, captured September 16, 2026. The AA-Speech to Speech Index bar chart shows Gemini 3.8 Live Extended Thinking at 82.6 in first place, GPT-Live-1 (Astra) at 81.5, Grok Voice Think Fast 2.0 at 81.3, GPT-Live-1 (Sol) at 80.1 and Gemini 3.8 Live at 76.0, alongside speed and cost-per-hour-of-input-audio panels.

איפה GPT-Live-1 עדיין מוביל

דופלקס מלא אינו הבחנה שיווקית, ופיצול הבנצ'מרק מראה היכן הוא הופך ליתרון אמיתי:

ביצועים סוכניים — GPT-Live-1 מוביל באופן חד-משמעי ב-τ-Voice עם 67.9% לעומת 56.5% של Grok. גוגל לא פרסמה נתון τ-Voice דומה עבור Gemini 3.8 Live, אלא רק 68.6% עבור גרסת ה-Extended Thinking.

דינמיקת שיחה — לקיחת תורות בדופלקס מלא נותרת אמת המידה לטבעיות, ומודלים מבוססי תורות פיגרו אחריה היסטורית.

עומק האצלה — GPT-Live-1 מעביר שאילתות קשות למודל טקסט מתקדם, כאשר גם GPT-5.5 וגם GPT-6 Astra מתועדים כ-backends, וחושף בוררי מאמץ חשיבה.

איסוף מקורות — תמלולי קול מ-ChatGPT כוללים קישורי ציטוט, דבר שנשאר נדיר באופן כללי באינטראקציות קוליות.

המשקל הנגדי הוא ש-GPT-Live-1 מפגר ביכולות הסקה גולמית בדיבור: 90.1% ב-Big Bench Audio לעומת 97.2% של Grok. ונתון השהיה הכותרתי שלו של 0.798 שניות ב-Full Duplex Bench הוא מדידה שונה מהזמן של ה-API עד לאודיו הראשון, שנע בין 1.24–1.34 שניות.

היכן Gemini 3.8 Live מוביל

היתרונות של Google פחות נוגעים לשיחה ויותר למה שהסשן יכול לעשות:

ראייה, נכון להיום — Gemini תומך בקלט מצלמה ובשיתוף מסך זה זמן מה. GPT-Live-1 הושק ללא וידאו או שיתוף מסך, כאשר OpenAI אומרת שהם בדרך ומצביעה על Advanced Voice Mode הישן יותר כפתרון זמני. Gemini 3.8 Live מוסיף על כך עיבוד קלט חזותי כמעט בזמן אמת.

כיסוי שפות — 97 שפות נתמכות עם החלפה אוטומטית באמצע השיחה, לעומת היצע צר בהרבה בצד של OpenAI.

עלות — התעריף המוכרז הוא 0.005 דולר לדקת קלט אודיו ו-0.018 דולר לדקת פלט אודיו. GPT-Live-1 מחויב ב-0.05 דולר לדקת קול עבור ה-Front-end בלבד, עם עלות מדודה כוללת של כ-4.47–5.83 דולר לשעה לאחר חישוב אסימוני ה-Back-end.

שכבה שנייה שמנמקת בקול רם — Gemini 3.8 Live Extended Thinking מתארת את ההתקדמות עם רמזים כמו "תן לי לבדוק את זה…", שזו תשובה שונה לבעיית השקט מזו של full-duplex.

השוואת העלויות שמשנה

תעריפי הקצה נראים כמו מפלה מוחצת — $0.018 לעומת $0.05 לדקה — והנתונים לשעה חדים אף יותר. התרשים של Artificial Analysis של עלות לשעת אודיו קלט מציב את Gemini 3.8 Live ב-$1.50 לשעה, לעומת $4.14 עבור GPT-Realtime-2 High ו-$10.75 עבור GPT-Realtime-2.1 High. ‏Grok Voice Think Fast 2.0 עומד על $4.80.

המלכוד הוא שאף אחד מהמספרים אינו החשבון האמיתי. ה-$0.05 לדקה של GPT-Live-1 מכסה רק את החזית הקולית; מודל הטקסט בצד האחורי, זה שמבצע את החשיבה בפועל, מחויב בנפרד — וכך כותרת של $0.05 הופכת ל-$4.47–$5.83 לשעה בסך הכול. ל-Gemini 3.8 Live יש אותו מבנה — הרצת כלים ברקע היא עבודה של מודל טקסט — ו-Google לא פרסמה כמה זה עולה.

אז הקריאה הכנה היא ש-Gemini 3.8 Live זול יותר במחיר ההתחלתי, ובפער ניכר, וההשוואה הכוללת אינה ידועה עבור שניהם עד שתמדדו את עומס העבודה שלכם. זו לא התחמקות; זה המצב בפועל של המידע.

השכבה ששניהם מאצילים לה

הנה העובדה המבנית שהופכת את ההתמודדות הזו להחלטת כבילה פחות מכפי שהיא נראית. שני המודלים מאצילים. GPT-Live-1 מעביר שאילתות קשות למודל טקסט בצד השרת מתוך תכנון, והרצת כלים ברקע בצד של Gemini מתנקזת לקריאות מודל רגילות. בשני המקרים ממשק הקול הוא שכבה דקה מעל מודל טקסט שעושה את החשיבה — ושכבת הטקסט הזו היא המקום שבו חיה שונות העלויות שלכם ושבו ההחלפה זולה.

OrcaRouter מאגד 190 מודלים מאחורי מפתח יחיד במחיר המחירון של הספק וללא תוספת, כך שהורדת מחיר במעלה הזרם מגיעה אלינו באותו היום ולא בחידוש החוזה הבא. עבור סטאק קולי, שתי התכונות שחשובות הן שאפשר להחליף את יעד ההאצלה בתעבורה חיה בלי לגעת באינטגרציית הקול, ושמעבר אוטומטי לגיבוי משאיר שיחה פעילה כשקצה אחורי מחזיר שגיאה או עובר לפסק זמן. הבהרה אחת, כי קל לרמוז אחרת: אנחנו לא מארחים את נקודות הקצה הקוליות של Gemini 3.8 Live או GPT-Live-1 — אלה מגיעות מה-API של הספקים עצמם. מודלי הטקסט שאליהם הם מעבירים עבודה נמצאים בדרך כלל בנתב.

Screenshot of the OrcaRouter model page for google/gemini-3.8-flash, showing the 1M-token context window, 65K max output, vision, audio and tool support, input pricing of $0.75 and output pricing of $3.75 per million tokens, and p50 time to first token of 3.35 seconds.

איך לבחור

קח GPT-Live-1 אם איכות השיחה היא המוצר — טיפול טבעי בקטיעות, תגובות חיזוק, והתחושה שאתה מדבר עם משהו במקום להפעיל אותו — ואם אתה יכול לספוג את העלות הכוללת, שהיא גבוהה באופן ניכר ממה שהתעריף המוצהר מרמז. שים לב שה-API שלו נהיה זמין רק בספטמבר 2026, ולכן כלי צד שלישי סביבו צעירים.

בחר את Gemini 3.8 Liveאם אתה זקוק לראייה חזותית עכשיו, אם אתה זקוק ליותר משני תריסרים של שפות, או אם השיקול הכלכלי לפי דקה הוא הקובע במודל שלך. קבל את העובדה שאתה קונה את המסלול הסטנדרטי, שממוקם חמישי במדד המשולב ולא ראשון, ושהציון 82.6 שכולם יצטטו שייך לגרסת ה-Extended Thinking.

קחו את Gemini 3.8 Live Extended Thinking אם החשיבה היא העיקר ואתם רוצים את המוביל הנוכחי במדד — אבל בדקו קודם את הפריסה שלו, כי נתיב ההפצה שלו דרך Gemini Live, Docs, Gmail ו-Keep רחב יותר מזה של המודל הסטנדרטי, והזמינות הארגונית שלו עדיין בתצוגה מקדימה פרטית.

הדבר שכדאי לעקוב אחריו ברבעון הקרוב הוא אם דופלקס מלא נשאר חפיר. מודלים מבוססי-תורות מצמצמים את פער השיחה בדרך אחרת — משאירים את האודיו עסוק בקריינות בזמן שהעבודה מתבצעת — ואם זה יחזיק מעמד בעומס אמיתי, ההבחנה הארכיטקטונית שהגדירה את הקטגוריה הזו במשך שנה תפסיק להיות הדבר שהקונים שואלים עליו.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית