כרטיס כותרת ראשי עבור 'Realtime-Venus מול SeedRealtime', עם כותרת משנה 'אחד רץ עבור מאות מיליוני אנשים. אחד רץ עדיין עבור אף אחד.', עם שלושה כרטיסים שעליהם נכתב 'SeedRealtime: פעיל ב-Doubao מאז 5 באוגוסט 2026, ללא API, ללא מחיר', 'Realtime-Venus: משקלים תחת Apache-2.0, ללא פריסה', ו'שניהם: אפס מבחני ביצועים ששוחזרו באופן עצמאי', מעל רצועת תחתית שעליה נכתב 'שתי קבוצות הנתונים הן דיווחי הספק; אף אחת מהן לא שוחזרה באופן עצמאי.' הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Realtime-Venus לעומת SeedRealtime: שתי דרכים מנוגדות להיות לא זמין

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Realtime-Venus ו-SeedRealtime הם שני החצאים של אותו סיפור משנת 2026, והם נכשלים במבחנים הפוכים. SeedRealtime הוא המודל הנייטיבי האודיו-ויזואלי הדו-כיווני המלא של ByteDance, שהופעל בתוך אפליקציית Doubao ב-5 באוגוסט 2026 בחינם, ומגיע לקהל שהיוצר שלו מתאר במאות מיליונים — ללא API, ללא מזהה מודל, ללא מחיר וללא יעד השהיה. Realtime-Venus הוא זוג צ'קפוינטים של 9B מצוות Venus של Ant Group ומאוניברסיטת Tsinghua, שפורסמו ב-12 בספטמבר 2026 תחת Apache-2.0 עם דוח טכני וללא הודעה, ויושבים במאגר שכל מהנדס יכול להוריד וכמעט אף אחד לא יכול לפרוס באופן ריאלי. אחד מהם אתה לא יכול לקרוא לו. את האחר אתה יכול להוריד ואז לגלות שאין לך על מה לקרוא לו. שניהם באמת נמצאים בחזית של אותה יכולת, ולאף אחד מהם אין בנצ'מרק שמישהו מחוץ למחבריו שלו שחזר.

שני טעמים של "אתה לא יכול לקבל את זה"

כדאי להיות מדויקים, כי הביטוי "לא זמין" מסתיר הבדל אמיתי.

SeedRealtime אינו זמין באופן שבו מוצר צרכני אינו זמין: הוא קיים, הוא עובד, יש לו משתמשים, והדלת פשוט סגורה בפני מפתחים. אין API, אין מחירון, אין פורטל תיעוד, ואין לוח זמנים מוצהר לאחד כזה. הדרך של ByteDance אל השוק הייתה האפליקציה, והאפליקציה הספיקה. מה שאתה מקבל כמי שבונה הוא הדגמה שאפשר לחוות אבל אי אפשר לשלב.

Realtime-Venus אינה זמינה באופן שבו תוצר מחקרי אינו זמין: המשקלים פומביים, הרישיון מתירני, הקוד נמצא שם, ואף אחד לא מריץ אותו. המאגר אינו נפרס על ידי אף ספק הסקה, וההורדות אינן נעקבות כלל, כך שאין אות פומבי לאימוץ לכאן או לכאן. היא זמינה במובן שחשוב לחוקר ואינה זמינה במובן שחשוב למנהל מוצר.

ביחד, הם מנסחים את השאלה שכל הקטגוריה הזו תקועה בה כרגע: המודלים שעובדים נמצאים מאחורי אפליקציות צרכניות, והמודלים שאפשר להריץ לא נמצאים בייצור בשום מקום.

שניהם ברמה שבאמת מבדילה את 2026

דרך שימושית לקרוא את תחום זמן־האמת היא בשלוש רמות. הראשונה היא קול חצי־דופלקס עם ראייה שהולחמה עליו — עוזרים מבוססי תורות שיכולים לראות אך עדיין פועלים בתורות. השנייה היא דופלקס מלא באודיו, הקשבה ודיבור בו־זמנית ללא מצלמה: Seeduplex של ByteDance עצמה, GPT-Live של OpenAI, Grok Voice Think Fast 2.0 של xAI. השלישית היא דופלקס מלא אודיו־ויזואלי, שבה תפיסה והבעה משתרעות על וידאו ואודיו ברציפות.

SeedRealtime הוא המודל הראשון בדרג השלישי שמגיע לפריסה מסחרית בקנה מידה גדול. Realtime-Venus הוא מצטרף במשקלים פתוחים באותו דרג — וידאו דרך מקודד SigLIP2, אודיו דרך Whisper-Medium, שלד Qwen3-8B, ולולאת אינטראקציה של שנייה אחת שלא מפסיקה לקלוט. כרטיס המודל שלו מציין שהוא מותאם מ-MiniCPM-o 4.5, המודל האומני-מודאלי של OpenBMB שיצא מוקדם יותר ב-2026, מה שממקם את התרומה של Ant Group באימון-המשך ובזמן הריצה ולא בארכיטקטורת הבסיס.

מה שמשותף להם, ומה שמציב אותם בדרגה אחת מעל מערכות השמע בלבד, הוא שאף אחד מהם לא עוצר כדי להסתכל. תפיסה חזותית רציפה תוך כדי דיבור היא יכולת שונה באמת מתיאור של פריים בודד, ושתי המודלים נבנו סביבה.

מה שווים המספרים של כל אחד מהם

A screenshot of the ByteDance Seed page for SeedRealtime, captured 18 September 2026, showing the page language toggle set to EN, the heading 'SeedRealtime: An Audio-Visual Full-Duplex LLM' dated August 5, 2026, and the opening overview text stating that the model natively unifies audio, video and text in a single architecture and that end-to-end human evaluations show it halves conversational pacing issues compared with cascaded models.

לאף אחד מהמודלים אין בנצ'מרק של צד שלישי. עם זאת, הראיות אינן שוות ערך, וההבדל משנה.

• SeedRealtime אינה מפרסמת שום בנצ׳מרק כלל. מה ש-ByteDance מציעה הוא טענה שבעיות בקצב השיחה — דיבור מעל המשתמש, תגובה מאוחרת, הפעלה מרעש של זר — פוחתות בכמחצית בהשוואה למערכת קסקדה, לפי הערכות אנושיות מקצה לקצה. הנתונים שמאחורי זה אינם מפורסמים.

• המספרים של קודמו הם באותה צורה. Seeduplex, מודל האודיו בלבד ש-ByteDance השיקה ב-Doubao באפריל 2026, דווח כי הוא הפחית בחצי את שיעורי התגובה השגויה וההפרעה השגויה, קיצר את השהיית נקודת הקצה בכ-250 מילישניות, צמצם תגובות מוקדמות ב-40%, והעלה את שביעות הרצון מהשיחה ב-8.34 נקודות במבחן A/B רחב היקף. הכל לפי דיווח הספק.

• Realtime-Venus מפרסמת טבלה. הדוח שלה טוען לציונים הטובים ביותר בשש מתוך שמונה בנצ'מרקים לווידאו, כולל StreamingBench 70.2, OVO-Bench 64.7 ו-Daily-Omni 81.3, ומוביל ב-MMAU 78.0, MMAU-Pro 63.2, Llama Questions 83.8 ו-Speech CMMLU 67.8 עבור נקודת הביקורת של האודיו.

• שניהם לא שוחזרו. טבלה שפורסמה שאיש לא בדק, וניסוי A/B שלא פורסם שאיש לא יכול לבדוק, הם סוגים שונים של חוסר אימות. אף אחד מהם אינו ראיה שאפשר לבסס עליה החלטת רכש.

ההשוואה היחידה ששווה לעשות בתוך המספרים של Realtime-Venus היא להשוות אותו לבסיס של עצמו. MiniCPM-o 4.5 מדווח 80.2 ב-Daily-Omni; Realtime-Venus-Omni מדווח 81.3. שיפור של נקודה אחת לעומת המודל שממנו הוא הותאם, במבחן שהמודל הזה כבר התמודד אתו, הוא תוצאה סבירה עבור מאמץ בפוסט-אימון ובזמן ריצה — וטענה קטנה בהרבה מכפי ש״הטוב ביותר בשישה מתוך שמונה״ נשמע בפני עצמו.

A two-column comparison scoreboard titled 'Realtime-Venus vs SeedRealtime — the scoreboard'. The left column, labelled Realtime-Venus, reads 'Availability: Apache-2.0 weights, no deployment', 'Where it runs: nowhere in production', 'Modality: audio, video and text', 'Benchmarks: self-reported table', 'Context: 40,960 tokens', 'Base model: adapted from MiniCPM-o 4.5'. The right column, labelled SeedRealtime, reads 'Availability: Doubao app only, no API', 'Where it runs: consumer scale since 5 August 2026', 'Modality: audio, video and text', 'Benchmarks: none published, vendor A/B claims', 'Context: not published', 'Base model: not disclosed'. The footer reads 'All figures vendor-reported; neither model has an independently reproduced benchmark.'

בעיית נטילת התורות, וזה התחום שבו הדופלקס המלא חי.

דופלקס מלא אינו תכונת השהיה. זהו מכלול של התנהגויות: לדעת מתי הפסקה משמעה "אני חושב" ולא "סיימתי", להבדיל בין שיחה של אדם מהצד לבין האדם שמדבר אליך, ולהישאר שקט בזמן תגובת לוואי במקום להתייחס ל"ממ־הם" כהפרעה.

הגישה של SeedRealtime היא למדל מצב שיחתי באופן מובנה ולוותר לחלוטין על גלאי פעילות דיבור חיצוני, כך שחילופי תורות הם התנהגות נלמדת בתוך הרשת ולא סף שמוחל על זרם אודיו. זו אותה מחויבות ארכיטקטונית ש-Realtime-Venus מאמצת, ושתיהן ממוקמות מול מערכות הקסקדה שזקוקות לרכיב נפרד כדי להחליט מי מדבר.

המקום שבו הראיות נבדלות הוא בכך שהטענה של SeedRealtime עוסקת בפריסה בקנה מידה גדול — מאות מיליוני משתמשים, חדרים אמיתיים, רעש אמיתי — ואילו זו של Realtime-Venus עוסקת בבנצ'מרק. תוצאות Full-Duplex-Bench v1.5 עבור Realtime-Venus-Audio — 75% תגובה להפרעות, המשכיות של 97% תחת בקצ'אנלים, 88% תחת דיבור המופנה לזולת ו-86% תחת דיבור רקע, תוך שהן עולות על Gemini 3.1 Live ו-GPT-4o בהמשכיות — הן המספרים הרלוונטיים ביותר במישרין שכל אחד מהמודלים פרסם לבעיה הזו. הן גם מבוססות כולן על דיווח עצמי בלבד, ו-97% המשכיות תחת בקצ'אנלים הוא נתון בולט שראוי שיהיה לו קורא נוסף לפני שמישהו מצטט אותו כעובדה.

היכן שכל אחד משאיר בנאי

הפער המעשי אינו באיכות, אלא בצורת ההצעה.

• SeedRealtime — אפשר לחוות אותו ב-Doubao בחינם, ולעולם לא לשלב אותו. אין שום מסלול מ"זה מרשים" אל "זה נמצא במוצר שלי".

• Realtime-Venus — אפשר להוריד אותו, לכוונן אותו, להריץ אותו במנותק מרשת, ולבחון כל שכבה. המחיר הוא שני צ'קפוינטים של 9B ב-BF16 במשקל של כשמונה-עשרה גיגה-בייט כל אחד, בתוספת לולאת סטרימינג מתמשכת בכל שנייה, מה שאומר צומת GPU שמחייב בין אם מישהו קורא לו ובין אם לא.

• לאף אחד מהם אין אפשרות אירוח. לא ניתן לנסות אף אחד מהם עם מפתח ואחר צהריים.

הנקודה האחרונה היא הסיבה לכך ששני המודלים שימושיים יותר כזוג מאשר כיריבים. יחד הם מדגימים ששני חצאיה של הבעיה נפתרו — היכולת עובדת, והמשקלים ניתנים לשחרור — תוך שהם מראים שאיש עדיין לא חיבר את שניהם למשהו שמפתח יכול למעשה לקרוא לו.

יש דרך עוקפת שרבים מהצוותים יגיעו אליה, וכדאי להיות ברורים לגבי מה היא מכסה ומה היא לא מכסה. אם אינכם יכולים להשיג את שכבת הקול, עדיין אפשר לבנות את החלק שחושב. Realtime-Venus מעבירה את העבודה היקרה שלה — אחזור, חשיבה קשה, קריאות API עסקיות — לרתמת רקע באמצעות סמני האצלה אסינכרוניים, והחלק המואצל הזה הוא הסקת טקסט רגילה. OrcaRouter לא נושאת את Realtime-Venus ולא את SeedRealtime; שתי שכבות הדופלקס מחוץ למה שאנחנו מספקים, ואיננו מארחים אף אחת מהן. כמעט 200 מודלים טקסטואליים מאחורי מפתח אחד במחיר המחירון של הספק, ללא תוספת הוא החצי של הארכיטקטורה שאנחנו כן מכסים, עם מעבר אוטומטי לגיבוי כך שמשימת רקע לא תיכשל מפני שלספק במעלה הזרם היה יום רע, DSL לניתוב להרכבת כמה מודלים לקריאה אחת, ומיזוג מודלים שבו שיקול הדעת של מודל בודד אינו מספיק. זה לא החלק הקשה במערכות האלה. זה החלק שאפשר למעשה לרכוש.

A screenshot of the Hugging Face model page for inclusionAI/Realtime-Venus, captured 18 September 2026, showing the Apache-2.0 licence badge, the arXiv 2609.13814 badge, the model card heading 'A full-duplex interaction system with asynchronous delegation', and a side panel stating 'This model isn't deployed by any Inference Provider.'

מה ישנה את ההשוואה הזו?

שלוש התפתחויות היו מכריעות בדבר, ואף אחת מהן עוד לא קרתה. בנצ'מרק בלתי תלוי של Realtime-Venus, מפני שטבלה בלי קורא שני היא טענה ולא תוצאה. API עבור SeedRealtime, מפני שהמודל עם הראיות החזקות ביותר לפריסה הוא נכון להיום זה שאיש אינו יכול להשתמש בו. ונתון השהיה מפורסם מאחד מהשניים — זמן עד לאודיו ראשון הוא המדד שלפיו קונים בקטגוריה הזו, ונכון לכתיבת שורות אלה אף אחד מהמודלים לא הצהיר על נתון כזה.

עד אז, הסיכום הכֵּן הוא ש-SeedRealtime הוא ההוכחה שדופלקס מלא אודיו-ויזואלי עובד בקנה מידה צרכני, ו-Realtime-Venus הוא ההוכחה שאפשר לפתוח את המשקלים, ואף אחת מהעובדות האלה לא מקרבת בונה ולו במעט להוצאת מוצר. זו אינה ביקורת על אף אחת מהמעבדות. זהו תיאור של קטגוריה שפתרה את בעיית המחקר ועדיין לא את בעיית ההפצה.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית