כרטיס כותרת הירו עבור 'Tavus Griffin נגד Seedance 2.5' עם כתובית משנה 'אחד מייצר שלושים שניות, אחד ממתין שתסיים את המשפט שלך', מעל ארבעה צ'יפים: Seedance 2.5 30 שניות במעבר אחד; Seedance 2.5 כ-0.51 דולר לכל 5 שניות ב-480p; Griffin 0.43 שניות אודיו-לווידאו; Griffin עדיין לא ניתן למכירה ללקוחות.
Guides & Insights

Tavus Griffin נגד Seedance 2.5: אחד מייצר שלושים שניות, אחד ממתין שתסיים את המשפט שלך

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הדרך המהירה ביותר להבין את הפער בין Tavus Griffin ל-Seedance 2.5 היא להסתכל על מה שכל אחד מהם עושה כשאתה מפסיק לדבר. Seedance 2.5, שיצא לאור על ידי צוות Seed של ByteDance ב-31 ביולי 2026, ממשיך לפעול: תן לו פרומפט והוא יפיק עד שלושים שניות של וידאו במעבר אחד, עם אודיו משותף, ברזולוציה ובקצב פריימים שבחרת לפני שלחצת על Enter. Tavus Griffin, שהוכרז על ידי Tavus באוקטובר 2026 כתצוגה מקדימה מחקרית, עוצר — ואז מתחיל שוב, כי הוא הקשיב כל הזמן ויש לו משהו לומר בחזרה. מודל אחד הוא מנוע הפקה שפועל ללא השגחה. האחר הוא משתתף שפועל רק אם אתה שם.

שלושים שניות בטאק אחד

הכותרת של Seedance 2.5 היא משך הזמן. בעוד שקודמו הגיע לתקרה של חמש-עשרה שניות, 2.5 מפיק שלושים שניות ביצירה אחת — כפול מהחלון, וזה ההבדל בין שוט לסצנה. מעבר לכך, הוא תומך בהארכה רב-סבבית, ו-ByteDance הדגימה מצב ארוך במיוחד בגרסת בטא שבו המודל מתבקש להמשיך את הפלט של עצמו במקום להתחיל מהתחלה.

משטח הקלט רחב אפילו לפי הסטנדרטים של 2026. בקשה בודדת יכולה לכלול עד כשלושים תמונות, עשרה קטעי וידאו ועשרה קטעי אודיו כרפרנסים, כאשר וידאו ואודיו רפרנס נמשכים כל אחד לכשלושים שניות. זה מספיק חומר כדי להגדיר דמות, מיקום, תנועה ופסקול בבת אחת. המודל מגיע גם עם סט מצבים בעלי שמות שנראים יותר כמו חבילת קומפוזיטינג מאשר תיבת פרומפט: מצב מודל לבן ומצב חימר עבור פרוויז, מסך ירוק, רפרנס תנועה ורפרנס יצירתי. מעל כל אלה יושבים שליטה ברמת חותמת זמן ועריכה ברמת אזור, ושם חלון שלושים השניות מפסיק להיות רק אורך ומתחיל להיות ציר זמן.

אודיו ווידאו יוצאים מאותו מעבר במקום להיות ממוזגים לאחר מכן, על פני יותר מעשר שפות של דיאלוג, ורשימת שותפי ההשקה — XCMG, XPeng, Lingchu Intelligence, Weifen Zhifei, Qiongche Intelligence — נקראת כמו בסיס לקוחות תעשייתי ורכבי ולא כמו בסיס לקוחות של כלי יצירה. המסגור של ByteDance עצמה הוא ש-Seedance 2.5 מיועד לאנשים שזקוקים לקטע צילום מוגמר, לא לאינטראקציה.

Screenshot of Artificial Analysis's 'AA-Video-T2V v2.0' leaderboard filtered to models with audio, captured 2 October 2026: Wan 3.0 first at Elo 1,157, Utopai X (based on MiniMax H3) second at 1,150, Dreamina Seedance 2.5 third at 1,144 with 7,526 votes and $34.12 per minute, MiniMax H3 (768p) fourth at 1,139 and MiniMax H3 Max fifth at 1,134, with samples, release month and per-minute API pricing columns.

המודל שקיים רק בזמן שאתה מדבר

גריפין הוא מערכת בעלת צורה הפוכה, וטאווס מפורש באופן יוצא דופן לגבי הצורה. הוא מכנה את גריפין מודל האינטראקציה האנושית הראשון: מערכת וידאו-לווידאו שצופה ומקשיבה למשתתף במהלך שיחה ומייצרת את הצד השני שלה בזמן אמת. הארכיטקטורה מתפצלת למידול שיחתי רציף, שמחליט מה הפרסונה צריכה לעשות מרגע לרגע, ויצירה אודיו-ויזואלית, שמזרימה את הדיבור והפנים המתאימים. הוא דופלקס מלא, כך שניתן להפריע לו, והוא אינו זקוק לאות סוף-תור נקי כדי להגיב.

הכול במימוש מכוונן לשבריר השנייה הבא ולא לשוט הבא. קודק האודיו Tavec פועל ב-48 kHz עם 40 ערכים לפריים בקצב של 100 פריימים לשנייה, ללא ספרי קודים, מפענח סיבתי לחלוטין, וחבילות קטנות עד 10 אלפיות השנייה. הווידאו מוזרם ב-720p במקטעים של 320 אלפיות השנייה, וקטור חבוי אחד לכל שמונה פריימים ב-25 fps, שלושה צעדי דיפוזיה לכל וקטור חבוי, עם דחיסה זמנית של פי 8 ב-VAE. זיקוק תלת-שלבי — התאמת התפלגות, לאחר מכן אוטורגרסיבי עם כפיית מורה, ולאחר מכן כפייה עצמית — הוא מה שמאפשר שלושה צעדי דיפוזיה בזמן אמת. השהיית אודיו-לווידאו עומדת בממוצע על 0.43 שניות ב-H100s, שלדברי Tavus היא כמחצית מהשיטה המהירה הבאה שהיא מדדה. שיבוט קול זקוק לדגימה של כעשר שניות.

ואז המשפט שקובע כיצד תתכננו בהתאם לו: Tavus מציינת כי Griffin-Lite, תצוגת המחקר, זמין לקבוצה נבחרת של בודקים מוקדמים, כי Griffin-Lite לא יהיה זמין לשימוש עבור לקוחות בשלב זה, כי בהמשך יגיע שחרור רחב יותר של מודל חזק יותר, וכי Griffin עדיין אינו נמצא בפלטפורמה של Tavus — הוא יגיע ברגע שהחברה ת�figured out how to release it safely.

הטענות שכל אחד מהם מעלה, וכמה הן שוות

הראיות של Seedance 2.5 עוסקות בעיקר ביכולת: מה היא יכולה לקבל, כמה זמן היא יכולה לפעול, כמה היא עולה. הראיות של Griffin עוסקות בעיקר בהשפעה. במחקר עם Queen Mary University of London, Tavus מדווחת ש-26 מתוך 54 משתתפים — 48% — האמינו ש-Griffin הוא אדם אמיתי לאחר שיחת וידאו בת דקה, לעומת 1 מתוך 41 (2.4%) במערך הקודם שלה של Phoenix-4.5, Sparrow-2 ו-Raven-1, כאשר המפקפקים בדרך כלל חשדו בתוך עשרים השניות הראשונות. הבנצ'מרק VideoFDB של NVIDIA, שנמדד בספטמבר 2026, מציב את Griffin במקום הראשון בבינה מלאכותית פנים אל פנים לפי החישוב של Tavus: יצירה 3.83 לעומת קו בסיס חזק ביותר שדווח של 2.80 ו-3.92 לאדם, תפיסה 3.73 לעומת 3.44 ו-4.20, ופער של 37% לעומת המערכת הטובה הבאה בתגובה ברגע. מדווח על ידי הספק, על בנצ'מרק ש-NVIDIA בנתה — אבל נקודות ההשוואה האנושיות הן אלו שנושאות משקל.

אין מבחן עצמאי בר־השוואה לשאלה "האם הקהל האמין לזה" ב-Seedance 2.5, מפני שזה לא הייעוד שלו. שני המודלים עונים על שאלות שונות, ואף אחת משתי קבוצות המספרים לא עוברת מהאחת לאחרת.

מה שאתה יכול לקנות בפועל

Seedance 2.5 הוא מוצר עם מחירון. בפלטפורמת ModelArk של ByteDance הוא מתומחר ב-10.70 דולר למיליון טוקנים ללא קלט וידאו וב-6.40 דולר למיליון עם קלט וידאו, מה שמסתכם בכ-0.51 דולר לקליפ של חמש שניות ביחס 16:9 באיכות 480p ובכ-1.16 דולר לאותו קליפ באיכות 720p. הגישה מתבצעת דרך אפליקציות הצריכה של ByteDance ודרך ה-API ב-Volcano Engine Ark בסין וב-BytePlus ModelArk internationally. לפחות מפיץ אחד מציין שהוא אינו זמין בארצות הברית, והמקורות חלוקים בשאלה אם הרזולוציה המקסימלית היא 720p או 1080p — שני דברים שכדאי לדעת לפני שכותבים אותם במפרט.

ל-Griffin אין מחירון, אין API ציבורי ואין תאריך. זו כל החלטת הרכישה, וזה ממוטט את השאלה יותר ממה שרוב מאמרי ההשוואה מודים.

Board titled 'Seconds versus Sentences'. Seedance 2.5 card: what it reads a prompt plus up to 30 images, 10 video clips and 10 audio clips; what it returns up to 30 seconds of video in one pass; audio joint audio and video over 10 languages; latency batch generation, no real-time mode; price about $0.51 per five-second 480p clip on ModelArk; availability shipped 31 July 2026, live on ModelArk. Tavus Griffin card: what it reads the live participant, video and audio; what it returns the other side of the conversation in real time; audio streaming speech with a voice cloned from a ten-second sample; latency 0.43 s average audio to video on H100s; price none published; availability research preview, selected testers only.

היכן שראוטר מצדיק את מקומו

אם אתם בונים משהו שזקוק לשניהם — סוכן שמנהל שיחה וגם מפיק קטעי וידאו מוגמרים — אתם מסתכלים על שני ספקים, שתי קונסולות, שתי מערכות חיוב ושתי תפיסות שונות של מהי בקשה. זה התפר שבו OrcaRouter באמת שימושי ולא רק דקורטיבי: מפתח אחד ביותר ממאתיים מודלים, כאשר מחירי המחירון של הספקים מועברים הלאה בתוספת של 0% תוספת מחיר כך שהורדת מחיר של ספק מגיעה לכרטיס באותו היום, מעבר אוטומטי לגיבוי כך שספק אחד רווי לא יהפוך לתקלה שלכם, ו-DSL לניתוב שמאפשר להצמיד משימות קריטיות ל-backend מסוים בעוד שטיוטות הולכות לאן שהקיבולת הזולה ביותר. גם כאן מיזוג מודלים חשוב בשוליים — עבור מחולל שמחירו נקבע לפי טוקן או לפי שנייה, הוצאת כסף על מודל טקסט זול כדי לחדד פרומפט לפני שאתם מוציאים על היצירה היקרה היא בדרך כלל השורה בעלת התשואה הגבוהה ביותר בצינור.

כדי להיות מדויקים לגבי שני המודלים שבכותרת: לא Seedance 2.5 ולא Griffin מהווים נתיב ב-OrcaRouter. אל Seedance מגיעים דרך הפלטפורמות של ByteDance עצמה ומפיצים מצד שלישי; אל Griffin אי אפשר להגיע כלל. מה שהקטלוג כן כולל בצד הווידאו הוא minimax/minimax-h3, המחולל האומני-מודאלי של MiniMax, במחיר של $0.08 לשנייה של פלט ב-768P ו-$0.13 לשנייה ב-2K, נמכר באותן יחידות של שנייה כמו Seedance וזמין כעת.

Screenshot of the OrcaRouter model page for MiniMax-H3, showing the model id minimax/minimax-h3, the description 'omni-modal video generation model (the Hailuo 3 generation), released July 31, 2026', a price of $0.08 per second, p50 time to first token of 375 ms and p95 of 416 ms over seven days.

שאלות נפוצות, בקצרה

האם אוכל להריץ את Seedance 2.5 ואת Griffin באותו מוצר?מבחינה ארכיטקטונית כן, וזה הפיצול המתבקש: Seedance לכל דבר שניתן לרנדר מראש, Griffin עבור הלייב. מבחינה מסחרית לא, כי עדיין אי אפשר למכור לך את Griffin.

האם Griffin הוא רק מחולל של ראש מדבר? לא, וב-Tavus מקפידים על ההבחנה — מחולל של ראש מדבר מקבל טקסט ומחזיר וידאו, בעוד ש-Griffin מקבל כקלט את הווידאו והאודיו של המשתתף ונמדד לפי האם הוא מגיב ברגע.

האם Seedance 2.5 פועל בזמן אמת? לא. זהו מחולל אצווה עם תקרה של שלושים שניות ומצב הארכה רב-סבבי; השהיה אינה הציר שעליו הוא מתחרה.

שורה תחתונה

Seedance 2.5 הוא מנוע הפקה שכבר יצא לשוק: שלושים שניות במעבר אחד, אודיו משולב, עד שלושים תמונות ועשר הפניות וידאו ואודיו, שליטה ברמת חותמת זמן ואזור, כ-0.51 דולר עבור קליפ של חמש שניות ב-480p וכ-1.16 דולר ב-720p ב-ModelArk, זמין כעת דרך הפלטפורמות של ByteDance עצמה, ולא, עד כמה שמישהו אישר, בארצות הברית. Tavus Griffin אינו מוצר: זהו מודל אינטראקציה אנושית דו-כיווני שהישגיו המפורסמים הם 48% מהמשתתפים שהאמינו שהוא אנושי בשיחה בת דקה אחת, והשהיה ממוצעת של 0.43 שניות מאודיו לווידאו על H100s, ושהספק שלו אמר בכתב שלקוחות עדיין לא יכולים להשתמש בו. אם אתה צריך צילומים היום, Seedance היא התשובה, והמחיר שלה גלוי. אם אתה צריך פרצוף שמגיב בזמן שאתה מדבר, התשובה היא שאף אחד עדיין לא מוכר אחד כזה.