כרטיס Hero עבור "Tavus Griffin נגד Google Veo 3.1" עם שלושה צ'יפים עם הכיתוב "Veo 3.1 — SynthID בכל פריים", "Griffin — 48% הוטעו במחקר חי" ו-"Veo 3.1 Standard — החל מ-$0.40 לשנייה", מעל שש שורות: מקור Griffin: לא פורסם; מקור Veo: SynthID בתוספת C2PA; מחיר Griffin: לא פורסם; מחיר Veo: $0.40 לשנייה; סטטוס Griffin: תצוגה מקדימה מחקרית; סטטוס Veo: זמין באופן כללי. כותרת תחתונה: "תעריפי Veo 3.1 הם מחירי המחירון של Google Gemini API; Griffin הוא תצוגה מקדימה מחקרית ללא תמחור."
Guides & Insights

Tavus Griffin נגד Google Veo 3.1: האחד מטביע סימן מים בכל פריים, האחר רימה 48% מהחדר

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הציבו Tavus Griffin ו-Google Veo 3.1 זה לצד זה, וההשוואה השגרתית — מחיר לשנייה, Elo, אורך קליפ — מתפרקת מיד, כי רק אחד מהם מתומחר ורק אחד מהם מדורג לפי משהו שקונה יכול לחפש. אבל מתחת לכך יש ציר אמיתי, והוא אינו איכות. התשובה של גוגל למדיה סינתטית היא להפוך אותה לניתנת לזיהוי: כל פלט של Veo 3.1 נושא SynthID, סימן מים בלתי נראה שנכתב אל תוך הפיקסלים פריים אחר פריים ואל תוך ספקטרום האודיו, ובנוסף C2PA Content Credentials המתעדים את מקור הקובץ, וגוגל הטמיעה גלאי בתוך אפליקציית Gemini כך שמשתמש יכול לשאול אם Google AI יצרה קליפ. הסיבה המוצהרת לקיומו של Tavus Griffin בתצוגה מקדימה ולא כמוצר היא התמונה ההפוכה: במחקר חי של Tavus עצמה, 26 מתוך 54 משתתפים סיימו שיחת וידאו של דקה כשהם מאמינים שבן שיחם הוא אדם אמיתי, לעומת 1 מתוך 41 במערכת הקודמת של החברה, ו-Tavus אומרת שהיא מעכבת את המודל עד שתברר כיצד לחשוף את מה שהוא. אחד מהספקים האלה מוכר זיהוי. האחר הוא כרגע הסיבה לכך שזיהוי חשוב, והוא יודע זאת.

שני מוצרים שנבנו על הנחות מנוגדות

Veo 3.1 הוא מחולל קליפים עם מעטפת צרה בכוונה. ב-API של Gemini של גוגל הוא מייצר 4, 6 או 8 שניות בכל מעבר ב-24 fps, באופן מקורי ב-720p, כאשר 1080p ו-4K מגיעים דרך מעבר הגדלה (upscaling) שנוסף בעדכון מינואר 2026. הרחבה מוסיפה שבע שניות בכל מעבר ויכולה לחזור עד עשרים פעמים לתקרה תיאורטית של כ-148 שניות, אבל הקלט חייב להיות קליפ שנוצר על ידי Veo באורך של לא יותר מ-141 שניות ב-720p ב-16:9 או 9:16, ואורך של שמונה שניות הוא חובה עבור הרחבה, עבור קלט תמונת ייחוס, ועבור כל דבר מעל 720p. לא ניתן ליצור קליפ של ארבע שניות ב-1080p. הפלט הוא קובץ בבעלותך, עם סימן מים, כשרשומת מקור חתומה מצורפת.

Griffin לא מייצר קובץ. הוא מנהל שיחה. מנוע למידה שיחתית רציפה קולט אודיו ווידאו ומעריך מחדש את החליפין במרווחים של פחות משנייה, בוחר אם לשתוק, לאותת, לתת משוב קולי או לקחת את התור, ופולט בקרות אקספרסיביות שמניעות יחד מחולל דיבור זורם ומחולל וידאו זורם. מחולל הווידאו מייצר 720p בנתחים של 320 מילישניות, לטנט אחד בכל פעם, בקצב של 25 פריימים לשנייה מתמונת ייחוס בודדת, ומנגן כל נתח תוך כדי פענוח. אין אורך קליפ כי אין קליפ; יש סשן שנמשך עד שמישהו מפסיק לדבר.

ההבחנה הזאת קובעת כמעט כל שורה אחרת בהשוואה הזו. המעטפת של Veo 3.1 היא אוסף אילוצים שצינור הפקה יכול לתכנן לפיהם — רשימות שוטים של שמונה שניות, סולם הארכה לשוטים ארוכים יותר, 24 fps קבוע, סולם רזולוציות ידוע. הפלט של Griffin אינו ניתן לתכנון מראש בסטוריבורד כלל, מפני שמה שהוא מרנדר תלוי במה שהאדם יעשה לאחר מכן.

כמה עולה Veo 3.1, בכל דרגה

התעריפים המפורסמים של Google עבור Gemini API כוללים אודיו, לפי שנייה של פלט, ואין מסלול חינמי באף רמה של Veo 3.1. לא ניתן להשבית אודיו ב-API הזה — הוא נוצר בכל בקשה — וזה חשוב מכיוון שמקורות צד שלישי מתארים טבלת תעריפים של Vertex AI שבה וידאו שקט עולה בערך כמחצית מהנתון הכולל אודיו. התיעוד של Google עצמה אינו חושף את המתג הזה. אם תעריף שקט חשוב לחשבון שלך, אמת אותו מול חיוב Vertex שלך ולא מול עמוד השוואה, כולל זה.

• Veo 3.1 Standard — $0.40 לשנייה ב-720p וב-1080p, $0.60 לשנייה ב-4K.

• Veo 3.1 Fast — $0.10 לשנייה ב-720p, $0.12 לשנייה ב-1080p, $0.30 לשנייה ב-4K.

• Veo 3.1 Lite — $0.05 לשנייה ב-720p, $0.08 לשנייה ב-1080p, ללא רמת 4K.

הריצו את חוק שמונה השניות מול התעריפים האלה, והעלות לכל ניסיון היא מה שצוות קריאייטיב באמת מתקצב: 32 סנט עבור טייק של שמונה שניות ב-1080p ב-Standard, 80 סנט עבור טייק של ארבע שניות באותה רזולוציה כי רצפת שמונה השניות לא חלה מתחת ל-720p, ו-4.80 דולר עבור טייק 4K בודד של שמונה שניות. המספר האחרון הוא זה שכדאי להתעכב עליו, כי חיפוש של ארבעה ניסיונות אחר שוט 4K שמיש אחד הוא קצת פחות מעשרים דולר, ודרישת שמונה השניות אומרת שאי אפשר לבדוק את הרעיון בחצי האורך תמורת חצי המחיר.

ל-Griffin אין מחיר, אין מסלול חינמי, ואין מחירון מכל סוג שהוא. Griffin-Lite זמין לבודקים נבחרים ומהימנים כתצוגה מקדימה מחקרית באמצעות טופס בקשה, אינו נמצא בפלטפורמת Tavus, וההכרזה מפורשת שהוא לא יהיה זמין לשימוש לקוחות בשלב זה. שורת הסיום של Tavus בדף היא ש-Griffin יגיע לאחר שהחברה תברר כיצד לשחרר אותו בבטחה. לכל טענה במאמר זה שמשווה בין השניים בכל דבר הדומה להחלטת רכישה יש חור בחצי של Griffin שלה, ושום כמות של מחקר לא ממלאת אותו.

מה שני לוחות התוצאות בעצם מודדים

שני המודלים הוערכו בכלים שונים מאותה הסיבה שבגללה קשה לתמחר אותם זה מול זה.

Veo 3.1 נמצא בזירת הווידאו של Artificial Analysis, שבה Elo נגזר מהעדפה אנושית עיוורת בזוגות על קטעים קצרים. קראו ב-2 באוקטובר 2026 בלוח הטקסט-לווידאו עם אודיו:

• Veo 3.1 — במקומות 18–21, Elo 968 (±11) מתוך 2,857 הצבעות, $24.00 לדקה.

• Veo 3.1 Fast — מקומות 18–21, Elo 961 (±10) על סמך 3,595 הצבעות, $7.20/דקה.

• Veo 3.1 Lite — מקומות 21–24, Elo 949 (±11) על בסיס 2,762 הצבעות, $4.80 לדקה. • Veo 3.1 ב-image-to-video (עם אודיו) — 11 מתוך 34, Elo 1,082 על בסיס 7,049 הצבעות, $24.00 לדקה. המיקום הטוב ביותר שלו בכל לוח דירוג, וזה שעומדות מאחוריו הכי הרבה הצבעות.

שני דברים נובעים מכך. כל שלוש הדרגות נמצאות בטווח של תשע עשרה נקודות Elo זו מזו, עם רווחי סמך חופפים, כך שמחיר השנייה הגבוה פי ארבעה של הדרגה הסטנדרטית לא קונה העדפה עיוורת מדידה. וסדרת Gemini Omni Flash החדשה יותר של Google עצמה מדורגת מעל כל דרגה של Veo 3.1 באותו לוח — מקום 7–8 ב-Elo 1,117 מתוך 7,801 הצבעות ובמחיר של $9.12 לדקה, לפני כל שלוש הדרגות, בעודה עולה בין רבע לחמישית מהמחיר לדקה שלהן — וזו שאלה שכל קונה של Veo 3.1 צריך לשאול, ושאלה שהמאמר הזה אינו המקום לענות עליה.

המספרים של Griffin מגיעים מ-VideoFDB של NVIDIA, בנצ'מרק לשיחה אודיו-ויזואלית בדופלקס מלא ש-NVIDIA בנתה וניקדה באופן עצמאי בספטמבר 2026. Griffin-Lite קיבלה 3.83 מתוך 5 במסלול היצירה לעומת ייחוס אנושי של 3.92 ו-2.80 למערכת הבאה הגבוהה ביותר שפורסמה, ו-3.73 במסלול התפיסה לעומת ייחוס אנושי של 4.20. Tavus גם מדווחת על 0.43 שניות של השהיה אמיתית מאודיו לווידאו עבור המחולל לעומת ארבעה קווי בסיס מפורסמים של דיפוזיה בזרימה על H100s, ומתארת אותה כמחצית מהמהירה הבאה.

שני המערכים אינם ניתנים להעברה. דירוג Elo מהצבעת העדפות על קליפים קצרים אינו אומר דבר על האם ניתן לקטוע מודל; ציון מחוון של שופט על שיחה אינו אומר דבר על האם קליפ נראה כשורה ב-4K. וההסתייגויות פועלות בשני הכיוונים: הפער של 0.09 נקודות של Griffin מול אמת המידה האנושית קטן מספיק במחוון בן חמש נקודות שנשפט על ידי מודל שפה, כך ש"קרוב לאדם" הוא הקריאה הכנה, וחלק מיתרון התפיסה שלו נמדד מול מערכות שפועלות ללא קלט וידאו בכלל.

A screenshot of the middle of Artificial Analysis's text-to-video-with-audio board, captured 2 October 2026, covering rows eleven to twenty-four: grok-imagine-video-1.5 at Elo 1,046, HappyHorse-1.1 at 1,045, Wan2.7-260612 at 1,032 with 4,645 votes and $9.00/min, HappyHorse-1.0 at 1,026, Kling 3.0 Omni 1080p Pro at 1,018, Kling 3.0 1080p Pro at 1,000 with 4,844 votes, PixVerse V6 at 987, Veo 3.1 at 968 with 2,857 votes and $24.00/min, Veo 3.1 Fast at 961 with 3,595 votes and $7.20/min, MAGI-2 Preview (0912) at 960, LTX-2.5 Fast at 950, Veo 3.1 Lite at 949 with 2,762 votes and $4.80/min, LTX-2.5 Pro at 944 and Vidu Q3 Pro at 941.

מקור, שהוא ההבדל האמיתי במוצר

עבור עסק עם חובת גילוי כלשהי, זהו הקטע היחיד שחשוב, וזה אפילו לא צמוד.

הפלט של Veo 3.1 נושא SynthID פריים אחר פריים בפיקסלים ובספקטרום האודיו, ומיועד לשרוד דחיסה, שינוי גודל, חיתוך והקלטת מסך, כאשר C2PA Content Credentials מתעדים את מקור הקובץ ואת היסטוריית העריכות ותואמים ליישומים של Adobe ו-Microsoft. גוגל הטמיעה זיהוי באפליקציית Gemini, כך שמשתמש יכול להעלות סרטון ולשאול אם Google AI יצרה אותו, כשהזיהוי מדווח איזה קטע ברצועת האודיו או הווידאו נשא את הסימן. המגבלה אמיתית וראויה לציון: הגלאי הזה מזהה רק את המודלים של גוגל. אין דבר בקטלוג של Alibaba או Kuaishou שמשתווה, וגם אין דבר מ-Tavus שמשתווה.

A screenshot of Google DeepMind's SynthID page, captured 2 October 2026: the Google DeepMind wordmark, the "SynthID" heading, the strapline "A tool to watermark and identify content generated through AI", the section tabs Overview / How it works / Hands-on, the heading "What is SynthID?", and a "Build with Gemini" panel with a Try Gemini link.

Tavus לא פרסמה סימן מים, גלאי, או צינור תעודות תוכן עבור Griffin. מה שכן פרסמה הוא הסיבה שהיא זקוקה לאחד כזה. המחקר פנים-אל-פנים בוטה באופן יוצא דופן לגבי אופן הכישלון: יותר ממחצית המשתתפים אמרו שהאפשרות שמדובר ב-AI לא עלתה בדעתם במהלך השיחה, כמעט כל הקבוצה הזו הגיעה למסקנה שבן השיח שלהם אמיתי, והאנשים שכן חשדו נטו לפענח זאת בתוך עשרים השניות הראשונות. המאמינים היו בטוחים בממוצע ב-79% והספקנים ב-81%. זהו מודל שהטעיה שלו אינה תוצר לוואי של איכות היצירה — היא איכות היצירה עצמה.

התגובה של Tavus נמצאת בהודעה ולא בהערת שוליים: אותן תכונות שהופכות את Human Interaction Models לממשקים רבי-עוצמה לתקשורת טבעית מאפשרות להן להונות אדם ולהביא אותו להאמין שזו אינה בינה מלאכותית, נדרשים נהלי יישור ובטיחות נוספים לשחרור בטוח, והחברה עובדת על תכונות חשיפה בטוחות ועם ארגונים העוסקים בבטיחות בינה מלאכותית. זו הסיבה שהשער קיים. Griffin-Lite לא יהיה זמין לשימוש לקוחות בשלב זה.

התנאים הארגוניים ש-Google מביאה ו-Tavus לא

Veo 3.1 מוגש דרך Vertex AI עם התשתית האזורית, ה-IAM ומשטח החוזה הארגוני שמשתמע מכך, ו-Google מגבילה את מה שהמודל יעשה לפי תחום שיפוט: באמצעות פרמטר ליצירת אנשים, האיחוד האירופי, בריטניה, שווייץ ו-MENA מאפשרים רק דמויות מבוגרות, בעוד שאזורים אחרים יכולים לאפשר הכל. זהו משטח מדיניות מתועד ומודע לאזור, ועבור קונה מפוקח הוא יכול לגבור על מיקום בטבלת המובילים.

יש עלות לצורה של זה. מזהי המודלים של Veo 3.1 ב-Gemini API הם עדיין מזהי preview — veo-3.1-generate-preview והאחים שלו — בעוד שה-SKU של Vertex נושא שמות של זמינות כללית, ודוחות של צד שלישי מעמידים את מכסת ה-preview על בערך חמישית ממכסת הייצור. גוגל הוציאה משימוש את ה-SKU-ים הישנים יותר של Veo 3.0 ב-30 ביוני 2026, מה שמלמד אותך כיצד מטופלת תחלופת דורות וכדאי לתמחר זאת בכל דבר שנבנה על מזהה preview. הפן הצרכני גם מוגבל באמת: Flow דורש מנוי Google AI Pro או Ultra וחסום באיחוד האירופי, בבריטניה, בהודו, באינדונזיה, בסין היבשתית וברוסיה, מבלי שמוצע פתרון עוקף VPN.

ל-Griffin אין תנאי שירות לקרוא, כי אין שירות. הגישה היא טופס בקשה ותצוגה מקדימה מחקרית. Tavus אמרה שהיא עובדת עם ארגוני בטיחות על הערכות ורוצה שאנשים ישתתפו בהן, וזו עמדה מחקרית ולא מסחרית.

להשיג את אחד מהם

Veo 3.1 נגיש דרך Gemini API, Vertex AI, Google AI Studio ו-Flow, ודרך אפליקציית Gemini באיכות 720p בלבד. מחוץ לסין, הוא בפער ניכר הקל יותר מבין השניים להשגת מפתח, מה שמחליש את טיעון האיכות שלעיל ומהווה את הסיבה העיקרית לכך שההשוואה הזו נשארת מעניינת למרות המספרים.

ניתן להגיע ל-Griffin באמצעות הגשת בקשת גישה ובחירה כבודק מהימן. זהו כל מסלול הרכש.

המקום שבו ראוטר באמת עוזר בצינור עיבוד של Veo הוא בצמוד למודל הווידאו ולא בתוכו. מודלי הטקסט של Google — Gemini 3.5 Flash, Gemini 3.1 Pro Preview, Gemini 3.6 Flash ושאר השורה — נמצאים בקטלוג של OrcaRouter וניתנים לקריאה באותו endpoint תואם-OpenAI כמו 200+ מודלים אחרים במחיר המחירון של הספק בתוספת 0% מרווח. רשימות שוטים, הרחבת פרומפטים, יצירת כיתובים, הערות המשכיות בין מקטעים של שמונה שניות, וסיכום סקירות — כל אלה עבודות טקסט, וזו השכבה שבה היכולת להציב מודל זול במעבר גורפי ומודל מן השורה הראשונה במעבר האחרון עולה שינוי בקונפיגורציה ולא מיגרציה. את Veo 3.1 עצמו אנחנו לא מנתבים, וגם לא את Griffin; כדאי להיות מפורשים לגבי זה במקום לתת לפסקה כמו זו לרמוז אחרת.

איזה מהם, בכנות

• בחרו ב-Veo 3.1 כאשר התוצר דורש שרשרת מקור, כאשר הקונה כפוף לרגולציה, כאשר ההפצה חייבת להיות קובץ עם אישורים מצורפים, או כאשר 4K אינו נתון למשא ומתן. תקצבו את רצפת שמונה השניות בכל מודל עלויות, ובדקו את מחזור החיים של preview-ID לפני בניית מסלול מול לקוחות עליו.

• אל תבחר ב-Griffin, כי אתה לא יכול. בקש גישה אם השאלה שלך היא אם אדם יכול להבחין בין בינה מלאכותית לאדם בשיחת דקה, או אם אתה צריך לדעת לאן שכבת האינטראקציה הולכת לפני שאתה מתחייב למפת דרכים לשכבת הקליפ.

• עקבו אחר הגלאי, לא אחרי ההדגמה. אם Tavus תפרסם מנגנון גילוי שישרוד שיחה סתמית, הפער בין שני הספקים האלה יצטמצם במידה ניכרת. אם לא, Griffin הוא תוצאה שכדאי לצטט, ו-Veo 3.1 נשאר היחיד מבין השניים שאפשר להעמיד בפני צוות ציות.

A two-column scoreboard titled "Tavus Griffin vs Google Veo 3.1 — the scoreboard". Left column "Tavus Griffin": Provenance: none published; Price: none published; Clip length: no clip - a session; Resolution: 720p at 25 fps; Loop: full duplex; Status: research preview. Right column "Google Veo 3.1": Provenance: SynthID plus C2PA; Price: $0.40 per second; Clip length: 4, 6 or 8 seconds; Resolution: 720p native; Loop: one generation; Status: generally available. Footer: "Veo 3.1 per Google's Gemini API pricing, 2 October 2026."