
تافوس غريفين مقابل غوغل فيو 3.1: أحدهما يضع علامة مائية على كل إطار، والآخر خدع 48% من الحاضرين في غرفة
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 223 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
ضع Tavus Griffin وGoogle Veo 3.1 جنبًا إلى جنب، فالمقارنة التقليدية — السعر لكل ثانية، وElo، وطول المقطع — تنهار فورًا، لأن واحدًا منهما فقط مُسعّر، وواحدًا منهما فقط يُقيَّم على أي شيء يمكن للمشتري التحقق منه. لكن ثمة محور حقيقي تحت ذلك، وهو ليس الجودة. جواب Google على الوسائط الاصطناعية هو جعلها قابلة للكشف: فكل ناتج من Veo 3.1 يحمل SynthID، وهي علامة مائية غير مرئية تُكتب في البكسلات إطارًا بإطار وفي الطيف الصوتي، إضافة إلى C2PA Content Credentials التي تسجّل مصدر الملف، وقد طرحت Google كاشفًا داخل تطبيق Gemini ليستطيع المستخدم أن يسأل ما إذا كان ذكاء Google الاصطناعي قد صنع مقطعًا. أما السبب المعلن لوجود Tavus Griffin في المعاينة بدلًا من كونه منتجًا فهو الصورة المعكوسة: في دراسة Tavus الحية الخاصة بها، أنهى 26 من 54 مشاركًا مكالمة فيديو مدتها دقيقة وهم يعتقدون أن شريكهم شخص حقيقي، مقابل 1 من 41 على البنية التقنية السابقة للشركة، وتقول Tavus إنها تُبقي النموذج بعيدًا عن الإطلاق حتى تتوصل إلى كيفية الإفصاح عن ماهيته. أحد هذين المورّدين يبيع الكشف. والآخر هو حاليًا السبب في أهمية الكشف، وهو يدرك ذلك.
منتجان مبنيان على افتراضين متعارضين
Veo 3.1 هو مولد مقاطع فيديو بنطاق ضيق متعمد. على واجهة برمجة تطبيقات Gemini من Google، ينتج 4 أو 6 أو 8 ثوانٍ في كل تمريرة بمعدل 24 إطارًا في الثانية، وبجودة أصلية 720p، فيما تأتي دقتا 1080p و4K عبر تمريرة رفع دقة أُضيفت في تحديث يناير 2026. ويضيف التمديد سبع ثوانٍ في كل تمريرة، ويمكن تكراره حتى عشرين مرة ليصل إلى سقف نظري يبلغ نحو 148 ثانية، لكن يجب أن يكون المُدخل مقطعًا مولَّدًا بواسطة Veo لا يزيد طوله على 141 ثانية بدقة 720p وبنسبة 16:9 أو 9:16، كما أن طول الثماني ثوانٍ إلزامي للتمديد، ولإدخال صورة مرجعية، ولأي شيء يزيد على 720p. لا يمكنك إنشاء مقطع بدقة 1080p مدته أربع ثوانٍ. الناتج ملف تملكه، يحمل علامة مائية، ومرفق به سجل منشأ موقّع.
Griffin لا يُنتج ملفًا. إنه يُدير محادثة. محرّك النمذجة الحوارية المستمرة يستقبل الصوت والفيديو ويعيد تقييم التبادل على فترات أقل من الثانية، ويختار بين أن يبقى صامتًا أو يُشير أو يُصدر إشارات خلفية أو يأخذ الدور، ويُصدر عناصر تحكم تعبيرية تقود مولّد كلام بثّي ومولّد فيديو بثّي معًا. ينتج مولّد الفيديو دقة 720p في أجزاء مدتها 320 مللي ثانية، متجه كامن واحد في كل مرة، بمعدل 25 إطارًا في الثانية من صورة فوتوغرافية مرجعية واحدة، ويشغّل كل جزء أثناء فك ترميزه. لا يوجد طول مقطع لأن لا وجود لمقطع؛ إنها جلسة تستمر حتى يتوقف شخص عن الكلام.
هذا التمييز يحدد تقريبًا كل سطر آخر في هذه المقارنة. نطاق Veo 3.1 هو مجموعة من القيود التي يمكن لخط الإنتاج أن يخطط بناءً عليها — قوائم لقطات من ثماني ثوانٍ، وسلّم تمديد للقطات الأطول، ومعدل ثابت يبلغ 24 إطارًا في الثانية، وسلّم دقة معروف. أما مخرجات Griffin فلا يمكن إعداد لوحة قصصية لها مسبقًا على الإطلاق، لأن ما ينتجه يعتمد على ما يفعله الشخص بعد ذلك.
ما تكلفة Veo 3.1 في كل المستويات
أسعار Gemini API التي نشرتها Google تشمل الصوت، وتُحتسب لكل ثانية من المخرجات، ولا توجد طبقة مجانية عند أي مستوى من Veo 3.1. لا يمكن تعطيل الصوت في واجهة API تلك — إذ يُولَّد مع كل طلب — وهذا أمر مهم لأن مصادر طرف ثالث تصف بطاقة أسعار Vertex AI يعمل فيها الفيديو الصامت بنحو نصف القيمة التي تشمل الصوت. ولا تكشف وثائق Google نفسها عن ذلك الخيار. وإذا كانت أسعار الفيديو الصامت مهمة لفاتورتك، فتحقق منها من خلال فاتورة Vertex الخاصة بك لا من خلال صفحة مقارنة، بما فيها هذه الصفحة.
• Veo 3.1 Standard — 0.40 دولار/ثانية بدقة 720p و1080p، و0.60 دولار/ثانية بدقة 4K.
• Veo 3.1 Fast — 0.10 دولار/ثانية بدقة 720p، و0.12 دولار/ثانية بدقة 1080p، و0.30 دولار/ثانية بدقة 4K.
• Veo 3.1 Lite — 0.05 دولار/ثانية بدقة 720p، و0.08 دولار/ثانية بدقة 1080p، مع عدم توفر فئة 4K.
طبّق قاعدة الثماني ثوانٍ على تلك الأسعار، وستجد أن تكلفة كل محاولة هي ما يضعه فريق إبداعي فعليًا في ميزانيته: 32 سنتًا للقطة مدتها ثماني ثوانٍ بدقة 1080p على Standard، و80 سنتًا للقطة مدتها أربع ثوانٍ بالدقة نفسها لأن حد الثماني ثوانٍ لا ينطبق عند أقل من 720p، و4.80 دولارًا للقطة واحدة مدتها ثماني ثوانٍ بدقة 4K. هذا الرقم الأخير هو الذي يستحق التوقف عنده، لأن البحث بأربع محاولات عن لقطة 4K واحدة قابلة للاستخدام يكلّف أقل بقليل من عشرين دولارًا، وشرط الثماني ثوانٍ يعني أنك لا تستطيع اختبار الفكرة بنصف المدة مقابل نصف السعر.
لا يوجد لـ Griffin سعر، ولا طبقة مجانية، ولا أي شكل من جدول أسعار. يتاح Griffin-Lite لمختبِرين موثوقين مختارين كمعاينة بحثية عبر نموذج طلب، وهو ليس على منصة Tavus، ويوضح الإعلان صراحةً أنه لن يكون متاحًا لاستخدام العملاء في الوقت الحالي. السطر الختامي لـ Tavus على الصفحة هو أن Griffin سيصل بمجرد أن تتوصل الشركة إلى كيفية إطلاقه بأمان. كل ادعاء في هذا المقال يقارن بين الاثنين في أي شيء يشبه قرار شراء فيه ثغرة في نصف Griffin منه، ولا يملؤها أي قدر من البحث.
ما الذي تقيسه لوحتا النتائج في الواقع
تم تقييم النموذجين بأدوات مختلفة للسبب ذاته الذي يجعل من الصعب تسعير كل منهما مقابل الآخر.
يعيش Veo 3.1 على ساحة الفيديو الخاصة بـ Artificial Analysis، حيث يأتي تصنيف Elo من تفضيل بشري أعمى قائم على المقارنات الثنائية لمقاطع قصيرة. اقرأ في 2 أكتوبر 2026 على لوحة تحويل النص إلى فيديو مع الصوت:
• Veo 3.1 — المرتبة 18–21، تصنيف Elo 968 (±11) من أكثر من 2,857 صوتًا، 24.00 دولار/دقيقة.
• Veo 3.1 Fast — المرتبة 18–21، إيلو 961 (±10) بناءً على 3,595 صوتًا، 7.20 دولار/دقيقة.
• Veo 3.1 Lite — المرتبة 21–24، بتقييم Elo قدره 949 (±11) عبر 2,762 صوتًا، و4.80 دولار/دقيقة. • Veo 3.1 في تحويل الصور إلى فيديو (مع الصوت) — المرتبة 11 من 34، بتقييم Elo قدره 1,082 عبر 7,049 صوتًا، و24.00 دولار/دقيقة. إنه أفضل ترتيب له على أي لوحة، والأكثر حصولًا على الأصوات المؤيدة له.
ينتج عن ذلك أمران. الفئات الثلاث كلها ضمن نطاق تسع عشرة نقطة إيلو من بعضها البعض، مع فترات ثقة متداخلة، لذا فإن سعر الفئة القياسية لكل ثانية، الأعلى بأربعة أضعاف، لا يشتري تفضيلاً أعمى قابلاً للقياس. كما يتفوق خط Gemini Omni Flash الأحدث من جوجل على كل فئة من فئات Veo 3.1 في لوحة الصدارة نفسها — في المركزين السابع والثامن عند 1,117 نقطة إيلو، بناءً على أكثر من 7,801 صوت، وبتكلفة 9.12 دولارًا للدقيقة، متقدمًا على الفئات الثلاث كلها بينما لا تبلغ تكلفته في الدقيقة سوى ما بين ربع وخُمس تكلفة أي منها في الدقيقة — وهو سؤال يجدر بكل مشترٍ لـ Veo 3.1 أن يطرحه، وليس هذا المقال هو المكان المناسب للإجابة عنه.
تأتي أرقام Griffin من VideoFDB التابع لـ NVIDIA، وهو معيار لمحادثة سمعية بصرية كاملة الازدواجية بنته NVIDIA وقيّمته بشكل مستقل في سبتمبر 2026. سجّل Griffin-Lite 3.83 من 5 في مسار التوليد مقابل مرجع بشري قدره 3.92 و2.80 لأعلى نظام منشور تالٍ، و3.73 في مسار الإدراك مقابل مرجع بشري قدره 4.20. كما أبلغت Tavus عن زمن كمون حقيقي من الصوت إلى الفيديو مقداره 0.43 ثانية للمولّد مقابل أربعة خطوط أساس منشورة للانتشار المتدفق على H100s، واصفةً إياه بأنه نصف زمن التالي الأسرع.
لا تنتقل أيٌّ من المجموعتين. فتصنيف Elo المستمد من التصويت على تفضيل المقاطع القصيرة لا يقول شيئًا عمّا إذا كان يمكن مقاطعة نموذج؛ ودرجة معيار الحكم على المحادثة لا تقول شيئًا عمّا إذا كان المقطع يبدو صحيحًا بدقة 4K. والتحفظات تنطبق في الاتجاهين: فالفجوة البالغة 0.09 نقطة بين Griffin والمرجع البشري صغيرة بما يكفي على مقياس من خمس نقاط يحكم عليه نموذج لغوي بحيث يكون «قريب من البشر» هو القراءة الصادقة، وجزء من تفوقه في الإدراك يُقاس مقابل أنظمة تعمل دون إدخال فيديو على الإطلاق.

المصدر، الذي يمثل الفرق الحقيقي في المنتج
بالنسبة لأي شركة لديها أي التزام بالإفصاح، هذا هو القسم الوحيد المهم، ولا مجال للمقارنة.
يحمل ناتج Veo 3.1 تقنية SynthID إطارًا بإطار في البكسلات وفي الطيف الصوتي، وهي مصمّمة لتقاوم الضغط وتغيير الحجم والقص وتسجيل الشاشة، كما تسجّل C2PA Content Credentials مصدر الملف وسجل التعديلات، وهي قابلة للتشغيل البيني مع تطبيقات Adobe وMicrosoft. أدرجت Google ميزة الكشف في تطبيق Gemini، بحيث يمكن للمستخدم رفع مقطع فيديو والسؤال عمّا إذا كانت Google AI قد أنشأته، مع إبلاغ الكشف عن أي جزء من المسار الصوتي أو المرئي حمل العلامة. الحد واقعي ويجدر ذكره: ذلك الكاشف لا يتعرّف إلا على نماذج Google. لا شيء لدى Alibaba أو Kuaishou قابل للمقارنة، ولا شيء من Tavus كذلك.

لم تنشر Tavus علامة مائية، أو كاشفًا، أو خطًا لاعتمادات المحتوى الخاص بـ Griffin. ما نشرته هو السبب في أنها تحتاج إلى واحد. الدراسة وجهًا لوجه صريحة بشكل غير معتاد بشأن نمط الفشل: قال أكثر من نصف المشاركين إن احتمال وجود ذكاء اصطناعي لم يخطر ببالهم أثناء المكالمة، وخلص ما يقرب من جميع أفراد تلك المجموعة إلى أن شريكهم كان حقيقيًا، أما الذين شكّوا فعلاً فقد كانوا يميلون إلى اكتشاف الأمر خلال أول عشرين ثانية. كان المصدّقون واثقين بنسبة 79% في المتوسط، والشاكّون بنسبة 81%. هذا نموذج ليس خداعه أثرًا جانبيًا لجودة التوليد — بل هو جودة التوليد.
رد Tavus موجود في الإعلان وليس في حاشية: الخصائص ذاتها التي تجعل Human Interaction Models واجهات قوية للتواصل الطبيعي تتيح لها خداع الإنسان ليعتقد أنها ليست ذكاءً اصطناعياً؛ لذا تلزم إجراءات إضافية للمواءمة والسلامة من أجل إطلاق آمن، وتعمل الشركة على ميزات إفصاح آمنة وبالتعاون مع منظمات تتصدى لسلامة الذكاء الاصطناعي. ولهذا السبب توجد هذه البوابة. لن يكون Griffin-Lite متاحاً لاستخدام العملاء في الوقت الحالي.
الشروط المؤسسية التي تقدّمها Google ولا تقدّمها Tavus
يتم تقديم Veo 3.1 عبر Vertex AI مع البنية التحتية الإقليمية، وإدارة الهوية والوصول (IAM) وسطح عقود المؤسسات الذي يستلزمه ذلك، وتقيد Google ما سيفعله النموذج حسب الولاية القضائية: من خلال معامل توليد الأشخاص، لا تسمح كل من الاتحاد الأوروبي والمملكة المتحدة وسويسرا ومنطقة الشرق الأوسط وشمال أفريقيا (MENA) إلا بالأشخاص البالغين، بينما يمكن للمناطق الأخرى السماح بالجميع. هذا سطح سياسات موثق ومراعٍ للمنطقة، وبالنسبة للمشتري الخاضع للتنظيم، يمكن أن يتفوق على موقع في لوحة الصدارة.
هناك تكلفة تتعلق بشكل الأمر. لا تزال معرّفات نموذج Veo 3.1 على Gemini API معرّفات معاينة — veo-3.1-generate-preview وأخواته — بينما يحمل SKU الخاص بـ Vertex تسمية الإتاحة العامة، وتضع تقارير طرف ثالث حصة المعاينة عند نحو خُمس حصة الإنتاج. أوقفت Google وحدات SKU الأقدم من Veo 3.0 في 30 يونيو 2026، وهو ما يوضح كيفية التعامل مع تبدّل الأجيال ويستحق أن يُدرج في تسعير أي شيء مبني على معرّف معاينة. كما أن واجهة المستهلك مقيّدة فعلاً: يتطلب Flow اشتراك Google AI Pro أو Ultra، وهو محظور في الاتحاد الأوروبي والمملكة المتحدة والهند وإندونيسيا والبر الرئيسي للصين وروسيا، مع عدم توفير أي حل بديل عبر VPN.
لا توجد لدى Griffin شروط خدمة يمكن قراءتها، لأنه لا توجد خدمة أصلاً. فالوصول عبارة عن نموذج طلب ومعاينة بحثية. وقد قالت Tavus إنها تعمل مع منظمات سلامة على التقييمات وتريد أن يشارك الناس فيها، وهو موقف بحثي لا تجاري.
الحصول على أيٍّ منهما
يمكن الوصول إلى Veo 3.1 عبر Gemini API وVertex AI وGoogle AI Studio وFlow، وعبر تطبيق Gemini بدقة 720p فقط. خارج الصين، هو بفارق كبير الأسهل بين الاثنين من حيث الحصول على مفتاح، وهو ما يتعارض مع حجة الجودة أعلاه، ويشكّل السبب الرئيسي وراء بقاء هذه المقارنة مثيرة للاهتمام رغم الأرقام.
يمكن الوصول إلى Griffin عبر تقديم طلب وصول واختيارك كمختبِر موثوق. هذا هو مسار الشراء بأكمله.
حيث يساعد الموجّه حقًا في خط أنابيب Veo يكون ذلك على مقربة من نموذج الفيديو وليس داخله. فالنماذج النصية من Google — Gemini 3.5 Flash وGemini 3.1 Pro Preview وGemini 3.6 Flash وبقية السلسلة — موجودة في كتالوج OrcaRouter ويمكن استدعاؤها عبر نفس نقطة النهاية المتوافقة مع OpenAI التي تتيح الوصول إلى أكثر من 200 نموذج آخر بسعر قائمة المزوّد مع إضافة هامش ربح بنسبة 0%. قوائم اللقطات، وتوسيع المطالبات، وتوليد التعليقات التوضيحية، وملاحظات الاستمرارية بين المقاطع ذات الثماني ثوانٍ، وتلخيص المراجعات — كلها أعمال نصية، وهذه هي الطبقة التي تصبح فيها القدرة على تشغيل نموذج رخيص في مرور مجمّع ونموذج متقدّم في المرور النهائي كلفتها تغييرًا في الإعدادات لا عملية هجرة. أما Veo 3.1 نفسه فلا نقوم بتوجيهه، وكذلك Griffin؛ ويجدر أن نكون صريحين في ذلك بدلًا من ترك فقرة كهذه توحي بغير ذلك.
أيّ واحد، بصراحة
• اختر Veo 3.1 عندما يحتاج المُخرَج إلى مسار يوثّق المصدر، أو عندما يكون المشتري خاضعًا للتنظيم، أو عندما يجب أن يكون التوزيع ملفًا مرفقًا به بيانات الاعتماد، أو عندما تكون دقة 4K غير قابلة للتفاوض. احتسب حدّ الثماني ثوانٍ في كل نموذج تكلفة، وتحقق من دورة حياة معرّف المعاينة قبل بناء مسار موجّه للعملاء عليه.
• لا تختر Griffin، لأنك لا تستطيع. اطلب الوصول إذا كان سؤالك هو ما إذا كان بإمكان شخص التمييز بين الذكاء الاصطناعي والإنسان في مكالمة مدتها دقيقة واحدة، أو إذا كنت بحاجة إلى معرفة إلى أين تتجه طبقة التفاعل قبل أن تلتزم بخارطة طريق لطبقة المقطع.
• راقب الكاشف، لا العرض التجريبي. إذا نشرت Tavus آلية إفصاح تصمد أمام محادثة عادية، فإن الفجوة بين هذين المورّدين تضيق بشكل كبير. وإذا لم تفعل، فإن Griffin نتيجة تستحق الاستشهاد بها، ويبقى Veo 3.1 الوحيد بين الاثنين الذي يمكنك وضعه أمام فريق الامتثال.

