
Tavus Griffin مقابل HeyGen Video 1: بفارق ست وثلاثين ساعة، وواحد فقط قابل للشراء
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 223 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
وقع إطلاقان خلال ست وثلاثين ساعة من بعضهما في الزاوية نفسها من السوق، والتقويم هو أكثر ما يثير الاهتمام في هذا الاقتران. انطلق HeyGen Video في 30 سبتمبر 2026 بسعر 0.01 دولار في الثانية حتى نهاية أكتوبر، مضبوطًا من MiniMax H3 ويُطرح تحت المعرّف heygen-video-1. أُعلن عن Tavus Griffin في 1 أكتوبر 2026 مع دراسة مباشرة وجهاً لوجه اعتقد فيها 26 من 54 مشاركًا أن شريكهم شخص حقيقي، وهو متاح فقط لمختبِرين موثوقين مختارين خلف استمارة طلب، بلا معرّف ولا نقطة نهاية ولا سعر. كلاهما يتعلق بتوليد إنسان مقنع. السبب الصادق لمقارنة Tavus Griffin وHeyGen Video 1 ليس أن مشتريًا سيختار بينهما — فاليوم يمكن شراء واحدٍ منهما فقط — بل إن الفرق يفسّر ما بُني كلٌّ منهما لفعله، وما تساويه فعلاً ثانية من إنسان مُولَّد.
أحدهما يبيع مقطعًا، والآخر يبيع محادثة.
HeyGen Video هو نموذج فيديو للأغراض العامة، وهو بارع على نحو غير معتاد في الأشخاص. يستقبل موجّهًا نصيًا، أو موجّهًا نصيًا مع صورة، أو موجّهًا نصيًا مع ما يصل إلى تسع صور مرجعية، وثلاثة فيديوهات مرجعية، وثلاثة مقاطع صوتية مرجعية، ويعيد مقطعًا يتراوح طوله بين 5 و15 ثانية بدقة 480p أو 768p، و24 fps، مع صوت AAC ستيريو بتردد 32 kHz يحمل حوارًا وأجواءً صوتية ومؤثرات مُولّدة. تغطي ثلاثة أوضاع التهيئة — text_to_video، image_to_video، وreference_to_video، وهو الوضع الافتراضي — ويصبح ترتيب القائمة هو التسمية التي تخاطبها في الموجّه، لذا فإن أول مدخل في reference_images هو <Picture 1>. تُرفض الحقول غير المعروفة في الطلب بدلًا من تجاهلها، والبذرة عدد صحيح 32-بت غير مُوقّع يجعل اللقطة قابلة للتكرار عندما تُبقيها ثابتة وتغيّر بندًا واحدًا في كل مرة. إنها أداة إنتاج ذات نطاق حتمي.
Griffin يقلب جميع هذه الخصائص تقريبًا رأسًا على عقب. فهو يولّد بدقة 720p على شكل أجزاء مدتها 320 ms بمعدل 25 fps انطلاقًا من صورة فوتوغرافية مرجعية واحدة، ويشغّل كل جزء أثناء فك ترميزه، لذا لا توجد مدة مقطع يجب تحديدها ولا ملف يُعاد تسليمه. محرّك Continuous Conversational Modeling يستهلك الصوت والفيديو ويعيد تقييم التبادل على فترات دون الثانية، فيختار ما إذا كان سيبقى صامتًا، أو يرسل إشارة، أو يشارك بإشارة خلفية، أو يأخذ الدور، كما تقود عناصر التحكم التعبيرية فيه مولّد كلام متدفقًا ومولّد فيديو متدفقًا بالتوازي. ويظهر قرار يُتخذ في منتصف الجملة في الصوت والوجه خلال نفس الدور المصغّر. أنت لا تكتب مطالبة نصية؛ بل تتحدث إليه، وهو يستجيب لوقفة، أو إبعاد نظرة، أو مقاطعة.
لهذا السبب، لا يُعدّ الاثنان بديلين أحدهما عن الآخر رغم أن كليهما يولّد إنسانًا. يُسأل HeyGen Video عن شكل لحظة موصوفة. ويُسأل Griffin عمّا ينبغي أن يحدث بعد ذلك.
كم تكلف كل ثانية، في تلك التي يمكنك فيها شراء الثواني
سعر إطلاق HeyGen Video هو 0.01 دولار في الثانية حتى نهاية أكتوبر، ويصف نص HeyGen نفسه ذلك بأنه خصم 50% عن السعر القياسي 0.02 دولار. أما مخطط التكلفة في الصفحة نفسها، والمُدوَّن في حاشيته كسعر قائمة لكل ثانية بدقة 768p مع الصوت قبل عروض الإطلاق، فيضعه عند 0.03 دولار. وهذا فرق قدره 50% بين النص والمخطط في مواد إطلاق المورّد نفسه، وإلى أن تنشر HeyGen صفحة تسعير API، فإن التفسير الآمن هو أن 0.01 دولار مؤكد لأنه سعر سارٍ فعليًا، وأن رقم ما بعد أكتوبر يقع في مكان ما بين 0.02 دولار و0.03 دولار.
اجرِ الحسابات على مدى ألف ثانية — مئة مقطع من عشر ثوانٍ — وهي الوحدة التي يفكّر بها فريق العمل بالجملة فعليًا:
• فيديو HeyGen في أكتوبر — 10$ بمعدل 0.01$ في الثانية.
• فيديو HeyGen بعد أكتوبر — 20 دولارًا عند 0.02 دولار، أو 30 دولارًا عند 0.03 دولار وفقًا للرسم البياني.
• MiniMax H3، النموذج الأساسي الذي تم ضبطه منه — 80 دولارًا بسعر MiniMax المعلن البالغ 0.08 دولار في الثانية.
• Kling 3.0 Pro — 168$ بمعدل 0.168$ في الثانية.
• Veo 3.1 — 400 دولار بمعدل 0.40 دولار في الثانية.
السبب الذي يجعل الحساب عنوانًا رئيسيًا لإطلاق HeyGen هو معدل الإهدار. فالفرق التي تنتج مقاطع مختصرة للسوشيال ميديا، ونسخًا إعلانية، وحلقات منتجات تولّد أكثر بكثير مما تنشره، وعند تكلفة عشرة سنتات لكل محاولة مدتها عشر ثوانٍ يتغير شكل اقتصاديات التخلص من المرشحين بالكامل. العقبة هي السقف: دقة 768p بمعدل 24 fps ليست صيغة تسليم 2K، وتصل MiniMax H3 إلى 2K عبر وحدة إعادة توليد منفصلة على واجهة API المستضافة الخاصة بـ MiniMax بتكلفة 0.13 دولار في الثانية، مع عدم وجود مقابل مكافئ على HeyGen Video. إذا كان هدف التسليم لديك أعلى من 768p، فإن الثانية الرخيصة ليست الثانية التي تحتاجها.
عمود Griffin في تلك القائمة فارغ، وليس على نحو مبشّر. لم تنشر Tavus سعرًا، لأن Griffin-Lite معاينة بحثية يقول إعلانها الخاص إنها لن تكون متاحة لاستخدام العملاء في الوقت الحالي، وليست على منصة Tavus. وفي ظل نموذج الألف ثانية لا يوجد شيء يمكن تدوينه. أي شخص يستشهد برقم لـ Griffin فهو يختلقه.
أرقام الجودة، ومن يقوم بالتقييم
لا يملك أيٌّ من هذين الطرازين نتيجةً مستقلة، ومن الجدير بالذكر قول ذلك منذ البداية لأن كلا البائعين لديهما رسوم بيانية.
جدول HeyGen هو جدول Elo مع تطبيع HeyGen Video إلى 1000، ثم Dreamina Seedance 2.0 عند 955، وعائلة H3 Max موزّعة من 952 نزولاً إلى 860، وKling 3.0 Pro عند 857 وVeo 3.1 عند 744. الحاشية السفلية تقوم بمعظم العمل: تأتي الدرجات من مجموعة تقييم داخلية من استعلامات Artificial Analysis Arena تضم 4,800 صوت، ودرجة HeyGen نفسها مطبّعة إلى 1000 لمقارنة أبسط. قيام مورّد بتطبيع نفسه إلى قمة مخططه الخاص هو خيار عرض تقديمي، وليس دليلاً على أنه يتصدّر. التباعد النسبي تحته هو الجزء المفيد.
الأكثر فائدة هو المواجهة المباشرة، فهي المكان الوحيد الذي تختبر فيه HeyGen نموذجها مقابل شيء لم تبنه بنفسها. تقول HeyGen إن مختبِرين في اختبار أعمى فضّلوا نموذجها على H3 Max post-train المدرج في المخطط في 55.8% من المقارنات عبر 650 صوتًا، بنطاق يتراوح بين 49% و62%. هذا النطاق هو التفصيل الصادق: عند طرفه الأدنى يقع حول 50%، لذا فحتى وفق أرقام البائع نفسه، ليست الأفضلية على ذلك المنافس منفصلة بوضوح عن الضوضاء. والتفصيل حسب المحاور مختلط بطريقة تبدو وكأنها ملف فشل محدد — 65% في الالتزام بالصورة المصدر و66% في التوقيت، مقابل 43% في الاتساق و45% في الموسيقى.
أرقام Griffin تأتي من أداة بناها طرف آخر، وهذا هو الفرق المهم. إن VideoFDB من NVIDIA هو معيار قياس للمحادثة السمعية البصرية كاملة الازدواجية، يُقيَّم على مسارين، وقد بنته NVIDIA وتُجري التقييم بحَكَم خاص بها وفق معيار تقييم منشور. سجّل Griffin-Lite 3.83 من 5 في التوليد مقابل مرجع بشري قدره 3.92، و2.80 لأعلى نظام منشور يليه، و3.73 في الإدراك مقابل مرجع بشري قدره 4.20. كما تذكر Tavus أيضًا أن زمن الاستجابة الحقيقي من الصوت إلى الفيديو للمولِّد يبلغ 0.43 ثانية، مقابل أربعة خطوط أساس منشورة للانتشار التدفقي على H100s. لا تزال التحفظات قائمة — ففجوة مقدارها 0.09 نقطة عن الأداء البشري في معيار من خمس نقاط يُحكم عليه بواسطة نموذج لغوي هي "قريبة"، وليست "متساوية"، وجزء من التقدم في الإدراك يُقاس مقابل أنظمة تعمل دون إدخال فيديو — لكن المُقيِّم ليس المورّد.
• درجات جودة مستقلة — لا يملك أيٌّ منهما واحدة. لا يظهر HeyGen Video على أيٍّ من لوحات الفيديو الثلاث لدى Artificial Analysis اعتبارًا من 2 أكتوبر 2026، وينطبق الأمر ذاته على Griffin. وقد لا يحدث ذلك أبدًا مع Griffin: فالتصويت الثنائي على التفضيلات عبر مقاطع قصيرة لا يمكنه تقييم محادثة مباشرة.
نفس اللوحات تحمل النموذج الأساسي بالفعل. يحتل MiniMax H3 المرتبة الرابعة في تحويل النص إلى فيديو (مع الصوت) بتقييم Elo 1,139 والمرتبة الثانية في تحويل الصورة إلى فيديو عند 1,181، وكلاهما بسعر 4.80 دولار/دقيقة — لذا فإن التدريب اللاحق الخاص بـ HeyGen يتنافس على ركيزة تصنفها ساحة مستقلة بالفعل قريبة من القمة، وهو أقوى حجة لصالحه لم تنشرها HeyGen بنفسها.

كلاهما رخيصان أو لا يمكن تسعيرهما للسبب نفسه.
الحقيقة البنيوية الكامنة تحت كلا الإطلاقين هي أن صناعة إنسان مقنع أصبحت رخيصة، وأن ميزة التكلفة لدى أي من الشركتين لا تأتي من الشيء الذي تبيعه.
فيديو HeyGen هو تدريب لاحق لـ MiniMax H3، الذي أصدرته MiniMax بأوزان متاحة بموجب رخصة مجتمعها الخاصة. وقد حوّل ذلك H3 إلى ركيزة يمكن لشركات أخرى أن تتخصص فيها وتعيد بيعها، وHeyGen هو المنتج الثاني الذي يفعل ذلك خلال خمسة أسابيع لقطاع مختلف — فيديو الأعمال، وعروض المنتجات التوضيحية، والتدريب، وجولات العقارات. هذا النمط هو السبب وراء قدرة HeyGen على التسعير بأقل من الأساس: فهو لا يتحمل تكلفة النموذج الأساسي، والأساس هو إصدار أوزان مفتوحة لجهة أخرى.
Griffin هو الرهان المعاكس. بنت Tavus النظام بأكمله — الكودك، ومولّد الكلام المتدفق، ومولّد الفيديو المتدفق، والنموذج الحواري — حول التفاعل نفسه، عبر تقطير معلّم انتشار ثنائي الاتجاه كبير إلى مولّد انحداري ذاتي قليل الخطوات على ثلاث مراحل، بحيث لا تنحرف عمليات التوليد الطويلة. هذا بحث مكلف بلا قاعدة مفتوحة يستند إليها، وهو جزء محتمل من سبب تقييد الإصدار: فلا توجد ركيزة رخيصة تحته يمكن أن تُوزَّع عليها التكلفة.
تصل الشركتان أيضًا إلى الموضع غير المريح نفسه من اتجاهين مختلفين. يسرد توثيق HeyGen الخاص ما يكون النموذج أسوأ فيه، وهو أمر نادر ويستحق القراءة: النصوص الطويلة على الشاشة، والحركة العضوية الناعمة مثل البتلات والورق والشعر، والعمل اليدوي القريب مثل تجميع المعدات أو تشغيلها. وهو في أفضل حالاته في اللقطات القصيرة المحدودة — شخص واحد، ومكان واحد، وفعل واحد، وكاميرا ثابتة أو بالكاد تتحرك. لا يقتصر قيد Griffin على قائمة بأنماط الفشل، بل هو مشكلة سلامة لم تُحل: يصرّح Tavus بوضوح أن الخصائص التي تجعل نموذج التفاعل البشري واجهة أفضل تجعله أيضًا أفضل في إقناع شخص بأنه يتحدث إلى إنسان، وأنه يحتجز المعاينة ريثما يبني آليات الإفصاح.
ما يمكن للمشتري فعله فعليًا اليوم
أصبح HeyGen Video قابلاً للاستدعاء الآن. يعمل عبر POST /v3/models/videos مع x-api-key كترويسة، وعلى مفاتيح API المدفوعة فقط، مع روابط تنزيل موقّعة تنتهي صلاحيتها — لذا فإن الاستقصاء الدوري يحدّثها — واستدعاءات راجعة تُجرَّب مرة واحدة لكل مهمة، وهو ما يخبرك HeyGen نفسه أن تعاملها كتحسين الكمون لا كضمان. إذا كنت تختبره هذا الشهر، فالثانية الترويجية بسعر 0.01 دولار متاحة، والحد الأقصى للمخرجات هو 768p، ووضع تحسين المطالبة رافعة تكلفة حقيقية: turbo افتراضيًا، وquality لتمريرة أطول، وdisabled لإرسال نصك دون تغيير.
Griffin غير قابل للاستدعاء. الوصول عبارة عن نموذج طلب ومعاينة بحثية. لا يوجد مفتاح، ولا مُعرّف، ولا نقطة نهاية، ولا SLA، والبيان المنشور الوحيد بشأن الإتاحة هو أنه سيصبح متاحًا بمجرد أن تتوصّل Tavus إلى كيفية إطلاقه بأمان.
ثمة أمر مشترك بين كليهما هو أن أياً منهما ليس نموذجاً يمكن لموجّه أن يساعدك في الوصول إليه، وفي حالة Griffin تُعد هذه مشكلة فئة وليست مشكلة مؤقتة — فجلسة كاملة الازدواج في الوقت الفعلي ليست استدعاء طلب-استجابة. ما يساعد فيه الموجّه في أي من المسارين هو الطبقة المحيطة بالفيديو. توسيع المطالبات، وجرد الصور المرجعية، ووصف اللقطات، وتوليد التعليقات التوضيحية، وتلخيص المراجعات كلها استدعاءات نصية، وتلك القادمة من OpenAI وGoogle والبقية توجد في كتالوج OrcaRouter خلف نقطة نهاية واحدة متوافقة مع OpenAI تضم أكثر من 200 نموذج على المفتاح نفسه، بسعر قائمة المزوّد مع هامش ربح مضاف بنسبة 0%، لذا يصبح أي تغيير في سعر المورّد ساريًا في اليوم نفسه. وفيما يخص نموذج الفيديو نفسه، ثمة حقيقة مفيدة واحدة: إن MiniMax H3 — النموذج الأساسي الذي ضُبط منه HeyGen Video، والشيء الذي يخفض سعر HeyGen البالغ $0.01 من سعره لكل ثانية — يُوجَّه هنا باسم minimax/minimax-h3 بسعر $0.08 لكل ثانية، و2K بسعر $0.13. HeyGen Video نفسه ليس في كتالوجنا، ولا Griffin كذلك؛ إذ يُقدَّم كلاهما عبر واجهات برمجة التطبيقات الخاصة بمورّديهما وعدة منصات طرف ثالث.

أي واحد، ولمن؟
• استخدم HeyGen Video إذا كان المُخرَج النهائي عبارة عن لقطات قصيرة، محدودة النطاق، تتمركز حول الشخص، مع صوت مدمج، ويمكنك تقبّل دقة 768p عند 24 fps. احسب سعر ما بعد أكتوبر بما يتراوح بين $0.02 و$0.03 في الثانية بدلًا من الدايم الترويجي، واختبر النص الطويل على الشاشة والعمل اليدوي عن قرب قبل اعتماد سير عمل عليه، لأن HeyGen أخبرك بالفعل أن هذه هي المواضع التي يتعطّل فيها.
• لا تخطط بناءً على Griffin. اطلب الوصول إذا كان سؤالك هو ما إذا كان يمكن لشخص أن يميّز إنسانًا مُولَّدًا من إنسان حقيقي في مكالمة مدتها دقيقة واحدة، أو إذا كنت بحاجة إلى رؤية إلى أين تتجه طبقة التفاعل في الوقت الفعلي قبل أن تلتزم بخريطة طريق لمقاطع مُصيَّرة.
• راقب مسألة الإفصاح، لأنها الشيء الوحيد الذي سيحرّك كليهما. لدى عملاء HeyGen Video إجابة واضحة متاحة — فالنموذج نسخة مدرَّبة تدريبًا لاحقًا من قاعدة مفتوحة الأوزان، والمخرجات ملف له مصدر معروف — بينما تُبقي Tavus نموذجًا محتجزًا تحديدًا لأنها لا تملك واحدة بعد. وأي شركة تنشر آلية إفصاح أفضل ستكون قد حسمت المسألة الأكثر قيمة.

