
Vidu Q4 Preview مقابل Seedance 2.5: ميزانية المراجع ليست الفرق الحقيقي
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
تبدو الميزانيات المرجعية المنشورة وكأنها فوز ساحق لـ Seedance 2.5: حتى 30 صورة، و10 مقاطع فيديو و10 مقاطع صوتية مقابل ما لدى Vidu Q4 Preview من 15 صورة و3 مقاطع صوتية. وهذا ضعف عدد الصور وثلاثة أضعاف الصوت، وكان ذلك وحده كفيلاً بحسم المسألة. لكن ذلك لا يحسم المسألة، لأن الرقم المهم ليس العدد — بل الوسيط الثاني. يقبل Seedance 2.5 الفيديو كمدخل. أما Vidu Q4 Preview فيقبل الصور والصوت، وليس لديه مسار موثّق لإدخال مقطع موجود.
أُطلق Seedance 2.5 في 31 يوليو 2026 بوصفه طرح ByteDance للنماذج الطويلة، إذ يولّد مقطعًا مدته 30 ثانية في تشغيل واحد مع تمديد متعدد الجولات لتسلسلات أطول. وأُطلق Vidu Q4 Preview في 7 أكتوبر 2026 من Shengshu Technology كمعاينة لنموذجها الرائد من الجيل التالي، بوضعين — تحويل الصورة إلى فيديو والمرجع إلى فيديو — ونقطتي نهاية API موثقتين. كلا النموذجين كثيفا الاعتماد على المراجع. وقد بُنيا ليستوعبا أشياء مختلفة.
ما الذي تتيحه فعليًا كل وسيلة إدخال
يمكن للنموذج الذي يتخذ من الصور مراجعَ أن يحافظ على طاقم أدوار ومظهر. تصف وثائق Vidu Q4 Preview دمج 1–15 صورة عبر الشخصيات والمشاهد والأسلوب بحيث يبقى الأشخاص متسقين عبر لقطة متعددة المشاهد، مع ما يصل إلى 3 مراجع صوتية بصيغة mp3 بمدة 3–12 ثانية لاستنساخ صوت والحفاظ على توافق الأداء. خمسة عشر موضعًا ضمن طاقم مشهد واحد وخزانة ملابسه ودعائمه وإضاءته هي ميزانية متماسكة، وهي السبب في أن النموذج يتقاسم الصدارة في لوحة تفضيلات تحويل الصورة إلى فيديو.
نموذج يمكن توجيهه إلى لقطات الفيديو أيضًا إذا اتخذ الفيديو مرجعًا له. إن قبول Seedance 2.5 لما يصل إلى 10 مدخلات فيديو إلى جانب 30 صورة و10 مقاطع صوتية يعني أن مجموعة المراجع يمكن أن تتضمن الحركة والإيقاع وسلوك الكاميرا المستمدة من مقطع موجود بدلًا من وصفها في توجيه نصي. تلك قدرة مختلفة، وليست نسخة أكبر من القدرة نفسها، وهي ما تضع Seedance 2.5 على لوحة تحرير الفيديو لدى Artificial Analysis — في المركز الثاني، بـ1,161 Elo بناءً على 5,162 صوتًا وفق ما قُرئ في 8 أكتوبر 2026 — لتحرير فيديو انطلاقًا من تعليمة نصية مع الإبقاء على الصوت. لا توجد Vidu Q4 Preview على تلك اللوحة، والسبب هو قائمة نقاط النهاية الخاصة بها، وليس درجتها.
التباين العملي:
• مراجع الصور — Vidu Q4 Preview حتى 15 مقابل Seedance 2.5 حتى 30
• مراجع الفيديو — Vidu Q4 Preview لا يوجد موثّق مقابل Seedance 2.5 حتى 10
• مراجع صوتية — Vidu Q4 Preview حتى 3 مقاطع MP3 من 3 إلى 12 ثانية، مقابل Seedance 2.5 حتى 10
• طول التشغيل الواحد — Vidu Q4 Preview من 3 إلى 16 ثانية في وضع الصورة إلى الفيديو، ومن 1 إلى 16 ثانية في وضع المرجع إلى الفيديو، مقابل Seedance 2.5 لمدة 30 ثانية في تشغيل واحد، مع إمكانية التمديد عبر جولات متعددة بعد ذلك
• الأوضاع — Vidu Q4 Preview من صورة إلى فيديو ومن مرجع إلى فيديو مقابل Seedance 2.5 من نص إلى فيديو، ومن مرجع إلى فيديو، ومن فيديو إلى مرجع، مع مسار تحرير مطروح على الطاولة
• دقة الإخراج — Vidu Q4 Preview من 540p حتى 4K كفئات توليد مُسعّرة، مع 2K و4K بعمق لوني 10-بت، مقابل Seedance 2.5 بدقة 480p و720p على المضيفين الذين ينشرون إعداداته، حيث تبلغ الفئات الأعلى دقة التسليم عبر رفع الدقة.
ضع تلك جنبًا إلى جنب، وستجد أن النماذج لا تتنافس على الموجز نفسه. لقطة بدقة 4K مدتها ست عشرة ثانية مع خمسة عشر مرجعًا، ولقطة بدقة 720p مدتها ثلاثون ثانية مع ثلاثين مرجعًا وإدخال فيديو، هما إجابتان عن سؤالين إنتاجيين مختلفين.
وحدات التسعير لا تُحوَّل، وهذه هي القصة كاملة
هنا يقع الخطأ في معظم المقارنات بين هذين الاثنين، والعيب في الوحدة لا في الحساب.
لا تبيع ByteDance نموذج Seedance 2.5 بالثانية عبر مورّدها. فهي تقيس النموذج بوحدات رموز الفيديو وفق بطاقة الأسعار الرسمية، المنشورة عبر Volcano Engine Ark في الصين وBytePlus ModelArk دوليًا. وتعتمد تكلفة المقطع على الدقة والمدة والاستخدام الفعلي للرموز، لذا فإن رقم التكلفة لكل ثانية لا يكون صالحًا إلا لدقة واحدة ومدة واحدة — كما أن المحاولات الفاشلة تُحاسَب بالتكلفة نفسها التي تُحاسَب بها المحاولات الناجحة. أما المضيفون من الأطراف الثالثة الذين يتيحون Seedance 2.5 فيضيفون هامش ربح خاصًا بهم فوق ذلك، وينشرون سعرهم الخاص لكل ثانية أو لكل مقطع، ولهذا تعطي اثنتا عشرة صفحة اثني عشر رقمًا مختلفًا، ولا أحدها هو رقم المورّد.
يتم تسعير Vidu Q4 Preview بالطريقة الأخرى: معدل ائتمان ثابت لكل ثانية يتغير فقط حسب طبقة الدقة التي تختارها، وينشره Shengshu علنًا. تسعة ائتمانات لكل ثانية عند 540p، و19 عند 720p، و24 عند 1080p، و38 عند 2K، و78 عند 4K، مقابل معدل ائتمان المنصة المعلن البالغ $0.005، مع خصومات حزمة محدودة الوقت تصل إلى 30% تُطرح حاليًا. عند السعر الأساسي، يمتد المنحنى من حوالي $0.045 لكل ثانية عند 540p إلى حوالي $0.39 عند 4K. رقم $0.014 لكل ثانية من إعلان الإطلاق هو طبقة 540p مع تطبيق الخصم.
وهو ما يعني أن بطاقتي الأسعار لا يمكن مقارنتهما سطراً بسطر، وأي صفحة تفعل ذلك إنما تقارن قائمة أسعار علنية لمورّد بهامش ربح يضيفه مستضيف. أما ما يمكن مقارنته فهو ما ينشره المورّد عن بنية تسعير كل منهما: تكلفة Vidu تتدرّج مع الدقة والمدة ويمكن معرفتها قبل أن تضغط على توليد؛ أما تكلفة Seedance فتُقاس بعدّاد التوكنات، وبالتالي تعتمد على كيفية اختيار النموذج لإنفاق التوكنات على موجّهك. إحداهما يمكن التنبؤ بها، والأخرى تُقاس بعدّاد. ليس أي منهما خاطئاً، لكنهما يناسبان مشترين مختلفين — والثاني أكثر خطورة بينهما عند بناء الميزانية عليه، لأن التباين يقع على جانب المورّد من الخط الفاصل.
على اللوحة المستقلة، تجدر قراءة الأرقام المسجلة لكل دقيقة كمؤشر على رتبة الحجم فقط. تسجّل Artificial Analysis نموذج Vidu Q4 Preview عند 7.20 دولارات في الدقيقة على لوحة الصورة إلى الفيديو، وDreamina Seedance 2.5 عند 34.12 دولارًا في الدقيقة على النص إلى الفيديو و40.82 دولارًا على التحرير. تمثّل تلك الأعمدة تكلفة دقيقة واحدة من مخرجات 1080p عند الإعدادات الافتراضية لكل نموذج — بينما يعتمد Seedance 2.5 افتراضيًا على الإعداد الأطول والأثقل الذي تُسعّره بطاقة معدلاته، في حين أن الإعداد الافتراضي لـ Vidu Q4 Preview هو مقطع بتوليد واحد. إنها تقيس سلوكيات افتراضية مختلفة، لا فجوة كفاءة تبلغ أربعة إلى خمسة أضعاف.
ست عشرة ثانية مقابل ثلاثين فرق حقيقي
هناك مقارنة واحدة تنجو من مشكلة الوحدة، وهي الطول. ثلاثون ثانية في تشغيل واحد تعادل تقريبًا ضعف الحد الأقصى البالغ ست عشرة ثانية لدى Vidu Q4 Preview، كما أن التمديد متعدد الجولات في Seedance 2.5 يعني أنه يمكن بناء تسلسل يتجاوز ذلك. بالنسبة للعمل السردي — مشهد له قوس درامي، أو إعلان له تمهيد وذروة — فإن الفرق بين ست عشرة وثلاثين ثانية هو الفرق بين لقطة ومشهد.
وينعكس الأمر عند الطرف الأدق. يولّد Vidu Q4 Preview انطلاقًا من ثلاث ثوانٍ، وتُسعَّر فئته بدقة 540p بنحو ثلث سعر فئته بدقة 720p نفسها، ما يجعل تخطيط تكوين المشهد رخيصًا قبل الالتزام بتصيير بالدقة الكاملة. ولا يؤدي أي شيء في هيكل أسعار Seedance 2.5 المنشور هذا الدور: ففئة 480p الأساسية لديه تكلف أقل من 720p، لكن فوترة المورّد نفسه قائمة على التوكنات، لذا لا يوجد لاختبار قصير منخفض الدقة سعر منشور واضح يمكن التخطيط على أساسه.
أيّ واحد، باختصار؟
اختر Seedance 2.5 عندما تكون المهمة مرتبطة بلقطات موجودة لديك بالفعل. وإذا كان العمل يتمثّل في تمديد مقطع موجود أو إعادة تصميمه بأسلوب مختلف أو إعادة مونتاجه، أو إذا كانت مجموعة المراجع بحاجة إلى نقل الحركة وليس المظهر فقط، فإن إدخال الفيديو هو القدرة الحاسمة ولا يمكن الاستعاضة عنه بـ Vidu Q4 Preview. أضِف التشغيل الواحد البالغ ثلاثين ثانية، وستكون الحجة واضحة للعمل السردي والإعلاني ذي القوس الأطول.
اختر Vidu Q4 Preview عندما تكون المهمة طاقمًا تمثيليًا يجب أن يحافظ على ثباته ومواصفات تسليم تتجاوز 720p. التوليد الأصلي بدقة 2K و4K بعمق لوني 10 بت هو مستوى لا تنشره Seedance 2.5 على مستوى المورّد، كما أن السعر لكل ثانية يجعل لقطة 4K كمية يمكنك وضع ميزانية لها فعليًا بدلًا من مجهول محسوب بالعدّاد. خمسة عشر مرجعًا صوريًا وثلاثة مراجع صوتية تكفي لطاقم مشهد واحد، كما أن مستوى التخطيط بدقة 540p يجعل التكرار رخيصًا.
ما الذي قد يغيّر هذا: إصدار كامل من Vidu Q4 يضيف نمط إدخال الفيديو من شأنه أن يُلغي الفرق البنيوي ويجعل هذين النموذجين متنافسين مباشرين، ومواد Shengshu نفسها تقول إن المعاينة موجودة تحديدًا لجمع الملاحظات التي تشكّل البناء النهائي. وفي المقابل، إذا نشرت ByteDance جدول أمثلة لمعدل التوكنات عند إعدادات أكثر، يصبح التخطيط حول عدم التماثل بين القائم على القياس والقابل للتنبؤ أسهل بكثير. وإلى أن يتحقق أي منهما، فإن القراءة الصحيحة لعبارة «30 مرجعًا مقابل 15» هي أن أحد هذين النموذجين يستقبل الفيديو والآخر لا.
مفتاح واحد لنماذج الفيديو التي يمكنك استدعاؤها فعلاً
يضع OrcaRouter نماذج الفيديو واللغة خلف نقطة نهاية واحدة متوافقة مع OpenAI على مفتاح واحد، بأسعار قائمة المورّد مُمرَّرة كما هي دون إضافة أي هامش، لذا يظهر أي تغيير في أسعار المورّد في اليوم نفسه بدلًا من موعد التجديد. لا تُعد Vidu Q4 Preview وSeedance 2.5 حاليًا من مسارات OrcaRouter، ولا تشير هذه الصفحة إلى خلاف ذلك. أما مسارات الفيديو التي نقدّمها فعلًا — Kling 3.0 ومنها نسختاه Turbo وv2.6 — فتقع إلى جانب نماذج اللغة على نقطة النهاية نفسها وبنمط الطلب نفسه، مع تحويل تلقائي عند الفشل بين المسارات بدلًا من عقد منفصل لكل نموذج.
هذه هي البنية التي تجعل مقارنةً كهذه قابلة للإتمام: شغّل المرشحين على الموجز الخاص بك، وبإعداداتك الخاصة، واترك القرار لمعدل القبول بدلًا من بطاقتَي أسعار بوحدات مختلفة.



