
Kandinsky 6.0 Video مقابل Seedance 2.5: النسخة الموجودة في الورقة البحثية ليست النسخة التي تشتريها
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 150 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 52 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 250 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
الجملة الأكثر اقتباسًا في هذه المواجهة هي مقارنة مع النموذج الخطأ. التقرير الفني لـ Kandinsky 6.0 Video، المنشور في 6 أكتوبر 2026 مع إصدار MIT للأوزان، يقارن بـ Dreamina Seedance 2.0 — الجيل السابق. Seedance 2.5، النموذج الحالي للفيديو والصوت من ByteDance، يُشحن منذ 31 يوليو 2026 وهو المعروض للبيع. لذا عندما يستنتج التقرير أن Seedance "مُفضَّل على المعايير البصرية، بفروق ذات دلالة إحصائية في الجودة البصرية الإجمالية، والعيوب، وواقعية الحركة، واتباع التوجيه البصري"، فإنه يصف إصدارًا لا يمكنك ترخيصه اليوم، تم تقييمه من قبل المختبر الذي كتب Kandinsky 6.0 Video. كلا شقي تلك الجملة مهمان، وليس أي منهما سببًا لتجاهل المقارنة — فجوة الإصدارات تضع حدًا أدنى لما يمكن أن تخبرك به، والصياغة تخبرك بمن تثق في ماذا.
ما الذي تغيّر بين نسختي Seedance؟
الخطوة من 2.0 إلى 2.5 ليست إعادة رسم، وهذا تحديداً سبب أن الاستبدال ليس تجميلياً. يولّد Seedance 2.5 ما يصل إلى ثلاثين ثانية في تمريرة واحدة — أي ستة أضعاف النطاق الزمني للنموذج الوارد في التقرير، وستة أضعاف الخمس الثواني الثابتة لدى Kandinsky 6.0 Video. ويضيف استهدافاً على مستوى الطابع الزمني وتعديلات بعد التوليد على مستوى المنطقة، ما يعني أنه يمكن تطبيق تغيير على نافذة زمنية من المقطع أو جزء من الإطار بدلاً من إعادة توليد المقطع بأكمله. ويقرأ النص إلى جانب نحو ثلاثين صورة وعشرة مقاطع فيديو وعشرة مقاطع صوتية كمواد مرجعية في طلب واحد، مقابل إطار الذيل المقنّع الواحد لدى Kandinsky 6.0 Video. وينتج صوتاً متزامناً مع الحوار، وهو السبب الوحيد الذي يجعل هذين الاثنين ينتميان إلى المقالة نفسها من الأساس.
كل واحد من هذه قدرة لم يختبرها تقييم التقرير. لذا تخبرك نتيجة المعايير البصرية بأن Kandinsky 6.0 Video تخلف عن الجيل السابق من Seedance في الجودة البصرية الإجمالية، والعيوب، وواقعية الحركة، واتباع المطالبات. وهي لا تخبرك بما قد يفعله الإصدار الحالي، والافتراض الصادق هو أن الجيل الأحدث لا يصبح أسوأ على المحاور التي تؤكد عليها ملاحظات إصداره.
ما الذي يثبته تقييم التقرير نفسه وما لا يثبته
تم الإفصاح عن المنهجية على نحو وافٍ يكفي لتقييمها. أزواج جنبًا إلى جنب مولّدة من الموجّه نفسه بواسطة نموذجين، مع إخفاء هوية المقطعين كليهما، وتوزيع مواضع اليسار/اليمين عشوائيًا لكل مهمة، وخلط ترتيب المهام، وتعطيل الصوت أولًا للأسئلة البصرية ثم تمكينه للأسئلة الصوتية، وخيار تعادل متماثل وخيار صريح لـ«لا ينطبق» (N/A) حيث يتعذر الحكم على معيار، وتجميع بتصويت الأغلبية عبر المقيّمين، ونحو 200 مقارنة زوجية أو أكثر لكل معيار مُقيَّم.
وفق تلك الطريقة، تنقسم نتيجة Seedance 2.0 على نحو سيبدو مألوفًا لكل من قرأ مقارنة Kling في التقرير نفسه. تذهب المعايير البصرية إلى Seedance بفوارق تتجاوز عتبة الدلالة. أما المجال الصوتي فهو أقرب بكثير: تصل مزامنة الصوت مع الفيديو إلى شبه تعادل، وتصب جودة الكلام في مصلحة Kandinsky 6.0 Video Pro. بين هاتين العبارتين يكمن القرار كله، لأنه يعني أن أحدث نقطة تحقق مفتوحة للصوت والفيديو متأخرة بشكل قابل للقياس في ما يتعلق بكيفية ظهور المقطع، ومتقدمة بشكل قابل للقياس في ما يتعلق بكيفية سماع الكلام فيه.
إن القيود المفروضة على تلك النتيجة هي القيود المعتادة، ولا يشكّل أي منها ضربة قاضية لها. فقد أجراها مؤلفو Kandinsky على مطالبات من اختيارهم ومع مُقيّمين استقطبوهم. ولا توجد أي ساحة عمياء عامة تقيّم Kandinsky 6.0 Video على الإطلاق، لذا لم يختبر أي طرف خارجي ما إذا كانت مطالبات شخص غريب تعيد إنتاج هذا الانقسام. ويكشف التقرير أيضًا عن السقف الذي يقيس مقابله: مقاطع تصل مدتها إلى خمس ثوانٍ، وتوليد أساسي بدقة SD مع بلوغ Full HD عبر مرحلة دقة فائقة، ووجود فجوة متبقية أمام أقوى الأنظمة المملوكة في الجودة البصرية والجودة الصوتية الإجمالية.
ثلاث فجوات هيكلية لن يلتقطها أي معيار قياس
المدة هي أولى العقبات وأكثرها مباشرة. إن Kandinsky 6.0 Video مُدرَّب ويُقيَّم عند 121 إطارًا، ويعمل بالاستدلال عند 121 إطارًا، أي 5 ثوانٍ بمعدل 24 إطارًا في الثانية، ويأتي دون وضع تمديد — فمقطع مدته ثلاثون ثانية يعني ست عمليات توليد، وخمس عمليات دمج، ومخاطر استمرارية تتحملها أنت. أما Seedance 2.5 فينجز ثلاثين ثانية في تمريرة واحدة. بالنسبة إلى تبادل حوار واحد، أو عرض توضيحي لمنتج، أو أي شيء سيكون فيه الدمج مرئيًا، هذا ليس فرقًا في المعايير القياسية؛ بل فرق في ما إذا كانت المهمة عملية تصيير واحدة أم خطوة تجميع.
الثاني هو التهيئة بالمراجع، والتباين صارخ. يأخذ Kandinsky 6.0 Video صورة مرجعية واحدة ويطبّقها كإطار خلفي مُقنّع — إطار مفتاحي يتم الاستيفاء نحوه. أما Seedance 2.5 فيأخذ مجموعة عمل من نحو ثلاثين صورة وعشرة مقاطع فيديو وعشرة مقاطع صوتية كسياق واحد. اتساق الشخصية عبر تسلسل، ونقل الأسلوب من لوح مزاج، وأداء منقول من مقطع موجود: هذه أعباء عمل تتيحها كثرة المراجع ولا يحاول وضع الإطار الواحد القيام بها.
الثالث هو قابلية التحرير، وهي التي تغيّر سير العمل بدلًا من لقطة واحدة. التحرير على مستوى المنطقة وعلى مستوى الطابع الزمني يعني أن نافذة معيبة مدتها ثلاث ثوانٍ تُصلَّح في مكانها. ولا يملك Kandinsky 6.0 Video أي سطح تحرير — إذ تُعاد توليد خمس ثوانٍ سيئة، وإذا كانت قد ضُمّت إلى أربع أخرى، يُعاد النظر في نقاط الوصل أيضًا. وعلى الفرق التي تُسعّر عادة إعادة التوليد أن تُدرج هذا الفرق في اختيار النموذج بدلًا من اكتشافه لاحقًا.
• المدة — Kandinsky 6.0 Video: 5 ثوانٍ ثابتة، 121 إطارًا بمعدل 24 إطارًا في الثانية، لا يوجد وضع تمديد. Seedance 2.5: حتى 30 ثانية في تمريرة واحدة.
• التهيئة المرجعية — Kandinsky 6.0 Video: صورة واحدة، تُطبَّق كإطار ذيلي مُقنَّع. Seedance 2.5: نحو ثلاثين صورة وعشرة فيديوهات وعشرة مقاطع صوتية لكل طلب.
• التحرير — Kandinsky 6.0 Video: لا شيء؛ إعادة التوليد وإعادة الدمج. Seedance 2.5: استهداف على مستوى الطابع الزمني وتعديلات على مستوى المنطقة بعد التوليد.
• الدقة — Kandinsky 6.0 Video: دقة SD بمقاس 512×768، ودقة Full HD 1920×1080 عبر مرحلة رفع دقة فائقة مدمجة. Seedance 2.5: يعتمد على الوضع، مع تحديد سعر كل مقطع وفقًا للدقة التي تختارها.
• الصوت — Kandinsky 6.0 Video: 44 kHz مع مزامنة الشفاه، يُولَّد بالاشتراك مع الصورة. Seedance 2.5: صوت متزامن يتضمن الحوار، يُولَّد مع الفيديو.
• الأوزان — Kandinsky 6.0 Video: رخصة MIT، وLite 3B وPro 29B، مع الكود والتكامل مع diffusers. Seedance 2.5: لا.
متران لا يُحوَّلان إلى بعضهما البعض
يُحاسب Seedance 2.5 بالتوكنات، ما يبلغ نحو 0.51 دولار لمقطع مدته خمس ثوانٍ بدقة 480p ونحو 1.16 دولار بدقة 720p. سبب ذكر ذلك بهذه الطريقة بدلًا من كونه سعرًا لكل ثانية هو أن عدد التوكنات يتناسب مع حجم اللقطات، لذا فإن توليدًا مدته ثلاثون ثانية ليس ثلاثين ثانية بمعدل ثابت — بل هو ستة أمثال توكنات مقطع مدته خمس ثوانٍ بالإعدادات نفسها، كما أن عمليات التحرير تُسعَّر حسب ما تلمسه. إن أي خط أنابيب يعتاد على إعادة التوليد سيجد أن العداد يستجيب لتلك العادة.
لا يملك Kandinsky 6.0 Video عدّادًا لأنه لا يوجد شيء لشرائه. تكلفته آلة وساعة، والتقرير يوفّر الساعة: نحو 402 ثانية من زمن العمل على H100 لمقطع Pro Full HD مدته خمس ثوانٍ، و854 على RTX 5090، و1,247 على RTX 4090، مع تفريغ الكتل مطلوبًا عند تخصيص ذروة أقل من 72.8 GiB، وإعداد VRAM مسبق سعة 16 GB يكمّم مُرمِّز النص إلى NF4 — وهو تغيير الإعداد المسبق الوحيد الذي يقول التقرير إنه يغيّر المقطع نفسه. إن نقطة التحقق المُقطّرة، التي قيست عند التكافؤ مع النموذج الكامل بمتوسط تفضيل 51% مقابل 49% دون بلوغ أي معيار دلالة إحصائية، هي التي تجعل تلك الأرقام قابلة للتطبيق.
• التكلفة لكل خمس ثوانٍ — Kandinsky 6.0 Video: لا يوجد سعر مُدرج؛ من ست إلى إحدى وعشرين دقيقة من وحدة معالجة رسومات واحدة حسب البطاقة. Seedance 2.5: نحو 0.51 دولار بدقة 480p و1.16 دولار بدقة 720p بوحدات tokens.
لا شيء في هذين السطرين قابل للمقارنة على مقياس واحد، والمحاولة المعتادة لاختزالهما إلى رقم واحد — بقسمة سعر ساعة GPU على مقاطع مدتها خمس ثوانٍ — تفترض ضمنيًا استخدامًا كاملاً، وصفر وقت خمول، وبطاقة تملكها بالفعل. المقارنة الأكثر فائدة هي مقارنة نوعية: تكلفة Seedance 2.5 تتناسب مع مقدار ما تولّده وتتلاشى عندما تتوقف؛ أما تكلفة Kandinsky 6.0 Video فهي قائمة سواء ولّدت أم لم تولّد.

حيث يمكن الوصول إلى كل واحد منها
لا يوجد أيٌّ من النموذجين على OrcaRouter، ولا يجري تقديم أيٍّ من الادعاءين. يتم الوصول إلى Seedance 2.5 عبر منصات البائع نفسه والعديد من خدمات الطرف الثالث؛ أما Kandinsky 6.0 Video فهو نقطة تحقق تقوم بتنزيلها بموجب MIT وتشغيلها على العتاد الخاص بك. أي صفحة تخبرك بأن كليهما على بُعد استدعاء API واحد على منصة متعددة النماذج فهي تصف نماذج مختلفة.
السبب في أن طبقة التوجيه ما زالت جديرة بالذكر في خط أنابيب Kandinsky أو Seedance هو أن هذه الأنظمة نصّية في الغالب من حيث عدد الاستدعاءات وفيديو من حيث التكلفة. يحوّل توسيع المطالبة ملاحظة لقطة إلى التعليق النصي الطويل المنظّم الذي يتوقعه نموذج T2AV. تُصاغ الحوارات قبل أن تحاول مرحلة مزامنة الشفاه تنفيذها، ويُعاد كتابتها عندما تشوّهها تلك المرحلة. تُراجع ستة توليدات مرشحة للإيقاع نفسه ويُختار واحد — حكم نصي على ناتج فيديو، وهو أرخص طريقة لاتخاذ القرار المكلف بشكل صحيح. على نقطة نهاية واحدة متوافقة مع OpenAI تشمل أكثر من 200 نموذج بأسعار قائمة المزوّد مُمرَّرة دون هامش ربح بنسبة 0%، تكلّف تلك الاستدعاءات ما يتقاضاه المزوّد ولا أكثر، بما في ذلك في اليوم التالي لتغيير أحد البائعين لأسعاره. تستحق لغة التوجيه DSL مكانها عندما ينبغي أن يكون المراجع الرخيص والمراجع الدقيق نموذجين مختلفين في موقع الاستدعاء نفسه، ويستحق التحويل التلقائي عند الفشل مكانه لأن وصفًا نصيًا يفشل أثناء تصيير المقطع الرابع من ستة ينبغي أن يُعاد توجيهه بدلًا من إنهاء الجلسة.
ما الذي قد يحرّك هذه المواجهة؟
فجوة الإصدار هي القصة كلها، وهي أيضًا أقصر طريق إلى حلّها. إن إجراء اختبار لـ Seedance 2.5 مقابل Kandinsky 6.0 Video سيحسم ما إذا كانت الخسائر في المعايير البصرية التي يرصدها التقرير مقابل 2.0 قد اتسعت أو تقلّصت أو انعكست — فالتقرير لا يستطيع الإجابة عن ذلك، ولم يكن مؤلفوه قادرين على ذلك. في الوقت الحالي، الموقف القابل للدفاع عنه أضيق مما يريده تسويق أيّ من الطرفين: استنادًا إلى الأدلة التي نشرها مختبر النموذج نفسه، يتقدّم Seedance في كيف يبدو المقطع، ويتقدّم Kandinsky 6.0 Video في كيف يبدو الكلام فيه سمعيًا، والإصدار من Seedance الذي يقوم عليه هذا الادعاء متأخّر بجيل واحد عن الإصدار الذي ستشتريه.
اختر بناءً على ذلك. إذا كان العمل طويلًا، أو كثيف المراجع، أو مدفوعًا بالمونتاج، فإن الفجوات البنيوية تحسم الأمر قبل أن تدخل الجودة إلى الغرفة. وإذا كان العمل لقطة ناطقة مدتها خمس ثوانٍ يجب أن يكون الحوار فيها سليمًا من المرة الأولى، فإن ميزة Kandinsky 6.0 Video المقيسة تقع على هذا المعيار تحديدًا — ورخصة MIT تعني أن الإجابة لا تعتمد على خارطة طريق أي شخص. الشيء الذي ينبغي مراقبته ليس لوحة الصدارة. بل إعادة تشغيل لمقارنة لم يتمكن التقرير قط من إجرائها.


أرخص طريقة لإجراء الاستدعاء المكلف بشكل صحيح: لغة توجيه DSL تبدّل المراجع حسب كل مرحلة، مع تجاوز فشل تلقائي بحيث لا يكلّف تعليقٌ ميت المقطع.
