
Odyssey-3 مقابل Kandinsky 6.0 Video: أوزان مفتوحة وصوت في مواجهة معاينة تفاعلية مغلقة
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 378 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
وصل Kandinsky 6.0 Video في 6 أكتوبر 2026 مصحوبًا بالأمر الذي نادرًا ما تحققه إصدارات النماذج المفتوحة في يوم الإطلاق: دعم في Diffusers وComfyUI وvLLM-Omni وSGLang وFastVideo، وكل ذلك موثّق في سجل التحديثات الخاص بالمستودع، إلى جانب تقرير على arXiv قُدّم في 4 أكتوبر ونقاط تحقق مرخّصة بموجب MIT على Hugging Face. ووصل Odyssey-3 بعد يومين، في 8 أكتوبر، كمعاينة بحثية عامة لمحوّل انتشار انحداري يبني بيئة من وصف نصي ويتنبأ بالتغييرات في الوقت الفعلي أثناء تحركك عبرها. أحدهما نموذج بـ29 مليار معامل يمكنك تنزيله وتشغيله على وحدة معالجة الرسومات الخاصة بك هذه الليلة. والآخر نظام تفاعلي لا يمكنك الوصول إليه إلا عبر المعاينة المتصفحية لـ Odyssey ونموذج تواصل. إنهما القطبان اللذان يحددان ما عناه مصطلح «نموذج الفيديو» في الأسبوع نفسه من أكتوبر 2026، والاختيار بينهما لا يتعلق بالمعايير بقدر ما يتعلق بمن يملك الأوزان.
إنهما يريدان منك أشياء مختلفة أيضًا. Kandinsky 6.0 Video هو نموذج توليدي: تُدخل الأمر النصي، فتحصل على مقطع مدته خمس ثوانٍ بصوت متزامن. أما Odyssey-3 فهو نموذج تنبؤي: تصرّف، وراقب استجابة العالم. لا يغني أحدهما عن الآخر، وكونهما طُرحا خلال 48 ساعة من بعضهما هو السياق الأكثر فائدة الذي يمتلكه أيٌّ منهما.
المعماريتان، وفق مصطلحات المورّدين أنفسهم
Kandinsky 6.0 Video هي عائلة من نماذج الانتشار التأسيسية لتوليد الصوت والفيديو المتزامنين، وتضم Kandinsky 6.0 Video Lite بـ 3 مليارات معلمة وKandinsky 6.0 Video Pro بـ 29 مليارًا. يولد كلاهما مقاطع مدتها خمس ثوانٍ مع صوت متزامن بتردد 44 كيلوهرتز، بما في ذلك مزامنة الشفاه، في وضعي النص إلى الصوت والفيديو والصورة إلى الصوت والفيديو، ويرفع نموذج الدقة الفائقة الإضافي الإخراج إلى Full HD 1920×1080. التقنية هي CrossDiT ثنائي التدفق يربط تدفق فيديو مدرب مسبقًا بتدفق صوتي مدرب حديثًا من خلال انتباه متقاطع ثنائي الاتجاه، بحيث تتوافق الوسيلتان في الزمن والدلالة بدلاً من توليدهما بشكل منفصل ودمجهما. وصفة التدريب مستمرة: يتم تدريب التدفق الصوتي من الصفر على مجموعات صوتية كبيرة، ثم يتم تدريب كلا التدفقين معًا على بيانات صوت وفيديو مقترنة مع الحفاظ على الدقة أحادية الوسيلة، يليه ضبط دقيق خاضع للإشراف، وتدريب لاحق بالتعلم المعزز، وتقطير.
Odyssey-3 هو محوّل انتشار انحداري ذاتي يصفه Odyssey بأنه نموذج انتشار فيديو متعدد الخطوات موسَّع عبر الإجبار التعليمي والإخفاء السببي، ومدرَّب على الاستمرار من الملاحظات السابقة والتنبؤ بالحالات المستقبلية مشروطًا بمدخلات الإجراءات، ثم يُقطَّر عبر مطابقة التوزيع والتقطير الخصامي إلى نسخة قليلة الخطوات سريعة بما يكفي للتفاعل معها. ويعمل بدقة 832×480، مع Odyssey-3 Pro بدقة 1280×720، ولا ينتج صوتًا، وكل غرضه أن يعتمد خرجه على ما فعلته قبل لحظة.
دعم اليوم الأول هو الفرق الذي لا يقيسه أحد.

أعد قراءة سجل تحديث Kandinsky 6.0، لأنه أكثر حقيقة ملموسة في هذه المقارنة. في 6 أكتوبر، سجّل المشروع إتاحته في Diffusers، وسجل عُقد ComfyUI، وvLLM-Omni، وSGLang، وFastVideo، وHugging Face Space لنموذج Pro المُقطّر. هذه خمس حزم استدلال مستقلة في يوم واحد. وبالنسبة لأي شخص انتظر شهورًا حتى تصل نقطة حفظ إلى إطار خدمة، فهذا هو الرقم الذي يحدد ما إذا كان النموذج قابلاً للاستخدام.
الآن ضع ذلك جنبًا إلى جنب مع قصة وصول Odyssey-3. تعمل المعاينة على experience.odyssey.systems مع تنقّل من منظور الشخص الأول، وتنقّل من منظور الشخص الثالث، وحركة كاميرا مستقلة. الوصول إلى API يكون عبر نموذج تواصل. لا توجد صفحة تسعير، ولا وثائق لحدود المعدل، ولا مفتاح ذاتي الخدمة. آخر تحديث لشروط API في الموقع كان في 2026-01-22، وما زالت تحكم "النموذج الأولي لواجهة Odyssey-2 API" — لم يُعَد كتابة الواجهة التجارية للنموذج الذي صدر هذا الشهر.
• أين يعمل — على وحدات معالجة الرسومات الخاصة بك، مع الأوزان والكود تحت رخصة MIT، مقابل خوادم Odyssey فقط.
• كيف تدمجه — خط أنابيب Diffusers، عُقد ComfyUI، vLLM-Omni، SGLang، FastVideo، مقابل معاينة في المتصفح ونموذج تواصل.
• ما يمكنك فحصه — البنية ووصفة التدريب وأحجام نقاط التحقق في تقرير عام، مقابل وصف البائع لخط أنابيب التدريب بدون أوزان ولا ورقة بحثية.
• ما يمكنك تعديله — الضبط الدقيق، وLoRAs، والتكميم والتقطير، وكلها كان المجتمع ينشرها بالفعل على Hugging Face في اليوم التالي للإصدار، مقابل لا شيء على الإطلاق.
بُعدًا بُعدًا

• المخرجات — مقاطع مدتها خمس ثوانٍ مزودة بصوت متزامن بتردد 44 كيلوهرتز لكلا طبقتي Kandinsky، مقابل بيئة تفاعلية بلا صوت لـ Odyssey-3.
• الدقة — Full HD 1920×1080 عبر نموذج الدقة الفائقة الإضافي لـ Kandinsky 6.0 Video، مقابل 832×480 لـ Odyssey-3 و1280×720 لـ Odyssey-3 Pro.
• الوسائط المُدخلة — نص وصورة لـ Kandinsky، في وضعي النص إلى صوت وفيديو والصورة إلى صوت وفيديو؛ وموجّه نصي بالإضافة إلى إدخال تحكّم مباشر لـ Odyssey-3.
• المعلمات — 3B و29B منشورة لفئتي Lite وPro، مقابل عدم الإفصاح عن كلا فئتي Odyssey-3.
• الأجهزة — وحدة معالجة رسومات NVIDIA وPython 3.13 أو 3.14، مع إعدادات مسبقة مضمنة لبطاقات من فئة H100/H200 وصولاً إلى RTX 5090 من أجل Kandinsky؛ ومتصفح لـ Odyssey-3.
• السعر — 0 دولار لكل مقطع لـ Kandinsky 6.0 Video إذا كانت لديك وحدة معالجة الرسوميات، مقابل عدم وجود أي سعر منشور من أي نوع لـ Odyssey-3. تقديرات التكلفة المُوحَّدة الخاصة باللوحة لـ Odyssey-3 وOdyssey-3 Pro هي 0.139 دولار و0.267 دولار لكل فيديو مُولَّد، باستثناء معالجة الأوامر النصية.
• تقييم من طرف ثالث — لا تدخل مخرجات أيٍّ من النموذجين نفسها في مقارنة مستقلة وجهاً لوجه. يعتمد تقرير Kandinsky على تقييم بشري جنبًا إلى جنب مقابل سابقه؛ أما أرقام Odyssey-3 فتأتي من تقديم إلى اختبار مرجعي إضافةً إلى تقييم تديره الجهة المورّدة.
• الترخيص — MIT لـ Kandinsky 6.0 Video، في مقابل غياب أي ترخيص منشور لأنه لا توجد أوزان لترخيصها.
ما تقوله المعايير وما لا تقوله
لا يظهر Kandinsky 6.0 Video على Physics-IQ Verified، لوحة Anates Labs وDeepMind التي تقيّم استكمالات تجارب فيزيائية حقيقية عبر 41 نموذجًا. ولا يظهر كذلك شريك Odyssey-3 في المواجهة المباشرة هنا، لأن اللوحة تقيّم نماذج تولّد مقاطع، وكلاهما يفعل ذلك. ما تحمله اللوحة بالفعل هو خط نماذج العالم الأقدم الخاص بـ Kandinsky، Kandinsky-WM 1.0، في المرتبة 20 وبفارق −8.02 نقطة مئوية مقابل متوسط المسار — عائلة مختلفة، وغرض مختلف، وهو المدخل الوحيد لـ Kandinsky على اللوحة.
صفوف Odyssey-3، على سبيل المقارنة: المرتبة 8 عند +2.15 نقطة مئوية على مطالبات المعيار نفسه و0.129 دولار لكل فيديو، والمرتبة 3 عند +9.99 نقطة مئوية على المطالبات المخصصة، مع حلول Odyssey-3 Pro في المرتبة الثانية إجمالًا عند +11.15 نقطة مئوية. هذه أرقام أفضل من أي شيء لدى سلسلة Kandinsky في ذلك الاختبار تحديدًا، كما أنها تقيس قدرة مختلفة — إذ يُقيَّم Odyssey-3 على ما يتوقعه بعد اضطراب، وهو الأمر نفسه الذي يروّج له عرضه التمهيدي.
الدليل الذي يقدّمه Kandinsky نفسه هو التقييم البشري في التقرير الفني: من الواضح أن Kandinsky 6.0 Video Pro يتفوق على سلفه Kandinsky 5.0 Video Pro، ويبقى منافسًا للنماذج الرائدة في توليد الصوت والفيديو، لا سيما في جودة الكلام. هذه مقارنة جنبًا إلى جنب تُجريها الجهة المورّدة، وهي نوع الادعاء الذي يمكن لأي شخص يمتلك بطاقة 5090 وبعد ظهرٍ كامل أن يتحقق منه عبر نقطة تحقق منشورة. أما ادعاء Odyssey-3 المكافئ فلا يمكن لأي شخص التحقق منه دون مفتاح API.

الوصول إليهم
لا يستضيف OrcaRouter أيًا من الطرازين، ولن يلمّح أبدًا إلى خلاف ذلك: فـ Odyssey-3 ليس له سعر منشور ليتمكن أي شخص من توجيهه، وKandinsky 6.0 Video مفتوح الأوزان، ما يعني أن الطريقة الصحيحة لتشغيله هي إعداد المستودع الخاص به على وحدة معالجة الرسوميات لديك، وليس نقطة نهاية مستضافة.
موضع انطباق مفتاح OrcaRouter الواحد هو الطبقة المحيطة بالتجربة. يفترض مستودع Kandinsky أنك توفّر وحدة معالجة الرسومات والبيئة وأداة المقارنة؛ أما ما لا يوفّره فهو طريقة لاستدعاء النماذج التي تريد إجراء المقارنة معها. أكثر من 200 نموذج متاحة خلف مفتاح OrcaRouter واحد بسعر القائمة لدى المزوّد وبدون أي هامش ربح — بما في ذلك minimax/minimax-h3، نموذج الفيديو مفتوح الأوزان الذي أطلقته MiniMax في 31 يوليو 2026، بسعر 0.08 دولار لكل ثانية من مخرجات 768P — لذا يظهر أي تغيير في سعر المزوّد على فاتورتك في اليوم نفسه، ويحول التجاوز التلقائي للأعطال دون أن تموت جولة تقييم بسبب ساعة سيئة عند أحد المزوّدين في الطبقة الأعلى، كما تتيح لك لغة التوجيه DSL وضع نموذج فيديو مستضاف ونموذج رؤية خلف واجهة واحدة عندما تكون المهمة هي التوليد ثم التقييم. وما زلت تستنسخ المستودع وتشغّل الإعداد بنفسك. كل ما في الأمر أنك لن تضطر إلى بناء النصف الآخر من المنظومة.
أيّ واحد تريده فعلاً؟
إذا كنت بحاجة إلى مخرجات تملكها — شروط تجارية يمكنك قراءتها، وأوزان يمكنك ضبطها بدقة، وخط أنابيب يعمل دون الحاجة إلى أن تكون واجهة API الخاصة بشخص آخر متاحة — فإن Kandinsky 6.0 Video هو الجواب، ودعم إطار العمل منذ اليوم الأول يعني أنك لا تراهن على نتاج بحثي. وإذا كنت بحاجة إلى صوت على الفيديو، فهو الوحيد من بين الاثنين الذي يولّد أي صوت.
إذا كانت المشكلة هي التنبؤ وليس الإنتاج — سياسة يجب أن تتفاعل، أو بيئة تدريب، أو أي شيء تعتمد فيه الحالة التالية على الإجراء الأخير — فإن Odyssey-3 هو الوحيد من بين الاثنين الذي يفعل ذلك، وهو أيضًا الذي لا يمكنك شراؤه. هذا هو الشكل الصادق لهذه المواجهة في الأسبوع الذي ظهر فيه كلا النموذجين: نموذج مفتوح يمكنك تنزيله ونموذج تفاعلي لا يمكنك سوى تجربته، مع أدلة المعايير المرجعية التي ترجّح النموذج المغلق والأدلة العملية التي ترجّح النموذج المفتوح.
