بطاقة عنوان مُولَّدة لـ Agora-2 مقابل Qwen 3.8 Max، بعنوان فرعي «نموذج يشاهد الفيديو، والآخر يصنعه». ثلاث بطاقات: «Qwen3.8-Max: مؤشر AA Index 45، 2$/6$ لكل مليون، سياق 1M»؛ «Qwen3.8-Max: يقرأ النص والصورة والفيديو»؛ «Agora-2: يُولِّد فيديو 640x480 لكل مشارك، بدون API». التذييل: «Qwen3.8-Max وفق Artificial Analysis؛ Agora-2 مُبلَّغ عنه من المورّد ولم يُعَد إنتاجه بشكل مستقل.»
Guides & Insights

Agora-2 مقابل Qwen 3.8 Max: نموذج يشاهد الفيديو، والآخر ينتجه

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ثمة انعكاس أنيق في قلب هذه المزاوجة. Qwen3.8-Max — الطراز الرائد للمورّد، الذي أُطلق في 3 أغسطس 2026 وحُدِّث في 2 سبتمبر، بسعر 2.00 دولار/6.00 دولار لكل مليون رمز — يقرأ الفيديو أصليًا، إلى جانب النصوص والصور، ضمن نافذة سياق تبلغ 1,000,000 رمز. Agora-2، النموذج العالمي متعدد الوكلاء Odyssey الذي استُعرض في 21 سبتمبر 2026، ينتج فيديو: تدفقات 640×480 تُولَّد لكل مشارك، وخمسة عشر تحديثًا كامنًا في الثانية، لما يصل إلى 20 إنسانًا ووكيلًا يتشاركون عالمًا محاكيًا واحدًا. صُمِّم أحد النموذجين لاستهلاك الإطارات وتفسيرها؛ وصُمِّم الآخر لإصدار الإطارات والسماح للمشاركين بالتصرف داخلها. وإذا جمعتهما معًا، فستحصل على شيء لم يهدف أي من المورّدين إلى بنائه — وسيلة لتحليل محاكاة متعددة الوكلاء باستخدام نموذج لغوي يمكنه بالفعل مشاهدتها.

جانبا الإطار

Qwen3.8-Max هو أعلى مستوى قدرة لدى Alibaba وأكثر كياناته تقليدية: نموذج أصلي متعدد الوسائط يقبل النص والصورة والفيديو، بسياق يبلغ مليون رمز، و131,072 رمزًا من الإخراج، واستخدام أدوات أصلي، ومؤشر ذكاء Artificial Analysis قدره 45 على الإصدار v4.3.2 من المؤشر. ذكرت تغطية سابقة لإطلاق أغسطس الرقم 40 — وقد جاء ذلك الرقم من مراجعة المؤشر السابقة ولا ينبغي وضعه إلى جانب هذا الرقم. يقيسه Artificial Analysis عند 88.8 على terminal-bench 2.1 و92.8 على GPQA Diamond. تضع Alibaba في دليل الترحيل الخاص بها هذا النموذج في مواجهة مباشرة مع GPT-5.5 وClaude Opus 4.7 وGemini 3.1 Pro، وتوصي به كلما احتاجت مهمة إلى أقوى استدلال متاح.

مواصفات Agora-2 لا تشبه ذلك تقريبًا من كل النواحي. أربعة مكوّنات تصيير، واحد لكل منظر، وكل منها نموذج من ستة عشر كتلة بعرض 2,048 يولّد منظور مشارك واحد. نموذج محاكاة من أربع طبقات وبعرض 256 يتنبأ بالحركة والقتال والرسوم المتحركة عبر أربعة عشر فرعًا حركيًا منفصلًا انطلاقًا من تاريخ كيان من أربع خطوات. حالة عالم مشتركة تحمل الهوية والموضع والصحة والرسوم المتحركة والموت وإعادة الظهور، بحيث تظل خصائص الكيان قائمة بشكل مستقل عن أي كاميرا بعينها — فالكيان خارج الإطار يحتفظ بموضعه بدلًا من إعادة بنائه عند ظهوره مجددًا. لا توجد نافذة سياق لأنه لا توجد لغة. القيد المكافئ هو السجل البصري المحدود لكل منظر، الذي يُعاد ضبطه عند الموت وإعادة الظهور وانقطاعات الكاميرا.

• الإخراج — فيديو Agora-2 بدقة 640×480 لكل مشارك، هدف 30 إطارًا في الثانية مقابل نص Qwen3.8-Max، حتى 131,072 توكن لكل استجابة

• المدخلات — عناصر التحكم في متصفح Agora-2 بالإضافة إلى 16 سياسة لوكلاء التعلّم المعزّز مقابل Qwen3.8-Max للنصوص والصور والفيديو

• تقييم مستقل — Agora-2: لم يُنشر أي شيء مقابل Qwen3.8-Max AA Intelligence Index 45 (v4.3.2)

• السعر — Agora-2 لم يُنشر أي شيء، معاينة فقط مقابل Qwen3.8-Max 2.00$/6.00$ لكل 1 مليون، 0.25$ للقراءة المخزنة مؤقتًا

• الذاكرة — الحالة المشتركة لـ Agora-2 بالإضافة إلى سجل محدود لكل عرض مقابل سياق Qwen3.8-Max البالغ 1,000,000 رمز

• الوصول — Agora-2 بلا API، بلا أوزان مقابل Qwen3.8-Max API احتكاري، سياق 1M

Generated two-column scoreboard for Agora-2 and Qwen3.8-Max on output, input, independent score, price, memory and access: Agora-2 640x480 video per participant, browser controls plus 16 RL policies, none published, no published price and preview only, shared state plus bounded history, no API or weights; Qwen3.8-Max text up to 131,072 tokens, text, image and video input, AA Index 45, $2.00/$6.00 per 1M, a 1,000,000-token context, a proprietary API. Footer reads 'Qwen3.8-Max per Artificial Analysis; Agora-2 figures vendor-reported and unreproduced.'Screenshot of Odyssey's Agora-2 announcement page, headlined 'Introducing Agora-2: Advancing Multi-Agent World Simulation' with the standfirst 'Our next-generation multi-agent world model, supporting up to 20 humans and agents inside a shared world simulation', bylined Oliver Cameron, September 21st, 2026, opening on the playable research preview and the Diablo II training captures.

ما يضيفه نموذج قراءة الفيديو إلى محاكي العالم المشترك

حجة Odyssey لبناء Agora-2 هي أن التفاعل بين وكلاء متعددين أصبح شيئًا يستحق الدراسة في ظروف مضبوطة، وتستشهد الشركة بحادثة يوليو 2026 التي نظّم فيها نحو 1,200 وكيل داخل بيئة تقييم معزولة اختراقًا استمر عدة أيام كدليل على السبب. الجزء الصعب في هذا النوع من البحث ليس توليد التفاعل — بل تفسيره. فنموذج عالمي يُصدر آلاف الإطارات لعشرين مشاركًا يتفاعلون ينتج قدرًا من المواد المصوّرة لا يستطيع أي فريق بشري مشاهدته.

هنا يتوقف النموذج المزوّد بإدخال فيديو أصلي عن كونه عدم تطابق في الفئة ويصبح مكوّنًا. إن جلسة من Agora-2 هي، من الخارج، بالضبط ما يدّعي Qwen3.8-Max أنه يستوعبه: فيديو، بدقة يؤكد التقرير أنه قادر على التعامل معها، مع كيانات تُصيّر النموذج هويتها وحالتها الصحية وحالة تحريكها من مخطط مشترك صريح. اقترن تدفّق الإطارات بسجل الحالة — فالتقرير ينشر كليهما، ويُظهر شكله 6 حالة اللاعب والعدو عند أربع نبضات متتالية إلى جانب الإطارات المصيّرة — وستحصل على مدوّنة يمكن أن يُسأل فيها نموذج استدلالي قادر على الفيديو عمّا حدث، ومن بدأه، وهل يطابق التصوير البصري الحالة المسجلة فعلاً. ذلك السؤال الأخير هو أحد الأسئلة التي يدرجها التقرير على أنها غير مُقيَّمة: فالتوافق بين المشاهد المولّدة استقلاليًا والالتزام بالإجراء من طرف إلى طرف كلاهما متروك صراحةً مفتوحًا.

سياق المليون رمز هو النصف الآخر. سجل حالة جلسة طويلة، ومخرجات الأدوات، والملاحظات المفرغة نصيًا تتسع داخله، وهذا هو الفرق العملي بين تحليل لقاء واحد وتحليل جلسة لعب بعد الظهر.

حيث تتوقف الأرقام الموثّقة

تُعدّ درجة مؤشر Qwen3.8-Max ونافذة سياقه ووسائطه وبطاقة أسعاره حقائق منشورة، قيست بشكل مستقل حيث ذُكر ذلك. ويشير تحديثه في 2 سبتمبر إلى أن Alibaba لا تزال تعمل على تطوير هذه الطبقة.

توجد أرقام Agora-2 في التقرير الفني لـ Team Odyssey ولا يمكن إعادة إنتاجها خارج الشركة. يدّعي التقرير أن مُصيّراً ببادئة مهيكلة يحقق 30.11 dB PSNR مقابل خط أساس VAE عند 20.67 dB على مدى ثلاثين مقطع مراقبة، وخفضاً بنسبة 45.8% في زمن مزيل الضوضاء بفضل التكييف بالانتباه الذاتي المهيكل مقابل الانتباه المتقاطع — حيث قيس هذا الأخير على مزيلات ضوضاء مهيّأة عشوائياً بمدخلات اصطناعية، وهو ما يذكر التقرير أنه معيار لتكلفة التنفيذ وليس معياراً لجودة الصورة. قسم القيود الخاص به هو الجزء الذي يستحق القراءة مرتين: معدّلا 15 تحديثاً كامناً و30 إطاراً في الثانية هما هدفان، ولم يتم تقييم معدل الإطارات المستدام وزمن الاستجابة من الإدخال إلى العرض تقييماً كمياً أثناء اللعب المباشر متعدد الوكلاء، والجودة البصرية طويلة المدى والتوافق بين المشاهدات لم يتم تقييمهما، وتتطلب البيئة محركاً مزوّداً بأدوات قياس مع هندسة صريحة ومفردات مظهر ثابتة، ولم يُختبر الانتقال إلى أصول أو قواعد أو بيئات جديدة.

يقع اثنان من تلك التحفظات مباشرةً على الاقتران المقترح أعلاه. إذا كان معدل الإطارات أثناء اللعب المباشر غير مقيس، فإن تدفق الإطارات الذي ستغذّي به نموذج فيديو لا يملك بعد أي ضمان للإنتاجية. وإذا كان التوافق بين الزوايا غير مُقيَّم، فإن التحليل المثير للاهتمام — هل بدا الحدث نفسه متسقًا من أربع زوايا — هو تحديدًا السؤال المفتوح، وليس مدخلًا محسومًا. الجمع واعد ولم يُختبر على الإطلاق.

أيّ واحد يمكنك استخدامه اليوم؟

Qwen3.8-Max متاح للنشر الآن: نموذج متعدد الوسائط من الطراز المتقدم بسعر $2/$6 مع نافذة مليون رمز، واستخدام أدوات أصلي ومؤشر مُقاس بشكل مستقل قدره 45. لأي شخص يقوم بتحليل مكثف للفيديو أو المستندات، فهو أحد النماذج القليلة عند نقطة السعر هذه التي تستهلك الإطارات على الإطلاق، ومعدل قراءة الذاكرة المؤقتة البالغ $0.25 يجعل السياقات الطويلة والمتكررة ميسورة التكلفة. من خلال OrcaRouter، يتم تقديمه بسعر Alibaba المعلن دون أي هامش ربح، بحيث يمرر ذلك المعدل دون تغيير وأي تغيير مستقبلي في السعر يصل إلى فاتورتك في نفس اليوم، مع تجاوز فشل تلقائي إذا تعطلت نقطة النهاية الأساسية — وهو أمر يستحق أن يكون لديك على عبء عمل تكون قيمته كلها في سياق طويل سيكون من المكلف إعادة تشغيله.

Screenshot of the OrcaRouter model page for Qwen3.8 Max (0902) (model ID qwen/qwen3.8-max-0902), showing a 1M-token context, 131K maximum output, text, image and video input, and pricing of $2.00 input and $6.00 output per million tokens.

Agora-2 ليس على OrcaRouter؛ نحن لا نستضيفه، ولا توجد API ولا أوزان، والمدخل الوحيد هو معاينة Odyssey الخاصة داخل المتصفح. ما يقدمه هو نتاج بحثي في فئة لا تكاد توجد: عالم مشترك يعمل فيه البشر وسياسات التعلم المعزز على الحالة ذاتها، ويحصل كل مشارك على عرضه المولَّد الخاص. إذا كنت تبني أنظمة متعددة الوكلاء، فإن الاقتران الذي يستحق قضاء فترة بعد الظهر هو الواضح — شغّل المعاينة، والتقط الإطارات وسجل الحالة، وسلّم كليهما إلى نموذج متعدد الوسائط بمليون رمز لتسأل ما الذي حدث فعلًا. يمنحك Agora-2 الساحة ويعترف بأنه لم يقس الأجزاء الصعبة؛ Qwen3.8-Max هو الأداة القادرة على ذلك، وهو متاح بسعر $2/$6 بينما لا تزال الساحة في طور المعاينة.