
Qwen3.8-Omni-Flash مقابل InternLumina U2: حواس مستأجرة مقابل أوزان مملوكة
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
الطريقة المفيدة لمقارنة Qwen3.8-Omni-Flash وInternLumina U2 ليست حسب صف المعايير، لأنهما لا يظهران في الصفوف نفسها. بل بالسؤال عن من يُسمح له بتشغيلهما. أما نموذج البائع Qwen3.8-Omni-Flash، المتاح لعملاء API منذ 18 سبتمبر 2026، هو نموذج مغلق على منصات البائع نفسها: مليون رمز من السياق، وحتى ساعة من الصوت والفيديو المتواصلين في كل نداء، ومخرجات نصية فقط، ولا أوزان. ونموذج مختبر شنغهاي للذكاء الاصطناعي InternLumina U2 هو نموذج انتشار خليط خبراء 16B-A1B بموجب Apache 2.0، يمكن تنزيل نقاط تفتيشه الخاصة بـ Ascend من Hugging Face الآن، بينما لا يزال كل من نقاط تفتيش NVIDIA والتقرير الفني مُدرجًا كقادم. أحدهما خدمة تستأجرها بالرمز. والآخر ملف يمكنك حيازته، مع تحفظ حول العتاد الذي يعمل عليه حالياً. هذا الفارق يحدد عمليات نشر واقعية أكثر من أي نتيجة في جدول أي من البائعين.
ما هو InternLumina U2 في الواقع
البنية هي الجزء المثير للاهتمام وهي غريبة حقًا. InternLumina U2 هو MoE متناثر بإجمالي 16 مليار معامل و1 مليار نشط، وهو نموذج لغوي انتشاري وليس نموذجًا انحداريًا ذاتيًا — فهو يحسّن تسلسلًا كاملًا بالتوازي بدلاً من إصدار الرموز من اليسار إلى اليمين. تمثيله البصري متقطع تمامًا: ثماني كتب رمزية للرموز البصرية مبنية على AToken من Apple، وهذا ما يسمح لنموذج واحد بقراءة صورة وإنتاج صورة دون مفكك ترميز منفصل مثبت في النهاية. الإجابة على الأسئلة النصية، وتوليد الصور من النص، وفهم الصور، وتحرير الصور، وفهم الفيديو، وفهم ثلاثي الأبعاد كلها نفس النموذج يقوم بنفس النوع من العمل على نفس المفردات.
• الحجم والشكل — يبلغ إجمالي معلمات InternLumina U2 نحو 16 مليار، منها 1 مليار نشطة، وهو MoE متناثر؛ أما عدد معلمات Qwen3.8-Omni-Flash فغير معلن.
• التوليد — يُنشئ InternLumina U2 الصور ويحرّرها ويتعامل مع الفهم ثلاثي الأبعاد؛ أما Qwen3.8-Omni-Flash فلا يولّد أي وسائط على الإطلاق، بل يُرجع نصًا فقط.
• فك الترميز — InternLumina U2 نموذج لغوي كبير قائم على الانتشار يقوم بفك الترميز على التوازي؛ أما Qwen3.8-Omni-Flash فهو انحداري ذاتي.
• السياق والمدة — يحمل Qwen3.8-Omni-Flash نافذة تبلغ مليون رمز وما يصل إلى ساعة من الصوت والفيديو المتواصل في استدعاء واحد؛ بينما لا تصف المواد المنشورة الخاصة بـ InternLumina U2 شيئًا من ذلك، وليس الصوت الطويل ضمن قدراتها المدرجة.
• الأوزان — InternLumina U2 مرخّص بموجب Apache 2.0، مع نشر نقاط حفظ Ascend بينما لا تزال نقاط حفظ NVIDIA معلّقة؛ أما Qwen3.8-Omni-Flash فلا يملك أوزانًا ولا خطة معلنة لتوفير أي منها.
• كيف تحصل عليه — InternLumina U2 هو تنزيل من Hugging Face مع كود الاستدلال على GitHub؛ أما Qwen3.8-Omni-Flash فهو استدعاء API إلى Alibaba Cloud Model Studio أو منصة Qianwen.
• درجات مستقلة — لا توجد لأي منهما. بطاقة InternLumina U2 الخاصة تصف جدول قياساتها المرجعي بأنه "نتائج أولية وجزئية"؛ أما نتائج Qwen فكلها مقابل سابقتها الخاصة وغير مُعاد إنتاجها.

لقد تحرّكت مسألة الأوزان منذ تغطية المعاينة
إذا قرأت مقالتنا السابقة عن InternLumina U2 عند ظهور الشيفرة أول مرة، فقد تغيّر الوضع في اتجاه وبقي على حاله في اتجاه آخر، وكلا الشقين مهم. لم يعد مستودع Hugging Face مجرد هيكل فارغ: أصبح مجلد ascend/ يضم الآن سبع شظايا safetensors بالإضافة إلى الإعدادات والمُرمِّز والشيفرة النمذجية، ما يعني أن النموذج قابل للتنزيل والتشغيل فعلياً من قبل أي شخص يملك العتاد المناسب. ولا يزال مجلد nvidia/ موسوماً بأنه "قريباً"، ولا يزال التقرير الفني منتظراً، ولا يزال قسم المعايير في المستودع نفسه يقول "نتائج أولية جزئية." لذا فإن العبارة الدقيقة اليوم ليست "الأوزان صدرت" أو "الأوزان مفقودة" — بل إن نقاط حفظ إحدى حزم العتاد منشورة والأخرى ليست كذلك، وهو قيد حقيقي لأي شخص تكون عنقودته من NVIDIA.
هناك أمران آخران تحركا بهدوء. استمر مستودع GitHub في استقبال الالتزامات بعد الإصدار الأولي في 1 سبتمبر بوقت طويل، لذا فإن الكود الصادر تتم صيانته بدلاً من تركه معطلاً. ولا يزال عدّاد التنزيلات على مستودع Hugging Face يظهر صفراً، وهذا لا يقول الكثير عن النموذج بقدر ما يقول عن الجمهور: نموذج انتشار 16B-A1B مع نقاط تفتيش Ascend-first موجه إلى مختبر، وليس إلى فريق منتج يبحث عن نقطة نهاية مستضافة هذا الربع.
حيث يتداخل الاثنان حقًا، وحيث لا يتداخلان
فهم الصور هو نقطة التقاطع، وهو أضيق مما يبدو. يمكن لكلا النموذجين النظر إلى صورة والإجابة عن أسئلة بشأنها، وهذه هي المهمة بأكملها لدى Qwen3.8-Omni-Flash وواحدة من ست مهام لدى InternLumina U2. وبعد ذلك يتباعد المساران بشدة. يمكن لـ InternLumina U2 بعد ذلك تحرير تلك الصورة أو توليد صورة جديدة من وصف نصي، في النموذج نفسه، باستخدام المفردات البصرية ذاتها التي استخدمها لقراءتها. لا يستطيع Qwen3.8-Omni-Flash إنتاج أي بكسل، لكنه سيقبل ساعة من الصوت والفيديو في استدعاء واحد ويخبرك مَن تحدّث، ومتى، وما الذي تقرّر — وهو ما لا تدّعي المواد المنشورة لـ InternLumina U2 القيام به على الإطلاق.
التداخل الذي يقلّ أهمية عما يفترضه الناس هو الفيديو. يُوصف كلاهما بأنه يتعامل مع الفيديو، لكنهما يفعلان به شيئًا مختلفًا: أحدهما يفهم تسجيلًا طويلًا بوصفه مستندًا، والآخر يتعامل مع الفيديو كوسيط بصري إلى جانب ثلاثي الأبعاد. الفريق الذي يحتاج إلى تلخيص ساعة من اللقطات لا يخدمه الثاني، والفريق الذي يحتاج إلى توليد إطار لا يخدمه الأول.

التكلفة والتحكم وما الذي تشتريه فعليًا
مقارنة التسعير ليست متقاربة من حيث النوع.Qwen3.8-Omni-Flash تتم المحاسبة فيه لكل رمز — $0.15 لكل مليون إدخال، و$0.016 للمخزّن مؤقتًا، و$0.47 للإخراج على القائمة الدولية، مع قائمة أسعار منفصلة للبر الرئيسي غير قابلة للمقارنة — وكان العنوان الرئيسي عند إطلاقه تخفيضًا أبلغ عنه المورّد بنسبة تتجاوز 98% في تكلفة ساعة من الإدخال الصوتي، حُسب عبر تسعير عيّنة مدتها دقيقتان وضرب الناتج في ثلاثين مع أخذ عينات الفيديو بدقة 720p وبمعدل إطار واحد في الثانية.InternLumina U2 لا توجد أي رسوم، لأنه لا يوجد شيء لفرض رسوم عليه: فالتكلفة هي العتاد الخاص بك ووقتك، وبطاقة النموذج نفسها لا تنشر رقم إنتاجية يسمح لك بتحويل ذلك إلى رقم لكل رمز.
تلك هي المقايضة في سطر واحد. يمنحك الـAPI قدرة لا يمكنك استضافتها وتكلفة ساعية تتزايد مع الاستخدام؛ أما الأوزان المفتوحة فتمنحك تكلفة ثابتة وسيطرة كاملة على مسار البيانات، مقابل حزمة استدلال يتعين عليك بناؤها ومجموعة نقاط حفظ تعني حاليًا عتاد Ascend. بالنسبة لأحمال العمل الخاضعة للتنظيم حيث لا يمكن للوسائط مغادرة المبنى، فإن الخيار الثاني ليس تفضيلًا — بل هو الخيار الوحيد في هذه الصفحة. وبالنسبة لفريق يحتاج إلى تحليل صوتي طويل هذا الشهر، فإن الخيار الأول هو الخيار الوحيد في هذه الصفحة.
لا تستضيف OrcaRouter أيًا من النموذجين اليوم، ونفضل قول ذلك بصراحة بدلاً من الإيحاء بمسار توجيه غير موجود: Qwen3.8-Omni-Flash يعمل فقط على منصات Alibaba الخاصة، و InternLumina U2 هو تنزيل وليس نقطة نهاية. ما نقوم بتشغيله هو بقية سلسلة Qwen3.8 — Qwen3.8-Flash و Qwen3.8-Max — عبر واجهة برمجة تطبيقات واحدة بسعر قائمة المزود دون أي هامش ربح (0%)، وهو الطريقة العملية للحفاظ على خط أساس عامل للجانب المغلق من هذه المقارنة بينما لا يزال الجانب المفتوح الأوزان يرتب نقاط التحقق الخاصة به من NVIDIA.

أيّ واحد يجب أن تختاره فعلاً؟
اختر InternLumina U2 إذا كنت بحاجة إلى نموذج واحد يقرأ الصور ويولّدها ويحرّرها، وكنت مستعدًا لتحمّل مسؤولية حزمة الاستدلال — وإذا كانت مسرّعاتك من Ascend، أو كان بإمكانك الانتظار حتى تتوفر نقاط تحقق NVIDIA. إنه النموذج الوحيد من بين الاثنين القادر على إنشاء صورة، والوحيد الذي يمكنك تشغيله دون إرسال بيانات إلى أي بائع. تعامل مع أرقام معاييره كغير مُثبتة حتى يصدر التقرير الفني، لأن بطاقة النموذج تقول ذلك بالضبط.
اختر Qwen3.8-Omni-Flash إذا كانت مشكلتك تتمثل في ساعات من الصوت والفيديو بدلاً من إخراج البكسلات — ذكاء الاجتماعات، وتحليل التسجيلات الطويلة، والعمل الوكيلي المكثّف صوتيًا باللغتين الصينية والإنجليزية — وإذا كان بإمكانك قبول الاعتماد على مصدر واحد ومخرجات نصية فقط. سرد التكلفة لديه قوي على ساعات الصوت المُدخَلة وأضعف بكثير على إجمالي الفاتورة، ومعاييره مُبلَّغ عنها من البائع وغير مُعاد إنتاجها، وأول تشغيلات طرف ثالث تظهر تضعه في المئين الثامن والعشرين في الاستدلال، على عيّنة صغيرة بما يكفي لأن تحفّز اختبارًا لا قرارًا.
إذا كنت بحاجة إلى كليهما، فهما مكمّلان لا بديلان: نموذج صور مفتوح الأوزان تستضيفه أنت، ونموذج وسائط طويلة مغلق تستدعيه أنت. لا يمكن توجيه أيٍّ منهما عبرنا اليوم. الشيء الجدير بالمتابعة من جهة هو نقطة تحقق NVIDIA والتقرير التقني؛ ومن الجهة الأخرى، أول تقييم مستقل، وهو غير موجود بعد، وهو أكبر فجوة منفردة في كل ما كُتب عن Qwen3.8-Omni-Flash حتى الآن.
