بطاقة عنوان رئيسية للمقارنة 'InternLumina-U2 vs Tencent UI-Mate-27B' مع العنوان الفرعي 'وكيل سطح المكتب الذي يمكنك تشغيله الآن مقابل نموذج الرؤية الذي لا يمكنك سوى قراءته' وثلاث رقائق إحصائية — 'UI-Mate-27B: يعمل على سطح المكتب اليوم'، 'InternLumina-U2: رؤية موحّدة، بلا أوزان'، 'كلاهما Apache-2.0، كلاهما غير مُثبت' — مع شعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

InternLumina-U2 مقابل Tencent UI-Mate-27B: وكيل سطح المكتب الذي يمكنك تشغيله الآن مقابل نموذج الرؤية الموحّد الذي يمكنك قراءته فقط

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

إصداران هادئان بترخيص Apache-2.0 صادران من مختبرات صينية، وهما Tencent UI-Mate-27B وInternLumina-U2، نُشرا بفارق أسبوعين عن بعضهما، وهما ليسا متنافسين — وهذا بالضبط ما يجعلهما جديرين بالمقارنة. Tencent UI-Mate-27B، الذي صدر بأوزان مفتوحة في 14 أغسطس 2026، هو وكيل لسطح المكتب: فهو يراقب الشاشة ويصدر حركات للفأرة وأوامر للوحة المفاتيح. أما InternLumina-U2، الذي نشرته مختبرات الذكاء الاصطناعي في شنغهاي ككود استدلال في 1 سبتمبر 2026، فهو نموذج رؤية موحّد مُحتمَل: يدّعي أنه يقرأ الصور والفيديو والثلاثي الأبعاد، ويولّد الصور ويحرّرها. الأول ينفّذ على ما يراه؛ والثاني، عندما توجد أوزانه أخيرًا، سيتحدث ويرسم حول ما يراه. إذا كانت مهمتك هي تشغيل سطح مكتب، فأنت تستطيع اليوم الاعتماد على واحد فقط من هذين الاثنين — وهو ليس ذاك الذي يملك البنية الأكثر تعقيدًا.

الوكيل الذي يعمل: Tencent UI-Mate-27B

UI-Mate-27B هو وكيل واجهات رسومية (GUI Agent) أساسي مفتوح الأوزان، يضم 27 مليار معامل، من فريق HY Frontier متعدد الوسائط التابع لـ Tencent، وهو معايَر انطلاقًا من Qwen3.6-27B. يراقب لقطات الشاشة المباشرة، ويستدل على حالة الشاشة الحالية، ثم يُخرج إجراءات مهيكلة للوحة المفاتيح والفأرة في فضاء إحداثيات معياري — ثمرة نموذج تدرّب على تشغيل سطح مكتب حقيقي، لا على الدردشة حوله. ميزته الفارقة هي التنفيذ الموجَّه بالعروض التوضيحية: اعرض عليه سير عمل مرة واحدة فيكيّف العرض المسجَّل مع المهمة المطروحة، معتبرًا لقطة الشاشة المباشرة هي المرجع المعتمد عندما تختلف الواجهة عمّا سُجِّل. أبرز أرقام Tencent المعلنة هي 77.0 في OSWorld-Verified و66.2 في WindowsAgentArena — وهي أرقام كانت لتتصدَّر لوحتي المتصدرين لعام 2026 لو تحقَّق منها مختبر مستقل — إلى جانب طيف من نتائج OSWorkerBench. الأوزان حقيقية وقابلة للتنزيل: اثنا عشر ملف shard بصيغة safetensors على Hugging Face، قابلة للاستضافة الذاتية عبر vLLM أو SGLang على وحدتي GPU، وتحمل بطاقة النموذج تنبيهًا مهمًا مفاده أنها نقطة تفتيش لوكيل وليست نموذج محادثة بصرية قائمًا بذاته — وجّه إليها عبارة "describe this image" فأنت تستخدمها استخدامًا خاطئًا.

العيون الموعودة: InternLumina-U2

InternLumina-U2 هو نوع مختلف تمامًا. إنه نموذج انتشار متناثر قائم على خليط من الخبراء بعدد 16 مليار معامل (مع تفعيل 1 مليار) تعتزم المختبر تقديمه كنموذج واحد لفهم بصري شامل وتوليد الصور وتحرير الصور — بتصميم من ثمانية كتبة رموز منفصلة تمامًا حيث يقوم هيكل واحد بقراءة صورة أو مخطط أو فيديو أو أصل ثلاثي الأبعاد وكتابة بكسلات جديدة. إذا كان نموذجك الذهني هو وكيل واجهة مستخدم رسومية، فإن InternLumina-U2 هو القطب المقابل: فهو لا يريد النقر على أي شيء، بل يريد فهم كل شيء والرسم عند الطلب. صورته المنشورة في 1 سبتمبر 2026 هي كود استدلال وهندسة معمارية — ست نقاط دخول للمهام في مستودع GitHub، وصفحة مشروع مع جدول معايير أولي، وهيكل Hugging Face فارغ — وأوزانه وكود التدريب والتقرير الفني كلها ما تزال موسومة بـ"قريبًا". لا يمكن لأحد تشغيله. الفجوة بين النموذجين ليست في الجودة؛ بل في الوجود.

لوحة النتائج

أرقام UI-Mate-27B مُبلّغ عنها من Tencent ولم يتم إعادة إنتاجها؛ بينما أرقام InternLumina-U2 مُبلّغ عنها من المختبر، وهي أولية وجزئية. كل صف يحمل مصدر بياناته.

• الوظيفة — Tencent UI-Mate-27B: تشغيل سطح المكتب — قراءة لقطات الشاشة المباشرة، وإصدار إجراءات الماوس ولوحة المفاتيح. InternLumina-U2: الإدراك والإبداع — فهم الصور/الفيديو/ثلاثي الأبعاد، وتوليد وتحرير الصور.

• الأوزان — Tencent UI-Mate-27B: متاح للعامة منذ 14 أغسطس 2026، اثنا عشر جزءًا من safetensors، بترخيص Apache-2.0. InternLumina-U2: غير متاح للعامة — مستودع Hugging Face فارغ، الأوزان "قريبًا".

• الحجم — نموذج كثيف بـ27B، مضبوط بدقة من Qwen3.6-27B، مقابل نموذج انتشار MoE متناثر بإجمالي 16B / 1B نشط.

• الإخراج — Tencent UI-Mate-27B: إجراءات منظمة متوافقة مع pyautogui في فضاء إحداثيات موحّد. InternLumina-U2: يقدّم النصوص، وتوليد الصور من النصوص بدقة تصل إلى 1024×1024، وتحرير الصور القائم على التعليمات.

• الأرقام الرئيسية — Tencent UI-Mate-27B: OSWorld-Verified 77.0، WindowsAgentArena 66.2، OSWorkerBench يحقق مكاسب من العروض التوضيحية (جميعها من تقارير Tencent). InternLumina-U2: ChartQA 86.52، GenEval 0.81، MathVision 33.22 (من تقارير المختبر، نتائج أولية).

• تنبيه بشأن مصدر البيانات — Tencent UI-Mate-27B: البطاقة نفسها تحذّر من أنه نقطة تفتيش وكيل (agent checkpoint) وليس نموذج محادثة بصرية مستقلًا. InternLumina-U2: صفحة المشروع تصف نتائجه بأنها «أولية وجزئية».

• حقيقة التشغيل — Tencent UI-Mate-27B: الاستضافة الذاتية عبر vLLM أو SGLang على حوالي وحدتي GPU؛ لا يوجد حاليًا مزوّد استضافة مُدار ينشره. InternLumina-U2: لا يمكن لأحد تشغيله — برنامج التشغيل المُصدَر يتطلب نقاط فحص غير موجودة في المستودع.

A comparison scoreboard for InternLumina-U2 and Tencent UI-Mate-27B: InternLumina-U2 with Job perceive & create visuals, Weights not public 'soon', Output text/images/edits, Headline ChartQA 86.5 (reported), Caveat untestable no weights, Serving no one can run it; Tencent UI-Mate-27B with Job operate a desktop, Weights public since Aug 14 2026, Output mouse & keyboard actions, Headline OSWorld 77.0 WAA 66.2, Caveat agent not visual chat, Serving self-host vLLM ~2 GPUs, with a footer noting all figures are vendor-reported and unreproduced, and the OrcaRouter logo in the bottom-right corner.

نكهتان مختلفتان من غير المُثبَت

كلا النموذجين غير مُثبَت، والكلمة لا تعني الشيء نفسه في المرتين. نموذج Tencent UI-Mate-27B غير مُثبَت بالمعنى العادي لنموذج جديد: نتائجه الرئيسية من إنتاج المورّد نفسه، ولم يُعِد أحد اختبارها بشكل مستقل، وعدد مرات تحميله ضئيل مقارنةً بالادعاءات — وهي الوضعية المعتادة لنقطة تفتيش بدت للوهلة الأولى وكأنها أُنشئت قبل أربعة أيام فحسب، وقد نمت حولها منذ ذلك الحين مجتمعٌ متواضع. لكنه غير مُثبَت بالطريقة القابلة للاختبار. ولأن الأوزان متاحة، يمكن التحقق من نتيجتي 66.2 و77.0 هذا الأسبوع من قبل أي شخص يمتلك بطاقتي GPU وبيئة اختبار تعمل بنظام Windows، ويمكن إعادة إنتاج الادعاءات الموجهة بالعروض التوضيحية أو دحضها على مهام عمل حقيقية. أما InternLumina-U2 فهو غير مُثبَت بمعنى أكثر صرامة: إنه غير قابل للاختبار. بنيته العامة علنية وقابلة للقراءة، لكن أرقامه ليست كذلك — فلا يوجد أي منتَج ملموس يمكنه تأكيدها، والجدول الجزئي الخاص بالمختبر يُظهره بالفعل متخلفًا عن منافس مسمى في معيار توليد واحد على الأقل. الرقم الصادر عن مورّد والمرتبط بملف قابل للتنزيل هو ادعاء بانتظار حَكَم. أما الرقم الصادر عن مورّد والمرتبط بخارطة طريق فهو أمل.

A screenshot of the Hugging Face model page for tencent/UI-Mate-27B (captured August 27 2026), showing the Qwen3.6-27B base model, the vendor-reported OSWorld and WindowsAgentArena benchmark tags, and the note that no inference provider currently deploys the model.

بطاقة tencent/UI-Mate-27B على Hugging Face، الملتقطة في 27 أغسطس 2026 — القاعدة الأساسية Qwen3.6-27B، ودرجات OSWorld وWindowsAgentArena كما أبلغ عنها البائع، مع ملاحظة أنه لا يوجد موفّر استدلال حاليًا ينشرها.

التقسيم الطبيعي للعمل: فاعل وعيناه

عند وضعهما جنبًا إلى جنب، يرسم النموذجان ملامح خط أنابيب أتمتة موثوق. المشكلة الصعبة مع وكلاء الواجهات الرسومية ليست الحالة المتوسطة؛ بل هي أن يقوم الوكيل بهدوء بفعل خاطئ عند حالة شاشة غير متوقعة دون أن يلاحظ أحد. هذا هو بالضبط العمل الذي وُجد من أجله نموذج رؤية رخيص وجدير بالثقة — التحقق من حالة الشاشة قبل كل إجراء وبعده، والتأكد من أن الحوار الذي ظهر هو الحوار الذي يعتقد الوكيل أنه ظهر، وإيقاف الحلقة عندما يتباعد الواقع عن نموذج الوكيل للواقع. Tencent UI-Mate-27B هو الممثل؛ أما نموذج الرؤية الموحد بالشكل الذي تدّعي InternLumina-U2 أنه عليه فهو المُدقّق الطبيعي، القادر على قراءة نفس لقطات الشاشة التي يعمل عليها الوكيل. عندما — وفقط عندما — تُنشر أوزان InternLumina-U2 فعليًا وتصمد ادعاءاتها المتعلقة بالفهم أمام الاختبارات المستقلة، عندها يمكن أن تملأ هذا الدور إلى جانب وكيل وليس ضده. الاثنان ليسا متنافسين على وظيفة؛ بل هما نصفا وظيفة واحدة.

A screenshot of the GitHub repository InternLM/InternLumina-U2 (captured September 2 2026), showing the Apache-2.0 repo landing page and the per-task inference scripts, including the image-understanding entry point that would underpin a screen-state verifier.

مستودع InternLM/InternLumina-U2 على GitHub، ملتقط بتاريخ 2 سبتمبر 2026 — الصفحة الرئيسية للمستودع تعرض سكربتات الاستدلال الخاصة بكل مهمة، بما فيها نقطة الدخول لفهم الصور التي يُبنى منها مدقّق حالة الشاشة؛ أمّا الأوزان التي تجعله قابلاً للتشغيل فليست موجودة في شجرة الملفات.

ما الذي تفعله طبقة التوجيه لمكدس وكيل مزوّد بعيون

لا يُستضاف أيٌّ من النموذجين على OrcaRouter، ولن نوحي بغير ذلك — إذ لا يوجد أي مزوّد يستضيف Tencent UI-Mate-27B في أي مكان، وInternLumina-U2 لا أوزان له يمكن لأي مزوّد استضافتها. نمط التوجيه المنطبق هنا هو نمط هذه البنية تحديدًا: وكيل ينفّذ ونموذج رؤية يتحقّق، مركّبَين بحيث تكون الخطوة المكلفة أو الخطرة مشروطة بالخطوة الرخيصة الموثوقة. تعبّر لغة التوجيه المخصصة عن ذلك باستدعاء منطقي واحد — نفّذ، ثم تحقّق، ثم تابع أو توقّف — بدلًا من كود لصق خاص يربط بين مزوّدي نماذج، ويغطي تجاوز الفشل التلقائي نمط الفشل الواقعي: فوكيل الواجهة الرسومية مثل UI-Mate-27B هو بالضبط نوع نقطة الفحص غير المثبتة التي تجرّبها أولًا على مسار اختباري، بحيث ينتقل الاستدعاء إلى نموذج مثبَت فور أن يسيء الجديد التصرف. واجهة برمجية واحدة لأكثر من 200 نموذج مستضاف، وسعر المزوّد المعلَن يُمرَّر دون أي زيادة، مع إبقاء المكونات غير المثبتة في البنية خلف حواجز أمان إلى أن تكتسب ثقتك.

الخلاصة

إذا كنت تبني شيئًا يتحكم في سطح المكتب، فإن Tencent UI-Mate-27B هو الوحيد من بين الاثنين الذي يتوفر بمعنًى قابل للاستخدام فعلًا — إذ يمكن تشغيله اليوم على وحدات GPU الخاصة بك، مع نتائج مثيرة للإعجاب لم تُستنسَخ بعد، ويمكنك اختبارها بنفسك. أما إذا كنت تبني شيئًا يحتاج إلى نموذج يفهم ما يراه ويستنتج بشأنه، فإن InternLumina-U2 بنية واعدة تنتظر أوزانها — جديرة بالقراءة الآن، ولا تساوي شيئًا كاعتماد برمجي حتى تظهر ملفات safetensors. راقب الاثنين بانتظار اليوم الذي يصبح فيه تقسيم العمل ممكنًا: فاعل على سطح مكتبك، وعيون موثّقة تراقبه، وطبقة توجيه تُبقيهما صادقَين.

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube