بطاقة عنوان رئيسية لمقال الأخبار «EVIE-8B» مع عنوان فرعي نصه: «Tencent تُطلق بهدوء أكثر مسترجع مستندات مرئي دقة حتى الآن»، تعرض رسمًا توضيحيًا تحريريًا مسطحًا لعدسة مكبرة فوق كومة من صفحات المستندات (صفحة تتضمن جدول بيانات صغيرًا، وأخرى تتضمن مخططًا خطيًا بسيطًا) تتدفق منها متجهات رموز مربعة صغيرة نحو شارة على شكل كبسولة تحمل 4096D، مع نص في التذييل: «أُطلق بهدوء في 4 سبتمبر 2026 — الأوزان متاحة على Hugging Face، دون أي إعلان بعد» وشعار OrcaRouter في الزاوية اليمنى السفلية.
Engineering & Research

EVIE-8B: Tencent تطرح بهدوء أداة استرجاع المستندات المرئية الأكثر دقة حتى الآن

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

قبل ثلاثة أسابيع، كان نموذج EVIE-Preview-4.5B من تينسنت هو المسترجع المفتوح الأدق للمستندات المرئية على لوحات تصدّر ViDoRe، استنادًا إلى أرقام أعلنتها تينسنت نفسها. وفي 4 سبتمبر، استبدلت تينسنت بهدوء ذلك النموذج في صدارة لوحة تصدّراتها — ليس بمنافس خارجي، بل بنموذج أخ أكبر أُطلق صباح اليوم نفسه. وكان EVIE-8B، وهو مسترجع تفاعل متأخر يضم 8.41 مليار معلمة فوق عمود فقري من Qwen3.5-9B مع تضمينات لكل توكين بعمق 4096، قد وصل كأوزان ورمز برمجي إلى Hugging Face وGitHub دون أي إعلان أو تدوينة أو ورقة بحثية. أما نقطة تفتيش ثالثة، EVIE-4.5B، فظهرت في الدقيقة نفسها وأصبحت الآن بين النموذجين. كل ادعاء يتصل بهذا الإصدار — النتائج، والبنية، وحتى الغرض من هذه النماذج — يقوم حاليًا على ما تقوله مستودعات تينسنت نفسها، إذ لم ينشر أحد خارج تينسنت أي شيء عن EVIE-8B بعد. هذا كل ما يمكن معرفته فعليًا من المستودع، وما لم يُؤكَّد بعد.

ما الذي أصدرته Tencent في 4 سبتمبر

في 2026-09-04، ظهر مستودعان جديدان في مؤسسة tencent على Hugging Face بفارق دقيقة واحدة تقريبًا: tencent/EVIE-8B وtencent/EVIE-4.5B. وإلى جانبهما، أُطلق مستودع GitHub موحّد باسم Tencent/EVIE يحمل كود التدريب، ومحرك استدلال ColQwen3.5، ومنصة تقييم تضم 138 مهمة. كلا مستودعي النماذج مرخّصان بموجب Apache-2.0، وكلاهما يستخدم مكتبة colpali-engine، وكلاهما يحمل وسم مسار استرجاع المستندات المرئية. الإصدار الأقدم EVIE-Preview-4.5B الصادر في 17 أغسطس ما زال متاحًا على Hugging Face تحت اسم "Preview"، لكنه لم يعد النموذج الرئيسي للعائلة: ففي لوحة المتصدرين المحدّثة داخل بطاقة EVIE-8B، تُدرج Tencent ثلاثة من نقاط التفتيش الخاصة بها في الصدارة — EVIE-8B بمعدل 66.75 في معيار ViDoRe V3 nDCG@10، وEVIE-4.5B بمعدل 66.02، وEVIE-Preview-4.5B بمعدل 65.36.

لم يصدر أي إعلان في أي مكان. تذكر ملاحظات إصدار بطاقة EVIE-8B أن الأوزان وخطوط أنابيب الاستدلال ومجموعات التقييم متاحة كمصدر مفتوح، ثم تضيف أن «التفاصيل التقنية الكاملة، وتجارب الاستئصال المعماري، والورقة البحثية الرسمية سيتم تحديثها في إصدار قادم». كان مستودع GitHub قد سجّل أربعة تعديلات فقط ولم ينشر أي إصدار وقت كتابة هذا النص. لا يُظهر أيٌّ من المستودعين الجديدين اعتمادًا ذا معنى بعد — لا توجد نسخ متفرعة مجتمعية بنتائج مستقلة، ولا تقييمات من جهات خارجية، وعدادات التنزيل ما تزال قريبة من الصفر بعد يومين من إتاحة المستودعين للعموم. بناءً على الأدلة المتاحة، هذا إصدار من Tencent يتبع نهج «الأوزان أولًا، والورقة لاحقًا»، بالطريقة الهادئة نفسها التي اعتمدها المختبر مع EVIE-Preview-4.5B وUI-Mate-9B في أغسطس.

A screenshot of the Hugging Face model page for tencent/EVIE-8B, showing the Tencent org, the visual-document-retrieval pipeline tag, the colpali-engine, qwen3_5, late-interaction and multi-vector tags, the Apache-2.0 license, and the start of the model card titled 'EVIE-8B: The Most Accurate Visual Document Retriever' (captured September 7, 2026).

بطاقة نموذج tencent/EVIE-8B أعلاه هي الواجهة العامة للإصدار: نقطة فحص لاسترجاع المستندات البصرية موسومة لمكتبة colpali-engine، مرخصة بموجب Apache-2.0، مع تضمين تفاعل متأخر بأبعاد 4096، وجدول ViDoRe المحدّث الخاص بالعائلة بالقرب من أعلى البطاقة.

EVIE-8B، المعلم الرائد

من الناحية المعمارية، ينتمي نموذج EVIE-8B إلى عائلة التفاعل المتأخر ColPali/ColBERT. فبدلاً من ضغط الصفحة في متجه تضمين واحد — وهو الأسلوب المُفقِر الذي تتبعه عمليات الاسترجاع الكثيفة أحادية المتجه — يقوم النموذج بتشغيل هيكل رؤية-لغة على صورة الصفحة ويحتفظ بتمثيل متعدد المتجهات على مستوى كل رمز، ثم يُقيّم الصلة باستخدام عامل MaxSim: كل رمز من رموز الاستعلام يجد أفضل تطابق له عبر رموز الصفحة، وتُجمع هذه القيم القصوى لتكوّن درجة الصلة. من الاختيارات الخاصة بنموذج EVIE-8B: هيكل Qwen3.5-9B يُشغَّل بانتباه ثنائي الاتجاه كامل (النموذج مُحوَّل إلى شكل مُرمِّز، لذا يتم تعطيل قناع السببية عبر تسلسل الرؤية-النص) بالإضافة إلى إسقاط عريض بأبعاد 4096 لكل رمز. الهدف من هذا العرض هو الدقة: فالتخطيط المكاني، والطباعة، وبنية المخططات، والعلاقات الجدولية تبقى محفوظة في التمثيل بدلاً من أن تُفقد عبر التوسيط.

تضع تينسنت نموذج EVIE-8B بشكل صريح بصفته "المعلّم الرئيسي." ويُدرَّب النموذج الطالب EVIE-4.5B من خلاله وفق منهجية تسمّيها تينسنت EVIE-ARD — وهي تقطير علاقات يحافظ على المراسي ويراعي السعة، ينقل طوبولوجيا العلاقات بين الرموز ويستخدم إشرافًا هامشيًا بالعينات السلبية الصعبة. بعبارة أخرى، يقع على عاتق نموذج 8B مهمتان: تحديد سقف الدقة لخط المنتج، والعمل كمرساة الجودة التي يقطّر منها الطالب المدمج. على الجانب التدريبي، يذكر التقرير 775,635 زوجًا من المستندات والاستعلامات، مع عينات سلبية صعبة مُستخرجة تتم إعادة تقييمها بواسطة حَكَم متعدد الوسائط يرفع المرشحات القابلة للإجابة إلى مرتبة الإيجابيات، ويُخفي الغامض منها خارج دالة الخسارة، ولا يُبقي إلا الصفحات غير ذات الصلة تمامًا كعينات سلبية حقيقية. نموذج "a40" المُصدَر هو بحد ذاته مزيج في فضاء الأوزان، عند α = 0.40، لذراعين مدرَّبين بشكل مستقل.

لوحة النتائج التي كتبتها تينسنت لنفسها

جميع الأرقام أدناه مُبلَّغ عنها من قِبل البائع. وهي مأخوذة من بطاقة نموذج تينسنت الخاصة، وقد أُنتجت باستخدام أداة التقييم التي توفّرها تينسنت في مستودعها؛ لم تتم إعادة إنتاج أيٍّ منها بشكل مستقل، ولم يقم أي شخص خارج المختبر بتشغيل EVIE-8B حتى الآن.

• المعلمات / العمود الفقري — 8.41B، Qwen3.5-9B، انتباه كامل ثنائي الاتجاه.

• التضمين — متجهات متعددة لكل رمز ببعد 4096، تفاعل متأخر MaxSim.

• ViDoRe V1 (10 مهام، nDCG@5) — 92.18.

• ViDoRe V2 (4 مهام، nDCG@5) — 74.23.

• ViDoRe V3 (48 مهمة، nDCG@10) — 66.75، ومع مسح لكل مجال تدّعي البطاقة أنها تفوز بجميع المجالات العامة الثمانية.

• JinaVDR (76 مهمة، nDCG@10) — 83.30؛ متوسط nDCG@10 الكلي عبر اللوحات الأربع — 79.51 عبر مجموعة المهام البالغ عددها 138 مهمة.

• الترخيص — Apache-2.0؛ الأوزان وكود الاستدلال والتقييم مفتوحة.

A single-column scoreboard for EVIE-8B reading: Params 8.41B, Backbone Qwen3.5-9B, Embedding 4096D per token, ViDoRe V1 (nDCG@5) 92.18, ViDoRe V3 (nDCG@10) 66.75, License Apache-2.0, with a footer noting all figures are vendor-reported from the tencent/EVIE-8B card and not independently reproduced, and the OrcaRouter logo in the bottom-right corner.

أكثر الصفوف إثارةً للاهتمام في جدول Tencent هو الصف الذي تتفوق فيه Tencent على Tencent. فقد ذكرت بطاقة نموذج EVIE-Preview-4.5B الصادرة في أغسطس أنها حققت «المركز الأول على ViDoRe V3» بنتيجة 65.36 وفقًا لمقياس nDCG@10، متفوقةً بفارق ضئيل على نتيجة webAI-ColVec1.1-8b البالغة 65.32. وفي الجدول المحدَّث ضمن بطاقة EVIE-8B، أصبحت النتيجة 65.36 نفسها الآن في المركز الثالث إجمالًا، خلف نتيجة EVIE-8B البالغة 66.75 ونتيجة EVIE-4.5B البالغة 66.02. وتتفوق أرقام EVIE-8B المفصَّلة حسب النطاق على أرقام المعاينة السابقة في جميع نطاقات ViDoRe V3 العامة الثمانية — CompSci: 81.86 مقابل 80.65، وFinance EN: 71.23 مقابل 70.50، وPharma: 70.81 مقابل 69.20، وهكذا — بمتوسط مكسب يبلغ 1.39 نقطة. وما إذا كان هذا المكسب سيصمد أمام تقييمٍ مستقلٍّ هو تحديدًا السؤال المفتوح؛ لكن الاتساق الداخلي جديرٌ بالملاحظة، لأنّ إطلاقَ نموذجٍ مُعلِّمٍ يعجز عن التغلّب على تلميذه الخاص سيكون أمرًا غريبًا.

A family graphic titled 'Three EVIE checkpoints, one self-published leaderboard' showing three stacked rows each with a ViDoRe V3 nDCG@10 value: EVIE-8B 66.75 with a gold rank-1 badge and the tag '4096D teacher', EVIE-4.5B 66.02 with a silver rank-2 badge and the tag 'Prefix-MRL student', and EVIE-Preview-4.5B 65.36 with a bronze rank-3 badge and the tag '128D preview', with a footer noting the ranking is vendor-reported from the EVIE-8B card of September 4, 2026, and the OrcaRouter logo in the bottom-right corner.

الرسم العائلي أعلاه يعيد عرض الترتيب متعدد النقاط الثلاث الذي نشرته {{1}}Tencent{{/1}} في بطاقة EVIE-8B في 4 سبتمبر — {{2}}EVIE-8B{{/2}} عند 66.75، و{{3}}EVIE-4.5B{{/3}} عند 66.02، و{{4}}EVIE-Preview-4.5B{{/4}} عند 65.36 على {{5}}ViDoRe V3 nDCG@10{{/5}} — حيث تُفسح النسخة الأولية {{6}}128D{{/6}} المجال للمعلّم {{7}}4096D{{/7}} وللتلميذ Prefix-MRL.

لماذا الرائد ليس نموذج النشر

هناك سبب وراء تسمية النموذج المتصدّر في الدقة بـ"المعلّم" وليس "الافتراضي". فالعرضُ (عدد الأبعاد) يكلّف مساحة تخزين وحساب تقييم، و4096 بُعدًا لكل توكن هو عرضٌ واسع جدًا. في صيغة BF16، يبلغ متجه التوكن الواحد في EVIE-8B 8 كيلوبايت قبل أي تكميم، ويمكن للصفحة الكثيفة إنتاج مئات متجهات التوكن، إذ يحدّ بروتوكول التقييم الخاص ببطاقة النموذج المستندات بـ1024 توكنًا مرئيًا كحد أقصى لكل صفحة. لا تنشر Tencent أي رقم لحجم الفهرس الخاص بـEVIE-8B، وهو أمر لافت للنظر لأن بطاقة EVIE-Preview-4.5B نشرت أرقامًا دقيقة لفهرسها ذي الـ128 بُعدًا: 179.2 جيغابايت من فهرس BF16 الخام لكل مليون صفحة عند ميزانية التدريب البالغة 768 توكنًا، و420.5 جيغابايت عند الطبقة المستقرأة البالغة 1792 توكنًا. وبمقارنة المتجهات واحدًا بواحد، فإن تضمينات EVIE-8B أعرض بـ32 مرة من تضمينات النموذج الأولي، لذا فإن فهرس EVIE-8B الخام عند ميزانية التوكنات نفسها يصل إلى نطاق متعدد التيرابايتات لكل مليون صفحة — قبل حتى أن يدخل نظامُ الاسترجاع الذي يجب أن يحمله في ذاكرة الوصول العشوائي إلى النقاش.

إن إصدار EVIE-4.5B في اليوم ذاته هو المؤشر على الكيفية التي تتوقع بها Tencent حلّ هذا التوتر. EVIE-4.5B هو النموذج الطالب بحجم 4.61B، مع إسقاط وحيد ذي 2048 بُعدًا يُقتطع أثناء التشغيل إلى 64 أو 128 أو 256 أو 512 أو 1024 أو 2048 بُعدًا (وتُسمّي Tencent هذا المخطط Prefix-MRL)، بالإضافة إلى مرحلة ضغط التوكنات دون تدريب تُسمّيها HAC، والتي تجمع قرابة 750 توكنًا مرئيًا للصفحة في 32–64 متجهًا. وعنوان Tencent الرئيسي لهذا النموذج هو بصمة فهرس تبلغ 3.81 جيبي بايت لكل مليون صفحة — وهو رقم، مثل بقية الأرقام، معلَن من قِبل البائع. وعند قراءتها معًا، لا يبدو الإصدار وكأنه "نموذج 8B جديد واحد"، بل أقرب إلى عائلة مقصودة: فالنموذج 8B يحدد السقف ويُدرّب الطالب، والطالب هو النموذج الذي صُمم بحجم يتيح له العمل فعليًا خلف فهرس إنتاجي.

كيفية تشغيل EVIE-8B اليوم

يتوفر EVIE-8B كأوزان فقط. لا توجد واجهة برمجة تطبيقات مستضافة على أي منصة — بما في ذلك OrcaRouter — لذا فإن السبيل الوحيد اليوم هو استضافة نقطة التحقق (checkpoint) ذاتيًا وتشغيلها عبر مسار ColQwen3.5 في colpali-engine. دليل البدء السريع للبطاقة قصير: حمّل النموذج بصيغة BF16 مع flash-attention، واستدعِ enable_bidirectional_attention()، وقم بتضمين صور الصفحات واستعلام النص، ثم قيّم باستخدام MaxSim الخاص بالمعالج. الخطوة ثنائية الاتجاه ليست زخرفة اختيارية — فإصدارات colpali-engine المنشورة تبني ColQwen3.5 بأقنعة سببية افتراضيًا، وقد وثّقت بطاقة النموذج الأولي أن إبقاء القناع كما هو يكلف حوالي 1.1 نقطة في MaxSim لأعلى نتيجة. يُشحَن نفس المُساعد مع EVIE-8B. تبلغ نقطة تحقق بحجم 8.41B بصيغة BF16 حوالي 17 جيجابايت من الأوزان وفقًا للقاعدة التقريبية بايتان لكل معامل، لذا فهذا خيار يتطلب بطاقة GPU واحدة مع مساحة إضافية وليس نموذجًا للطرفيات (edge)، وتقع المجموعة النصية حيثما تحتفظ بالفهرس، وليس على النموذج.

ما الذي تغيّره EVIE-8B لمكدس RAG للمستندات؟

بالنسبة لأي شخص يبني استرجاعًا فوق المستندات الممسوحة ضوئيًا أو الإيداعات أو الرسوم البيانية أو النماذج، فإن التغيير العملي يتمثل في أن سقف الجودة للاسترجاع المفتوح للمستندات المرئية قد ارتفع للتو، وأنه ارتفع داخل عائلة أصبحت توفّر الآن ثلاث فئات سعرية-أدائية. بيد أن أداة الاسترجاع لا تمنحك غير الصفحات. أما النموذج الذي يقرأ تلك الصفحات ويكتب الإجابة فهو قرار منفصل، وفي هذه الطبقة يُثبت التوجيه جدارته: إذ يكشف OrcaRouter عن واجهة API واحدة عبر أكثر من 200 نموذج بسعر القائمة المعلن من المزوّد وبدون أي هامش ربح (0%)، مما يسمح بتبديل نموذج القارئ خلف أداة الاسترجاع دون إعادة كتابة الشيفرة، ويجعل أي تخفيضٍ سعري من المزوّد على أي نموذج موجَّه ساريًا في اليوم ذاته الذي يُعلَن فيه. وتزداد أهمية هذا الفصل عندما يكون جانب الاسترجاع نموذجًا جديدًا كليًا غير مُثبَت — إذ يمكنك اعتماد EVIE-8B للفهرسة مع إبقاء طبقة التوليد خلف واجهةٍ لا تربطك بأي نموذج واحد.

ماذا تشاهد بعد ذلك

ثلاثةُ أمورٍ كفيلةٌ بأن تحوِّل هذا الأمر من إطلاقٍ صامتٍ لمستودَعٍ إلى قصةٍ محسومة. أولًا: تشغيلٌ مستقل؛ فإلى أن يُعيد شخصٌ من خارج تينسنت إنتاجَ أرقام ViDoRe وJinaVDR، سيظلُّ ادعاء «المرتبة الأولى» لـ EVIE-8B وادعاء «المرتبة الأولى» للمعاينة القديمة ادعاءين ذاتيَّين، والغريبُ أنهما متعارضان. ثانيًا: الورقةُ الموعودةُ ودراساتُ الإزالة؛ فاختيارُ بُعدٍ قدرُه 4096، ونقطةُ تفتيشِ مزجِ الأوزان، ووصفةُ التقطير، كلُّها حاليًا تأكيداتٌ بلا وثيقةٍ مكتوبةٍ تدعمها. ثالثًا: التسميةُ؛ وبما أنّ EVIE-4.5B تحتلُّ الآن المكانَ الذي كانت تحتلُّه EVIE-Preview-4.5B قبل ثلاثة أسابيع، يظلُّ السؤالُ مطروحًا: هل تُبقي تينسنت خطَّ «Preview» قائمًا أم تدمجه في العائلةِ التي أُعيدت تسميتُها؟ وبالنظر إلى الوتيرة — ثلاثُ نقاطِ تفتيشٍ لاسترجاعِ المستنداتِ المرئية في ثلاثة أسابيع — فإنّ الافتراضَ الأكثرَ فائدةً هو أنّ هذا الخطَّ يُستثمَر فيه بقوة، وأنّ الإصداراتِ الهادئةَ هي طريقةُ المختبر في الإطلاقِ قبلَ ورقةِ البحث.