
Intern-Decision-4B مقابل ContextPilot-8B: نموذج يقلّص السياق مقابل نموذج يديره
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 592 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 187 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
اختر ما يناسبك: internlm/Intern-Decision-4B يرفض قراءة أكثر من 8,192 رمزًا، وtencent/ContextPilot-8B موجود تحديدًا للنجاة من السياقات التي تنمو بلا حدود. إنهما من نفس فئة الحجم، وكلاهما نسختان مضبوطتان من نموذج Qwen الأساسي، وكلاهما ظهرا على الـ Hub دون إعلان من المزوّد ودون أي تقييم مستقل من أي نوع — ContextPilot-8B في 27 أغسطس 2026، وIntern-Decision-4B في 26 سبتمبر 2026 — وهما يحلان مشكلتين متعارضتين. Intern-Decision-4B هو نموذج قرار مُهيكل بـ 4.5 مليار معامل يقوم بتمريرة أمامية واحدة، ويقرأ اللوجيتات، ويعيد احتمالًا معايرًا لكل سؤال طرحته؛ وهو لا يكتب أي رمز أبدًا. ContextPilot-8B هو مولّد نصوص بـ 8.19 مليار معامل مدرَّب على التخطيط والتذكر وتفريغ سياق عمله الخاص أثناء تشغيل وكيل طويل. مقارنتهما ليست في الحقيقة مسألة معيار. إنها مسألة تتعلق بأي نصف من مشكلتك تفضّل أن يبتلعه النموذج.
أولاً، الشيء الذي يتشاركونه حقاً
لا يمتلك أي من النموذجين رقمًا واحدًا تحقق منه أي شخص خارج مختبره الخاص. هذا أمر غير معتاد بما يكفي لذكره قبل أي شيء آخر، لأن معظم المقارنات في هذه المدونة يمكنها على الأقل الاعتماد على لوحة صدارة مستقلة لأحد الجانبين.
ينشر Intern-Decision-4B جدول تقييم كامل على بطاقته — بمتوسط 90.02 عبر سبع مجموعات، ودرجة براير 0.347، وخطأ معايرة متوقع 0.065 — كل ذلك قاسه InternLM على منصة اختبار InternLM. لا ينشر ContextPilot-8B أي جدول على الإطلاق. تقول بطاقته إن الإطار "يتفوق باستمرار على خطوط الأساس الحالية عبر مختلف النماذج الأساسية والمعايير" وتشير إلى ورقة بحثية وخط أنابيب تقييم للحصول على التفاصيل. لذا في هذه المواجهة، يكون سطر المصدر الصادق قصيرًا: أحد الطرفين مُبلغ عنه من البائع وغير مُعاد إنتاجه، والآخر مُدَّعى من البائع وغير منشور، ولا شيء في هذه الصفحة مستقل.

الرهانان، بوضوح تام
رهان Intern-Decision-4B هو أن الجزء الصعب في القرار ليس الاستدلال، بل الالتزام. أعطِه حالة، ومخططًا لأسئلة مُسمّاة، وما يصل إلى ثماني صور، فيُعيد توزيعًا على سلاسل خياراتك الخاصة. إجراء الاستدلال حتمي وثابت الشكل: يُسند الخيارات إلى رموز من رمز واحد، ويُنشئ هيكل JSON للمساعد مع عنصر نائب واحد لكل حقل، ويُشغّل تمريرة أمامية سببية واحدة، ويقرأ اللوغيتات مباشرة قبل كل عنصر نائب، ويطبّق softmax على مرشّحي ذلك الحقل فقط، ويطبّق درجة الحرارة المُعايَرة. لا توجد حلقة فك ترميز، لذا لا يوجد محلل ولا سطح هلوسة بالنص الحر. ثمن هذا الرهان هو سقف إدخال صارم — تقول البطاقة إن المدخلات التي تتجاوز DecisionEngine(max_length=8192) "تُرفض دون اقتطاع".
رهان ContextPilot-8B هو الصورة المرآتية: أبقِ الوكيل يكتب التوكنات، لكن علّمه أن يحرّر ما يحمله. فهو يضيف التخطيط، والذاكرة المهيكلة طويلة المدى، والاسترجاع، وتفريغ السياق اللين إلى مجموعة أدوات الوكيل، ثم يدرّب نقطة التحقق بوصفة تعلّم معزز (RL) تأخذ عينات من فروع حول قرارات تحرير السياق المهمة، وتخصّص الإسناد على مستوى الإجراء لا على مستوى المسار. والبطاقة صريحة بشأن نتيجة التغليف: تحميل نقطة التحقق لا يمنحك إدارة السياق. فتعريفات الأدوات، وبيئة تشغيل الوكيل، وخط أنابيب التقييم موجودة في مكان آخر ويجب جلبها معك.
لوحة النتائج، بُعدًا ببُعد
• الإخراج — لا يصدر Intern-Decision-4B أي نص على الإطلاق، بل فقط احتمالاتٍ على قيم خياراتك؛ أما ContextPilot-8B فيولّد بشكل طبيعي، وإجاباته نثرٌ واستدعاءات أدواتٍ عليك تحليلها.
• الحد الأقصى للمدخلات — يرفض Intern-Decision-4B أي شيء يتجاوز 8,192 رمزًا؛ بينما يرث ContextPilot-8B حدّ الموضع البالغ 40,960 رمزًا من Qwen3-8B، وقد صُمِّم ليواصل العمل في حين ينمو السياق الفعّال.
• المعلمات — 4.54B BF16 لـ Intern-Dec-4B، عبر برج نصي وبرج رؤية ومُسقِط؛ 8.19B BF16 لـ ContextPilot-8B، وهو نموذج لغوي سببي كثيف عادي من Qwen3.
• زمن الاستجابة — يعمل Intern-Decision-4B بمتوسط 44.16 مللي ثانية و44.60 مللي ثانية عند P95 على بطاقة RTX 4090 واحدة، وفقًا لبطاقته الخاصة؛ ولا تنشر ContextPilot-8B أي رقم لزمن الاستجابة، وتكلفته مختلفة جوهريًا لأنه يولّد الرموز بدلًا من تقييمها.
• الصور — يستوعب Intern-Decision-4B حتى ثماني صور، وتُحتسب رموز الصور ضمن السقف البالغ 8,192؛ أما بطاقة ContextPilot-8B فتصف نقطة تفتيش لتوليد النص دون أي مسار متعدد الوسائط.
• الترخيص — Intern-Decision-4B مرخّص بموجب Apache-2.0 مع الاحتفاظ بترخيص Qwen الأصلي إلى جانبه؛ يبدأ ترخيص ContextPilot-8B بالقسم 0، الذي ينص على «إتاحته حصراً لغرض البحث والتطوير العلمي. ولا يجوز لك استخدامه لأي غرض آخر».
• أدلة منشورة — جدول من سبع مجموعات مع تشخيصات المعايرة على جانب؛ وملخّص ورقة بحثية ومؤشر إلى مستودع تقييم على الجانب الآخر.
• السجل — كلاهما هادئان. يُظهر Intern-Decision-4B إعجابًا واحدًا وصفر تنزيلات منذ 26 سبتمبر 2026؛ ولدى ContextPilot-8B 11 إعجابًا ونحو ألف تنزيل منذ 27 أغسطس 2026، وهو ما يعني اهتمامًا أكبر، لكنه لا يزال بلا تقييم من طرف ثالث.

أين ينكسر كل واحد منها فعليًا
نمط فشل Intern-Decision-4B بنيوي، ويجدر بنا أن نكون محددين بشأنه. إذا لم تتسع الأدلة الخاصة بقرار ما في 8,192 توكن، فإن النموذج لا يتدهور بسلاسة — بل يرفض الطلب. هذا خيار هندسي يمكن الدفاع عنه، لكنه مناسب بشكل سيئ للغاية لعبء العمل الذي بُني ContextPilot-8B من أجله تحديدًا. والتكوين الخاص بالبطاقة نفسها يجعل التوتر أكثر حدة: إذ يعلن برج النص الواقع تحت الغلاف حدًا للموضع يبلغ 262,144 توكن. يستطيع العمود الفقري معالجة ربع مليون توكن، بينما لا يقبل الغلاف المُصدَر أكثر من ثمانية آلاف.
إن نمط فشل ContextPilot-8B هو أنه ليس بديلاً جاهزاً لأي شيء. إنه نقطة حفظ داخل إطار عمل، وإطار العمل هو حيث يقيم السلوك. اسحب الأوزان بدون تعريفات الأدوات وبيئة تشغيل الوكيل، وستحصل على نموذج Qwen3-8B مضبوط تكون قدرته المميزة معطّلة. أضف إلى ذلك القسم 0 من الترخيص، فيكون الجواب العملي للنشر التجاري هو أنك لا تستطيع استخدامه على الإطلاق كما هو مُشحون — وهو ما يعني أيضاً أنه ليس مساراً مرشحاً لنا، الآن أو قريباً.
نشر كل منها، إذا كنت تنوي القيام بذلك
يريد Intern-Decision-4B وحدة معالجة رسومات صغيرة ولا حزمة تقديم تُذكر: ثبّت PyTorch 2.9.1 وTransformers 5.14.1 ضمن Python 3.12، وحمّل الأجزاء الأربعة مرة واحدة، وأبقِ المحرك مقيماً في الذاكرة، وقم بالتنقيط. ولأن مرور الانتشار الأمامي ثابت الشكل، فإن P50 وP95 يقعان ضمن ستة أعشار مللي ثانية من بعضهما البعض، لذا يتعلق تخطيط السعة بالتزامن لا بتأخر الذيل. الجزء المحرج هو أنه يُوزَّع كصنف Python قابل للاستيراد بدلاً من خدمة HTTP، لذا فإن وضعه أمام مُستدعٍ في بيئة الإنتاج يعني تغليفه بنفسك.
ContextPilot-8B يريد المعالجة المعاكسة: مسار تقديم حقيقي، ومنفّذ أدوات، ومخازن ذاكرة، وبيئة إطلاق قادرة على التفرّع إذا كنت تنوي يومًا إعادة تدريبه أو تقييمه كما صُمّم. هذا ليس نموذجًا تجرّبه في أصيل يوم واحد؛ بل هو إطار بحثي تتبنّاه.
هل يفيد جهاز التوجيه هنا؟
، والنسخة الصادقة أضيق من المعتاد. لا يُدرج OrcaRouter النموذج Intern-Decision-4B أو ContextPilot-8B أو أي نقطة تحقق مماثلة لتقييم القرارات في كتالوغه — فصفحات النماذج لدينا تُرجع 404 لكليهما، ولا ينبغي قراءة أي شيء في هذا المقال على أنه ادعاء بتوافرهما. وما الذي تمنحك إياه نقطة النهاية الموحّدة فعلاً؟ إنه القدرة على وضع تجربة فاشلة خلف مسار احتياطي: مفتاح واحد عبر أكثر من 200 نموذج، وسعر قائمة المزوّد يُمرَّر بهامش ربح 0%، وتحويل تلقائي عند الفشل بحيث لا يصبح المقيّم الذي ما زلت تقيّمه نقطة فشل واحدة. هذه ميزة حقيقية لجانب Intern-Decision في هذه المقارنة، حيث يعمل النموذج فعلاً بتكلفة زهيدة ومحلياً. أما بالنسبة إلى ContextPilot-8B فهي غير ذات جدوى، لأن ترخيصاً مخصصاً للبحث والتطوير فقط يستبعد أي مسار تجاري بصرف النظر عما يدعمه أي موجّه.
أي واحد إذن؟
إذا كان سؤالك ذا مجموعة مغلقة من الإجابات، ويأتي والأدلة مرفقة به، ويحتاج إلى احتمال بدلاً من تفسير، فإن Intern-Decision-4B هو الكائن الأكثر إثارة للاهتمام — رخيص، ثابت الشكل، مُعاير بالبناء، وصادق بشأن المدخلات التي لن يقبلها. أما إذا كانت مشكلتك أن الأدلة لن تتوقف عن الوصول، فلن يفيدك أي مُقيّم قرار، وContextPilot-8B موجّه نحو الهدف الصحيح، مع التحفظ بأنك تتبنى إطار عمل ورخصة بحثية بدلاً من نموذج.
ما يحسم الأمر هو اختبار لم يُجرِه أيٌّ من المورّدَين: أن تُعطى لكليهما المسألة القصيرة المنظّمة نفسها، مع إجابة قابلة للحساب من الحالة، ثم نرى هل يصمد متوسط 90.02 لدى المُقيِّم خارج بيئته الخاصة. وإلى أن يفعل أحدٌ ذلك، فالقراءة الصحيحة لهذه المواجهة هي أن النموذجَين لا يتنافسان على الخانة نفسها على الإطلاق.

