
MiniCPM5-2B-DSpark مقابل Gemma 4 12B: طريقتان للصياغة، وفئتان من حيث الوزن للذكاء الاصطناعي المحلي
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
أسرع طريقة لترى لماذا يستحق MiniCPM5-2B-DSpark وGemma 4 12B أن يكونا في الصفحة نفسها هي أن تتجاهل حجميهما للحظة وتراقب كيف يكتب كلٌّ منهما جملة. كلاهما يخدع ناقل الذاكرة باستخدام مُصَوِّغ (drafter): نموذج صغير يقترح عدة رموز (tokens) تالية دفعةً واحدة، ثم يتحقق النموذج الحقيقي من الكتلة كلها في مرور واحد، فيدفع السيليكون تكلفة تحميل الأوزان مرةً واحدة لكل كتلة بدلاً من مرة لكل رمز. MiniCPM5-2B-DSpark هو المُصَوِّغ الذي نشرته OpenBMB بهدوء على Hugging Face في 6 سبتمبر 2026 — نقطة تحقق مرافقة مع 323.8M معاملات تسرّع MiniCPM5-2B، النموذج المحلي الكثيف ذا 2.52B معاملات الذي أعلنت عنه ModelBest في WAIC في 19 يوليو 2026. أما Gemma 4 12B فهو نموذج Google العام متعدد الوسائط ذو 11.95B معاملات وبدون مُرمِّز، أُطلق في 3 يونيو 2026 مع مُصَوِّغات مدمجة خاصة به وسياق يبلغ 256K. أحدهما يبيع المُصَوِّغ كنقطة تحقق منفصلة بترخيص Apache-2.0 تُحمّلها بنفسك؛ والآخر يُخفي حيلة مشابهة داخل نموذج كبير واحد تشغّله مباشرةً.
الملاحظة الصادقة التي تحسم هيئة هذه المقالة: نموذج MiniCPM5-2B-DSpark ليس نموذجًا يمكن توجيه الأوامر إليه؛ فهو لا يملك مُحوِّلًا رمزيًا (tokenizer)، ولا قالب محادثة، ولا مخرجاتٍ مستقلة — بل مجرد بطاقة تسرد ملف model.safetensors وإعدادات config وملف README. وهو مجرد إضافةٍ إلى طبقة الخدمة تستهدف فئة 2B؛ أما المقارنة الحقيقية التي يجريها القارئ فتقع بين فئتين من أوزان الذكاء الاصطناعي المحلي: فئة 2B بحجم الهاتف التي تولّد رموزها، في مقابل فئة 12B العامة بذاكرة 16 غيغابايت التي تولّد رموزها. وكل ما يلي ذلك ليس سوى تجسيدٍ ملموس لهذا القرار.
ما هو MiniCPM5-2B-DSpark في الواقع
بطاقة النموذج هي الواجهة العامة الكاملة للإصدار؛ لذا فهي كل ما يمكن معرفته عنه. MiniCPM5-2B-DSpark هو نقطة فحص مسودّة (draft checkpoint) من DSpark: خمس طبقات انتباه كامل، وعدد معاملاته 323,776,001، وانتباه مجمّع الاستعلامات (grouped-query attention) بعدد 16 رأس استعلام ورأسَي مفتاح-قيمة (KV)، وحجم كتلة يساوي سبعة — إذ يقترح حتى سبعة توكنات مرشّحة في كل تمرير أمامي ليتحقق منها النموذج الهدف MiniCPM5-2B. يُصرِّح ملف الإعداد (config) بمعمارية Qwen3DSparkModel مع خريطة تلقائية (auto-map) إلى DSparkDraftModel، ويأتي مرفقًا برأس الثقة ورأس ماركوف المنبثقَين من طريقة DSpark (arXiv 2607.05147، ورقة DeepSeek الصادرة في يوليو 2026)، وكلاهما ما يزال مفعَّلًا — أي المُتحقِّق المدرِك للحمل الذي يقرر متى لا تستحق لاحقةٌ ما أن تُفحص. وقد دُرِّب على ستِّ دورات (epochs) وعلى 7.05 مليار توكن من الاستجابات التي ولّدها MiniCPM5-2B عبر مطالبات عامة ورياضية وبرمجية.

بطاقة openbmb/MiniCPM5-2B-DSpark أعلاه هي كامل ما تم إصداره: بطاقة النموذج، والإعدادات، وملف Safetensors واحد، ولا إعلان، ولا تدوينة، ولا بيان صحفي — إصدار أوزان صامت عمره يوم واحد وقت كتابة هذا النص.
ما لا تحتويه البطاقة لا يقل أهمية عمّا تحتويه. إنها تبلغ عن طول القبول — في تقييم المستودع نفسه، إجمالي 5.52 رمزًا مقبولًا لكل خطوة تحقق عند فك التشفير الجشع، مع 6.05 في الرياضيات و6.11 في البرمجة من أصل سقف سبعة رموز — لكنها لا تنشر أي تسريع لوقت الساعة الفعلي، ولا رقمًا للرموز في الثانية، ولا معيارًا مستقلًا. محرك DSPARK من SGLang هو مسار الخدمة الموثّق، مع تحميل المسودة بجوار هدف MiniCPM5-2B. بعبارة أخرى: جودة المسودة مُحدَّدة كميًا، لكن عائدها لم يُحدَّد بعد، وأي شخص يتبنّاها يجب أن يقيس قبل أن يصدّق.
ما الذي تقدمه Gemma 4 12B للجانب الآخر
Gemma 4 12B هو الابن الأوسط في عائلة Gemma 4 من Google، ويقع على نقطة مختلفة كليًا من منحنى الذكاء الاصطناعي المحلي. إنه نموذج واحد كثيف بعدد 11.95 مليار معامل، يقبل النص والصورة والصوت والفيديو كمدخلات دون أي مشفّرات منفصلة، وينفّذ استدعاءات الأدوات مباشرة دون الحاجة إلى إعدادات، ويجمع بين سياق أصلي بطول 256K وبين مسوّدات التنبؤ متعدد الرموز التي تؤدي الحيلة ذاتها لناقل الذاكرة داخليًا — لكن من داخل نقطة الحفظ، فلا يوجد أي شيء إضافي لتنزيله أو توصيله. وهو مرخّص بموجب Apache 2.0، ويعمل عمليًا على حاسوب محمول بذاكرة 16GB، وقد وصل بالمنظومة الكاملة من Google: تقييمات الإطلاق، وبطاقات النماذج لكل من إصداري القاعدة والتعليمات، ودعمًا للنظام البيئي في Model Garden وLM Studio وOllama. ولديه أشهر من النشر المجتمعي خلفه، وهو ما لا تملكه مسودة MiniCPM التي لم يتجاوز عمرها يومًا واحدًا.

بطاقة نموذج Google لـ Gemma 4 12B أعلاه هي التباين في إطار واحد: نموذج عام متعدد الوسائط ناضج، يكون مُعدّوه سمةً من سمات الإصدار، وليسوا مستودعًا منفصلًا.
المواصفات، موسومة بصدق
اقرأ هذه الأرقام مع وضع المصدر في الاعتبار: أرقام MiniCPM5-2B هي ادعاءات من بطاقة ModelBest ولم يتم التحقق منها؛ أما أرقام Gemma 4 12B فمصدرها Google نفسها، وقد طال استخدامها من قبل المجتمع.
• ما الذي تشغّله — MiniCPM5-2B-DSpark: نموذج مسودة بحجم 324M لا يعمل إلا إلى جانب MiniCPM5-2B (كثيف بـ2.52B و42 طبقة). أمّا Gemma 4 12B: فهو نموذج كثيف مستقل واحد بحجم 11.95B.
• السياق — MiniCPM5-2B هدفه 128K أصليًا، وGemma 4 12B هدفه 256K أصليًا.
• النمط — مجموعة MiniCPM5-2B: نص فقط. Gemma 4 12B: إدخال نص وصورة وصوت وفيديو، بدون مرمّز.
• الصياغة — MiniCPM5-2B-DSpark: مسودة DSpark خارجية، سبعة توكنات لكل تمريرة، عبر محرك SGLang DSPARK. أما Gemma 4 12B: فيستخدم مسوّدات داخلية قائمة على التنبؤ متعدد التوكنات، ولا يتطلب تثبيت أي شيء.
• البصمة — يبلغ حجم MiniCPM5-2B حوالي 5 جيجابايت بصيغة BF16 بالإضافة إلى ملف مسودة بحجم ~650 ميجابايت؛ بينما يبلغ حجم Gemma 4 12B حوالي 18 جيجابايت بصيغة BF16، وهو عملي على أجهزة من فئة 16 جيجابايت عند تكميمه.
• الأدلة — MiniCPM5-2B-DSpark: أرقام طول القبول في المستودع فقط، عمرها يوم واحد. Gemma 4 12B: تقييمات الإطلاق إضافة إلى أشهر من النشر المجتمعي.

لوحة النتائج أعلاه هي نفس الصورة في ستة صفوف: يختلف العمودان في كل شيء تقريبًا باستثناء الاستراتيجية التي يستخدمها كلاهما للكتابة بسرعة.
أي فئة وزن تناسب السيليكون الذي لديك فعليًا؟
نظرًا لأن MiniCPM5-2B-DSpark ليس نموذجًا بحد ذاته، فإن المقارنة الجوهرية تكمن في فئة أوزان النموذج المستهدف مقابل فئة أوزان Gemma 4 12B — وهذه المقارنة هي في الغالب مسألة عتاد. فالهاتف، أو لوحة القيادة الذكية، أو صندوق الحوسبة الطرفية الصغير الذي يملك بضعة غيغابايتات من الذاكرة العشوائية لا يمكنه تشغيل نموذج بحجم 11.95B بسرعة مفيدة؛ فالناقل الذاكرتي (Memory Bus) هو بالضبط عنق الزجاجة الذي سيخنقه. هذا هو العالم الذي بُني عليه مكدس MiniCPM5-2B — نموذج كثيف (Dense) بحجم 2B تتناسب أوزانه مع الذاكرة المحلية للجهاز، مع نموذج مساعد (Draft) مُلحَق به لاستعادة جزء من معدل الرموز في الثانية (Tokens-Per-Second) الذي تتنازل عنه النماذج الكثيفة الصغيرة. إن فك الترميز التخميني (Speculative Decoding) يكون في أقصى فعاليته تحديدًا في هذا النظام الكثيف المقيَّد بناقل الذاكرة، ولهذا السبب يُعد النموذج المساعد الجزء المثير للاهتمام في هذا الإصدار بدلًا من كونه مجرد حيلة تسويقية.
Gemma 4 12B هو الجواب بوزن فئة أعلى. إذا كان جهازك يحتوي على 16GB أو أكثر — كمبيوتر محمول، محطة عمل، خادم طرفي قوي — فبإمكانك حمل النموذج العام متعدد الوسائط، وتكسب ثلاثة أمور لا يمكن لمجموعة 2B تقديمها: إدخال الصور والصوت والفيديو دون مشفرات أو خط أنابيب ثانٍ؛ نافذة 256K للعمل على نطاق المستودعات أو على نطاق المستندات؛ ونضجًا لا تمتلكه نقطة تفتيش مسودة لم يتجاوز عمرها يومًا واحدًا. أنت تتخلى عن القدرة على التشغيل على أصغر الأجهزة، وتدفع ما يقارب ثلاثة أضعاف بصمة الذاكرة.
واقع التوجيه لكليهما
لا يوجد أي من طرفي هذه المقارنة في كتالوج مستضاف اليوم، بما في ذلك OrcaRouter. MiniCPM5-2B-DSpark هو ملحق خدمة ذاتية الاستضافة بحكم التعريف — أنت تشغّل حزمة SGLang بنفسك، والمسودة موجودة فقط في نشرك المحلي. Gemma 4 12B مفتوح الأوزان، لذا يمكنك تقديمه أو استخدامه حيثما يتوفر لك بالفعل. هذا هو بالضبط الموقف الذي تبرر فيه طبقة التوجيه دورها كشبكة أمان وليس كآلية توصيل: عندما تجرّب بناءً أوليًا جديدًا ضد عبء عمل تقدمه بالفعل، فإن توجيه مسار الاختبار عبر واجهة برمجة تطبيقات واحدة مع تجاوز تلقائي للفشل يعني أن البنية غير المثبتة قد تتوقف دون أن تعطّل الإنتاج، وأسعار مقدمي الخدمة المحيطة بها تمر بهامش ربح 0%، لذا فإن أي تغيير في السعر على أي نموذج مستضاف تقارنه به سيظهر في نفس اليوم. أما بالنسبة للمقارنة نفسها، فالخطة الصادقة لكلا النموذجين هي نفسها: أنت تستضيف بنفسك، لذا فإن المعيار الذي يهم هو الذي تشغّله على أجهزتك الخاصة.
الحكم
إن MiniCPM5-2B-DSpark وGemma 4 12B ليسا منافسَين في أي مواجهة مباشرة — بل هما فئتا وزن مختلفتان من الذكاء الاصطناعي المحلي تجمعهما خدعة مشتركة. اختر حزمة MiniCPM5-2B مع مسودتها DSpark عندما لا يستطيع جهازك استيعاب نموذج 12B وتريد نموذجًا نصيًا، مرخّصًا بموجب Apache-2.0، موجّهًا نحو الوكلاء، ويناسب ذاكرة الجهاز؛ فالمسودة تسريع مجاني واعد، لكن قِسها على نسخة SGLang الخاصة بك قبل أن تثق بها، لأن مردودها ما يزال غير مُقدَّر كميًا. اختر Gemma 4 12B عندما يتيح عتادك هامشًا من الأداء وتريد نموذجًا واحدًا متعدد الوسائط بنافذة سياق 256K وبنظام بيئي يدعمه. والسؤال ليس أيّ النموذجين أكثر ذكاءً — بل أيّهما يستطيع سيليكون جهازك تغذيته فعليًا.
