بطاقة عنوان رئيسية للمقارنة 'MiniCPM5-2B-DSpark vs Gemma 4 12B' مع العنوان الفرعي 'طريقتان للمسودة، وفئتا وزن للذكاء الاصطناعي المحلي'، تعرض شريحة صغيرة مكتوب عليها '324M draft' تغذي كتلة مكتوب عليها '2.5B on-device target' على اليسار ولوحة أوسع مكتوب عليها '11.95B multimodal generalist' على اليمين، مع خط تدفق لرقاقات الرموز في الأعلى مكتوب عليه 'draft then verify'، وشعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

MiniCPM5-2B-DSpark مقابل Gemma 4 12B: طريقتان للصياغة، وفئتان من حيث الوزن للذكاء الاصطناعي المحلي

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

أسرع طريقة لترى لماذا يستحق MiniCPM5-2B-DSpark وGemma 4 12B أن يكونا في الصفحة نفسها هي أن تتجاهل حجميهما للحظة وتراقب كيف يكتب كلٌّ منهما جملة. كلاهما يخدع ناقل الذاكرة باستخدام مُصَوِّغ (drafter): نموذج صغير يقترح عدة رموز (tokens) تالية دفعةً واحدة، ثم يتحقق النموذج الحقيقي من الكتلة كلها في مرور واحد، فيدفع السيليكون تكلفة تحميل الأوزان مرةً واحدة لكل كتلة بدلاً من مرة لكل رمز. MiniCPM5-2B-DSpark هو المُصَوِّغ الذي نشرته OpenBMB بهدوء على Hugging Face في 6 سبتمبر 2026 — نقطة تحقق مرافقة مع 323.8M معاملات تسرّع MiniCPM5-2B، النموذج المحلي الكثيف ذا 2.52B معاملات الذي أعلنت عنه ModelBest في WAIC في 19 يوليو 2026. أما Gemma 4 12B فهو نموذج Google العام متعدد الوسائط ذو 11.95B معاملات وبدون مُرمِّز، أُطلق في 3 يونيو 2026 مع مُصَوِّغات مدمجة خاصة به وسياق يبلغ 256K. أحدهما يبيع المُصَوِّغ كنقطة تحقق منفصلة بترخيص Apache-2.0 تُحمّلها بنفسك؛ والآخر يُخفي حيلة مشابهة داخل نموذج كبير واحد تشغّله مباشرةً.

الملاحظة الصادقة التي تحسم هيئة هذه المقالة: نموذج MiniCPM5-2B-DSpark ليس نموذجًا يمكن توجيه الأوامر إليه؛ فهو لا يملك مُحوِّلًا رمزيًا (tokenizer)، ولا قالب محادثة، ولا مخرجاتٍ مستقلة — بل مجرد بطاقة تسرد ملف model.safetensors وإعدادات config وملف README. وهو مجرد إضافةٍ إلى طبقة الخدمة تستهدف فئة 2B؛ أما المقارنة الحقيقية التي يجريها القارئ فتقع بين فئتين من أوزان الذكاء الاصطناعي المحلي: فئة 2B بحجم الهاتف التي تولّد رموزها، في مقابل فئة 12B العامة بذاكرة 16 غيغابايت التي تولّد رموزها. وكل ما يلي ذلك ليس سوى تجسيدٍ ملموس لهذا القرار.

ما هو MiniCPM5-2B-DSpark في الواقع

بطاقة النموذج هي الواجهة العامة الكاملة للإصدار؛ لذا فهي كل ما يمكن معرفته عنه. MiniCPM5-2B-DSpark هو نقطة فحص مسودّة (draft checkpoint) من DSpark: خمس طبقات انتباه كامل، وعدد معاملاته 323,776,001، وانتباه مجمّع الاستعلامات (grouped-query attention) بعدد 16 رأس استعلام ورأسَي مفتاح-قيمة (KV)، وحجم كتلة يساوي سبعة — إذ يقترح حتى سبعة توكنات مرشّحة في كل تمرير أمامي ليتحقق منها النموذج الهدف MiniCPM5-2B. يُصرِّح ملف الإعداد (config) بمعمارية Qwen3DSparkModel مع خريطة تلقائية (auto-map) إلى DSparkDraftModel، ويأتي مرفقًا برأس الثقة ورأس ماركوف المنبثقَين من طريقة DSpark (arXiv 2607.05147، ورقة D​eepSeek الصادرة في يوليو 2026)، وكلاهما ما يزال مفعَّلًا — أي المُتحقِّق المدرِك للحمل الذي يقرر متى لا تستحق لاحقةٌ ما أن تُفحص. وقد دُرِّب على ستِّ دورات (epochs) وعلى 7.05 مليار توكن من الاستجابات التي ولّدها MiniCPM5-2B عبر مطالبات عامة ورياضية وبرمجية.

A screenshot of the Hugging Face model page for openbmb/MiniCPM5-2B-DSpark (captured September 7, 2026) showing the model title, the description 'a DSpark draft checkpoint trained for exact pairing with MiniCPM5-2B and its tokenizer', and the Model Specification table listing Target model MiniCPM5-2B, five draft layers, 323,776,001 draft parameters, and a block size of seven.

بطاقة openbmb/MiniCPM5-2B-DSpark أعلاه هي كامل ما تم إصداره: بطاقة النموذج، والإعدادات، وملف Safetensors واحد، ولا إعلان، ولا تدوينة، ولا بيان صحفي — إصدار أوزان صامت عمره يوم واحد وقت كتابة هذا النص.

ما لا تحتويه البطاقة لا يقل أهمية عمّا تحتويه. إنها تبلغ عن طول القبول — في تقييم المستودع نفسه، إجمالي 5.52 رمزًا مقبولًا لكل خطوة تحقق عند فك التشفير الجشع، مع 6.05 في الرياضيات و6.11 في البرمجة من أصل سقف سبعة رموز — لكنها لا تنشر أي تسريع لوقت الساعة الفعلي، ولا رقمًا للرموز في الثانية، ولا معيارًا مستقلًا. محرك DSPARK من SGLang هو مسار الخدمة الموثّق، مع تحميل المسودة بجوار هدف MiniCPM5-2B. بعبارة أخرى: جودة المسودة مُحدَّدة كميًا، لكن عائدها لم يُحدَّد بعد، وأي شخص يتبنّاها يجب أن يقيس قبل أن يصدّق.

ما الذي تقدمه Gemma 4 12B للجانب الآخر

Gemma 4 12B هو الابن الأوسط في عائلة Gemma 4 من Google، ويقع على نقطة مختلفة كليًا من منحنى الذكاء الاصطناعي المحلي. إنه نموذج واحد كثيف بعدد 11.95 مليار معامل، يقبل النص والصورة والصوت والفيديو كمدخلات دون أي مشفّرات منفصلة، وينفّذ استدعاءات الأدوات مباشرة دون الحاجة إلى إعدادات، ويجمع بين سياق أصلي بطول 256K وبين مسوّدات التنبؤ متعدد الرموز التي تؤدي الحيلة ذاتها لناقل الذاكرة داخليًا — لكن من داخل نقطة الحفظ، فلا يوجد أي شيء إضافي لتنزيله أو توصيله. وهو مرخّص بموجب Apache 2.0، ويعمل عمليًا على حاسوب محمول بذاكرة 16GB، وقد وصل بالمنظومة الكاملة من Google: تقييمات الإطلاق، وبطاقات النماذج لكل من إصداري القاعدة والتعليمات، ودعمًا للنظام البيئي في Model Garden وLM Studio وOllama. ولديه أشهر من النشر المجتمعي خلفه، وهو ما لا تملكه مسودة MiniCPM التي لم يتجاوز عمرها يومًا واحدًا.

A screenshot of the Hugging Face model page for google/gemma-4-12B-it (captured August 31, 2026, reused from a published sibling) showing the model title, the Any-to-Any and image-text-to-text tags, the Transformers and Safetensors libraries, and the Apache 2.0 license.

بطاقة نموذج Google لـ Gemma 4 12B أعلاه هي التباين في إطار واحد: نموذج عام متعدد الوسائط ناضج، يكون مُعدّوه سمةً من سمات الإصدار، وليسوا مستودعًا منفصلًا.

المواصفات، موسومة بصدق

اقرأ هذه الأرقام مع وضع المصدر في الاعتبار: أرقام MiniCPM5-2B هي ادعاءات من بطاقة ModelBest ولم يتم التحقق منها؛ أما أرقام Gemma 4 12B فمصدرها Google نفسها، وقد طال استخدامها من قبل المجتمع.

• ما الذي تشغّله — MiniCPM5-2B-DSpark: نموذج مسودة بحجم 324M لا يعمل إلا إلى جانب MiniCPM5-2B (كثيف بـ2.52B و42 طبقة). أمّا Gemma 4 12B: فهو نموذج كثيف مستقل واحد بحجم 11.95B.

• السياق — MiniCPM5-2B هدفه 128K أصليًا، وGemma 4 12B هدفه 256K أصليًا.

• النمط — مجموعة MiniCPM5-2B: نص فقط. Gemma 4 12B: إدخال نص وصورة وصوت وفيديو، بدون مرمّز.

• الصياغة — MiniCPM5-2B-DSpark: مسودة DSpark خارجية، سبعة توكنات لكل تمريرة، عبر محرك SGLang DSPARK. أما Gemma 4 12B: فيستخدم مسوّدات داخلية قائمة على التنبؤ متعدد التوكنات، ولا يتطلب تثبيت أي شيء.

• البصمة — يبلغ حجم MiniCPM5-2B حوالي 5 جيجابايت بصيغة BF16 بالإضافة إلى ملف مسودة بحجم ~650 ميجابايت؛ بينما يبلغ حجم Gemma 4 12B حوالي 18 جيجابايت بصيغة BF16، وهو عملي على أجهزة من فئة 16 جيجابايت عند تكميمه.

• الأدلة — MiniCPM5-2B-DSpark: أرقام طول القبول في المستودع فقط، عمرها يوم واحد. Gemma 4 12B: تقييمات الإطلاق إضافة إلى أشهر من النشر المجتمعي.

A two-column scoreboard for MiniCPM5-2B-DSpark vs Gemma 4 12B: left column MiniCPM5-2B-DSpark with 'What you run: 324M draft for a 2.52B target', text-only modality, 128K target window, external DSpark drafting at 7 tokens per pass, ~5GB target plus 650MB draft footprint, and an unannounced Hugging Face release September 6 2026; right column Gemma 4 12B with a standalone 11.95B model, text/image/audio/video input, 256K native context, internal MTP drafters, ~18GB BF16, and Google's June 3 2026 launch, with a footer reading 'MiniCPM figures from the model card, unreproduced; Gemma specs per Google' and the OrcaRouter logo in the bottom-right corner.

لوحة النتائج أعلاه هي نفس الصورة في ستة صفوف: يختلف العمودان في كل شيء تقريبًا باستثناء الاستراتيجية التي يستخدمها كلاهما للكتابة بسرعة.

أي فئة وزن تناسب السيليكون الذي لديك فعليًا؟

نظرًا لأن MiniCPM5-2B-DSpark ليس نموذجًا بحد ذاته، فإن المقارنة الجوهرية تكمن في فئة أوزان النموذج المستهدف مقابل فئة أوزان Gemma 4 12B — وهذه المقارنة هي في الغالب مسألة عتاد. فالهاتف، أو لوحة القيادة الذكية، أو صندوق الحوسبة الطرفية الصغير الذي يملك بضعة غيغابايتات من الذاكرة العشوائية لا يمكنه تشغيل نموذج بحجم 11.95B بسرعة مفيدة؛ فالناقل الذاكرتي (Memory Bus) هو بالضبط عنق الزجاجة الذي سيخنقه. هذا هو العالم الذي بُني عليه مكدس MiniCPM5-2B — نموذج كثيف (Dense) بحجم 2B تتناسب أوزانه مع الذاكرة المحلية للجهاز، مع نموذج مساعد (Draft) مُلحَق به لاستعادة جزء من معدل الرموز في الثانية (Tokens-Per-Second) الذي تتنازل عنه النماذج الكثيفة الصغيرة. إن فك الترميز التخميني (Speculative Decoding) يكون في أقصى فعاليته تحديدًا في هذا النظام الكثيف المقيَّد بناقل الذاكرة، ولهذا السبب يُعد النموذج المساعد الجزء المثير للاهتمام في هذا الإصدار بدلًا من كونه مجرد حيلة تسويقية.

Gemma 4 12B هو الجواب بوزن فئة أعلى. إذا كان جهازك يحتوي على 16GB أو أكثر — كمبيوتر محمول، محطة عمل، خادم طرفي قوي — فبإمكانك حمل النموذج العام متعدد الوسائط، وتكسب ثلاثة أمور لا يمكن لمجموعة 2B تقديمها: إدخال الصور والصوت والفيديو دون مشفرات أو خط أنابيب ثانٍ؛ نافذة 256K للعمل على نطاق المستودعات أو على نطاق المستندات؛ ونضجًا لا تمتلكه نقطة تفتيش مسودة لم يتجاوز عمرها يومًا واحدًا. أنت تتخلى عن القدرة على التشغيل على أصغر الأجهزة، وتدفع ما يقارب ثلاثة أضعاف بصمة الذاكرة.

واقع التوجيه لكليهما

لا يوجد أي من طرفي هذه المقارنة في كتالوج مستضاف اليوم، بما في ذلك OrcaRouter. MiniCPM5-2B-DSpark هو ملحق خدمة ذاتية الاستضافة بحكم التعريف — أنت تشغّل حزمة SGLang بنفسك، والمسودة موجودة فقط في نشرك المحلي. Gemma 4 12B مفتوح الأوزان، لذا يمكنك تقديمه أو استخدامه حيثما يتوفر لك بالفعل. هذا هو بالضبط الموقف الذي تبرر فيه طبقة التوجيه دورها كشبكة أمان وليس كآلية توصيل: عندما تجرّب بناءً أوليًا جديدًا ضد عبء عمل تقدمه بالفعل، فإن توجيه مسار الاختبار عبر واجهة برمجة تطبيقات واحدة مع تجاوز تلقائي للفشل يعني أن البنية غير المثبتة قد تتوقف دون أن تعطّل الإنتاج، وأسعار مقدمي الخدمة المحيطة بها تمر بهامش ربح 0%، لذا فإن أي تغيير في السعر على أي نموذج مستضاف تقارنه به سيظهر في نفس اليوم. أما بالنسبة للمقارنة نفسها، فالخطة الصادقة لكلا النموذجين هي نفسها: أنت تستضيف بنفسك، لذا فإن المعيار الذي يهم هو الذي تشغّله على أجهزتك الخاصة.

الحكم

إن MiniCPM5-2B-DSpark وGemma 4 12B ليسا منافسَين في أي مواجهة مباشرة — بل هما فئتا وزن مختلفتان من الذكاء الاصطناعي المحلي تجمعهما خدعة مشتركة. اختر حزمة MiniCPM5-2B مع مسودتها DSpark عندما لا يستطيع جهازك استيعاب نموذج 12B وتريد نموذجًا نصيًا، مرخّصًا بموجب Apache-2.0، موجّهًا نحو الوكلاء، ويناسب ذاكرة الجهاز؛ فالمسودة تسريع مجاني واعد، لكن قِسها على نسخة SGLang الخاصة بك قبل أن تثق بها، لأن مردودها ما يزال غير مُقدَّر كميًا. اختر Gemma 4 12B عندما يتيح عتادك هامشًا من الأداء وتريد نموذجًا واحدًا متعدد الوسائط بنافذة سياق 256K وبنظام بيئي يدعمه. والسؤال ليس أيّ النموذجين أكثر ذكاءً — بل أيّهما يستطيع سيليكون جهازك تغذيته فعليًا.