بطاقة عنوان رئيسية مُولّدة تقرأ 'Solar Mini 4 vs Granite 4.2 3B' مع العنوان الفرعي 'نموذج تتصل به ونقطة تفتيش تقوم بتنزيلها' وشارتين تقرآن 'نحو 3 مليارات معامل نشطة لكل رمز، لكل منهما' و'أحدهما يُحاسب لكل رمز، والآخر لكل واط'.
Guides & Insights

Solar Mini 4 مقابل Granite 4.2 3B: نموذج تستدعيه ونقطة تفتيش تُنزّلها

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ضع Solar Mini 4 إلى جانب Granite 4.2 3B، والرقم المثير للاهتمام ليس فجوة الاختبارات القياسية. بل إن Granite 4.2 3B، نموذج IBM للاستدلال المرخّص بموجب Apache-2.0 والصادر في 25 أغسطس 2026، سيعمل على حاسوب محمول هذه الليلة مجانًا، بينما Solar Mini 4، نموذج Upstage الاحتكاري الصادر في 22 سبتمبر 2026، لن يعمل على أي جهاز تملكه، ويتقاضى $0.10 لكل مليون رمز إدخال و$0.40 لكل مليون رمز إخراج للإجابة عن سؤال. ينشّط كلاهما نحو ثلاثة مليارات معامل من الحوسبة لكل رمز. أحدهما ملف، والآخر عدّاد.

هذا الفرق يحدد تقريبًا كل شيء آخر في هذه المقارنة، بما في ذلك أي المعايير تستحق حتى أن توضع جنبًا إلى جنب. خضع Granite 4.2 3B لتقييم مستقل قبل وقت طويل من خضوع Solar Mini 4 له — يمنحه Artificial Analysis درجة 9 على Intelligence Index v4.3.2، من نفس مجموعة التقييم ونفس المؤسسة التي تمنح Solar Mini 4 درجة 24. مما يعني أن الفارق البالغ خمس عشرة نقطة هنا مبني على أساس متين على نحو غير معتاد: فهو مختبر واحد، ومنهجية واحدة، ونموذجان لم يكن على أحد أن يقبلهما إيمانًا أعمى.

المواصفة، فيما يتعلق بالأبعاد التي تفصل بينها فعليًا

• البنية — Solar Mini 4 هو مزيج متناثر من الخبراء: 35B إجمالي المعلمات، و3B نشطة لكل رمز، وفقًا لـ Upstage. أما Granite 4.2 3B فهو كثيف، بنحو 3B معلمة مع ما يقرب من 4B إجمالًا بما في ذلك التضمينات وفقًا للبيانات الوصفية لـ safetensors. ميزانية التنشيط ذاتها، وطريقتان مختلفتان لإنفاقها.

• الأوزان — نموذج Solar Mini 4 مملوك ومغلق المصدر. أما Granite 4.2 3B فيُوزَّع بموجب ترخيص Apache 2.0 مع وصفة تدريب موثّقة تصل إلى نسب البيانات نفسها.

• السياق — توثّق Upstage 512 ألف توكن مع مخرجات تصل إلى 128 ألفًا؛ وتُدرج Artificial Analysis 1.0 مليون للنموذج نفسه، لذا تعامل مع الحد الأقصى على أنه غير محسوم. يعمل Granite 4.2 3B بـ 131,072 توكن أصليًا، ويُمدّ إلى 512 ألف عبر مرحلة خامسة من التدريب المسبق.

• السعر — Solar Mini 4 بسعر 0.10 دولار / 0.01 دولار للمخزّن مؤقتًا / 0.40 دولار لكل مليون رمز، بخصم 50% حاليًا حتى 22 أكتوبر 2026. لا يمتلك Granite 4.2 3B بطاقة أسعار من المورّد لأنه لا يوجد شيء لاستئجاره؛ نقاط النهاية المستضافة التي تتعقّبها Artificial Analysis تسعّره بنحو 0.03 / 0.12 دولار، والاستضافة الذاتية تكلفتها الكهرباء.

• مؤشر الذكاء — 24 لـ Solar Mini 4، و9 لـ Granite 4.2 3B، وكلاهما من Artificial Analysis v4.3.2.

• السرعة — 204 رمز إخراج في الثانية لـ Solar Mini 4 و223 لـ Granite 4.2 3B، وكلاهما قيس بواسطة المختبر نفسه، مع زمن الوصول إلى أول جزء 1.5 ث و0.5 ث على التوالي. النموذج الكثيف هو الأسرع في كلا القياسين.

مِمَّ يتكوَّن في الواقع فارق الخمس عشرة نقطة

A two-column comparison scoreboard titled 'Solar Mini 4 vs Granite 4.2 3B', subtitled 'Same activation budget, two different ways of spending it'. Solar Mini 4: parameters 35B total / 3B active; weights proprietary, no download; context 512K claimed and 1.05M listed; price per 1M $0.10 / $0.01 / $0.40; Intelligence Index 24.05; cost per index task $0.36; output per task 88,300 tokens at 204 tok/s; non-hallucination 64.2%. Granite 4.2 3B: parameters 3.66B dense; weights Apache 2.0 on Hugging Face; context 131,072 native; price per 1M about $0.03 / $0.12 hosted; Intelligence Index 9.06; cost per index task $0.006; output per task 18,600 tokens at 223 tok/s; non-hallucination 73.7%.

التقييمات الفردية تحكي قصة أقل إطراءً من العنوان الرئيسي بالنسبة إلى Granite 4.2 3B، وقصة أكثر تعقيدًا بالنسبة إلى Solar Mini 4. على معيار AA-LCR v1.1، المعيار المرجعي لاستدلال السياق الطويل، يسجّل Solar Mini 4 نسبة 83% ويسجّل Granite 4.2 3B نسبة 24%. هذا التقييم الواحد يستحوذ على نصيب هائل من الفارق في المؤشر، وهو ليس مصادفة ناجمة عن الحجم — بل هو ما تحصل عليه مقابل سياق يتراوح بين 512K و1M من الرموز (tokens) والتدريب اللازم لاستخدامه. تبلغ نافذة Granite 4.2 3B حدها الأقصى عند 131K بشكل أصلي؛ ومرحلة 512K الموسّعة موجودة بالفعل، لكن النموذج لم يُضبط ليجري الاستدلال عبره على النحو الذي ضُبط به Solar Mini 4.

في المعرفة العامة تضيق الفجوة ثم تنقلب في طبيعتها. يسجل Granite 4.2 3B نسبة 55.9% في GPQA، بينما لا يملك Solar Mini 4 أي رقم لـ GPQA على الإطلاق؛ وفي Humanity's Last Exam يبلغ الرقمان 6.6% و25.8% على التوالي، وهي المقارنة الأكثر مباشرة وتلك التي يتوقعها فارق الحجم. وما لا يفعله Granite 4.2 3B، وفقًا لـ Artificial Analysis، هو الاختلاق: فمعدل عدم الهلوسة في AA-Omniscience لديه 73.7%، وهو أعلى من 64.2% لدى Solar Mini 4. النموذج الأصغر أقل احتمالًا لاختلاق إجابة لا يملكها.

البرمجة الوكيلية هي المجال الذي يخفق فيه كلا النموذجين، والمجال الذي تهم فيه قراءة الأرقام. يسجل Solar Mini 4 نسبة 1% في Terminal-Bench 4.0 و22.3% في AutomationBench-AA. ويسجل Granite 4.2 3B نسبة 0% في Terminal-Bench 4.0، و13.9% في Terminal-Bench 2.1 الأقدم، و5.6% في τ³-Banking. لا يُعد أي من النموذجين الأداة الصحيحة للعمل المستقل في الطرفية. حصل الطرازان 8B و30B من عائلة Granite 4.2 على التعلم المعزز الوكيلي من IBM، وهما يحملان نتائج SWE-Bench وTerminal-Bench؛ أما 3B فقد تخطى كتلة التدريب تلك صراحةً، ونموذج Upstage مسعّر لأجل الاسترجاع والهيكلة وتطبيق السياسات لا لتشغيل shell.

حيث لا يزال Granite 4.2 3B هو الإجابة الصحيحة

سبعة وثلث جيجابايت من الأوزان بصيغة bfloat16، وأقل من أربعة جيجابايت عند تكميم عملي، ورخصة Apache 2.0 تتيح لك ضبطه بدقة على بياناتك الخاصة وإطلاق النتيجة دون سؤال أي أحد. طالب يملك بطاقة رسومات استهلاكية واحدة، ومستشفى لا يمكنه إرسال نصوص المرضى إلى طرف ثالث، ومنتج يحتاج إلى العمل على متن طائرة أو في قبو مصنع، وفريق يريد امتلاك نموذج بدلًا من استئجار نقطة نهاية — كل حالة من هذه الحالات تختار Granite 4.2 3B ولا تنظر إلى الوراء. يعمل المحرك عبر vLLM وSGLang وTransformers وGGUF، ويُدرج Ollama إصدار granite4.2:3b.

أرقامه التي أبلغ عنها المورّد تستحق الحذر المعتاد. تدّعي بطاقة IBM تحقيق 78.33 في AIME 2025، و66.67 في HMMT فبراير 2025، و69.71 في LiveCodeBench v6 — وكلها لم يُعِد إنتاجها أي طرف ثالث، وبالنسبة لنموذج كثيف بحجم 3B فإن رقم AIME يقع بعيدًا فوق النطاق التاريخي. مؤشر Artificial Analysis البالغ 9 يصنّف النموذج بأنه مفيد حقًا وليس قريبًا بأي حال من الطليعة، وهو إشارة أكثر موثوقية تحديدًا لأن IBM لم تنشره.

حيث تكون Solar Mini 4 هي الإجابة الصحيحة

أي شيء يكون فيه العمل مستندًا طويلًا، أو استخراجًا منظمًا متكررًا، أو سياسة يجب تطبيقها باستمرار وعلى نطاق واسع — وحيث يكون زمن استجابة قدره تسعون ثانية مقبولًا. إن ملامح Solar Mini 4 هي ملامح متخصص: 83% في الاستدلال طويل السياق، و48% في البرمجة العلمية، و64% في عدم اختلاق المعلومات، وميل موثّق إلى الامتناع بدلًا من التخمين. كما يتحدث الكورية بوصفها لغة من الدرجة الأولى إلى جانب الإنجليزية واليابانية، وهو أمر ليس هامشًا بالنسبة للنشر في السوق الكورية.

ما لا ينبغي للمشترين فعله هو مقارنة سعري التوكنين والاستنتاج أن Solar Mini 4 أغلى بثلاث مرات. قاست Artificial Analysis تكلفة Solar Mini 4 عند 0.36 دولار لكل مهمة مكتملة في Intelligence Index — وعلى المجموعة نفسها، Granite 4.2 3B عند 0.006 دولار. هذا عامل يبلغ ستين، مدفوعًا بالأمور نفسها التي تضخم تكلفة Solar Mini 4 مقابل GPT-6 Luna (max): 88,300 توكن إخراج لكل مهمة مقابل 18,600 لدى Granite، وهيكل تكلفة تشكل فيه كتابات ذاكرة التخزين المؤقت للمطالبات 0.30 دولار من أصل 0.36 دولار لدى Solar Mini 4 مقابل 0.0006 دولار من أصل 0.006 دولار لدى Granite. سعر إخراج رخيص على نموذج مفرط في الإسهاب ليس مهمة رخيصة.

A screenshot of the Hugging Face model card for ibm-granite/granite-4.2-3b showing the model summary table: developer Granite Team at IBM, a decoder-only dense transformer, base model Granite-4.1-3B-Base, 3B parameters, context length natively 128K with long-context extension to 512K, bfloat16 precision, twelve tested languages including Korean, a built-in chain-of-thought thinking mode, and an Apache-2.0 licence, with the model tree showing three finetunes and the base model ibm-granite/granite-4.1-3b-base.

لا يوجد أي من النموذجين على OrcaRouter — فنحن لا نوجّه Granite ولا Upstage — لذا إن أردت Granite 4.2 3B فهو يأتي من Hugging Face، وإن أردت Solar Mini 4 فهو يأتي من واجهة Upstage البرمجية الخاصة بها ومنصات الطرف الثالث. لكن نمط النموذجين الذي توحي به هذه المقارنة هو ما صُمِّمت الموجِّهات من أجله، وهو السبب وراء أن OrcaRouter يضع أكثر من 200 نموذج خلف مفتاح واحد بهامش 0% فوق سعر قائمة المزوِّد: شغِّل أعمال المستندات الطويلة واللغة الكورية على أي نموذج يستحق تكلفته فعلاً، وأبقِ خطوات الاستخراج الحتمية على شيء تستضيفه أنت، ودع التوجيه والتحويل عند الفشل ينقلان الطلب بينهما لكل استدعاء لا لكل عقد.

A screenshot of the Artificial Analysis comparison page headed 'Granite 4.2 3B Intelligence, Performance & Price Analysis', marked as an IBM open-weights model released August 2026, with an overall speed of 223.4 output tokens per second, a 131k-token context window, and the summary line that Granite 4.2 3B scores 9 on the Artificial Analysis Intelligence Index, placing it above average among comparable models with a median of 6.

ملاحظة أخيرة بشأن الأرقام أعلاه. كل رقم يخص Solar Mini 4 ويأتي من Artificial Analysis هو قياس مستقل؛ وكل رقم يخص Granite 4.2 3B من بطاقة نموذج IBM هو ادعاء من المورّد لم يُعِد إنتاجه أي طرف ثالث. درجتا مؤشر Artificial Analysis البالغتان 24 و9 هما الرقمان الوحيدان هنا اللذان أنتجهما المختبر نفسه في الظروف نفسها — وهما الرقمان اللذان ينبغي بناء القرار عليهما.