
Solar Mini 4 مقابل Granite 4.2 3B: نموذج تستدعيه ونقطة تفتيش تُنزّلها
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 لكل مليون رمز
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 لكل مليون رمز · 159 tok/s
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 220 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
ضع Solar Mini 4 إلى جانب Granite 4.2 3B، والرقم المثير للاهتمام ليس فجوة الاختبارات القياسية. بل إن Granite 4.2 3B، نموذج IBM للاستدلال المرخّص بموجب Apache-2.0 والصادر في 25 أغسطس 2026، سيعمل على حاسوب محمول هذه الليلة مجانًا، بينما Solar Mini 4، نموذج Upstage الاحتكاري الصادر في 22 سبتمبر 2026، لن يعمل على أي جهاز تملكه، ويتقاضى $0.10 لكل مليون رمز إدخال و$0.40 لكل مليون رمز إخراج للإجابة عن سؤال. ينشّط كلاهما نحو ثلاثة مليارات معامل من الحوسبة لكل رمز. أحدهما ملف، والآخر عدّاد.
هذا الفرق يحدد تقريبًا كل شيء آخر في هذه المقارنة، بما في ذلك أي المعايير تستحق حتى أن توضع جنبًا إلى جنب. خضع Granite 4.2 3B لتقييم مستقل قبل وقت طويل من خضوع Solar Mini 4 له — يمنحه Artificial Analysis درجة 9 على Intelligence Index v4.3.2، من نفس مجموعة التقييم ونفس المؤسسة التي تمنح Solar Mini 4 درجة 24. مما يعني أن الفارق البالغ خمس عشرة نقطة هنا مبني على أساس متين على نحو غير معتاد: فهو مختبر واحد، ومنهجية واحدة، ونموذجان لم يكن على أحد أن يقبلهما إيمانًا أعمى.
المواصفة، فيما يتعلق بالأبعاد التي تفصل بينها فعليًا
• البنية — Solar Mini 4 هو مزيج متناثر من الخبراء: 35B إجمالي المعلمات، و3B نشطة لكل رمز، وفقًا لـ Upstage. أما Granite 4.2 3B فهو كثيف، بنحو 3B معلمة مع ما يقرب من 4B إجمالًا بما في ذلك التضمينات وفقًا للبيانات الوصفية لـ safetensors. ميزانية التنشيط ذاتها، وطريقتان مختلفتان لإنفاقها.
• الأوزان — نموذج Solar Mini 4 مملوك ومغلق المصدر. أما Granite 4.2 3B فيُوزَّع بموجب ترخيص Apache 2.0 مع وصفة تدريب موثّقة تصل إلى نسب البيانات نفسها.
• السياق — توثّق Upstage 512 ألف توكن مع مخرجات تصل إلى 128 ألفًا؛ وتُدرج Artificial Analysis 1.0 مليون للنموذج نفسه، لذا تعامل مع الحد الأقصى على أنه غير محسوم. يعمل Granite 4.2 3B بـ 131,072 توكن أصليًا، ويُمدّ إلى 512 ألف عبر مرحلة خامسة من التدريب المسبق.
• السعر — Solar Mini 4 بسعر 0.10 دولار / 0.01 دولار للمخزّن مؤقتًا / 0.40 دولار لكل مليون رمز، بخصم 50% حاليًا حتى 22 أكتوبر 2026. لا يمتلك Granite 4.2 3B بطاقة أسعار من المورّد لأنه لا يوجد شيء لاستئجاره؛ نقاط النهاية المستضافة التي تتعقّبها Artificial Analysis تسعّره بنحو 0.03 / 0.12 دولار، والاستضافة الذاتية تكلفتها الكهرباء.
• مؤشر الذكاء — 24 لـ Solar Mini 4، و9 لـ Granite 4.2 3B، وكلاهما من Artificial Analysis v4.3.2.
• السرعة — 204 رمز إخراج في الثانية لـ Solar Mini 4 و223 لـ Granite 4.2 3B، وكلاهما قيس بواسطة المختبر نفسه، مع زمن الوصول إلى أول جزء 1.5 ث و0.5 ث على التوالي. النموذج الكثيف هو الأسرع في كلا القياسين.
مِمَّ يتكوَّن في الواقع فارق الخمس عشرة نقطة

التقييمات الفردية تحكي قصة أقل إطراءً من العنوان الرئيسي بالنسبة إلى Granite 4.2 3B، وقصة أكثر تعقيدًا بالنسبة إلى Solar Mini 4. على معيار AA-LCR v1.1، المعيار المرجعي لاستدلال السياق الطويل، يسجّل Solar Mini 4 نسبة 83% ويسجّل Granite 4.2 3B نسبة 24%. هذا التقييم الواحد يستحوذ على نصيب هائل من الفارق في المؤشر، وهو ليس مصادفة ناجمة عن الحجم — بل هو ما تحصل عليه مقابل سياق يتراوح بين 512K و1M من الرموز (tokens) والتدريب اللازم لاستخدامه. تبلغ نافذة Granite 4.2 3B حدها الأقصى عند 131K بشكل أصلي؛ ومرحلة 512K الموسّعة موجودة بالفعل، لكن النموذج لم يُضبط ليجري الاستدلال عبره على النحو الذي ضُبط به Solar Mini 4.
في المعرفة العامة تضيق الفجوة ثم تنقلب في طبيعتها. يسجل Granite 4.2 3B نسبة 55.9% في GPQA، بينما لا يملك Solar Mini 4 أي رقم لـ GPQA على الإطلاق؛ وفي Humanity's Last Exam يبلغ الرقمان 6.6% و25.8% على التوالي، وهي المقارنة الأكثر مباشرة وتلك التي يتوقعها فارق الحجم. وما لا يفعله Granite 4.2 3B، وفقًا لـ Artificial Analysis، هو الاختلاق: فمعدل عدم الهلوسة في AA-Omniscience لديه 73.7%، وهو أعلى من 64.2% لدى Solar Mini 4. النموذج الأصغر أقل احتمالًا لاختلاق إجابة لا يملكها.
البرمجة الوكيلية هي المجال الذي يخفق فيه كلا النموذجين، والمجال الذي تهم فيه قراءة الأرقام. يسجل Solar Mini 4 نسبة 1% في Terminal-Bench 4.0 و22.3% في AutomationBench-AA. ويسجل Granite 4.2 3B نسبة 0% في Terminal-Bench 4.0، و13.9% في Terminal-Bench 2.1 الأقدم، و5.6% في τ³-Banking. لا يُعد أي من النموذجين الأداة الصحيحة للعمل المستقل في الطرفية. حصل الطرازان 8B و30B من عائلة Granite 4.2 على التعلم المعزز الوكيلي من IBM، وهما يحملان نتائج SWE-Bench وTerminal-Bench؛ أما 3B فقد تخطى كتلة التدريب تلك صراحةً، ونموذج Upstage مسعّر لأجل الاسترجاع والهيكلة وتطبيق السياسات لا لتشغيل shell.
حيث لا يزال Granite 4.2 3B هو الإجابة الصحيحة
سبعة وثلث جيجابايت من الأوزان بصيغة bfloat16، وأقل من أربعة جيجابايت عند تكميم عملي، ورخصة Apache 2.0 تتيح لك ضبطه بدقة على بياناتك الخاصة وإطلاق النتيجة دون سؤال أي أحد. طالب يملك بطاقة رسومات استهلاكية واحدة، ومستشفى لا يمكنه إرسال نصوص المرضى إلى طرف ثالث، ومنتج يحتاج إلى العمل على متن طائرة أو في قبو مصنع، وفريق يريد امتلاك نموذج بدلًا من استئجار نقطة نهاية — كل حالة من هذه الحالات تختار Granite 4.2 3B ولا تنظر إلى الوراء. يعمل المحرك عبر vLLM وSGLang وTransformers وGGUF، ويُدرج Ollama إصدار granite4.2:3b.
أرقامه التي أبلغ عنها المورّد تستحق الحذر المعتاد. تدّعي بطاقة IBM تحقيق 78.33 في AIME 2025، و66.67 في HMMT فبراير 2025، و69.71 في LiveCodeBench v6 — وكلها لم يُعِد إنتاجها أي طرف ثالث، وبالنسبة لنموذج كثيف بحجم 3B فإن رقم AIME يقع بعيدًا فوق النطاق التاريخي. مؤشر Artificial Analysis البالغ 9 يصنّف النموذج بأنه مفيد حقًا وليس قريبًا بأي حال من الطليعة، وهو إشارة أكثر موثوقية تحديدًا لأن IBM لم تنشره.
حيث تكون Solar Mini 4 هي الإجابة الصحيحة
أي شيء يكون فيه العمل مستندًا طويلًا، أو استخراجًا منظمًا متكررًا، أو سياسة يجب تطبيقها باستمرار وعلى نطاق واسع — وحيث يكون زمن استجابة قدره تسعون ثانية مقبولًا. إن ملامح Solar Mini 4 هي ملامح متخصص: 83% في الاستدلال طويل السياق، و48% في البرمجة العلمية، و64% في عدم اختلاق المعلومات، وميل موثّق إلى الامتناع بدلًا من التخمين. كما يتحدث الكورية بوصفها لغة من الدرجة الأولى إلى جانب الإنجليزية واليابانية، وهو أمر ليس هامشًا بالنسبة للنشر في السوق الكورية.
ما لا ينبغي للمشترين فعله هو مقارنة سعري التوكنين والاستنتاج أن Solar Mini 4 أغلى بثلاث مرات. قاست Artificial Analysis تكلفة Solar Mini 4 عند 0.36 دولار لكل مهمة مكتملة في Intelligence Index — وعلى المجموعة نفسها، Granite 4.2 3B عند 0.006 دولار. هذا عامل يبلغ ستين، مدفوعًا بالأمور نفسها التي تضخم تكلفة Solar Mini 4 مقابل GPT-6 Luna (max): 88,300 توكن إخراج لكل مهمة مقابل 18,600 لدى Granite، وهيكل تكلفة تشكل فيه كتابات ذاكرة التخزين المؤقت للمطالبات 0.30 دولار من أصل 0.36 دولار لدى Solar Mini 4 مقابل 0.0006 دولار من أصل 0.006 دولار لدى Granite. سعر إخراج رخيص على نموذج مفرط في الإسهاب ليس مهمة رخيصة.

لا يوجد أي من النموذجين على OrcaRouter — فنحن لا نوجّه Granite ولا Upstage — لذا إن أردت Granite 4.2 3B فهو يأتي من Hugging Face، وإن أردت Solar Mini 4 فهو يأتي من واجهة Upstage البرمجية الخاصة بها ومنصات الطرف الثالث. لكن نمط النموذجين الذي توحي به هذه المقارنة هو ما صُمِّمت الموجِّهات من أجله، وهو السبب وراء أن OrcaRouter يضع أكثر من 200 نموذج خلف مفتاح واحد بهامش 0% فوق سعر قائمة المزوِّد: شغِّل أعمال المستندات الطويلة واللغة الكورية على أي نموذج يستحق تكلفته فعلاً، وأبقِ خطوات الاستخراج الحتمية على شيء تستضيفه أنت، ودع التوجيه والتحويل عند الفشل ينقلان الطلب بينهما لكل استدعاء لا لكل عقد.

ملاحظة أخيرة بشأن الأرقام أعلاه. كل رقم يخص Solar Mini 4 ويأتي من Artificial Analysis هو قياس مستقل؛ وكل رقم يخص Granite 4.2 3B من بطاقة نموذج IBM هو ادعاء من المورّد لم يُعِد إنتاجه أي طرف ثالث. درجتا مؤشر Artificial Analysis البالغتان 24 و9 هما الرقمان الوحيدان هنا اللذان أنتجهما المختبر نفسه في الظروف نفسها — وهما الرقمان اللذان ينبغي بناء القرار عليهما.
