بطاقة عنوان تحمل «Kolibri مقابل Solar Mini 4» مع عنوان فرعي «نفس الميزانية النشطة 3B، رهانان مختلفان جدًا»، وسطران بحروف دقيقة يقرآن «Kolibri — 78.1B الإجمالي، أوزان Apache 2.0، مستضاف ذاتيًا» و«Solar Mini 4 — 35B الإجمالي، مغلق، واجهة برمجة تطبيقات مستضافة»، على خلفية بيضاء مع لمسات تدرج أزرق وسماوي ناعمة وشعار OrcaRouter في أسفل اليمين.
Guides & Insights

Kolibri مقابل Solar Mini 4: نفس ميزانية 3B النشطة، رهانان مختلفان تمامًا

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

صدر نموذجان يفصل بينهما سبعة عشر يومًا، وكلاهما مضبوط لاستهلاك نحو ثلاثة مليارات معامل نشط لكل رمز، ومع ذلك لا يكادان يكونان أكثر اختلافًا من حيث تبنّيهما فعليًا. كوليبري من Aleph Alpha هو 78.1 مليار معامل بأوزان Apache-2.0 تقوم بتنزيلها وتشغيلها بنفسك: لا توجد نقطة نهاية مستضافة، وحتى اليوم لا يوجد له أي تقييم مستقل في أي مكان. Solar Mini 4 من Upstage هو 35 مليار معامل لا يمكنك تنزيلها إطلاقًا — فهو موجود فقط كنقطة نهاية تُحاسَب حسب الاستخدام، ويحمل بالفعل مؤشر الذكاء Artificial Analysis Intelligence Index بقيمة 24.05. يخبرك عدد المعاملات النشطة بتكلفة تشغيل كل منهما. ولا يخبرك أي شيء آخر في ذلك الرقم بتكلفة البدء بالنسبة لك.

السبب في أن الإجماليين يتباعدان إلى هذا الحد — 78.1B مقابل 35B مع وجود جزء نشط شبه متطابق — هو أن كليهما تصميمات خليط الخبراء المتناثر، وقد اتخذ المختبران قرارين متعاكسين بشأن مقدار سعة الخبراء التي يجب إبقاؤها في الاحتياط. يضم Kolibri 384 خبيرًا ويوجّه كل توكن إلى خبير مشترك واحد بالإضافة إلى 6 منها. ويكشف Solar Mini 4 عن تقسيم 35B/3B ولا شيء عن عدد خبرائه. عندما يُروَّج لنموذجين بالاستناد إلى الرقم النشط نفسه، فإن إجمالي المعاملات، وليس الرقم النشط، هو ما يحدد فاتورة العتاد لديك — وهنا يبلغ الفرق 2.2× ضمن الميزانية الحسابية المعلنة نفسها.

ما هو كل واحد منها في الحقيقة

• إجمالي المعاملات — Kolibri 78.10B مقابل Solar Mini 4 35B

• المعاملات النشطة لكل رمز — Kolibri 3.46B مقابل Solar Mini 4 3B

• الأوزان — Kolibri Apache 2.0، أوزان كاملة على Hugging Face مقابل Solar Mini 4 مغلق؛ API فقط

• السياق — تم التحقق من 1,048,576 رمزًا لـ Kolibri مقابل 512K لـ Solar Mini 4 وفقًا لوثائق Upstage، و1,048,576 وفقًا لبطاقة نموذج Artificial Analysis

• الحد الأقصى للإخراج — لا يفرض المورّد حدًّا على Kolibri، مقابل 128,000 رمز لـ Solar Mini 4

• اللغات — Kolibri: الألمانية والإنجليزية مقابل Solar Mini 4: الإنجليزية والكورية واليابانية

• حد المعرفة — Kolibri 18 يونيو 2026 مقابل Solar Mini 4 فبراير 2026

• التسليم — Kolibri المُستضاف ذاتيًا (vLLM) مقابل Solar Mini 4 المُستضاف على Console وPlayground الخاصين بـ Upstage وداخل المنشأة

• تقييم مستقل — Kolibri لم يُنشر أي شيء مقابل Solar Mini 4 AA Intelligence Index 24.05

Kolibri: 78 مليار معامل، ولم يقم أحد خارج المختبر بتقييمه.

نشرت Aleph Alpha نموذج Kolibri في 3 أكتوبر 2026، عمدًا في يوم إعادة توحيد ألمانيا، بوصفه الأول في عائلة جديدة وخليفةً لـ Kolibri Origin. وتكشف بطاقة النموذج، على نحو غير معهود، عمّا دخل في تدريبه: 20 تريليون توكن في التدريب المسبق، و3.44 تريليون في التدريب المتوسط، و201 مليار في التدريب على السياق الطويل، وجرى ذلك عبر 768 من وحدات معالجة الرسومات B200 خلال 21 يومًا، مقابل نحو 6.4×10²³ FLOPs وحوالي 950 ميغاواط-ساعة. كما يتطوّع المورّد بالإفصاح عن عدد حالات الفشل — 38 انقطاعًا غير مخطط له، أي نحو واحد لكل 10,000 ساعة GPU — وهو رقم من النوع الذي تُغفله المختبرات عادةً.

Screenshot of Aleph Alpha's newsroom post “Kolibri Has Landed”, showing the 03/10/2026 release date, the line about releasing on the Day of German Reunification, and the architecture comparison table between Kolibri and Kolibri Origin.

البنية عبارة عن قصة MoE متناثرة أنيقة. خمسون طبقة بنسبة 4:1 من انتباه النافذة المنزلقة (نوافذ بحجم 512 رمزًا) إلى الانتباه العالمي، الذي لا يُفعَّل إلا في كل طبقة خامسة. أوزان FP8 مع تحجيم كتل 128×128 وذاكرة KV مؤقتة بتنسيق FP8. أما Kolibri Origin، للمقارنة، فقد استخدم 128 خبيرًا بتوجيه بعرض 8، وبُعد مخفي للخبير بعرض 768، وانتباهًا كاملًا في كل طبقة، على بيانات إنجليزية مقطوعة في سبتمبر 2024. وينتقل Kolibri إلى 384 خبيرًا بتوجيه بعرض 6 مع بُعد مخفي بعرض 512، ويرفع كلا حدَّي اللغة إلى 18 يونيو 2026.

إنّ خط الأنابيب الألماني هو الجزء الذي يصعب حقًا شراؤه من مكان آخر. درّبت Aleph Alpha مُرمِّز UniBPE خاصًا بها، وتُفيد بأن النص الألماني يبلغ 4.90 بايت لكل رمز، مقابل 4.35 لـ GPT-5، و4.17 لـ Qwen3.5، و4.13 لـ Gemini. هذا مُرمِّز يدّعي ضغطًا ألمانيًا أفضل من أي من النماذج الحدودية متعددة اللغات، وهو الآلية الملموسة وراء عرض النشر السيادي: عدد رموز أقل لكل مستند ألماني يعني رموزًا مفوترة أقل ونافذة فعالة أطول على العتاد نفسه.

كل رقم أداء موجود لـ Kolibri يأتي من بطاقة نموذج Aleph Alpha الخاصة، وينبغي قراءته على هذا النحو. يُظهر الجدول الذي أبلغ عنه المورّد أن Kolibri يحقق 75.5 إجمالًا في تقييمات الإنجليزية و70.8 في الألمانية، و84.3 في GPQA Diamond بالإنجليزية مقابل 81.3 بالألمانية، و21.5 في Humanity's Last Exam بالإنجليزية مقابل 15.9 بالألمانية، و66.4 في SWE-Bench Verified، و85.9 في LiveCodeBench v6، و68.3 في AA-LCR. هذه أرقام غير مدققة. لا توجد صفحة Artificial Analysis لـ Kolibri — رابط النموذج في المتتبِّع يُرجع خطأ 404 — لذا لم يُعَد إنتاج أي شيء في ذلك الجدول بشكل مستقل، والمقال الذي تقرأه لا يمكن أن يجعله أكثر موثوقية مما هو عليه.

ما تجعله البطاقة راسخًا هو قصة التقديم. الحد الأدنى من العتاد هو بطاقتا A100 80GB، أو بطاقتا H100 SXM5، أو بطاقة واحدة H200 أو B200 أو B300. ووصفة vLLM منشورة تشغّله مع --kv-cache-dtype fp8 ومحلّلات مخصّصة للاستدلال واستدعاء الأدوات، عند درجة حرارة 1.0، وtop-p 0.97 وtop-k 128، مع قرص reasoning_effort يمتد بين none وlow وmedium وhigh. بطاقة B300 واحدة تقدّم نموذجًا بحجم 78B عند سياق مُتحقَّق منه بطول 1M هي الشكل الملموس للعرض: أنت تشتري الجهاز، ثم تملك التكلفة الحدّية لكل رمز.

Solar Mini 4: تستأجر الشريحة النشطة بسعة 3B بدلًا من شرائها

وصل Solar Mini 4 في 22 سبتمبر 2026 — لقطة solar-mini4-260922، ويُعرف باسم solar-mini4 — كنموذج Upstage الصغير الموجّه للوكلاء: 35 مليار إجمالاً، و3 مليارات نشطة، وتاريخ قطع فبراير 2026، والإنجليزية والكورية واليابانية، مع أوضاع الدردشة والاستدلال والمخرجات المنظمة واستدعاء الأدوات. وهو متاح عبر Console وPlayground من Upstage، وللنشر على الخوادم المحلية، لكن لا يوجد تنزيل للأوزان ولا ترخيص لفحصه. كما تسجّل وثائق Upstage أيضًا "لا تُجمع البيانات" بشأنه، وهو بند الامتثال المهم إذا كنت تضع النموذج أمام حركة مرور حقيقية.

Screenshot of Upstage's Console documentation page for Solar Mini 4, showing the snapshot identifier solar-mini4-260922, the release date 2026-09-22, 35B total and 3B active parameters, a 512K context window with 128K maximum output, the list price of $0.10 per million input, $0.40 per million output and $0.01 per million cached, and the note “Data not collected”.

على عكس Kolibri، خضع Solar Mini 4 لمنظومة تقييم مستقلة. ويضعه Artificial Analysis عند مؤشر ذكاء قدره 24.05، مع نتيجة مقاسة بلغت 1.01% في Terminal-Bench 4.0، و47.6% في SciCode، و83.3% في AA-LCR، و25.8% في Humanity's Last Exam. وتصوغ منشورات إطلاق Upstage الرقم 24.1 بوصفه أعلى مؤشر بين النماذج ذات المعاملات النشطة البالغة 3B، متقدمًا على Qwen3.6 35B A3B عند 18 وNemotron 3.5 Lightning عند 13 — وهو تأطير منصف في حدوده، وجدير بالملاحظة أنه ضيّق تمامًا كما يبدو، لأنه ادعاء يخص فئة النماذج ذات 3B نشطة لا النماذج الصغيرة عمومًا.

المقياس الذي يجب أن يشكل كيفية وضع ميزانيتك له ليس المؤشر. تفصيل التكلفة لكل مهمة من Artificial Analysis يضع Solar Mini 4 عند حوالي 0.36 دولار لكل مهمة في مؤشر الذكاء، وحوالي 0.30 دولار من ذلك — حوالي 82% — هو ذاكرة التخزين المؤقت للمطالبات عمليات الكتابة. قراءات ذاكرة التخزين المؤقت هي 0.03 دولار والمخرجات المولدة هي فقط 0.035 دولار. يصدر النموذج حوالي 88,300 رمز إخراج لكل مهمة، منها حوالي 71,600 رمز استدلال. بعبارة أخرى: هذا نموذج رخيص تهيمن فاتورته على إعادة كتابة سياق طويل، وليس على الرموز التي يكتبها مرة أخرى. تتراوح تكاليف كل تقييم من 1.63 دولار لـ Terminal-Bench 4.0 إلى 0.95 دولار لـ AA-Briefcase. متوسط سرعة الإخراج هو 198 رمزًا في الثانية عند زمن 1.58 ثانية للوصول إلى أول جزء.

سعر كل مسار

لا يُسعّر Solar Mini 4 بسعر القائمة اليوم. تعرض صفحة التسعير الخاصة بـ Upstage نفسها له سلّمًا زمنيًا مؤرخًا: 0.03 دولار لكل مليون إدخال، و0.003 دولار للإدخال المخزّن مؤقتًا، و0.12 دولار للإخراج — خصم إطلاق بنسبة 70% — حتى 10 أكتوبر 2026 بتوقيت UTC، ثم 0.05 / 0.005 / 0.20 دولار من 11 أكتوبر، وأخيرًا سعر القائمة 0.10 / 0.01 / 0.40 دولار من 23 أكتوبر. يصف منشور إطلاق Upstage الخصم بصورة أقل تحديدًا مما يفعل جدول صفحة التسعير نفسها؛ السلّم الوارد أعلاه هو النسخة المزوّدة بالتواريخ، وهو الجدير بالتخطيط على أساسه. لاحظ أين يقع أشدّ خصم: ينخفض الإدخال المخزّن مؤقتًا إلى عُشر سعر الإدخال، وهو ما يكافئ بالضبط عبء العمل ذا السياق الطويل المستقر الذي يفرض ملف تعريف تكلفة كتابة الذاكرة المؤقتة أعلاه رسومًا مقابله.

سعر Kolibri هو أمر شراء. لا يوجد سعر لكل مليون توكن للمقارنة به لأنه لا يوجد عدّاد مستضاف — أنت تدفع مقابل وحدات GPU والكهرباء، والإشارة الوحيدة العلنية للتكلفة من البائع هي عملية التدريب نفسها: نحو 950 ميغاواط/ساعة لإنتاج النموذج. إذا كنت تملك بالفعل سعة استدلال، فإن التكلفة الحدية لكل توكن لدى Kolibri تقترب من تكلفة الكهرباء؛ وإذا لم تكن تملكها، فإن ثمن الدخول هو جهاز ببطاقتي A100 أو أفضل. هذا شكل مختلف جوهريًا من الالتزام عن نموذج يمكنك استدعاؤه بالمليون توكن ثم التوقف عن استدعائه غدًا، وهو القرار الفعلي الذي يطرحه الخياران.

حيث يتداخلان، وحيث تنهار المقارنة

• الحوسبة النشطة — شبه متطابقة: 3.46B مقابل 3B لكل رمز

• كل ما يترتب على ذلك — غير قابل للمقارنة، لأن واحدًا فقط من الاثنين لديه أي دليل موثّق

• أفضل درجة مقيسة — يمتلك Solar Mini 4 مؤشرًا مدققًا قدره 24.05؛ بينما يمتلك Kolibri جدولًا من المورّد ولا توجد لديه أي درجة مدققة على الإطلاق

• الألمانية — Kolibri هو الوحيد بين الاثنين المدرَّب عليها، عند 4.90 بايت لكل رمز؛ Solar Mini 4 لا يُدرجها

• الكورية واليابانية — يسرد Solar Mini 4 كليهما؛ ولا يسرد Kolibri أياً منهما

• سياق طويل — يتحقق Kolibri من 1,048,576 رمزًا كاملة؛ تقول وثائق Solar Mini 4 الخاصة إن الحد 512K بينما تقول بطاقة Artificial Analysis الخاصة به إنه 1M، لذا تعامل مع الحد الأقصى على أنه يعتمد على المورّد

• الوقت حتى أول رمز — Solar Mini 4 يستغرق دقائق، لأنك تسجّل الاشتراك؛ Kolibri يستغرق أيامًا، لأنك تركّب جهازًا

• نموذج التكلفة — لكل توكن، ينخفض مع سلّم الخصومات، مقابل رأس المال مضافًا إليه الطاقة

الخلاصة الصادقة هي أن هذه ليست مواجهة تُحسم على لوحة المتصدرين. حتى جدول المورّد الخاص بـ Kolibri يتضمّن مجموعة المقارنة الخاصة به — GLM-4.7 Flash 30B-A3B عند 64.7 في التقييم الإنجليزي العام، وNemotron 3 Nano 30B-A3B عند 65.6، وQwen3.5 35B-A3B عند 74.7، وQwen3.6 35B-A3B عند 71.4، وGemma 4 26B-A4B IT عند 71.9، وكلها مقابل 75.5 الخاصة بـ Kolibri — وكل صف من تلك الصفوف هو رقم Aleph Alpha نفسه، شغّله المختبر نفسه على أداة التقييم الخاصة به. إنها خريطة مفيدة لجوار 3B النشط. لكنها ليست تصنيفًا مستقلًا.

إذا كان ما تريده هو MoE نشط بحجم 3B على مفتاح اليوم

لا يوجد أيٌّ من النموذجين في هذه المقارنة على OrcaRouter، ويجدر بنا أن نكون دقيقين بشأن السبب. لا يملك Kolibri أي استدلال مستضاف من أي نوع حتى الآن — فهو أوزان ووصفة vLLM، لذا لا يوجد شيء يمكن للموجّه أن يشير إليه. يُقدَّم Solar Mini 4 من قِبل Upstage ومن خلال قناة Upstage الخاصة بالتشغيل المحلي؛ نحن لا نوجّهه، ولا نوجّه أي نموذج من Upstage. إذا أردت أيًا منهما، فستحصل عليه من المورّدين أنفسهم.

المسار الذي نوفّره هو الفئة المحيطة — فئة MoE الصغيرة المتناثرة التي يتنافس فيها هذان النموذجان. Gemma 4 26B-A4B IT مدرج في الكتالوج بسعر 0.06 دولار للإدخال و0.33 دولار للإخراج لكل مليون رمز مع نافذة 262,144 رمزًا. Qwen3.5 35B-A3B بسعر 0.057 / 0.459 وQwen3.6 35B-A3B بسعر 0.248 / 1.485 مع نافذة 262,144 رمزًا و65,536 رمزًا كحد أقصى للإخراج. هذه هي المقايضة نفسها التي يقوم بها النموذجان أعلاه — شريحة نشطة من 3B إلى 4B تُشترى بسعر نموذج صغير — متاحة عبر مفتاح API واحد مع تمرير سعر القائمة الخاص بالمزوّد بهامش ربح 0%، لذا يظهر تغيير سعر المورّد على فاتورتك في اليوم نفسه الذي يُعلَن فيه بدلًا من موعد تجديد العقد التالي. التحويل التلقائي عند الفشل له أهمية أكبر هنا من المعتاد: عندما تقيّم نموذجًا متناثرًا لم تثبت جدارته، فإن مسارًا ثانيًا خلف المفتاح نفسه هو ما يمنع بعد ظهيرة سيئة من أن يتحوّل إلى انقطاع.

A two-column comparison scoreboard titled “Kolibri vs Solar Mini 4 — the scoreboard”. The Kolibri column lists total parameters 78.1B, 3.46B active per token, Apache 2.0 downloadable weights, 1,048,576-token context, German and English, and no independent score published. The Solar Mini 4 column lists total parameters 35B, 3B active per token, closed API-only weights, a 512K-per-docs / 1M-per-Artificial-Analysis context, English, Korean and Japanese, and an Artificial Analysis Intelligence Index of 24.05. A footer line reads “Kolibri figures are Aleph Alpha's own, unaudited; Solar Mini 4 figures per Artificial Analysis and Upstage.”

ما يجب فعله، وما يجب مراقبته

اختر Kolibri إذا كانت أعباء عملك بالألمانية أو الإنجليزية، وإذا كانت البيانات لا يمكن أن تغادر رفّك الخاص، وإذا كنت تمتلك — أو أنت على استعداد لشراء — وحدات معالجة الرسوميات (GPUs) اللازمة لتشغيل 78B بدقة FP8. في هذا التكوين، هو النموذج الوحيد من بين هذين النموذجين الذي يُعدّ خيارًا مطروحًا أصلًا، وسياق 1M رمز المُتحقَّق منه مع مُرمِّز ألماني بمعدل 4.90 بايت لكل رمز ميزة حقيقية، وإن كانت مقيسة من جهة البائع. اختر Solar Mini 4 إذا كنت تريد أن تدخل مرحلة الإنتاج هذا الأسبوع، وإذا كانت الكورية أو اليابانية على خارطة الطريق، وإذا كان عبء عملك سياقًا طويلًا مستقرًا يكافئه خصم التخزين المؤقت؛ فاحسب ميزانيتك لعمليات كتابة التخزين المؤقت، لا لرموز الإخراج.

السؤال المفتوح هو نفسه لكليهما، وهو سؤال أدلة لا سؤال قدرات. إنّ نتيجتي Kolibri البالغتين 75.5 و84.3 هما أرقام Aleph Alpha نفسها على منصة اختبار Aleph Alpha الخاصة، وإلى أن يشغّلهما متتبّع مستقل، فأي شخص يقتبسهما إنما يقتبس المختبر. إنّ نتيجة Solar Mini 4 البالغة 24.05 حقيقية وتم إعادة إنتاجها، لكن Index مجرد لقطة لنموذج لا يزال في منتصف سلّم الخصومات، حيث لا يصل سعر القائمة حتى 23 أكتوبر. ترقّب أول تقييم مستقل لـ Kolibri، وراقب التكلفة الفعلية لـ Solar Mini 4 بعد انتهاء السلّم — لأن بمعدل $0.10 / $0.40 تبدو اقتصاديات استئجار شريحة 3B مختلفة عن $0.03 / $0.12 المعروض عليك اليوم.