بطاقة hero مُنشأة لـ Kolibri مقابل Gemma 4 12B، بعنوان 'Kolibri vs Gemma 4 12B' مع سطر فرعي 'نموذج MoE بحجم 78B مقابل نموذج كثيف بحجم 11.95B'، وأيقونة طائر طنان على اليسار وماسة على اليمين على جانبَي فاصل رفيع. ويقع شعار OrcaRouter في الشريط أسفل العمل الفني.
Guides & Insights

Kolibri مقابل Gemma 4 12B: 78 مليار معامل مقابل 12، وواحد فقط منهما لديه نتيجة

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

كوليبري وGemma 4 12B هما طرفا طيف لا تتيح إصدارات الأوزان المفتوحة عادةً المقارنة بينهما على قدم المساواة. صدر كوليبري من Aleph Alpha في 3 أكتوبر 2026: 78.1 مليار معامل إجمالي، 3.46 مليار نشط لكل رمز، نافذة سياق مُتحقَّق منها بحجم 1,048,576 رمزًا، الألمانية والإنجليزية فقط، Apache 2.0. صدر Gemma 4 12B في 3 يونيو 2026: 11.95 مليار معامل كثيف، نافذة سياق 262,144 رمزًا، إدخال نص وصورة وصوت وفيديو، Apache 2.0. أحدهما لديه نتيجة مستقلة قابلة لإعادة الإنتاج علنًا. والآخر لديه جدول معايير من المورّد. هذا التفاوت ليس حاشية في هذه المقارنة؛ بل هو المقارنة نفسها، لأن كل ما يهم المشتري — التكلفة لكل مهمة، الجودة لكل واط، ما إذا كان سيعمل على مستنداتك — يمر عبره.

ينبغي أن نكون مباشرين بالقدر نفسه بشأن طبيعة المقارنة، لأن عنوانًا رئيسيًا يضع نموذج 78B في مواجهة نموذج 12B يدعو إلى استنتاج خاطئ. فهذان ليسا متنافسين. أحدهما نشر بحجم 78 GB موجّه لأعمال المستندات في القطاعين العام والصناعي الألمانيين على رفوف يملكها العميل؛ والآخر نموذج موحّد متعدد الوسائط بمعاملات تبلغ 12 مليارًا يعمل على حاسوب محمول ويحمل مؤشرًا مستقلًا قيمته 14. وما يلي هو عرض لما صُمّم كل منهما له فعليًا، وأين تسمح لك الأرقام المنشورة بترتيبهما وأين لا تسمح، وما تكلفة ألّا يكون لديك تقييم مستقل.

الرقم الوحيد الذي يمكنك الوثوق به هنا، والرقم الوحيد الذي لا يمكنك الوثوق به.

قامت Artificial Analysis بقياس Gemma 4 12B، في إعداد الاستدلال الخاص به. النتائج، كما نُشرت على صفحة الطراز الخاصة بهم، هي التي ينبغي العمل انطلاقًا منها:

• الذكاء — مؤشر Artificial Analysis Intelligence Index بقيمة 14، مما يضعه في نطاق الفئة العليا بمركز رقم 21 ضمن 142 نموذجًا في تلك المقارنة، مقابل وسيط قدره 8 للنماذج المماثلة.

• السرعة — 112.5 رمز إخراج في الثانية، المرتبة 21 من 142 في عرض السرعة، وفوق الوسيط البالغ 91 رمزًا للنماذج المماثلة.

• السعر — 0.10 دولار لكل مليون توكن إدخال و0.30 دولار لكل مليون توكن إخراج، وهو ما تُشير صفحتهم إلى أنه مكلف إلى حدٍّ ما مقارنةً بوسيط يبلغ 0.03 دولار و0.15 دولار للنماذج المشابهة في الحجم والفئة.

• المواصفات — سياق 262,144 رمزًا، إجمالي 12B معلمة، Apache 2.0، إدخال نص وصورة وكلام وفيديو، إخراج نص.

إن الحكم الموجز الذي أصدرته Artificial Analysis بنفسها يتّسم بصراحة غير معتادة بالنسبة إلى صفحة لوحة صدارة، ويستحق التكرار: يُعدّ Gemma 4 12B من بين النماذج الرائدة في الذكاء، لكنه مكلف إلى حدٍّ ما مقارنةً بنماذج أخرى مفتوحة الأوزان ذات الحجم المماثل. وهذا تقييم حقيقي ومستقل وقابل للتكرار من طرف ثالث لا مصلحة له مع أيٍّ من المورّدين.

لا يوجد لـ Kolibri ما يعادله. لا توجد له صفحة نموذج على Artificial Analysis، وفي وقت كتابة هذا النص لم يُعِد أي طرف ثالث إنتاج مجموعة التقييم. الموجود هو جدول المقارنة الخاص بـ Aleph Alpha نفسه، الذي يسجّل فيه Kolibri ‏75.5 في المتوسط الإنجليزي و70.8 في المتوسط الألماني عبر مجموعة مهامه. هذه متوسطات نسب مئوية غير موزونة على مزيج معايير اختاره المورّد، وعلى إطار اختبار كتبه المورّد، عند جهد استدلال مرتفع. وهي ليست مؤشر ذكاء، ولا يمكن تحويل الرقمين أحدهما إلى الآخر أو وضعهما جنبًا إلى جنب. أي شخص يقدّم «Kolibri 75.5 مقابل Gemma 14» كترتيب فإنه يقارن نسبة مئوية على مقياس بدرجة على مقياس آخر. الموقف الأمين هو أن جودة Gemma 4 12B مقيسة، بينما جودة Kolibri مزعومة.

ما يتيحه لك جدول المورّد هو القراءة عبر الصفوف. يظهر Gemma 4 26B-A4B IT، نظير Google الخاص القائم على مزيج الخبراء للطراز 12B، في جدول Aleph Alpha عند 71.9 في الإنجليزية و66.3 في الألمانية، وهو أدنى من Kolibri في كليهما. وهذا أقرب ما يتوفر إلى تحقق متقاطع، ويأتي مع التحفظ نفسه: بيئة اختبار المورّد، وأرقام المورّد. إنها إشارة ضعيفة، وليست دليلًا.

Screenshot of the Artificial Analysis model page for Gemma 4 12B (Reasoning), marked 'Open weights model, Released June 2026', showing an Intelligence Index of 14 against a median of 8, a #21/142 intelligence rank and a #21/142 speed rank, 112.5 output tokens per second against a 91-token median, input pricing $0.10 per million tokens against a $0.03 median and output pricing $0.30 against a $0.15 median, a 262k-token context window, the summary verdict that the model is amongst the leading models in intelligence but somewhat expensive compared with other open-weight models of similar size, and the 142 models in this class count.

الكثيف 12B مقابل المتناثر 78B ليس عدم التطابق الذي يبدو عليه.

الفجوة في البنية المعمارية أكبر من الفجوة في المعاملات عندما تأخذ في الحسبان ما يُحسب فعليًا لكل رمز.

• الحوسبة لكل توكن — يُنشّط Gemma 4 12B جميع المعاملات البالغ عددها 11.95 مليار مع كل توكن. بينما يُنشّط Kolibri ‏3,457,573,120 من أصل 78,103,074,560 لديها، أي نحو واحد على اثنين وعشرين من النموذج، مع خبير مشترك واحد وستة خبراء موجّهين لكل طبقة من أصل 384.

• الذاكرة — المقايضة تسير في الاتجاه المعاكس وهي قاسية. Gemma 4 12B بدقة bfloat16 يبلغ حجم الأوزان في حدود 24 GB. بطاقة Kolibri تضع أوزان FP8 عند نحو 78 GB، مع حد أدنى من بطاقتَي A100 80 GB، أو بطاقتَي H100 SXM5، أو H200 واحدة، أو B200 واحدة أو B300 واحدة.

• الانتباه — يستخدم Gemma 4 مزيجًا هجينًا من الانتباه المحلي ذي النافذة المنزلقة والانتباه العالمي الكامل، مع كون الطبقة الأخيرة عالمية دائمًا. ويستخدم Kolibri تقسيمًا بنسبة 4:1 بين النافذة المنزلقة والاستعلام المُجمَّع عبر 50 طبقة كلها من نوع MoE.

• السياق — 262,144 رمزًا لـ Gemma 4 12B؛ 262,144 أصلي لـ Kolibri، تم التحقق منها حتى 1,048,576 دون تحجيم الموضع.

إذن، الصياغة الصادقة لـ"78B مقابل 12B" هي أن Kolibri يتفوق من حيث تكلفة التنشيط ويخسر من حيث البصمة التخزينية للأوزان، ولا تأتي أي من الميزتين مجانًا. النموذج المتناثر الذي ينشّط 3.46 مليار معامل لكل رمز يظل مضطرًا للاحتفاظ بكل الـ78 مليار في الذاكرة، ولهذا يكون الحد الأدنى للنشر زوجًا من مسرعات بسعة 80 GB بدلًا من بطاقة استهلاكية واحدة. أما Gemma 4 12B فيعقد المقايضة المعاكسة: تُفعَّل حصة أكبر من النموذج مع كل رمز، لكنه يتسع على عتاد يمكن لشخص شراؤه.

هناك تفصيل دقيق خاص بألمانيا على جانب Kolibri يغيّر الحساب لا الترتيب. إذ يبلغ متوسط مُرمِّز الرموز لديه 4.90 بايت لكل رمز على النص الألماني على الويب، مقابل 4.13 لـ Gemini، و4.17 لعائلة Qwen3.5–3.8، و4.35 لـ GPT-5، وفقًا لقياسات Aleph Alpha الخاصة. وعدد أقل من الرموز لكل مستند ألماني يعني خفضًا مباشرًا في تكلفة الاستدلال، وبالنسبة لعبء عمل يتمثل في نصوص إدارية ألمانية بالملايين، قد يكون لهذا الأثر قيمة تتجاوز بضع نقاط في المؤشر. كما أنه مُبلَّغ عنه من المورّد بالكامل.

Generated two-column scoreboard for Kolibri and Gemma 4 12B. Left column Kolibri: independent score 'none published', context '262,144 native, 1M validated', parameters '78.1B MoE, 3.46B active', modalities 'text only', licence Apache 2.0, price 'self-host, 78 GB'. Right column Gemma 4 12B: independent score 'AA Index 14', context 262,144, parameters '11.95B dense', modalities 'text, image, audio, video', licence Apache 2.0, price '$0.10 in / $0.30 out'. The footer reads 'Kolibri figures vendor-reported; Gemma 4 12B figures per Artificial Analysis.'

ما يمكن لكل واحد منهم رؤيته فعليًا

عند هذه النقطة لم يعد التنافس متقاربًا، وهذه حقيقة مواصفات لا ادعاء جودة. إن Gemma 4 12B نموذج متعدد الوسائط موحّد: تصف بطاقته بنية بلا مُشفّرات تُسقط رقع الصور الخام والموجات الصوتية مباشرة إلى فضاء تضمين نموذج اللغة، مع إدخال النص والصورة والكلام والفيديو وإخراج النص. وقد صُمم ليعمل على أجهزة المستهلكين دون الحاجة إلى توفير مُشفّرات منفصلة.

يقرأ Kolibri النص، بلغتين، ولا شيء غير ذلك. ويصوغ Aleph Alpha ذلك عمدًا باعتباره عمقًا بدلًا من اتساع: لغتان، منتقاة بعناية فائقة، بدلًا من خليط واسع متعدد اللغات. لا يوجد برج رؤية، ولا مسار صوتي، ولا فيديو. إذا كان عبء عملك يتضمن استمارات ممسوحة ضوئيًا، أو مكالمات مسجلة، أو صورًا فوتوغرافية للمعدات، فإن Gemma 4 12B مرشح، أما Kolibri فليس كذلك، مهما قالت صفوف المقارنات المعيارية. وإذا كان عبء عملك عبارة عن مجموعة نصوص من الوثائق الألمانية والإنجليزية يجب ألا تغادر المبنى أبدًا، فإن العكس أقرب إلى الصواب — لكن لاحظ أن متطلب «ألا تغادر المبنى أبدًا» يتحقق مع Gemma 4 12B أيضًا، بما أن الأوزان بترخيص Apache 2.0 وقابلة للتنزيل.

أيّهما أرخص يعتمد على ما تشتريه.

الموديلان مُسعَّران بعُملتين غير قابلتين للتحويل. لدى Gemma 4 12B سعر سوقي: 0.10 دولار و0.30 دولار لكل مليون رمز، وفقًا لما قاسه Artificial Analysis عبر مزوّدين مختلفين، وهو أرخص عند طبقة MoE على نقاط النهاية الموجّهة. أما Kolibri فليس له سعر على الإطلاق، لأن Aleph Alpha لا تبيع الاستدلال الخاص به — فالإصدار هو أوزان، وتقرير تقني، وبطاقة نموذج.

• Gemma 4 12B على مسار مُستضاف — 0.10 دولار لكل مليون رمز إدخال و0.30 دولار لكل مليون رمز إخراج وفق أرقام Artificial Analysis. وفي دليلنا الخاص، يظهر الشقيق MoE ‏Gemma 4 26B-A4B IT بسعر 0.06 دولار للإدخال و0.33 دولار للإخراج مع نافذة سياق تبلغ 262,144 رمزًا، ويظهر النموذج الكثيف الأكبر Gemma 4 31B IT بسعر 0.13 و0.38 دولارًا؛ وهذه أسعار قوائم المزوّدين مُمرَّرة كما هي، وهي الرقم الوحيد الذي لا نضيف إليه شيئًا.

• Kolibri على عتادك الخاص — 78 جيجابايت من الأوزان، وإضافة vLLM من حزمة aleph-alpha-inference الخاصة بالمورّد، وحدّ أدنى قدره H200 أو B200 واحد، أو زوج من H100 SXM5s. والتكلفة هي شراء رأسمالي، وخانة رفّ، وشخص قادر على تشغيل نشر vLLM، تُقسَّط على عدد الرموز التي تولّدها.

تلك ليستا نفس عملية الشراء، والمقارنة ليست "أيهما أرخص". بل ما إذا كان عبء العمل له شكل يبرّر امتلاك العتاد. فالفريق الذي يعالج مجموعة مستندات ثابتة وحساسة بكميات كبيرة يمكن أن يتقدّم كثيرًا على الجانب المستضاف ذاتيًا. أما الفريق الذي يبني ميزة في منتج تستدعي نموذجًا ببضع ملايين من الرموز يوميًا فلا يكاد يفعل ذلك أبدًا.

أحد المسارات الوسطى العملية: فئة Gemma موجودة على OrcaRouter اليوم، على نفس نقطة النهاية المتوافقة مع OpenAI مثل كل شيء آخر، مع التجاوز عند الفشل عبر المزودين وسعر القائمة الخاص بالمزود يتم تمريره دون إضافة أي شيء لكل رمز. وهذا يجعله طريقة رخيصة لقياس حجم الرموز الفعلي لديك على مسار مستضاف قبل أن تقرر ما إذا كان نشر سيادي بحجم 78 GB مبررًا. من الجدير القول بوضوح ما ليس كذلك: نحن لا نوجّه Kolibri. لقد فحصنا الكتالوج تحت كل تهجئة لاسم البائع والطراز، وهو ليس موجودًا. الاستضافة الذاتية هي حاليًا الطريقة الوحيدة لاستدعائه.

Screenshot of the OrcaRouter model page for google/gemma-4-26b-a4b-it, showing the 262K-token context badge, text, image and video input with text output, the Vision, Tools, JSON and Reasoning capability tags, the attribution 'Public benchmarks by Google - 2026-04-05', the description of Gemma 4 26B A4B IT as an instruction-tuned mixture-of-experts model from Google DeepMind with roughly 26B total parameters of which about 4B activate per token, the pricing tiles $0.06 and $0.33, and the OpenAI-compatible base URL https://api.orcarouter.ai/v1.

من الذي يجب أن يختار ماذا

قاعدة القرار قصيرة بما يكفي لصياغتها في ثلاثة أسطر.

اختر Gemma 4 12B إذا كنت تحتاج إلى أي شيء غير النص الألماني والإنجليزي، أو إذا كنت تحتاج إلى رقم جودة مقيس قبل أن تلتزم، أو إذا كان يجب تشغيل النموذج على أجهزة تملكها بالفعل، أو إذا كنت تفضّل استئجار الرموز بدلًا من امتلاك رفّ خوادم. فهو الوحيد بين الاثنين الذي يمتلك تقييمًا مستقلًا، وسرعة منشورة، وسعرًا في السوق.

اختر Kolibri إذا كان ما تحتاجه هو نموذج استدلال بـ78 مليار معامل، تكون أوزانه ومصدر بيانات تدريبه واستهلاكه للطاقة وترخيصه كلها موثّقة، ويُنشر داخل محيطك الخاص، مع مُرمِّز (tokenizer) مبنيّ للنصوص الإدارية الألمانية وسلوك امتناع يمكن لسير عمل خاضع للتنظيم أن يعتمد عليه. ذلك هدف ضيّق، وقد استهدفته Aleph Alpha عن قصد.

لا تختر أيًا منهما استنادًا إلى صف في اختبار أداء رأيته في منشور إطلاق. إن الرقم 14 الخاص بـ Gemma 4 12B هو قياس أجراه شخص آخر ويمكنك التحقق منه. أما الرقم 75.5 الخاص بـ Kolibri فهو ادعاء أطلقه مؤلفه، والشخص الوحيد القادر حاليًا على دحضه هو عميل يملك وحدتي H100 ومجموعة مستندات.