تم إنشاء بطاقة رئيسية لـ Kolibri vs Qwen 3.8، بعنوان 'Kolibri مقابل Qwen 3.8' مع السطر الفرعي 'خدمة سيادية ألمانية في مواجهة عائلة صينية مفتوحة'، وأيقونة طائر الطنان على اليسار ومخطط سحابة على اليمين على جانبي فاصل رفيع. ويقع شعار OrcaRouter في الشريط أسفل الرسم.
Guides & Insights

Kolibri مقابل Qwen 3.8: النموذج الألماني يخسر على طاولته الخاصة، وهذا هو المغزى

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ابدأ بالجملة التي أغفلتها معظم تغطية إطلاق Kolibri. في جدول المعايير الذي نشرته Aleph Alpha مع نموذجها الخاص في 3 أكتوبر 2026، النموذج الذي يُقاس ضده في أغلب الأحيان ليس منافسًا أوروبيًا ولا أمريكيًا. إنه Qwen3.8 27B، الطبقة مفتوحة الأوزان من ذلك الجيل لدى المورّد، والصادرة في 13 أغسطس 2026 — وبحسب أرقام Aleph Alpha نفسها، فهو يفوز. يحقق Qwen3.8 27B نتيجة 80.2 في المتوسط الإنجليزي و79.9 في المتوسط الألماني لمجموعة التقييم نفسها التي تمنح Kolibri 75.5 و70.8. ويتقدّم في GPQA Diamond بنتيجة 89.2 مقابل 84.3. ويتقدّم في LiveCodeBench v6 بنتيجة 93.8 مقابل 85.9. ويتقدّم في SWE-Bench Verified بنتيجة 72.6 مقابل 66.4، وفي كلا معياري السياق الطويل، 76.9 مقابل 64.5 في LongBench Pro و81.3 مقابل 68.3 في AA-LCR. نموذج صيني كثيف بـ27 مليار معامل، يقيّمه مختبر ألماني، يتفوق على النموذج الرائد لذلك المختبر البالغ 78 مليار معامل في معظم جدوله الخاص. هذه ليست فضيحة. إنها المعلومة الأكثر فائدة في الإصدار، لأنها تفرض السؤال: ما الغرض الفعلي من Kolibri؟

توضيح واحد قبل أن تمضي المقارنة أبعد من ذلك، لأن "Qwen 3.8" يسمّي عائلة وليس نموذجًا، والتمييزات مهمة هنا. Qwen3.8-Max هو الرائد المستضاف من علي بابا، يعمل منذ 3 أغسطس 2026 بنافذة سياق تبلغ مليون رمز بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولار للإخراج. Qwen3.8-27B هي الفئة ذات الأوزان المفتوحة، صدرت في 13 أغسطس 2026 بنافذة 262,144 رمزًا. Qwen3.8-Flash هي فئة الاستخدام الكثيف، صدرت في 26 أغسطس 2026 بنافذة المليون رمز وأسعار أقل بكثير. أما Qwen3.8 المجرّد — الذي أُعلن عنه في 19 يوليو 2026 كرائد مفتوح الأوزان بـ2.4 تريليون معامل — فلم يصدر بعد؛ وهو موجود كصفحة تتبّع في الكتالوج وإعلان. كل ما يلي يتعلق بالنسخة التي يمكنك تنزيل أوزانها وتشغيلها، وهي 27B.

حيث يفوز Kolibri فعليًا، كما يُقرأ من الجدول نفسه

الصفوف التي يتقدّم فيها Kolibri على Qwen3.8 27B ليست مبعثرة عشوائياً. إنها تتكتّل، والتكتّل هو المنتج.

• الامتناع — في RGB Negative، يسجّل Kolibri 85.6 مقابل 70.6. عندما لا يحتوي السياق على الإجابة، يصرّح Kolibri بذلك أكثر بكثير.

• استدعاء الأدوات تحت القيد — على τ²-bench telecom، 94.7 مقابل 82.5؛ وعلى المجموعة الرأسية لمورّدي السيارات، 99.0 مقابل 97.3.

• سياق طويل جدًا — على SealQA مع عدم وجود مشتتات تتجاوز 24 ألف رمز، 100.0 مقابل 94.4.

• اقتصاديات تقديم الخدمة بالألمانية — مُرمِّز ثنائي اللغة بمتوسط 4.90 بايت لكل رمز على نص الويب الألماني، مقابل 4.17 لعائلة Qwen3.5–3.8 في قياس Aleph Alpha الخاص. عدد رموز أقل لكل مستند ألماني هو خفض مباشر لتكلفة الاستدلال يظهر في الفاتورة ولا يظهر في أي صف من صفوف المعايير.

ثلاثة من هذه الأربعة تتعلق بالسلوك لا بالقدرة. الامتناع، واستدعاء الأدوات المقيّد، والاسترجاع المُسنَد للسياق الطويل هي ما تحتاجه من نموذج يقرأ مواد مؤسستك الخاصة ويُتوقَّع منه أن يعترف عندما لا تجيب المادة عن السؤال. لقد بنت Aleph Alpha الإصدار بأكمله حول هذا الرهان، ويُظهر الجدول أن الرهان يتحقق.

Generated two-column scoreboard for Kolibri and Qwen3.8 27B. Left column Kolibri: English average 75.5, German average 70.8, abstention 85.6, GPQA Diamond 84.3, SWE-Bench Verified 66.4, licence Apache 2.0. Right column Qwen3.8 27B: English average 80.2, German average 79.9, abstention 70.6, GPQA Diamond 89.2, SWE-Bench Verified 72.6, licence Apache 2.0. The footer reads 'Both columns from Aleph Alpha's published table, vendor harness; no independent reproduction.'

الصفوف التي يفوز فيها Qwen3.8 27B تتعلق بالاتساع: المعرفة بكلتا اللغتين، وأسئلة العلوم بمستوى الدراسات العليا، والبرمجة التنافسية، وهندسة البرمجيات على مستوى المستودعات، وفهم المستندات الطويلة. إذا كان متطلبك نموذجًا عامًا قويًا بسعر منخفض لكل توكن مع أوزان مفتوحة، فإن Qwen3.8 27B هو النموذج الأفضل، والجدول يقول ذلك بحبر المورّد نفسه.

هذا الاستنتاج مُدعَّم، بينما استنتاج Kolibri ليس كذلك. قامت Artificial Analysis بقياس Qwen3.8 27B بشكل مستقل، في إعداد الاستدلال Xhigh الخاص به، وأفادت بمؤشر ذكاء (Intelligence Index) قدره 34 في المرتبة الأولى من بين 142 نموذجًا في تلك المقارنة، و45.4 رمز إخراج في الثانية، وسياق من 256,000 رمزًا، ورخصة Apache 2.0. ملاحظتهم غير مادحة بطريقة مألوفة — كثير الكلام جدًا إذ بلغ 200 مليون رمز تم توليدها أثناء تقييم المؤشر مقابل وسيط قدره 82 مليونًا، وبطيء — لكن النتيجة نفسها هي قياس طرف ثالث للخصم. لا يوجد لـ Kolibri صفحة على Artificial Analysis على الإطلاق. لذا فإن النموذج الأقوى في هذه المقارنة تم التحقق منه بشكل مستقل، والنموذج الأضعف يعتمد على كلمة البائع، وهو عكس الطريقة التي يُصاغ بها عادةً رائد أوروبي من الجيل الأول.

نوعان من الادعاءات المتعلقة بسلسلة التوريد، يشيران في اتجاهين متعاكسين.

كلا هذين الإصدارين حجّتان حول مصدر النموذج، والحجّتان صورتان معكوستان لإحداهما الأخرى.

حالة Aleph Alpha هي المنشأ كسمة. تم تدريب Kolibri بواسطة فرق ألمانية على بنية تحتية في ألمانيا وفنلندا، بموجب القانون الأوروبي والألماني. تكشف البطاقة عن مزيج التدريب المسبق — 20 تريليون رمز بنسبة 62.5 في المائة تقريبًا للإنجليزية، و23.9 في المائة للألمانية، و13.6 في المائة للكود — والتدريب المتوسط والسياق الطويل، والحوسبة الدقيقة 768 من NVIDIA B200s عبر 96 عقدة HGX لمدة 21 يومًا، وتقدير 9.5×10² ميجاواط/ساعة من الطاقة بما في ذلك النفقات العامة لمركز البيانات. وتذكر طريقة التدريب وصولاً إلى الطبقة: محوّل مزيج خبراء من 50 طبقة بنسبة 4:1 لتقسيم الانتباه بين النافذة المنزلقة والاستعلام المجمّع، وMuon وExact Quantile Balancing عبر 384 خبيرًا مع 1 مشترك و6 موجّهين. اثنا عشر ألف كلمة من الإفصاحات مرفقة بتنزيل بحجم 78 جيجابايت، وموقف معلن كأحد الموقعين على مدونة الممارسات للذكاء الاصطناعي العام للاتحاد الأوروبي.

حالة Alibaba مختلفة من حيث النوع: ليست «يمكننا تبرير كل قرار» بل «إليك الأوزان، خذها». أوزان مفتوحة مرخصة بموجب Apache على نطاق وجودة جعلا Qwen الافتراضي الفعلي حول العالم، ومفردات من 248,077 رمزًا تغطي أكثر من مئة لغة بكثير، ونظام بيئي للخدمة تم ضبطه حول نقاط الحفظ هذه لفترة كافية بحيث تدعمها كل حزم الاستدلال تقريبًا بشكل جاهز. حجة السيادة هناك تتعلق بالتوافر: لا يمكن لأي بائع سحب النموذج، لأنك تملك الملف بالفعل.

كلا الادعاءين صادقان، وهما يستجيبان لمخاوف مختلفة. فمشترٍ من القطاع العام في بادن-فورتمبيرغ قلقٌ بشأن الاختصاص القضائي وقابلية التدقيق، و«كوليبري» موجَّه إلى هذا القلق. ومجموعة بحثية في نيروبي أو ساو باولو قلقةٌ من أن نموذجًا محجوبٌ خلف بطاقة ائتمان بعملة لا يستطيعون الدفع بها، وأوزان Qwen المفتوحة موجَّهة إلى ذلك القلق. غير الصادق هو التظاهر بأن أياً منهما مقارنة قدرات، لأن جدول القدرات قد أعطى إجابته بالفعل.

Screenshot of the Artificial Analysis model page for Qwen3.8 27B (Xhigh), marked 'Open weights model, Released August 2026', showing an Intelligence Index of 34 against a median of 8, a #1/142 intelligence rank, a #55/142 speed rank at 45 tokens per second against a 91-token median, input pricing $0.50 per million tokens against a $0.03 median and output pricing $3.00 against a $0.15 median, an average cost of $1.01 per task on the Intelligence Index, a verbosity rank of #22/142 having generated 200M tokens during the index evaluation against a median of 82M, a 256k-token context window, and the Apache 2.0 licence badge.

فجوة الترخيص حقيقية لكنها أضيق مما يبدو

Kolibri هو Apache 2.0. Qwen3.8 27B أوزان مفتوحة مرخّصة بموجب Apache. يأتي كلاهما بلا بند إضافي للاستخدام المقبول، وبلا حدّ أدنى للمستخدمين النشطين شهريًا، وبلا شروط تجارية منفصلة — ما يضعهما في فئة صغيرة، ويعني أن أياً منهما لا يتطلب مراجعة قانونية قبل الاستخدام التجاري.

ما يفصل بينهما هو كل ما يأتي بعد الترخيص. يأتي Kolibri مزوّدًا بإضافة vLLM وحزمة محلل من المورّد، وصورة حاوية، وأربعة مستويات لجهد الاستدلال قابلة للضبط عبر قالب المحادثة، وسلوك امتناع صريح، وإعداد أخذ عينات موصى به. أما Qwen3.8 27B فيأتي كأوزان تعرف Transformers وvLLM وSGLang بالفعل كيفية تقديمها، مع صيغة لاستدعاء الأدوات أتيحت للنظام البيئي الأوسع أشهرًا للتكيّف معها.

تختلف أجهزة النشر على المنوال نفسه. تشغل أوزان Kolibri بدقة FP8 نحو 78 غيغابايت، بحد أدنى من بطاقتَي A100 80 GB، أو وحدتَي H100 SXM5، أو واحدة H200، أو واحدة B200، أو واحدة B300. أما Qwen3.8 27B بدقة bfloat16 فوزنه نحو 54 غيغابايت، أي مسرّع واحد بسعة 80 غيغابايت بالدقة الكاملة، أو نسخة مكمَّمة على أقل من ذلك بكثير. يكلّف النموذج الألماني عتادًا أكثر ويعيد مقياس أداء أقل مقابله. ولا تكون هذه مقايضة سيئة إلا إذا كنت تشتري مقياس الأداء.

ما تخبرك به بطاقات الأسعار وما لا تخبرك به

ليس لـ Kolibri سعر، لأن Aleph Alpha لا تبيع الاستدلال الخاص به. الإصدار عبارة عن أوزان وتقرير تقني وبطاقة؛ لا يوجد SKU مُستضاف. أي رقم تكلفة لـ Kolibri هو حساب إطفاء لتكاليف العتاد تقوم به بنفسك.

Qwen3.8 متاح للعموم بثلاث فئات سعرية، والفئة الوسطى هي المهمة لفريق يقارن بين الاستضافة الذاتية والاستئجار.

• Qwen3.8-Max — 2.00 دولار لكل مليون رمز إدخال و6.00 دولار للإخراج، سياق يبلغ مليون رمز، قراءات الذاكرة المؤقتة بسعر 0.25 دولار، صدر في 3 أغسطس 2026.

• Qwen3.8-27B — 0.33 دولار للإدخال و2.40 دولار للإخراج، وسياق من 262,144 رمزًا، صدر في 13 أغسطس 2026. هذه أوزان مفتوحة، لذا فهذا هو السعر الذي تدفعه إذا كنت تفضّل عدم تشغيلها بنفسك.

• Qwen3.8-Flash — 0.15 دولارًا للإدخال و0.47 دولارًا للإخراج مع نافذة سياق تبلغ مليون رمز، صدر في 26 أغسطس 2026.

تلك هي أسعار القائمة من المزوّدين على OrcaRouter، تُمرَّر كما هي دون إضافة أي شيء لكل رمز، وهي السمة المفيدة عندما يكون السؤال هو ما إذا كان النشر المُستضاف ذاتيًا يغطي تكاليفه: يمكنك قياس حجم الرموز الفعلي لديك على الطبقات المستضافة قبل الالتزام بالعتاد. نحن لا نضيف هامش ربح، لذلك يصبح تخفيض سعر المورّد ساريًا لدينا في اليوم نفسه. جميع طبقات Qwen3.8 الثلاث قابلة للتوجيه اليوم عبر مفتاح واحد متوافق مع OpenAI مع تحويل تلقائي عند الفشل بين المزوّدين، ولدى Qwen3.8 القادم الذي يبلغ 2.4 تريليون معلمة صفحة كتالوج تنتظر الأوزان بدلًا من عنصر نائب يتظاهر بتقديمها.

Kolibri ليس قابلًا للتوجيه. لقد فحصنا الكتالوج تحت كل تهجئة للبائع والنموذج وهو غائب — لذا فإن الطريقة الوحيدة لاستدعائه هي تنزيل بحجم 78 GB. إذا أردت معرفة ما الذي سيكلفه النموذج الألماني لعبء عملك، فالإجابة هي رفّ وشخص يستطيع تشغيل vLLM، ولا يمكن لأي طرف ثالث حاليًا أن يقدم لك عرضًا لأي شيء آخر.

Screenshot of the OrcaRouter model page for qwen/qwen3.8-max, showing the 1M-token context badge, text, image and video input with text output, the Vision, Tools, JSON and Reasoning capability tags, a p50 time-to-first-token of 2.35 seconds, the attribution 'Public benchmarks by Qwen - 2026-08-03', the description as Alibaba's newest flagship in the Qwen line positioned against GPT-5.5, Claude Opus 4.7 and Gemini 3.1 Pro, the pricing tiles $2.00 and $6.00, and the OpenAI-compatible and Anthropic-compatible base URLs at https://api.orcarouter.ai/v1 and https://api.orcarouter.ai.

من يجب أن يشتري أيًا منها

لا يتوقف القرار على الجودة، لأن جدول المورّد نفسه قد حسم تلك المسألة لصالح علي بابا. بل يتوقف على المخاطرة التي تشتري تأمينًا ضدها.

• اختر Kolibri إذا كان القيد الملزم هو الاختصاص القضائي أو توثيق المصدر أو قابلية التدقيق — إذا كنت بحاجة إلى أن تكون قادرًا على الإجابة عن مصدر بيانات التدريب، وأين جرى تشغيل الحوسبة، وتحت أي قانون، وإذا كان عبء العمل يتمثل في مستندات ألمانية وإنجليزية تُعالَج داخل محيطك الخاص. أنت تدفع علاوة قدرات مقابل ذلك، وهذه العلاوة ظاهرة في الجدول أعلاه.

• اختر Qwen3.8 27B إذا كان القيد الحاسم هو القدرة مقابل التكلفة، أو اتساع نطاق اللغات، أو دعم المنظومة البيئية. فهو النموذج الأقوى وفق تقييم Aleph Alpha نفسه، وهو مرخّص بموجب رخصة Apache، ويعمل على مسرّع واحد، وتبدأ الفئات المستضافة من 0.33 دولار لكل مليون رمز إدخال إذا كنت تفضّل ألّا تشغّله بنفسك على الإطلاق.

• فكّر في كليهما ضمن البنية نفسها إذا كان عبء العمل يتضمّن نواة خاضعة للتنظيم ومحيطًا عامًا. الوثائق التي لا يمكنها مغادرة المبنى تذهب إلى نقطة نهاية Kolibri مستضافة ذاتيًا؛ أما أعمال التلخيص والترجمة والبرمجة فتذهب إلى طبقة Qwen3.8 الموجّهة بثلث سنت لكل ألف رمز. مفتاح API واحد، وقاعدة توجيه واحدة، وأسعار قوائم المزوّدين تُمرَّر كما هي، والتبديل الاحتياطي عند الفشل يُدار نيابةً عنك — وهذا ترتيب أكثر فائدة بكثير من اختيار أحدهما والتظاهر بأن الآخر غير موجود.