
Kolibri مقابل Qwen 3.8: النموذج الألماني يخسر على طاولته الخاصة، وهذا هو المغزى
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 218 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 115 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 982 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 47 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 105 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 215 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
ابدأ بالجملة التي أغفلتها معظم تغطية إطلاق Kolibri. في جدول المعايير الذي نشرته Aleph Alpha مع نموذجها الخاص في 3 أكتوبر 2026، النموذج الذي يُقاس ضده في أغلب الأحيان ليس منافسًا أوروبيًا ولا أمريكيًا. إنه Qwen3.8 27B، الطبقة مفتوحة الأوزان من ذلك الجيل لدى المورّد، والصادرة في 13 أغسطس 2026 — وبحسب أرقام Aleph Alpha نفسها، فهو يفوز. يحقق Qwen3.8 27B نتيجة 80.2 في المتوسط الإنجليزي و79.9 في المتوسط الألماني لمجموعة التقييم نفسها التي تمنح Kolibri 75.5 و70.8. ويتقدّم في GPQA Diamond بنتيجة 89.2 مقابل 84.3. ويتقدّم في LiveCodeBench v6 بنتيجة 93.8 مقابل 85.9. ويتقدّم في SWE-Bench Verified بنتيجة 72.6 مقابل 66.4، وفي كلا معياري السياق الطويل، 76.9 مقابل 64.5 في LongBench Pro و81.3 مقابل 68.3 في AA-LCR. نموذج صيني كثيف بـ27 مليار معامل، يقيّمه مختبر ألماني، يتفوق على النموذج الرائد لذلك المختبر البالغ 78 مليار معامل في معظم جدوله الخاص. هذه ليست فضيحة. إنها المعلومة الأكثر فائدة في الإصدار، لأنها تفرض السؤال: ما الغرض الفعلي من Kolibri؟
توضيح واحد قبل أن تمضي المقارنة أبعد من ذلك، لأن "Qwen 3.8" يسمّي عائلة وليس نموذجًا، والتمييزات مهمة هنا. Qwen3.8-Max هو الرائد المستضاف من علي بابا، يعمل منذ 3 أغسطس 2026 بنافذة سياق تبلغ مليون رمز بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولار للإخراج. Qwen3.8-27B هي الفئة ذات الأوزان المفتوحة، صدرت في 13 أغسطس 2026 بنافذة 262,144 رمزًا. Qwen3.8-Flash هي فئة الاستخدام الكثيف، صدرت في 26 أغسطس 2026 بنافذة المليون رمز وأسعار أقل بكثير. أما Qwen3.8 المجرّد — الذي أُعلن عنه في 19 يوليو 2026 كرائد مفتوح الأوزان بـ2.4 تريليون معامل — فلم يصدر بعد؛ وهو موجود كصفحة تتبّع في الكتالوج وإعلان. كل ما يلي يتعلق بالنسخة التي يمكنك تنزيل أوزانها وتشغيلها، وهي 27B.
حيث يفوز Kolibri فعليًا، كما يُقرأ من الجدول نفسه
الصفوف التي يتقدّم فيها Kolibri على Qwen3.8 27B ليست مبعثرة عشوائياً. إنها تتكتّل، والتكتّل هو المنتج.
• الامتناع — في RGB Negative، يسجّل Kolibri 85.6 مقابل 70.6. عندما لا يحتوي السياق على الإجابة، يصرّح Kolibri بذلك أكثر بكثير.
• استدعاء الأدوات تحت القيد — على τ²-bench telecom، 94.7 مقابل 82.5؛ وعلى المجموعة الرأسية لمورّدي السيارات، 99.0 مقابل 97.3.
• سياق طويل جدًا — على SealQA مع عدم وجود مشتتات تتجاوز 24 ألف رمز، 100.0 مقابل 94.4.
• اقتصاديات تقديم الخدمة بالألمانية — مُرمِّز ثنائي اللغة بمتوسط 4.90 بايت لكل رمز على نص الويب الألماني، مقابل 4.17 لعائلة Qwen3.5–3.8 في قياس Aleph Alpha الخاص. عدد رموز أقل لكل مستند ألماني هو خفض مباشر لتكلفة الاستدلال يظهر في الفاتورة ولا يظهر في أي صف من صفوف المعايير.
ثلاثة من هذه الأربعة تتعلق بالسلوك لا بالقدرة. الامتناع، واستدعاء الأدوات المقيّد، والاسترجاع المُسنَد للسياق الطويل هي ما تحتاجه من نموذج يقرأ مواد مؤسستك الخاصة ويُتوقَّع منه أن يعترف عندما لا تجيب المادة عن السؤال. لقد بنت Aleph Alpha الإصدار بأكمله حول هذا الرهان، ويُظهر الجدول أن الرهان يتحقق.

الصفوف التي يفوز فيها Qwen3.8 27B تتعلق بالاتساع: المعرفة بكلتا اللغتين، وأسئلة العلوم بمستوى الدراسات العليا، والبرمجة التنافسية، وهندسة البرمجيات على مستوى المستودعات، وفهم المستندات الطويلة. إذا كان متطلبك نموذجًا عامًا قويًا بسعر منخفض لكل توكن مع أوزان مفتوحة، فإن Qwen3.8 27B هو النموذج الأفضل، والجدول يقول ذلك بحبر المورّد نفسه.
هذا الاستنتاج مُدعَّم، بينما استنتاج Kolibri ليس كذلك. قامت Artificial Analysis بقياس Qwen3.8 27B بشكل مستقل، في إعداد الاستدلال Xhigh الخاص به، وأفادت بمؤشر ذكاء (Intelligence Index) قدره 34 في المرتبة الأولى من بين 142 نموذجًا في تلك المقارنة، و45.4 رمز إخراج في الثانية، وسياق من 256,000 رمزًا، ورخصة Apache 2.0. ملاحظتهم غير مادحة بطريقة مألوفة — كثير الكلام جدًا إذ بلغ 200 مليون رمز تم توليدها أثناء تقييم المؤشر مقابل وسيط قدره 82 مليونًا، وبطيء — لكن النتيجة نفسها هي قياس طرف ثالث للخصم. لا يوجد لـ Kolibri صفحة على Artificial Analysis على الإطلاق. لذا فإن النموذج الأقوى في هذه المقارنة تم التحقق منه بشكل مستقل، والنموذج الأضعف يعتمد على كلمة البائع، وهو عكس الطريقة التي يُصاغ بها عادةً رائد أوروبي من الجيل الأول.
نوعان من الادعاءات المتعلقة بسلسلة التوريد، يشيران في اتجاهين متعاكسين.
كلا هذين الإصدارين حجّتان حول مصدر النموذج، والحجّتان صورتان معكوستان لإحداهما الأخرى.
حالة Aleph Alpha هي المنشأ كسمة. تم تدريب Kolibri بواسطة فرق ألمانية على بنية تحتية في ألمانيا وفنلندا، بموجب القانون الأوروبي والألماني. تكشف البطاقة عن مزيج التدريب المسبق — 20 تريليون رمز بنسبة 62.5 في المائة تقريبًا للإنجليزية، و23.9 في المائة للألمانية، و13.6 في المائة للكود — والتدريب المتوسط والسياق الطويل، والحوسبة الدقيقة 768 من NVIDIA B200s عبر 96 عقدة HGX لمدة 21 يومًا، وتقدير 9.5×10² ميجاواط/ساعة من الطاقة بما في ذلك النفقات العامة لمركز البيانات. وتذكر طريقة التدريب وصولاً إلى الطبقة: محوّل مزيج خبراء من 50 طبقة بنسبة 4:1 لتقسيم الانتباه بين النافذة المنزلقة والاستعلام المجمّع، وMuon وExact Quantile Balancing عبر 384 خبيرًا مع 1 مشترك و6 موجّهين. اثنا عشر ألف كلمة من الإفصاحات مرفقة بتنزيل بحجم 78 جيجابايت، وموقف معلن كأحد الموقعين على مدونة الممارسات للذكاء الاصطناعي العام للاتحاد الأوروبي.
حالة Alibaba مختلفة من حيث النوع: ليست «يمكننا تبرير كل قرار» بل «إليك الأوزان، خذها». أوزان مفتوحة مرخصة بموجب Apache على نطاق وجودة جعلا Qwen الافتراضي الفعلي حول العالم، ومفردات من 248,077 رمزًا تغطي أكثر من مئة لغة بكثير، ونظام بيئي للخدمة تم ضبطه حول نقاط الحفظ هذه لفترة كافية بحيث تدعمها كل حزم الاستدلال تقريبًا بشكل جاهز. حجة السيادة هناك تتعلق بالتوافر: لا يمكن لأي بائع سحب النموذج، لأنك تملك الملف بالفعل.
كلا الادعاءين صادقان، وهما يستجيبان لمخاوف مختلفة. فمشترٍ من القطاع العام في بادن-فورتمبيرغ قلقٌ بشأن الاختصاص القضائي وقابلية التدقيق، و«كوليبري» موجَّه إلى هذا القلق. ومجموعة بحثية في نيروبي أو ساو باولو قلقةٌ من أن نموذجًا محجوبٌ خلف بطاقة ائتمان بعملة لا يستطيعون الدفع بها، وأوزان Qwen المفتوحة موجَّهة إلى ذلك القلق. غير الصادق هو التظاهر بأن أياً منهما مقارنة قدرات، لأن جدول القدرات قد أعطى إجابته بالفعل.

فجوة الترخيص حقيقية لكنها أضيق مما يبدو
Kolibri هو Apache 2.0. Qwen3.8 27B أوزان مفتوحة مرخّصة بموجب Apache. يأتي كلاهما بلا بند إضافي للاستخدام المقبول، وبلا حدّ أدنى للمستخدمين النشطين شهريًا، وبلا شروط تجارية منفصلة — ما يضعهما في فئة صغيرة، ويعني أن أياً منهما لا يتطلب مراجعة قانونية قبل الاستخدام التجاري.
ما يفصل بينهما هو كل ما يأتي بعد الترخيص. يأتي Kolibri مزوّدًا بإضافة vLLM وحزمة محلل من المورّد، وصورة حاوية، وأربعة مستويات لجهد الاستدلال قابلة للضبط عبر قالب المحادثة، وسلوك امتناع صريح، وإعداد أخذ عينات موصى به. أما Qwen3.8 27B فيأتي كأوزان تعرف Transformers وvLLM وSGLang بالفعل كيفية تقديمها، مع صيغة لاستدعاء الأدوات أتيحت للنظام البيئي الأوسع أشهرًا للتكيّف معها.
تختلف أجهزة النشر على المنوال نفسه. تشغل أوزان Kolibri بدقة FP8 نحو 78 غيغابايت، بحد أدنى من بطاقتَي A100 80 GB، أو وحدتَي H100 SXM5، أو واحدة H200، أو واحدة B200، أو واحدة B300. أما Qwen3.8 27B بدقة bfloat16 فوزنه نحو 54 غيغابايت، أي مسرّع واحد بسعة 80 غيغابايت بالدقة الكاملة، أو نسخة مكمَّمة على أقل من ذلك بكثير. يكلّف النموذج الألماني عتادًا أكثر ويعيد مقياس أداء أقل مقابله. ولا تكون هذه مقايضة سيئة إلا إذا كنت تشتري مقياس الأداء.
ما تخبرك به بطاقات الأسعار وما لا تخبرك به
ليس لـ Kolibri سعر، لأن Aleph Alpha لا تبيع الاستدلال الخاص به. الإصدار عبارة عن أوزان وتقرير تقني وبطاقة؛ لا يوجد SKU مُستضاف. أي رقم تكلفة لـ Kolibri هو حساب إطفاء لتكاليف العتاد تقوم به بنفسك.
Qwen3.8 متاح للعموم بثلاث فئات سعرية، والفئة الوسطى هي المهمة لفريق يقارن بين الاستضافة الذاتية والاستئجار.
• Qwen3.8-Max — 2.00 دولار لكل مليون رمز إدخال و6.00 دولار للإخراج، سياق يبلغ مليون رمز، قراءات الذاكرة المؤقتة بسعر 0.25 دولار، صدر في 3 أغسطس 2026.
• Qwen3.8-27B — 0.33 دولار للإدخال و2.40 دولار للإخراج، وسياق من 262,144 رمزًا، صدر في 13 أغسطس 2026. هذه أوزان مفتوحة، لذا فهذا هو السعر الذي تدفعه إذا كنت تفضّل عدم تشغيلها بنفسك.
• Qwen3.8-Flash — 0.15 دولارًا للإدخال و0.47 دولارًا للإخراج مع نافذة سياق تبلغ مليون رمز، صدر في 26 أغسطس 2026.
تلك هي أسعار القائمة من المزوّدين على OrcaRouter، تُمرَّر كما هي دون إضافة أي شيء لكل رمز، وهي السمة المفيدة عندما يكون السؤال هو ما إذا كان النشر المُستضاف ذاتيًا يغطي تكاليفه: يمكنك قياس حجم الرموز الفعلي لديك على الطبقات المستضافة قبل الالتزام بالعتاد. نحن لا نضيف هامش ربح، لذلك يصبح تخفيض سعر المورّد ساريًا لدينا في اليوم نفسه. جميع طبقات Qwen3.8 الثلاث قابلة للتوجيه اليوم عبر مفتاح واحد متوافق مع OpenAI مع تحويل تلقائي عند الفشل بين المزوّدين، ولدى Qwen3.8 القادم الذي يبلغ 2.4 تريليون معلمة صفحة كتالوج تنتظر الأوزان بدلًا من عنصر نائب يتظاهر بتقديمها.
Kolibri ليس قابلًا للتوجيه. لقد فحصنا الكتالوج تحت كل تهجئة للبائع والنموذج وهو غائب — لذا فإن الطريقة الوحيدة لاستدعائه هي تنزيل بحجم 78 GB. إذا أردت معرفة ما الذي سيكلفه النموذج الألماني لعبء عملك، فالإجابة هي رفّ وشخص يستطيع تشغيل vLLM، ولا يمكن لأي طرف ثالث حاليًا أن يقدم لك عرضًا لأي شيء آخر.

من يجب أن يشتري أيًا منها
لا يتوقف القرار على الجودة، لأن جدول المورّد نفسه قد حسم تلك المسألة لصالح علي بابا. بل يتوقف على المخاطرة التي تشتري تأمينًا ضدها.
• اختر Kolibri إذا كان القيد الملزم هو الاختصاص القضائي أو توثيق المصدر أو قابلية التدقيق — إذا كنت بحاجة إلى أن تكون قادرًا على الإجابة عن مصدر بيانات التدريب، وأين جرى تشغيل الحوسبة، وتحت أي قانون، وإذا كان عبء العمل يتمثل في مستندات ألمانية وإنجليزية تُعالَج داخل محيطك الخاص. أنت تدفع علاوة قدرات مقابل ذلك، وهذه العلاوة ظاهرة في الجدول أعلاه.
• اختر Qwen3.8 27B إذا كان القيد الحاسم هو القدرة مقابل التكلفة، أو اتساع نطاق اللغات، أو دعم المنظومة البيئية. فهو النموذج الأقوى وفق تقييم Aleph Alpha نفسه، وهو مرخّص بموجب رخصة Apache، ويعمل على مسرّع واحد، وتبدأ الفئات المستضافة من 0.33 دولار لكل مليون رمز إدخال إذا كنت تفضّل ألّا تشغّله بنفسك على الإطلاق.
• فكّر في كليهما ضمن البنية نفسها إذا كان عبء العمل يتضمّن نواة خاضعة للتنظيم ومحيطًا عامًا. الوثائق التي لا يمكنها مغادرة المبنى تذهب إلى نقطة نهاية Kolibri مستضافة ذاتيًا؛ أما أعمال التلخيص والترجمة والبرمجة فتذهب إلى طبقة Qwen3.8 الموجّهة بثلث سنت لكل ألف رمز. مفتاح API واحد، وقاعدة توجيه واحدة، وأسعار قوائم المزوّدين تُمرَّر كما هي، والتبديل الاحتياطي عند الفشل يُدار نيابةً عنك — وهذا ترتيب أكثر فائدة بكثير من اختيار أحدهما والتظاهر بأن الآخر غير موجود.
