ساعة رملية على قاعدة نموذج فارغة — لم يتم إصدار أوزان Qwen3.8-27B، لذا لا يمكن وجود أي واجهة برمجة تطبيقات مجانية.
Guides & Insights

واجهة برمجة تطبيقات Qwen 3.8 27B المجانية: ليست متاحة بعد — ماذا تشغّل بدلاً منها

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

لا — حتى 12 أغسطس 2026، لا توجد واجهة برمجة تطبيقات مجانية لـ Qwen3.8-27B، ولا توجد مدفوعة أيضًا. تم الإعلان عن النموذج في 3 أغسطس مع وعود بإتاحة الأوزان مفتوحة المصدر على Hugging Face وModelScope "خلال أسبوع 10 أغسطس"، لكن منظمة Qwen الرسمية لا تزال لا تملك مستودع Qwen3.8. وإلى أن تُطرح الأوزان، لا يمكن لأي جهة استضافة Qwen3.8-27B، لذا فـ"المجاني" غير وارد. إليك الطرق الثلاث للحصول عليه مجانًا بمجرد صدور الأوزان (وما تكلفه كل واحدة فعلًا)، بالإضافة إلى النماذج التي يمكنك تشغيلها مجانًا محليًا اليوم.

لا توجد واجهة برمجة تطبيقات مجانية بعد — الأوزان هي البوابة

أعلنت Alibaba عن عائلة Qwen3.8 في 3 أغسطس 2026: نموذج Qwen3.8-Max (2.4 تريليون معامل، حوالي 95 مليار معامل نشط، سياق مليون رمز، بسعر 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج على Alibaba Cloud Model Studio) والنموذج الكثيف أحادي الجهاز Qwen3.8-27B. وقد وُعد بطرح كليهما بأوزان مفتوحة على Hugging Face وModelScope في نفس الأسبوع.

هذا الوعد تأخر الآن لمدة يومين. لقد راجعت Hugging Face مباشرة في 12 أغسطس: منظمة Qwe​n الرسمية لا تمتلك أي مستودع لـ Qwen3.8 من أي نوع. المستودعات Qwen3.8-27B-GGUF و-FP8 و-NVFP4A16 و-NInfer التي تظهر في بحث النماذج هي بطاقات مؤقتة — بلا أي ملفات أوزان، وعدد تنزيلات من خانة واحدة، وبطاقات نماذج تقرأ حرفيًا "محجوزة قبل إصدار Qwe​n/Qwen3.8-27B." لا تعتبر هذه دليلًا على وجود النموذج؛ عاملها كأشخاص يحجزون أماكن لانتظار السيارات.

هناك أمران لا يمكنك افتراضهما. أولًا، الترخيص: لم يُذكر أي ترخيص لـ Qwen3.8-27B. وقد صدرت الأوزان المفتوحة الأخيرة لـ Qwen بموجب ترخيص Tongyi Qianwen، الذي يتضمن بندًا بشأن 100 مليون مستخدم نشط شهريًا يُفعّل محادثات الترخيص التجاري على نطاق واسع — لذا فإن Apache 2.0 ليس خيارًا افتراضيًا آمنًا. ثانيًا، المواصفات: لم تنشر Alibaba أي جدول قياس أداء، أو نافذة سياق، أو متطلبات أجهزة مؤكدة لنسخة 27B. كل ما يُكرر عنها اليوم هو مجرد تخمين.

لقد غطّينا قائمة التحقق قبل الإصدار — ما هو مؤكد، وما هو مجرد شائعة، وما يجب التحقق منه قبل التنزيل — في مقال Qwen3.8-27B Open Weights: What We Know Before the Drop. هذا المقال هو الجزء الذي لم يغطّه ذلك المقال: كيف سيعمل "مجاني" فعليًا بمجرد صدور النموذج.

بعد سقوط الأثقال: ثلاثة طرق نحو الحرية، وما يكلفه كل طريق حقًا

"مجاني" ليس مجانيًا أبدًا. جميع الطرق الثلاث للحصول على Qwen3.8-27B مجانًا تنقل التكلفة إلى مكانٍ ما؛ الفرق هو أين تستقر التكلفة. نموذج 27B هو نموذج كثيف — فكل واحد من معلماته البالغة ~27 مليارًا يكون نشطًا على كل توكن — لذا فإن التكاليف أدناه تتعلق بعتاد حقيقي، وليست تسويقًا.

Three routes to a free Qwen3.8-27B API after the weights drop: run it yourself, a hosted free tier, or OrcaRouter's planned free tier — and the real cost of each.

المسار الأول: شغّله بنفسك — مجاني بالمال، مكلف بالعتاد

الطريق الوحيد الذي تتحقق فيه كلمة "مجانية" حرفيًا بعد شراء العتاد. يتوقع دانيال هان، المؤسس المشارك لـ Unsloth، أن يعمل نموذج 27B بحوالي 17GB من ذاكرة VRAM عند الإصدار — هدف وليس مواصفة نهائية. وباستخدام سلم التكميم المُقاس لنموذج Qwen3.6-27B كمرجع: يقع Q4_K_M حول 16GB، وQ6_K حول 21GB، وFP8 حول 27GB، وBF16 الكامل حول 54–56GB. الحد الأدنى الواقعي اليوم هو بطاقة بسعة 24GB — RTX 3090 أو RTX 4090 أو فئة A6000 — بجودة Q4.

التوقيت مهم: الأوزان الرسمية مع vLLM أو SGLang تعمل عادةً خلال أيام من الطرح، لكن عمليات التكميم المجتمعية GGUF وAWQ تتأخر من أسبوع إلى أسبوعين، لذا فإن أسلوب "السحب والتشغيل" على غرار Ollama لن يكون موجودًا في يوم الإصدار. التكاليف الخفية هي الكهرباء، وجهاز هادئ، ووقتك. المكسب هو الخصوصية — لا شيء يغادر جهازك — وتكلفة حدية صفرية تتراكم إذا استخدمت GPU لنماذج أخرى أيضًا.

المسار ٢: المستويات المجانية المستضافة — مجانية ماديًا، لكن ثمنها القيود

بمجرد نشر الأوزان، توقع حصة تقييم من Alibaba Cloud وطبقات مجانية من مضيفي serverless المعتادين. النمط المنتظر هو ما تتبعه Alibaba بالفعل مع Qwen3.8-Max: حصة مستخدم جديد تبلغ 1M توكن، بمنطقة سنغافورة فقط، صالحة لمدة 90 يومًا، دون ترحيل — وتُحتسب توكنات الاستدلال كإخراج، لذا فإن النموذج الذي يستدل بشكل افتراضي قد يستهلك الحصة كاملة في عطلة نهاية أسبوع من النماذج الأولية. ما تدفعه فعليًا هو حدود المعدل، وقفل إقليمي، وتاريخ انتهاء، ووصول استفساراتك إلى طرف ثالث. الطبقة المجانية هي مدخل لتقييم النموذج، وليست مكانًا لنشره.

المسار 3: الطبقة المجانية لـOrcaRouter — مخطط لها، غير مفعّلة بعد

نظرًا لأن استعلام البحث هو حرفيًا "free"، سنكون صريحين: تخطط OrcaRouter لتقديم طبقة مجانية لـ Qwen3.8-27B بمجرد إصدار الأوزان. هذا غير متاح حاليًا. لا يوجد نقطة نهاية للاتصال بها، ولن ألصق مثالًا placeholder. سنعلن عن ذلك عندما يكون هناك شيء للإعلان عنه. ما نستضيفه اليوم هو Qwen3.8-Max بسعر 2$ / 6$ لكل 1M توكن بدون أي زيادة — و27B ليس على المنصة، لأنه لا يمكن لأحد تقديمه بعد.

ما يمكنك استخدامه مجانًا الآن

إذا كانت حاجتك هي "نموذج مفتوح من فئة 27B يمكنني تشغيله دون أن أدفع"، فلست بحاجة إلى الانتظار. الإجابة الصادقة من نفس المستوى هي Qwen3.6-27B، وهو السلف المباشر للنموذج الذي تنتظره.

Comparison of Qwen3.6-27B and Nemotron 3.5 Lightning 30B A3B, which you can run free today, against Qwen3.8-27B, which is not yet released.

Qwen3.6-27B مرخّص بموجب رخصة Apache 2.0، وهو نموذج كثيف بحجم 27.8 مليار معامل، مع سياق يبلغ 262 ألف رمز، ويدعم إدخال النصوص والصور والفيديو بشكل أصلي. يبلغ حجم ملف Q4_K_M بصيغة GGUF حوالي 16.5 جيجابايت، ويعمل بسرعة تبلغ نحو 25 رمزًا في الثانية على وحدة معالجة رسومية استهلاكية بسعة 24 جيجابايت (16–18 رمزًا في الثانية على M4 Max). الأرقام المذكورة من بطاقة النموذج حسب ما أعلنه البائع: SWE-Bench Verified 77.2، وMMLU-Pro 86.2، وAIME 2026 94.1، وGPQA Diamond 87.8، وMMMU 82.9. إذا كان Qwen3.8-27B هو "نموذج 27B"، فهذا هو نموذج 27B الذي يمكنك الوصول إليه فعليًا اليوم — نفس العائلة، نفس التصميم الكثيف، ومفتوح بالفعل.

Nemotron 3.5 Lightning 30B A3Bهو شكل مختلف، وهو مجاني أيضًا: صدر في 11 أغسطس 2026 بموجب ترخيص OpenMDW 1.1 من NVIDIA. إنه نموذج خليط خبراء بإجمالي 30B و~3B نشطة، ببنية Mamba-2 هجينة وسياق يصل إلى 1M — نقاط تفتيش NVFP4 تبلغ حوالي 21.6GB وإصدار Q4 GGUF حوالي 25GB. يحتاج إلى بطاقة بسعة 24GB+، لأن جميع المعاملات الثلاثين مليارًا توجد في الذاكرة، رغم أن حوالي 3 مليارات فقط تُنشَّط لكل رمز. تشير التقارير الأولى إلى سرعته بحوالي 45 رمزًا في الثانية على GPU واحدة. وهو مصمم لطبقة تنفيذ الوكلاء — استدعاء الأدوات، والتحقق، والتنسيق — وليس للاستدلال المتقدم. إذا كان عبء عملك أعمال وكلاء روتينية عالية الحجم، فيمكنه التفوق على نموذج كثيف 27B في عملك الفعلي.

{{1}}وإذا كان ما تريده تحديدًا اليوم هو واجهة برمجية مستضافة مجانية بدلًا من التثبيت المحلي، فإن "المجاني" الوحيد الصادق هو حصة Alibaba's Qwen3.8-Max: مليون توكن، منطقة سنغافورة، 90 يومًا. {{2}}إنه ليس الإصدار 27B، وهو بدل تجريبي وليس خدمة — {{3}}استخدمه لتجربة سلوك Qwen3.8 الآن، ثم انتقل. {{4}}

عندما تكون هذه النصيحة خاطئة

إذا كنت تمتلك بالفعل بطاقة رسومات بسعة 24 جيجابايت أو أكثر، فإنّ إطار "الانتظار للحصول على مستويات مجانية" خاطئ بالنسبة لك. في اليوم الذي تُطرح فيه الأوزان، ستكون vLLM على الأوزان الرسمية هي مستواك المجاني؛ وستكون تنتظر وسائل راحة لا تحتاجها. انتظر أسبوعين تقريبًا فقط إذا كنت تريد تحديدًا سلم القياس الكمي GGUF المُحسَّن.

إذا كنت تبني نموذجًا أوليًا استنادًا إلى عقد API، الحصص المجانية المستضافة (بمجرد أن تحصل عليها 27B) قد تكون أقل تكلفة من وقتك — حتى مع انتهاء الصلاحية بعد 90 يومًا وتقييد المنطقة، فإن استئجار جهاز GPU لمدة أسبوع من النمذجة الأولية عادةً ما يكون الخيار الأكثر تكلفة.

إذا تبين أن الترخيص هو Tongyi Qianwen بدلاً من Apache،فإن «الأوزان الحرة» لن تعني حرية التسويق التجاري فوق عتبة 100 مليون مستخدم نشط شهرياً. اقرأ ملف LICENSE في المستودع الفعلي قبل أن تبني أي شيء عليه — فهذه هي الطريقة الأكثر شيوعاً التي تتحول بها «الأوزان الحرة المفتوحة» إلى فاتورة.

وإذا أخرت Alibaba الموعد مرة أخرى — فقد مضى يومان بالفعل على المهلة الموعودة — فكل أسبوع يمر يجعل Qwen3.6-27B هو الخيار الصحيح بدلاً من الحل المؤقت.

A timeline from announcement to free local run of Qwen3.8-27B.

خلاصة القول

لا توجد واجهة برمجة تطبيقات (API) مجانية لـ Qwen3.8-27B لأن Qwen3.8-27B غير متوفر في أي مكان. عندما يتم إصدار الأوزان، تكون المسارات المجانية الثلاثة هي: الاستضافة الذاتية (تدفع مقابلها بالأجهزة)، والطبقات المجانية المستضافة (تدفع مقابلها بالقيود)، والطبقة المجانية المخطط لها من OrcaRouter — وهي غير مفعّلة بعد، وسنوضح ذلك عندما تُفعَّل. اليوم، أقرب خيار مجاني هو Qwen3.6-27B على أجهزتك الخاصة. الانتظار لا يكلفك شيئًا سوى 27B؛ أما تشغيل الإصدار السابق فلا يكلفك شيئًا سوى وحدة معالجة رسومية (GPU) يمكنك استغلالها في كل شيء آخر خلال هذه الأثناء.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا