
Ling-3.1-flash متاح الآن ومجاني لمدة أسبوعين: ما الذي يقدمه 560B MoE فعليًا
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 219 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 117 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 41 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
Ling-3.1-flash، نموذج مزيج الخبراء ذو نحو 560 مليار معامل الذي أعلن عنه مختبر inclusionAI التابع لـ Ant Group في 29 و30 سبتمبر 2026، لم يعد بيانًا صحفيًا هذا الأسبوع: فهو الآن يستجيب للطلبات عبر واجهة API تجارية حية. ويعمل النموذج كتجربة مجانية لمدة أسبوعين على بوابة استدلال تابعة لطرف ثالث، ويظهر أيضًا في منتج Ling Studio الخاص بـ Ant — ما ينقل السؤال من "هل هو موجود" إلى "ما الذي يقدّمه فعليًا". والإجابة أضيق مما توحي به الأرقام الرئيسية. Ling-3.1-flash نصي إدخالًا ونصي إخراجًا؛ ويتيح سياقًا من 262,144 رمزًا (256K) رغم أن الإعلان يذكر 1M كهدف نهائي؛ ويقتصر إخراجه على 32,768 رمزًا؛ ولم ينشر أحد السعر الذي ستدفعه في اليوم الخامس عشر، حين تُغلق النافذة المجانية ويُفترض أن تصدر الأوزان بعدها.
هذه الفجوة بين بطاقة الإعلان ونقطة النهاية الحية هي الشيء المفيد الذي يجب التمسك به، لأن معظم التغطية لهذا الإصدار تقرأ المواصفات كما لو أن النموذج يطلقها اليوم. وهو ليس كذلك. Ling-3.1-flash هو النموذج الثاني من هذا المختبر خلال ثلاثة أشهر يصل مصنفًا كما يصنفه المتتبع المستقل LLM Releases بصراحة تحت "الأوزان غير المنشورة"، والفرق بين ما تقول Ant إن النموذج عليه وما يمكن للمطور استدعاؤه الآن هو حيث يمكن لميزانية أو مشروع تجريبي أن يخطئ بهدوء.
ما الذي تغيّر بين الإعلان واليوم؟
كان الإعلان نفسه منشورًا مواصفاتيًا: ~560 مليار معامل إجمالي، ~25 مليار نشط لكل رمز، حتى 1 مليون رمز من السياق، ثلاثة أرقام تقييم رئيسية، ووعد — "نخطط لإتاحة النموذج مفتوح المصدر قريبًا". لم يتغير أي من ذلك. ما تغير هو التوفر. خلال يوم واحد من الإعلان، كان النموذج متاحًا على حافة تجارية، وتكشف النسخة التجريبية المجانية عن نفس نقطة النهاية الحقيقية التي ستوفرها نسخة مدفوعة: نفس واجهة API، نفس النمط النصي فقط، نفس مفتاح وضع التفكير للعمل الوكيلي طويل المدى.
بالنسبة لأي شخص يحاول أن يقرر ما إذا كان سيستثمر وقتًا هندسيًا في هذا الأمر، فإن التجربة هي القصة كاملة هذا الأسبوع، وهي سلاح ذو حدين. الاستدلال المجاني لمدة أسبوعين وسيلة رخيصة حقًا لرؤية كيف يتصرف النموذج مع مطالباتك الخاصة — وهو أمر نادر لنموذج بهذا الحجم. لكن المجانية حالة ترويجية، وليست سعرًا. لا توجد حتى الآن أي قائمة أسعار منشورة لما بعد التجربة الخاصة بـ Ling-3.1-flash في أي مكان، لذا فإن أي نموذج تكلفة تبنيه على الطبقة المجانية ليس سوى بديل مؤقت إلى أن يضع Ant والجهات المضيفة له أرقامًا عليه.
ورقة المواصفات، والأرقام الثلاثة التي لا تزال وعودًا
• المعاملات — 560 مليار إجمالًا، و~25 مليار نشطة لكل توكن. بحسب ما ذكره المورّد، وهي نحو أربعة أضعاف الجيل السابق البالغ 124 مليارًا إجمالًا / 5.1 مليار نشطة. تظل نسبة التخلخل قرب 1 من 22، لذا ليس التنشيط أنحف بدرجة هائلة — إنما النموذج أكبر بكثير من النموذج الذي يخلفه.
• السياق — يُقدَّم اليوم عند 262,144 رمزًا. عبارة "حتى 1M" هي الهدف بمجرد تفعيل النافذة؛ وهي ليست ما تمنحه لك نقطة النهاية التجريبية، وهي أكثر ما يُساء فهمه شيوعًا في هذا الإصدار.
• الإخراج — 32,768 رمزًا كحد أقصى. معقول لحلقات الوكيل، وضيّق إذا كنت تنوي إنشاء مستندات طويلة في تمريرة واحدة.
• الوسائط — إدخال نصي، إخراج نصي. هذا نموذج نصي. الرؤية والصوت وإدخال الملفات ليست جزءًا من الإطلاق، ولم يُحدد لها موعد بعد.
• الاستدلال — مكدس هجين مزوّد بمفتاح صريح لوضع التفكير، وهو النمط نفسه الذي استخدمه الجيل السابق، وموجّه إلى عمل الوكلاء متعدد الخطوات واستدعاء الأدوات بدلًا من الدردشة أحادية الدور.
• الأوزان والترخيص — لم يُنشرا. هذا هو الرقم الأكثر أهمية، وهو الرقم الذي لا توجد له أي قيمة على الإطلاق حتى الآن: لا يوجد مستودع على Hugging Face، ولا نص ترخيص، ولا نقطة تحقق قابلة للتنزيل حتى تاريخ اليوم.

بطاقة المعيار، تُقرأ مع الخصم الذي تحتاجه
يضع تقرير Ant نفسه نموذج Ling-3.1-flash عند إجمالي 81.0 عبر خمسة معايير للوكلاء، بنسبة 40.4% في Terminal-Bench 4.0، و55.9% في SWE-Atlas، و65.35% في HealthBench Professional؛ ويضيف حساب الشركة نفسه 1,673 إيلو في GDPVal-AA v2.1 و75.16 في FrontierSWE. كل رقم من هذه الأرقام مصدره الطرف الأول. لا توجد أداة اختبار، ولا مجموعة مطالبات، ولا أوزان ليتمكن أي شخص آخر من إعادة تشغيل المجموعة، وهو التحفظ المعتاد لنموذج في هذه المرحلة — وهنا يجدر القول بوضوح: درجة بائع غير معاد إنتاجها هي ادعاء حول نموذج، وليست قياسًا له.
البطاقة مفيدة أيضًا بطريقة ربما لم يقصدها مؤلفوها. نتيجة 40.4% في Terminal-Bench 4.0 تقع متأخرة كثيرًا عن الطبقة الرائدة؛ إذ تسجل Claude Sonnet 5.5، وهو نموذج متوسط الوزن لا طراز رائد، 70.6% على الإصدار نفسه من ذلك المعيار. القراءة الأمينة ليست أن Ling-3.1-flash ضعيف — فـ40.4% رقم محترم في فئة الوكلاء الطرفيين لنموذج مُوجَّه نحو التكلفة — بل إن صياغة "قريب من الحدود الرائدة في المعايير الرئيسية" التي انتشرت على وسائل التواصل يوم الإعلان لا تصمد عند مواجهة الصفوف المحددة. المعيار الذي يبدو فيه النموذج الأقوى، HealthBench Professional عند 65.35، هو أيضًا المعيار الذي يحمل الحاشية المحرجة: تذكر Ant أنه تم تقييمه في بيئة تسميها AQ وأن قدرة النموذج في الرعاية الصحية "لا يمكن تجربتها حاليًا إلا في AQ"، دون تعريف AQ في أي مكان عام. النتيجة العنوانية المرفقة ببيئة غير مسماة هي عرض توضيحي، لا نتيجة قابلة للتكرار.
لماذا يُعدّ وصول نموذج كبير في صورة نسخة تجريبية هو الخبر الفعلي
الحركة الأكثر إثارة للاهتمام هنا هي التسلسل، وليس المعاملات. فقد انتقل Ling-3.0-flash مباشرة إلى أوزان مفتوحة. أما هذا النموذج فيصل بالتجربة أولًا، مع حجب الأوزان والرخصة والتسعير الرسمي جميعها، والتزام علني بالمصدر المفتوح فقط بعد انتهاء الفترة المجانية. هذا كتاب إطلاق تجاري يرتدي ثوب إعلان عن نموذج مفتوح، وهو تغيير حقيقي يستحق التتبع: إذا وصلت الأوزان بموجب رخصة متساهلة، فسيحصل المجتمع على نموذج أساسي بحجم 560 مليار معلمة لضبطه الدقيق وتقطيره؛ وإذا وصلت بشروط تجارية مرتبطة بها، فستكون تجربة الأسبوعين هي المنتج، وستكون عبارة "المصدر المفتوح" تسويقًا. وفي كلتا الحالتين، يقع الخيار داخل نافذة التجربة، وهو الشيء الذي يجب مراقبته بدلًا من أي صف منفرد في اختبارات الأداء.
أين يعمل، والصورة الصادقة للتوجيه
في الوقت الحالي، يمكن الوصول إلى Ling-3.1-flash عبر واجهة منتج المورّد الخاصة وعبر منصات استدلال تابعة لأطراف ثالثة تشغّل النسخة التجريبية — وهذا كل ما في الأمر. وهو ليس ضمن كتالوج OrcaRouter اليوم؛ إن البحث في واجهة API العامة للنماذج لدينا عن Ling-3.1-flash، وLing-3.0-flash، وLing-3.0 vision variant يعيد جميعها نتيجة «not-found»، ولن نتظاهر بغير ذلك. وعندما يصل أحد نقاط نهاية Ant فعلاً إلى التوافر العام بسعر قائمة منشور، فإن نموذج التمرير الذي يعمل به OrcaRouter — حيث يُمرَّر سعر قائمة المزوّد دون أي هامش ربح، بحيث يصبح أي تخفيض من المورّد ساريًا لدينا في اليوم نفسه — هو بالضبط الترتيب الذي يناسب نموذجًا لا يزال تسعيره غير مكتوب.
ما يمكنك فعله اليوم، دون انتظار قرار الترخيص، هو إجراء المقارنة التي تهم فعلاً بشأن نموذج غير مُثبت: قياسه مقابل نماذج فئة Flash التي يمكنك استدعاؤها الآن. Gemini 3.8 Flash وDeepSeek-V4.1-Flash كلاهما في كتالوجنا بأسعار قائمة مزوّديهما، عبر مفتاح API واحد، مع تجاوز فشل تلقائي بينهما. بالنسبة لنموذج في فترة تجريبية مجانية، أوزانه وبطاقة أسعاره كلاهما غير معروف، فهذه هي الطريقة العقلانية للاحتفاظ به — مرشح إضافي يمكنك التوجيه إليه ما دامت التجربة مستمرة، ومسار إنتاج لا يعتمد على ما يحدث في اليوم الخامس عشر.

ماذا تفعل هذا الأسبوع
إذا كان هذا النموذج ذا صلة بعملك، فإن التجربة هي سبب التحرك الآن بدل انتظار حسم مسألة الأوزان المفتوحة — أسبوعان من الاستدلال المجاني على نموذج MoE بحجم 560B هما أرخص تقييم ستحصل عليه، وإجابة سؤال "هل يصمد مع مطالباتي؟" متاحة اليوم، حتى وإن لم تكن إجابة سؤال "هل يمكنني استضافته ذاتيًا؟" متاحة بعد. ثلاثة أشياء يجب التحقق منها طالما أن النافذة مفتوحة، بالترتيب:
• شغّل عبء العمل الخاص بك، لا بطاقة القياس المرجعي. الأرقام المنشورة هي اختيار Ant من المهام؛ مطالباتك هي التي تحدد حزمتك التقنية.
• اختبر السياق الذي ستستخدمه فعليًا. نقطة النهاية تخدم 262,144 رمزًا، وليس 1M. إذا كان تصميمك يعتمد على النافذة الأكبر، فأنت تصمم بناءً على وعد.
• لا تبنِ نموذج تكلفة على "المجاني". فالمجاني حالة تدوم أسبوعين. وإلى أن تُنشر بطاقة أسعار، خطّط للعودة إلى نموذج Flash-tier المُسعّر كخيار افتراضي، وتعامل مع Ling-3.1-flash كسعة إضافية.
الإعلان حقيقي والنموذج يعمل، وهذا أكثر مما كان يمكن قوله قبل أسبوع. لكن كون النموذج مُصدَرًا ومفتوحًا وكونه يعمل تجريبيًا حالتان مختلفتان، وهذه الحالة هي الثانية بشكل قاطع — مواصفة 560B، ونقطة نهاية 256K، وبطاقة قياس خاصة بالمورّد فقط، ومهلة أسبوعين هي الموعد النهائي الصارم الوحيد في الإصدار بأكمله.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
