
Ling-3.1-flash مقابل Ling-3.0-flash: ما الذي تغيّره فعلياً نافذة سياق بسعة 1M توكن ومعاملات أكثر بـ4.5 أضعاف؟
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 262 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- xAISpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
عائلة Ling التابعة لـ Ant Group لديها فئة سريعة جديدة، وهذه المرة لا يتجاوز عمرها جملة واحدة. أُعلِن عن Ling-3.1-flash في 30 سبتمبر — نحو 560 مليار معامل إجمالي، وحوالي 25 مليار معامل نشط لكل رمز، ونافذة سياق يُذكر أنها تصل إلى مليون رمز، وعبارة نمطية ملحقة: "نخطط لجعل النموذج مفتوح المصدر قريبًا." النموذج الذي يحل محله في صدارة الخط السريع، Ling-3.0-flash، هو نوع مختلف تمامًا بكل المقاييس: 124 مليار معامل إجمالي، و5.1 مليار معامل نشط لكل رمز، وسياق من 262,144 رمزًا، وأوزان مرخّصة تحت MIT على Hugging Face منذ 7 أغسطس، ومؤشر Artificial Analysis Intelligence Index المستقل بقيمة 20. أحد هذين النموذجين يمكنك تنزيله اليوم. والآخر يمكنك القراءة عنه. إن مقارنتهما مفيدة حقًا، لكن فقط إذا بدأت المقارنة من هناك.
الحساب الرئيسي سهل ومضلل قليلاً. إن Ling-3.1-flash يعادل حوالي 4.5× إجمالي عدد معاملات Ling-3.0-flash وحوالي 4.9× عدد المعاملات النشطة — 25B مقابل 5.1B لكل رمز. القراءة العابرة تقول "نموذج أكبر بكثير، وبالتالي نموذج أذكى بكثير". لكن القراءة الأكثر دقة هي أن Ant حافظت تقريباً على نسبة التخلخل أثناء توسيع الجسم، وما يمنحك إياه ذلك هو السعة، وليس بالضرورة عمق الاستدلال لكل رمز: النموذج الذي يوجه 25B من أصل 560B عبر كل رمز يقوم بعمل أكثر لكل رمز من نموذج يوجه 5.1B، لكنه يدفع أيضاً حوالي خمسة أضعاف الحوسبة لكل رمز للقيام بذلك. وأين تستقر هذه المقايضة يعتمد كلياً على ما إذا كانت بنية Ant تتعامل مع المعاملات الإضافية بكفاءة — وهذا سؤال لا يجيب عليه الإعلان.
المodelان، جنبًا إلى جنب
ضع الحقائق المنشورة جنبًا إلى جنب، وستنفصل الأجيال بوضوح. يذكر كل سطر أدناه ما نشرته Ant أو مقيّم مستقل فعليًا؛ وحيثما يغيب رقم، فإنه يغيب لأن لا أحد قد نشره.
• إجمالي المعاملات — Ling-3.1-flash: ~560B (المورّد). Ling-3.0-flash: 124B (بطاقة النموذج).
• المعلمات النشطة لكل توكن — Ling-3.1-flash: ~25 مليار (المورّد). Ling-3.0-flash: 5.1 مليار (بطاقة النموذج).
• نافذة السياق — Ling-3.1-flash: حتى {{1}}مليون رمز{{/1}} (المورّد). Ling-3.0-flash: {{2}}256 ألف{{/2}} أصلي، ويُقدَّم عند 262,144 (بطاقة النموذج ووصفات الاستدلال).
• الأوزان والترخيص — Ling-3.1-flash: غير منشورة؛ لا مستودع، ولا ترخيص (تم التحقق في 30 سبتمبر ومرة أخرى في 1 أكتوبر 2026). Ling-3.0-flash: MIT، متاحة على Hugging Face باسم inclusionAI/Ling-3.0-flash وعلى ModelScope منذ 7 أغسطس 2026.
• صيغ الأوزان — Ling-3.1-flash: لا يوجد أي منها متاح. Ling-3.0-flash: BF16 (~255GB) وFP8 (~128GB) من المختبر، بالإضافة إلى تكميمات المجتمع.
• مصدر نتائج المعيار — Ling-3.1-flash: مُبلَّغ عنه بالكامل من المورّد، ولا توجد أداة اختبار عامة، ولا أوزان لإعادة التشغيل. Ling-3.0-flash: قيّمته Artificial Analysis بشكل مستقل عند درجة 20 على Intelligence Index، مع نشر سرعة الإخراج وحجم توليد الرموز المقاسين إلى جانب ذلك.
• التوفر — Ling-3.1-flash: في منتج Ling Studio الخاص بـ Ant فقط. Ling-3.0-flash: قابل للاستضافة الذاتية، بالإضافة إلى إمكانية استدعائه عبر واجهة API الخاصة بالمطورين من Ant.

ما الغرض المحتمل من السعة الإضافية
إنّ وصف Ant نفسه، المكوّن من سطر واحد، لـ Ling-3.1-flash هو أكثر المحتوى إفادةً في الإصدار. يسوّقه تطبيق Ling Studio على أنه موجَّه إلى «وكلاء الأغراض العامة، والبحث، والأعمال المكتبية الروتينية، وتطوير البرمجيات/الكود» — أي تأطير قائم على العمل المكتبي والوكلاء، وليس تأطيرًا مرتبطًا بمقاييس الاستدلال. وهذا متسق مع طريقة تنظيم العائلة: Ling هو خط النصوص والأدوات للأغراض العامة، وRing هو خط الاستدلال، ويتولى Ming تعدد الوسائط. وقد شغل Ling-3.0-flash الموضع نفسه قبل جيل واحد، وكان صراحةً الفئة السريعة والرخيصة وليس الطراز الرائد.
اقرأ التوسّع في هذا الضوء وسيصبح منطقيًا. أعباء العمل الوكيلية والتي تعتمد على استدعاء الأدوات طويلة ومتكررة وشرهة للسياق: حلقة وكيل واحدة يمكن أن تستهلك عشرات الآلاف من الرموز من مخرجات الأدوات المتراكمة قبل أن تتخذ إجراءً، لذا فإن نافذة بمليون رمز تُعدّ متطلبًا وظيفيًا لا زخرفة في ورقة المواصفات. توسيع العدد الإجمالي للمعاملات مع الإبقاء على نسبة نشطة كبيرة هو كيف تضيف معرفة بالعالم وعمقًا في اتباع التعليمات إلى نموذج لا يزال عليه أن يكون سريعًا بما يكفي ليجلس داخل حلقة. لا يبني Ant هنا طرازًا رائدًا أبطأ وأذكى؛ بل يبني طبقة سريعة أكبر.
الحجة المقابلة هي التكلفة، وهي الحساب نفسه قادمًا من الاتجاه المعاكس. السعة الإضافية ليست مجانية عند الاستدلال — بل تُدفع تكلفتها مع كل رمز، ولم تنشر Ant أي سعر لـ Ling-3.1-flash على الإطلاق: لا قائمة أسعار API، ولا خصم على التخزين المؤقت، ولا شيء يُقارَن بـ $0.075/$0.22 لكل مليون رمز يسردها الجيل السابق. هذا هو الرقم المفقود الذي سيحسم هذه المقارنة، وهو مفقود.
اختبارات الأداء المعيارية، ومن أجراها
يأتي Ling-3.1-flash بثلاث نتائج تبدو قوية عند النظر إليها منفردة: 1,673 Elo على GDPVal-AA v2.1، و75.16 على FrontierSWE، و65.35 على HealthBench Professional. الثلاث جميعها من Ant نفسها، مأخوذة من الإعلان، ولم يُعِد أي مختبر خارجي إنتاج أي منها. والنتيجة العملية هي أنه يمكن مقارنتها بأرقام بائعين آخرين، لكن ليس بأرقام مستقلة — كما أن مؤشر الذكاء البالغ 20 نقطة لدى Artificial Analysis الخاص بـ Ling-3.0-flash هو رقم مستقل على مقياس مختلف، لذا فإن وضع الرقمين جنبًا إلى جنب سيكون مقارنة قياس بادّعاء. لا توجد صفحة لـ Ling-3.1-flash على Artificial Analysis في وقت كتابة هذه السطور.
هناك حاشية واحدة في مخطط Ant نفسه تستحق الإشارة إليها بحد ذاتها. تذكر البطاقة أن نتيجة HealthBench Professional قد جرى تقييمها في «بيئة AQ»، وأن قدرات Ling-3.1-flash في مجال الرعاية الصحية لا يمكن تجربتها حاليًا إلا داخل AQ. لا توجد وثائق عامة تشرح ما هو AQ. والنتيجة الرئيسية التي تحمل محددًا بيئيًا غير مسمى ليست شيئًا يستطيع فريق خارجي إعادة إنتاجه، حتى بعد توفر الأوزان.
أيّ واحد يجب أن نستخدمه فعليًا هذا الأسبوع؟
تُحلّ مسألة الأجيال بشكل مختلف تبعًا لما تحتاجه اليوم، وبالنسبة للجميع تقريبًا، فإن الإجابة الآن ليست الطراز الأحدث.
إذا كنت بحاجة إلى تشغيل شيء ما هذا الأسبوع، فإن Ling-3.0-flash هو الوحيد بين الاثنين الموجود بشكل قابل للاستخدام: أوزان MIT يمكنك استضافتها ذاتيًا، وFP8 إذا أردت مساحة أصغر، وتسعير API من الطرف الأول منشور، ودرجة مستقلة تخبرك بما ستحصل عليه. إنه نموذج جيد حقًا في فئته — وضعته المستقل على حدود Pareto لنماذج الأوزان المفتوحة من حيث الذكاء مقابل إجمالي المعاملات، ومنح سرعته تقييمًا عاليًا، مع التحفظ بأنه مطوّل بشكل غير معتاد وولّد نحو 260 مليون توكن أثناء تقييمه، مقابل وسيط قريب من 100 مليون.
إذا كنت تخطط للستة أشهر القادمة، فإن Ling-3.1-flash هو الاتجاه الذي تسير إليه الأمور، وليس مكوّنًا بعد. الأمور المحددة التي ينبغي متابعتها قبل أن يصبح كذلك: ما إذا كانت الأوزان ستُفتح فعلاً وتحت أي ترخيص، وما إذا كانت نافذة الخدمة هي بحق 1M أم امتدادًا لسياق أصلي أقصر، وما تكلفته لكل مليون توكن، وما إذا كان مختبر مستقل يعيد إنتاج 75.16 على FrontierSWE. أي من هذه الأمور إذا تحقق سيكون سببًا لإعادة إجراء المقارنة. لم يتحقق أي منها.

أين يندرج هذا في مكدس التوجيه
لا يوجد أي من نماذج Ling في كتالوجنا اليوم — Ling-3.0-flash وLing-3.0-flash-VL وLing-3.1-flash جميعها تُرجع not-found مقابل واجهة OrcaRouter API للنماذج، لذا فإن الإجابة الصادقة عن سؤال "هل يمكنني استدعاؤه من خلالكم" هي لا، في الوقت الحالي. ما تكون طبقة التوجيه جيدة فيه حقًا في أسبوع مثل هذا هو النصف الآخر من المشكلة: النماذج التي ستقيس مرشحًا مقابلها. Claude Opus 5، وGPT-5.6 Sol وDeepSeek-V4.1-Flash كلها مسارات نشطة بسعر المزوّد المعلن دون أي هامش ربح، والموجّه الذي يحتفظ بها خلف مفتاح واحد مع تجاوز الفشل التلقائي هو كيف تُبقي منصة تقييم موجهة نحو هدف متحرك دون الحفاظ على أربعة تكاملات. وعندما تصل أوزان Ling-3.1-flash ويصبح الترخيص مقروءًا، فإن هذا أيضًا شكل القرار: أضف نقطة نهاية واحدة، لا تعد بناء المكدس.
الملخّص الجيلي قصير. إنّ Ling-3.0-flash نموذج مُطلَق فعليًا، ومُقيَّم بشكل مستقل، ومرخَّص بترخيص متساهل، ويمكن استضافته ذاتيًا اليوم. أمّا Ling-3.1-flash فهو وعدٌ أكبر، وبسياقٍ أطول، وأكثر تكلفةً في التشغيل، ولم تُسلّمه Ant بعد بأي شكلٍ يمكن للمطوّر استخدامه. إنّ التعامل مع الثاني على أنه ترقيةٌ للأول هو الخطأ الذي يدعو إليه هذا الإصدار، والأرقام لا تدعمه بعد.

