بطاقة رئيسية تحريرية مُنشأة بعنوان "Ling-3.1-flash: مُعلَن، غير مفتوح" مع العنوان الفرعي "~560B إجمالي المعاملات · ~25B نشطة لكل رمز · حتى 1M سياق". ثلاث بطاقات مُوسَّمة تقرأ "الأوزان: لم تُشحن بعد"، "المقاييس: مُبلَّغ عنها من المورّد فقط" و"لا ترخيص · لا بطاقة نموذج · لا تنزيل".
Guides & Insights

Ling-3.1-flash مُعلَن عنه، وليس مفتوحًا: نحو 560 مليار معامل، وسياق بطول مليون توكن، ورسم بياني لم يُشغّله سوى Ant

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

وضع فريق Ling التابع لـ Ant Group أرقامًا لنموذجه التالي من الطبقة السريعة في 30 سبتمبر 2026، وقال في الوقت نفسه إنه لا يمكنك الحصول عليه بعد. Ling-3.1-flash هو نموذج خليط خبراء (mixture-of-experts) بنحو 560 مليار معامل، يفعّل حوالي 25 مليار معامل لكل رمز (token)، ويحمل نافذة سياق تصل إلى مليون رمز، وفقًا لإعلان النموذج الذي نشرته Ant من حسابها الخاص @AntLingAGI. الجملة التي تحدد هذا الإصدار هي التي تأتي بعد المواصفات: «نخطط لجعل النموذج مفتوح المصدر قريبًا». حتى اليوم لا يوجد مستودع Ling-3.1-flash على Hugging Face، ولا ترخيص، ولا ملف أوزان قابل للتنزيل، ولا تقييم من أي جهة خارج Ant Group. ما هو موجود هو مخطط معياري، وواجهة منتج حية، ووعد.

هذا التمييز هو القصة كلها، ويجدر أن نكون صريحين بشأنه، لأن التأطير الذي يصل إلى معظم الناس أولًا — إصدار مفتوح الأوزان من فئة 500B من الصين يقترب من الحدود التقنية — يصف شيئًا لم يحدث. Ling-3.1-flash ليس إصدارًا مفتوحًا. بل هو إصدار معلن. والاثنان ليسا متقاربين، والفجوة بينهما هي بالضبط الموضع الذي قد يُحرق فيه القارئ: إذا كنت تخطط للسعة، أو ترصد ميزانية لتجربة تجريبية، أو تكتب مذكرة شراء حول أوزان مفتوحة لا توجد بعد، فأنت تخطط استنادًا إلى بيان صحفي.

ما يحتويه الإعلان فعليًا

المنشور قصير والأرقام الواردة فيه محددة. يذكر Ant أن إجمالي عدد المعلمات يبلغ نحو 560 ملياراً مقابل نحو 25 ملياراً نشطة لكل رمز، أي نسبة تقارب 1 إلى 22، وأكثر كثافة بقليل من جيل Ling-3.0-flash الذي يخلفه — فهذا النموذج يعمل بإجمالي 124 ملياراً مقابل 5.1 مليار نشطة، أي نحو 1 إلى 24، في هيكل يقل حجمه عن الربع. ويُذكر السياق على أنه "حتى مليون رمز"، أي أربعة أضعاف نافذة 262,144 رمزاً التي تقدمها عائلة Ling-3.0-flash اليوم. وتُرفَق ثلاث درجات رئيسية: 1,673 Elo على GDPVal-AA v2.1، و75.16 على FrontierSWE، و65.35 على HealthBench Professional.

كل واحد من تلك الأرقام مُبلَّغ عنه من المورد، ومن الطرف الأول، وغير منشور بأي شكل يمكن لطرف ثالث إعادة تشغيله. لا توجد أداة تقييم، ولا مجموعة موجهات، ولا إعدادات تشغيل، ولا بذرة — وبشكل أكثر جوهرية، لا توجد أوزان لتشغيلها عليها. إذا كانت أرقام Ant صحيحة، فإن النموذج يقع في الطبقة العليا من إصدارات النماذج المفتوحة الصينية؛ لا توجد حاليًا طريقة لمعرفة ما إذا كانت صحيحة.

الرسم البياني، والتحذير الكامن فيه

Ant Group's own Ling-3.1-flash benchmark card, published from the @AntLingAGI account on 30 September 2026. Multi-panel bar charts compare Ling-3.1-flash against GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3 and GLM 5.3 Flash, and DeepSeek-V4.1-Flash across GDPval-AA v2.1 (1,673 Elo), tau-Banking, SkillsBench, Automationbench, Terminal-Bench 4.0, CyberGym, FrontierSWE (75.16), SWE Atlas Codebase QnA, Finance Agent v2, HealthBench Professional (65.35), DRACO and MultiChallenge. A footnote states that HealthBench Professional was evaluated in the AQ environment.

نشرت Ant نموذج Ling-3.1-flash إلى جانب بطاقة قياس أداء متعددة اللوحات تضعانه في مجال يضم نماذج رائدة وقريبة من الحدود القصوى: GPT-5.6 Sol، Claude Opus 5، وKimi K3، ومدخلين من عائلة GLM، وDeepSeek-V4.1-Flash. وعبر اللوحات، يستقر شريط Ling عند القمة أو قريبًا منها في مقاييس العمل الوكيلي والبرمجة، وفي منتصف المجموعة في المقاييس متعددة الجولات والخاصة بمجالات محددة. واقرأها على حقيقتها — اختيار المورّد نفسه للمهام، مأخوذًا من مجموعة تضم العمل الوكيلي العام، والبرمجة، ومهام القطاع المصرفي، والرعاية الصحية — وهي بطاقة تبدو ذات مصداقية.

انظر إلى مَن هم عليها، مع ذلك، وسيبرز أمر واحد. النماذج الحدودية النظيرة التي اختارها Ant هي GPT-5.6 Sol وClaude Opus 5. وقد أصبح هذان النموذجان الآن متأخرين بجيل كامل. أُطلق كل من Opus 5.5 وGPT-6 Sol في 22 سبتمبر 2026، في اليوم نفسه، وكلاهما قابلان للتوجيه اليوم. وأحدث النماذج التي لم يضعها Ant على البطاقة هي تحديدًا تلك التي قد يرغب القارئ في أن يُقاس النموذج مقابلها، وهي الشكوى نفسها التي ظهرت في الموجة الأولى من التعليقات على الإصدار — التمنّي بأن نموذجًا صادرًا في أكتوبر كان قد قيس مقابل طليعة أكتوبر لا طليعة يوليو. هذا ليس انتقاصًا من النموذج، الذي قد يصمد جيدًا. بل هو سبب للتعامل مع البطاقة كادعاء اتجاهي لا كحكم نهائي، وللإشارة إلى أن المقارنة التي اختارها Ant لا تجمّل النتيجة بقدر ما تجعلها تبدو قديمة.

حيث يمكنك لمسه، وحاشية واحدة غير مفسّرة

يوجد مكان واحد بالضبط يعمل فيه Ling-3.1-flash للمستخدم اليوم: منتج Ant نفسه. واجهة Ling Studio على ling.tbox.cn تُدرج Ling-3.1-flash في مُحدِّد الطرازات الخاص بها، ووصف التطبيق نفسه للنموذج أوسع من بطاقة المعيار — فهو يقدمه على أنه "وكلاء الأغراض العامة، والبحث، والعمل المكتبي الروتيني، وتطوير البرمجيات/الكود"، وهو التموضع المألوف لهذه الفئة: ليس أعمق مُستدِل في العائلة، بل ذلك الذي يُقصد استدعاؤه باستمرار وبتكلفة زهيدة.

يحمل ذلك السطح أيضًا أكثر تفاصيل الإصدار إحراجًا. تقول الحاشية الموجودة على بطاقة المعيار نفسها إن HealthBench Professional — رقم 65.35، أحد الأرقام الثلاثة في نص الإعلان — «تم تقييمه في بيئة AQ»، وتضيف أن قدرات Ling-3.1-flash في مجال الرعاية الصحية «لا يمكن تجربتها حاليًا إلا في AQ». لا شيء على البطاقة يشرح ما الذي تعنيه AQ، ولم نعثر على أي وثائق عامة تعرّفها. النتيجة الرئيسية المرفقة بمُحدِّد بيئة، حيث تكون البيئة غير مسمّاة، ليست نتيجة قابلة لإعادة الإنتاج؛ إنها عرض تجريبي للمنتج مع رقم بجانبه.

ما يمكن معرفته، وما لا يمكن

تصنيف هذا الإصدار في هاتين الفئتين هو أنفع ما يمكن للقارئ فعله به اليوم.

المعروف الآن: المعاملات، وعدد المعاملات النشطة، ونافذة السياق كما ذكرها المورّد؛ واختبارات الأداء الثلاثة الخاصة بالمورّد؛ ووجود النموذج في منتج Ant نفسه؛ ومجموعة المقارنة التي اختارتها Ant؛ وحقيقة أنه لم تُنشر أي أوزان أو ترخيص أو بطاقة نموذج؛ وحقيقة أن Artificial Analysis، التي قيّمت الجيل السابق بشكل مستقل، لا تملك صفحة خاصة بـ Ling-3.1-flash. وحتى لحظة كتابة هذه السطور، لم ينشر خط أنابيب التقييم المستقل الذي جعل رقم مؤشر Intelligence Index البالغ 20 نقطة الخاص بـ Ling-3.0-flash واضحًا أي شيء عن 3.1 على الإطلاق.

ما لا يمكن معرفته الآن: هل ستُفتح الأوزان فعلاً، وتحت أي رخصة؛ وهل المعمارية نسخة موسّعة من مكدس Ling-3.0 الهجين أم شيء جديد؛ وكم تبلغ تكلفة النموذج عبر واجهة Ant البرمجية، إن كان له سعر API على الإطلاق؛ وكيف يتصرف في السياق الطويل عملياً، على عكس كيفية تحديد النافذة؛ وما إذا كانت فجوات النتائج في الاختبارات المعيارية تصمد عندما يشغّل شخص ليس من Ant المهام نفسها. كل واحد من هذه سؤال يجيب عنه نموذج مُصدَر في اليوم الأول، ويجيب عنه نموذج مُعلَن عنه في يوم لاحق لم يُحدَّد موعده بعد.

Generated two-column information card. Left column headed "Knowable today" lists five cards: "~560B total / ~25B active (vendor)", "up to 1M-token context (vendor)", "1,673 Elo GDPval-AA v2.1 (vendor)", "available in Ant's Ling Studio only" and "no independent score exists". Right column headed "Not knowable" lists five cards: "whether the weights will open", "the licence terms", "API price per million tokens", "long-context behaviour in practice" and "whether the benchmark gaps hold".

كيف تقرأ يومًا كهذا

أصبح هذا النمط شائعًا بما يكفي لتسميته. يُطلق مختبر صيني ذو سجل حافل بطاقة نموذج ومخطط معايير مرجعية، فتحلّ الأرقام قرب الطليعة، ويتفاعل المجتمع مع الأرقام، ثم تصل الأوزان — أو لا تصل — بعد أسابيع. وقد نفّذ Ling-3.0-flash هذا السيناريو بالضبط هذا الصيف، ويجدر بنا تذكّر كيف انتهى: أعلنت Ant عنه في 24 يوليو 2026 بوصفه نموذجًا متاحًا عبر API فقط، من دون بيان ترخيص ودون معيار مرجعي مستقل، ولم تظهر الأوزان تحت رخصة MIT على Hugging Face حتى 7 أغسطس، أي بعد أسبوعين من الإعلان. أما Ling-3.1-flash فهو عند النقطة المكافئة في ذلك المسار في يومه الأول، مع فارق إضافي هو أن الوعد بالمصدر المفتوح هذه المرة صريح في الإعلان بدلًا من أن يكون مستنتجًا.

لا يوجد أي من النماذج التي اختارها Ant كنقاط مقارنة في كتالوجنا كموضوع للمقال — Ling-3.1-flash وLing-3.0-flash وLing-3.0-flash-VL كلها تُرجع not-found على كتالوج OrcaRouter اليوم، ولن نتظاهر بخلاف ذلك. لكن ثلاثة من النماذج النظيرة على ذلك المخطط قابلة للتوجيه الآن: Claude Opus 5، GPT-5.6 Sol، وDeepSeek-V4.1-Flash كلها تعمل خلف مفتاح واحد، بسعر قائمة المزوّد دون أي هامش ربح، مع تحويل تلقائي عند الفشل بينها. وهذا يهم أكثر مما يبدو في أسبوع مثل هذا، لأن الطريقة الصادقة لتقييم نموذج معلَن هي إجراء المقارنة التي يدعو إليها Ant — مقابل النماذج التي يمكنك استدعاؤها فعلاً — بينما لا يزال موضوع المقارنة مجرد مخطط.

عندما تصدر الأوزان، لن يكون السؤال المفيد هو ما إذا كانت Ling-3.1-flash قد تفوقت على Opus 5 في تصنيف Elo واحد. بل سيكون: هل يمكن لنموذج MoE بحجم ~560B وبعدد معلمات نشطة يقارب ~25B أن يستوعب سياقًا بطول 1M توكن بسعر يجعل هذا التناثر يستحق العناء، وهل الترخيص متسامح بما يكفي للاستضافة الذاتية. هذان هما السؤالان اللذان لا يجيب عنهما الإعلان، وهما الوحيدان اللذان سيحددان ما إذا كان هذا سيصبح نموذجًا يبني عليه الناس أم مجرد شريحة في العرض التقديمي التالي لشخص ما. في الوقت الراهن: الاسم حقيقي، والأرقام تخص Ant وحدها، والأوزان ما زالت مجرد جملة.

Generated horizontal timeline with four milestone nodes. "Jul 24, 2026 — Ling-3.0-flash announced, API-only, no weights, no licence"; "Aug 7, 2026 — MIT weights land on Hugging Face, 14 days later"; "Sep 30, 2026 — Ling-3.1-flash announced: ~560B, ~25B active, 1M context"; and a dashed open node reading "Weights: not yet — 'we plan to open-source soon'", captioned "the same point in the same arc, on day one".