
Ling-3.1-flash مقابل Gemini 3.8 Flash: نموذج تجريبي بسعة 256K ضد نموذج حي بسعة مليون رمز
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 219 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 117 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 41 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
ضع Ling-3.1-flash وGemini 3.8 Flash جنبًا إلى جنب، فتكون المقارنة لا تتعلق بالذكاء — بل بالحالة. إن Ling-3.1-flash، وهو مزيج خبراء بنحو 560 مليار معامل تابع لـ Ant Group أُعلن عنه في 29–30 سبتمبر 2026، هو تجربة مجانية لمدة أسبوعين بسياق مُتاح بحجم 256K، وحد إخراج 32,768 رمزًا، وإدخال نصي فقط، ولا أوزان أو ترخيص أو سعر منشورة. أما Gemini 3.8 Flash، نموذج الاستدلال من فئة Flash من Google الذي صدر في 2 سبتمبر 2026، فهو API متاح للعموم بنافذة كاملة تبلغ 1,048,576 رمزًا، وإخراج 65,536 رمزًا، وإدخال متعدد الوسائط، وبطاقة أسعار عامة. على الورق، هذه مقارنة بين نموذجين؛ أما عمليًا، فهي مقارنة بين نموذج يمكنك البناء عليه اليوم وآخر لا يمكنك سوى اختباره هذا الشهر.
هذا ليس سببًا لاستبعاد Ling-3.1-flash. نموذج MoE مجاني بحجم 560B ذو نزعة وكيلية يستحق أسبوعين من وقت تقييم أي شخص. لكنه يغيّر الغرض من المقارنة المباشرة: فليس السؤال «أيّهما ينبغي أن أعتمده كمعيار؟»، بل «هل النموذج التجريبي جيد بما يكفي لأتحوّط بشأن الإجابة بعد خمسة عشر يومًا من الآن؟». هذان سؤالان مختلفان، ولهما إجابتان مختلفتان على كل محور أدناه.
الأمور الثلاثة التي تحسم الأمر قبل أن يحسمه أي اختبار قياسي
تبدأ معظم المقارنات بالنتائج. أما هذه المقارنة فينبغي أن تبدأ بالتوفر، لأن الفجوة هناك ليست مسألة درجات.
• التسعير — Ling-3.1-flash مجاني طوال مدة تجربته، وليس له إطلاقًا جدول أسعار منشور بعد انتهاء التجربة. يُدرج Gemini 3.8 Flash بسعر 0.75 دولار لكل مليون رمز إدخال و3.75 دولار لكل مليون رمز إخراج خلال فترته الترويجية، ثم يعود إلى 1.50 / 7.50 دولار في 1 يناير 2027. أسعار قائمة حسب ما أبلغ به المزوّد؛ وكلاهما عرضة للتغيير.
• السياق — يوفّر Ling-3.1-flash 262,144 رمزًا في النسخة التجريبية، مع الإشارة إلى 1,000,000 كهدف نهائي. أما Gemini 3.8 Flash فيوفّر اليوم كامل 1,048,576 رمزًا. إذا كان عبء العمل لديك يعتمد على نافذة المليون رمز، فواحد فقط من هذين الاثنين يمتلكها الآن.
• الأوزان — لا توجد لـ Ling-3.1-flash أي أوزان منشورة: لا مستودع، ولا رخصة، ولا checkpoint، فقط نية معلنة لجعله مفتوح المصدر بعد التجربة. أما Gemini 3.8 Flash فهو مغلق وسيبقى كذلك دائمًا، لكنه API مُدار يمكنك استدعاؤه دون غموض اليوم.
إذا قُرئت معًا، فإن تلك الثلاثة تشكل نقطة واحدة: مزايا نموذج Ling الرئيسية إما ترويجية (مجانية) أو مستقبلية (سياق 1M، أوزان مفتوحة)، بينما مزايا نموذج Gemini تعاقدية. هذا التفاوت يتخلل كل ما يلي.
أين يتفوق نموذج Ling حقًا
مكانان، وكلاهما حقيقي.
العامل الأول هو التكلفة أثناء التقييم. إن تجربة مجانية لمدة أسبوعين على نموذج بهذا الحجم ليست حيلة تسويقية يمكن تجاهلها — بل هي أرخص طريقة لاكتشاف ما إذا كان نموذج 560B القائم على خليط الخبراء يتعامل مع مطالباتك. Gemini 3.8 Flash، أيا كان سعره، ليس مجانيًا، والتقييم الجدي عبر بضعة آلاف من الاستدعاءات يكلّف أموالًا حقيقية.
المسار الثاني هو مسار الانفتاح. إن Ling-3.1-flash هو خليفة نموذج سبق أن أصدر أوزانًا مرخّصة بموجب MIT، وقد صرّحت Ant علنًا بأنها تعتزم جعل هذا النموذج مفتوح المصدر أيضًا. وإذا صدر ذلك برخصة متساهلة، فستحصل على شيء لا يستطيع Gemini 3.8 Flash تقديمه أبدًا: خيار الاستضافة الذاتية، أو الضبط الدقيق، أو تقطير نموذج أساسي بحجم 560B. لكن العقبة هي الأكثر أهمية: أنت تراهن على وعد، ووعد الجيل السابق أُوفي به بعد تأخير أسبوعين، وليس ضمانًا.
حيث لا يقترب Gemini 3.8 Flash من الخسارة
إذا استبعدنا التجربة ومسألة الانفتاح، فإن المقارنة التشغيلية تميل بشكل حاد لصالح Google.
• المدخلات — يستقبل Gemini 3.8 Flash النص والصورة والفيديو والصوت. أما Ling-3.1-flash فيستقبل النص ويعيد النص. وبالنسبة لسير العمل المعتمد على المستندات أو لقطات الشاشة أو الفيديو، فهذا ليس تفضيلًا، بل حدّ من حدود القدرات.
• سقف الإخراج — 65,536 رمزًا مقابل 32,768. ذو صلة في اللحظة التي تُنشئ فيها تقارير أو ملفات شيفرة أو مخرجات منظّمة طويلة في تمريرة واحدة.
• الإنتاجية — تشير الاختبارات المستقلة إلى أن السرعة الوسيطة للإخراج لدى Gemini 3.8 Flash تبلغ نحو 249 توكنًا في الثانية، بينما تُظهر بيانات القياس عن بُعد الخاصة بـ OrcaRouter على مدى سبعة أيام قياس 552 توكنًا في الثانية عند p50 البالغ 4.95 ثانية حتى أول توكن. وقد أُفيد بأن الاستضافة التجريبية لـ Ling-3.1-flash تبلغ نحو 63 توكنًا في الثانية. إن نموذج Gemini ينتمي إلى فئة سرعة مختلفة.
• عمق المرجع — لدى Gemini 3.8 Flash مجموعة من القياسات المستقلة خلفه؛ أما أرقام Ling-3.1-flash فكلها من الطرف الأول، على نقطة نهاية جديدة تمامًا، ولم يُعِد أي طرف ثالث تشغيلها بعد.
• وكلاء متعددو الوسائط — أي شيء يتعين عليه قراءة لقطة شاشة، أو ملف PDF، أو مكالمة مسجّلة هو مهمة Gemini بحكم التكوين، لا بحكم الجودة.

المعايير المرجعية، ولماذا لا يمكن فعليًا مقارنة المجموعتين
الطرح الذي يورده المورّد بشأن Ling-3.1-flash هو نتيجة إجمالية تبلغ 81.0 عبر خمسة اختبارات مرجعية للوكلاء، بواقع 40.4% على Terminal-Bench 4.0، و55.9% على SWE-Atlas، و65.35% على HealthBench Professional؛ ويضيف تقرير Ant نفسه 1,673 نقطة Elo على GDPVal-AA v2.1 و75.16 على FrontierSWE. كل واحد من تلك القياسات هو قياس خاص بـ Ant. لا توجد أداة تقييم منشورة، والأهم من ذلك، لا توجد أوزان كي يعيد أي شخص تشغيل المجموعة عليها.
صورة Gemini 3.8 Flash مختلفة نوعيًا. على إصدار Intelligence Index الحالي من Artificial Analysis (v4.3.2)، يسجل 40.9 عند جهد الاستدلال العالي، و39.8 عند المتوسط، و33.5 عند المنخفض — ومن الجدير بالتنبيه أن المؤشر قد جرى تنقيحه مؤخرًا، لذا فإن الأرقام المنشورة عن هذا النموذج في وقت سابق من الخريف حُسبت وفق إصدار مختلف وليست قابلة للمقارنة مباشرة بهذه. وتتضمن ادعاءات Google الخاصة بهذا النموذج 54.9 على HLE-Verified ونتائج قوية على Terminal-Bench 2.1 في الثمانينيات العليا. أرقام مستقلة وأرقام المورّد، جنبًا إلى جنب، وكلاهما مشروع، ولا يمكن استبدال أحدهما بالآخر.
هناك مقارنة متقاطعة واحدة نظيفة تستحق أن تُجرى، لأن كليهما يندرجان ضمن العائلة نفسها من المعايير. على Terminal-Bench 4.0، الرقم الذي أعلنته الشركة المصنّعة لـ Ling-3.1-flash هو 40.4%. أما Claude Sonnet 5.5 — وهو نموذج من الفئة المتوسطة، وليس نموذجًا رائدًا — فيسجّل 70.6% على الإصدار نفسه. هذا الصف الواحد هو أقوى حجة ضد قراءة بطاقة Ant على أنها "على تخوم الطليعة": فالنموذج منافس في القياسات الوكيلية التي اختارت Ant إبرازها، ومتأخر بوضوح في قياس البرمجة الطرفية حيث يوجد رقم خارجي.

الشكل العملي للخيار
إذا كنت بحاجة إلى بناء شيء ما خلال الأسبوعين المقبلين، فالإجابة ليست متقاربة، وهذا ليس انتقاصًا من Ling-3.1-flash. Gemini 3.8 Flash هو الوحيد من بين الاثنين الذي يمنحك نقطة نهاية مستقرة، وسعرًا منشورًا، ونافذة كاملة بمليون رمز، وإدخالًا متعدد الوسائط، وترخيصًا يمكنك قراءته. إنه نموذج إنتاجي من فئة Flash.
Ling-3.1-flash هو هدف تقييم. تكمن قيمته الآن في أن التقييم مجاني والنموذج مثير للاهتمام: نموذج MoE بحجم 560B مع حوالي 25B فقط نشطة لكل رمز هو رهان على التخلخل، وقد وضعته Ant تحديدًا لأعباء عمل الوكيل والبحث وأتمتة المكاتب التي تتنافس عليها نماذج Flash-tier. تشغيل مطالباتك الخاصة من خلاله خلال نافذة التجربة يستحق العناء تحديدًا لأن لا أحد خارج Ant قد فعل ذلك بعد — ستكون من بين أول من يملك رأيًا غير تابع للبائع.
شجرة القرار المنطقية هذا الشهر: وجّه الإنتاج إلى Gemini 3.8 Flash، واستغل التجربة المجانية في تشغيل Ling-3.1-flash على أصعب مطالباتك، واعتبر مسألة الأوزان المفتوحة هي المفترق الحقيقي. إذا وصلت الأوزان برخصة متساهلة واستقر السعر قرب فئة Flash، يصبح Ling-3.1-flash خيارًا ثانيًا حقيقيًا — يمكنك استضافته ذاتيًا، وهو أمر لن يكون ممكنًا مع Gemini أبدًا. وإذا وصلت بشروط مقيّدة، تنتهي التجربة وتنتهي معها المقارنة.
تشغيل كليهما من مفتاح واحد، والصراحة بشأن ما هو مفقود
Gemini 3.8 Flash موجود على كتالوج OrcaRouter اليوم تحت معرّف الطراز google/gemini-3.8-flash، بسعر قائمة Google نفسه دون أي هامش ربح — لذا عندما يعود السعر الترويجي في يناير، فإن السعر الذي تدفعه هنا يتتبعه تلقائيًا بدلًا من الحاجة إلى عقد جديد. ويقع DeepSeek-V4.1-Flash، النموذج الرخيص الآخر من فئة Flash الذي يستحق القياس في التجربة نفسها، على الكتالوج نفسه بسعر قائمة مزوّده، لذا فإن اختبارًا ثلاثيًا للنموذج التجريبي مقابل خيارات فئة Flash الراسخة يعمل عبر مفتاح API واحد مع تجاوز فشل تلقائي بينها.
Ling-3.1-flash ليس في كتالوجنا، ويعيد الاستعلام عبر واجهة برمجة تطبيقات النماذج العامة لدينا نتيجة «غير موجود» له وللجيل السابق — لذا فالصياغة الصادقة هي أن التجربة تعمل حيث تعمل، من خلال واجهة المورّد الخاصة ومنصات استدلال تابعة لجهات خارجية، ولا ندّعي أننا نستضيفه. وهذا هو الجزء من هذه المقارنة الذي قد يتغير بأسرع وتيرة: فنموذج في تجربة مجانية بسعر غير معلن هو بالضبط نوع الأشياء التي تصل إلى طبقة توجيه بمجرد أن ينشر Ant ومضيفوه قائمة أسعار، والتمرير دون هامش ربح يعني أنه في اليوم الذي يحدث فيه ذلك، يكون السعر هنا هو السعر هناك.
إذن، الحكم أضيق مما توحي به أعداد المعاملات. إنّ Ling-3.1-flash هو النموذج الأكثر طموحًا والنتيجة البحثية الأكثر إثارة للاهتمام؛ أما Gemini 3.8 Flash فهو الذي يمكنك الاعتماد عليه للإطلاق. وإلى أن يتوفر ترخيص وسعر، فهذا هو الفرق كله — وهو فرق لا يحسمه صف واحد في جدول مقارنات.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
