
LongCat-2.5-Preview مقابل Qwen3.8-Max: بسُبع السعر ودون أي حضور على لوحة النتائج
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 610 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 189 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
طرحت Meituan LongCat-2.5-Previewعلى منصتها للـ API في 25 سبتمبر 2026، مع إدخال في سجل التغييرات وبطاقة أسعار، ومن دون أي اختبار أداء من أي نوع — ثم سعّرته بنحو سُبع ما Qwen3.8-Maxيتقاضاه مقابل الاستدعاء نفسه. وهذه ليست فجوة صغيرة، ولا فجوة آمنة. إن Qwen3.8-Max، الطراز الرائد للمزوّد، متاح على نحو عام منذ 3 أغسطس 2026، ويحمل تصنيفًا مستقلًا من Artificial Analysis، وينشر لقطة مؤرخة يمكنك تثبيتها بالاسم، ويتقاضى 6.7 ضعفًا مقابل الإدخال و5 أضعاف مقابل الإخراج. والسؤال الذي يجب أن تجيب عنه هذه المقارنة ليس أيّ النموذجين أفضل — فلا أحد خارج Meituan في موقع يسمح له بالإجابة عن ذلك بعد. بل هو: ما الذي تشتريه مقابل هذا الفارق، وهل يستحق الفارق أن تشتريه.
ما الذي نشرته كل جهة فعليًا
ابدأ بالمصدر، لأنه هو ما يفصل بين هذين بشكل أكثر حدة مما تفعله أي مقاييس أداء.
ظهر LongCat-2.5-Preview مع إدخال مؤرخ في سجل التغييرات الخاص بـ Meituan — كلمات البائع: "الإصدار: 2026-09-25 — LongCat-2.5-Preview متاح الآن" — صفحة تسعير تدرجه كنموذج الدفع حسب الاستخدام الحالي للمنصة، ودليل بدء سريع يغطي كلا تنسيقي الاتصال. يصف حساب Meituan الخاص على X النموذج بأنه "1.6 تريليون معامل. ~48 مليار نشط. نافذة سياق بحجم 1 مليون رمز. متعدد الوسائط أصلاً." بعد ذلك، لا يوجد شيء للقراءة. لا يوجد مستودع في meituan-longcat مؤسسة Hugging Face يغطي هذا النموذج — أحدث مستودع للمؤسسة هو LongCat-Flash-Lite-Sparse، من 31 يوليو — وكتالوج نماذج OpenCode، الذي يقدمه، يسجله كـ مغلق الأوزان. لا بطاقة نموذج، ولا تقرير تقني، ولا ترخيص، ولا جدول معاملات نشره البائع، ولا تقييم مستقل في أي مكان: اعتبارًا من 27 سبتمبر لا توجد صفحة لـ LongCat-2.5-Preview على Artificial Analysis.
Qwen3.8-Max هي الحالة المعاكسة في كل الجوانب تقريبًا. أصبح متاحًا عمومًا في 3 أغسطس 2026 مع بطاقة أسعار منشورة، وأطلقت علي بابا تحديثًا مسمّى، Qwen3.8-Max-0902، في 2 سبتمبر. تقيسه Artificial Analysis: مؤشر الذكاء 45.4، في المرتبة 15 من 145 نموذجًا، ومؤشر البرمجة 76.2، في المرتبة 9 من 138. وسجّل GPQA Diamond 92.8%، وHumanity's Last Exam 43.1%، وSciCode 52.1%، وLong-Context Recall 80.3%، وTerminal-Bench 2.1 بنسبة 88.8%، وτ-bench banking بنسبة 47.8%. هذا نموذج مقيس ولديه دليل على كل رقم.
إذن، الخلاصة الأمينة لعمود الأدلة مختلّة التوازن على نحو لا علاقة له بالقدرة. أحد هذين النموذجين يمكن تقييمه قبل أن تلتزم به. أما الآخر فلا سبيل إلا إلى تجربته.
بطاقة الأسعار، سطرًا بسطر
كلاهما نموذجان بمليون توكن ولهما السقف نفسه للمخرجات، لذا تتقارب أوراق المواصفات تمامًا حيث تكون ورقة المواصفات أقل فائدة:
• إدخال غير مخزّن مؤقتًا — LongCat-2.5-Preview 0.30 دولار لكل مليون مقابل Qwen3.8-Max 2.00 دولار لكل مليون، بفارق 6.7×.
• الإدخال المخزَّن مؤقتًا — 0.006$ لكل مليون مقابل 0.25$ لكل مليون، بفارق 41.7×.
• الإخراج — $1.20 لكل 1M مقابل $6.00 لكل 1M، فارق 5×.
• نافذة السياق — 1,048,576 توكن مقابل 1,000,000 توكن. عمليًا تعادل.
• الحد الأقصى للإخراج — 131,072 رمزًا في كليهما. متطابقان.
• تقييم مستقل — لا يوجد منشور مقابل AA Intelligence 45.4 وAA Coding 76.2.
كل رقم يخص LongCat هناك يأتي من صفحة التسعير الخاصة بـ Meituan نفسها، وتسمّي الصفحة العمود بأكمله «السعر المخفّض (لفترة محدودة)». أرقام Qwen3.8-Max هي سعر القائمة لدى Alibaba، مستخرجة من بطاقة النموذج الخاصة بنا، مع قراءة من الذاكرة المؤقتة بسعر 0.25 دولار لكل مليون، وكتابة إلى الذاكرة المؤقتة بسعر 2.50 دولار لكل مليون. لقطة Artificial Analysis مؤرخة في 2 سبتمبر 2026.
سطر الإدخال المُخزَّن مؤقتًا هو الذي يستحق التحديق. إن فرق 42× في قراءات الذاكرة المؤقتة هو أكبر رقم منفرد في هذه المقارنة، وهو يقع على البُعد الذي تعتمد عليه أحمال عمل الوكلاء فعليًا. حلقة الوكيل التي تعيد إرسال توجيه نظام ومخطط أدوات بحجم 100,000 توكن في كل دور تدفع سعر الإدخال المُخزَّن مؤقتًا مقابل معظم توكناتها، لا السعر المعلن للإدخال.
استدعاء بـ150,000 رمز، مسعّر بكلا الطريقتين
خذ طلبًا معقولًا على شكل وكيل: 150,000 رمز إدخال، يُخدَّم 50,000 منها من ذاكرة التخزين المؤقت، وإجابة من 4,000 رمز. بسعر Meituan المخفّض، تكلّف تلك الاستدعاء 0.0501 دولار. وبسعر القائمة لدى Qwen3.8-Max، تكلّف الاستدعاء نفسه 0.3365 دولار — أي أكثر بمقدار 6.7×، أو 50 دولارًا مقابل 337 دولارًا لألف استدعاء في اليوم. إذا جعلت المزيج مخزَّنًا بالكامل في ذاكرة التخزين المؤقت، وهو الوضع المستقر لمطالبة متكررة، فإن النسبة تتسع إلى 12.3×: 0.006 دولار مقابل 0.074 دولار لكل استدعاء.
لا شيء في تلك الحسابات يعتمد على أن يكون LongCat-2.5-Preview جيدًا. وهذه هي المشكلة بالضبط. المضاعف المعروض عليك حقيقي، والكلمة المرفقة به على صفحة البائع نفسه هي "لفترة محدودة"، بلا تاريخ انتهاء ولا سعر معلن لخليفته. خصم بنسبة 6.7× بلا تاريخ انتهاء منشور هو بند ميزانية لا يمكنك وضعه في خطة؛ إنه بند ميزانية تراقبه.
هناك أيضًا عدم تماثل في التوجيه جدير بأن يُقال بوضوح. Qwen3.8-Max هو مسار نقدّمه — qwen/qwen3.8-max والنسخة المثبّتة qwen/qwen3.8-max-0902 — لدى علي بابا سعر القائمة دون أي هامش ربح، لذا فإن أي تغيير في سعر المورّد يصل إلى جهتنا في اليوم نفسه بدلًا من بعد أسابيع. LongCat-2.5-Preview ليس أحد مساراتنا، ولن نتظاهر بغير ذلك؛ في الجانب الأرخص من هذه المقارنة، أنت تتعامل مع واجهة Meituan API الخاصة بها وأي منصة تصل إليها عبرها.
الادعاء الوحيد الذي تناقضه واجهة برمجة التطبيقات الخاصة بـ Meituan نفسها
هذا هو الاستنتاج الذي ينبغي أن يحسم المقارنة لأي شخص لا يقتصر عبء عمله على النص الخالص.
تُدرج قائمة تغييرات Meituan فهم الصور بوصفه الإضافة الأبرز في الجيل 2.5: "الفهم متعدد الوسائط: قدرة جديدة على فهم الصور، قادرة على تحليل محتوى الصورة، وتدعم الأسئلة والأجوبة عبر الوسائط المختلفة، وتلخيص المحتوى، والاستدلال البصري المعقّد." ويقول منشور X إنه "متعدد الوسائط بطبيعته." هذه ادعاءات من الجهة المورّدة، وكان من المعقول في حد ذاتها أن تُدرَج في قرار ما.
ثم ينشر موقع التوثيق نفسه مثال الاستجابة لاسترداد بيانات التعريف الخاصة بذلك النموذج نفسه، والنموذج الذي يعيده نصي فقط. وبالنسبة إلى المعرّف "LongCat-2.5-Preview"، تُظهر الحمولة context_length: 1048576، input_modalities: ["text"]، output_modalities: ["text"]، وسلسلة الوسائط text->text. لا يوجد إدخال صورة. ليس في لقطة قديمة — بل في المثال العملي على الصفحة التي توثّق نقطة النهاية.
![A screenshot of Meituan's LongCat API documentation for the model-retrieval endpoint, showing the worked example response for 'LongCat-2.5-Preview': context_length 1048576, input_modalities ["text"], output_modalities ["text"] and modality "text->text". The word 'text' is visible in red against the grey page.](https://cms.orcarouter.ai/api/media/file/2-1349.png)
هذا لا يثبت أن النموذج لا يستطيع الرؤية. إنه يثبت أن المورّد لم يوائم نصه المكتوب مع مخطط API الخاص به، ويعني أن المشتري لا يمكنه أن يفوتر حمل عمل رؤية استنادًا إلى جملة سجل التغييرات تلك حتى يحسمها أحد. ضع ذلك إلى جانب الجانب الآخر: يدرج كتالوجنا Qwen3.8-Max بوصفه يقبل إدخال النص والصورة والفيديو، مع كون الرؤية ضمن قدراته المعلنة، ويقف خلف النموذج جدول معايير مرجعية مستقل. إذا كانت مهمتك فهم المستندات، أو فرز لقطات الشاشة، أو تحليل إطارات الفيديو، فإن العمود المُكلف هو الذي تكون فيه طريقة الإدخال مُتحقَّقًا منها، والعمود الرخيص هو الذي تكون فيه طريقة الإدخال غير محسومة. هذا الصف الواحد يمكن أن يمحو كامل 6.7×.
ما لا يمكن تثبيت المعاينة إليه
تُصدر علي بابا لقطات مؤرخة. qwen/qwen3.8-max-0902 هو إصدار مُسمّى ومُجمَّد بسعر 2$/6$ نفسه الخاص بالنموذج الأساسي، ما يعني أن أي قاعدة توجيه تُسمّيه ستظل تُعيد الأوزان نفسها الشهر المقبل. أما تغييرات السلوك فتأتي في صورة معرّف جديد يمكنك تبنّيه وفق جدولك الزمني الخاص.
ليس لدى LongCat-2.5-Preview معرّف كهذا. معرّف النموذج هو معرّف المعاينة، فلا توجد لاحقة لقطة، ولا سجل إصدارات على المنصة، ولا مدخل في سجل التغييرات يخبرك بأن الأوزان تغيّرت — فقط أن الخصم "لفترة محدودة". إنه إصدار معاينة بالمعنى المعتاد: يُسمح للشيء الذي تحت الاسم أن يتغير، وستكتشف ذلك من مخرجاتك لا من ملاحظة إصدار.
أرخص طريقة لشراء الدليل المفقود هي النافذة التي فتحها {{1}}Meituan{{/1}} على الجانب الآخر من هذا: يُدرج {{2}}OpenCode{{/2}} {{3}}LongCat-2.5-Preview{{/3}} كمجاني لفترة محدودة، مع التزام المزوّد بسياسة عدم الاحتفاظ وعدم التدريب على بياناتك، وقال في 26 سبتمبر إن النافذة تستمر أسبوعين. إدخال مجاني، وإخراج مجاني، وقراءات ذاكرة تخزين مؤقت مجانية. هذه طريقة مشروعة لبناء جدول المعايير الذي لم ينشره أحد — شغّل مجموعة التقييم الخاصة بك عليه، وسيكون لديك رقم حيث أعطاك المورّد جملة. لكنها ليست سعرًا يمكنك التخطيط على أساسه: تنتهي الأسبوعان، والرقم على الجانب الآخر منه متروك لـ {{4}}Meituan{{/4}} لتحدده.
من الذي يجب أن يختار ماذا
اختر Qwen3.8-Max عندما يكون عبء العمل هو السبب الأساسي الذي يدفعك لشراء النموذج من الأساس. إذا كانت المدخلات صورًا أو فيديو، أو إذا كان يجب أن تكون الإجابة قابلة لإعادة الإنتاج من إصدار إلى إصدار، أو إذا كان وجود مؤشر مستقل شرطًا من شروط الشراء، أو إذا كانت المهمة من نوع البرمجة الوكيلية التي يمثل Terminal-Bench وCoding Index وكيلين عنها، فإن 6.7× هو ثمن القدرة على التحقق من عملك. وعلى أحد المفاتيح، يقع أيضًا خلف سلسلة احتياطية، بحيث يمكن لنموذج مُقيَّم أن يمتص يومًا سيئًا للنموذج غير المُقيَّم من دون أن تشغّل تكاملين.

استعن بـ LongCat-2.5-Preview عندما يكون عبء العمل ضخم الحجم، وقصير السياق، ونصيًا فقط، وداخليًا — التصنيف والاستخراج والتلخيص وإعادة الصياغة بالجملة — وعندما تكون تكلفة الخطأ إعادة محاولة بدلًا من عميل. على هذا النحو، فإن بند الإدخال المخزّن مؤقتًا ليس خصمًا، بل هو الاقتصاد الكامل للمهمة، و42× رقم يستحق عناء قياسه. استخدم النافذة المجانية لإنتاج المعيار المرجعي غير الموجود. لا ترحّل مسارًا حرجًا إليه.
ما الذي سيغيّر هذا الحكم، بترتيب الأهمية: تقييم مستقل لـ LongCat-2.5-Preview؛ تاريخ انتهاء منشور وسعر يخلف الخصم؛ سجل إصدارات يتضمن لقطات مؤرخة؛ وحسم ما إذا كانت قائمة الوسائط نصية فقط أم لا. أيٌّ من هذه وحده يجعل عمود الخيار الأرخص أكثر من مجرد خصم. وإلى أن يتحقق واحد منها على الأقل، فإن هذه المقارنة ليست مواجهة بين نموذجين — بل مواجهة بين سعر يمكنك التحقق منه وقدرة لا يمكنك التحقق منها.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
