
LongCat-2.5-Preview مقابل GLM-5.2: نافذتان بسعة مليون رمز، إحداهما مُثبَتة بالقياس
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 610 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 189 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
LongCat-2.5-Preview وGLM-5.2يحملان الرقم الرئيسي نفسه: نافذة سياق تبلغ مليون توكن. هذه المصادفة الوحيدة هي التي تؤدي كل العمل في معظم المقارنات التي تُكتب هذا الأسبوع، وهي لا تكفي للمقارنة بين نموذجين. GLM-5.2 موثّق علنًا منذ 16 يونيو 2026 بملف قياس أداء عام، وبطاقة أسعار منشورة، ودرجة استدعاء للسياق الطويل من مُقيّم مستقل. ظهر LongCat-2.5-Preview على منصة LongCat API Platform التابعة لـ Meituan في 25 سبتمبر 2026 ببطاقة أسعار مخفّضة، وعدد معاملات أوردته تغطية تجارية صينية، ومن دون أي قياس أداء منشور من أي نوع. إحدى النافذتين مقيسة. والأخرى مُدّعاة. كل ما يلي يبقي هاتين الفئتين منفصلتين، لأن ورقة المواصفات ونتيجة اختبار ليستا من النوع نفسه من الحقائق.
هذه هي النسخة الصادقة من المواجهة، وهي أكثر فائدة من النسخة المجاملة.
ما الذي نشرته كل جهة فعليًا
يتضمّن سجل تغييرات Meituan مدخلًا مؤرّخًا — "الإصدار: 2026-09-25، LongCat-2.5-Preview متاح الآن" — يسرد ثلاث قدرات مزعومة: فهم الصور، والبرمجة، والتوافق مع "Claude Code وبيئات التطوير السائدة الأخرى"، ويذكر Hermes وOpenClaw وOpenCode وKilo Code. وتذكر صفحة التسعير الخاصة بالمورّد سعر الدفع حسب الاستخدام البالغ 0.30 دولار لكل مليون رمز إدخال غير مخزّن مؤقتًا، و0.006 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، و1.20 دولار لكل مليون رمز إخراج، وقد أُشير في الصفحة نفسها إلى أنه خصم لفترة محدودة. نافذة السياق مليون رمز، والحد الأقصى للإخراج 131,072. وتأتي أرقام ما يقارب 1.6 تريليون معامل إجمالي، مع نحو 48 مليار معامل نشط لكل رمز، على بنية خليط الخبراء، من بيانات موقع Meituan الوصفية ومن تغطية تجارية صينية للإدراج — لا من توثيق API. ولم يرافق أيًّا من ذلك تقرير تقني أو بطاقة نموذج أو جدول معايير. لا يوجد مستودع LongCat-2.5-Preview على HuggingFace، ولا مستودع بهذا الاسم في مؤسسة Meituan على GitHub؛ وبيانات كتالوج النماذج التي تُشحن مع OpenCode تسجّل الأوزان المفتوحة على أنها false.

يحتل GLM-5.2 من Z.ai الموقع المعاكس. إنه إصدار يونيو مع بطاقة أسعار نقدمها بسعر القائمة: 1.40 دولار لكل مليون رمز إدخال، و0.26 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، و4.40 دولار لكل مليون رمز إخراج في كتالوجنا، مع نافذة سياق تبلغ 1,000,000 رمز و128,000 رمز كحد أقصى للإخراج. تأتي درجاته المنشورة من مكانين مختلفين، والتمييز مهم: أرقام Z.ai الخاصة لـ AIME 2026 وHMMT February 2026 وGPQA-Diamond ومجموعة FrontierSWE هي مُبلَّغ عنها من البائع؛ أما أرقام Coding Index وIntelligence Index التي يحملها كتالوجنا فمصدرها Artificial Analysis، التي تجري تقييماتها الخاصة.
البعد الوحيد الذي يتساوون فيه حقًّا
يدّعي كلا النموذجين امتلاك سياق يبلغ 1,000,000 رمز بالضبط. لكن واحدًا منهما فقط لديه درجة منشورة تختبر ما إذا كان النموذج لا يزال قادرًا على استخدام ما بداخله. تسجّل Artificial Analysis رقمًا لاستدعاء السياق الطويل (Long-Context Recall) قدره 78.33 لـ GLM-5.2. أما LongCat-2.5-Preview فليس لديه رقم مكافئ، من أي جهة. هذا التفاوت هو المواجهة كلها في سطر واحد: نافذة المليون رمز هي تصريح عن سعة البنية المعمارية، لا عن ما إذا كان النموذج يسترجع المعلومات بشكل صحيح عند الرمز 900,000. الإعلان عن السعة رخيص، والتحقق منها مكلف، ولهذا يعلنها كل بائع، ولا يكاد أي منهم ينشر اختبار الاستدعاء.
لذا، إذا كان العمل ذو السياق الطويل هو ما تختار بين هذين الخيارين من أجله، فأنت تختار بين خيار له درجة استدعاء منشورة وخيار آخر بلا درجة — والخيار الذي لا يملكها هو أيضًا الخيار الذي يمتلك ملفًا معياريًا غير مُقاس. هذا ليس حجة ضده. بل هو حجة ضد التعامل مع الاثنين باعتبارهما قابلين للتبادل استنادًا إلى عدد صحيح متطابق.

كيف تبدو فجوة السعر في وظيفة حقيقية
بطاقات الأسعار ليست متقاربة، والاتجاه ليس هو الذي يتوقعه الناس من منافس صيني بأوزان مفتوحة ضد مختبر حدودي غربي. إن LongCat-2.5-Preview أرخص بنحو 4.7 مرات في الإدخال غير المخزّن مؤقتًا و3.7 مرات في الإخراج من GLM-5.2 — وهي نسبة ناتجة عن حساب مباشر على البطاقتين المنشورتين، لا عن قياس. في تمريرة معالجة مستند بحجم 500,000 رمز تكتب 20,000 رمز، يعني ذلك نحو 17 سنتًا مقابل نحو 79 سنتًا. على كلا النموذجين أن يقرأ المستند نفسه. وواحد فقط منهما لديه درجة منشورة لما إذا كان سيظل منتبهًا حتى نهايته.
ثمة تحفظ ثانٍ يجدر ذكره في السياق نفسه: تصف Meituan بطاقة أسعارها الخاصة بأنها خصم لفترة محدودة. الرقم 0.30 دولار هو السعر الترويجي، ولا يوضّح المورّد ما الذي يأتي بعده. نموذج التكلفة المبني على سعر ترويجي له تاريخ انتهاء لا يمكنك قراءته. وهذا سبب لإبقاء الانتقال بين المزوّدين رخيصًا، لا سبب لتجنّب النموذج.
على OrcaRouter، تكون المسارات التي نقدّمها خلف مفتاح واحد بسعر القائمة لدى المزوّد مع صفر هامش ربح، لذا يصل تغيّر سعر البائع إلى فاتورتك في اليوم نفسه بدلًا من التجديد التالي، والتحويل التلقائي عند الفشل ينقل طلبًا متدهورًا إلى مزوّد سليم دون أن يعلم تطبيقك. GLM-5.2 هو أحد مساراتنا. LongCat-2.5-Preview ليس كذلك — نحن لا نقدّمه، ولا ينبغي قراءة أي شيء هنا على أنه يدّعي خلاف ذلك. كما مضت Z.ai قُدُمًا منذ يونيو: أصبح GLM-5.3 متاحًا في كتالوجنا اعتبارًا من 18 أغسطس 2026، لذا فإن مقارنة مصوغة على أنها "طراز جديد مقابل الطراز الحالي" تُصوّر GLM-5.2 سلفًا باعتباره النموذج القائم بدلًا من كونه في الطليعة.

ما الذي قد يحسم هذا، وما الذي لن يحسمه
• درجة الاستدعاء للسياق الطويل الخاصة بـ LongCat-2.5-Preview، من Meituan أو من مُقيِّم مستقل. وإلى أن يوجد ذلك، فإن نافذته البالغة 1M مجرد ادعاء بلا اختبار مرتبط به، و78.33 الخاصة بـ GLM-5.2 هي الرقم الوحيد في المقارنة الذي يتناول السؤال نفسه.
• بطاقة أسعار المورّد بدون إشارة المدة المحدودة. السعر المخفَّض يخبرك بكم يكلّف النموذج خلال العرض الترويجي، لا بكم يكلّف فعليًا.
• جدول قياس مرجعي من أي نوع. ليس مركزًا في لوحة الصدارة — مجرد تشغيل تقييم منشور، بحيث تتوقف المقارنة عن كونها ورقة مواصفات في مقابل صفحة نتائج.
• تأكيد على إدخال الصور. يقدّم سجل التغييرات فهم الصور كإضافة رئيسية، لكن مثال الاستجابة في وثائق "Retrieve Model" الخاصة بـ Meituan لا يزال يُظهر input_modalities كـ ["text"] مع text->text سلسلة نمطية. قد تكون تلك العينة قديمة فحسب. ومع ذلك، هو العقد المنشور من البائع، لذا تعامل مع إدخال الصور على أنه مُدّعى وليس متاحًا. في المقابل، GLM-5.2 هو نصي الإدخال ونصي الإخراج في كتالوجنا بدون أي نمط صور على الإطلاق — لذا في هذا البُعد لا يمنحك أي من النموذجين إجابة مُتحققًا منها، وأحدهما يمنحك ادعاءً.
• أرقامك الخاصة. الفجوة بين ما يُنشر وما تحتاجه تُغلق بتشغيل كلا النموذجين على مهامك، والنافذة المجانية على LongCat-2.5-Preview تجعل ذلك رخيصًا الآن. أثر استدلال يصل في حقل reasoning_content متداخل هو تفصيل أدوات التشغيل الذي يجب فحصه أولًا، لأن الأدوات التي تُسقطه بصمت ستفقد معظم فائدة النموذج دون أن تُصدر خطأ.
ما الذي يعنيه هذا بالنسبة للمقارنة
إذا كنت بحاجة إلى قرار اليوم وهو يتضمن سياقًا طويلًا، فإن GLM-5.2 هو النموذج الذي يمكنك تقييمه فعليًا: فهو يمتلك استدعاءً منشورًا، ودرجة برمجة مستقلة تبلغ 68.8، ومؤشر ذكاء قدره 33.7 من Artificial Analysis، وسعرًا يمكنك وضع ميزانية على أساسه. تصف هذه الأرقام نموذجًا كفؤًا لا في الطليعة — فنموذج Z.ai اللاحق، GLM-5.3، يتفوق عليه في النتيجة — لكنها تصف شيئًا. أما LongCat-2.5-Preview فهو طرح أرخص وبسياق أكبر وغير مُقاس بالكامل، وأكثر صفاته جذبًا، أي سعره، مؤقتة صراحةً. الموقف الصحيح تجاهه ليس التشكيك، بل تقييم لمدة أسبوعين مع إرفاق أداة التقييم الخاصة بك به، يُجرى قبل أن يختفي السعر الترويجي.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
