بطاقة عنوان رئيسية مُنشأة تحمل النص 'LongCat-2.5-Preview مقابل GLM-5.2'، مع سطر علوي 'نافذة 1M نفسها، لكن واحدًا فقط منهما قاسها'، ولوحتان: 'LongCat-2.5-Preview: سياق 1M، 0.30 دولار / 1.20 دولار لكل 1M، لم يُنشر أي معيار أداء' و'GLM-5.2: سياق 1M، AA Long-Context Recall 78.33'. شعار OrcaRouter أسفل اليمين.
Guides & Insights

LongCat-2.5-Preview مقابل GLM-5.2: نافذتان بسعة مليون رمز، إحداهما مُثبَتة بالقياس

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

LongCat-2.5-Preview وGLM-5.2يحملان الرقم الرئيسي نفسه: نافذة سياق تبلغ مليون توكن. هذه المصادفة الوحيدة هي التي تؤدي كل العمل في معظم المقارنات التي تُكتب هذا الأسبوع، وهي لا تكفي للمقارنة بين نموذجين. GLM-5.2 موثّق علنًا منذ 16 يونيو 2026 بملف قياس أداء عام، وبطاقة أسعار منشورة، ودرجة استدعاء للسياق الطويل من مُقيّم مستقل. ظهر LongCat-2.5-Preview على منصة LongCat API Platform التابعة لـ Meituan في 25 سبتمبر 2026 ببطاقة أسعار مخفّضة، وعدد معاملات أوردته تغطية تجارية صينية، ومن دون أي قياس أداء منشور من أي نوع. إحدى النافذتين مقيسة. والأخرى مُدّعاة. كل ما يلي يبقي هاتين الفئتين منفصلتين، لأن ورقة المواصفات ونتيجة اختبار ليستا من النوع نفسه من الحقائق.

هذه هي النسخة الصادقة من المواجهة، وهي أكثر فائدة من النسخة المجاملة.

ما الذي نشرته كل جهة فعليًا

يتضمّن سجل تغييرات Meituan مدخلًا مؤرّخًا — "الإصدار: 2026-09-25، LongCat-2.5-Preview متاح الآن" — يسرد ثلاث قدرات مزعومة: فهم الصور، والبرمجة، والتوافق مع "Claude Code وبيئات التطوير السائدة الأخرى"، ويذكر Hermes وOpenClaw وOpenCode وKilo Code. وتذكر صفحة التسعير الخاصة بالمورّد سعر الدفع حسب الاستخدام البالغ 0.30 دولار لكل مليون رمز إدخال غير مخزّن مؤقتًا، و0.006 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، و1.20 دولار لكل مليون رمز إخراج، وقد أُشير في الصفحة نفسها إلى أنه خصم لفترة محدودة. نافذة السياق مليون رمز، والحد الأقصى للإخراج 131,072. وتأتي أرقام ما يقارب 1.6 تريليون معامل إجمالي، مع نحو 48 مليار معامل نشط لكل رمز، على بنية خليط الخبراء، من بيانات موقع Meituan الوصفية ومن تغطية تجارية صينية للإدراج — لا من توثيق API. ولم يرافق أيًّا من ذلك تقرير تقني أو بطاقة نموذج أو جدول معايير. لا يوجد مستودع LongCat-2.5-Preview على HuggingFace، ولا مستودع بهذا الاسم في مؤسسة Meituan على GitHub؛ وبيانات كتالوج النماذج التي تُشحن مع OpenCode تسجّل الأوزان المفتوحة على أنها false.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

يحتل GLM-5.2 من Z.ai الموقع المعاكس. إنه إصدار يونيو مع بطاقة أسعار نقدمها بسعر القائمة: 1.40 دولار لكل مليون رمز إدخال، و0.26 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، و4.40 دولار لكل مليون رمز إخراج في كتالوجنا، مع نافذة سياق تبلغ 1,000,000 رمز و128,000 رمز كحد أقصى للإخراج. تأتي درجاته المنشورة من مكانين مختلفين، والتمييز مهم: أرقام Z.ai الخاصة لـ AIME 2026 وHMMT February 2026 وGPQA-Diamond ومجموعة FrontierSWE هي مُبلَّغ عنها من البائع؛ أما أرقام Coding Index وIntelligence Index التي يحملها كتالوجنا فمصدرها Artificial Analysis، التي تجري تقييماتها الخاصة.

البعد الوحيد الذي يتساوون فيه حقًّا

يدّعي كلا النموذجين امتلاك سياق يبلغ 1,000,000 رمز بالضبط. لكن واحدًا منهما فقط لديه درجة منشورة تختبر ما إذا كان النموذج لا يزال قادرًا على استخدام ما بداخله. تسجّل Artificial Analysis رقمًا لاستدعاء السياق الطويل (Long-Context Recall) قدره 78.33 لـ GLM-5.2. أما LongCat-2.5-Preview فليس لديه رقم مكافئ، من أي جهة. هذا التفاوت هو المواجهة كلها في سطر واحد: نافذة المليون رمز هي تصريح عن سعة البنية المعمارية، لا عن ما إذا كان النموذج يسترجع المعلومات بشكل صحيح عند الرمز 900,000. الإعلان عن السعة رخيص، والتحقق منها مكلف، ولهذا يعلنها كل بائع، ولا يكاد أي منهم ينشر اختبار الاستدعاء.

لذا، إذا كان العمل ذو السياق الطويل هو ما تختار بين هذين الخيارين من أجله، فأنت تختار بين خيار له درجة استدعاء منشورة وخيار آخر بلا درجة — والخيار الذي لا يملكها هو أيضًا الخيار الذي يمتلك ملفًا معياريًا غير مُقاس. هذا ليس حجة ضده. بل هو حجة ضد التعامل مع الاثنين باعتبارهما قابلين للتبادل استنادًا إلى عدد صحيح متطابق.

A screenshot of OrcaRouter's own model page for Z.ai GLM-5.2 at /models/z-ai/glm-5.2, showing the z-ai/glm-5.2 identifier, a 1M-token context window, 128K maximum output, text input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-06-16, a p50 first-token figure of 5.13 s, $1.40 and $4.40 rate tiles, and the OpenAI-compatible code samples.

كيف تبدو فجوة السعر في وظيفة حقيقية

بطاقات الأسعار ليست متقاربة، والاتجاه ليس هو الذي يتوقعه الناس من منافس صيني بأوزان مفتوحة ضد مختبر حدودي غربي. إن LongCat-2.5-Preview أرخص بنحو 4.7 مرات في الإدخال غير المخزّن مؤقتًا و3.7 مرات في الإخراج من GLM-5.2 — وهي نسبة ناتجة عن حساب مباشر على البطاقتين المنشورتين، لا عن قياس. في تمريرة معالجة مستند بحجم 500,000 رمز تكتب 20,000 رمز، يعني ذلك نحو 17 سنتًا مقابل نحو 79 سنتًا. على كلا النموذجين أن يقرأ المستند نفسه. وواحد فقط منهما لديه درجة منشورة لما إذا كان سيظل منتبهًا حتى نهايته.

ثمة تحفظ ثانٍ يجدر ذكره في السياق نفسه: تصف Meituan بطاقة أسعارها الخاصة بأنها خصم لفترة محدودة. الرقم 0.30 دولار هو السعر الترويجي، ولا يوضّح المورّد ما الذي يأتي بعده. نموذج التكلفة المبني على سعر ترويجي له تاريخ انتهاء لا يمكنك قراءته. وهذا سبب لإبقاء الانتقال بين المزوّدين رخيصًا، لا سبب لتجنّب النموذج.

على OrcaRouter، تكون المسارات التي نقدّمها خلف مفتاح واحد بسعر القائمة لدى المزوّد مع صفر هامش ربح، لذا يصل تغيّر سعر البائع إلى فاتورتك في اليوم نفسه بدلًا من التجديد التالي، والتحويل التلقائي عند الفشل ينقل طلبًا متدهورًا إلى مزوّد سليم دون أن يعلم تطبيقك. GLM-5.2 هو أحد مساراتنا. LongCat-2.5-Preview ليس كذلك — نحن لا نقدّمه، ولا ينبغي قراءة أي شيء هنا على أنه يدّعي خلاف ذلك. كما مضت Z.ai قُدُمًا منذ يونيو: أصبح GLM-5.3 متاحًا في كتالوجنا اعتبارًا من 18 أغسطس 2026، لذا فإن مقارنة مصوغة على أنها "طراز جديد مقابل الطراز الحالي" تُصوّر GLM-5.2 سلفًا باعتباره النموذج القائم بدلًا من كونه في الطليعة.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs GLM-5.2' with the subhead 'Six dimensions, and which side of each one has evidence behind it'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'GLM-5.2' (Z.ai, released 2026-06-16, independently scored): 1,000,000-token context, 128,000 max output, text to text only, $1.40 / $0.26 input, $4.40 output, coding index 68.8 at rank 30, long-context recall 78.33. Footnote credits OrcaRouter's catalogue and Artificial Analysis for the right column and notes LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

ما الذي قد يحسم هذا، وما الذي لن يحسمه

• درجة الاستدعاء للسياق الطويل الخاصة بـ LongCat-2.5-Preview، من Meituan أو من مُقيِّم مستقل. وإلى أن يوجد ذلك، فإن نافذته البالغة 1M مجرد ادعاء بلا اختبار مرتبط به، و78.33 الخاصة بـ GLM-5.2 هي الرقم الوحيد في المقارنة الذي يتناول السؤال نفسه.

• بطاقة أسعار المورّد بدون إشارة المدة المحدودة. السعر المخفَّض يخبرك بكم يكلّف النموذج خلال العرض الترويجي، لا بكم يكلّف فعليًا.

• جدول قياس مرجعي من أي نوع. ليس مركزًا في لوحة الصدارة — مجرد تشغيل تقييم منشور، بحيث تتوقف المقارنة عن كونها ورقة مواصفات في مقابل صفحة نتائج.

• تأكيد على إدخال الصور. يقدّم سجل التغييرات فهم الصور كإضافة رئيسية، لكن مثال الاستجابة في وثائق "Retrieve Model" الخاصة بـ Meituan لا يزال يُظهر input_modalities كـ ["text"] مع text->text سلسلة نمطية. قد تكون تلك العينة قديمة فحسب. ومع ذلك، هو العقد المنشور من البائع، لذا تعامل مع إدخال الصور على أنه مُدّعى وليس متاحًا. في المقابل، GLM-5.2 هو نصي الإدخال ونصي الإخراج في كتالوجنا بدون أي نمط صور على الإطلاق — لذا في هذا البُعد لا يمنحك أي من النموذجين إجابة مُتحققًا منها، وأحدهما يمنحك ادعاءً.

• أرقامك الخاصة. الفجوة بين ما يُنشر وما تحتاجه تُغلق بتشغيل كلا النموذجين على مهامك، والنافذة المجانية على LongCat-2.5-Preview تجعل ذلك رخيصًا الآن. أثر استدلال يصل في حقل reasoning_content متداخل هو تفصيل أدوات التشغيل الذي يجب فحصه أولًا، لأن الأدوات التي تُسقطه بصمت ستفقد معظم فائدة النموذج دون أن تُصدر خطأ.

ما الذي يعنيه هذا بالنسبة للمقارنة

إذا كنت بحاجة إلى قرار اليوم وهو يتضمن سياقًا طويلًا، فإن GLM-5.2 هو النموذج الذي يمكنك تقييمه فعليًا: فهو يمتلك استدعاءً منشورًا، ودرجة برمجة مستقلة تبلغ 68.8، ومؤشر ذكاء قدره 33.7 من Artificial Analysis، وسعرًا يمكنك وضع ميزانية على أساسه. تصف هذه الأرقام نموذجًا كفؤًا لا في الطليعة — فنموذج Z.ai اللاحق، GLM-5.3، يتفوق عليه في النتيجة — لكنها تصف شيئًا. أما LongCat-2.5-Preview فهو طرح أرخص وبسياق أكبر وغير مُقاس بالكامل، وأكثر صفاته جذبًا، أي سعره، مؤقتة صراحةً. الموقف الصحيح تجاهه ليس التشكيك، بل تقييم لمدة أسبوعين مع إرفاق أداة التقييم الخاصة بك به، يُجرى قبل أن يختفي السعر الترويجي.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا