
LongCat-2.5-Preview مقابل MiniMax M3: المقعد الرخيص محجوز بالفعل
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 610 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 189 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
تقوم فرضية معظم تغطية LongCat-2.5-Preview على أن Meituan قد خفضت الأسعار عن المنافسين. في مواجهة MiniMax M3، تتبخر هذه الفرضية عند التلامس. يُدرج MiniMax M3 بسعر 0.30 دولار لكل مليون توكن إدخال و1.20 دولار لكل مليون توكن إخراج في كتالوجنا. بطاقة الأسعار المنشورة لـ LongCat-2.5-Preview هي 0.30 دولار لكل مليون توكن إدخال غير مخزّن مؤقتًا و1.20 دولار لكل مليون توكن إخراج. هذه ليست أرقامًا متشابهة؛ بل هي الأرقام نفسها. الموضع الوحيد الذي يختلفان فيه هو الإدخال المخزّن مؤقتًا، حيث تعلن Meituan عن 0.006 دولار لكل مليون مقابل 0.06 دولار للشركة الحالية — فجوة بعشرة أضعاف في أرخص بند في الفاتورة. إذن فالسؤال المثير ليس ما إذا كان LongCat-2.5-Preview رخيصًا. بل ما الذي تشتريه وتتخلى عنه عندما يصل نموذج جديد بالسعر نفسه تمامًا للشركة الحالية.
الجواب المختصر: سقف مخرجات أكبر بكثير، وقاعدة أدلة أضعف بكثير، وخصم على التخزين المؤقت.
السعر الرئيسي نفسه، لكن الحدود القصوى المنشورة مختلفة للغاية.
تم الإعلان رسميًا عن MiniMax M3 منذ 31 مايو 2026. ويوفره كتالوجنا بنافذة سياق تبلغ 1,048,576 رمزًا وحد أقصى للإخراج يبلغ 512,000 رمز — أكثر مما تتيحه معظم النماذج، وأربعة أضعاف 131,072 لدى LongCat-2.5-Preview. ويقبل النص والصور والفيديو كمدخلات، ويُرجع نصًا، مع إتاحة استدعاء الأدوات ووضع JSON والاستدلال.

LongCat-2.5-Preview، المدرَج على منصة LongCat API الخاصة بـ Meituan في 25 سبتمبر 2026، يطابق في السياق عند 1,000,000 رمز ويقل كثيرًا عن المطلوب في الإخراج عند 131,072. الملف التعريفي لمدخلاته هو السؤال المطروح: يعرض سجل التغييرات فهم الصور كإضافته الرئيسية، لكن استجابة المثال في وثائق Meituan نفسها «Retrieve Model» لا تزال تُظهر input_modalities/ على أنها ["text"]/ مع text->text/ كسلسلة نمط. كما أن MiniMax M3 يقبل الفيديو أيضًا، وهو ما لا يدّعيه LongCat-2.5-Preview على الإطلاق. إذا كانت خطوط أنابيبك تُغذّي تسجيلات شاشة أو تسلسلات إطارات، فإن هذه المقارنة تنتهي هنا.
يسير عدم التماثل في التخزين المؤقت في الاتجاه المعاكس، ويجدر ذكره لصالح Meituan، لأنه البُعد الوحيد الذي يتمايز فيه النموذج الجديد حقًّا. إن $0.006 لكل مليون من المدخلات المخزنة مؤقتًا مقابل $0.06 ميزة حقيقية لأعباء عمل الوكلاء التي تعيد إرسال البادئة الطويلة نفسها في كل دور — وهو ما ينطبق على معظمها. وهو أيضًا البند الأكثر عرضة للتغير دون إشعار، لأن Meituan تُشير إلى البطاقة بأكملها باعتبارها خصمًا لفترة محدودة.
فجوة الأدلة، مقيسة بصدق في كلا الاتجاهين
موقع MiniMax M3 في الاختبارات المعيارية ليس قويًا، وقول ذلك جزء من إجراء هذه المقارنة بشكل صحيح. تسجل Artificial Analysis مؤشر Coding Index بقيمة 58.6 له — في المرتبة السادسة والأربعين بين النماذج المتتبعة — ومؤشر Intelligence Index بقيمة 29.2 في المرتبة الستين. GPQA Diamond 92.9%، Humanity's Last Exam 39%، SciCode 47.1%، Long-Context Recall 83، τ²-Bench banking 15.3، Terminal-Bench v2.1 65.2. أرقام MiniMax المنشورة تغطي مجالًا مختلفًا: BrowseComp 83.5، GDPval rubrics 76.7، MCP Atlas 74.2، BankerToolBench 76.1. تلك أرقام مقدمة من البائع وتنتمي إلى عمود مختلف عن الأرقام المستقلة، لكنها موجودة، وهذه هي الكلمة المفتاحية.

لا يوجد لـ LongCat-2.5-Preview أي عمود على الإطلاق. لا جدول قياسات منشور، ولا بطاقة نموذج، ولا تقرير تقني، ولا مستودع على HuggingFace أو في منظمة Meituan على GitHub، والبيانات الوصفية للكتالوج تسجل الأوزان المفتوحة على أنها خطأ. عدد المعلمات التقريبي الإجمالي 1.6 تريليون / 48 مليار نشط مأخوذ من البيانات الوصفية لموقع Meituan ومن التغطية التجارية الصينية وليس من الوثائق. لذا فإن العبارة الدقيقة هي: درجات M3 متواضعة ومصدرها مستقل؛ أما درجات LongCat-2.5-Preview فغائبة. النموذج الذي يحصل على درجات في الأربعينيات في مؤشر البرمجة هو كمية معروفة يمكنك التخطيط بناءً عليها. النموذج الذي لا توجد له درجة هو نوع مختلف من المخاطر، وكون السعر متطابقاً يزيل التعويض الذي يبرر عادةً اختياره.
حيث يغيّر السعر نفسه ما ينبغي عليك فعله
عندما يخفض نموذج جديد الأسعار في المجال، فإن التصرف العقلاني هو تقييمه — فالميزة هي خصم حقيقي. وعندما يصل نموذج جديد بالسعر نفسه تمامًا كما منافس قائم يطرح منذ مايو، فالميزة ليست السعر. إنها القدرة، والقدرة هي الشيء الوحيد الذي لم ينشره LongCat-2.5-Preview. وهذا يعيد تأطير التقييم بالكامل: أنت لا تختبر ما إذا كان أرخص، بل تختبر ما إذا كان أفضل، على مهامك، من نقطة انطلاق ثابتة دون أي دليل تستند إليه.
هناك تفصيل من الدرجة الثانية يجعل ذلك الاختبار أرخص مما يبدو. LongCat-2.5-Preview مجاني وغير محدود عبر OpenCode لفترة غير محددة الطول، مع سياسة عدم الاحتفاظ يوثقها OpenCode صراحةً — تدريب النموذج "غير مستخدم"، الاحتفاظ بالبيانات "0 أيام"، مقابل ثلاثين يومًا لقائمة المقارنة. لذا فإن تكلفة إنشاء تقييمك الخاص قريبة من الصفر، وسياسة الاحتفاظ تعني أنه يمكنك تشغيله على شيفرة خاصة. التفصيل الوحيد في أداة الاختبار الذي يجب حسمه أولاً هو أن النموذج يعيد مسار استدلاله في reasoning_content/ حقل متشابك؛ العملاء الذين يحللون إكمالات الدردشة دون توقع ذلك سيتجاهلون التفكير بصمت ويجعلون النموذج يبدو أسوأ مما هو عليه.

حجة التوجيه، الخاصة بمقارنة بنفس السعر
نوفّر MiniMax M3 بسعر قائمة MiniMax مع عدم وجود أي هامش ربح. LongCat-2.5-Preview ليس أحد مساراتنا — نحن لا نوفّره، ولا ينبغي تفسير أي شيء هنا على أنه يدّعي خلاف ذلك.
المواجهة بنفس السعر هي بالضبط الحالة التي يستحق فيها التوجيه كلفته بدلًا من أن يكون مجرد وسيلة راحة. إذا كان سعر نموذجين متساويًا، يصبح القرار بينهما لكل طلب ولكل مهمة: M3 لسقف الإخراج البالغ 512,000 رمز وإدخال الفيديو، وLongCat-2.5-Preview لخصم البادئة المخزّنة مؤقتًا في حلقات الوكيل الطويلة بعد أن تطمئن إلى جودته. دمج النماذج هو الآلية التي تجعل ذلك حرفيًا — يمكن أن تكون مرحلة استرجاع وخطوة تركيب نماذج مختلفة في طلب واحد، فلا تُضطر إلى اختيار فائز قبل أن تتوفر لديك الأدلة. ولأننا نمرّر أسعار قائمة المزوّدين دون أي هامش ربح، فإن تغيير سعر المورّد يظهر على فاتورتك في اليوم نفسه بدلًا من موعد تجديد العقد التالي، وهذا يهم أكثر من المعتاد عندما تكون إحدى البطاقتين ترويجية بشكل صريح.ثم التحويل التلقائي عند الفشل يغطي الحالة التي يتراجع فيها أحد المزوّدين، ويكون الأهم بالنسبة للنموذج الذي لا يوجد له سجل تقديم خدمات يمكن فحصه.
الأسئلة الشائعة
• هل LongCat-2.5-Preview أرخص من MiniMax M3؟ لا. في بطاقات الأسعار المنشورة، تتطابق أسعار الإدخال والإخراج عند 0.30 دولار و1.20 دولار لكل مليون. ميزة السعر الوحيدة هي في الإدخال المخزّن مؤقتًا، 0.006 دولار مقابل 0.06 دولار، وتصنّف Meituan بطاقتها بالكامل على أنها خصم لفترة محدودة دون أن تقول ما سيأتي بعد ذلك.
• أيهما يمتلك مخرجات قابلة للاستخدام أكبر؟ إنه MiniMax M3 بفارق واسع: 512,000 رمز مقابل 131,072. بالنسبة للتوليد طويل النصوص، أو الاستخراج المُهيكل من مستندات ضخمة، أو أي مهمة تكتب أكثر من فصل كامل، فإن هذا السقف هو المواصفة الحاسمة.
• أي واحد يمكنني التحقق منه؟ MiniMax M3، والتحقق لا يجمّله — البرمجة 58.6 في المرتبة السادسة والأربعين، ومؤشر الذكاء 29.2 في المرتبة الستين من Artificial Analysis. لا يملك LongCat-2.5-Preview أي تقييم منشور من أي جهة. إذا ظهر هذا الأسبوع أي اختبار أداء لـ LongCat-2.5-Preview، فتعامل معه باعتباره غير قابل للتحقق حتى تتتبعه إلى مُقيّم مُسمّى.
• أيّهما ينبغي أن أضعه في بيئة الإنتاج؟ لا هذا ولا ذاك دون اختبار خاص بك. بين الاثنين، M3 هو الخيار الأقل تباينًا لأن نقاط ضعفه موثّقة ووسائط إدخاله مؤكدة؛ أما LongCat-2.5-Preview فهو الأعلى تباينًا، مع ادّعاء سياق أكبر، وسقف إخراج أصغر بكثير، وخصم على التخزين المؤقت، وغياب أي دليل عام. شغّله مجانًا ما دامت النافذة مفتوحة، وأبقِ كليهما خلف مفتاح واحد، ودع أرقامك الخاصة تتخذ القرار.
