
Mercury 2.5 مقابل Mercury 2.5 Preview: نموذج انتشار واحد، تاريخان للإطلاق
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
إليك مقارنة وجهاً لوجه يشترك فيها الطرفان في بطاقة نموذج واحدة. إصدار Inception من Mercury 2.5 Preview، الذي صدر في 31 أغسطس 2026، وإصدار Mercury 2.5، الذي صدر في 8 سبتمبر 2026، هما نفس نموذج اللغة الانتشارية بفارق ثمانية أيام: قناة معاينة فتحتها Inception للمطورين، ونسخة الإنتاج "الجاهزة للمؤسسات" التي أطلقتها بعد أسبوع. لم تكشف Inception عن نقطة تحقق مختلفة، أو رقم سرعة مختلف، أو سعر مختلف لـ Mercury 2.5 — والأرقام التي تغيّرت فعلاً بين الإعلانين تبدو كترتيب وتنظيف، لا كنموذج جديد. تم تصحيح رقم السياق من 256K في صفحة المعاينة إلى 260K عند الإطلاق، وأعيدت صياغة مكسب الذكاء مقارنة بـ Mercury 2 من "أكثر من 10 نقاط" (مواد المعاينة) إلى "40 بالمئة" (مواد الإطلاق). المحرك، وادعاء 1,107 رمزاً في الثانية، وقائمة الأسعار، كلها متطابقة. لذا فهذه ليست معركة مواصفات معتادة، وتضخيم إحداهما سيكون غير نزيه. المقارنة المهمة بين هذين الاسمين تدور حول التغليف والتوقيت: ما الذي غيّره إطلاق الإنتاج فعلاً، وما الذي كان يخبرك به ملصق المعاينة حقاً، وأي اسم ينبغي أن تستخدمه استدعاءات واجهة برمجية لديك الآن.
لماذا تتم مقارنة نموذج مع نفسه؟
عادةً ما يعرض الباعة نموذجًا للمعاينة ثم يدمجونه بهدوء في الاسم الرئيسي، فتختفي قائمة المعاينة ولا أحد يكتب عن المواجهة. لكن Inception أبقت الاسمين جنبًا إلى جنب لمدة أسبوع، ولم يتم إيقاف العمل بهوية المعاينة إلا الآن — وهذا هو بالضبط سبب وجود محتوى في هذه المقارنة. كانت المعاينة هي المسار السريع الذي استخدمته Inception لوضع رهانها على الانتشار أمام المطورين. ظهرت في 31 أغسطس مع ورقة مواصفات هي نفسها ورقة مواصفات Mercury 2.5 حاليًا: نموذج لغوي كبير انتشاري (dLLM) يولّد ويحسّن كتل الرموز على التوازي بدلاً من إصدار رمز واحد في كل مرة؛ مع ادّعاء بمعالجة 1,107 رموز في الثانية على وحدات معالجة رسومية قياسية؛ وادّعاء بزمن يقل عن 300 مللي ثانية حتى الرمز الأول؛ ونافذة سياقية تتسع لـ260 ألف رمز مع مخرجات يصل حجمها إلى 65,536 رمزًا؛ ومستويات استدلال قابلة للضبط؛ واستخدام أدوات أصلي، واستدعاءات أدوات متوازية، ومخرجات منظمة. كل هذه الأرقام هي أرقام Inception ذاتها، ولم يقم أي مختبر مستقل بقياس النموذج عندما أُطلقت المعاينة.
في 8 سبتمبر، أطلقت Inception نسخة Mercury 2.5 بوصفها "المرحلة التالية من الذكاء لنماذج LLM الانتشارية" وباعتبارها أسرع نماذجها الاستدلالية في الإنتاج — جاهزة للمؤسسات، وموجهة لوكلاء الصوت، والوكلاء الفرعيين للبرمجة، والبحث المؤسسي، وأحمال عمل الدعم. نفس المواصفات، نفس التموضع، نفس قائمة الأسعار. كما استعرض الإطلاق شقيقتين توضحان الاتجاه الذي تسير إليه Inception: Mercury Voice، وهو نموذج dLLM مضبوط على أول رمز بأقل من 170 مللي ثانية لوكلاء الصوت، و Mercury Router، الذي يوجّه الاستفسارات عبر النماذج وفقًا للجودة والسرعة والتكلفة. إن Mercury 2.5 هو الرائد لعائلة صُمّمت لأحمال العمل القائمة على الوكلاء والحساسة لزمن الاستجابة بدلاً من أن تكون لفئة الجودة الحدودية المتطورة.
ما الذي غيّره إطلاق 8 سبتمبر فعليًا؟
قارن بين الاسمين سطرًا بسطر، والفرق ليس في المحرك — بل في كل ما يحيط بالمحرك:
• الحالة — Mercury 2.5 Preview: معاينة مغلقة قد «تغيّر السلوك أو التوافر». Mercury 2.5: نموذج إنتاجي أُطلق مع التزام بجاهزية المؤسسات، وقناة مبيعات، وقائمة إنتاج مؤرخة.
• الهوية — أصبحت صفحة النماذج لدى Inception تعرض الآن Mercury 2.5 وMercury Voice وMercury Router، مع عدم وجود أي Preview، كما يذكر الحاشية السفلية للدعم أن Mercury 1 وMercury 2 وMercury Edit 2 هي النماذج التي «ستظل مدعومة للعملاء الحاليين». ولا تظهر Preview في أيٍّ من القائمتين. أمّا بالنسبة للمورّد، فقد اندمجت تسمية Preview ضمن Mercury 2.5.
• نقطة النهاية — تعمل منصة مطوّري Inception على تقديم النموذج باسم mercury-2.5، وقائمة الإنتاج التي أصبحت متاحة في 8 سبتمبر هي التي تخدم الزيارات الجديدة. وفي الكتالوج الذي حمل اسم Preview لأول مرة في أواخر أغسطس، لم يعد اسم Preview يشير إلى أي نقطة نهاية مباشرة نشطة، بينما قائمة Mercury 2.5 المضافة في 8 سبتمبر تُقدِّم الإجابات. وعلى كل من كتب أكوادًا بالاعتماد على Preview بالاسم أن يعيد التوجيه إلى Mercury 2.5 ويتحقّق ممّا يفوّتره مزوّده فعليًا؛ فالمعرّف الذي أدمجته في الأسبوع الأول هو الذي سيُخرَج من الخدمة.
• السعر: قائمة أسعار متطابقة وخصم متطابق. كلاهما بسعر 0.20 دولار لكل مليون توكن إدخال و0.75 دولار لكل مليون توكن إخراج، مع مدخلات مخزّنة مؤقتًا بسعر 0.02 دولار. وأُطلق كلاهما بخصم يناهز 80%: 0.04 دولار / 0.15 دولار، والمدخلات المخزّنة مؤقتًا بسعر 0.004 دولار. كان خصم Preview محددًا بفترة زمنية واضحة حتى 8 سبتمبر؛ بينما أُطلق Mercury 2.5 بنفس عرض الخصم البالغ 80%، وما يزال السعر المخفّض هو المعروض في صفحة النسخة الإنتاجية الخاصة به وقت كتابة هذا المقال. وهذا هو الفخ، وهو موضّح بالتفصيل أدناه.
• الإعداد — أضاف الإطلاق الكامل حصةً من الرموز المجانية لحسابات المطورين الجديدة — تشير مواد الإطلاق إلى 100 مليون رمز — وفتح مسارًا خاصًا للتواصل مع المؤسسات لم يكن متاحًا في نسخة المعاينة.
• الدليل — بدون تغيير. لا يمتلك أي من الاسمين معيارًا مرجعيًا مستقلًا، وادعاءات البائع هي نفس الادعاءات بصياغة مختلفة قليلًا: قفزة ذكاء «أكثر من 10 نقاط» على Mercury 2 في المواد الترويجية الأولية تتحول إلى زيادة «40 بالمئة» في مواد الإطلاق، إلى جانب نفس التكافؤ المعلن مع الفئة الحدودية المحسّنة من حيث التكلفة (GPT-5.6 Luna في وضع الجهد المنخفض، وGemini 3.5 Flash-Lite، وClaude Haiku 4.5) ونفس النسبة المبلّغة من البائع وهي 79% في GPQA Diamond و77% في IFBench. الادعاء المُعاد صياغته ليس ادعاءً تم التحقق منه.

فخ التسعير في قلب الاقتران
لأن الاسمين يحملان نفس السعر الرسمي ونفس العرض التشويقي بنسبة 80%، فمن السهل أن نفترض أنهما يكلفان نفس المبلغ دائمًا. لكن ليس من الضروري أن يكون كذلك. خصم Preview توقف نهائيًا في 8 سبتمبر؛ بينما خصم إطلاق Mercury 2.5 يعمل بعدّاد جديد تمامًا. ولمدة أسبوع كان من الممكن تمامًا أن تدفع 0.20 دولار / 0.75 دولار مقابل مكالمة إلى Preview بينما كان المحرك نفسه يرد بتكلفة 0.04 دولار / 0.15 دولار تحت اسمه الإنتاجي — أو في الأرجح، أن تكون على معرّف Preview توقف عن العمل بهدوء بينما استمرت الفواتير في الوصول. خصم الإطلاق الذي تنتهي صلاحيته عند نقطة الوصول هو بالضبط ذلك النوع من الشروط الدقيقة الذي يحوّل قصة "نفس الموديل، نفس السعر" إلى فرق حقيقي في التكلفة.
الرقم الدائم هو السعر القائم، والنصيحة الدائمة هي وضع الميزانية حوله: 0.20$ / 0.75$ لكل مليون، والإدخال المخزن مؤقتًا 0.02$ — رخيص لنموذج استدلال بسياق 260 ألف، وهو مريح تحت الطبقة الرائدة، لكنه ليس 0.04$ / 0.15$ الذي تعلن عنه لافتات الإطلاق. تعامل مع السعر المخفض كسعر تجربة بعمر افتراضي، وتحقق مما يفوتره مزودك بالضبط لمعرف النموذج في كودك بدلاً من الاسم في صفحة التسويق، وإذا كنت قد انضممت على الإصدار التجريبي Preview، فانتقل إلى Mercury 2.5 قبل أن يحسم انتهاء الصلاحية أو نقطة نهاية متقاعدة الأمر بدلاً عنك.
هذه أيضًا هي فئة المشكلة التي وُجدت طبقة التوجيه لإزالتها. موجّه النماذج الذي يمرّر أسعار قائمة المزوّدين مع 0% زيادةيُظهر السعر الذي يفوّره المورّد فعليًا، ويُحدَّث في اليوم نفسه الذي يبدأ فيه خصم الإطلاق أو ينتهي، كما أن التبديل التلقائي عند الفشل يُبقي المكالمات متدفقة عندما تُسحب نقطة نهاية من الخدمة من تحتك. ميركوري 2.5 غير متاح على OrcaRouter وقت كتابة هذا — Inception يقدّمه عبر API الخاص به والعديد من المنصات الخارجية — لذا حاليًا تُعد صفحة نماذج المورّد المصدر الموثوق للسعر. بمجرد أن يدرجه مزوّد، تحصل على آليات التمرير المباشر هذه عبر مفتاح واحد، ويظهر خفض السعر أو انتهاء الخصم لدينا في اليوم نفسه الذي يُعلن فيه.
مشكلة الأدلة المشتركة بين الاسمين
البطاقة الصادقة لهذا الاقتران قصيرة، لأن العمودين يمثلان النموذج نفسه مع الافتقار نفسه إلى الإثبات. لا يمتلك Mercury 2.5 ولا Mercury 2.5 Preview درجة مؤشر مستقلة، ولا نتيجة تشغيل مُعاد إنتاجه، ولا ترتيبًا في أرينا اعتبارًا من 9 سبتمبر 2026. ادعاءات Inception نفسها — القفزة في الذكاء مقارنةً بـ Mercury 2، والتكافؤ مع مستوى Haiku 4.5، و79% في GPQA Diamond، و1,107 توكنًا في الثانية — هي كلام الشركة، وهي متطابقة للاسمين لأن النموذج متطابق.
القطعة الوحيدة من الأدلة المستقلة في العائلة تشير إلى كيفية قراءة ادعاء السرعة. قامت Artificial Analysis بقياس Mercury 2، الطراز السابق، عند 684 رمزًا في الثانية على نقطة النهاية الإنتاجية، مسجلةً 22 على مؤشر الذكاء — إنها سريعة حقًا، ودليل على أن نهج الانتشار ليس سرابًا، لكنها بعيدة كثيرًا عن حوالي 1,000 رمز في الثانية التي تعلن عنها Inception لذلك الطراز على أجهزة Blackwell. توقع فجوة مماثلة بين رقم 1,107 الخاص بـ Mercury 2.5 وما تقدمه نقطة نهاية مشتركة متعددة المستأجرين في الواقع تحت الحمل الفعلي. ينطبق نفس التحذير على الجودة: نموذج انتشار جديد كليًا قاسه صانعه فقط لا ينبغي الأخذ بكلامه بشأن مطابقته لـ Claude Haiku 4.5 حتى يقوم طرف ثالث بتشغيله.

المتتبّعات التي بدأت تغطية الإصدار تعكس ذلك الوضع تمامًا. سجلّ BenchLM لـ Mercury 2.5، الذي نُشر في 8 سبتمبر، لا يمنح النموذج أي درجة عامة ولا ترتيبًا عامًا؛ بل يتضمّن أرقام Inception البالغة 79% في GPQA Diamond و77% في IFBench، مع وسمها صراحةً على أنها مُبلَّغة من المزوّد، ويشير إلى أن سرعة التشغيل المستقلة لم تُقَس بعد. أول إدخال في مؤشر Artificial Analysis، أو موضع في LMArena، أو إعادة إنتاج مستقلة لنتيجة GPQA سوف يحوّل Mercury 2.5 من مجرّد ادعاء إلى كائن قابل للمقارنة — وسينطبق ذلك على الاسمين معًا، لأنه لا يوجد سوى نموذج واحد لقياسه.

أي اسم يجب أن تنادي به؟
• تكامل جديد، بلا إرث قديم:استخدم Mercury 2.5 وتجاهل Preview. يحمل الاسم الإنتاجي نفس المحرك، ونفس الخصم حاليًا، وشروط المؤسسات، وضمان أنه المعرّف الذي يقدّمه البائع فعليًا. لا يضيف Preview سوى مخاطر عدم الاستقرار ولا شيء آخر.
• إذا كنت قد أدمجت Preview بالفعل،فتحقق اليوم مما يقدمه مزود الخدمة تحت هذا الاسم وما يتقاضاه مقابله. أعد توجيه عميلك إلى معرّف Mercury 2.5 وأكّد السعر. إبقاء اسم Preview في كود الإنتاج أصبح الآن رهانًا على أن قناة المعاينة المقيّدة زمنيًا بشكل صريح ستعيش بعد تقاعدها.
• حركة المرور المؤسسية أو الحرجة للإنتاج: يُستخدم Mercury 2.5 عبر مسار Inception للمؤسسات، وليس من خلال تسمية معاينة لا التزام خلفها. أما احتياجات الصوت والتوجيه فتشير إلى Mercury Voice وMercury Router على التوالي، وهما لا يزالان في مرحلة المعاينة.
• أي شخص يقيّم فئة الانتشار: كلا الاسمين يشير إلى هدف التقييم نفسه، لذا شغّل تقييمك على Mercury 2.5 مرة واحدة، واعتبر النتيجة سارية على خط الطرازات. ضع في ميزانيتك السعر المعلن، وعامل ادعاءات المورّد على أنها فرضيات حتى تظهر نتيجة تقييم مستقل.
ماذا تشاهد
ثلاثة أمور ستحسم هذه الثنائية خلال الأسابيع القليلة المقبلة. أولاً، أول معيار مستقل — موضع في مؤشر أو تشغيل مُعاد لـ GPQA أو AIME — والذي سيختبر ادعاء التكافؤ الذي يمثل الرهان التجاري بأكمله. ثانيًا، ما إذا كانت هوية Preview ستختفي من النظام البيئي للنماذج تمامًا، كما توحي صفحة نماذج Inception نفسها بالفعل. ثالثًا، ما سيحدث لخصم الإطلاق البالغ 80% بعد أن مضى تاريخ 8 سبتمبر الذي كانت Preview مثبتة عليه: تمديدٌ يجعل Mercury 2.5 رخيصًا هيكليًا، في حين أن العودة إلى $0.20 / $0.75 تجعله منافسًا فقط. وحتى ذلك الحين، الإجابة الصحيحة على "Mercury 2.5 أو Mercury 2.5 Preview؟" هي أنه نموذج واحد، ويجب أن تستدعي النموذج الذي ما يزال منتجًا.
