
ميركوري 2.5 بريفيو ضد جيميني 3.1 برو: نسختا معاينة، بينهما ستة أشهر
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0259الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0258الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0166الذكاء82البرمجة
- AlibabaجديدQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.3 Flash2026-08-2658الذكاء72البرمجة
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
كلا النموذجين في هذه المواجهة يحملان كلمة "معاينة" في اسميهما، وهنا ينتهي التشابه. كل من Mercury 2.5 Preview و Gemini 3.1 Pro هما نموذجا تفكير (reasoning) يمكنك استدعاؤهما من واجهة برمجة التطبيقات (API) اليوم، لكنهما معاينتان في طرفين متقابلين من عمرهما. Gemini 3.1 Pro، نموذج التفكير الرائد، موجود في مرحلة المعاينة منذ 19 فبراير 2026 — مع ستة أشهر من التقييمات المستقلة، ومواضع في لوحات الصدارة العامة، وحركة إنتاج فعلية خلفه، ومؤشر ذكاء تحليلي اصطناعي (Artificial Analysis Intelligence Index) يبلغ 57 عند الإطلاق، وإدخال متعدد الوسائط عبر النص والصورة والصوت والفيديو، وسياق سعته 1M رمز (token)، وسعر يبلغ 2.00 دولار / 12.00 دولار لكل مليون رمز. أما Mercury 2.5 Preview، نموذج الانتشار اللغوي من Inception الذي صدر في 31 أغسطس 2026، فعمره يومان فقط: نموذج نصي فقط بسياق 256K، وسرعة مزعومة تبلغ 1,107 رمز في الثانية، وسعر قائمة يبلغ 0.20 دولار / 0.75 دولار (نحو 0.04 دولار / 0.15 دولار مع خصم حتى 8 سبتمبر)، وليس لديه أي اختبار معياري مستقل. إن تسميتهما معًا "معاينتين" يخفي السؤال الحقيقي، وهو: كم تساوي بداية سابقة من الأدلة تمتد لستة أشهر أمام طريقة أسرع جوهريًا لتوليد النص؟
ما هو كل نموذج في الواقع
Gemini 3.1 Pro هو نموذج رائد مغلق ومتعدد الوسائط ومتعدد الأغراض في مجال الاستدلال. يقرأ النصوص والصور والصوت والفيديو، ويتعامل مع نافذة سياق تبلغ مليون رمز مع سقف إخراج يبلغ 64 ألف رمز، ويضبط عمق استدلاله ديناميكيًا — يصف البائع أربعة مستويات من كثافة الاستدلال تتدرج مع تعقيد المهمة. الأرقام المعلنة عند إطلاقه — ARC-AGI-2 بنسبة 77.1%، وGPQA Diamond بنسبة 94.3%، وSWE-bench Verified بنسبة 80.6%، وTerminal-Bench 2.0 بنسبة 68.5% — هي أرقام أبلغ عنها البائع، لكنها ترتكز على ستة أشهر من التدقيق المستقل، بما في ذلك إعادة قياس من Artificial Analysis على مقياس مؤشر أكثر صرامة حيث يسجّل النموذج حوالي 46.5. تلك إعادة القياس هي بالضبط ما يستحقه نموذج ناضج: فقد خضع لاختبارات مكثفة بما يكفي ليجعل المؤشر أكثر صرامة حوله. Mercury 2.5 Preview هو نموذج انتشار — يولّد الرموز ويحسّنها بالتوازي بدلاً من واحد تلو الآخر — مع استدلال قابل للضبط، واستدعاءات أدوات متوازية، وJSON متوافق مع المخطط، وهو مبني لأحمال العمل المتراكمة زمن الاستجابة التي تسميها Inception: وكلاء البحث، وخطوط معالجة الصوت، والوكلاء الفرعيون للبرمجة. كل ادعاء جودة مرتبط به، بما في ذلك قفزة تزيد على 10 نقاط عن Mercury 2، هو ادعاء من البائع نفسه، ولم يقِسه أي طرف ثالث.

تباين المواصفات
• السعر — Mercury 2.5 Preview: $0.20 / $0.75 لكل 1M إدخال/إخراج، ~$0.04 / $0.15 سعر تمهيدي حتى 8 سبتمبر. Gemini 3.1 Pro: $2.00 / $12.00 لكل 1M، ثم يتدرج إلى $4.00 / $18.00 فوق 200K إدخال.
• السياق / المخرجات — Mercury 2.5 Preview: سياق 256K. Gemini 3.1 Pro: سياق 1M، أقصى مخرجات 64K.
• المدخلات — Mercury 2.5 Preview: نص فقط. Gemini 3.1 Pro: نص، صورة، صوت، فيديو، ملف.
• البنية — Mercury 2.5 Preview: نموذج لغوي كبير انتشاري، توليد متوازٍ للتوكنات. Gemini 3.1 Pro: تراجعي ذاتي، عمق استدلال ديناميكي.
• السرعةMercury 2.5 Preview: ادعاء بسرعة 1,107 رمزًا في الثانية. Gemini 3.1 Pro: لا يوجد ادعاء رئيسي مماثل.
• الأدلة — Mercury 2.5 Preview: حسب تقارير البائع فقط. Gemini 3.1 Pro: مؤشر AA 57 عند الإطلاق (46.5 بالمقياس الأحدث) بالإضافة إلى سجل تقييم مستقل طويل.

فجوة تعدد الوسائط هي الفارق الحاسم
بالنسبة لمعظم التطبيقات، يُحسم هذا المقارنة قبل دخول التسعير أو المعايير في الصورة، لأن Mercury 2.5 Preview لا يمكنه الرؤية. أما Gemini 3.1 Pro فيقرأ لقطات الشاشة والرسوم البيانية والصوت والفيديو — إنه النموذج الذي توجّهه إلى ملف PDF أو رسم بياني أو تسجيل اجتماع أو واجهة مستخدم عندما تريد إجابة عن شيء ليس نصًا بالفعل. إن Mercury 2.5 Preview نصي فقط بحكم التصميم؛ فالنموذج اللغوي الانتشار الذي يولّد النص بالتوازي لا يملك مسار إدخال للصور أو الصوت إطلاقًا. بالنسبة لتطبيق كثيف المستندات، أو وكيل رؤية، أو أي منتج متعدد الوسائط، فإن Gemini 3.1 Pro هو المرشح الوحيد هنا، نقطة وانتهى. إن قيد النصية فقط في Mercury 2.5 Preview ليس تحذيرًا بخط صغير؛ بل هو الحد الذي يحدد المهام التي يكون النموذج مؤهلاً لها أصلًا.
ستة أشهر من الاختبارات مقابل يومين
عند النظر إلى الأدلة، فهذه ليست منافسة، ومن المهم أن نوضح السبب بصراحة. {{1}}Gemini 3.1 Pro{{/1}} تم تفكيكه من قبل مختبرات مستقلة على مدى ستة أشهر؛ وتم تثبيت نتيجته، وإعادة قياسها، والجدال بشأنها، وهذا هو شكل "الجديرة بالثقة" بالنسبة لنموذج. {{2}}Mercury 2.5 Preview{{/2}} لديه مصدر معلومات واحد — وهو صانعه — وهذا المصدر يدّعي قفزة ذكاء تتجاوز 10 نقاط مقارنةً بـ{{3}}Mercury 2{{/3}} وتكافؤًا مع الطبقة المحسّنة من حيث التكلفة في الحدود القصوى. كلا العبارتين قد تكونان صحيحتين. لكن لم يؤكدهما أي شخص خارج {{4}}Inception{{/4}}، والنموذج جديد جدًا بحيث لا يمكن توقع أي شيء آخر غير ذلك. عدم التماثل ليس في كون أحدهما أفضل؛ بل في أن أحدهما قابل للمعرفة والآخر ليس كذلك بعد.
حيث تتفوق سرعة عطارد حقًا
الحالة الصادقة لـ Mercury 2.5 Preview ضيّقة، نصّية فقط، وحقيقية. توليد التوكنات المتوازية يغيّر معادلة زمن الاستجابة بطريقة لا يستطيع أي نموذج انحداري — بما في ذلك Gemini 3.1 Pro — مجاراتها، لأن النموذج الانحداري تسلسلي بطبيعته. بالنسبة لخط الصوت، المفارقة هي أن المدخلات والمخرجات صوتية لكن التفكير بينهما نصي: طبقة تفكير نصي سريعة هي تحديدًا ما يجعل الوكيل الصوتي يبدو مستجيبًا. بالنسبة لوكيل بحث يكرر استدعاءات الأدوات، ولوكيل برمجة فرعي يطلق العديد من الاكتمالات الصغيرة لكل مهمة، فإن زمن الاستجابة لكل استدعاء يتراكم ليصبح سرعة محسوسة. عند السعر التمهيدي — 0.04$ للدخول، 0.15$ للخروج — فإن Mercury 2.5 Preview أرخص بنحو 80 مرة من معدل الإخراج القياسي لـ Gemini 3.1 Pro، مما يجعله ليس أسرع فحسب، بل فئة تكلفة مختلفة للتفكير النصي عالي الحجم. التحفّظ الذي يجب أن يرافق كل جملة من هذه الجمل: السرعة ادعاء، وتكافؤ الجودة ادعاء، ولا يوجد أي قياس مستقل.
التسعير: علاوة السياق الطويل من Gemini مقابل العرض التشويقي من Mercury
تحتوي بطاقة أسعار Gemini 3.1 Pro على تفصيل يستحق المعرفة قبل مقارنة الأرقام الرئيسية: الطلبات التي تتجاوز 200 ألف توكِن إدخال تقفز من 2.00 دولار / 12.00 دولار إلى 4.00 دولار / 18.00 دولار لكل مليون. وفي نموذج بسياق يبلغ مليون توكِن، لا تُعد هذه العلاوة للسياق الطويل حالةً هامشية — بل هي ثمن الاستخدام الفعلي للنافذة التي يشتهر بها النموذج. أما Mercury 2.5 Preview فلا يتضمن مثل هذه القفزة، ومن غير المرجح أن يصل سياقه البالغ 256 ألف توكِن إلى نطاق السياق الطويل في كثير من الأحيان. لكن السعر المنخفض لـ Mercury هو مجرد إغراء ينتهي في 8 سبتمبر، بينما سعر Gemini هو تعريفة مستقرة ومنشورة. وعند المقارنة، قارن السعر الرسمي لـ Mercury البالغ 0.20 دولار / 0.75 دولار بالفئة القياسية لـ Gemini، وليس بالرقم المخفّض — فالخصم هو حافز للتجربة، وليس السعر الذي يجب التخطيط بناءً عليه.
قرار التوجيه
كلا النموذجين قابلان للتوجيه اليوم، وهذا يغير طريقة تعاملك مع كل منهما. Gemini 3.1 Pro موجود على OrcaRouter باسم google/gemini-3.1-pro-preview، بسعر القائمة من المزود مع تمرير بمقدار 0% هامش ربح، لذا فإن مستويات السياق القياسي والطويل تكلف بالضبط ما ينشره المزود، إلى جانب أكثر من 200 نموذج آخر على مفتاح API واحد. شارة المعاينة هي بالضبط النوع الذي يجب التوجيه حوله بدلاً من المراهنة عليه — لوحة معدل الأخطاء في صفحة النموذج موجودة لسبب، والتحويل الاحتياطي التلقائي يعني أن استجابة المعاينة المتدهورة تُوجَّه إلى مزود ثانٍ دون تغيير في الكود. Mercury 2.5 Preview ليس على OrcaRouter بعد؛ Inception يقدمه عبر واجهة برمجة التطبيقات الخاصة به والعديد من منصات الأطراف الثالثة. النموذج الذي يبلغ عمره يومين ولا يمكنك وضعه بعد خلف التحويل الاحتياطي هو مرشح للاختبار، وليس اعتمادًا للإنتاج. في اليوم الذي يدرجه المزود، يتم تطبيق نفس التمرير المباشر ويصل الخصم التمهيدي هنا في نفس اليوم — وهذا هو الوقت الذي تصبح فيه هذه المواجهة قاعدة توجيه بدلاً من قرار.
الخلاصة الصادقة هي أن هاتين النسختين التجريبيتين تجيبان عن سؤالين مختلفين. يجيب Gemini 3.1 Pro عن سؤال «أي نموذج ينبغي أن أبني منتجي عليه اليوم؟» — فهو متعدد الوسائط، طويل السياق، خضع لاختبارات مستقلة، ومستقر، بسعر يعكس كل ذلك. ويجيب Mercury 2.5 Preview عن سؤال «ما السرعة القصوى التي يمكن للاستدلال النصي بلوغها فعليًا؟» — وهندسة السرعة فيه هي أكثر ما يثير الاهتمام في النموذج، وهي بانتظار مختبر مستقل لتأكيد ما إذا كانت الجودة المرافقة لها حقيقية. إذا كانت أعباء عملك متعددة الوسائط أو طويلة السياق، فقد حُسم الاختيار بالفعل. أما إذا كانت أعباء عملك نصية فقط، وحساسة لتراكم زمن الاستجابة، وحساسة للسعر، فإن Mercury 2.5 Preview هو الرهان الذي يستحق المتابعة — و8 سبتمبر هو التاريخ الذي يُقاس عليه.

