بطاقة عنوان رئيسية لـ 'Mercury 2.5 Preview مقابل Gemini 3.1 Pro' مع العنوان الفرعي 'معاينتان، بفارق ستة أشهر'. اللوحة اليسرى الموسومة بـ 'Mercury 2.5 Preview' تعرض رمز صاعقة، وحبة 'سياق 256K'، ووسم 'نص فقط'، وحبة 'سعر تمهيدي $0.04'؛ اللوحة اليمنى الموسومة بـ 'Gemini 3.1 Pro' تعرض مجموعة رموز متعددة الوسائط (صورة، صوت، فيديو)، وحبة 'سياق 1M'، وشارة 'مؤشر AA 57 عند الإطلاق'، وحبة '$2.00 / $12.00'. شارة رفيعة 'مقابل' تقع بينهما. شعار OrcaRouter مُركّب في الزاوية السفلية اليمنى.
Guides & Insights

ميركوري 2.5 بريفيو ضد جيميني 3.1 برو: نسختا معاينة، بينهما ستة أشهر

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

كلا النموذجين في هذه المواجهة يحملان كلمة "معاينة" في اسميهما، وهنا ينتهي التشابه. كل من Mercury 2.5 Preview و Gemini 3.1 Pro هما نموذجا تفكير (reasoning) يمكنك استدعاؤهما من واجهة برمجة التطبيقات (API) اليوم، لكنهما معاينتان في طرفين متقابلين من عمرهما. Gemini 3.1 Pro، نموذج التفكير الرائد، موجود في مرحلة المعاينة منذ 19 فبراير 2026 — مع ستة أشهر من التقييمات المستقلة، ومواضع في لوحات الصدارة العامة، وحركة إنتاج فعلية خلفه، ومؤشر ذكاء تحليلي اصطناعي (Artificial Analysis Intelligence Index) يبلغ 57 عند الإطلاق، وإدخال متعدد الوسائط عبر النص والصورة والصوت والفيديو، وسياق سعته 1M رمز (token)، وسعر يبلغ 2.00 دولار / 12.00 دولار لكل مليون رمز. أما Mercury 2.5 Preview، نموذج الانتشار اللغوي من Inception الذي صدر في 31 أغسطس 2026، فعمره يومان فقط: نموذج نصي فقط بسياق 256K، وسرعة مزعومة تبلغ 1,107 رمز في الثانية، وسعر قائمة يبلغ 0.20 دولار / 0.75 دولار (نحو 0.04 دولار / 0.15 دولار مع خصم حتى 8 سبتمبر)، وليس لديه أي اختبار معياري مستقل. إن تسميتهما معًا "معاينتين" يخفي السؤال الحقيقي، وهو: كم تساوي بداية سابقة من الأدلة تمتد لستة أشهر أمام طريقة أسرع جوهريًا لتوليد النص؟

ما هو كل نموذج في الواقع

Gemini 3.1 Pro هو نموذج رائد مغلق ومتعدد الوسائط ومتعدد الأغراض في مجال الاستدلال. يقرأ النصوص والصور والصوت والفيديو، ويتعامل مع نافذة سياق تبلغ مليون رمز مع سقف إخراج يبلغ 64 ألف رمز، ويضبط عمق استدلاله ديناميكيًا — يصف البائع أربعة مستويات من كثافة الاستدلال تتدرج مع تعقيد المهمة. الأرقام المعلنة عند إطلاقه — ARC-AGI-2 بنسبة 77.1%، وGPQA Diamond بنسبة 94.3%، وSWE-bench Verified بنسبة 80.6%، وTerminal-Bench 2.0 بنسبة 68.5% — هي أرقام أبلغ عنها البائع، لكنها ترتكز على ستة أشهر من التدقيق المستقل، بما في ذلك إعادة قياس من Artificial Analysis على مقياس مؤشر أكثر صرامة حيث يسجّل النموذج حوالي 46.5. تلك إعادة القياس هي بالضبط ما يستحقه نموذج ناضج: فقد خضع لاختبارات مكثفة بما يكفي ليجعل المؤشر أكثر صرامة حوله. Mercury 2.5 Preview هو نموذج انتشار — يولّد الرموز ويحسّنها بالتوازي بدلاً من واحد تلو الآخر — مع استدلال قابل للضبط، واستدعاءات أدوات متوازية، وJSON متوافق مع المخطط، وهو مبني لأحمال العمل المتراكمة زمن الاستجابة التي تسميها Inception: وكلاء البحث، وخطوط معالجة الصوت، والوكلاء الفرعيون للبرمجة. كل ادعاء جودة مرتبط به، بما في ذلك قفزة تزيد على 10 نقاط عن Mercury 2، هو ادعاء من البائع نفسه، ولم يقِسه أي طرف ثالث.

A screenshot of the Artificial Analysis model page for Inception's Mercury 2, the diffusion model Mercury 2.5 Preview builds on, showing its independently measured output speed of 684 tokens per second, its $0.25 / $0.75 per-1M pricing, its 128K context window, and its Intelligence Index score of 22.

تباين المواصفات

السعر — Mercury 2.5 Preview: $0.20 / $0.75 لكل 1M إدخال/إخراج، ~$0.04 / $0.15 سعر تمهيدي حتى 8 سبتمبر. Gemini 3.1 Pro: $2.00 / $12.00 لكل 1M، ثم يتدرج إلى $4.00 / $18.00 فوق 200K إدخال.

السياق / المخرجات — Mercury 2.5 Preview: سياق 256K. Gemini 3.1 Pro: سياق 1M، أقصى مخرجات 64K.

المدخلات — Mercury 2.5 Preview: نص فقط. Gemini 3.1 Pro: نص، صورة، صوت، فيديو، ملف.

البنية — Mercury 2.5 Preview: نموذج لغوي كبير انتشاري، توليد متوازٍ للتوكنات. Gemini 3.1 Pro: تراجعي ذاتي، عمق استدلال ديناميكي.

السرعةMercury 2.5 Preview: ادعاء بسرعة 1,107 رمزًا في الثانية. Gemini 3.1 Pro: لا يوجد ادعاء رئيسي مماثل.

الأدلة — Mercury 2.5 Preview: حسب تقارير البائع فقط. Gemini 3.1 Pro: مؤشر AA 57 عند الإطلاق (46.5 بالمقياس الأحدث) بالإضافة إلى سجل تقييم مستقل طويل.

A two-column scoreboard titled 'Mercury 2.5 Preview vs Gemini 3.1 Pro — the scoreboard'. Left column 'Mercury 2.5 Preview': 'Price: $0.20 / $0.75 (intro $0.04 / $0.15)', 'Inputs: text only', 'Context: 256K', 'Speed: 1,107 tok/s (claimed)', 'Independent score: none yet', 'Preview since: Aug 31, 2026'. Right column 'Gemini 3.1 Pro': 'Price: $2.00 / $12.00', 'Inputs: text, image, audio, video', 'Context: 1M', 'Speed: autoregressive', 'Independent score: AA Index 57 at launch', 'Preview since: Feb 19, 2026'. A footer reads 'Gemini index per Artificial Analysis; Mercury figures vendor-reported.' The OrcaRouter logo is composited in the bottom-right corner.

فجوة تعدد الوسائط هي الفارق الحاسم

بالنسبة لمعظم التطبيقات، يُحسم هذا المقارنة قبل دخول التسعير أو المعايير في الصورة، لأن Mercury 2.5 Preview لا يمكنه الرؤية. أما Gemini 3.1 Pro فيقرأ لقطات الشاشة والرسوم البيانية والصوت والفيديو — إنه النموذج الذي توجّهه إلى ملف PDF أو رسم بياني أو تسجيل اجتماع أو واجهة مستخدم عندما تريد إجابة عن شيء ليس نصًا بالفعل. إن Mercury 2.5 Preview نصي فقط بحكم التصميم؛ فالنموذج اللغوي الانتشار الذي يولّد النص بالتوازي لا يملك مسار إدخال للصور أو الصوت إطلاقًا. بالنسبة لتطبيق كثيف المستندات، أو وكيل رؤية، أو أي منتج متعدد الوسائط، فإن Gemini 3.1 Pro هو المرشح الوحيد هنا، نقطة وانتهى. إن قيد النصية فقط في Mercury 2.5 Preview ليس تحذيرًا بخط صغير؛ بل هو الحد الذي يحدد المهام التي يكون النموذج مؤهلاً لها أصلًا.

ستة أشهر من الاختبارات مقابل يومين

عند النظر إلى الأدلة، فهذه ليست منافسة، ومن المهم أن نوضح السبب بصراحة. {{1}}Gemini 3.1 Pro{{/1}} تم تفكيكه من قبل مختبرات مستقلة على مدى ستة أشهر؛ وتم تثبيت نتيجته، وإعادة قياسها، والجدال بشأنها، وهذا هو شكل "الجديرة بالثقة" بالنسبة لنموذج. {{2}}Mercury 2.5 Preview{{/2}} لديه مصدر معلومات واحد — وهو صانعه — وهذا المصدر يدّعي قفزة ذكاء تتجاوز 10 نقاط مقارنةً بـ{{3}}Mercury 2{{/3}} وتكافؤًا مع الطبقة المحسّنة من حيث التكلفة في الحدود القصوى. كلا العبارتين قد تكونان صحيحتين. لكن لم يؤكدهما أي شخص خارج {{4}}Inception{{/4}}، والنموذج جديد جدًا بحيث لا يمكن توقع أي شيء آخر غير ذلك. عدم التماثل ليس في كون أحدهما أفضل؛ بل في أن أحدهما قابل للمعرفة والآخر ليس كذلك بعد.

حيث تتفوق سرعة عطارد حقًا

الحالة الصادقة لـ Mercury 2.5 Preview ضيّقة، نصّية فقط، وحقيقية. توليد التوكنات المتوازية يغيّر معادلة زمن الاستجابة بطريقة لا يستطيع أي نموذج انحداري — بما في ذلك Gemini 3.1 Pro — مجاراتها، لأن النموذج الانحداري تسلسلي بطبيعته. بالنسبة لخط الصوت، المفارقة هي أن المدخلات والمخرجات صوتية لكن التفكير بينهما نصي: طبقة تفكير نصي سريعة هي تحديدًا ما يجعل الوكيل الصوتي يبدو مستجيبًا. بالنسبة لوكيل بحث يكرر استدعاءات الأدوات، ولوكيل برمجة فرعي يطلق العديد من الاكتمالات الصغيرة لكل مهمة، فإن زمن الاستجابة لكل استدعاء يتراكم ليصبح سرعة محسوسة. عند السعر التمهيدي — 0.04$ للدخول، 0.15$ للخروج — فإن Mercury 2.5 Preview أرخص بنحو 80 مرة من معدل الإخراج القياسي لـ Gemini 3.1 Pro، مما يجعله ليس أسرع فحسب، بل فئة تكلفة مختلفة للتفكير النصي عالي الحجم. التحفّظ الذي يجب أن يرافق كل جملة من هذه الجمل: السرعة ادعاء، وتكافؤ الجودة ادعاء، ولا يوجد أي قياس مستقل.

التسعير: علاوة السياق الطويل من Gemini مقابل العرض التشويقي من Mercury

تحتوي بطاقة أسعار Gemini 3.1 Pro على تفصيل يستحق المعرفة قبل مقارنة الأرقام الرئيسية: الطلبات التي تتجاوز 200 ألف توكِن إدخال تقفز من 2.00 دولار / 12.00 دولار إلى 4.00 دولار / 18.00 دولار لكل مليون. وفي نموذج بسياق يبلغ مليون توكِن، لا تُعد هذه العلاوة للسياق الطويل حالةً هامشية — بل هي ثمن الاستخدام الفعلي للنافذة التي يشتهر بها النموذج. أما Mercury 2.5 Preview فلا يتضمن مثل هذه القفزة، ومن غير المرجح أن يصل سياقه البالغ 256 ألف توكِن إلى نطاق السياق الطويل في كثير من الأحيان. لكن السعر المنخفض لـ Mercury هو مجرد إغراء ينتهي في 8 سبتمبر، بينما سعر Gemini هو تعريفة مستقرة ومنشورة. وعند المقارنة، قارن السعر الرسمي لـ Mercury البالغ 0.20 دولار / 0.75 دولار بالفئة القياسية لـ Gemini، وليس بالرقم المخفّض — فالخصم هو حافز للتجربة، وليس السعر الذي يجب التخطيط بناءً عليه.

قرار التوجيه

كلا النموذجين قابلان للتوجيه اليوم، وهذا يغير طريقة تعاملك مع كل منهما. Gemini 3.1 Pro موجود على OrcaRouter باسم google/gemini-3.1-pro-preview، بسعر القائمة من المزود مع تمرير بمقدار 0% هامش ربح، لذا فإن مستويات السياق القياسي والطويل تكلف بالضبط ما ينشره المزود، إلى جانب أكثر من 200 نموذج آخر على مفتاح API واحد. شارة المعاينة هي بالضبط النوع الذي يجب التوجيه حوله بدلاً من المراهنة عليه — لوحة معدل الأخطاء في صفحة النموذج موجودة لسبب، والتحويل الاحتياطي التلقائي يعني أن استجابة المعاينة المتدهورة تُوجَّه إلى مزود ثانٍ دون تغيير في الكود. Mercury 2.5 Preview ليس على OrcaRouter بعد؛ Inception يقدمه عبر واجهة برمجة التطبيقات الخاصة به والعديد من منصات الأطراف الثالثة. النموذج الذي يبلغ عمره يومين ولا يمكنك وضعه بعد خلف التحويل الاحتياطي هو مرشح للاختبار، وليس اعتمادًا للإنتاج. في اليوم الذي يدرجه المزود، يتم تطبيق نفس التمرير المباشر ويصل الخصم التمهيدي هنا في نفس اليوم — وهذا هو الوقت الذي تصبح فيه هذه المواجهة قاعدة توجيه بدلاً من قرار.

الخلاصة الصادقة هي أن هاتين النسختين التجريبيتين تجيبان عن سؤالين مختلفين. يجيب Gemini 3.1 Pro عن سؤال «أي نموذج ينبغي أن أبني منتجي عليه اليوم؟» — فهو متعدد الوسائط، طويل السياق، خضع لاختبارات مستقلة، ومستقر، بسعر يعكس كل ذلك. ويجيب Mercury 2.5 Preview عن سؤال «ما السرعة القصوى التي يمكن للاستدلال النصي بلوغها فعليًا؟» — وهندسة السرعة فيه هي أكثر ما يثير الاهتمام في النموذج، وهي بانتظار مختبر مستقل لتأكيد ما إذا كانت الجودة المرافقة لها حقيقية. إذا كانت أعباء عملك متعددة الوسائط أو طويلة السياق، فقد حُسم الاختيار بالفعل. أما إذا كانت أعباء عملك نصية فقط، وحساسة لتراكم زمن الاستجابة، وحساسة للسعر، فإن Mercury 2.5 Preview هو الرهان الذي يستحق المتابعة — و8 سبتمبر هو التاريخ الذي يُقاس عليه.

A screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview) showing the model header, the Home > Models > Google breadcrumb, the February 19, 2026 preview start date, and the description of Google's frontier reasoning model.
© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube