
Mercury 2.5 Preview مقابل Grok 4.6: هل يمكن لإصدار Preview بسرعة 1,107 توكن/ثانية أن يكسر سعر بطل القيمة؟
- AlibabaجديدQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.3 Flash2026-08-2658الذكاء72البرمجة
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1653الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1560الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0952الذكاء71البرمجة
إليك الإجابة في جملة واحدة: يُعدّ Mercury 2.5 Preview أرخص نموذج استدلال موثوق في الإنتاج اليوم بسعر $0.04 / $0.15 لكل مليون توكن، بينما يُعدّ Grok 4.6 أرخص نموذج في فئة النماذج الحدودية بسعر $2.00 / $6.00 — لذا فإن السؤال العملي بينهما هو: هل يمكن لنموذج انتشار تجريبي تكتفي شركة Inception بالادعاء بأنه «قابل للمقارنة مع» GPT-5.6 Luna (Low) وClaude Haiku 4.5 أن يؤدي المهام التي كنت ستدفع مقابلها عادةً لاستخدام الطبقة الحدودية من النماذج؟ يولّد Mercury 2.5 Preview، الذي صدر في 31 أغسطس 2026، التوكنات بالتوازي ويدّعي تحقيق 1,107 توكن في الثانية على وحدات معالجة رسومية قياسية؛ بينما يسجّل Grok 4.6، النموذج الحدودي الرائد الذي صدر في 12 أغسطس 2026، 61 نقطة على مؤشر Artificial Analysis Intelligence Index، متعادلًا على المركز الثالث عالميًا، ويحقق ذلك بسعر لم يسبق أن شهدته النماذج الحدودية. هذا التصادم — ادعاء السرعة القصوى في أسفل منحنى الأسعار يلتقي بأفضل قيمة في قمته — هو موضوع هذا المقال.
النقاط الرئيسية
• Grok 4.6 بسعر 2.00$ / 6.00$ مع مؤشر الذكاء الاصطناعي AA بمعدل 61 هو بطل القيمة في الطبقة الحدودية؛ أما Mercury 2.5 Preview بسعر 0.04$ / 0.15$ فهو رهان على أن الجودة الجيدة بما فيه الكفاية بسعر 1/50 تجلب أداءً يفوق الجودة الحدودية التي نادرًا ما تحتاجها.
• ادعاءات Mercury 2.5 Preview بخصوص السرعة والجودة هي بالكامل من Inception؛ لم توجد أي نتائج معايير مستقلة في اليوم الأول.
• خصم الإطلاق البالغ 80% على Mercury 2.5 Preview ينتهي في 8 سبتمبر 2026، وبعدها يصبح سعره الرسمي $0.20 / $0.75 — وهو لا يزال أرخص بـ10 مرات من Grok 4.6 في الإدخال، لكنها قصة أقل أهمية.
• يتم توجيه Grok 4.6 عبر OrcaRouter اليوم بالسعر المعلن؛ لم يتم توجيه Mercury 2.5 Preview بعد، ويتم تقديمه عبر واجهة برمجة التطبيقات الخاصة بـ Inception والعديد من منصات الطرف الثالث.
لوحة النتائج

• الذكاء — Mercury 2.5 Preview: لا يوجد مؤشر مستقل؛ تدّعي Inception التكافؤ مع الفئة المحسّنة من حيث التكلفة. Grok 4.6: حقّق 61 في AA Intelligence Index، متعادلًا في المركز الثالث عالميًا (وفقًا لـ Artificial Analysis؛ أرقام المختبر نفسه مقدَّمة من البائع).
• السعر — معاينة Mercury 2.5: $0.04 / $0.15 لكل مليون توكين (بخصم 80% عن $0.20 / $0.75، حتى 8 سبتمبر 2026). Grok 4.6: $2.00 / $6.00 لكل مليون توكين، ويتضاعف إلى $4.00 / $12.00 للمطالبات التي تبلغ 200 ألف توكين أو أكثر.
• السرعة — Mercury 2.5 Preview: 1,107 توكن/ثانية بحسب ما أعلنه البائع. Grok 4.6: السرعة ليست المواصفة الرئيسية؛ فالنموذج مصمَّم لتشغيلات وكيلية طويلة، وليس لتدفقات سريعة.
• السياق — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.
• العمل الوكيلي — Mercury 2.5 Preview: لا توجد نتائج عامة، وإن كانت استدعاءات الأدوات المتوازية مدعومة. Grok 4.6: APEX-Agents 57.5، DeepSWE v1.1 65.9، CursorBench v3.2 69.9 (مُبلَّغ عنها من المورّد وغير مُعاد إنتاجها في معظمها).
• الأوزان — ميركوري 2.5 بريفيو: مغلق ومملوك. جروك 4.6: مغلق ومملوك.
بطل القيمة وتخطي السعر
موقف Grok 4.6 غير معتاد. فهو يحتل المرتبة الثالثة في الذكاء على مؤشر Artificial Analysis — متعادلًا مع GPT-5.6 Sol Max — بينما هو أرخص من كل نموذج يقترب منه بعشر نقاط، وقد ركّزت التغطية الإعلامية لإطلاقه على عمليات الوكلاء الطويلة التي تنتهي بمتوسط يقارب 0.84 دولارًا للمهمة الواحدة في تقييم يديره أحد البائعين. هذا هو تعريف البطل القيّم: قدرة قريبة من الحدود القصوى بسعر يجعل تكاليف كل مهمة مرئية في جدول بيانات. أما Mercury 2.5 Preview فلا يسعى إلى أن يكون كذلك. تضعه Inception في مواجهة نماذج مثل GPT-5.6 Luna (Low) وGemini 3.5 Flash-Lite وClaude Haiku 4.5 — أي الفئة المحسّنة من حيث التكلفة، وليس الحدود القصوى. إذا كانت Inception محقة، فإن Mercury 2.5 Preview هو أدنى من Grok 4.6 بدرجة في القدرات، وأدنى بعدة درجات في السعر، وهو منتج متماسك تمامًا: قفزة سعرية لتلك المهام التي تُعد فيها فئة الحدود القصوى مضيعة.
ما الذي يغيّره فك الترميز المتوازي فعليًا
البنية هي الجزء الجدير بالفهم، لأنها تغيّر معنى "السرعة". تصدر النماذج الانحدارية الذاتية رمزًا واحدًا لكل خطوة، لذا تكون الإنتاجية محدودة بزمن الاستجابة التسلسلي؛ بينما يولّد نموذج لغوي انتشاريّ مثل Mercury 2.5 Preview كتلةً من الرموز بالتوازي ويحسّنها عبر خطوات إزالة الضوضاء، وهو ما يفصل الإنتاجية عن عدد الرموز المُنتجة. لهذا تستطيع Inception الادعاء بـ 1,107 رمز/ثانية على وحدات معالجة رسومية قياسية — دون مسرّعات خاصة أو حيل تجميع — ولهذا أيضًا فإن الادعاء العملي الحقيقي يتمثل في زمن أقل من 300 ميلي ثانية لصدور أول رمز في أعباء العمل التفاعلية. بالنسبة إلى وكيل صوتي، أو خط أنابيب بحث، أو وكيل فرعي للبرمجة يستدعي النموذج في كل دورة، فإن فارق الاستجابة هذا هو المنتج نفسه: إنه الفرق بين حلقة صوتية تشعر بأنها مباشرة وأخرى تتوقف. غير أنّ نماذج اللغة الانتشارية ما زالت مجالًا بحثيًا حديثًا، ورقم 1,107 هو رقم Inception، ولم يقِس أي مختبر مستقل هذه السرعة أو يقيّم انحراف الجودة، إن وُجد، الذي يُدخله التوليد المتوازي على المطالبات الطويلة أو العدائية.
حيث لا يزال Grok 4.6 يتفوّق في المهمة
لا شيء في معاينة Mercury 2.5 Preview يمسّ المجالات التي تحقق فيها Grok 4.6 مكاسب فعلية. تركّزت مكاسب Grok مقارنةً بـ Grok 4.5 على معايير الوكلاء والبرمجة — DeepSWE ارتفع 11.9 نقطة، وAPEX-Agents ارتفع 10.4، وTerminal-Bench ارتفع 10.3 — كما أن نافذة السياق البالغة 500K موجودة لخدمة الوكلاء طويلي الأفق الذين يتعين عليهم الاحتفاظ بالمهمة كاملة في السياق. توفّر معاينة Mercury 2.5 Preview استدعاءات أدوات متوازية، لكن نموذجًا بلا نتائج مستقلة في معايير الوكلاء، وبسقف إخراج يبلغ 65,536 رمزًا، وسياق يبلغ 260K ليس الأداة المناسبة لتشغيل هندسي برمجي من 50 خطوة. النموذجان بالكاد يتداخلان في الاستخدام: Grok 4.6 هي المحرك للعمل الذي يجب أن يُنجز فعلًا؛ أما معاينة Mercury 2.5 Preview فهي المحرك للعمل الذي يجب أن يبدو فوريًا ويكلف تقريبًا لا شيء لكل استدعاء.
نافذة الخصم 80%
التسعير هنا له تاريخ انتهاء صلاحية، وهو ما يغيّر القرار. سعر Mercury 2.5 Preview البالغ $0.04 / $0.15 هو خصم 80% عن السعر المعلن البالغ $0.20 / $0.75، وقد صرّحت Inception بأن العرض الترويجي يسري حتى 8 سبتمبر 2026. سعر Grok 4.6 البالغ $2.00 / $6.00 هو سعر معلن مستقر بهيكل واضح — إدخال مخزَّن مؤقتًا بسعر $0.50، ومستوى أولوية بسعر 2×، وحين يصل الطلب إلى 200 ألف توكن من النصوص الطويلة، يُفوتر الطلب بالكامل بالسعر الأعلى. إذا كنت تقارن أرقام اليوم، فتبدو Mercury أرخص 50× في الإدخال وأرخص 40× في الإخراج؛ أما إذا انتهى الخصم كما هو مقرر، فإن الفجوة الحقيقية على المدى الطويل هي 10× في الإدخال و5× في الإخراج. لا يُعد أي من العرضين مضللًا — فهما مجرد أفقين زمنيين مختلفين، وخط أنابيب يُسعَّر على أساس الخصم دون نقطة إعادة تقييم سيفاجأ في 9 سبتمبر. سعر Grok 4.6 البالغ $2.00 / $6.00 هو بالضبط ما تدفعه على OrcaRouter، حيث يُمرَّر السعر المعلن للمزوّد مباشرة بهامش ربح 0% — فعندما يغيّر المزوّد رقمًا ما، يصبح السعر ساريًا على المفتاح نفسه في اليوم نفسه، مع تجاوز تلقائي إذا فرض أحد مسارات المزوّد حدًّا على معدل الاستخدام.
الحكم في سطر واحد
إذا كانت المهمة يجب أن تُنجَز وتريد قدرة من الطراز الأول بأفضل سعر في الفئة، فاشترِ Grok 4.6 — إنه بطل قيمة مُثبت، متاح على OrcaRouter اليوم بسعر $2.00 / $6.00. أما إذا كانت المهمة استدلالًا نصيًا عالي الحجم وحساسًا لزمن الاستجابة، حيث يكون التحقق من الإجابات المقبولة رخيصًا، فإن Mercury 2.5 Preview بسعر $0.04 / $0.15 يُمثل قفزة سعرية تستحق التجربة داخل نافذة الخصم — فقط تذكر أن كل ادعاء على جانبه من اللوحة يعود إلى Inception، والدليل ما يزال معلقًا.


يقوم OrcaRouter بتمرير أسعار القائمة من المزودينبهامش ربح 0%مع تجاوز تلقائي للفشل، بحيث يصبح تغيير سعر المورد ساريًا على نفس المفتاح في نفس اليوم.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
