بطاقة رئيسية مُولّدة لمقارنة بين GPT-6.1 Sol وGrok 4.7، بعنوان «أرخص بنسبة 40% لكل توكن، و5.2 ضعف الفاتورة»، مع ثلاث شارات مكتوب عليها «مخرجات Grok 4.7: 6.00 دولارات لكل مليون»، و«مخرجات GPT-6.1 Sol: 10.00 دولارات لكل مليون»، و«توكنات الإخراج في تشغيل المؤشر: 67 مليون مقابل 240 مليون»، وشعار OrcaRouter في الزاوية اليمنى السفلى.
Guides & Insights

جي بي تي-6.1 سول مقابل جروك 4.7: أرخص سعر للإخراج في القاعة، وأغلى محادثة

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Grok 4.7، خليفة Grok 4.6 من xAI، صدر في 21 سبتمبر 2026 بسعر 2.00 دولار لكل مليون توكن إدخال و6.00 دولار لكل مليون توكن إخراج. GPT-6.1 Sol، تحديث OpenAI للفئة المتوسطة، صدر بعد ثمانية أيام في 29 سبتمبر بسعر 2.00 دولار للإدخال و10.00 دولار للإخراج. أسعار الإدخال متطابقة، وسعر الإخراج أرخص بنسبة 40% على Grok 4.7، وهنا تتوقف معظم المقارنات. لكنه المكان الخاطئ للتوقف، لأن الجهة المستقلة نفسها قاست الآن كلا النموذجين من البداية إلى النهاية: استهلك Grok 4.7 نحو 240 مليون توكن إخراج عند إكمال Artificial Analysis Intelligence Index؛ واستهلك GPT-6.1 Sol 67 مليونًا. اضرب السعر الأرخص في حجم أكبر بثلاثة أضعاف ونصف، فالنموذج الأقل سعرًا لكل توكن يكلف 3.74 دولار لكل مهمة مكتملة مقابل 0.72 دولار.

نموذجان يفصل بينهما ثمانية أيام، وبطاقة أسعار تنقلب

Grok 4.7 هو أقوى نموذج لدى x​AI في البرمجة وأعمال المعرفة: نافذة سياق بسعة 500,000 رمز، وحتى 450,000 رمز إخراج في استجابة واحدة وفقًا لقائمة المورّد نفسه، وإدخال نصي وصوري وملفات، وجهد الاستدلال قابل للضبط عبر منخفض، متوسط (افتراضي)، مرتفع ومرتفع جدًا. لم تفصح x​AI عن عدد المعاملات، ويُذكر أن تاريخ قطع التدريب المسبق هو يونيو 2026 مع تدريب تكميلي حتى أغسطس.

GPT-6.1 Sol هو تحديث بخطوة واحدة من OpenAI لطبقة GPT-6 Sol، يقع دون GPT-6 Astra وفوق GPT-6 Luna: 1,050,000 رمز من السياق — أي ضعف ما لدى Grok تقريبًا — مع حد أقصى للإخراج يبلغ 128,000 رمز، وهو ما يعادل ثلث ما لدى Grok تقريبًا، وتاريخ قطع المعرفة 30 أبريل 2026، ونفس إدخال النص والصور والملفات. يعمل سلم الاستدلال الخاص به منخفض عبر الأقصى مع افتراضي متوسط، ولم يعد يقبل لا شيء على الإطلاق.

سطر واحد لكل بُعد، وكلا الجانبين على كلٍّ منها:

• الإدخال — GPT-6.1 Sol 2.00 دولار لكل مليون رمز مقابل Grok 4.7 2.00 دولار لكل مليون رمز؛ متطابقان
• الإخراج — GPT-6.1 Sol 10.00 دولار لكل مليون رمز مقابل Grok 4.7 6.00 دولار لكل مليون رمز؛ Grok أرخص بنسبة 40%
• الإدخال المخزَّن مؤقتًا — GPT-6.1 Sol 0.10 دولار لكل مليون رمز مقابل Grok 4.7 0.50 دولار لكل مليون رمز؛ Sol أرخص خمس مرات، عكس ما يوحيه سطر الإخراج
• نافذة السياق — 1,050,000 رمز مقابل 500,000
• الحد الأقصى للإخراج في استجابة واحدة — 128,000 رمز مقابل 450,000 مزعوم
• مستوى السياق الطويل — يُعاد تسعير الطلب بالكامل عند تجاوز 272,000 رمز إدخال بمقدار 2× للإدخال والتخزين المؤقت و1.5× للإخراج، مقابل مضاعفة كل معدل عند تجاوز 200,000 رمز إدخال، وذلك للطلب بأكمله أيضًا
• جهد الاستدلال — منخفض، متوسط (افتراضي)، مرتفع، xhigh، max مقابل منخفض، متوسط (افتراضي)، مرتفع، xhigh
• الأوزان والمعاملات — مغلق، غير معلن مقابل مغلق، غير معلن؛ لا يمنحك أي منهما نقطة تفتيش
• مؤشر الذكاء عند أقصى جهد معلن — GPT-6.1 Sol 51.8 عند max مقابل Grok 4.7 46.4 عند xhigh
• التكلفة لكل مهمة مؤشر، مستقلة — 0.72 دولار مقابل 3.74 دولار
• رموز الإخراج في تشغيل المؤشر — 67 مليون مقابل 240 مليون، مقارنةً بوسيط لوحة الصدارة الذي يقارب 81 مليونًا

سطران في تلك القائمة يمثلان المقارنة كلها. معدل إخراج Grok 4.7 أدنى حقًا، وبند التخزين المؤقت لديه أعلى حقًا بخمس مرات؛ وقد أنتج ثلاثة أضعاف ونصف عدد الرموز لكي يُقاس. بطاقة الأسعار، إذا قُرئت وحدها، تشير في اتجاه. أما القياس فيشير في الاتجاه الآخر، بمعامل خمسة.

A generated hero card for a GPT-6.1 Sol versus Grok 4.7 comparison, headed '40% cheaper per token, 5.2 times the bill', with two badges reading 'Grok 4.7 output: $6.00 per 1M' and 'GPT-6.1 Sol output: $10.00 per 1M', a footer reading 'Independent figures per Artificial Analysis v4.3.2; Grok at xhigh, Sol at max; AI-generated card', and the OrcaRouter logo in the bottom-right corner.

أين يتقدّم Grok 4.7 فعلاً

سيكون من غير الأمانة أن ننشر هذا المقال على أنه هزيمة ساحقة، لأن Grok 4.7 يفوز في التقييمات الحقيقية. تم تقييمهما جنبًا إلى جنب بأقصى جهد منشور على Artificial Analysis v4.3.2 — Grok عند xhigh، Sol عند max، وهو فرق في التكوين يستحق أن يبقى في الاعتبار طوال الوقت:

• GDPval-AA v2.1 — Grok 4.7 بتصنيف Elo 1715.4 مقابل GPT-6.1 Sol بتصنيف Elo 1575.1. تقدم بـ140 نقطة في تصنيف Elo في أعمال المعرفة ذات القيمة الاقتصادية، وأكبر فوز منفرد مستقل للنموذج ذي بطاقة السعر الأرخص.
• AutomationBench-AA — Grok 4.7 0.6556 مقابل GPT-6.1 Sol 0.6487. عمليًا تعادل، لكنه اسميًا لصالح Grok.
• SciCode — Grok 4.7 0.5741 مقابل GPT-6.1 Sol 0.5417. تقدم بـ3.2 نقطة في البرمجة العلمية.
• Terminal-Bench 4.0 — Grok 4.7 0.2576 مقابل GPT-6.1 Sol 0.5606. تأخر بـ30 نقطة، وهو أكبر فارق في هذه الثنائية.
• Humanity's Last Exam — Grok 4.7 0.4314 مقابل GPT-6.1 Sol 0.5292.
• AA-LCR v1.1، الاستدلال بالسياق الطويل — Grok 4.7 0.7667 مقابل GPT-6.1 Sol 0.83.
• AA-Omniscience — Grok 4.7 32.0 مقابل GPT-6.1 Sol 41.5.
• GDP.pdf — Grok 4.7 0.20 مقابل GPT-6.1 Sol 0.31.
• CritPt — Grok 4.7 0.1771 مقابل GPT-6.1 Sol 0.3171.

ثلاث من تسع تقييمات تذهب إلى Grok 4.7 أو تنتهي بالتعادل، بما في ذلك التقييم الذي يصعب الجدال فيه أكثر من غيره: صُمّم GDPval-AA لتسعير العمل المهني ذي القيمة الاقتصادية، وتقدُّم بفارق 140 نقطة في Elo ليس ضجيجًا. إذا كان عبء عملك من النوع الذي بُني GDPval ليمثله — تحليل كثيف المستندات، ومخرجات مهنية، وقرارات تقديرية لها إجابة صحيحة — فإن النموذج الأرخص في بطاقة الأسعار هو أيضًا النموذج الأفضل على اللوحة المحايدة، وعقوبة التكلفة لكل مهمة هي ما تدفعه مقابل ذلك.

أرقام الإطلاق الخاصة بـ x​AI كبيرة، وكما هي الحال مع كل أرقام إطلاق المورّدين، غير مُعاد إنتاجها. CursorBench 4.0 عند 46.3% عند xhigh مقابل 40.4% لـ Grok 4.6؛ Terminal-Bench 4.0 عند 38.0% مقابل 20.3%، وهو أكبر مكسب منفرد مُعلَن في الإصدار؛ DeepSWE v1.1 عند 71.0% عند high مقابل 65.2%؛ EEBench عند 64.0% مقابل 53.0%. تلك هي بيئة الاختبار الخاصة بـ x​AI، وإعدادات x​AI، وإبلاغ x​AI — ولاحظ أن ادعاء 38.0% في Terminal-Bench 4.0 يأتي مقابل 0.2576 لدى لوحة الصدارة المستقلة للنموذج نفسه على المعيار نفسه، وهو نوع التباين الذي ينبغي أن تتوقعه بين تهيئة مضبوطة من مورّد وتشغيل محايد بأقصى جهد.

أرقام OpenAI الخاصة بـ GPT-6.1 Sol تستحق الخصم ذاته ولها نقطة الضعف نفسها. الرقم الوحيد في هذه المقارنة الذي لم ينتجه أي من المورّدين هو التكلفة لكل مهمة مكتملة، لأنه يُحتسب من استهلاك الرموز المقيس لا من جدول الدرجات. ذلك هو الرقم الذي يصمد.

لماذا تحسم 240 مليون رمز الأمر

يصف Artificial Analysis إسهاب Grok 4.7 في ملخّصها الخاص، وعدد الرموز الكامن وراء تشغيل المؤشر هو الدليل: 240 مليون رمز مُخرَج مقابل وسيط لوحة يقارب 81 مليونًا، أي نحو ثلاثة أضعاف ما ينتجه نموذج نمطي في المجموعة نفسها. أما الـ67 مليونًا الخاصة بـ GPT-6.1 Sol فتقع أدنى بكثير من الوسيط. اجمع النسبتين معًا — 3.6× من الحجم عند 0.6× من السعر — لتجد أن سعر الإخراج الأرخص يشتري مزيدًا من الرموز لا فاتورة أصغر، وهو بالضبط ما تبدو عليه فجوة تكلفة المهمة الواحدة بين 3.74 دولار و0.72 دولار.

التخزين المؤقت يغيّر حجم الأثر لا اتجاهه، وهذه هي التفصيلة التي تربك الناس. المدخلات المخزنة مؤقتًا في Grok 4.7 تكلف 0.50 دولار لكل مليون مقابل 0.10 دولار لدى Sol — أي أغلى خمس مرات على السطر الذي تعيش عليه سجلات الوكلاء الطويلة ومطالبات النظام المتكررة. لذلك يجد عبء عمل يغلب عليه إعادة قراءة بادئة كبيرة مستقرة أن النموذجين أقرب مما توحي به المقارنة بين 6 دولارات و10 دولارات، وبمجرد إضافة إسهاب Grok فوق ذلك، يصبحان أبعد مما توحي به أسعار المدخلات. يشير خط التخزين المؤقت وخط الرموز إلى الاتجاه نفسه هنا، وهو أمر غير معتاد ويجعل هذه المقارنة أنظف مما توحي به بطاقات الأسعار.

تستحق بنود السياق الطويل تسعيرها بشكل منفصل لأنها تُفعَّل عند نقاط مختلفة. يعيد GPT-6.1 Sol تسعير الطلب بأكمله عندما يتجاوز 272,000 رمز إدخال؛ ويفعل Grok 4.7 الشيء نفسه فوق 200,000. في استدعاء من 250,000 رمز، يكون Grok قد ضاعف بالفعل — 4.00$ و12.00$ مع قراءة ذاكرة تخزين مؤقت بـ1.00$ — بينما لا يزال Sol على سعره القياسي 2.00$ و10.00$. بين 200,000 و272,000 رمز، يكون النموذج ذو قائمة الأسعار الأرخص هو الأغلى بفارق كبير، وهذا النطاق شائع في العمل على المستندات.

النقطة التي يتفوق فيها Grok حقًا في البنية وليس في النتيجة هي سقف الإخراج. استجابة قصوى تبلغ 450,000 رمز مقابل 128,000 لدى Sol هي فئة مختلفة من المخرجات: قاعدة برمجية كاملة مولّدة، أو نص مفرّغ طويل، أو توليف بطول كتاب في استدعاء واحد. إذا كنت تصل إلى حدود الإخراج اليوم، فإن هذا البند يحسم المقارنة ولا ينطبق أي شيء في حساب التكلفة أعلاه — لا يمكنك شراء قدرة لا يمتلكها النموذج الآخر بأي ثمن.

كلاهما على مفتاح واحد، وهذا هو الجزء المفيد

يتوفر Grok 4.7 على OrcaRouter بسعر xAI المدرج نفسه — 2.00 دولار و6.00 دولار لكل مليون توكن، مع قراءة من الذاكرة المؤقتة بـ0.50 دولار، وارتفاع شريحة الـ200,000 توكن إلى 4.00 دولار و12.00 دولار يُمرَّر تمامًا كما تدرجه xAI — وقد وصل GPT-6.1 Sol إلى مساراتنا يوم إطلاقه بسعر OpenAI، 2.00 دولار و10.00 دولار، مع إدخال مخزّن مؤقتًا بـ0.10 دولار، وشريحة الـ272,000 توكن دون تغيير. لا يُضاف شيء إلى أيٍّ منهما: تمرّر المنصة سعر المزوّد المدرج كما هو بدلًا من رفع سعره، ما يعني أن أي تخفيض سعر من المورّد على أيٍّ من الجانبين يكون ساريًا هنا في اليوم نفسه الذي يكون فيه ساريًا هناك، بلا فاتورة ثانية ولا وسيط في المنتصف.

A screenshot of the OrcaRouter model page for grok/grok-4.7, showing the listing dated 2026-09-21, the model described as SpaceXAI's flagship for coding, agentic tasks and knowledge work, a 500K-token context with up to 450K output tokens, text, image and file input, and the list price of $2.00 input and $6.00 output per million tokens with a 4.03 s median time to first token.

بالنسبة لهذا الزوج تحديدًا، فإن الأمر يستحق أكثر من مجرد الراحة. يختلف النموذجان حول ما يتفوق فيه كل منهما — يتصدر Grok 4.7 في Elo الخاص بالعمل المهني وفي البرمجة العلمية، ويتصدر GPT-6.1 Sol في تنفيذ الطرفية والموثوقية الوقائعية والاسترجاع طويل السياق — والحد الفاصل بين أعباء العمل هذه يظهر في حركة المرور الخاصة بك قبل أن يظهر في أي معيار تقييم. إن إرسال طلبات على شكل GDPval في اتجاه وتشغيلات وكلاء طويلة الأفق في الاتجاه الآخر، خلف نقطة نهاية واحدة، مع تجاوز تلقائي للأعطال بين الاثنين وقاعدة توجيه تغيّرها في الإعدادات لا في عملية نشر، طريقة أرخص لاكتشاف ذلك الحد من مشروع تقييم. دمج النماذج، حيث تجيب مجموعة من النماذج معًا، هو الخيار الآخر الذي تقدمه المنصة إذا كنت تفضّل ألا تتعامل مع كل طلب على حدة إطلاقًا.

A screenshot of xAI's Grok 4.7 developer documentation, showing the model ID grok-4.7, the description 'SpaceXAI's frontier model for coding, agentic tasks, and knowledge work', text and image to text modalities, a 500,000-token context window, and pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens.

المكالمة

• العمل الوكيلي والطرفي ذو الإخراج الطويل، وحلقات البادئات المخزّنة مؤقتًا — GPT-6.1 Sol. ثلاثون نقطة على Terminal-Bench 4.0، وسطر ذاكرة مؤقتة أرخص خمس مرات وخُمس التكلفة لكل مهمة مكتملة.
• العمل المعرفي الاحترافي، وتحليل المستندات، ومهام الحكم — Grok 4.7 بفضل تقدّم قدره 140 نقطة في GDPval-AA Elo، مع وضع فاتورة التوكنات في الميزانية بدلًا من افتراضها.
• البرمجة العلمية — Grok 4.7، بفارق ضيق، في شريحة SciCode الخاصة باللوحة. اختبره مقابل مجموعتك الخاصة؛ فـ3.2 نقطة تقع ضمن النطاق الذي يمكن لمجموعة مطالبات مختلفة أن تحرّكه.
• الردود الفردية التي تتجاوز 128,000 توكن إخراج — Grok 4.7، ولا توجد أي حسابات تعوّض عنه.
• الطلبات التي تتراوح بين 200,000 و272,000 توكن إدخال — GPT-6.1 Sol، لأن Grok 4.7 قد ضاعف طلبه بالكامل بالفعل، بينما لم يفعل Sol ذلك.
• أرخص محادثة ممكنة — لا هذا ولا ذاك. كلاهما نموذجان بتسعير الطليعة وشهية توكنات طليعية؛ والمقارنة تدور حول أيهما ينهي مهمتك، لا أيهما الأرخص في المجرّد.
• إذا انتهت مقارنة بعبارة «Grok أرخص لكل توكن» — فقد انتهت خطوة واحدة مبكرًا جدًا. الخطوة التالية هي عدد التوكنات، وهو 240 مليون مقابل 67.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا