بطاقة عنوان رئيسية لمقال يقارن بين GPT-6 Sol Pro وGrok 4.7، تحمل عنوان "GPT-6 Sol Pro مقابل Grok 4.7" مع عنوان فرعي "ضعف الإسهاب، ثلث السعر".
Guides & Insights

GPT-6 Sol Pro مقابل Grok 4.7: ضعف الإسهاب، وثلث السعر

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

أرخص نموذجين قريبين من حدود الطليعة في سبتمبر 2026 صدرا بفارق يوم واحد، والأمر المثير للاهتمام فيهما ليس أيهما أذكى. GPT-6 Sol — النموذج الذي يلجأ إليه الناس عندما يبحثون عن GPT-6 Sol Pro، وهو ذلك النموذج نفسه مع ضبط reasoning.mode على pro بدلاً من كونه منتجًا منفصلًا — صدر في 22 سبتمبر 2026 بسعر 2.00 دولار لكل مليون توكن إدخال و10.00 دولارات لكل مليون توكن إخراج. Grok 4.7 صدر من المورّد في 21 سبتمبر بنفس سعر الإدخال 2.00 دولار، وسعر الإخراج 6.00 دولارات. على منصة التقييم المحايدة لدى Artificial Analysis، يفصل بين النموذجين نقطتا مؤشر، ونحو دولارين لكل مهمة مكتملة، والسبب في تلك الفجوة ليس القدرة. بل عدد التوكنات التي يحرقها كل منهما للوصول إلى هناك.

ولّد Sol 77 مليون رمز إخراج أثناء تشغيل Intelligence Index. وولّد Grok 4.7 240 مليون رمز. تلك النسبة — ما يزيد قليلًا على ثلاثة إلى واحد — هي المقارنة بأكملها، وهي تقلب الاستنتاج الذي يقدمه لك جدول أسعار لكل رمز.

بطاقتا الأسعار، وأين لا تكون الرخيصة رخيصة

كلا المورّدين ينشران هذه الأرقام بنفسيهما؛ ولم يُعَد تسعير أيٍّ منهما بشكل مستقل.

• إدخال — GPT-6 Sol ‏2.00 دولار لكل مليون رمز مقابل Grok 4.7 ‏2.00 دولار لكل مليون رمز

• الإخراج — GPT-6 Sol ‏10.00 دولارات لكل مليون رمز مقابل Grok 4.7 ‏6.00 دولارات لكل مليون رمز

• المدخلات المخزَّنة مؤقتًا — GPT-6 Sol بسعر 0.20 دولار لكل مليون رمز مقابل Grok 4.7 بسعر 0.50 دولار لكل مليون رمز؛ قراءة الذاكرة المؤقتة لدى Sol أرخص بمقدار مرتين ونصف، وهو عكس ما يوحي به سعر المخرجات المُعلن.

• نافذة السياق — GPT-6 Sol 1,050,000 توكن مقابل Grok 4.7 500,000 توكن

• رسوم إضافية للسياق الطويل — GPT-6 Sol تعيد تسعير الطلب الذي يتجاوز 272,000 رمز إدخال بمعدل 2× لأسعار الإدخال والتخزين المؤقت و1.5× للإخراج للطلب بأكمله، مقابل Grok 4.7 الذي يضاعف كل سعر عند 200,000 رمز إدخال، وذلك للطلب بأكمله أيضًا

• حد المعرفة — GPT-6 Sol في 20 أبريل 2026 مقابل Grok 4.7، بحد تدريب مسبق يُذكر أنه يونيو 2026 مع تدريب تكميلي حتى أغسطس

• جهد الاستدلال — GPT-6 Sol: لا شيء، منخفض، متوسط (افتراضي)، عالٍ، xhigh، أقصى مقابل Grok 4.7: منخفض، متوسط (افتراضي)، عالٍ، xhigh

• الوسائط — كلاهما يقبل إدخال النص والصورة ويُرجع نصًا

بند قراءة الذاكرة المؤقتة هو ما ينبغي للمشتري أن يتوقف عنده. معدل الإخراج لدى Grok 4.7 أقل بنسبة 40%، لكن مدخلاته المخزّنة مؤقتًا أعلى بنسبة 150%، والمدخلات المخزّنة مؤقتًا هي حيث توجد سجلات الوكيل الطويلة والتوجيهات النظامية المتكررة. عبء العمل الذي يقوم في معظمه بإعادة قراءة سياق كبير مستقر سيجد النموذجين أقرب بكثير مما توحي به المقارنة بين $6 مقابل $10.

A six-row scoreboard card titled 'GPT-6 Sol Pro vs Grok 4.7 - the scoreboard', comparing output price, cached input, context window, index tokens, AA Intelligence Index and cost per task. GPT-6 Sol Pro is listed at $10.00 output and $0.20 cached input per million tokens, a 1,050,000-token context, 77M index tokens, an AA Index of 48 and $1.06 per task; Grok 4.7 at $6.00 output and $0.50 cached input, a 500,000-token context, 240M index tokens, an AA Index of 46 and $3.74 per task. A footer reads 'Vendor list prices; index and cost figures per Artificial Analysis.'

السجل المستقل، والرقم الوحيد الذي يحسم الأمر

يُعدّ Artificial Analysis الأداة الوحيدة التي قامت بقياس كلا النموذجين، وتستحق أرقامه أن تُعرض جنبًا إلى جنب لأن التباين فيها مفيد.

• مؤشر الذكاء — GPT-6 Sol 48 بأقصى جهد مقابل Grok 4.7 46 عند xhigh؛ وكلاهما أعلى بكثير من الوسيط 25 للنماذج المماثلة

• التكلفة لكل مهمة فهرسة — GPT-6 Sol ‏1.06 دولار مقابل Grok 4.7 ‏3.74 دولار

• رموز الإخراج لجولة الفهرس — GPT-6 Sol 77M في مقابل Grok 4.7 240M، مقارنةً بوسيط قدره 88M

• سرعة الإخراج — سُجّلت Grok 4.7 عند 39 رمزًا في الثانية، وهي سرعة يصفها نظام الاختبار نفسه بأنها بطيئة بشكل ملحوظ؛ أما رقم Sol على اللوحة نفسها فغير منشور في سطر الملخص ذاته

• مؤشر وكلاء البرمجة — GPT-6 Sol 57 بتكلفة 2.99 دولار لكل مهمة مقابل Grok 4.7 56 مع أداة Grok Build الخاصة به، بارتفاع تسع نقاط عن Grok 4.6

فرق نقطتين في المؤشر، وتكلفة لكل مهمة تبلغ ثلاثة أضعاف ونصف. هذا ليس شذوذاً في التسعير — بل هو حساب الإسهاب. Grok 4.7 نموذج يفكّر بصوت عالٍ وبإسهاب؛ وتصنّفه أداة الاختبار بأنه «بالغ الإسهاب» مقابل وسيط يبلغ 88 مليون رمز، والتكلفة تتبع الرموز، لا قائمة الأسعار.

تحمل مقارنة وكيل البرمجة تحذيرًا تخفيه لوحة النتائج. فدرجة 56 الخاصة بـ Grok 4.7 تُقاس داخل بيئة اختبار Grok Build التابعة لـ xAI نفسها، وهي الإعداد الذي تطرحه xAI وتقيس عليه. أما درجة 57 الخاصة بـ Sol فتُقاس في بيئة اختبار محايدة. وميزة بيئة اختبار الطرف الأول بمقدار نقطة أو نقطتين تقع ضمن النطاق الذي يفسّره اختيار البيئة، ما يعني أن القراءة الأمينة هي أن هذين متعادلان في البرمجة الوكيلة — لا أن Sol متقدم بنقطة واحدة.

Screenshot of the Artificial Analysis model page for Grok 4.7 (xhigh), captured 23 September 2026, showing list pricing of $2.00 per million input tokens and $6.00 per million output tokens with a 75% cache discount, an Intelligence Index score of 46, a cost per Intelligence Index task of $3.74, 240 million output tokens generated during the index run, a 500,000-token context window, and a measured output speed of 39 tokens per second that the page labels notably slow.

ما يدّعيه كل مورّد، وما لم يُظهره أيّ منهما

مواد إطلاق xAI محددة وهي قصة طويلة الأمد: تم بناء Grok 4.7 على نموذج أساسي أكبر من Grok 4.6، وأُعطي جولة تعلم معزز أطول تستهدف مهامًا "قد تستغرق ساعات لإكمالها"، مما يصقل التحقق الذاتي والتعامل مع السياق الطويل والسلوك داخل بيئة Grok Bot. تشمل الأرقام المبلغ عنها من المورد Terminal-Bench 4.0 بنسبة 38.0% مقابل 20.3% لـ Grok 4.6، وCursorBench 4.0 بنسبة 46.3%، وDeepSWE v1.1 بنسبة 71.0%. كل واحد من هذه هو قياس xAI الخاص ولم يتم إعادة إنتاج أي منها بشكل مستقل؛ الرقم المستقل لـ Terminal-Bench 4.0 الذي يتداول أقل بشكل ملموس من رقم المورد، وهو الشكل المعتاد لتلك الفجوة.

ادعاءات OpenAI بشأن GPT-6 Sol هي نفسها المذكورة أعلاه، وهي تحمل الوسم نفسه. الأرقام المعلنة من المزوّد هي 33.2% على AutomationBench عند جهد xhigh مقابل 26.9% لـ Claude Opus 5 عند max، وبتكلفة تقارب 9% لكل مهمة، و68.8% على DeepSWE v1.1 عند جهد max — بفارق 1.1 نقطة عن Claude Fable 5 عند xhigh، وبتكلفة أقل بنحو 80% لكل مهمة. لاحِظ هدف المقارنة: مخططات OpenAI الخاصة تُقارن Sol بنماذج Anthropic، لا بـ Grok 4.7. ولم ينشر أي من المزوّدين مقارنة مباشرة ضد الآخر.

Screenshot of OpenAI's developer model page for GPT-6 Sol, captured 23 September 2026, showing the model id gpt-6-sol as the default snapshot, a 1,050,000-token context window with 128,000 maximum output tokens, an April 20, 2026 knowledge cutoff, text and image input with text output, and Standard pricing of $2.00 input, $0.20 cached input, $2.50 cache writes and $10.00 output per million tokens. No pro model id appears on the page.

حيث تستحق طبقة التوجيه مكانها

لا يوفّر OrcaRouter أيًّا من الطرازين في هذه المقارنة — فكلٌّ من Grok 4.7 وGPT-6 Sol غائبان عن كتالوجنا، لذا لا شيء هنا يُعدّ ادّعاءً بشأن سعرهما من خلالنا. ما تستحقه طبقة التوجيه في هذه المقارنة تحديدًا هو نمط الفشل لا بطاقة الأسعار. سبب اللجوء إلى Grok 4.7 هو سلوكه الوكيلي بعيد المدى؛ وسبب عدم اللجوء إليه هو أن سرعة إخراج تبلغ 39 رمزًا في الثانية تجعل تشغيل وكيل طويل بطيئًا بما يكفي ليُحدث فرقًا، والتشغيل البطيء هو تشغيل قد تنتهي مهلته. التحويل التلقائي عند الفشل بين المزوّدين يعني أنه يمكن توجيه مهمة طويلة إلى الطراز المتاح فعليًا دون أن تصبح تلك السرعة نقطة فشل وحيدة، وتعبّر لغة التوجيه DSL عن اختيار الطراز كقاعدة داخل الاستدعاء لا كعملية ترحيل — وهذا مهم هنا، لأن الإجابة الصحيحة لهذا الثنائي تعتمد على ما إذا كانت المهمة شرهة للرموز أو حساسة لزمن الاستجابة، وذلك خاصية للطلب لا للربع.

قاعدة القرار

• البرمجة الوكيلية بميزانية ثابتة — قدرة بمستوى GPT-6 Sol على مؤشر البرمجة المحايد، بنحو ثلث التكلفة لكل مهمة، لأنها تصل إلى ذلك بثلث عدد الرموز.

• المهام طويلة المدى التي يكون فيها طول التشغيل هو المقصود — Grok 4.7. دُرّب هذا الإصدار تحديدًا للعمل لعدة ساعات، وأرقام المورّد على SWE-Marathon وCursorBench تتحرك في هذا الاتجاه بالضبط.

• الحجم الحسّاس لزمن الاستجابة — لا هذا ولا ذاك، وفق السجل الحالي. تكلفة Sol لكل مهمة هي الرقم الأفضل، لكن 39 رمزًا في الثانية المقيسة لدى Grok 4.7 قيدٌ حقيقي على أي شيء تفاعلي.

• أحمال العمل ذات السياق الطويل المُخزَّن غالبًا في الذاكرة المؤقتة — GPT-6 Sol، في بند قراءة الذاكرة المؤقتة بدلًا من بند الإخراج. عند 0.20 دولار مقابل 0.50 دولار لكل مليون رمز مُخزَّن مؤقتًا، ومع نافذة تبلغ ضعف الحجم، تزداد قوة الحجة كلما زاد استقرار جزء أكبر من الموجِّه لديك.

• إذا كانت مقارنتك مبنية على بطاقة الأسعار لكل رمز — فأعد بناءها على أساس التكلفة لكل مهمة. إن 6.00 دولارات مقابل 10.00 دولارات للإخراج هو أقل زوج من الأرقام إفادةً في هذا المقال، وهو الزوج الذي تتصدّر به كل صفحة موجودة.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا