
GPT-6 Sol Pro مقابل Grok 4.7: ضعف الإسهاب، وثلث السعر
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 986 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 196 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 112 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
أرخص نموذجين قريبين من حدود الطليعة في سبتمبر 2026 صدرا بفارق يوم واحد، والأمر المثير للاهتمام فيهما ليس أيهما أذكى. GPT-6 Sol — النموذج الذي يلجأ إليه الناس عندما يبحثون عن GPT-6 Sol Pro، وهو ذلك النموذج نفسه مع ضبط reasoning.mode على pro بدلاً من كونه منتجًا منفصلًا — صدر في 22 سبتمبر 2026 بسعر 2.00 دولار لكل مليون توكن إدخال و10.00 دولارات لكل مليون توكن إخراج. Grok 4.7 صدر من المورّد في 21 سبتمبر بنفس سعر الإدخال 2.00 دولار، وسعر الإخراج 6.00 دولارات. على منصة التقييم المحايدة لدى Artificial Analysis، يفصل بين النموذجين نقطتا مؤشر، ونحو دولارين لكل مهمة مكتملة، والسبب في تلك الفجوة ليس القدرة. بل عدد التوكنات التي يحرقها كل منهما للوصول إلى هناك.
ولّد Sol 77 مليون رمز إخراج أثناء تشغيل Intelligence Index. وولّد Grok 4.7 240 مليون رمز. تلك النسبة — ما يزيد قليلًا على ثلاثة إلى واحد — هي المقارنة بأكملها، وهي تقلب الاستنتاج الذي يقدمه لك جدول أسعار لكل رمز.
بطاقتا الأسعار، وأين لا تكون الرخيصة رخيصة
كلا المورّدين ينشران هذه الأرقام بنفسيهما؛ ولم يُعَد تسعير أيٍّ منهما بشكل مستقل.
• إدخال — GPT-6 Sol 2.00 دولار لكل مليون رمز مقابل Grok 4.7 2.00 دولار لكل مليون رمز
• الإخراج — GPT-6 Sol 10.00 دولارات لكل مليون رمز مقابل Grok 4.7 6.00 دولارات لكل مليون رمز
• المدخلات المخزَّنة مؤقتًا — GPT-6 Sol بسعر 0.20 دولار لكل مليون رمز مقابل Grok 4.7 بسعر 0.50 دولار لكل مليون رمز؛ قراءة الذاكرة المؤقتة لدى Sol أرخص بمقدار مرتين ونصف، وهو عكس ما يوحي به سعر المخرجات المُعلن.
• نافذة السياق — GPT-6 Sol 1,050,000 توكن مقابل Grok 4.7 500,000 توكن
• رسوم إضافية للسياق الطويل — GPT-6 Sol تعيد تسعير الطلب الذي يتجاوز 272,000 رمز إدخال بمعدل 2× لأسعار الإدخال والتخزين المؤقت و1.5× للإخراج للطلب بأكمله، مقابل Grok 4.7 الذي يضاعف كل سعر عند 200,000 رمز إدخال، وذلك للطلب بأكمله أيضًا
• حد المعرفة — GPT-6 Sol في 20 أبريل 2026 مقابل Grok 4.7، بحد تدريب مسبق يُذكر أنه يونيو 2026 مع تدريب تكميلي حتى أغسطس
• جهد الاستدلال — GPT-6 Sol: لا شيء، منخفض، متوسط (افتراضي)، عالٍ، xhigh، أقصى مقابل Grok 4.7: منخفض، متوسط (افتراضي)، عالٍ، xhigh
• الوسائط — كلاهما يقبل إدخال النص والصورة ويُرجع نصًا
بند قراءة الذاكرة المؤقتة هو ما ينبغي للمشتري أن يتوقف عنده. معدل الإخراج لدى Grok 4.7 أقل بنسبة 40%، لكن مدخلاته المخزّنة مؤقتًا أعلى بنسبة 150%، والمدخلات المخزّنة مؤقتًا هي حيث توجد سجلات الوكيل الطويلة والتوجيهات النظامية المتكررة. عبء العمل الذي يقوم في معظمه بإعادة قراءة سياق كبير مستقر سيجد النموذجين أقرب بكثير مما توحي به المقارنة بين $6 مقابل $10.

السجل المستقل، والرقم الوحيد الذي يحسم الأمر
يُعدّ Artificial Analysis الأداة الوحيدة التي قامت بقياس كلا النموذجين، وتستحق أرقامه أن تُعرض جنبًا إلى جنب لأن التباين فيها مفيد.
• مؤشر الذكاء — GPT-6 Sol 48 بأقصى جهد مقابل Grok 4.7 46 عند xhigh؛ وكلاهما أعلى بكثير من الوسيط 25 للنماذج المماثلة
• التكلفة لكل مهمة فهرسة — GPT-6 Sol 1.06 دولار مقابل Grok 4.7 3.74 دولار
• رموز الإخراج لجولة الفهرس — GPT-6 Sol 77M في مقابل Grok 4.7 240M، مقارنةً بوسيط قدره 88M
• سرعة الإخراج — سُجّلت Grok 4.7 عند 39 رمزًا في الثانية، وهي سرعة يصفها نظام الاختبار نفسه بأنها بطيئة بشكل ملحوظ؛ أما رقم Sol على اللوحة نفسها فغير منشور في سطر الملخص ذاته
• مؤشر وكلاء البرمجة — GPT-6 Sol 57 بتكلفة 2.99 دولار لكل مهمة مقابل Grok 4.7 56 مع أداة Grok Build الخاصة به، بارتفاع تسع نقاط عن Grok 4.6
فرق نقطتين في المؤشر، وتكلفة لكل مهمة تبلغ ثلاثة أضعاف ونصف. هذا ليس شذوذاً في التسعير — بل هو حساب الإسهاب. Grok 4.7 نموذج يفكّر بصوت عالٍ وبإسهاب؛ وتصنّفه أداة الاختبار بأنه «بالغ الإسهاب» مقابل وسيط يبلغ 88 مليون رمز، والتكلفة تتبع الرموز، لا قائمة الأسعار.
تحمل مقارنة وكيل البرمجة تحذيرًا تخفيه لوحة النتائج. فدرجة 56 الخاصة بـ Grok 4.7 تُقاس داخل بيئة اختبار Grok Build التابعة لـ xAI نفسها، وهي الإعداد الذي تطرحه xAI وتقيس عليه. أما درجة 57 الخاصة بـ Sol فتُقاس في بيئة اختبار محايدة. وميزة بيئة اختبار الطرف الأول بمقدار نقطة أو نقطتين تقع ضمن النطاق الذي يفسّره اختيار البيئة، ما يعني أن القراءة الأمينة هي أن هذين متعادلان في البرمجة الوكيلة — لا أن Sol متقدم بنقطة واحدة.

ما يدّعيه كل مورّد، وما لم يُظهره أيّ منهما
مواد إطلاق xAI محددة وهي قصة طويلة الأمد: تم بناء Grok 4.7 على نموذج أساسي أكبر من Grok 4.6، وأُعطي جولة تعلم معزز أطول تستهدف مهامًا "قد تستغرق ساعات لإكمالها"، مما يصقل التحقق الذاتي والتعامل مع السياق الطويل والسلوك داخل بيئة Grok Bot. تشمل الأرقام المبلغ عنها من المورد Terminal-Bench 4.0 بنسبة 38.0% مقابل 20.3% لـ Grok 4.6، وCursorBench 4.0 بنسبة 46.3%، وDeepSWE v1.1 بنسبة 71.0%. كل واحد من هذه هو قياس xAI الخاص ولم يتم إعادة إنتاج أي منها بشكل مستقل؛ الرقم المستقل لـ Terminal-Bench 4.0 الذي يتداول أقل بشكل ملموس من رقم المورد، وهو الشكل المعتاد لتلك الفجوة.
ادعاءات OpenAI بشأن GPT-6 Sol هي نفسها المذكورة أعلاه، وهي تحمل الوسم نفسه. الأرقام المعلنة من المزوّد هي 33.2% على AutomationBench عند جهد xhigh مقابل 26.9% لـ Claude Opus 5 عند max، وبتكلفة تقارب 9% لكل مهمة، و68.8% على DeepSWE v1.1 عند جهد max — بفارق 1.1 نقطة عن Claude Fable 5 عند xhigh، وبتكلفة أقل بنحو 80% لكل مهمة. لاحِظ هدف المقارنة: مخططات OpenAI الخاصة تُقارن Sol بنماذج Anthropic، لا بـ Grok 4.7. ولم ينشر أي من المزوّدين مقارنة مباشرة ضد الآخر.

حيث تستحق طبقة التوجيه مكانها
لا يوفّر OrcaRouter أيًّا من الطرازين في هذه المقارنة — فكلٌّ من Grok 4.7 وGPT-6 Sol غائبان عن كتالوجنا، لذا لا شيء هنا يُعدّ ادّعاءً بشأن سعرهما من خلالنا. ما تستحقه طبقة التوجيه في هذه المقارنة تحديدًا هو نمط الفشل لا بطاقة الأسعار. سبب اللجوء إلى Grok 4.7 هو سلوكه الوكيلي بعيد المدى؛ وسبب عدم اللجوء إليه هو أن سرعة إخراج تبلغ 39 رمزًا في الثانية تجعل تشغيل وكيل طويل بطيئًا بما يكفي ليُحدث فرقًا، والتشغيل البطيء هو تشغيل قد تنتهي مهلته. التحويل التلقائي عند الفشل بين المزوّدين يعني أنه يمكن توجيه مهمة طويلة إلى الطراز المتاح فعليًا دون أن تصبح تلك السرعة نقطة فشل وحيدة، وتعبّر لغة التوجيه DSL عن اختيار الطراز كقاعدة داخل الاستدعاء لا كعملية ترحيل — وهذا مهم هنا، لأن الإجابة الصحيحة لهذا الثنائي تعتمد على ما إذا كانت المهمة شرهة للرموز أو حساسة لزمن الاستجابة، وذلك خاصية للطلب لا للربع.
قاعدة القرار
• البرمجة الوكيلية بميزانية ثابتة — قدرة بمستوى GPT-6 Sol على مؤشر البرمجة المحايد، بنحو ثلث التكلفة لكل مهمة، لأنها تصل إلى ذلك بثلث عدد الرموز.
• المهام طويلة المدى التي يكون فيها طول التشغيل هو المقصود — Grok 4.7. دُرّب هذا الإصدار تحديدًا للعمل لعدة ساعات، وأرقام المورّد على SWE-Marathon وCursorBench تتحرك في هذا الاتجاه بالضبط.
• الحجم الحسّاس لزمن الاستجابة — لا هذا ولا ذاك، وفق السجل الحالي. تكلفة Sol لكل مهمة هي الرقم الأفضل، لكن 39 رمزًا في الثانية المقيسة لدى Grok 4.7 قيدٌ حقيقي على أي شيء تفاعلي.
• أحمال العمل ذات السياق الطويل المُخزَّن غالبًا في الذاكرة المؤقتة — GPT-6 Sol، في بند قراءة الذاكرة المؤقتة بدلًا من بند الإخراج. عند 0.20 دولار مقابل 0.50 دولار لكل مليون رمز مُخزَّن مؤقتًا، ومع نافذة تبلغ ضعف الحجم، تزداد قوة الحجة كلما زاد استقرار جزء أكبر من الموجِّه لديك.
• إذا كانت مقارنتك مبنية على بطاقة الأسعار لكل رمز — فأعد بناءها على أساس التكلفة لكل مهمة. إن 6.00 دولارات مقابل 10.00 دولارات للإخراج هو أقل زوج من الأرقام إفادةً في هذا المقال، وهو الزوج الذي تتصدّر به كل صفحة موجودة.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
