
GPT-6 مقابل Grok 4.6: فئتان متوسطتان، وفاتورة واحدة تتباين فوق 200 ألف توكن
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
GPT-6 Sol وGrok 4.6 يكلفان نفس المبلغ: 2.00 دولار لكل مليون توكن إدخال و6.00 دولار لكل مليون توكن إخراج عند أعلى العمودين. ما لا يطبعه أحد تقريبًا بجانب ذلك هو أن العمودين يكفّان عن التطابق عند نقاط مختلفة في الطلب. يبدأ Grok 4.6 في فرض سعر السياق الطويل الخاص به بمجرد أن يتجاوز الموجّه 200,000 توكن إدخال؛ أما GPT-6 Sol فينتظر حتى 272,000. وفوق هذين الحدّين يُعاد تسعير الطلب بأكمله — وليس فقط الجزء الفائض — ويعيد المورّدان تسعيره في اتجاهين متعاكسين، وهذا هو الجزء الذي يحدد فاتورة تشغيل وكيل طويل. طُرح GPT-6 Sol وأشقاؤه GPT-6 Astra وGPT-6 Luna في 22 سبتمبر 2026؛ أما Grok 4.6، الفئة المتوسطة من سلسلة SpaceXAI، فقد طُرح في 12 أغسطس 2026 وانضم إليه بالفعل Grok 4.7، لذا فهذه مقارنة بين نموذجين مطروحين وليست إطلاقًا لأيّ منهما.
وثمة أمر ثانٍ تغيّر في 7 أكتوبر 2026 وله أهمية في طريقة قراءتك لـ GPT-6 أصلًا: بدأت OpenAI طرح GPT-6 في تبويب الدردشة الرئيسي في ChatGPT، فوصل إلى الطبقات المجانية في 8 أكتوبر، مع تشغيل طبقات Plus وPro وBusiness وEnterprise على GPT-6 Sol، وطبقات Free وGo على GPT-6 Luna. هذا تغيير على مستوى الواجهة — النماذج نفسها، وجمهور أوسع بكثير، وطبقة واجهة جديدة تسميها OpenAI «Intelligent UI». وهو لا يحرّك أيًّا من معدلات API. لكنه يعني أنه إذا كنت تقيس أداء "GPT-6" مقابل أي شيء، فإنك الآن تقيسه مقابل نموذج يتحدث إليه أيضًا عدد هائل جدًا من الأشخاص في تبويب متصفح.
أين تختلف البطاقتان فعليًا
• إدخال السياق القصير — GPT-6 Sol 2.00 دولار لكل مليون مقابل Grok 4.6 2.00 دولار لكل مليون
• إخراج السياق القصير — GPT-6 Sol 10.00 دولار لكل مليون مقابل Grok 4.6 6.00 دولار لكل مليون
• عتبة الطلبات الطويلة — تعيد GPT-6 Sol التسعير فوق 272,000 توكن إدخال مقابل Grok 4.6 فوق 200,000
• إدخال الطلبات الطويلة — GPT-6 Sol 4.00 دولار لكل مليون مقابل Grok 4.6 4.00 دولار لكل مليون
• إخراج الطلبات الطويلة — GPT-6 Sol 15.00 دولار لكل مليون مقابل Grok 4.6 12.00 دولار لكل مليون
• الإدخال المخزّن مؤقتًا — GPT-6 Sol 0.20 دولار لكل مليون مقابل Grok 4.6 0.50 دولار لكل مليون
• نافذة السياق — GPT-6 Sol 1,050,000 توكن مقابل Grok 4.6 500,000 توكن
• أنماط الإدخال — كلاهما يقبل النص والصورة والملف
• درجة العمل المعرفي — GPT-6 Sol 47.6 مقابل Grok 4.6 44.3 على Artificial Analysis Intelligence Index
• Terminal-Bench 2.1 — GPT-6 Sol غير منشور على المراجعة نفسها مقابل Grok 4.6 88.4
اقرأ سطري الإخراج معًا، فتظهر لك صورة القرار. إن Grok 4.6 أرخص بمقدار 4.00 دولارات لكل مليون رمز إخراج على أي طلب دون 200K، وأرخص بمقدار 3.00 دولارات فقط فوق ذلك. هذه فجوة أصغر بكثير مما توحي به النسبة الرئيسية البالغة 40%، لأن كلا النموذجين يعيدان تسعير الطلب بأكمله بدلًا من الجزء الذي يتجاوز الحد — تفصيل يستحق التوقف عنده، إذ لا يُحتسب نصّ من 200,001 رمز كرمز واحد بالسعر المرتفع زائد 200,000 رمز بالسعر المنخفض.
ثم إن العتبة نفسها تسير في الاتجاه المعاكس. يبدأ Grok 4.6 إعادة التسعير قبل GPT-6 Sol بمقدار 72,000 توكن. وبالنسبة لحمل عمل يبقى باستمرار بين 200K و272K، يكون Grok 4.6 هو النموذج الأكثر تكلفة رغم سعره المعلن الأرخص لكل توكن، وهو الوحيد من بين الاثنين الذي تحرّك على الإطلاق. إن معرفة أي جانب من تلك النافذة تقع عليه مطالباتك سؤال أكثر فائدة من معرفة أي سعر معلن أقل.

فجوة المعيار أصغر وأضيق من فجوة السعر
على Intelligence Index الخاص بـ Artificial Analysis، وهو قياس من طرف ثالث وليس جدولاً يصدره مورّد، يسجّل GPT-6 Sol عند 47.6 وGrok 4.6 عند 44.3. الفارق البالغ 3.3 نقطة على مقياس من 0 إلى 100 حقيقي، لكنه ليس نوع المسافة التي تجعل أحد النموذجين خاطئًا في مهمة والآخر صحيحًا. كما أنه يُقاس عند إعداد استدلال محدد لكل نموذج، ويتيح GPT-6 Sol جهد استدلال قابلًا للتهيئة بينما يتيح Grok 4.6 جهده الخاص — لذا فإن أي شخص يقتبس رقمًا واحدًا لمواجهة مباشرة إنما يقتبس نقطة واحدة في شبكة ثنائية الأبعاد.
حيث يزداد الفارق الحقيقي بينهما هو في العمل الوكيلي بأسلوب الطرفية. على Terminal-Bench 2.1، يسجّل Grok 4.6 نتيجة 88.4. ولا يملك GPT-6 Sol رقمًا منشورًا قابلًا للمقارنة على المراجعة التي يتضمّنها كتالوجنا، والقراءة الأمينة لخلية فارغة هي أن الرقم غير منشور — لا أن النموذج أدى أداءً سيئًا. وإذا كان عبء العمل وكيلًا طويل التشغيل يعمل عبر الشِل، فالأدلة المنشورة ترجّح Grok 4.6، والأدلة المفقودة لا تُحتسب دليلًا لأي من الطرفين.
ينطبق العكس على استرجاع المعرفة في السياقات الطويلة. يسجّل GPT-6 Sol 83.7 في الاستدعاء طويل السياق مقابل 80.3 لـ Grok 4.6، ويُبلّغ مورّدو كلا النموذجين عن أرقامهما الخاصة في مواضع أخرى — إذ تُبرز SpaceXAI نتيجة GPQA Diamond عند 94.9 لـ Grok 4.6، بينما مواد GPT-6 من OpenAI مُبلّغ عنها من المورّد إلى حد كبير وغير مُعاد إنتاجها. قاعدتان تحافظان على وضوح ذلك: رقم المورّد ادّعاء، ورقم المؤشر قياس على مراجعة مسمّاة. وهما غير قابلين للتبادل، ولا ينبغي أبدًا جمعهما في متوسط للحصول على درجة "أفضل" واحدة.
مشكلة اللاحق
لا يُعد أيٌّ من هذين أحدث طراز من مختبره الخاص، والتظاهر بخلاف ذلك سيكون أكثر ما يمكن أن تضلل به هذه المقارنة. طرحت SpaceXAI طراز Grok 4.7 في 21 سبتمبر 2026 بالسعر الأساسي نفسه البالغ 2.00 دولار / 6.00 دولارات، مع انتقال مؤشر الذكاء من 44.3 إلى 46.4. وطرحت OpenAI طراز GPT-6.1 Sol في 29 سبتمبر 2026، أيضًا بسعر 2.00 دولار / 10.00 دولارات، مع بلوغ مؤشر الذكاء 51.8 وتحسّن أحد الأسعار فعليًا: انخفض سعر الإدخال المخزّن مؤقتًا من 0.20 دولار إلى 0.10 دولار لكل مليون. والآن تصنّف Artificial Analysis صفحة GPT-6 Sol الخاصة بها على أنها مهملة، وتوجّه القرّاء إلى GPT-6.1 Sol.
إذن، الصياغة المنصفة ليست «أيّ هذين ينبغي أن تعتمد؟» بل «أيّ هذين، وهل أنت متأكد أنه ليس أحدث بجيل واحد على أيٍّ من الجانبين؟». السبب في البقاء على GPT-6 Sol عادةً هو تكامل معيّن عمره ثمانية أيام وليس ادّعاء قدرة؛ والسبب في البقاء على Grok 4.6 هو رقم منشور لوكيل طرفية لم يضاهِه خلفه علنًا بعد. كلاهما مشروع، وكلاهما محدَّد زمنيًا.

تشغيل كلاهما من مفتاح واحد
كلا النموذجين يتم توجيههما بواسطة OrcaRouter، لذا فإن الجزء الميكانيكي من إبقاء مرشحين اثنين نشطين لا يكلف شيئًا: واجهة برمجة تطبيقات واحدة أمام أكثر من 200 نموذج، نفس المفتاح، لا عقد ثانٍ ولا تغيير في الكود بينهما. وهذا يهم هنا أكثر من المعتاد، لأن الحجة لوجود نموذج ثانٍ في هذه المواجهة تحديدًا ليست تحوطًا للقدرات بل قرار توجيه — أرسل نافذة 200K إلى 272K إلى GPT-6 Sol وكل ما هو أقصر إلى Grok 4.6، فيحصل نفس التطبيق على الفاتورة الأرخص على جانبي عتبة لا يسمح لك أي من الموردين باختيارها.
يُعدّ التبديل التلقائي عند الفشل النصف الممل من الإعداد نفسه. فتشغيلات الوكيل ذات السياق الطويل تكون طويلة تحديدًا لأن ثمة ما يُبقي الجلسة مفتوحة، وأي عثرة من مزوّد الخدمة عند الدقيقة الأربعين تُعدّ من نوع الأعطال الباهظة التكلفة. ويؤدي وجود مسار ثانٍ مُهيَّأ مسبقًا إلى تحويل ذلك إلى إعادة محاولة بدلًا من إعادة تشغيل من الصفر.
يُدرج كتالوجنا كلا البطاقتين بسعر القائمة الخاص بمزوّد كل منهما، دون أي زيادة عليه، لذا فإن أي تغيير في السعر على أي من البطاقتين يصل إلينا في اليوم نفسه الذي يصل فيه إليهم. هذا جدير بأن يُقال بوضوح لا كشعار: سبب الاهتمام هو أن فرق الإدخال المخزّن مؤقتًا بين 0.20 دولار و0.50 دولار المذكور أعلاه هو بالضبط نوع البند الذي يغيّره الموردون بهدوء، كما أن تمرير السعر يعني أنك لن تضطر أبدًا إلى انتظار بائع إعادة بيع ليلحق بالتغيير.

ما الذي يحسم الأمر في الواقع؟
إذا كانت مطالباتك قصيرة، فإن Grok 4.6 يفوز في سعر الإخراج بفارق لا يسدّه أي فرق في المؤشر، ودرجته في وكيل الطرفية هي أقوى رقم منشور في أيٍّ من العمودين. وإذا كانت مطالباتك طويلة، فإن عتبة إعادة التسعير اللاحقة لدى GPT-6 Sol ونافذته الأطول تستحقان أكثر من معدل الإخراج الأعلى لديه، وسطر الإدخال المخزَّن مؤقتًا يمثل ربع التكلفة. وإذا كانت مطالباتك تقع بين 200K و272K، فأنت تحمل عبء العمل الوحيد الذي يكون فيه النموذج الذي يبدو أرخص هو الأكثر تكلفة، والحل هو اختيار المسار بدلًا من اختيار النموذج.
الشيء الجدير بالمراقبة ليس أيًّا من الطرازين، بل الخليفتان الموجودتان بالفعل على الرف. فـGrok 4.7 وGPT-6.1 Sol كلاهما يُقوّضان مبرر الانتظار لاتخاذ قرار هنا، والمقارنة التي يلزم إعادة تشغيلها كل ثلاثة أسابيع هي مقارنة مكانها خلف موجّه لا في وثيقة معمارية.
مقارنات في هذه المقالة3
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
