بطاقة عنوان رئيسية لمقارنة بين GPT-6 وGrok 4.7. يقرأ العنوان الرئيسي "GPT-6 مقابل Grok 4.7". تقرأ شريحة "GPT-6 Sol: سياق 1.05M، مخرجات 128K، $2.00 / $10.00". تقرأ شريحة "Grok 4.7: سياق 500K، مخرجات 450K، $2.00 / $6.00". يقرأ التذييل "سعر الإدخال متعادل؛ أما سعر الإخراج وحدّ الإخراج فليسا كذلك."
Guides & Insights

GPT-6 مقابل Groq 4.7: عمود المخرجات يحسم الأمر

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

GPT-6 Sol و Grok 4.7 تفرضان السعر نفسه على رموز الإدخال — 2.00 دولار لكل مليون، لكلتيهما — مما يجعل عمود الإدخال عديم الفائدة عند الاختيار بينهما. القرار يكمن في عمود واحد إلى اليمين. تفرض GPT-6 Sol رسومًا قدرها 10.00 دولار لكل مليون رمز إخراج؛ بينما تفرض Grok 4.7 رسومًا قدرها 6.00 دولار. ويختلف النموذجان بشأن مقدار الإخراج المسموح لك بإنتاجه في استدعاء واحد بمعامل ثلاثة ونصف: يصل GPT-6 Sol إلى حد أقصى 128,000 رمز، في حين أن Grok 4.7 — الطراز الرائد لـ SpaceXAI، الذي صدر في 21 سبتمبر 2026 خلفًا لـ Grok 4.6 — يصل إلى 450,000.

كل شيء آخر في هذه المواجهة يتبع من هاتين الحقيقتين، بالإضافة إلى حقيقة أخرى: يمتلك GPT-6 Sol نافذة السياق الأكبر، إذ تبلغ 1,050,000 توكن مقابل 500,000 لدى Grok 4.7. لذا، هذه ليست قصة عن كون أحد النموذجين أفضل. إنها قصة عن نموذجين مختلفَي الشكل، وعن أي شكل يتخذه عبء عملك.

اضبط شكل طلبك أولًا

الطريقة المفيدة للبتّ في الاختيار بين GPT-6 وGrok 4.7 هي حسب المورد الذي تستهلكه مهمتك فعليًا. ثلاث حالات تغطي معظم حركة الإنتاج.

مدخلات طويلة، مخرجات قصيرة. أنت تُغذّي مستندًا كبيرًا أو قاعدة شيفرة أو نصًا طويلًا لوكيل، وتحصل في المقابل على ملخّص أو فرق أو قرار. هنا تكون نافذة السياق هي القيد الحاكم، و1,050,000 رمز لدى GPT-6 Sol تعادل تقريبًا ضعف 500,000 لدى Grok 4.7. لكن لاحظ سطر الشرائح على البطاقتين: سعر Grok 4.7 البالغ 2.00 دولار ينطبق حتى 200,000 رمز إدخال ثم يقفز إلى 4.00 دولار بعد ذلك، بينما يمتد سعر GPT-6 Sol البالغ 2.00 دولار حتى 272,000 ثم يقفز إلى 4.00 دولار بعده. عند 200,001 رمز يكون Grok قد أُعيد تسعيره بالفعل بينما GPT-6 Sol لم يفعل، لذا فإن مستندًا من 250,000 رمز يكلّف 4.00 دولار لكل مليون على Grok 4.7 و2.00 دولار لكل مليون على GPT-6 Sol — أي الضعف، قبل أن تحسب المخرجات.

مدخل قصير، مخرجات طويلة. أنت تُنشئ: مستندًا طويلًا، أو ملف شفرة كبيرًا، أو مُخرَجًا مُهيكلًا، أو سلسلة من نداءات الأدوات التي يجب على النموذج كتابة نتائجها. هذه هي الحالة التي صُمم من أجلها Grok 4.7. سقف مخرجات يبلغ 450,000 رمز يزيد بأكثر من مرتبة قدرية عما تسمح به معظم النماذج، وعند 6.00 دولارات لكل مليون رمز مخرجات مقابل 10.00 دولارات فإنك تدفع أقل بنسبة 40% مقابل كل رمز من تلك الرموز. إذا كان توليدك يتجاوز عادةً 128,000 رمز مخرجات، فلن يتمكن GPT-6 Sol من تلبية الطلب على الإطلاق في نداء واحد، بينما يستطيع Grok 4.7 ذلك.

متوازنة وثقيلة على كليهما. المدخل الطويل والمخرج الطويل معًا هما الحالة التي تتفاعل فيها البطاقتان. مدخل بـ400,000 رمز ومخرج بـ200,000 رمز يُسعَّر بـ4.00 دولارات للمدخل و12.00 دولارًا للمخرج على Grok 4.7 (وكلاهما فوق حدّه) و4.00 دولارات للمدخل و15.00 دولارًا للمخرج على GPT-6 Sol. هذا هو التكوين الوحيد الذي يكون فيه GPT-6 Sol النموذج الأغلى لكل رمز، ويستحق أن تتحقق من متوسطاتك الخاصة مقارنةً به قبل أن تفترض أن الوضع الافتراضي في عصر ChatGPT أرخص.

ما الذي غيّرته OpenAI، ولماذا يهم ذلك هنا

GPT-6 هي عائلة من ثلاثة نماذج، وفي 7 أكتوبر 2026 وضعت OpenAI النموذج الأوسط منها أمام الجمهور. إن GPT-6 في ChatGPT — إطلاق Intelligent UI — مدعوم بـ GPT-6 Sol لباقات Plus وPro وBusiness وEnterprise، وبـ GPT-6 Luna لباقتي Free وGo، ويصل إلى أكثر من 1.2 مليار شخص يستخدمون ChatGPT أسبوعيًا. هذه حقيقة توزيعية لا حقيقة تتعلق بالقدرات، وهي تغيّر ما يعنيه «GPT-6» في أي مقارنة: عندما يقول أحدهم إن GPT-6 تغلب على نموذج آخر أو خسر أمامه في بعض الاختبارات المعيارية، فهو عادةً يقصد GPT-6 Sol تحديدًا، أو النموذج الرائد GPT-6 Astra بسعر 10.00 / 50.00 دولارًا.

في هذه المواجهة، يهم طرح ChatGPT من زاوية واحدة ملموسة. صدر Grok 4.7 في 21 سبتمبر 2026، قبل أربعة أيام من GPT-6 Sol، وهو نموذج API وتطبيق خالص، وليس له مقابل بوصفه خيارًا استهلاكيًا افتراضيًا بمليار مستخدم. إن وصف SpaceXAI نفسه له ضيّق ومحدد: طراز رائد للهندسة البرمجية طويلة الأمد، وسير العمل الوكيلي باستخدام الأدوات والتحقق الذاتي، والعمل المعرفي. هذا تصريح عن عمل كثيف المخرجات، وهو بالضبط الشكل الذي تكون فيه ورقة Grok أقوى.

لوحة النتائج، موسومة بصدق

يأتي التقييم المستقل لهذين الاثنين من Artificial Analysis، والخلاصة هي أنهما متقاربان على المؤشر المركّب ويختلفان في الاختبارات الفردية بطريقة تتوافق مع المنتجين.

• AA Intelligence Index: Grok 4.7 46.4 (المرتبة 16 من النماذج التي يقيّمها)، GPT-6 Sol 47.6 — GPT-6 Sol متقدّم بنحو نقطة
• Humanity's Last Exam: Grok 4.7 43.1%، GPT-6 Sol 47.9%
• SciCode: Grok 4.7 57.4%، GPT-6 Sol 57.6% — متساويان فعليًا
• Long-Context Recall: Grok 4.7 76.7%، GPT-6 Sol 83.7% — GPT-6 Sol متقدّم، بما يتوافق مع النافذة الأكبر
• Terminal-Bench (v4.0 على بطاقة Grok): Grok 4.7 25.8%، GPT-6 Sol 43.9% على نفس عائلة أدوات الاختبار
• البرمجة: Grok 4.7 يقع في العُشر الأعلى من مؤشر البرمجة، في صحبة أقوى النماذج على اللوحة

ملاحظتان تحذيريتان، وليستا شكلية. قُيّمت قيم المؤشر للنموذجين في تاريخين مختلفين، لذا فهذه ليست مواجهة مباشرة في اليوم نفسه، وفارق نقطة واحدة يقع ضمن حدود التغيّر الذي ينتجه تنقيح واحد. وكل رقم لـ Grok 4.7 أعلاه هو الرقم المنشور من المزوّد نفسه كما هو مُدرج في الكتالوج، وليس نتيجة أعدنا تشغيلها — والقراءة الصادقة هي أن Grok 4.7 نموذج برمجة ضمن أعلى 10%، ويتخلف بنقطة أو نحو ذلك عن GPT-6 Sol في مركّب استدلال عام، وأن فجوة terminal-bench هي أكبر إشارة منفردة في المجموعة.

Screenshot of the OrcaRouter model page for Grok 4.7, showing the SpaceXAI Grok 4.7 card with a 500,000-token context window, up to 450,000-token output, text/image/file input and text output, and a tiered rate of $2.00 per million input and $6.00 per million output up to 200,000 tokens, stepping to $4.00 and $12.00 above.

زمن الاستجابة والموثوقية، وهما ما تخفيه ورقة المواصفات.

تغفل جداول الأسعار المنشورة وجداول المقارنات المرجعية كليهما عن العامل الذي يحدد جودة الخدمة في بيئة الإنتاج، لذا يجدر النظر إلى الأرقام المقيسة بدلاً من الأرقام التسويقية.

وفق قياسات ساحة الاختبار الخاصة بـ OrcaRouter خلال الأسبوع الأول من أكتوبر 2026، أعاد Grok 4.7 وسيط زمن وصول إلى أول رمز قدره 3,825 مللي ثانية، وأنتج مخرجات بمعدل نحو 147 رمزًا في الثانية، مع معدل خطأ يقارب 8%. وكان وسيط زمن الوصول المقاس لدى GPT-6 Sol في النافذة الزمنية نفسها أعلى — 6,363 مللي ثانية — مع معدل خطأ أعلى بكثير. هذه ملاحظات من ساحة اختبار على مسار مشترك، وليست اتفاقية مستوى خدمة من مورّد، ومعدل خطأ بنسبة 39% على مسار أحد النماذج يمثل مشكلة توجيه لا مشكلة نموذج؛ وهو بالضبط نوع الفجوة الذي وُجد التبديل الاحتياطي لتغطيته. النقطة المهمة في أي مقارنة هي أن مسار Grok 4.7 بدا أكثر استجابة وموثوقية بشكل ملموس من مسار GPT-6 Sol في تلك النافذة بعينها، وأن بطاقة المواصفات المنشورة لأي من المورّدين لم تكن لتخبرك بذلك.

تشغيل كليهما دون الالتزام بأيّ منهما

الإغراء في مواجهة بهذا التقارب هو أن تختار أحدها مسبقًا بناءً على السعر، ثم تكتشف بعد ثلاثة أشهر أن شكل حركة المرور لديك قد تغيّر. هذه هي المشكلة التي يحلّها التوجيه. على OrcaRouter، كلا grok/grok-4.7و GPT-6 Sol مساران مباشران في الكتالوج نفسه خلف واجهة API واحدة، بسعر المزوّد المعلن دون أي هامش ربح — فحين يغيّر SpaceXAI أو OpenAI أحد الأسعار، يصبح التغيير ساريًا في اليوم نفسه لا عند تسوية فاتورتك التالية. التجاوز التلقائي عند الفشل عبر المزوّدين يغطي حالة تدهور أحد المسارات، وهو أمر بالغ الصلة نظرًا لتفاوت معدلات الخطأ المذكور أعلاه. و تتيح لك لغة التوجيه DSL تقسيم حركة المرور حسب شكل الطلب لا حسب تفضيل النموذج: أرسل الأعمال ذات المدخلات الطويلة والمخرجات القصيرة إلى النموذج ذي النافذة الأكبر، وأرسل التوليد ذا المخرجات الطويلة إلى النموذج ذي السقف 450K وسعر المخرجات الأرخص، ودع محدد حجم الطلب يتولى الاختيار بدلًا من الإنسان.

اختيار

إذا كان عملك تحليل المستندات الطويلة، أو الاستدلال بسياق كبير، أو أي شيء يتجاوز 200,000 رمز إدخال، فإن GPT-6 Sol هو الخيار الأفضل: ضعف السياق، ومؤشر مستقل أعلى، وعتبة تقع أبعد بـ72,000 رمز. إذا كان عملك التوليد — نواتج برمجية طويلة، وكتابة مطولة، وسلاسل طويلة من استدعاء الأدوات حيث يتعين على النموذج كتابة ما وجده — فإن Grok 4.7 هو الخيار الأفضل: سقف إخراج يبلغ 450,000 رمز لا يستطيع GPT-6 Sol بلوغه، ورموز إخراج أرخص بنسبة 40%، وملف برمجي ضمن أعلى 10% يضاهي ذلك. إذا كنت تقوم بالاثنين معًا حقًا، فالإجابة ليست نموذجًا. بل مسار.

A comparison card titled 'The shape of the request decides'. Left column 'Grok 4.7': rows 'Context: 500K', 'Output: up to 450K', 'Input: $2.00 to 200K, then $4.00', 'Output: $6.00, then $12.00', 'AA Index: 46.4'. Right column 'GPT-6 Sol': rows 'Context: 1,050,000', 'Output: 128K', 'Input: $2.00 to 272K, then $4.00', 'Output: $10.00, then $15.00', 'AA Index: 47.6'. A footer reads 'Figures per each vendor's published card and Artificial Analysis; evaluation dates differ between models.'Screenshot of the OrcaRouter model page for GPT-6 Sol, showing the OpenAI GPT-6 Sol card with a 1,050,000-token context window, 128,000 maximum output, text/image/file input, and the tiered rate card of $2.00 per million input and $10.00 per million output up to 272,000 tokens, stepping to $4.00 and $15.00 above that.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا