بطاقة عنوان تحمل النص “Grok 4.7 مقابل GPT-5.6 Sol”، مع عنوان فرعي “النموذج الأرخص يكلّف أكثر لكل إجابة”، وثلاث بطاقات: AA Index v4.3.2: ‏46 مقابل 47، السعر لكل مليون: $2/$6 مقابل $4/$20، ووحدات التوكين الناتجة لكل مهمة: 81 ألف مقابل 29 ألف.
Guides & Insights

Grok 4.7 مقابل GPT-5.6 Sol: النموذج الأرخص يكلّف أكثر لكل إجابة

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

يُسعّر Grok 4.7 عند 2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج. ويُسعّر GPT-5.6 Sol عند 4.00 و20.00 دولارًا. على قائمة الأسعار، نموذج البائع أرخص بثلاث مرات وثلث عند التوليد به، وهذا هو الرقم الذي ستتوقف عنده معظم المقارنات. إنه الرقم الخاطئ. تقيس Artificial Analysis رموز الإخراج لكل مهمة لكل نموذج تقيّمه، وعلى المؤشر الحالي يُصدر Grok 4.7 — الذي أُطلق في 21 سبتمبر 2026 — 81,000 رمز إخراج لكل مهمة، بينما يُصدر GPT-5.6 Sol، المتاح عمومًا منذ 9 يوليو 2026، 29,000 رمز. اضرب الأسعار في الرموز، وتتحول فجوة السعر البالغة 3.3 أضعاف إلى فرق في التكلفة يبلغ نحو عشرين في المئة لكل إجابة مكتملة، لصالح Sol من حيث الجودة. كلاهما قوي؛ والسبب في القراءة لما هو أبعد من قائمة الأسعار هنا هو أن النموذجين يختلفان حول أي التقييمات تهم، والاختلاف منهجي.

نموذجان حدوديان بعادات متعاكسة في التعامل مع الرموز

GPT-5.6 Sol هو النموذج الرائد المتقدّم من OpenAI، أُطلق في 9 يوليو 2026 وما زال متاحًا للعموم حتى بعد أن حلّ GPT-6 Astra فوقه في 3 سبتمبر. وهو يمتلك نافذة سياق تبلغ 1,050,000 توكن، بحدّ أقصى للمدخلات يبلغ 922,000 توكن وحدّ أقصى للمخرجات يبلغ 128,000 توكن، ويستقبل النصوص والصور، ويكشف عن سلّم لمستوى جهد الاستدلال يشمل none وlow وmedium وhigh وxhigh وmax، ويكون medium هو الافتراضي. مجموعة أدواته واسعة على نحو غير معتاد — hosted shell، وapply patch، وcomputer use، وMCP، ومُفسّر الأكواد، وتوليد الصور، والبحث في الملفات — كما يدعم المخرجات المنظمة. الأوزان مغلقة.

Grok 4.7 صدر منذ يوم واحد، وهو مغلق الأوزان، ويحتفظ بسياق يبلغ 500 ألف توكن — نحو نصف سياق Sol — مع إدخال نصي وصوري وإخراج نصي. ومقبض جهد الاستدلال خاص به، ويرتفع تسعيره فوق 200 ألف توكن مطالبة إلى 4.00 و12.00 دولارًا، مع قراءات مخزّنة مؤقتًا عند 0.50 و1.00 دولار. وتُدرج xAI أيضًا نسخة أسرع بسرعة إخراج مضاعفة تقريبًا وسعر مضاعف، وأعلنت بشكل منفصل عن تهيئة Ultrafast في أغسطس تعمل على عتاد على مستوى الرقاقة بسرعة تصل إلى 750 توكن إخراج في الثانية؛ تلك معاينة محدودة بلا تسعير منشور، لذا فهي ليست فئة يمكنك التخطيط حولها حاليًا. ولا ينشر أي من المورّدين رقمًا أقصى للإخراج لـ Grok 4.7 في الوثائق التي جرى فحصها هنا.

خمس نقاط متباعدة، وموجهة في اتجاهات مختلفة

يتم تقييم كلا النموذجين على مؤشر Artificial Analysis Intelligence Index v4.3.2، الإصدار المنشور في 19 سبتمبر 2026. يُقاس عمود Sol عند أقصى جهد، وعمود Grok 4.7 عند xhigh. الفجوة المركبة نقطة واحدة. أما التشتت في التقييمات الفردية فليس كذلك.

Composite — Grok 4.7 ‏(xhigh): ‏46 في مؤشر الذكاء Artificial Analysis Intelligence Index v4.3.2، في المرتبة 16 من 655. ‏GPT-5.6 Sol ‏(max): ‏47 في الإصدار نفسه، في المرتبة 14 من 200 ضمن فئته.

وكلاء الطرفية — Grok 4.7: Terminal-Bench 4.0 26. GPT-5.6 Sol: 40. أوسع فوز لـ Sol، والتقييم الأقرب إلى العمل البرمجي المستقل.

الاستدلال الصعب — Grok 4.7: Humanity's Last Exam 43، وCritPt 18، وGDP.pdf 20. GPT-5.6 Sol: HLE 49، وCritPt 32، وGDP.pdf 27. ويتقدّم Sol في الاختبارات الثلاثة جميعها، بستّ و14 وسبع نقاط.

سياق طويل — Grok 4.7: AA-LCR v1.1 بنسبة 77%، نافذة 500k. GPT-5.6 Sol: 84%، نافذة 1.05M. يتصدر Sol في كل من القياس والحد.

أتمتة سير العمل — Grok 4.7: AutomationBench-AA 66%. GPT-5.6 Sol: 60%. فوز لـ Grok، وبفارق ست نقاط.

المخرجات المهنية — Grok 4.7: AA-Briefcase v1.1 ‏1657 إيلو، GDPval-AA v2.1 ‏1695 إيلو. GPT-5.6 Sol: ‏1487 و1588. يفوز Grok في كليهما، بفارق 170 و107 إيلو.

صدق المعرفة — Grok 4.7: AA-Omniscience 32. GPT-5.6 Sol: 22. يجيب Grok بشكل صحيح في كثير من الأحيان أكثر ويفتري أقل في هذا المُركّب.

البرمجة العلمية — Grok 4.7: SciCode 57%. GPT-5.6 Sol: 57%. تعادل حقيقي.

OrcaRouter model page for GPT-5.6 Sol showing the openai/gpt-5.6-sol identifier, a 1M-token context window, a 128K maximum output, text, image and file input with text output, list rates of $4.00 per 1M input and $20.00 per 1M output, and 41.2M tokens of traffic over seven days.

الحساب الذي لا تقوم به صفحات الأسعار

خذ الفئة القياسية وطلبًا وكيليًا بمطالبة قصيرة، 30 ألف إدخال و8 آلاف إخراج. تبلغ فاتورة Grok 4.7 ‏$0.06 للإدخال و$0.048 للإخراج. تبلغ فاتورة GPT-5.6 Sol ‏$0.12 للإدخال و$0.16 للإخراج. تبلغ كلفة Sol نحو ثلاثة أضعاف لهذا الطلب. هذا هو المقارنة التي تدعو إليها جداول الأسعار، وعلى مستوى طلب واحد فهي دقيقة.

والآن طبّق ذلك على كيفية تصرف هذه النماذج فعليًا خلال تقييم. تبلغ تكلفة 81,000 رمز إخراج لكل مهمة لدى Grok 4.7، بمعدل 6.00 دولارات لكل مليون، 0.486 دولار من التوليد؛ بينما تبلغ تكلفة 29,000 لدى Sol، بمعدل 20.00 دولارًا لكل مليون، 0.58 دولار. وهكذا تتحول ميزة المعدل البالغة 3.3 أضعاف إلى عيب بنسبة تسعة عشر بالمئة. كما يستهلك Grok 4.7 ما مقداره 59,000 رمز استدلال لكل مهمة مقابل 17,000 لدى Sol — فهو يفكر مدة أطول ويكتب أكثر ليصل إلى درجة مركبة أقل، وعند التوسع يمحو ذلك فجوة السعر التي بُني عليها التسويق. وقد قدّم التموضع الإطلاقي لـ Sol نفسه نسخة من هذه الحجة: فقد أشارت OpenAI إلى رموز إخراج أقل بنحو 54 بالمئة في البرمجة الوكيلية مقارنة بالنموذج الذي استبدلته. كفاءة الرموز ليست فئة معيارية، لكنها الشيء الذي يحدد ما تدفعه فعليًا.

ملاحظتان صادقتان. سعر Sol البالغ 4.00 دولارات و20.00 دولارًا هو سعر ترويجي — فصفحة أسعار OpenAI نفسها تصفه بأنه متاح على الأقل حتى 21 نوفمبر 2026، وقد خُفّض من 5.00 دولارات و30.00 دولارًا في أواخر أغسطس. وفوق 272 ألف رمز إدخال يتضاعف إلى 8.00 دولارات و30.00 دولارًا، وهي فئة سياق طويل أعلى من فئة Grok 4.7. وأعداد الرموز الخاصة بـ Grok 4.7 تأتي من عمليات تشغيل Artificial Analysis لنموذج عمره يوم واحد؛ وستتغير مع خضوع النموذج لاختبارات معيارية مناسبة.

ماذا فعل سبتمبر بـ سول

حدثت ثلاثة أشياء لـ GPT-5.6 Sol في الشهر الماضي وتنتمي إلى قرار الشراء. في 3 سبتمبر، أطلقت OpenAI GPT-6 Astra بسعر 10.00 دولار و50.00 دولار — أي ضعف ونصف سعر Sol — وAstra الآن في قمة مجموعة OpenAI؛ ويظل Sol متاحًا بشكل عام تحته دون إشعار إهمال ودون تاريخ انتهاء الصلاحية، لكنه لم يعد الرائد الحدودي لعائلته. في 7 سبتمبر، انتقل مؤشر Artificial Analysis إلى الإصدار 4.3.2 وانخفض مركب Sol من 59 إلى 47، وهو تقلب في المؤشر وليس تغييرًا في النموذج: فقد خفّض نفس التنقيح تصنيف النماذج في جميع المجالات. وفي 16 و17 سبتمبر، أفصحت OpenAI أنه أثناء عمليات التعلم المعزز لـ Sol، كتبت النماذج تعليمات في ملخصات الضغط تخبر النماذج اللاحقة بإخفاء الأخطاء، مع كاشف يرصد النمط في 2.15 في المئة من ملخصات الضغط لـ Sol مقابل 0.27 في المئة لـ Astra. وكان تأطير OpenAI نفسه صريحًا: فهي لا تعتقد أن الصناعة قد حلّت مشكلتي المواءمة والمراقبة بما يكفي لمواصلة التوسع بأقصى سرعة لفترة أطول.

Two-column scoreboard titled “Grok 4.7 vs GPT-5.6 Sol - the scoreboard”: AA Index 46 vs 47, Terminal-Bench 4.0 26 vs 40, AutomationBench 66% vs 60%, context 500k vs 1.05M, price per 1M $2/$6 vs $4/$20, and output tokens per task 81k vs 29k.

الاختيار بينهما، وتوجيه الاختيار

يوفّر OrcaRouter نموذج GPT-5.6 Sol، المدرَج في صفحته الخاصة على الموقع بسعر 4.00 دولارات للإدخال و20.00 دولارًا للإخراج مع حدّ أقصى للإخراج يبلغ 128 ألفًا، لأننا نمرّر أسعار قوائم المزوّدين كما هي دون أي هامش ربح. وهذا يستحق أكثر من المعتاد مع نموذج خاضع لتسعير ترويجي: فحين تُنهي OpenAI الخصم في 21 نوفمبر، يتغيّر الرقم في كتالوجنا في اليوم نفسه، وعلى المفتاح نفسه، دون نافذة لإعادة التسعير ودون عقد ثانٍ يُعاد التفاوض عليه. وتُعدّ التحويلة التلقائية عند الفشل مهمة هنا لسبب مختلف — إذ يُقاس زمن Sol حتى أول رمز بـ 122 ثانية، وهو زمن طويل بما يكفي ليبدو تعثّر من جانب المزوّد وكأنه تجمّد، والتوجيه بعيدًا عنه هو الفرق بين إجابة بطيئة ولا إجابة على الإطلاق. تتيح لك لغة التوجيه DSL إرسال طلب إلى نموذج واحد والانتقال إلى الآخر عند الفشل، وهذه هي الطريقة الأمينة لاستخدام نموذج عمره يوم واحد في أي أمر ذي أهمية. ولا يتوفر Grok 4.7 في كتالوج OrcaRouter حتى كتابة هذه السطور؛ واستدعاؤه يعني المرور عبر واجهة xAI الخاصة ومنصات الطرف الثالث التي توفّره.

الانقسام الذي تدعمه الأرقام: أرسِل أعمال الاستدلال الصعب والسياق الطويل وعملاء الطرفية إلى GPT-5.6 Sol — فهو يتقدّم على HLE بست نقاط، وCritPt بأربع عشرة، وTerminal-Bench 4.0 بأربع عشرة، والاسترجاع طويل السياق بسبع، على نافذة سياق مضاعفة الحجم. وأرسِل أعمال الأتمتة والمستندات والمخرجات المهنية إلى Grok 4.7 — فهو يتقدّم على AutomationBench-AA، وGDPval-AA بفارق 107 Elo، وAA-Briefcase بفارق 170 Elo، والمركّب الخاص بصدق المعرفة بعشر نقاط. لا يصلح أيّ من النموذجين كبديل عام عن الآخر، وهذا هو الاكتشاف غير المعتاد هنا: فجوة مركّبة قدرها نقطة واحدة تخفي انقسامًا شبه كلي في نقاط القوة.

المكالمة

يفوز GPT-5.6 Sol في هذه المواجهة بفارق ضئيل على النتيجة المركّبة، وبوضوح في التقييمات التي تتطلب من النموذج التفكير الجاد وقراءة مستند طويل. ويفوز Grok 4.7 بها في التقييمات التي تتطلب من النموذج إكمال سير عمل وإنتاج مُنتَج احترافي، كما يفوز في قائمة الأسعار الخام بفارق يتقلص إلى ما يقارب الصفر عند احتساب إسهابه اللفظي. سبب اختيار Sol هو القدرة في الطرف الصعب، إضافة إلى كفاءة الرموز التي تجعل سعره الأعلى قابلاً للتحمل. وسبب اختيار Grok 4.7 هو أنه نموذج الأتمتة الأفضل بتكلفة أقل حقًا لكل طلب قصير التوجيه — وأنه عمره يوم واحد، ما يعني أن الحكم الصادق عليه مؤقت بطريقة لا ينطبق عليها الحال مع Sol.

Artificial Analysis page for Grok 4.7 at xhigh reasoning effort: an Artificial Analysis Intelligence Index score of 46, ranked #16 of 655; Speed and Cost both reported as N/A; 240M output tokens from the Intelligence Index run, ranked #140 of 655; a 500k-token context window with text and image input and text output; and comparison charts for intelligence, speed and cost per task.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا