لوحة نتائج مقارنة مُولَّدة من عمودين بعنوان 'GPT-6.1 Sol مقابل GPT-5.6 Sol - لوحة النتائج'. العمود الأيسر 'GPT-6.1 Sol': صفوف تقرأ 'مؤشر الذكاء: 51.8'، 'التكلفة لكل مهمة مؤشر: 0.72$'، 'المدخلات / المخرجات: 2.00$ / 10.00$'، 'المدخلات المخزنة مؤقتًا: 0.10$'، 'رموز المخرجات في تشغيل المؤشر: 67 مليون'، 'حد الجهد: منخفض'. العمود الأيمن 'GPT-5.6 Sol': صفوف تقرأ 'مؤشر الذكاء: 47.0'، 'التكلفة لكل مهمة مؤشر: 1.99$'، 'المدخلات / المخرجات: 4.00$ / 20.00$'، 'المدخلات المخزنة مؤقتًا: 0.40$'، 'رموز المخرجات في تشغيل المؤشر: 90 مليون'، 'حد الجهد: لا يوجد'. يقرأ التذييل 'أرقام مستقلة وفقًا لـ Artificial Analysis v4.3.2 بأقصى جهد؛ أسعار قائمة البائع'.
Guides & Insights

GPT-6.1 Sol مقابل GPT-5.6 Sol: أربع نقاط ونصف في المؤشر، نصف الفاتورة، تراجعان

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Open​AI released GPT-6.1 Sol on 29 September 2026, eleven weeks after GPT-5.6 Sol, which shipped on 9 July 2026 as the flagship of the previous generation. Both are still on sale, both are still callable, and the difference between them on the neutral board is 4.8 points — 51.8 against 47.0 on Artificial Analysis's Intelligence Index, both measured at maximum reasoning effort on the same ten-evaluation suite. The price difference is much larger than the score difference: $0.72 per completed index task against $1.99, and $2.00/$10.00 per million tokens against $4.00/$20.00. That is the short version. The long version is that the upgrade is not uniform, and two of the evaluations moved backwards.

ما هو كل نموذج، وما الذي حل محل ماذا؟

GPT-5.6 Sol was the top of the 5.6 line — a closed, API-only model with a 1,050,000-token context window, a 128,000-token output ceiling, text, image and file input, and a reasoning ladder running from none through max. It was described by Open​AI as the tier built for the hardest work: long-horizon agentic workflows, multi-file software engineering, deep reasoning, and it was priced accordingly at $4.00 and $20.00 per million tokens with cached input at $0.40 and cache writes at $5.00. Above 272,000 input tokens it repriced to $8.00 and $30.00, and it carried a Batch tier at $2.50 and $15.00.

GPT-6.1 Sol is the mid-tier of the generation that came after: below GPT-6 Astra, above GPT-6 Luna, and now the model Open​AI points cost-sensitive developers at. It keeps the 1,050,000-token window and the 128,000-token output cap, extends the knowledge cutoff from April 20 to April 30, 2026, and cuts the effort ladder from six rungs to five — low, medium (default), high, xhigh, max. The none value that GPT-5.6 Sol accepted now returns an error, and Open​AI's migration guidance is explicit that the substitution is low, not a silent upgrade.

يجدر التوقف عند هذا الأمر لأنه التغيير الوحيد في الإصدار الذي يكلّف مالًا بدلًا من أن يوفّره. إن خط معالجة كان يلجأ إلى none للحصول على استدعاء رخيص وسريع وغير استدلالي لم يعد يملك هذا التكوين، في أي من عائلتي النماذج. أرخص درجة على GPT-6.1 Sol هي درجة استدلالية، وتُحتسب رموز الاستدلال كرموز إخراج سواء أكان بإمكانك رؤيتها أم لا.

السلّم، درجةً درجة

تنشر الهيئة المستقلة درجة وتكلفة تشغيل لكل إعداد جهد على كلا الطرازين، مما يحوّل المواجهة المباشرة إلى شيء أكثر فائدة من مقارنة واحدة. وعند ترتيبهما عند إعدادات مكافئة:

• سلّم الجهد، GPT-6.1 Sol — الحد الأقصى 51.8 عند 0.72 دولار لكل مهمة فهرسة؛ xhigh 51.0 عند 0.39 دولار؛ high 50.2 عند 0.32 دولار؛ متوسط (الافتراضي) 47.8 عند 0.21 دولار • سرعة الإخراج — 59.7 رمزاً في الثانية لـ GPT-6.1 Sol مقابل 87.8 لـ GPT-5.6 Sol
• الوقت حتى أول جزء — 332 ثانية لـ GPT-6.1 Sol مقابل رقم أسرع لـ GPT-5.6 Sol، مقابل وسيط لوحة قريب من 4 ثوانٍ
• رموز الإخراج في تشغيل الفهرس — 67.2 مليون لـ GPT-6.1 Sol مقابل 90.0 مليون لـ GPT-5.6 Sol
• سعر الإدخال / الإخراج — $2.00 / $10.00 مقابل $4.00 / $20.00
• الإدخال المخزن مؤقتًا — $0.10 مقابل $0.40؛ كتابات التخزين المؤقت $2.50 مقابل $5.00
• سعر الدفعة — غير منشور لـ GPT-6.1 Sol مقابل $2.50 / $15.00 لـ GPT-5.6 Sol
• خطوة السياق الطويل — فوق 272,000 رمز إدخال، يعيد GPT-6.1 Sol التسعير إلى $4.00 / $15.00 للطلب بأكمله مقابل $8.00 / $30.00 لـ GPT-5.6 Sol
• الحد الأدنى للجهد — منخفض مقابل لا شيء

ثمة أمران يبرزان من تلك القائمة. الأول هو أن تخفيض السعر بنيوي وليس ترويجيًا: فسعر GPT-6.1 Sol القياسي البالغ 2.00 و10.00 دولار يقل عن سعر GPT-5.6 Sol للدفعات البالغ 2.50 و15.00 دولارًا، لذا حتى الفئة المخفّضة من الطراز القديم أغلى من السعر المعلن للطراز الجديد. والثاني هو أن الترقية ليست خطًا مستقيمًا فيما يخص زمن الاستجابة. يُنتج GPT-6.1 Sol مخرجات أبطأ بنحو الثلث، واستغرق 332 ثانية حتى أول جزء في اختبارات المطالبات الطويلة لدى اللوحة — أي من نفس رتبة المقدار البالغة 107 ثوانٍ لدى GPT-6 Sol، ونحو ثمانين ضعف وسيط اللوحة. إذا كنت قد بنيت منتجًا تفاعليًا على GPT-5.6 Sol، فهذا تراجع وظيفي مستقل عن أي معيار قياس، والإصلاح معماري وليس معاملًا.

A generated hero card for a GPT-6.1 Sol versus GPT-5.6 Sol comparison, headed 'Four and a half index points, half the bill', with two badges reading 'GPT-6.1 Sol: $0.72 per index task' and 'GPT-5.6 Sol: $1.99 per index task', a footer reading 'Independent figures per Artificial Analysis v4.3.2 at max effort; vendor list prices.', and the OrcaRouter logo in the bottom-right corner.

تقييمان سارا في الاتجاه الخاطئ

الربح المركّب هو 4.8 نقاط. ليست المكوّنات إيجابية بشكل موحّد، ودرجات المجلس لكل تقييم تقول ذلك:

• SciCode — GPT-6.1 Sol 0.542 مقابل GPT-5.6 Sol 0.571. تراجع بمقدار 2.9 نقطة في البرمجة العلمية.
• GDPval-AA v2.1 — GPT-6.1 Sol Elo 1575.1 مقابل GPT-5.6 Sol Elo 1611.3. تراجع بمقدار 36 نقطة في تصنيف Elo في الأعمال المعرفية ذات القيمة الاقتصادية.
• Humanity's Last Exam — GPT-6.1 Sol 0.529 مقابل GPT-5.6 Sol 0.495. تحسّن بمقدار 3.4 نقطة.
• Terminal-Bench 4.0 — GPT-6.1 Sol 0.561 مقابل GPT-5.6 Sol 0.399. تحسّن بمقدار 16 نقطة، وهو أكبر تغيّر منفرد في هذه المقارنة.
• AA-Omniscience — GPT-6.1 Sol 41.5 مقابل GPT-5.6 Sol 22.0، وهو اختبار يتعلق بموثوقية المعرفة والهلوسة بدلاً من الاسترجاع الخام.
• AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf, CritPt — المعايير الخمسة المتبقية، التي تكمل المؤشر المركّب وعندها يُحتسب باقي التحسّن البالغ 4.8 نقاط.

A model that is meaningfully better on terminal work, substantially better on factual reliability, and measurably worse on scientific coding and on professional-work Elo is not a strictly better model. It is a different point on the frontier, and it was placed there deliberately: Open​AI's own launch framing for GPT-6.1 Sol is cost per completed task at near-flagship quality, not maximum score. If your workload is SciCode-shaped or GDPval-shaped, the composite number is not the one that applies to you, and the regression is.

لا يزال GPT-5.6 Sol يمتلك نتيجة السياق الطويل المنشورة

المكان الوحيد الذي يمتلك فيه النموذج الأقدم رقمًا لا يمتلكه الأحدث هو دقة الاسترجاع في نطاق السياق حيث تتغير بطاقة أسعار GPT-6.1 Sol. يحمل GPT-5.6 Sol نتيجة منشورة لـ MRCR v2 eight-needle بنسبة 91.5% في نطاق 256,000 إلى 512,000 رمز. ليس لدى GPT-6.1 Sol نظير منشور، وفوق 272,000 رمز إدخال يُعاد تسعير طلبه بالكامل عند 2× للإدخال وذاكرة التخزين المؤقت و1.5× للإخراج.

إذا جمعت هاتين الحقيقتين معًا، فإن الجزء الذي تكون فيه الجدوى الاقتصادية للنموذج الجديد أضعف ما تكون هو بالضبط الجزء الذي يمتلك فيه النموذج القديم نقطة القوة الموثّقة الوحيدة. لا تختفي التوفيرات — $4.00 و$15.00 على الطبقة المعاد تسعيرها مقابل $8.00 و$30.00 على طبقة السياق الطويل الخاصة بـ GPT-5.6 Sol لا تزال خفضًا بالنصف — لكن قصة نصف السعر هي قصة أحمال العمل العامة، وخط أنابيب استرجاع السياق الطويل ليس كذلك. إذا كان هذا هو عبء عملك، فإن GPT-5.6 Sol بسعر $4.00 و$20.00 مع نسبة منشورة تبلغ 91.5% يمثل مكانًا يمكن الدفاع عنه للبقاء.

GPT-5.6 Sol's other published results remain intact and are the reason some teams will not move: BrowseComp 90.4 for web-research agents, Terminal-Bench 2.1 at 88.8 and 88.0, SWE-Bench Pro 64.6, Agents' Last Exam 53.6, OSWorld 2.0 at 62.6. Those are Open​AI-reported, on Open​AI's harness, and they were reported in July. What has changed since is that the board now scores both models on one suite at one set of settings, and the older model loses on the composite and on cost.

الترحيل نفسه تغيير في سلسلة نصية، باستثناء واحد

المورّد نفسه، وواجهة API نفسها، ومتجاوران في الترتيب، والنافذة نفسها وسقف الإخراج نفسه — لذا، بالنسبة لمعظم التكديسات التقنية، لا يعدو الأمر أن يكون معرّف نموذج وسعرًا ينخفض إلى النصف. الاستثناءات محددة وتستحق التسمية قبل أن تقوم بالتبديل.

إذا كان الكود لديك يعيّن reasoning.effort إلى none أو minimal، فسيفشل بدل أن يتدهور، وlow هو البديل الموثّق. إذا تجاوزت حركة المرور لديك 272,000 رمز إدخال، فتحقق من الفئة المعاد تسعيرها قبل أن تحسب التوفير. إذا كان منتجك يعتمد على زمن الوصول إلى أول رمز، فقِس قبل الإطلاق، لأن رقم 332 ثانية في لوحة النتائج ليس خطأ تقريب. وإذا كانت تقييماتك تحتوي على شريحة على شكل SciCode أو على شكل GDPval، فشغّل تلك الشريحة على كلا النموذجين بدلاً من الوثوق بالنتيجة المركبة.

Both models are on OrcaRouter at Open​AI's own list prices — GPT-6.1 Sol at $2.00 and $10.00 with cached input at $0.10, GPT-5.6 Sol at $4.00 and $20.00 with cached input at $0.40 — under a pass-through model that puts an Open​AI price change on our side the same day it lands rather than after a reseller renegotiates. Because the price list is passed through unchanged rather than marked up, the arithmetic in this article is the arithmetic you get: the same $0.72-per-task model, the same halving, no platform premium layered on either side.

A screenshot of the OrcaRouter model page for openai/gpt-5.6-sol, showing the listing dated 2026-07-09, the model described as the flagship of OpenAI's GPT-5.6 series for deep multi-step reasoning and long-horizon agentic workflows, a 1.05M-token context with 128K maximum output, text, image and file input, and the list price of $4.00 input and $20.00 output per million tokens.

الفائدة العملية من وجود كليهما خلف نقطة نهاية واحدة هي أن المقارنة تظل حية. وجّه حركة المرور الجديدة إلى GPT-6.1 Sol، وأبقِ GPT-5.6 Sol على بُعد تغيير إعداد واحد كخيار احتياطي وكمسار للسياق الطويل، ودع تجاوز الفشل التلقائي يغطي الفترة التي لا يزال فيها توافر طراز رائد عمره شهران وتمكين Enterprise يستقران. إن الترحيل الذي يخفض الفاتورة إلى النصف ويحرّك اثنين من المعايير الفرعية إلى الخلف ليس قرارًا يُتخذ مرة واحدة ثم يُنسى؛ بل هو قرار يُتخذ لكل مسار، وطبقة التوجيه هي ما يجعل ذلك رخيصًا.

A screenshot of the OrcaRouter model page for openai/gpt-6.1-sol, showing the listing dated 2026-09-29, a 1M-token context with 128K maximum output, text, image and file input, a reasoning effort ladder running from low to max, and the pass-through list price of $2.00 input and $10.00 output per million tokens with cached input at $0.10.

حيث ينتمي كل واحد

• العمل الوكيلي العام وأعمال الطرفية — GPT-6.1 Sol. ست عشرة نقطة في Terminal-Bench 4.0 ونصف السعر ليسا بفارق ضئيل.
• الموثوقية الواقعية، ومنتجات الإجابات المسترجَعة — GPT-6.1 Sol، بفارق يقارب عشرين نقطة في AA-Omniscience.
• البرمجة العلمية — راجع تقييماتك الخاصة أولًا. تُظهر اللوحة تراجعًا بمقدار 2.9 نقطة، ولن يُبرز المقياس المركّب ذلك.
• العمل المعرفي ذو القيمة الاقتصادية — الحذر نفسه. تراجع Elo في GDPval-AA يبلغ 36 نقطة.
• الاسترجاع طويل السياق فوق 272,000 رمز — GPT-5.6 Sol، إلى أن يتوفر لدى GPT-6.1 Sol رقم منشور في ذلك النطاق.
• الواجهات التفاعلية الحساسة لزمن الاستجابة — قِس قبل الترحيل. إخراج أسرع، وأول رمز أبطأ بكثير.
• أرخص استدعاء غير استدلالي — لا هذا ولا ذاك. هذا التكوين لم يعد موجودًا في هذه العائلة.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا