لوحة نتائج مقارنة مولّدة من عمودين بعنوان 'GPT-6.1 Sol مقابل GPT-6 Sol — لوحة النتائج'. العمود الأيسر 'GPT-6.1 Sol': صفوف نصّها 'الإصدار: 29 سبتمبر 2026'، 'المدخلات: $2.00 لكل 1M'، 'المدخلات المخزّنة مؤقتًا: $0.10 لكل 1M'، 'السياق: 1,050,000 رمز'، 'الاستدلال: لا شيء غير مدعوم'، 'ذروة المورّد: DeepSWE +6.4 نقطة'. العمود الأيمن 'GPT-6 Sol': صفوف نصّها 'الإصدار: 22 سبتمبر 2026'، 'المدخلات: $2.00 لكل 1M'، 'المدخلات المخزّنة مؤقتًا: $0.20 لكل 1M'، 'السياق: 1,050,000 رمز'، 'الاستدلال: لا شيء مدعوم'، 'ذروة المورّد: خط الأساس'. ويقول تذييل الصفحة: 'أرقام OpenAI مُبلّغ عنها من المورّد؛ لم تُنشر أي نتيجة مستقلة لأي من النموذجين حتى 30 سبتمبر 2026.'
Guides & Insights

GPT-6.1 Sol مقابل GPT-6 Sol: ما الذي حقّقه أسبوع إضافي من العمل، وما الذي لم يحققه

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

إذا كان لديك GPT-6 Sol قيد التشغيل في الإنتاج اليوم وتحاول أن تقرر ما إذا كان GPT-6.1 Sol يستحق الترحيل، فإن الإجابة تعتمد كليًا على أيّ من تكاليفك أكبر — وقد صُمّم الطرازان بحيث تكون الإجابة "كلاهما" شبه معدومة. صدر GPT-6 Sol في 22 سبتمبر 2026 بسعر 2.00 دولار لكل مليون رمز، و0.20 دولار للمخزّن مؤقتًا، و10.00 دولار للمخرجات. صدر GPT-6.1 Sol في 29 سبتمبر 2026 بسعر 2.00 دولار للمدخلات، و0.10 دولار للمخزّن مؤقتًا، و10.00 دولار للمخرجات، مع تحسّن مقداره 6.4 نقطة مئوية أبلغت عنه الجهة المورّدة في مهام هندسة البرمجيات المعقّدة عند جهد استدلالي أقل. لم يتغيّر سعرا المدخلات والمخرجات. انخفض معدل التخزين المؤقت إلى النصف. هذا السطر الوحيد المتغيّر هو الحجة المالية بأكملها، وكل ما عداه حجة قدرات تأتي، في هذه المرحلة من عمر الإصدار، من مصدر واحد بالضبط.

تغيّرت ثلاثة أشياء. أحدها مشروع قانون.

جرّد الأمر من الدعاية التسويقية، وستجد أن الفارق بين هذين النشرين قصير بما يكفي ليسع في ذهنك.

• الإدخال المخزّن مؤقتًا — 0.10 دولار لكل مليون توكن على GPT-6.1 Sol مقابل 0.20 دولار على GPT-6 Sol. قياسًا لا ادعاءً، والتغيير الوحيد الذي يظهر على شكل حساب.
• القدرات، وفقًا للمورّد — تُفيد OpenAI بتفوّق بمقدار 6.4 نقطة على DeepSWE v1.1 عند جهد استدلال وتكلفة أقل، وأكثر من ضعف النتيجة على Terminal-Bench Science 0.1 عند أقصى جهد، وسبع نقاط على مجموعة OSWorld 2.0 غير المتصلة عند أقصى جهد، و4.8 نقاط على AutomationBench عند جهد متوسط، وانخفاض معدل الأخطاء الواقعية من 11.4% إلى 7.7% على مجموعة مطالبات مُصمَّمة عمدًا لإحداث الأخطاء. وكل ذلك غير مُعاد إنتاجه.
• سلّم الاستدلال — يدعم GPT-6.1 Sol low، medium، high، xhigh وmax، ولا يدعم none؛ يدعم GPT-6 Sol الست جميعها. هذا هو الفارق الذي يكسر الكود، وهو الفارق الذي لا يضعه أحد في منشور إطلاق.

كل شيء آخر متطابق أو قريب بما يكفي: النافذة السياقية نفسها البالغة 1,050,000 رمز، وسقف الإخراج نفسه البالغ 128,000 رمز، وسعر كتابة ذاكرة التخزين المؤقت نفسه البالغ 2.50 دولار، وعتبة إعادة التسعير نفسها عند 272 ألف رمز التي يُحاسَب الطلب بأكمله فوقها بمعدل ضعف سعر الإدخال وسعر ذاكرة التخزين المؤقت و1.5 ضعف سعر الإخراج، واشتراط Responses-API نفسه لاستدعاء الأدوات، وغياب دعم الضبط الدقيق نفسه. انتقل حد المعرفة من 20 أبريل إلى 30 أبريل 2026 — عشرة أيام، وهو رقم من النوع الذي يخبرك بأن هذا كان إعادة تجهيز أكثر منه إعادة بناء.

لماذا يستحق سطر الذاكرة المؤقتة أكثر مما يبدو

A screenshot of OpenAI's developer model page for GPT-6.1 Sol showing the pricing block with input at $2.00, cached input at $0.10, cache writes at $2.50 and output at $10.00 per million tokens, the note that cached input tokens are priced at 5% of the uncached rate, the 272K-token repricing rule, and a 1,050,000-token context window with 128,000 max output tokens.

من الغريب أن تتصدّر قراءة ذاكرة مؤقتة مخفَّضة إلى النصف تحديثَ منتج ما، حتى تنظر إلى ما تبدو عليه حركة مرور الوكيل فعليًا. حلقة الوكيل تعيد إرسال بادئة ثابتة — موجّه النظام، مخططات الأدوات، السياق المسترجَع، سجل المحادثة — في كل دور، وفي جلسة طويلة تُحتسب البادئة نفسها عشرات أو مئات المرات. هذه هي حركة المرور التي يتوقف عندها معدل التخزين المؤقت عن كونه خطأ تقريب ليصبح البند السائد في الفاتورة.

لنُجرِ الحسابات على جلسة وكيل واحدة طويلة. افترض إعادة استخدام بادئة من 120,000 رمز عبر 40 دورًا، أي 4.8 مليون رمز إدخال مخزّن مؤقتًا لكل جلسة، إضافة إلى 150,000 رمز إخراج جديد متواضعة. على GPT-6 Sol، تبلغ فاتورة القراءات المخزّنة مؤقتًا 0.96 دولار، وفاتورة الإخراج 1.50 دولار — أي نحو 2.46 دولار لكل جلسة. على GPT-6.1 Sol، تكلّف الجلسة نفسها 0.48 دولار للقراءات المخزّنة مؤقتًا و1.50 دولار نفسها للإخراج: نحو 1.98 دولار. الفرق لكل جلسة هو 48 سنتًا، وهو ليس فارقًا يُتخذ بشأنه قرار. اضربه على مئة ألف جلسة شهريًا فيصبح 48,000 دولار — وهذا فارق يُتخذ بشأنه قرار.

هناك تحفّظان يحافظان على مصداقية ذلك. فالقراءات المخزّنة مؤقتًا لا تُحتسب بسعر التخزين المؤقت إلا عندما تصيب البادئة فعلًا، لذا فإن التوفير المحقق لديك هو معدل الإصابة مضروبًا في الفرق، وليس الفرق نفسه. ويجب أن تكون البادئة أقل من 272,000 رمز حتى تنطبق الأسعار القياسية أصلًا: تجاوز هذا الحد، ويُعاد تسعير الطلب بأكمله عند 2× للمدخلات والتخزين المؤقت و1.5× للمخرجات، وهو ما قد يطغى على توفير قدره 10 سنتات على البادئة. والجلسات ذات السياق الطويل هي التي يقلّ فيها احتمال أن يبدو حساب التخزين المؤقت مطابقًا لما في الكتيّب الدعائي.

فجوة المعيار حقيقية، وهي تنبع من مكان واحد

منشور الإطلاق الخاص بـ OpenAI محدد بشكل غير معتاد بشأن تقييماته، وهذه نقطة لصالحه، وكل واحد من تلك الأرقام هو تقييم البائع لنموذجه الخاص، وهذه هي النقطة ضده. النمط فيما بينها متسق: المقارنة التي تنتشر تكون دائماً مقابل GPT-6 Astra، ومقارنة Astra هي دائماً مقارنة تكلفة. في DeepSWE v1.1، الادعاء هو مضاهات Astra بتكلفة تقارب الخُمس. في GDP.pdf، الاقتراب من أحدث ما لدى Astra بتكلفة تقارب الخُمس لكل مهمة. في OSWorld 2.0، ضمن 2.1 نقطة من Astra بتكلفة تقارب السُبع لكل مهمة. في الواقعية، ضمن 1.9 نقطة من Astra بتكلفة أقل من الخُمس لكل مهمة. هذا ليس مصادفة في الصياغة؛ إنه أطروحة المنتج، وهي أطروحة عن السعر، لا عن قيادة القدرات.

الموضع الوحيد الذي تتنازل فيه OpenAI عن صياغتها الخاصة جديرٌ بالتقدير: ففي Terminal-Bench Science 0.1 تقول بوضوح إن GPT-6 Astra لا يزال يحتفظ بأعلى نتيجة بين النماذج التي جرى اختبارها بنسبة 68.1%، وينبغي استخدامه في أصعب الأبحاث العلمية. ومنشور إطلاق يخبرك بمتى تشتري النموذج الشقيق الأغلى لهو منشور إطلاق يتّسم بقدر من الانضباط.

فيما يتعلق بـ GPT-6 Sol تحديدًا، فإن الحالة الصادقة للمقارنة هي هذه — لا يوجد تقييم مستقل لأي من النموذجين في هذا التكوين. لدى Artificial Analysis تقييم كامل لـ GPT-6 Sol عند أقصى جهد استدلالي: مؤشر Intelligence Index بقيمة 48، و1.06 دولار لكل مهمة مؤشر، و77 مليون رمز مُخرَجة تم توليدها مقابل وسيط لوحة قدره 88 مليون، ومؤشر Coding Agent Index بقيمة 57 بتكلفة 2.99 دولار لكل مهمة. ليس لديها أي إدخال لـ GPT-6.1 Sol على الإطلاق حتى 30 سبتمبر؛ معرّف النموذج (slug) يعطي 404 والسلسلة النصية لا تظهر في لوحة المتصدرين المباشرة. لذا فإن المقارنة الوحيدة المُقاسة من طرف ثالث المتاحة اليوم هي بين GPT-6 Sol ونماذج مختبرات أخرى — وليس بين GPT-6 Sol وخليفته. أي شخص يعرض عليك مخططًا للمقارنة بين 6.1 و6.0 الآن إنما يعرض عليك شريحة OpenAI.

الترحيل مجرد تغيير نصي، إلا حيث لا يكون كذلك.

يستحق إرشاد الترحيل الخاص بـ OpenAI لعائلة GPT-6 أن يُقرأ قبل أن تقوم بتبديل المعرّف، لأن بندين فيه يكسران كودًا يعمل. الأول هو سلّم الاستدلال: إذا أرسل أي طلب reasoning_effort: "none"، فإن GPT-6.1 Sol يرفضه، والعلاج الموثّق هو البدء من low ومقارنة على مهام تمثيلية بدلًا من افتراض أن الإعداد الأدنى مكافئ. سير العمل الذي استخدم none كخط أساس للزمن الاستجابة يفقد ذلك الخط الأساسي. الثاني هو استدعاء الأدوات: يدعم GPT-6.1 Sol Chat Completions لكن ليس استدعاء الأدوات من خلاله — تتطلب الأدوات واجهة Responses API. إذا كانت حزمتك تستدعي الدوال على /v1/chat/completions، فأنت لا تستبدل سلسلة نصية، بل تنقل نقطة نهاية. تعليمة المورّد نفسه للمطورين الموجودين بالفعل على GPT-6 Sol هي مراجعة ذلك الإرشاد قبل التبديل، وهي إشارة واضحة إلى أن هذا ليس التحديث الجاهز الذي توحي به فجوة الأسبوع الواحد.

تتصرف المعلمات المتبقية على النحو التالي: جهد الاستدلال، والمخرجات المهيكلة، والبث، والتخزين المؤقت للمطالبات، ومجموعة الأدوات كلها تنتقل معًا، وتنطبق قاعدة إعادة التسعير نفسها البالغة 272K على كلا الطرازين بالشكل نفسه. اضبط model إلى gpt-6.1-sol، وأبقِ إعداد الجهد كما هو حيث كان مدعومًا، وأزل temperature، top_p وtop_logprobs كلما لم يكن الجهد none — ينطبق هذا الأخير على كلا الطرازين وهو مصدر شائع لأخطاء 400 بعد أي ترحيل لنموذج استدلالي.

الترحيل دون المراهنة بمسار الإنتاج عليه

A screenshot of the OrcaRouter model page for GPT-6 Sol (openai/gpt-6-sol) showing the header 'by OpenAI - 2026-09-22', capability tags for vision, tools, JSON and reasoning, a 1,050,000-token context window with 128,000 maximum output tokens, a standard tier reading $2.00 input and $10.00 output per million tokens with $0.20 cached input, and a long-prompt tier reading $4.00 input and $15.00 output.

الهجرة الواقعية ليست قطعًا كاملًا، بل هي تشغيل ظل: أرسل شريحة من حركة الإنتاج إلى المعرّف الجديد، وأبقِ القديم كالمسار الذي يستجيب، وقارن على مهامك الخاصة. تلك مشكلة توجيه، وهي المكان الوحيد الذي تغيّر فيه المنصة التي تتصل عبرها شكل العمل. توفّر OrcaRouter نموذج GPT-6 Sol اليوم بسعر OpenAI المدرج نفسه دون أي هامش — فئة $2.00 / $0.20 / $10.00، مع تضمين قاعدة إعادة التسعير 272K — لذا فإن ذراع الأساس في المقارنة يعمل بالمفتاح نفسه مثل كل شيء آخر، ويمكن إضافة ذراع 6.1 إلى مجموعة المسارات بمجرد أن يصبح قابلًا للاستدعاء، دون عقد ثانٍ أو SDK ثانٍ. حتى ذلك الحين، الموقف الصادق هو أن GPT-6 Sol هو النموذج المتاح للاستدعاء، ويجدر قول ذلك بوضوح بدلًا من الإيحاء بخلاف ذلك: openai/gpt-6.1-sol يُرجع "model not found" على العامة لديناالكتالوج نقطة النهاية اليوم. التبديل التلقائي هو ما يجعل تشغيل الظل آمنًا عندما يتحقق — إذا أخطأ المسار الجديد، يكتمل الطلب على المسار القديم، وتكتشف الأمر من السجلات بدلًا من مستخدميك.

من ينبغي أن ينتقل الآن: الفرق التي تُهيمن على تكلفتها المدخلات المخزَّنة مؤقتًا في جلسات الوكيل الطويلة، والفرق التي تستخدم سير عملها بالفعل واجهة Responses API ولا ترسل أبدًا none. بالنسبة لهم، هذا ترقية شبه مجانية — إذ يُفيد المورّد بمكاسب القدرات، ويُخفَّض معدل التخزين المؤقت إلى النصف، والترحيل يقتصر على سلسلة نصية واحدة. ومن ينبغي أن ينتظر: الفرق التي لديها none في مسار حرج من حيث زمن الاستجابة، والفرق التي يجري استدعاء أدواتها عبر Chat Completions، وأي شخص يحتاج إلى رقم من جهة خارج OpenAI قبل الالتزام. وبالنسبة لتلك الفئة الأخيرة، لا يوجد تاريخ انتهاء منشور للانتظار، والشيء الحكيم الذي يمكن فعله بالوقت هو بناء مجموعة التقييم التي ستحتاجها المقارنة — لأنه عندما تصل النتيجة المستقلة، ستكون لحركة مرور شخص آخر.

A generated summary card titled 'What changed in one week' with five rows reading 'Cached input: $0.20 to $0.10 per 1M', 'DeepSWE v1.1: +6.4 points, vendor-reported', 'Terminal-Bench Science: more than doubled, vendor-reported', 'Context window: unchanged at 1,050,000', 'Input and output price: unchanged at $2.00 / $10.00', and a footer reading 'Vendor-reported figures only; no independent evaluation of GPT-6.1 Sol existed as of September 30, 2026.'

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا