بطاقة عنوان مُولَّدة تحمل نص 'GPT-6.1 Sol Context Window' مع عنوان فرعي '1,050,000 tokens، وحدّ 922,000، وهاوية 272,000'. أسفلها ثلاثة ألواح مستديرة الزوايا: 1,050,000 موسوم بـ 'نافذة السياق، على صفحة المورّد'، و922,000 موسوم بـ 'أقصى إدخال، في نموذج الوثائق'، و272,000 موسوم بـ 'سطر الإدخال الذي يُعيد تسعير الطلب بأكمله'. ويظهر شعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

نافذة سياق GPT-6.1 Sol: 1,050,000 رمز، وخط 922,000، وهاوية 272,000

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

صفحة النموذج لدى المورّد الخاصة بـ GPT-6.1 Sol، كما قُرئت في 7 أكتوبر 2026، تذكر نافذة سياق تبلغ 1,050,000 رمز وحدًّا أقصى للمخرجات يبلغ 128,000 رمز. الصفحة نفسها، في الشكل القابل للقراءة آليًا الذي تحصل عليه بإلحاق .md بعنوان URL الخاص بها، تحمل رقمًا ثالثًا لا تطبعه الصفحة المعروضة أبدًا: حد أقصى قدره 922,000 رمز إدخال. GPT-6 Sol، النموذج الذي أُصدر الإصدار 6.1 ليخلفه في 2026-09-29، ينشر الزوج نفسه من أرقام السقف على صفحته الخاصة، والسطر نفسه 922,000 في شكل Markdown الخاص به. بطاقة النموذج الخاصة بنا لـ openai/gpt-6-sol تذكر أن النافذة 1,050,000 رمز وأن الحد الأقصى للمخرجات 128,000، وتعرض الأول منهما كـ "1M" في شريط المواصفات الخاص بها، وتطبع "1.1M" للنموذج نفسه في جدول مقارنة أسفل الصفحة نفسها.

إذن، الصفحات تتناقض بالفعل، ومن الجدير أن نكون دقيقين في كيفية تناقضها. شريط المواصفات المعروض من المورّد يعطي نافذةً وسقفًا للمخرجات ولا سقف للمدخلات. أما وثائق المورّد بصيغة ماركداون للطراز نفسه فتعطي الثلاثة جميعًا. أي شخص يحدّد حجم طلب بناءً على الصفحة المعروضة يتعامل مع قيد واحد أقل مما نشره المورّد، والقيد الناقص هو الرقم الذي يحدّد ما إذا كان الطلب مناسبًا.

ثلاثة أرقام، وثلاثة مصادر، وطرح واحد لا يكتبه أحد

إليك كل رقم مع المستند الذي جاء منه، وقد قُرئت جميعها في 7 أكتوبر 2026.

• نافذة سياق 1,050,000 — صفحة النموذج الخاصة بالمورّد لـ gpt-6.1-sol، في شريط المواصفات المعروض وفي نسخته بتنسيق ماركداون، وكذلك الرقم نفسه في صفحة gpt-6-sol. وهو أيضًا ما يُرجعه كتالوجنا لـ openai/gpt-6-sol و openai/gpt-6-luna، حيث يكون الحقل مُدخَلًا كـ 1,050,000 بدلًا من كونه مُقرَّبًا.

• 128,000 رمز إخراج كحد أقصى — الصفحة نفسها، والنموذجان نفسهما، لكلا الجيلين. يشير حقل بطاقتنا إلى 128,000؛ أما عرضها فيُقرّب إلى "128K".

• 922,000 حدٍّ أقصى لرموز الإدخال — الصيغة الماركداونية لصفحة طراز gpt-6-sol لدى المورِّد ولصفحته gpt-6.1-sol. وهي ليست في الشريط المعروض لأيٍّ من الصفحتين، وليست في حقل الكتالوج الخاص بنا لهذا الطراز، الذي يتوقف عند نافذة السياق وسقف الإخراج.

الأرقام الثلاثة متسقة حسابيًا بعضها مع بعض: 922,000 زائد 128,000 يساوي بالضبط 1,050,000. ويصف دليل الاستدلال الخاص بالمورّد نفسه الآلية التي تجعل هذا التطابق ذا معنى، من دون أن يجري عملية الجمع على صفحة النموذج قط — إذ يقول إن رموز الاستدلال "لا تزال تشغل مساحة في نافذة سياق النموذج"، وإذا "بلغت الرموز المولّدة حد نافذة السياق أو قيمة max_output_tokens التي ضبطتها"، فإن الاستجابة تعود موسومة بأنها غير مكتملة. والنافذة المشتركة بين ما يدخل وما يخرج هي نافذة يكون فيها سقف الإدخال هو النافذة ناقص الحجز المخصص للإخراج.

هذه القراءة مؤيَّدة بالأدلة، لا مُثبتة، ويجدر الفصل بين الأمرين. فالمُوثَّق هو نافذة سعتها 1,050,000، وسقف مخرجات قدره 128,000، وحد أقصى للمدخلات قدره 922,000. أما المُستنتَج فهو أيٌّ من هذه هو القيد الذي يُفعَّل أولاً. يصحّ الاستنتاج مع كل طلب يحجز كامل مخصص المخرجات الخاص به، ويفشل مع أي طلب لا يفعل ذلك — فعند ضبط max_output_tokens على 4,000 مع 1,046,000 من رموز الإدخال، لا يُرفض الطلب بوضوح. وإلى أن يكتب المورّد عملية الطرح في الصفحة التي توجد عليها الأرقام، تعامل مع الاقتران باعتباره شكل الميزانية لا كقاعدة قبول صارمة، وتحقق عبر نقطة نهاية العدّ لا عبر منشور مدونة.

السياق ليس ثمنًا: الخطوة البالغة 272,000 رمز

النافذة الأكبر هي ادعاء سعة. وهي ليست ادعاء تكلفة، وفي هذه العائلة يفترق الاثنان عند خط موثّق. توضح صفحة التسعير الخاصة بالبائع القاعدة في جملة واحدة: المطالبات التي تحتوي على أكثر من 272K رمز إدخال تُسعّر بمقدار 2x من أسعار الإدخال والتخزين المؤقت و1.5x من الإخراج للطلب بأكمله. كما أن تعريف الصفحة نفسها لعموديها هو "سياق قصير: ≤272K رمز إدخال. سياق طويل: >272K رمز إدخال."

اقرأ الكلمة full بعناية. لا تفرض الطبقة ضريبة على الرموز بعد الخط — بل تعيد تسعير كل شيء، بما في ذلك الرمز الأول. وهي ليست تغييرًا في 6.1: القاعدة المطابقة نفسها، بالعتبة المطابقة نفسها، تنطبق على GPT-6 Sol، ولهذا يجب أن تُنسب الهاوية إلى الطبقة لا إلى الإصدار.

شغّل مهمة واحدة طويلة السياق عبر كلا الجانبين، وفقًا للأسعار المنشورة لـ GPT-6.1 Sol، مع بقاء البادئة موجودة بالفعل في ذاكرة التخزين المؤقت كي لا تُشوّش رسوم كتابة ذاكرة التخزين المؤقت المقارنة:

• 240,000 رمز إدخال (200,000 مخزّن مؤقتًا، 40,000 جديد)، 6,000 إخراج — الإدخال الجديد 40,000 بسعر $2.00 لكل مليون يساوي $0.080؛ الإدخال المخزّن مؤقتًا 200,000 بسعر $0.10 يساوي $0.020؛ الإخراج 6,000 بسعر $10.00 يساوي $0.060. الإجمالي، $0.160.

• 300,000 رمز إدخال (260,000 مخزّن مؤقتًا، 40,000 جديد)، 6,000 رمز إخراج — الطلب الآن فوق العتبة، لذا يتغير كل معدل: الإدخال الجديد 40,000 بسعر $4.00 يساوي $0.160؛ الإدخال المخزّن مؤقتًا 260,000 بسعر $0.20 يساوي $0.052؛ الإخراج 6,000 بسعر $15.00 يساوي $0.090. الإجمالي، $0.302.

خمسة وعشرون بالمئة المزيد من رموز الإدخال تشتري فاتورة أكبر بنسبة 89 بالمئة. شغّل الزوج نفسه على GPT-6 Sol وسيبقى النمط قائمًا بميل أكثر انحدارًا — 0.180 دولار أدنى من الخط مقابل 0.354 دولار أعلى منه، لأن السعر المخبأ للبطاقة الأقدم البالغ 0.20 دولار يقع في الموضع نفسه الذي يقع فيه السعر المخبأ للسياق الطويل لدى 6.1. العبور عبارة عن درجة، لا ميل، وأرخص طريقة لرؤية ذلك هي عبوره بفارق ضئيل للغاية. طلب غير مخبأ بالكامل من 271,000 رمز مع 1,000 رمز إخراج يكلّف 0.552 دولار؛ وعند 273,000 يكلّف 1.107 دولار. سبعة أعشار بالمئة رموز إدخال إضافية، مقابل 2.01 ضعف المبلغ. اقتطع 2,000 رمز من ذلك الطلب وتهبط الفاتورة من 1.107 دولار إلى 0.552 دولار — أقل من واحد بالمئة من الإدخال مقابل نصف التكلفة.

لا شيء في هذا القسم يتعلق بكون نافذة GPT-6.1 Sol كبيرة. بل يتعلق بكون النافذة كبيرة بما يكفي للوصول إلى حدٍّ تزيد كلفته على ما تشتريه سعة النافذة.

A generated two-column scoreboard titled 'GPT-6.1 Sol vs GPT-6 Sol - the scoreboard'. Both columns carry the same six rows. GPT-6.1 Sol reads: context window 1,050,000 tokens; max input 922,000 tokens (docs form); max output 128,000 tokens; input price $2.00 / $4.00 per M; cached input $0.10 / $0.20 per M; output price $10.00 / $15.00 per M. GPT-6 Sol reads the same on every row except cached input, which is $0.20 / $0.20 per M. A footer line credits OpenAI's model and pricing docs read Oct 7 2026 and explains that the second figure in each price row is the long-context rate above 272,000 input tokens. The OrcaRouter logo appears in the bottom-right corner.

ما الذي يملأ فعليًا 1,050,000 توكن؟

تتكوّن ميزانية السياق من ستة أشياء، وهي ليست قابلة للتخزين المؤقت بالتساوي. حصص تقريبية لطلب وكيلي توضيحي بحجم 240,000 رمز؛ النسب من عندنا، وقواعد قابلية التخزين المؤقت من عند المورّد، من دليل التخزين المؤقت للمطالبات الخاص به الذي قُرئ في اليوم نفسه.

• محتوى النظام المُحقَن من قِبَل مزوِّد الخدمة وتنسيق الطلب — يُعرض قبل رسائلك، ويُحتسب ضمن المُدخلات، ومستبعَد صراحةً من الحد الأدنى للطول القابل للتخزين المؤقت. ليس لك التحكم فيه، ولا تقليصه.

• تعليمات المطور والنظام الخاصة بك، حوالي 6,000 رمز. قابل للتخزين المؤقت. هذا هو الجزء الأمامي من البادئة، لذا فإن أي تغيير هنا يبطل كل ما يليه.

• تعريفات الأدوات ومخططاتها، حوالي 14,000 رمز لسطح الأدوات المستضاف بالإضافة إلى دوالك. قابلة للتخزين المؤقت، وهي الجزء الأكثر هشاشة من البادئة: يسرد الدليل أسماء الأدوات وأوصافها ومخططاتها وترتيبها والتعليمات الخاصة بكل أداة باعتبارها أشياء تحرّك حدود البادئة.

• المدونة المسترجعة، بنحو 180,000 رمز. قابلة للتخزين المؤقت، وهي إلى حد بعيد أكبر سطر. لا تستحق التخزين المؤقت إلا إذا كانت مستقرة على مستوى البايت بين الاستدعاءات — فالمدونة التي يعاد تجميعها عند كل طلب هي مدونة بالسعر الكامل.

• النص المتراكم — الأدوار السابقة ونتائج الأدوات — نحو 30,000 رمز مميز ويزيد. قابل للتخزين المؤقت حتى أحدث تغيير؛ أما نتيجة الأداة التي وصلت في هذا الدور فهي مدخل جديد بالمعدل الكامل.

• رموز الاستدلال — يتم توليدها، ولا يتم تخزينها مؤقتًا أبدًا، ويُحتسب ثمنها كمخرجات. تستهلك النافذة ولا تكون مرئية في جسم الاستجابة.

تنتج ملاحظتان تشغيليتان مباشرة من تلك القائمة. أولاً، يتم الاحتفاظ بإدخالات ذاكرة التخزين المؤقت على أجهزة فردية: يقول الدليل إنه يمكن للطلب إعادة استخدام بادئة "فقط إذا وصل إلى جهاز يحتفظ بإدخال مطابق لم تنته صلاحيته"، وأن توجيه الفائض يبدأ فوق حوالي 15 طلبًا في الدقيقة. قد تفشل بادئة مستقرة في الكود الخاص بك في بيئة الإنتاج. ثانيًا، الحد الأدنى للبادئة القابلة للتخزين المؤقت هو 1,024 رمز إدخال مرئي، ولا تُحتسب رموز النظام المخفية ضمنها — لذا فإن موجه نظام صغير ليس بادئة قابلة للتخزين المؤقت مهما كان حجم الطلب المحيط به كبيرًا.

سقف الإنتاج هو ميزانية منفصلة، وليس حصة ثانية من الطعام

128,000 من رموز الإخراج القصوى لا تعني 128,000 رمز من الإجابة. يوضّح دليل الاستدلال صراحةً أن max_output_tokens يحدّ من الإجمالي الذي يولّده النموذج، «بما في ذلك رموز الاستدلال، ورموز الإخراج المرئية، ورموز التنسيق غير المرئية»، وأن رموز الاستدلال تُحتسب ضمن الإخراج بينما تشغل حيّزًا في النافذة.

وهذا يجعل الاقتطاع قرارًا تصميميًا لا حالةً هامشية، بسبب طريقة فشله. عندما يبلغ التوليد الحد، تعود الاستجابة بحالة incomplete وسبب max_output_tokens — ويحذر الدليل من أن هذا «قد يحدث قبل إنتاج أي رموز إخراج مرئية، ما يعني أنك قد تتحمل تكاليف رموز الإدخال والاستدلال دون تلقي استجابة مرئية». إن الميزانية التي تنفق النافذة كلها على الإدخال وتترك حجز الإخراج للصدفة هي ميزانية يمكن أن تحاسب على طلب كامل طويل السياق ولا تعيد شيئًا يمكن للمتصل تحليله. وتوصية المورّد نفسه كنقطة انطلاق هي أن تحجز 25,000 رمز على الأقل للاستدلال والمخرجات بينما لا تزال تقيس ما يحتاجه الموجّه فعليًا.

GPT-6.1 Sol يشحذ هذا، وهو أحد الأسطر القليلة الخاصة حقًا بـ 6.1 في الإصدار. يتدرج سلّم جهد الاستدلال الخاص به عبر: منخفض، ومتوسط، ومرتفع، وxhigh، وأقصى، ولا يُدعم إعدادا none و minimal. يقبل GPT-6 Sol الستة جميعها. لذلك لا يوجد إعداد في 6.1 يوقف إنفاق الاستدلال، والافتراضي هو متوسط، وجانب الإخراج من الميزانية ليس مجانيًا أبدًا.

اقرأ تنصيف الإدخال المُخزَّن مؤقتًا حيث تكون النافذة أوسع ما تكون.

السعر الوحيد على بطاقة GPT-6.1 Sol الذي تحرّك في اتجاه معاكس لـ GPT-6 Sol هو الإدخال المخزّن مؤقتًا: من 0.20 دولار إلى 0.10 دولار لكل مليون رمز، وهو ما تعبّر عنه صفحة الطراز بأنه 5% من سعر الإدخال غير المخزّن مؤقتًا، ويسمّيه دليل التخزين المؤقت لدى المورّد صراحةً حالة 0.05x مقابل 0.1x الذي تُسعَّر به معظم طرز GPT-5.5-and-later. الإدخال وكتابات ذاكرة التخزين المؤقت والإخراج متطابقة في كلتا البطاقتين، وكذلك السياق الطويل.

بالنسبة لعبء العمل الذي تتناوله هذه الصفحة تحديدًا، فإن هذا هو العدّاد الصحيح الذي كان ينبغي تحريكه، والسبب هو تكوين الطلب الطويل لا حجمه. في المهمة البالغة 300,000 توكن أعلاه، هناك 260,000 من رموز الإدخال عبارة عن بادئة مخزّنة مؤقتًا — أي 87 بالمئة من كل ما يرسله الطلب. لذا فإن البند المخزّن مؤقتًا هو أكبر عدّاد إدخال منفرد في الفاتورة، وهذه هي السمة العامة للعمل ذي السياق الطويل: كلما طالت النافذة التي تستخدمها، زاد مقدار ما تمثله من بادئة سبق أن أرسلتها. وخفض ذلك العدّاد إلى النصف يعادل 0.02 دولار في ذلك الطلب.

والجرف يسترد أكثر مما يمنحه التنصيف، في الطلب نفسه. فلو سُعِّرت بأسعار السياق القصير التي كان سيدفعها تحت الخط، لكانت المهمة نفسها البالغة 300,000 رمز على {{1}}GPT-6.1 Sol{{/1}} تكلّف 0.166 دولار بدل 0.302 دولار — أي كلفة عبور قدرها 0.136 دولار، نحو 2.6 ضعف قيمة العدّاد الواحد الذي غيّره الإصدار. وفوق الخط، يقرأ السعر المخزَّن 0.20 دولار، وهو ليس رقمًا جديدًا في هذه العائلة: فهو ضعف السعر الرئيسي المعلن على بطاقة 6.1 وتمامًا ما كان {{2}}GPT-6 Sol{{/2}} يتقاضاه مقابل قراءة مخزَّنة تحت الخط قبل هذا الإصدار. وحملٌ مخزَّن طويل السياق يجمع السعر الرئيسي المعلن ثم يسلّمه عند الحدّ، والحدّ — لا النموذج — هو السبب.

A screenshot of the machine-readable markdown form of OpenAI's GPT-6.1 Sol model documentation, captured October 7 2026, showing the Model details block with the three figures on consecutive lines — 1,050,000 context window, Maximum input tokens: 922,000, and 128,000 max output tokens — above the Text tokens pricing table listing Input $2, Cached input $0.1, Cache writes $2.5 and Output $10 per 1M tokens, the note that cached input tokens are priced at 5% of the uncached input rate, and the sentence 'Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request.'

كيفية تحديد حجم ميزانية السياق

كإجراء، بالترتيب الذي تُلزم به القيود:

• أحصِ الطلب، ولا تخمّن عدده.أرسِل الحمولة الدقيقة — الأدوات والصور والملفات وكل شيء — عبر POST إلى نقطة نهاية عدّ رموز الإدخال في واجهة Responses API. يشرح الدليل السبب بصراحة: يتضمن العدّ رموز تنسيق لأدوار الرسائل والحدود لا تظهر أبدًا في النص الذي يمكنك ترميزه محليًا، كما أن التقديرات المحلية مثل عدد الأحرف مقسومًا على أربعة غير دقيقة للصور والملفات والمخططات.

• احجز جانب الإخراج أولاً. اختر max_output_tokens مع تذكّر أنه يغطي الاستدلال والإخراج المرئي والتنسيق معًا، وابدأ من المخزون المؤقت للمورّد البالغ 25,000 رمز بدلًا من الصفر. ميزانية الإدخال لديك هي النافذة ناقص ذلك الحجز، والرقم تسعمائة واثنان وعشرون هو نسخة المورّد من الطرح نفسه.

• سعّر الطلب على جانبي 272,000 قبل أن ترسله. الخطوة كبيرة بما يكفي لدرجة أن طلبًا مصممًا ليستقر تحت الخط بقليل وطلبًا مصممًا ليستقر فوقه بقليل هما منتجان مختلفان.

• رتّب البادئة حسب الثبات. التعليمات، ثم مخططات الأدوات، ثم المدونة، ثم النص. أي شيء يتغير بين الاستدعاءات ينبغي وضعه في النهاية، حيث يكلف مطابقة بادئة بدلاً من الذاكرة المؤقتة بأكملها.

• امسح 1,024 من رموز الإدخال المرئية قبل توقع وجود ذاكرة تخزين مؤقت. تحت هذا الحد الأدنى، لا يتم تخزين أي شيء مؤقتًا، ولا تُحتسب رموز المزوّد المخفية ضمنه.

• تحقّق من أن إعادة الاستخدام أمر معقول. يجب إعادة استخدام البادئة خلال مدة صلاحية التخزين المؤقت البالغة 30 دقيقة، ويجب أن تستقر على الجهاز الذي يحتفظ بالإدخال؛ كلاهما موصوف في الدليل، ولا يُعدّ أيٌّ منهما خاصية من خواص شفرتك البرمجية.

• أعِد القياس بعد أي تغيير في النموذج أو الإعدادات. الانتقال إلى GPT-6.1 Sol يزيل وضع إيقاف الاستدلال، ما يغيّر عدد رموز الاستدلال وبالتالي جانب الإخراج من الميزانية — كما أن تغيير جهد الاستدلال أو الأدوات أو مخطط الإخراج المهيكل أو إدارة السياق يمكن أن يحرّك حدود البادئة ويُكلّفك السعر المخزّن بالكامل.

• قرّر ما يحدث عندما لا تنكمش المهمة. الضغط هو المخرج الموثّق: يمكن لطلب Responses تعيين context_management بعتبة compact، ويستبدل الخادم محتوى المحادثة السابق بعنصر ضغط معتم يحمل الحالة الأساسية إلى الأمام في رموز أقل. إنه قرار ميزانية وليس تشذيبًا مجانيًا، لأن الدليل يذكر أن الضغط "يمكن أن يمنع إعادة الاستخدام بدءًا من أول رمز متغيّر فصاعدًا" — تمريرة الضغط تُبطل البادئة الواقعة خلفها.

A screenshot of the OrcaRouter model page at www.orcarouter.ai/models/openai/gpt-6-sol, captured October 7 2026, showing the OrcaRouter nav bar, the breadcrumb Home -> Models -> OpenAI, the model identifier openai/gpt-6-sol attributed to OpenAI with the date 2026-09-22, the Vision, Tools, JSON and Reasoning capability badges, the spec tiles reading Max output 128K, input text + image + file, output text and a p50 TTFT of 1.44 s, the description stating a 1.05M-token context, and the /v1/chat/completions rate row of $2.00 in and $10.00 out per 1M tokens.

تبدأ الحسابات في هذه الصفحة من الجيل الذي يحل GPT-6.1 Sol محله، وتلك الدرجة هي المتاحة للاستدعاء اليوم: تعرض بطاقتنا الخاصة بـ openai/gpt-6-sol نافذة سياق تبلغ 1,050,000 رمز مع حد أقصى للإخراج يبلغ 128,000 رمز بأسعار OpenAI المعلنة مع هامش ربح 0% — سعر المورّد هو السعر الظاهر على الصفحة، ويصل أي تغيير من المورّد إلى هناك في اليوم نفسه بدلاً من أن يصل عند التجديد. لا تحمل بطاقتنا حقلًا خاصًا بها للحد الأقصى للإدخال، لذا يجب أن يأتي رقم 922,000 رمز لذلك النموذج من وثائق المورّد نفسه، وهو ما اعتمدته هذه الصفحة في كل ما ورد فيها. تكمن فائدة البطاقة في تقدير الحجم: إن نافذة السياق وسقف الإخراج التي تنشرهما البطاقة بالفعل هما الرقمان اللذان يطرحهما إجراء الميزانية أعلاه أحدهما من الآخر، والدرجة الأدنى هي التي يمكنك فعليًا تطبيق ذلك الإجراء عليها بينما لا يزال 6.1 جديدًا. وهي متاحة على https://www.orcarouter.ai/models/openai/gpt-6-sol.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا