بطاقة عنوان رئيسية مُولَّدة لـ 'GPT-5.6 Sol Ultrafast مقابل GPT-5.6 Sol' مع سطر علوي 'الوزنات نفسها. طبقة خدمة مختلفة.' وبطاقتين: اليسرى 'GPT-5.6 Sol Ultrafast' تسرد العتاد: رقائق Cerebras، السرعة: حتى 750 tok/s، السعر: لم يُنشر بعد؛ واليمنى 'GPT-5.6 Sol' تسرد العتاد: عناقيد GPU، السرعة: قياسية، السعر: $4.00 / $20.00؛ تذييل 'كلاهما يشغّل نقطة التفتيش ذاتها GPT-5.6 Sol.' شعار OrcaRouter في أسفل اليمين.
Guides & Insights

GPT-5.6 Sol Ultrafast مقابل GPT-5.6 Sol: نفس الأوزان، طبقة خدمة مختلفة

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

GPT-5.6 Sol Ultrafast ليس نموذجًا جديدًا، وهذه ليست قصة إطلاق. أعلن المورّد عن الوضع في 13 أغسطس 2026، وفي اليوم نفسه ظهرت القيمة ultrafast في مخطط OpenAPI العام للشركة، داخل وصف ServiceTierResponses في المواصفة — وهو الوصف الذي يحصر الطبقة، بحسب صياغته نفسها، في نقطة نهاية gpt-5.6-sol ويصنّفها كمقيّدة بالوصول. ما أعاد هذه الصفحة إلى قائمة انتظارنا أصغر وأكثر تحديدًا: في 25 سبتمبر 2026، وسّع الإيداع fe4f7a1 تلك القيمة إلى تعدادين إضافيين، وهما معامل طبقة الخدمة على مستوى الطلب وحقل سياسة طبقة خدمة الوكيل. بعد ستة أسابيع من الإعلان، لا تزال الطبقة على قائمة الانتظار، ولا يزال لا سعر منشور لها، وهي الآن موصولة بمساحة أكبر من واجهة API مما تستطيع خدمته فعليًا. GPT-5.6 Sol Ultrafast وGPT-5.6 Sol هما النموذج نفسه؛ الشيء الوحيد الذي يمكن لهذه المقارنة أن تحسمه هو من يتحكم في المؤشر ومن أخبرك بالتكلفة.

إذاً المواجهة الواردة في العنوان غير معتادة. إن GPT-5.6 Sol Ultrafast وGPT-5.6 Sol هما النموذج نفسه. الأوزان نفسها، ونقطة التحقق نفسها، وسلوك الاستدلال نفسه، ونافذة السياق نفسها البالغة 1.05 مليون توكن، والحد الأقصى نفسه للإخراج البالغ 128K، والإجابات نفسها. وصياغة OpenAI نفسها هي «عمل أكثر فائدة في الثانية»، وليس نموذجاً أذكى. الشيء الوحيد الذي يختلف بين عمودي هذه المقارنة هو كيفية إنتاج التوكنات وما يُسمى به المستوى في جسم طلبك — وهذا يجعله أنظف تجربة ضابطة في التشكيلة الحالية، وأيضاً الأصعب في التسوق، لأن أحد المستويين ليس له سعر منشور على الإطلاق.

ما الذي تغيّر فعليًا هذا الأسبوع؟

الدليل على تغيير سبتمبر هو إيداع (commit)، وليس منشور مدونة. تُدير OpenAI مستودع openai-openapi، وهو المستودع الذي ينشر المخطط القابل للقراءة آليًا لواجهة برمجة التطبيقات الخاصة بها، والإيداع fe4f7a1 — بتاريخ 2026-09-25 — يضيف ultrafast إلى تعدادين: سياسة طبقة الخدمة المرتبطة بالوكلاء، والحقل على مستوى الطلب الذي تصفه المواصفة بأنه «طبقة الخدمة المستخدمة لطلبات النموذج». هذا توسيع، وليس ظهورًا أول: قبل هذا الإيداع كانت هاتان القائمتان تضمّان auto وdefault وflex وpriority وfast، وكانت الطبقة موجودة بالفعل في المخطط منذ 13 أغسطس. يستحق هذا الإيداع الملاحظة بسبب الحقل الذي وصل إليه — حقل السياسة الذي يُهيأ به الوكيل، وهو سطح مختلف عن تجاوز لكل طلب.

الوصف المهم يعود تاريخه إلى إيداع 13 أغسطس، وليس هذا الإيداع، وهو أكثر بيان محدد نشرته OpenAI عن هذه الفئة في أي مكان. وإلى جانب القيمة الجديدة، تنص المواصفة على: "إذا تم الضبط على 'ultrafast'، فسيتم معالجة الطلب باستخدام فئة خدمة Ultrafast Processing الخاضعة لضبط الوصول. هذه الفئة متاحة حالياً لـ gpt-5.6-sol؛ والاستجابة التي تُقدَّم من خلالها ستُظهر service_tier=ultrafast."

اقرأ تلك الجملة مرتين، لأنها تحسم سؤالين لولا ذلك لاضطرت صفحة المقارنة هذه إلى التحوط بشأنهما. المستوى مخصص لنموذج واحد — نموذج GPT-5.6 Sol الرائد ولا شيء آخر في التشكيلة — وهو مقيّد بالوصول لا مفتوح، بما يطابق توصيف OpenAI لمعاينة بقائمة انتظار. كما يخبرك كيف ستعرف أنك حصلت عليه: تعكس الاستجابة المستوى الذي خدم الطلب فعلاً، لذا يكون الرجوع إلى المعالجة القياسية مرئيًا في جسم الاستجابة بدلًا من أن يكون شيئًا عليك استنتاجه من زمن الاستجابة. يظهر الوصف نفسه في كل من مخططي Responses القياسي وBeta Responses، وذلك منذ 13 أغسطس.

A screenshot of the GitHub commit page for openai/openai-openapi commit fe4f7a1 by openai-openapi-publisher[bot], titled "Add 'ultrafast' service tier option to improve request speed", showing the diff adding "ultrafast" to the enum lists after "fast" and a new x-enumDescription reading "Uses the ultrafast service tier."

وصلت إشارة ثانية أضعف في اليوم التالي. يصف تقرير بتاريخ 26 سبتمبر محدد سرعة جديد — Fast وStandard وUltrafast — قادمًا إلى Responses API Playground، مع توقّع توفر أوسع لـ Ultrafast بعد مؤتمر المطورين DevDay الخاص بـ OpenAI. لم نرَ المحدد بأنفسنا، ولم تنشر OpenAI ملاحظة طرح، لذا تعامل مع الأمر كتقرير من مصدر واحد لا كميزة تم شحنها. الأجزاء القابلة للتحقق اليوم هي الموضعان في المخطط العام وحقيقة أنه لم يظهر أي جدول أسعار لهذه الفئة.

ما الذي لم يتغير لا يقل أهمية. لا يزال سعر Ultrafast غير موجود. صفحة أسعار OpenAI، التي اطُّلِع عليها في 27 سبتمبر، تضم التبويبات الأربعة التي كانت لديها من قبل — Standard وBatch وFlex وFast — ولا تظهر السلسلة النصية "ultrafast" في أي مكان فيها. لا يزال الوصول موصوفًا بأنه معاينة محدودة لعملاء مختارين، تتوسع مع نمو السعة. المستوى موجود في العقد وخارج قائمة الأسعار في الوقت نفسه، وهذا هو وضعه الصادق.

الطبقتان، جنبًا إلى جنب

لأنه لا توجد أي قدرة تفصل بين هذين الاثنين، تنحصر المقارنة بالكامل تقريبًا في التقديم والفوترة. كل سطر أدناه يحمل الجانبين في صف واحد.

• النموذج — يشغّل GPT-5.6 Sol Ultrafast نقطة التحقق ذاتها الخاصة بـ GPT-5.6 Sol مقابل المعالجة القياسية لـ GPT-5.6 Sol، النقطة نفسها، بلا تقطير، وبلا تقليص للحجم.

• إنتاجية الإخراج — حتى 750 رمز إخراج في الثانية، أي ما يصل إلى 14 ضعف المعيار، وفقًا لإعلان OpenAI في 13 أغسطس، مقارنةً بمعالجة GPT-5.6 Sol القياسية على عناقيد وحدات معالجة الرسومات (GPU)، وهو الرقم الذي يُقاس عليه معدل 14 ضعفًا.

• العتاد — شرائح Cerebras واسعة النطاق على مستوى الرقاقة، مع بقاء الأوزان مقيمة في ذاكرة SRAM على الشريحة، وهو أول منتج لشراكة OpenAI الحوسبية في يناير 2026 مع Cerebras، والتي يُقال إن قيمتها نحو 10 مليارات دولار على مدى ثلاث سنوات، مقابل الاستدلال التقليدي بوحدات GPU، حيث يُستهلك جزء كبير من الوقت في نقل الأوزان بين الذاكرة والحوسبة.

• السعر — لم يُنشر اعتبارًا من 27 سبتمبر 2026، مقابل 4.00 دولارات للإدخال / 20.00 دولارًا للإخراج لكل مليون رمز، وهو سعر OpenAI الترويجي الحالي، بالإضافة إلى 0.40 دولار لكل مليون مقابل الإدخال المخزّن مؤقتًا.

• الإتاحة — معاينة محدودة بقائمة انتظار لعملاء مختارين مقابل المسار الافتراضي، القابل للاستدعاء من أي شخص لديه مفتاح API.

• الإجابات التي تحصل عليها — متطابقة، من حيث المبدأ، مقابل متطابقة، من حيث المبدأ؛ وإذا اختلفت عند نفس المُطالبة، فهذا اكتشاف، وليس ميزة.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs GPT-5.6 Sol — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Serving hardware Cerebras wafers, Output speed up to 750 tok/s, Speed vs standard up to 14x, Price not published, Access waitlisted preview. Right column 'GPT-5.6 Sol': Checkpoint same as Sol, Serving hardware GPU clusters, Output speed standard processing, Speed vs standard 1x baseline, Price $4.00 / $20.00, Access open to any API key. Footer sourcing line; OrcaRouter logo bottom-right.

ادّعاء السرعة، والسقف الموضوع عليه

الرقم الرئيسي هو 14× ويستحق العناية نفسها التي تحظى بها بقية هذه الصفحة. تذكر OpenAI أنها تصل إلى 750 رمز إخراج في الثانية مقارنةً بالمعالجة القياسية — رقم إنتاجية للإخراج بالرموز، وليس ادعاءً بأن كل طلب ينتهي أسرع بـ14 مرة. يشمل الزمن من البداية إلى النهاية أيضًا معالجة المدخلات واستدلال النموذج نفسه، ولا يضغط العتاد بحجم الرقاقة أيًّا منهما بالنسبة نفسها. ولهذا تصف الشركة 14× بأنه حد أقصى لا قياس.

المقارنات المنشورة هي بحسب المورّد على جانبي الجدول، وواحدة منها تمتد عبر مجموعتي تقنيات مورّدين. يُبلَّغ عن تشغيل Humanity's Last Exam المكوَّن من 2,500 سؤال بأنه انتهى في 11 ساعة و11 دقيقة على Ultrafast مقابل 78 ساعة و27 دقيقة لـ Claude Fable 5، بدقة مماثلة — أي أن OpenAI وCerebras يخبراننا عن اختبار معياري يتضمن نموذج منافس، وقد نقلت تغطية مستقلة للإطلاق مقارنة أضيق لسرعة التوليد بنحو 11× في التشغيل نفسه، بينما تشير أرقام Cerebras نفسها إلى نحو 7× لزمن الاختبار الإجمالي. الفجوة بين 14× و11× و7× ليست تناقضًا؛ بل هي ما يحدث عندما يقيس ثلاثة أطراف أجزاء مختلفة من عبء عمل واحد. وتُبلّغ Cerebras منفصلةً عن 5.6× من البداية إلى النهاية على GDP-Val دون خسارة جودة قابلة للقياس. ولم يُعِد أيٌّ من ذلك طرف ثالث.

قائمة الأسعار بها ثغرة.

هنا تتوقف الفئتان عن التماثل. لدى GPT-5.6 Sol أربع بطاقات أسعار منشورة، وUltrafast ليست واحدة منها.

• إصدار GPT-5.6 Sol القياسي — ‏$4.00 / $20.00 لكل مليون رمز، مع الإدخال المخزّن مؤقتًا بسعر $0.40 وفئة السياق الطويل بسعر $8.00 / $30.00 عندما يتجاوز الإدخال نحو 272 ألف رمز.

• الوضع السريع — 8.00 $ / 40.00 $، أي ضعف المعدل القياسي بالضبط. هذه هي الفئة التي أُعيد تسميتها من Priority processing في 30 يوليو 2026، وتقبل واجهة API كلاً من service_tier: "priority" أو service_tier: "fast". وهي توفّر سرعة إخراج تصل إلى نحو 2.5×.

• Batch وFlex — 2.00 دولار / 10.00 دولار، خصم ثابت بنسبة 50% من السعر القياسي مقابل جدولة أكثر مرونة.

• فائق السرعة — لا قائمة أسعار. ليس فراغًا ملأناه بتخمين؛ بل فراغًا تركه OpenAI.

صف Fast-mode ذاك هو المرجع السابق الحقيقي الوحيد الذي يمكن لأي أحد أن يسعّر Ultrafast مقارنةً به، وهو مرجع يبعث على التفكير الجدي لمن يخطط لوضع ميزانية: ففئة السرعة الوحيدة التي وضعت OpenAI عليها رقمًا فعليًا تكلّف ضعف السعر القياسي بالضبط مقابل سرعة تعادل مثلي السرعة ونصفها. وUltrafast ادعاء بسرعة أكبر يستند إلى عتاد أكثر ندرة — فسعة Cerebras لإنتاج الرقائق ليست سلعة متاحة بوفرة — لذا فإن اتجاه العلاوة السعرية النهائية ليس محل شك. أما مقدارها فمحل شك. وإلى أن تصدر قائمة أسعار، فإن أي رقم «GPT-5.6 Sol Ultrafast price» تراه منقولًا في أي مكان هو استنتاج شخص ما، بما في ذلك أي استنتاج لنا.

كيف ستسميه فعليًا؟

يخبرك تغيير المخطط بشكل الاستدعاء النهائي. وإذا كانت هذه الطبقة تتبع نمط الطبقات الأخرى، فإنها تصل كحقل إضافي في طلب تُرسله بالفعل: تُبقي على model gpt-5.6-sol، وتُبقي على prompt الخاص بك، وتضيف محدّد الطبقة — بالطريقة نفسها التي يُختار بها وضع Fast اليوم عبر استبدال priority بـ fast. لا يتغير أي شيء في تحليل استجابتك، لأنه لا يتغير أي شيء في النموذج. فهذا هو كل ما يجعل طبقة الخدمة جذابة مقارنةً بتبديل النموذج، وهو السبب وراء أن صفحة مقارنة كهذه لا تجد سوى القليل جدًا مما يمكن مقارنته.

ما لا يمكنك فعله اليوم هو استدعاؤه. قيمة التعداد موجودة؛ أما السعة التي تقف خلفها فغير موجودة، بالنسبة لمعظم الحسابات. لذا فالسؤال العملي في الأسابيع القليلة القادمة ليس أيّ المستويين تختار — بل ما الذي تشغّله بينما يكون الاختيار غير متاح.

هذا سؤال تجيب عليه بوابة أفضل من قائمة انتظار. الطبقة القياسية من النموذج متاحة الآن على OrcaRouter باسم openai/gpt-5.6-sol، وتُقدَّم بسعر المزوّد نفسه مع دون أي هامش ربح على الرموز، عبر نقطة النهاية المتوافقة مع OpenAI على api.orcarouter.ai/v1 — لذا تُمرَّر أسعار OpenAI الترويجية البالغة 4 دولارات / 20 دولارًا، وشريحة السياق الطويل البالغة 8 دولارات / 30 دولارًا، كما هي بدلًا من أن نعيد تسعيرها، وأي تغيير عليها يصل إلى جانبنا في اليوم نفسه الذي يصل فيه إلى OpenAI. المفتاح نفسه يحمل أكثر من 200 نموذج، وهو أمر يهم أكثر من المعتاد هنا: لأنك لا تستطيع ضبط service_tier: "ultrafast" والحصول على إجابة، فإن السبيل إلى شراء زمن استجابة أقل اليوم هو توجيه العمل بشكل مختلف — أرسل الاستدعاءات التفاعلية إلى أي نموذج في الكتالوج يجتاز معيار الجودة لديك بأسرع ما يمكن، وأبقِ الدفعات الليلية على أرخص مسار يجتاز المعيار. عندما تُفتح الطبقة فعلاً، يكون الراوتر هو المكان الذي تقلب فيه المفتاح، وحتى ذلك الحين، فهو الفرق بين قائمة انتظار وخطة.

A screenshot of OrcaRouter's own model page for OpenAI GPT-5.6 Sol at /models/openai/gpt-5.6-sol, showing the live catalogue entry with the openai/gpt-5.6-sol identifier, Vision, Tools, JSON and Reasoning capabilities, the byline 'by OpenAI - 2026-07-09', code samples, pricing, performance and public benchmark sections listed on-page.

أي واحد ينتمي إلى الإنتاج؟

تجاهل كلمة "versus" للحظة، لأنه لا يوجد قرار جودة يُتخذ هنا. إذا كنت تُحسّن التكلفة لكل توكن، فإن GPT-5.6 Sol القياسي هو الجواب، ومسار Batch بخصم 50% هو الجواب لأي شيء يمكنه الانتظار. وإذا كنت تُحسّن المدة التي يجلس فيها إنسان أمام مؤشر انتظار دوّار، فإن Ultrafast هو الجواب بمجرد أن تتمكن من الحصول عليه — والأعباء التي تسمّيها OpenAI للمعاينة تُظهر السبب بالضبط: الاستجابة للحوادث مع السجلات والفروقات مفتوحة أثناء انقطاع جارٍ، وفحوصات الاحتيال مقابل بيانات متغيّرة، ومحادثات الدعم حيث تُقرأ نصف ثانية من الصمت كمنتج معطّل، وحلقات بحث كانت تُشغّل طوال الليل وتُضغط الآن في جلسة عمل.

الفارق الحقيقي هو شكل مخطط طلباتك، لا حجم المطالبة لديك. توليد واحد طويل يحقق مكسبًا قدره 14× على الورق، وأقل من ذلك كثيرًا في الممارسة، لأن معالجة المدخلات والاستدلال لا ينضغطان بهذه النسبة. أما أربعون استدعاءً متتاليًا لأدوات خلف إجراء واحد ظاهر للمستخدم، فتحقق مكسبًا أقرب بكثير إلى المضاعف الكامل، لأن كل رحلة ذهاب وإياب من هذه الرحلات هي زمن انتقال يظل المستخدم ينتظره. إذا كان عبء عملك يشبه الحالة الثانية، فهذه الطبقة موجهة إليك؛ وإذا كان يشبه الحالة الأولى، فكان المسار القياسي سيكون جيدًا على الدوام.

أمران يستحقان المراقبة، وليس أي منهما شائعة يمكننا حسمها من هنا. أولاً، بطاقة الأسعار: مستوى مميز بلا سعر لا يمكن تخصيص ميزانية له، وسابقة Fast-mode تشير إلى أنه لن يكون صغيراً. الثاني، ما إذا كانت قائمة الانتظار ستُرفع فعلاً حول DevDay كما ورد — لأن قيمة service_tier التي لا تستطيع معظم الحسابات استخدامها هي توثيق، وليست إتاحة، والفرق بين الاثنين هو الفرق بين خطة ووعد.