بطاقة عنوان مُولَّدة بعنوان «Ultrafast vs Sol» مع عنوان فرعي «نقطة تحقق واحدة، بطاقتا أسعار، ثلاثة أحمال عمل» وثلاث شرائح نصّها «وكيل تفاعلي: انتقال»، و«مسح ليلي: بقاء»، و«ملخِّص دفعي: بقاء»، وفوق تذييل نصّه «الأسعار هي أسعار OpenAI المعلَنة لكل مليون رمز، سياق قصير، أكتوبر 2026».
Engineering & Research

GPT-6.1 Ultrafast مقابل GPT-6.1 Sol: ثلاث مهام، وحكم واحد لكل منها

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

اسأل ما إذا كان GPT-6.1 Ultrafast يستحق ستة أضعاف سعر GPT-6.1 Sol والجواب الصادق هو أن اثنتين من أعباء العمل الثلاثة لديك ينبغي أن تبقيا في مكانهما تمامًا. وكيل البرمجة التفاعلي ينبغي أن ينتقل. أما جولة التقييم الليلية فلا، وكذلك مُلخِّص الدفعات، والسبب ليس أن الطبقة مبالغ في سعرها — بل أنهم لم يشتروا قط الشيء الذي تبيعه. صدر GPT-6.1 Sol في 29 سبتمبر 2026، ووصل Ultrafast كوضع فوقه في 8 أكتوبر 2026: النقطة المرجعية نفسها، ونافذة السياق نفسها البالغة 1,050,000 رمز، وسقف المخرجات نفسه البالغ 128,000 رمز، وتاريخ قطع المعرفة نفسه في 30 أبريل 2026، والإجابات نفسها، مقابل 12.00 دولارًا لكل مليون رمز إدخال و60.00 دولارًا لكل مليون رمز إخراج، في مقابل 2.00 و10.00 دولارًا. طبقة السرعة هي شراء للزمن الفعلي، والزمن الفعلي لا يستحق المال إلا في مهمة ينتظرها أحدهم.

إعادة التأطير هذه هي المقالة كلها. والباقي هو الحساب الذي يخبرك أيّ من وظائفك هو النوع الذي يتطلب الانتظار، والتكلفتان اللتان تأتيان إلى جانب المُضاعِف سواء خططت لهما أم لم تخطط.

ما الذي يختلف فعليًا: حقل طلب واحد وفاتورة واحدة

لا توجد نقطة تحقق Ultrafast، ولا حد سياق منفصل، ولا تاريخ قطع معرفة بديل، ولا شيء يمكن تثبيته. أنت ترسل معرّف النموذج نفسه مع ضبط حقل طبقة الخدمة، فتقوم OpenAI بجدولة الطلب بطريقة مختلفة؛ أرسله بدون الحقل وستكون على Standard. كل ما يبرمج المطوّر بناءً عليه متطابق، ويستحق أن نتعامل مع القائمة بشكل آلي، لأن طول القائمة هو الحجة.

• معرّف النموذج — المعرّف نفسه على كليهما، لقطة افتراضية واحدة، ولا شيء مؤرّخ لتثبيته.

• السياق — نافذة بحجم 1,050,000 رمز، وبحدّ أقصى للإدخال 922,000 رمز و128,000 رمز للإخراج على كليهما.

• سلّم الاستدلال — low وmedium (افتراضي) وhigh وxhigh وmax على كليهما، مع عدم دعم none وminimal على كليهما.

• سطح الأدوات — البحث في الويب، البحث في الملفات، توليد الصور، مفسّر الشيفرة، صدفة مُستضافة، تطبيق التصحيح، المهارات، استخدام الحاسوب، MCP والبحث في الأدوات، عبر Responses API، على كليهما.

• السعر — ‏$2.00 للإدخال / ‏$0.10 للمخزَّن مؤقتًا / ‏$2.50 لكتابة الذاكرة المؤقتة / ‏$10.00 للإخراج لكل مليون رمز على Standard، مقابل ‏$12.00 / ‏$0.60 / ‏$15.00 / ‏$60.00 على Ultrafast.

• عند تجاوز 272,000 رمز إدخال — يُعاد تسعير الطلب بالكامل بمعدل ضعف أسعار الإدخال والتخزين المؤقت و1.5 ضعف أسعار الإخراج لكليهما، ما يجعل Ultrafast long-context عند $24.00 / $1.20 / $30.00 / $90.00.

• السرعة — يُعد Standard خط الأساس بحكم التعريف؛ وUltrafast هو المستوى الأعلى، والمضاعف الوحيد الخاص بنموذج معيّن الذي تنشره O​penAI يخص G​PT-6 Astra، وليس هذا النموذج.

هذا السطر الأخير هو التحذير الذي يسري تحت كل شيء آخر، وله قسم خاص به في الأسفل. أولًا، الوظائف.

المهمة الأولى: الوكيل التفاعلي. هذا هو الذي يتحرّك

حلقة وكيل تُجري أربعين استدعاءً للأدوات على التوالي هي العميل الذي بُني هذا المستوى من أجله، لأن زمن توليد كل دور يحدد الدور التالي، والمستخدم يراقب. خذ جلسة ترسل 30,000 رمز إدخال وتتلقى 1,500 رمز إخراج لكل دور على مدى 40 دورًا — 1,200,000 رمز إدخال و60,000 رمز إخراج إجمالًا، وكل طلب أقل بكثير من عتبة إعادة التسعير البالغة 272,000 رمز.

• قياسي — 1.2 مليون توكن إدخال بسعر 2.00 دولار يكون 2.40 دولارًا؛ 60,000 توكن إخراج بسعر 10.00 دولار يكون 0.60 دولار. ثلاثة دولارات مقابل التشغيل.

• Ultrafast — تكلفة 1.2 مليون رمز إدخال بسعر 12.00 دولارًا هي 14.40 دولارًا؛ وتكلفة 60,000 رمز إخراج بسعر 60.00 دولارًا هي 3.60 دولارًا. ثمانية عشر دولارًا مقابل التشغيل.

• الفارق — 15.00 دولارًا لإزالة معظم زمن انتقال التوليد من مهمة تكون مخرجاتها متطابقة فيما عدا ذلك.

كون مبلغ 15.00 دولارًا رخيصًا هو سؤال عن الدقائق، لا عن الرموز. إذا استغرقت الجلسة عشرين دقيقة على Standard وأربع دقائق على Ultrafast، فأنت قد اشتريت ست عشرة دقيقة مقابل خمسة عشر دولارًا — نحو 0.94 دولار في الدقيقة — والمقارنة المهمة هي مع ما كلفتك إياه تلك الدقائق الست عشرة. قيمة المطوّر بمعدل التكلفة الكاملة تزيد على دولار في الدقيقة، لذا في حالة وجود الإنسان في الحلقة تكون الإجابة محسومة. الوكيل الذي ينتظر في قائمة انتظار المراجعة البشرية لا يساوي شيئًا في الدقيقة، وهناك تكون الدقائق الست عشرة نفسها دقائق مجانية، ويكون هذا المستوى هدرًا.

هذا هو الاختبار الذي يجب تطبيقه، ولا علاقة له بالطراز. على ساعة مَن يستند زمن التوليد، وما قيمة تلك الساعة؟ إذا كانت الإجابة "ساعة شخص، وبقيمة كبيرة"، فإن Ultrafast هو أرخص شيء في فاتورتك. وإذا كانت الإجابة "ساعة مُجدوِل، وبلا قيمة"، فهو الأغلى.

A generated cost card headed 'One run, four configurations', listing Batch at half of Standard for $1.50, standard GPT-6.1 Sol at $3.00, GPT-6.1 Ultrafast at $18.00 and Ultrafast above 272,000 input tokens at $24.00 input and $90.00 output per 1M, with a note that all four describe the same 40-turn agent of 1,200,000 input and 60,000 output tokens and a footer reading that prices are OpenAI list rates and the arithmetic is ours.

المهمة الثانية: جولة التقييم الليلية. هذا مرفوض.

تُجري عملية مسح تقييمية بضعة آلاف من المطالبات عبر النموذج، وتكتب النتائج في تخزين الكائنات، ويقرأ إنسان الجدول في الصباح. ميزانية زمن الاستجابة لديها ليست بالدقائق، بل بليلة كاملة. لا شيء في خط الأنابيب ينتظر النموذج سوى الطلب التالي في قائمة الانتظار.

Ultrafast لا يزيل التكلفة الزمنية الفعلية لعملية المسح، لأن التكلفة الزمنية الفعلية لعملية المسح هي قرار جدولة اتخذته أنت، وليست مشكلة زمن وصول لديك. ما يفعله هو ضرب الفاتورة في ستة ونقل المهمة إلى ميزانية لها حدود معدل خاصة بها لكل مؤسسة — وهو خطر حقيقي في تشغيل دفعي غير مراقب، لأن سقف حد المعدل هو بالضبط نمط الفشل الذي تصطدم به عملية مسح كبيرة، ولا تنشر صفحة الفئة الرقم.

وهناك مسار على بطاقة الأسعار نفسها مسعّر لهذه المهمة ومسعّر في الاتجاه المعاكس. تعمل Batch وFlex بنصف سعر Standard، وقد صُممت معالجة Batch في API تحديدًا لهذا الشكل: أحجام كبيرة، بلا موعد نهائي تفاعلي، وتُعاد النتائج بشكل غير متزامن. وفقًا للأرقام أعلاه، يكلّف إجمالي الرموز نفسه البالغ 40 دورة 1.50 دولار على Batch مقابل 18.00 دولارًا على Ultrafast. وهذا فارق بمقدار 12 ضعفًا لمهمة لا تستطيع التمييز بينهما.

الخطأ الذي ينبغي تجنّبه هو التعامل مع Ultrafast كترقية متعددة الأغراض. فهو قمة سلّم — Batch وFlex عند النصف، وStandard عند واحد، وFast عند اثنين، وUltrafast عند ستة — والسلّم ليس قائمة من إصدارات أفضل. اختيار الدرجة الخاطئة يكلّف مالًا أكثر من اختيار الطراز الخاطئ.

المهمة الثالثة: مُلخِّص الدفعات. وأيضًا لا، لسبب مختلف

لنفترض أن عبء العمل عبارة عن مرور ليلي على مخزن مستندات: مدخلات طويلة، ومخرجات قصيرة، ولا وجود لعنصر بشري في الحلقة، واتفاقية مستوى خدمة (SLA) تُقاس بالساعات. هنا ينقلب مزيج الرموز ضد Ultrafast بدلًا من أن يكون لصالحه.

عتبة 272,000 رمز هي السبب. على أي من المستويين، فإن طلبًا واحدًا يتجاوزها يعيد تسعير الطلب بأكمله — كل رمز إدخال، وكل قراءة مخزّنة مؤقتًا، وكل رمز إخراج — بضعف أسعار الإدخال والتخزين المؤقت و1.5 ضعف أسعار الإخراج. لذلك يبلغ سعر Ultrafast للسياق الطويل 24.00 دولارًا لكل مليون رمز إدخال و90.00 دولارًا لكل مليون رمز إخراج، ويُفعَّل إعادة التسعير بواسطة الطلب نفسه، لا بواسطة الجزء الذي يتجاوز الحد. أداة تلخيص المستندات التي ترسل أحيانًا طلبًا عند 300,000 رمز إدخال تدفع سعر السياق الطويل على كل 300,000 رمز منها.

يفاقم سلوك التخزين المؤقت الأمر. فالقراءات المخزّنة مؤقتًا هي أقل الرموز تكلفة على هذا النموذج وأكثر رافعة للتكلفة فعالية، وهي تتدرّج مع الفئة بدلًا من امتصاصها — 0.10 دولار لكل مليون إدخال مخزّن مؤقتًا على Standard، و0.60 دولار على Ultrafast، وكلاهما بنسبة 5% من سعر الإدخال غير المخزّن مؤقتًا. لا يوجد أي مزيج من الرموز المخزّنة مؤقتًا والجديدة يخفف من معامل المضاعفة، لذا فإن خط أنابيب مخزّنًا مؤقتًا ومحسّنًا بحدّة لا يحصل على خصم من المسار السريع. إنه يدفع فقط ستة أضعاف رقم أصغر.

بجمع الاثنين معًا، تكون حالة الملخِّص هي الحالة التي تكون فيها العلاوة السعرية لـ Ultrafast هي الأكبر بالقيمة المطلقة، بينما تكون فائدته هي الأصغر. وإذا كانت المستندات طويلة فعلًا وكان الموعد النهائي محسوبًا بالساعات فعلًا، فالإعداد الصحيح هو Batch أو Standard العادي، والاستخدام الصحيح لـ Ultrafast هو حلقة منتصف التطوير التي تُجري فيها تكرارات على المُوجِّه وينتظر شخص كل مراجعة.

التكلفتان اللتان تأتيان مع المضاعف

معدل ستة أضعاف هو الجزء المرئي من السعر. وهناك جزءان غير مرئيين يهمان أكثر في الإنتاج.

الأول هو ميزانية حد المعدل. يعمل Ultrafast بحدوده الخاصة به، منفصلة عن ميزانيتي Standard وFast، وتحددها OpenAI لكل مؤسسة بدلًا من نشرها في صفحة الفئة؛ والإرشاد هو التحقق من حدود مؤسستك قبل زيادة الحركة، والاتصال بفريق الحساب إذا احتاجت إلى رفعها. لذا فإن نقل حمل عمل إلى Ultrafast يفعل أمرين في آن واحد: يضاعف الفاتورة، وينقل حمل العمل إلى سقف قد لا تتمكن من قراءته. وبالنسبة لوكيل يعمل دون إشراف، يكون السقف هو القيد الأول.

الثاني هو شكل التوفير. يقلل Ultrafast الوقت بين الرموز، وليس الوقت حتى الرمز الأول، وليس مرحلة التفكير. الطلب الذي يقضي معظم وقته الفعلي في التفكير قبل أن يصدر أي شيء، يمكن تحويله إلى Ultrafast وسيظل يبدو بطيئًا، لأن الطبقة تسرّع الجزء من الطلب الذي لم يكن أبدًا عنق الزجاجة. هذا هو نمط الفشل الذي ينتج تقارير "دفعنا ستة أضعاف والسرعة هي نفسها": إنه يقيس تطبيقًا يقع زمن استجابته في مكان لا تصل إليه الطبقة. قبل الالتزام، قِس أين تذهب الثواني فعليًا — الوقت حتى الرمز الأول مقابل الوقت بين الرموز — لأن الطبقة تملك واحدًا فقط من هذين.

لماذا لا يُعد "أسرع" رقمًا يمكنك أن تحاسب O​penAI عليه بعد

يُباع Ultrafast على أساس "حتى 8x"، والقياس الكامن وراء تلك العبارة يخص نموذجًا مختلفًا. الجملة المنشورة تتعلق بـ GPT-6 Astra Ultrafast وهو يولّد الرموز أسرع بما يصل إلى 8x من GPT-6 Astra في الوضع القياسي في Codex. لا يوجد مضاعف منشور مكافئ لـ GPT-6.1 Sol، كما لم ينشر أي طرف مستقل رقمًا لعدد الرموز في الثانية لنسخة Sol أيضًا. ويصف توثيق هذه الفئة أنه يقلل الوقت بين رموز الإخراج المولَّدة، ويشير إلى بطاقة أسعار.

من المعقول افتراض أن المضاعف ينطبق — فكلا الطرازين يعملان على حزمة الخدمة نفسها، وآلية الطبقة نفسها — لكن عبارة «حتى» تؤدي دورًا حقيقيًا في تلك الجملة، وسقف المورّد المقيس على طراز شقيق في عميل مختلف ليس الرقم الذي سيراه حِمل عملك. وينطبق الأمر نفسه على المرتبة الأقدم: أُعلن عن Ultrafast على GPT-5.6 Sol في أغسطس 2026 بوصفه «أسرع بما يصل إلى 14 مرة من معالجة Standard» في معاينة محدودة، ولا تزال الوثائق تذكر الوصول في وضع المعاينة مع جدول أسعار Ultrafast الذي يحتوي على صفّين بالضبط.

ما يمكنك أن تحاسب OpenAI عليه هو السعر، لأن السعر منشور ويسري على كل توكن. وهذا يعني أن القرار الذي تتناوله هذه الصفحة هو قرار بشأن ميزانية زمن الوصول الخاصة بك، وليس بشأن ادعاء المورّد حول السرعة.

A generated decision card headed 'Which lane for which job' with three columns: 'Interactive agent' carrying the rows 'A person is waiting' and 'Ultrafast: yes', 'Overnight eval sweep' carrying 'Nobody is waiting' and 'Batch: half of Standard', and 'Long-document batch pass' carrying '272,000-token repricing line' and 'Standard: yes', footnoted to OpenAI's published per-million rates and tier documentation, October 2026.

اختباره دون الالتزام، والتبديل مرة أخرى

هذه الطبقة متاحة لجميع مستخدمي API، لذا فإن الطريقة الأقل تكلفة للإجابة عن سؤال الزمن الفعلي هي تشغيل مجموعة المطالبات نفسها مرتين، مرة مع تفعيل الحقل ومرة مع تعطيله، ثم مقارنة أعداد الرموز والتوقيتات. وهناك أمران يجب الانتباه إليهما في ذلك الاختبار: ما إذا كانت طلباتك تتجاوز حد 272,000 رمز، وما إذا كان زمن الوصول إلى أول رمز يطغى على الزمن بين الرموز. أي منهما قد يجعل التجربة تبدو كنتيجة صفرية بينما تكون الطبقة تعمل تمامًا كما هو معلن عنها.

العودة إلى المسار القياسي حقلٌ في الطلب، لا عملية ترحيل، والمسار القياسي يُقدَّم بسعر القائمة الخاص بالمزوّد نفسه عبر OrcaRouter بصيغة openai/gpt-6.1-sol — 2.00 دولار لكل مليون رمز إدخال و10.00 دولارات لكل مليون رمز إخراج، بهامش 0% ويُمرَّر سعر المزوّد كما هو مباشرةً، لذا يصبح أي تعديل سعري من المزوّد ساريًا لدينا في اليوم نفسه. أما Ultrafast نفسها فلسنا نبيعها؛ إنها علامة على مستوى الخدمة تُحتسب على حساب OpenAI الخاص بك، وقول ذلك أنفع من الإيحاء بخلافه. وما يشتريه المفتاح الواحد فعلًا هو المسار القياسي إضافةً إلى بقية الكتالوج خلف نقطة نهاية واحدة متوافقة مع OpenAI، والتبديل التلقائي بين المزوّدين عند الفشل، وهو أمر يستحق أن يكون لديك إذا كنت على وشك وضع طبقة مكلفة أمام وكيل إنتاجي وتريد أن يكون المسار القياسي قرار توجيه لا تغييرًا في الشيفرة.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the page's code sample and EN language toggle visible in the header.

ملاحظة عملية واحدة بشأن المسار السريع لا تنطبق على المسار الرخيص: WebSockets. توصي OpenAI باتصال WebSocket دائم من أجل Ultrafast، وهو الشكل المناسب لوكيل يُجري العديد من الاستدعاءات المتتابعة والشكل غير المناسب لنص برمجي دفعي يرسل طلبًا واحدًا لكل عملية. إذا كان عميلك من النوع الثاني، فإن وسيلة النقل الموصى بها من الطبقة نفسها سبب آخر يجعل المهمة الليلية تنتمي إلى مكان آخر.

عندما يتغير الحكم

ثلاثة تطورات ستُخرج المهام من قائمة «البقاء». إن نشر حد معدل Ultrafast الخاص بـ GPT-6.1 Sol سيزيل خطر السقف من حالة الدفعات. كما أن نشر قياس سرعة لفئة Sol أو إعادة إنتاجه بشكل مستقل سيتيح لك تقدير التوفير في الزمن الفعلي بدلًا من افتراضه. وستغيّر درجة خصم على المسار السريع — نظير Ultrafast لـ Batch، حيث تظل الفئة سريعة لكن ليس بستة أضعاف السعر — الجدوى الاقتصادية لكل مهمة في منتصف السلم.

لا شيء من ذلك موجود اليوم. ما هو موجود هو فئة تكون بالضبط كما تقول إنها عليه: نفس GPT-6.1 Sol، بجدولة مختلفة، وبستة أضعاف السعر على كل بند. انقل الوكيل التفاعلي، واترك الاثنين الآخرين على حالهما، وقس أين تذهب ثوانيك فعليًا قبل أن تقرر أيّهما فئتك.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا