بطاقة عنوان مُولّدة بعنوان رئيسي "GPT-6 Astra Ultrafast يعمل على Blackwell"، وعنوان فرعي "NVIDIA تسمّي العتاد الذي يقف خلف 8x"، وثلاث بطاقات مكتوب عليها "العتاد: وحدات معالجة رسومات Blackwell"، و"مضاعف السعر: 6.00x من المعدل القياسي" و"السرعة المعلنة: تصل إلى 8x"، مع تذييل مكتوب فيه "منشور NVIDIA، 1 أكتوبر 2026 - أرقام معلنة من المورّد".
Guides & Insights

GPT-6 Astra Ultrafast يعمل على Blackwell: NVIDIA تسمي العتاد الذي يقف خلف الأداء المضاعف 8 مرات

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

في 1 أكتوبر 2026، نشرت NVIDIA منشورًا لـ ديون هاريس بعنوان "كيف تساعد وحدات معالجة الرسومات NVIDIA في تسريع GPT-6 Astra Ultrafast من OpenAI"، والجملة الموجودة في مركزه هي المرة الأولى التي تقول فيها أي من الشركتين ما يعمل عليه هذا المستوى: "GPT-6 Astra Ultrafast، الذي يعمل على وحدات معالجة الرسومات NVIDIA Blackwell، متاح الآن في OpenAI API وللمستخدمين المؤهلين في ChatGPT Work وCodex." هذا هو الخبر، وهو أضيق مما يوحي به العنوان. تم إصدار نموذج GPT-6 Astra في 3 سبتمبر 2026. أصبح مستوى الخدمة Ultrafast فوقه متاحًا على نطاق واسع في 29 سبتمبر 2026. كان ادعاء السرعة — أسرع بما يصل إلى 8 أضعاف في توليد الرموز من وضع Astra القياسي — قديمًا بالفعل بيومين عندما كررته NVIDIA.

وهذا يطرح السؤال الذي يجيب عنه المنشور حقًا: ليس «ما مدى سرعته؟» بل «لمن هذا السيليكون؟»

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Our fastest API service tier, with up to 8x faster speeds than Standard mode.', the sentence 'It is broadly available for GPT-6 Astra, with preview access for GPT-5.6 Sol.', the note that Ultrafast for GPT-6 Astra is currently available to all API users at low rate limits with higher limits or Sol preview access requestable through an OpenAI account team, the recommendation to use WebSockets because without a persistent connection network overhead can reduce the latency gains, and a Python code sample setting service_tier to 'ultrafast' with model 'gpt-6-astra'.

ثلاثة أشياء أضافها المنشور فعلاً

جرّد البيان المُعاد صياغته، وستجد أن منشور 1 أكتوبر يسهم بثلاث حقائق.

• العتاد — Blackwell. توثيق OpenAI نفسه لفئة Ultrafast، المنشور في 30 سبتمبر، يصف سرعة هذه الفئة وإعداداتها وحدود معدلها، ولا يذكر أي وحدة معالجة رسومات على الإطلاق. لذا فإن نسبتها إلى شريحة معيّنة يستند إلى مصدر وحيد هو مورّد العتاد. وهذا لا يجعلها زائفة؛ بل يجعلها ادعاءً من مورّد عن معداته الخاصة، ويستحق أن يُصنَّف على هذا النحو.

• مهندسان مذكوران بالاسم — فيليب تيليه، مسؤول الاستدلال في OpenAI، وأوداي روداراجو، المدير التنفيذي للتكنولوجيا للحوسبة في OpenAI، وقد نُقلت عنهما تصريحات علنية حول مصدر التسريع.

• الجمهور — «مستخدمو ChatGPT Work وCodex المؤهلون»، وهو أوسع من التأطير القائم على API فقط الذي أُطلقت به هذه الطبقة. لا تزال وثائق OpenAI نفسها تقول إن Ultrafast الخاص بـ GPT-6 Astra «متاح لجميع مستخدمي API عند حدود معدل منخفضة»، ولم يُلغَ هذا التحذير بشأن الحدود المنخفضة على نحو رسمي.

الاقتباسان، ولماذا هما الجزء المثير للاهتمام

مساهمة تيليت هي حلقة وليست معيارًا مرجعيًا. يقول إن استثمار NVIDIA في الأدوات والوثائق «مكّننا من جعل نماذجنا بارعة استثنائيًا في البرمجة»، وبعد ذلك تستطيع Astra أن «تحوّل تلك المعرفة إلى نوى عالية الأداء تجعل عتاد NVIDIA جذابًا». أما روداراجو فهو أكثر صراحة بشأن اتجاه العمل: «استخدمنا نماذجنا الداخلية لتحسين الاستدلال على وحدات GPU من NVIDIA».

إذا قُرِئا معًا، فإن هذا ادعاء يتعلق بالنشر أكثر من تعلقه بالقدرة: نماذج OpenAI المتقدمة أصبحت الآن بارعة بما يكفي في كتابة نوى GPU لدرجة أن OpenAI تستخدمها لتحسين مكدس الخدمة الخاص بها. وهو متسق أيضًا مع القسم الوحيد في منشور NVIDIA الذي لا يتعلق بأسبوع الإطلاق على الإطلاق — عنوان نصه "تحسين الأداء باستمرار"، ويحتج بأن الاستدلال المنشور يصبح أسرع بمرور الوقت لأن OpenAI تواصل توجيه نماذجها الخاصة نحو برمجيات NVIDIA التي تعمل عليها.

لا شيء من هذا يُعدّ قياسًا. إنهما مهندسان يصفان عملية، نشرتها الشركة التي باعت وحدات GPUs. والقراءة الأمينة هي أن العملية معقولة، ويسهل تصديقها، ولا يمكن تكذيبها من الخارج — وهو ما ينطبق أيضًا على كل رقم سرعة في هذه القصة.

Blackwell هنا، وCerebras هناك

أكثر ما يفيد في هذا المنشور هو كشفه عن انقسام لم يفسّره أحد. في 13 أغسطس 2026، قدّمت OpenAI معاينة لفئة سريعة على نموذج مختلف — GPT-5.6 Sol يعمل أسرع «بما يصل إلى 14×» — وسمّت Cerebras كالشريك وراء ذلك، واصفةً عتادًا بحجم الرقاقة يولّد ما يصل إلى 750 توكن إخراج في الثانية. وبعد سبعة أسابيع، أصبحت الفئة السريعة على Astra تعمل على Blackwell، والرقم هو 8x.

مستويان سريعان، وإجابتان على مستوى العتاد، إحداهما من شريك متخصص والأخرى من أكبر مورّد للشركة نفسها. لم ينشر أي من المورّدين مقارنة بين مساري التقديم هذين، ولم يقس أي مُقيّم مستقل أياً منهما. لاحظ أيضاً ما يفعله منشور NVIDIA بالاسم الثاني: يظهر "Rubin" مرة واحدة، داخل اقتباس Tillet حول نماذج تكتب أنوية لـ "وحدات معالجة الرسومات Blackwell و Rubin". إنه تصريح عمّا تستطيع نماذج OpenAI برمجته، وليس تصريحاً بأن أي شيء يُقدّم على Rubin اليوم.

الرقم الذي لم تنشره NVIDIA

هناك رقم في هذه القصة لا تملكه أي من الشركتين بجانب الـ8x، وهو الرقم الذي يحدد ما إذا كان الفريق سيبدّل الفئة. بطاقة أسعار Ultrafast المنشورة من OpenAIgpt-6-astra عند $60.00 لكل مليون رمز إدخال، و$6.00 للإدخال المخزّن مؤقتًا، و$75.00 لكتابة التخزين المؤقت، و$300.00 للإخراج. النموذج نفسه بالسعر القياسي هو $10.00 و$50.00، مع الإدخال المخزّن مؤقتًا عند $1.00 وكتابة التخزين المؤقت عند $12.50. كل عمود يساوي بالضبط ستة أضعاف السعر القياسي.

• المضاعف — 6.00x على الإدخال، والإخراج، والإدخال المخزّن مؤقتًا، وكتابة ذاكرة التخزين المؤقت. ليس "حتى". ستة.

• الحد الأقصى — 8x، الرقم الذي يستشهد به كلا الموردين مرفقًا بعبارة «حتى» ودون شروط معلنة.

• ماذا يعني ذلك — يقع مضاعف السعر أدنى من أفضل حالة تدّعيه هذه الفئة نفسها. عند الحد الأقصى تكون الصفقة مواتية؛ وعند أي مستوى أقل من 6x على حركة المرور الخاصة بك، فأنت تدفع أكثر لكل وحدة من الوقت الموفَّر مما يوحي به التسويق. ولهذا فإن الاختبار الوحيد ذا المعنى لهذه الفئة هو قياس على طلباتك الخاصة.

• خطوة السياق الطويل — عند تجاوز 272,000 رمز إدخال، تصبح أسعار Ultrafast 120.00 دولارًا للإدخال و450.00 دولارًا للإخراج، أي ستة أضعاف الأسعار المتدرجة الخاصة بالفئة القياسية نفسها.

• التفاصيل التنفيذية الدقيقة — توثّق OpenAI سلّمًا فائق السرعة للرموز في الدقيقة يبلغ 500,000 لمستويات الاستخدام من 1 إلى 3، و1,000,000 للمستوى 4، و5,000,000 للمستوى 5؛ ويدعم Ultrafast إقامة البيانات في الولايات المتحدة والمعالجة العالمية فقط، دون نقطة نهاية للمعالجة الإقليمية في الاتحاد الأوروبي أو أي منطقة أخرى خارج الولايات المتحدة؛ وتوصي الوثائق باستخدام WebSockets مع Ultrafast "لا سيما للتطبيقات الوكيلية التي تُجري العديد من استدعاءات الأدوات بتتابع سريع"، محذّرة من أنه "بدون اتصال دائم، قد يقلل الحمل الشبكي الإضافي من مكاسب زمن الاستجابة."

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing the gpt-6-astra row at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens for short-context requests, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, alongside gpt-5.6-sol at $4.00 / $0.40 / $5.00 / $20.00 short-context and $8.00 / $0.80 / $10.00 long-context, with the page's notes that regional processing endpoints carry a 10% uplift for models released on or after March 5, 2026, that FedRAMP endpoints carry a further 10%, that Priority processing was renamed Fast mode on July 30, 2026, and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

تلك النقطة الأخيرة هي التي ينبغي التصرف بناءً عليها. إن فريقًا يفعّل الطبقة ويترك HTTP لكل طلب تحتها قد دفع ستة أضعاف المعدل ليعيد جزءًا من التسريع إلى إعداد الاتصال — طريقة موثّقة ويمكن تجنّبها لإهدار المال.

كيف يبدو هذا من نقطة نهاية واحدة

GPT-6 Astra متاح على OrcaRouter باسم openai/gpt-6-astra: نافذة سياق تبلغ 1,050,000 توكن، وحتى 128,000 توكن إخراج، ومدخلات نصية وصور وملفات، وسعر قائمة OpenAI يُمرَّر مباشرةً بواقع 10.00 دولارات للمدخلات و50.00 دولارًا للمخرجات لكل مليون توكن، ويرتفع إلى 20.00 دولارًا و75.00 دولارًا فوق 272,000 توكن مدخل. ونتيجة المعيار الرئيسية في كتالوجه هي 96.1 على GPQA Diamond.

مستوى Ultrafast ليس على OrcaRouter، ولا يمكن أن يكون كذلك: فهو سمة خاضعة للتحكم في الوصول ضمن حساب OpenAI وليس معرّف طراز، ولهذا openai/gpt-6-astra-ultrafast يعيد model-not-found. إذا فعّلت المستوى، فإنه يوجد في تكاملك المباشر مع OpenAI. وما يمنحك إياه نقطة نهاية تدعم أكثر من 200 طراز مع هامش ربح 0% في هذه الحالة ليس المسار السريع — بل هو التحكم. لأن سعر القائمة لدى المزوّد يُمرَّر كما هو بدلًا من إضافة هامش ربح عليه، فإن تغيير OpenAI لأسعاره يصل إلى جانبنا في اليوم نفسه الذي يصل فيه إلى جانبهم، ولأن مسار Astra القياسي موجود بالفعل، فإن التجربة التي تحسم هذا القرار هي سطر واحد من الإعدادات: نفس المطالبة، والمستوى القياسي، وطراز أرخص بجانبه، على المفتاح نفسه. وهذا أقرب شيء إلى اختبار أداء زمن الاستجابة الذي ستجريه معظم الفرق على الإطلاق، ولا يكلف شيئًا لإعداده.

A screenshot of the OrcaRouter model page for GPT-6 Astra, model id openai/gpt-6-astra, showing a 1,050,000-token context window, 128k maximum output, text, image and file input, public benchmarks attributed to OpenAI dated 2026-09-04, input price $10.00 and output price $50.00 per 1M tokens, p50 time to first token 4.69 s, a 10.00 s figure and 155.1M tokens of traffic, with an OpenAI-compatible Python code sample and the EN language toggle in the header.

ما الذي لم يتم قياسه بعد؟

ثلاثة أمور قابلة للتحقق اليوم. الفئة موجودة، وهي مدرجة في بطاقة الأسعار بما يعادل ستة أضعاف السعر القياسي بالضبط، واعتبارًا من 1 أكتوبر/تشرين الأول تُنسب علنًا إلى NVIDIA Blackwell GPUs.

هناك أمر واحد ليس صحيحًا: مضاعف حركة المرور لديك. لم ينشر أي مورّد توزيعًا لزمن الاستجابة للفئة عند مستوى تزامن معلن، ولم يُعِد أي طرف ثالث إنتاج مضاعف 8x. كذلك لا يوجد اختبار أداء يقارن Astra على Ultrafast بـ Astra عند الإعداد القياسي، ولا ينبغي أن يوجد اختبار مُجامِل — فهي نقطة التحقق نفسها على مسار أسرع، لذا ينبغي أن تُنتج الإعدادات المتطابقة إجابات متطابقة عند سرعات مختلفة. إذا تباعد مساراك على المطالبات نفسها، فأنت أمام تقرير خلل، لا ميزة.

إذن، الخلاصة المفيدة للأول من أكتوبر أصغر مما يوحي به نص الإعلان. إنها الفئة نفسها بالسعر نفسه، وبسقف السرعة غير المُتحقَّق منه نفسه، لكنها الآن تحمل وسمًا عتاديًا. هذا الوسم مهم — فهو يخبرك على أي خط من المسرّعات تُوسّع OpenAI هذا، ويخبرك أن قصة الفئة السريعة انتقلت من شريك متخصص إلى أكبر مورّد لوحدات معالجة الرسومات في الصناعة خلال أقل من شهرين. غير أنه لا يخبرك بشيء عن ميزانية الكمون الخاصة بك، ولن يفعل ذلك أي منشور.