بطاقة عنوان مُولّدة بعنوان رئيسي 'GPT-6 Astra Ultrafast مقابل MiMo v2.6 Pro Ultraspeed'، وعنوان فرعي 'المناورة نفسها، صفقتان مختلفتان'، وبطاقتان تقولان 'مضاعف السعر: 6x مقابل 10x' و'ادعاء السرعة: 8x مقابل 20x'، مع تذييل يقول 'أرقام مبلّغ عنها من المورّد، سبتمبر–أكتوبر 2026'.
Guides & Insights

GPT-6 Astra Ultrafast مقابل Xiaomi MiMo v2.6 Pro Ultraspeed: المناورة نفسها، صفقتان مختلفتان

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

أجرى مختبران نفس المناورة في نفس الأسبوعين، والجزء المثير للاهتمام هو أنهما أجراها بناءً على افتراضات متعارضة حول ما يشتريه العميل. GPT-6 Astra Ultrafast هو المنتج الرائد للبائع الذي يُباع عبر طبقة خدمة Ultrafast — الطراز الذي صدر في 3 سبتمبر 2026، والطبقة متاحة على نطاق واسع منذ 29 سبتمبر 2026، وذُكر في منشور NVIDIA بتاريخ 1 أكتوبر أنه يعمل على وحدات معالجة رسومات Blackwell. Xiaomi MiMo v2.6 Pro Ultraspeed هو إصدار Xiaomi، الذي صدر في 22 سبتمبر 2026: نفس نقطة التحقق ذات 1.02 تريليون معامل مثل MiMo-V2.6-Pro، ولكن يُقدَّم بشكل أسرع، بسرعة تعادل عشرة أضعاف السرعة القياسية تقريبًا.

أحدهما أسرع طريقة لاستدعاء نموذج متقدم. والآخر أرخص فئة سريعة موجودة. إنهما ليسا منافسين بالمعنى العادي — سيتعين عليك كتابة تطبيق غريب جدًا لتختار بين نموذج مغلق رائد بتكلفة 300 دولار لكل مليون رمز ونموذج مفتوح الأوزان بتكلفة 8.70 دولار لكل مليون رمز. ما يجعل هذه المقارنة الثنائية تستحق مقالة هو أن كليهما فئتان سريعتان وليسا نموذجين، لذا فإن مقارنتهما تعزل السؤال الوحيد الذي تطرحه فئة السرعة: ما الذي تدفع مقابل هذا المضاعف بالضبط؟

كلا المستويين يبيعان نفس اللاشيء

لا يُعدّ أيٌّ من الاسمين نقطة تحقّق. هذا هو الجزء الذي تغالب تغطية الإطلاق أن تَطمسه، لذا يجدر التعامل معه بمنهجية آلية.

• إلى ماذا يشير الاسم — إن GPT-6 Astra Ultrafast هو GPT-6 Astra مع حقل الطلب service_tier: "ultrafast" المضبوط؛ ولا يزال معرّف النموذج في الطلب هو gpt-6-astra. Xiaomi MiMo v2.6 Pro Ultraspeed هو نقطة حفظ MiMo-V2.6-Pro المقدَّمة عبر مسار أسرع، ويُسعَّر كبند مستقل.

• ما الذي يتغيّر — التجميع، والفكّ التخميني، وتخصيص العتاد، وحدود التزامن، ومعالجة الاتصالات. كل ما يقع بين الأوزان وطلب HTTP الخاص بك، ولا شيء داخل الأوزان.

• ما لا يتغيّر — الإجابات. يجب أن تنتج نقطة التحقق نفسها، عند الإعدادات نفسها، المحتوى نفسه بمعدل مختلف. إذا تباعد مساران لنفس النموذج عند إدخال مطابق، فذلك عيب يجب الإبلاغ عنه، وليس قدرة اشتريتها.

• لماذا يهم ذلك في هذه المقارنة — لأنه بما أن أيًا من الفئتين لا تدّعي تحسينًا في معايير الأداء مقارنة بفئتها القياسية، فإن قرار الشراء بأكمله يتلخص في السعر لكل رمز مقابل الثواني الموفرة. وهذا يعني أن الصفقتين تُحسمان بالحساب لا بالتقييم.

ثمة عدم تماثل واحد في طريقة التأطير، مع ذلك، وهو ليس في المستويات. إذ تستند UltraSpeed من شاومي إلى نموذج مرخّص علنًا — فأوزان MiMo-V2.6 تحمل رخصة MIT، وفق بطاقات النماذج الخاصة بشاومي، وقد أُطلقت العائلة مع بيئة تدريبها بالتعلم المعزز. أما Ultrafast من OpenAI فتستند إلى نموذج رائد مغلق لا يمكن الوصول إليه إلا عبر API. ودفع مضاعف سرعة مقابل أوزان مفتوحة قرار قابل للعكس؛ يمكنك دائمًا تشغيل نقطة الحفظ بنفسك. أما دفعه مقابل نموذج رائد مغلق فليس كذلك.

A screenshot of the XiaomiMiMo/MiMo-V2.6-Pro-RL model card on Hugging Face, showing 64 likes, the TextGeneration, Transformers, Safetensors, English, Chinese, conversational, custom_code, 8-bit precision and fp8 tags, an MIT licence tag, a Safetensors model size of 524B params and the model card's opening description of MiMo-V2.6-Pro-RL as the flagship checkpoint of the MiMo-V2.6 series, covering native omnimodal input and 1M-token context.

المضاعفان السعريان، وما الذي يشتريانه

هنا يتوقف هذا الزوج عن كونه متماثلًا، والأرقام نظيفة بشكل غير معتاد على كلا الجانبين لأن كل مورّد حدّد سعرًا كمضاعف لا كقيمة مطلقة.

• GPT-6 Astra Ultrafast — $60.00 لكل مليون توكن إدخال، $6.00 للإدخال المخزن مؤقتًا، $75.00 لكتابة الذاكرة المؤقتة و $300.00 للإخراج، مقابل $10.00 و $50.00 للفئة القياسية. بشكل موحد 6.00x عبر كل الأعمدة، لتصل إلى $120.00 و $450.00 فوق 272,000 توكن إدخال. الفئة القياسية متاحة في كتالوجنا بسعر OpenAI المعلن، وهو أرخص طريقة للوصول إلى الطراز الرائد.

• Xiaomi MiMo v2.6 Pro Ultraspeed — 4.35 دولار للإدخال و8.70 دولار للإخراج لكل مليون رمز، مقابل مسار Pro القياسي عند 0.44 دولار و0.87 دولار. وهذا يعادل تقريبًا 9.9x في الإدخال و10x بالضبط في الإخراج.

• ادّعاءات السرعة المرتبطة بتلك المضاعفات — تضع كل من OpenAI وNVIDIA سقفًا لـ Astra Ultrafast عند توليد رموز أسرع "بما يصل إلى 8 أضعاف" مقارنةً بالوضع القياسي Astra. وتزعم مواد Xiaomi الخاصة سرعة إخراج تصل إلى 20 ضعفًا مقارنةً بخدمة Pro القياسية؛ بينما تقول قوائم كتالوجات صادرة عن أطراف ثالثة تصف الطراز نفسه في اليوم نفسه إنها نحو 10 أضعاف. ولم يُنشر أي قياس يوفّق بين هذين الرقمين.

• نسبة المضاعف إلى السرعة — سعر OpenAI البالغ 6 أضعاف يشتري سقفًا مزعومًا يبلغ 8 أضعاف، لذا فإن هذه الفئة مسعّرة دون أفضل حالة لها. اعتمادًا على الرقم الذي تصدّقه، فإن سعر Xiaomi البالغ 10 أضعاف يشتري سقفًا مزعومًا يتراوح بين 10 أضعاف و20 ضعفًا، لذا عند سقف البائع تكون الصفقة مواتية، وعند الرقم الأقل تكون تعادلًا تامًا.

هذا هو الفرق الوحيد الأكثر صلةً بالقرار بين الاثنين، وهو أضيق مما توحي به الأسعار المعلنة. مقابل كل وحدة من زمن الاستجابة المُزال وفقًا لما تدّعيه الشركتان نفساهما، تُعدّ Astra Ultrafast الصفقة الأفضل بين الاثنتين. مقابل كل رمز (token) من العمل، يكون Xiaomi UltraSpeed أرخص بنحو أربعة عشر ضعفًا في المدخلات وأربعة وثلاثين ضعفًا في المخرجات مقارنةً بأسعار Ultrafast، وأرخص بما يتراوح بين ضعفين وستة أضعاف من المسار القياسي لدى Astra — لكنه نموذج مختلف، وأقل قدرةً بكثير، وهذه هي المقايضة التي تقوم بها فعليًا. تنشر بطاقات النماذج الخاصة بـ Xiaomi لهذه العائلة حقائق تتعلق بالبنية والتدريب بدلًا من درجة إجمالية مستقلة، ولم تُنشر لها على الإطلاق أي قراءة من المؤشر الذي يُقاس عليه الطراز الرائد لدى OpenAI.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing the gpt-6-astra row at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens for short-context requests, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, alongside gpt-5.6-sol at $4.00 / $0.40 / $5.00 / $20.00 short-context and $8.00 / $0.80 / $10.00 long-context, with the page's notes on the 10% regional-processing uplift and on GPT-5.6 Sol's promotional pricing running at least through November 21, 2026.

ما اختار المورّدان الإفصاح عنه

مستويات السرعة هي اختبار إفصاح أكثر منها اختبار أداء، لأن ما ستحتاجه للتحقق من الادعاء — توزيع زمن الاستجابة عند مستوى تزامن معلَن — يقع بالكامل في يد المورّد.

يُعد منشور NVIDIA بتاريخ 1 أكتوبر البيان العام الأكثر تحديدًا وراء طبقة Astra، وما يقدمه هو الإسناد وليس القياس: وحدات معالجة الرسومات Blackwell، والتوافر في OpenAI API وللمستخدمين المؤهلين من ChatGPT Work وCodex، ومهندسان من OpenAI يصفان الحلقة. يقول فيليب تيليت، مسؤول الاستدلال في OpenAI، إن Astra يمكنها "تحويل تلك المعرفة إلى نوى عالية الأداء تجعل أجهزة NVIDIA جذابة"؛ ويقول أوداي روداراجو، الرئيس التنفيذي للتكنولوجيا للحوسبة في OpenAI، "استخدمنا نماذجنا الداخلية لتحسين الاستدلال على وحدات معالجة الرسومات NVIDIA." لا تأتي أي من الجملتين برقم للإنتاجية لهذه الطبقة. الرقم 8x قائم بذاته، ولا يخضع لأي تحفظ يتجاوز "تصل إلى".

اتخذ إفصاح Xiaomi الاتجاه المعاكس — فقد نشر اقتصاديات التدريب، بما في ذلك بيئة التعلّم المعزّز والشيفرة، وبطاقات نموذجه تحمل حقائق معمارية بدلًا من حقائق الخدمة. وجاءت فئة UltraSpeed نفسها بادعاء مضاعفة السرعة 20 مرة ومن دون منحنى زمن استجابة منشور. ما يعني أنه في ما يتعلق بالسؤال الذي توجد فئة السرعة للإجابة عنه، فإن كلا المزوّدين غير مفيدين بالقدر نفسه، والتعادل هناك هو الاستنتاج الصادق.

الاختيار، إن كان عليك حقًا

لا تتداخل الفئتان كثيرًا، لذا فإن القرار لا يتعلق باختيار الفائز بقدر ما يتعلق بمعرفة أي من الشراءين هو شراؤك.

اختر Astra Ultrafast إذا كان العمل وكيليًا وكان اختيار النموذج قد حُسم بالفعل. مهمة يبلغ إخراجها 40,000 رمز ترتفع من 2.00 دولار إلى 12.00 دولارًا، وهذه الفئة هي الطريقة الوحيدة للحصول على جودة نموذج رائد بسرعة أكبر. توثيق OpenAI نفسه صريح بشأن الشرط التشغيلي المسبق: فهو يوصي باستخدام WebSockets «خاصةً للتطبيقات الوكيلية التي تجري العديد من استدعاءات الأدوات بتعاقب سريع»، محذرًا من أنه «بدون اتصال دائم، قد تؤدي أعباء الشبكة إلى تقليل مكاسب زمن الاستجابة». فعّل الفئة واترك HTTP لكل طلب تحتها، وستكون قد دفعت 6 أضعاف مقابل جزء ضئيل من التسريع. ومن الجدير أيضًا معرفته قبل أن تدمجه: تدعم الفئة إقامة البيانات في الولايات المتحدة والمعالجة العالمية فقط، دون وجود نقاط معالجة إقليمية في الاتحاد الأوروبي أو أي منطقة أخرى خارج الولايات المتحدة، وقد أُطلقت بحدود معدل أولية منخفضة حتى بالنسبة للحسابات التي كانت ستتأهل لحدود أعلى.

اختر MiMo v2.6 Pro Ultraspeed إذا كان النموذج مدخلًا سلعيًا لخط أنابيب يمكنك استضافته بنفسك. تعني رخصة MIT أن مسار Pro القياسي ليس خيارك الاحتياطي الوحيد — فالاستضافة الذاتية خيار احتياطي كذلك. عند $4.35 و$8.70، إنه رخيص بما يكفي بحيث يستحق تمكين طبقة أسرع على سبيل الاستكشاف بدل تبريرها لكل مهمة، كما أن سياقه البالغ 1M رمز يطابق سياق الطراز الرائد. لكن افهم ما الذي تشتريه: معدل أعلى بنحو عشر مرات مقابل نموذج يتخلف عن الطليعة، وهي المقايضة الصحيحة للاستخراج عالي الحجم والخاطئة لأي شيء تكون فيه جودة الإجابة بوابة لسير العمل.

لا توجد أي من الفئتين السريعتين على OrcaRouter، ويجدر التصريح بذلك بدلًا من الإيماء إليه من بعيد. أما ما يوجد على OrcaRouter فهو openai/gpt-6-astra — الرائد في الفئة القياسية، بسعر 10.00 دولار و50.00 دولار لكل مليون رمز، مع تسعير درجة السياق الطويل عند 20.00 دولار و75.00 دولار، وسياق يبلغ 1,050,000 رمز وحد أقصى للإخراج يبلغ 128,000 رمز، عبر نقطة نهاية متوافقة مع OpenAI. لا يُستضاف أي نموذج من Xiaomi هنا على الإطلاق، لذا فإن MiMo-V2.6-Pro ومسار UltraSpeed الخاص به لا يمكن الوصول إليهما إلا عبر واجهة برمجة تطبيقات Xiaomi نفسها وعدة منصات طرف ثالث. الاستخدام العملي لـ نقطة نهاية تضم أكثر من 200 نموذج في هذه المقارنة ليس الوصول إلى الفئات السريعة. بل هو أنه عندما تريد معرفة ما إذا كان المسار المكلف يستحق مضاعف سعره، يمكنك إرسال المطالبة نفسها إلى نموذج أرخص باستخدام بيانات الاعتماد نفسها والمفتاح نفسه، في الطلب التالي، وتعرف الجواب. تلك هي أرخص تجربة متاحة، وهي التي تجيب عن السؤال — لأنه لم ينشر أي مورّد منحنى زمن الاستجابة الذي يتيح لك الإجابة عنه دون قياس.

A screenshot of the OrcaRouter model page for GPT-6 Astra, model id openai/gpt-6-astra, showing a 1,050,000-token context window, 128k maximum output, text, image and file input, public benchmarks attributed to OpenAI dated 2026-09-04, input price $10.00 and output price $50.00 per 1M tokens, p50 time to first token 4.69 s, a 10.00 s figure and 155.1M tokens of traffic, with an OpenAI-compatible Python code sample and the EN language toggle in the header.

القراءة الصادقة

في الأسابيع الثلاثة الماضية، أصدر كلا المورّدين قائمة أسعار لزمن الاستجابة، ولم يُصدر أيٌّ منهما قياسًا. هذا التماثل هو القصة، وله نتيجة عملية: الأرقام الوحيدة التي يمكنك التصرف بناءً عليها اليوم هي الأسعار، وهي مفيدة على نحو غير معتاد لأنّ الطرفين سعّرا مضاعفًا واضحًا بدلًا من رقم مخصص.

تكلّف الفئة السريعة من OpenAI ستة أضعاف سعرها القياسي الخاص، وتزعم سقفًا يبلغ ثمانية. وتكلّف فئة شاومي عشرة أضعاف سعرها القياسي الخاص، وتزعم سقفًا يتراوح بين عشرة وعشرين، حسب أي رقم تصدّقه. وإذا قُرِئا كعملية حسابية على أرقام البائعين أنفسهم، فإن الاثنين قريبان من التعادل: فئة OpenAI تشتري سقفًا مزعومًا بقيمة 1.33 وحدة من السرعة لكل وحدة من السعر، وفئة شاومي تشتري ما بين 1.0 و2.0 وفق الحساب نفسه — والسبب في أنه يمكن تبرير كليهما هو أن الفئتين تبيعان لمشترين مختلفين لن يفكروا بجدية أبدًا في خيار الآخر. كما أن الأسعار هي الجزء الوحيد القابل للتدقيق اليوم في أي من الصفقتين، لأن بطاقة الأسعار حقيقة منشورة، أما ادعاء الكمون فليس كذلك.