بطاقة عنوان مُنشأة بعنوان 'Step 5 Preview مقابل GPT-6 Astra — عشرة أضعاف السعر' بعمودين: Step 5 Preview عند AA Index 44، إجمالي 600B / نشط 27B، السعر $1.00 / $2.70، السعر المدمج $0.51 و99.8 توكن/ثانية؛ GPT-6 Astra عند AA Index 53، السعر $10.00 / $50.00، السعر المدمج $7.70 و59.3 توكن/ثانية. وفي التذييل: 'كلا الرقمين وفق Artificial Analysis Intelligence Index؛ يرتفع سعر Astra إلى $20 / $75 فوق 272K من توكنات الإدخال.'
Guides & Insights

Step 5 Preview مقابل GPT-6 Astra: عشرة أضعاف سعر الإدخال مقابل تسع نقاط مؤشر

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

أُعلن عن هذين الطرازين بفارق سبعة عشر يومًا، وتم تسعيرهما لكوكبين مختلفين. Step 5 Preview، النموذج المتناثر القائم على خليط الخبراء من StepFun بعدد معلمات 600 مليار والذي أُعلن في 20 سبتمبر 2026، يتقاضى 1.00 دولار لكل مليون رمز إدخال و2.70 دولار لكل مليون رمز إخراج. GPT-6 Astra، الطراز الرائد للمورّد الذي صدر في 3 سبتمبر 2026، يتقاضى 10.00 دولارات و50.00 دولارًا للوحدتين نفسيهما تحت عتبة إدخال تبلغ 272 ألف رمز — و20.00 دولارًا و75.00 دولارًا فوقها. هذا عشرة أضعاف سعر الإدخال، ونحو ثمانية عشر ضعفًا لسعر الإخراج، مقابل نموذج يسجل أعلى بتسع نقاط في مؤشر الذكاء المستقل، 53 مقابل 44. كون Astra أفضل ليس محل شك. أما ما إذا كانت الفجوة تستحق ثلاثين دولارًا إضافية لكل مليون رمز إخراج في عبء عملك، فهو محل شك، والجواب يتغير مرتين خلال هذه المقالة.

ما الغرض من كل نموذج

تم بناء Step 5 Preview وبيعه للعمل الوكيلي: البرمجة بالذكاء الاصطناعي، هندسة البرمجيات، العمل المعرفي المهني، التمويل. وقد ضُبطت البنية لذلك — 600 مليار معامل إجمالي مع حوالي 27 مليار معامل نشط لكل رمز، وسياق يبلغ مليون رمز، وإدخال نصي وصوري، واستدلال مع تفكير موسّع. وقد تخطت StepFun سلسلة Step 4.x بالكامل للوصول إلى هنا، منتقلة مباشرة من Step-3.7-Flash إلى Step 5.

GPT-6 Astra هو الطراز الرائد متعدد الأغراض من OpenAI: سياق يبلغ مليون توكن، ومخرجات تصل إلى 128 ألف توكن، ومدخلات من النصوص والصور والملفات، ومخرجات نصية، وتاريخ قطع المعرفة في 30 أبريل 2026، ودعم للاستدلال والبرمجة وسير العمل الوكيلي. إنه النموذج الذي تلجأ إليه المؤسسات عندما يجب أن تكون الإجابة صحيحة ولا تكون فاتورة التوكنات هي القيد الحاسم.

• {{1}}مؤشر الذكاء — معاينة الخطوة 5{{/1}} {{2}}44 مقابل{{/2}} {{3}}GPT-6 Astra 53{{/3}}

• المعاملات — Step 5 Preview: إجمالي 600 مليار / 27 مليار نشط مقابل GPT-6 Astra غير معلن

• السياق وسقف الإخراج — كلاهما بسياق يبلغ مليون توكن؛ تذكر Astra نافذة تبلغ 1,050,000 توكن وسقف إخراج يبلغ 128K، ولم تنشر StepFun أي سقف للإخراج

• نمط الإدخال — النص والصور مقابل النص والصور والملفات

• سرعة الإخراج — Step 5 Preview 99.8 توكن/ثانية مقابل GPT-6 Astra 59.3 توكن/ثانية

• السعر لكل مليون توكن — $1.00 للمدخلات / $2.70 للمخرجات مقابل $10.00 للمدخلات / $50.00 للمخرجات لما يقل عن 272 ألف مدخل، ويرتفع إلى $20.00 / $75.00 لما يزيد عن ذلك

• الذاكرة المؤقتة — Step 5 Preview بخصم 95% مقابل GPT-6 Astra بخصم 90% على القراءة مع سعر كتابة في الذاكرة المؤقتة قدره 12.50 دولارًا لكل مليون

• التكلفة لكل مهمة في Intelligence Index — Step 5 Preview ‏0.71 دولار مقابل GPT-6 Astra ‏3.26 دولار

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GPT-6 Astra — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71 and output speed 99.8 tokens/sec. The right column gives GPT-6 Astra the rows AA Index 53, parameters undisclosed, price $10.00 / $50.00, cache discount 90%, cost per index task $3.26 and output speed 59.3 tokens/sec. A footer reads 'Both figures per Artificial Analysis Intelligence Index; Astra pricing rises to $20 / $75 above 272K input tokens.'

الفاتورة، سطراً بسطر

تسعير Step 5 Preview ثابت ورخيص: 1.00 دولار للإدخال، و2.70 دولار للإخراج، مع خصم بنسبة 95% على الذاكرة المؤقتة، ما يضع الإدخال المخزّن مؤقتًا قرب 0.05 دولار لكل مليون توكن. عند مزيج من إصابة الذاكرة المؤقتة والإدخال والإخراج بنسبة 7:2:1 — وهو التقليد الذي تستخدمه هذه المدونة لحركة الوكلاء — يستقر السعر المدمج قرب 0.51 دولار لكل مليون توكن، وتأتي التكلفة لكل مهمة في Intelligence Index عند 0.71 دولار، في المرتبة 27 من 200. المأخذ هو الإسهاب: فقد أنتج النموذج 160 مليون توكن إخراج على ذلك المؤشر مقابل وسيط قدره 92 مليونًا، لذا تتجاوز أعداد التوكنات الخام ما يوحي به سعر التذكرة.

تسعير GPT-6 Astra متدرّج، والشريحة هي الجزء الجدير بالقراءة المتأنية. دون 272K رمز إدخال لكل طلب يكون السعران $10.00 و$50.00؛ وفوق ذلك، $20.00 و$75.00. تُحدَّد الشريحة حسب عدد رموز الإدخال الخاصة بكل طلب، وهو أمر يهم أكثر مما يبدو لنموذج يُباع بسياق 1M رمز — فنداء واحد بسياق كبير يتجاوز الحد ويضاعف السعر للطلب بأكمله. قراءات الذاكرة المؤقتة هي $1.00 لكل مليون، بخصم 90%، وكتابات الذاكرة المؤقتة هي $12.50 لكل مليون. وعند المزيج نفسه 7:2:1 يستقر السعر المدمج قرب $7.70 لكل مليون رمز، وتكلفة كل مهمة Index هي $3.26، في المرتبة 71 من 200.

تسير Astra في الاتجاه المعاكس فيما يتعلق بالإسهاب، وهي النموذج المقتضب هنا: 60 مليون رمز مُخرَج على Index مقابل 160 مليون لـ Step 5 Preview، والمرتبة 27 من 200 في ذلك المقياس. عدد الرموز الأقل بمعدل أعلى يضيّق الفجوة بطريقة يبالغ فيها المضاعف الخام. لكنه لا يسدّها — فرقم التكلفة لكل مهمة يستبعد بالفعل الإسهاب وسلوك التخزين المؤقت والتسعير معًا، و3.26 دولار مقابل 0.71 دولار لا يزال فرقًا بمقدار 4.6 أضعاف.

ما الذي تشتريه نقاط المؤشر التسع؟

أرقام أسترا الرئيسية هي أرقام OpenAI نفسها ولم يُعَد إنتاجها: 96.1 على GPQA Diamond، و72.6% على OSWorld 2.0، و97.6% على FrontierMath Tier 4، و57.2% على Humanity's Last Exam مع الأدوات، ونحو 57.9% على Terminal-Bench 4.0. أما رقم ARC-AGI-3 فهو الذي يجب التعامل معه بحذر — إذ تذكر OpenAI 99.9% ضمن أداة اختبار موائم المزوّد الخاصة بها، و62.7% على أداة الاختبار القياسية، والفارق البالغ 37 نقطة بين أداتي الاختبار هو تصريح عن أداة الاختبار بقدر ما هو عن النموذج على الأقل.

تقع الأرقام المنشورة لـ Step 5 Preview في النطاق نفسه ضمن المهام الوكيلية التي بُني من أجلها، وتحمل التحفظ نفسه: 33.3% على Terminal-Bench 4.0، و80.5 على ProgramBench، و67.7 على DeepSWE v1.1، و49.0 على StepCodeBench، جميعها من StepFun ولم يُعَد إنتاج أي منها بشكل مستقل. مورّدون مختلفون، وأُطر تقييم مختلفة، ولا تشغيل مشترك — وهذا بالتحديد هو السبب في أن الفجوة البالغة تسع نقاط والمقيسة بشكل مستقل هي الرقم الأكثر فائدة من أي من هذه.

تلك الفجوة حقيقية وليست صغيرة. عبر لوحة تضم 200 نموذج، يحتل 53 و44 المركزين الثالث والرابع والعشرين، ويظهر الفارق كفئة مختلفة من المهام بدلًا من كونه اختلافًا في الدرجة على المهمة نفسها: تتركّز انتصارات Astra المنشورة على الاستدلال طويل الأفق واستخدام الحاسوب، وهو الموضع الذي تنفصل فيه قمة اللوحة عن البقية. إذا كان عبء عملك يقع هناك، فإن النقاط التسع تستحق أكثر من الفاتورة.

تحفّظ واحد بشأن نتيجة Astra. تعيد Artificial Analysis مراجعة Intelligence Index، وتتباين أرقام النموذج نفسه بين لقطات مأخوذة بفارق أسابيع — إذ تظهر 52.8 و53 و54.7 جميعها في مواد منشورة عن هذا النموذج خلال الشهر نفسه. أما الرقم 53 الوارد في صفحة النموذج الحالية فهو الرقم الذي ينبغي استخدامه، وأي مقارنة تضع لقطة أقدم من Astra إلى جانب رقم حالي من Step 5 Preview إنما تقيس بمسطرتين مختلفتين.

Screenshot of the Artificial Analysis model page for GPT-6 Astra, showing OpenAI as the creator with a September 2026 release date, an Intelligence Index of 53 at rank 3 of 200, output speed 59.3 tokens per second at rank 101 of 200, cost per Intelligence Index task $3.26 at rank 71 of 200, verbosity 60M output tokens at rank 27 of 200, pricing of $10.00 per million input tokens and $50.00 per million output tokens with a 90% cache discount, and technical specifications listing reasoning, text and image input, a 1M-token context window and an April 30, 2026 knowledge cutoff.

السرعة وزمن الاستجابة مسألتان مختلفتان

فيما يتعلق بسرعة التوليد، فإن اللوحة المستقلة واضحة لا لبس فيها: 99.8 رمز إخراج في الثانية لـ Step 5 Preview مقابل 59.3 لـ GPT-6 Astra، وهو أيضًا أبطأ من متوسط 70 رمزًا في الثانية عبر النماذج المقاسة. في حلقة برمجة تفاعلية، هذا هو الفرق بين اقتراح وتوقف، وهو يتراكم عبر الجلسة كما يفعل خصم ذاكرة التخزين المؤقت.

الكمون هو القصة الأكثر تعقيدًا، ورقم واحد يضلّل بشأنه. يُوجّه Astra الاستدلال قبل أن يُصدره، لذا فإن زمن الوصول إلى أول رمز وزمن الوصول إلى إجابة قابلة للاستخدام ليسا القياس نفسه، والأرقام المنشورة عنه تتباين على نطاق واسع بحسب ما إذا كان الاستدلال محتسبًا أم لا. على مستوى حركتنا خلال الأيام السبعة الماضية، يبلغ الوسيط الزمني للوصول إلى أول رمز لدى GPT-6 Astra 6.72 ثانية مع مئين مئوي 95 عند 10.00 ثوانٍ — وهو الرقم الذي يختبره المتصل فعليًا عبر نقطة الوصول لدينا. وتضع Artificial Analysis زمن الوصول إلى أول رمز لدى Step 5 Preview عند 2.96 ثانية على منصة اختبارها الخاصة، وهذان الرقمان ليسا مقيسين بالطريقة نفسها، لذا لا ينبغي طرح أحدهما من الآخر.

أين يقع عدم التماثل في الذاكرة المؤقتة فعليًا

كلا النموذجين يمنح خصمًا كبيرًا على البادئات المتكررة، وكلاهما يتقاضى رسومًا لكتابتها، والفرق بينهما يبلغ 20 ضعفًا عند القراءة. خصم الذاكرة المؤقتة بنسبة 95% لدى Step 5 Preview يجعل الإدخال المخزّن مؤقتًا قريبًا من 0.05 دولار لكل مليون رمز. يقرأ GPT-6 Astra من الذاكرة المؤقتة بسعر 1.00 دولار لكل مليون — أي خصم بنسبة 90% عن سعر أساس أعلى بعشر مرات — ويكتب فيها بسعر 12.50 دولارًا لكل مليون.

بالنسبة لحلقة وكيل تعيد إرسال التوجيه النظامي نفسه وسياق المستودع في كل دور، فإن معدل القراءة هو ما يتراكم، والخصم الأعمق على النموذج الأرخص أعلى قيمة من الخصم الأضحل على النموذج الأغلى. لا يزال مزيج Astra يبلغ نحو 7.70 دولارات لكل مليون رمز مقابل 0.51 دولارًا لـ Step 5 Preview عند المزيج نفسه 7:2:1 — وهو فرق يبلغ خمسة عشر ضعفًا لا تسدّه جلسة طويلة بل توسّعه.

تشغيل كلاهما من مفتاح واحد

GPT-6 Astra متاح الآن على OrcaRouter تحت openai/gpt-6-astra بأسعار OpenAI المعلنة — 10.00 دولارات و50.00 دولارًا لكل مليون دون عتبة 272K، و20.00 دولارًا و75.00 دولارًا فوقها — تُمرَّر دون أي هامش ربح، لذا يصبح تغيير سعر المورّد ساريًا من جانبنا في اليوم نفسه بدلًا من دورة الفوترة التالية. تُظهر بيانات القياس الخاصة بنا لمدة سبعة أيام على تلك النقطة الطرفية وسيطًا قدره 6.72 ثانية، وزمنًا للوصول إلى أول رمز عند المئين 95 يبلغ 10.00 ثانية المذكور أعلاه، إلى جانب 277.9 مليون رمز من حركة المرور عبره في الأسبوع الماضي.

Step 5 Preview ليس في كتالوجنا ولا نوجّهه. يعمل على واجهة API واستوديو StepFun الخاصة، وهو المكان الوحيد الذي يعمل فيه حتى تصل نقطة التحقق في 15 أكتوبر. عدم التماثل هذا ليس عيبًا في المقارنة؛ بل هو المقارنة نفسها. النصف الرخيص من هذه المواجهة هو النصف الذي عليك أن تذهب إلى مكان آخر لاستدعائه، والنصف الذي يمكنك إدخاله إلى الإنتاج اليوم يقع خلف واجهة API واحدة لأكثر من 200 نموذج: GPT-6 Astra بالأسعار المذكورة أعلاه، وGLM-5.3 بسعر 1.26 دولارًا و3.96 دولارًا، وDeepSeek V4 Pro، وClaude Opus 5 والباقي، مع تحويل تلقائي عند الفشل عبر المزوّدين يُبقي المسار ثابتًا عندما تتغير سعة أحد المزوّدين، وDSL التوجيه الذي يتيح لمهمة أن تبدأ بتكلفة منخفضة ولا تتصاعد إلا عند الضرورة. قاعدة التصعيد هذه هي الجواب الحقيقي لفجوة سعرية تبلغ عشرة أضعاف: معظم عبء العمل لا يحتاج إلى أعلى الفئة، وطبقة التوجيه هي وسيلتك للتوقف عن الدفع مقابل الجزء الذي لا يحتاج إلى ذلك.

Screenshot of the OrcaRouter model page for GPT-6 Astra at www.orcarouter.ai/models/openai/gpt-6-astra, showing the model id openai/gpt-6-astra with NEW, FLAGSHIP and FEATURED badges, a 1M-token context and 128K max output, text, image and file input with text output, best-for tags for reasoning, coding and agentic work, input pricing of $10.00 and output pricing of $50.00 per million tokens, a seven-day median time to first token of 6.72 seconds and a 95th percentile of 10.00 seconds, 277.9M tokens of seven-day traffic, and the chat-completions and responses endpoints behind the OrcaRouter API.

من الذي يجب أن يختار ماذا

إذا كان عبء عملك وكيلاً طويل الأفق يتعيّن عليه إنجاز مهمة صعبة إنجازاً صحيحاً — استخدام الحاسوب، أو بحث متعدد الخطوات، أو عمل تكون فيه تكلفة الإجابة الخاطئة أكبر من تكلفة الرموز — فإن تقدّم GPT-6 Astra بفارق تسع نقاط هو أرخص جزء في القرار، والفاتورة هي ثمن هذه القدرة. شغّله كهدف تصعيد، لا كخيار افتراضي، وراقب عتبة 272K: طلب واحد متضخّم الحجم يضاعف التعرفة لكل ما يتضمنه.

إذا كان عبء العمل لديك نصًا وكيليًا ضخم الحجم — توليد الشيفرة، وإعادة الهيكلة، والاستخلاص المهيكل، والحلقة الداخلية لمساعد برمجة — فإن Step 5 Preview متقدم في كل ما تهتم به الفاتورة والساعة، ومن غير المرجح أن تصمد تسع نقاط مؤشر عند ملامسة توزيع مهام لا يقع في قمة لوحة الصدارة. العثرة ليست في الأداء: النموذج مملوك، بلا ترخيص منشور، ولا منح للاستخدام التجاري، ولا نقطة تفتيش حتى 15 أكتوبر. يمكنك استدعاؤه؛ لكن لا يمكنك امتلاكه أو ضبطه الدقيق أو إصدار نسخة مشتقة منه.

إذا لم تكن الإجابة واضحة، فالنمط هو تقسيم طبقي لا اختيار. وجّه حركة المرور العامة إلى نموذج من الطبقة المتوسطة، واحتفظ بـ Astra للطلبات التي تحتاج إلى قمة التصنيف — وطرفا هذه القاعدة يقعان خلف مفتاح واحد من جانبنا، لذا لا يكلّف هذا التقسيم سوى قاعدة توجيه واحدة بدلًا من عقد ثانٍ. إن دفع أسعار الطراز الرائد مقابل عمل ينجزه نموذج من الطبقة المتوسطة على نحو صحيح هو الخطأ الذي تدور حوله هذه المقارنة في واقع الأمر.