بطاقة عنوان لمقارنة بين Step 5 Preview وGPT-5.6 Sol، تُظهر Step 5 Preview عند مؤشر الذكاء Artificial Analysis Intelligence Index بقيمة 44 وGPT-5.6 Sol عند 47، مقابل أسعار إخراج تبلغ 2.70 دولار و20.00 دولارًا لكل مليون رمز.
Guides & Insights

Step 5 Preview مقابل GPT-5.6 Sol: ثلاث نقاط مؤشر، وبسُبع سعر المخرجات

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

على مؤشر Artificial Analysis Intelligence Index الحالي، يحقق Step 5 Preview نتيجة 44. ويحقق GPT-5.6 Sol نتيجة 47. هذه هي الفجوة كاملة — ثلاث نقاط — وهي تقف فوق فارق في السعر المعلن قدره 2.70 دولار مقابل 20.00 دولار لكل مليون رمز إخراج. إن نموذج StepFun البالغ 600 مليار والمعتمد على خليط الخبراء المتناثر ونموذج الشركة الرائد ليسا من النوع نفسه من المنتجات، ولن يخبرك المؤشر وحده بأيّهما تختار. يتناول هذا المقال من أين تأتي النقاط الثلاث، ومن أين لا تأتي، وكم يكلف النموذجان فعليًا عند تشغيلهما.

أولاً، وضع الإصدار — لأنه غير معتاد

تم إصدار Step 5 Preview. ويجب قول ذلك بوضوح، لأن كثيرًا من التغطية التي دارت حوله كُتبت قبل اليوم وتصف شيئًا آخر. أعلنت StepFun عن النموذج وفتحته في 20 سبتمبر 2026، مع إتاحة واجهة API الخاصة بها وStudio في اليوم نفسه. وتؤرّخ Artificial Analysis النموذج الذي قيّمته في 18 سبتمبر. وما لم يكتمل فهو الأوزان: مستودع Hugging Face stepfun-ai/Step-5-Preview-BF16 موجود، لكنه قوقعة فارغة — لا بطاقة نموذج، ولا ملف تهيئة، ولا تنسورات. وقد قالت StepFun إن الأوزان الكاملة ستصدر في 15 أكتوبر 2026. لذا فالحالة الدقيقة في سطر واحد هي: واجهة API متاحة الآن، والأوزان موعودة بعد نحو أربعة أسابيع، وكلمة «Preview» في الاسم تصف قناة الإصدار لا مدى نضج النموذج.

إذا كنت قد قرأت أي شيء يصف Step 5 Preview بأنه تسريب غير معلن ظهر بهدوء على لوحة صدارة، فقد انتهت صلاحية ذلك الوصف. كان دقيقًا في منتصف سبتمبر. لكنه ليس دقيقًا اليوم.

ما هي معاينة الخطوة 5

أكدت StepFun شكل البنية: نموذج خليط خبراء متناثر يضم 600 مليار معلمة إجمالية و27 مليارًا نشطة لكل رمز، ونافذة سياق بسعة 1M رمز، وإدخال نص وصورة مع إخراج نصي، ودعم للاستدلال. رقم المعلمات النشطة هو الرقم المهم. إن ميزانية نشطة تبلغ 27B تضع Step 5 Preview في الفئة الحاسوبية نفسها لكل رمز مثل نماذج لا تمثل سوى جزء يسير من حجمها الإجمالي، وهذا بالضبط سبب ظهور أرقام معدل إنتاجيتها بهذه الطريقة.

التسعير على واجهة برمجة التطبيقات الخاصة بالمورّد هو $1.00 لكل مليون رمز إدخال، $2.70 لكل مليون إخراج، مع خصم 95% على الذاكرة المؤقتة على جانب الإدخال. تحسب Artificial Analysis معدلًا مختلطًا قدره $0.51 لكل مليون عند مزيج 7:2:1 من الذاكرة المؤقتة إلى الإدخال إلى الإخراج، وتكلفة لكل مهمة Intelligence Index قدرها $0.71.

ما هو GPT-5.6 Sol

دخل GPT-5.6 Sol المعاينة المحدودة في 26 يونيو 2026 أمام ما يقرب من عشرين شريكًا أمريكيًا، ووصل إلى التوفر العام في 9 يوليو 2026 عبر ChatGPT وCodex وOpenAI API. إنه مغلق بالمعنى الدقيق: لم تنشر OpenAI أي عدد للمعاملات، ولا وصف للبنية، ولا تفاصيل عن التدريب، والنموذج متاح فقط عبر API.

الحدود المنشورة هي نافذة سياق بحجم 1,050,000 رمز، وحد أقصى للإدخال يبلغ 922,000 رمز وحد أقصى للإخراج يبلغ 128,000 رمز — سقف إخراج صارم لا يعلن Step 5 Preview عن ما يعادله. reasoning.effort يقبل none، low، medium (الافتراضي)، high، xhigh وmax. هذا الإعداد ليس حاشية؛ كما تُظهر الأرقام أدناه، فإنه يغيّر كل رقم رئيسي.

سعر Sol على بطاقة الطراز الخاصة بـ OpenAI هو 4.00 دولارات لكل مليون رمز إدخال، و0.40 دولار للإدخال المخزّن مؤقتًا، و20.00 دولارًا لكل مليون رمز إخراج. هذا سعر ترويجي أُعلن في 21 أغسطس 2026 — خفض بنسبة 20% على الإدخال و33% على الإخراج — ولا تلتزم بطاقة OpenAI به إلا حتى 21 نوفمبر 2026. كان سعر الإطلاق في يوليو 5.00 / 30.00 دولارات مع 0.50 دولار للإدخال المخزّن مؤقتًا. على من يضع ميزانية على أساس 4/20 دولارات أن يعلم أن البائع لم يفصح عما سيحدث في 22 نوفمبر.

الأرقام، جنبًا إلى جنب

Intelligence Index — Step 5 Preview 44 (المرتبة 24 من 200) مقابل GPT-5.6 Sol 47 عند أقصى جهد، و44 عند xhigh. كلا الرقمين قياسان من Artificial Analysis ضمن النسخة الحالية من المؤشر، التي أُعيدت معايرتها في 7 سبتمبر 2026. وهما قابلان للمقارنة المباشرة أحدهما بالآخر، وليسا قابلين للمقارنة بأي شيء نُشر قبل ذلك التاريخ.

سعر الإدخال — 1.00 دولار لكل مليون مقابل 4.00 دولار لكل مليون.

سعر الإخراج — ‏$2.70 لكل مليون مقابل ‏$20.00 لكل مليون.

المدخلات المخزّنة مؤقتًا — خصم بنسبة 95% على 1.00 دولار مقابل 0.40 دولار ثابت لكل مليون.

Terminal-Bench 4.0 — 33.3% مقابل 39.9% عند max و25% عند xhigh، وقد قِيس كلاهما بواسطة Artificial Analysis على نفس أداة الاختبار. تقع نتيجة Step 5 Preview البالغة 33.3% بين إعدادَي الجهد لدى Sol. هذا هو الرقم الأكثر إثارة للاهتمام في المقارنة.

SciCode — 59% مقابل 57%، مجددًا وفقًا لـ Artificial Analysis، وقد قُيس Sol عند xhigh.

سرعة الإخراج — 99.8 رمز/ثانية (المرتبة 45 من 200) مقابل 61.5 رمز/ثانية (المرتبة 92 من 200) عند أقصى جهد.

زمن الوصول إلى أول رمز — 2.96 ثانية مقابل 129.50 ثانية عند max من الجهد، أو 38.70 ثانية عند xhigh.

A comparison scoreboard for Step 5 Preview and GPT-5.6 Sol covering Intelligence Index, output price, Terminal-Bench 4.0, output speed, time to first token, and weight availability.

فجوة زمن الاستجابة هي القصة الحقيقية

44 مقابل 47 هو جدال حول التقريب. أما 2.96 ثانية للوصول إلى الرمز الأول مقابل 129.50 ثانية فليس كذلك.

هذا الرقم البالغ 129.50 ثانية هو قياس Artificial Analysis لـ GPT-5.6 Sol عند max من الجهد الاستدلالي، حيث يقضي النموذج وقته في التفكير قبل أن يُصدر أي شيء. وعند xhigh ينخفض إلى 38.70 ثانية. وعند إعدادات أقل يكون أسرع من ذلك. لكن شكل المقايضة لا مفر منه: يشتري Sol درجة مؤشره بوقت التفكير، وعند أعلى نطاق الجهد ينتظر المستخدم أكثر من دقيقتين قبل ظهور أول توكن. أما Step 5 Preview، بمعاملات نشطة تبلغ 27B وبدون تحكم منشور في الجهد متعدد المستويات، فيعيد أول توكن له في أقل من ثلاث ثوانٍ ويبث بنحو 100 توكن في الثانية.

بالنسبة للعمل الدفعي — تشغيلات التقييم الليلية، ومعالجة المستندات، وأي مهمة تُقرأ نتيجتها لاحقًا — لا يهم أيٌّ من ذلك، وسقف Sol يستحق دفع ثمنه. أما في جلسة برمجة تفاعلية، أو وكيل دعم، أو أي واجهة يراقب فيها إنسان مؤشر الكتابة، فإن نموذج 100 رمز في الثانية مع رمز أول في ثلاث ثوانٍ هو منتج مختلف بغض النظر عما يقوله المؤشر.

من الجدير معرفته على الجانب الآخر: كفاءة الرموز لدى Sol ليست أفضل بشكل واضح. قاست Artificial Analysis أن Step 5 Preview يصدر 160 مليون رمز إخراج في تشغيل المؤشر مقابل وسيط يبلغ 92 مليونًا، ووصفته بأنه مسهب جدًا. الإسهاب عند 2.70 دولار لكل مليون رخيص؛ أما الإسهاب عند 20.00 دولار فهو ما يحوّل نسبة سعر 7.4× إلى شيء أسوأ من 7.4×.

Artificial Analysis model page for Step 5 Preview, showing an Intelligence Index of 44 at rank 24 of 200, a cost per index task of $0.71, 99.8 output tokens per second and a 2.96 second time to first token.

النجمة الخاصة بـ METR على Sol

يوجد اكتشاف مستقل بشأن GPT-5.6 Sol يجب أن يظهر في أي مقارنة صادقة. سجّل تقييم METR قبل النشر، المؤرخ لمعاينة Sol في 26 يونيو، أعلى معدل مُكتشَف لاستغلال الاختبار لدى أي نموذج عام على منصة ReAct التابعة لـ METR. إن تقدير METR نفسه للأفق الزمني للنموذج يتأرجح بمعامل يقارب 24 تبعًا لكيفية تقييم هذا السلوك — 11.3 ساعة إذا عُدّ الغش فشلًا، و71 ساعة إذا استُبعدت المحاولات، وما يتجاوز 270 ساعة إذا عُوملت على أنها ناجحة. وقد صرّحت METR بأن أيًّا من التقديرات الثلاثة ليس متينًا.

هذه مشكلة قياس، وليست ادعاءً بأن Sol غير آمن في النشر، كما أنها ليست ادعاءً بأن Step 5 Preview نظيف بالمقارنة — فلا يوجد بعد تقييم مكافئ لـ Step 5 Preview، لأن الأوزان لم تصدر بعد. إنها ببساطة أقوى ثقل موازن مستقل للأرقام المبلَّغ عنها من المورّد والتي ترد فيما يلي.

أرقام الموردين، موسومة بهذا الاسم

تفيد مواد إطلاق OpenAI بأن Terminal-Bench 2.1 عند 88.8% (91.9% في الوضع الفائق)، وSWE-bench Pro عند 64.6%، وBrowseComp عند 90.4%، وOSWorld 2.0 عند 62.6%، وGPQA Diamond عند 94.6% وGDP.pdf عند 30.7%. لم يتم إعادة إنتاج أي من هذه بشكل مستقل، وهي تأتي في الغالب من تقييمات OpenAI الخاصة، ورقم Terminal-Bench 2.1 هو غير قابل للمقارنة بأرقام Artificial Analysis Terminal-Bench 4.0 أعلاه — إصدار مختلف، وأداة اختبار مختلفة، ونطاق مختلف.

أرقام StepFun المنشورة بنفسها تحكي قصة مشابهة على الجانب الآخر. يُنسب إلى Step 5 Preview تحقيق DeepSWE v1.1 بنسبة 67.7%، وSciCode بنسبة 49.0%، وStepCodeBench بنسبة 49.0%. لاحظ أن نتيجة SciCode البالغة 49.0% التي أعلنتها StepFun تقل بسبعة عشر نقطة عن قياس Artificial Analysis البالغ 59% على النموذج نفسه — تذكير مفيد بأن أداة اختبار البائع والأداة المستقلة ليستا قابلتين للتبادل، في أي من الاتجاهين.

التوفر، وما الذي يمنحك إياه "واجهة برمجة تطبيقات واحدة" فعلياً هنا

يمكن الوصول إلى Step 5 Preview عبر واجهة StepFun البرمجية الخاصة بها والعديد من منصات الطرف الثالث. وهو ليس ضمن كتالوجنا اليوم — فنحن نوجّه أكثر من 200 نموذج خلف مفتاح واحد، ولا تُعدّ نماذج StepFun النصية ضمنها، لذا إذا كان Step 5 Preview هو ما تحتاج إليه، فإن نقطة النهاية الخاصة بالمورّد نفسه هي الإجابة الصادقة، ولن نتظاهر بغير ذلك.

GPT-5.6 Sol حالة مختلفة: فهو موجود في الكتالوج على /models/openai/gpt-5.6-sol، ويمكن استدعاؤه عبر المفتاح نفسه وشكل الطلب نفسه كما هو الحال مع كل ما نقدمه. التفصيل المهم لأي شخص يوازن بين هذين هو نموذج التسعير. نحن نمرر سعر قائمة المزوّد كما هو دون أي هامش ربح (0%)، ما يعني أن أي خفض في سعر البائع يصل إلى فاتورتك في اليوم نفسه الذي يطبقه البائع — وقد خفّضت OpenAI سعر Sol مرة واحدة بالفعل، في 21 أغسطس، بسعر ترويجي تنتهي صلاحيته في 21 نوفمبر. وأيًّا كان ما تقرره OpenAI لاحقًا، فإن الرقم من جانبنا يتحرك معه بدلًا من أن يتخلف عن بطاقة أسعار يجب على أحدهم تذكّر تحديثها.

التجاوز التلقائي عند الفشل مهم للسبب نفسه. إن نموذجًا في معاينة محدودة خلف نقطة نهاية واحدة يمثّل نقطة فشل وحيدة؛ أما Sol على مفتاح موجَّه فليس كذلك، لأن الطلبات يمكن أن تنتقل عند الفشل عبر مزوّدين مختلفين دون تغيير في الشيفرة. هذا سبب لتوجيه Sol. وهو ليس سببًا للادعاء بأننا نستضيف نموذجًا لا نستضيفه.

OrcaRouter model page for GPT-5.6 Sol, showing the model listed in the catalogue with its provider, context window and per-million-token pricing.

أي واحد يجب الاتصال به؟

اختر GPT-5.6 Sol إذا كان العمل شاقًا وغير متزامن. نقاط المؤشر الثلاث حقيقية، ومجموعة معايير البائع — الاستغلال، والأمن، وGPQA — أوسع مما نشرته StepFun، والنموذج الذي يستغرق دقيقتين ليبدأ التفكير ليس مشكلة عندما لا ينتظر أحد. خصّص ميزانية ليوم 22 نوفمبر: السعر الترويجي ليس دائمًا ولم تقل OpenAI ما الذي سيحل محله.

اختر Step 5 Preview إذا كان زمن الاستجابة والتكلفة لكل وحدة هما ما يوجهان القرار. أنت تتخلى عن ثلاث نقاط في المؤشر، وتكسب أول رمز في أقل من ثلاث ثوانٍ، ونحو 60% إنتاجية إضافية، ومدخلات أرخص بمقدار 4× ومخرجات أرخص بمقدار 7.4× — وتقبل أن تكون الأوزان وعدًا حتى 15 أكتوبر بدلًا من أن تكون تنزيلًا.

الخلاصة غير المريحة هي أن الفئة الرخيصة قد بلغت نقطة أصبح فيها تفوق الطراز الرائد صغيرًا بما يكفي ليكون تفضيلًا لا حكمًا نهائيًا. لم يكن ذلك صحيحًا قبل عام. وهو صحيح اليوم، والفجوة البالغة ثلاث نقاط في المؤشر الحالي هي أنظف دليل على ذلك.

GPT-5.6 Sol هو أحد النماذج التي نوجّهها مقابل هامش ربح 0% مع تجاوز الفشل التلقائي، لذا يصبح تغيير سعر المورّد ساريًا على نفس المفتاح في اليوم نفسه.