
معاينة Step 5: الرائد 600B غير المُعلَن عنه من StepFun موجود بالفعل على لوحة المتصدرين
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Step 5 Previewلديه مرتبة في لوحة الصدارة، وسعر منشور، وسرعة إخراج مقيسة، ودرجة 44 على مؤشر الذكاء — وهي الدرجة نفسها التي حصل عليها Kimi K3، وهو نموذج يبلغ حجمه نحو خمسة أضعافه. ما لا يملكه هو إطلاق. لم تُعلن StepFun عنه، ولم تدرجه وثائق منصة StepFun الخاصة، ولا توجد أوزان لتنزيلها. كل رقم أدناه يأتي من طرف ثالث حصل على وصول قبل أن تقول الجهة الموردة أي شيء علنًا، مما يجعل هذا مقالًا عمّا نعرفه حتى الآن لا مراجعة. اقرأ الأرقام كدليل على ما هو قادم، لا كورقة مواصفات.
التسريب هو القصة
أول أثر عام لـ Step 5 Preview هو عملية تقييم. لدى Artificial Analysis صفحة نموذج حية له، تم تقييمه عبر واجهة API الخاصة بـ StepFun تحت وسم الاختبار step-5-preview-b، مع تأريخ المنصة للنموذج بـ 18 سبتمبر 2026. تلك الصفحة هي مصدر الرقم 44، والتسعير، وقياس السرعة، وصفوف المعايير في هذه المقالة.
في المقابل، الجانب الخاص بالمورّد فارغ. توثيق المطوّرين لدى StepFun يسرد نماذج تصل إلى Step 3.7 Flash وStep 3.5 Flash ثم يتوقف — لا step-5، ولا إدخال معاينة. لا تملك منظمة stepfun-ai على Hugging Face أي مستودع لـ Step 5، وهو ما يتسق مع كونها منتجًا رائدًا بأوزان مغلقة لا مع سهو. تشير تقارير مجتمعية في منتديات المطوّرين الصينية إلى احتمال الكشف عنه في فعالية AGI Frontier في شنغهاي في 19 سبتمبر، وهو ما سيكون بعد نحو يوم من ظهور التقييمات. وحتى وقت كتابة هذا النص، لا يملك أي شخص خارج StepFun مواصفات رسمية ولا سعرًا رسميًا ولا اسمًا رسميًا للنسخة المطروحة.
التسمية نفسها هي أول دليل على أن هذه معاينة وليست إطلاقًا. لقد تخطّت StepFun سلسلة Step 4.x بالكامل وانتقلت إلى Step 5. النموذج الصادر تحت لاحقةPreview، والذي يُختبر قبل أن تكون له صفحة منتج، هو نموذج لا يزال البائع يعايره — يمكن أن يتغير التسعير والتوجيه والحدود جميعها قبل الإتاحة العامة.
كيف تبدو المواصفة، على حد علم أي شخص
هذه هي الأرقام المتداولة، وهي أكثر ادعاءات التسريب تكرارًا — وهو ما لا يعني أنها أكثرها تأكيدًا:
• إجمالي المعاملات — نحو 600 مليار، مقابل حوالي 2.8 تريليون لـ Kimi K3
• يُفعَّل عند كل استدلال — نحو 27B، أي ما يقارب 4.5% من الإجمالي، وهي نسبة خليط خبراء متناثرة بشكل غير معتاد
• أنماط الإدخال — نص وصور؛ الإخراج نص فقط
• الاستدلال — نعم، مع تفكير موسّع
• نافذة السياق — مليون رمز على Artificial Analysis؛ وإعداد طرف ثالث منفصل متداول في أدوات المطورين يذكر 350,000 مع حد أقصى للإخراج يبلغ 64,000
• توفر الوزن — مغلق، لا يوجد مستودع
هذا التناقض المتعلق بنافذة السياق يستحق الإشارة إليه بوضوح، لأنه لم يحلّه أحد. فنافذة 1M توكن ونافذة 350k توكن منتجان مختلفان بتكاليف ذاكرة مختلفة، ويأتي الرقم الثاني مع سقف مخرجات 64k لا يذكر الأول شيئًا عنه. إذا كنت تخطط لخط معالجة للمستندات الطويلة اعتمادًا على رقم 1M، فإن تهيئة 350k هي السبب للانتظار حتى تظهر صفحة المورّد. وأعداد المعاملات تنطوي على غموض مماثل: لا يزال متتبّع DataLearner يسجّل بنية MoE وأعداد المعاملات الخاصة بـ Step 5 Preview كغير متاحة، مما يعني أن زوج 600B/27B — الحقيقة الأكثر اقتباسًا عن هذا النموذج — هو أيضًا من أقل الوقائع تأكيدًا رسميًا.
الرقم المثير للاهتمام هو 27 مليار، وليس 600 مليار.
لا تنفق نماذج خليط الخبراء المتفرقة الحوسبة إلا على الخبراء الذين يوجّه إليهم الرمز فعليًا، لذا فإن الرقم المُنشَّط هو الذي يحكم كيفية تصرف النموذج في بيئة الإنتاج. وعند نحو 27 مليار معامل مُنشَّط، يؤدي Step 5 Preview عملًا لكل رمز ضمن النطاق نفسه الذي تؤديه نماذج لا تمثل إلا جزءًا يسيرًا من حجمه، بينما الإجمالي البالغ 600 مليار هو إلى حد كبير مسألة تتعلق ببصمة الذاكرة.
تترتب على ذلك نتيجتان، وكلتاهما تظهران في قياسات الطرف الثالث. تكلفة الخدمة تتتبع المعاملات المنشَّطة، وهذا جزء من سبب كون السعر حيث هو. وسرعة كل رمز تستفيد أيضًا: تقيس Artificial Analysis سرعة 99.8 رمز إخراج في الثانية، في المرتبة 42 من 200 نموذج، مقابل وسيط قدره 64.6. أما زمن الوصول إلى أول رمز فيبلغ 2.96 ثانية مقابل وسيط يبلغ نحو 3.57 ثانية. وإذا كان تقسيم 600B/27B دقيقًا، فهذا نموذج مصمَّم ليكون رخيص الخدمة لا رخيص الاستضافة — وهو تمييز مهم إذا كنت أنت من يدفع مقابل وحدات معالجة الرسوميات لا مقابل الرموز.
أين يقع على مؤشر الذكاء
يمنح Artificial Analysis نموذج Step 5 Preview درجة 44 على Intelligence Index v4.3، الذي يتضمن عشر تقييمات. وهذا يجعله في المرتبة 25 من بين 200 نموذج على لوحة الترتيب، وأعلى بكثير من النموذج الوسيط بين النماذج التي يقيّمها المؤشر، والذي يقع عند 25.
• مؤشر الذكاء — Step 5 Preview 44 مقابل Kimi K3 44
• مباشرةً أعلاه — GLM-5.3 وClaude Opus 5، وكلاهما عند 45
• أدناه مباشرة — DeepSeek V4.1 Flash عند 40 وDeepSeek V4 Pro عند 36
• Terminal-Bench 4.0 — Step 5 Preview 33.3% مقابل Kimi K3 بنحو 12.6%، ومقابل DeepSeek V4.1 Flash عند 26.8%
• SciCode — 59% لـ Step 5 Preview، بمستوى مماثل لـ Kimi K3
• سرعة الإخراج — 99.8 رمزًا في الثانية مقابل وسيط المجال البالغ 64.6
العنوان هو التعادل مع Kimi K3، والقراءة الصادقة أضيق مما توحي به العناوين. إن مجاراة نموذج بـ2.8T معلمة على مؤشر إجمالي عند 600B إجمالًا نتيجة كفاءة حقيقية، لكن الإجمالي يخفي شكلها: الفجوة في Terminal-Bench 4.0 لصالح Step 5 Preview هائلة، بينما نتيجة SciCode تعادل تام. التعادل الإجمالي على مؤشر ليس تعادلًا في كل مكان، وإصدار المعاينة هو أقل اللحظات موثوقيةً لافتراض أن الفجوات ستستمر.
ثمة تباين آخر يستحق الذكر: يُبلِغ Artificial Analysis عن 44، بينما يسجّل متتبع DataLearner المستقل نفس التشغيل عند 43.6. هذا فرق تقريب لا خلاف حول القدرات، لكنه من النوع الذي يوضح الفكرة بشأن أرقام هذا النموذج عمومًا — فهي قراءات من طرف ثالث لنموذج غير معلن عنه، أُخذت في لحظات مختلفة قليلًا، ولم تؤكد StepFun أيًّا منها. لا شيء من هذه الاختبارات المعيارية مُبلَّغ عنه من الجهة المطوِّرة، وهذا ذو حدّين: فلم يطالب أحد في StepFun برقم هنا، ولم يقف أحد في StepFun خلف أي رقم أيضًا.

الثمن، والإسهاب الذي يقتطع منه
التسعير هو الجزء من هذا التسريب الذي سيؤثر على الميزانية في أقرب وقت. عبر واجهة برمجة تطبيقات StepFun، تسجّل Artificial Analysis ما يلي:
• الإدخال — 1.00 دولار لكل مليون رمز، مقابل وسيط قدره 1.88 دولار للنماذج المماثلة
• الإخراج — $2.70 لكل مليون رمز، مقابل وسيط يبلغ $10.00
• الكاش — خصم بنسبة 95% على الكاش، مما يجعل إصابات الكاش تبلغ حوالي $0.05 لكل مليون رمز
• مدمج — حوالي 0.51 دولار لكل مليون رمز عند مزيج بنسبة 7:2:1 من إصابة الذاكرة المؤقتة إلى المدخلات إلى المخرجات
• التكلفة لكل مهمة في Intelligence Index — 0.71 دولار
• تكلفة تشغيل فهرسة كاملة — $918.34 إجمالًا
الإخراج بسعر 2.70 دولار هو البند الأكثر أهمية، لأنه أقل من خُمس ما تتقاضاه Kimi K3 مقابل نفس المليون رمز بسعر 15.00 دولارًا. لكن هناك مأخذًا تحجبه المقارنة لكل رمز، ويقيسه Artificial Analysis مباشرة: الإسهاب. ولّد Step 5 Preview 160 مليون رمز إخراج لإكمال Intelligence Index، مقابل وسيط قدره 90 مليونًا للمجال ومرتبة 65 من 200 في ذلك المقياس.
احسب ذلك بالتفصيل. بمعدل $2.70 لكل مليون، تبلغ تكلفة 160M من رموز الإخراج نحو $432 — أي نحو نصف التكلفة الإجمالية البالغة $918.34 لدورة تشغيل الفهرس بأكملها، أُنفقت على إسهاب النموذج نفسه لا على المهام. مرّر نفس الـ160M رمز عبر سعر الإخراج البالغ $15.00 لدى Kimi K3 وستصل إلى $2,400، ومن هنا تأتي ميزة السعر. لكن التحذير العملي موجّه إلى كل من يقدّر التكاليف بأخذ عدد الرموز من نموذج مختلف: إذ يكتب Step 5 Preview نحو 1.8 ضعف الوسيط، لذا فإن حمل العمل الذي يغلب عليه الإخراج يجمع بين السعر الأرخص وعدد رموز أكبر في الوقت نفسه. يظل الخصم قائمًا، لكنه أصغر مما يوحي به $1.00/$2.70 مقابل $3.00/$15.00، ويعتمد حجمه كليًا على مقدار الكلام الذي تجعل مطالباتك النموذج ينتجه.
خصم التخزين المؤقت بنسبة 95% هو الرافعة الأخرى، وهو عدواني على نحو غير معتاد. إن حمل عمل يعيد استخدام المطالبات بكثافة — مطالبة نظام طويلة، أو مستند ثابت، أو قاعدة شيفرة مشتركة — يقع أقرب بكثير إلى السعر المدمج $0.51 منه إلى سعر الإدخال $1.00. ويفترض ذلك الرقم المدمج نسبة 7:2:1، وهي افتراض في النمذجة لا ضمان، لكنها البنية الصحيحة للحساب التي يمكن تشغيلها مقابل بيانات حركتك الخاصة.

ما يواجهه المختبِرون الأوائل
هذه تقارير فردية من منتديات المطوّرين ومنشورات اجتماعية في الأيام المحيطة بالتسريب، وليست قياسات، وينبغي ترجيحها وفقًا لذلك:
• يُعدّ استدعاء الأدوات أكثر الشكاوى شيوعًا — اختيار أسماء أدوات خاطئة، ومحاولة إجراء تعديلات دون قراءة الملف الهدف أولًا
• أخطاء تم الإبلاغ عنها بعد تجاوز نحو 340,000 رمز من السياق، وهو نمط الفشل الذي يجب مراقبته إذا تبيّن أن نافذة 1M هي الرقم الحقيقي.
• تصفية المحتوى تقتطع المخرجات في بعض المطالبات
• انطباعات القدرات منقسمة: بعض المختبِرين يضعونه أعلى من GLM-5.3 Flash، بينما يضعه آخرون أدنى من DeepSeek V4.1 Flash
إن فشل نسخة معاينة غير مُصدَرة في استخدام الأدوات ليس فضيحة — فهذا هو الغرض من وسم المعاينة. لكنه يعني أن الرقم 44 لا ينبغي قراءته كوعد بالموثوقية الوكيلية، لأن Intelligence Index لا يختبر الشيء الذي يشكو منه المختبِرون الأوائل أكثر من غيره.
كيف ستناديه فعليًا — وما الذي تستخدمه في هذه الأثناء
لا يقوم OrcaRouter بتوجيه Step 5 Preview. لا توجد نقطة نهاية عامة ولا أوزان، لذا لا يوجد شيء يمكن توجيهه، ولا يمكن لأي منصة طرف ثالث أن تدّعي بصدق عكس ذلك بعد. أي شخص يخبرك أين يمكن استدعاؤه اليوم فهو يصف نقطة نهاية تقييمية، وليس منتجًا.
النماذج التي يُقاس مقابلها مسألة مختلفة. Kimi K3 وGLM-5.3 وDeepSeek V4.1 Flash كلها متاحة عبر OrcaRouter، إلى جانب 199 نموذجًا من 15 مزوّدًا خلف مفتاح API واحد وفاتورة واحدة. يُمرَّر التسعير بسعر قائمة المزوّد مع هامش ربح 0%، وهذا يهم أكثر من المعتاد في نموذج كهذا: إذا ثبت سعر Step 5 Preview البالغ $1.00/$2.70 عند الإطلاق ثم تغيّر، فإن مسار التمرير يتغيّر في اليوم نفسه بدلًا من أن يتغيّر وفق جدول إعادة تسعير شخص آخر.
عندما يصبح قابلًا للاستدعاء فعلًا، فإن الطريقة المعقولة لتشغيل نموذج قريب من طور ما قبل الإصدار هي الطريقة ذاتها التي تشغّل بها أي نموذج لا تثق به بعد — خلف مسار مزوّد بتحويل تلقائي عند الفشل، بحيث يؤدي فشل استدعاء أداة أو خطأ في السياق الطويل إلى الانتقال إلى نموذج يعمل، بدلًا من أن يُسقط تطبيقك معه. وهذا هو النمط الذي تدعو إليه التقارير المبكرة هنا تحديدًا: إصدار تجريبي أولي مع مشكلات مُبلَّغ عنها في استدعاء الأدوات وأخطاء في السياق الطويل هو بالضبط النموذج الذي تريد أن تضع خلفه بديلًا احتياطيًا، لا النموذج الذي تريد أن تضعه في مسار الإنتاج بمفرده.

ما الذي سيحوّل هذا من تسريب إلى إصدار؟
ثلاثة أمور يجب مراقبتها، مرتبة حسب مقدار ما ستحسمه. أولاً، صفحة نموذج وتسعير على منصة StepFun الخاصة بالمطورين — اللحظة التي يظهر فيها step-5 في قائمة النماذج، تحل ورقة مواصفات البائع محل كل قراءة من طرف ثالث في هذا المقال، بما في ذلك زوج 600B/27B وادعاء سياق 1M. ثانياً، حل التناقض في السياق بين 1M و350k؛ حد إخراج 64k تحت نافذة 1M هو فرق ذو معنى لأي شخص يبني خطوط أنابيب للمستندات الطويلة أو الوكلاء، وهو غير محل حالياً. ثالثاً، ما إذا كان التسعير وضعية إطلاق أم خطاً دائماً — كان لتسعير المعاينة على النماذج الرائدة الصينية تاريخ في التغير بمجرد أن تصبح السعة ضيقة، و$2.70 لكل مليون رمز إخراج عدواني بما يكفي لطرح هذا السؤال.
إلى أن يتحقق أول هذه الأمور على الأقل، فإن الخلاصة الصادقة هي أن Step 5 Preview يبدو نموذجًا فعّالًا حقًا — 600B إجمالًا تؤدي عملًا تراكميًا من فئة 2.8T، بسعر أدنى من سعر المنافسين بعدة أضعاف — مع مواصفات غير مُتحقَّق منها، وضريبة إسهاب حقيقية، وسمعة في استدعاء الأدوات لم تُكتسب بعد. يستحق التخطيط على أساسه. لكنه لا يستحق بعد المراهنة عليه كمسار إنتاجي.
مقارنات في هذه المقالة4
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
