
النموذج الحلقي الثاني لـ OpenAI: ما الذي يدّعيه فعلاً تسريب DevDay «المحور المحرّم»
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 177 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1323 tok/s
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
لا يوجد سوى مصدر واحد للادعاء الذي يتناوله هذا المقال، وهو منشور واحد على X. في 24 سبتمبر، كتب الحساب @scaling01 أن المورّد "فتح الأبواب على مصراعيها وسيطلق نموذجه اللغوي الحلقي الثاني إلى جانب GPT-6 Astra في DevDay"، واصفًا العمق التكراري بأنه "المحور المحرَّم" ومشيرًا إلى أنه "لم يعد محرَّمًا". هذا كل ما في الأمر: لا اسم نموذج، ولا معرّف نموذج، ولا سعر، ولا تاريخ يتجاوز الكلمة الرئيسية في DevDay في 29 سبتمبر في سان فرانسيسكو، ولا أي كلمة من المورّد. وما يجعل الادعاء يستحق وقت القارئ ليس التغريدة، بل الحقائق المُطلَقة الكامنة تحتها. GPT-6 Astra، الذي أطلقه المورّد في 3 سبتمبر، هو أول نموذج إنتاجي من أي مختبر كبير ربطته التقارير بمعمارية حلقية ذات عمق تكراري. GPT-6 Sol وGPT-6 Luna، اللذان طُرحا في 22 سبتمبر بسعر 2 دولار للإدخال / 10 دولارات للإخراج و0.10 دولار للإدخال / 0.50 دولار للإخراج لكل مليون رمز، حوّلا ذلك النموذج الرائد إلى سلّم أسعار. ونموذج حلقي ثانٍ سيعني أن المورّد لم يعد يتعامل مع العمق التكراري كرهان لمرة واحدة بل كمعمارية قائمة — وهذا ادعاء أكبر من أي إطلاق منفرد، وأصعب بكثير في التحقق منه.
هذا مقال عمّا نعرفه حتى الآن. كل ما يُنسب إلى ناشر أو إلى تقارير مجهولة المصدر موسوم بذلك، ولا ينبغي قراءة أي شيء هنا على أنه إصدار.
لماذا تُعد عبارة «المحور المحظور» الجزء الأكثر إثارة للاهتمام في التغريدة
الصياغة خاصة بكاتب المنشور، وليست مصطلحًا فنيًا، لكنها تشير إلى شيء حقيقي. في توسيع نطاق المحوّلات هناك ثلاثة محاور واضحة: المعاملات، والبيانات، والحوسبة التدريبية. العمق عبر التكرار هو المحور الرابع، وهو محور غريب. فبدلًا من تكديس N من الكتل المتميزة، يعيد نموذج حلقاتي استخدام نفس المكدس الصغير من الكتل R مرة، لذا يكون العمق الفعّال تقريبًا عدد الطبقات مضروبًا في عدد الحلقات، بينما يظل عدد المعاملات ثابتًا. وضعت Google DeepMind النظرية فيالاستدلال بالأفكار الكامنة: حول قوة المحوّلات الحلقية، والمُستشهد به على نطاق واسع توسيع نطاق الحوسبة وقت الاختبار بالاستدلال الكامن: نهج العمق التكراري قدّمت الحجة العملية.
إنه ليس عمقًا مجانيًا. إن أعمال القياس متساوي العمق على النماذج اللغوية ذات الحلقات التكرارية تضع أُس تكافؤ التكرار عند نحو 0.46 — أي أن حلقة إضافية واحدة تشتري لك نحو 46% مما كانت كتلة جديدة حقيقية ستشتريه. أنت تشتري العمق بخصم، وتدفع ثمنه من الحوسبة التسلسلية بدلًا من الذاكرة. وهذه مقايضة مواتية إذا كنت محدودًا بالذاكرة أو أردت لنموذج صغير أن يتصرف كنموذج كبير، وهي بالضبط المقايضة التي تبحث عنها الطبقات الرخيصة في أي عائلة.
فلماذا "محظورة"؟ لأن الحساب الذي يحدث داخل الحلقة يحدث في الحالة المخفية، لا في الرموز المُصدَرة. كانت مراقبة سلسلة التفكير — قراءة ما يكتبه النموذج أثناء تفكيره — أداة الضمان الرئيسية في القطاع منذ ظهور نماذج الاستدلال، وهي الأداة التي جعلت حادثة وكيل Hugging Face في يوليو مفهومة للمحققين من الأساس. النموذج الذي ينجز قدرًا أكبر من عمله في الفضاء الكامن يمنح تلك الأداة قدرًا أقل لتقرأه. وقد كان ذلك هو الحجة ضد التكرار الحلقي في طليعة المجال لمدة عامين، وهو السبب وراء انتشار هذه التقنية في الأوزان المفتوحة — من ByteDance Seed:Ouro عند 1.4B و2.6B، وNanbeige4.2-3B، الذي يمرر مكدسًا من 22 طبقة مرتين — بينما ابتعدت عنه المختبرات ذات التزامات السلامة المنشورة. وقد عالجت ورقتا MeSH وSpiralFormer من Alibaba المشكلة نفسها من جانب الكفاءة.
ما قالته OpenAI فعليًا، وما لم تقله
التقرير الذي أطلق هذا الأمر هو تقرير The Information الصادر في 1 و2 سبتمبر: أن Astra تستخدم تقنية تُسمى العمق التكراري، وتُوصف أيضًا بالتكرار المعتم. وهي وسيلة إخبارية جيدة المصادر ولها سجل حقيقي، لكنها ما زالت تقريرًا صحفيًا لا توثيقًا. لم تنشر OpenAI قط ورقة معمارية تؤكد تصميمًا حلقيًا، ويقول تحليل سيباستيان راشكا واسع القراءة لـ Astra بوضوح إن البنية الحلقية مستنتجة من تصريحات علنية — إذ تفترض إعادة بنائه أن Astra تشغّل كتلها الـ22 مرتين، أي 44 تطبيقًا فعليًا للكتل، مع كون حلقتين مثاليتين، وأن المزيد من الحلقات يزعزع استقرار التدريب.
ما قاله أفراد OpenAI أنفسهم أضيق نطاقًا وأكثر حذرًا مما أوحى به كل من التغطية أو ردّ الفعل المعارض. نشر كبير العلماء ياكوب باتشوكي في 2 سبتمبر أن عمق الرسم البياني الحسابي في النماذج الرائدة، بما فيها Astra، يقع في حدود عامل اثنين من GPT-4 — قدر محدود من التكرار الحلقي، وليس الاستدعاء الذاتي المتطرف الذي ألمحت إليه بعض العناوين — واعترض على ما وصفه بالتقارير المشوّشة، مع إقراره بأن مراقبة سلسلة التفكير هشة وتميل في اتجاه سلبي. ويُقال إن بطاقة نظام Astra تشير إلى أن قابلية مراقبة مسارات الاستدلال أقل بدرجة من GPT-5.6 Sol، وهو اعتراف حقيقي ولا يتوقف على المعمارية التي تسببت في ذلك.
كان ردّ فعل مجال السلامة صاخبًا. قال باك شليغيريس من Redwood Research إنه قلق للغاية، وحذّر من أن توسيع نطاق التكرار قد "يدمّر تمامًا قابلية مراقبة CoT"؛ وقد قدّم Ryan Greenblatt وZvi Mowshowitz الحجة نفسها بنبرات مختلفة. جاء أكثر الردود المضادة فائدة من Raschka: فقد امتنعت OpenAI عن نشر مسارات الاستدلال الخام منذ جيل o1 بصرف النظر عن البنية المعمارية، وأن إصدار نموذج أقوى لسلسلة تفكير أقصر ليس بحد ذاته دليلًا على وجود قناة استدلال خفية.
اجمع هاتين الفقرتين معًا، وستحصل على الوضع الراهن الذي تراهن عليه التغريدة. إن «Astra في حلقة» تقرير موثوق رفضت OpenAI تأكيده. و«نموذج ثانٍ بحلقة يُطرح في 29 سبتمبر» ليس سوى منشور واحد.
خمس تسريبات لـOpenAI في سبتمبر، وأين يقع هذا التسريب منها
أنتج شهر سبتمبر مجموعة كثيفة من قصص التسريبات المتعلقة بـ OpenAI، والشيء المفيد بشأنها أنها ليست جميعها من الفئة نفسها من الأدلة.
• 3 سبتمبر — السلسلتان النصيتان gpt-6-astra و gpt-6-astra-aeon ظهرتا في علامة ميزة Statsig داخل Codex Desktop، وقد التقط @notjazii لقطة شاشة لها ووسّع @kimmonismus انتشارها. انبثقت قصة وكيل Aeon من ذلك. وبعد مرور خمسة أسابيع، لا تزال لا توجد صفحة منتج، ولا سعر، ولا توثيق، ولا اختبار أداء لـ Aeon، ولا معرّف نموذج يمكن استدعاؤه.
• 21 سبتمبر — ظهرت سلسلة "GPT-6 Sol medium" في سجلات الدمج الخاصة بـ NVIDIA.
• 22 سبتمبر — نُشرت ثلاثة مسارات في سجل Azure، الخاصة بـ gpt-6-sol وgpt-6-luna وgpt-6-astra-minor، من منتدى المطورين الصيني locdd.com كعنوان URL مباشر من Microsoft. وعندما جلبنا نقطة نهاية إعدادات ساحة التجربة العامة في اليوم التالي، لم تكن الأسماء الثلاثة الجديدة موجودة فيه؛ إذ كان السجل يضم بدلاً منها gpt-6-astra وإدخالات الجيل الأقدم GPT-5.6.
• 22 سبتمبر — صدور GPT-6 Sol وGPT-6 Luna. خلال يوم واحد تبع ذلك كلٌّ من السعر ومعرّفات الطرازات وملاحظات إصدار SDK وقائمة على Bedrock ومدخل في منتقي GitHub Copilot وإعداد افتراضي في Perplexity.
النمط ليس خفيًا. فئات التسريبات التي كانت تحمل أثرًا داخل واجهة تُشحن فعليًا — ملاحظة إصدار SDK، أو سجل سحابي، أو علامة ميزة على سطح المكتب — ظلت تتحول إلى منتجات. أما فئات التسريبات التي كانت مجرد اسم فلم تتحول. ادعاء اليوم، وهو نموذج لغوي ثانٍ ذو حلقات من OpenAI في DevDay، لا يحمل أي أثر على الإطلاق: لا سلسلة نصية، ولا علامة، ولا مسار سجل، ولا صف سعر، ولا معرّف نموذج. هذا لا يجعله خاطئًا. بل يجعله غير قابل للتحقق من الخارج، وهو وصف مختلف وأكثر صدقًا.
جدول DevDay المحيط به حقيقي، وموثّق بشكل غير معتاد.
الشيء الوحيد الذي يمكنك تحديد تاريخه بدقة هو الحدث نفسه. تم تأكيد DevDay 2026 ليوم الثلاثاء، 29 سبتمبر، في Fort Mason بسان فرانسيسكو، مع كلمة رئيسية يلقيها سام ألتمان وبثّ مباشر مجاني — وقد أعلنت OpenAI عن التاريخ في أبريل.
ما يُتوقع فيه قد جرى التلميح إليه بقوة أكبر من المعتاد. نشر ألتمان في 15 سبتمبر أن OpenAI لديها «إطلاق كبير هذا الأسبوع، ثم في DevDay إطلاق × 6»، ثم تراجع عن النصف الأول مساء اليوم التالي: «الشيء الرئيسي الذي كنت متحمسًا لإطلاقه هذا الأسبوع سيأتي الأسبوع المقبل بدلًا من ذلك، لكنه في رأيي يستحق الانتظار!» وقال تيبو سوتيو، مدير المنتج، الذي كان قد وصف الأسبوع بأنه بحجم DevDay، في 19 سبتمبر إن الإصدار ما زال قادمًا يوم الثلاثاء، وفي 22 سبتمبر حدث ذلك فعلًا — Sol وLuna، إضافة إلى إعادة تعيين استخدام Codex المُدّخر للحسابات المدفوعة. اقرأ «إطلاق × 6» كعدد لستة أشياء تُطلق حول DevDay، ويتسع المعنى العادي للعبارة بسهولة ليشمل نموذجًا ثانيًا مُكرّرًا؛ أما إذا قرأتها كمبالغة فلا تنطبق إطلاقًا. في كلتا الحالتين، إنه منشور من مؤسس، وليس خارطة طريق.
تؤشر التسريبات المتجاورة إلى الاتجاه نفسه من دون تسمية أي نموذج. ظهر إصدار من Codex Cloud في إصدار ChatGPT لسطح المكتب رقم 9922 مع تكاملات Tailscale والبروكسي، وأظهر مسار إعداد أولي مستويات خطط المطوّرين — Free وPrototype وAccelerate، الأخيرة بسعر 50 دولارًا — قبل أيام من الكلمة الرئيسية. لا يعد أي منهما نموذجًا حلقيًا. ويتسق كلاهما مع DevDay يركّز على المنصة أكثر من البحث.
إذا كان حقيقيًا، فما هو الطراز؟
لم يُبلّغ أي شخص عن هوية، لذا فإن ما يلي استنتاج ويجب قراءته على هذا النحو.
أقصر طريق إلى "نموذج OpenAI الثاني القائم على الحلقات" هو خَلَفٌ لـ Astra. وقد قال ألتمان إن نماذج أكثر قدرة قادمة "قريبًا جدًا"، وأرخص طريقة لبناء واحد منها على أساس عمق تكراري هي الإبقاء على البنية المعمارية ورفع ميزانية الحلقات — مزيد من التكرار لكل رمز بدلًا من مزيد من الأوزان. وهذا التفسير يشرح أيضًا صياغة "انفتاح السدود" على أفضل وجه، لأن وجود نموذج رائد ثانٍ على البنية نفسها إعلانٌ بأن الأول نجح.
القراءة الثانية هي طبقة جديدة داخل خط GPT-6 الحالي. لقد أفرزت قواعد التسمية بالفعل سلاسل gpt-6-astra-minor وgpt-6-sol وgpt-6-luna، كما أن وجود نموذج شقيق بحلقة تكرارية عند ميزانية عمق مختلفة يتسق تمامًا مع عائلة تمتد الآن من 0.10 دولار إلى 50 دولارًا لكل مليون رمز إخراج. سيكون النموذج الأرخص ذو الحلقة التكرارية هو النسخة التي يشعر بها القارئ أكثر من سواها في محفظته.
القراءة الثالثة — إطلاق مفتوح الأوزان ذو البنية الحلقية — هي الأقل سندًا. فمن شأنها أن تفسّر العبارة أفضل من أي شيء آخر، والأدبيات المفتوحة عن النماذج الحلقية التي ستقع بجوارها موجودة بالفعل في Ouro وNanbeige4.2-3B، لكن OpenAI لم تُعلن شيئًا في ذلك الاتجاه لهذا الجيل، واختلاق منتج ليطابق كلمة هو السبيل الذي تسوء به تغطية التسريبات.

ما الذي سيجعل هذا قابلاً للتحقق قبل 29 سبتمبر؟
راقب الأسطح التي عالجت التسريبات الثلاثة الأخيرة، بهذا الترتيب:
• معرّف نموذج يمكن التحقق منه في API الخاص بـ OpenAI، أو صف جديد في صفحة الأسعار الخاصة بها.
• ملاحظة إصدار في SDK openai-go أو openai-node تذكر معرّفات نماذج جديدة — وهكذا بالضبط سرّب Sol وLuna وصولهما، مع شحن SDK v3.65.0 لمعرّفات النماذج قبل ساعات من نشر صفحة الإعلان.
• قائمة Bedrock أو Azure، أو سلسلة علامة Statsig جديدة في إصدار سطح مكتب.
• جملة عن البنية المعمارية في بطاقة نظام. هذه هي الجملة التي ستكون الأكثر أهمية وستصل أخيرًا، لأن OpenAI لم تؤكد قط التصميم الحلقي لـ Astra.
كل ما هو أقل من الثلاثة الأولى هو اسم، وقد كانت الأسماء أقل العناصر موثوقية في هذه الدورة بأكملها.

لماذا يهم الأمر حتى لو تبيّن أن التغريدة خاطئة
هناك أمران يتغيران إذا أصبح العمق التكراري هو القاعدة بدلًا من الاستثناء.
الأول هو الضمان. إذا أجرى الجيل القادم مزيدًا من استدلاله داخل الحالة المخفية، فإن أي تقييم يعتمد على قراءة سلسلة تفكير النموذج المكتوبة يفقد الإشارة — وهذا يشمل تقييم السلامة من طرف ثالث، وليس فقط المراقبة التي تُجريها OpenAI نفسها. وهذا مُدخل من مُدخلات الشراء لأي جهة لديها متطلَّب ضمان، ولن يكون ظاهرًا في جدول المقارنات المعيارية.
الثاني هو شكل سلّم الأسعار. تستبدل النمذجة الحلقية المعاملات بالحوسبة التسلسلية، لذا تنقل التكلفة من الذاكرة إلى الزمن: قد تكون أرخص في الاستضافة، وقد تكون أبطأ لكل رمز. تسعّر سلسلة GPT-6 هذه المقايضة صراحةً بالفعل — GPT-6 Astra بسعر 10 دولارات للإدخال / 50 دولارًا للإخراج لكل مليون رمز هو نموذج العمق، GPT-6 Sol بسعر 2 دولار / 10 دولارات هو النموذج السريع، GPT-6 Luna بسعر 0.10 دولار / 0.50 دولار هو النموذج عالي الحجم. الثلاثة جميعًا متاحة على OrcaRouter بسعر OpenAI المعلن دون أي هامش ربح، لذا إذا وصل نموذج رابع حَلقي في 29 سبتمبر، فإن بطاقة الأسعار لدينا هي بطاقة أسعار المورّد يوم إطلاقه — وأي خفض لسعر المورّد يصبح ساريًا هنا في نفس اليوم الذي يصبح فيه ساريًا هناك.
الاستخدام العملي لتسريب مثل هذا ليس التنبؤ، بل الاستعداد. نموذج قد يُطرح خلال خمسة أيام وليس له معيار تقييم مستقل هو بالتحديد الحالة التي وُجد التحويل التلقائي عند الفشل من أجلها: وجّه مسارًا إلى النموذج الجديد، وأبقِ GPT-6 Astra أو GPT-6 Sol خلفه، فيكلفك أول أسبوع سيئ جزءًا صغيرًا من حركة المرور لديك بدلًا من مسار الإنتاج الخاص بك. وهذه أيضًا هي الطريقة المعقولة لاختبار نموذج كثيف العمق — إذ يدمجه routing DSL في استدعاء واحد إلى جانب النماذج التي يُفترض أن يستبدلها، وسيُشغّل model fusion مجموعة منها مقابل المطالبة نفسها، وهو قراءة أسرع لمعمارية جديدة من أي منشور إطلاق.
ما هو الصحيح فعلاً الليلة؟
منشور واحد على X يقول إن ثاني نموذج لغوي قائم على الحلقات لدى OpenAI يصل في 29 سبتمبر. لا معرّف للنموذج، ولا سعر، ولا اسم، ولا مصدر ثانٍ، ولا دليل مادي. وتحت ذلك: طراز رئيسي طُرح في 3 سبتمبر تقول التقارير إنه قائم على الحلقات، ولم تؤكد OpenAI قط أنه قائم على الحلقات، وتراجع مُعترف به في قابلية رصد أثر الاستدلال مقارنةً بـ GPT-5.6 Sol، وعالم رئيسي يقول إن الحلقات محدودة في حدود ضعف عمق الرسم البياني الحسابي لـ GPT-4، وفئة رخيصة طُرحت في 22 سبتمبر جعلت مسألة البنية ذات أهمية تجارية لا أكاديمية.
ذلك ادعاء واهٍ يستند إلى رواية كثيفة، وهو الشكل المعتاد لتسريب قبل الحدث بخمسة أيام. إذا ظهر نموذج ثانٍ مُدوَّر في فورت ماسون يوم الثلاثاء، فلن تكون التفصيل المثير هو رقم المعيار — بل ما إذا كانت بطاقة النظام تكرر التحذير بشأن قابلية المراقبة. تلك الجملة الواحدة هي التي تخبرك ما إذا كانت عبارة "لم تعد محظورة" شعارًا أم سياسة.

مقارنات في هذه المقالة3
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
