
OpenAI Astra: كل ما نعرفه عن النموذج الذي ليس GPT-6
- qwenجديدQwen: Qwen3.8 Max2026-08-03$2.00 / $6.00 لكل مليون رمز · 56 tok/s
- deepseekجديدDeepSeek: DeepSeek V4 Flash 07312026-07-3150الذكاء69البرمجة
- qwenجديدQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز · 200 tok/s
- orcaجديدOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicجديدAnthropic: Claude Opus 52026-07-2461الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2150الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1651الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1557الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0951الذكاء71البرمجة
- openaiOpenAI: GPT-5.6 Terra2026-07-0955الذكاء77البرمجة
- openaiOpenAI: GPT-5.6 Sol2026-07-0959الذكاء77البرمجة
- grokxAI: Grok 4.52026-07-0854الذكاء72البرمجة
- tencentTencent: Hy32026-07-0641الذكاء59البرمجة
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232الذكاء42البرمجة
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226الذكاء39البرمجة
- anthropicAnthropic: Claude Sonnet 52026-06-3053الذكاء72البرمجة
- klingKling: Kling 3.0 Turbo2026-06-1757الذكاء52البرمجة57الرياضيات
- z-aiZ.ai: GLM 5.22026-06-1651الذكاء69البرمجة60الرياضيات
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242الذكاء61البرمجة61الرياضيات
الشيء الذي يمكنك تحميله اليوم ليس نموذجًا، بل هو عشرة ملفات من كود ليين. في 1 أغسطس 2026، نشرت OpenAI منشورًا بحثيًا حول الرياضيات، وكان مدفونًا فيه أول تأكيد لاسم نظامها الحدودي القادم: أسترا. لا توجد بطاقة نموذج، ولا صفحة تسعير، ولا نقطة واجهة برمجة تطبيقات، ولا تاريخ. النموذج الرئيسي الحالي الذي يمكنك الاتصال به بالفعل هو لا يزال GPT-5.6 Sol، بسعر 5 دولارات لكل مليون رمز إدخال و30 دولارًا لكل مليون رمز إخراج، تمامًا كما كان الحال منذ 9 يوليو.
إذا كنت تبحث عن GPT-6، فهذه هي النسخة المختصرة: لم تعلن OpenAI أبدًا عن نموذج بهذا الاسم، وحتى اليوم لم تقرر ما إذا كانت Astra ستُطرح باسم GPT-6، أم كإصدار نقطي من GPT-5 مثل GPT-5.7، أم كطبقة رابعة تتوازى مع Sol وTerra وLuna. هذا الغموض في التسمية ليس تهرّبًا من الإعلام. بل هو سؤال داخلي قائم، كما أفادت به The Information في 31 يوليو ولم يُحسم منذ ذلك الحين.
يفصل ما يلي بين ثلاثة أمور تخلط بينها معظم التغطيات الإعلامية لهذه القصة: ما صرّحت به OpenAI نفسها، وما تضيفه التقارير الموثوقة، وما يتم تداوله دون أي مصدر. البراهين عبارة عن مصنوعات حقيقية يمكنك تجميعها. أما الرقم البالغ 10 تريليونات معامل فهو مجرد رقم كتبه شخص ما على الإنترنت. وتلك تستحق وزنًا مختلفًا تمامًا.
ما قالته OpenAI فعليًا — والقائمة الأطول بكثير مما لم تقله
لم يأتِ الإعلان على هيئة إطلاق منتج، بل جاء في صورة ورقة بحثية. وصف منشور OpenAI نتائج أنتجتها "نسخة داخلية من Astra، نموذجنا الرئيسي القادم"، وذلك في مسائل لم تشهد، وفقًا لصياغته، أي تقدم في النتيجة الرئيسية على مدى عقد على الأقل. وقد وُصفت Astra بأنها نظام مبني للعمل طويل الأمد: وكلاء متعددون يتعاونون على أجزاء مختلفة من مشكلة واحدة كبيرة على مدى فترات ممتدة بدلاً من الإجابة في تمريرة واحدة.
هذا قريب من الوصف الفني الرسمي بأكمله. وبالمقارنة به، تُعدّ قائمةُ النواقص لافتةً للنظر.
• مؤكَّد من OpenAI — الاسم أسترا؛ وأنه "النموذج الرئيسي التالي"؛ وأن نسخة داخلية أنتجت عشر نتائج؛ والنية التصميمية متعددة الوكلاء وطويلة الأفق؛ ومخطوطة من 249 صفحة؛ وشهادات Lean 4 على مستودع عام؛ وتقدير تكلفة الرموز بأسعار GPT-5.6 Sol.
• لم يُذكر من قبل OpenAI — تاريخ الإصدار؛ السعر؛ نافذة السياق؛ عدد المعاملات؛ أي نتيجة معيارية؛ بطاقة النموذج؛ ما إذا كان يصل إلى ChatGPT أو فقط عبر API؛ كم عدد الوكلاء الذين عملوا، ولأي مدة، وعلى أي أجهزة؛ المطالبات؛ معدل النجاح؛ اسم المنتج النهائي.
التقارير الموثوقة تملأ بعض التفاصيل. The Information ذكرت أن سام ألتمان عرض Astra على صنّاع السياسات في واشنطن في أواخر يوليو — وهي إحاطة، وفقًا لتلك التقارير، حضرها السناتور رافائيل وارنوك وبرني مورينو ومارك وارنر، كما حضرها وزير الخزانة سكوت بيسنت ووزير التجارة هوارد لوتنيك. وتوصف عائلة النماذج بأنها قيد الاختبار بالفعل، مع بقاء اسم "Astra" نفسه تسمية مبدئية.
لا أحد خارج OpenAI قام بتشغيل هذا النموذج على أي شيء. كل ادعاء بالقدرات المتداول يعود إما إلى البراهين العشرة المنشورة أو إلى عرض تجريبي لم يرَه الجمهور.
البراهين العشرة: يمكن التحقق منها بشكل غير معتاد، وما زالت غير محسومة

هنا يكون الإعلان أقوى حقًا من إسقاط معيار نموذجي، ومن الجدير أن نكون دقيقين بشأن السبب. لم تنشر OpenAI نتيجة وتطلب أن يُصدَّق بها. بل نشرت مخرجات قابلة للتحقق آليًا بموجب رخصة Apache 2.0 في مستودع openai/ten-proofs — ملف Lean واحد لكل نتيجة، مثبّت على إصدار Lean 4.32.0 مع اعتماد على mathlib، إلى جانب دليل ComparatorChallenges للتحقق المستقل. وصل المستودع كتغيير واحد (commit) في 1 أغسطس، ومنذ ذلك الحين حصل على عدة مئات من النجوم وعشرات من النسخ (forks).
النتائج العشر، كما يسميها المستودع، تمتد عبر مجموعة واسعة بشكل غير عادي من المجالات:
• نظرية الزمر — بناء زمرة غير صوفية، وهو إجابة بالنفي عن سؤال ظل مفتوحًا منذ عام 1999. الصوفية خاصية تحققها تقريبًا كل زمرة يتعامل معها علماء الرياضيات؛ فقد ظل سؤال ما إذا كانت كل زمرة متقطعة قابلة للعد يجب أن تحققها قائمًا لمدة 27 عامًا.
• جبر المؤثرات — مثال مضاد يتعلق بحدسية الصلابة لكونيس، التي طرحها الحائز على وسام فيلدز آلان كونيس عام 1980.
• هندسة عالية الأبعاد — تحسينٌ لطريقة تعبئة الكرات، يُعدّ الأول من نوعه منذ عام 1978 — بالإضافة إلى صيغةٍ دقيقةٍ لمتباينة الحجم لإيرهارت.
• نظرية الترميز — حدود جديدة للرموز الثنائية والكروية.
• التعقيد — حد أدنى للدوائر الحسابية للبرماننت، ونتيجة أسية للتكرار المتوازي للألعاب المتشابكة.
• تشفير الشبكات — صلابة متعددة الحدود الثابتة لمشكلة أقرب متجه.
• التوافقيات المتطرفة — مقياس النمو لأعداد رامزي للمثلثات متعددة الألوان، وأمثلة مضادة في نظرية الرسوم البيانية المتطرفة، بما في ذلك العمل على عدة مسائل إردوس المُصنَّفة.
كانت ردود فعل علماء الرياضيات مهتمة لا رافضة. توماس بلوم، القائم على قاعدة بيانات مسائل إردوس، وصف النتائج بأنها أخبار كبيرة وصنفها فوق المثال المضاد لحدسية المسافة الواحدة الذي ظهر في مايو. أما نعوم براون من OpenAI فقد قدّم التخفيض المفيد من الداخل: "للأسف، لا توجد مسائل جائزة الألفية (بعد)."
ما الذي تحسمه شهادة Lean، وما الذي تتركه مفتوحًا؟
إن برهان Lean الذي يجتاز فحص الأنواع يكون صحيحًا بحكم بنيته. لا يتعين عليك الوثوق بمنهجية تقييم OpenAI، أو اختيارها لخطوط الأساس، أو تفسيرها لنتائجها الخاصة — يمكنك تجميع الملفات. بالنسبة لصناعة حيث "لقد حققنا 94.1%" هي الوحدة القياسية للإثبات، فإن ذلك يشكل ترقية جوهرية في قابلية التكذيب.
كما أنه أضيق مما توحي به العناوين، في أربع نواحٍ محددة. يتحقق Lean من أن برهان عبارة رسمية سليم. ولا يتحقق من أن العبارة الرسمية هي النظرية التي يدّعيها النص. ولا يتحقق من أن التعريفات المشفّرة تطابق ما يعنيه المجال بتلك الكلمات. ولا يتحقق من الاختزالات غير الرسمية التي تربط النقاط الرسمية بالنتيجة الرئيسية. ولا يقول شيئًا عن الجِدّة — سواء كانت النتيجة جديدة أم معروفة سابقًا باسم مختلف.
كل هذه الأسئلة الأربعة هي مسائل حكم بشري، وحتى لحظة الإعلان لم يخضع أيٌّ منها لمراجعة محكَّمة. المخطوطة تقرّ بالتشاور مع مختصّين؛ غير أنّ الإقرارات ليست تأييدًا لكل ادعاء. في أحد البَناءات الجزئية المنشورة للمستودع، تم تجميع 8,820 من أصل 9,007 مهام، وهذا هو شكل التمثيل الرسمي الواسع الحقيقي في منتصف التحقّق، لا تدقيقًا مكتملًا. الوضع الصادق اليوم هو عشرة ادعاءات بحثية جادّة ومُشفَّرة رسميًا — وليست عشرة مدخلات مستقرة في المتن الرياضي.
هناك حد ثانٍ وأكثر هدوءًا: عملية الاكتشاف غير قابلة للتكرار من قبل أي شخص خارج OpenAI. البراهين علنية؛ نظام البحث والموجّهات ونقاط التوقف وبيئة التنفيذ ليست كذلك. يمكنك التحقق من الوجهة. لا يمكنك إعادة تشغيل الرحلة.
رقم 2,000 دولار، ولماذا يشتري أقل مما يوحي به

كان الرقم الأكثر انتشارًا هو التكلفة. قدّرت OpenAI إنفاق الرموز للحلول العشرة بنحو 2,000 دولار بأسعار معدلات GPT-5.6 Sol — أي حوالي 200 دولار عن كل مشكلة مفتوحة عمرها عقد، وفق القراءة الأكثر شيوعًا لصياغتها. قرأت بعض التغطيات الجملة نفسها على أنها أقل من 2,000 دولار لكل مشكلة، أي بفارق عشرة أضعاف؛ ومنشور OpenAI مقتضب بما يكفي لتبقى القراءتان في المطبوع، ولم نرَ الشركة توضح ذلك.
خذ القراءة الإجمالية وقم بحسابها. تفرض Sol رسومًا قدرها 5 دولارات لكل مليون رمز إدخال و30 دولارًا لكل مليون رمز إخراج، مع احتساب رموز الاستدلال كإخراج. إذا كان الإنفاق كله على الإخراج، فإن 2000 دولار تشتري على الأكثر حوالي 67 مليون رمز إخراج — أي ما يقارب 6.7 مليون لكل مسألة. هذا كثير من التفكير، وليس مقدارًا غير معقول من التفكير. إنه نوع الميزانية التي يمكن لفريق بحثي ممول جيدًا أن ينفقها بالفعل على سؤال صعب واحد.
ثلاثة تحذيرات أكثر أهمية من العنوان الرئيسي:
• إنه سعر افتراضي مضاد للواقع، وليس سعرًا.أسترا غير مطروحة وغير مسعّرة. يصف مبلغ 2000 دولار ما تلك الرموز كانت ستكلفه بأسعار نموذج آخر. نظام متطوّر مصمم لتشغيل وكلاء متعددين لساعات طويلة لا سبب واضح ليكون تسعيره كتسعير Sol، بل كل الأسباب تجعل تسعيره أعلى منه.
• يحسب الانتصارات فقط.لم يُنشر أي معدل نجاح. لا نعرف عدد المشكلات التي وُجّهت إلى Astra وفشلت في حلّها، أو ما كلفته تلك المحاولات. إن التكلفة لكل نجاح المنشورة دون معدل نجاح ليست تكلفة لكل نتيجة، وقد يصل الفارق إلى مرتبة من حيث الحجم في أي اتجاه.
• التوكنات هي الجزء الرخيص. البشر هم من صاغوا المشكلات، وأعدّوا المخطوطات، وقادوا الصياغة الرسمية. وهذا الجهد غير مشمول في الـ 2,000 دولار.
الجزء الوحيد الذي يمكنك تحديد سعره اليوم هو الخط الأساسي. لأن OrcaRouter يمرر سعر القائمة من المزود مباشرةً بهامش ربح 0%، فإن GPT-5.6 Sol يكلف نفس السعر 5$/30$ على واجهة برمجياتنا كما هو على واجهة OpenAI — لذا إذا أردت التحقق من الحسابات مقابل عبء العمل الخاص بك، فإن السعر المذكور في الإعلان هو السعر الذي ستدفعه فعليًا. ما لا يمكن لأحد تحديد سعره بعد هو Astra نفسها، وأي مورّد يخبرك بخلاف ذلك إنما يخمّن.
تاريخ الإصدار محكوم بساعة مدتها 30 يومًا، وليس بالتسريب.

معظم التغطيات حول "متى سيكون GPT-6" هي حسابات مبنية على الشائعات. هناك قيد أكثر واقعية واضح للعيان، وبالكاد تم ربطه بهذا السؤال.
وجّه أمر تنفيذي وقّع في 2 يونيو 2026 الوكالات الفيدرالية إلى إنشاء عملية مراجعة طوعية، يقدّم بموجبها مطوّرو النماذج الحدودية نماذجهم لمراجعة الحكومة قبل الإصدار العام بما يصل إلى 30 يومًا. وكان من المقرر أن يدخل الإطار حيز التنفيذ رسميًا في 1 أغسطس — نفس اليوم الذي نُشر فيه منشور أسترا. وتشير التقارير إلى أنه من المتوقع أن تكون أسترا أول نموذج يمر عبر هذه العملية.
"طوعي" تقوم ببعض العمل في هذه الجملة. عمليًا، سبق للإدارة أن اعتمدت على توقيت الإصدار من قبل، ويبدو سلوك OpenAI الأخير بمثابة بروفة: قُيّد GPT-5.6 بحوالي عشرين منظمة مُدققة اعتبارًا من 26 يونيو حتى جاء الوصول الواسع في 9 يوليو — وهو طرح مرحلي استغرق حوالي أسبوعين.
اجمع بين هاتين الحقيقتين و{{1}}ستحصل على حدٍّ أدنى تقريبي لا توقعًا دقيقًا{{/1}}. إذا خضعت أسترا لمراجعة ما قبل الإصدار لمدة 30 يومًا ثم كررت نمط GPT-5.6، {{2}}فإن التوافر الواسع يتحقق بعد نحو ستة أسابيع من التقديم{{/2}}. وتاريخ التقديم هو تحديدًا ما لا نعرفه. ولهذا السبب يجب عدم الوثوق بالمواعيد المؤكدة في أغسطس: فالخطوة الحاسمة هي عملية بمدة زمنية معلنة، ولم تبدأ الساعة في العد بشكل ملموس بعد.
تحركت أسواق التوقعات في هذا الاتجاه تمامًا. في 5 أغسطس 2026، كان سلم Polymarket "إصدار GPT-6" عند 1% لـ 7 أغسطس، و3% لـ 14 أغسطس، و13% لـ 21 أغسطس، و25% لـ 31 أغسطس، و68% لـ 30 سبتمبر، و89% لـ 31 ديسمبر، على حجم تداول يقارب مليون دولار. تعامل مع ذلك كتقدير مجمع من الجمهور، لا كمصدر — لكن لاحظ أن الجمهور نقل ثقله إلى الربع الرابع.
كما يساعد أيضًا تذكّر السجل. كل ادعاء من نوع "إطلاق GPT-6 الأسبوع القادم" خلال الاثني عشر شهرًا الماضية كان خاطئًا. تسريب غير مؤكد حدد 14 أبريل 2026 موعدًا للإطلاق؛ وما صدر فعليًا بعد تسعة أيام كان GPT-5.5.
الشائعات، مُصنَّفة
مرتبة حسب مقدار الوزن الذي يحمله كل منها فعليًا:
• التسمية لم تُحسم بعد (GPT-6 / GPT-5.7 / فئة منفصلة). مصدره The Information. الادعاء الأكثر موثوقية في هذه القصة من خارج OpenAI، وهو ما ينبغي أن يعيد ضبط التوقعات — نظام يُعلن عنه عبر ورقة رياضية قد لا يُقدَّم إطلاقًا كقفزة جيلية.
• تم رصد الاسمين الرمزيين "Zinc" و"Magnesium" في Design Arena. رصد من المجتمع، المشاركات معطلة حسب التقارير، غير مؤكد من OpenAI. يُقرأ على أنه: من المرجح أن يصدر إصدار نقطي من GPT-5.x قبل Astra، وهو ما لن يرضي توقعات أي شخص بشأن GPT-6 بينما يستحوذ على دورة الأخبار.
• حوالي ضعف حجم GPT-5.6 Sol؛ والتسعير قريب من نطاق GPT-5.6. شائعة متداولة. المسرّب الذي يقف خلفها اعترف بعدم اختباره للنموذج. تبدو معقولة لكنها غير مدعومة بأي دليل.
• نافذة سياق تبلغ 1.5 مليون توكن.يظهر في تجميعات التسريبات دون مصدر مسمى. تجدر الإشارة إلى أن Sol توفر بالفعل 1,050,000 توكن، لذا ستكون هذه زيادةً وليست قفزة — وهذا ما يجعلنا نشك في أنه تسريبٌ بارز.
• حوالي 10 تريليونات من المعلمات. لا يوجد أي إسناد في أي مكان تمكّنا من تتبعه. الرقم الأكثر تكرارًا والأقل دعمًا في القصة بأكملها.
• الذاكرة والتخصيص بوصفهما الاتجاه المحدد. استنادًا إلى تصريحات ألتمان العلنية في مقابلة أجريت في أغسطس 2025 — حقيقية، لكنها تعود لعام مضى وتتعلق بالاتجاه العام لما بعد GPT-5، وليس بـ Astra تحديدًا.
ما الذي يجب فعله بالفعل بين الآن وحين يتم إطلاقه
الخطأ هو إعادة هندسة البنية لنموذج لا يملك بطاقة تعريف. والصواب هو ملاحظة أيٍّ من مشاكلك يمكن لنظام طويل الأمد متعدد الوكلاء أن يغيّرها، لأن تلك هي أجزاء مجموعتك التقنية غير المُبنية بما يكفي اليوم، بغضّ النظر عمّا تطلقه OpenAI.
ثلاثة منها تستحق البناء الآن ضد GPT-5.6 Sol:
• سقوف التكلفة لكل مهمة، وليس لكل مكالمة.إذا كان بإمكان وظيفة واحدة أن تعمل لساعات وتستهلك ستة أو سبعة ملايين رمز إخراج، فإن حدود الطلب الواحد تتوقف عن حمايتك. أنت بحاجة إلى ميزانية ترثها المهمة بأكملها، وإيقاف صارم.
• نقاط التوقف واستئناف العمل. الاستدعاء لمرة واحدة إما يُرجع نتيجة أو يفشل. تشغيل وكيل يستمر لساعات ويموت عند الدقيقة 90 دون كتابة أي شيء دائم يُعد فئةً من الفشل المكلف لم تتعامل معها معظم قواعد الأكواد من قبل.
• تقييم تثق به في المسائل التي لا توجد لها إجابة مرجعية. البراهين العشرة مثيرة للاهتمام جزئيًا لأن Lean يوفر متنبئًا. لا شيء تقريبًا في الإنتاج يفعل ذلك. إذا لم تستطع التمييز بين تشغيل جيد لست ساعات وتشغيل سيئ يبدو معقولًا، فالمزيد من الطاقة الحاسوبية لن يساعدك.
بخصوص مسألة التبديل: Astra غير متاحة على OrcaRouter، لأنها غير متاحة في أي مكان. ما يمكننا قوله هو أن مشكلة تقلّب الإصدارات حُلّت إلى حد كبير من جانبنا. مفتاح واحد يمنحك الوصول إلى أكثر من 200 نموذج، لذا سواء طرح هذا الإصدار باسم GPT-6 أو GPT-5.7 أو مستوى رابع من GPT-5.6، فإن تبنّيه يمثل تغييرًا في سلسلة النموذج وليس ترحيلًا — لا عقد ثانٍ ولا SDK جديد. وبالنسبة تحديدًا لنموذج رائد غير مُثبت، فإن التبديل التلقائي عند الفشل هو الفرق بين تقييمه في حمل عمل حقيقي وبين المراهنة على مسار إنتاجي يعتمد نظامًا لم يختبره أحد خارج المختبر تحت الضغط. توجّه جزءًا من حركة المرور إليه، وتُبقي Sol تحته كخيار احتياطي، وتكتشف النتيجة.
أسئلة تستحق الإجابة
هل Astra هو نفسه GPT-6؟
ليس بالضرورة، وهذا هو المجهول الأكثر تأثيرًا في هذه القصة. أكدت OpenAI أن Astra هو نموذجها الرئيسي التالي لكنها لم تحدد اسم إصداره؛ وتشير التقارير إلى أن GPT-6 وGPT-5.7 وفئة منفصلة إلى جانب Sol وTerra وLuna كلها مطروحة على الطاولة. ومن الممكن تمامًا ألا يظهر نموذج باسم GPT-6 أبدًا، وأن قفزة القدرات التي كان الناس ينتظرونها تأتي تحت اسم لم يكن أحد يتابعه.
هل يمكنني الوصول إلى Astra بأي شكل اليوم؟
لا — ليس في ChatGPT، ولا عبر API، ولا عبر أي موزع أو بائع. ما هو متاح للعموم هو الورقة البحثية، وشروح الاستدلال، ومستودع Lean. إذا ادعت أي خدمة أنها تقدم الوصول إلى Astra، فهي إما تعيد بيع شيء آخر أو تكذب. الشيء الوحيد المفيد حقًا الذي يمكنك فعله مع الإصدار الآن هو تجميع البراهين بنفسك.
هل قامت "أسترا" حقًا بحل مشكلات لم يستطع علماء الرياضيات البشريون حلها؟
أنتجت براهينَ جرى التحققُ منها رسميًا لعباراتٍ ظلّت مفتوحةً لمدة عقدٍ على الأقل، وهي نتيجة حقيقية وغير مألوفة — والتحققُ يعلو بخطوةٍ عن معيار الصناعة. لكن «التحقق عبر Lean» ليس «مراجعة الأقران»، والسؤالُ التأطيري حول ما إذا كانت كل عبارة رسمية تلتقط المشكلةَ الرئيسية هو بالضبط الجزء الذي لا يستطيع Lean الإجابةَ عنه. أبدى المتخصصون الذين اطّلعوا على المخطوطات انطباعًا إيجابيًا؛ ولم يخضع أيٌّ منها لمراجعة تحكيمية. توقَّع أن تتبلور التقييمات على مدى أشهر، في أيٍّ من الاتجاهين.
هل يعني مبلغ 2000 دولار أن الأبحاث المتطورة أصبحت رخيصة الآن؟
هذا يعني أن عمليات تشغيل الرموز الفائزة كانت رخيصة، بأسعار نموذج آخر، باستثناء الإخفاقات وباستثناء البشر. كل من هذه الاستثناءات الثلاثة قد يكون كبيرًا. القراءة الصادقة هي أن التكلفة الحدية لبحث إثبات آلي ناجح انخفضت بما يكفي لتكون مثيرة للاهتمام، وليس أن عشر مشكلات مفتوحة تكلف الآن سعر حاسوب محمول.
ما الذي سيحسم هذا الأمر فعليًا؟
ثلاثة أمور محددة، ليست أيًّا منها شائعات، وكلها يمكن التحقق منها عند حدوثها.
بطاقة نموذج وصفحة تسعير. تلك هي اللحظة التي تتوقف فيها Astra عن كونها نتاجًا بحثيًا وتصبح شيئًا يمكنك التخطيط بناءً عليه — واللحظة التي يُحسم فيها سؤال التسمية من تلقاء نفسه.
إعادة بناء مستقلة لمستودع Lean على يد متخصصين يدققون التعريفات والاختزالات غير الرسمية، لا مجرد التحقق من الأنواع فقط. دليل ComparatorChallenges يوحي بأن OpenAI تتوقع هذا. إذا صمدت العبارات الرسمية أمام ذلك التدقيق، تصبح النتائج أصعب كثيرًا في التشكيك؛ وإذا ظهر عدم تطابق في واحدة فقط من العشر، تُعاد قراءة كل ادعاء في المجموعة.
دليل على أن ساعة المراجعة الفيدرالية قد بدأت. في إطار نافذة ما قبل الإصدار البالغة 30 يومًا، يُعد ذلك التقديم أقرب إشارة موثوقة لموعد الإصدار — وهو أكثر إفادة بشكل ملحوظ من لقطة شاشة أخرى لإدخال معطل في لوحة صدارة الساحة.
حتى ذلك الحين، العبارة الدقيقة ضيقة النطاق وتستحق التمسك بها: إن النموذج الرئيسي القادم من OpenAI له اسم، وعشرة براهين قابلة للتحقق آليًا، وعرض توضيحي في واشنطن، ولا شيء غير ذلك. أي شخص يقدم لك موعدًا إنما يخمن، وأي شخص يقدم لك عدد المعاملات إنما يختلقه.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
