
واجهة برمجة تطبيقات القرارات من OpenAI: GPT-6 Luna يتوقف عن الدردشة ويختار إجابة واحدة
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 393 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 209 tok/s
- OrcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- xAISpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
GPT-6 Luna صدر في 22 سبتمبر 2026 كأرخص درجة في سلّم GPT-6 من OpenAI. الجديد في 29 سبتمبر هو مهمة له لا علاقة لها بالمحادثة. تأخذ Decisions API من OpenAI سؤالًا كتبته، وقائمة منتهية من الإجابات التي تسمح بها، وقطعة من السياق — نص أو صورة — وتعيد إحدى تلك الإجابات. ليس نثرًا. وليس فقرة لتحلّلها وتأمل خيرًا. بل اختيار واحد فقط، بحيث تذهب تذكرة دعم إلى أحد خمسة طوابير، أو تندرج صورة في فئة إشراف واحدة، أو يختار وكيل خطوته التالية من سياسة حددتها أنت. أُعلن عنها في DevDay 2026 وهي الآن في معاينة محدودة، وتقول OpenAI إن إطلاقًا واسعًا مخطط له خلال الأيام المقبلة.
معظم ما يحتاجه الفريق قبل أن يبني على هذا لم يُنشر بعد. لا يوجد سعر لكل استدعاء، ولا حد معلن لعدد الإجابات المرشحة التي يمكن أن يحملها الطلب، ولا بيان حول ما إذا كان يمكنك ضبطه على بياناتك الخاصة، و—حتى 30 سبتمبر—لا يوجد مدخل له في أي مكان في فهرس وثائق المطورين الخاص بـ OpenAI، أو سجل التغييرات، أو مرجع API. لقد تحققنا من الثلاثة جميعًا. توجد هذه القدرة حاليًا في ملخص DevDay من OpenAI وفي ما قاله متحدث باسم OpenAI للصحفيين يوم الإطلاق. لذلك تُبقي بقية هذه المقالة ثلاث طبقات منفصلة على نحو واضح: ما أكدته OpenAI، وما يدّعيه قياس واحد من يوم الإطلاق، وما لا يمكن لأحد معرفته بعد.
ما هو القرار المقيّد في الواقع
هناك نهجان قائمان يقومان بهذه المهمة بشكل سيئ، وتستهدف واجهة Decisions API الفجوة بينهما. الأول هو توجيه نموذج محادثة: تكتب تعليمات دقيقة تطلب منه الاختيار من قائمة، فيكتب لك جملة، وإذا كنت محظوظًا يمكنك قراءة احتمالات الرموز من الاستجابة للحصول على شيء يشبه درجة الثقة. إنه يعمل، لكنه يستهلك الرموز، ورقم الثقة تخمين تقريبي. الثاني هو تدريب مصنّف صغير: سريع، ورخيص، ويحتاج إلى بيانات موسومة بالإضافة إلى تشغيل إعادة تدريب في كل مرة تتغير فيها مجموعة التسميات.
يقع نموذج قرار بين هذين. فهو يقبل تسميات جديدة في الموجّه — تمامًا كما يفعل أي موجّه — لكنه يعيد درجة أو اختيارًا يستطيع المطوّر أن يتفرّع بناءً عليه دون تحليل، وهي الخاصية التي امتلكها المصنّف ولم يمتلكها نموذج محادثة قط. ليست OpenAI جديدة على هذا الشكل: فقد ظلّت Moderation API التابعة لها تعيد درجات لكل فئة بدلًا من نص لسنوات، مع فارق واحد مهم هنا. فئات Moderation هي فئات OpenAI. أما فئات Decisions API فهي فئاتك.
القيد هو المنتج، ويستحق الأمر أن نكون دقيقين بشأن ما يمنحه وما لا يمنحه. إن مساحة الإخراج المحدودة تعني أن كل قيمة مسموح بها معروفة مسبقًا، لذا يمكن لتطبيقك أن يرفض إجابة لم يعرّفها، وأن يربط مستوى صلاحيات مختلفًا بكل فرع، وأن يلجأ إلى إنسان عندما تكون الثقة أو السياق ضعيفين. كما أنها تجعل التقييم دون اتصال قابلًا للمعالجة، لأن كل حالة اختبار لها فئة مستهدفة وكلفة قابلة للقياس عندما تكون خاطئة. أما ما لا يمنحه فهو الصحة. فالنموذج المقيّد يمكنه مع ذلك أن يختار إجابة صالحة لكنها خاطئة، أو أن يُوجَّه بسياق مضلِّل، أو أن يرث تحيّز الفئات التي كتبتها.
ادعاء الـ150 مللي ثانية، والرقم الذي لم تنشره OpenAI
تقول OpenAI إن Decisions API تتخذ القرارات أسرع بنحو عشر مرات مما يفعله GPT-6 Luna عبر API العادية — في حدود 150 مللي ثانية مقابل نحو 1.6 ثانية. هذا الرقم مذكور من المورّد ولم يُعَد إنتاجه؛ فلا يوجد قياس مستقل له خلال اليومين المنقضيين منذ الإطلاق، ولا يقول ملخص OpenAI نفسه سوى «اتخاذ القرارات في الوقت الفعلي». ولا يصحب هذا الرقم أي توزيع لزمن الاستجابة، ولا منطقة، ولا حجم مدخلات، ولا مستوى تزامن، ولا اتفاقية مستوى خدمة.
بيانات المرور الخاصة بنا ليست بديلاً عن ذلك الاختبار، لكنها تشرح لماذا يهم التوزيع المفقود. على مدى الأيام السبعة المنتهية في 30 سبتمبر، يُظهر GPT-6 Luna المُقدَّم عبر مسار chat-completions العادي لدى OrcaRouter وسيطًا قدره 699 ميلي ثانية وp95 قدره 7.6 ثانية عبر 3.23 مليار رمز من أحمال عمل مختلطة — فارق يتجاوز مرتبة مقدارية واحدة بين الوسط والذيل. هذا شكل طلب مختلف عن قرار مقيّد، لذا ليس مقارنة بادعاء 150 ms. وهو السبب في أن رقم p50 رئيسي واحد هو الرقم الخاطئ لتصميم مهلة حوله. إذا اختبرت الإصدار التجريبي، فسجّل الوسيط وp95 وp99 بشكل منفصل لمدخلات النص والصور، وضمّن زمن الشبكة وإعادات المحاولة، وقِس المهلة التي يمتلكها منتجك فعلاً — قرار توجيه لقائمة انتظار غير متزامنة وقرار يقع بين نقرة ودفعة لا يتشاركان ميزانية زمن وصول.

التسعير: تكلفة النموذج الأساسي، ولماذا لا يمثل ذلك سعر API
لم تنشر OpenAI أي سعر لـ Decisions API. كما أنه ليس من الآمن افتراض أن أسعار رموز Luna تنطبق، لأن Decisions API هي حزمة قائمة بذاتها — نقطة نهاية مختلفة بحدود مختلفة، وقد قالت OpenAI إنها ستشارك مزيدًا من التفاصيل «عند الطرح الواسع». أي شخص يقدم لك الآن تكلفة لكل قرار فإنه يستنتجها.
ما يُنشر هو بطاقة أسعار النموذج الذي بُني عليه، كما وردت في صفحة أسعار OpenAI بتاريخ 30 سبتمبر 2026:
• الإدخال — $0.10 لكل مليون رمز، ويصبح $0.20 فوق 272,000 رمز إدخال
• الإخراج — $0.50 لكل مليون رمز، ويصبح $0.75 فوق 272,000 رمز إدخال
• الإدخال المخزّن مؤقتًا — $0.01 لكل مليون رمز؛ وتُحتسب عمليات كتابة الذاكرة المؤقتة بسعر $0.125، أي بعلاوة 25% على السعر غير المخزّن مؤقتًا
• معالجة الدفعات وFlex — 50% من الأسعار القياسية؛ الوضع السريع — ضعف الأسعار المطبقة
الخط الفاصل للسياق الطويل هو ما يفاجئ الناس، وهو يعمل بالطريقة نفسها عبر عائلة GPT-6: تجاوز 272,000 رمز إدخال يعيد تسعير الطلب بأكمله بالفئة الأعلى، وليس فقط الفائض. إن واجهة برمجة تطبيقات القرار التي تسلّم مستندًا طويلًا أو مجموعة صور كبيرة إلى النموذج هي بالضبط نوع الاستدعاء الذي يمكن أن يتجاوز هذا الخط، وهو أمر آخر تتركه حدود المعاينة غير المنشورة مفتوحًا.
GPT-6 Luna بشروطها الخاصة
إذا أزلنا واجهة API، فإن النموذج الكامن تحته هو نموذج استدلالي في أسفل عائلة من ثلاث درجات — دون GPT-6 Sol بسعر 2.00$/10.00$ و GPT-6 Astra الرائد بسعر 10.00$/50.00$ — بنافذة سياق تبلغ 1,050,000 رمز، وحد أقصى للإخراج يبلغ 128,000 رمز، وتاريخ قطع المعرفة 18 مايو 2026، وجهد الاستدلال قابل للضبط عبر ست قيم من لا شيء إلى الأقصى. وهو يستقبل مدخلات نصية وصورية ويعيد نصًا، وفي وثائق OpenAI للمطورين، فإن القيمة الافتراضية لجهد الاستدلال هي متوسط. وهناك تحذير عملي من نفس الصفحة، لا علاقة له بـ Decisions API ولكنه ذو صلة إذا كنت تقوم بتوصيل Luna كخيار احتياطي: في Chat Completions، لا يعمل استدعاء الدوال إلا عندما يتم ضبط جهد الاستدلال على لا شيء. الأدوات على أي إعداد جهد آخر تحتاج إلى Responses API.
من حيث الجودة، الرقم المستقل هو Intelligence Index من Artificial Analysis عند 37.3 لـ Luna بأقصى جهد، مقابل 47.5 لـ GPT-6 Sol — فجوة تبلغ نحو عشر نقاط، وهي الطريقة الصادقة لقراءة فجوة السعر البالغة عشرين ضعفًا في المدخلات. لا يمثل أي من الرقمين تصريحًا بشأن Decisions API، التي تُعد مهمتها المقيّدة قياسًا مختلفًا تمامًا وليس لها درجة منشورة.

جيف، ولايا، وتأطير «النظام الأول»
لم تصل واجهة برمجة تطبيقات القرارات إلى حقل فارغ. لـ TypeSafe AI Jev، الذي تم إطلاقه في 15 سبتمبر 2026 بواسطة Diogo Almeida ومتاح بشكل عام منذ 21 سبتمبر، هو النموذج الذي جعل هذه الفئة مفهومة للمطورين: إنه لا ينتج أي نص على الإطلاق، بل يعيد إجابات مكتوبة بقيم ثقة بدلاً من ذلك، بسعر 0.042 دولار لكل مليون رمز إدخال مع احتساب الإخراج بصفر. أول اختبار مستقل لـ Jev، أجرته Every، وضع 777 حكمًا عبر 37 مستندًا في أقل من 0.7 ثانية مقابل ربع سنت تقريبًا، واختبار ثانٍ قاسه عند وسيط 0.35 ثانية لكل مقطع مقابل 8.83 ثانية لـ Claude Fable 5.1 بجهد عالٍ — أسرع بنحو 25 مرة بتكلفة تقريبية 1/580، مع اكتشاف ستة من سبعة عيوب مزروعة عمدًا حيث اكتشف Fable 5 السبعة جميعها. "جيد ولكن ليس مثاليًا" كان حكم Every، وهو القراءة الصحيحة في سطر واحد. Laya هي المشارك الثالث بنفس الشكل، نموذج قرار يجيب دون كتابة أي رمز.
ما إذا كانت OpenAI قد أنشأت Decisions API بسبب Jev هو مجرد تكهن. وصفت The New Stack، في تقريرها يوم الإطلاق، ردّ الفعل على TypeSafe بأنه «مرجّح»، وأشارت إلى أن OpenAI على الأرجح استعجلت الإعلان قبل DevDay؛ ولم تقل OpenAI شيئًا من هذا القبيل، والتوقيت — الإتاحة العامة لـ Jev في 21 سبتمبر، وDevDay في 29 سبتمبر — مثير للانتباه لكنه ليس دليلًا. وما ليس تكهنًا هو أن الاثنين ليسا بعد قابلين للمقارنة على المحور الذي يهم المشترين. Jev تنشر سعرًا، وشكلًا لكل استدعاء، وتاريخ الإتاحة العامة (GA). أما Decisions API فلا تنشر أيًا من تلك الثلاثة.
حيث يعمل، وما يجب إبقاؤه دافئًا بجانبه
واجهة Decisions API هي التغليف الخاص بـ OpenAI. إنها ليست نموذجًا في كتالوجنا ولا نوجّهها، لذا إذا كنت تريد نقطة النهاية هذه تحديدًا، فإن OpenAI هي التي تستضيفها. أما النموذج الذي بُنيت عليه فهو أمر مختلف: GPT-6 Luna هو مسار نشط على OrcaRouter بسعر القائمة لدى OpenAI مع عدم تمرير أي هامش ربح — $0.10 للإدخال و$0.50 للإخراج لكل مليون توكن، مع احتساب شريحة >272K عند $0.20/$0.75 — وخلال الأيام السبعة المنتهية في 30 سبتمبر، قدّم عبرنا 3.23 مليار توكن بمعدل خطأ 0.18%.
هذا مهم لكيفية تقليل المخاطر عند تجربة إصدار تجريبي. الطريقة المعقولة لاختبار نقطة نهاية ذات قرار مقيّد هي إبقاء المسار القائم على المطالبات دافئًا كخيار احتياطي، لأن الإصدار التجريبي قد يغيّر الحدود أو التسعير دون إشعار، والقرار الواقع على مسار حرج يحتاج إلى مكان يذهب إليه. إبقاء هذا الخيار الاحتياطي على المفتاح نفسه الذي تستخدمه لنماذجك الأخرى يعني عدم الحاجة إلى عقد ثانٍ وعدم تغيير الشيفرة في مسار الاحتياط: واجهة API واحدة لأكثر من 200 نموذج، مع تجاوز الفشل التلقائي عبر المزوّدين عندما يتعثر أحدهم. وإذا كان قرارك خطوة واحدة في سلسلة أطول، فإن لغة توجيه DSL تجمع النماذج في استدعاء واحد، وهو بالضبط نمط المنسّق مع متخذ القرار الذي روّجت له تغطية Jev — نموذج أكبر يخطط، ونموذج صغير يختار كل خطوة. هذا النمط قابل للبناء اليوم من النماذج التي نقدّمها؛ أما Decisions API نفسه فسيظل خارجها حتى تفتحه OpenAI.
من الذي يجب أن يتحرك، ومن الذي يجب أن ينتظر؟
إذا كانت مشكلتك مهمة تصنيف أو توجيه عالية الحجم يكون فيها الفرع الخاطئ رخيصًا وقابلًا للتراجع، فإن المعاينة تستحق شكل طلب ومجموعة موسومة هذا الأسبوع — فالقدرة حقيقية، والقيد تحسين حقيقي على تحليل النثر، والمعاينة هي أرخص وقت ممكن لتكتشف أين تقع تكاليف أخطائها. وإذا كان قرارك يأذن بصرف المال، أو يرسل رسالة إلى عميل، أو يقع بين مستخدم وعملية دفع، فلا شيء في هذا الأسبوع يغيّر حساباتك: فلا سعر منشور لتبني عليه نموذجًا، ولا حد منشور تصمم حوله، ولا اتفاقية مستوى خدمة (SLA)، ولا أي كلمة عمّا إذا كان بإمكانك ضبط الشيء على بياناتك الخاصة. هذه الفراغات الأربعة هي ما يجب أن يملأه "الإطلاق الواسع"، وإلى أن تسمّيها OpenAI، فإن القراءة الصادقة لواجهة Decisions API هي واجهة واعدة بساعة سريعة معلنة من المورّد وبلا فاتورة مرفقة.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
