
GPT-6 Luna مقابل GPT-5.6 Luna: الاسم نفسه، ونصف السعر، ومُخرَج أسوأ
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
نموذجان، تجمعهما كلمة واحدة، ودرجة مستقلة متطابقة فعليًا. GPT-6 Luna يبلغ 37.26 على مؤشر الذكاء Artificial Analysis Intelligence Index؛ GPT-5.6 Luna بلغ 37.32. فارق 0.07 نقطة ليس قياسًا، بل هو ضجيج، وهو أهم حقيقة منفردة بشأن هذا الاقتران. ما يفصل بين النموذجين ليس القدرة — بل 0.0681 دولار لكل مهمة مكتملة في المؤشر مقابل 0.1783 دولار، ومجموعة من الانتكاسات في العمل المعرفي لا يذكرها تخفيض السعر.
تكتسي التواريخ أهمية في قراءة الأرقام. طُرح GPT-5.6 Luna في 9 يوليو 2026 بسعر 0.20 دولار لكل مليون رمز إدخال و1.20 دولار لكل مليون رمز إخراج. وطُرح GPT-6 Luna في 22 سبتمبر 2026 بسعر 0.10 دولار و0.50 دولار — أي نصف سعر الإدخال بالضبط وخصم 58% على سعر الإخراج، وهو ما وصفته OpenAI بأنه دائم وليس ترويجيًا. هذا خفض حقيقي، وهو أيضًا النصف الأصغر من القصة. أما النصف الأكبر فهو أن الطراز الأحدث طراز مختلف، وليس النموذج نفسه معاد تسعيره.

ما الذي تحققه الهجرة فعليًا، بالأرقام
ضع الاثنين جنبًا إلى جنب على الأبعاد التي تحدد الترحيل، فيكون الشكل غير متساوٍ. بعض الصفوف تتحسّن، وبعضها يتراجع، وواحد يتحسّن كثيرًا.
• السعر — GPT-6 Luna $0.10 للمدخلات / $0.50 للمخرجات لكل مليون رمز مقابل GPT-5.6 Luna $0.20 / $1.20. النصف على المدخلات، 58% خصم على المخرجات.
• الإدخال المخزّن مؤقتًا — 0.01 دولار لكل مليون مقابل 0.02 دولار. الخصم نفسه البالغ 90% على أساس مخفّض إلى النصف، لذا تكلّف البادئة المتكررة نصف ما كانت تكلّفه في يوليو.
• التكلفة لكل مهمة مكتملة — 0.0681 دولار مقابل 0.1783 دولار على نفس الحزمة. انخفاض بنسبة 62%، وهو أكبر من خفض سعر التوكن لأن مزيج المهام ليس متطابقًا.
• رموز الإخراج لكل مهمة — 50,537 مقابل 41,235. النموذج الجديد أكثر إسهابًا بنسبة 23% لكل مهمة منتهية، و78% من إخراجه عبارة عن استدلال لا يظهر في الاستجابة أبدًا.
• نافذة السياق — 1,050,000 رمز مقابل 1,000,000. السقف العملي نفسه؛ يحدّ كلاهما الإخراج عند 128,000 رمز.
• الامتناع — معدل هلوسة 76.7% على AA-Omniscience مقابل 92.6%. هذا أكبر تحسين منفرد في المجموعة، وهو ليس مكسبًا معرفيًا: تنتقل الدقة من 42.7% إلى 43.8%، أي ثابتة تقريبًا. النموذج الأحدث يمتنع بدلًا من أن يختلق، وهو تغيير سلوكي وليس تغييرًا في القدرات.
• مخرجات العمل المعرفي — ينخفض AA-Briefcase v1.1 من 1,345.38 إيلو إلى 1,299.23، وينخفض GDPval-AA v2.1 من 1,443.14 إلى 1,367.09. كلاهما منخفض، بنحو 46 و76 نقطة.
• البرمجة والعمل على المدى الطويل — يرتفع Terminal-Bench 4.0 من 11.6% إلى 12.6% وSciCode من 53.6% إلى 54.6%، وهما الصفان الوحيدان هنا اللذان يرتفعان. وفي المقابل، ينخفض Coding Agent Index من 43 إلى 41، وتتحرك التقييمات الوكيلية على نمط SWE في الاتجاه نفسه.
• AutomationBench-AA — 53.2% مقابل 50.2%. مرتفع، وبفارق أكبر من أي مقياس وكيلي آخر في المجموعة.

الانحدار في الأرتيفاكت، لا في الاستدلال.
يستحق النمط في هذين الصفين الأخيرين أن يُسمّى، لأنه القرار بأكمله. فالنموذج الجديد أفضل في إجراءات الوكيل أحادية الخطوة وأسوأ في إعادة مستند مكتمل. وتعزو Artificial Analysis تراجع العمل المعرفي إلى جودة العرض والمخرجات التي تخطّت عناصر معايير التقييم المطلوبة، لا إلى إخفاقات واقعية أو متعلقة بالاستدلال — وهو تحديدًا نوع الانحدار الذي ينجو من اختبار الدخان ويفشل في المراجعة.
اجمع الحقيقتين معًا، ينقسم الترحيل بوضوح بحسب ما يستهلك المخرجات. إذا كانت خطوط معالجتك تقرأ مخرجات منظمة — JSON، أو تصنيفًا، أو حقلًا مستخرجًا، أو قرار توجيه — فإن تراجع جودة العرض لا يكلفك شيئًا، وتحسّن الامتناع مكسب حقيقي، وانخفاض تكلفة المهمة بنسبة 62% يتحقق بالكامل. وإذا كان إنسان هو من يقرأ المُخرَج النهائي — تقريرًا، أو مذكرة، أو مستندًا موجّهًا للعميل — فإن النموذج الأحدث أسوأ بشكل قابل للقياس في الشيء نفسه الذي تدفع مقابله، والتوفير يجلب لك مراجعًا.
رقم الامتناع يستحق المعالجة نفسها. النموذج الذي ينتقل من الاختلاق في 93% مما لا يعرفه إلى الاختلاق في 77% هو كيان مختلف جوهريًا بالنسبة لضابط حماية، أو شاشة امتثال، أو أي مسار تنتشر فيه إجابة خاطئة واثقة. هذا التحسن حقيقي، ويُقاس بشكل مستقل، وهو أقوى حجة لنقل العمل إلى النموذج الجديد لا تعتمد على السعر إطلاقًا.
ما الذي يتغير في كودك، وما الذي لا يتغير؟
أقل مما يوحي به خفض سعر بهذا الحجم، وهذه هي الأخبار السارة. نافذة السياق من الفئة نفسها، والحد الأقصى للإخراج مطابق عند 128,000 رمز، وبند إعادة تسعير السياق الطويل الخاص بالعائلة دون تغيير: تُحتسب الطلبات التي تتجاوز 272,000 رمز إدخال بمعدل 2x للإدخال والتخزين المؤقت و1.5x للإخراج، على الطلب بأكمله وليس على الجزء الذي يتجاوز الحد. الطلب الذي كان مكلفًا عند 300,000 رمز على GPT-5.6 Luna يظل مكلفًا على GPT-6 Luna أيضًا — نصف المعدل، ونفس الجرف السعري، لذا فإن عبء العمل الذي كان ينبغي تقسيمه في يوليو ينبغي أن يظل مقسَّمًا الآن.
سلّم الجهد هو حيث يتغيّر السلوك لا التكلفة. يكشف GPT-6 Luna عن none وlow وmedium (الافتراضي) وhigh وxhigh وmax، والافتراضي مهم: فخط الأنابيب الذي ضُبط وفق الجهد الافتراضي لنموذج ما ليس مضبوطًا تلقائيًا وفق نموذج آخر. الفرق التي ثبّتت إعدادًا صراحةً غير متأثرة. أما الفرق التي اعتمدت الافتراضي فهي تشغّل تهيئة مختلفة عمّا كانت عليه في يوليو، وستكون العَرَضة الظاهرة حجم الرموز لا الجودة.
يستحق أحد الفخاخ إعادة ذكره لأنه لا يختفي مع النموذج الجديد. في نقطة نهاية Chat Completions، لا يعمل استدعاء الدوال إلا عندما يكون جهد الاستدلال مضبوطًا على لا شيء؛ كل مستوى جهد آخر، وكل أداة مدمجة، يتطلب Responses API. الفريق الذي ينقل حلقة استدعاء الأدوات عبر تغيير سلسلة النموذج سيجد أدواته غير متاحة بصمت عند الجهد المتوسط الافتراضي، والإصلاح هو إعادة كتابة سطح الاستدعاء وليس معاملًا.
ما يمكنك توجيهه اليوم، وما لا يمكنك توجيهه
هذا هو الجزء من الترحيل الذي لا علاقة له بمعايير الأداء. GPT-5.6 Luna متاح على OrcaRouter بسعره المدرج — 0.20 دولار لكل مليون رمز إدخال، و1.20 دولار لكل مليون رمز إخراج، ونافذة سياق تبلغ 1,000,000 رمز، وحد أقصى للإخراج يبلغ 128,000 رمز، وزمن p50 للوصول إلى أول رمز يبلغ 1.60 ثانية، مقيسًا عبر حركة المرور الحية على صفحة النموذج الخاصة بنا. نمرر أسعار القائمة من المزوّد كما هي دون أي هامش ربح، لذا في اليوم الذي أعادت فيه OpenAI تسعير هذه العائلة، أصبح التغيير ساريًا لدينا بدلًا من دورة الفوترة التالية.

GPT-6 Luna ليس قابلاً للتوجيه عبر OrcaRouter اعتباراً من 23 سبتمبر 2026. يقتصر التوافر على API الخاصة بـ OpenAI والكتالوجات السحابية التي تضم هذه العائلة، ونحن لا نُدرج نموذجاً لا نستطيع تقديمه. والنتيجة العملية هي أن الفريق الذي يخطط لهذا الترحيل يمكنه نقل التسعير اليوم ولا يمكنه نقل التوجيه اليوم — إذ يقع نصفا التغيير في تاريخين مختلفين.
ما يجعل ذلك ممكنًا في الوقت نفسه هو الترتيب الذي سينتهي معظم الفرق إلى الرغبة فيه على أي حال. أبقِ GPT-5.6 Luna على المسارات التي يكون فيها المخرج النهائي هو المنتج، وشغّل GPT-6 Luna حيثما تُستهلك المخرجات بواسطة الشيفرة، وتعامل مع الحدّ كطبقة بدلًا من إعادة كتابة. ولأن النماذج التي يمكنك الوصول إليها تقع خلف نقطة نهاية واحدة تضم أكثر من 200 نموذج على المفتاح نفسه مع تجاوز تلقائي للفشل عبر المزوّدين، فإن إضافة طبقة أو إزالتها تصبح مدخلًا في الإعدادات بدلًا من تكامل ثانٍ — كما أن مسار التصعيد يتوقف عن الاعتماد على توفر أي نموذج بعينه.
قرار الترحيل، مصوغ بوضوح
انقل العمل إلى حيث تكون المخرجات مقروءة آليًا وشرط النجاح قابلًا للتحقق. التصنيف، والاستخراج، وقرارات التوجيه، واستدعاءات ضوابط الحماية، وتمريرات التحويل الجماعية، وإجراءات الوكيل أحادية الخطوة — كلها تنطبق: المركّب لم يتغيّر، وسلوك الامتناع أفضل بشكل ملموس، وتكلفة المهمة انخفضت بنحو 62%. مع Batch بنصف المعدلات القياسية، والمدخلات المخزّنة مؤقتًا بعُشر سعر أساس مخفّض إلى النصف، يمكن لخط أنابيب كان هامشيًا في يوليو أن يصبح مباشرًا الآن.
لا تنقل العمل الذي يعتمده شخص على الناتج، ولا تنقل مسارات وكيل البرمجة بشكل أعمى. إن انخفاض AA-Briefcase بمقدار 46 نقطة وانخفاض GDPval بمقدار 76 نقطة هما رقمان صغيران يشيران في الاتجاه نفسه الذي يشير إليه انخفاض بنقطتين في Coding Agent Index، ونمط الفشل الذي يصفه Artificial Analysis — عناصر معايير مُتجاهَلة، وعرض أضعف — غير مرئي لفحص آلي. أبقِ النموذج السابق حيث يكون الإتقان هو المُسلَّم.
وتعامل مع تعادل المؤشر بفارق 0.07 نقطة بوصفه النتيجة الجوهرية التي هو عليها فعلًا. فهذا ليس نموذجًا أذكى بسعر أقل، بل هو نموذج مختلف الشكل بسعر أقل، والسؤال الذي يجب أن تجيب عنه أي خطة ترحيل هو أي شكل يستهلكه عبء العمل لديك — لا أي الدرجتين أعلى، لأن هاتين الدرجتين هما الرقم نفسه في السجل المستقل.
