بطاقة عنوان رئيسية مُولَّدة تحمل نص «GPT-6 Sol وGPT-6 Luna» تحت السطر العلوي «إطلاق النموذج - سبتمبر 2026»، وبعنوان فرعي «نصف السعر لكل رمز ليس نصف التكلفة لكل مهمة.»، مع أربع شرائح تحمل «GPT-6 Sol: 2.00 دولار / 10.00 دولار لكل مليون»، و«GPT-6 Luna: 0.10 دولار / 0.50 دولار لكل مليون»، و«Sol: المؤشر 48 بتكلفة 1.06 دولار لكل مهمة» و«Luna: المؤشر 37 بتكلفة 0.07 دولار لكل مهمة»، وحاشية تقرأ «الأسعار وفق OpenAI؛ المؤشر والتكلفة لكل مهمة وفق Artificial Analysis، 22 سبتمبر 2026.» ويظهر شعار OrcaRouter الحقيقي مُركَّبًا في الزاوية السفلية اليمنى.
Guides & Insights

GPT-6 Sol وGPT-6 Luna: الرمز الأرخص ليس دائمًا المهمة الأرخص

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

طرح المورّد GPT-6 Sol وGPT-6 Luna في 22 سبتمبر 2026، والعنوان في كل مكان هو السعر: Sol بسعر 2.00 دولار لكل مليون توكن إدخال و10.00 دولار للإخراج، وLuna بسعر 0.10 و0.50 دولار، وكلاهما نحو نصف ما GPT-5.6 Sol وGPT-5.6 Luna تتقاضاه بموجب الأسعار الترويجية الحالية، وكلاهما أدنى بكثير من النموذج الرائد GPT-6 Astra عند 10.00/50.00 دولار. ويستهل إعلان المورّد نفسه بعبارة "لقد جعلنا أيضًا التخزين المؤقت والاستدلال أكثر كفاءة". المشكلة في قراءة ذلك كقصة خصم هي أن الوحدة التي تصل فعليًا إلى فاتورتك ليست توكنًا، بل مهمة. وتُظهر أولى القياسات المستقلة، المنشورة في اليوم نفسه، أن النموذجين الجديدين ينجرفان في اتجاهين متعاكسين على هذه الوحدة تحديدًا — إذ يقدّم GPT-6 Luna، الأرخص بين الاثنين بعامل عشرين في الإدخال، أداءً هو الأسوأ بين الاثنين مقابل سابقه. أحد هذين النموذجين ترقية مباشرة والآخر مقايضة حقيقية، وإعلان المورّد لا يميّز بينهما.

قبل الأرقام، قواعد المصادر لهذا المقال، لأن مجموعتي الأدلة هنا تستحقان وزنًا مختلفًا تمامًا. الأسعار، ونافذة السياق، ومعدلات التخزين المؤقت، وتواريخ قطع المعرفة تأتي من وثائق واجهة برمجة التطبيقات (API) الخاصة بـ OpenAI وجداول الأسعار الخاصة بها، المقروءة في 23 سبتمبر 2026، مع تأكيد بنود طبقة الخدمة وكتابة التخزين المؤقت مقابل متتبعات التكلفة الخارجية بدلاً من أخذها من الإعلان وحده. جداول القياس المرجعي الخاصة بـ OpenAI — AutomationBench، وDeepSWE 1.1، وOSWorld 2.0، وAgents' Last Exam، وتقييم داخلي للواقعية — مُبلَّغ عنها من البائع ولم يتم إعادة إنتاجها، وكل رقم مستمد منها أدناه مُوسَم على هذا النحو. الأرقام المستقلة تأتي من Artificial Analysis، التي شغّلت كلا النموذجين على Intelligence Index وCoding Agent Index الخاصين بها في يوم الإطلاق؛ تلك هي التي يجب الوثوق بها لاتخاذ قرار. وحيث يختلف الاثنان، يذكر المقال ذلك بدلاً من حساب المتوسط بينهما.

الإطلاق، في فقرة واحدة

Sol وLuna عضوان من الفئتين المتوسطة والدنيا في عائلة GPT-6، دُرّبا بالأساليب التي تقف خلف GPT-6 Astra ويُروَّجان كطريقين أسرع وأرخص للوصول إلى معظم قدراته. تأطير OpenAI يقوم على التكلفة لكل مهمة لا على القدرة الخام: تقول إن GPT-6 Sol يرتكب نحو نصف عدد الأخطاء التي يرتكبها GPT-5.6 Sol في تقييمها الداخلي لصحة الوقائع، وإن GPT-6 Luna عند جهد استدلال أعلى يضاهي صحة وقائع GPT-5.6 Sol بتكلفة مهمة تبلغ نحو واحد على مئة من تكلفة المهمة. كلاهما يقبل إدخال النص والصورة وينتج نصًا، وكلاهما يحمل نافذة سياق تبلغ 1,050,000 رمز مع سقف إخراج 128K — ويُدرج Artificial Analysis قيمة 872k للطراز نفسه، لذا اعتبر الحد الأعلى لتلك النافذة مُعلنًا من البائع — وكلاهما يتيح جهد الاستدلال من لا شيء إلى الأقصى، وهو مستوى لا يوفره GPT-6 Astra، لأن Astra لا يملك مستوى لا شيء. معرّفات الطرازين هي gpt-6-sol وgpt-6-luna. وتتوفر عبر API، وعبر ChatGPT Work وCodex لحسابات Plus وPro وBusiness وEnterprise وEdu، وعبر Amazon Bedrock، التي أعلنت التوفر العام لكليهما في اليوم نفسه. يحصل مستخدمو Free وGo على Luna في تطبيق سطح المكتب؛ ولا يوجد أي من الطرازين في وضع الدردشة العادي بعد.

ما الذي تقوله الأرقام الأربعة المستقلة، ولماذا تختلف

ابدأ بـ GPT-6 Sol، لأن قصته بسيطة. يمنحه Artificial Analysis 48 في مؤشر الذكاء، والمرتبة 18 من 212 نموذجًا جرى قياسه، بتكلفة 1.06 دولار لكل مهمة مؤشر مقابل 1.99 دولار لـ GPT-5.6 Sol — أي نحو نصف التكلفة مقابل درجة مؤشر مماثلة، وتحسّن في التكلفة لكل مهمة يصمد بدلًا من أن يتبخر. ويرتفع مؤشر وكيل البرمجة لديه إلى 57 من 55، مع انتقال Terminal-Bench 4.0 من 37% إلى 43% وSWE-Atlas-QnA من 54% إلى 58%، بتكلفة 2.99 دولار لكل مهمة على حدود باريتو. وينخفض معدل الهلوسة لديه من 92% إلى 60%، ويتغيّر سلوك الامتناع لديه تغيّرًا كاملًا في الشكل: فهو الآن يجيب عن 83% من الأسئلة التي كان الجيل السابق يجيب عن 99% منها، وفي المقابل يحصل على ربع عدد أقل من الإجابات الخاطئة، مع انخفاض الدقة من 59% إلى 54%. هذا نموذج لُقِّن أن يصمت عندما لا يعرف، وانتقال مؤشر AA-Omniscience من 22 إلى 27 هو الحقيقة نفسها مصوغة كدرجة.

الآن GPT-6 Luna، وتتغير القصة. يمنحها Artificial Analysis 37 على مؤشر الذكاء — وهي نفس النتيجة التي تحصل عليها GPT-5.6 Luna. تنخفض تكلفتها لكل مهمة على المؤشر من 0.18 دولار إلى 0.07 دولار، أي أقل بنحو 60%، وهذا التوفير حقيقي. لكن مؤشر وكيل البرمجة لديها ينخفض، من 43 إلى 41، مع تراجع SWE-Atlas-QnA من 49% إلى 44% وDeepSWE 1.1 من 66% إلى 64%. يتحسن معدل الهلوسة لديها من 93% إلى 77%، ولا يكاد يتغير سلوك الامتناع لديها — الدقة 44% مقابل 43%، وAA-Omniscience من −10 إلى 1. وبقراءة ذلك مجتمعًا: الذكاء المقاس نفسه، بتكلفة تبلغ نحو 40% من تكلفة المهمة، مع وكيل برمجة أسوأ وجودة إجابة شبه دون تغيير.

هذا ليس تناقضًا، والسبب مهم. الرمز الأرخص لا يمنحك إلا أقل فقط إذا أنفق النموذج رموزًا أكثر لإنجاز المهمة نفسها — والبيانات المستقلة تقول إن هذه النماذج تنفق أكثر، لا أقل. ارتفع الناتج لكل مهمة فهرسة من 29 ألفًا إلى 31 ألف رمز لدى Sol ومن 41 ألفًا إلى 51 ألفًا لدى Luna. ويأتي توفير GPT-6 Luna البالغ 60% بالكامل من خفض السعر، لا من التشغيل بأقل استهلاك. انزياح عدد الرموز لكل مهمة صغير بما يكفي بحيث تظل الحسابات في صالحك هنا؛ لكنه ليس صغيرًا بما يكفي لتجاهله كفئة، لأنه الآلية التي يمكن بها تحييد خفض سعر مستقبلي بواسطة نموذج أكثر ثرثرة. وقد انتقلت صياغة OpenAI نفسها إلى التكلفة لكل مهمة للسبب ذاته.

يوجد تراجعان خارج المؤشرين الرئيسيين ويستحقان التسمية، لأن أياً منهما لا يظهر في إعلان OpenAI. في GDPval-AA v2.1، الذي يقيس مخرجات العمل المعرفي، يخسر GPT-6 Sol حوالي 100 إيلو مقابل سابقه وGPT-6 Luna حوالي 75. كما يفقد GPT-6 Luna حوالي 45 إيلو في AA-Briefcase v1.1، حيث يبقى Sol ثابتاً — وتعزو Artificial Analysis الفجوة إلى ضعف العرض وغياب عناصر التقييم. إذا كان استخدامك للفئة الرخيصة هو التلخيص والاستخراج والتصنيف بالجملة، فلا شيء من ذلك يمسك. أما إذا كان استخدامك هو صياغة شيء يوقّع عليه شخص ما، فإنه يمسك.

A generated two-column scoreboard titled 'GPT-6 Sol vs GPT-6 Luna - the scoreboard'. The left column, GPT-6 Sol, lists Intelligence Index 48, cost per index task $1.06, Coding Agent Index 57, hallucination rate 60%, GDPval-AA about 100 Elo lower, and price per million tokens $2.00 / $10.00. The right column, GPT-6 Luna, lists Intelligence Index 37, cost per index task $0.07, Coding Agent Index 41, hallucination rate 77%, GDPval-AA about 75 Elo lower, and price per million tokens $0.10 / $0.50. A footer line credits Artificial Analysis for the index, cost and hallucination figures as of September 22, 2026 and OpenAI for the prices. The real OrcaRouter logo is composited in the bottom-right corner.

تغيير التخزين المؤقت هو الخبر الحقيقي بشأن API

تحت جدول الأسعار يكمن تغيير يهم فاتورة الإنتاج أكثر من الخفض الرئيسي المعلن، وهو الجزء الذي تشير إليه تدوينة OpenAI نفسها بجملة واحدة. ثلاثة أشياء تغيرت، والثالث هو ما يستحق القراءة مرتين.

الأول هو الخصم نفسه: تُحتسب قراءات الإدخال المخزن مؤقتًا بسعر 10% من سعر الإدخال، خصم بنسبة 90%، وهو نفس الشرط الذي كانت العائلة تتحمله بالفعل وليس شرطًا جديدًا. الإدخال المخزن مؤقتًا لدى Sol هو 0.20 دولار لكل مليون و لدى Luna هو 0.01 دولار؛ تحمل كتابات الذاكرة المؤقتة علاوة 1.25x، 2.50 دولار و 0.125 دولار على التوالي، مع مدة صلاحية واحدة تبلغ 30 دقيقة.

الثاني هو التحكم. التخزين المؤقت الصريح عبر prompt_cache_options و prompt_cache_breakpoint — المعاملان اللذان يتيحان لك الإعلان عن مكان انتهاء بادئة مطالبة قابلة لإعادة الاستخدام بدلًا من الأمل في أن يخمّن المزوّد — متاحان على كلا الطرازين. هذه ليست واجهة API جديدة؛ الجديد هو أنها تستحق الاستخدام، لأن معدلات الإصابة الافتراضية ارتفعت.

الثالث هو الذي يغيّر البنية. لم يعد تغيير جهد الاستدلال أو تشغيل الأدوات وإيقافها يُبطل البادئة المخزّنة. قبل هذا، كانت حلقة الوكيل التي ترفع الجهد لخطوة صعبة وتخفضه لخطوة سهلة تدفع ثمن إعادة معالجة سياقها بالكامل عند كل تغيير، وكذلك الحال مع حلقة أضافت أداة أو أزالتها في منتصف المحادثة. هذه الكلفة زالت الآن في هذين النموذجين. تستشهد OpenAI بشركة GitHub، التي أفادت بأن التغييرات خفّضت نسبة رموز المطالبة التي تحتاج إلى معالجة جديدة بأكثر من النصف عبر مليارات الطلبات. اعتبر ذلك رقمًا مقدَّمًا من المورّد — فهو موثوق لكنه غير مدقَّق بشكل مستقل.

قم بإجراء الحسابات على حلقة وكيل طويلة، وسينقلب ترتيب الإعلانين. حلقة تحمل طلب نظام ومخطط أدوات بحجم 30,000 رمز عبر 200 دورة تنقل 6 ملايين رمز من السياق. من دون تخزين مؤقت، على GPT-6 Sol، يكون ذلك 12.00 دولارًا من المدخلات. مع تخزين البادئة مؤقتًا بسعر 0.20 دولار لكل مليون، يصبح 1.20 دولارًا بالإضافة إلى الكتابة لمرة واحدة — فرق بمقدار مرتبة قدر، من تغيير معامل، قبل تطبيق خفض السعر أصلاً. خفض السعر هو ما روّج له الإعلان. سلوك التخزين المؤقت هو ما يحرّك الرقم فعليًا، وهو السبب في أن سعرًا معلنًا قدره 2.00 دولار يتصرف كشيء أرخص بكثير على أحمال العمل التي تروّج OpenAI لهذه النماذج من أجلها.

بطاقة الأسعار، بما في ذلك الأجزاء التي يتجاهلها الإعلان

الأسعار المعلنة ليست كامل قائمة الأسعار، وثلاث فئات تُغيّر القرار بالنسبة لأحمال عمل محددة.

الأساسي — GPT-6 Sol $2.00 للإدخال / $10.00 للإخراج؛ GPT-6 Luna $0.10 للإدخال / $0.50 للإخراج، لكل مليون توكن، للطلبات التي تصل إلى 272 ألف توكن إدخال.

سياق طويل — عند تجاوز 272 ألف رمز إدخال، تُحتسبالطلب بأكملهبسعر مضاعف للإدخال و1.5x للإخراج: 4.00/15.00 دولارًا لـ Sol و0.20/0.75 دولارًا لـ Luna. هذا منحدر سعري، وليس سعرًا هامشيًا. إذا بلغت مطالباتك 300 ألف رمز، فأنت تدفع ضعف السعر على الطلب بأكمله، وليس على 28 ألفًا الزائدة عن الحد، وغالبًا ما يكون تقسيم مستند إلى نداءين دون الحد الأقصى أرخص من إرساله مرة واحدة فوقه.

مستويات الخدمة — يخفض Flex الفاتورة إلى النصف ($1.00/$5.00 لـ Sol، $0.05/$0.25 لـ Luna) مقابل زمن إنجاز أبطأ؛ ويضاعفها Priority. يتم اختيار كليهما عبر service_tier المعامل. إن Flex هو المكان الذي يُفترض أن توجد فيه المهام شبه الدفعية، لكنها لا تكاد تفعل ذلك أبدًا.

الإدخال المخزَّن مؤقتًا — ‏$0.20 لكل مليون على Sol و‏$0.01 على Luna، بخصم 90%، مع مدة صلاحية 30 دقيقة وعلاوة كتابة في الذاكرة المؤقتة بمقدار 1.25x.

السياق والمخرجات — نافذة سياق بحجم 1,050,000 رمز، ومخرجات بحد أقصى 128 ألف، وإدخال نص وصورة، وإخراج نص، وجهد الاستدلال من لا شيء إلى الأقصى مع متوسط كخيار افتراضي.

حدود المعرفة — 20 أبريل 2026 لـ GPT-6 Sol و18 مايو 2026 لـ GPT-6 Luna، أي فارق شهر واحد داخل العائلة نفسها، ويجدُر معرفة ذلك قبل أن تفترض أن النموذجين يتشاركان النظرة نفسها إلى العالم.

ما يقوله جدول المعايير الخاص بـ OpenAI، وما لا يقوله

مقارنات OpenAI المنشورة كلها قائمة على التكلفة لكل مهمة، وكلها ضد Anthropic، وكلها أجراها المورّد. في AutomationBench 1.0.6، وهو تقييم وكيلي بـ47 أداة، تُفيد الشركة بأن GPT-6 Sol عند جهد xhigh يسجل 33.2% بتكلفة $0.27 لكل مهمة، مقابل Claude Opus 5 عند 26.9% وبتكلفة تبلغ نحو 11 ضعفًا للتكلفة لكل مهمة. وفي DeepSWE 1.1 تُفيد بأن Sol عند أقصى جهد يسجل 68.8% مقابل Claude Fable 5 عند 69.9% — خسارة في النتيجة بتكلفة أقل بنحو 80% لكل مهمة — وLuna عند 66.6%. وفي OSWorld 2.0، يسجل Sol 60.5% عند xhigh مقابل 60.3% لـOpus 5، مجددًا بتكلفة أقل بنحو 80% لكل مهمة. وفي Agents' Last Exam، يصل Sol إلى 56.4%، وهو ما تقول OpenAI إنه يتفوق على أفضل نتيجة لـOpus 5 بتكلفة أقل بنسبة 60% لكل مهمة.

كل هذه الأرقام مُبلَّغ عنها من المورّد ولم تُعَد إنتاجها، وهناك تحذيران يستحقان أن نُبقيهما معنا بدل أن نحفظهما في الأرشيف. أولًا، أجرت OpenAI اختبارًا مقارنًا مع Claude Opus 5، وليس مع Claude Opus 5.5 الذي صدر قبل الإعلان بساعات، لذا لا توجد حتى الآن مقارنة على نفس منصة الاختبار تُثبت أي النموذجين يحقق فعليًا التكلفة الأقل لكل مهمة ناجحة. ثانيًا، التكلفة لكل مهمة ليست التكلفة لكل مهمة صحيحة: النموذج الذي يجيب في 83% من الحالات ويمتنع في بقيتها سيبدو رخيصًا لكل مهمة في معيار يحتسب الامتناعات كمهام. بيانات الامتناع المستقلة الواردة أعلاه هي ما يتيح لك تسعير ذلك بصدق — إن إجابة GPT-6 Sol عن 83% من الأسئلة بينما كان النموذج القديم يجيب عن 99% هي مقايضة مقصودة، وما إذا كانت مقايضة جيدة يتوقف كليًا على ما تكلفك إياه الإجابة الخاطئة.

تُفيد OpenAI بأنّ GPT-6 Luna، عند جهد أعلى، يطابق دقة وقائع GPT-5.6 Sol بتكلفة تبلغ نحو واحد من مئة من تكلفة المهمة. وهذه مقارنة وقائعية، لا مقارنة قدرات، كما أنّ Coding Agent Index المستقل يضع GPT-6 Luna أدنى بنقطتين من GPT-5.6 Luna، ناهيك عن GPT-5.6 Sol.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing the model's Intelligence Index of 48 alongside its cost per task and its output-token and speed figures for the measured reasoning-effort settings.

ما الذي يجب فعله فعلاً بهذا؟

GPT-6 Sol هو الخيار المباشر. نصف تكلفة المهمة عند درجة مؤشر المستوى، ووكيل برمجة أفضل، وانخفاض كبير في الهلوسة، وتغيّر حقيقي في سلوك الامتناع عن الإجابة، كل ذلك يفضي مجتمعةً إلى ترقية يمكنك اعتمادها وفق جدول زمني بدلًا من مقامرة. إذا كنت تستخدم GPT-5.6 Sol، فهذه هجرة، والسؤال الحقيقي الوحيد هو أيّ من مطالباتك يعتمد على استعداد النموذج القديم للإجابة عن كل شيء.

GPT-6 Luna هو النموذج الذي ينبغي اختباره قبل أن تتحرك. فهو ليس نسخة أفضل بكل المقاييس من GPT-5.6 Luna؛ بل نسخة مختلفة الشكل — أرخص لكل مهمة، وأكثر أمانًا بشأن ما ستصرّح به، وأسوأ بشكل قابل للقياس في البرمجة الوكيلية. أما للتصنيف والاستخراج والتوجيه والتلخيص بكميات كبيرة، فالمقايضة تكاد تكون مالًا مجانيًا. وبالنسبة لأي شيء يغذّي وكيل برمجة، أو ينتج مستندًا يصادق عليه شخص، فإن تراجع Coding Agent بمقدار نقطتين وانخفاض GDPval هما السبب في إبقاء GPT-5.6 Luna في المسار حتى تُشغّل مهامك الخاصة عبر كليهما.

وهذا أيضًا هو الحجة ضد تثبيت أي منهما تثبيتًا صلبًا. كلا النموذجين مقتصران على OpenAI في الوقت الحالي، والأعباء التي تخدمها هذه الطبقات — التوجيه، والاستخراج، والتصنيف الرخيص — هي بالتحديد تلك التي يحوّل فيها مزوّد ثانٍ خلف النقطة الطرفية نفسها أي تراجع في النموذج إلى أمر غير ذي أهمية. يمرّر OrcaRouter أسعار قوائم المزوّدين كما هي مقابل هامش ربح 0%، لذا يصل تغيّر معدل المورّد إلينا في اليوم نفسه الذي يصل فيه إلى المورّد، ولغة التوجيه DSL تتيح لك وضع GPT-6 Luna خلف نموذج أرخص للحصة السهلة من حركة المرور، بينما تذهب الحصة الأصعب إلى GPT-6 Sol — مع التحويل التلقائي عند الفشل إذا تدهور أي من المسارين. لستم مضطرين لاختيار فائز في يوم الإطلاق لتستفيدوا من الإطلاق.

التحفظ الصادق: لا يمكن توجيه GPT-6 Sol وGPT-6 Luna عبر OrcaRouter اعتبارًا من 23 سبتمبر 2026. نحن لا نستضيفهما بعد، ولا ينبغي تفسير أي مما سبق على أنه ادعاء بأننا نفعل ذلك. ما هو متاح لدينا اليوم هو مجموعة المقارنة — GPT-5.6 Sol بسعر $4.00/$20.00، وGPT-5.6 Luna بسعر $0.20/$1.20، وGPT-6 Astra بسعر $10.00/$50.00 — وهو بالضبط ما تحتاجه لتسعير عملية الانتقال قبل أن تلتزم بها.

Screenshot of the OrcaRouter model page for GPT-5.6 Luna, captured 23 September 2026, showing the model id openai/gpt-5.6-luna with its context window, input and output pricing per million tokens, measured time to first token and recent traffic.

ماذا تشاهد بعد ذلك

ثلاثة أمور كفيلة بأن تحسم ما كان عليه هذا الإطلاق في حقيقته. الأول هو ما إذا كان سعر GPT-5.6 Luna البالغ $0.20/$1.20 سيصمد خلال الربع، لأن السعر الدائم من مورّد واحد كان تاريخياً الخطوة الافتتاحية لا نهايته — وإصدار Claude Opus 5.5 في اليوم نفسه يشير إلى أن الضغط الذي أنتج هذا الخفض لم يزل قائماً. الثاني هو ما إذا كان التحول نحو الامتناع يصمد ميدانياً: رفض GPT-6 Sol الإجابة عن سؤال واحد من كل ستة هو نوع التغيير الذي يُقرأ كتحسين في مختبر، وكمنتج معطوب في خط أنابيب كان يفترض وجود إجابة. الثالث هو ما إذا كان سلوك الذاكرة المؤقتة حقيقياً على حركة المرور لديك، وهو أمر قابل للقياس هذا الأسبوع ولا يُجاب عنه إلا بالقياس — فالخصم كبير بما يكفي لأن تكون ساعة واحدة تُنفق على تجهيز قياس معدلات إصابة الذاكرة المؤقتة على أطول مطالباتك أكثر قيمة من جدول معايير آخر.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا