تم إنشاء بطاقة عنوان رئيسية بعنوان 'GPT-6 Luna vs Qwen3.8-Max' مع عنوان فرعي 'أرخص نموذج هنا ليس هو النموذج الذي يشاهد الفيديو'، وتذييل نصّه 'الأسعار وفقًا لـ OpenAI و Alibaba Cloud؛ وأرقام المؤشر وفقًا لـ Artificial Analysis.'، وشعار OrcaRouter مركّب في أسفل اليمين.
Guides & Insights

GPT-6 Luna مقابل Qwen3.8-Max: النموذج الأرخص في هذه المقارنة هو أيضًا الوحيد الذي يشاهد الفيديو

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

التأطير البديهي لهذا الاقتران هو التأطير الخاطئ. Qwen3.8-Max يُسعّر بـ2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج، مع قراءات الذاكرة المؤقتة بـ0.25 دولار. GPT-6 Luna يُسعّر بـ0.10 دولار و0.50 دولار مع قراءات الذاكرة المؤقتة بسنت واحد. عشرون ضعفًا في الإدخال، واثنا عشر ضعفًا في الإخراج، وخمسون ضعفًا في الإدخال المخزَّن مؤقتًا — فجوة سعرية واسعة إلى حد أن المقارنة تبدو محسومة قبل أن تبدأ.

الأمر لم يُحسم، لأن النموذجين لا يتنافسان على الطلب نفسه. يقبل Qwen3.8-Max النص والصورة والفيديو، وسقفه الإخراجي البالغ 131,072 رمزًا يزيد قليلًا على 128,000 لدى GPT-6 Luna. أما GPT-6 Luna فلا يقبل سوى النص والصورة. يسجّل نموذج علي بابا 58 في Intelligence Index المستقل — الأول في فئته على لوحة الوكلاء — بينما يسجّل GPT-6 Luna 37 عند أقصى جهد، و29 في وضعه الافتراضي. أحدهما نموذج رائد ذو سلالة مفتوحة الأوزان ووسيط إدخال فيديو. والآخر فئة كمية ذات رقم سرعة وسعر تخزين مؤقت يبلغ سنتًا واحدًا. فجوة السعر ليست خصمًا على الشيء نفسه؛ بل هي وصف لشيئين مختلفين.

ما هو كل واحد من هذين

Qwen3.8-Max هو الطراز الرائد من الجيل 3.8 لدى علي بابا، وهو نقطة تحقق من فئة Max صدر نموذجه الأساسي — Qwen3.8-2.4T-A95B — علنًا بموجب ترخيص مخصص في 12 أغسطس 2026، مما يجعله أول نموذج Qwen من فئة Max تتوفر له أوزان مفتوحة على الإطلاق. أما الطراز الرائد المستضاف نفسه فلا تزال اللوحة المستقلة تدرجه على أنه مملوك احتكاريًا. وهو يحمل نافذة سياق تبلغ 1,000,000 رمز، وحدًا أعلى للإخراج يبلغ 131,072 رمزًا، ويدعم إدخال النص والصورة والفيديو، مع إمكانية اختيار جهد الاستدلال عند منخفض أو متوسط أو عالٍ جدًا. ويتوفر إصدار Qwen3.8-Max-0902 مثبت بالسعر نفسه، وهو تفصيل صغير ذو قيمة تشغيلية حقيقية.

GPT-6 Luna هو فئة الكفاءة لدى OpenAI من 22 سبتمبر 2026، وتقع دون GPT-6 Sol بسعر 2.00/10.00 دولار، ودون النموذج الرائد GPT-6 Astra بسعر 10.00/50.00 دولار. نص وصورة كمدخلات، ونص كمخرجات، ونافذة بحجم 1,050,000 رمزًا مع حد أقصى للمدخلات يبلغ 922,000، وسقف للمخرجات يبلغ 128,000 رمزًا، ومستوى الجهد من none إلى low وmedium وhigh وxhigh وmax مع medium كافتراضي. مغلق، بمعرّف واحد، ومتاح لأي شخص يملك مفتاح API.

أحدهما يقبل الفيديو ويمكن تنزيله في شكله الأساسي. والآخر يقبل الصور وهو سريع. كلاهما مسعّر لاستخدامه بكميات كبيرة. التداخل بين هذين القولين أصغر مما توحي به نسبة السعر.

البطاقات، سطرًا بسطر

سطر واحد لكل بُعد، وكلا الجانبين على كلٍّ منها:

• الإدخال لكل مليون — GPT-6 Luna $0.10 مقابل Qwen3.8-Max $2.00

• الإخراج لكل مليون — GPT-6 Luna ‏0.50 دولار مقابل Qwen3.8-Max ‏6.00 دولار

• المدخلات المخزّنة مؤقتًا لكل مليون — GPT-6 Luna $0.01 مقابل Qwen3.8-Max $0.25 لقراءات الذاكرة المؤقتة الضمنية، مع قراءة ذاكرة مؤقتة صريحة بسعر $0.17 وكتابة ذاكرة مؤقتة صريحة بسعر $2.50

• بند السياق الطويل — يضاعف GPT-6 Luna المدخلات والذاكرة المؤقتة ويرفع المخرجات 1.5× فوق 272,000 رمز إدخال، ويُطبَّق على الطلب بأكمله، مقابل Qwen3.8-Max الذي يوفّر شريحة ثابتة عبر النافذة الكاملة، وهو المكان الوحيد الذي تكون فيه بطاقة Qwen أفضل هيكليًا بدلًا من كونها أرخص بشكل هامشي

• نافذة السياق — GPT-6 Luna 1,050,000 رمز مقابل Qwen3.8-Max 1,000,000 رمز

• الحد الأقصى للإخراج — ‏128,000 رمز لـ GPT-6 Luna مقابل ‏131,072 رمز لـ Qwen3.8-Max

• وسائط الإدخال — GPT-6 Luna: نص وصورة مقابل Qwen3.8-Max: نص وصورة وفيديو

• جهد الاستدلال — GPT-6 Luna: بلا، منخفض، متوسط (افتراضي)، مرتفع، مرتفع جدًا، أقصى مقابل Qwen3.8-Max: منخفض، متوسط، ومرتفع جدًا

• مؤشر الذكاء، مستقل — GPT-6 Luna 37 عند أقصى جهد مقابل Qwen3.8-Max 58

• Agentic Index، مستقل — Qwen3.8-Max 58، الأول في فئته؛ لم يُنشر رقم مماثل لـ GPT-6 Luna

• درجة الجهد الافتراضي — GPT-6 Luna 29 عند إعداده الافتراضي المتوسط مقابل Qwen3.8-Max مقيسًا عند أقصى إعداد له

• تكلفة كل مهمة Index، بصورة مستقلة — GPT-6 Luna نحو 0.07 دولار مقابل Qwen3.8-Max 5.41 دولار

• GDPval، مستقل — Qwen3.8-Max 1,739 Elo عند 64 دورًا لكل مهمة، وهو ما يعادل نحو 1.14 دولار لكل مهمة مكتملة في ذلك التقييم؛ ولم يُنشر أي تشغيل مماثل لـ GPT-6 Luna

• معدل الهلوسة في AA-Omniscience — Qwen3.8-Max 40%، وهو تراجع من 23% في الجيل السابق؛ GPT-6 Luna 77%، بانخفاض من 93%

• لقطة مؤرخة — GPT-6 Luna معرّف واحد متدحرج مقابل Qwen3.8-Max-0902 متاح كمراجعة مثبّتة بتاريخ 2 سبتمبر 2026 بالسعر نفسه

• الأوزان — GPT-6 Luna مغلق، عبر API فقط، مقابل Qwen3.8-Max: نقطة التحقق الأساسية Qwen3.8-2.4T-A95B متاحة للعموم بموجب ترخيص مخصص منذ 12 أغسطس 2026، بينما يُدرج الطراز الرائد المستضاف باعتباره مملوكًا.

• على OrcaRouter — GPT-6 Luna غير موجود في كتالوجنا مقابل Qwen3.8-Max قابل للتوجيه بسعر Alibaba المعلن

Generated two-column scoreboard titled 'GPT-6 Luna vs Qwen3.8-Max - the scoreboard'. Left column GPT-6 Luna rows: Price in/out $0.10 / $0.50, Cached input $0.01, AA Index 37 at max effort, Context 1,050,000, Input text + image, Cost per index task $0.07. Right column Qwen3.8-Max rows: Price in/out $2.00 / $6.00, Cached input $0.25, AA Index 58, Context 1,000,000, Input text + image + video, Cost per index task $5.41. Footer: 'Prices per OpenAI and Alibaba Cloud; index figures per Artificial Analysis.'

الفيديو ليس خط ميزات، بل هو عبء عمل مختلف

صف النمط هو الذي يحسم مقارنات حقيقية أكثر من صف السعر، وعادةً ما يُقرأ كمربع اختيار.

يقبل Qwen3.8-Max الفيديو، أما GPT-6 Luna فلا يقبله. وإذا كانت خط أنابيبك بحاجة إلى الاستدلال على تسجيل شاشة، أو عرض توضيحي لمنتج، أو تسجيل محاضرة، أو مقطع من كاميرا مراقبة، أو جولة في واجهة مستخدم، فإن المقارنة تنتهي عند هذا الحد، ويصبح فارق السعر البالغ عشرين ضعفًا غير ذي صلة — فأنت لا تختار بين خيار باهظ وخيار رخيص، بل تختار بين خيار ولا خيار. إن استخراج الإطارات وتمريرها كصور ليس إلا حلًا التفافيًا، وليس بديلًا مكافئًا، ومن بنى شيئًا كهذا يعرف الفرق في التكلفة والجودة معًا.

إذا كانت خطوط معالجتك تتألف من النصوص والصور، فإن خط الوسائط يبقى صامتًا وخط السعر يتحدث. هذا هو الانقسام الصادق، ويستحق الأمر أن تكون صريحًا بشأن أي جانب منه تقف عليه قبل قراءة أي شيء آخر في هذه الصفحة.

الفجوة الوكيلية حقيقية، وهي النصف المكلف من فرق السعر.

يسجّل Qwen3.8-Max 58 على مؤشر الذكاء المستقل. ويسجّل GPT-6 Luna 37 عند أقصى جهد و29 عند وضعه المتوسط الافتراضي. واحد وعشرون نقطة عند إعدادات متطابقة، وتسع وعشرون عند الإعدادات الافتراضية — على مقياس مركّب تكون فيه نقطة واحدة ضمن ضوضاء إعادة التشغيل، فإن فجوة بهذا الحجم ليست ضوضاء.

يتركّز موقع Qwen3.8-Max في العمل الوكيلي. فهو يسجّل 58 في مؤشر Agentic Index المستقل، وهو الأول في فئته، و1,739 من نقاط Elo في GDPval عند 64 دورة لكل مهمة. وهذا الرقم الأخير هو الأكثر دلالة، لأنه قياس لقدرة نموذج على الحفاظ على تماسك مهمة عبر أربع وستين قرارًا متتابعًا، ويأتي مصحوبًا بثمن: نحو 1.14 دولار لكل مهمة مكتملة في ذلك التقييم. قارن ذلك بتكلفة GPT-6 Luna لكل مهمة في المؤشر، البالغة نحو 0.07 دولار، فيكون القول الصادق ليس أن Qwen مكلف. بل أن Qwen يُطلب منه أن يفعل شيئًا أصعب بكثير، وهو يفعله.

النتيجة اللازمة هي أن عجز GPT-6 Luna البالغ واحدًا وعشرين نقطة ليس موزعًا بالتساوي عبر عبء عملك أيضًا. في مهمة قصيرة، ومحددة جيدًا، ويستهلكها برنامج — استخرج هذا الحقل، وصنّف هذه التذكرة، ووجّه هذا الطلب — سيُنتج كلا النموذجين الإجابة نفسها القابلة للاستخدام في nearly كل الأوقات، وستكون فجوة المؤشر غير مرئية في تقييمك. أما في مهمة تتطلب أربعًا وستين إجراءً متسلسلًا مع نقطة تحقق في النهاية، فالفجوة هي الفرق بين الإنهاء والتوقف بهدوء في منتصف الطريق، وتلك هي المهمة التي صُمم من أجلها Qwen3.8-Max ولم يُصمم من أجلها GPT-6 Luna.

هناك رقم واحد يسير في الاتجاه المعاكس ويستحق أن يُذكر لا أن يُطمر. معدل الهلوسة لدى Qwen3.8-Max على لوحة المعرفة الشاملة هو 40%، ارتفاعًا من 23% في الجيل السابق — تراجع كبير، ومن النوع الذي يظهر في الإنتاج على هيئة إجابات خاطئة واثقة لا على هيئة سطر في اختبار معياري. أما GPT-6 Luna فمعدله 77%، انخفاضًا من 93%. والرقمان مرتفعان بالقيمة المطلقة، ولا يزال النموذج الأرخص هو الأسوأ بين الاثنين في هذا المقياس. ولا يُعد أي من الرقمين سببًا لتفضيل أحد النموذجين؛ بل كلاهما سبب للإبقاء على إنسان أو مدقق في الحلقة بشأن أي شيء تكون فيه حقيقة مُفبركة مكلفة.

عبارة السياق الطويل هي السطر الوحيد الذي يتفوق فيه Qwen من حيث البنية.

يتضمن GPT-6 Luna بندًا لا يتضمنه Qwen3.8-Max: تُحتسب الطلبات التي تتجاوز 272,000 رمز إدخال بمعدل ضعف معدلات الإدخال والتخزين المؤقت و1.5× معدل الإخراج، ويُطبَّق ذلك على الطلب بأكمله بدلًا من الجزء الذي تجاوز الحد. استدعاء واحد بطول 300,000 رمز على GPT-6 Luna تُحتسب تكلفته بمعدل 0.20 دولار لكل مليون رمز إدخال لكامل الرموز الـ300,000 لأنه تجاوز الحد بمقدار 28,000. قسّم المستند نفسه إلى استدعاءين وستنخفض التكلفة إلى النصف دون أي تغيير في المطالبة.

Qwen3.8-Max ثابت عبر نافذته الكاملة البالغة 1,000,000 رمز. بالنسبة للطلبات الفردية الضخمة حقًا، فإن ذلك يجعل فجوة سعر الإخراج البالغة اثني عشر ضعفًا أصغر مما تبدو، ويمكن أن يقلبها: فوق 272,000 رمز إدخال، يتضاعف معدل الإدخال الفعلي لـ GPT-6 Luna ليصل إلى 0.20 دولار، ويرتفع معدل إخراجه إلى 0.75 دولار، مقابل سعر Qwen الثابت البالغ 2.00 دولار و6.00 دولار. تضيق الفجوة من عشرين ضعفًا إلى عشرة في الإدخال، ومن اثني عشر إلى ثمانية في الإخراج. لا تزال واسعة — لكن أحمال العمل الأكثر ترجيحًا لامتلاك سياق عمل من 300,000 رمز هي بالتحديد الأحمال الوكيلية التي يستهدفها كلا الموردين بالبيع، والفرق التي تديرها هي الفرق التي ستلاحظ.

البند الهيكلي الآخر هو المراجعة المثبّتة. يتوفّر Qwen3.8-Max-0902 بالسعر نفسه الذي يتوفّر به المعرّف المتدحرج، ما يعني أن أي فريق يحتاج إلى سلوك قابل لإعادة الإنتاج عبر تحديث النموذج يمكنه الحصول عليه دون دفع علاوة. لا يقدّم GPT-6 Luna ما يعادله. وهذا سطر صغير في بطاقة الأسعار وسطر كبير في تقرير ما بعد الحادث.

تشغيل أحدهما أو كليهما

يتوفّر Qwen3.8-Max على OrcaRouter بسعر قائمة Alibaba، وذلك ضمن التسعير التمريري الذي يعني أن أي تغيير في أسعار المورّد يصبح ساريًا لدينا في اليوم نفسه. وهناك أمران في طبقة التوجيه لدينا يستحقّان مكانتهما مع هذا الطراز تحديدًا: التبديل التلقائي عند الفشل، لأن نموذجًا رائدًا مستضافًا له قاعدة أوزان مفتوحة منشورة تكون له مصادر upstream أكثر من نموذج مغلق يعود لمورّد واحد، وسبل أكثر لتدهور أحدها؛ والتعامل مع المراجعة المثبَّتة، الذي يتيح لمسار ما أن يُبقي Qwen3.8-Max-0902 صراحةً بدلًا من أن يرث ما يستقرّ عليه المعرّف المتدحرج الأسبوع المقبل.

لا يتواجد GPT-6 Luna في كتالوجنا حتى كتابة هذه السطور، ويُوصَل إليه عبر واجهة API الخاصة بـ OpenAI، لذا فإن فريقًا يريد الاثنين يشغّل مفتاحًا واحدًا لـ Qwen3.8-Max إلى جانب ما يستخدمه بالفعل مع OpenAI. وهذا أيضًا هو الاقتران الذي تكون فيه لغة توجيه DSL أكثر قيمة من تقسيم ثابت، لأن الحد الفاصل بين النموذجين هو فحص للوسائط وفحص للطول وليس تفضيلًا: الطلبات التي تحمل فيديو تذهب إلى Qwen3.8-Max لأنه لا شيء آخر يمكنه خدمتها، والطلبات التي تتجاوز 272,000 من رموز الإدخال تذهب إلى Qwen3.8-Max لأن جرف النموذج الآخر السعري يجعلها أكثر تكلفة هناك، وكل ما عدا ذلك يذهب إلى النموذج الذي يكلف عشرين مرة أقل. هذه قاعدة، ومكانها الإعدادات لا فرع في التطبيق.

Screenshot of OpenAI's developer documentation page for GPT-6 Luna, showing the model selector, the description 'Our most efficient model for focused, high-volume tasks', reasoning set to High, speed Fast, price $0.1 · $0.5, text and image input with text output, a 1,050,000-token context window, 128,000 maximum output tokens, a May 18, 2026 knowledge cutoff, and pricing cards of $0.10 input, $0.01 cached input, $0.125 cache writes and $0.50 output per 1M tokens.

أي واحد، ومتى؟

اختر Qwen3.8-Max إذا كان أي مما يلي صحيحًا. يحتاج خط أنابيبك إلى فيديو كمدخل. تتجاوز طلباتك بشكل روتيني 272,000 توكن إدخال، حيث تتفوق طبقته الثابتة على إعادة تسعير GPT-6 Luna. تتجاوز مخرجاتك 128,000 توكن. عملك هو تنفيذ وكيلي طويل المدى بنقطة نهاية قابلة للتحقق، حيث إن 58 على لوحة الأداء الوكيلي و1,739 Elo على GDPval عند 64 جولة لكل مهمة هي الدليل الذي يهم. أو أنك تحتاج إلى مراجعة مثبتة لأغراض قابلية إعادة الإنتاج، وتكون مستعدًا للدفع مقابلها — وهذا، بالسعر نفسه للمعرّف المتدحرج، يعني أنك لست كذلك.

اختر GPT-6 Luna إذا لم ينطبق أيٌّ من ذلك وكان عبء عملك كثيف الحجم، تستهلكه البرامج، نصيًّا وصوريًّا، وقصيرًا. التصنيف، والاستخراج، والتوجيه، والتلخيص بالجملة، والحلقة الداخلية لوكيل يحتاج إلى إجابة سريعة لا متأنية. عند 0.10 دولار/0.50 دولار مع قراءة مخزّنة مؤقتًا بتكلفة سنت واحد، وتكلفة لكل مهمة مكتملة تبلغ نحو 1/15 من تكلفة Qwen3.8-Max، فالحساب ليس متقاربًا. اضبط معامل الجهد صراحةً — فالقيمة الافتراضية هي medium، والرقم الرئيسي 37 هو قيمة بأقصى جهد — وأبقِ الاستدعاءات الطويلة على الجانب الصحيح من حد 272,000 رمز.

الخطأ الذي تدعو إليه هذه المقارنة هو قراءة سعر الإدخال البالغ عشرين ضعفًا بوصفه حكمًا نهائيًا. إنه حكم على شكل واحد من أشكال عبء العمل، وهو صامت إزاء الأسطر الثلاثة التي تحسم الشكل الآخر: ما إذا كان الطلب يحمل فيديو، وما إذا كان يتجاوز 272,000 توكن، وما إذا كان الجواب مضطرًا للصمود عبر أربع وستين خطوة متتابعة.

Screenshot of the OrcaRouter model page for Qwen3.8 Max (0902) showing the breadcrumb Home > Models > Qwen > Qwen3.8 Max (0902), a NEW badge, the model id qwen/qwen3.8-max-0902, Vision, Tools, JSON and Reasoning chips, a Qwen attribution dated 2026-09-02, the description of a September 2, 2026 snapshot accepting text, image and video input with a 1M-token context, input pricing of $2.00 and output of $6.00 per 1M tokens, a p50 time to first token of 3.50s, a p95 of 9.38s, and traffic of 196.6M tokens over seven days.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا