
GPT-6 Sol مقابل Qwen3.8-Max: السطر الواحد الذي لا يستطيع النموذج المغلق المنافسة فيه
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
ستُحسم تقريبًا كل مقارنة بين GPT-6 Sol وQwen3.8-Max على أساس التكلفة، وستخطئ تقريبًا كل واحدة منها في تقدير التكلفة في الاتجاه نفسه. Qwen3.8-Max، الطراز الرائد المستضاف من المورّد، سُعّر عند 2.00 دولار لكل مليون توكن إدخال و6.00 دولارات لكل مليون توكن إخراج منذ إتاحته العامة في 3 أغسطس 2026، مع Qwen3.8-Max-0902 اللقطة المؤرخة الصادرة في 2 سبتمبر. GPT-6 Sol أصبح متاحًا بشكل عام في 22 سبتمبر 2026 بسعر 2.00 دولار للإدخال و10.00 دولارات للإخراج. سعر إدخال مطابق، وإخراج أرخص بنسبة 40% على قائمة أسعار Qwen3.8-Max — وعلى منصة الاختبار المستقلة، تبلغ تكلفة إتمام المهمة نحو خمسة أضعاف.
لكن ثمة فرق ثانٍ أكثر وضوحًا تظل حجة التكلفة تدفنه، وهو الفرق الذي يحسم فعليًا بعض أعباء العمل. Qwen3.8-Max يقبل الفيديو. أما GPT-6 Sol فلا. هذا ليس بند سعر ولا بند معيار أداء؛ بل قدرة يمتلكها أحد هذين النموذجين ولا يستطيع الآخر محاكاتها، وهي الجزء الوحيد في هذه المواجهة الذي لن يصلحه أي قدر من العمل على كفاءة الرموز.

رائدان، وشكلان مختلفان
Qwen3.8-Max هو نموذج خليط خبراء متناثر بمعاملات تبلغ 2.4 تريليون، مع ما يقارب 95 مليار معامل نشط لكل استعلام — ثاني أكبر نموذج مُستضاف قيد الإنتاج بعد Kimi K3. نافذة سياقه مليون رمز مع حد إخراج يبلغ 131,072 رمزًا، ووحدات إدخاله هي النص والصورة والفيديو، وهو يدعم جهد الاستدلال عبر مستويات منخفض ومتوسط وعالٍ جدًا مع مخرجات منظمة واستدعاء الأدوات. النموذج الرائد المُستضاف ليس بأوزان مفتوحة؛ والمنتج القابل للتنزيل من الجيل نفسه هو إصدار منفصل له قيوده الخاصة.
GPT-6 Sol هو نص وصورة كمدخل، ونص كمخرج. نافذته 1,050,000 توكن، بحد أقصى للمدخلات 922,000 توكن وسقف للمخرجات 128,000 توكن، بسعر ثابت قدره 2.00 دولار و10.00 دولار، مع قراءة مخزّنة مؤقتًا بـ0.20 دولار وكتابات ذاكرة مؤقتة بـ2.50 دولار، وإعادة تسعير الطلب بأكمله فوق 272,000 توكن من المدخلات إلى 4.00 دولار و15.00 دولار. وهو مغلق، وبمعرّف واحد، وقد وصفت OpenAI الأسعار بأنها دائمة لا ترويجية.
أرقام النوافذ تختلف عن بعضها بنحو 7% فقط، وسقوف الإخراج في النطاق نفسه. قائمة الوسائط هي الفجوة الهيكلية الوحيدة — وهي في اتجاه واحد.
سطرًا بسطر
• المدخلات — GPT-6 Sol 2.00 دولار لكل مليون رمز مقابل Qwen3.8-Max 2.00 دولار لكل مليون رمز؛ الرقم الرئيسي متطابق
• الإخراج — GPT-6 Sol بسعر 10.00 دولارات لكل مليون رمز مقابل Qwen3.8-Max بسعر 6.00 دولارات لكل مليون رمز؛ سعر علي بابا أقل بنسبة 40%
• الإدخال المُخزَّن مؤقتًا — GPT-6 Sol بسعر 0.20 دولار لكل مليون رمز مقابل Qwen3.8-Max بسعر 0.25 دولار لكل مليون رمز لقراءات الذاكرة المؤقتة الضمنية، مع قراءة صريحة من الذاكرة المؤقتة بسعر 0.17 دولار وكتابة صريحة إلى الذاكرة المؤقتة بسعر 2.50 دولار
• نافذة السياق — GPT-6 Sol 1,050,000 توكن مقابل Qwen3.8-Max 1,000,000 توكن
• الحد الأقصى للإخراج — GPT-6 Sol 128,000 رمز مقابل Qwen3.8-Max 131,072 رمزًا
• أنماط الإدخال — نص وصورة من GPT-6 Sol مقابل نص وصورة وفيديو من Qwen3.8-Max
• التعامل مع السياق الطويل — يعيد GPT-6 Sol تسعير الطلب بأكمله فوق 272,000 رمز إدخال بمعدلات إدخال وتخزين مؤقت تبلغ 2×، وإخراج 1.5×، مقابل Qwen3.8-Max بفئة ثابتة عبر النافذة كاملة، وهو الموضع الوحيد الذي تكون فيه بطاقة أسعار Qwen أفضل بنيويًا بدلًا من كونها أرخص بشكل هامشي
• جهد الاستدلال — GPT-6 Sol: بلا، منخفض، متوسط (افتراضي)، عالٍ، عالٍ جدًا، أقصى مقابل Qwen3.8-Max: منخفض، متوسط، ومرتفع للغاية
• تاريخ انتهاء المعرفة — GPT-6 Sol 20 أبريل 2026 مقابل Qwen3.8-Max غير منشور كتاريخ واحد
• لقطة مؤرخة — GPT-6 Sol معرّف متدحرج واحد مقابل Qwen3.8-Max-0902 المتاح كمراجعة مثبّتة بتاريخ 2 سبتمبر 2026 بالسعر نفسه
يستحق سطر السياق الطويل اهتمامًا أكثر مما يحظى به عادةً. الرسم الإضافي لـ GPT-6 Sol هو خطوة تُطبَّق على الطلب بأكمله، لذا فإن تشغيل وكيل بـ 900,000 رمز يُحتسب بسعر 4.00 دولارات و15.00 دولارًا على كل رمز. تفرض Qwen3.8-Max فئة سعرية واحدة عبر النافذة بأكملها. بالنسبة لعبء عمل يتجاوز 272,000 رمز، تتوقف بطاقتا الأسعار عن كونهما قابلتين للمقارنة على الإطلاق — فالطراز الأرخص في العنوان هو الأغلى بفارق واسع، واتجاه الفجوة يعتمد كليًا على مكان سياقك.

تقول بطاقة الأسعار إن السعر أرخص بنسبة 40%. أما أداة الاختبار فتقول إن الفاتورة خمسة أضعاف.
قاسَت Artificial Analysis نموذج Qwen3.8-Max-0902 بدرجة 45 على مؤشر Intelligence Index، بتكلفة 5.41 دولار لكل مهمة مكتملة على المؤشر، بعدما أنتج 190 مليون رمز إخراج طوال التشغيل. ويصف ملخّصه النموذج بأنه "بطيء بشكل ملحوظ ومُسهب جدًا". وسجّل GPT-6 Sol درجة 48 بتكلفة 1.06 دولار لكل مهمة باستخدام 77 مليون رمز إخراج.
اقرأ تلك الأزواج الثلاثة معًا فتظهر ملامح المواجهة. يتأخر Qwen بثلاث نقاط في المؤشر، وأنتج ضعفين ونصفًا من الرموز، وكلّف نحو خمسة أضعاف لكل مهمة منجزة — على بطاقة أسعار يكون فيها إنتاجه أرخص بنسبة 40%. الآلية ليست خفية. عند $6.00 لكل مليون رمز إخراج، تكلّف 190 مليون رمز $1.14 لكل تشغيل مؤشر من الإخراج وحده قبل احتساب الإدخال؛ وعند $10.00 لكل مليون، تكلّف 77 مليونًا لدى Sol $0.77. السعر الأرخص يشتري مزيدًا من الرموز، لا فاتورة أصغر.
هذا هو النمط نفسه الذي يظهر في ساحة سبتمبر، ويجدر ذكره كقاعدة لا كواقعة تخص هذين النموذجين: على بطاقة أسعار لكل توكن، لا قيمة لخصم 40% على المخرجات إذا كان النموذج يُصدر ضعفين ونصفًا من التوكنات. تكلفة المهمة المكتملة هي الرقم الوحيد الذي يصمد.
ما نشرته Alibaba، ومشكلة تحديد الجهد
جدول اختبارات الأداء الخاص بـ Alibaba نفسه هو الأطول في هذه المقارنة، وهو الأقل قابلية للمقارنة. تضع النتائج التي أبلغ عنها المورّدون Qwen3.8-Max في المقدمة على PaperBench وIFBench، بينما تتخلف في SWE-bench Pro وHumanity's Last Exam، مع مقياس لجهد الاستدلال — منخفض، متوسط، مرتفع للغاية — ليس له مقابل مباشر في مقياس OpenAI المكوّن من ستة مستويات. النتيجة المنشورة عند مستوى "مرتفع للغاية" ليست المنتج نفسه الذي تمثله النتيجة المنشورة عند مستوى "متوسط"، ولا يوضّح أيٌّ من المورّدين أي المستويين أنتج رقمًا معيّنًا في مخطط المقارنة.
هذا هو السبب الصادق لعدم الاعتماد على جدول أيٍّ من المورّدين هنا. فأرقام Alibaba يتم تشغيلها على منصة اختبار Alibaba وبإعداد الجهد الخاص بـ Alibaba؛ وأرقام OpenAI يتم تشغيلها على منصة OpenAI وبإعداد الجهد الخاص بها. إن أرقام Artificial Analysis موجودة تحديدًا لأن كليهما غير صالح للاستخدام في مقارنة مباشرة، وهي الأرقام المستخدمة أعلاه.
قابلية إعادة الإنتاج ميزة حقيقية، وثمنها صفر
اللقطة المؤرخة هي البند الأكثر استهانةً به في هذه المقارنة. Qwen3.8-Max-0902 هو إصدار مثبَّت بتاريخ 2 سبتمبر 2026، تقول Alibaba إنه يحمل القدرات والتسعير نفسيهما اللذين يحملهما النموذج الأساسي. وتثبيته يعني أن النموذج الذي يقف خلف نقطة النهاية لديك لا يتغير تحتك بين يوم ثلاثاء ويوم خميس.
لا يوجد لـ GPT-6 Sol نظير. فهو معرّف واحد متجدد — الصفحة نفسها للنموذج تحمل لقطة افتراضية ولا تحمل متغيرات مؤرخة — ما يعني أن ما قمت بقياس أدائه في سبتمبر ليس مضمونًا أن يكون ما تستدعيه في نوفمبر. بالنسبة لمعظم الفرق، لا مشكلة في ذلك. أما بالنسبة لخط أنابيب خاضع للتنظيم يجب أن يثبت ما أنتج مخرجًا ما، فهو فرق حقيقي، وهو فرق تقدمه Alibaba مجانًا بينما لا تقدمه OpenAI على الإطلاق.
خط الفيديو هو الذي يقرر
كل ما سبق هو مقارنة. هذا الجزء ليس كذلك. إذا تضمّن مُدخلك فيديو — تسجيلات شاشة، أو لقطات تفتيش، أو تسجيل محاضرات، أو أي شيء تكون فيه المعلومات في حركة لا في إطار ثابت — فإن Qwen3.8-Max يقبله أصليًا، ولا يملك GPT-6 Sol أي مسار إليه. لا يمكنك أن تتحايل على نمط إدخالٍ ما عبر المطالبات. ولا يمكنك معالجة فيديو مسبقًا إلى صور والحصول على الشيء نفسه، لأن المعلومات الزمنية هي المقصد، ولا يغني أي قدر من نقاط المؤشر في معيار نصي عن المُدخل الذي تتطلبه مهمتك فعليًا.
الحالة المعاكسة تستحق التسمية أيضًا، لأنها الحالة التي تتوقف عندها المقارنة عن كونها غير متكافئة. إذا كان مُدخلك نصًا وصورًا، فإن Sol أرخص لكل مهمة، ومتقدّم بأربع نقاط على اللوحة المحايدة، وأرخص في القراءات المخزنة مؤقتًا. قدرة الفيديو ليست عامل حسم لصالحك؛ إنها ببساطة غير مستخدمة.
توجيه قرار له إجابتان منفصلتان

هذه مواجهة تكون فيها البنية الصحيحة نموذجين اثنين بحق، لا نموذجًا واحدًا، والسبب هو أن التقسيم يكون حسب نمط الإدخال وليس حسب الصعوبة. وخط المعالجة الذي يستوعب الفيديو ويُجري استدلالًا على النص يحتاج إلى كليهما، وقاعدة التوجيه سمة من سمات الطلب وليست قرارًا تقديريًا.
Qwen3.8-Max موجود في كتالوج OrcaRouter — اللقطة المؤرخة qwen/qwen3.8-max-0902 قابلة للتوجيه بسعر Alibaba المعلن وفق نموذج التمرير، ما يعني أن تغيير أسعار Alibaba يسري لدينا في اليوم نفسه بدلًا من أن ينتظر إعادة تفاوض الموزّع. أما GPT-6 Sol فليس في كتالوجنا حتى كتابة هذه السطور، ويمكن الوصول إليه عبر واجهة OpenAI الخاصة. لغة التوجيه DSL هي ما يناسب هذه الحالة تحديدًا: قاعدة ترسل الطلبات التي تحمل فيديو في اتجاه، وكل ما عداها في الاتجاه الآخر، هي بالضبط الغرض منها، والتحويل التلقائي عند الفشل يعني ألا يصبح فرع الوسائط نقطة فشل وحيدة.
أين يفوز كل واحد
• فيديو كمدخل، ونص كمخرج — Qwen3.8-Max، ولا وجود لمنافسة تستحق الوصف.
• إدخال النص والصورة، والتكلفة لكل مهمة مكتملة كمقياس — GPT-6 Sol، بنحو خمسة أضعاف على أداة الاختبار المستقلة.
• العمل بالبادئة المخزّنة مؤقتًا — GPT-6 Sol. قراءته المخزّنة أرخص بشكل هامشي، وحجم رموزه أقل من النصف.
• الطلبات التي تتجاوز 272,000 رمز إدخال — Qwen3.8-Max. تُعدّ إعادة تسعير Sol للطلب بالكامل أكبر فرق منفرد في التكلفة ضمن هذه المقارنة، وهو فرق لا يظهر في الأسعار المعلَنة.
• تثبيت قابل لإعادة الإنتاج — Qwen3.8-Max-0902، الذي لا يكلّف شيئًا إضافيًا وهو الإصدار المثبَّت الوحيد من بين الاثنين.
• إذا عُرض عليك مخطط يظهر فيه Qwen متقدّمًا في SWE-bench Pro — فتحقّق من الجهة التي أنتجت أداة الاختبار هذه وبأي إعداد للجهد. لدى اللوحة المستقلة Qwen متأخّر بثلاث نقاط في النتيجة المركّبة، كما أن جداول المورّدين ليست على المقياس نفسه إذا قورنت ببعضها.
مقارنات في هذه المقالة3
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
