Qwen 3.8 ضد GPT-5.6: الآن بعد أن أصبح لكلاهما سعر، أيهما يفوز؟
Guides & Insights

Qwen 3.8 ضد GPT-5.6: الآن بعد أن أصبح لكلاهما سعر، أيهما يفوز؟

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

عندما استعرضت علي بابا Qwen3.8-Max في شنغهاي في 19 يوليو 2026، كان رد فعل المجتمع فوريًا: هذا النموذج الذي يضم 2.4 تريليون معامل «يُزعم أنه يتفوق على GPT-5.6 ويتخلف قليلاً فقط عن Fable 5.» نموذج GPT-5.6 من OpenAI في إصداره الرئيسي Sol يحتل المركز الثاني في مؤشر Artificial Analysis Intelligence Index المستقل، بفارق نقطة واحدة عن Fable 5، لذا كان ادعاءً كبيرًا بدون أرقام منشورة تدعمه.

تغيّر أمران منذ ذلك الحين. Qwen3.8-Max أصبح متاحًا بشكل عام في 3 أغسطس 2026 مع بطاقة أسعار حقيقية وجدول معايير حقيقي. وفي 31 يوليو، خفضت OpenAI الأسعار عبر عائلة GPT-5.6 — Terra إلى $2 / $12، وLuna إلى $0.20 / $1.20، بينما بقيت Sol دون تغيير في الفئة المميزة. لذا لم تعد هذه المواجهة مجرد ادعاء ضد لوحة الصدارة؛ بل أصبحت نموذجين مُسعّرَين وموثّقَين يمكن مقارنتهما فعليًا.

ملاحظة للمطورين — أسرع طريقة لحسم ادعاء كهذا هي تشغيل كليهما على استفساراتك الخاصة. يوفّر OrcaRouter أكثر من 200 نموذج خلف نقطة نهاية واحدة متوافقة مع OpenAI، بحيث يمكنك وضع Qwen 3.8 Max في مواجهة GPT-5.6 على المهمة نفسها دون ربط حزمتي SDK.

خلاصة الحكم. Qwen3.8-Max عند GA مُسعّر بقوة — $2 / $6 لكل مليون رمز، بسعر ثابت عبر مليون رمز — مما يجعله بنفس سعر الإدخال مثل GPT-5.6 Terra لكن نصف تكلفة مخرجات Terra، وأقل بكثير من Sol. أرقامه المُعلنة ذاتيًا قوية (GPQA Diamond 92.6، وTerminal-Bench 2.1 86.6). لكن GPT-5.6 Sol ما زال يتفوّق في الأمرين اللذين يحدّدان الاستخدام الإنتاجي: فهو المُدقَّق رقم 2 في مؤشر Artificial Analysis Intelligence Index (~59) وهو سريع — يصل إلى 750 رمزًا/ثانية على أجهزة Cerebras. وتبقى Qwen3.8-Max بدون تقييم من أي مُقيِّم مستقل. لذا قد تضاهي Qwen GPT-5.6 في جودة المحاولة الواحدة، وتتفوّق بوضوح على Terra في سعر المخرجات؛ لكن GPT-5.6 يفوز في الإثبات المُحكَّم وفي الإنتاجية، التي غالبًا ما تكون حسم المباراة.

النقاط الرئيسية

Qwen3.8-Max متاح بشكل عام منذ 3 أغسطس 2026 مع تسعيرة معلنة تبلغ $2 / $6 لكل 1M توكن، ثابت عبر كامل سياق الـ1M توكن.

بالمقارنة مع GPT-5.6 Terra (2 دولار / 12 دولارًا بعد تخفيض OpenAI في 31 يوليو)، تعادل Qwen في الإدخال وتخفض معدل الإخراج إلى النصف. بالمقارنة مع Sol، Qwen أرخص بكثير.

GPT-5.6 Sol مُقيَّم في المرتبة الثانية على مؤشر AA للذكاء (~59)، وتشير Artificial Analysis إلى أنه يتصدر أصعب مسائل STEM. أما Qwen3.8-Max فهو لا يزال غير مُقيَّم من قبل AA وLMArena.

السرعة هي أبرز تباين. يعمل GPT-5.6 بسرعة تصل إلى 750 رمزًا في الثانية على Cerebras. كان Qwen هو النموذج الأبطأ في الاختبارات العملية للمعاينة — وهي نتيجة تسبق إصدار GA وتحتاج إلى إعادة اختبار.

جدول البائع المقدَّم من Qwen موثوق لكنه غير مُحكّم: GPQA Diamond 92.6، وPaperBench 93.0، وTerminal-Bench 2.1 86.6، وOSWorld-Verified 86.1، وFrontierSWE 73.5 (بارتفاع من 40.7 التي حققها سلفه).

الانفتاح يفرّق بينهما نهائيًا: تعد Qwen بتوفير أوزان مفتوحة خلال الأسبوع، إلى جانب Qwen3.8-27B الذي يتطلب ~17 جيجابايت من ذاكرة الفيديو؛ بينما GPT-5.6 مغلق ومتاح عبر API فقط.

ملاحظة دقة: جميع أرقام جودة Qwen3.8-Max هي من إعلانات Alibaba ولم يتم التحقق منها من طرف ثالث. أرقام GPT-5.6 مأخوذة من Artificial Analysis وقد تختلف عن تقارير OpenAI الرسمية. تعكس تسعيرة عائلة GPT-5.6 تخفيض OpenAI بتاريخ 31 يوليو 2026. تسعيرة Qwen هي بطاقة الأسعار العامة وتلغي خصم المعاينة الخاص بشهر يوليو.

المواصفات والسعر، جنبًا إلى جنب

هذه هي البيانات الدقيقة، كل رقم منسوب إلى مصدره.

• الصانع / الحالة — Qwen3.8-Max: Alibaba؛ GA (3 أغسطس 2026)؛ GPT-5.6 Sol: OpenAI؛ نموذج رئيسي مغلق (إصدارات Sol / Terra / Luna)

• البنية — Qwen3.8-Max: ~2.4 تريليون إجمالاً، MoE متفرق (المعلمات النشطة لم تُكشف بعد)؛ GPT-5.6 Sol: مغلق؛ البنية غير معلنة

• نافذة السياق — Qwen3.8-Max: 1M توكن (983,616 مع التفكير؛ الحد الأقصى للإخراج 131,072)؛ GPT-5.6 Sol: الرائد في السياق الطويل

• مؤشر AA للذكاء — Qwen3.8-Max: لم يُقيَّم بعد؛ GPT-5.6 Sol: ~59 — #2 (Artificial Analysis)

• نقاط القوة المدققة — Qwen3.8-Max: لا يوجد طرف ثالث؛ GPT-5.6 Sol: يتصدّر أصعب مسائل STEM (Artificial Analysis)

• نقاط القوة المذكورة من المورّد — Qwen3.8-Max: GPQA Diamond 92.6، Terminal-Bench 2.1 86.6، OSWorld-Verified 86.1 (مذكور من Alibaba)؛ GPT-5.6 Sol: غير متاح

• السرعة — Qwen3.8-Max: p50 TTFT 1.64 ثانية (وفقًا لبيانات OrcaRouter على مدى 7 أيام)؛ أبطأ نموذج في اختبارات المعاينة العملية؛ GPT-5.6 Sol: حتى 750 رمزًا/ثانية على Cerebras (Artificial Analysis)

• التسعير (إدخال / إخراج) — Qwen3.8-Max: $2.00 / $6.00 لكل 1M، بسعر ثابت؛ الإدخال المخزَّن مؤقتًا $0.25؛ GPT-5.6: Terra $2 / $12، Luna $0.20 / $1.20، Sol المميز (~1/3 من تكلفة Fable لكل AA)

• أوزان مفتوحة — Qwen3.8-Max: موعود به خلال الأسبوع (لا ترخيص بعد)؛ GPT-5.6: لا — مغلق / API فقط

شيئان يؤطران هذه المقارنة، وكلاهما جديد منذ يوليو.

أولاً، قصة السعر أصبحت مثيرة للاهتمام حقًا وليست مجرد رخص. في يوليو، كانت ميزة Qwen هي خصم غير محسوب في الميزانية. الآن المقارنة ملموسة وتنقسم حسب الفئة. مقابل Terra بسعر $2 / $12، يطابق Qwen معدل الإدخال تمامًا ويخفض معدل الإخراج إلى النصف — وهي ميزة حقيقية للأعمال التي تعتمد على الاستدلال حيث يهيمن الإخراج على الإنفاق. مقابل Luna بسعر $0.20 / $1.20، فإن Qwen أغلى بـ10 مرات، وLuna هي الخيار الأفضل للمهام البسيطة ذات الحجم الكبير. مقابل Sol، فإن Qwen أرخص بكثير. إذًا "أيهما أرخص" أصبح له ثلاث إجابات مختلفة اعتمادًا على أي GPT-5.6 تقصد — والإطار الصادق هو أن تخفيض OpenAI في 31 يوليو قلّص الفجوة بشكل ملحوظ.

ثانيًا، لا يزال صفّ السرعة هو المجال الذي يختلفان فيه بأشدّ درجة، وما زال يصبّ في مصلحة OpenAI. تُسجّل Artificial Analysis سرعة تصل إلى 750 رمزًا في الثانية لـ GPT-5.6 Sol على رقائق Cerebras. لا شيء في مواد GA الخاصة بـ Alibaba يشير إلى أن Qwen3.8-Max مصمَّم لهذا المستوى من الإنتاجية، ومُراجع حقبة المعاينة الذي وصفه بأنه أبطأ نموذج استخدمه كان يقيس تحديدًا عمليات التشغيل الوكيلة الطويلة التي تتضاعف فيها الإنتاجية. إذا كانت مهامك تفاعلية أو وكيلة أو عالية الحجم، فإن هذه الفجوة يمكن أن تحسم المواجهة قبل أن تُطرح مسألة الجودة.

إثبات: ما يحسمه جدول معايير GA وما لا يحسمه

قرار علي بابا بنشر الأرقام في GA هو تحسّن حقيقي مقارنة بالمعاينة، حيث أن عبارة المجتمع "متقدم على GPT-5.6" لم تستند إلى أي شيء منشور إطلاقًا. الجدول قوي:GPQA Diamond 92.6 في العلوم على مستوى الدراسات العليا، PaperBench 93.0 في إعادة إنتاج النتائج البحثية، Terminal-Bench 2.1 86.6 في تشغيل شل حقيقي، OSWorld-Verified 86.1 في قيادة واجهة المستخدم الرسومية لسطح المكتب. القفزة الجيلية في البرمجة هي الأبرز — FrontierSWE 73.5 مقابل 40.7 للإصدار السابق، و DeepSWE 1.1 56.6 مقابل 21.6.

ما لا يفعله الجدول هو حسم مقارنة GPT-5.6، وذلك لسببين.

الأول هو المنشأ. كل رقم أنتجته أليبابا على منصتها الخاصة. جداول البائعين تُختار، لا تُعيّن عشوائيًا — فالمختبر ينشر المعايير التي يبدو فيها جيدًا ويحذف الباقي. ترتيب OpenAI في مؤشر الذكاء رقم 2، على النقيض، تم تعيينه بواسطة مُقيّم لا مصلحة له في النتيجة. والجدير بالذكر أن Artificial Analysis ينسب على وجه التحديد إلى GPT-5.6 Sol صدارة أصعب مسائل STEM، وهو بالضبط المجال الذي يهدف Qwen's GPQA Diamond 92.6 إلى المطالبة به. واحدة من تلك الادعاءات قد تم التحقق منها.

الاعتبار الثاني هو أن أضعف رقم لدى Alibaba في حد ذاته يدل على الكثير.IFBench 82.8— وهي اتباع التعليمات في ظل القيود— هي أدنى نتيجة في جدول النتائج، وتتوافق تمامًا مع أكثر انتقادات فترة المعاينة اتساقًا: النموذج يقدّم أكثر مما طُلب، ويتجاوز النطاق، ويضيف أشياء لم يطلبها أحد. وهذا أمر جذاب في العرض التوضيحي، لكنه مكلف عندما تُفوتر المخرجات بمبلغ 6 دولارات لكل مليون رمز وتحتاج إلى تنسيق دقيق. وفي خطوط عمل الوكلاء حيث تقوم الخطوات اللاحقة بتحليل المخرجات، فإن الانضباط في اتباع التعليمات أكثر أهمية من نقطة في GPQA.

على سبيل التثبيت: سجّل سابقه Qwen3.7-Max 46 في مؤشر AA للذكاء مقابل ~59 لـ GPT-5.6 Sol. تقليص الفارق بثلاثة عشر نقطة في جيل واحد سيكون قفزة استثنائية. ممكن — اقتراب أداء FrontierSWE الخاص بـ Alibaba من المضاعفة يشير إلى تقدم حقيقي — ولكن حتى ينشر مُحكّم رقمًا، تبقى عبارة "أفضل من GPT-5.6" ادعاءً غير مثبت وليست نتيجة.

التكلفة عمليًا: مثال مُطبَّق عبر جميع المستويات

تخيل وكيل استدلال يرسل 100,000 رمزًا من السياق ويولّد 10,000 رمزًا من المخرجات لكل استدعاء — وهي بنية نموذجية لتحليل المستندات أو التخطيط متعدد الخطوات.

Qwen3.8-Max: 0.1M × $2 = $0.20، زائد 0.01M × $6 = $0.06. ≈ $0.26 لكل مكالمة.

GPT-5.6 Terra: 0.1M × $2 = $0.20، بالإضافة إلى 0.01M × $12 = $0.12. ≈ $0.32 لكل استدعاء.

GPT-5.6 Luna: 0.1M × $0.20 = $0.02، زائد 0.01M × $1.20 = $0.012. ≈ $0.03 لكل مكالمة.

• عند 5,000 مكالمة/يوم: Qwen ≈ $1,300، Terra ≈ $1,600، Luna ≈ $160.

يترتب على ذلك درسان. بالمقارنة مع Terra، التوفير من Qwen حقيقي لكنه متواضع — حوالي 19% على هذا الشكل — ولا يقترب بأي حال من الميزة ذات الترتيب المقداري (أي عشرة أضعاف) التي تتمتع بها Qwen مقابل النماذج المتميزة مثل Fable 5 أو Sol. أي شخص افترض أن OpenAI مكلفة هيكليًا عليه أن يحدّث افتراضه: فقد قام تخفيض 31 يوليو بمعظم العمل في تحييد قصة تسعير Qwen في الفئة المتوسطة.

ما يتفوق فيه Qwen بشكل حاد هو السياق الطويل والتخزين المؤقت. نظرًا لأن معدل $2/$6 ثابت عبر نافذة الـ1M من الرموز، فإن طلبًا من 900,000 رمز يكلّف نفس التكلفة لكل رمز كطلب قصير، بينما يفرض العديد من المنافسين رسومًا إضافية على المدخلات الطويلة. والمدخلات المخزنة مؤقتًا بسعر $0.25 لكل 1M تقلّل جانب الإدخال بمقدار 8× في أعباء العمل ذات السياق المتكرر: يهبط الطلب أعلاه من $0.26 إلى حوالي $0.09 بمجرد تخزين السياق مؤقتًا. إذا كان وكيلك يعيد قراءة سياق شبه مستقر في كل دورة، فهنا تكمن الميزة الدائمة — وليس في السعر المعلن.

الانفتاح والشقيق 27B

لن يكون GPT-5.6 قابلًا للاستضافة الذاتية أبدًا. أما Qwen3.8-Max فقد يكون كذلك — إذ تقول Alibaba الآن إن الأوزان ستصل خلال الأسبوع — لكن النموذج الرئيسي ليس هدفًا عمليًا: فمساحة تبلغ نحو 1.2 تيرابايت بدقة 4-بت مقابل حوالي 141 جيجابايت لكل H200 تعني الحاجة إلى ثمانية مسرّعات فائقة أو أكثر، ومع بقاء عدد المعاملات النشطة غير معلن، لا يمكنك حتى نمذجة الإنتاجية التي يوفّرها ذلك. كما لا يوجد حتى الآن نص ترخيص، ما يعني أن قابلية الاستخدام التجاري غير محدّدة رسميًا.

المُعلن عنه بالتزامنQwen3.8-27B هو الإصدار الأكثر أهمية لأي شخص يكون اهتمامه بـ Qwen منصبًا على التحكم بدلاً من القدرة الخام. كما أنه، باعتباره مفتوح الأوزان، يُذكر أنه يعمل في حوالي 17 جيجابايت من VRAM — وهي بطاقة استهلاكية واحدة من الفئة العليا — مما يجعله خيارًا حقيقيًا للتشغيل المحلي، وهو ما لن يكون عليه الطراز الرائد 2.4T أبدًا. إذا كنت تقارن Qwen بـ GPT-5.6 بسبب حاجتك إلى إقامة البيانات، فإن 27B هو النموذج الذي يجب تقييمه.

الأسئلة الشائعة

هل Qwen 3.8 أفضل من GPT-5.6؟

ليس بناءً على الأدلة الموجودة. جدول GA من علي بابا قوي (GPQA Diamond 92.6, Terminal-Bench 2.1 86.6) لكنه مُعلَن ذاتيًا بالكامل، ولم يقيّم النموذج أي مُقيّم مستقل. يحمل GPT-5.6 Sol مؤشر الذكاء رقم 2 المُدقَّق (~59)، ويتصدّر أصعب مسائل STEM وفقًا لـ Artificial Analysis، ويعمل بسرعة تصل إلى 750 رمزًا/ثانية. يتفوّق GPT-5.6 في الإثبات والسرعة.

هل ادعاء "Qwen 3.8 متقدم على GPT-5.6" صحيح؟

بدأ الأمر كمشاعر مجتمع وما زال غير مؤكد. جاء إصدار GA بجدول معايير خاص بـ Alibaba دون أي نتيجة من طرف ثالث — فلا تزال Artificial Analysis وLMArena بلا تقييم. حقّقت النسخة السابقة Qwen3.7-Max نتيجة 46 مقابل ~59 لـ Sol، لذا يحتاج الادعاء إلى قفزة كبيرة جدًا عبر جيل واحد ليظل صحيحًا حرفيًا.

أيهما أرخص، Qwen 3.8 أم GPT-5.6؟

يعتمد الأمر على الفئة، وقد تغيّر الجواب في 31 يوليو عندما خفّضت OpenAI الأسعار. Qwen3.8-Max بسعر 2 دولار / 6 دولارات لكل مليون. GPT-5.6 Terra بسعر 2 دولار / 12 دولارًا — نفس المدخلات وضِعف المخرجات، لذا تتفوّق Qwen هنا. Luna بسعر 0.20 دولار / 1.20 دولار، ما يجعلها أرخص بنحو 10 مرات من Qwen. Sol فئة ممتازة، لذا فإن Qwen أرخص بكثير من Sol.

أيهما أسرع؟

GPT-5.6، بشكل حاسم في الإنتاجية. تشير تقارير Artificial Analysis إلى ما يصل إلى 750 رمزًا في الثانية على أجهزة Cerebras. يُظهر Qwen3.8-Max زمن p50 للوصول إلى أول رمز يبلغ 1.64 ثانية في بيانات القياس عن بُعد لمدة 7 أيام الخاصة بـ OrcaRouter، لكن المراجعين من فترة المعاينة وجدوا أنه بطيء جدًا في البنيات الوكيلية الطويلة — وهذا الاستنتاج يسبق الإتاحة العامة ويستحق إعادة الاختبار.

هل خرج Qwen 3.8 Max من مرحلة المعاينة؟

نعم، في 3 أغسطس 2026. لديه الآن بطاقة أسعار منشورة ونقطة نهاية متوافقة مع OpenAI وDashScope، لذا فإن تأطير يوليو لحملة أرصدة Qoder بخصم 90% لم يعد يصف كيفية بيعه.

هل يمكنني استضافة Qwen 3.8 ذاتيًا لتجنب تسعير OpenAI؟

ليس الخيار الرئيسي، واقعيًا. من المقرر إصدار الأوزان خلال الأسبوع لكن لم يُنشر أي ترخيص، وبحجم ~1.2 تيرابايت بدقة 4 بت ستحتاج إلى ثمانية أو أكثر من وحدات معالجة رسومية من فئة H200. الإصدار المُعلن بالتزامن Qwen3.8-27B، الذي يُقال إنه يستهلك ~17 جيجابايت من ذاكرة الفيديو، هو الخيار العملي.

أي واحد يجب أن أستخدمه اليوم؟

GPT-5.6 Sol لأي شيء حسّاس لزمن الاستجابة، أو تفاعلي، أو يتطلب استدلالًا دقيقًا حيث تكون الجودة المدقّقة أمرًا حاسمًا. Luna للمهام البسيطة ذات الحجم الكبير، حيث تكون الخيار الأرخص بفارق كبير. Qwen3.8-Max عندما يهيمن السياق الطويل والتخزين المؤقت للطلبات على فاتورتك — فسعر موحّد يبلغ 1M توكن ومعدّل الإدخال المخزّن مؤقتًا البالغ $0.25 هما أقوى جوانب عرضها.

خلاصة القول

Qwen 3.8 مقابل GPT-5.6 معركة أكثر عدلاً مما كانت عليه في يوليو، وأقل انحيازًا بقليل من حيث السعر مما توقعه معجبو Qwen. وصل Qwen3.8-Max إلى الإتاحة العامة (GA) بتسعير حقيقي، وجدول معايير موثوق مُعلن ذاتيًا، وسعر ثابت لكل مليون توكن، بالإضافة إلى تخزين مؤقت منخفض التكلفة، مما يجعله جذابًا حقًا للعمل مع السياقات الطويلة. هذه مزايا هيكلية، وليست ترويجية.

لكن خفضَ OpenAI للأسعار في 31 يوليو أضعفَ الحجةَ المتعلقة بالتكلفة في الفئة الوسطى — إذ أصبح Terra الآن يضاهي Qwen في المدخلات — وما زالت GPT-5.6 تمتلك الخاصيتين الحاسمتين: ترتيبٌ ثانٍ مُدقَّقٌ من جهة تقييم لا مصلحة لها في النتيجة، وإنتاجية تصل إلى 750 رمزًا في الثانية لا يُظهر Qwen أي دليل على الاقتراب منها. راقب حدثين: أول درجة مستقلة من مؤشر Intelligence Index لـ Qwen3.8-Max، ووصول الأوزان مع ترخيص. وحتى ذلك الحين، وجّه اختيارك حسب الشكل — GPT-5.6 عندما تكون السرعة والإثبات مهمَّين، وQwen عندما يهيمن طول السياق وضربات التخزين المؤقت على الفاتورة — وتحقق بنفسك من خلال استفساراتك الخاصة.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا