
GPT-6.1 Sol مقابل Qwen3.8-Max: الفاتورة، لا قائمة الأسعار
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
Take one nightly repository-maintenance job, run it once a night for a month, and put GPT-6.1 Sol and Qwen3.8-Max on it in turn. On Artificial Analysis's v4.3.2 per-task figures, GPT-6.1 Sol costs $21.72 for those thirty nights and Qwen3.8-Max costs $162.27 — a gap of $140.55 a month, about $1,690 a year, for a job whose per-token price list reads $2.00 in and $10.00 out against $2.00 in and $6.00 out. The per-million rates are within a rounding error of each other on input and the Chinese model is 40% cheaper on output, yet the invoice differs by a factor of 7.5. The vendor released GPT-6.1 Sol on 29 September 2026; Qwen3.8-Max has been live since 3 August 2026.
تلك الفجوة ليست حيلة تسعير، وليست أثرًا ناتجًا عن المعيار المرجعي — بل هي كل ما لهذه المقارنة أن تقوله، وهي تنبع من رقم واحد لا تُظهره لك أي قائمة أسعار.
ما هو كل نموذج
«GPT-6.1 Sol» هو الطراز الرائد الحالي لدى OpenAI في الاستدلال والبرمجة، وقد طُرح بعد أسبوع واحد من «GPT-6 Sol» الذي حلّ محلّه، وبالسعر المعلن نفسه البالغ 2.00 دولار / 10.00 دولارات، مع سعر 0.10 دولار للإدخال المخزَّن مؤقتًا ونافذة سياق تبلغ 1,050,000 رمز. وهو مخصَّص للعمل الوكيلي: فوسوم «الأفضل في» على بطاقة الطراز الخاصة بنا تشير إلى الاستدلال والبرمجة والعمل الوكيلي، وهو يحمل درجة الجودة من الفئة الأعلى.
Qwen3.8-Max هو النموذج الرائد الوكيلي من Alibaba — نموذج مغلق لا يعمل إلا عبر API، يقبل مدخلات نصية وصورية وفيديو ويمتلك سياقًا من 1-token. وخلافًا لإصدارات Qwen، هذا الإصدار. في Artificial Analysis، يستقر عند 45.42 في المؤشر، في المرتبة 17 من 147 نموذجًا، مع مؤشر برمجي قدره 76.2 يحتل المرتبة 9 في ذلك المجال. إنه نموذج ريد. إنه ببساطة نموذج مكلف عندما يُترك ليفكر.
الرقم غير الموجود في بطاقة الأسعار

يسجل Artificial Analysis 107,730 رمز إخراج لكل مهمة لـ Qwen3.8-Max، منها 70,830 رمز استدلال. ينتج GPT-6.1 Sol 38,128 رمز إخراج، 25,190 منها استدلال. يكتب النموذج الصيني 2.8 ضعف عدد الرموز للإجابة على نفس السؤال، ويكتبها بتكلفة أقل بنسبة 40% لكل رمز.
• رموز الإخراج لكل مهمة — 38,128 مقابل 107,730؛ يكتب Qwen أكثر بمقدار 2.8×
• منها الاستدلال — 25,190 مقابل 70,830
• التكلفة لكل مهمة — 0.724 دولار مقابل 5.409 دولار؛ تكلفة Qwen أعلى بـ 7.5×
• الوقت لكل مهمة — 640 ثانية مقابل 2,152 ثانية؛ حوالي 11 دقيقة مقابل حوالي 36
• الوقت حتى أول رمز إجابة — 332.0 ث مقابل 55.1 ث
• مؤشر الذكاء — 51.83 مقابل 45.42
• نافذة السياق — 1,050,000 مقابل 1,000,000 رمز
• المدخلات المقبولة — نص، صورة وملف مقابل نص، صورة وفيديو
أجرِ عملية الضرب وسيختفي الخصم. النموذج الذي يُصدر قرابة ثلاثة أضعاف عدد الرموز بمعدل أقل بنسبة 40% لا يكلّف أقل — بل يكلّف نحو 1.7 ضعف على المخرجات وحدها، ويضع الرقم المقيس لكل مهمة المضاعف الحقيقي عند 7.5 متى أُخذ في الحسبان الإدخال والقراءات المخزّنة مؤقتًا وطول الإجابة المنتجة.
لاحظ السطرين الرابع والخامس، لأنهما يشيران في اتجاهين متعاكسين، ومعًا يشرحان ما هو Qwen3.8-Max. فهو يعيد أول توكن له في 55 ثانية، بينما يستغرق GPT-6.1 Sol خمس دقائق ونصفًا، ثم يمضي ستًا وثلاثين دقيقة في إكمال المهمة، بينما ينتهي نموذج OpenAI في إحدى عشرة دقيقة. هذا نموذج يبدأ الكلام فورًا ويفكّر بإسهاب كبير. بالنسبة لواجهة دردشة ذات إجابة متدفقة، يُقرأ ذلك على أنه سرعة استجابة. أما بالنسبة لمهمة ليلية دون إشراف، فهو وقت فعلي تدفع ثمنه أيضًا.
ثلاثة مجالات يتفوق فيها Qwen3.8-Max حقًا
تبلغ فجوة المؤشر 6.4 نقطة عبر المجموعة كاملة، وهو نوع من الأرقام يُقتبس وكأنه موحّد. لكنه ليس كذلك، والاختلاف مفيد:
• GPQA Diamond — Qwen3.8-Max 0.9283 مقابل GPT-6.1 Sol لم يُنشر في هذه الجولة
• GDPval — 1,671.4 مقابل 1,575.09
• Terminal-Bench 2.1 — 0.8876 مقابل عدم نشره في هذا التشغيل
• AutomationBench — 0.5619 مقابل 0.6487
SciCode — 0 GPT-6 Sol
• CritPT — 0.1771 مقابل 0.3171
يفوز Qwen3.8-Max في أسئلة العلوم بمستوى الدراسات العليا وعيّنة المهام المهنية، وهو نتيجة حقيقية لنموذج من جيله والسبب في أن مؤشره البرمجي يحتل المرتبة التاسعة من أصل 138. لكنه يخسر في التقييمات الأصعب المتاخمة للبحث — CritPT بفارق 14 نقطة — ويخسر AutomationBench بفارق 8.7، وهو التقييم الأكثر شبهًا بالعمل الحاسوبي غير المُراقَب. أيٌّ من هذين تعتقد أنه أكثر أهمية لعبء عملك هو القرار الفعلي؛ فالرقم الرئيسي البالغ 6.4 نقاط هو متوسطٌ لتضاربٍ في النتائج، وليس حكمًا نهائيًا.
ما الذي توفره الرموز الإضافية، وما الذي لا توفره
مسارات الاستدلال الطويلة ليست هدرًا بحكم التعريف. النموذج الذي ينفق 70,830 رمزًا من التأمل في مهمة صعبة يفعل شيئًا ربما يتخطاه النموذج الأقصر، وفي التقييمات التي يتقدم فيها Qwen3.8-Max، من المعقول أن يكون هذا التأمل هو السبب. نمط الفشل هو أنك تدفع ثمنه في كل مهمة، وليس في المهام الصعبة فحسب. أعداد رموز التفكير خاصية من خصائص معايرة النموذج، لا من خصائص صعوبة السؤال، والنموذج الذي يفرط في التفكير في استخراج سطر واحد يجعلك تدفع ثمن ذلك.
الطريقة لمعرفة أيّ من مهامك هي أيّها هي أن تتوقف عن التعامل مع اختيار النموذج كخيار عالمي. وهذا يقودنا إلى الجزء الخاص بتغيير الإعدادات.
تحتوي بطاقة النموذج الخاصة بنا لـ GPT-6.1 Sol على أرقام الخدمة الفعلية الخاصة بالخاضع: سعر 2.00 دولار / 10.00 دولار، ونافذة سياق بسعة 1,050,000 رمز، وزمن p50 قدره 4.54 ثانية للوصول إلى أول رمز، وكتلة مؤشر Artificial Analysis مخزَّنة في الصفحة نفسها التي توجد بها التسعيرة التي سيعتمد عليها التطبيق فعليًا عند التوجيه.

مفتاح واحد، عدّاد واحد، طرازان
كلا النموذجين يمكن الوصول إليهما عبر نقطة نهاية واحدة من OrcaRouter — واجهة برمجية واحدة تتسع لأكثر من 200 نموذج، مع تمرير سعر قائمة المزوّد كما هو دون أي هامش ربح. وتحمل بطاقة OrcaRouter الخاصة بـ Qwen3.8-Max السعر المقدَّم إلى جانب نافذة السياق البالغة 1,000,000 توكن، وواجهات الإدخال النصية/الصورية/الفيديوية، وحجم الاستخدام البالغ 101.4 مليون توكن على مدى سبعة أيام — وهي الأرقام التي يوجّه التطبيق مساره بناءً عليها، إلى جانب الأرقام التي يجادل فيها المقال. ويكتسب هذا التمرير أهمية خاصة في حالة Qwen3.8-Max، لأن النموذج الذي تهيمن على جدواه الاقتصادية أحجام توكنات الإخراج هو نموذج يستطيع مورده إعادة تسعيره في أي وقت، ومقياس التمرير يعني أن التغيير يصل إلى فاتورتك في اليوم الذي تنشره Alibaba لا وفق الجدول الزمني لأحد الموزّعين.

الاستخدام الأكثر إثارة للاهتمام لطبقة التوجيه هنا هو لغة التوجيه DSL، التي تتيح لك تركيب نماذج في استدعاء واحد بدلًا من اختيار نموذج واحد للتطبيق بأكمله. قسّم المهمة الليلية: نموذج رخيص يصنّف ويستخرج، ويتولّى GPT-6.1 Sol خطوات الاستدلال والتحقق، ويُحتفَظ بـ Qwen3.8-Max للمهام التي يُحدث فيها تفكيره الطويل وقوته العلمية من فئة GPQA فرقًا فعليًا في الإجابة. ويغطّي التحويل التلقائي عند الفشل ما تبقّى — إذا تدهور مزوّد أثناء التشغيل، ينتقل الطلب بدلًا من أن تفشل الدفعة.
لا يُعد أيٌّ من هذين سببًا لاختيار نموذج. إنهما السبب في أنك لست مضطرًا إلى اتخاذ قرار الاختيار مرة واحدة والتعايش معه.
المكالمة، والشيء الذي يجب الانتباه إليه
ادفع تكلفة 7.5 أضعاف فقط حيث يستحق التروّي ذلك. في مهمة ليلية عامة الغرض، يُعدّ GPT-6.1 Sol بتكلفة 0.724 دولار للمهمة الخيار الافتراضي القابل للدفاع عنه، و1,690 دولارًا سنويًا مبلغ حقيقي. وحيث تكون المهمة في العلوم الصعبة أو الاستدلال المهني بإجابة قابلة للتحقق، فإن 0.9283 لـ Qwen3.8-Max على GPQA Diamond تستحق التوكنات — فهذا هو الأمر المحدد الذي تتفوق فيه.
ما ينبغي مراقبته هو ما إذا كانت علي بابا تعيد التسعير. نموذج بمعامل 2.8× للرموز بسعر 2.00/6.00 دولار مُسعَّر كما لو كانت الرموز هي الشيء النادر؛ لكن سلوك النموذج نفسه يجعل الرموز وفيرة. إذا تحرّك سعر الإخراج تحرّكًا ملموسًا، فستتحرك الحسابات الواردة في هذا المقال معه، وسيُظهر لك مقياس التمرير ذلك في اليوم نفسه الذي يحدث فيه.
مقارنات في هذه المقالة3
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
