بطاقة رئيسية بعنوان Claude Sonnet 5.5 مقابل Qwen3.8 Max، وعنوان فرعي: ستة أسابيع، طبقتان، وحكم واحد بشأن التكلفة، مع شرائح تقرأ: الإدخال $2 لكليهما، الإخراج $10 مقابل $6، والمؤشر 56 مقابل 45، وتذييل يستشهد بـ Artificial Analysis v4.3.2 وأسعار المورّد.
Guides & Insights

Claude Sonnet 5.5 مقابل Qwen3.8 Max: ستة أسابيع، فئتان، وحكم واحد على التكلفة

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

أجرِ الحسابات على ثلاثة مطالبات، وستُحسم المقارنة غالبًا قبل أن تصل إلى المعايير. استدعاء قصير للرد على دعم: 2,000 رمز إدخال، و500 رمز إخراج. على Qwen3.8 Max بسعر دولارين لكل مليون إدخال و6 دولارات لكل مليون إخراج، يكون ذلك أربعة أعشار سنت؛ وعلى Claude Sonnet 5.5 بسعر دولارين و10 دولارات، يكون تسعة أعشار سنت. إعادة هيكلة مستودع: 400,000 إدخال، و30,000 إخراج — 43 سنتًا مقابل 83 سنتًا. جلسة وكيلية طويلة تنفق ميزانيتها فعلاً: مليونان من الرموز إدخالًا، و200,000 إخراجًا، أي 5.20 دولارات مقابل 6.30 دولارات بمجرد أن تصبح الأرقام كبيرة بما يكفي ليسيطر جانب الإدخال.

الفجوة التي تبدأ كفرق 2.25× في سعر الإخراج تضيق إلى نحو 1.2× على النطاق الوكيلي، وهذا التوسع ليس مجرد فضول. Qwen3.8 Max وClaude Sonnet 5.5 كلاهما نموذجان بسعة مليون رمز مع سقوف إخراج مرتفعة، وكلاهما مسعّر بـ2 دولار لكل مليون على الإدخال، وأُطلق كلاهما خلال ثمانية أسابيع من الآخر — إصدار المورّد في 3 أغسطس 2026 مع تحديث مؤرخ في 2 سبتمبر، وAnthro​pic's في 28 سبتمبر. الفرق بينهما ليس في بطاقة الأسعار. بل في ما ينفقه كل منهما لإتمام المهمة.

ما الذي تم إصداره، ومتى؟

Qwen3.8 Max هو أعلى مستوى قدرات لدى Alibaba حتى الآن. وتضعه Alibaba مباشرة في مواجهة GPT-5.5 وClaude Opus 4.7 وGemini 3.1 Pro في دليل الترحيل الخاص بها، وتوصي به كلما احتاجت مهمة إلى أقوى استدلال متاح. وهو يحمل نافذة سياق تبلغ مليون رمز، ويقبل إدخال النص والصورة والفيديو، ويُخرج نصًا — وواجهة إدخال الفيديو هي القدرة الوحيدة هنا التي لا يمتلكها Claude Sonnet 5.5. التسعير هو 2 دولار لكل مليون إدخال و6 دولارات لكل مليون إخراج، مع قراءات ذاكرة التخزين المؤقت بسعر 0.25 دولار وكتابات ذاكرة التخزين المؤقت بسعر 2.50 دولار. ينضم إلى إدخال 3 أغسطس في كتالوجنا تحديث بتاريخ 2 سبتمبر مُدرج باسم Qwen3.8 Max (0902)، والذي يحمل نفس الأسعار الرئيسية وسقف إخراج يبلغ 131 ألفًا.

Two-column scoreboard for Claude Sonnet 5.5 and Qwen3.8 Max across six rows. Left column Claude Sonnet 5.5: input $2.00 per million, output $10.00 per million, text and image input, AA Intelligence Index 56, cost per Index task $7.60, released September 28 2026. Right column Qwen3.8 Max: input $2.00 per million, output $6.00 per million, text image and video input, AA Intelligence Index 45, cost per Index task $5.41, September 2 2026 refresh. A footer line reads Index and cost per task per Artificial Analysis v4.3.2; prices per the vendors.

Claude Sonnet 5.5 هو النموذج الثاني في الجيل 5.5 من Anthropic، وقد صدر في 28 سبتمبر 2026، بعد ستة أيام من Claude Opus 5.5. وهو يُتاح باسم claude-sonnet-5-5 على Claude API وعبر Amazon Bedrock وGoogle Cloud وMicrosoft Foundry، مع نافذة سياق تبلغ مليون رمز، وسقف إخراج متزامن قدره 128 ألف رمز يمتد إلى 300 ألف على Message Batches API خلف ترويسة output-300k-2026-03-24، مع الإبقاء على أسعار Claude Sonnet 5 كما هي تمامًا: دولاران للإدخال، و10 دولارات للإخراج، و0.20 دولار لقراءات الذاكرة المؤقتة، و2.50 دولار لكتابات الذاكرة المؤقتة. احتفاظ صفري بالبيانات منذ الإطلاق، وإيقاف الخدمة ليس قبل 28 سبتمبر 2027.

إذن، سعر الإدخال متطابق، ونوافذ السياق بالحجم نفسه، وقد جدّد المورّدان إصداراتهما خلال شهر أحدهما من الآخر. وكل ما يفصل بينهما يقع في جانب المخرجات من الفاتورة أو في اختبارات الأداء.

المقاييس المرجعية: جدول المورّد مقابل المؤشر المستقل

يوجد هنا نوعان من الأدلة، وهما ليسا قابلين للتبادل.

جدول الإطلاق الخاص بـ Anthropic مُبلَّغ عنه من الجهة المورّدة، ولم يُعِد إنتاجه أي طرف ثالث، ويغطي ثماني تقييمات. الصفوف التي تهم

• تيرمينال-بنش 4.0 — Claude Sonnet 5.5 بنسبة 70.6% مقابل 10.3% لـ Claude Sonnet 5

• CursorBench 4.0 — 55.5% مقابل 34.1% لـ Claude Sonnet 5

• GDPval-AA v2.1 — 1844 مقابل 1449 لـ Claude Sonnet 5، و1846 لـ Claude Opus 5.5 و1487 لـ GPT-6 Sol

• اختبار البشرية الأخير، مع الأدوات — 64.5% مقابل 54.9%؛ ويسجّل Claude Opus 5.5 نسبة 67.7%

• OSWorld 2.1، جزئي — 80.1% مقابل 57.0%

• رسم المخططات، بدون أدوات — 61.6% مقابل 15.6%

لا تنشر علي بابا جدولًا رباعي الأعمدة مكافئًا مباشرةً، لذا فإن الأرقام الوحيدة التي يمكن وضعها على المحور نفسه هي الأرقام المستقلة. Artificial Analysis، مراجعة v4.3.2

• مؤشر الذكاء المركّب — Claude Sonnet 5.5 56 في المرتبة 3 من أصل 216؛ Qwen3.8 Max 45 في المرتبة 27

• تكلفة كل مهمة في Intelligence Index — 7.60 دولار مقابل 5.41 دولار

• سرعة الإخراج — يعمل نموذج Anthropic وفق خط أساس Claude Sonnet 5 مُقاس عند 78.7 رمزًا في الثانية؛ بينما يُقاس Qwen3.8 Max عند 39.1

• الإسهاب — 410 مليون رمز مُخرَج على Index مقابل 190 مليون

تُعدّ درجات Qwen3.8 Max الخاصة بكل تقييم محترمة وليست هامشية: ‏92.8% في GPQA Diamond، و88.8% في Terminal-Bench 2.1، و80.3% في استرجاع السياق الطويل، و47.8% في tau-banking. لكنه يتراجع في النتيجة المركّبة لأنه لا يفوز بأي شيء بشكل حاسم، بينما تفوز الطبقة الأحدث من Anthropic بعدة أمور بشكل قاطع. لاحظ أيضًا أن الصفحة المستقلة الخاصة بـ Qwen3.8 Max تحمل تاريخ إصدار 2 سبتمبر 2026 وقراءة سياق 984K — إنها تصف تحديث (0902)، وليس إصدار أغسطس، وأن خلط الأرقام بين الاثنين سيكون خطأً.

Artificial Analysis model page for Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback), released September 2026, showing an Intelligence Index of 56, a price of $2.00 per million input tokens and $10.00 per million output tokens, a cost of $7.60 per Intelligence Index task, a verbosity of 410M output tokens against a median of 88M, and a 1M-token context window.

ما يغيب عن كلا العمودين لا يقل أهمية عما هو موجود فيهما. لم يُعِد أحد إنتاج أرقام Anthropic الخاصة بـ OSWorld أو Terminal-Bench بشكل مستقل. ولم ينشر أحد رقم Chartography أو CursorBench الخاص بـ Qwen3.8 Max. الرقم المركب هو الرقم الوحيد الذي جرى قياسه بالطريقة نفسها على كلا النموذجين، ولهذا تحديدًا يؤدي رقم التكلفة لكل مهمة الواقع أسفله دورًا كبيرًا إلى هذا الحد.

الرقم الذي يحسم الأمر، وهو ليس على أيٍّ من بطاقتَي الأسعار.

تفرض Artificial Analysis الرسوم على كلا النموذجين بالطريقة ذاتها: تشغيل التقييمات العشرة في المؤشر، واحتساب الرموز، وضربها في سعر القائمة. يبلغ Claude Sonnet 5.5 نحو 7.60 دولارات لكل مهمة، ويبلغ Qwen3.8 Max نحو 5.41 دولارات، أي علاوة بنسبة 40% لصالح نموذج Anthropic رغم حصوله على درجة مركّبة أعلى. توضّح قراءات الإسهاب الاتجاه — 410M رمز مقابل 190M — وتوضّح قراءات السرعة بقية الأمر: النموذج الذي يُصدر رموزًا أقل ويستغرق وقتًا أطول لكل رمز ليس هو النموذج الذي يدفع مقابل الإخراج بضعف المعدل.

ادعاء Anthropic نفسه بشأن الكفاءة يتسق مع السرد نفسه بدل أن يناقضه. تقول الشركة إن Claude Sonnet 5.5 يولّد مخرجات أسرع بنسبة تزيد على 30% من Claude Sonnet 5 ويكلّف "ما يصل إلى 30% أقل لكل مهمة" بالأسعار نفسها — وهو ادعاء عن الرموز لكل مهمة، لا عن المعدلات. وما إذا كان يصمد أمام نموذج يستهلك أقل من نصف عدد الرموز هو بالتحديد ما يطرحه رقم 7.60 دولار، وتشغيل مستقل واحد ليس إلا نقطة بيانات واحدة.

النتيجة العملية: معدل الإخراج بين 6 دولارات و10 دولارات هو الرقم الذي سينظر إليه قسم المشتريات، وهو أقل رقم تنبؤي في المقال. أما الرقم التنبؤي فهو عدد الرموز (tokens) لكل مهمة على مطالباتك الخاصة، ولن يقدمه لك أي من البائعين.

المدخلات، والفيديو، وفخ الترحيل

الفرق في القدرات الذي يظهر فورًا هو نوع الوسائط. يقبل Qwen3.8 Max الفيديو إلى جانب النص والصور؛ بينما يقبل Claude Sonnet 5.5 النص والصور. بالنسبة لتحليل تسجيلات الشاشة، أو خطوط معالجة لقطات الاجتماعات، أو أي شيء يتعامل مع الفيديو كمدخل من الدرجة الأولى، ليست هذه فجوة في المقاييس المرجعية — بل هي مسألة أهلية ثنائية، ولا يجتازها إلا واحد فقط من هذين النموذجين.

OrcaRouter model page for qwen/qwen3.8-max, attributed to Qwen and dated 2026-08-03, showing a 1M-token context window, text, image and video input, an input price of $2.00 and output price of $6.00 per million tokens, a p50 time to first token of 2.25 seconds, and 53.0M tokens of traffic in the last seven days.

الفرق الذي يظهر بعد أسبوع هو فرق سلوكي. تُجري Claude Sonnet 5.5 خمسة تغييرات كاسرة على الكود الذي يعمل على Claude Sonnet 5. وأي قيمة غير افتراضية لـ temperature، top_p أو top_k تُعيد الآن 400. وإرسال thinking: {"type": "disabled"} يُعيد 400 ويشير إلى between_tools، وهو أدنى إعداد تفكير جديد، يُقبل عند الجهد low وmedium وhigh ويُرفض عند xhigh أو max. واستخدام الأدوات القسري — tool_choice بقيمة "any" أو أداة مُسمّاة — يُعيد 400 مباشرةً. وأداة استخدام الكمبيوتر الأقدم computer_20251124 مرفوضة على Claude API وGoogle Cloud. كما أن كتل التفكير مرتبطة بالنموذج وبالحساب الذي أنتجها، لذا يمكن تمرير الاستدلال من Claude Sonnet 5 إلى الأمام ولكن ليس إلى عائلة أخرى، ويمكن أن تحوّل بادئة محادثة معدّلة إعادة التشغيل إلى خطأ.

Qwen3.8 Max لا يطلب أيًّا من ذلك. فهو نموذج بصيغة OpenAI ذو واجهة طلبات تقليدية، والانتقال إليه من فئة Qwen أخرى ليس سوى تغيير في سلسلة اسم النموذج.

وازِن بين الكلفتين بصدق. اختيار نموذج Qwen يكلّفك فجوة المركّب البالغة إحدى عشرة نقطة، وأرقام مزوّد Anthropic التي لا يمكنك التحقق منها بشكل مستقل على أي حال. أما اختيار نموذج Anthropic فيكلّفك إدخال الفيديو وقائمة من أربعة تغييرات في API، كلٌّ منها سيفشل بشكل صاخب برمز 400 عند أول ارتطام به — وهو النوع الجيد من الفشل، لكنه يوم عمل على أي حال.

أين يتناسب OrcaRouter

السبب في التوجيه بدلًا من الاختيار هو أن الرقم الحاسم — التكلفة لكل مهمة على حركة المرور لديك — لا يمكن حسابه من وثائق أيٍّ من المورّدين.

OrcaRouter هو نقطة وصول واحدة متوافقة مع OpenAI تغطي أكثر من 200 طراز، مع تمرير سعر قائمة المزوّد كما هو دون أي هامش ربح، لذا فإن أي خفض في السعر أو تغيير في الفئة من أي من الجانبين يصبح سارياً في اليوم نفسه الذي يُعلن فيه. كلا إصدارَي Qwen3.8 Max موجودان في الكتالوج بسعر Alibaba نفسه البالغ $2 / $6 — إصدار أغسطس ونسخة (0902) المحدّثة — إلى جانب Claude Sonnet 5، الطراز الذي لا يزال معظم حركة Claude API يعمل عليه، قابل للتوجيه منذ 30 يونيو بسعر Anthropic البالغ $2 / $10 بمعدل مقاس يبلغ 150 رمز إخراج في الثانية. أما Claude Sonnet 5.5 نفسه فليس في كتالوجنا بعد؛ وبما أن ذلك صحيح، فإن الطريق الأمين إليه هو واجهة API الخاصة بالمزوّد والسحابات الثلاث التي تدرجها Anthropic، وسبيل تجربته دون نقل أي عبء عمل هو جزء من حركة المرور خلف تحويل تلقائي عند الفشل إلى Claude Sonnet 5 أو Qwen3.8 Max.

أي واحد، لأي وظيفة؟

يتفوّق Qwen3.8 Max في إدخال الفيديو، وفي معدّل الإخراج، وفي التكلفة المقيسة لكل مهمة فهرسة، وفي جهد التكامل. وهو الخيار الافتراضي الصحيح للأعمال ضخمة الحجم والمحدّدة تحديدًا جيدًا، حيث لا تظهر فجوة مركّبة قدرها اثنتا عشرة نقطة في جودة المخرجات.

يتفوق Claude Sonnet 5.5 في المؤشر المركّب المستقل، وفي تقييمات البرمجة الوكيلية حيث أظهرت أرقام Anthropic كمورّد قفزة بمقدار 60 نقطة عن سابقه على Terminal-Bench 4.0، وفي سقف الإخراج الدفعي البالغ 300K، وفي قرار شبيه بالمهمة لا تستطيع بطاقة أسعار اتخاذه: إنه النموذج الذي ينبغي اختياره عندما تكون المهمة صعبة بما يكفي ليكون الصواب فيها أهم من الرخص.

ما قد يغيّر الإجابة لأيٍّ منهما هو الشيء نفسه، وهو ليس إصدار معيار قياس جديد. إنه عدد الرموز لكل مهمة على مطالباتك الخاصة، وبإعدادات الجهد الخاصة بك، لكلا النموذجين. إن معامل الجهد لدى Anthropic وسقف الإخراج لدى Qwen هما رافعتان مؤثرتان في ذلك العدد، وأنت من يضبط كليهما، لا قائمة أسعار المزوّد.

الشيء الوحيد الذي تحسمه هذه المقارنة: عند 2 دولار لكل مليون على الإدخال، لم يعد جانب الإدخال في الفاتورة عامل تمييز بين نموذج صيني رائد وAnthropic من الفئة المتوسطة. فقد انتقل هذا السباق إلى جانب الإخراج وإلى عدد الرموز منذ أشهر.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا