بطاقة رئيسية مُولّدة بعنوان 'Claude Haiku 5.5 مقابل Qwen3.8 27B' مع عبارة تمهيدية 'الأوزان المفتوحة مقابل API'، تعرض Claude Haiku 5.5 عند المدخلات $0.10، والمخرجات $0.50، والمؤشر 43.40 مقابل Qwen3.8 27B عند المدخلات $0.50، والمخرجات $3.00، والمؤشر 33.70، فوق شريط يقرأ 'تكلفة المهمة المكتملة $0.21 مقابل $1.01'.
Engineering & Research

Claude Haiku 5.5 مقابل Qwen 27B: حجة حول واجهة API، ولماذا ما زلنا موجودين

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

معظم المقارنات في هذه السلسلة تُختزل إلى مقايضة. هذه المقارنة ليست كذلك، وغياب المقايضة هو بحد ذاته الاستنتاج. Claude Haiku 5.5، الذي صدر في 7 أكتوبر 2026، يتفوق على Qwen3.8 27B، النموذج الكثيف مفتوح الأوزان بحجم 27B من 14 أغسطس 2026، في درجة الذكاء المركبة، وفي التكلفة لكل رمز، وفي التكلفة لكل مهمة منجزة، وفي نافذة السياق، وفي سقف الاستجابة، وفي البرمجة الوكيلية، وفي صفوف الاستدلال العلمي — وهو يفعل ذلك من واجهة برمجة تطبيقات API احتكارية واحدة لا تتطلب أي عتاد. الصف الوحيد الذي يفوز به Qwen3.8 27B بشكل قاطع هو إدخال الفيديو، والآخر هو الترخيص.

هذا ليس سببًا لاستبعاد النموذج، لأن ترخيص Apache-2.0 ووجود نمطية الفيديو ليسا جائزة ترضية. إنه سبب ليكون المرء دقيقًا بشأن لماذا قد يختار أي شخص جانب الأوزان المفتوحة، وللتوقف عن التظاهر بأن النقاش يدور حول المقاييس المعيارية.

الأرقام التي شُغِّل كلا النموذجين عليها فعليًا

لكل مليون رمز بالدولار الأمريكي. أسعار المورّد مستمدة من وثائق التسعير الخاصة به؛ والقياسات المشتركة هي مؤشر Artificial Analysis Intelligence Index v4.3.2، بتاريخ 2026-10-08، وكلاهما بأعلى إعداد جهد منشور.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Qwen3.8 27B — the scoreboard' with rows Index v4.3.2 43.40 against 33.70, cost per task $0.21 against $1.01, input price $0.10 against $0.50, context window 1M tokens against 256K tokens, AutomationBench 0.3541 against 0.4824 and weights 'proprietary' against 'open, Apache 2.0', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; Qwen vendor-card scores are unreproduced by the board.'

• الإدخال — Claude Haiku 5.5: 0.10 دولار حتى 100,000 رمز، و0.50 دولار لما فوق ذلك؛ Qwen3.8 27B: 0.50 دولار وفق سعر الطرف الثالث المسجَّل في اللوحة.

• المخرجات — Claude Haiku 5.5 بسعر 0.50 دولار حتى 100,000 رمز و2.50 دولار لما فوق ذلك؛ Qwen3.8 27B بسعر 3.00 دولار.

• الإدخال المخزَّن مؤقتًا — Claude Haiku 5.5 بسعر 0.01 دولار و0.05 دولار، بخصم 90%؛ Qwen3.8 27B بسعر 0.10 دولار، بخصم 80%.

• درجة مستقلة — 43.40 لـ Claude Haiku 5.5 (Max) مقابل 33.70 لـ Qwen3.8 27B (Xhigh). فارق 9.70 نقطة، وهو الأوسع في هذه الدفعة.

• التكلفة لكل مهمة منجزة — 0.21 دولار مقابل 1.01 دولار، في نفس جولة التقييم. فجوة تبلغ 4.7 أضعاف، وهي أيضًا الأوسع هنا.

• السياق والإخراج — 1 مليون رمز وحد أقصى للاستجابة قدره 128,000 رمز لـ Claude Haiku 5.5؛ وسياق من 256 ألف رمز لـ Qwen3.8 27B.

• الوسائط المتعددة — كلاهما يقبل النصوص والصور ويعيد النصوص. يضيف Qwen3.8 27B إدخال الفيديو؛ أما Claude Haiku 5.5 فلا يفعل ذلك.

• الأوزان — Qwen3.8 27B هو نموذج بكثافة 27B من المعاملات، بموجب رخصة Apache 2.0، وقابل للتنزيل. أما Claude Haiku 5.5 فهو احتكاري ومتاح عبر API فقط.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the two-tier pricing lines and 'Released October 7, 2026'.

لماذا تكون الفجوة لكل مهمة أربعة أضعاف الفجوة لكل رمز

تُظهر بطاقة الأسعار بالفعل فجوة إدخال تبلغ 5 أضعاف وفجوة إخراج تبلغ 6 أضعاف لصالح المورّد، لذا لا شك في الاتجاه. والجدير بالقراءة أن الرقم لكل مهمة أصغر من الرقم لكل رمز، وهو عكس ما حدث في المقارنات الأخرى ضمن هذه الدفعة، والسبب يحمل درسًا.

Claude Haiku 5.5 يُصدر 162,164 توكن إخراج لكل مهمة في مؤشر الذكاء — 129,047 للاستدلال و33,118 للإجابة. Qwen3.8 27B يُصدر 66,797، مقسمة إلى 47,711 للاستدلال و19,087 للإجابة. يستهلك نموذج المورّد 2.4 ضعف عدد التوكنات لكل مهمة، لذا فإن ميزته في معدل الإخراج البالغة 6 أضعاف تتقلص إلى ميزة تبلغ 4.7 أضعاف لكل مهمة. لا تزال هائلة. لكنها ليست الرقم الذي يعلن عنه جدول الأسعار.

حساب المزيج طريقة أنظف لرؤية شكله. في مزيج 7:2:1 المُثقَل بالمدخلات — وهو الوزن الذي تحمله معظم حركة الإنتاج فعليًا — يبلغ Claude Haiku 5.5 نحو $0.077 لكل مليون رمز مقابل $0.470 لـ Qwen3.8 27B. وفي مزيج متوازن 1:1 يبلغ $0.30 مقابل $1.75. إن حدّ 100,000 رمز لدى المورّد هو الشيء الوحيد الذي يسدّ هذه الفجوة أبدًا: فبعد تجاوزه، تصبح عدّادات Claude Haiku 5.5 عند $0.50 و$2.50 على الطلب كله، ويلتقي النموذجان عند السعر نفسه تقريبًا — وعندها تدفع علاوة قدرها 9.7 نقطة في النتيجة مقابل لا شيء.

حيث تتعارض بطاقة المورد مع اللوحة المستقلة

هذه هي مجموعة الصفوف التي تستحق التمهل عندها، لأن بطاقة النموذج الخاصة بـ Qwen3.27B 27B تبدو أقوى بكثير مما تُظهره القياسات المستقلة، والفرق هو السبب الكامل وراء حاجة ادعاء «نموذج 27B ينافس نماذج أكبر بكثير» إلى مصدر ثانٍ.

تشمل الأرقام المنشورة الخاصة بالمورّد نفسه، كما هي مسجلة على صفحة الكتالوج لدينا الخاصة بالطراز، 90.3 على LiveCodeBench v6، و89.2 على GPQA Diamond، و84.3 على OSWorld-Verified، و79.0 على QwenSWEBench. هذه أرقام مُبلَّغ عنها من المورّد ولم يُعَد إنتاجها، وهي تصف طرازًا منافسًا يتجاوز فئته بكثير.

في التشغيل المستقل لـ Artificial Analysis، يسجّل Qwen3.8 27B 0.0556 على Terminal-Bench 4.0، و0.4664 على SciCode، و0.3392 على Humanity's Last Exam، و1423.21 على GDPval-AA v2.1. ضع الرقم 0.0556 إلى جانب الرقم 84.3 الذي تُبلغ عنه بطاقة المورّد على OSWorld، وستتضح صورة الاختلاف: في العمل الوكيلي على الحاسوب والطرفية، تضع اللوحة المستقلة هذا النموذج تقريبًا حيث ينتمي نموذج كثيف بحجم 27B، بينما لا تفعل بطاقة المورّد ذلك.

هناك صفان يسيران في الاتجاه المعاكس، ويستحقان الذكر للسبب نفسه. يسجل Qwen3.8 27B 0.4824 على AutomationBench مقابل 0.3541 لـ Claude Haiku 5.5 — فوز مستقل بفارق 12.8 نقطة على أقرب ما يملكه أي من اللوحين إلى معيار أتمتة الأعمال. هذا رقم حقيقي من نفس التشغيل، على الصف الأقرب إلى ما ينشر الناس النماذج الصغيرة من أجله فعليًا.

القراءة الصادقة ليست أن «البائع ضخّم كل شيء». بل إن بطاقة النموذج تقيس المهام التي اختار مؤلفوها، واللجنة المستقلة تقيس مجموعة ثابتة، ونقاط قوة Qwen3.8 27B موجودة على قائمة البائع لا على قائمة اللجنة.

تتغير المعادلة الاقتصادية عندما تمتلك العتاد

كل سعر مذكور أعلاه هو سعر API، وبالنسبة إلى Qwen3.8 27B فإن هذا إطار خاطئ.

هذا نموذج كثيف بحجم 27B بموجب Apache 2.0. يتّسع على مسرّع حديث واحد عند مستوى التكميم الذي تقبله معظم الفرق، ما يعني أن التكلفة الحدية للرمز تتوقف عن كونها عدّاد مورّد وتصبح استغلالك الخاص. لهذا السبب يختلف سعر استدعائه حسب المضيف على نحو لا يستطيع أي من النموذجين الاحتكاريين في هذه المقارنة أن يفعله أبدًا: يسجّل الجدول سعر طرف ثالث قدره $0.50 للإدخال و$3.00 للإخراج، ويتيحه كتالوج OrcaRouter بسعر $0.33 للإدخال و$2.40 للإخراج من دون أي بند لقراءة الذاكرة المؤقتة على الإطلاق، لأننا نشغّل الأوزان على بنيتنا التحتية الخاصة بدلًا من إعادة بيع نقطة نهاية طرف آخر.

بالنسبة لفريق يدفع بالفعل مقابل وحدات معالجة الرسومات (GPUs)، فإن المقارنة ليست بين $0.21 و$1.01 لكل مهمة. بل هي بين السعر الذي يفوتره المورّد والتكلفة الإضافية لطلب واحد على عتاد تملكونه أنتم، وهذان رقمان مختلفان. هذه هي الحجة لصالح جانب الأوزان المفتوحة، وهي الوحيدة التي تصمد عند مواجهة جدول المعايير.

ثمة نتيجة ثانية أقل وضوحًا لكون الترخيص Apache 2.0: إذ يمكن شحن النموذج داخل منتج، وضبطه ضبطًا دقيقًا على حركة الاستخدام الخاصة بك، وتثبيته عند مراجعة محددة، وتدقيقه وصولًا إلى الأوزان. لا شيء من ذلك متاح بأي ثمن من نموذج مملوك لا يُتاح إلا عبر API، وبالنسبة لأعباء العمل الخاضعة للتنظيم، كثيرًا ما يكون هذا هو القيد الحاسم بدلًا من كونه مجرد تفضيل.

A capture of the OrcaRouter model page for Qwen3.8 27B under qwen/qwen3.8-27b, showing a 262K-token context chip, text, image and video input, text output, a p50 time to first token of 1.84 seconds, public benchmarks by Qwen dated 2026-08-15, and the page's own description of the model as Alibaba's open-weight 27B dense multimodal model released under Apache-2.0 and self-hosted on OrcaRouter's own infrastructure.

الاتصال بأيّ منهما

Qwen3.8 27B is on the OrcaRouter catalogue as qwen/qwen3.8-27b at $0.33 and $2.40 per million tokens, self-hosted on our own infrastructure, with the OpenAI-compatible endpoint at https://api.orcarouter.ai/v1. Run against our own traffic over the last week it returns a median 1,837 ms to first token at 319 output tokens per second — a fast model, measured on our playground rather than a standardised harness, so treat that as a serving figure and not a benchmark. Video, image and text input, 262K-token context, native tool calling, structured outputs and a reasoning mode are all supported on the same key as everything else on the catalogue.

Claude Haiku 5.5 ليس في الكتالوج. ويمكن الوصول إليه مباشرةً عبر واجهة برمجة التطبيقات الخاصة بالمورّد، وعبر AWS وAzure ومنصات السحابة الكبرى، وهذا هو البيان الدقيق. وما يحمله الكتالوج فعلاً من تشكيلة المورّد هو Claude Sonnet 5.5 وClaude Opus 5.5، وهو ما يجعل مسار الترقي من نموذج صغير مُستضاف ذاتيًا إلى نموذج وكيلي مُستضاف من الطبقة المتوسطة مجرد تغيير في التوجيه بدلًا من تكامل ثانٍ — التجاوز التلقائي عند الفشل يقع تحته في كلتا الحالتين.

الحكم، الذي يتسم بعدم توازن غير معتاد

بصفتها استدعاء API على النصوص أو الصور، يفوز Claude Haiku 5.5 في هذه المقارنة في كل صف لا يتعلق بالترخيص. تسع نقاط وسبعة من نقاط المؤشر، أرخص بمقدار 4.7 مرة لكل مهمة منجزة، أربعة أضعاف نافذة السياق، ضعف سقف الاستجابة، وسعر أقل بخمس إلى ست مرات داخل نطاق المطالبات القصيرة. لا توجد حجة متعلقة بشكل عبء العمل تنقذ Qwen3.8 27B من حيث السعر، لأن عيب المورّد — الاستخدام الكثيف لوحدات التوكين في المخرجات — يساوي أقل بكثير من ميزته السعرية.

ما ينقذها هو كل ما لا يلتقطه سعر واجهة برمجة التطبيقات: ترخيص يسمح بإعادة التوزيع، وأوزان يمكن الاحتفاظ بها وتثبيتها، وإدخال فيديو، ومسار استضافة ذاتية تكون فيه تكلفة الرمز الواحد من عتادك أنت بدلًا من بطاقة مورّد. إذا كنت تبحث عن أرخص طريقة لتصنيف النص واستخراجه وتلخيصه وتوجيهه، فإن Claude Haiku 5.5 هو الجواب، والفجوة ليست ضيقة. وإذا كنت تبحث عن نموذج يمكنك وضعه داخل منتجك الخاص، على عتادك الخاص، وتحت تدقيقك الخاص، فقد كفّت فجوة المعايير عن كونها السؤال منذ عدة فقرات.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا