بطاقة رئيسية مُولَّدة لـ 'Claude Haiku 5.5 مقابل Gemma 4 12B' مع لوحين يفصل بينهما خط رفيع: اللوح الأيسر مُوسَم 'Claude Haiku 5.5' ويحمل 'المؤشر 43' و'واجهة برمجة تطبيقات مملوكة'، واللوح الأيمن مُوسَم 'Gemma 4 12B' ويحمل 'المؤشر 14' و'أوزان Apache 2.0'. سطر تذييل يقول 'الدرجات حسب Artificial Analysis.' وشعار OrcaRouter مُركَّب في الزاوية اليمنى السفلى.
Guides & Insights

كلود هايكو 5.5 مقابل جيما 4 12B: نموذج بأوزان يمكنك الاحتفاظ بها في مواجهة واجهة برمجة تطبيقات مورّد

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

كلود هايكو 5.5 وG​emma 4 12B لا يتنافسان حقًا على المكانة نفسها، وأسرع طريقة لرؤية ذلك هي سطر واحد: أحدهما يُتاح كأوزان Apache-2.0 يمكنك تنزيلها وتكميمها وتشغيلها على عتادك الخاص، والآخر لا يوجد إلا خلف واجهة برمجة تطبيقات (API). وصل كلود هايكو 5.5 في 7 أكتوبر 2026 وأعاد فورًا رسم ما يمكن أن تحققه فئة صغيرة — 43 على مؤشر Artificial Analysis Intelligence Index المستقل. أما G​emma 4 12B فيقع عند 14 على اللوحة نفسها. هذه الفجوة هائلة، وهي ليست السبب الذي يجعل معظم الفرق تنتهي إلى الاختيار بينهما.

عادةً ما يُفرض الاختيار قبل الرجوع إلى أي معيار قياس: خط أنابيب خاضع للتنظيم لا يمكنه إرسال الرموز إلى مورّد، أو جهاز طرفي لا يمتلك منفذ خروج موثوقًا، أو ميزانية زمن استجابة تُقاس بالمللي ثانية، أو متطلب ضبط دقيق لا يمكن لواجهة برمجة تطبيقات مغلقة أن تلبيه أبدًا. إذا لم ينطبق أي من هذه عليك، فالإجابة ليست متقاربة. وإذا انطبق أحدها، يتوقف فارق النقاط عن الأهمية ويحسم قيد النشر الأمر برمته.

ما الذي قاسه المجلس، ومتى

الأرقام المستقلة أدناه مصدرها Artificial Analysis، أما أسعار المورّدين فتأتي من وثائق A​nthropic وG​oogle الخاصة بهما. وهما نوعان مختلفان من الأرقام، ويُشار إليهما على هذا النحو في كل المواضع.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Gemma 4 12B - the scoreboard'. The Claude Haiku 5.5 column reads independent score 43 (AA, #2 of 182), weights Proprietary API, context 1,000,000 tokens, input price $0.10 / 1M, output price $0.50 / 1M and throughput 240.4 tok/s. The Gemma 4 12B column reads independent score 14 (AA, #21 of 142), weights Apache 2.0 12B dense, context 262,000 tokens, input price $0.10 / 1M, output price $0.30 / 1M and throughput 113.1 tok/s. A footer line reads 'Both columns per Artificial Analysis; pricing per each vendor.'

• درجة مستقلة — Claude Haiku 5.5 عند 43 في مؤشر الذكاء، الثاني من بين 182 نموذجًا. G​​ 12B (الاستدلال) عند 11، 142 في فئته.

• سعر الإدخال لكل مليون رمز — Claude Haiku 5.5 بسعر 0.10 دولار حتى 100,000 رمز و0.50 دولار لما يتجاوز ذلك؛ Gemma 4 12B بسعر 0.10 دولار.

• سعر المخرجات لكل مليون رمز — Claude Haiku 5.5 بسعر 0.50 دولار حتى 100,000 رمز و2.50 دولار لما يزيد عن ذلك؛ G​emma 4 12B بسعر 0.30 دولار.

• نافذة السياق — 1,000,000 توكن لـ Claude Haiku 5.5؛ و262,000 لـ G​emma 4 12B.

• الإنتاجية — 240.4 رمز إخراج في الثانية لـ Claude Haiku 5.5؛ 113.1 لـ Gemma 4 12B، مع زمن 2.48 ثانية للرمز الأول.

• التكلفة لكل مهمة Index منجزة — 0.21 دولارًا لـ Claude Haiku 5.5. إن G​emma 4 12B رخيص بما يكفي لكل رمز بحيث يبلغ الرقم المُدمج للوحة 0.12 دولارًا لكل مليون رمز، لكن التكلفة المشتقة لكل مهمة ليست الرقم الذي ينبغي أن يحسم هذه المقارنة.

• الأوزان — Apache 2.0 لـ Gemma 4 12B، قابلة للتنزيل، كثيفة بنحو 12 مليار معامل. Claude Haiku 5.5 احتكاري؛ لا يوجد إصدار للأوزان ولا توجد خطة لإصدارها.

• العمر — G​emma 4 12B متاح منذ يونيو 2026. Claude Haiku 5.5 عمره يومان عند كتابة هذا النص.

الفارق 29 نقطة، وفارق السعر لا يكاد يذكر

انظر إلى صفّي الأسعار مرة أخرى: 0.10 دولار للإدخال لكليهما، و0.30 دولار مقابل 0.50 دولار عند الإخراج. إن G​emma 4 12B أرخص، والفرق صغير بما يكفي لأن تطغى عليه أعداد الرموز — فمُرمِّز Claude Haiku 5.5 الأحدث يعني أن النص نفسه سيتحول إلى رموز أكثر بنحو 30%، لذا فإن ميزة معدل الإخراج الخام البالغة 40% في جانب G​emma أقرب إلى التعادل في فاتورة حقيقية.

إذن فأنت تدفع السعر نفسه تقريبًا مقابل نموذج متأخر بـ29 نقطة في المؤشر، أو تدفع السعر نفسه تقريبًا مقابل نموذج متقدم بـ29 نقطة، حسب العمود الذي تقرأه أولًا. هذا هو التأطير الصادق، وينبغي قوله بوضوح: في أي مهمة يستطيع كلا النموذجين أداءها، يُعد Claude Haiku 5.5 الخيار الأفضل شراءً بسعر القائمة، وهو أفضل بفارق لن يسدّه أي قدر من هندسة التلقين على النموذج الأصغر.

السؤال المثير للاهتمام، إذن، ليس «أيّهما أفضل». بل «في أيّ من المهام في قائمتي يفشل Gemma 4 12B»، والإجابة عن ذلك هي الشيء الوحيد الذي يحسم المقارنة.

ما الذي تمنحك إياه الأوزان ولا تستطيع واجهة برمجة التطبيقات منحه؟

A screenshot of the Artificial Analysis page for Gemma 4 12B (Reasoning), showing an Intelligence Index of 14 at rank 21 of 142, speed rank 19 of 142, input $0.10 and output $0.30, 113.1 output tokens per second, a summary noting text, image, speech and video input with text output and a 262k-token context window, and the note that the score places it well above the median of 8 for comparable models.

النموذج الذي جرى تنزيله هو نوع مختلف من الأصول، ومزاياه بنيوية لا تدريجية.

• حدود البيانات — مع G​emma 4 12B، لا يوجد أي مورّد في الحلقة على الإطلاق. بالنسبة لأعباء العمل الصحية أو القانونية أو الدفاعية أو المالية، غالبًا ما يكون ذلك المتطلب الوحيد المهم، ولا تجعل أي درجة واجهة API مقبولة.

• تكلفة ثابتة بدلًا من متغيرة — نموذج كثيف بحجم 12 مليار معامل ومُكمَّم إلى أربع بتات يتّسع بسهولة على مسرّع حديث واحد. عند هذه النقطة، تصبح التكلفة الحدية لكل رمز هي الكهرباء، ويمكن قياس حجم عبء العمل وفقًا لآلة بدلًا من عدّاد.

• لا خروج بيانات، ولا كمون شبكة — نموذج 12B داخل المنشأة يجيب خلال مللي ثانية لأن لا شيء يغادر الجهاز. أما واجهة API لمورّد خارجي فتتحمّل رحلة ذهاب وإياب وذيل بدء بارد لا يمتلكه نشر طرفي ببساطة.

• الضبط الدقيق والتقطير — يمكنك تكييف G​emma 4 12B على بياناتك الخاصة، وشحن المحوِّل، وتجميده. أما ما إذا كانت A​nthropic ستسمح لك يومًا ما بالضبط الدقيق لنموذج بمستوى Haiku، فهذا ليس شيئًا يمكنك بناء خارطة طريق حوله.

• أرضية صلبة تسند خارطة طريقك — فلا يمكن إيقاف دعم الأوزان وسحبها من تحت قدميك. تعهّدت Anthropic بعدم إيقاف Claude Haiku 5.5 قبل 7 أكتوبر 2027، وهو كرم منها، لكن التعهد المقرون بتاريخ يبقى تعهدًا مقرونًا بتاريخ.

• الوسائط، بشكل غريب — تسجّل اللوحة أن G​emma 4 12B يستقبل مدخلات نصية وصورية وكلامية ومرئية لإخراج نصي، وهو استقبال أوسع من النص والصورة لدى Claude Haiku 5.5. وبالنسبة لخط أنابيب محلي يستقبل الصوت دون خدمة نسخ منفصلة، فهذه قدرة حقيقية لا يمتلكها جانب API.

A screenshot of the Hugging Face model card for gemma-4-12B, showing the Google uploader, the 'Any-to-Any' and 'Transformers / Safetensors' tags, the gemma4_unified_image-text-to-text identifier, 'Eval Results', 'Model card', 'Files and versions' and 'Community' tabs, a licence line reading 'License: Apache 2.0, Authors: Google DeepMind', and the opening of the card describing the Gemma 4 12B Unified model as sharing the multimodal functionality of Gemma 4 E2B and E4B with native audio and vision understanding and no separate encoders.

حيث لا ينجو 12B من التلامس

اللوحة نفسها التي تقيس فجوة الـ29 نقطة ترصد أيضًا الأشياء التي لا يستطيع نموذج كثيف صغير أداءها جيدًا، وسيكون تخطّيها تصرفًا غير أمين:

• سياق طويل — 262,000 توكن مقابل 1,000,000. خط أنابيب يحشو قاعدة برمجية أو سنة من السجلات في موجه واحد ليس له سبيل على G​emma 4 12B، وتقطيعه إلى حلقة استرجاع يضيف هندسة كانت النافذة الأكبر ستتجنبها.

• العمل الوكيلي والمهام القائمة على استخدام الحاسوب — فئة المهام التي يكون فيها فشل نموذج صغير صامتًا ومكلفًا. الأرقام التي أبلغت بها Anthropic بصفتها المورّد عن Claude Haiku 5.5 تضع OSWorld 2.1 عند 72.4% مقابل 15.7% لـ Haiku السابق؛ ونموذج بحجم 12B بمؤشر Index قدره 14 ليس الأداة المناسبة لتلك المهمة، وأرقام المورّد هنا إشارة مفيدة حتى مع الأخذ في الاعتبار أن أي تشغيل مستقل لم يُعِد إنتاجها.

• الإنتاجية لكل دولار على أسطول مشترك — 113 رمزًا في الثانية على نسخة مستضافة أمر جيد، لكن سبب الاستضافة الذاتية ليس السرعة، وسيكون النشر على وحدة معالجة رسومات واحدة أبطأ بعد.

• ليس بديلاً احتياطياً لأحد — إذا كنت تشغّل G​emma 4 12B في بيئة الإنتاج، فإن انقطاع أجهزتك الخاصة هو انقطاعك أنت، دون مزوّد ثانٍ يمكن التحويل إليه إلا إذا بنيت واحداً.

تشغيل أيٍّ منهما عبر نقطة نهاية واحدة

تُدرج OrcaRouter كلاً من Gemma 4 31B وGemma 4 26B A4B في الكتالوج بسعر قائمة Google بهامش ربح 0، لكن ليس 12B — ومن الجدير قول ذلك بوضوح بدلاً من الإيحاء بخلاف ذلك. يمكن الوصول إلى 12B عبر قناة التوزيع الخاصة بالمورّد وعدة منصات طرف ثالث. وبالمثل، Claude Haiku 5.5 ليس في الكتالوج بعد؛ وهو متاح من واجهة برمجة التطبيقات الخاصة بـ A​nthropic والسحابات الكبرى.

ما يقدّمه الموجّه فعلاً هو الشكل الذي تتطلبه هذه المقارنة حقًا. إن النشر المعقول لنموذج محلي رخيص ونموذج API مكلف ليس تفرعًا — بل مسار: يتولّى G​emma 4 12B أو نسخة مستضافة من G​emma 4 الإجابة عن الأغلبية السهلة، وتُرفَع الطلبات التي تُفعّل شرطًا متعلقًا بالجودة أو الطول إلى مسار A​nthropic. Claude Haiku 4.5 وClaude Sonnet 5.5 وClaude Opus 5.5 متاحة الآن في الكتالوج، لذا يمكن بناء مسار التصعيد واختباره تحت الحمل قبل أن يتوفر مسار الفئة الصغيرة أصلًا. على OrcaRouter، هذا التركيب هو تعبير DSL للتوجيه والتحويل التلقائي عند الفشل بدلًا من خدمة تديرها بنفسك، ومع تمرير أسعار قائمة المزوّدين بهامش ربح 0%، يصبح أي تحرك سعري على أي مسار ساريًا في اليوم نفسه الذي يحدث فيه.

القاعدة

اختر Claude Haiku 5.5 إلا إذا كان هناك قيد يستبعده. فهو متقدم بـ29 نقطة Index على G​emma 4 12B مقابل سعر قائمة يكاد يكون نفسه، ويستوعب مليون توكن من السياق، وهو النموذج الأقوى في كل مهمة يستطيع كلاهما محاولتها. لا توجد أي صيغة لهذه المقارنة يفوز فيها 12B بالجدارة.

اختر G​emma 4 12B عندما يكون القيد هو المقصد — عندما لا تستطيع الرموز مغادرة مقرّك، وعندما تكون الميزانية آلة لا عدّادًا، وعندما تحتاج إلى الضبط الدقيق، أو عندما تحتاج إلى الأوزان بين يديك بدلًا من بطاقة أسعار وتاريخ تقاعد. هذه ليست تفضيلات، بل متطلبات، وإزاء متطلب ما، فإن فارق 29 نقطة ليس ببساطة الرقم الحاسم.