بطاقة رئيسية مُولَّدة بعنوان 'Claude Haiku 5.5 vs Nemotron 3.5 Lightning 30B A3B Base' مع عبارة استهلالية 'النموذج الرخيص لا يستطيع الإجابة عن سؤال' وشرائح تعرض 0.10 دولار مقابل 0.06 دولار لكل مليون رمز إدخال، ومؤشر AA 43 مقابل 13، وجاهز للإجابة مقابل نقطة تحقق أساسية.
Guides & Insights

Claude Haiku 5.5 مقابل Nemotron 3.5 Lightning 30B A3B Base: الرخيص لا يستطيع الإجابة عن سؤال

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

على الرقمين الأكثر أهمية في جدول بيانات المشتريات، يفوز الطراز الأرخص والأسرع. يعمل Nemotron 3.5 Lightning 30B A3B Base بسرعة 298.9 رمز إخراج في الثانية، وهو الأسرع بين 142 طرازًا يجري تتبّعها بشكل مستقل، ويكلّف 0.06 دولار لكل مليون رمز إدخال مقابل 0.10 دولار لـ Claude Haiku 5.5. وهو أيضًا، كما تحذّرك كلمة "Base" في اسمه، ليس مساعدًا. إنه نقطة تحقق مُدرّبة مسبقًا — لا ضبط دقيق تحت إشراف، ولا تعلّم معزّز، ولا قالب محادثة يستحق الاسم — نُشر بموجب رخصة OpenMDW-1.1 في 11 أغسطس 2026 كي يتمكن آخرون من البناء عليه. أما Claude Haiku 5.5، الذي صدر في 7 أكتوبر 2026، فهو منتج نهائي يمكنك إرسال سؤال إليه. ومقارنتهما من حيث السعر تشبه مقارنة تكلفة الطحين بتكلفة الخبز، والجزء المثير للاهتمام في هذه المواجهة هو تحديد أيّهما يحتاجه عبء العمل لديك فعلاً.

لا أحد في تغطية الإطلاق يقول ذلك الجزء بوضوح، لأن «أرخص وأسرع من Claude Haiku 5.5» عنوان أفضل من «أرخص وأسرع وغير قابل للاستخدام دون إجراء ضبط دقيق». كلا العبارتين صحيحتان. وواحدة فقط منهما مفيدة.

ما هو كل نموذج في الواقع

Claude Haiku 5.5 — Anthropic، المعرّف claude-haiku-5-5، صدر في 7 أكتوبر 2026. إدخال نص وصورة، وإخراج نص. سياق بسعة مليون رمز، وحد أقصى للإخراج 128,000 رمز (300,000 خلف ترويسة تجريبية في Batch API)، وقطع تدريب في يونيو 2026، وإيقاف الخدمة ليس قبل 7 أكتوبر 2027. جهد قابل للضبط بين Low وMedium وHigh وXhigh وMax، والافتراضي هو Medium، مع تفكير تكيّفي مُفعَّل افتراضيًا. API محاسبية بالاستخدام، وقراءات الذاكرة المؤقتة بسعر 0.01 دولار لكل مليون، وBatch بنصف السعر. متاح عبر Anthropic API، ومنه، حيثما يُعاد بيع نماذج Anthropic.

Nemotron 3.5 Lightning 30B A3B Base — من NVIDIA، أُعلن في 11 أغسطس 2026. نقطة تحقق هجينة بخليط الخبراء (MoE) بـ 30 مليار معامل مع نحو 3 مليارات معامل نشطة لكل رمز، مبنية على منظومة تجمع Mamba-2 مع Mo مع الانتباه، مقطَّرة من Nemotron 3 Ultra، وتأتي مع فك ترميز تخميني MTP وDFlash وDSpark. يمتد السياق إلى مليون رمز، وإن كان نحو 256,000 هو الحد العملي على وحدة H100 واحدة. وهو نصي فقط. الأوزان مفتوحة بموجب OpenMDW-1.1. وهو نقطة تحقق أساسية: أوزان خام مُدرَّبة مسبقًا دون ضبط تعليمات، ما يعني أنه يكمل النص بدلًا من اتباع التعليمات.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Nemotron 3.5 Lightning 30B A3B Base — the scoreboard'. Claude Haiku 5.5 reads output speed 243.4 tokens per second, AA Index 43, proprietary weights, instruction-tuned yes, $0.10 per million input and $0.21 per task; the Nemotron column reads output speed 298.9 tokens per second, AA Index 13, weights open under OpenMDW-1.1, instruction-tuned no — base checkpoint, $0.06 per million input and $0.09 per task. A footer notes the Artificial Analysis figures are independently run and the NVIDIA figures are vendor-reported and unreproduced.

• الأبعاد، سطر واحد لكل منها

• سعر الإدخال — Claude Haiku 5.5: 0.10 دولار لكل مليون حتى 100 ألف رمز، ثم 0.50 دولار؛ Nemotron 3.5 Lightning 30B A3B Base: 0.06 دولار لكل مليون.

• سعر الإخراج — 0.50 دولار لكل مليون حتى 100 ألف رمز ثم 2.50 دولار، مقابل 0.20 دولار لكل مليون.

• التكلفة لكل مهمة منجزة — 0.21 دولار لكل مهمة فهرسة مستقلة لدى Claude Haiku 5.5، مقابل 0.09 دولار لدى Nemotron — النموذج الأرخص أرخص من حيث التكلفة لكل مهمة، وليس لكل توكن فقط.

• سرعة الإخراج — 243.4 رمزًا في الثانية لـ Claude Haiku 5.5، التاسع من 182؛ 298.9 رمزًا في الثانية لـ Nemotron، الأول من 142.

• زمن الوصول إلى أول رمز — حوالي 0.3 ثانية لـ Claude Haiku 5.5، مقابل 0.54 ثانية لـ Nemotron.

• درجة مستقلة — مؤشر الذكاء Artificial Analysis عند 43 لـ Claude Haiku 5.5، الثاني من 182، مع إعداد Max عند 43.40؛ المؤشر 13 لـ Nemotron، التاسع والعشرون من 142.

• نافذة السياق — 1,000,000 رمز لكل منها، مع ما يقارب 256,000 قابلة للاستخدام عمليًا لـ Nemotron على بطاقة H100 واحدة.

• الوسائط — إدخال النص والصورة لـ Claude Haiku 5.5؛ النص فقط لـ Nemotron.

• الأوزان — مملوكة مقابل مفتوحة بموجب OpenMDW-1.1، بتصميم MoE هجين بإجمالي 30B و3B نشط.

• الضبط بالتعليمات — موجود في Claude Haiku 5.5، وغائب في نقطة التحقق الأساسية.

مشكلة «Base» بصياغة واضحة.

تتوقع نقطة التحقق الأساسية الرمز التالي. اطرح عليها سؤالًا، فغالبًا ما ستواصل النص بأسلوب وثيقة قد تحتوي على مثل هذا السؤال، بدلًا من الإجابة عنه. وجّه إليها الأمر «لخّص هذا العقد»، فقد ينتج النموذج الأساسي تكملة معقولة لوثيقة تدريب قانونية بدلًا من ملخص لعقدك. تنشر NVIDIA نقطة تحقق BF16 منفصلة ونماذج شقيقة منفصلة مضبوطة بالتعليمات تحديدًا لأن الأوزان الأساسية مادة خام.

على بطاقة النموذج الخاصة بـ NVIDIA — مُبلَّغٌ عنها من المورّد، وليست مُعاد إنتاجها بشكل مستقل — تسجّل نقطة التفتيش الأساسية 78.59 على MMLU، و67.94 على MMLU-Pro، و91.28 على GSM8K، و77.44 على HumanEval و69.62 على RULER عند مليون رمز. وتُفيد بطاقة Lightning الخاصة بالنظير المضبوط بتسجيل MMLU-Pro 81.94، وGPQA Diamond 75.44، وSWE-Bench Verified 51.56، و86% على PinchBench، مع استدلال أسرع بنحو 30% من النموذج الذي حلّت محله. حتى الأرقام المضبوطة هي أرقام NVIDIA نفسها، والأرقام الأساسية هي التي تنطبق على نقطة التفتيش المذكورة في عنوان هذا المقال. وبالمقارنة بها، فإن نتيجة 43.40 المقيسة بشكل مستقل لـ Claude Haiku 5.5 — الثانية من 182 في مؤشر Artificial Analysis، وهو مؤشر مختلف يقيس أشياء مختلفة — ليست قابلة للمقارنة المباشرة، والقراءة الصادقة هي أن نقطة تفتيش أساسية بحجم 30B ونموذجًا صغيرًا مكتملًا يجري تقييمهما بأدوات مختلفة لأغراض مختلفة.

ما يمكن قوله دون تحفّظ هو شكل الفجوة. نقطة تحقق أساسية تحتاج إلى خط أنابيب ضبط دقيق، ومكدس تقديم، وأداة تقييم قبل أن تجيب عن أي شيء، ليست بديلاً عن نموذج مُستضاف بتكلفة 0.10 دولار لكل مليون. إنها نقطة انطلاق لمن يريد أن يمتلك النموذج.

حيث يفوز Nemotron حقًا، وهو ليس جائزة ترضية

السرعة أولاً. 298.9 رمز إخراج في الثانية يضعه في صدارة لوحة تضم 142 نموذجًا — أسرع بنسبة 23% من 243.4 لدى Claude Haiku 5.5. وبالنسبة لخط أنابيب حساس لزمن الاستجابة، يُعد ذلك فرقًا حقيقيًا وقابلًا للقياس، وهو سبب وجود اسم "Lightning" على العلبة.

ثانيًا، الأوزان المفتوحة، وهذه هي النقطة الأكبر. بموجب OpenMDW-1.1 يمكنك تنزيل نقطة الحفظ (checkpoint)، وضبطها الدقيق على بياناتك الخاصة، وتشغيلها بنفسك. أما Claude Haiku 5.5 فلا يمكن ضبطه الدقيق على الإطلاق، ولا يمكن استضافته ذاتيًا بأي ثمن. وبالنسبة لفريق لديه مهمة خاصة، أو توزيع مدخلات غير معتاد، أو متطلب امتثال يقضي بألّا تغادر حركة البيانات بنيته التحتية الخاصة، فإن هذا الفرق حاسم بغض النظر عمّا تقوله صفحات المعايير القياسية. كما أن نموذجًا بإجمالي 30 مليار معامل مع 3 مليارات نشطة صغير بما يكفي ليكون قابلاً للتشغيل اقتصاديًا — فالمعمارية مصممة لهذا الغرض تحديدًا.

السعر ثالثًا: $0.06 للإدخال و$0.20 للإخراج لكل مليون، مع خصم 17% على الذاكرة المؤقتة و$0.09 لكل مهمة فهرسة، وهو نحو نصف سعر Claude Haiku 5.5 البالغ $0.21. كلا الطرازين رخيصان؛ لكن Nemotron أرخص.

حيث يفوز Claude Haiku 5.5، وهو كل بُعد يتطلب إجابة.

اتباع التعليمات، لأنه دُرّب على ذلك. القدرة المستقلة، عند Index 43 مقابل 13 — فجوة بثلاثين نقطة على لوحة قيّمت كليهما، وهي أكبر فجوة من هذا النوع في هذه المجموعة من المقارنات. إدخال الصور، وهو ما لا يقبله Nemotron على الإطلاق. الحد الأقصى للإخراج عند 128,000 توكن مقابل رقم غير منشور، مع مسار بيتا بسعة 300,000 توكن على Batch. وقرص الجهد، الذي يتيح لك استرداد التكلفة عبر خفض جهد الاستدلال بدلاً من إعادة بناء النموذج.

تحذير الإسهاب ينطبق في كلا الاتجاهين هنا. في مجموعة اختبارات Artificial Analysis، يُصدر Claude Haiku 5.5 حوالي 440 مليون رمز إخراج مقابل وسيط يبلغ نحو 100 مليون — إنه يفكر كثيرًا. يُصدر Nemotron حوالي 120 مليون، وهو ما يصفه المصدر نفسه بأنه مُسهب إلى حد ما بالنسبة لحجمه. ومع ذلك، تبلغ تكلفة Haiku 5.5 لكل مهمة 0.21 دولار مقابل 0.09 دولار لـ Nemotron، لذا حتى النموذج الثرثار ليس هو المكلف. ما يخبرك به ذلك هو أن الأسعار لكل رمز مضللة في كلا الاتجاهين، وأن الرقم لكل مهمة هو الذي يجب أن تُبنى عليه الميزانية.

الاستضافة الذاتية مقابل نقطة نهاية واحدة

يُوزَّع Nemotron 3.5 Lightning 30B A3B Base بأوزان مفتوحة، وتقدّمه عدة مزوّدي استدلال؛ كما تنشر NVIDIA أشقّاءه المُحسَّنة. ويتاح Claude Haiku 5.5 عبر واجهة Anthropic البرمجية، ومنها حيثما يُعاد بيع نماذج Anthropic. لا يوجد أيٌّ منهما في كتالوج OrcaRouter، ولن ندّعي غير ذلك — ما نوجّهه من هذا النطاق هو anthropic/claude-haiku-4.5، anthropic/claude-sonnet-5.5، anthropic/claude-opus-5.5 وanthropic/claude-fable-5.1، الفئة الأعلى من موضوع هذا المقال.

المساران اللذان تصفهما هذه المقارنة لهما بنية تحتية مختلفة فعلًا، ويجدر تسميتهما. المسار المُستضاف ذاتيًا يعني وحدة معالجة رسومات (GPU)، وإطار تقديم، وقرار تكميم، ونوبة عمليات. أما المسار المُستضاف فيعني مفتاحًا وسلسلة نموذج. وُجد OrcaRouter من أجل المسار الثاني: واجهة برمجة تطبيقات واحدة لأكثر من 200 نموذج، ومفتاح واحد وفاتورة واحدة، مع تمرير سعر قائمة المزوّد بهامش ربح 0% بحيث يصبح خصم المورّد ساريًا في اليوم نفسه، مع تجاوز تلقائي للأعطال في الخلفية. وهو ليس طريقًا إلى نقطة تحقق أساسية بسعة 30B، وشراء صندوق من فئة DGX ليس طريقًا إلى نموذج صغير مُستضاف.

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

من الذي يجب أن يختار ماذا

إذا كانت مهمتك محددة جيدًا، وكانت بيانات تدريبك كبيرة بما يكفي لتكون ذات أهمية، ولم تكن حركة المرور الخاصة بك قادرة على مغادرة بنيتك التحتية الخاصة، فإن Nemotron 3.5 Lightning 30B A3B Base هو الكائن الأكثر إثارة للاهتمام: الأسرع من بين 142 في سرعة الإخراج، ونصف السعر لكل رمز، وهو لك لتعديله. خصّص ميزانية لتشغيل الضبط الدقيق وتكلفة الخدمة قبل أن تحسب التوفيرات، لأن سعر الإدخال البالغ 0.06 دولار يفترض أن شخصًا ما قد أنجز بالفعل العمل الذي يحوّل نقطة تحقق إلى مساعد.

إذا أردت إرسال مطالبة والحصول على إجابة بعد ظهر هذا اليوم، فإن Claude Haiku 5.5 هو الذي يفعل ذلك — 43 على المؤشر المستقل مقابل 13، وإدخال الصور، وسقف إخراج يبلغ 128,000 توكن، وسعر صغير حقًا. لا تبدو المقارنة متقاربة إلا على ورقة الأسعار. لكنها تكف عن ذلك بمجرد أن تكون المهمة الإجابة عن سؤال لا متابعة مستند.

A capture of the Artificial Analysis page for Nemotron 3.5 Lightning showing its Intelligence Index of 13 and rank of 29 of 142, the $0.06 per-million input and $0.20 output pricing, the $0.09 cost per index task, the 298.9 tokens-per-second output speed ranked first of 142, the 0.54-second time to first token, the 1M-token context window, text-only input and open weights.