
Claude Haiku 5.5 مقابل Gemini 3.5 Flash-Lite: أرخص لكل توكن، وأغلى لكل إجابة
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
Claude Haiku 5.5 يكلّف 0.10 دولار لكل مليون رمز إدخال و0.50 دولار لكل مليون رمز إخراج. Gemini 3.5 Flash-Lite يكلّف 0.30 و2.50 على المقياسين نفسيهما. أما نموذج Anthropic فسعره الثلث عند الإدخال والخُمس عند الإخراج، وهو يسجّل 43.40 مقابل 22.2 في مؤشر Artificial Analysis Intelligence Index v4.3.2 — فارق يتجاوز عشرين نقطة في مجال تُعدّ فيه عشر نقاط قفزة جيلية. وعلى بطاقة الأسعار ليست هذه مقارنة متقاربة، وفي القدرات أيضًا ليست مقارنة متقاربة.
على الفاتورة، تبدو المقارنة متقاربة، لكن النتيجة تنعكس في الاتجاه المعاكس. ضع كلا النموذجين على اللوحة المستقلة نفسها، واحتسب تكلفة كل منهما مقابل مهمة مكتملة بدلاً من رمز واحد، فيظهر Gemini 3.5 Flash-Lite أرخص لكل إجابة. وتضع Artificial Analysis سعر Claude Haiku 5.5 عند 0.21 دولار لكل مهمة في مؤشر الذكاء، وGemini 3.5 Flash-Lite عند 0.1235 دولار — أي أفضلية بنسبة 1.7 إلى واحد للنموذج الذي يدفع خمسة أضعاف مقابل كل رمز يُصدره.
هذا الانقلاب هو جوهر هذه المقارنة بأكملها. يستبدل Claude Haiku 5.5 أرخص فئة طرحتها Anthropic على الإطلاق، ويتفوق على كل ما يقترب منها في اللوحة المشتركة. صدر Gemini 3.5 Flash-Lite في 21 يوليو 2026، وظل الخيار الأفضل من حيث القيمة في هذه الفئة منذ الصيف. السؤال الذي يراود المشتري فعلاً ليس أيهما أفضل، لأن الإجابة عن ذلك محسومة، بل أيهما يضع أمام طلب يجب أن يعود رخيصًا.
كل ما يلي لكل مليون توكن بالدولار الأمريكي. أسعار القائمة هي الأسعار المعلنة من الموردين أنفسهم. الدرجات المستقلة، وأرقام التكلفة لكل مهمة، وقياسات السرعة المنسوبة إلى Artificial Analysis هي الخاصة بذلك المُقيِّم. أما أرقام زمن الاستجابة الخاصة بـ Gemini 3.5 Flash-Lite فتأتي من حركة المرور المقيسة لدينا. وحيثما يَرِد رقم في سجل النموذج الذي نحتفظ به بدلًا من قراءته من صفحة المُقيِّم في ذلك اليوم، فقد اعتبرنا ذلك المُقيِّم هو المصدر وليس أنفسنا.
الملصق والفاتورة لا يتفقان
فجوة التكلفة لكل مهمة لا تفسّرها بطاقة الأسعار، والسبب الكامن وراءها جدير بالمعرفة قبل أن يقترب أي من النموذجين من بيئة الإنتاج.
Claude Haiku 5.5 مُسهِب، ويقول المُقيِّم ذلك صراحةً. عند تشغيل Intelligence Index، سجّلت Artificial Analysis 440 مليون رمز إخراج من النموذج مقابل وسيط يبلغ 100 مليون في جميع الحالات، ووصفته بأنه مُسهِب للغاية. التفكير يُحسب ضمن المخرجات، والتفكير مُفعّل افتراضيًا مع مقياس جهد يبدأ من المستوى المتوسط، ولا يفيد سعر الإدخال الرخيص حملَ عملٍ تكون فاتورته في معظمها من الإخراج.
Gemini 3.5 Flash-Lite ليس مقتضبًا أيضًا، لكنه أقل تكلفة بشكل ملحوظ لكل مهمة. يسجل نفس اللوح 17,507 توكن إخراج لكل مهمة فهرسة مكتملة له — 10,405 منها للاستدلال و7,102 للإجابة. ضع ذلك في مقابل حجم توكنات نموذج Anthropic وستتضح الحسابات: ميزة خمسة إلى واحد في معدل الإخراج تُستهلك جزئيًا بواسطة نموذج يُصدر الاستجابة الأكبر، وما يتبقى على مستوى المهمة هو عيب صغير وليس ميزة كبيرة.
هناك تأثير ثانٍ أكثر هدوءًا يسير في الاتجاه نفسه. تقول وثائق Anthropic إن Claude Haiku 5.5 يستخدم أداة تقسيم الرموز (tokenizer) المشتركة مع Claude 4.7 والإصدارات اللاحقة، لذا يُحسب النص نفسه على أنه يحتوي على رموز أكثر بنحو 30% مما كان عليه في النموذج الذي يحل هذا محلّه. انخفض المعدل إلى الثلث مقارنةً بفئة Google. لم ينخفض عدد الرموز، بل ارتفع على النص نفسه.
كلا النموذجين، بالنسبة إلى الأرقام المهمة
أسعار مُخزّنة مؤقتًا وأسعار قائمة من وثائق Anthropic وGoogle الخاصة؛ أرقام مستقلة منسوبة إلى Artificial Analysis؛ زمن استجابة مباشر من نافذة حركة المرور الخاصة بنا على مدى سبعة أيام. مُخزّن مؤقتًا بتاريخ 2026-10-08.

الإدخال — Claude Haiku 5.5 بسعر $0.10 حتى 100,000 و$0.50 فوق ذلك؛ Gemini 3.5 Flash-Lite بسعر $0.30 ثابت عبر نافذة 1,048,576 رمزًا.
• الإخراج — Claude Haiku 5.5 بسعر 0.50 دولار حتى 100,000 رمز و2.50 دولار لما فوق ذلك؛ Gemini 3.5 Flash-Lite بسعر ثابت 2.50 دولار.
• الإدخال المخزن مؤقتًا — Claude Haiku 5.5 $0.01 حتى 100,000 توكن و $0.05؛ Gemini 3.5 Flash-Lite $0.03. عمليات الكتابة في الذاكرة المؤقتة هي $0.125 و $0.625 لكل مليون توكن لـ Claude Haiku 5.5.
• السياق والمخرجات — مليون توكن لكل منهما. الحد الأقصى للمخرجات هو 128,000 توكن لـ Claude Haiku 5.5 مقابل 65,536 لـ Gemini 3.5 Flash-Lite، لذا فإن سقف Anthropic يقارب الضعف.
• طريقة الإدخال — النصوص والصور لـ Claude Haiku 5.5؛ النصوص والصور والفيديو والصوت والملفات لـ Gemini 3.5 Flash-Lite. كلاهما يُعيد نصًا.
• نتيجة مستقلة — 43.40 لـ Claude Haiku 5.5 (Max)، المرتبة الثانية من 182 نموذجًا في Intelligence Index 3.2.2، مقابل 22.2 لـ Gemini 3.5 Flash-Lite، المرتبة السادسة والتسعون من 147 وفي المئين الرابع والثلاثين من ذلك.
• تكلفة مستقلة لكل مهمة — 0.21 دولار مقابل 0.1235 دولار على اللوحة نفسها.
• معدل الإنتاجية — 241.9 توكن إخراج في الثانية وفق قياس Artificial Analysis لـ Claude Haiku 5.5، مقابل 280.0 لـ Gemini 3.5 Flash-Lite وفق قياسنا في ساحتنا الخاصة خلال الأيام السبعة الماضية. هذان إطارا اختبار مختلفان، وليس إطارًا واحدًا، لذا اقرأهما على أنهما رتبة مقدار لا سباق.
واحد وعشرون نقطة، ومِمَّ تتكوَّن
فجوة قدرها واحد وعشرون نقطة في مؤشر تصل قيمه إلى الستينيات ليست هامشًا. إنها الفرق بين نموذج قادر على تشغيل حلقة وكيلية ونموذج ينبغي أن يُسند إليه استدعاء واحد محدد بدقة.
لا يقيس المورّدان أُطُر التقييم الخاصة ببعضهما البعض، لذا لا يمكن عقد مقارنة مباشرة بين مجموعات الاختبار الخاصة بكل منهما. ينشر Anthropic نتائج GDPval-AA v2.1 وOSWorld 2.1 وTerminal-Bench 4.0 وFrontierCode الخاصة بـ Claude Haiku 5.5؛ بينما ينشر Google مجموعته الخاصة بفئة Flash-Lite؛ ولم يُجرِ أيٌّ منهما مجموعة الآخر. المقارنة المتكافئة الوحيدة المتاحة هي اللوحة المستقلة، وهناك يتقدّم نموذج Anthropic بفارق كبير وليس ضيقًا.
إن الدرجات الفرعية التي منحها المقيّم لـ Gemini 3.5 Flash-Lite توثّق ملامح تلك الفئة في السجل. فهي تسجل 83.8% على GPQA Diamond و54.2% على SWE-Bench Pro، و54% على Terminal-bench 2.1، و41.3% على SciCode و39.2% على MLE-Bench، مع 18.8% على Humanity's Last Exam. هذه أرقام فئة كفؤة ورخيصة وعامة الأغراض — قوية في أسئلة المعرفة، ومتأخرة بوضوح في تقييمات الاستدلال والبحث الأصعب. أما Claude Haiku 5.5 عند 43.40 على النتيجة المركبة فيقع في نطاق مختلف تمامًا، والقراءة العملية هي أن العمل الذي يحتاج إلى تخطيط متعدد الخطوات على أفق طويل ليس مهمة لفئة Google على الإطلاق.
مليون رمز للنافذة، و65,536 للإجابة
نافذتا السياق بالحجم نفسه وليستا المنتج نفسه.
يتدهور السياق الطويل على Gemini 3.5 Flash-Lite مع المسافة بطريقة جديرة بالملاحظة قبل الوثوق به. في GDM-MRCR v2، تقييم الاسترجاع ذي الإبر الثماني، يسجل في المتوسط 72.2% عندما تقع الإبر داخل 128,000 رمز، و21.3% في الصيغة النقطية ذات المليون رمز. ورقم Long-Context Recall الخاص به هو 76%، ويأتي CharXiv Reasoning عند 74.5% بدون أدوات و76.5% معها. إن نافذة المليون رمز قدرة حقيقية؛ لكن الاسترجاع الموثوق من طرفها البعيد قدرة أصغر، والرقمان أعلاه يمثلان المسافة بينهما. لم تُقس نافذة نموذج Claude بالطريقة نفسها على اللوحة نفسها، لذا لا يتوفر له رقم مكافئ، وهذا المقال لا يختلق واحدًا.
حدود الإخراج هي الفرق الأكثر فائدة على الفور. سيُصدر Claude Haiku 5.5 ما مقداره 128,000 رمز في استجابة واحدة؛ بينما يتوقف Gemini 3.5 Flash-Lite عند 65,536. وإذا كان الناتج الذي تريده ملفًا طويلًا، أو ترحيلًا كاملًا، أو مجموعة اختبارات مُولَّدة، أو إعادة كتابة بحجم نص مفرَّغ، فإن أحد هذين النموذجين قادر على إنتاجه في نداء واحد بينما الآخر لا يستطيع — وإن تقسيم مهمة على نداءين يكلّف أكثر من ضعف نداء واحد، لأن البادئة المشتركة تُرسَل مرتين.

الصوت والفيديو ليس مسألة سعر
يقبل Gemini 3.5 Flash-Lite الفيديو والصوت والملفات بالمعدل نفسه الذي يقبل به النص. ويقبل Claude Haiku 5.5 النص والصور.
بالنسبة إلى خط أنابيب يستقبل المكالمات المسجَّلة أو تسجيلات الشاشة أو لقطات المراقبة، فإن فارق القدرة المهم ليس نقاط المؤشر الإحدى والعشرين. بل إن أحد هذين النموذجين يتلقى المدخلات مباشرة، في حين يحتاج الآخر إلى مرحلة تفريغ صوتي أو استخراج إطارات أمامه — نموذج ثانٍ، وفاتورة ثانية، ونمط فشل جديد يقع بين المصدر والإجابة. الفرق التي تجد نفسها في هذا الموقف لا تختار بين فئتين رخيصتين، بل تختار بين نموذج واحد وخط أنابيب.
والعكس صحيح بالنسبة إلى الصور والمستندات. فكلا النموذجين يقرأ الصور أصلاً، ويحقّق Claude Haiku 5.5 نتيجة 43.40 في المركّب، لذا فإن أي عبء عمل لاستخراج صور الصفحات أو فهم المخططات لا يحتوي على صوت ينتمي إلى جانب Anthropic استناداً إلى الأرقام لا إلى حجّة الوسائط.
تشغيل واحدة من الاثنتين من هنا
Gemini 3.5 Flash-Lite متاح في كتالوج OrcaRouter بسعر Google المعلن مع هامش ربح 0%، ما يعني أن سعر المزوّد يُمرَّر كما هو بدلًا من أن يُدمج، وأن أي تغيير يطرأ على بطاقة أسعار Google يصل إلى فاتورتك في اليوم نفسه الذي يصل فيه إليهم. هذا مفتاح واحد وSDK واحد لطبقة Google إلى جانب Claude Sonnet 5.5 وClaude Opus 5.5، وهما مدرجان في الكتالوج أيضًا — لذا فإن إجراء مقارنة A/B بين مسار Google Flash-Lite ومسار Anthropic هو مجرد إعداد قائم وليس مشروع تكامل. التبديل التلقائي عند الفشل يقع في الطبقة الأساسية، بحيث لا يكون أي من المسارين نقطة فشل واحدة، وستعبّر لغة التوجيه DSL عن التصعيد داخل المسار إذا كان هذا هو المكان الذي ينتمي إليه المنطق.
يعتمد ملف زمن الاستجابة لذلك الجزء على قياسنا نحن وليس على قياس المورّد. خلال الأيام السبعة الماضية من حركة المرور الحية، حافظ Gemini 3.5 Flash-Lite على p50 عند 2,426 مللي ثانية وp95 عند 8,600 مللي ثانية عند 280 رمزًا مُخرَجًا في الثانية، مع معدل خطأ 0.313%. اقرأه كنافذة متدحرجة لا كوعد: فهو يتغير بتغير حركة المرور وأحوال المزوّد، والرقم الذي يمكن الاعتماد عليه لخط معالجة معيّن هو الذي تقيسه بنفسك بعد أسبوع.

Claude Haiku 5.5 ليس في الكتالوج. صدر في 7 أكتوبر 2026 — أي قبل يوم واحد من كتابة هذا النص — وهو غير قابل للتوجيه من خلالنا اليوم، لذا فإن جانب Anthropic في هذه المقارنة لا يمكن الوصول إليه حاليًا إلا عند Anthropic. قول ذلك صراحةً أفضل من تركه ضمنيًا. الفجوة بين صدور نموذج ما وإمكانية استدعائه من خلالنا أمر طبيعي، وهي ليست وعدًا بموعد انغلاقها، وعلى القارئ الذي يخطّط لعملية انتقال أن يخطّط وفق الجدول الزمني الذي يراه لا الذي يفضّله.
أي واحد، ولمن؟
إذا كان العمل نصًا يدخل ونصًا يخرج، وإذا كانت المطالبات تقع تحت 100,000 رمز، وإذا كانت المهمة تتطلب تخطيطًا متعدد الخطوات أو وكلاء ذوي أفق طويل، فإن Claude Haiku 5.5 هو النموذج الأقوى بفارق واحد وعشرين نقطة، والأرخص لكل رمز بمعامل يتراوح بين ثلاثة وخمسة. اعتمد في الميزانية على التكلفة لكل مهمة بدلًا من قائمة الأسعار، وتوقّع نحو 0.21 دولار لنوع العمل الذي تقيسه اللجنة المستقلة، وأعد عدّ مطالباتك قبل أن تتنبأ بأي شيء، لأن تغيير المُرمِّز يغيّر العدد بنحو ثلاثين بالمئة بمفرده.
إذا كان العمل قصيرًا وذا حجم كبير وعلى شكل إجابة — وسم، أو فئة، أو استخلاص، أو قرار حاجز حماية — فإن الحساب يرجّح Gemini 3.5 Flash-Lite، ويفعل ذلك لسبب غير مبهر. فاتورة استدعاء لا يصدر سوى القليل جدًا يهيمن عليها الإدخال، وسعرا الإدخال هما $0.30 مقابل $0.10، كما أن بصمة المهمة الأقصر بكثير لدى نموذج Google تعني أن المعدل الأرخص يفوز بالمهمة المكتملة حتى وإن خسر السعر المعلن. أضِف إدخال فيديو أو صوت أو ملف، فيكف الاختيار عن كونه متعلقًا بالسعر إطلاقًا.
ما تحسمه هذه المقارنة الثنائية فعليًا أضيق من عبارة «Haiku الجديد رخيص». إنه يحسم أن السعر المعلن في فئة رخيصة ليس دليلًا جيدًا على ما تكلفك إياه تلك الفئة، وأن النموذج الذي يبدو أغلى ثلاث مرات على صفحة الأسعار قد يرسل لك الفاتورة الأصغر. وأيًا كان ما تنتهي إليه، فقِس التوكنات التي تُصدرها لا التي ترسلها، لأن الفاتورة على هذين النموذجين تُكتب فعليًا بهذا العداد.
