
كلود هايكو 5.5 مقابل جيميني 3.7 فلاش: أحد هذين الاثنين تقاعد بالفعل
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
ثمة حقيقة محرجة تكمن تحت أي Claude Haiku 5.5مقابل Gemini 3.7 Flashمقارنة تُكتب اليوم: إن Gemini 3.7 Flash مُهمَل (متوقف عن الدعم). فقد أطلقته الشركة المُصنِّعة في 13 أغسطس 2026، واستبدلته بـ Gemini 3.8 Flash في 2 سبتمبر، وتحمل صفحة 3.7 الآن على Artificial Analysis علامة إهمال. أما Claude Haiku 5.5، في المقابل، فقد أُطلق في 7 أكتوبر 2026 ويحمل التزامًا بعدم الإحالة إلى التقاعد قبل أكتوبر 2027 على الأقل.
هذا لا يجعل المقارنة عديمة الجدوى. إنه يغيّر السؤال. لم يعد الأمر «أي هذين ينبغي أن أستدعيه» — فبالنسبة لمعظم الفرق، الإجابة عن ذلك هي لا هذا ولا ذاك، لأن سلسلة 3.7 قد جرى تجاوزها داخل عائلتها نفسها. لكن ما تفيد به هو شيء أكثر دقة، ويمكن القول إنه أكثر نفعًا: قراءة واضحة لمدى سرعة تحرّك فئة Flash لدى Google خلال ثلاثة أسابيع، ولأي أجزاء من ورقة مواصفات نموذج من فئة Flash تحدد فعليًا ما إذا كان سيُستخدم.
ما لا يزال بإمكانك قياسه
تم تشغيل كلا الطرازين على نفس اللوحة المستقلة، وهي المكان الوحيد الذي يمكن فيه مقارنة الاثنين على الإطلاق. على مؤشر Artificial Analysis Intelligence Index v4.3.2، يسجل Claude Haiku 5.5 نتيجة 43.40 في إعداد Max مقارنةً بـ 39.06 لـ Gemini 3.7 Flash في إعداد High — بفارق 4.33 نقطة.
كما ينشر المورّدان أيضًا مجموعات التقييم الخاصة بهما، وهي لا تتقاطع على نحو يسمح بمقارنة مباشرة. الصفوف المستقلة المشتركة هي الأربعة التي أجرتها Artificial Analysis على كليهما:
• Terminal Bench 4.0 — 0.3283 لصالح Claude Haiku 5.5 مقابل 0.1364 لصالح Gemini 3.7 Flash. فجوة مطلقة قدرها 19 نقطة، وهي أوسع تباين في المجموعة.
• SciCode — 0.5498 مقابل 0.5718. يتفوق عليه Gemini 3.7 Flash بفارق 2.2 نقطة.
• Humanity's Last Exam — 0.4439 مقابل 0.4787. Gemini 3.7 Flash بفارق 3.5 نقاط.
• AutomationBench، نتيجة جزئية — 0.3541 مقابل 0.6203. Gemini 3.7 Flash بفارق 27 نقطة.
اقرأ هذه النتيجة بعناية، لأنها تحتوي على النتيجة المثيرة للاهتمام.يفوز Gemini 3.7 في ثلاثة من المعايير الأربعة المشتركة، ومع ذلك يخسر المؤشر المركب بفارق 4.3 نقطة. المؤشر مزيج مرجّح، والترجيح يضع صفوف الطرفية والبرمجة — حيث يسير الفارق في الاتجاه المعاكس بفارق أكبر بكثير — أمام إجمالي الصفوف الأخرى. وهذا ليس خللًا في التسجيل بقدر ما هو بيان عن الغرض من المؤشر: فهو يحاول التنبؤ بما إذا كان النموذج قادرًا على إنجاز المهمة، وفي هذه المسألة كان خط 3.7 ضعيفًا بطريقة لم تخفِها درجاته المحترمة في معايير العلوم.

ما الذي كانت سلسلة 3.7 سيئة فيه في الواقع
صفّان يرويان القصة أفضل مما يفعل المؤشر.
النتيجة 0.1364 في Terminal Bench 4.0 رقم منخفض، وهي تقع إلى جانب 0.8577 في الجيل السابق من Terminal Bench الصادر عن النموذج نفسه. هذا ليس نموذجًا ساء أداؤه؛ بل معيار قياس غيّر ما يقيسه، ولم ينجح Gemini 3.7 Flash في هذا الانتقال. أما Claude Haiku 5.5، على المعيار المنقّح نفسه، فيسجل 0.3283 — ليس مبهرًا بالقيم المطلقة، لكنه يقارب ضعفين ونصف ضعف رقم 3.7 Flash، في الصف الذي يتنبأ بأداء البرمجة الوكيلية بأكثر الطرق مباشرة.
الصف الثاني هو Tau-Bench Banking، حيث يسجّل Gemini 3.7 Flash نتيجة 0.3278. إن موثوقية استخدام الأدوات في نطاق مُهيكل هي بالضبط ما يُنشر من أجله نموذج منخفض التكلفة، ونتيجة أقل من 0.33 هي من النوع الذي يقتل مشروعًا تجريبيًا بهدوء. لا يملك Claude Haiku 5.5 رقمًا منشورًا في Tau-Bench ضمن الجدول نفسه، لذا لا تتوفر مقارنة هناك — والأمانة تقتضي قول ذلك بدل استنتاج رقم.
حيث صمد Gemini 3.7 Flash هو حيث صمد دائمًا: GPQA عند 0.9455 وMMMU-Pro عند 0.8549 هما نقطتا قوة حقيقيتان، ولم يكن مدخله متعدد الوسائط موضع شك قط. كان الفشل في الجزء من ورقة المواصفات الذي يحدد ما إذا كانت حلقة الوكيل تعمل، لا في الجزء الذي يكسب صفوف لوحة المتصدرين.
ما الذي تغيّر في الأسابيع الثلاثة بعد ذلك؟
وصل Gemini 3.8 Flash في 2 سبتمبر 2026، ويُعدّ التحرّك داخل فئة Flash الخاصة بجوجل نفسها المقارنة الأكثر فائدة لأي شخص يخطط لخط أنابيب لعام 2027.
على المؤشر نفسه، يسجل Gemini 3.8 Flash نسبة 40.93 مقابل 39.06 لسلسلة 3.7 — بزيادة قدرها 1.87 نقطة خلال ثلاثة أسابيع. انتقل Terminal Bench 4.0 من 0.1364 إلى 0.1970. وانتقل Tau-Bench Banking من 0.3278 إلى 0.4495. تلك هي الصفوف نفسها التي كان نموذج 3.7 الأسوأ فيها، ما يوحي بأن النموذج اللاحق استهدف هذا الضعف تحديدًا بدلًا من تحقيق زيادة عامة في القدرات.
لم يتحرك السعر على الإطلاق. كان Gemini 3.7 Flash مُدرجًا بسعر 0.75 دولار للمدخلات و3.75 دولارات للمخرجات لكل مليون رمز، وأُطلق Gemini 3.8 Flash بالسعر نفسه 0.75 دولار و3.75 دولارات — بطاقة الأسعار ذاتها، مرتبطة بنموذج أفضل بنقطتين في المؤشر في الصفوف المهمة للوكلاء.

بطاقة الأسعار هي النقطة التي تأخذ عندها هذه المقارنة منعطفًا حقيقيًا.
في مواجهة Claude Haiku 5.5، سعر Google هو القصة كاملة، والأمر ليس متقاربًا.
• الإدخال — Claude Haiku 5.5: 0.10 دولار لكل مليون رمز حتى 100,000، و0.50 دولار فوق ذلك؛ Gemini 3.7 Flash: 0.75 دولار بسعر ثابت، أو 7.5 أضعاف سعر Anthropic ضمن الشريحة الأولى.
• المخرجات — $0.50 لـ Claude Haiku 5.5 ضمن الشريحة الأولى، و$2.50 فوقها؛ و$3.75 لـ Gemini 3.7 Flash.
• الإدخال المخزَّن مؤقتًا — 0.01 $ و0.125 $ لـ Claude Haiku 5.5؛ 0.075 $ للقراءة و0.75 $ للكتابة لـ Gemini 3.7 Flash.
• السياق — مليون رمز لكلٍّ منهما. الحد الأقصى للإخراج — 128,000 رمز لـ Claude Haiku 5.5 مقابل 65,536 لـ Gemini 3.7 Flash.
• نمط الإدخال — النصوص والصور لـ Claude Haiku 5.5؛ النصوص والصور والفيديو لـ Gemini 3.7 Flash. لا تزال هذه هي الحالة الوحيدة التي تكون فيها مواصفات جوجل أطول بشكل صارم، وقد صمدت أمام الانتقال إلى الإصدار 3.8 دون تغيير.
• تكلفة مستقلة لكل مهمة Index مكتملة — 0.21 دولارًا لـ Claude Haiku 5.5 مقابل 0.93 دولارًا لـ Gemini 3.7 Flash. فجوة 4.4×، وهي أوسع مما قد توحي به نسبة المدخلات البالغة سبعة ونصف إلى واحد، لأن نموذج Anthropic هو المُسهب هنا: 162,164 رمز إخراج لكل مهمة Index مقابل 58,387 لـ Gemini 3.7 Flash. كما توثّق Anthropic مُرمِّزًا مشتركًا مع Claude 4.7 والإصدارات اللاحقة، يعدّ نحو 30% رموزًا إضافية للنص نفسه، وهو ما يدفع في الاتجاه نفسه.
• السرعة — 212.3 ثانية لكل مهمة Index لـ Gemini 3.7 Flash مقابل 424.6 لـ Claude Haiku 5.5. نموذج Google هو الأسرع بين النموذجين بمعامل اثنين، وهو السطر الوحيد في هذا القسم حيث لا يكون النموذج الأرخص هو الأفضل أيضًا.
ما الذي يعنيه هذا إذا كنت تختار اليوم
القراءة العملية هي أن أياً من هذين ليس الجواب الصحيح، وذلك لأسباب مختلفة.
Gemini 3.7 Flash مهجور، ويُسعَّر بالسعر نفسه الذي يُسعَّر به خليفته، وهو أسوأ من ذلك الخليفة في الصفوف ذاتها التي يحتاجها نموذج إنتاجي رخيص. والتوصية به ستكون توصية بقائمة أسعار معلَّقة على نموذج استُبدل بغيره — فالخليفة يكلّف القدر نفسه ويفعل أكثر. ولا ينبغي لمن يختار بين هذين النموذجين في أكتوبر 2026 أن يستقرّ على خط 3.7، وكون قائمة أسعاره لم تتغيّر هو ما يحسم الأمر.
Claude Haiku 5.5 هو النموذج المُتاح حاليًا، وفي الأعمال النصية إدخالًا وإخراجًا هو أرخص بكل المقاييس، وأعلى في المؤشر المركّب، وأفضل بكثير في الصفّين اللذين يتنبآن بنجاح الأنظمة الوكيلية. وهو أيضًا الأبطأ، ولا يستطيع استقبال الصوت أو الفيديو. وأما إذا كان ذلك يهم، فهو سؤال يخص خط أنابيبك، لا يخص النماذج.
الخيار الثالث، الذي تجعله الفجوة في نقاط المؤشر بين 3.8 و3.7 مرئيًا، هو أن طبقة Flash لدى Google تتحرك بسرعة كافية بحيث أصبحت مقارنة عمرها ثلاثة أسابيع تاريخية بالفعل. تعامل مع أي مواجهة مباشرة على مستوى Flash على أنها ذات مدة صلاحية تُقاس بالأسابيع، لا بالأرباع.
تشغيل أي جانب تهبط عليه
Gemini 3.8 Flash — الخليفة، لا الإصدار 3.7 المهجور — موجود في كتالوج OrcaRouter بسعر Google المعلن وبهامش ربح 0%، لذا فالسعر الذي تنشره Google هو السعر الذي يصل إلى فاتورتك، وأي تغيير من جانبهم يسري لدينا في اليوم نفسه. كما يتوفر Claude Sonnet 5.5 وClaude Opus 5.5 في الكتالوج أيضاً، ما يجعل اختبار التوجيه بين مورّدين إعداداً لا مشروعاً: واجهة API واحدة لأكثر من 200 نموذج، ومفتاح واحد، مع تحويل تلقائي عند الفشل في الخلفية، ولغة التوجيه DSL عندما تفضّل إبقاء التصعيد في المسار بدلاً من الكود.
Gemini 3.7 Flash نفسه ليس ضمن الكتالوج الخاص بنا، وClaude Haiku 5.5 ليس كذلك أيضًا. يظل كلاهما قابلًا للوصول عبر واجهات برمجة التطبيقات الخاصة بمورّديهما، وفي حالة Google، عبر عدة منصات تابعة لجهات خارجية. هذا أمر يستحق الذكر بوضوح بدلًا من ترك القارئ يكتشفه بنفسه.

العدد المُراد طرحه
ليست المسألة فجوة المؤشر البالغة 4.33 نقطة. بل إن Gemini 3.7 Flash فاز في ثلاثة من المعايير المشتركة الأربعة ومع ذلك خسر النتيجة المركّبة بأربع نقاط، لأن المعيار الذي يمنحه المؤشر أكبر وزن كان هو الذي سجّل فيه 0.1364. قد تبدو نتائج العلوم لنموذج من فئة الفلاش جيدة، بينما يفشل في الأمر الذي تُشترى النماذج الرخيصة من أجله.
المحصلة المنطقية هي أن الخَلَف أصلح تلك الصفوف تحديدًا خلال ثلاثة أسابيع، وبسعر لم يتغيّر. وبناءً على هذا الدليل، فإن الضغط التنافسي في هذه الفئة ليس السعر، بل ما إذا كان النموذج قادرًا على إكمال مهمة متعددة الخطوات، وهذا الآن يتقدّم أسرع مما تفعل بطاقات الأسعار.
