
Claude Haiku 5.5 مقابل Xiaomi MiMo-V2.6-Flash: عندما تتعارض بطاقة الأسعار مع الفاتورة المقيسة
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 57 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 345 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
خذ بطاقتي الأسعار على ظاهرهما، تبدو المقارنة بين Claude Haiku 5.5 وXiaomi MiMo-V2.6-Flash وكأنها حسم ساحق لصالح نموذج Xiaomi: 0.14 دولار و0.28 دولار لكل مليون رمز مقابل 0.10 دولار و0.50 دولار، أي أفضلية قدرها 1.8 ضعف في المخرجات على سعر ثابت بدلًا من سعر يرتفع بعد تجاوز 100,000 رمز. ثم انظر إلى التكلفة الفعلية لتشغيلات المهام المستقلة، فينقلب الترتيب — يأتي MiMo-V2.6-Flash بتكلفة 0.06231 دولار لإكمال مهمة يُكملها Haiku مقابل 0.2128 دولار، ومع ذلك يحقق Haiku نتيجة أعلى بنسبة خمسة عشر بالمئة على لوحة النتائج نفسها، ويُنهي المهمة في ثلث الزمن الفعلي المنقضي. لا شيء من تلك العبارات الأربع خاطئ؛ إنها تقيس أشياء مختلفة. يتناول هذا المقال مسألة أيٍّ منها يتنبأ بفاتورتك، وأين يتوقف كل واحد منها عن أن يكون مفيدًا.
بطاقتا الأسعار
ابدأ بالأرقام التي ينشرها كل مورّد، لأنها هي التي تُقارَن، وهي غالبًا ليست الأرقام المهمة:
• السعر — Claude Haiku 5.5 بسعر $0.10 / $0.50 لكل مليون مقابل أقل من 100 ألف توكن، و$0.50 / $2.50 مقابل أكثر من ذلك (قائمة Anthropic)؛ Xiaomi MiMo-V2.6-Flash بسعر $0.14 / $0.28 ثابت (قائمة المورّد)
• نافذة السياق — 1,000,000 رمز لـ Claude Haiku 5.5، و1,000,000 لـ MiMo-V2.6-Flash، وكلاهما منشور من قبل المورّد
• الحد الأقصى للإخراج — 128,000 توكن على Haiku (300,000 على Batch)؛ غير مُعلَن كسقف منفصل لـ MiMo-V2.6-Flash
• البنية — غير معلنة بالنسبة إلى Haiku؛ 309 مليار معامل إجمالي مع 15 مليارًا نشطة، مزيج من الخبراء (Mixture-of-Experts)، بالنسبة إلى MiMo-V2.6-Flash (منشور من المورّد)
• الترخيص — مغلق ومقتصر على API فقط لـ Haiku؛ MIT لـ MiMo-V2.6-Flash (منشور من المورّد)
• مؤشر مستقل — 43.395 لـ Claude Haiku 5.5 مقابل 37.884 لـ MiMo-V2.6-Flash (Artificial Analysis)
ثلاثة من تلك السطور تحسم معظم عمليات الشراء الحقيقية، وهي تشير في ثلاثة اتجاهات مختلفة. في سعر الإخراج، طراز Xiaomi أرخص — 0.28 دولار مقابل 0.50 دولار عند السياق القصير. وفي سعر الإدخال، يكون Haiku أرخص دون 100,000 رمز وأكثر تكلفة بكثير فوق ذلك. وفي نافذة السياق، يدّعي طراز Xiaomi ضعف المساحة. واحد فقط من تلك الثلاثة — الأخير — هو ادّعاء قدرة أصلاً، وخطوة السعر الموحّد لدى Haiku عند 100,000 رمز تعني أن في مقارنة الأسعار شقّاً يخفيه زوج واحد من الأرقام.

الفاتورة المقاسة
بطاقات الأسعار تُسعّر الرموز. العمل يكلّف مالًا. تشغّل Artificial Analysis كلا النموذجين عبر مجموعة المهام نفسها، وتنشر التكلفة الفعلية لإنجاز كل مهمة، وهي كمية مختلفة عن سعر الرمز الواحد، وغالبًا ما تؤدي إلى ترتيب مختلف:
• التكلفة لكل مهمة — MiMo-V2.6-Flash $0.06231 مقابل Claude Haiku 5.5 $0.2128
• رموز الإخراج لكل مهمة — MiMo-V2.6-Flash 77,792 مقابل Claude Haiku 5.5 162,164
• الوقت الفعلي لكل مهمة — MiMo-V2.6-Flash ١٬٣٢٠٫٠٨ ث مقابل Claude Haiku 5.5 ٤٢٦٫٢٦ ث
• مؤشر الذكاء — Claude Haiku 5.5 43.395 مقابل MiMo-V2.6-Flash 37.884
• Terminal-Bench Hard — Claude Haiku 5.5 بنتيجة 0.329 مقابل MiMo-V2.6-Flash بنتيجة 0.227
جميع الأرقام الخمسة هي أرقام Artificial Analysis، مأخوذة من صفحات الطرازات الخاصة باللوحة نفسها في أوائل أكتوبر 2026، وهي الأرقام التي ينبغي استخدامها عندما يكون على قرار أن يصمد أمام تدقيق أحدهم له.
الفجوة في التكلفة لكل مهمة أكبر مما يوحي به جدول الأسعار، والسبب هو السطر الثاني. يستهلك Claude Haiku 5.5 عدد 162,164 رمز إخراج لإنجاز مهمة يُكملها MiMo-V2.6-Flash في 77,792 — أي نحو 2.1 مرة من الرموز، ويرجع ذلك إلى حد كبير إلى أنه يستدل باستفاضة افتراضيًا. النموذج الأرخص بمقدار 1.8 مرة لكل رمز إخراج، والذي يصدر أقل من نصف هذا العدد منها لكل مهمة، لا ينتهي به الأمر أرخص بمقدار 1.8 مرة؛ بل ينتهي به الأمر أرخص بما يقارب عشرة أضعاف على مجموعة الاختبارات هذه تحديدًا. وهذا هو أهم شيء على الإطلاق في هذه الصفحة، ولا ينشره أي جدول أسعار في أي مكان.
يمضي خط الزمن الفعلي في الاتجاه المعاكس، ويستحقّ أن نكون صادقين بشأن ذلك. استغرق MiMo-V2.6-Flash 1,320 ثانية لكل مهمة مقابل 426 لدى Haiku — أي ثلاثة أضعاف المدة، رغم سرعة إخراج مقيسة أعلى بلغت 56.69 رمزًا في الثانية، لأن استدلال Haiku ليس عنق الزجاجة في هذه المجموعة بالطريقة التي تتوقعها معدلات الرموز الخام. إذا كان عبء العمل محدودًا بزمن الاستجابة لا بالتكلفة، فليس النموذج الرخيص تلقائيًا هو الخيار الصحيح، ولوحة النتائج المستقلة هي المكان الوحيد الذي يوجد فيه أي من هذين الرقمين.

أين توجد النقاط الخمس عشرة في الواقع
43.395 مقابل 37.884 يمثل فجوة بنسبة خمسة عشر بالمئة على مؤشر الذكاء، وهو أقوى حجة لصالح Haiku في هذه المواجهة. أما ما إذا كان ذلك مهمًا فيعتمد كليًا على المهمة. على Terminal-Bench Hard، الرقمان هما 0.329 و0.227 — فجوة نسبية أوسع، وتقع على الجانب الوكيلي المتعدد الخطوات من اللوحة حيث تميل فجوة المؤشر البالغة خمسة عشر بالمئة إلى التضاعف لتصبح فرقًا أكبر بكثير في إكمال المهام. على المؤشرات الفرعية للاستدلال العام والمعرفة، يكون الاثنان أقرب مما يوحي به المؤشر الرئيسي، وMiMo-V2.6-Flash متقدم في العديد منها.
القراءة العملية: عند أسفل منحنى الصعوبة، يكون النموذجان قابلين للتبادل وينبغي أن يحسم فرق التكلفة الأمر. أما عند القمة — الوكلاء ذوو الأفق الطويل، وقواعد الشيفرة، وأي شيء يجب فيه إعادة تشغيل مهمة فاشلة — فإن نقاط Haiku الخمس عشرة هي الفرق بين مهمة تكتمل ومهمة تكلّف المال نفسه مرتين، وقد ينقلب تفوق النموذج الرخيص في التكلفة لكل مهمة على نحو لا يستطيع متوسط لوحة النتائج إظهاره لك. هذه هي الحالة التي يتعيّن عليك فيها تشغيل تقييمك الخاص بدلًا من قراءة مؤشر شخص آخر، لأنه لا يوجد متوسط منشور يحسمها.
ما قيمة رخصة MIT
يُصدَر MiMo-V2.6-Flash تحت رخصة MIT — أقل الرخص المفتوحة تقييدًا، بلا سقف للاستخدام التجاري وبلا شرط للمشاركة بالمثل. وهذا منح أقوى من رخصة Qwen Community Licence، ويعني أن أوزان MoE بحجم 309B/15B يمكن استضافتها ذاتيًا وضبطها الدقيق وإعادة توزيعها من قبل أي شخص يرغب في ذلك. وبالنسبة لفريق يتمثل قيده في أن الاستدلال يحدث على عتاده الخاص، أو يكون حجمه مرتفعًا بما يكفي بحيث يتفوق امتلاك وحدات GPU على استئجار الرموز، فهذه ليست حاشية — بل هي السطر الوحيد المهم في المقارنة، لأن Claude Haiku 5.5 لا يمكنك تشغيله على الإطلاق.
كما أنه يغيّر نمط الأعطال أيضًا. النموذج المغلق الذي توفّره شركة واحدة وشركاؤها في السحابة يتعطّل عندما تتعطّل خدماتهم؛ أما نموذج مرخّص بموجب MIT وله عدة مضيفين مستقلين، فيمكن التحويل بينها عند الفشل، بشرط أن يكون هناك ما يقوم بهذا التحويل عند الفشل. لا يُعد أيٌّ من هذين سببًا لاختيار MiMo-V2.6-Flash من قِبل فريق يريد واجهة API ولا شيء غيرها. وكلاهما حاسم لفريق لا يريد ذلك.
ادعاءات المورّد التي تستحق أن تتحقق منها بنفسك
خط MiMo هو خط Xiaomi، وتُدرج Xiaomi أرقامها الخاصة للسرعة والجودة في مواد الإطلاق. تلك أرقام مورّد، لم يُعَد إنتاجها وقت كتابة هذا النص، ويقيس المجلس المستقل حاليًا النموذج عند مستوى أدنى مما يضعه فيه تأطير المورّد — 37.884 على المؤشر، و0.227 على Terminal-Bench Hard مقابل 0.329 لـ Haiku. هذا ليس اتهامًا بأي شيء؛ إنه الفارق الطبيعي بين أداة تقييم المورّد الخاصة وأداة طرف ثالث، وهو السبب في وسم أي الرقمين من أي جهة في كل مرة يُكرَّر فيها رقم.
الفحص الذي يستحق القيام به على حركة الاستخدام الخاصة بك يكلّف بعد ظهر واحد، ويحسم السؤال أفضل من أي مؤشر. شغّل المهام العشرين نفسها عبر كلا النموذجين باستخدام مطالباتك الخاصة، وسجّل رموز الإدخال، ورموز الإخراج، والزمن الفعلي المنقضي لكل مهمة ولكل منهما، ثم اضرب في الأسعار أعلاه. الأرقام الأربعة التي تحسم الأمر كلها أشياء يمكنك قياسها: الرموز الداخلة، والرموز الخارجة، والثواني، وما إذا كانت المهمة قد نجحت. رقم التكلفة لكل مهمة على اللوحة المستقلة هو الصورة بالنسبة لمجموعة اختبارات عامة؛ أما رقمك فسيختلف، والفرق بين الرقمين عادةً هو الإسهاب، وهو بالضبط ما تخفيه بطاقة الأسعار. إذا كان الاستدلال المفعّل افتراضيًا في Haiku يمنحك إكمال مهام كنت ستدفع مقابل إعادة المحاولة عليها لولا ذلك، فهو رخيص رغم أن سعره 3.4× سعر المهمة. وإذا لم يكن كذلك، فأنت تدفع مقابل رموز لم تغيّر الإجابة.
الحصول على كليهما عبر نقطة نهاية واحدة
لا يوفّر OrcaRouter خدمة Claude Haiku 5.5 ولا Xiaomi MiMo-V2.6-Flash — فبالنسبة إليهما، يمكن الحصول عليهما عبر واجهة برمجة التطبيقات الخاصة بالجهة المطوّرة وعدة منصات تابعة لجهات خارجية. أما ما نوفّره فهو الطاقم المحيط: qwen/qwen3.8-flashبسعر 0.15 دولار و0.47 دولار لكل مليون وz-ai/glm-5.3-flashبسعر 0.15 دولار و0.50 دولار، وكلاهما بسعر القائمة لدى الجهة المطوّرة، على المفتاح نفسه والفاتورة نفسها الخاصة بكتالوج يضم أكثر من 200 طراز مع تسعير تمرير التكلفة وتحويل تلقائي عند الفشل.
هذا مهم لهذه المواجهة بطريقة محددة: عندما يكون النموذجان اللذان تختار بينهما هما اللذان لا يمكنك توجيههما، فإن كسر التعادل يُحسم عادةً بتشغيلهما جنبًا إلى جنب على حركة مرور حقيقية — ما يعني إبقاءهما متاحين إلى جانب النماذج التي توجّهها فعلاً، دون عقد ثانٍ أو SDK ثانٍ لأي منهما. ضع النموذج المرشح على مسار الإنتاج مع وجود نموذج عامل خلفه كخيار احتياطي، ودع الطلب يذهب إلى أيٍّ منهما تختاره طبقة التوجيه، ودع سجلات الرموز الخاصة بك تُنتِج رقم التكلفة لكل مهمة الذي رفضت بطاقات الأسعار إعطاءه لك. مجموعة اختبارات الهيئة المستقلة ليست سوى قياس بديل؛ أما عبء العمل لديك فهو القياس.

المكالمة
إذا كان عبء العمل ذا حجم كبير، ومخرجات قصيرة، ويتحمّل إعادة المحاولات العرضية، فإن Xiaomi MiMo-V2.6-Flash هو النموذج الأرخص بفارق أوسع مما تعلن عنه بطاقة أسعاره — 0.06231 دولارًا لكل مهمة مقابل 0.2128 دولارًا — ويمنحك ترخيص MIT مخرجًا لا يمتلكه Haiku. إذا كان عبء العمل طويل الأفق ووكيليًا، فإن نقاط المؤشر الخمس عشرة لدى Claude Haiku 5.5 وإنجاز المهام أسرع بثلاث مرات يستحقان المضاعف، وتضيق فجوة التكلفة أو تنعكس بمجرد احتساب إعادة المحاولات.
الأمر الوحيد الذي ينبغي ألا تفعله هو الاختيار بناءً على بطاقة الأسعار وحدها. هناك نموذجان هنا لا يختلف سعر الرمز بينهما بأكثر من عامل اثنين، ومع ذلك يفصل بينهما فارق رتبة مقدار لكل مهمة مكتملة، وواحد فقط من هذين الرقمين موجود على الصفحة التي يعرضها عليك المورّد.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
