بطاقة عنوان رئيسية مُولَّدة لمقال بعنوان «Grok 4.7 مقابل Kimi K3 — السعر مقابل السياق»، مع العنوان الفرعي «نموذجان رائدان، رهانان مختلفان»، وشرائح إحصائية تعرض: السعر $2/$6 مقابل $3/$15، والسياق 500K مقابل 1M، والأوزان المفتوحة لا مقابل نعم.
Guides & Insights

Grok 4.7 مقابل Kimi K3: نصف السعر، ونصف السياق، ولا أوزان على الإطلاق

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

خُذ شهرًا من عمل البرمجة الوكيلية باستهلاك 300 مليون توكن، وشغّله عبر كلا النموذجين بأسعارهما المعلنة، وعندها يتوقف الاختيار عن الظهور كأنه نقاش حول اختبارات الأداء المرجعية. Grok 4.7، الذي أطلقته SpaceXAI في 21 سبتمبر 2026، يتقاضى دولارين لكل مليون توكن إدخال و6 دولارات لكل مليون توكن إخراج. Kimi K3، الذي أطلقته Moonshot AI في 16 يوليو 2026، يتقاضى 3 دولارات و15 دولارًا. في ذلك الشهر الافتراضي — لنقل 200 مليون توكن إدخال و100 مليون توكن إخراج — يصل Grok 4.7 إلى نحو 1000 دولار، ويصل Kimi K3 إلى نحو 2100 دولار. الفجوة ليست فرق تقريب؛ إنها ميزانية تكفي لنموذج ثانٍ. وبالمقابل، يمنحك Kimi K3 نافذة سياق تبلغ 1,000,000 توكن بدلًا من 500,000، وإدخال فيديو أصلي إضافة إلى الصور، وأوزانًا قابلة للتنزيل. يمنحك Grok 4.7 نموذجًا مغلقًا أسرع وأرخص، دُرِّب صراحةً على العمل الطرفي الطويل المدى الذي يستهدفه Kimi K3 أيضًا. كلاهما من فئة الحدود. لكنهما ليسا الصفقة نفسها.

النموذجان، باختصار

Grok 4.7 هو نموذج SpaceXAI الرائد في البرمجة وأعمال المعرفة، وهو مبني على نموذج أساسي أكبر من Grok 4.6، وقد خضع لجولة تدريب أطول بالتعلم المعزّز تستهدف مهاماً قد تستغرق ساعات. وهو احتكاري — لا أوزان، ولا تنزيل — ويقدّم نافذة سياق تبلغ 500,000 رمز، ويستقبل النصوص والصور ويعيد النصوص، ويدعم مستويات جهد الاستدلال من low إلى xhigh. وأبرز ما يُروَّج له هو السرعة والسعر: تُصنّفه SpaceXAI بوصفه أسرع بنحو الضعف من النماذج المماثلة بنحو نصف السعر.

كيمي K3 هو النموذج الرائد مفتوح المصدر من Moonshot AI والقائم على مزيج الخبراء، وهو أول نموذج مفتوح في فئة الثلاثة تريليونات معامل: 2.8 تريليون معامل إجمالًا مع 104 مليارات معامل نشطة لكل رمز، مبنيّ على Kimi Delta Attention وأوزان MXFP4 المراعية للتكميم. يستقبل النصوص والصور والفيديو، ويوفّر سياقًا يبلغ 1,000,000 رمز، ويعمل بالاستدلال دائم التشغيل بجهد قابل للضبط، ويمكن تنزيل أوزانه بموجب رخصة Kimi K3 — يُسمح بالاستخدام التجاري، مع وجود قيود. إنه، بحكم التصميم، النموذج الذي يمكنك أن تأخذه معك إلى منزلك.

هذا هو الفرق البنيوي كله بينهما. أحدهما نقطة نهاية مغلقة، رخيصة وسريعة. والآخر نتاج مفتوح أكثر تكلفة وأبطأ، بضعف السياق. وكل ما يلي هو نتيجة لذلك.

ما الذي تقارنه اختبارات الأداء فعليًا

هنا تكمن المشكلة في معظم المقالات التي تقارن بين Grok 4.7 وKimi K3، لذا يجدر بنا أن نكون صريحين: الأرقام المنشورة للنموذجين لا تقيس في الغالب الأشياء نفسها، وزوج واحد على الأقل يبدو قابلاً للمقارنة لكنه ليس كذلك.

ابدأ بالثنائي المضلِّل فعلًا. تستشهد مواد إطلاق Kimi K3 بدرجة 88.3 في Terminal-Bench 2.1. وتستشهد مواد إطلاق Grok 4.7 بدرجة 38.0% في Terminal-Bench 4.0. هذان إصداران مختلفان من المعيار، ولهما مجموعتا مهام مختلفتان وطريقة تسجيل مختلفة، ووضعهما جنبًا إلى جنب سيوحي بأن Kimi K3 يتجاوز ضعف قدرة النموذج الوكيلي. هذه قراءة لا يمكن الدفاع عنها، ولا ينبغي لأحد أن يكررها. كلا الرقمين أيضًا مُبلَّغ عنهما من المورّد — ولم يُعِد إنتاجهما أحد بشكل مستقل.

ما يمكن مقارنته هو المؤشر المركب المستقل، وهناك يكون الاثنان متقاربين. على مؤشر Artificial Analysis Intelligence Index الحالي، الإصدار v4.3.2، يسجل Kimi K3 نتيجة 44 — في المرتبة الثانية من بين 113 نموذجًا، وهو أعلى مركز يحققه أي نموذج مفتوح الأوزان على القائمة. يسجل Grok 4.7 نتيجة 46، في المرتبة السادسة عشرة من 655. يفصل بينهما نقطتان، مع كون مركز Kimi K3 قد تحقق عند أقصى جهد استدلالي. على المؤشر المركب المدمج، هذان النموذجان نظيران.

• مركّب مستقل — Grok 4.7 46 على AA Intelligence Index v4.3.2 مقابل Kimi K3 44 على نفس الإصدار. تعادل عمليًا.

• نافذة السياق — Grok 4.7: 500,000 توكن مقابل Kimi K3: 1,000,000 توكن. إنها ميزة حقيقية غير مشروطة لصالح Kimi K3، والفرق الوحيد في المواصفات غير المصحوب بأي تحفظ.

• طرق الإدخال — Grok 4.7 نص وصورة مقابل Kimi K3 نص وصورة وفيديو. Kimi K3 أوسع نطاقًا، إذا كان عبء العمل لديك يتضمن فيديو.

• الأوزان — Grok 4.7 احتكاري، بلا تنزيل، مقابل أوزان Kimi K3 المفتوحة بموجب ترخيص Kimi K3. بالنسبة لمتطلب النشر المحلي أو المعزول عن الشبكة، فهذا هو السطر الوحيد المهم.

• السعر لكل مليون رمز — Grok 4.7: 2 دولار للمُدخلات / 6 دولارات للمُخرجات، مقابل Kimi K3: 3 دولارات للمُدخلات / 15 دولارًا للمُخرجات، مع سعر الإدخال المُخزَّن مؤقتًا لدى Kimi عند 0.30 دولار لكل مليون. Grok 4.7 أرخص على كل المحاور، وأرخص بكثير في المُخرجات.

• التحكم في جهد الاستدلال — Grok 4.7 من منخفض إلى xhigh مقابل Kimi K3 دائم التشغيل بجهد قابل للتكوين. متشابهان وظيفيًا؛ الفرق هو أن Grok 4.7 يتيح لك خفض الاستدلال.

• أدلة وكيليّة مُبلَّغ عنها من المورّد — Grok 4.7 Terminal-Bench 4.0 بنسبة 38.0%، CursorBench 4.0 بنسبة 46.3%، DeepSWE v1.1 بنسبة 71.0% (جميعها مُبلَّغ عنها من المورّد) مقابل Kimi K3 Terminal-Bench 2.1 بنسبة 88.3%، وFrontend Code Arena في المركز الأول بـ1,679 Elo (مُبلَّغ عنه من المورّد عند الإطلاق). غير قابلة للمقارنة — انظر أعلاه.

A generated two-column comparison scoreboard for Grok 4.7 and Kimi K3 with six rows: price $2/$6 vs $3/$15 per million tokens, context 500K vs 1M tokens, AA Intelligence Index 46 vs 44, weights proprietary vs open, modalities text and image vs text, image and video, and speed twice as fast vs slower output, with a footer noting index scores are per Artificial Analysis v4.3.2 and all benchmark figures are vendor-reported.Screenshot of the Artificial Analysis model page for Grok 4.7 (xhigh), showing an Intelligence Index of 46 on index version v4.3.2, a 500k token context window, text and image input with text output, and a verbosity figure of 240M output tokens generated on the index.

إلى أين يذهب المال فعلاً

بطاقة الأسعار تُقلّل من تقدير الفجوة، لأن النموذجين يستهلكان الرموز بطريقة مختلفة. Grok 4.7 نموذج استدلال مسهب — فقد قاست Artificial Analysis توليد 240 مليون رمز إخراج أثناء تشغيل Intelligence Index، مقابل وسيط قدره 92 مليوناً عبر النماذج. أما Kimi K3 فيمثّل النوع المعاكس من الغلاء: فهو نموذج استدلال كبير يعمل دائماً، وعند 15 دولاراً لكل مليون رمز إخراج، فالإسهاب هو ما تشتريه.

إذن، نموذج التكلفة الصادق ليس "$2/$6 مقابل $3/$15". إنه رموز الإخراج لكل مهمة مكتملة، مضروبة في سعر الإخراج، زائد رموز الإدخال بما يشمل كل إعادة محاولة، مضروبة في سعر الإدخال. النموذج الذي ينجز مهمة في تمريرة واحدة طويلة بسعر $6 لكل مليون يمكن أن يتغلب على نموذج يحتاج إلى ثلاث محاولات بسعر $15 لكل مليون، ويمكنه أيضًا أن يخسر أمامه إذا كانت تمريرات النموذج الرخيص طويلة بما يكفي. هذا قياس تجريه على مستودعك الخاص، وليس قياسًا ينشره لك أي شخص.

ثمة عدم تماثل يستحق المعرفة قبل أن تشغّله: يطبّق Grok 4.6، سلف Grok 4.7، حدًا سعريًا مفاجئًا عند 200,000 رمز إدخال، حيث يُعاد تسعير الطلب بأكمله الذي يتجاوز هذا الحد بمعدل مضاعف. يحتاج العمل ذو السياق الطويل على جانب Grok إلى التحقق من ذلك مقابل بطاقة الأسعار الحالية للنموذج الذي تنشره، لأن نافذة سياق من 500,000 رمز وحدًا سعريًا عند 200,000 رمز يتفاعلان بشكل سيئ. تسعير Kimi K3 ثابت، وهو الميزة الأكثر هدوءًا بين الاثنين.

أين ينكسر كل واحد

كلا النموذجين لديهما نمط فشل لا تبدأ به مواد الإطلاق، وهما فشلان مختلفان.

أما بالنسبة إلى Kimi K3، فالمسألة تتعلق بالموثوقية تحت الحمل المستمر. فقد أفادت اختبارات المجتمع والاختبارات المستقلة عند الإطلاق بأن أداءه الوكيلي يتدهور مع اطالة مدة التشغيل — نتائج قوية في الطلقة الواحدة، ومعدلات نجاح مستمرة أضعف — وأن سرعة مخرجاته تبلغ نحو 37 إلى 38 رمزًا في الثانية، وهي سرعة بطيئة بالنسبة إلى البرمجة التفاعلية. كما اضطرت Moonshot إلى تعليق الاشتراكات الاستهلاكية الجديدة بعد الإطلاق بوقت قصير لأن الطلب تجاوز الطاقة الاستيعابية، وهو ما يقول شيئًا عن هامش القدرة على الخدمة من جانب الاستضافة.

شكل Grok 4.7 هو النقيض: فهو سريع ورخيص ومغلق، ما يعني أنك لا تستطيع فحصه، ولا تشغيله بنفسك، ولا التحوّط في حال التخلي عنه. وقد أعلنت SpaceXAI علنًا عن إطلاق Grok 4.8 وGrok 4.9 وGrok 5 تباعًا بعد هذا الإصدار، كما أن Grok 4.6 استمر قرابة خمسة أسابيع قبل أن يُستبدل. وأي شيء تبنيه على Grok 4.7 ينبغي أن يُبنى بحيث يكون معرّف النموذج قيمة إعدادات، لا افتراضًا.

هناك اعتبار ثالث لا يُعد فشلاً لأي من النموذجين: لا أحد منهما هو الإجابة الصحيحة لتشغيل مستقل لمدة أسبوعين، وقد عرض كلا البائعين ذلك بالضبط. العروض التوضيحية المنشورة للبرمجة المستقلة لمدة 16 يومًا و48 ساعة يديرها البائعون، على مهام اختارها البائعون، دون إعادة إنتاج مستقلة. يستحق معرفتها ولكن لا يستحق التخطيط بناءً عليها.

Screenshot of the OrcaRouter model page for Kimi K3 (model ID kimi/kimi-k3), showing Moonshot AI's list pricing of $3.00 per million input tokens and $15.00 per million output tokens, a 1M token context window, and the vision, tools, JSON and reasoning capability tags.

تشغيل كليهما، ولماذا يُعد ذلك هو الجواب الحقيقي

تشير فجوة التكلفة وفجوة السياق إلى اتجاهين متعاكسين، وهذا هو argument لعدم اختيار أحدهما. يستحق Kimi K3 سعره في العمل على نطاق المستودعات، حيث تعني نافذة 1M أنك لا تقسّم المدخلات إلى أجزاء، وفي أي شيء يجب استضافته ذاتيًا. ويستحق Grok 4.7 سعره في الحجم الكبير — حلقات الوكلاء ذات الجولات العالية، وخطوط الأنابيب الكثيفة باستدعاءات الأدوات، وجلسات الطرفية الطويلة حيث تهيمن السرعة وتكلفة المخرجات.

Kimi K3 متاح على OrcaRouter، مما يجعل هذا التقسيم قرار توجيه لا قرار شراء. وهو مُدرَج في الكتالوج بسعر Moonshot المعلن، ولأن OrcaRouter يمرّر أسعار القائمة من المزوّدين دون هامش ربح بنسبة 0%، فإن أي تخفيض سعر من مزوّد يصبح ساريًا هنا في اليوم نفسه الذي يُعلن فيه بدلًا من تجديد العقد التالي. وبالنسبة لأحمال العمل التي ينبغي أن يتعاون فيها تمرير السياق الطويل وتمرير التنفيذ بدلًا من أن يتنافسا — نموذج واحد يُبقي المستودع كله في مرمى النظر، وآخر يعمل بناءً عليه — فإن لغة توجيه DSL تجمع عدة نماذج في استدعاء واحد، ويسمح دمج النماذج لفريق من النماذج بالإجابة معًا عندما تستحق المهمة الإنفاق الإضافي. مفتاح API واحد يغطي Kimi K3 بالإضافة إلى أكثر من 200 نموذج آخر، لذا يمكن أن يأتي نصف التنفيذ من ذلك التقسيم من أي نموذج يكون الأرخص والأسرع للمهمة بدلًا من النموذج الذي يصادف أنه يحمل السياق.

هناك أمر واحد يجب توضيحه: أوزان Kimi K3 المفتوحة قابلة للتنزيل، لكن نقطة النهاية المستضافة هي ما يوجّه إليه OrcaRouter. إذا كان متطلبك هو الاستدلال داخل البنية التحتية لديك فعليًا، فهذا مشروع استضافة ذاتية على عتادك الخاص، وليس قرار توجيه — وهو السيناريو الوحيد الذي تكون فيه لهذه المقارنة إجابة صحيحة واحدة.

الحكم، والرقم الوحيد الذي يجب التمسك به

إذا كنت تختار بناءً على التكلفة والسرعة، فإن Grok 4.7 يفوز وبفارق غير ضئيل: نصف سعر الإدخال، وأقل من نصف سعر الإخراج، وتقديم أسرع، ومؤشر استدلال يمكنك خفضه. وإذا كنت تختار بناءً على السياق، أو اتساع الوسائط، أو القدرة على امتلاك النموذج، فإن Kimi K3 يفوز بالشروط نفسها. وإذا كنت تختار بناءً على القدرة وحدها، فإن التقييم المركّب المستقل يقول إن الفارق بينهما نقطتان، وعليك أن تقرر بناءً على تقييمك الخاص لا بناءً على مخطط الإطلاق الخاص بأي من المورّدين.

الرقم الذي يجب التمسك به هو الرقم الوارد في الأعلى: $2/$6 مقابل $3/$15. كل شيء آخر في هذه المقارنة قابل للتفاوض، أما هذه النسبة فليست كذلك.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا