بطاقة عنوان مُولَّدة تحمل نص "Kimi K4" مع العنوان الفرعي "ما يقوله التسريب، وما لا يقوله"، وشارة "تسريب / غير موثّق"، وثلاثة أسطر متراكبة تحمل "لا بطاقة نموذج"، و"لا أوزان"، و"لا سعر أو مسار"، وسطر تذييل "اعتبارًا من 25 سبتمبر 2026"، مع شعار OrcaRouter مركّب في الزاوية السفلية اليمنى.
Guides & Insights

كيمي K4: ما الذي يدّعيه التسريب فعلاً، ولماذا ستكون "معاملات نشطة أقل" هي القصة الحقيقية

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

منشور واحد طرح أربعة أسماء نماذج غير مُعلنة للتداول دفعة واحدة. تبدأ القائمة بـKimi K4، الجيل التالي المفترض من Moonshot AI، إلى جانب GLM-5.5 Flash وGLM-5.4 من Z.ai وDeepSeek V4.1P — ولا ينصبّ تركيز الكاتب نفسه على أي من الأسماء الرئيسية، بل على شكّ حول الحساب الكامن وراء K4: من أنه قد يُفعّل عددًا أقل من المعاملات مقارنة بالنموذج الذي يحلّ محله. هذا الادعاء غير مُتحقَّق منه. لا توجد بطاقة نموذج لـKimi K4، ولا أوزان، ولا معرّف API، ولا سعر، ولا مسار، وينطبق الأمر نفسه على كل اسم من Z.ai في القائمة. ما يستحق فعله الآن هو تحديد أي من هذه الادعاءات سيكون قابلًا للتحقق، وكيف يبدو خط الأساس المُشحون، وما الذي سيعنيه K4 الأكثر تناثرًا في الواقع.

الإشارة، ومستواها

هذه إشارة مبكرة، وينبغي قراءتها على هذا الأساس. المنشور الذي يحملها هو قراءة لاصطلاحات تسمية النماذج وليس تقريرًا عن رصد: فهو يبرز "GLM-5.5 Flash، GLM-5.4" باعتبارها تسمية مثيرة للاهتمام، ويصف K​imi K4 بأنها "غريبة جدًا"، ثم يقدّم آلية تخمينية — عدد أقل من الخبراء المفعّلين — دون ادعاء أنه رأى إعدادًا أو قائمة نقاط حفظ أو نقطة نهاية staging.

لا شيء في السجل العام يناقض هذه الأسماء، ولا شيء يؤكدها أيضًا. هذا التفاوت طبيعي في هذه المرحلة من دورة الإصدار، وهو بالتحديد سبب أن الخطوة المفيدة هي تثبيت خط الأساس والاختبارات، لا الاستمرار في التخمين. إن اسمًا في منشور ما هو فرضية حول منتج، وليس دليلًا عليه.

الأساس الذي سيُقاس عليه Kimi K4

Kimi K3 حقيقي، وقد تم إطلاقه، وهو موثّق جيدًا على نحو غير معتاد، مما يجعله نقطة مرجعية راسخة. تصف بطاقة النموذج الخاصة بـ Moonshot نموذج مزيج الخبراء (Mixture-of-Experts) البالغ 2.8 تريليون معامل، والذي يفعّل 104 مليارات معامل لكل رمز، موزعة على 93 طبقة — طبقة كثيفة واحدة و92 طبقة متفرقة. التناثر شديد ويُذكر بصراحة: 16 من أصل 896 خبيرًا يُفعّلون لكل رمز، إضافة إلى خبيرين مشتركين، وهو ما يعزو إليه Moonshot تحسنًا بنحو 2.5× في كفاءة التوسع مقارنةً بـ Kimi K2.

في مكدس الانتباه يختلف K3 عن الجيل السابق. من بين طبقاته المتفرقة البالغ عددها 92، تستخدم 69 منها Kimi Delta Attention — وهي آلية انتباه خطي هجينة — بينما تستخدم 24 منها gated MLA، وهو تقسيم بنسبة 3:1 يُبقي أقلية من طبقات الانتباه الكامل ويدفع الباقي إلى المسار الخطي الأقل كلفة. تحمل الطبقات متبقياً للانتباه كل 12 كتلة، ودالة التنشيط هي SiTU-GLU، ويُدرَّب النموذج بأكمله باستخدام أوزان MXFP4 وتنشيطات MXFP8 ضمن التدريب الواعي بالتكميم. طول السياق هو 1,048,576 رمزًا، وحجم المفردات 163,840، وتمر الرؤية عبر مُرمِّز MoonViT-V2 بعدد معاملات يبلغ 401 مليون، مما يجعل K3 قادرًا على معالجة الصور بطبيعته بدلاً من أن يكون متعدد الوسائط بإضافة ملحقة.

Screenshot of the Artificial Analysis model page for Kimi K3 (max), headed "Released July 2026", whose comparison summary reads In $3.00 / Out $15.00 and describes the model as leading on intelligence but expensive next to other open-weight models of similar size, notably slow and somewhat verbose, with text and image input and a 1M-token context window.

تلك هي الأرقام التي يتعين على الطراز اللاحق أن يحققها. لاحظ ما تعنيه بشأن فكرة "معلمات نشطة أقل": فـ K3 هو بالفعل نموذج فائق التناثر. فهو يفعّل نحو 3.7% من إجمالي عدد معلماته لكل رمز. أما K4 الذي يفعّل أقل من 104B فلن يكون يقتطع الشحوم من تصميم مفرط التجهيز — بل سيكون تراجعًا عن نسبة تناثر صوّرتها Moonshot علنًا على أنها مكسب، وسيفعل ذلك في الجيل الذي يسير فيه بقية المجال في الاتجاه المعاكس.

ما الذي سيعنيه "عدد أقل من المعاملات النشطة" إذا كان هذا صحيحًا؟

ثمة قراءتان متاحتان، وهما تشيران في اتجاهين متعاكسين. القراءة الأكثر تسامحًا هي معمارية: فقد يكون Moonshot بصدد توسيع هجين KDA أكثر، واستبدال مزيد من طبقات الانتباه الكامل بطبقات خطية، وإعادة موازنة ميزانية الخبراء بحيث يشتري عدد تنشيط أقل سياقًا أطول، أو بصمة خدمة أرخص، أو نسبة جودة لكل فلوب أفضل. وبموجب هذه القراءة، فإن قلة المعاملات النشطة تُعد تنقيحًا للأطروحة نفسها التي يصرح بها K3 بالفعل — وهي أن التخلخل استراتيجية توسّع، لا تنازل.

القراءة الأخرى هي أن K4 ليس خلفًا موحّدًا على الإطلاق. لقد تفرّع خط Kimi بالفعل مرة واحدة هذا العام، وقد أشارت التقارير على نحو متنوّع إلى K3.1 وK3.2 وK4 بوصفها ثلاثة منتجات مختلفة. إن K4 الذي يفعّل أقل من K3، في عائلة تطرح نسخة برمجية منفصلة، يتوافق على الأقل مع إعادة التموضع بقدر ما يتوافق مع ترقية مباشرة. كلتا القراءتين تكهّن. ولا يحسم أيًّا منهما منشور.

هناك أيضًا بُعد يتعلق بالترخيص لم يتطرق إليه أحد. فأوزان K3 صدرت بموجب ترخيص Kimi K3 License، وهو ترخيص مخصص من نوع "أخرى" وليس ترخيصًا مفتوح المصدر قياسيًا، وهو أول نموذج مفتوح من فئة 3T. وما إذا كان K4 الأكثر تناثرًا سيرث ذلك الترخيص أو يضيّقه يهم أي شخص يبني على الأوزان أكثر من بضع نقاط في درجة المؤشر.

A generated two-column scoreboard titled "Kimi K3 vs Kimi K4 — the scoreboard", with six shared rows: Status (K3 "released 15 July 2026" vs K4 "unreleased"), Total parameters ("2.8T" vs "unverified"), Activated parameters ("104B" vs "unverified"), Experts per token ("16 of 896" vs "unverified"), Context ("1M tokens" vs "unverified") and Price ("$3 / $15" vs "none"), with the footer line "Kimi K3 figures per Moonshot's model card; Kimi K4 has no model card, weights or price."

الأسماء الثلاثة الأخرى في المنشور نفسه

GLM-5.5 Flash وGLM-5.4 هما الزوج الأكثر إثارة للدهشة، وليس بسبب الأرقام. السقف المعلن من Z.ai هو GLM-5.3، الذي صدر في 14 أغسطس 2026 بـ 743 مليار معامل، وتبعه GLM-5.3-Flash في 26 أغسطس، مع صدور أوزان BF16 وFlash-BF16 في 25 أغسطس. وتُدرج وثائق Z.ai نفسها ثلاثة معرّفات نماذج حالية فقط: glm-5.3 وglm-5.3-flash وglm-5.2. لا وجود لـ GLM-5.4، ولا لـ GLM-5.5، ولا لـ GLM-5.5 Flash — والجزء الغريب هو اتجاه التسمية، إذ إن جيل 5.5 يسبق جيل 5.4 ليس هو الأسلوب الذي اعتمدته Z.ai قط في ترقيم أي عائلة. إن ظهور أرقام الإصدارات خارج ترتيبها في أي تسريب هو نمط فشل مألوف: فهي تميل إلى أن تكون منتجات متجاورة، أو أسماء داخلية، أو تسمية لطبقة تقديم، لا نموذجاً أساسياً جديداً.

D​eepSeek V4.1P هو الاسم الذي يقول مؤلف الإشارة إنه الأكثر اهتمامًا به، وهو الأسهل بين الأربعة في التحقق منه. توثيق واجهة برمجة التطبيقات (API) الخاص بـ D​eepSeek يذكر بالضبط سلسلتَي تعريف الطراز الحاليتين: deepseek-flash و deepseek-v4-pro. اللاحقة "P" ليس لها نظير في أي معرّف لدى D​eepSeek، وأحدث إصدار أوزان في منظمة D​eepSeek نفسها هو DeepSeek-V4.1-Flash، المنشور في 10 سبتمبر 2026. من المرجح جدًا أن يكون V4.1P شقيقًا من فئة Pro لذلك الطراز — لكن "الأرجح بشكل كبير" تخمين حول سلسلة نصية، وليس منتجًا.

كيف ستعرف أن أيًا من هذا حقيقي؟

تفشل الأسماء الأربعة في الاختبار نفسه بالطريقة نفسها، مما يجعل الانتظار يسيرًا لا مؤلمًا. الإصدار الحقيقي يخلّف مخرجات، ويكون التحقق من كل منها غير مكلف:

• بطاقة نموذج في منظمة Hugging Face الخاصة بالمورّد. أحدث إصدار لدى Moonshot هو Kimi-K3، أُنشئ في 13 يونيو 2026؛ وأحدث إصدارات Z.ai هي عائلة GLM-5.3 من 25 أغسطس؛ وأحدث إصدار لدى DeepSeek هو DeepSeek-V4.1-Flash من 10 سبتمبر. لا يوجد أي شيء أحدث في أيٍّ من الثلاثة.

• إعداد يحسم الجدل. بالنسبة لـ K4 تحديداً، الحقول التي يجب البحث عنها هي num_experts و num_experts_per_token — قراءة K3 هي 896 و16. إعداد K4 برقم أقل لكل رمز هو الادعاء في هذا التسريب الذي يتم تأكيده أو دحضه في ملف واحد.

• نموذج قابل للتوجيه. الاسم الذي يظهر في كتالوج هو اسم له سعر ونافذة سياق ومزوّد يقف خلفه؛ أما الاسم الذي لا يوجد إلا في منشور فلا يملك أيًا من ذلك.

Screenshot of the OrcaRouter model page for kimi/kimi-k3 by MoonshotAI, dated 2026-07-15, with Vision, Tools, JSON and Reasoning capability chips and pricing of $3.00 per million input tokens and $15.00 per million output tokens.

ما يمكنك توجيهه اليوم

النسخة العملية من هذا التسريب هي أن الجيل الذي يصفه ليس ما يمكنك البناء عليه. المتاح فعليًا هو الجيل السابق، ومهمة الموجّه هي جعل الفجوة بين الأجيال قرار توجيه بدلًا من مشروع ترحيل. Kimi K3 متاح الآن بسياقه الكامل البالغ مليون رمز ورؤيته الأصلية، بسعر 3.00 دولارات لكل مليون رمز إدخال و15.00 دولارًا لكل مليون رمز إخراج، مع قراءات ذاكرة مؤقتة بسعر 0.30 دولار — تُحتسب بسعر المزوّد دون أي هامش ربح، ولهذا يصل تغيير سعر المزوّد على K3 إلى فاتورتك في اليوم نفسه بدلًا من دورة إعادة التسعير التالية. Kimi K3 على OrcaRouter يحمل ورقة المواصفات الكاملة والسعر الحالي.

ينطبق الأمر نفسه على بقية اللوحة. يمكن توجيه GLM-5.3 وGLM-5.3-Flash وDeepSeek V4.1 Flash إلى جانب Kimi K3، عبر نقطة نهاية واحدة متوافقة مع OpenAI تغطي أكثر من 200 نموذج، مع تجاوز فشل تلقائي عندما يتدهور مزود الخدمة، ولغة توجيه (DSL) للتعبير عن التفضيلات — سقوف التكلفة، وحدود الجودة الدنيا، وميزانيات زمن الاستجابة — كسياسة وليس كمنطق لكل استدعاء. عندما يظهر K​imi K4 أو GLM-5.5 Flash أو D​eepSeek V4.1P، فإن الترحيل هو تغيير سلسلة نصية في سياسة التوجيه ولا شيء آخر. يتيح لك دمج النماذج الجمع بين مخرجات عدة نماذج على نفس نقطة النهاية عندما تستفيد المهمة من ذلك.

لنكون صريحين بشأن ما لا يعنيه ذلك: لا يُعد أيٌّ من الأسماء الأربعة المسرَّبة مسارًا على OrcaRouter اليوم. نحن لا نستضيفها ولا يمكننا تقديمها.

الخلاصة

الادعاء المثير للاهتمام هنا ليس أرقام الإصدارات. بل الآلية — أي أن نموذجًا رائدًا من الجيل التالي يُفعّل عددًا أقل من المعاملات مقارنة بسابقه سيكون بيانًا بأن تعتقد Moonshot أن التناثر، وليس عدد التنشيطات الخام، هو المحور الذي يستحق الدفع، وأن تقسيم K3 للخبراء بنسبة 16 من 896 هو بالفعل حجة في هذا الاتجاه. كل جزء من الادعاء غير مُتحقق منه: Kimi K4 وGLM-5.5 Flash وGLM-5.4 وDeepSeek V4.1P ليس لديها بطاقات نموذج، ولا أوزان، ولا معرّفات API، ولا أسعار، كما أن كتالوجات الموردين أنفسهم تتوقف قبل جيل واحد في كل حالة. اعتبر الأسماء معاينة لسؤال، لا إجابة — وإذا كنت بحاجة إلى أوزان مفتوحة من فئة الطراز الرائد عند سياق 1M اليوم، فإن Kimi K3 هو النموذج الموجود بالفعل.

عندما يصل K​imi K4 فعلًا، التجاوز التلقائي عند الفشل هو ما يمنع الترحيل من أن يتحول إلى حادثة