بطاقة عنوان رئيسية مُولَّدة بعنوان "GPT-6 Luna vs Kimi K3" وعنوان فرعي "أربعة أضعاف الإنتاجية، وبسعر يعادل جزءًا واحدًا من ثلاثين"، مع تذييل نصه "الأسعار وفقًا لـ OpenAI وMoonshot AI؛ وأرقام المؤشر وفقًا لـ Artificial Analysis."، وشعار OrcaRouter مُركَّب في الزاوية السفلية اليمنى.
Guides & Insights

GPT-6 Luna مقابل Kimi K3: أربعة أضعاف الإنتاجية، وبسعر يعادل واحدًا من ثلاثين، واستثناء حقيقي واحد

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

نموذجان، كلاهما صدرا خلال الأشهر الثلاثة الماضية، وكلاهما يُصنَّفان كالفئة الرخيصة من عائلة رائدة، وكلاهما مخطئان بشأن ما تعنيه "الفئة الرخيصة" بالطريقة نفسها — وهي ليست كذلك على الإطلاق. Kimi K3 هو النموذج الرائد مفتوح الأوزان من Moonshot AI، متاح للعموم بموجب رخصة MIT المعدلة منذ 27 يوليو 2026، بسعر 3.00 دولارات لكل مليون توكن إدخال و15.00 دولارًا لكل مليون توكن إخراج مع قراءات الذاكرة المؤقتة عند 0.30 دولار. GPT-6 Luna هو فئة الحجم لدى المورّد، متاح بشكل عام منذ 22 سبتمبر 2026 عند 0.10 و0.50 دولار مع قراءات الذاكرة المؤقتة عند سنت واحد. ثلاثون ضعفًا في الإدخال، وثلاثون ضعفًا في الإخراج، ورخصة في جانب لا يمكن للآخر تقديمها بأي ثمن.

لكن بطاقة الأسعار ليست ما يحسم هذا الاقتران، لأنها ليست متقاربة بما يكفي لتستلزم حسمًا. ما يحسمه هو رقم لا يضعه أي من المورّدين في العنوان الرئيسي: سرعة الإخراج المقيسة. يولّد Kimi K3 38.7 رمزًا في الثانية. ويولّد GPT-6 Luna 153.9. وهذا فارق بأربعة أضعاف، وبالنسبة لأي عبء عمل يكون فيه النموذج مكوّنًا داخل حلقة بدلًا من كونه نقطة نهاية يتحدث إليها شخص، فإن فارق إنتاجية بأربعة أضعاف يغيّر البنية وليس الفاتورة.

ما هذان الاثنان في الواقع

Kimi K3 هو نموذج مزيج خبراء (MoE) بـ 2.8 تريليون معامل، مع 104 مليارات معامل نشطة لكل رمز، ونافذة سياق تبلغ 1,048,576 رمزًا، وسقف إخراج يبلغ 1,048,576 رمزًا، وأوزان منشورة على Hugging Face تحت رخصة MIT المعدّلة. وهو النموذج المفتوح الأوزان الأعلى تقييمًا على اللوحة المستقلة — الأول بين 112 نموذجًا مفتوح الأوزان — ويحتل المركز الأول على لوحة المتصدرين WebDev من Code Arena برصيد 1,679 من نقاط Elo. وتُبلغ Moonshot عن 88.3% على Terminal-Bench 2.0، وهو رقم من المورّد وليس مُعاد إنتاجه بشكل مستقل.

‏GPT-6 Luna هو الفئة الصغيرة من الجيل GPT-6 لدى OpenAI، ويقع دون GPT-6 Sol بسعر $2.00/$10.00، وأقل بكثير من الطراز الرائد GPT-6 Astra بسعر $10.00/$50.00. إدخال نص وصورة، وإخراج نص، مع نافذة سياق بحجم 1,050,000 توكن، وحد أقصى للإدخال يبلغ 922,000، وسقف إخراج يبلغ 128,000 توكن، ومستوى جهد استدلال قابل للاختيار من بلا إلى منخفض، ومتوسط، وعالٍ، وعالٍ جدًا، وأقصى، مع كون المتوسط هو الافتراضي. وهو مغلق، وبمعرّف واحد، ومتاح لأي شخص يمتلك مفتاح API.

أحدهما تنزيل. والآخر نقطة نهاية. وكلاهما مُسعّر حسب الحجم. هذا هو شكل المقارنة.

البطاقات، سطرًا بسطر

سطر واحد لكل بُعد، وكلا الجانبين على كلٍّ منها:

• الإدخال لكل مليون — GPT-6 Luna $0.10 مقابل Kimi K3 $3.00

• الإخراج لكل مليون — GPT-6 Luna $0.50 مقابل Kimi K3 $15.00

• الإدخال المخزّن مؤقتًا لكل مليون — GPT-6 Luna ‏$0.01 مقابل Kimi K3 ‏$0.30، أي عُشر معدل الإدخال الخاص بها على كلتا البطاقتين

• بند السياق الطويل — تُضاعف GPT-6 Luna الإدخال وذاكرة التخزين المؤقت وترفع الإخراج 1.5× عند تجاوز 272,000 رمز إدخال، ويُطبَّق على الطلب بأكمله، مقابل Kimi K3 التي لم يُنشر على بطاقتها أي بند مكافئ

• نافذة السياق — GPT-6 Luna 1,050,000 توكن مع حدٍّ أقصى للمدخلات يبلغ 922,000 مقابل Kimi K3 بـ 1,048,576 توكن

• الحد الأقصى للإخراج — GPT-6 Luna 128,000 رمز مميز مقابل Kimi K3 1,048,576 رمزًا مميزًا، أي ثمانية أضعاف السقف

• مؤشر الذكاء، مستقل — GPT-6 Luna 37 بأقصى جهد مقابل Kimi K3 44 بأقصى جهد، بنفس مراجعة المؤشر

• درجة الجهد الافتراضي — GPT-6 Luna 29 عند مستواها المتوسط الافتراضي مقابل Kimi K3 المقاسة عند إعدادها الأقصى

• التكلفة لكل مهمة Index، بشكل مستقل — GPT-6 Luna حوالي 0.07 دولار مقابل Kimi K3 بـ 2.00 دولار

• رموز الإخراج في تشغيل المؤشر — GPT-6 Luna 150M مقابل Kimi K3 160M، مقابل وسيط لوحة صدارة يبلغ 88M؛ وكلاهما أكثر إسهابًا بكثير من النموذج الوسيط في لوحة الصدارة

• سرعة الإخراج، مستقلة — GPT-6 Luna ‏153.9 توكن/ثانية مقابل Kimi K3 ‏38.7 توكن/ثانية

• الأوزان — GPT-6 Luna مغلقة، عبر API فقط، مقابل Kimi K3 متاحة للعموم على Hugging Face منذ 27 يوليو 2026

• رخصة — GPT-6 Luna غير منطبقة مقابل Kimi K3 Modified MIT، وهي ليست الصك نفسه الذي تمثله MIT

• إجمالي المعلمات — GPT-6 Luna غير معلن مقابل Kimi K3: 2,800 مليار، منها 104 مليار نشطة لكل توكن

• دليل بارز — استدعاء أدوات GPT-6 Luna وحلقاتها الوكيليّة بعُشر سنت لكل ألف رمز إدخال مخزّن مؤقتًا، مقابل Kimi K3 Code Arena WebDev #1 عند 1,679 Elo، وTerminal-Bench 2.0 بنسبة 88.3% وفقًا لما أبلغت به الجهة المورّدة، وأعلى نتيجة لنموذج مفتوح الأوزان على لوحة الصدارة المستقلة

• على OrcaRouter — GPT-6 Luna غير موجود في كتالوجنا مقابل Kimi K3 القابل للتوجيه بسعر Moonshot المعلن

Generated two-column scoreboard titled 'GPT-6 Luna vs Kimi K3 - the scoreboard'. Left column GPT-6 Luna rows: Price in/out $0.10 / $0.50, Cached input $0.01, AA Index at max effort 37, Output speed 153.9 tok/s, Context 1,050,000, Weights closed. Right column Kimi K3 rows: Price in/out $3.00 / $15.00, Cached input $0.30, AA Index at max effort 44, Output speed 38.7 tok/s, Context 1,048,576, Weights Modified MIT. Footer: 'Prices per OpenAI and Moonshot AI; index and speed per Artificial Analysis.'

الإنتاجية هي المواصفة التي لا يجعلها أحدٌ عنوانًا

نموذج بسرعة 38.7 رمز في الثانية ونموذج بسرعة 153.9 رمز في الثانية ليسا نفس المنتج بأسعار مختلفة. إنهما منتجان مختلفان.

خذ مهمةً يُطلب فيها من النموذج إنتاج إجابة من 1,500 رمز — ملخّص، أو استخلاص منظَّم، أو رقعة برمجية مع شرحها. بمعدّل 153.9 رمزًا في الثانية، تستغرق تلك الإجابة نحو عشر ثوانٍ. وبمعدّل 38.7 تستغرق نحو تسعٍ وثلاثين. لا يشمل أيٌّ من الرقمين زمن الاستدلال أو زمن استجابة الشبكة، لذا فإن الفجوة في الواقع العملي أوسع من أربعة أضعاف نسبيًا، لا أضيق.

الآن ضع ذلك في حلقة تكرارية. الوكيل الذي يجري ثلاثين استدعاءً للنموذج لإنجاز مهمة واحدة — يخطّط، ويختار أداة، ويقرأ النتيجة، ويقرّر الخطوة التالية، ويكرّر — ينتج ربما 15,000 رمز إخراج عبر تلك الاستدعاءات. يستغرق GPT-6 Luna نحو 97 ثانية في التوليد. ويستغرق Kimi K3 نحو 388. هذا هو الفرق بين مهمة ينتظرها المستخدم ومهمة يجدولها المستخدم، ولا يغيّر ذلك أي قدر من تسامح الترخيص.

الإسهاب يُفاقم مشكلة السرعة بدلاً من أن يعوّض عنها. أنتج Kimi K3 160 مليون رمز إخراجي عند إكمال المؤشر المستقل مقابل 150 مليون لـ GPT-6 Luna — لذا في ذلك التقييم، كان النموذج الأبطأ ينتج أيضًا رموزًا أكثر قليلاً، وليس أقل. النموذجان متساويان في الإسهاب؛ لكنهما ببساطة ليسا متساويين في السرعة، وعلى بطاقة مسعّرة حسب الإخراج، يكون الإسهاب مكلفًا مرتين.

من الجدير القول بصراحة إن هذا ليس عيبًا في Kimi K3. فَنموذج بـ2.8 تريليون معامل مع 104 مليارات معامل نشط يقوم بعمل أكبر لكل رمز مما يفعله نموذج من فئة صغيرة، ورقم الإنتاجية هو قياس لذلك العمل. السؤال ذو الصلة هو ما إذا كان عبء عملك يحتاج إلى هذا العمل. إذا كان يحتاج إليه، فإن 38.7 رمزًا في الثانية هو ثمن هذه القدرة. وإذا لم يكن يحتاج إليه، فأنت تدفع مقابل تروٍّ لم تطلبه، ثلاثين مرة.

أين توجد نقاط K3 السبع

يسجّل Kimi K3 نتيجة 44 على مؤشر الذكاء المستقل عند أقصى جهد. ويسجّل GPT-6 Luna نتيجة 37 عند الإعداد نفسه. سبع نقاط، على مقياس مركّب تقع فيه النقطة الواحدة ضمن ضجيج إعادة التشغيل — ويفصل بين الاثنين نحو 28 ضعفًا في التكلفة لكل مهمة مكتملة، 2.00 دولار مقابل نحو 0.07 دولار.

تلك النقاط السبع ليست موزّعة بالتساوي. تتركّز سمعة Kimi K3 في البرمجة وفي العمل البرمجي الوكيلي، وهذا هو سبب وجود النموذج: فلوحة WebDev في Code Arena تضعه في المرتبة الأولى بـ 1,679 من Elo، ورقم Terminal-Bench 2.0 لدى المورّد البالغ 88.3% هو قياس لوكيل برمجي. أما موقع GPT-6 Luna البرمجي نفسه فهو خطوة إلى الوراء لا إلى الأمام — إذ يقع Coding Agent Index الخاص به عند 41، أي أدنى بنقطتين من GPT-5.6 Luna الذي حلّ محلّه، مع تركّز الانخفاضات في SWE-Atlas-QnA وDeepSWE v1.1. إذا كان عملك وكيلًا يكتب البرمجيات مقابل مستودع حقيقي، فذاك فجوة في المؤشر قدرها سبع نقاط وتراجع جيلي بنقطتين يشيران في الاتجاه نفسه، وتصبح الحجة لصالح الفئة منخفضة التكلفة أضعف بكثير.

حيث لا توجد النقاط السبع هو فئة العمل التي سُعّر من أجلها GPT-6 Luna. التصنيف، والاستخراج، والتوجيه، والتلخيص المجمّع، والحلقة الداخلية لوكيل يحتاج إلى نعم-أو-لا سريعة — في تلك المهام، سينتج النموذجان المخرجات القابلة للاستخدام نفسها في الغالبية العظمى من الوقت، ولن تصمد الفروق عند التلامس مع مجموعة التقييم الخاصة بك. يقيس المؤشر مركّبًا يمنح وزنًا كبيرًا للاستدلال طويل المدى والبرمجة، ولا شيء من هذين هو ما يتطلبه قرار التوجيه.

ملاحظة تحفظية جديرة بالإلحاق بأرقام المؤشر على الجانبين: هذه اللوحة تقييم متجدد ومراجعتها مهمة. لقطات سابقة من اللوحة نفسها وضعت Kimi K3 أعلى بفارق جوهري من الـ44 التي يُظهرها التقاطنا اليوم، لأن المركّب وأداة الاختبار ومجموعة النماذج كلها تتغير. أي مقارنة تستند إلى الفارق الدقيق بين نموذجين على مؤشر متجدد تستند إلى شيء لا يثبت على حال. القراءة الصادقة هي أن هذين الاثنين في نطاقين متجاورين من القدرات عند سقفيهما، وأن المؤشر لا يستطيع أن يخبرك أيهما أفضل لمهمتك.

الاستثناء: ما الذي يمنحك إياه ترخيص MIT المُعدَّل فعليًا

رخصة Kimi K3 هي البُعد الوحيد الذي لا يملك GPT-6 Luna أي جواب عليه بأي ثمن، وهي تستحق دقةً أكبر مما تحظى به عبارة «الأوزان المفتوحة» عادةً.

الأوزان متاحة للعموم على Hugging Face، والترخيص هو Modified MIT وليس MIT. هذا التمييز مهم: فترخيص Modified MIT عادةً ما يضيف شروطًا — وغالبًا شرطًا بعرض إسناد عند استخدام النموذج في منتج يتجاوز حجمًا معينًا — وعلى أي شخص يخطط لبناء منتج تجاري على الأوزان أن يقرأ الوثيقة الفعلية بدلًا من اسم العائلة الذي يشبهه. هذا ليس سببًا لتجنّبه، بل هو سبب لعدم وصفه بأنه MIT في مستند مشتريات.

ما يوفّره التنزيل حقيقي ومحدود. إنه يوفّر حدًا أدنى للتكلفة، بمعنى أن بصمة GPU ثابتة يمكنها التغلب على فاتورة محسوبة بالاستهلاك عند حجم كافٍ. إنه يوفّر الاستقلال عن خارطة طريق المورّد — فالنموذج الذي تستضيفه لا يمكن إهماله وسحبه من تحتك. إنه يوفّر القدرة على الضبط الدقيق وفق توزيعك الخاص. كما يوفّر خيار إبقاء الموجّهات داخل حدودك الخاصة، وهو ما ينهي المقارنة بالنسبة لبعض الفرق قبل ذكر السعر.

ما يكلّفه هو العتاد. نموذج خليط خبراء بمعاملات تبلغ 2.8 تريليون معامل و104 مليارات معامل نشط ليس نموذجًا يعمل على محطة عمل. وتقديمه بمعدل إنتاجي للإنتاج هو التزام على نطاق العنقود، بتكلفة رأسمالية وتكلفة تشغيلية وملف زمن استجابة تملكه بدلًا من أن تستأجره. وهذا ليس حجة ضد الاستضافة الذاتية لـ Kimi K3 — بل حجة على أن المقارنة الصحيحة ليست $15.00 لكل مليون رمز إخراج مقابل $0.00، بل $15.00 لكل مليون رمز إخراج مقابل تكلفة شاملة بالكامل لكل رمز تتضمن السيليكون والأشخاص. وبالنسبة لعدد قليل من المؤسسات، هذا الرقم أقل. وبالنسبة لمعظمها ليس كذلك، ونقطة التقاطع أبعد مما يجعل الترخيص يبدو عليه.

تشغيل أحدهما أو كليهما

Kimi K3 متاح على OrcaRouter بسعر قائمة Moonshot، وفي ظل تسعير التمرير المباشر يعني ذلك أن تغيير سعر المورد يصبح ساريًا لدينا في اليوم نفسه. تجاوز الفشل التلقائي هو الجزء الذي يستحق مكانه لهذا النموذج تحديدًا: تدهور نقطة نهاية Kimi K3 المستضافة ذاتيًا أو التابعة لطرف ثالث هو بالضبط السيناريو الذي تريد فيه أن ينتقل المسار دون عملية نشر، ونموذج بسرعة 38.7 رمزًا في الثانية لديه هامش أقل لاستيعاب مصدر أعلى بطيء مقارنة بنموذج سريع.

لا يرد GPT-6 Luna في كتالوجنا حتى لحظة كتابة هذا النص، ويُreach إليه عبر واجهة برمجة التطبيقات الخاصة بـ OpenAI، لذا فإن أي فريق يريد كليهما يشغّل مفتاحًا واحدًا لـ Kimi K3 إلى جانب ما يستخدمه بالفعل مع OpenAI. وهذا أيضًا هو الاقتران الذي يفعل فيه DSL التوجيه شيئًا لا تستطيع القسمة المثبّتة في الشيفرة فعله: قاعدة ترسل أعمال البرمجة والمهام الطويلة الأفق إلى Kimi K3، وكل ما يستهلكه البرنامج والمهام القصيرة إلى GPT-6 Luna، تعبّر عن حدّ يتحرك في كل مرة تُصدر فيها أي من الجهتين إصدارًا جديدًا، ويتحرك كإعدادات لا كمسار في الشيفرة.ويعدّ دمج النماذج التكوين الآخر الجدير بالذكر هنا — لوحة من نموذج بطيء متأنٍّ ونموذج سريع رخيص يجيبان معًا، حيث يتولى العضو الرخيص الحجم الأكبر ويتولى العضو المكلف الحكم في الحالات المهمة، وهي بنية يناسبها هذا الزوج من النماذج بشكل غير معتاد، لأن التفاوت في التكلفة بينهما كبير بما يكفي بحيث يكون إنفاق استدعاء واحد من Kimi K3 على نسبة صغيرة من حركة المرور أمرًا في متناول الميزانية.

Screenshot of OpenAI's developer documentation page for GPT-6 Luna, showing the model selector, the description 'Our most efficient model for focused, high-volume tasks', reasoning set to High, speed Fast, price $0.1 · $0.5, text and image input with text output, a 1,050,000-token context window, 128,000 maximum output tokens, a May 18, 2026 knowledge cutoff, and pricing cards of $0.10 input, $0.01 cached input, $0.125 cache writes and $0.50 output per 1M tokens.

أي واحد، ومتى؟

اختر GPT-6 Luna إذا كان عبء العمل لديك ضخم الحجم، ويُستهلك برمجيًا، وحسّاسًا لزمن الاستجابة. التصنيف، والاستخراج، والتوجيه، والتلخيص بالجملة، والحلقة الداخلية للوكيل. بسعر $0.10/$0.50 مع قراءة مخزّنة مؤقتًا بتكلفة سنت واحد وإنتاجية تعادل أربعة أضعاف إنتاجية Kimi K3، فالحساب ليس متقاربًا، والفرق في زمن الاستجابة ليس هامشيًا. اضبط معامل الجهد صراحةً، لأن القيمة الافتراضية متوسطة، والرقم 37 المذكور في العنوان هو رقم الجهد الأقصى، وأبقِ الاستدعاءات الطويلة على الجانب الصحيح من حد 272,000 رمز.

اختر Kimi K3 إذا كنت تحتاج إلى الأوزان، وإذا كان عملك يتمثل في البرمجة الوكيلية على مستودع حقيقي حيث تكون مكانة WebDev فيه ونسبة 88.3% المعلنة من المورّد على Terminal-Bench 2.0 هي الدليل المهم، وإذا كنت تحتاج إلى سقف إخراج يتجاوز 128,000 رمز، أو إذا كان مؤسستك لا تستطيع إرسال المطالبات إلى نقطة نهاية مغلقة. اقبل 38.7 رمزًا في الثانية كجزء من الصفقة، واقرأ شروط Modified MIT بدلًا من افتراضها.

الخطأ الذي تستدعيه هذه المقارنة هو التعامل مع معدل ثلاثين ضعفًا على أنه إجابة عن سؤال يتعلق بالقدرة. إنه إجابة عن سؤال يتعلق بالرموز. تُحسم مسألة القدرة بما إذا كنت بحاجة إلى الأوزان أم السرعة، وهاتان الإجابتان تشيران في اتجاهين متعاكسين.

Screenshot of the OrcaRouter model page for Kimi K3 showing the breadcrumb Home > Models > MoonshotAI > Kimi K3, a FEATURED badge, the model id kimi/kimi-k3, Vision, Tools, JSON and Reasoning chips, a MoonshotAI attribution dated 2026-07-15, the description of a 2.8-trillion-parameter mixture-of-experts model with a 1M-token context window, input pricing of $3.00 and output of $15.00 per 1M tokens, a p50 time to first token of 8.11s, a p95 of 10.00s, and traffic of 1163.7M tokens over seven days.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا