
GPT-6 مقابل Kimi K3: نموذجان بمليوني رمز يتخصصان بشكل مختلف
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 361 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
GPT-6 Sol و Kimi K3 هما النموذجان الأكثر ترجيحًا لإدراجهما في القائمة المختصرة للمهمة نفسها: نافذة سياق بمليون توكن، وإدخال صور، وسعر يجعل المستندات الطويلة ميسورة التكلفة. وقد وصلا إلى هناك من اتجاهين متعاكسين. Kimi K3 هو المتخصص في السياق الطويل لدى MoonshotAI، وصدر في 15 يوليو 2026، وبطاقته مبنية حول الاستدعاء — فهو يسجل 88.7% في اختبار الاستدعاء للسياق الطويل لدى Artificial Analysis، متقدّمًا على كل نموذج من المورّد الذي يمكننا مقارنته به. GPT-6 Sol هو النموذج العام متوسط الفئة لدى المورّد، وطُرح في 22 سبتمبر 2026 بسعر 2.00 دولار لكل مليون توكن إدخال و10.00 دولار لكل مليون توكن إخراج، وحجته هي الاتساع: نافذة أكبر قليلاً، ومركّب استدلال عام أعلى، وتوكن إخراج أرخص.
إذاً، الطرح الصادق ليس "أفضل مقابل أسوأ". بل هو استرجاع مقابل استدلال، وهو يتحدد بما تفعله بالمليون توكن بعد تحميلها.
النوافذ بالحجم نفسه على الورق
تقول كلتا البطاقتين نحو مليون توكن، والفرق شكلي. نافذة Kimi K3 هي 1,048,576 توكن — أي 2^20 بالضبط، المليون الثنائي الذي تذكره كل نماذج السياق الطويل. أما نافذة GPT-6 Sol فهي 1,050,000، وهو رقم عشري مستدير أكبر بنحو 1,400 توكن. لأي عبء عمل يمكنك تحميله فعليًا، هاتان النافذتان متطابقتان. لا تختر بناءً على هذا.
ما يختلف هو بقية المغلّف، وهي قائمة قصيرة.
• السياق: Kimi K3 1,048,576 توكن، GPT-6 Sol 1,050,000 — على نفس المستوى فعليًا
• نمط الإدخال: يقبل Kimi K3 النص والصور؛ ويقبل GPT-6 Sol النص والصور والملفات
• سقف الإخراج: GPT-6 Sol 128,000 توكن في استجابة واحدة؛ ولا تنشر بطاقة Kimi K3 رقمًا أقصى للإخراج
• السعر القياسي: Kimi K3 $3.00 إدخال / $15.00 إخراج لكل مليون، GPT-6 Sol $2.00 إدخال / $10.00 إخراج
• الإدخال المخزّن مؤقتًا: Kimi K3 $0.30 لكل مليون، GPT-6 Sol $0.20 لكل مليون
• تسعير السياق الطويل: يسرد Kimi K3 سعرًا واحدًا دون فئة موثّقة؛ وتعيد GPT-6 Sol تسعير الطلب بأكمله فوق 272,000 توكن إدخال إلى $4.00 إدخال / $15.00 إخراج
• عناصر التحكم في الاستدلال: يعرض GPT-6 Sol خيارًا قابلًا للتهيئة reasoning.effort؛ ويكشف Kimi K3 عن معاملَي reasoning وreasoning-effort عبر نفس الواجهة المتوافقة مع OpenAI
غياب سقف المخرجات في Kimi K3 يستحق الإشارة إليه بدلًا من التغاضي عنه: تنشر MoonshotAI رقمًا للسياق ولا تنشر رقمًا لأقصى المخرجات، لذا لا يستطيع نظام يعتمد على سقف مخرجات صارم لإعداد الميزانية أن يقرأ رقمًا كهذا من البطاقة. فئة السياق الطويل هي التباين الآخر، وهي تسير في اتجاه غير بديهي — سعر GPT-6 Sol المعلن أقل، لكن إعادة تسعير الطلب بالكامل فوق 272K تعني أن استدعاءً بـ 300,000 رمز يُحتسب بسعر $4.00 / $15.00 من أول رمز، بينما سعر Kimi K3 الوحيد البالغ $3.00 / $15.00 غير موثّق على أنه يتدرّج على الإطلاق. بالنسبة لمستند طويل جدًا، قد ينتهي Kimi K3 بأن يكون الأرخص بين الاثنين من حيث الإدخال رغم السعر المعلن الأعلى.
Recall هو المنتج الفعلي لـ Kimi K3
السبب في اختيار Kimi K3 ليس أنه يمتلك نافذة سياق كبيرة — فالعديد من النماذج لديها ذلك. بل لأنه يحتفظ بما تحتويه. في تقييم استرجاع السياق الطويل الخاص بـ Artificial Analysis، المدرج في كتالوج النماذج، يسجل Kimi K3 نسبة 88.7% مقابل 83.7% لـ GPT-6 Sol. هذه فجوة بخمس نقاط في الاختبار نفسه الذي يقيس ما إذا كان النموذج قادرًا على العثور على تفصيل مدفون في مُدخل طويل واستخدامه، وهي الفجوة التي تظهر كأعطال حقيقية في الإنتاج — أداة التلخيص التي تُسقط البند في الصفحة 400، ومراجع العقود الذي يفوته قسم التعويض.
يتصدّر Kimi K3 أيضًا مجال البرمجة، وبفارق أوسع مما يوحي به المؤشر المركّب. فعلى مؤشر البرمجة يحلّ عند 76.2 بترتيب يضعه ضمن أفضل عشرة نماذج مُقيَّمة، ويسجّل 85.0% في terminal-bench v2.1 — المعيار المرجعي الوكيلي لسطر الأوامر الذي تتوقف عليه فائدة وكيل البرمجة. أما نتيجته في GPQA Diamond، وهي 93.5%، فتقع ضمن النطاق الأعلى في لوحة التصنيف.
يأتي ردّ GPT-6 Sol في المقاييس المركّبة وفي الشيفرة العلمية. مؤشره للذكاء العام، 47.6، يتقدّم بأربع نقاط على 43.6 لدى Kimi K3 ويقترب من العُشر الأعلى؛ وهما متعادلان في SciCode عند 57.6% و59.5% على التوالي، ضمن ضوضاء تشغيل واحد؛ وفي Humanity's Last Exam يتقدّم GPT-6 Sol بنسبة 47.9% بفارق ضئيل على 46.9% لدى Kimi K3. ولا يوجد أي من تلك الفروق في اختبار منفرد كبير بما يكفي للاختيار بناءً عليه وحده.

التكلفة حسب عبء العمل، لا حسب قائمة الأسعار.
تُضلّل جداول الأسعار لأن نسبة الرموز المُدخلة إلى الرموز المُخرجة تختلف من مهمة إلى أخرى، ويختلف هذان النموذجان حول أيّ جانبي المقايضة أرخص. فـ Kimi K3 أرخص على افتراض أن عملك مُدخلاته في الغالب — مستندات طويلة تدخل، وإجابات قصيرة تخرج. أما GPT-6 Sol فأرخص على افتراض أن عملك متوازن أو ثقيل المُخرجات، لأن سعر مُخرجاته أقل بمقدار الثلث.
• نمط "اقرأ كتابًا واحدًا ولخّصه" (مدخلات 900 ألف، مخرجات 4 آلاف): Kimi K3 ≈ 2.76 دولار، GPT-6 Sol ≈ 3.64 دولار قبل تطبيق إعادة التسعير عند 272 ألفًا؛ ومع إعادة التسعير، ينتقل كامل استدعاء GPT-6 Sol إلى الفئة الأعلى ويتّسع الفارق
• نمط المهام الوكيلية المتوازن (60 ألف مدخلات، 20 ألف مخرجات): Kimi K3 ≈ 0.48 دولار، GPT-6 Sol ≈ 0.32 دولار
• نمط توليد الأكواد (30 ألف مدخلات، 60 ألف مخرجات): Kimi K3 ≈ 0.99 دولار، GPT-6 Sol ≈ 0.66 دولار
تلك حسابات توكنات خام على الأسعار المعلنة لكل مورّد، وهي تستبعد الإدخال المُخزَّن مؤقتًا، وهو ما يفيد أكثر من غيره النموذجَ الذي تخزّن مُدخلاته مؤقتًا لديه. شكل الإجابة هو ما يهم: بالنسبة لأعمال الاسترجاع ذات المدخلات الطويلة البحتة، تفوز أسعار Kimi K3 الثابتة، وبالنسبة لأي شيء يكتب كثيرًا في المقابل، تفوز أسعار الإخراج الأقل لدى GPT-6 Sol. لا أحدهما أرخص على نحو شامل، وأي مقارنة تسمّي فائزًا واحدًا من حيث السعر دون ذكر نسبة التوكنات لا تقيس شيئًا.
المصدر جزء من القرار
Kimi K3 طوّرته MoonshotAI، وهو مختبر صيني، وGPT-6 Sol طوّرته OpenAI. هذا الفرق ليس مقياس أداء ولا يظهر على بطاقة أسعار، لكنه بالنسبة لأعباء العمل الخاضعة للتنظيم يحسم القائمة المختصرة قبل مناقشة السعر. بطاقة MoonshotAI في الكتالوج لا تنشر حقل ترخيص، لذا لا ينبغي قراءة أي شيء هنا كادعاء حول توفر الأوزان في أي من الاتجاهين — إذا كانت الأوزان المفتوحة تهمّ نشرك، فتحقق من المصدر بدلًا من الافتراض استنادًا إلى اسم العائلة.
بالنسبة للفرق التي تحتاج إلى كليهما — نموذج من مختبر صيني لجزء من خط المعالجة، ونموذج من OpenAI لجزء آخر، مع إدارة التوجيه والفوترة والإقامة في مكان واحد — هذا هو السبب الذي يجعل امتلاك بوابة واحدة أمرًا يستحق العناء بدلًا من مجموعتين من بيانات الاعتماد. على OrcaRouter، كلا kimi/kimi-k3 وGPT-6 Sol مساران مباشران في الكتالوج نفسه، بسعر القائمة الخاص بالمزوّد مع هامش ربح 0%، لذا يصبح أي تغيير في أسعار MoonshotAI أو OpenAI ساريًا في اليوم نفسه. يعني التبديل التلقائي عند الفشل أن مسارًا متدهورًا لدى أي من المزوّدين لا يُسقط خط المعالجة، وتتيح لك لغة التوجيه DSL إرسال الأعمال التي تعتمد على الاسترجاع إلى Kimi K3 والأعمال التي تعتمد على التوليد إلى GPT-6 Sol وفق قاعدة لا وفق تخمين.

أيّ واحد نضعه في خط الأنابيب؟
اختر Kimi K3 عندما تكون المهمة هي الاسترجاع والاحتفاظ عبر مدخلات طويلة جدًا — مراجعة الوثائق القانونية والطبية، وفهم الشيفرة البرمجية لكامل المستودع، وتحليل النصوص عبر مئات الوثائق — وعندما تكون مطالباتك كثيفة المدخلات بما يكفي ليكون السعر الثابت البالغ 3.00 دولارات أفضل من إعادة تسعير GPT-6 Sol. إن تفوقه في الاستدعاء وترتيبه ضمن العشرة الأوائل في البرمجة هما الرقمان اللذان يبرران هذا الاختيار.
اختر GPT-6 Sol عندما تكون المهمة مساعدًا عامًا مدعومًا بنافذة تبلغ مليون رمز: تفكير مختلط، والتسلسل إلى JSON، وحلقات وكيلية تكتب الكثير من الردود، وأي سير عمل يكون فيه سقف الإخراج البالغ 128,000 رمز ميزة لا قيدًا. فهو أرخص في الإخراج، ويكشف عن تحكم صريح بجهد التفكير، ومؤشره المركب هو الإشارة العامة الأقوى. وحين يقوم خط أنابيب فعلاً بالأمرين معًا، فإن الإجابة الصادقة هي التوجيه بدلاً من الاختيار — وهذا تصريح عن شكل حركة مرورك، لا عن أي من النموذجين.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
