بطاقة رئيسية بعنوان Claude Sonnet 5.5 مقابل Kimi K3، بعنوان فرعي: لن يقبل أي من النموذجين إعداد درجة الحرارة الخاص بك، مع كبسولات تقرأ: أوزان مغلقة $2 / $10 مقابل أوزان مفتوحة $3 / $15، المؤشر 56 مقابل 44، ولا أي منهما يقبل درجة الحرارة، وتذييل يستشهد بـ Artificial Analysis v4.3.2 وأسعار البائعين.
Guides & Insights

Claude Sonnet 5.5 مقابل Kimi K3: لن يتقبل أيٌّ من النموذجين إعداد درجة الحرارة الخاص بك

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

إليك مقارنة يتفق فيها النموذجان على أمر سيؤدي إلى تعطّل شفرتك في كلتا الحالتين. Claude Sonnet 5.5، الصادر في 28 سبتمبر 2026، يرفض أي طلب يضبط temperature، top_p أو top_k على قيمة غير افتراضية، ويُعيد خطأ 400. أما Kimi K3، المتاح عمومًا من Moonshot AI منذ منتصف يوليو 2026، فلا يقبل أي معاملات أخذ عينات على الإطلاق — لا temperature، ولا top_p، ولا seed — ولا يكشف عن عمق الاستدلال إلا عبر عنصر تحكم reasoning_effort. مختبران مختلفان، ومعماريتان مختلفتان، ونتيجة واحدة مشتركة: مقابض أخذ العينات التي لا تزال معظم عمليات التكامل تضبطها بدافع العادة اختفت في كليهما.

هذه ليست المقارنة التي يكتب عنها أحد. المقارنة التي يكتب عنها الجميع هي السعر: Kimi K3 بسعر 3 دولارات لكل مليون رمز إدخال و15 دولارًا للإخراج مقابل Claude Sonnet 5.5 بسعر 2 و10 دولارات، وهو فوز واضح لصالح Anthropic على بطاقة الأسعار. لكن Kimi K3 نموذج مفتوح الأوزان بمزيج خبراء يضم 2.8 تريليون معامل يمكنك تنزيله وتشغيله داخل حدودك الخاصة، أما Claude Sonnet 5.5 فهو نموذج مغلق متاح على أربع سحابات. وبين نموذج مغلق أرخص وآخر قابل للتنزيل أغلى، لا يُتخذ القرار على أساس سعر الرمز على الإطلاق.

ما هو كل واحد منها، في فقرة واحدة لكل منها

Claude Sonnet 5.5 هو النموذج الثاني في الجيل 5.5 من Anthropic، بعد Claude Opus 5.5 على Claude API بعد خمسة أيام من ذلك الإطلاق. ويتوفر باسم claude-sonnet-5-5 عبر Claude API وAmazon Bedrock وGoogle Cloud وMicrosoft Foundry، ويحتفظ بنافذة سياق تبلغ 1M توكن وسقف إخراج متزامن 128K، ويحافظ على تسعير Claude Sonnet 5 نفسه تمامًا: $2 للإدخال، و$10 للإخراج، و$0.20 لكل مليون لقراءات التخزين المؤقت. التفكير التكيفي مفعّل افتراضيًا عند مستوى عالٍ من الجهد. وهو متاح مع احتفاظ صفري بالبيانات، وتمنحه Artificial Analysis مؤشر ذكاء قدره 56 في مراجعته v4.3.2 — الثالث من بين 216 نموذجًا تقيسها.

Two-column scoreboard for Claude Sonnet 5.5 and Kimi K3 across six rows. Left column Claude Sonnet 5.5: input $2.00 per million, output $10.00 per million, 1M-token context, AA Intelligence Index 56, cost per Index task $7.60, closed weights on four clouds. Right column Kimi K3: input $3.00 per million, output $15.00 per million, 1M-token context, AA Intelligence Index 44, cost per Index task $2.00, open weights under the Kimi K3 License. A footer line reads Index and cost per task per Artificial Analysis v4.3.2; prices per the vendors.

Kimi K3 هو الطراز الرائد لـ Moonshot AI: نموذج خليط خبراء بـ2.8 تريليون معامل، يُنشّط نحو 104 مليارات معامل لكل رمز، مع نافذة سياق تبلغ مليون رمز وفهم بصري أصيل. وقد صُمم للبرمجة طويلة الأفق وأعمال المعرفة متعددة الخطوات، وتضعه Moonshot بالاسم ضمن أُطر تشغيل وكلاء البرمجة. يتحدث بصيغة OpenAI API، ويكشف عن reasoning_effort بوصفه ضابط الاستدلال الوحيد، وهو مفتوح الأوزان بموجب ترخيص Kimi K3 — وهذا ليس الشيء نفسه الذي يعنيه مفتوح المصدر، والفرق هو الجزء الذي ينبغي قراءته قبل أن تبني عليه.

بطاقة الأسعار، والرقم الموجود أسفلها

ضع الاثنين جنبًا إلى جنب وفق الأبعاد التي تحدّد مصير مشروع قانون لا عنوانًا رئيسيًا:

• سعر الإدخال — Claude Sonnet 5.5 بسعر 2 دولار لكل مليون مقابل Kimi K3 بسعر 3 دولارات لكل مليون

• سعر الإخراج — Claude Sonnet 5.5 بسعر 10 دولارات لكل مليون مقابل Kimi K3 بسعر 15 دولارًا لكل مليون

• قراءات الذاكرة المؤقتة — 0.20 $ لكل مليون مقابل 0.20 $ لكل مليون

• نافذة السياق — 1,000,000 رمز مقابل 1,048,576 رمز

• الأوزان — مملوكة، أربع منصات مستضافة مقابل أوزان مفتوحة بموجب رخصة Kimi K3

• مؤشر الذكاء — Claude Sonnet 5.5 56 مقابل Kimi K3 44 على نفس المراجعة v4.3.2

• التكلفة لكل مهمة في مؤشر الذكاء — Claude Sonnet 5.5 بسعر 7.60 دولار مقابل Kimi K3 بسعر 2.00 دولار

• الإسهاب في المؤشر — Claude Sonnet 5.5 ‏410 مليون رمز إخراج مقابل Kimi K3 ‏160 مليون

هذا الزوج الأخير هو الانقلاب الجدير بالتوقف عنده. نموذج Anthropic أرخص بنسبة 50% في الإدخال وبالثلث في الإخراج، ومع ذلك تبلغ تكلفته 3.8 أضعاف لإكمال التقييم نفسه، لأنه ينفق 2.6 أضعاف الرموز للوصول إلى ذلك. وعلى المؤشر المركّب يسجّل أيضًا أعلى باثنتي عشرة نقطة، لذا ليست هذه حالة نموذج مُسرِف لا يشتري شيئًا. إنها حالة نموذجين لا يمكن مقارنة سلوكهما في التكلفة بقراءة بطاقتي أسعار، ولهذا يوجد رقم مهمة المؤشر.

لن يكون أيٌّ من هذين العددين من الرموز هو عدد الرموز الخاص بك. تشير وثائق Moonshot نفسها إلى أن عمق استدلال K3 يُحدَّد عبر reasoning_effort وليس عبر أخذ العينات، وينطبق الأمر نفسه فعليًا على معامل effort في Claude Sonnet 5.5 — لذا في كلا الطرازين، أكبر رافعة منفردة على فاتورتك هي إعداد الجهد، وليست مفاوضة على السعر.

Anthropic Claude Platform documentation page for Claude Sonnet 5.5 showing the summary line the best combination of speed and intelligence, the model ID claude-sonnet-5-5, a 1M-token context window, a 128K maximum output, an input price of $2 per million tokens and an output price of $10 per million tokens, with links to the What is new and Migration guide pages.

أخطاء 400 بالتفصيل

OrcaRouter model page for kimi/kimi-k3, attributed to MoonshotAI and dated 2026-07-15, showing a 1M-token context window, text and image input, Vision, Tools, JSON and Reasoning capability tags, an input price of $3.00 and output price of $15.00 per million tokens, a p50 time to first token of 8.20 seconds, and 371.9M tokens of traffic in the last seven days.

الرفض المشترك لمعاملات أخذ العينات هو أكثر نقاط التقاطع عمليةً هنا، لأنه الفشل الذي يظهر في صباح اليوم التالي بعد استبدال النموذج.

في Claude Sonnet 5.5، القواعد صريحة ولا ترحم. أي قيمة غير افتراضية لـ temperature، أو top_p أو top_k تعيد خطأ 400. إرسال thinking: {"type": "disabled"} يعيد خطأ 400 يشير إلى between_tools، وهو أدنى إعداد تفكير جديد، ويُقبل عند الجهد المنخفض والمتوسط والعالٍ لكنه يُرفض عند xhigh أو max. استخدام الأدوات القسري — tool_choice المضبوط على "any" أو على أداة محددة بالاسم — يعيد خطأ 400 بالرسالة "tool_choice: type \"tool\" and \"any\" are not supported for this model"، والإصلاح هو auto بالإضافة إلى الاستخدام الصارم للأدوات أو المخرجات المنظمة. والمزيد: أصبحت كتل التفكير الآن مرتبطة بالطراز والحساب الذي أنتجها، لذا يمكن نقل محادثة من Claude Sonnet 5 إلى Sonnet 5.5 مع بقاء استدلالها سليمًا، لكن لا يمكن نقل هذا الاستدلال إلى عائلة طراز مختلفة، كما أن بادئة معدّلة يمكن أن تحوّل إعادة التشغيل إلى خطأ 400.

على Kimi K3، الواجهة أصغر لكن العواقب مشابهة. لا توجد معلمات أخذ عينات لإرسالها، لذا فإن أي عميل يقوم بتثبيت واحدة يرسل بالفعل معلمة لا يقرأها النموذج. عمق الاستدلال هو من المستوى الأعلى reasoning_effort حقل بدلاً من ذلك.

يشير كلا التغييرين في الاتجاه نفسه: إذ يحل مقبض الجهد على جانب النموذج محل نهج المقبض الحتمي في التحكم بالتوجيه. أي خط أنابيب كان يضبط نفسه باستخدام درجة حرارة 0.2 وبذرة ثابتة يجب إعادة ضبطه حسب مستوى الجهد على هذين النموذجين، وإعادة الضبط هي الترحيل.

ما الذي تمنحك إياه الأوزان المفتوحة فعليًا هنا؟

سبب التفكير في Kimi K3 في مقابل نموذج مغلق أرخص وأعلى تقييمًا ليس القدرة ولا السعر، بل الحدود.

تشغيل K3 داخل البنية التحتية الخاصة بك يعني أن المطالبات والمستندات والمخرجات لا تغادر أبدًا شبكة تتحكم بها، وهو حديث امتثال مختلف عن اتفاقية عدم الاحتفاظ بالبيانات مع أحد الموردين. كما يعني أن النموذج لا يمكن إيقاف دعمه من تحتك — إذ يأتي Claude Sonnet 5.5 بالتزام تقاعد من Anthropic ليس قبل 28 سبتمبر 2027، بينما لا يحمل نقطة تحقق تم تنزيلها مثل هذا التاريخ. ويعني أيضًا أن منحنى التكلفة الحدية يتسطح: بعد الأجهزة، تصبح الرموز مجانية، وهو الهيكل الوحيد الذي يصبح فيه نموذج بـ2.8 تريليون معامل الخيار الرخيص.

الترخيص هو ما تقوم بتوقيعه فعليًا. Kimi K3 مفتوح الأوزان، وليس مفتوح المصدر، ولا تستخدم Moonshot المصطلح الأخير. ترخيص Kimi K3 واسع لمعظم الاستخدامات، لكن نشاطًا تجاريًا قائمًا على النموذج كخدمة يتجاوز حدًا متدحرجًا للإيرادات يحتاج إلى اتفاق تجاري منفصل، كما يجب على المنتجات التي تتجاوز حدودًا كبيرة لعدد المستخدمين أو الإيرادات أن تعرض إسناد "Kimi K3". ووصفه بأنه مرخّص بموجب MIT هو عدم دقة من حقبة K2 لا يزال متداولًا. إذا كنت تخطط للبناء على الأوزان بدلًا من استدعاء API، فهذه مراجعة قانونية وليست حاشية.

والأوزان كبيرة بما يكفي بحيث يصبح الاستضافة الذاتية قرارًا رأسماليًا. فنموذج MoE بمعاملات تبلغ 2.8 تريليون ومع نحو 104 مليارات معامل نشط ليس عملية نشر على خادم واحد، والجهد اللازم لتشغيله هو التكلفة الحقيقية لهذا الخيار — وهي تكلفة تجعل فارق الـ5 دولارات لكل مليون في أسعار الإخراج يبدو ضئيلًا.

أين يتناسب OrcaRouter

معظم الفرق التي تقيّم هذين الخيارين لا تريد الاختيار بين واجهة برمجة تطبيقات مُدارة وشراء أجهزة. بل تريد التوجيه.

‏OrcaRouter هو نقطة نهاية واحدة متوافقة مع OpenAI تغطي أكثر من 200 نموذج، مع تمرير سعر قائمة المزوّد كما هو ودون أي هامش ربح، بحيث يظهر أي تغيّر في أسعار المزوّد من أي من الطرفين في اليوم نفسه لا في دورة الفاتورة التالية.‏Kimi K3 موجود في الكتالوج منذ يوليو بسعر Moonshot نفسه البالغ 3$ / 15$، مع زمن مُقاس لأول رمز (p50) يبلغ نحو ثماني ثوانٍ، ونحو 371.9 مليون رمز تمرّ عبره خلال الأسبوع الماضي. Claude Sonnet 5 — النموذج الذي لا يزال معظم حركة Claude API يعمل عليه، وبمعدل مُقاس يبلغ 150 رمز إخراج في الثانية — قابل للتوجيه منذ 30 يونيو بسعر Anthropic البالغ 2$ / 10$.

لا يتوفر Claude Sonnet 5.5 في كتالوجنا بعد. وحيث يكون ذلك صحيحًا، قل ذلك صراحةً وابحث عن مسار بديل له: فواجهة API الخاصة بالمورّد نفسه هي السبيل إليه، وطريقة اختباره دون الالتزام هي توجيه نسبة مئوية من حركة المرور خلف التحويل التلقائي عند الفشل، مع Claude Sonnet 5 أو Kimi K3 كخيار احتياطي. إذا كان سبب النظر إلى K3 هو الحدود وليس المعدل، فإن الأوزان قابلة للتنزيل اليوم وAPI ليست سوى حل مؤقت — وهذا قرار يتعلق ببنيتك التحتية، لا بمقارنة النماذج.

الحكم، مقسّمًا حسب ما تشتريه فعليًا

اختر Claude Sonnet 5.5 عندما تكون المهمة طويلة السياق وكثيفة الإخراج، وعندما تكون النقاط الاثنتا عشرة من المؤشر المركّب هي ما تشتريه، وعندما تجتاز واجهة API مُدارة بعدم احتفاظ بالبيانات مراجعتك. خصّص ميزانية لعادة الـtokens — 410 ملايين token على المؤشر مقابل 160 مليونًا لدى K3 مضاعف حقيقي — وخصّص يومًا لتغييرات استخدام الأدوات وكتل التفكير.

اختر Kimi K3 عندما يكون الحدّ هو المتطلّب، أو عندما تريد نقطة تحقّق لا يمكن لأي مورّد سحبها، أو عندما يكون عبء عملك هو البرمجة الوكيلية بكثافة عالية حيث تتراكم تكلفة 2.00 دولار لكل مهمة فهرسة مقابل 7.60 دولار. تقبّل أنه نموذج بـ2.8 تريليون معامل يجب استضافته، وأن ترخيصه يتضمّن بنود إسناد وبنود إيرادات، وأنه يسجّل أقل من مستوى Anthropic في المقياس المركّب.

ما لا يفلت منه أيٌّ من الخيارين هو الفقرة الأولى: فقد اختفت معاملات أخذ العينات في كليهما، ومُحدِّد الجهد هو أداة التحكم التي حلّت محلها. أيّهما تختار من هذين، فهذا هو التغيير الذي يحتاجه كودك.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا