بطاقة عنوان رئيسية تحمل 'Fugu Max vs Kimi K3' مع عنوان فرعي 'اختارت Sakana هذا المقياس'، وثلاث شارات كبسولية تحمل '$6.00 مقابل $15.00 للمخرجات'، و'أقل بنسبة 60% في المخرجات'، و'1M ثابت مقابل نافذة غير منشورة'، وسطر تذييل يحمل 'Sakana AI، سبتمبر 2026 مقابل Moonshot AI، يوليو 2026'، وشعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

فوغو ماكس مقابل كيمي K3: ساكانا اختارت هذا المقياس، فلنقرأه

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

يسمّي إصدار Sakana AI لنموذج Fugu Max ثلاثة نماذج بالضبط لتبرير تسعيره، وKimi K3 من Moonshot AI أحدها. الادعاء هو أن سعر الإخراج لدى Fugu Max يقل بنسبة 40 إلى 60 بالمئة عن تلك النماذج الثلاثة، ما يجعل Kimi K3 — لا Grok 4.6 ولا Qwen3.8-Max — المعيار الذي اختارته Sakana نفسها للقيمة. هذا تصرف كريم بشكل غير معتاد من مورّد: يسلّمك مسطرة قياس ويخبرك أين تمسكها. لذا تفعل هذه الصفحة الشيء البديهي وتمسكها. طُرح Fugu Max في 11 سبتمبر 2026 بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولار لكل مليون رمز إخراج. أما Kimi K3 فمُدرج بسعر 3.00 دولارات و15.00 دولارًا. ادعاء 60 بالمئة بشأن الإخراج صحيح حسابيًا. ما لا تذكره الجملة هو أن النموذج الذي يخفض Fugu Max سعره مقارنةً به ينشر سجلًا كاملًا بنتائج مقاسة بشكل مستقل، بينما النموذج الذي يقوم بخفض السعر لا ينشر شيئًا.

الجملة من 40 إلى 60 بالمئة، مفحوصة

• المدخل — Fugu Max بسعر 2.00 دولار لكل مليون رمز مقابل Kimi K3 بسعر 3.00 دولار لكل مليون رمز، أي توفير بنسبة 33 بالمئة بدلاً من نسبة 40 إلى 60 بالمئة التي يستهلّ بها البيان الصحفي

• الإخراج — Fugu Max بسعر 6.00 دولارات لكل مليون رمز مقابل Kimi K3 بسعر 15.00 دولارًا لكل مليون رمز، وهو أقل بنسبة 60 بالمئة من الحد الأعلى للنطاق المعلن من ساكانا

• الإدخال المخزَّن مؤقتًا — Fugu Max بسعر 0.25 دولار لكل مليون توكن مقابل Kimi K3 بسعر 0.30 دولار لكل مليون توكن، وهي فجوة صغيرة بما يكفي كي لا تلاحظها الحلقات كثيفة الاعتماد على التخزين المؤقت

• نافذة السياق — Fugu Max لم يُنشر أي رقم في الإصدار مقابل Kimi K3 بـ 1,048,576 رمزًا

• إعادة تسعير المطالبات الطويلة — Fugu Max دون ذكر أي فئة، مقابل Kimi K3 بسعر ثابت على مدار النافذة بأكملها دون رسوم إضافية عند أي طول

• النشر — واجهة API الخاصة بمورّد Fugu Max فقط، وعضوية المجمّع غير معلنة مقابل أوزان Kimi K3 القابلة للتنزيل بموجب ترخيص Kimi K3

• تقييم مستقل — Fugu Max: لا يوجد، ولا توجد صفحة Artificial Analysis لأي طراز Fugu مقابل Kimi K3 بمؤشر ذكاء Artificial Analysis Intelligence Index قدره 44 ونسبة معيارية قدرها 93.40% على SWE-bench Verified من Vals AI

لاحظ شكل ذلك الصف الأول. النطاق اللافت، من 40 إلى 60 بالمئة، هو النطاق عبر ثلاثة منافسين مُسمّين، وKimi K3 هو الذي يُنتج الـ60. وبالنظر إلى المدخلات وحدها، تكون المقارنة 33 بالمئة، وهو توفير حقيقي مع ذلك لكنه جملة مختلفة. هذا ليس انتقادًا للتسعير — فـ 2.00 دولار و6.00 دولارات رقمان منخفضان حقًا لنظام يدّعي نتائج قريبة من الطليعة. إنها ملاحظة عن أي رقم في البيان هو الذي يقوم بالإقناع، وعن كيفية ترتيب الفقرة حوله.

Kimi K3 مدرج في كتالوجنا بسعر Moonshot نفسه — 3.00 دولارات لكل مليون مدخل، و0.30 دولار عند إصابة ذاكرة التخزين المؤقت، و15.00 دولارًا لكل مليون مخرج — يُمرَّر دون أي هامش ربح بنسبة 0%، لذا إذا غيّرت Moonshot تسعيرها يصبح السعر الجديد ساريًا على المفتاح نفسه في اليوم نفسه بدلًا من دورة ترحيل. وهذا الأمر يهم هنا أكثر من المعتاد، لأن خفض السعر من المنبع هو بالتحديد ما يُضعف أو يوسّع فجوة الـ60 بالمئة التي تقوم عليها هذه المواجهة بأكملها.

ما ينشره المعيار

سجل Kimi K3 هو نقيض الضآلة. فبطاقة النموذج الخاصة بـ Moonshot نفسها تُفيد بأن Terminal-Bench 2.1 عند 88.3، وGPQA Diamond عند 93.5، وHLE-Full عند 43.5 ويرتفع إلى 56.0 مع الأدوات، وSWE-Marathon عند 42.0، وOSWorld-Verified عند 84.8، وMCPMark-Verified عند 94.5، وDeepSWE عند 67.5. جميعها مُبلَّغ عنها من المورّد، وهناك الكثير منها.

الطبقة المستقلة موجودة أيضًا، وهي الجزء المهم في هذه المقارنة. تمنح Artificial Analysis نموذج Kimi K3 درجة 44 على v4.3 Intelligence Index — الثاني بين النماذج مفتوحة الأوزان، خلف GLM-5.3 عند 45 — مع إنتاجية مسجلة تبلغ 37.9 رمزًا مُخرَجًا في الثانية وزمن حتى أول رمز يبلغ 3.80 ثانية. تضع أداة Vals AI المعيارية الوكيلية عند 93.40% على SWE-bench Verified، خلف Claude Opus 5 وDeepSeek V4 Pro ولكن عن قرب. كما يتصدر Frontend Code Arena عند 1679 Elo، متقدمًا على Claude Fable 5 عند 1631 وGPT-5.6 Sol عند 1618. تحذير واحد: إذا رأيت Kimi K3 مذكورًا عند 57 أو 60 على Intelligence Index، فهذه أرقام ما قبل إعادة البيان من قبل أن تعيد Artificial Analysis معايرة المقياس في سبتمبر 2026 ويجب عدم تكرارها إلى جانب الأرقام الحالية.

ثمة إشارة استخدام أيضًا، وهي تأتي من بوابتنا الخاصة لا من تسويق أي جهة: نقل Kimi K3 نحو 3.27 مليار رمز عبر OrcaRouter خلال الأيام السبعة الماضية، وهو أكبر حجم حركة بين أي نموذج في هذه المقارنة. لكن ذلك ليس مقياسًا للجودة. إنه عيّنة كبيرة لما يلجأ إليه المطورون حين تكون التكلفة الوحيدة للاختيار هي سعر الرمز، وهو يقول إن نافذة المليون رمز الثابتة والأوزان المفتوحة قد كسبت بالفعل حصة كبيرة من العمل الحقيقي الممتد.

A two-column scoreboard titled 'Fugu Max vs Kimi K3 - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, benchmarks six wins with no figures, evidence vendor-reported only. Kimi K3: output price $15.00 per 1M, input price $3.00 per 1M, cached input $0.30 per 1M, context 1M flat with no surcharge, benchmarks Terminal-Bench 2.1 at 88.3, evidence Artificial Analysis Index 44 and SWE-bench Verified 93.40%. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Kimi K3 rows Moonshot-reported and per Artificial Analysis and Vals AI.' OrcaRouter logo bottom-right.

لوحة النتائج التي لا توجد عليها أرقام

تذكر ساكانا أن Fugu Max يحقق أفضل نتيجة إجمالية في ستة معايير: Terminal Bench 2.1 وGPQAD وAA-LCR وGDP.pdf وAutomationBench وSWEFish. وتقول أيضًا إن Max يوسّع حدود باريتو لأداء-التكلفة في سبعة من عشرة معايير. كلتا العبارتين تتعلقان بالمرتبة على رسم بياني. ولا تأتي أي منهما بقيمة أو هامش أو رقم منافس إلى جانبها.

القائمتان بالكاد تتقاطعان، وهذه هي المشكلة العملية. تسجّل Kimi K3 نتيجة 88.3 في Terminal-Bench 2.1؛ وتقول Sakana إن Fugu Max يحقق أفضل نتيجة إجمالية في Terminal Bench 2.1 ولا تطبع شيئًا للمقارنة به. هذا الصف الوحيد هو أوضح مثال على المواجهة بأكملها: كلا المورّدين يذكران الاختبار نفسه، أحدهما يطبع رقمًا، والآخر يطبع كلمة «best». وإلى أن تنشر Sakana الرقم، لا يوجد دليل منشور يجيب عمّا إذا كان Fugu Max يتفوق على Kimi K3 في الاختبار المعياري الذي اختارت Sakana أن تتصدر به.

هناك قراءة منصفة لهذا الإصدار تستحق أن تُذكر. إن Fugu Max هو فئة التكلفة — صدر في اليوم نفسه الذي صدر فيه Fugu Ultra v2، وهو دفعة القدرات بسعر 5.00 دولارات للمدخلات و30.00 دولارًا للمخرجات — وتُستمد حجته من مخطط باريتو حيث يكون الادعاء قائمًا على النتيجة لكل دولار، لا على النتيجة وحدها. ووفق هذا التأطير، سيكون رقم معيار مجرد إحصائية أقل صدقًا. المشكلة أن الإصدار يحذف أيضًا المقام: فالتغطية الخاصة بـ Sakana نفسها تقر بأن تبديل النماذج في منتصف المهمة قد يقلل إعادة استخدام ذاكرة السياق المؤقتة ويولّد رموز تنسيق إضافية، وتؤكد أن الشركة لم تفصح عن معدل إصابة الذاكرة المؤقتة لدى Max أو إجمالي تكلفة الرموز لكل مهمة. لذا فإن القياس الوحيد الذي سيحسم حجة فئة التكلفة هو القياس غير المقدَّم.

أوزان يمكنك حملها، أو بركة لا يمكنك رؤيتها

هنا يتوقف المنتجان عن كونهما قابلين للمقارنة على الإطلاق.

تأتي Kimi K3 بأوزان قابلة للتنزيل، وهو منفذ نجاة حقيقي: إذا تغيرت الأسعار أو الشروط، يمكن تقديم النموذج من بنيتك التحتية الخاصة. الترخيص أضيق مما تعنيه عبارة "الأوزان المفتوحة" عادةً. فهو ترخيص Kimi K3 وليس منحة معتمدة من OSI، والوصف المتكرر له بأنه MIT معدّلة محل خلاف. تتطلب الشروط اتفاقًا منفصلًا مع Moonshot للشركات التي تقدم النموذج كخدمة والتي تتجاوز إيراداتها 20 مليون دولار خلال أي اثني عشر شهرًا متتالية، إضافة إلى الإسناد للمنتجات التي يتجاوز عدد مستخدميها الشهريين 100 مليون أو إيراداتها الشهرية 20 مليون دولار، مع إعفاء الاستخدام الداخلي. والحجم العملي حقيقي: تبلغ نقطة الحفظ نحو 1.5 تيرابايت، وتوصي Moonshot بـ64 مسرّعًا أو أكثر، لذا فإن الاستضافة الذاتية قرار يتعلق بعنقود استدلال وليس بحاسوب محمول.

لا يوفّر Fugu Max أيًا من ذلك — فلا أوزان، ولا مجموعة قابلة للتفتيش، ولا خيار استضافة ذاتية — وفي المقابل لا يفرض أي شرط ترخيص، لأنه لا يوجد شيء يُرخّص. الفائدة المعلنة من Sakana هي عكس التحكم: مجموعة تمتد عبر النماذج مفتوحة الأوزان والمتخصصة، وُسّعت من أجل Max بعائلة NVIDIA Nemotron، تعني أن إيقاف أي مورّد منبع واحد أو إعادة تسعيره لا يمكن أن يُسقط منتجك. هذا تحوّط حقيقي. وهو أيضًا غير قابل للتحقق من الخارج، لأن العضوية لا تُنشر عمدًا، ويعني أن نتيجة Fugu Max تحمل تاريخ انتهاء صلاحية لا تحمله نتيجة Kimi K3.

الأوزان المفتوحة ومجمّع غير معلن هما إجابتان مختلفتان للخوف نفسه. إحداهما تقول إن بوسعك المغادرة. والأخرى تقول إنه لا يوجد شيء لتغادره.

حيث تحسم النافذة المسطحة الأمر

سياق Kimi K3 البالغ 1,048,576 رمزًا موحّد — لا طبقة سياق طويلة، ولا رسوم إضافية عند أي طول. إصدار Fugu Max لا يذكر أي نافذة على الإطلاق، لذا لا يوجد شيء لمقارنته به ولا شيء للتخطيط على أساسه. بالنسبة إلى البرمجة الوكيلية طويلة الأفق التي يستهدفها كلا المنتجين، حيث تقضي الجلسات معظم عمرها في أعماق السياق، فإن عدم التماثل هذا يهم أكثر مما تهم بطاقة الأسعار.

السرعة هي الصورة المعكوسة للمشكلة ذاتها. يُقاس Kimi K3 عند 37.9 رمزًا في الثانية مع زمن يبلغ 3.80 ثانية حتى أول رمز، وهو بطيء — قيد حقيقي بالنسبة إلى طراز بُني حول حلقات طويلة، وتشير Artificial Analysis إلى أنه مطوّل بشكل ملحوظ. لا تنشر Sakana أي رقم لزمن الاستجابة أو معدل الإنتاجية الخاص بـ Fugu Max، وهو أمر يمكن القول إنه صادق وليس مراوغًا بالنسبة إلى منسّق: إذ يعتمد زمن الاستجابة على الطرازات التي يختارها وعدد التمريرات التي يجريها. لكنه يعني أنك لا تستطيع نمذجة التكلفة الزمنية الفعلية للتبديل من دون قياسها بنفسك. أما Fugu Ultra الأسبق، فقد أبلغ مستخدمون علنًا عن تشغيلات تمتد نحو 30 دقيقة. هذا هو طراز يونيو 2026، وليس دليلًا على Max، لكنه الرقم الذي يجب تجاوزه عند إجراء القياس المرجعي.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the opening argument about the two-dimensional frontier of capability against cost and the statement that Fugu Max expands the Pareto efficiency frontier by orchestrating Sakana's largest pool of open and specialized models to date.

الحكم، بمصطلحات Sakana نفسها

اختارت ساكانا Kimi K3 كأحد النماذج الثلاثة التي يقلّ سعر Fugu Max عنها، وعلى صعيد سعر الإخراج يصحّ الادعاء: 6.00 دولارات مقابل 15.00 دولارًا تمثّل انخفاضًا بنسبة 60 في المئة، وهو بالضبط الحدّ الأعلى للنطاق المذكور. إذا أخذنا البيان على ظاهره، فإن Fugu Max هو المنتج الأرخص.

الآن، طبّق المقياس الذي تجنّبه الإصدار. إن Kimi K3 أغلى بنسبة 33 بالمئة على الإدخال و150 بالمئة على الإخراج — وبهذا المال يمنحك نافذة بسعة مليون رمز دون هاوية إعادة تسعير، ونقطة تحقق قابلة للتنزيل بموجب ترخيص مقيّد بالإيرادات، ومرتبة 44 في مؤشر الذكاء المستقل، ودرجة معيارية قدرها 93.40% في SWE-bench Verified، والمركز الأول في Frontend Code Arena، وأكثف حركة مرور حقيقية بين أي نموذج في هذه المقارنة. أما Fugu Max فيمنحك سعرًا أقل على كلا جانبي الرمز، وستة انتصارات معيارية غير مُقاسة، ومعدل ذاكرة تخزين مؤقت يساوي نصف نظيره لدى K3 دون معدل إصابة منشور، ومجمّعًا لا يمكنك تفحّصه.

الاستنتاج الصادق هو أن ساكنا اختارت معيارًا يجعلها تبدو أفضل في السعر، ولم تمنحك شيئًا يمكنك التحقق منه في القدرات. إذا كان عبء عملك ضخم الحجم وكانت مهامك من النوع الذي يستطيع منسّق تفكيكه بشكل موثوق، فإن فرق المعدل/السعر هو مال حقيقي، ويستحق Fugu Max تجربة محددة النطاق مع تفعيل محاسبة التوكنات من أول طلب. وإذا كنت تحتاج إلى قرار إنتاجي يمكنك الدفاع عنه هذا الربع — نافذة يمكنك التخطيط بناءً عليها، ودرجة يمكنك الإشارة إليها، ونموذج يمكنك تشغيله حتى لو اختفى المورّد — فإن Kimi K3 هو الجواب، وهو متاح على OrcaRouter بسعر Moonshot المعلن مع تمرير سعر المزوّد كما هو دون مساس.

A screenshot of the OrcaRouter model page for Kimi K3 (English UI, captured September 11, 2026), showing the Featured badge, the identifier kimi/kimi-k3, by MoonshotAI dated 2026-07-15, vision, tools, JSON and reasoning capability tags, a 2.8-trillion-parameter Mixture-of-Experts description, a 1M-token context window with text and image input, list pricing of $3.00 per 1M input tokens and $15.00 per 1M output tokens, traffic of 3,274.3 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.