
Fugu Ultra v2 مقابل Kimi K3: موجّهان، ارتفاعان
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
كلا هذين النظامين عبارة عن موجّهين، وهذا أول ما يفوته معظم التغطية. Kimi K3 هو نموذج خليط الخبراء (Mixture-of-Experts) ببارامترات تبلغ 2.8 تريليون، ويُنشّط نحو 104 مليار بارامتر لكل رمز — ما يعني أنه عند كل رمز يولّده، يتخذ قرار توجيه، فيختار 16 من خبرائه الـ896 للقيام بالعمل. Fugu Ultra v2، الذي أعلنت عنه Sakana AI في 11 سبتمبر 2026، عبارة عن موجّه على مستوى مختلف تمامًا: فهو يتلقى مهمة واردة، ويجزئها، ويوزّع الأجزاء عبر مجموعة من النماذج المنفصلة. أحد النظامين يوجّه داخل تمريرة أمامية واحدة؛ والآخر يوجّه عبر أسطول. إن إدراك أنهما الفكرة نفسها على مقياسين هو أسرع طريقة لرؤية سبب اختلاف أسعارهما بمعامل 2× على الإدخال و5× على الإخراج.
الراوتران، جنبًا إلى جنب
• Kimi K3 — النموذج الرائد لـ Moonshot AI، صدر في منتصف يوليو 2026 بأوزان مفتوحة نُشرت في 27 يوليو 2026. البنية غير معتادة حتى بمعايير 2026: 69 طبقة Kimi Delta Attention متداخلة مع 24 طبقة Gated MLA، وAttention Residuals، وتصميم "Stable LatentMoE"، ومشفّر رؤية MoonViT-V2 بمعاملات 401 مليون. تُشحن الأوزان بتنسيق MXFP4 مع تنشيطات MXFP8 في إطار تدريب واعٍ بالتكميم. وتكشف واجهة API المستضافة الخاصة به عن جهد الاستدلال بقيمة مدعومة واحدة بالضبط — max.
• Fugu Ultra v2 — طبقة التنسيق ذات القدرة القصوى من Sakana AI، وليست نموذجًا أساسيًا بالمعنى المعتاد. إنها نقطة نهاية واحدة متوافقة مع OpenAI تفكك المهام وتوزعها على مجموعة من النماذج المفتوحة الأوزان والمتخصصة. وتذكر Sakana أن Claude Fable 5 وClaude Fable 5.1 وGPT-6 Astra مستبعدة من تلك المجموعة، وتدرج تاريخ قطع التدريب 20260828. لا يوجد عدد منشور للمعاملات، لأنه لا توجد معاملات تُعدّ بالطريقة التي تُعدّ بها مع K3 — فالقدرة تكمن في سياسة الجدولة.
النتيجة هي أن K3 مكوّن وFugu Ultra v2 تجميعة. هذا يجعل هذه المقارنة غير عادية: هذان ليسا متنافسين فحسب، بل مكوّنات محتملة. نموذج مثل K3 هو بالضبط نوع النظام المفتوح الأوزان، طويل السياق، القادر على استدعاء الأدوات، الذي قد يستأجره منسّق بشكل معقول. لا تنشر Sakana عضوية التجمع، لذا ما إذا كان K3 داخل Fugu Ultra v2 غير معروف — ولكن إذا كان كذلك، فإن بعض ما تدفع مقابله بسعر Fugu هو رموز K3 مع هامش ربح.
ما هي فجوة السعر في الواقع
• الإدخال — Fugu Ultra v2 بسعر مُبلّغ عنه يبلغ 5.00 دولارات لكل مليون (قوائم طرف ثالث؛ صفحة إعلان Sakana لا تنشر أسعارها الخاصة) مقابل Kimi K3 بسعر 3.00 دولارات لكل مليون، مع إصابات الذاكرة المؤقتة عند 0.30 دولار.
• الإخراج — Fugu Ultra v2 بسعر مُعلن قدره 30.00 دولارًا لكل مليون مقابل Kimi K3 بسعر 15.00 دولارًا لكل مليون. بنصف السعر، لطراز يمكنك تنزيله أيضًا.
• المُدخَل المخزَّن مؤقتًا — Fugu Ultra v2 بسعر $0.50 لكل مليون مقابل Kimi K3 بسعر $0.30 لكل مليون عند إصابة الذاكرة المؤقتة. في حلقة وكيل طويلة ذات توجيه نظام ثابت، يتراكم هذا الفارق في كل دور.
• تقسيم السياق إلى مستويات — سعر Kimi K3 ثابت عبر نافذته الكاملة البالغة 1,048,576 رمزًا دون أي رسوم إضافية للسياق الطويل. أما المستوى المُعلن لدى Fugu Ultra v2 لما يزيد على نحو 272,000 من رموز الإدخال فينقل الطلب بأكمله إلى نحو 10.00 / 45.00 دولارًا.
ذاك الصف الأخير هو الذي يحسم الفواتير الحقيقية. إن تشغيل وكيل طويل الأمد يقضي معظم عمره بعد 272K رمز، وهو بالضبط الموضع الذي يظل فيه سعر K3 الثابت ثابتًا بينما يتضاعف سعر Fugu Ultra v2. وإذا كان عبء العمل لديك بهذا الشكل، فإن الفجوة الفعلية على جانب الإدخال أقرب إلى 3.3× منها إلى 1.7×.

الرقم الوحيد الذي يتشاركانه
تذكر كلتا الشركتين DeepSWE، والمقارنة أقل إطراءً لـ Fugu مما يوحي به تأطير إطلاقه. تدرج Sakana نموذج Fugu Ultra v2 عند 74.3. وتدرج Moonshot نموذج Kimi K3 عند 67.5 — وفق ما أبلغت به الشركة المطوّرة، من بطاقة النموذج. وهذا فرق 6.8 نقاط في اختبار معياري لوكلاء البرمجة، وهو فرق حقيقي، لكنه اختبار واحد من مجموعة منشورة أكبر بكثير، وهو الاختبار نفسه الذي تتقدم فيه Sakana بـ1.6 نقطة على GPT-5.6 Sol. إن معيارًا تتجمع فيه ثلاث شركات مختلفة ضمن سبع نقاط يقيس شيئًا حقيقيًا لكنه لا يفصل بينها بشكل حاسم.
عدا ذلك، ينشر الاثنان على رفوف مختلفة تمامًا. تشمل أرقام K3 من Moonshot كلاً من Terminal-Bench 2.1 عند 88.3، وGPQA Diamond عند 93.5، وHLE-Full عند 43.5 (56.0 مع الأدوات)، وSWE-Marathon عند 42.0، وOSWorld-Verified عند 84.8، وMCPMark-Verified عند 94.5 — جميعها مُبلَّغ عنها من المورّد، وجميعها على بطاقة الطراز. أما الثمانية الخاصة بـ Sakana لـ Fugu Ultra v2 فتشمل معيارين داخليين، SWEFish وToolathon، لا يستطيع أي شخص خارج Sakana إعادة إنتاجهما.
بشكل مستقل، لم يُقَس من بينها سوى واحد على الإطلاق. يسجّل Kimi K3 نتيجة 44 في مؤشر Artificial Analysis Intelligence Index v4.3 — وهو الثاني بين النماذج مفتوحة الأوزان، خلف GLM-5.3 عند 45 — و93.40% في SWE-bench Verified ضمن إطار Vals AI المعياري القائم على الوكلاء، خلف Claude Opus 5 وDeepSeek V4 Pro وإن كان قريباً منهما. كما يتصدّر Frontend Code Arena بـ1679 Elo، متقدّماً على Fable 5 عند 1631 وGPT-5.6 Sol عند 1618. إذا رأيت K3 مذكوراً عند 57 أو 60، فهذا هو مقياس المؤشر الذي تم استبداله ولا ينبغي تكراره.
لا يمتلك Fugu Ultra v2 أي تقييم مستقل من أي نوع. فقد أُعلن عنه في 11 سبتمبر 2026، ولم يقم بتشغيله أحد خارج Sakana.
السرعة: واحدة مقيسة، وأخرى غير مقيسة
Kimi K3 بطيء، وهذا أمر مقيس لا مجرد ادّعاء: تسجّل Artificial Analysis معدّل 37.9 رمزًا في الثانية مع زمن حتى أول رمز يبلغ 3.80 ثانية، وتشير إلى أنه مطوّل بشكل ملحوظ. وبالنسبة إلى نموذج مبني حول البرمجة الوكيلية طويلة المدى، يُعدّ معدّل الإنتاجية قيدًا حقيقيًا — فالنموذج البطيء في حلقة طويلة يستهلك الوقت الفعلي، وليس المال فحسب.
لا تنشر Sakana أي رقم لزمن الاستجابة أو معدل الإنتاجية لـ Fugu Ultra v2 على الإطلاق. وبالنسبة إلى منسّق، يمكن اعتبار ذلك صراحةً لا مراوغة، لأن زمن الاستجابة يعتمد كليًا على النماذج التي يقرر استدعاءها وعدد التمريرات التي يقوم بها. لكنه يعني أيضًا أنك لا تستطيع نمذجة التكلفة الزمنية الفعلية للتحول إليه دون قياسها بنفسك. وبالنسبة إلى Fugu Ultra السابق، أبلغ مختبِرون علنًا عن عمليات تشغيل تمتد نحو 30 دقيقة؛ ذاك هو نموذج يونيو 2026 وليس دليلًا على v2، لكنه الرقم الذي يجب تجاوزه عند إجراء القياس المرجعي.

أوزان مفتوحة، مع شرطٍ يستحق القراءة
يمكن تنزيل أوزان Kimi K3، وهو فرق حقيقي عن نموذج Fugu Ultra v2 المستضاف فقط — لكن الترخيص أضيق مما تعنيه عبارة «أوزان مفتوحة» عادةً. يُقدَّم K3 بموجب ترخيص Kimi K3، وليس ترخيصًا من نوع MIT أو Apache معتمدًا من OSI، كما أن الادعاء الشائع على نطاق واسع بأنه «MIT معدّل» محل نزاع. تشترط الشروط اتفاقًا منفصلًا مع Moonshot للشركات التي تقدم النموذج كخدمة والتي تتجاوز إيراداتها 20 مليون دولار خلال أي اثني عشر شهرًا متتالية، بالإضافة إلى الإسناد للمنتجات التي يتجاوز عدد مستخدميها الشهريين 100 مليون أو إيراداتها الشهرية 20 مليون دولار. الاستخدام الداخلي معفى.
إذن، الصياغة الصادقة هي: يمنحك K3 أوزانًا يمكنك الاحتفاظ بها وفحصها وضبطها بدقة واستضافتها ذاتيًا، وذلك خاضع لشرط تجاري مرتبط بالإيرادات. لا يمنحك Fugu Ultra v2 أيًا من ذلك — لا أوزان، ولا مجموعة قابلة للفحص، ولا استضافة ذاتية — لكنه أيضًا لا يفرض أي شرط مرتبط بالإيرادات، لأنه لا يوجد شيء لترخيصه. أيّهما أكثر تسامحًا يعتمد كليًا على ما إذا كنت من نوع الشركة التي يستهدفها ترخيص K3.
تحذير عملي واحد إذا كانت الاستضافة الذاتية هي الخطة: نقطة تفتيش K3 تبلغ نحو 1.5 تيرابايت، ويوصي المورّد بـ64 مسرّعًا أو أكثر. مصطلح «الأوزان المفتوحة» هنا يعني قرارًا يخص عنقود الاستدلال، لا قرارًا يخص حاسوبًا محمولًا. وبالنسبة لمعظم الفرق، يظل API هو المسار المعقول في كل الأحوال — ولهذا فإن دعم vLLM وSGLang منذ اليوم صفر يهم أكثر مما يهم التنزيل.
ما تقوله حركة المرور الخاصة بنا
نقطة بيانات واحدة لا ينشرها أي من المورّدين، وهي تستحق أكثر مما تبدو عليه: عبر بوابة OrcaRouter، يُعد Kimi K3 النموذج الأكثر استخدامًا من بين أي نموذج تمت مناقشته في هذا المقال، وبفارق كبير، إذ مرّر نحو 3.27 مليار توكن في الأيام السبعة الماضية.
هذا ليس اختبارًا مرجعيًا، ولا يحسم شيئًا بشأن الجودة. لكنها عينة كبيرة مما يختاره المطورون فعليًا عندما لا يكلفهم القرار شيئًا سوى سعر التوكن، وتقول إن مزيج K3 المكوّن من نافذة بسعر ثابت تبلغ 1M، وأوزان مفتوحة، وترتيب قوي في coding-arena، قد حاز بالفعل حصة كبيرة من العمل الوكيلي الحقيقي ذي السياق الطويل. ولا يملك Fugu Ultra v2 أي إشارة مماثلة، لأنه أُطلق اليوم.

الوصول إلى كل واحد منها
أصبح Kimi K3 متاحًا على OrcaRouter بسعر Moonshot نفسه — $3.00 لكل مليون رمز إدخال، و$0.30 عند إصابة الذاكرة المؤقتة، و$15.00 لكل مليون رمز إخراج — يُمرَّر دون أي هامش إضافي، لذا يصل أي تغيير في سعر المورّد هنا في اليوم نفسه بدلًا من انتظار جدول ترحيل. وهو متوافق مع OpenAI على نفس عنوان URL الأساسي المستخدم لبقية الكتالوج، ولأنه يقع خلف البوابة نفسها مثل كل شيء آخر، يمكنك وضعه في سلسلة تجاوز الفشل أو التوجيه إليه بشكل شرطي بدلًا من ترميز مزوّد واحد بشكل ثابت في مسار الإنتاج. وهذا يهم أكثر من المعتاد هنا: نموذج بـ2.8 تريليون معامل يعمل بسرعة 37.9 رمزًا في الثانية هو بالضبط نوع الاعتماد الذي يستحق أن يكون خلفه بديل احتياطي.
لا نتولّى نحن توجيه Fugu Ultra v2. وهو متاح عبر واجهة API الخاصة بـ Sakana AI والمتوافقة مع OpenAI، وتقول الشركة إن تكاملات Fugu القائمة تنتقل إليه بتغيير معامل واحد فقط. يستخدم الطرازان صيغة الطلب نفسها، لذا فإن تقييمًا يضعهما خلف مفتاح تشغيل واحد ليس سوى تبديل لعنوان URL الأساسي، لا إعادة كتابة.
أيهما أختار؟
Kimi K3هو الخيار الأكثر قابلية للدفاع عنه للشراء في معظم أعباء العمل تقريبًا. سعره نصف سعر Fugu Ultra v2 في كل من الإدخال والإخراج، وثابت عبر نافذة تبلغ مليون رمز دون أي هبوط في السياق الطويل، وحصل على تقييم مستقل عند 44 في مؤشر Artificial Analysis الحالي، وقابل للاستضافة الذاتية بموجب ترخيص مشروط بعتبة الإيرادات، وهو بالفعل النموذج الأكثر استخدامًا في هذه المقارنة بفارق واسع. أما تكاليفه فهي السرعة والإسهاب: فسرعة 37.9 رمزًا في الثانية بطيئة حقًا لحلقات الوكلاء، والترخيص له أنياب فعلية إذا كنت شركة كبيرة تقدم النماذج كخدمة.
Fugu Ultra v2 هو الخيار الذي يجب شراؤه إذا كنت تريد الخاصية المحددة التي تبيعها Sakana — طبقة قدرات تُفكّك العمل الصعب متعدد الخطوات عبر مجموعة تستبعد بنيويًا الموردين الروّاد، بحيث لا يمكن إبطال أي نموذج منبع واحد، أو إعادة تسعيره، أو قطع وصوله من تحتك. تفوقه في DeepSWE على K3 حقيقي ومُبلّغ عنه من المورد؛ كما أن وجوده ضمن المركزين الأولين في سبعة من ثمانية معايير هو أيضًا مُبلّغ عنه من المورد، وفي اختبارات لا توجد جزئيًا في أي مكان آخر.
الشيء الجدير بالملاحظة هو أن كليهما قرارا توجيه، وأنت مطالب باختيار مستوى النظر. يوجّه K3 الرموز إلى خبراء داخل نموذج يمكنك تنزيله والتحكم فيه. أما Fugu Ultra v2 فيوجّه المهام إلى نماذج لا يمكنك رؤيتها. الثاني فكرة أكبر وأكثر قوة. وهو أيضًا الخيار الذي لا يمكنك تبنّيه إلا بالإيمان — ويكلّفك تبنّي ذلك الإيمان خمسة أضعاف لكل رمز.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
