
Fugu Ultra v2 مقابل DeepSeek V4 Pro: مسألة سعر الإخراج البالغ 34 ضعفًا
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
تتقاضى Fugu Ultra v2 حوالي أربعة وثلاثين ضعفًا من سعر القائمة لـ DeepSeek V4 Pro مقابل النص الذي تكتبه. هذا ليس خطأ مطبعيًا وليس ناتجًا عن تقريب: يُسعّر المنسّق الجديد من Sakana AI عند 30.00 دولارًا لكل مليون رمز إخراج، وتُبلغ DeepSeek عن 0.87 دولارًا لكل مليون، وعلى المعيار الوحيد الذي ينشر كلا البائعين رقمًا له، فإن الفجوة في الأداء لا تشبه أربعة وثلاثين ضعفًا بأي حال. تدّعي Sakana تحقيق 74.3 على DeepSWE لـ Fugu Ultra v2، الذي صدر في 11 سبتمبر 2026؛ وتُبلغ DeepSeek عن 62.7 لـ DeepSeek V4 Pro، النموذج مفتوح الأوزان الذي أطلقته في أغسطس. تفوّق مقداره 11.6 نقطة مبلّغ عنه من البائع مقابل سعر إخراج يبلغ 34 ضعفًا هو المقارنة بأكملها في سطر واحد — والسؤال الصادق ليس ما إذا كان Fugu Ultra v2 أفضل، بل ما إذا كان أفضل بتسعة عشر دولارًا لكل مليون رمز، ولمن.
إجابتان للمشكلة نفسها، مبنيتان من طرفين متعاكسين
إن DeepSeek V4 Pro وFugu Ultra v2 هما استجابتان للقلق نفسه — الاعتماد على مزوّد طليعي مغلق واحد — وهما مختلفان إلى أبعد حد في المنهج.
DeepSeek V4 Pro هو نموذج. تؤرخ تغطية الإطلاق طرح API للنسخة الرسمية — البناء DeepSeek-V4-Pro-0813 — في حوالي 12 إلى 13 أغسطس 2026، ليحل محل معاينة 24 أبريل. وهو نظام مزيج من الخبراء يُذكر أنه يضم 1.5 إلى 1.6 تريليون معامل إجمالي، مع تنشيط نحو 49 مليارًا لكل رمز، ويحمل نافذة سياق بسعة مليون رمز وحدًا أقصى للإخراج يبلغ 384 ألف رمز. يستدل في وضعي التفكير وغير التفكير بثلاثة مستويات جهد، ويتحدث بروتوكولي API الخاصين بـ OpenAI و Anthropic، وأضاف واجهة Responses API أصلية تستهدف مباشرة أُطر تشغيل الوكلاء على غرار Codex. والأهم أن الأوزان نُشرت بموجب MIT، مما يعني أن حجة الصمود محسومة بالحيازة: لا يمكن لأحد أن يلغي نسختك.
Fugu Ultra v2 ليس نموذجًا. إنه منسّق مُدرَّب، يُقال إنه بنحو 7 مليارات معامل، يفكّك الطلب عبر مجموعة من النماذج غير المُعلَنة، ويسند أدوار Thinker وWorker وVerifier، ويصوغ إجابةً خلف نقطة نهاية واحدة متوافقة مع OpenAI. وحجّته في المرونة معمارية لا قانونية: لأن المجموعة قابلة للتبديل، يستطيع النظام أن يصمد إذا غيّر أي مورّد واحد شروطه. الإصدار 2.0، الذي طُرح إلى جانب Fugu Max، نقل تاريخ قطع التدريب إلى 28 أغسطس 2026، وبشكل لافت — أزال Claude Fable 5 وClaude Fable 5.1 وGPT-6 Astra من المجموعة بالكامل، مع استمراره في ادعاء الفوز عليها.
إذن، المقارنة هي بين الامتلاك والتنسيق. يمنحك DeepSeek نموذجًا يمكنك تنزيله وفحصه وضبطه بدقة وتشغيله بنفسك، بأي هامش يسمح به عتادك الخاص. وتمنحك Sakana نظامًا يقرر كيفية التعامل مع كل مشكلة، بمعدل يموّل تشغيل عدة نماذج رائدة نيابةً عنك.

ما الذي يشتريه 34x فعليًا
المعايير أولاً، مع إبراز المصدر في الصدارة. كل رقم DeepSeek أدناه هو رقم المزوّد نفسه، ويسبق مراجعة التسعير بين وقت الذروة/خارج وقت الذروة التي أعلنتها DeepSeek لمنتصف أغسطس، والتي لا تزال المصادر متباينة حول أرقامها النهائية — يضع أحد التقارير مخرجات وقت الذروة قرب ¥27 لكل مليون، وآخر قرب ¥12، مقابل أساس ¥6. تحقق من بطاقة الأسعار المنشورة لدى DeepSeek قبل أن تحسب ميزانية. كل رقم Fugu هو رقم Sakana نفسه، ولم يُعِد أي طرف مستقل إنتاج أي منها؛ ولا يزال لا يوجد مُدخل Artificial Analysis لأي نموذج Fugu.
• DeepSWE — Fugu Ultra v2 74.3 (بحسب ما أفادت به الشركة) مقابل DeepSeek V4 Pro 62.7 (بحسب ما أفادت به الشركة)
• تيرمينال بنش 2.1 — لا يوجد رقم منشور لـ Fugu Ultra v2 من Sakana مقابل DeepSeek V4 Pro 87.9 (بحسب ما أعلنته الشركة المُصنّعة)
• SWE-bench (Vals) — لا يوجد رقم لـ Fugu Ultra v2 مقابل DeepSeek V4 Pro بنتيجة 96.4 (بحسب الشركة المصنّعة)
• Humanity's Last Exam — لا توجد نتيجة لـ Fugu Ultra v2 v2.0 مقابل DeepSeek V4 Pro: 42.7 بدون أدوات، 60.0 مع أدوات (وفقًا لما أبلغ عنه المورّد)
• GPQA Diamond — لا يوجد رقم لـ Fugu Ultra v2 v2.0 مقابل DeepSeek V4 Pro 92.8 (المُبلَّغ عنه من المورّد)
• سعر الإخراج — Fugu Ultra v2 بسعر 30.00 دولار لكل 1M، ويرتفع إلى 45.00 دولار فوق سياق 272K مقابل DeepSeek V4 Pro بنحو 0.87 دولار لكل 1M حسب قائمة الأسعار، مع سعر محسوب حسب الاستهلاك سجل ارتفاعًا أعلى
تحذيران بشأن صف السعر ذلك، لأن المقارنة كلها تقوم عليه. أولًا، رقم DeepSeek هو سعر القائمة المذكور في تغطية الإطلاق والمعاد ذكره في وصف نموذجنا الخاص، لكن السعر المحتسب بالعداد في إدراجنا جرى عند 2.18 دولار لكل مليون مخرج و0.73 دولار لكل مليون إدخال — سلوك التخزين المؤقت ومزيج الاستخدام يحركان الرقم الفعلي، لذا فإن المضاعف الأمين يقع بين نحو 14 ضعفًا ونحو 34 ضعفًا اعتمادًا على مقدار الإدخال المخزَّن مؤقتًا لديك. وحتى عند الحد الأدنى من هذا النطاق، تزيد تكلفة المخرجات على اثني عشر ضعفًا. ثانيًا، أعلنت DeepSeek بالفعل مراجعة تسعير للذروة/خارج الذروة لا تزال المصادر تختلف حول أرقامها النهائية — يضع أحد التقارير مخرجات الذروة قرب ¥27 لكل مليون، وآخر قرب ¥12، مقابل أساس ¥6. تحقّق من بطاقة الأسعار المنشورة قبل أن تحسب ميزانية.
• سعر الإدخال — Fugu Ultra v2 بسعر 5.00 دولارات لكل 1M، ويتضاعف فوق 272 ألف مقابل DeepSeek V4 Pro بنحو 0.435 دولار لكل 1M عند فقدان الذاكرة المؤقتة، وأرخص بنحو 120 ضعفًا عند إصابة الذاكرة المؤقتة
• الأوزان — Fugu Ultra v2 مغلقة، والتجمّع غير مُفصح عنه، والتوجيه غير مكشوف بحكم التصميم، مقابل DeepSeek V4 Pro المفتوح بموجب رخصة MIT والقابل للاستضافة الذاتية
• السياق والمخرجات — سياق 1M لدى Fugu Ultra v2، وسقف المخرجات غير معلن، مقابل سياق 1M لدى DeepSeek V4 Pro، وسقف مخرجات 384K
مشكلة التداخل واضحة: النظامان بالكاد يظهران في الصفوف نفسها. تنشر Sakana خمسة انتصارات من أصل ثمانية معايير اختارتها؛ وتنشر DeepSeek لوحة أوسع تتضمن تغطية وكيلية عميقة — MCP Atlas 73.6، وToolathlon-Verified 74.1، وCyberGym 83.3، وNL2Repo 61.5، وCorpusQA 62.0 في السياق الطويل — حيث لا تملك Fugu Ultra v2 أي رقم منشور على الإطلاق. الصف الوحيد الذي يمكنك مقارنته، DeepSWE، هو الصف الذي تدّعي فيه Fugu أكبر ميزة لها في هندسة البرمجيات. القارئ الذي يقارن الإصدارين إنما يقارن بين اختبارين مختلفين.
مضاعف الإسهاب
سعر الإخراج ليس ضريبة خطية على التنسيق؛ بل هو مُضاعِف لكميةٍ يزيدها التنسيق. يُنشئ Fugu Ultra v2 وكلاء، ينتج كل منهم رموز استدلال ورموز إخراج، قبل أن يركّبها منسّق. يقدّم قسم الأسئلة الشائعة حول التسعير من Sakana التزامًا ودّيًا للمستهلك حقًا — إذ تدفع سعرًا موحّدًا مدمجًا استنادًا إلى الطراز الأعلى فئة في المجموعة، وإضافة وكلاء لا تضاعف الفاتورة — وهو ما يحدّ من أسوأ الحالات. لكنه لا يحدّ من الحجم. بسعر $30 لكل مليون رمز إخراج، فإن تشغيلًا متعدد الوكلاء يُصدر نصًا يعادل أربعة أضعاف استدعاء بنموذج واحد يكلّف أربعة أضعاف، ويتضاعف المُضاعِف مع معدل إخراج أعلى بـ34 مرة.
بنية تكلفة DeepSeek V4 Pro تكافئ السلوك المعاكس. فإصابة الذاكرة المؤقتة عند الإدخال أرخص بنحو مئة ضعف من عدم إصابتها، ما يجعل الأعمال المتكررة ذات السياق الطويل — المستودع نفسه، ومجموعة المستندات نفسها، والموجّه النظامي نفسه — أرخص بكثير مما يوحى به السعر المُعلن. وبالنسبة إلى حلقة وكيل تعيد قراءة السياق نفسه في كل دورة، فهناك تقع التكلفة الفعلية، وهي ميزة بنيوية لا يستطيع أي منسّق أن يلتف حولها.
بجمع الاثنين معًا، يصبح القرار ملموسًا. إذا حقّق Fugu Ultra v2 تفوقًا قدره 11.6 نقطة في DeepSWE، ويُصدر ثلاثة أضعاف رموز الإخراج لاستدعاء واحد، فأنت تدفع نحو مئة ضعف لكل مهمة مكتملة مقابل مكسب من عشر إلى خمس عشرة نقطة على معيار واحد. هذه المقايضة يمكن تبريرها للبحث والمسائل الهندسية الصعبة بشكل غير قابل للاختزال حيث تكون النقطة الحدية هي كل شيء، ولا يمكن تبريرها لخط أنابيب يعمل مئة ألف مرة في اليوم.

لمن كل واحد منهم في الواقع
اختر DeepSeek V4 Pro إذا كان أي مما يلي صحيحًا: عبء العمل لديك كبير الحجم وحساس للتكلفة؛ تحتاج إلى مخرجات أطول من السقف الذي سيمنحك إياه المنسق؛ تحتاج إلى نظام يمكنك تدقيقه أو ضبطه الدقيق أو استضافته على أجهزتك الخاصة لأسباب تتعلق بالموقع الجغرافي للبيانات؛ أو تحتاج إلى أن يكون السعر رقمًا يمكنك حسابه بدلاً من رقم تلاحظه. رخصة MIT المفتوحة ليست ميزة تسويقية — بل هي أقوى شكل من حجة المرونة التي يقدمها أي من النظامين، لأنها لا تعتمد على استمرار حسن نية أي مورد. كما أنها، عند حوالي $0.87 لكل مليون من المخرجات، رخيصة بما يكفي بحيث لا تكلف التجربة شيئًا.
اختر Fugu Ultra v2 إذا كانت النقطة الهامشية تستحق مضاعفًا، وكان العمل طويل الأفق، وكانت الصحة قابلة للتحقق — البرمجة باستخدام مجموعة اختبارات، والاستدلال المنظم على المستندات، والتحليل متعدد الخطوات حيث يستطيع دور المدقّق أن يلتقط خطأً كانت تمريرة واحدة لتشحنه. تشير دراسات الحالة الخاصة بـ Sakana نفسها إلى هذا بالضبط: جولة بحث ذاتية لمدة أربع عشرة ساعة، وحلّال مكعب روبيك أكمل جميع عمليات الخلط الـ300 حيث انهار خطّا أساس مجهولا الهوية تمامًا. ضع في اعتبارك أن خطوط الأساس تلك مجهولة الهوية واختارها المورّد، مما يضعف قيمتها كدليل ولا يجعلها زائفة. ضع في اعتبارك أيضًا القيد الذي ينهي النقاش بالنسبة لبعض الفرق: لا يُباع Fugu Ultra v2 في الاتحاد الأوروبي أو المنطقة الاقتصادية الأوروبية، وتصرّح Sakana بذلك بوضوح.
ملاحظة عملية واحدة إذا كنت تنوي تشغيل أيٍّ منهما. لا يتوفر Fugu Ultra v2 على OrcaRouter — بل يأتي عبر واجهة API الخاصة بـ Sakana والمتوافقة مع OpenAI وعدة منصات خارجية، والترقية من إصدار Fugu أقدم هي تغيير في معامل بسطر واحد. DeepSeek V4 Pro متاح على OrcaRouter بسعر القائمة الخاص بالمزوّد دون هامش ربح بنسبة 0%، وهذا يهم هنا أكثر من المعتاد: فقد أعلنت DeepSeek بالفعل عن مراجعة تسعير واحدة في هذه الدورة، وعلى موجّه تمريري يصبح تغيير سعر البائع ساريًا على المفتاح نفسه في اليوم نفسه بدلًا من أن يحدث بعد إعادة التفاوض. إذا كنت تريد قياس أداء كليهما مقابل عبء العمل الخاص بك قبل الالتزام، فإن الجانب الأرخص في المقارنة هو الذي يمكنك استدعاؤه بسعر القائمة مع تجاوز فشل تلقائي خلفه.

الحكم
هذه ليست مواجهة متقاربة من الناحية الاقتصادية، وليست حاسمة من ناحية القدرات. إن DeepSeek V4 Pro هو الخيار الافتراضي الأفضل بفارق واسع: أوزان مفتوحة يمكنك الاحتفاظ بها، وسقف إخراج يبلغ 384K، وسياق يبلغ 1M، ودرجات منشورة للسياق الطويل، وسعر على الإخراج يعادل نحو 1/34 من سعر Fugu Ultra v2. أما Fugu Ultra v2 فهو الأداة الأفضل لفئة ضيقة من المسائل المكلفة، وادعاء Sakana — بأن مجموعة ثابتة تستبعد أقوى ثلاثة نماذج يمكنها مع ذلك التغلب عليها في الأعمال القابلة للتحقق — هو أكثر الحجج المعمارية إثارة للاهتمام في المجال الآن، وهو الأقل استنادًا إلى أدلة مستقلة.
الحل العملي ليس أن تختار. شغّل DeepSeek V4 Pro كخيار افتراضي لأنه رخيص ومفتوح وسريع، وأبقِ Fugu Ultra v2 في الاحتياط للمهام التي تظل فيها زيادة التكلفة بمئة ضعف أصغر من تكلفة الخطأ. وما لا ينبغي فعله هو قراءة لوحة Sakana ذات المعايير الثمانية كدليل على أن المنسّق الباهظ قد حلّ محل النموذج المفتوح الرخيص. في الصف الوحيد المشترك بينهما، إنه متقدّم بـ11.6 نقطة مقابل 34 ضعفًا من سعر المخرجات. وسواء كان ذلك صفقة رابحة أم فخًا، فهذا يعتمد كليًا على المشكلة التي توجّهه إليها.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
