
Fugu Max مقابل Gemini 3.1 Pro: نفس سعر الإدخال، ونصف سعر الإخراج، ومجمّع لا يمكن لأحد رؤيته
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
يتقاضى Fugu Max وGemini 3.1 Pro المبلغ نفسه مقابل طرح سؤال. كلاهما مُدرج بسعر $2.00 لكل مليون توكن إدخال. لكنهما يفترقان عند الإخراج: يكتب Fugu Max من Sakana AI بسعر $6.00 لكل مليون توكن إخراج، ويكتب Gemini 3.1 Pro من Google بسعر $12.00. أطلقت Sakana نظام Fugu Max في 11 سبتمبر 2026 بصفته منسّقًا يوجّه كل مهمة إلى أرخص نموذج كافٍ ضمن مجموعة لا يكشف عنها. Gemini 3.1 Pro نموذج مُسمّى — يمكن استدعاؤه بمعرّف، وله إصدارات، ومتعدد الوسائط — وهو ما صُمِّم المُنظِّم عمدًا لئلا يكونه. لذا فالسؤال المثير هنا ليس أيهما أفضل عند إدخال بسعر $2.00. بل ما إذا كانت المقارنة بين منسّق ونموذج هي الشكل الصحيح أصلًا، بالنظر إلى أن جيل Fugu الأسبق من Sakana أفادت التقارير بأنه عدّ Gemini 3.1 Pro ضمن النماذج التي كان يوجّه إليها.
مسألة المسبح، بصياغة دقيقة
عندما طُرح أول Fugu Ultra في يونيو 2026، وصفت تقارير عن بنيته مجموعة ضمّت Gemini 3.1 Pro إلى جانب نماذج من مختبرات حدودية أخرى. لم تنشر Sakana عضوية مجموعة Fugu Max. يقول البيان إن المجموعة توسّعت لتضمّ عددًا غير مسبوق من النماذج مفتوحة الأوزان والمتخصصة، مسمّيًا عائلة NVIDIA Nemotron عبر تعاون مع NVIDIA، ثم يتوقف عند هذا الحد. كما لا يقول إنه تمت إزالة Gemini 3.1 Pro.
وهذا يترك احتمالين ولا توجد طريقة علنية للاختيار بينهما. إذا كان Gemini 3.1 Pro ضمن مجموعة Fugu Max، فإن هذه المواجهة هي جزئيًا «ضد» وجزئيًا «عبر» — فقد تكون إجابة Fugu Max على مهمة استدلال صعبة إجابةَ Gemini اختارها منسّق وفحصها وأعاد كتابتها، وفي هذه الحالة يشتري سعر الإخراج البالغ 6.00 دولارات استدلال Gemini إضافة إلى تكاليف التنسيق بخصم مقارنةً باستدعاء Gemini مباشرةً. وإذا لم يكن ضمن المجموعة، فالمنتجان أداتان مختلفتان حقًا، ويعكس فرق السعر اختلافًا في القدرة الكامنة.
لا شيء في الإصدار يحسم هذا. أي شخص يخبرك أيّ واحد هو فقد استنتجه بدلًا من أن يقرأه. ما يمكن قوله بثقة أضيق نطاقًا لكنه يظل مفيدًا: إن الدرجات المنشورة لمنظِّم تنتمي إلى المجموعة، لا إلى المنسِّق، والمجموعة التي لا يُفصح عن أعضائها تجعل إسناد تلك الدرجات مستحيلًا.
• سعر الإدخال — Fugu Max: 2.00 دولار لكل مليون توكن، مقابل Gemini 3.1 Pro: 2.00 دولار لكل مليون توكن
• سعر الإخراج — Fugu Max 6.00 دولار لكل مليون رمز مقابل Gemini 3.1 Pro 12.00 دولار لكل مليون رمز
• إدخال مخزَّن مؤقتًا — Fugu Max بسعر 0.25 دولار لكل مليون توكن مقابل التخزين المؤقت في Gemini 3.1 Pro المُتاح بخصم على سعر الإدخال الأساسي
• السياق — Fugu Max غير منشور مقابل Gemini 3.1 Pro بـ 1M رمز
• سقف الإخراج — Fugu Max غير منشور مقابل 65 ألف رمز لدى Gemini 3.1 Pro
• وسائط الإدخال — Fugu Max غير منشور مقابل Gemini 3.1 Pro الصوت والملفات والصور والنصوص والفيديو
• نمط الإخراج — Fugu Max غير المنشور مقابل نص Gemini 3.1 Pro، مع سطر منفصل لتوليد الصور في عائلة 3.1
• أرقام المعايير — يُزعم أن Fugu Max حقق ستة انتصارات دون درجات، مقابل ما أبلغت عنه Google لـ Gemini 3.1 Pro: ARC-AGI-2 بنسبة 77.1%، وGPQA Diamond بنسبة 94.3%، وSWE-bench Verified بنسبة 80.6%، وBrowseComp بنسبة 85.9%
ما يمكن للنموذج أن يَعِد به ولا يستطيع المنسّق أن يَعِد به
أكبر فرق عملي منفرد في تلك القائمة ليس سعر الإخراج. إنه صف الوسائط. يقبل Gemini 3.1 Pro الصوت والفيديو والصور كمدخلات، وهو موثّق على هذا النحو، ما يجعله صالحًا لأعمال لا علاقة لها بالنص — قراءة تسجيل شاشة، ونسخ مكالمة والاستدلال عليها، وتحليل نموذج ممسوح ضوئيًا. لا تنشر Fugu Max أي مواصفة للوسائط على الإطلاق. قد يتعامل فعلًا مع بعض تلك المدخلات، اعتمادًا على ما تحتويه مجموعتها وما إذا كان المنسّق يمرّر محتوى متعدد الوسائط أو يحوّله أولًا إلى نص مسطّح. لا أحد خارج Sakana يعرف، وذلك نوع مختلف من عدم اليقين عن «لم نقم بقياسه بعد». وهو يعني أنك لا تستطيع أن تقرر ملاءمته لعبء عمل متعدد الوسائط من الوثائق؛ عليك أن تختبره.
ثمة عدم تماثل ثانٍ في سقف الإخراج. توثّق Gemini 3.1 Pro حدًا أقصى قدره 65 ألف رمز إخراج. أما Fugu Max فلا توثّق شيئًا. بالنسبة إلى منسّق، يكون السقف الفعّال هو الحد الأدنى بين النماذج التي يوجّه إليها أيًّا كانت، لذا يصعب ذكر الرقم حقًّا — لكن النظام ذا سقف غير معلن يكون التخطيط على أساسه مربكًا إذا كان تطبيقك يولّد نواتج طويلة.

قراءة صفوف المعيار بصدق
تذكر Sakana ستة معايير تحقق فيها Fugu Max "أفضل نتيجة إجمالية": Terminal Bench 2.1 وGPQAD وAA-LCR وGDP.pdf وAutomationBench وSWEFish. لا تُرفق أي أرقام بهذا الادعاء، وSWEFish هو معيار البرمجة الداخلي الخاص بـ Sakana. في المقابل، تنشر Google أرقامًا حقيقية لـ Gemini 3.1 Pro تشمل 77.1% على ARC-AGI-2، و94.3% على GPQA Diamond، و80.6% على SWE-bench Verified، و85.9% على BrowseComp.
احترس من حالة شبه تطابق واحدة. تُفيد Google بأن النتيجة على Terminal-Bench 2.0 تبلغ 68.5%. وتزعم Sakana أنها حققت أفضل نتيجة إجمالية على Terminal Bench 2.1. وهذان رقمَا إصدار متجاوران في معيار يتغيّر بينهما، ما يعني أن النتيجتين لا يمكن وضعهما جنبًا إلى جنب حتى من حيث المبدأ. القارئ الذي يتصفّح العناوين سيرى أن «كليهما يدّعي ريادة Terminal Bench» ويستنتج أنهما قابلتان للمقارنة. وهما ليستا كذلك.
GPQA هو الحالة الأقرب إلى الحسم — تُدرِج Sakana النتيجة GPQAD ضمن ستة انتصارات لها؛ وتُبلِغ Google عن GPQA Diamond بنسبة 94.3%. العائلة التقييمية الأساسية نفسها، وكلتاهما من إبلاغ المورّد، وواحدة فقط منهما تعطيك رقمًا. لو كانت نتيجة Sakana في GPQAD منشورة، لكان هذا الصف الوحيد الذي يمكن فيه إجراء مقارنة حقيقية. لكنها ليست منشورة، لذا يُقرأ الصف كادّعاء في مواجهة رقم.
لم يقيّم أي طرف مستقل Fugu Max، ولا يوجد مدخل لـ Artificial Analysis عنه أو عن أي من نماذج Fugu. أما Gemini 3.1 Pro، في المقابل، فقد كان متداولًا علنًا لفترة كافية ليظهر في لوحات الصدارة والتقييمات الصادرة عن أطراف ثالثة — وهذا ما تمنحك إياه «أشهر من التدقيق المستقل» مقارنةً بإصدار صدر في الأسبوع نفسه.
السبب في أن هذا يهم أكثر من المعتاد في هذه المواجهة تحديدًا هو أن بنية Fugu Max نفسها تجعل درجاته أصعب في التفسير. نسبة 94.3% التي حققها Gemini 3.1 Pro على GPQA Diamond هي حقيقة تخص نموذجًا واحدًا في إصدار واحد. أما نتيجة Fugu Max على الاختبار نفسه فستكون حقيقة تخص سياسة توجيه، ومجموعة غير معلَن أعضاؤها، ومنسّقًا مدرَّبًا على الاختيار من بينها. غيّر أيًّا من هذه العناصر وستتغير النتيجة دون أن يتغير اسم المنتج. نتيجة Gemini 3.1 Pro لها مرجع ثابت. أما نتيجة Fugu Max فلن يكون لها ذلك.
استدعاؤهم، وما تغييرات التوجيه
Gemini 3.1 Pro متاح على OrcaRouter تحت معرّف النموذج google/gemini-3.1-pro-preview، بسعر Google المعلن دون هامش ربح بنسبة 0% — إذ يُمرَّر سعر المزوّد كما هو، لذا يظهر أي تغيير في سعر Google على مفتاحك الحالي في اليوم نفسه بدلًا من موعد التجديد. وهو يأتي إلى جانب أكثر من 200 نموذج آخر خلف مفتاح API واحد، وهذا مهم هنا لسبب محدد: إذا أردت معرفة ما إذا كان سعر المخرجات البالغ 6.00 دولارات لدى Fugu Max أفضل فعلاً لحمل عملك، فإن التجربة النظيفة هي تشغيل كليهما على مجموعة المهام نفسها، لكن Fugu Max ليس في كتالوجنا. إنه يصلك عبر واجهة API المتوافقة مع OpenAI الخاصة بـ Sakana وعدة منصات خارجية. تشغيل اختبار A/B خاص بك يعني تكاملين، وفاتورتين، ومجموعتي بيانات اعتماد.
التحويل التلقائي عند الفشل هو الجزء الآخر الجدير بالذكر. يعمل Gemini 3.1 Pro عبر مسارات مزوّدين متعددة من خلال الموجّه، وإذا خضع أحدها لتقييد المعدل أو تدهور أدائه، تنتقل حركة المرور دون تغيير في الشيفرة. هذا نسخة جزئية وعملية من المرونة التي تسوّقها Sakana باعتبارها الفرضية الكاملة للتنسيق — تحصل عليها في طبقة النقل بدلاً من طبقة الاستدلال، وتحصل عليها لنموذج يمكنك تثبيت سلوكه.

كيف تختار بينهما
اختر Gemini 3.1 Pro إذا كان عملك يتضمن مدخلات غير نصية، أو إذا كنت بحاجة إلى سقف موثّق للمخرجات، أو إذا أردت نموذجًا يمكن التحقق من أرقام أدائه مقارنة بنتائج الآخرين، أو إذا كنت ببساطة تحتاج إلى مكوّن يمكنك تثبيته بإصدار معيّن والاستدلال بشأنه. بسعر 2.00 دولار للمدخلات، لا يكلّفك تجربته شيئًا، كما أن 65 ألفًا من المخرجات تكفي لمعظم مهام التوليد. أرقامه المنشورة تضعه بين أقوى النماذج متعددة الأغراض المتاحة، ومجموعة مدخلاته متعددة الوسائط ليست شيئًا يمكن لطبقة تنسيق أن تحل محله.
اختر Fugu Max إذا كان عملك كثيف النصوص، وقابلاً للتحقق، وضخم الحجم، وكنت تهتم بالتكلفة الوسيطة لمهمة مكتملة بدلاً من السقف الأعلى لأي استدعاء واحد. معدل الإخراج البالغ 6.00 دولارات هو نصف معدل Gemini 3.1 Pro، ومعدل التخزين المؤقت البالغ 0.25 دولار هو الرقم الأكثر جرأة في أي من بطاقتي الأسعار. شغّله على المسائل التي يكون فيها الجواب الخاطئ قابلاً للكشف، وحدّد ميزانية لرموز الإخراج قبل أن تبدأ، وقِس الرموز لكل مهمة منتهية. لا تختره لخط أنابيب متعدد الوسائط استناداً إلى صفحة الإصدار، لأن صفحة الإصدار لا تخبرك ما إذا كان يقبل الصور.
القرار
Gemini 3.1 Pro هو الخيار الأكثر أمانًا والأفضل توثيقًا: سعر إدخال مماثل، ونافذة سياق منشورة، وسقف إخراج معلن يبلغ 65K، وإدخال متعدد الوسائط موثّق، ومعايير أداء من المورّد أتيحت لأطراف ثالثة فرصة لفحصها. معدل إخراجه ضعف معدل Fugu Max، وهذا هو كل ما يمكن قوله لصالح الطرف الآخر.
Fugu Max هي الطريقة الأرخص لتوليد النصوص، والطريقة الأكثر إبهامًا لفعل أي شيء آخر. انتصاراتها الستة في اختبارات الأداء المعيارية لا تحمل أي أرقام، ولم يُنشر كل من نافذة سياقها ودعمها للوسائط، وتكوين المجموعة التي تنتج نتائجها غير معلن — ما يعني أنه لا يمكنك استبعاد أنك تدفع 6.00 دولارات مقابل نسخة مخفّضة من الاستدلال الذي يمكنك شراؤه من Gemini 3.1 Pro مباشرةً بسعر 2.00 دولار للإدخال على OrcaRouter مع تمرير سعر القائمة الخاص بالمزوّد و0% هامش ربح إضافي فوقه.

