بطاقة عنوان رئيسية تحمل النص 'Fugu Max مقابل Grok 4.6' مع عنوان فرعي 'بطاقات أسعار متطابقة، نتيجة منشورة واحدة'، وثلاث شارات على شكل كبسولة تحمل '$2.00 مقابل $2.00 للإدخال'، و'$6.00 مقابل $6.00 للإخراج' و'ستة انتصارات، صفر أرقام'، وسطر تذييل يحمل 'Sakana AI، سبتمبر 2026 مقابل SpaceXAI، أغسطس 2026'، وشعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

Fugu Max مقابل Grok 4.6: بطاقات أسعار متطابقة، ونتيجة منشورة واحدة

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

تكلّف Fugu Max وGrok 4.6 نفس المبلغ بالضبط. أطلقت Sakana AI نموذج Fugu Max في 11 سبتمبر 2026، بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولار لكل مليون رمز إخراج — وهذا هو حرفيًا نفس جدول الأسعار الذي تتقاضاه SpaceXAI مقابل Grok 4.6 منذ إطلاقه في 12 أغسطس. هذه المصادفة هي أكثر حقيقة مفيدة في هذه المواجهة، لأنها تلغي عامل السعر من المعادلة. عندما يكون منتجان بتكلفة متطابقة، يصبح السؤال الوحيد المتبقي هو ما الذي ستحصل عليه مقابل المال، وهنا يفترق الاثنان تمامًا. Grok 4.6 نموذج واحد يمكنك تثبيته حسب الإصدار، وقراءة جدول قياسات أداء له، والتحقق منه مقابل مؤشر مستقل. أما Fugu Max فهو منسّق مدرّب يوزّع كل مهمة على أرخص نموذج في مجموعته، ويزعم إعلان Sakana أنه يحقق أفضل نتيجة إجمالية في ستة اختبارات معيارية دون نشر أي رقم من أي منها. أحد هذين الشراءين قابل للقياس قبل أن تقوم به. أما الآخر فليس كذلك.

منتجان، بطاقة أسعار واحدة

• الإدخال — Fugu Max 2.00 دولار لكل مليون رمز مقابل Grok 4.6 2.00 دولار لكل مليون رمز

• الإخراج — Fugu Max ‏6.00 دولار لكل مليون رمز مقابل Grok 4.6 ‏6.00 دولار لكل مليون رمز

• مدخل مُخزَّن مؤقتًا — Fugu Max بسعر 0.25 دولار لكل مليون رمز مقابل Grok 4.6 بسعر 0.50 دولار لكل مليون رمز، وهو السطر الوحيد الذي يختلف فيه السعران على الإطلاق

• نافذة السياق — Fugu Max لم يُنشر من قبل المورّد مقابل Grok 4.6 بـ500,000 توكن، دون تغيير عن Grok 4.5

• إعادة تسعير المطالبات الطويلة — لا توجد فئة معلنة لـ Fugu Max في الإصدار، مقابل Grok 4.6 الذي يتضاعف إلى $4.00 / $12.00 بمجرد أن يتجاوز طلب واحد 200,000 رمز، ويُطبَّق على الطلب بأكمله بدلًا من الكمية الزائدة

• التحكم في الاستدلال — Fugu Max غير متاح مقابل Grok 4.6 بأربعة مستويات للجهد، من low وحتى xhigh، مع الافتراض إلى high وعدم إمكانية إيقافه

• البنية المعمارية — Fugu Max منسّق مُدرَّب على مجموعة غير معلنة تضم نماذج مفتوحة الأوزان ونماذج متخصصة، موسَّع لـ Max بعائلة NVIDIA Nemotron عبر تعاون مع NVIDIA، مقابل Grok 4.6: نموذج واحد بإصدار واحد

• تقييم مستقل — Fugu Max: لا يوجد أي تقييم منشور، ولا توجد صفحة Artificial Analysis لأي من نماذج Fugu، في مقابل Grok 4.6 الذي لديه مؤشر Artificial Analysis Intelligence Index مباشر بقيمة 44، ويحتل المرتبة #20 من 200

العمود الرخيص هو العمود الذي لا يمكن التنبؤ به

انظر إلى حيث يفوز Fugu Max فعليًا من حيث السعر: قراءة الذاكرة المؤقتة، بنصف سعر Grok 4.6. إنها ميزة حقيقية، وهي بالضبط المكان الخاطئ لبناء نموذج تكلفة، لأن تسعير الذاكرة المؤقتة لا يعود بالنفع إلا بما يتناسب مع معدل إصابة الذاكرة المؤقتة لديك — ولا تنشر Sakana معدلًا له لـ Fugu Max. كما لا يذكر الإصدار نافذة سياق، ولا فئة سياق طويل، ولا سقفًا للمخرجات. لذا فإن العمود الوحيد الذي يخفض فيه Fugu Max سعر Grok 4.6 هو خصم بحجم مجهول يُطبَّق على حصة مجهولة من رموزك.

نقاط ضعف Grok 4.6 مرئية على الأقل. عتبته البالغة 200,000 توكن عدوانية — فهو يعيد تسعير الطلب بأكمله، لذا يُحاسَب موجّه من 250,000 توكن بسعر مضاعف من أول توكن، وليس من التوكن رقم 200,001. لكن يمكنك رؤية الحد القاطع، وقياس موجّهاتك مقابله، وتقرير ما إذا كنت ستقسّمها إلى أجزاء. هذا هو الفرق في النوع هنا: نظام واحد ينشر جدول أسعار له شكل يمكنك التخطيط بناءً عليه، والآخر ينشر سعرًا معلنًا دون أي جدول مرفق.

ستة انتصارات ولا هدف واحد

المعايير التي تذكرها ساكانا هي Terminal Bench 2.1 وGPQAD وAA-LCR وGDP.pdf وAutomationBench وSWEFish. خمسة منها تقييمات عامة معترف بها. أما السادس، SWEFish، فهو معيار البرمجة الخاص بساكانا، ما يعني أن إحدى الانتصارات الستة المعلنة يُقيَّم عبر اختبار كتبته الشركة ولم تصدره. أما الخمسة الأخرى، فيقول الإصدار إن Fugu Max يحقق أفضل نتيجة إجمالية ويتوقف عند هذا الحد — لا نتيجة، ولا فارق، ولا رقم منافس يوضع إلى جانبه.

ضع ذلك مقابل الجدول الذي نشرته SpaceXAI لـ Grok 4.6، وهو مُبلَّغ عنه من الجهة الموردة في كل بنوده لكنه على الأقل جدول: GDPVal-AA v2 عند 1,753، وAA-Briefcase عند 1,577، وDeepSWE v1.1 عند 65.9%، وCursorBench v3.2 عند 69.9%، وGPQA Diamond عند 94.9%. كما تفيد مواد الإطلاق بنحو 53 دورة وحوالي نصف مليار رمز إدخال لحل مهام طويلة الأفق على AA-Briefcase، مقابل نحو 103 دورات وملياري رمز لنموذج حدودي منافس — وهي حجة، مرة أخرى مُبلَّغ عنها من الجهة الموردة، بأن Grok رخيص لكل مهمة مكتملة حتى عند سعر متواضع لكل رمز.

ثمة رقمان من أرقام Grok هذه يحتاجان إلى معالجة قبل أن تستشهد بهما. الأول هو أن درجته الرئيسية البالغة 94.9% في GPQA Diamond تأتي من اختبار قياسي سحبته Artificial Analysis لاحقًا باعتباره مشبعًا، لذا لم يعد يفصل بين النماذج الرائدة كما كان يفعل فيما مضى. والثاني هو الرقم الذي ستراه في تغطية أقدم: مؤشر الذكاء من Artificial Analysis البالغ 61 لـ Grok 4.6. كان ذلك على المقياس السابق لإعادة الإصدار. أعادت Artificial Analysis معايرة المؤشر في سبتمبر 2026، والرقم الحالي هو 44 في المرتبة 20 من 200، بتكلفة 1.86 دولار لكل مهمة من مهام مؤشر الذكاء. أي شخص يضع Grok 4.6 في مقارنة مع Claude Fable 5 أو GPT-5.6 Sol بناءً على الرقم 61 إنما يقارن قراءات من أداتين مختلفتين.

A two-column scoreboard titled 'Fugu Max vs Grok 4.6 - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, benchmarks six wins with no figures, evidence vendor-reported only. Grok 4.6: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.50 per 1M, context 500K with a 200K repricing cliff, benchmarks GDPVal 1,753 and DeepSWE 65.9%, evidence Artificial Analysis Index 44 ranked #20 of 200. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Grok 4.6 rows SpaceXAI-reported and per Artificial Analysis. No independent Fugu Max evaluation exists.' OrcaRouter logo bottom-right.

ما لا يتضمنه سعر رمز المنسّق

تقرّ تغطية Sakana نفسها لهذا الإصدار بالمشكلة الهيكلية. ولأن Fugu Max يتنقل بين النماذج داخل مهمة واحدة، فإنه "قد يقلل إعادة استخدام ذاكرة التخزين المؤقت للسياق، كما يولّد رموز تنسيق إضافية" — ولم تفصح الشركة عن معدل إصابة ذاكرة التخزين المؤقت الناتج أو التكلفة الإجمالية للرموز لكل مهمة. كل وكيل يولّده المنسّق يكتب نص الاستدلال والمخرجات، ويُحتسب كل ذلك بسعر 6.00 دولارات لكل مليون. والسعر مطابق لسعر Grok 4.6. لكن الحجم ليس كذلك، والحجم هو المتغير الذي لا تستطيع صفحة تسعير أن تُظهره لك.

كلا المورّدين يدفعانك نحو التصحيح نفسه — توقّف عن مقارنة المعدلات، وابدأ بمقارنة التكلفة لكل مهمة منتهية — لكن واحدًا منهما فقط يمنحك رقمًا تبدأ منه. يأتي Grok 4.6 بملف تعريف منشور للجولات والرموز. ويأتي Fugu Max بتعليمة مفادها أن تقيسه بنفسك.

هناك قراءة عادلة لصمت Fugu Max وهي تستحق الذكر. Max هو الطبقة المُحسّنة من حيث التكلفة في خط Fugu، وقد طُرح في نفس اليوم الذي طُرح فيه Fugu Ultra v2، وهو الدفعة نحو القدرات بسعر $5.00 للإدخال و$30.00 للإخراج. الحجة البصرية لـ Sakana لصالح Max هي مخطط باريتو — القدرة مقابل التكلفة — وعلى مخطط باريتو، فإن درجة الأداء الخام ليست ذات أهمية؛ النتيجة لكل دولار هي الادعاء بأكمله. إذا كانت هذه هي الحجة، فإن نشر ست درجات فائزة دون تكاليفها سيكون هو المخطط المضلل، وليس المخطط المفقود. ما لا يزال الإصدار يدين به للمشتري هو قاسم مشترك، وهو لا يقدمه.

أين يكون Grok 4.6 مكشوفًا حقًا

يُعدّ العمل في الطرفية أضعف مجال منشور بالنسبة إلى Grok 4.6. فنتيجته في Terminal-Bench v3.0 تبلغ 26%، وهي متأخرة بفارق كبير عن صدارة الميدان. كن حذراً بشأن الرقم المجاور: النموذج نفسه يسجّل 88.4% في Terminal-Bench v2.1، وهما اختباران مختلفان. سترى الاثنين مدمجين في التغطية، وهذا الدمج يجعل Grok يبدو أفضل كثيراً.

يتمثل التعرض الثاني في أن التفكير لا يمكن تعطيله. تُحتسب رموز التفكير في كل طلب، لذا تعتمد تكلفة الإخراج الفعلية لـ Grok 4.6 على مدى عمق التفكير الذي يقرر النموذج بذله في موجّهك. يمنحك قرص الجهد تحكمًا عند الحد الأدنى، ولكن لا يوجد إعداد بمستوى صفر.

في المقابل، يمتلك Grok 4.6 شيئًا لا تستطيع Fugu Max تقديمه حاليًا بأي ثمن: رقم. يمكن لأي طرف ثالث التحقق من كل صف أعلاه، ويعني إدراج Artificial Analysis أن أحدهم قد فعل ذلك بالفعل. نُشرت انتصارات Fugu Max الستة في اليوم نفسه الذي نُشر فيه النموذج، من قبل الشركة التي بنته، وحتى وقت كتابة هذه السطور لم يقم أحد خارج Sakana بتشغيله.

استدعاء أحدهما، وقيادة الآخر

‏Grok 4.6 متاح على OrcaRouter بسعر SpaceXAI المعلن — 2.00 دولار لكل مليون رمز إدخال، و0.50 دولار عند إصابة الذاكرة المؤقتة، و6.00 دولارات لكل مليون رمز إخراج — يُمرَّر دون أي هامش ربح (0%)، لذا يصل أي تغيير في سعر المورّد إلى بوابتنا في اليوم نفسه بدلًا من انتظار جدول ترحيل. وهو متوافق مع OpenAI على عنوان URL الأساسي نفسه المستخدم لبقية الكتالوج، ما يعني أنه يمكنك وضعه في سلسلة تجاوز الفشل أو خلف قاعدة توجيه شرطية بدلًا من تثبيت مزوّد معيّن في مسار الإنتاج، ويمكنك إجراء اختبار A/B له مقابل نموذج آخر دون عقد ثانٍ. وقد مرّر 46.6 مليون رمز عبر البوابة خلال الأيام السبعة الماضية.

Fugu Max ليس في كتالوجنا. يصل إليك عبر واجهة Sakana البرمجية المتوافقة مع OpenAI وعدة منصات طرف ثالث، وتقول الشركة إن تكامل Fugu الحالي يمكن ترقيته إليه بتغيير معامل واحد. ولأن كليهما يتحدثان تنسيق الطلب نفسه، فإن التقييم الذي يضعهما خلف مفتاح واحد هو تبديل لعنوان URL الأساسي وليس إعادة كتابة — وهذه هي الطريقة الصحيحة لحسم هذه المسألة بعينها، لأن الجدل يدور حول الرموز لكل مهمة منجزة، ولا يمكن إلا لعبء العمل الخاص بك أن ينتج ذلك الرقم.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the introductory argument that a system deploying a multi-trillion-parameter model for a simple lookup is wasteful, and a cost-versus-performance chart placing Fugu Max on a frontier formed by Fugu models above the frontier formed by single models.

أيّ واحد يجب شراؤه؟

Grok 4.6 هو الخيار الافتراضي القابل للدفاع عنه. وببطاقة أسعار مطابقة لبطاقة Fugu Max، يمنحك نافذة سياق بحجم 500K يمكنك التخطيط بناءً عليها، وإصدارًا يمكنك تثبيته، وأربعة مستويات للتحكم في الاستدلال، وموضعًا في مؤشر مستقل عند 44 مع رقم التكلفة لكل مهمة بجانبه، وأشهرًا من القياسات المستقلة من طرف ثالث. تكاليفه محددة ومعروفة: حافة إعادة التسعير عند 200K، واستدلال يُفوتر دائمًا، وملف أداء في مهام الطرفية يتخلف عن الساحة.

Fugu Max هو الرهان الأكثر إثارة للاهتمام، وبناءً على الأدلة المتاحة، هو الأقل قابلية للفحص. حجة التصميم سليمة — إذا اختار منسق بشكل موثوق أرخص نموذج يمكنه إنجاز مهمتك، فإن تكلفتك الوسيطة لكل مهمة مكتملة تنخفض حتى عندما لا تنخفض بطاقة أسعارك. لكن عند $2.00 / $6.00، فإن سعر الرمز ليس حيث تكمن ميزة Fugu Max؛ هذا السعر هو بالضبط سعر Grok 4.6. يجب أن تأتي الميزة من إنفاق رموز أقل، ولم تنشر Sakana القياس الذي من شأنه أن يُظهر أنها تفعل ذلك.

إذن أجرِ المقارنة بالطريقة التي يطلبها منك المورّدان كليهما. ضَع Grok 4.6 على بوابتك، واستدعِ Fugu Max خلف علامة ميزة، واحسب رموز الإخراج لكل مهمة مكتملة في أعمال تشبه أعمالك. إذا أنهى Fugu Max المهمة بعدد رموز أقل من نموذج واحد وبالسعر نفسه، فإن خصم التخزين المؤقت والتنسيق يمثلان أموالًا حقيقية، ويكون التبديل مبررًا. وإن لم يحدث ذلك، فأنت تدفع الأسعار نفسها مقابل نظام يمكن أن يتغيّر تكوينه من تحت قدميك دون أن يتغيّر رقم إصداره.

لكل ما يمكنك أن تقرره في هذا الربع دون ذلك القياس، ابدأ بالنموذج الذي يمتلك لوحة نتائج.

A screenshot of the OrcaRouter model page for Grok 4.6 (English UI, captured September 11, 2026), showing the NEW and Featured badges, the identifier grok/grok-4.6, by SpaceXAI dated 2026-08-12, vision, tools, JSON and reasoning capability tags, a 500K-token context window with text, image and file input, a p50 TTFT of 10.00 seconds, list pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens, traffic of 46.6 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا