
Fugu Max против Grok 4.6: идентичные тарифные сетки, один опубликованный балл
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Fugu Max и Grok 4.6 стоят ровно одинаково. Sakana AI выпустила Fugu Max 11 сентября 2026 года по цене $2.00 за миллион входных токенов и $6.00 за миллион выходных токенов — и это в точности та тарифная сетка, которую SpaceXAI взимает за Grok 4.6 с момента его запуска 12 августа. Это совпадение — самый полезный факт в данном сравнении, потому что оно убирает цену из спора. Когда два продукта тарифицируются одинаково, единственный оставшийся вопрос — что вы получаете за эти деньги, и здесь эти двое полностью расходятся. Grok 4.6 — это одна модель, которую можно закрепить по версии, прочитать для неё таблицу бенчмарков и сверить с независимым индексом. Fugu Max — это обученный координатор, который направляет каждую задачу самой дешёвой модели в своём пуле, а в анонсе Sakana утверждается, что он получает лучший совокупный результат по шести бенчмаркам, не публикуя ни одной цифры ни по одному из них. Одну из этих покупок можно измерить до того, как вы её совершите. Другую — нет.
Два продукта, одна тарифная карта
• Ввод — Fugu Max $2,00 за 1 млн токенов против Grok 4.6 $2,00 за 1 млн токенов
• Вывод — Fugu Max $6.00 за 1 млн токенов против Grok 4.6 $6.00 за 1 млн токенов
• Кэшированный ввод — Fugu Max $0.25 за 1 млн токенов против Grok 4.6 $0.50 за 1 млн токенов — единственная строка, где эти две цены вообще различаются
• Контекстное окно — Fugu Max не опубликовано производителем, в отличие от Grok 4.6 с 500 000 токенов, без изменений по сравнению с Grok 4.5
• Пересмотр цен для длинных промптов — для Fugu Max в релизе не указан тарифный уровень, тогда как Grok 4.6 удваивает цену до $4.00 / $12.00, как только один запрос превышает 200 000 токенов; это применяется ко всему запросу, а не только к превышению
• Контроль рассуждений — Fugu Max не предоставлен, тогда как Grok 4.6 имеет четыре уровня усилий, от low до xhigh, по умолчанию high, и его нельзя отключить
• Архитектура — Fugu Max, обученный координатор над нераскрытым пулом, включающим модели с открытыми весами и специализированные модели, расширенный для Max семейством NVIDIA Nemotron в рамках сотрудничества с NVIDIA, против Grok 4.6 — одна модель в одной версии
• Независимая оценка — по Fugu Max ничего не опубликовано, и ни для одной модели Fugu не существует страницы Artificial Analysis; в сравнении с Grok 4.6 — актуальный Artificial Analysis Intelligence Index 44, место #20 из 200
Дешёвая колонка — это непрогнозируемая.
Посмотрите, где Fugu Max действительно выигрывает по цене: чтение из кэша — вдвое дешевле, чем у Grok 4.6. Это реальное преимущество, но именно не то место, где стоит строить модель затрат, потому что цена кэша окупается лишь пропорционально вашему коэффициенту попаданий в кэш — а Sakana не публикует его для Fugu Max. В релизе также не указано ни контекстное окно, ни уровень для длинного контекста, ни потолок вывода. Так что единственный столбец, где Fugu Max обходит Grok 4.6 по цене, — это скидка неизвестного размера, применённая к неизвестной доле ваших токенов.
Слабости Grok 4.6 по крайней мере видны. Его порог в 200 000 токенов довольно агрессивен — он пересчитывает весь запрос, поэтому промпт на 250 000 токенов тарифицируется по удвоенной ставке с первого токена, а не с 200 001-го. Но вы можете увидеть этот обрыв, измерить свои промпты относительно него и решить, стоит ли разбивать их на части. В этом и заключается принципиальная разница: одна система публикует график цен с формой, вокруг которой можно планировать, а другая публикует ставку из заголовка без какого-либо прилагаемого графика.
Шесть побед и ни одного очка
Бенчмарки, которые называет Sakana, — это Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Пять из них — признанные публичные тесты. Шестой, SWEFish, — собственный бенчмарк Sakana по программированию, а значит, одна из шести заявленных побед получена на тесте, который написал сам вендор и не выпустил. Что касается остальных пяти, в пресс-релизе говорится, что Fugu Max достигает лучшего общего результата, — и на этом всё: ни балла, ни отрыва, ни цифры конкурента, с которой его можно было бы поставить рядом.
Сопоставьте это с таблицей, которую SpaceXAI опубликовала для Grok 4.6: все данные в ней предоставлены производителем, но это по крайней мере таблица: GDPVal-AA v2 — 1 753, AA-Briefcase — 1 577, DeepSWE v1.1 — 65,9 %, CursorBench v3.2 — 69,9 % и GPQA Diamond — 94,9 %. В материалах запуска также сообщается о примерно 53 ходах и около полумиллиарда входных токенов для решения долгосрочных задач на AA-Briefcase против примерно 103 ходов и двух миллиардов токенов у конкурирующей фронтирной модели — аргумент, снова основанный на данных производителя, что Grok обходится дёшево в расчёте на выполненную задачу даже при умеренной цене за токен.
С двумя из этих чисел по Grok нужно разобраться, прежде чем вы их процитируете. Первое — его главный показатель GPQA Diamond в 94,9% происходит из бенчмарка, который Artificial Analysis с тех пор сняла с использования как насытившийся, поэтому он больше не разграничивает фронтирные модели так, как когда-то. Второе — число, которое вы увидите в старых публикациях: Artificial Analysis Intelligence Index, равный 61, для Grok 4.6. Это была шкала до пересчёта. Artificial Analysis перекалибровала индекс в сентябре 2026 года, и актуальное значение — 44, место №20 из 200, при стоимости $1,86 за задачу Intelligence Index. Любой, кто ранжирует Grok 4.6 относительно Claude Fable 5 или GPT-5.6 Sol по показателю 61, сравнивает показания двух разных инструментов.

Что не входит в цену токена оркестратора
Собственный материал Sakana об этом релизе признаёт структурную проблему. Поскольку Fugu Max переключается между моделями внутри одной задачи, он «может снижать повторное использование кэша контекста, а также генерировать дополнительные токены оркестрации» — и компания не раскрыла итоговый коэффициент попаданий в кэш или общую стоимость токенов на задачу. Каждый агент, запускаемый координатором, пишет текст рассуждений и вывода, и всё это тарифицируется по $6,00 за миллион. Этот тариф идентичен тарифу Grok 4.6. А вот объём — нет, и объём — это та переменная, которую страница с ценами не может вам показать.
Оба поставщика подталкивают вас к одной и той же поправке — перестаньте сравнивать тарифы, начните сравнивать стоимость за выполненную задачу — но только один из них даёт вам число, с которого можно начать. Grok 4.6 поставляется с опубликованным профилем числа ходов и токенов. Fugu Max поставляется с указанием измерить его самостоятельно.
Есть справедливая интерпретация молчания Fugu Max, и она заслуживает того, чтобы её озвучили. Max — это оптимизированный по затратам уровень линейки Fugu, выпущенный в тот же день, что и Fugu Ultra v2, который представляет собой рывок по возможностям при цене $5.00 за вход и $30.00 за выход. Визуальный аргумент Sakana в пользу Max — это график Парето: возможности против стоимости; а на графике Парето сырой результат бенчмарка не имеет значения — весь смысл утверждения в баллах на доллар. Если аргумент именно таков, публикация шести победных результатов без их стоимости была бы вводящим в заблуждение графиком, а не отсутствующим. Релиз всё ещё должен покупателю знаменатель, но не предоставляет его.
Где Grok 4.6 действительно уязвим
Работа в терминале — самая слабая из опубликованных сторон Grok 4.6. Его результат в Terminal-Bench v3.0 составляет 26%, что значительно отстаёт от лидеров. Осторожнее с соседней цифрой: та же модель показывает 88,4% в Terminal-Bench v2.1, и это разные тесты. Вы увидите, как в освещении эти два результата смешивают, и такое смешение заметно льстит Grok.
Второй риск заключается в том, что рассуждения нельзя отключить. Токены размышлений тарифицируются при каждом запросе, поэтому фактическая стоимость вывода Grok 4.6 зависит от того, насколько интенсивно модель решит обдумывать ваш запрос. Настройка усилия даёт вам контроль на нижнем пределе, но нулевого значения нет.
В противовес этому, у Grok 4.6 есть то, что Fugu Max сейчас не может предложить ни за какие деньги: число. Каждую строку выше может проверить третья сторона, а запись в Artificial Analysis означает, что одна уже была проверена. Шесть побед Fugu Max были опубликованы в тот же день, что и модель, компанией, которая её создала, и на момент написания никто за пределами Sakana её не запускал.
Вызывая одного, пилотируя другого
Grok 4.6 уже доступен на OrcaRouter по каталожной цене SpaceXAI — 2,00 доллара за миллион входных токенов, 0,50 доллара при попадании в кэш, 6,00 доллара за миллион выходных — передаётся без наценки, 0%, так что изменение цены поставщиком доходит до нашего шлюза в тот же день, а не по графику миграции. Он совместим с OpenAI и работает на том же базовом URL, что и весь остальной каталог, а значит, его можно включить в цепочку отказоустойчивости или поставить за условное правило маршрутизации вместо того, чтобы жёстко прописывать провайдера в продакшен-путь, и вы можете проводить его A/B-тестирование против другой модели без второго договора. За последние семь дней через шлюз прошло 46,6 миллиона токенов.
Fugu Max отсутствует в нашем каталоге. Доступ к нему осуществляется через собственный OpenAI-совместимый API Sakana и несколько сторонних платформ, и компания утверждает, что существующая интеграция Fugu обновляется до него изменением одного параметра. Поскольку оба используют один и тот же формат запросов, оценка, которая ставит их за один флаг, — это замена base-URL, а не переписывание, — а это правильный способ уладить этот конкретный спор, поскольку спор идёт о токенах на завершённую задачу, и только ваша собственная рабочая нагрузка может дать это число.

Какой купить
Grok 4.6 — это обоснованный выбор по умолчанию. При тарифной сетке, идентичной тарифной сетке Fugu Max, он даёт вам окно контекста в 500K, на которое можно рассчитывать при планировании, версию, которую можно зафиксировать, четыре уровня управления рассуждениями, независимое место в индексе — 44 — с показателем стоимости за задачу рядом и месяцы сторонних измерений. Его издержки конкретны и известны: ценовой скачок при пересмотре тарифов на 200K, рассуждения, которые всегда тарифицируются, и профиль работы в терминале, уступающий остальным участникам рынка.
Fugu Max — более интересная ставка и, судя по имеющимся данным, менее поддающаяся проверке. Логика конструкции убедительна: если координатор надёжно выбирает самую дешёвую модель, способную выполнить вашу задачу, медианная стоимость одной выполненной задачи падает, даже если ваша тарифная сетка не снижается. Но при $2,00 / $6,00 преимущество Fugu Max не в ставке за токен; эта ставка в точности соответствует ставке Grok 4.6. Преимущество должно достигаться за счёт меньшего расхода токенов, а Sakana не опубликовала измерение, которое показало бы, что это так.
Проведите сравнение так, как просят вас оба вендора. Поставьте Grok 4.6 на свой шлюз, вызывайте Fugu Max под фича-флагом и считайте токены вывода на каждую завершённую задачу на работе, похожей на вашу. Если Fugu Max завершает работу за меньшее число токенов, чем одна модель по той же ставке, то скидка за кэш и координация — это реальные деньги, и переход оправдан. Если нет, вы платите по одинаковым ставкам за систему, состав которой может меняться у вас под ногами без изменения номера версии.
Для всего, что вы можете решить в этом квартале без этого измерения, начните с модели, у которой есть табло.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
