
Sakana Fugu Max: оркестратор за $2/$6, который выбирает самую дешёвую работающую модель
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Большинство моделей соревнуются в том, сколько они умеют делать. Sakana Fugu Max соревнуется в том, как мало она может себе позволить делать. Sakana AI выпустила Sakana Fugu Max 11 сентября 2026 года, вместе с Sakana Fugu Ultra v2 — две настройки единой архитектуры оркестрации, нацеленные на противоположные концы кривой «стоимость — производительность». Fugu Max не отвечает на ваш запрос сама. Она читает задачу, выбирает самую дешёвую модель в своём пуле, которая с ней предположительно справится, направляет запрос туда и возвращает один ответ. Sakana устанавливает для неё цену в $2 за миллион входных токенов и $6 за миллион выходных токенов.
Самое интересное — это то, с чем сравнивается эта цена. Sakana утверждает, что стоимость вывода у Fugu Max на 40–60% ниже, чем у Claude Sonnet 5, GPT-5.6 Terra и Kimi K3. Это утверждение можно проверить, и, что необычно для бенчмарка в день запуска, арифметика сходится: при текущих ценах из прайс-листа трёх моделей, которые называет Sakana, $6 за миллион выходных токенов попадают почти точно в середину заявленного диапазона. Гораздо сложнее проверить сторону производительности, потому что Sakana опубликовала результаты Fugu Max в виде диаграмм рассеяния, а не чисел.
Что такое Fugu Max на самом деле
Fugu Max — это не чекпоинт. Здесь нет файла весов, нет количества параметров и нечего скачивать. Sakana описывает его как «архитектуру, а не отдельную модель» — тот же базовый движок оркестрации, что и в Fugu Ultra v2, настроенный на другой вопрос. Ultra v2 отвечает на вопрос, каковы максимальные доступные возможности. Fugu Max отвечает на вопрос, какой наилучший результат можно получить при наименьших затратах.
Это различие важно с операционной точки зрения. Вы не можете дообучить Fugu Max, развернуть его на собственных серверах или выяснить, почему он выбрал одну модель вместо другой. Вы также не можете увидеть весь список моделей, между которыми он маршрутизирует запросы, — Sakana говорит, что пул расширяется до «нашего самого крупного на сегодня пула открытых и специализированных моделей», и прямо называет семейство Nemotron от NVIDIA, добавленное благодаря партнёрству с NVIDIA, о котором Sakana объявила в августе. Остальная часть пула не названа, и Sakana не публикует трассировку маршрутизации по каждому запросу.
То, что вы видите, — это очертания этой конструкции. Собственная схема вендора показывает Fugu Max во главе веерной схемы: один оркестратор, ряд взаимозаменяемых слотов для моделей за ним, а среди целевых моделей — Sakana Namazu и сам Fugu Max. Пул описывается как взаимозаменяемый по замыслу, и заявленная мотивация здесь в равной мере политическая и экономическая — Sakana трактует оркестрацию как защиту от привязки к поставщику, отзыва API и экспортного контроля, исходя из того, что систему, способную менять своих поставщиков, не сможет отрезать ни один из них.
Сама Sakana Fugu — не новинка. Она стала общедоступной 22 июня 2026 года, а собственный график вендора выглядит так: апрель (бета), июнь (GA плюс Fugu Ultra v1), июль (Fugu-Cyber и интерфейс Claude Code), август (Sakana Chat плюс партнёрство с NVIDIA) и теперь сентябрь. Fugu Max — это пятый месячный шаг, а не дебют, — и все, кто уже использует Fugu, переходят на Fugu Max однострочным изменением параметра в том же эндпоинте, совместимом с OpenAI, без миграции.
Заявление о ценах выдерживает проверку прейскурантными ценами.
У Sakana прямо на странице запуска указаны цены: $2 за входные данные и $6 за выходные. Вторичные публикации добавляют тариф на кэшированные входные данные — $0,25 за миллион токенов, которого сама страница запуска не приводит: считайте эту цифру заявленной, а не подтверждённой. Для сравнения: Fugu Ultra v2 — $5 за входные данные, $30 за выходные и $0,50 за кэшированные входные данные.
Теперь об утверждении про 40–60%. Три названных компаратора сейчас находятся на уровне:
• GPT-5.6 Terra — $2 за входные данные / $12 за выходные данные, после того как снижение цен OpenAI от 30 июля уменьшило стоимость выходных данных с $15.
• Claude Sonnet 5 — $10 за вывод по стартовому промо-тарифу, $15 по стандартному тарифу. Источники расходятся в том, было ли запланированное сентябрьское повышение отменено или лишь отложено, поэтому диапазон такой широкий.
• Kimi K3 — $3 за ввод / $15 за вывод, при этом кэшированный ввод — $0.30.
На их фоне цена вывода в $6 на 50% ниже, чем у Terra, на 40% ниже промо-тарифа Sonnet 5, на 60% ниже стандартного тарифа Sonnet 5 и на 60% ниже, чем у Kimi K3. Утверждение подтверждается, причём подтверждается на основе опубликованных прайс-листов, а не внутренней модели затрат — а это можно сказать не о всяком проценте, озвученном в день запуска.
Одно число в том же разделе не выдерживает той же проверки. Sakana также утверждает, что Fugu Max обеспечивает «производительность, близкую к элитным моделям, при затратах в два–шесть раз ниже». Если сравнить с тремя моделями, названными в связи с показателем 40–60 %, фактический разрыв в цене вывода ближе к 1,7–2,5×. Более широкий множитель, предположительно, измеряется по всему фронтиру — включая модели, которые стоят намного больше $12, — а не по трём моделям из предложения. Это обоснованное утверждение о кривой Парето и необоснованное — о названных конкурентах, и страница запуска не проводит между ними различия.
Именно здесь слой маршрутизации оправдывает себя в вопросах ценообразования. OrcaRouter передаёт каталожные цены провайдеров без наценки, поэтому когда вендор меняет каталожную цену, цифра, которую вы видите, меняется в тот же день — и это здесь уместно, ведь вся предпосылка Fugu Max в том, что где-то в пуле существует более дешёвая модель и вы должны добраться до неё, не задумываясь. Мы не размещаем Fugu Max у себя; он работает через собственный API Sakana. Но принцип сквозной передачи — тот же самый, который заставляет проверять ставку за вывод в $6 на фоне тарифа действующего игрока в $12, а не верить любой из этих цифр на слово.
Что, по словам Sakana, она превосходит, и что она не покажет вам

В разделе бенчмарков поставщика приводятся три конкретных утверждения о Fugu Max: лучший общий результат по шести бенчмаркам — Terminal Bench 2.1, GPQA-D, AA-LCR, GDP.pdf, AutomationBench и SWEFish; расширение границы Парето по соотношению «затраты — производительность» на семи из десяти бенчмарков; и производительность «почти на уровне элитных моделей» при значительно меньшем расходе токенов.
Прежде чем цитировать что-либо из этих доказательств, стоит запомнить три вещи о них.
Во-первых, Sakana не опубликовала ни одной цифры. Результаты Fugu Max представлены в виде десяти диаграмм рассеяния — оценка по вертикальной оси, цена вывода в долларах за миллион токенов по горизонтальной — при этом Fugu Max обозначена красной точкой к северо-западу от серого поля. Видно, что она расположена выше и левее. Из неё нельзя прочитать оценку. У Terminal Bench 2.1, GPQA-D и AA-LCR есть публичные таблицы лидеров, где число было бы напрямую сопоставимо, но ни одного числа не привели.
Во-вторых, один из шести бенчмарков — собственный бенчмарк Sakana. На странице запуска SWEFish описывается как «наш внутренний бенчмарк, отражающий собственные задачи и сценарии использования Sakana AI в программировании». Это законный способ измерить, насколько модель подходит для вашего собственного продукта, но это не способ сравнения с конкурентом — оценка на бенчмарке, разработанном поставщиком, на задачах, выбранных поставщиком, не является доказательством относительно чьей-либо ещё модели.
Третье: самые сильные цифры на этой странице принадлежат другой модели. Fugu Ultra v2 достаются числа там, где Fugu Max достаются графики: Chartography 48.3 против 27.3 у Opus 5 и 29.5 у Fable 5, DeepSWE 74.3, лучший или разделяющий первое место результат в пяти из восьми бенчмарков и попадание в топ-2 в семи из восьми. Ultra v2 также имеет заявленную дату отсечки обучающих данных — 2026-08-28, то есть чуть более чем за две недели до запуска, — и, что показательно, явную пометку о том, что Fable 5, Fable 5.1 и GPT-6 Astra не входят в её пул. Sakana утверждает, что добивается этого, не арендуя именно эти модели, — и весь аргумент о суверенитете умещается в одной сноске.
Ничто из этого не делает утверждения о Fugu Max ложными. Это делает их непроверенными и делает заголовок о шести бенчмарках безопасным для повторения только с прикреплённой пометкой. Независимая оценка совершенно нового эндпоинта оркестрации — редкость, и пока ничего не опубликовано.
Fugu Max против Fugu Ultra v2: какой из них вам действительно нужен

Это не конкурирующие продукты, и выбор между ними уже не кажется близким, как только видишь цифры рядом. Fugu Max — дешёвый вариант: $2 за вход, $6 за выход, создан для того, чтобы уводить запросы от дорогих моделей всякий раз, когда с задачей справится более дешёвая. Fugu Ultra v2 — сильный вариант: $5 за вход, $30 за выход, $0,50 за кэшированные данные, создан для того, чтобы направлять запросы туда, где нужна мощь, в сложной многоэтапной работе, даже если это стоит дороже.
Практическое разделение проходит по форме задач, а не по бюджету. Если ваш трафик — это в основном поисковые запросы, извлечение, классификация, короткие генерации и простые вызовы инструментов, весь дизайн Fugu Max состоит в том, чтобы это замечать и тратить как можно меньше, — и утверждение Sakana о том, что он раздвигает границы на семи из десяти бенчмарков, по крайней мере в общих чертах именно об этом. Если ваш трафик включает длительные агентные прогоны, многофайловые рефакторинги или исследовательские задачи, которые дорого проваливаются, когда какой-то шаг идёт не так, ставка $30 за вывод на Ultra v2 покупает нечто реальное: место в топ-2 на семи из восьми бенчмарков — это та часть страницы запуска, которая больше всего похожа на заявление о возможностях, а не о стоимости.
Обе доступны через один и тот же API, совместимый с OpenAI, через консоль Sakana, а путь обновления с существующей Fugu — это изменение параметра. Применяются две оговорки о доступности. Сообщалось, что Fugu недоступна в ЕС и ЕЭЗ в ожидании работ по GDPR; если это всё ещё так, это ограничивает, где можно развернуть любую из моделей. И обе являются закрытыми системами: вы покупаете эндпоинт, а вендор выбирает, какие модели за ним стоят, — включая, для Fugu Max, состав, который он не раскрывает полностью.
Загвоздка: оркестратор, который всё ещё арендует свой фронтир.
Самая резкая критика Fugu — та, которую Sakana сама провоцирует, представляя его как инфраструктуру суверенитета. Оркестрационный слой, маршрутизирующий запросы через сторонние API, не мешает отозвать эти API. Он превращает единую точку отказа в диверсифицированную, что действительно является улучшением, но лежащие в основе модели по-прежнему принадлежат кому-то другому, по-прежнему подпадают под те же меры экспортного контроля и по-прежнему подвержены тем же внезапным отключениям сервиса. Августовское партнёрство с NVIDIA и дополнения Nemotron — самое конкретное на сегодняшний день решение этой проблемы: модели с открытыми весами в пуле — это модели, которые никто не может отключить, — но Sakana не говорит, какая доля трафика Fugu Max на самом деле приходится на них.
Есть и второй, более тихий компромисс. Решения о маршрутизации добавляют задержку и лишают систему детерминизма. Запрос, который сегодня попадает на небольшую модель, завтра может попасть на другую, если изменится пул или веса стоимости, а это усложняет регрессионное тестирование поведения и объяснение его кому-либо, кто проводит аудит системы. Ответ Sakana таков: оркестрация внутренняя, а API ведёт себя как единая модель. Это верно на уровне интерфейса и неверно под капотом, и командам с жёсткими требованиями к воспроизводимости следует тщательно проверить это, прежде чем это станет несущей опорой.
Если вы хотите получить выигрыш по стоимости, не делая пул своей единственной зависимостью, тот же паттерн можно собрать самостоятельно. Наш DSL маршрутизации позволяет определить набор моделей за одним эндпоинтом и решать, какая из них обрабатывает какой класс запросов, а слияние моделей запускает несколько моделей на одном промпте и согласует ответы там, где согласованность важнее цены. Переключение при сбое между провайдерами означает, что когда поставщик деградирует — или исчезает — трафик переходит на модель, которой вы уже доверяете, без изменений в коде. Это более консервативная версия ставки, которую Sakana предлагает вам сделать целиком.

Стоит быть точными в том, что мы здесь предлагаем, а что нет. Sakana Fugu Max нет в нашем каталоге — это не маршрутизируемая модель на нашей стороне, она работает на собственном API и в консоли Sakana. Наш каталог — это 196 моделей от 15 провайдеров по одному ключу и одному счёту, с указанными на каждой карточке ставками за токен и без наценки сверх них. Существенное пересечение с Fugu Max — это идея, а не ассортимент: и то, и другое — аргументы в пользу того, что правильный ответ на вопрос «какая модель должна с этим справиться» обычно не самая крупная.
Кому следует двигаться, а кому — ждать
Fugu Max — один из самых интересных релизов месяца именно потому, что это не модель. Если вы уже используете Sakana Fugu, обновление — это изменение в одну строку по более низкой цене, и нет причин раздумывать. Если вы гоняете большой объём несложного трафика через модель среднего уровня и платите за это $10–$15 за миллион выходных токенов, арифметика, которую предлагает Sakana, заслуживает собственного бенчмарка — возьмите неделю реальных запросов, прогоните их через Fugu Max и сравните качество с вашей текущей моделью, а не с диаграммами рассеяния.
Если вам нужны опубликованные числа бенчмарков, прежде чем принять решение, подождите. По Fugu Max пока нет ничего независимого: собственные доказательства вендора — это график, а не таблица, и один из шести основных бенчмарков принадлежит Sakana. Это не причина отвергать его — это причина протестировать его на вашем собственном трафике, а это единственный бенчмарк, который вообще мог бы предсказать ваши результаты. И если ваша рабочая нагрузка агентная, долгосрочная и ошибка в ней дорого обходится, модель, на которую стоит обратить внимание в этой паре, — Fugu Ultra v2, а не Fugu Max: именно она — та, к которой приложены числа.
Наш DSL маршрутизации позволяет определить набор моделей за одним эндпоинтом и решать, какая из них обрабатывает какой класс запросов, а объединение моделей запускает несколько моделей на одном и том же промпте и согласовывает ответы там, где согласованность важнее цены.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
