Титульная карточка для "Fugu Max vs Claude Opus 5" с подзаголовком "В четыре раза дешевле, и цифра, которую никто не публиковал", три бейджа-пилюли с надписью $6.00 vs $25.00 вывод", "Шесть побед, ноль очков", "$2.00 vs $5.00 ввод, строка футера "Sakana AI vs Anthropic — сентябрь 2026", и логотип OrcaRouter в правом нижнем углу.
Guides & Insights

Fugu Max против Claude Opus 5: в четыре раза дешевле и цифра, которую никто не публиковал

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Стоимость производства миллиона токенов вывода у Fugu Max составляет $6.00. Claude Opus 5 стоит $25.00. Sakana AI выпустила Fugu Max 11 сентября 2026 года как координатор, который направляет каждую задачу к самой экономичной модели в своём пуле, и назначила на него настолько агрессивную цену, что четырёхкратный разрыв по объёму вывода с флагманом Anth​ropic стал главным фактом релиза. Чего в релизе нет — так это ни одной цифры, описывающей, насколько хорошо Fugu Max на самом деле работает. Sakana утверждает, что он получает «лучший общий результат» на шести бенчмарках и расширяет границу соотношения стоимости и производительности на семи из десяти — это утверждения о положении на графике, а не о значениях на оси. Claude Opus 5, напротив, выходит с опубликованным результатом почти для всего, что он делает. Так что честная версия этого сравнения — не «дешёвый против дорогого». Это «измеренное против заявленного», и именно ценовой разрыв делает этот компромисс достойным спора.

Разрыв — и сравнение, которое Sakana решила не проводить

Страница релиза Sakana обосновывает стоимость вывода Fugu Max, сравнивая её с другими моделями. Три модели, которые там названы, — это Claude Sonnet 5, GPT-5.6 Terra и Kimi K3, и утверждается, что цена вывода Fugu Max на 40–60 процентов ниже, чем у них. Обратите внимание, кого здесь нет. Claude Opus 5 в этом списке отсутствует, и причина арифметическая: при $6,00 против $25,00 Fugu Max не на 40 процентов дешевле Opus 5, а на 76 процентов дешевле. Упоминание Opus 5 заставило бы это утверждение выглядеть неправдоподобным, а не конкурентоспособным, поэтому сравнение проводится с уровнем ниже флагмана.

Это не критика цен, которые действительно низкие. Это замечание о том, что делает окружающее предложение. Собственная формулировка Sakana — производительность «в пределах досягаемости элитных моделей при стоимости в два-шесть раз ниже» — откалибрована под модели, которые она решила назвать. В сравнении с Claude Opus 5 множитель не два-шесть, а больше четырёх на выходе; остаётся невысказанным, является ли Opus 5 всё ещё «элитной моделью» по меркам этого предложения, что является любопытным упущением в релизе, весь посыл которого — эффективность затрат и производительности на переднем крае.

• Цена ввода — Fugu Max $2.00 за 1 млн токенов против Claude Opus 5 $5.00 за 1 млн токенов

• Цена вывода — Fugu Max $6.00 за 1 млн токенов против Claude Opus 5 $25.00 за 1 млн токенов

• Кэшированный ввод — Fugu Max: $0,25 за 1 млн токенов, тогда как кэширование Claude Opus 5 оценивается как скидка до 90% на кэшированный ввод

• Результаты бенчмарков — у Fugu Max не опубликовано ни одного; заявлено шесть побед в бенчмарках без цифр против Claude Opus 5, по данным Anthropic: 96,0% SWE-bench Verified, 79,2% SWE-bench Pro, примерно 30,2% на ARC-AGI 3

• Архитектура — Fugu Max: обученный координатор над нераскрытым пулом против Claude Opus 5: единой модели, которую можно закрепить по версии

• Контекст — Fugu Max не опубликован в сравнении с Claude Opus 5 на 1 млн токенов, при потолке вывода в 128K

• Независимая оценка — Fugu Max не существует ни для одной модели Fugu, в отличие от Claude Opus — 5 месяцев позиций в сторонних лидербордах

Шесть побед без указания счёта

Шесть бенчмарков — это Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Пять из них — известные публичные тесты. Шестой, SWEFish, — это собственный бенчмарк Sakana для программирования, а значит, одна из шести побед оценивается по тесту, который написала сама компания-разработчик и не опубликовала.

Что касается остальных пяти, в релизе утверждается, что Fugu Max достигает лучшего общего результата, но не говорится, каков этот результат и сколько набрал кто-либо из конкурентов. Это необычная форма для анонса модели. Производители регулярно преувеличивают, но обычно преувеличивают с цифрами, потому что именно цифры и распространяются. Релиз, который заявляет шесть побед и не приводит ни одной из них, просит верить ему просто на слово.

Есть благожелательная трактовка, и её стоит изложить прямо. Fugu Max — это оптимизированный по затратам координатор, а не рывок в возможностях — Sakana выпустила Fugu Max в тот же день, что и Fugu Ultra v2, версию, нацеленную на максимальные возможности при $5.00 за вход и $30.00 за выход. Задача Max — достичь приемлемого качества при $6.00 за выход, и главный показатель оркестратора менее значим, чем его показатель на доллар, что как раз и показывает график Парето. Визуальная коммуникация Sakana для этого релиза — это графики Парето. Если аргумент звучит как «смотрите на кривую, а не на пик», то сырое число из бенчмарка несущественно.

Неблагожелательная трактовка состоит в том, что число спровоцировало бы сравнение, которого разработчик предпочёл бы избежать. Обе трактовки согласуются с имеющимися данными, и ничто в открытых источниках сейчас не позволяет их различить. Можно сказать, что ни одна независимая сторона не оценивала ни одну модель Fugu, и в Artificial Analysis нет записи ни для Fugu Max, ни для одной из его родственных моделей. Каждая цифра в пресс-релизе, включая шесть побед, исходит от Sakana.

A two-column scoreboard titled "Fugu Max vs Claude Opus 5 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Benchmarks six wins with no figures, Context not published, Evidence vendor-reported only. Right column Claude Opus 5: Output price $25.00 / 1M, Input price $5.00 / 1M, Cached input up to 90% discount, Benchmarks 96.0% SWE-bench Verified, Context 1M with a 128K output ceiling, Evidence independent evals. Footer reading "Fugu Max figures vendor-reported by Sakana AI; Opus 5 rows Anthropic-reported. No independent Fugu Max evaluation exists.", with the OrcaRouter logo bottom-right.

Покупка, которую вы на самом деле совершаете

Когда поставщик одной модели публикует бенчмарк, вы покупаете утверждение о модели. Когда оркестратор публикует его, вы покупаете утверждение о пуле — моделях, которые поставщик не обучал и которые работают под управлением координатора, чьи решения о маршрутизации намеренно не раскрываются. Пул здесь описывается как крупнейший из использованных Fugu, расширенный за счёт моделей с открытыми весами и специализированных моделей, включая семейство NVIDIA Nemotron, благодаря сотрудничеству с NVIDIA. В остальном состав участников не раскрывается.

Практическое следствие состоит в том, что поведение Fugu Max может меняться без изменения версии. Прекращение поддержки какой-то модели передовой лабораторией, изменение цены или вывод модели из региона меняют набор моделей, которые координатор может вызывать, и Sakana прямо заявляет, что весь смысл именно в этой устойчивости — она продаёт защиту от привязки к поставщику и отзыва API. Это реальное преимущество, и оно не бесплатно. Это также причина, по которой бенчмарк Fugu Max, если бы его опубликовали, имел бы срок годности, которого нет у бенчмарка Claude Opus 5.

Ценностное предложение Claude Opus 5 — обратное, и его проще оценить по цене. Это одна модель одной версии, по умолчанию использующая адаптивное мышление с явным регулятором усилий от низкого до максимального, с контекстным окном в 1 млн токенов и потолком вывода в 128 тыс. токенов, а также с поддержкой изображений, вызова инструментов и режима JSON. Anthropic сообщает о 96,0% в SWE-bench Verified и 79,2% в SWE-bench Pro, и эти цифры были измерены на том, что вы получаете при обращении к эндпоинту, — а не на ансамбле, состав которого может измениться у вас под ногами. Для рабочей нагрузки, которая выполняется в продакшене и проходит проверку, эта стабильность — то преимущество, за которое вы платите $19.00 за миллион выходных токенов.

За выполненную задачу, а не за токен

Ставка Fugu Max в $6.00 за выходные токены действительно привлекательна, и способ проверить её — перестать сравнивать цены на токены. Оркестратор порождает агентов; каждый из них пишет токены рассуждений и выходные токены; координатор пишет синтез. В FAQ по ценам Sakana для линейки Fugu заявлена единая смешанная ставка на основе участвующей модели верхнего уровня, при этом мультиагентные запуски не накапливают счёт — это устраняет умножение при fan-out в худшем случае, из-за которого наивные мультиагентные системы становятся неподъёмно дорогими. Оно не устраняет объём. Количество выходных токенов, за которые вы платите, зависит от того, сколько агентов запускалось, и при $6.00 за миллион этот объём — та переменная, о которой страница с ценами вам не расскажет.

Структура затрат Claude Opus 5 — это один вызов, одна модель, регулятор усилий под вашим контролем и пакетная обработка по половинной ставке для задач, которые могут подождать. Вы можете спрогнозировать её до запуска. На десяти тысячах выполнений предсказуемость стоит куда дороже, чем преимущество в бенчмарке, которое никто не публиковал.

Здесь вопрос маршрутизации отделяется от вопроса выбора модели. Claude Opus 5 доступен на OrcaRouter по прайсовой цене Anth​ropic с наценкой 0% — тариф провайдера передаётся напрямую, поэтому изменение цен Anth​ropic вступает в силу на том же ключе в тот же день, с автоматическим переключением между провайдерскими маршрутами, когда один из них ограничен по скорости или недоступен. Fugu Max отсутствует в нашем каталоге; до вас он доходит через собственный OpenAI-совместимый API Sakana и несколько сторонних платформ, а переход на него с более раннего Fugu — это изменение одного параметра. Если вам нужна доказательная база Opus 5 и предсказуемый счёт, роутер — более короткий путь. Если вам нужна система, которая сама выстраивает веер запросов на сложных задачах, то именно это и делает Fugu Max — и пилотировать его стоит с включённым учётом токенов с самого первого запроса.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Где {{1}}Fugu Max{{/1}}, вероятно, является правильным ответом

Отдайте должное этой схеме. Если ваша работа характеризуется большим объёмом, поддаётся проверке, и вам важна медианная стоимость выполненной задачи, а не пиковая производительность отдельного вызова, оркестратор, выбирающий самую дешёвую достаточную модель для каждого запроса, делает то, чего не может фиксированная флагманская модель. Fugu Max нацелен ровно на такую нагрузку, и ставка $2.00 за входные данные при $0.25 за кэшированный ввод рассчитана на длинные повторяющиеся контексты, которые порождают такие нагрузки. Сотрудничество с NVIDIA также значит больше, чем кажется: модели Nemotron имеют открытые веса, а значит, самая дешёвая ступень пула не зависит от ценовой политики другой лаборатории.

Чего это вам не даёт — так это основания полагать, что Fugu Max сравняется с Claude Opus 5 на задачах, где опубликованные показатели Opus 5 наиболее сильны — в разработке ПО масштаба репозитория и сложных рассуждениях. Это как раз те строки, где таблица Sakana с шестью бенчмарками не приводит вообще ни одной цифры. Если ваша задача — из тех, где быть лучшим важнее, чем быть дешёвым, то ставка за вывод в $25.00 покупает именно то, что вам действительно нужно.

Итог

Claude Opus 5 — это покупка с лучшей доказательной базой и более безопасный вариант по умолчанию для продакшена: опубликованные вендорские бенчмарки, версия, которую можно закрепить, контекстное окно, которое не меняется, потолок вывода 128K, регулятор усилий, позволяющий оплачивать рассуждения только тогда, когда это окупается, и месяцы сторонних результатов за спиной. Fugu Max — более интересная ставка и по-настоящему более дешёвая: примерно на 60 % дешевле по входу и на 76 % дешевле по выходу, при этом тариф на кэш на порядок ниже базовой цены за вход у Opus 5.

Если вы выполняете проверяемую, повторяющуюся работу большого объёма и находитесь за пределами ЕС/ЕЭЗ, Fugu Max заслуживает ограниченного пилотного проекта с потолком выходных токенов, установленным до начала работы, и измерением количества токенов на выполненную задачу, а не на вызов. Если вам в этом квартале нужно решение о продакшене, которое вы сможете обосновать кому-то ещё, Claude Opus 5 остаётся ответом — и он доступен на OrcaRouter по каталожной цене Anth​ropic, при этом тариф провайдера передаётся без изменений.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured September 11, 2026, English UI), showing the Featured badge, the anthropic/claude-opus-5 model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24, the /v1/chat/completions and /v1/messages endpoints, the pricing tiles reading INPUT $5.00 and OUTPUT $25.00 per 1M tokens with p50 TTFT 4.94s and 195.4M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.