Титульная карточка для «Fugu Max vs GPT-5.6 Sol» с подзаголовком «Заявление о ценах было нацелено на середину семейства», тремя бейджами-таблетками с надписями «$6.00 против $20.00 за вывод», «Утверждение о 40-60% против Terra», «Шесть побед, без баллов», строкой нижнего колонтитула «Sakana AI против OpenAI — сентябрь 2026» и логотипом OrcaRouter в правом нижнем углу.
Guides & Insights

Fugu Max против GPT-5.6 Sol: заявление о ценах было нацелено на середину линейки

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Fugu Max's price justification names a G​PT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same Ope​nAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.

Проверяем утверждение на соответствие семейству, на которое оно указывает.

Цифра Sakana в 40–60 процентов поддаётся проверке, потому что у модели, которую она называет, есть опубликованный тариф. GPT-5.6 Terra указана по цене $2.00 за вход и $12.00 за выход за миллион токенов. Fugu Max указана по цене $2.00 за вход и $6.00 за выход. Проведите сравнение — и обнаруживаются две вещи. По выходу $6.00 против $12.00 — это снижение ровно на 50 процентов, точно в середине заявленного диапазона 40–60, что служит признаком того, что диапазон был очерчен вокруг этого сравнения, а не выведен из него. По входу обе ставки идентичны до цента.

That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the G​PT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.

• Цена ввода — Fugu Max $2.00 за 1 млн токенов против GPT-5.6 Sol $4.00 за 1 млн токенов

• Цена вывода — Fugu Max $6.00 за 1 млн токенов против GPT-5.6 Sol $20.00 за 1 млн токенов

• Кэшированный ввод — Fugu Max: $0.25 за 1 млн токенов, тогда как в GPT-5.6 Sol кэширование тарифицируется как скидка к базовой ставке за ввод

• Контекст — Fugu Max не опубликован по сравнению с GPT-5.6 Sol 1M токенов

• Максимальный объём вывода — у Fugu Max не опубликован, у GPT-5.6 Sol — 128K токенов

• Модальность ввода — Fugu Max: не опубликовано, против GPT-5.6 Sol: текст, изображение и файл

• Теги возможностей — у Fugu Max ничего не опубликовано, в отличие от GPT-5.6 Sol: зрение, использование инструментов, режим JSON, рассуждение

• Эндпоинты — Fugu Max: одна совместимая с OpenAI поверхность против chat completions и responses API у GPT-5.6 Sol

• Показатели бенчмарков — шесть побед Fugu Max заявлены без оценок против опубликованных производителем показателей GPT-5.6 Sol, включая Terminal-Bench 2.0 на 91,9% и SWE-bench Pro на 64,6%.

Почему средняя ступень — правильная ступень, которую стоит назвать

Есть оправданная версия выбора Sakana, и её стоит изложить до критики. Оркестратор, который направляет каждую задачу к самой экономной из подходящих моделей, не конкурирует с флагманом в работе уровня флагмана. Он конкурирует с моделью среднего уровня в задачах среднего уровня и предлагает выполнить часть этой работы дешевле. Если посыл таков: «большинство вашего трафика не нуждается в Sol», то Terra — правильный объект для сравнения, потому что Terra — это то, к чему большинство команд фактически обращается, когда не хочет платить цены Sol. Сравниваться с тем уровнем, который ваш клиент иначе бы купил, честнее, чем сравниваться с самой дорогой доступной моделью.

Сложность в том, что в том же предложении также утверждается, что производительность «вплотную приближается к элитным моделям». Эти две половины питча тянут в противоположные стороны. Если Fugu Max — это замена Terra, то подача как элитной модели выполняет маркетинговую работу, которую не может подкрепить, потому что Terra явно позиционируется не как элитная, а как уровень «достаточно хорошего». Если Fugu Max действительно вплотную приближается к Sol, то сравнение цен следовало бы проводить с Sol, где разрыв самый большой и выглядит наиболее выигрышно. Релиз, который в одном и том же абзаце делает агрессивное заявление о возможностях и осторожное сравнение цен, пытается усидеть на двух стульях, а читатель не может понять, какая из половин является несущей.

A two-column scoreboard titled "Fugu Max vs GPT-5.6 Sol - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Context not published, Modality not published, Benchmarks six wins with no figures. Right column GPT-5.6 Sol: Output price $20.00 / 1M, Input price $4.00 / 1M, Cached input discount on base rate, Context 1M tokens with 128K output, Modality text, image and file, Benchmarks 91.9% on Terminal-Bench 2.0. Footer reading "Fugu Max figures vendor-reported by Sakana AI. Sakana's 40-60% output claim names GPT-5.6 Terra at $2.00 / $12.00, not Sol.", with the OrcaRouter logo bottom-right.

Шесть бенчмарков, ни одной цифры и одно имя, которое должно вызвать вопрос

Половина презентации, посвящённая возможностям, опирается на список. Fugu Max «достигает лучшего общего результата» на Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Ни для одного из них не указаны оценки. SWEFish — это собственный внутренний бенчмарк Sakana по программированию, а значит, одна из шести побед измеряется на тесте, который написал сам вендор и который он не выпустил.

GPT-5.6 Sol приводит показатели. В данных сторонних сравнений Sol указан с 91,9% на Terminal-Bench 2.0 и 64,6% на SWE-bench Pro. Обратите внимание на несоответствие версий в терминальном бенчмарке: опубликованное число Sol относится к Terminal-Bench 2.0, а Sakana заявляет о победе на 2.1 — это другая оценка, и её нельзя сопоставлять с ним. Это стоит отметить, потому что в заголовке эти два утверждения выглядят соседними, а фактически несопоставимы.

Релевантным сравнением для этого противостояния было бы сопоставление Sol с моделью Fugu в рамках общего тестирования. Страницы сравнений от третьих сторон действительно содержат сопоставление GPT-5.6 Sol с базовым поколением Sakana Fugu — Sol впереди на Terminal-Bench 2.0 со счётом 91,9% против 80,2% и на SWE-bench Pro — 64,6% против 59% — но это показатели более раннего поколения, а не Fugu Max, и те же источники явно отказываются называть общего победителя, поскольку покрытие общих бенчмарков слишком скудное. Не существует опубликованного сравнения какого-либо рода между Fugu Max и GPT-5.6 Sol. Любой, кто это утверждает, занимается экстраполяцией.

Ни одна независимая сторона не оценивала Fugu Max, и ни для него, ни для какой-либо модели Fugu не существует записи в Artificial Analysis. Все числа в пресс-релизе, включая шесть побед, исходят от производителя. Sol, напротив, находится в общем доступе с 9 июля 2026 года и фигурирует в сторонних таблицах лидеров — уровень внешней проверки, который Fugu Max не имел возможности получить.

Что вы на самом деле покупаете с каждой стороны

Настройка GPT-5.6 Sol — хорошо изученный процесс. У неё контекстное окно на 1 млн токенов, потолок вывода 128K, ввод текста, изображений и файлов, vision, использование инструментов, режим JSON и reasoning в числе документированных возможностей, а также две конечные точки — chat completions и responses API — так что существующей интеграции есть куда двигаться. По обслуживаемому нами трафику она демонстрирует p50 времени до первого токена 6,68 секунды, что медленнее самых быстрых моделей в нашем каталоге, и это стоит знать, прежде чем строить на ней интерактивный продукт.

Настройка Fugu Max ближе к покупке уровня обслуживания, чем модели. Вы получаете одну конечную точку, совместимую с OpenAI, изменение параметра в одну строку для перехода на неё с более ранней версии Fugu, и координатор, который решает, какие модели вызывать. Чего вы не получаете со страницы релиза, так это контекстного окна, ограничения вывода, списка модальностей, показателя задержки или результата бенчмарка. Решения координатора по маршрутизации не раскрываются по замыслу. Пул в этом релизе расширился, включив модели с открытыми весами и специализированные модели, при этом семейство NVIDIA Nemotron названо в рамках сотрудничества с NVIDIA, а в остальном не раскрывается.

Озвученное Sakana обоснование этой непрозрачности имеет право на существование: пул, не привязанный к конкретному вендору и допускающий замену, — это защита от прекращения поддержки, изменения цен и ухода из отдельных регионов. Это настоящий хедж, а ставка $0,25 за кэшированный ввод позволяет предположить, что Sakana рассчитывает на рабочие нагрузки с длинным контекстом и высокой повторяемостью, где такой хедж имел бы наибольшее значение. Но это означает, что спецификация, которую вы покупаете, — это обещание о цепочке поставок, а не описание продукта.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Как запустить тест

Правильный способ разрешить этот вопрос — не читать страницы ни того, ни другого вендора. Возьмите выборку из своего собственного трафика — несколько сотен реальных запросов, в идеале включая те, которые ваша команда сейчас эскалирует, — и прогоните их через оба эндпоинта с включённым учётом токенов. Оценивайте их по токенам на завершённую задачу, а не по токенам на вызов, задайте бюджет вывода до начала, чтобы веерное выполнение не застало вас врасплох, и измеряйте качество по тому, согласен ли второй человек, что ответ приемлем. Этот эксперимент ответит на вопрос за неделю и потребует небольших затрат.

Сложность в том, что Fugu Max нет на OrcaRouter. Он доступен вам через собственный OpenAI-совместимый API Sakana и несколько сторонних платформ, а значит, нужна вторая интеграция, второй набор учётных данных и второй счёт. GPT-5.6 Sol есть в нашем каталоге по прайс-листовой цене Ope​nAI с наценкой 0% — тариф провайдера передаётся без наценки, поэтому изменение цен Ope​nAI вступает в силу на вашем существующем ключе в тот же день, с автоматическим переключением между путями провайдеров, когда один из них ограничен по скорости или недоступен. Он работает через тот же ключ, что и более 200 других моделей, поэтому когда пилот закончится, вы сохраните интеграцию и измените одну строку.

Суть

GPT-5.6 Sol выигрывает сравнение, которое Sakana отказалась проводить. Он стоит вдвое дороже на входе и более чем втрое дороже на выходе, а взамен вы получаете опубликованное контекстное окно, потолок вывода в 128K, задокументированный мультимодальный ввод, именованные теги возможностей, две конечные точки и вендорские бенчмарки, которые третьи стороны могли изучать месяцами. Если ваша работа — это то, для чего создавался Sol, — глубокое многошаговое рассуждение, крупномасштабная разработка ПО, длительные агентные задачи, — то разница в цене и есть стоимость покупки чего-то, что можно точно специфицировать.

Fugu Max выигрывает за счёт более узкой и по-настоящему интересной ставки, и при этом он с большим отрывом дешевле: на 50 процентов ниже GPT-5.6 Terra по выходу, на 70 процентов ниже Sol, с самой низкой ставкой кэша в любой из тарифных карт. Если ваш трафик — высокообъёмный, только текстовый, проверяемый и по большей части не требует рассуждений уровня флагмана, оркестратор, который направляет запросы к самой лёгкой достаточной модели, — это цельная схема, и именно в ставке $6.00 за выход заключается ценность. Воспринимайте собственную подачу релиза буквально и запускайте его в пилот как замену Terra, а не Sol, — а если вам нужен флагман с неизменённой прайсовой ценой провайдера, GPT-5.6 Sol — на расстоянии одного ключа на OrcaRouter.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol, captured September 11, 2026, English UI), showing the Featured badge, the openai/gpt-5.6-sol model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-09, the /v1/chat/completions and /v1/responses endpoints, the pricing tiles reading INPUT $4.00 and OUTPUT $20.00 per 1M tokens with p50 TTFT 6.68s and 153.0M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно