
Fugu Max против GPT-5.6 Sol: заявление о ценах было нацелено на середину линейки
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Fugu Max's price justification names a GPT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same OpenAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.
Проверяем утверждение на соответствие семейству, на которое оно указывает.
Цифра Sakana в 40–60 процентов поддаётся проверке, потому что у модели, которую она называет, есть опубликованный тариф. GPT-5.6 Terra указана по цене $2.00 за вход и $12.00 за выход за миллион токенов. Fugu Max указана по цене $2.00 за вход и $6.00 за выход. Проведите сравнение — и обнаруживаются две вещи. По выходу $6.00 против $12.00 — это снижение ровно на 50 процентов, точно в середине заявленного диапазона 40–60, что служит признаком того, что диапазон был очерчен вокруг этого сравнения, а не выведен из него. По входу обе ставки идентичны до цента.
That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the GPT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.
• Цена ввода — Fugu Max $2.00 за 1 млн токенов против GPT-5.6 Sol $4.00 за 1 млн токенов
• Цена вывода — Fugu Max $6.00 за 1 млн токенов против GPT-5.6 Sol $20.00 за 1 млн токенов
• Кэшированный ввод — Fugu Max: $0.25 за 1 млн токенов, тогда как в GPT-5.6 Sol кэширование тарифицируется как скидка к базовой ставке за ввод
• Контекст — Fugu Max не опубликован по сравнению с GPT-5.6 Sol 1M токенов
• Максимальный объём вывода — у Fugu Max не опубликован, у GPT-5.6 Sol — 128K токенов
• Модальность ввода — Fugu Max: не опубликовано, против GPT-5.6 Sol: текст, изображение и файл
• Теги возможностей — у Fugu Max ничего не опубликовано, в отличие от GPT-5.6 Sol: зрение, использование инструментов, режим JSON, рассуждение
• Эндпоинты — Fugu Max: одна совместимая с OpenAI поверхность против chat completions и responses API у GPT-5.6 Sol
• Показатели бенчмарков — шесть побед Fugu Max заявлены без оценок против опубликованных производителем показателей GPT-5.6 Sol, включая Terminal-Bench 2.0 на 91,9% и SWE-bench Pro на 64,6%.
Почему средняя ступень — правильная ступень, которую стоит назвать
Есть оправданная версия выбора Sakana, и её стоит изложить до критики. Оркестратор, который направляет каждую задачу к самой экономной из подходящих моделей, не конкурирует с флагманом в работе уровня флагмана. Он конкурирует с моделью среднего уровня в задачах среднего уровня и предлагает выполнить часть этой работы дешевле. Если посыл таков: «большинство вашего трафика не нуждается в Sol», то Terra — правильный объект для сравнения, потому что Terra — это то, к чему большинство команд фактически обращается, когда не хочет платить цены Sol. Сравниваться с тем уровнем, который ваш клиент иначе бы купил, честнее, чем сравниваться с самой дорогой доступной моделью.
Сложность в том, что в том же предложении также утверждается, что производительность «вплотную приближается к элитным моделям». Эти две половины питча тянут в противоположные стороны. Если Fugu Max — это замена Terra, то подача как элитной модели выполняет маркетинговую работу, которую не может подкрепить, потому что Terra явно позиционируется не как элитная, а как уровень «достаточно хорошего». Если Fugu Max действительно вплотную приближается к Sol, то сравнение цен следовало бы проводить с Sol, где разрыв самый большой и выглядит наиболее выигрышно. Релиз, который в одном и том же абзаце делает агрессивное заявление о возможностях и осторожное сравнение цен, пытается усидеть на двух стульях, а читатель не может понять, какая из половин является несущей.

Шесть бенчмарков, ни одной цифры и одно имя, которое должно вызвать вопрос
Половина презентации, посвящённая возможностям, опирается на список. Fugu Max «достигает лучшего общего результата» на Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Ни для одного из них не указаны оценки. SWEFish — это собственный внутренний бенчмарк Sakana по программированию, а значит, одна из шести побед измеряется на тесте, который написал сам вендор и который он не выпустил.
GPT-5.6 Sol приводит показатели. В данных сторонних сравнений Sol указан с 91,9% на Terminal-Bench 2.0 и 64,6% на SWE-bench Pro. Обратите внимание на несоответствие версий в терминальном бенчмарке: опубликованное число Sol относится к Terminal-Bench 2.0, а Sakana заявляет о победе на 2.1 — это другая оценка, и её нельзя сопоставлять с ним. Это стоит отметить, потому что в заголовке эти два утверждения выглядят соседними, а фактически несопоставимы.
Релевантным сравнением для этого противостояния было бы сопоставление Sol с моделью Fugu в рамках общего тестирования. Страницы сравнений от третьих сторон действительно содержат сопоставление GPT-5.6 Sol с базовым поколением Sakana Fugu — Sol впереди на Terminal-Bench 2.0 со счётом 91,9% против 80,2% и на SWE-bench Pro — 64,6% против 59% — но это показатели более раннего поколения, а не Fugu Max, и те же источники явно отказываются называть общего победителя, поскольку покрытие общих бенчмарков слишком скудное. Не существует опубликованного сравнения какого-либо рода между Fugu Max и GPT-5.6 Sol. Любой, кто это утверждает, занимается экстраполяцией.
Ни одна независимая сторона не оценивала Fugu Max, и ни для него, ни для какой-либо модели Fugu не существует записи в Artificial Analysis. Все числа в пресс-релизе, включая шесть побед, исходят от производителя. Sol, напротив, находится в общем доступе с 9 июля 2026 года и фигурирует в сторонних таблицах лидеров — уровень внешней проверки, который Fugu Max не имел возможности получить.
Что вы на самом деле покупаете с каждой стороны
Настройка GPT-5.6 Sol — хорошо изученный процесс. У неё контекстное окно на 1 млн токенов, потолок вывода 128K, ввод текста, изображений и файлов, vision, использование инструментов, режим JSON и reasoning в числе документированных возможностей, а также две конечные точки — chat completions и responses API — так что существующей интеграции есть куда двигаться. По обслуживаемому нами трафику она демонстрирует p50 времени до первого токена 6,68 секунды, что медленнее самых быстрых моделей в нашем каталоге, и это стоит знать, прежде чем строить на ней интерактивный продукт.
Настройка Fugu Max ближе к покупке уровня обслуживания, чем модели. Вы получаете одну конечную точку, совместимую с OpenAI, изменение параметра в одну строку для перехода на неё с более ранней версии Fugu, и координатор, который решает, какие модели вызывать. Чего вы не получаете со страницы релиза, так это контекстного окна, ограничения вывода, списка модальностей, показателя задержки или результата бенчмарка. Решения координатора по маршрутизации не раскрываются по замыслу. Пул в этом релизе расширился, включив модели с открытыми весами и специализированные модели, при этом семейство NVIDIA Nemotron названо в рамках сотрудничества с NVIDIA, а в остальном не раскрывается.
Озвученное Sakana обоснование этой непрозрачности имеет право на существование: пул, не привязанный к конкретному вендору и допускающий замену, — это защита от прекращения поддержки, изменения цен и ухода из отдельных регионов. Это настоящий хедж, а ставка $0,25 за кэшированный ввод позволяет предположить, что Sakana рассчитывает на рабочие нагрузки с длинным контекстом и высокой повторяемостью, где такой хедж имел бы наибольшее значение. Но это означает, что спецификация, которую вы покупаете, — это обещание о цепочке поставок, а не описание продукта.

Как запустить тест
Правильный способ разрешить этот вопрос — не читать страницы ни того, ни другого вендора. Возьмите выборку из своего собственного трафика — несколько сотен реальных запросов, в идеале включая те, которые ваша команда сейчас эскалирует, — и прогоните их через оба эндпоинта с включённым учётом токенов. Оценивайте их по токенам на завершённую задачу, а не по токенам на вызов, задайте бюджет вывода до начала, чтобы веерное выполнение не застало вас врасплох, и измеряйте качество по тому, согласен ли второй человек, что ответ приемлем. Этот эксперимент ответит на вопрос за неделю и потребует небольших затрат.
Сложность в том, что Fugu Max нет на OrcaRouter. Он доступен вам через собственный OpenAI-совместимый API Sakana и несколько сторонних платформ, а значит, нужна вторая интеграция, второй набор учётных данных и второй счёт. GPT-5.6 Sol есть в нашем каталоге по прайс-листовой цене OpenAI с наценкой 0% — тариф провайдера передаётся без наценки, поэтому изменение цен OpenAI вступает в силу на вашем существующем ключе в тот же день, с автоматическим переключением между путями провайдеров, когда один из них ограничен по скорости или недоступен. Он работает через тот же ключ, что и более 200 других моделей, поэтому когда пилот закончится, вы сохраните интеграцию и измените одну строку.
Суть
GPT-5.6 Sol выигрывает сравнение, которое Sakana отказалась проводить. Он стоит вдвое дороже на входе и более чем втрое дороже на выходе, а взамен вы получаете опубликованное контекстное окно, потолок вывода в 128K, задокументированный мультимодальный ввод, именованные теги возможностей, две конечные точки и вендорские бенчмарки, которые третьи стороны могли изучать месяцами. Если ваша работа — это то, для чего создавался Sol, — глубокое многошаговое рассуждение, крупномасштабная разработка ПО, длительные агентные задачи, — то разница в цене и есть стоимость покупки чего-то, что можно точно специфицировать.
Fugu Max выигрывает за счёт более узкой и по-настоящему интересной ставки, и при этом он с большим отрывом дешевле: на 50 процентов ниже GPT-5.6 Terra по выходу, на 70 процентов ниже Sol, с самой низкой ставкой кэша в любой из тарифных карт. Если ваш трафик — высокообъёмный, только текстовый, проверяемый и по большей части не требует рассуждений уровня флагмана, оркестратор, который направляет запросы к самой лёгкой достаточной модели, — это цельная схема, и именно в ставке $6.00 за выход заключается ценность. Воспринимайте собственную подачу релиза буквально и запускайте его в пилот как замену Terra, а не Sol, — а если вам нужен флагман с неизменённой прайсовой ценой провайдера, GPT-5.6 Sol — на расстоянии одного ключа на OrcaRouter.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
