Титульная карточка с надписью «Fugu Max против Qwen3.8-Max» и подзаголовком «Та же цена, тот же бенчмарк, одна цифра», три бейджа-пилюли с надписями «$2.00 / $6.00 у обоих», «Terminal Bench 2.1: 86.6 против не указано» и «Независимая оценка: нет данных против 40», строка нижнего колонтитула «Sakana AI, сентябрь 2026 против Alibaba, август 2026», а также логотип OrcaRouter в правом нижнем углу.
Guides & Insights

Fugu Max против Qwen3.8-Max: та же цена, тот же бенчмарк, одно опубликованное число

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Fugu Max и Qwen3.8-Max указаны по одинаковому тарифу: 2,00 доллара США за миллион входных токенов и 6,00 доллара США за миллион выходных токенов. Sakana AI выпустила Fugu Max 11 сентября 2026 года, а Ali​baba предоставляет Qwen3.8-Max с начала августа, и два вендора пришли к идентичной тарифной сетке с противоположных сторон — один назначает цену за политику маршрутизации, другой — за модель с 2,4 триллиона параметров. Такое равенство полностью убирает цену из процесса принятия решения, что делает ситуацию необычно чистой. Остаются доказательства, и именно здесь две стороны расходятся сильнее, чем где-либо ещё. В обеих таблицах вендоров упоминается Terminal Bench 2.1. Ali​baba указывает 86,6 для Qwen3.8-Max. Sakana заявляет, что Fugu Max показывает лучший общий результат на Terminal Bench 2.1, и не приводит ни одной цифры — ни для этого теста, ни для остальных пяти, в которых, по её словам, побеждает.

Единственный ориентир, который называют обе стороны

Всё это противостояние сжато в одну строку, так что стоит быть точным.

В релизе Sakana перечислены шесть бенчмарков, по которым Fugu Max получает лучший общий балл: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Пять из них — признанные публичные тесты, а шестой, SWEFish, — собственный бенчмарк Sakana по программированию. Ни для одного из шести в релизе не указано ни значения, ни отрыва, ни показателя конкурента, который можно было бы привести рядом. Параллельное утверждение — что Fugu Max расширяет границу Парето по соотношению «стоимость–производительность» на семи из десяти бенчмарков — также является утверждением о положении на графике, а не о точке на оси.

В опубликованных Alibaba результатах для Qwen3.8-Max указаны Terminal-Bench 2.1 — 86,6, OSWorld-Verified — 86,1, GPQA Diamond — 92,6 и SWE-bench Pro — 67,7. Всё заявлено производителем, всё — числа. Так что по единственному тесту, который обе компании решили назвать, одна опубликовала число, а другая — ранг. Из этого нельзя заключить, какая система лучше, — «лучший в целом» у Sakana может означать и 91, и 87. Можно заключить, что на момент публикации ни одно публичное доказательство не отвечает на этот вопрос, а вендор, делающий более громкое заявление, — это тот, кто отказывается переводить его в числа.

Идентичные цены, противоположная конструкция

• Ввод — Fugu Max $2.00 за 1 млн токенов против Qwen3.8-Max $2.00 за 1 млн токенов

• Вывод — Fugu Max 6,00 $ за 1 млн токенов против Qwen3.8-Max 6,00 $ за 1 млн токенов

• Кэшированный ввод — Fugu Max $0,25 за 1 млн токенов против Qwen3.8-Max $0,25 за 1 млн токенов, и Artificial Analysis независимо измеряет 88-процентную скидку на кэш на стороне Qw​en

• Надбавка за длинный промпт — у Fugu Max в релизе не указан уровень, тогда как Qwen3.8-Max — фиксированная цена до окна без надбавки

• Контекст и вывод — у Fugu Max ни один из показателей не опубликован, тогда как у Qwen3.8-Max — окно в 1M токенов с потолком вывода примерно в 128K.

• Модальность ввода — текст у Fugu Max, за которым стоят собственные возможности пула, против текста, изображений, видео и PDF у Qwen3.8-Max

• Архитектура — Fugu Max: обученный координатор над нераскрытым пулом, расширенный для Max с открытыми весами и специализированными моделями, включая семейство NVIDIA Nemotron, благодаря сотрудничеству с NVIDIA, против Qwen3.8-Max — одной разреженной модели смеси экспертов с примерно 2,4 трлн общих параметров и около 95 млрд активных на токен

• Веса — Fugu Max закрыты, членство в пуле не раскрывается намеренно, в отличие от Qwen3.8-Max: открытые веса опубликованы для чекпоинта класса Max по кастомной лицензии

• Независимая оценка — для Fugu Max ничего не опубликовано, и не существует страницы Artificial Analysis ни для одной модели Fugu, против Qwen3.8-Max — действующей записи Artificial Analysis с опубликованными показателями скорости, многословности и стоимости за задачу

В четырёх из этих строк на стороне Fugu написано «не опубликовано», а на стороне Qw​en указана цифра. Когда тарифы одинаковы, этим всё сравнение и исчерпывается: за одни и те же деньги можно купить одну систему, которую вы можете описать, и одну, которую не можете.

A two-column scoreboard titled 'Fugu Max vs Qwen3.8-Max - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, Terminal Bench 2.1 best with no figure, evidence vendor-reported only. Qwen3.8-Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context 1M with a 128K output ceiling, Terminal Bench 2.1 at 86.6, evidence Artificial Analysis Index 40 and $2.67 per task. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Qwen3.8-Max rows Alibaba-reported and per Artificial Analysis.' OrcaRouter logo bottom-right.

За одной колонкой стоит третья сторона.

Artificial Analysis присуждает Qwen3.8-Max 40 баллов в пересмотренном индексе Intelligence Index v4.3, ставя его на 30-е место из 200, при стоимости $2,67 за задачу Intelligence Index и 37,8 выходных токенов в секунду — достаточно медленно, чтобы занять 154-е место из 200 по скорости. В той же записи указано 180 миллионов выходных токенов, сгенерированных в рамках индекса, что более чем вдвое превышает 89 миллионов у медианной модели, а также 88-процентная скидка на кэш.

Прежде чем что-либо из этого цитировать, нужно внести две поправки. Первая: широко разошедшаяся цифра 58 — или 58,1, или 58,4 — для Qwen3.8-Max относится ко времени до того, как Artificial Analysis перекалибровала индекс в сентябре 2026 года, а на актуальной странице стоит значок «Updated», который отмечает пересчитанный балл. В более старых материалах также фигурировал иной налог на усилия по прежней шкале: 64 хода на задачу против 14 у предыдущего поколения Qwen при примерно $1,14 за задачу Intelligence Index; текущая страница показывает $2,67. Вторая — это не артефакт шкалы, а настоящее предупреждение: Artificial Analysis отдельно измерила, что частота галлюцинаций у Qwen3.8-Max выросла с 23 до 40 процентов по сравнению с предыдущим поколением. Для модели, которую продвигают для автономной многошаговой работы, это издержки, которые нужно закладывать в бюджет верификаторов, а не сноска.

У Fugu Max нет независимой записи какого-либо рода. Каждая цифра, связанная с ним, исходит от Sakana, и на момент написания не существует страницы Artificial Analysis для Fugu Max или кого-либо из его собратьев. Это не обвинение — модель, выпущенная несколько часов назад, не будет иметь стороннего освещения — но это означает, что две колонки не одинаково поддаются проверке, и так будет оставаться до тех пор, пока кто-то за пределами Sakana не запустит эту штуку.

Два способа потратить слишком много

Обе эти системы отвязали стоимость ответа от стоимости токена, и делают это в противоположных направлениях. Qwen3.8-Max экономен по токенам и щедр на ответ: 180 миллионов выходных токенов в Intelligence Index, вдвое больше медианы, при $2,67 за задачу. Он работает долго, а не является большим, и 88-процентная скидка на кэш — это рычаг, управляющий счётом: длительный запуск агента, который продолжает перечитывать один и тот же контекст, остаётся дешёвым, а тот, который постоянно генерирует новый текст, — нет.

Fugu Max дорог по токенам и непредсказуем по ответу. Его координатор порождает субагентов, каждый из которых пишет рассуждения и выходной текст, оплачиваемые по $6.00 за миллион, плюс собственный синтез координатора. Sakana гарантирует, что за многоагентные запуски взимается единая смешанная ставка, привязанная к участвующей модели верхнего уровня, и что добавление агентов не умножает счёт, что устраняет в худшем случае разрастание веерного разветвления, из-за которого наивные многоагентные системы становятся неподъёмно дорогими. Это не устраняет объём. И по вопросу объёма релиз молчит, и это важно: в собственных материалах Sakana говорится, что смена моделей в середине задачи может снизить повторное использование кэша контекста и породить дополнительные токены оркестрации, и подтверждается, что компания не раскрыла частоту попаданий в кэш Max или его общую стоимость токенов на задачу.

Итак, одна и та же ставка $2.00 / $6.00 с одной стороны — предсказуемое число, а с другой — неограниченный множитель с нижней границей. Многословность Qwen3.8-Max можно измерить до того, как вы примете решение; у Fugu Max — нет.

Тест аварийного выхода

Именно здесь привычный аргумент о привязке переворачивается, и это самое полезное в таком сочетании.

Аргумент Sakana в пользу Fugu Max — это устойчивость. Пул, охватывающий открытые веса и специализированные модели, расширенный для Max с помощью семейства NVIDIA Nemotron, означает, что ни прекращение поддержки, ни пересмотр цен, ни уход из региона какого-либо одного передового поставщика не смогут обрушить ваш продукт — настоящий хедж, и компания прямо говорит, что продаёт именно его. Но этот хедж невозможно проверить извне. Вы не можете увидеть пул, не можете включить или исключить его участника, не можете развернуть что-либо из этого на своих мощностях и вообще не можете запускать это в ЕС/ЕЭЗ. Обещание насчёт пула, который вам не разрешено инспектировать, — более слабая гарантия, чем кажется.

Qwen3.8-Max разворачивает аргумент в другую сторону. Это модель одного вендора и потому подвержена решениям одного вендора — но Alibaba опубликовала открытые веса для чекпоинта Qwen3.8-2.4T-A95B класса Max по специальной лицензии, а значит, лазейка реальна, а не риторична: если цены или условия изменятся, модель можно будет запускать на собственной инфраструктуре. Для команды, которая на самом деле боится, что вендор выдернет ковёр из-под ног, скачиваемый чекпоинт лучше описания пула.

Вызов любого из них

Qwen3.8-Max есть в нашем каталоге по цене $2,00 за вход и $6,00 за выход за миллион токенов, что представляет собой цену Alibaba из прайс-листа, передаваемую с наценкой 0%, поэтому изменение цены поставщиком отражается на том же ключе в тот же день, а не по графику миграции. Он совместим с OpenAI по тому же базовому URL, что и остальной каталог, а значит, вы можете поставить его за условным правилом маршрутизации, цепочкой аварийного переключения или панелью объединения моделей без второго договора или изменения кода — а автоматическое переключение при сбое покрывает маршрут провайдера с ограничением скорости или деградацией. Он провёл через шлюз 127,7 млн токенов за последние семь дней.

Fugu Max нет на OrcaRouter. Он доходит до вас через собственный API Sakana, совместимый с OpenAI, и несколько сторонних платформ, и компания заявляет, что существующая интеграция Fugu обновляется изменением одного параметра в строке. Поскольку оба используют один и тот же формат запросов, самый дешёвый способ уладить разрыв в бенчмарках — перестать ждать, пока Sakana его опубликует: запустить оба под одним флагом на вашей собственной рабочей нагрузке и подсчитывать выходные токены на каждую выполненную задачу. Именно это измерение не предоставил ни один из поставщиков.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the argument that the industry has raced along a single axis of bigger and more expensive foundation models while the frontier that matters is two-dimensional, capability on one axis and cost on the other.

Какой именно, и когда

Qwen3.8-Max — это выбор, который можно проверить аудитом, оценить по цене и от которого можно отказаться. По той же тарифной сетке он даёт окно в 1 млн токенов без надбавки за длинные промпты, ввод изображений, видео и PDF, скачиваемый чекпоинт класса Max, живую независимую запись, измеряющую то, что влияет на ваш счёт, и скидку 88% на кэшированный ввод. Его издержки столь же конкретны: он медленный — 37,8 токена в секунду, занимает одно из последних мест среди участников по скорости, он чрезвычайно многословен — 180 млн токенов в индексе, а измеренная частота галлюцинаций примерно удвоилась по сравнению с предыдущим поколением, что вызывает серьёзную озабоченность именно в той автономной работе, для которой его продают. Активно используйте скидку на кэш и предусмотрите в бюджете верификатор.

Fugu Max — это ставка на то, что координация побеждает возможности. Если ваша работа долгосрочна и проверяема, а координатор, который порождает верификатора, завершает задачи, на которых одиночная модель дважды терпит неудачу, то токены оркестрации дешевле повторных попыток, и идентичная тарифная сетка — вовсе не ничья. То, что вы покупаете, — это настойчивость, в системе, чей пул вы не можете закрепить, чьё контекстное окно не опубликовано и чьи шесть побед в бенчмарках не сопровождаются значениями — от поставщика, который решил назвать тест и скрыть число.

Оба продукта стоят одинаково за токен. Только один из них говорит, что именно вы получаете за эти деньги.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (English UI, captured September 11, 2026), showing the Featured badge, the identifier qwen/qwen3.8-max, by Qwen dated 2026-08-03, vision, tools, JSON and reasoning capability tags, a 1M-token context window with text, image and video input, list pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens, a p50 TTFT of 10.00 seconds, traffic of 127.7 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно