
Fugu Max против Qwen3.8-Max: та же цена, тот же бенчмарк, одно опубликованное число
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Fugu Max и Qwen3.8-Max указаны по одинаковому тарифу: 2,00 доллара США за миллион входных токенов и 6,00 доллара США за миллион выходных токенов. Sakana AI выпустила Fugu Max 11 сентября 2026 года, а Alibaba предоставляет Qwen3.8-Max с начала августа, и два вендора пришли к идентичной тарифной сетке с противоположных сторон — один назначает цену за политику маршрутизации, другой — за модель с 2,4 триллиона параметров. Такое равенство полностью убирает цену из процесса принятия решения, что делает ситуацию необычно чистой. Остаются доказательства, и именно здесь две стороны расходятся сильнее, чем где-либо ещё. В обеих таблицах вендоров упоминается Terminal Bench 2.1. Alibaba указывает 86,6 для Qwen3.8-Max. Sakana заявляет, что Fugu Max показывает лучший общий результат на Terminal Bench 2.1, и не приводит ни одной цифры — ни для этого теста, ни для остальных пяти, в которых, по её словам, побеждает.
Единственный ориентир, который называют обе стороны
Всё это противостояние сжато в одну строку, так что стоит быть точным.
В релизе Sakana перечислены шесть бенчмарков, по которым Fugu Max получает лучший общий балл: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Пять из них — признанные публичные тесты, а шестой, SWEFish, — собственный бенчмарк Sakana по программированию. Ни для одного из шести в релизе не указано ни значения, ни отрыва, ни показателя конкурента, который можно было бы привести рядом. Параллельное утверждение — что Fugu Max расширяет границу Парето по соотношению «стоимость–производительность» на семи из десяти бенчмарков — также является утверждением о положении на графике, а не о точке на оси.
В опубликованных Alibaba результатах для Qwen3.8-Max указаны Terminal-Bench 2.1 — 86,6, OSWorld-Verified — 86,1, GPQA Diamond — 92,6 и SWE-bench Pro — 67,7. Всё заявлено производителем, всё — числа. Так что по единственному тесту, который обе компании решили назвать, одна опубликовала число, а другая — ранг. Из этого нельзя заключить, какая система лучше, — «лучший в целом» у Sakana может означать и 91, и 87. Можно заключить, что на момент публикации ни одно публичное доказательство не отвечает на этот вопрос, а вендор, делающий более громкое заявление, — это тот, кто отказывается переводить его в числа.
Идентичные цены, противоположная конструкция
• Ввод — Fugu Max $2.00 за 1 млн токенов против Qwen3.8-Max $2.00 за 1 млн токенов
• Вывод — Fugu Max 6,00 $ за 1 млн токенов против Qwen3.8-Max 6,00 $ за 1 млн токенов
• Кэшированный ввод — Fugu Max $0,25 за 1 млн токенов против Qwen3.8-Max $0,25 за 1 млн токенов, и Artificial Analysis независимо измеряет 88-процентную скидку на кэш на стороне Qwen
• Надбавка за длинный промпт — у Fugu Max в релизе не указан уровень, тогда как Qwen3.8-Max — фиксированная цена до окна без надбавки
• Контекст и вывод — у Fugu Max ни один из показателей не опубликован, тогда как у Qwen3.8-Max — окно в 1M токенов с потолком вывода примерно в 128K.
• Модальность ввода — текст у Fugu Max, за которым стоят собственные возможности пула, против текста, изображений, видео и PDF у Qwen3.8-Max
• Архитектура — Fugu Max: обученный координатор над нераскрытым пулом, расширенный для Max с открытыми весами и специализированными моделями, включая семейство NVIDIA Nemotron, благодаря сотрудничеству с NVIDIA, против Qwen3.8-Max — одной разреженной модели смеси экспертов с примерно 2,4 трлн общих параметров и около 95 млрд активных на токен
• Веса — Fugu Max закрыты, членство в пуле не раскрывается намеренно, в отличие от Qwen3.8-Max: открытые веса опубликованы для чекпоинта класса Max по кастомной лицензии
• Независимая оценка — для Fugu Max ничего не опубликовано, и не существует страницы Artificial Analysis ни для одной модели Fugu, против Qwen3.8-Max — действующей записи Artificial Analysis с опубликованными показателями скорости, многословности и стоимости за задачу
В четырёх из этих строк на стороне Fugu написано «не опубликовано», а на стороне Qwen указана цифра. Когда тарифы одинаковы, этим всё сравнение и исчерпывается: за одни и те же деньги можно купить одну систему, которую вы можете описать, и одну, которую не можете.

За одной колонкой стоит третья сторона.
Artificial Analysis присуждает Qwen3.8-Max 40 баллов в пересмотренном индексе Intelligence Index v4.3, ставя его на 30-е место из 200, при стоимости $2,67 за задачу Intelligence Index и 37,8 выходных токенов в секунду — достаточно медленно, чтобы занять 154-е место из 200 по скорости. В той же записи указано 180 миллионов выходных токенов, сгенерированных в рамках индекса, что более чем вдвое превышает 89 миллионов у медианной модели, а также 88-процентная скидка на кэш.
Прежде чем что-либо из этого цитировать, нужно внести две поправки. Первая: широко разошедшаяся цифра 58 — или 58,1, или 58,4 — для Qwen3.8-Max относится ко времени до того, как Artificial Analysis перекалибровала индекс в сентябре 2026 года, а на актуальной странице стоит значок «Updated», который отмечает пересчитанный балл. В более старых материалах также фигурировал иной налог на усилия по прежней шкале: 64 хода на задачу против 14 у предыдущего поколения Qwen при примерно $1,14 за задачу Intelligence Index; текущая страница показывает $2,67. Вторая — это не артефакт шкалы, а настоящее предупреждение: Artificial Analysis отдельно измерила, что частота галлюцинаций у Qwen3.8-Max выросла с 23 до 40 процентов по сравнению с предыдущим поколением. Для модели, которую продвигают для автономной многошаговой работы, это издержки, которые нужно закладывать в бюджет верификаторов, а не сноска.
У Fugu Max нет независимой записи какого-либо рода. Каждая цифра, связанная с ним, исходит от Sakana, и на момент написания не существует страницы Artificial Analysis для Fugu Max или кого-либо из его собратьев. Это не обвинение — модель, выпущенная несколько часов назад, не будет иметь стороннего освещения — но это означает, что две колонки не одинаково поддаются проверке, и так будет оставаться до тех пор, пока кто-то за пределами Sakana не запустит эту штуку.
Два способа потратить слишком много
Обе эти системы отвязали стоимость ответа от стоимости токена, и делают это в противоположных направлениях. Qwen3.8-Max экономен по токенам и щедр на ответ: 180 миллионов выходных токенов в Intelligence Index, вдвое больше медианы, при $2,67 за задачу. Он работает долго, а не является большим, и 88-процентная скидка на кэш — это рычаг, управляющий счётом: длительный запуск агента, который продолжает перечитывать один и тот же контекст, остаётся дешёвым, а тот, который постоянно генерирует новый текст, — нет.
Fugu Max дорог по токенам и непредсказуем по ответу. Его координатор порождает субагентов, каждый из которых пишет рассуждения и выходной текст, оплачиваемые по $6.00 за миллион, плюс собственный синтез координатора. Sakana гарантирует, что за многоагентные запуски взимается единая смешанная ставка, привязанная к участвующей модели верхнего уровня, и что добавление агентов не умножает счёт, что устраняет в худшем случае разрастание веерного разветвления, из-за которого наивные многоагентные системы становятся неподъёмно дорогими. Это не устраняет объём. И по вопросу объёма релиз молчит, и это важно: в собственных материалах Sakana говорится, что смена моделей в середине задачи может снизить повторное использование кэша контекста и породить дополнительные токены оркестрации, и подтверждается, что компания не раскрыла частоту попаданий в кэш Max или его общую стоимость токенов на задачу.
Итак, одна и та же ставка $2.00 / $6.00 с одной стороны — предсказуемое число, а с другой — неограниченный множитель с нижней границей. Многословность Qwen3.8-Max можно измерить до того, как вы примете решение; у Fugu Max — нет.
Тест аварийного выхода
Именно здесь привычный аргумент о привязке переворачивается, и это самое полезное в таком сочетании.
Аргумент Sakana в пользу Fugu Max — это устойчивость. Пул, охватывающий открытые веса и специализированные модели, расширенный для Max с помощью семейства NVIDIA Nemotron, означает, что ни прекращение поддержки, ни пересмотр цен, ни уход из региона какого-либо одного передового поставщика не смогут обрушить ваш продукт — настоящий хедж, и компания прямо говорит, что продаёт именно его. Но этот хедж невозможно проверить извне. Вы не можете увидеть пул, не можете включить или исключить его участника, не можете развернуть что-либо из этого на своих мощностях и вообще не можете запускать это в ЕС/ЕЭЗ. Обещание насчёт пула, который вам не разрешено инспектировать, — более слабая гарантия, чем кажется.
Qwen3.8-Max разворачивает аргумент в другую сторону. Это модель одного вендора и потому подвержена решениям одного вендора — но Alibaba опубликовала открытые веса для чекпоинта Qwen3.8-2.4T-A95B класса Max по специальной лицензии, а значит, лазейка реальна, а не риторична: если цены или условия изменятся, модель можно будет запускать на собственной инфраструктуре. Для команды, которая на самом деле боится, что вендор выдернет ковёр из-под ног, скачиваемый чекпоинт лучше описания пула.
Вызов любого из них
Qwen3.8-Max есть в нашем каталоге по цене $2,00 за вход и $6,00 за выход за миллион токенов, что представляет собой цену Alibaba из прайс-листа, передаваемую с наценкой 0%, поэтому изменение цены поставщиком отражается на том же ключе в тот же день, а не по графику миграции. Он совместим с OpenAI по тому же базовому URL, что и остальной каталог, а значит, вы можете поставить его за условным правилом маршрутизации, цепочкой аварийного переключения или панелью объединения моделей без второго договора или изменения кода — а автоматическое переключение при сбое покрывает маршрут провайдера с ограничением скорости или деградацией. Он провёл через шлюз 127,7 млн токенов за последние семь дней.
Fugu Max нет на OrcaRouter. Он доходит до вас через собственный API Sakana, совместимый с OpenAI, и несколько сторонних платформ, и компания заявляет, что существующая интеграция Fugu обновляется изменением одного параметра в строке. Поскольку оба используют один и тот же формат запросов, самый дешёвый способ уладить разрыв в бенчмарках — перестать ждать, пока Sakana его опубликует: запустить оба под одним флагом на вашей собственной рабочей нагрузке и подсчитывать выходные токены на каждую выполненную задачу. Именно это измерение не предоставил ни один из поставщиков.

Какой именно, и когда
Qwen3.8-Max — это выбор, который можно проверить аудитом, оценить по цене и от которого можно отказаться. По той же тарифной сетке он даёт окно в 1 млн токенов без надбавки за длинные промпты, ввод изображений, видео и PDF, скачиваемый чекпоинт класса Max, живую независимую запись, измеряющую то, что влияет на ваш счёт, и скидку 88% на кэшированный ввод. Его издержки столь же конкретны: он медленный — 37,8 токена в секунду, занимает одно из последних мест среди участников по скорости, он чрезвычайно многословен — 180 млн токенов в индексе, а измеренная частота галлюцинаций примерно удвоилась по сравнению с предыдущим поколением, что вызывает серьёзную озабоченность именно в той автономной работе, для которой его продают. Активно используйте скидку на кэш и предусмотрите в бюджете верификатор.
Fugu Max — это ставка на то, что координация побеждает возможности. Если ваша работа долгосрочна и проверяема, а координатор, который порождает верификатора, завершает задачи, на которых одиночная модель дважды терпит неудачу, то токены оркестрации дешевле повторных попыток, и идентичная тарифная сетка — вовсе не ничья. То, что вы покупаете, — это настойчивость, в системе, чей пул вы не можете закрепить, чьё контекстное окно не опубликовано и чьи шесть побед в бенчмарках не сопровождаются значениями — от поставщика, который решил назвать тест и скрыть число.
Оба продукта стоят одинаково за токен. Только один из них говорит, что именно вы получаете за эти деньги.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
