
Fugu Ultra v2 против MiniMax M3: цена вывода в двадцать пять раз выше
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Поставьте две выходные цены рядом — и число будет выглядеть как опечатка. MiniMax M3 берёт $1,20 за миллион выходных токенов. Fugu Ultra v2, анонсированная Sakana AI 11 сентября 2026 года, заявлена по цене $30,00. Это в 25 раз — а на входе разрыв составляет 16,7 раза: $0,30 против заявленных $5,00. MiniMax M3 к тому же быстрее, нативно принимает видео и поставляется в виде скачиваемых открытых весов. Столкнувшись с такой таблицей, разумная первая реакция — что оркестрационный уровень никак не может оправдать свою цену. Куда более интересный вопрос — что должно было бы быть верно, чтобы он её оправдал.
Разрыв, если сказать прямо
• Ввод — MiniMax M3 $0,30 за 1 млн против Fugu Ultra v2 с заявленными $5,00 за 1 млн. Ставку M3 компания MiniMax называет бессрочной скидкой 50%, а не промоакцией с истекающим сроком.
• Вывод — MiniMax M3 $1.20 за 1 млн против Fugu Ultra v2 — заявленные $30.00 за 1 млн.
• Кэшированный ввод — MiniMax M3: $0,06 за 1 млн против заявленных $0,50 за 1 млн у Fugu Ultra v2. Чтение из кэша у M3 составляет пятую часть цены её собственного ввода, что делает повторные агентные циклы по стабильному промпту необычайно дешёвыми.
• Свыше 512K входных данных — MiniMax M3 удваивается до $0.60 / $2.40 / $0.12. Заявленный тариф Fugu Ultra v2 выше примерно 272K повышается до около $10.00 / $45.00 / $1.00. Оба пересчитывают стоимость всего запроса; M3 вступает в силу позже и достигает лишь доли этой ставки.
• Контекст — MiniMax M3: 1 048 576 токенов при гарантированном поставщиком минимуме 512 тыс. Контекст Fugu Ultra v2, по данным сторонних каталогов, заявлен как 1 млн; на странице анонса Sakana цифра не указана.
Одна оговорка по столбцу Fugu, и она немаленькая: Sakana не публикует тарифы на токены для Fugu Ultra v2 на своей странице с анонсом. Цифры $5.00 / $0.50 / $30.00 взяты из сторонних каталогов моделей, и к ним следует относиться как к неподтверждённым, пока вы не проверите актуальную тарифную карту. Столбец M3, напротив, документирован поставщиком. Само это различие в происхождении данных — часть сравнения.

Что M3 делает нативно, а оркестратору приходится маршрутизировать
MiniMax M3 принимает на вход текст, изображения и видео и возвращает текст. Видео — самое примечательное. Модель обучалась на смешанных модальностях с нулевого шага, и она построена на MiniMax Sparse Attention — архитектуре, которая, как утверждает производитель, обеспечивает до 9× более быстрый prefill и 15× более быстрый decode при контексте 1M по сравнению с предшественницей, при примерно одной двадцатой вычислений на токен.
Это важно в этом противостоянии, потому что это возможность, которую Fugu Ultra v2 себе не приписывает. Ответ оркестратора на «обработай это видео» — направить видео модели, которая может его увидеть, а это означает дополнительный вызов, а значит, больше токенов, тарифицируемых по ставке оркестратора. Ответ M3 — просто прочитать его. При входной цене $0.30 час анализа видео — это погрешность округления; при $5.00 на входе плюс всё, что стоит маршрутизация, это уже статья бюджета.
Сравнение архитектур тоже перекошено, только иначе. У MiniMax M3 примерно 428 млрд общих параметров при около 23 млрд активных на каждый токен — это архитектура Mixture-of-Experts, в которой разреженная маршрутизация помогает удерживать низкую стоимость обслуживания. У Fugu Ultra v2 число параметров не опубликовано, потому что её возможности заключены не в весах, обученных Sakana, а в политике планирования над моделями других компаний. Одно из этого — модель. Другое — процедура принятия решений.
Неудобный подтекст
Вот что стоит обдумать, прежде чем платить в 25 раз больше за результат.
MiniMax M3 — это модель с открытыми весами, дешёвая, быстрая, мультимодальная и с длинным контекстом. На бумаге это превосходный субагент. Если бы вы строили слой оркестрации с нуля — а именно им и является Fugu Ultra v2, — такая модель, как M3, была бы близка к идеальному компоненту: достаточно дешёвая, чтобы вызывать её спекулятивно, достаточно способная, чтобы справляться с основной массой декомпозированных подзадач, и способная видеть изображения и видео без второго перехода.
Sakana не публикует пул моделей Fugu Ultra v2, поэтому мы не можем сказать, входит ли в него M3. Что мы можем сказать, так это то, что экономика имеет смысл только в одном из двух случаев. Либо Fugu Ultra v2 не вызывает такие модели, как M3, и тогда он упускает самую дешёвую подходящую вычислительную мощность. Либо он их вызывает, и тогда значительная доля токенов, за которые с вас берут $5.00 и $30.00, — это токены M3, которые выше по цепочке стоят $0.30 и $1.20, а надбавка — это плата за политику оркестрации плюс маржа.
Ни одна из этих трактовок не фатальна для продукта — хороший планировщик может окупаться многократно, а покупка готового избавляет вас от необходимости создавать и поддерживать его самостоятельно. Но это означает, что вопрос, который стоит задавать о Fugu Ultra v2, — не «лучше ли он, чем M3», а «стоит ли планирование больше, чем токены». И ответ на этот вопрос могут дать только ваши собственные измерения задач.
Нет общего бенчмарка
В отличие от некоторых других противостояний в этой серии, не существует ни одного бенчмарка, по которому оба производителя публиковали бы показатель.
Опубликованный набор результатов MiniMax для M3 обширен и в основном воспроизводим по структуре: SWE-bench Verified — 80,5%, SWE-bench Pro — 59,0%, Terminal-Bench 2.0/2.1 — 66, BrowseComp — 83,5%, OSWorld-Verified — 70,1%, PostTrainBench — 37,1 — третье место, после Claude Opus 4.7 с 42,4 и GPT-5.5 с 39,3. Все данные сообщены производителем. По независимой оценке, Artificial Analysis оценивает MiniMax M3 в 30 баллов по своему v4.3 Intelligence Index, где она занимает #16 из 113, при пропускной способности 95,7 токенов в секунду и времени до первого токена 1,95 секунды — быстро, и это одна из моделей своего класса с лучшим обслуживанием. Если вы видели, что M3 указывают на 44 или 45, это относится ко времени до пересмотра индекса.
Восемь бенчмарков Sakana для Fugu Ultra v2 — среди них GDP.pdf, Chartography, SWEFish, DeepSWE и Toolathon, с лучшим или совместно лучшим результатом в пяти и местом в топ-2 в семи, — вообще не пересекаются с этим списком. Два из них, SWEFish и Toolathon, — внутренние тесты Sakana. Основные заявления — Chartography с 48,3 против 27,3 у Opus 5 и 29,5 у Fable 5, а также DeepSWE с 74,3 — сообщены производителем и были опубликованы сегодня. Ничто в Fugu Ultra v2 не было независимо проверено.
Итак, сравнение, которое каждый агрегатор выпустит в ближайшие две недели, — таблица общих оценок, — недоступно. Единственное, что можно честно сказать о возможностях, — это то, что MiniMax M3 имеет измеренную независимую позицию, а Fugu Ultra v2 — лишь заявление.

Скорость против конфигурации
Цифры MiniMax M3 известны: 95,7 токена в секунду, 1,95 секунды до первого токена. Это примерно в два с половиной раза больше пропускной способности Kimi K3 и один из самых быстрых показателей среди измеренных моделей, близких к фронтиру, что соответствует архитектуре, явно оптимизированной для дешёвого обслуживания длинного контекста.
Fugu Ultra v2 не публикует показателей задержки или пропускной способности. Как и в случае с ценами, отчасти это структурная особенность: время отклика оркестратора зависит от того, какие модели он выбирает и сколько проходов выполняет, поэтому одно-единственное число вводило бы в заблуждение. Но это означает, что реальные временные затраты на его внедрение не измерены и не поддаются измерению извне. О предыдущей Fugu Ultra тестировщики публично сообщали о прогонах, растягивающихся почти до 30 минут; речь о модели июня 2026 года, а не о v2, и это не свидетельство о новой модели, — но если вы тратите в 25 раз больше на вывод, знать, сколько придётся ждать, — не просто приятный бонус.
Лицензия и то, что говорится в арабском фрагменте
Веса MiniMax M3 можно скачать по лицензии MiniMax Community License — это открытые веса с прикреплёнными коммерческими условиями, в частности с порогом дохода, выше которого требуется письменное разрешение. Это не MIT, и любая страница, которая утверждает обратное, не читала лицензионный тег. Fugu Ultra v2 не даёт вам ничего лицензировать, потому что нечего скачивать.
Более интересная недавняя разработка для M3 — это то, что другие люди делают с этими весами. 3 сентября 2026 года HUMAIN — саудовская ИИ-компания, поддерживаемая PIF, — выпустила арабский флагман, созданный путём постобучения MiniMax M3 на более чем триллионе арабских токенов, при 428 млрд общих и 23 млрд активных параметров, сообщив о равновзвешенных 89,37% по семи арабским бенчмаркам и опередив GPT-5.6 Sol с 87,30 и Claude Opus 5 с 87,34. Это исследовательская предварительная версия, и это собственные показатели HUMAIN.
Контраст с Fugu Ultra v2 не мог бы быть резче — как заявление о том, чем является каждый из продуктов. MiniMax M3 — это база, на которой другие компании строят суверенные модели. Fugu Ultra v2 — это шлюз, в который вы обращаетесь, чей состав вы не можете увидеть и чьи веса вы не можете держать. Обе позиции законны. Но это совершенно не одно и то же.

Вызов любого из них
MiniMax M3 доступен на OrcaRouter по собственной цене MiniMax — $0,30 за миллион входных токенов, $0,06 при попадании в кэш, $1,20 за миллион выходных — передаётся без какой-либо наценки, так что если MiniMax изменит структуру скидок, это появится здесь в тот же день, а не через цикл миграции. Он совместим с OpenAI и работает по тому же базовому URL, что и остальной каталог, а значит, вы можете направлять к нему запросы по правилу, включать его в цепочку отказоустойчивости или добавлять в панель объединения моделей без второго контракта и без изменений в коде. Для модели, весь смысл которой — цена, важна именно эта сквозная передача: самый дешёвый маршрут остаётся самым дешёвым.
Fugu Ultra v2 не маршрутизируется нами. Он доступен через собственный OpenAI-совместимый API Sakana AI, и компания утверждает, что существующая интеграция Fugu переходит на него изменением одного параметра в одной строке. Оба используют один и тот же формат запросов, поэтому размещение их за одним флагом для оценки — это просто замена базового URL.
Вердикт
Для подавляющего большинства рабочих нагрузок MiniMax M3 выигрывает это сравнение уже по одной арифметике. Он в 16,7 раза дешевле на входе и в 25 раз дешевле на выходе, быстрее по всем измеряемым метрикам, нативно мультимодален, включая видео, имеет открытые веса по лицензии, потолок которой большинство компаний никогда не достигнет, и независимо оценён в 30 баллов по текущему индексу Artificial Analysis. Его слабые места реальны, но узки: он многословен, его оценка в агентной категории средняя относительно его оценок по программированию, а набор бенчмарков от вендора силён в разработке ПО и тоньше в долгосрочной автономности.
Выбирайте Fugu Ultra v2только если вы верите в то, что Sakana на самом деле продаёт, — уровень пиковых возможностей, который раскладывает сложные многошаговые задачи по пулу, не контролируемому ни одним фронтирным вендором, достигая результатов фронтирного уровня без зависимости от фронтирных моделей, — и у вас есть измерения на уровне задач, показывающие, что декомпозиция превосходит одну дешёвую модель на вашей работе. Это по-настоящему иное предложение по сравнению со всем, что предлагает MiniMax, и именно поэтому существует 25×.
Но проводите измерение до покупки, а не после. Если модель за $0.30 выполняет вашу задачу за две попытки, а Fugu Ultra v2 — за одну, Fugu всё равно обходится дороже. Единственная рабочая нагрузка, где 25× — выгодная сделка, — это та, где дешёвая модель вообще не может завершить работу; и это гораздо меньший набор задач, чем подразумевает маркетинговый текст к запуску.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
