
Fugu Max против Kimi K3: Sakana выбрала это мерило, так давайте прочитаем его
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
В анонсе Sakana AI для Fugu Max названы ровно три модели для обоснования его цены, и Kimi K3 от Moonshot AI — одна из них. Утверждается, что тариф Fugu Max на вывод на 40–60 процентов ниже, чем у этих трёх, что делает Kimi K3 — не Grok 4.6 и не Qwen3.8-Max — тем эталоном, который Sakana сама выбрала для оценки выгодности. Это на удивление щедрый жест со стороны поставщика: он вручает вам линейку и говорит, где её держать. Поэтому эта страница делает очевидное и держит её. Fugu Max вышел 11 сентября 2026 года по цене $2.00 за миллион входных и $6.00 за миллион выходных токенов. Kimi K3 в прайс-листе стоит $3.00 и $15.00. Утверждение о 60 процентах для выходных токенов арифметически верно. О чём в этом предложении не говорится: модель, которую он подрезает по цене, публикует полный набор независимо измеренных результатов, а модель, которая подрезает, не публикует ничего.
Предложение о 40–60 процентах, рассмотренное
• Ввод — Fugu Max $2.00 за 1 млн токенов против Kimi K3 $3.00 за 1 млн токенов: экономия 33 процента, а не 40–60 процентов, о которых заявляет релиз
• Вывод — Fugu Max $6.00 за 1 млн токенов против Kimi K3 $15.00 за 1 млн токенов, что на 60 процентов ниже верхней границы заявленного диапазона Sakana
• Кэшированный ввод — Fugu Max $0.25 за 1 млн токенов против Kimi K3 $0.30 за 1 млн токенов: разрыв настолько мал, что циклы с интенсивным использованием кэша его не заметят
• Контекстное окно — Fugu Max: в релизе цифра не опубликована, против Kimi K3 1 048 576 токенов
• Пересмотр цен для длинных промптов — у Fugu Max тариф не указан, а Kimi K3 — единая цена на всём окне без надбавки при любой длине.
• Развёртывание — Fugu Max: только через API вендора, участие в пуле не раскрывается, в отличие от Kimi K3 с доступными для скачивания весами на условиях лицензии Kimi K3 License
• Независимая оценка — Fugu Max: нет, и для моделей Fugu не существует страницы Artificial Analysis, в отличие от Kimi K3 с Индексом интеллекта Artificial Analysis 44 и стандартизированным показателем 93,40% на SWE-bench Verified от Vals AI
Обратите внимание на структуру первой строки. Диапазон, вынесенный в заголовок, — от 40 до 60 процентов — это диапазон по трём названным конкурентам, и именно Kimi K3 даёт 60. Только по входным данным сравнение даёт 33 процента, что всё ещё означает реальную экономию, но звучит как другое утверждение. Это не критика ценообразования — $2,00 и $6,00 действительно низкие цифры для системы, которая заявляет о результатах, близких к фронтирным. Это замечание о том, какое число в релизе выполняет убеждающую функцию, и о том, как абзац выстроен вокруг него.
Kimi K3 представлена в нашем каталоге по собственному тарифу Moonshot — $3.00 за миллион входных токенов, $0.30 при попадании в кэш, $15.00 за миллион выходных токенов — передаётся без наценки 0%, поэтому если Moonshot изменит цены, новый тариф заработает на том же ключе в тот же день, а не в рамках цикла миграции. Здесь это важнее, чем обычно, ведь снижение цены на стороне поставщика — это именно то, что сокращает или увеличивает разрыв в 60 процентов, на котором держится всё это противостояние.
Что публикует мерило
Набор результатов Kimi K3 — полная противоположность скудному. В собственной карточке модели Moonshot приводятся такие данные: Terminal-Bench 2.1 — 88,3, GPQA Diamond — 93,5, HLE-Full — 43,5 с ростом до 56,0 при использовании инструментов, SWE-Marathon — 42,0, OSWorld-Verified — 84,8, MCPMark-Verified — 94,5 и DeepSWE — 67,5. Все данные заявлены производителем, и их очень много.
Независимый слой тоже существует, и именно эта часть важна для данного сравнения. Artificial Analysis присуждает Kimi K3 44 балла в v4.3 Intelligence Index — второе место среди моделей с открытыми весами, после GLM-5.3 с 45 — при зафиксированной пропускной способности 37,9 выходных токенов в секунду и времени до первого токена 3,80 секунды. Стандартизированный агентный стенд Vals AI оценивает её в 93,40% на SWE-bench Verified — позади Claude Opus 5 и DeepSeek V4 Pro, но близко. Она также лидирует в Frontend Code Arena с 1679 Elo, опережая Claude Fable 5 с 1631 и GPT-5.6 Sol с 1618. Одно предостережение: если вы видели, что Kimi K3 указывают с оценкой 57 или 60 в Intelligence Index, это показатели до пересмотра, относящиеся ко времени до того, как Artificial Analysis перекалибровала шкалу в сентябре 2026 года, и их не следует приводить вместе с текущими числами.
Есть также сигнал об использовании, и он исходит от нашего собственного шлюза, а не из чьего-либо маркетинга: через OrcaRouter за последние семь дней прошло примерно 3,27 млрд токенов Kimi K3 — самый интенсивный трафик среди всех моделей в этом сравнении. Это не измерение качества. Это большая выборка того, к чему обращаются разработчики, когда единственная стоимость выбора — цена токенов, и она говорит, что фиксированное окно в 1M и открытые веса уже завоевали значительную долю реальной долгосрочной работы.

Табло, на котором нет цифр
Sakana сообщает, что Fugu Max набирает лучший общий балл в шести бенчмарках: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Также утверждается, что Max расширяет границу Парето по соотношению цена-производительность в семи из десяти бенчмарков. Оба утверждения касаются места в рейтинге на графике. Ни одно из них не сопровождается значением, отрывом или показателем конкурента рядом.
Два списка почти не соприкасаются — в этом и заключается практическая проблема. Kimi K3 указывает для Terminal-Bench 2.1 результат 88,3; Sakana утверждает, что Fugu Max занимает первое место в общем зачёте на Terminal Bench 2.1, и не публикует ничего для сравнения с ним. Эта единственная строка — самое наглядное свидетельство всего противостояния: оба вендора называют один и тот же тест, один публикует число, а другой — слово «best». Пока Sakana не опубликует эту цифру, никакие опубликованные данные не дают ответа на вопрос, превосходит ли Fugu Max Kimi K3 на бенчмарке, который Sakana решила представить в первую очередь.
Есть справедливое прочтение релиза, которое стоит озвучить. Fugu Max — это стоимостной уровень, выпущенный в тот же день, что и Fugu Ultra v2, представляющий собой рывок по возможностям при $5.00 за ввод и $30.00 за вывод, — и его аргумент строится на графике Парето, где утверждением является показатель «баллов на доллар», а не просто баллы. В такой трактовке голое число бенчмарка было бы менее честной статистикой. Проблема в том, что в релизе также опущен знаменатель: собственное освещение Sakana признаёт, что переключение моделей в середине задачи может снизить повторное использование кэша контекста и породить дополнительные токены оркестрации, а также подтверждает, что компания не раскрыла частоту попаданий в кэш для Max или его общую стоимость токенов на задачу. Так что единственное измерение, которое разрешило бы спор о стоимостном уровне, — это то, которое не предоставлено.
Веса, которые можно держать в руках, или бассейн, которого не видно
Вот здесь два продукта вообще перестают поддаваться сравнению.
Kimi K3 поставляется с загружаемыми весами — это настоящий запасной выход: если цены или условия изменятся, модель можно обслуживать на собственной инфраструктуре. Лицензия более узкая, чем обычно подразумевают «открытые веса». Это лицензия Kimi K3, а не одобренное OSI разрешение, и часто повторяемое описание её как модифицированной MIT оспаривается. Условия требуют отдельного соглашения с Moonshot для бизнесов, предоставляющих модель как услугу, с выручкой свыше $20 млн за любые двенадцать последовательных месяцев, а также указания авторства для продуктов с более чем 100 млн ежемесячных пользователей или $20 млн ежемесячной выручки; внутреннее использование освобождено. И практический масштаб реален: контрольная точка весит примерно 1,5 терабайта, и Moonshot рекомендует 64 или более ускорителей, так что самостоятельный хостинг — это решение уровня инференс-кластера, а не ноутбука.
Fugu Max ничего из этого не предлагает — ни весов, ни доступного для проверки пула, ни возможности самостоятельного развёртывания — и взамен не налагает никаких лицензионных условий, потому что лицензировать нечего. Заявленное преимущество Sakana — это обратная сторона контроля: пул, охватывающий модели с открытыми весами и специализированные модели, расширенный для Max семейством NVIDIA Nemotron, означает, что ни прекращение поддержки, ни изменение цен со стороны какого-либо одного поставщика выше по цепочке не смогут обрушить ваш продукт. Это настоящая страховка. Её также невозможно проверить извне, поскольку состав участников намеренно не публикуется, и это означает, что результат Fugu Max имеет срок годности, которого нет у результата Kimi K3.
Открытые веса и нераскрытый пул — это два разных ответа на один и тот же страх. Один говорит: ты можешь уйти. Другой говорит: нечего покидать.
Там, где решает плоское окно
Контекст Kimi K3 в 1 048 576 токенов — фиксированный: ни отдельного уровня для длинного контекста, ни надбавки при любой длине. В релизе Fugu Max окно не указано вовсе, так что сравнивать не с чем и не от чего отталкиваться при планировании. Для долгосрочного агентного программирования, на которое ориентированы оба продукта, где сессии большую часть своей жизни проводят глубоко в контексте, эта асимметрия важнее, чем тарифная сетка.
Скорость — это зеркальное отражение той же проблемы. Kimi K3 показывает измеренные 37,9 токена в секунду при времени до первого токена 3,80 секунды, и это медленно — по-настоящему ограничение для модели, построенной вокруг длинных циклов, а Artificial Analysis отмечает её как заметно многословную. Sakana не публикует ни показателей задержки, ни пропускной способности для Fugu Max, что для оркестратора, пожалуй, честно, а не уклончиво: время ответа зависит от того, какие модели он выбирает и сколько проходов делает. Но это означает, что вы не можете смоделировать реальные временные затраты на переключение, не измерив их самостоятельно. Для более ранней Fugu Ultra пользователи публично сообщали о запусках, приближавшихся к 30 минутам. Это модель июня 2026 года, а не свидетельство о Max, но именно это число нужно превзойти, когда вы проводите бенчмарк.

Вердикт, по словам самой Sakana
Sakana назвала Kimi K3 одной из трёх моделей, которые Fugu Max превосходит по дешевизне, и по ставке за вывод это утверждение подтверждается: 6,00 доллара против 15,00 долларов — это на 60 процентов ниже, ровно верхняя граница заявленного диапазона. Если принимать релиз на слово, Fugu Max — более дешёвый продукт.
Теперь применим ту мерку, которую релиз обошёл стороной. Kimi K3 на 33 процента дороже на входе и на 150 процентов дороже на выходе — и за эти деньги вы получаете окно в 1 млн токенов без скачка цен при пересчёте, загружаемый чекпойнт под лицензией с порогом по выручке, независимую позицию 44 в Intelligence Index, стандартизированную оценку SWE-bench Verified в 93,40%, первое место в Frontend Code Arena и самый большой реальный трафик среди всех моделей в этом сравнении. Fugu Max даёт более низкую ставку как на вход, так и на выход, шесть не подкреплённых цифрами побед в бенчмарках, ставку за кэш вдвое ниже, чем у K3, без опубликованного процента попаданий, и пул, который нельзя проверить.
Честный вывод таков: Sakana выбрала мерило, которое льстит ей по цене, и не дала вам ничего, по чему можно проверить возможности. Если ваша нагрузка отличается большим объёмом, а ваши задачи таковы, что координатор может надёжно их декомпозировать, разница в тарифах — это реальные деньги, и Fugu Max заслуживает пилота с чётко очерченными рамками и включённым учётом токенов с первого запроса. Если вам нужно решение о выводе в продакшен, которое можно защитить в этом квартале — окно, на которое можно планировать, оценка, на которую можно сослаться, и модель, которую вы всё ещё сможете запускать, даже если поставщик исчезнет, — ответ Kimi K3, и он доступен на OrcaRouter по прайс-листовой цене Moonshot, при этом тариф провайдера передаётся без изменений.

