Главная титульная карточка с надписью «Fugu Max против Kimi K3» и подзаголовком «Sakana выбрала этот эталон», три бейджа-пилюли с надписями «$6.00 против $15.00 за выход», «на 60% ниже по выходу» и «1M фиксированно против неопубликованного окна», строка нижнего колонтитула «Sakana AI, сентябрь 2026 против Moonshot AI, июль 2026», а также логотип OrcaRouter в правом нижнем углу.
Guides & Insights

Fugu Max против Kimi K3: Sakana выбрала это мерило, так давайте прочитаем его

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

В анонсе Sakana AI для Fugu Max названы ровно три модели для обоснования его цены, и Kimi K3 от Moonshot AI — одна из них. Утверждается, что тариф Fugu Max на вывод на 40–60 процентов ниже, чем у этих трёх, что делает Kimi K3 — не Grok 4.6 и не Qwen3.8-Max — тем эталоном, который Sakana сама выбрала для оценки выгодности. Это на удивление щедрый жест со стороны поставщика: он вручает вам линейку и говорит, где её держать. Поэтому эта страница делает очевидное и держит её. Fugu Max вышел 11 сентября 2026 года по цене $2.00 за миллион входных и $6.00 за миллион выходных токенов. Kimi K3 в прайс-листе стоит $3.00 и $15.00. Утверждение о 60 процентах для выходных токенов арифметически верно. О чём в этом предложении не говорится: модель, которую он подрезает по цене, публикует полный набор независимо измеренных результатов, а модель, которая подрезает, не публикует ничего.

Предложение о 40–60 процентах, рассмотренное

• Ввод — Fugu Max $2.00 за 1 млн токенов против Kimi K3 $3.00 за 1 млн токенов: экономия 33 процента, а не 40–60 процентов, о которых заявляет релиз

• Вывод — Fugu Max $6.00 за 1 млн токенов против Kimi K3 $15.00 за 1 млн токенов, что на 60 процентов ниже верхней границы заявленного диапазона Sakana

• Кэшированный ввод — Fugu Max $0.25 за 1 млн токенов против Kimi K3 $0.30 за 1 млн токенов: разрыв настолько мал, что циклы с интенсивным использованием кэша его не заметят

• Контекстное окно — Fugu Max: в релизе цифра не опубликована, против Kimi K3 1 048 576 токенов

• Пересмотр цен для длинных промптов — у Fugu Max тариф не указан, а Kimi K3 — единая цена на всём окне без надбавки при любой длине.

• Развёртывание — Fugu Max: только через API вендора, участие в пуле не раскрывается, в отличие от Kimi K3 с доступными для скачивания весами на условиях лицензии Kimi K3 License

• Независимая оценка — Fugu Max: нет, и для моделей Fugu не существует страницы Artificial Analysis, в отличие от Kimi K3 с Индексом интеллекта Artificial Analysis 44 и стандартизированным показателем 93,40% на SWE-bench Verified от Vals AI

Обратите внимание на структуру первой строки. Диапазон, вынесенный в заголовок, — от 40 до 60 процентов — это диапазон по трём названным конкурентам, и именно Kimi K3 даёт 60. Только по входным данным сравнение даёт 33 процента, что всё ещё означает реальную экономию, но звучит как другое утверждение. Это не критика ценообразования — $2,00 и $6,00 действительно низкие цифры для системы, которая заявляет о результатах, близких к фронтирным. Это замечание о том, какое число в релизе выполняет убеждающую функцию, и о том, как абзац выстроен вокруг него.

Kimi K3 представлена в нашем каталоге по собственному тарифу Moonshot — $3.00 за миллион входных токенов, $0.30 при попадании в кэш, $15.00 за миллион выходных токенов — передаётся без наценки 0%, поэтому если Moonshot изменит цены, новый тариф заработает на том же ключе в тот же день, а не в рамках цикла миграции. Здесь это важнее, чем обычно, ведь снижение цены на стороне поставщика — это именно то, что сокращает или увеличивает разрыв в 60 процентов, на котором держится всё это противостояние.

Что публикует мерило

Набор результатов Kimi K3 — полная противоположность скудному. В собственной карточке модели Moonshot приводятся такие данные: Terminal-Bench 2.1 — 88,3, GPQA Diamond — 93,5, HLE-Full — 43,5 с ростом до 56,0 при использовании инструментов, SWE-Marathon — 42,0, OSWorld-Verified — 84,8, MCPMark-Verified — 94,5 и DeepSWE — 67,5. Все данные заявлены производителем, и их очень много.

Независимый слой тоже существует, и именно эта часть важна для данного сравнения. Artificial Analysis присуждает Kimi K3 44 балла в v4.3 Intelligence Index — второе место среди моделей с открытыми весами, после GLM-5.3 с 45 — при зафиксированной пропускной способности 37,9 выходных токенов в секунду и времени до первого токена 3,80 секунды. Стандартизированный агентный стенд Vals AI оценивает её в 93,40% на SWE-bench Verified — позади Claude Opus 5 и DeepSeek V4 Pro, но близко. Она также лидирует в Frontend Code Arena с 1679 Elo, опережая Claude Fable 5 с 1631 и GPT-5.6 Sol с 1618. Одно предостережение: если вы видели, что Kimi K3 указывают с оценкой 57 или 60 в Intelligence Index, это показатели до пересмотра, относящиеся ко времени до того, как Artificial Analysis перекалибровала шкалу в сентябре 2026 года, и их не следует приводить вместе с текущими числами.

Есть также сигнал об использовании, и он исходит от нашего собственного шлюза, а не из чьего-либо маркетинга: через OrcaRouter за последние семь дней прошло примерно 3,27 млрд токенов Kimi K3 — самый интенсивный трафик среди всех моделей в этом сравнении. Это не измерение качества. Это большая выборка того, к чему обращаются разработчики, когда единственная стоимость выбора — цена токенов, и она говорит, что фиксированное окно в 1M и открытые веса уже завоевали значительную долю реальной долгосрочной работы.

A two-column scoreboard titled 'Fugu Max vs Kimi K3 - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, benchmarks six wins with no figures, evidence vendor-reported only. Kimi K3: output price $15.00 per 1M, input price $3.00 per 1M, cached input $0.30 per 1M, context 1M flat with no surcharge, benchmarks Terminal-Bench 2.1 at 88.3, evidence Artificial Analysis Index 44 and SWE-bench Verified 93.40%. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Kimi K3 rows Moonshot-reported and per Artificial Analysis and Vals AI.' OrcaRouter logo bottom-right.

Табло, на котором нет цифр

Sakana сообщает, что Fugu Max набирает лучший общий балл в шести бенчмарках: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и SWEFish. Также утверждается, что Max расширяет границу Парето по соотношению цена-производительность в семи из десяти бенчмарков. Оба утверждения касаются места в рейтинге на графике. Ни одно из них не сопровождается значением, отрывом или показателем конкурента рядом.

Два списка почти не соприкасаются — в этом и заключается практическая проблема. Kimi K3 указывает для Terminal-Bench 2.1 результат 88,3; Sakana утверждает, что Fugu Max занимает первое место в общем зачёте на Terminal Bench 2.1, и не публикует ничего для сравнения с ним. Эта единственная строка — самое наглядное свидетельство всего противостояния: оба вендора называют один и тот же тест, один публикует число, а другой — слово «best». Пока Sakana не опубликует эту цифру, никакие опубликованные данные не дают ответа на вопрос, превосходит ли Fugu Max Kimi K3 на бенчмарке, который Sakana решила представить в первую очередь.

Есть справедливое прочтение релиза, которое стоит озвучить. Fugu Max — это стоимостной уровень, выпущенный в тот же день, что и Fugu Ultra v2, представляющий собой рывок по возможностям при $5.00 за ввод и $30.00 за вывод, — и его аргумент строится на графике Парето, где утверждением является показатель «баллов на доллар», а не просто баллы. В такой трактовке голое число бенчмарка было бы менее честной статистикой. Проблема в том, что в релизе также опущен знаменатель: собственное освещение Sakana признаёт, что переключение моделей в середине задачи может снизить повторное использование кэша контекста и породить дополнительные токены оркестрации, а также подтверждает, что компания не раскрыла частоту попаданий в кэш для Max или его общую стоимость токенов на задачу. Так что единственное измерение, которое разрешило бы спор о стоимостном уровне, — это то, которое не предоставлено.

Веса, которые можно держать в руках, или бассейн, которого не видно

Вот здесь два продукта вообще перестают поддаваться сравнению.

Kimi K3 поставляется с загружаемыми весами — это настоящий запасной выход: если цены или условия изменятся, модель можно обслуживать на собственной инфраструктуре. Лицензия более узкая, чем обычно подразумевают «открытые веса». Это лицензия Kimi K3, а не одобренное OSI разрешение, и часто повторяемое описание её как модифицированной MIT оспаривается. Условия требуют отдельного соглашения с Moonshot для бизнесов, предоставляющих модель как услугу, с выручкой свыше $20 млн за любые двенадцать последовательных месяцев, а также указания авторства для продуктов с более чем 100 млн ежемесячных пользователей или $20 млн ежемесячной выручки; внутреннее использование освобождено. И практический масштаб реален: контрольная точка весит примерно 1,5 терабайта, и Moonshot рекомендует 64 или более ускорителей, так что самостоятельный хостинг — это решение уровня инференс-кластера, а не ноутбука.

Fugu Max ничего из этого не предлагает — ни весов, ни доступного для проверки пула, ни возможности самостоятельного развёртывания — и взамен не налагает никаких лицензионных условий, потому что лицензировать нечего. Заявленное преимущество Sakana — это обратная сторона контроля: пул, охватывающий модели с открытыми весами и специализированные модели, расширенный для Max семейством NVIDIA Nemotron, означает, что ни прекращение поддержки, ни изменение цен со стороны какого-либо одного поставщика выше по цепочке не смогут обрушить ваш продукт. Это настоящая страховка. Её также невозможно проверить извне, поскольку состав участников намеренно не публикуется, и это означает, что результат Fugu Max имеет срок годности, которого нет у результата Kimi K3.

Открытые веса и нераскрытый пул — это два разных ответа на один и тот же страх. Один говорит: ты можешь уйти. Другой говорит: нечего покидать.

Там, где решает плоское окно

Контекст Kimi K3 в 1 048 576 токенов — фиксированный: ни отдельного уровня для длинного контекста, ни надбавки при любой длине. В релизе Fugu Max окно не указано вовсе, так что сравнивать не с чем и не от чего отталкиваться при планировании. Для долгосрочного агентного программирования, на которое ориентированы оба продукта, где сессии большую часть своей жизни проводят глубоко в контексте, эта асимметрия важнее, чем тарифная сетка.

Скорость — это зеркальное отражение той же проблемы. Kimi K3 показывает измеренные 37,9 токена в секунду при времени до первого токена 3,80 секунды, и это медленно — по-настоящему ограничение для модели, построенной вокруг длинных циклов, а Artificial Analysis отмечает её как заметно многословную. Sakana не публикует ни показателей задержки, ни пропускной способности для Fugu Max, что для оркестратора, пожалуй, честно, а не уклончиво: время ответа зависит от того, какие модели он выбирает и сколько проходов делает. Но это означает, что вы не можете смоделировать реальные временные затраты на переключение, не измерив их самостоятельно. Для более ранней Fugu Ultra пользователи публично сообщали о запусках, приближавшихся к 30 минутам. Это модель июня 2026 года, а не свидетельство о Max, но именно это число нужно превзойти, когда вы проводите бенчмарк.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the opening argument about the two-dimensional frontier of capability against cost and the statement that Fugu Max expands the Pareto efficiency frontier by orchestrating Sakana's largest pool of open and specialized models to date.

Вердикт, по словам самой Sakana

Sakana назвала Kimi K3 одной из трёх моделей, которые Fugu Max превосходит по дешевизне, и по ставке за вывод это утверждение подтверждается: 6,00 доллара против 15,00 долларов — это на 60 процентов ниже, ровно верхняя граница заявленного диапазона. Если принимать релиз на слово, Fugu Max — более дешёвый продукт.

Теперь применим ту мерку, которую релиз обошёл стороной. Kimi K3 на 33 процента дороже на входе и на 150 процентов дороже на выходе — и за эти деньги вы получаете окно в 1 млн токенов без скачка цен при пересчёте, загружаемый чекпойнт под лицензией с порогом по выручке, независимую позицию 44 в Intelligence Index, стандартизированную оценку SWE-bench Verified в 93,40%, первое место в Frontend Code Arena и самый большой реальный трафик среди всех моделей в этом сравнении. Fugu Max даёт более низкую ставку как на вход, так и на выход, шесть не подкреплённых цифрами побед в бенчмарках, ставку за кэш вдвое ниже, чем у K3, без опубликованного процента попаданий, и пул, который нельзя проверить.

Честный вывод таков: Sakana выбрала мерило, которое льстит ей по цене, и не дала вам ничего, по чему можно проверить возможности. Если ваша нагрузка отличается большим объёмом, а ваши задачи таковы, что координатор может надёжно их декомпозировать, разница в тарифах — это реальные деньги, и Fugu Max заслуживает пилота с чётко очерченными рамками и включённым учётом токенов с первого запроса. Если вам нужно решение о выводе в продакшен, которое можно защитить в этом квартале — окно, на которое можно планировать, оценка, на которую можно сослаться, и модель, которую вы всё ещё сможете запускать, даже если поставщик исчезнет, — ответ Kimi K3, и он доступен на OrcaRouter по прайс-листовой цене Moonshot, при этом тариф провайдера передаётся без изменений.

A screenshot of the OrcaRouter model page for Kimi K3 (English UI, captured September 11, 2026), showing the Featured badge, the identifier kimi/kimi-k3, by MoonshotAI dated 2026-07-15, vision, tools, JSON and reasoning capability tags, a 2.8-trillion-parameter Mixture-of-Experts description, a 1M-token context window with text and image input, list pricing of $3.00 per 1M input tokens and $15.00 per 1M output tokens, traffic of 3,274.3 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.