
Fugu Ultra v2 vs Kimi K3: два роутера, две высоты
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Обе эти системы — роутеры, и именно это упускает большинство публикаций о них. Kimi K3 — это модель смеси экспертов с 2,8 триллиона параметров, которая активирует примерно 104 миллиарда параметров на токен: это значит, что на каждом отдельном токене, который она генерирует, она принимает решение о маршрутизации, выбирая 16 из своих 896 экспертов для выполнения работы. Fugu Ultra v2, представленная Sakana AI 11 сентября 2026 года, — это роутер совершенно иного уровня: она принимает входящую задачу, разбивает её на части и распределяет эти части по пулу отдельных моделей. Один маршрутизирует внутри прямого прохода; другой маршрутизирует между целым парком моделей. Понимание того, что это одна и та же идея на двух масштабах, — самый быстрый способ увидеть, почему их ценники различаются в 2× на входе и в 5× на выходе.
Два роутера бок о бок
• Kimi K3 — флагманская модель Moonshot AI, выпущенная в середине июля 2026 года с открытыми весами, опубликованными 27 июля 2026 года. Архитектура необычна даже по меркам 2026 года: 69 слоёв Kimi Delta Attention, чередующихся с 24 слоями Gated MLA, Attention Residuals, дизайн «Stable LatentMoE» и визуальный кодировщик MoonViT-V2 на 401M параметров. Веса поставляются в MXFP4 с активациями MXFP8 в рамках обучения с учётом квантования. Его хостируемый API предоставляет reasoning effort ровно с одним поддерживаемым значением — max.
• Fugu Ultra v2 — оркестрационный уровень пиковых возможностей от Sakana AI, и не фундаментальная модель в привычном смысле. Это единая конечная точка, совместимая с OpenAI, которая разбирает задачи на части и распределяет их по пулу моделей с открытыми весами и специализированных моделей. Sakana заявляет, что Claude Fable 5, Claude Fable 5.1 и GPT-6 Astra исключены из этого пула, и указывает дату отсечения обучения — 20260828. Опубликованного числа параметров нет, потому что здесь нет параметров, которые можно было бы подсчитать так, как вы бы делали это для K3 — возможности заключены в политике планирования.
Следствие таково: K3 — это компонент, а Fugu Ultra v2 — сборка. Из-за этого сравнение необычно: эти двое не только конкуренты, но и потенциальные ингредиенты. Модель вроде K3 — ровно тот тип системы с открытыми весами, длинным контекстом и вызовом инструментов, которую оркестратор вполне мог бы арендовать. Sakana не публикует состав пула, поэтому неизвестно, входит ли K3 в Fugu Ultra v2, — но если да, то часть того, за что вы платите по тарифу Fugu, — это токены K3 с наценкой.
Что такое ценовой разрыв на самом деле
• Ввод — Fugu Ultra v2 по сообщениям за $5.00 за 1 млн (сторонние листинги; страница анонса Sakana не публикует собственные тарифы) против Kimi K3 за $3.00 за 1 млн, при попаданиях в кэш — $0.30.
• Вывод — Fugu Ultra v2 по заявленной цене $30,00 за 1 млн против Kimi K3 за $15,00 за 1 млн. Вдвое дешевле, причём модель можно ещё и скачать.
• Кэшированный ввод — Fugu Ultra v2 — $0,50 за 1 млн против Kimi K3 — $0,30 за 1 млн при попадании в кэш. В длинном цикле агента со стабильным системным промптом эта разница накапливается на каждом шаге.
• Уровневая тарификация контекста — У Kimi K3 единая цена на всём окне в 1 048 576 токенов без надбавки за длинный контекст. Заявленный тарифный уровень Fugu Ultra v2 при превышении примерно 272 000 входных токенов переводит весь запрос на тариф около $10.00 / $45.00.
Именно последняя строка определяет реальные расходы. Долгосрочный прогон агента большую часть своей жизни проводит после 272K токенов — а именно там фиксированная ставка K3 остаётся неизменной, тогда как у Fugu Ultra v2 она удваивается. Если ваша нагрузка выглядит так, эффективный разрыв на стороне входных данных ближе к 3,3×, чем к 1,7×.

То единственное число, которое у них общее
Оба вендора приводят данные по DeepSWE, и это сравнение менее лестно для Fugu, чем предполагает его подача при запуске. Sakana указывает Fugu Ultra v2 на уровне 74,3. Moonshot указывает Kimi K3 на уровне 67,5 — по данным вендора, из карточки модели. Это разрыв в 6,8 пункта в бенчмарке для кодирующих агентов, и он реален, но это лишь один тест из гораздо более крупного опубликованного набора, и это тот же тест, в котором Sakana лидирует с отрывом в 1,6 пункта от GPT-5.6 Sol. Бенчмарк, в котором три разных вендора укладываются в пределах семи пунктов, измеряет нечто реальное, но не разделяет их убедительно.
Помимо этого, эти двое публикуют данные в совершенно разных плоскостях. Показатели K3 от Moonshot включают Terminal-Bench 2.1 — 88,3, GPQA Diamond — 93,5, HLE-Full — 43,5 (56,0 с инструментами), SWE-Marathon — 42,0, OSWorld-Verified — 84,8 и MCPMark-Verified — 94,5 — все заявлены производителем, все указаны в карточке модели. Восемь бенчмарков Sakana для Fugu Ultra v2 включают два внутренних бенчмарка, SWEFish и Toolathon, которые никто за пределами Sakana не может воспроизвести.
Независимо от этого, лишь один из них вообще измерялся. Kimi K3 набирает 44 балла в Artificial Analysis Intelligence Index v4.3 — второй результат среди открытых моделей, после GLM-5.3 с 45 — и 93,40 % в SWE-bench Verified в стандартизированном агентном харнессе Vals AI, уступая Claude Opus 5 и DeepSeek V4 Pro, но совсем немного. Он также лидирует в Frontend Code Arena с 1679 Эло, опережая Fable 5 с 1631 и GPT-5.6 Sol с 1618. Если вы видели, что K3 указывают как 57 или 60, это устаревшая шкала индекса, и её не следует повторять.
Fugu Ultra v2 не имеет никакой независимой оценки. Он был анонсирован 11 сентября 2026 года, и никто за пределами Sakana его не запускал.
Скорость: одна измерена, другая нет
Kimi K3 работает медленно, и это измерено, а не заявлено: Artificial Analysis фиксирует 37,9 токена в секунду при времени до первого токена 3,80 секунды и отмечает её как заметно многословную. Для модели, построенной вокруг агентного программирования с длинным горизонтом, пропускная способность — реальное ограничение: медленная модель в длинном цикле отнимает реальное время, а не только деньги.
Sakana вообще не публикует никаких показателей задержки или пропускной способности для Fugu Ultra v2. Для оркестратора это, возможно, честно, а не уклончиво, потому что время отклика полностью зависит от того, какие модели он решит вызвать и сколько проходов сделает. Но это также означает, что вы не можете оценить реальное время выполнения перехода на него, не измерив его самостоятельно. Что касается предыдущей Fugu Ultra, тестировщики публично сообщали о запусках, растягивавшихся почти до 30 минут; это модель июня 2026 года, и это не доказательство относительно v2, но именно этот показатель нужно побить, когда вы проводите бенчмарк.

Открытые веса, но с важным нюансом, который стоит прочитать
Веса Kimi K3 можно скачать, что является реальным отличием от модели Fugu Ultra v2, доступной только через хостинг, — но лицензия более узкая, чем обычно подразумевает фраза «открытые веса». K3 распространяется под лицензией Kimi K3, а не под одобренной OSI лицензией MIT или Apache, и широко повторяемое утверждение, что это «модифицированный MIT», оспаривается. Условия требуют отдельного соглашения с Moonshot для бизнесов, предоставляющих модель как услугу, с доходом выше $20 млн за любые двенадцать последовательных месяцев, а также указания авторства для продуктов с более чем 100 млн ежемесячных пользователей или $20 млн ежемесячного дохода. Внутреннее использование освобождено от этих требований.
Итак, честная формулировка такова: K3 даёт вам веса, которые можно держать у себя, изучать, дообучать и разворачивать самостоятельно, при условии соблюдения коммерческого требования, привязанного к размеру выручки. Fugu Ultra v2 не даёт ничего из этого — ни весов, ни доступного для проверки пула, ни возможности самостоятельного развёртывания — но и не налагает требований по выручке, потому что лицензировать нечего. Что из этого более либерально, целиком зависит от того, относитесь ли вы к тому типу компаний, на который нацелена лицензия K3.
Одно практическое предостережение, если планируется самостоятельный хостинг: чекпоинт K3 весит примерно 1,5 терабайта, а производитель рекомендует 64 ускорителя или больше. «Открытые веса» здесь означают решение в пользу инференс-кластера, а не ноутбука. Для большинства команд API в любом случае — разумный путь, и именно поэтому поддержка vLLM и SGLang с первого дня значит больше, чем сама загрузка.
Что говорит наш собственный трафик
Одна точка данных, которую не публикует ни один из вендоров и которая значит больше, чем кажется: через шлюз OrcaRouter Kimi K3 — самая активно используемая модель из всех, обсуждаемых в этой статье, с большим отрывом, обработав примерно 3,27 млрд токенов за последние семь дней.
Это не бенчмарк, и он ничего не решает в вопросе качества. Но это большая выборка того, что разработчики реально выбирают, когда решение не стоит им ничего, кроме цены за токены, и она говорит, что сочетание у K3 окна на 1M с фиксированным тарифом, открытых весов и сильной позиции в coding-arena уже завоевало существенную долю реальной агентной работы с длинным контекстом. У Fugu Ultra v2 нет сопоставимого сигнала, потому что запуск состоялся сегодня.

Как добраться до каждого из них
Kimi K3 доступна на OrcaRouter по тарифу самого Moonshot — $3,00 за миллион входных токенов, $0,30 при попадании в кэш, $15,00 за миллион выходных — передаются без наценки, так что изменение цены поставщиком отражается здесь в тот же день, а не по графику миграции. Она совместима с OpenAI по тому же базовому URL, что и остальной каталог, и поскольку она находится за тем же шлюзом, что и всё остальное, вы можете включить её в цепочку отказоустойчивости или маршрутизировать к ней условно, вместо того чтобы жёстко зашивать одного поставщика в продакшен-путь. Здесь это важно больше, чем обычно: модель с 2,8 трлн параметров, обслуживаемая со скоростью 37,9 токена в секунду, — именно та зависимость, для которой стоит иметь резервный вариант.
Fugu Ultra v2 не маршрутизируется через нас. Он доступен через собственный OpenAI-совместимый API Sakana AI, и компания утверждает, что существующие интеграции Fugu переходят на него при изменении одного параметра. Обе модели используют один и тот же формат запросов, поэтому оценка, объединяющая их под одним флагом, — это замена base-URL, а не переписывание.
Что выбрать
Kimi K3 — более оправданная покупка практически для любой рабочей нагрузки. Он вдвое дешевле Fugu Ultra v2 как по входу, так и по выходу, имеет неизменную цену во всём окне 1M без провала на длинном контексте, независимо оценён в 44 балла в текущем индексе Artificial Analysis, доступен для самостоятельного развёртывания по лицензии с порогом по выручке и уже с большим отрывом является моделью с самым высоким трафиком в этом сравнении. Его издержки — скорость и многословность: 37,9 токена в секунду — это действительно медленно для агентных циклов, а лицензия имеет зубы, если вы крупный бизнес, предоставляющий модели как услугу.
Fugu Ultra v2 — это то, что стоит купить, если вам нужно конкретное свойство, которое продаёт Sakana — уровень возможностей, который декомпозирует сложную многошаговую работу по пулу, структурно исключающему вендоров фронтира, так что ни одну отдельную вышестоящую модель нельзя отозвать, пересмотреть её цену или отрезать у вас под ногами. Его преимущество по DeepSWE над K3 реально и заявлено вендором; его место в топ-2 на семи из восьми бенчмарков тоже заявлено вендором, причём на тестах, которые отчасти не существуют больше нигде.
Стоит заметить, что и то и другое — это решения о маршрутизации, и вам предлагают выбрать высоту. K3 направляет токены к экспертам внутри модели, которую вы можете скачать и контролировать. Fugu Ultra v2 направляет задачи к моделям, которых вы не видите. Второе — более масштабная и более мощная идея. И именно её можно принять только на веру — и чтобы принять эту веру, приходится платить в пять раз больше за токен.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
