Главная карточка для противостояния Fugu Ultra v2 и GLM 5.2, показывающая систему оркестрации против единой модели Mixture-of-Experts под надписью «Вы платите за координацию, а не за параметры».
Guides & Insights

Fugu Ultra v2 vs GLM 5.2: вы платите за координацию, а не за параметры

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Поставьте две тарифные карты рядом — и это противостояние выглядит как ошибка. Fugu Ultra v2, которую Sakana AI анонсировала 11 сентября 2026 года, тарифицируется по $5 за миллион входных токенов и $30 за миллион выходных токенов. GLM 5.2, флагман Z.ai от 16 июня 2026 года, тарифицируется по $1,40 и $4,40. Обе заявляют контекстное окно в диапазоне миллиона токенов. Обе нацелены ровно на одного и того же покупателя — команду, выполняющую длительную многошаговую агентную работу в масштабе репозитория. У одной цена за входные токены примерно в 3,6 раза выше, а за выходные — в 6,8 раза выше, чем у другой, и более дешёвая — это та, которую можно скачать и оставить себе. Так что всё сравнение сводится к одному вопросу: что на самом деле покупается за дополнительные деньги и покупается ли за них что-то, чем одна модель быть не может?

Они не относятся к одному и тому же типу объектов.

Причина разрыва в цене заключается в том, что эти две вещи решают долгосрочные задачи с помощью совершенно разных механизмов, и эта разница проявляется ещё до того, как вы вообще запустите бенчмарк.

Fugu Ultra v2 — это оркестрационная система, а не базовая модель. Это уровень линии Fugu от Sakana AI, максимизирующий возможности: единая конечная точка, совместимая с OpenAI, которая разбирает входящую задачу на части и распределяет их по пулу других моделей — некоторых с открытыми весами, а некоторых специализированных. Сама Sakana формулирует это так: она «поднимает пиковую производительность выше, чем когда-либо прежде, без обязательной зависимости от передовых моделей, которые она оркеструет». Вы покупаете планировщик и платите за каждый токен, который этот планировщик тратит на размышления, включая внутренние токены оркестрации.

GLM 5.2 — единая модель Mixture-of-Experts. Z.ai публикует её как модель «текст на входе / текст на выходе» с «реально пригодным к использованию» контекстным окном на 1 млн токенов и выводом до 128K токенов, гибридным режимом рассуждений, управляемым через reasoning_effort, и встроенной поддержкой вызова инструментов. Заявленная архитектура — примерно 753 млрд параметров всего при около 40 млрд активных на токен, хотя Z.ai не подтвердила количество активных параметров именно для 5.2 — считайте, что этот показатель перенесён из GLM-5.1.

Вот и развилка. Одно из них — то, что вы вызываете; другое — то, что вызывает вещи.

О чём Fugu Ultra v2 нам не рассказал бы

Страница анонса Sakana необычно откровенна в одном и необычно молчалива в другом, и оба момента важны для решения о покупке.

Откровенная часть: компания прямо заявляет, что Claude Fable 5, Claude Fable 5.1 и GPT-6 Astra не входят в пул моделей Fugu Ultra v2, даже при том что утверждает, что превосходит их по бенчмаркам. Заявленное обоснование — устойчивость: сменный пул открытых и специализированных моделей, который нельзя отозвать, переоценить или отрезать со стороны поставщика или из-за геополитических сдвигов. Дата отсечки обучения указана как 20260828. Что бы вы ни думали об этом аргументе, это реальная архитектурная позиция, и это самая ясная причина выбрать Fugu Ultra v2 вместо стека, который вы собрали сами.

Неочевидная деталь: в анонсе не указано контекстное окно, и на самой странице не указана цена за токены Fugu Ultra v2. Сторонние каталоги моделей указывают окно в 1 млн токенов и тарифы на уровне $5 / $0,50 за кэш / $30, а при превышении примерно 272 тыс. входных токенов действует тарифный уровень пересчёта, который доходит примерно до $10 / $1,00 / $45. Именно эти цифры используются далее в статье, но это данные из каталогов, а не документация вендора — сверьте их с актуальной тарифной сеткой Sakana, прежде чем закладывать их в бюджет.

Вопрос о стоимости за токен, на который никто не отвечает

Ценообразование за токен — неправильная единица для этого сравнения, и каждая страница, которая сейчас ранжируется по этому запросу, совершает ту же ошибку. Счёт оркестратора — это не размер вашего промпта, умноженный на ставку; это размер вашего промпта, плюс каждый подвызов, который он решает сделать, плюс токены рассуждений моделей, которые он арендует, и всё это с наценкой по собственной ставке оркестратора.

Sakana прямо признаёт это: токены оркестрации, потребляемые внутри, тарифицируются как обычные входные и выходные токены. А значит, честный способ сравнить Fugu Ultra v2 с GLM 5.2 — это стоимость за выполненную задачу, и ни один из поставщиков не публикует этот показатель.

Некоторые структурные моменты, которые сохраняют силу в любом случае:

Цена ввода — Fugu Ultra v2 $5.00 / 1M против GLM 5.2 $1.40 / 1M на OrcaRouter по тарифу провайдера Z.ai. Fugu стоит в 3,6 раза дороже, прежде чем сделает хотя бы один субвызов.

Цена вывода — Fugu Ultra v2 $30.00 / 1M против GLM 5.2 $4.40 / 1M. Это то самое число, которое причиняет боль, потому что агенты генерируют много вывода, а оркестратор выдаёт вывод, которого вы не запрашивали.

Кэшированный ввод — Fugu Ultra v2 заявляет $0.50 / 1M; GLM 5.2 кэшируется по $0.26 / 1M — скидка 81% от собственного тарифа за ввод. Именно на повторяющихся циклах агента со стабильным системным промптом преимущество GLM 5.2 накапливается сильнее всего.

Пересмотр цен для длинного контекста — У Fugu Ultra v2 заявленный уровень при объёме ввода свыше ~272K переводит весь запрос примерно на двойную ставку за ввод и 1,5× ставку за вывод. У GLM 5.2 вообще нет разбиения контекста на тарифные уровни: фиксированные $1.40 / $4.40, вплоть до 1M.

Именно последнюю строку и стоит обвести. При длительном запуске агента большая часть его жизненного цикла проходит после отметки 272K токенов. Фиксированная ставка GLM 5.2 экономит реальные деньги именно там, где ставка Fugu Ultra v2 удваивается.

Two-column comparison scoreboard for Fugu Ultra v2 and GLM 5.2 covering type, release date, input price ($5.00 vs $1.40 per million tokens), output price ($30.00 vs $4.40), cached input ($0.50 vs $0.26) and long-context pricing (reprices above roughly 272K vs flat to 1M).

Бенчмарки едва касаются

Вот что действительно странно в этом противостоянии, и то, о чём ни одна текущая страница рейтинга не говорит прямо: эти две модели почти никогда не измеряются на одном и том же тесте.

Sakana сообщает, что Fugu Ultra v2 показал лучший или равный лучшему результат в пяти из восьми бенчмарков — GDP.pdf, Chartography, SWEFish, DeepSWE и Toolathon — и вошёл в топ-2 в семи из восьми. Две ключевые цифры, которые она приводит, — это Chartography с 48,3 против Opus 5 с 27,3 и Fable 5 с 29,5, а также DeepSWE с 74,3. SWEFish и Toolathon — это собственные внутренние бенчмарки Sakana. Всё это заявлено производителем, и ничто из этого не было независимо воспроизведено на момент публикации.

Показатели Z.ai для GLM 5.2 взяты из совершенно другого источника: Terminal-Bench 2.1 — 81,0, SWE-bench Pro — 62,1, GPQA-Diamond — 91,2, AIME 2026 — 99,2, HLE — 40,5; они также заявлены производителем. Что касается независимых оценок, GLM 5.2 имеет AA Coding Index 68,8 и Intelligence Index 39 на пересчитанной странице Artificial Analysis, где он отмечен как предварительная оценка и занимает 7-е место из 113. Более старые упоминания 51 или 53 для GLM 5.2 относятся к устаревшей шкале индекса, и их не следует цитировать.

Так что если вы хотите получить чистое число для прямого сравнения, его нет. Ближе всего к общей оси то, что обе компании сильны в агентном кодинге, и честная интерпретация такова: каждая компания публиковала результаты по тестам, в которых она показывает хорошие результаты. Это причина провести собственную оценку, а не выбирать более высокое число.

Одна вещь, которую стоит отметить всем, кто сегодня покупает GLM 5.2: это уже не самая новая модель Z.ai. GLM-5.3 появилась примерно 14 августа 2026 года по той же рекомендованной цене, но под нестандартной лицензией, которая ограничивает крупных облачных провайдеров — поэтому GLM 5.2 остаётся последним полностью лицензированным по MIT флагманом Z.ai и причиной, по которой у него по-прежнему есть отдельный аргумент в пользу покупки.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

Лицензия — самый резкий водораздел

Отложите бенчмарки в сторону — и структурное различие окажется резче любого показателя.

GLM 5.2 поставляется с открытыми весами под лицензией MIT на Hugging Face, без региональных ограничений. Вы можете скачать её, запустить на собственном оборудовании, дообучить и встроить в продукт, не спрашивая ни у кого разрешения и вообще не платя за токены. Z.ai обучила её — примечательно, что, по собственному заявлению компании, полностью на ускорителях Huawei Ascend, а не Nvidia.

Fugu Ultra v2 не даёт ничего из этого. Это хостинговый сервис: политика оркестрации для пула моделей, состав которого Sakana описала лишь в самых общих чертах. Вы не можете ни скачать его, ни изучить, ни зафиксировать его версию, ни запустить его в изолированном контуре. Вместо этого вы получаете абстракцию — единую точку входа, поведение которой в принципе устойчиво к исчезновению любой одной вышестоящей модели. Это настоящее преимущество для продакшен-системы, которая не может позволить себе исчезновение зависимости. И это тоже настоящая плата, потому что за неё вы отдали контроль.

Если ваше ограничение — «модель не должна меняться у меня под руками», то подходит только один из этих ответов. Если ваше ограничение — «модель не должна быть удаляемой кем-то другим», то подходит только другой.

Скорость и то, что тестировщики сказали о последнем.

GLM 5.2 измеримо не быстр: Artificial Analysis зафиксировала примерно 66,3 токена в секунду при времени до первого токена около 4,03 секунды, что скромно для модели фронтирного класса, а собственные пользователи Z.ai жаловались на перегрузку обслуживания в часы пик.

Sakana не публикует данные о задержке или пропускной способности для Fugu Ultra v2, что само по себе показательно — у системы, которая направляет запросы к нескольким моделям, профиль задержки полностью зависит от того, что она решит вызвать, поэтому одно число пропускной способности было бы почти бессмысленным. Для предыдущей Fugu Ultra тестировщики публично сообщали о запусках, растягивавшихся примерно до 30 минут, и затратах, значительно превышающих ставку одной модели для той же задачи. Это модель июня 2026 года, а не свидетельство о v2 — но именно этот режим отказа и следует проверять, и именно поэтому сравнение по токенам льстит оркестраторам.

Screenshot of the OrcaRouter model page for GLM 5.2 showing the z-ai/glm-5.2 identifier, a 1M token context window, 128K maximum output, and input pricing of $1.40 per million tokens with output at $4.40.

Как бы вы на самом деле назвали каждый из них?

GLM 5.2 уже доступен на OrcaRouter сегодня по собственным тарифам провайдера Z.ai — $1.40 за миллион входных токенов и $4.40 за миллион выходных, передаются без наценки, так что любое снижение цен от Z.ai появляется здесь в тот же день. Он совместим с OpenAI, поэтому переключение на него — это изменение базового URL и ID модели в SDK, который у вас уже есть, и вы можете поместить его за цепочку отказоустойчивости или правило маршрутизации, вместо того чтобы ставить производственный путь на одного провайдера.

Fugu Ultra v2 — это не то, что мы маршрутизируем. Он доступен через собственный OpenAI-совместимый API Sakana AI, и изменение одного параметра переводит существующую интеграцию Fugu на него. Если вы сравниваете его с GLM 5.2, практичный вариант — оставить GLM 5.2 на вашем существующем шлюзе и напрямую вызывать Fugu Ultra v2 от Sakana, пока вы принимаете решение: оба совместимы с OpenAI, поэтому они могут находиться в одном и том же пути кода за флагом.

Какой выбрать?

Выбирайте GLM 5.2, если вам нужен предсказуемый вариант по известной цене: веса под лицензией MIT, которые вы могли бы развернуть у себя уже завтра, фиксированные $1.40 / $4.40 без надбавки за длинный контекст, действительно рабочее окно в 1M и скидка, которая накапливается при кэшированных агентных циклах. Смиритесь с тем, что он работает только с текстом, что он на поколение отстаёт от GLM-5.3 и что его оценка в независимом индексе предварительна.

Выберите Fugu Ultra v2, если то, что вы покупаете, — это устойчивость плюс пиковые возможности на сложных многошаговых задачах, и вы готовы платить за координацию по токенам и отказаться от возможности проверять или самостоятельно хостить то, что вызываете. Сам вендор утверждает, что он достигает результатов уровня фронтирных моделей, не завися от фронтирных моделей, — реальное и необычное утверждение, и такое, которое по состоянию на сегодня не удалось проверить буквально никому за пределами Sakana.

Чего мы точно не стали бы делать, так это выбирать между ними по таблице бенчмарков. Тесты почти не пересекаются, оба вендора опубликовали результаты на своей самой сильной стороне, а решающий показатель — стоимость одной выполненной долгосрочной задачи — как раз тот, который ни одна из компаний не опубликовала.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно