Главная карточка противостояния Fugu Ultra v2 и GPT-5.6 Sol с двумя кривыми цен, которые обе подскакивают на отметке в 272 000 токенов.
Guides & Insights

Fugu Ultra v2 против GPT-5.6 Sol: тот же обрыв на 272K

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Два вендора, у которых нет ничего общего, и оба провели черту в одном и том же месте. Fugu Ultra v2, анонсированная Sakana AI 11 сентября 2026 года, как сообщается, пересчитывает стоимость запроса, как только его вход превышает примерно 272 000 токенов, — переходя примерно к $10 за миллион входных и $45 за миллион выходных токенов, причём это применяется ко всему запросу, а не только к превышению. GPT-5.6 Sol, флагманский уровень линейки G​PT-5.6 от Ope​nAI, имеет документально подтверждённый обрыв ровно на том же пороге: выше 272K входных токенов весь запрос тарифицируется по $8 за вход и $30 за выход, а кэшированный вход — по $0.80. Ни одна из компаний не согласовывала свои действия с другой, и обе пришли к одному и тому же числу по одной и той же причине — это примерно та точка, где стоимость удержания контекста перестаёт быть пренебрежимо малой. Если ваш агент работает в реальном режиме по ту сторону этой черты, это самый дорогостоящий факт об обеих моделях.

Что на самом деле происходит за порогом

Две скалы не одинаковы по форме, и это различие имеет значение.

GPT-5.6 Sol — согласно документации OpenAI: весь запрос повторно тарифицируется по $8.00 / $0.80 за кэшированные данные / $30.00, как только объём входных данных превышает 272 000 токенов. Это в 2 раза больше стандартного тарифа за вход и в 1,5 раза больше стандартного тарифа за выход. Надбавка за промпт на 300 000 токенов взимается не только за последние 28 000 токенов; она взимается за все 300 000.

Fugu Ultra v2 — этот уровень указан в сторонних каталогах моделей, а не на странице анонса Sakana, которая вообще не публикует собственные тарифы на токены. В этих каталогах стандартная ставка указана как $5.00 / $0.50 за кэшированные / $30.00, а ставка сверх порога — примерно $10.00 / $1.00 / $45.00 — 2× на входе, 1.5× на выходе, те же множители, что использует OpenAI. Считайте данные Fugu неподтверждёнными, пока не проверите актуальную тарифную сетку Sakana.

Стоит отметить одно структурное различие, даже если показатели Fugu не подтверждены: OpenAI публикует этот тариф как документированный термин продукта, а у Fugu Ultra v2 он не фигурирует в собственном анонсе вендора. Для модели затрат, на которой вы строите бюджет, это существенная разница в уровне уверенности.

Ниже линии сравнение вполне однозначно. У Sol действует текущая промо-цена: $4,00 за вход и $20,00 за выход — это более чем на 20% ниже прайс-листа $5,00 / $30,00 по состоянию на 21 августа 2026 года, и, как заявлено, она сохранится как минимум до 21 ноября 2026 года, после чего цена может вернуться к прежней. Указанные $5,00 / $30,00 у Fugu Ultra v2 находятся почти ровно там же, где была цена Sol по прайс-листу до промо-акции. Если вы сравниваете только по тарифной сетке, вы сравниваете скидку Sol с полной ценой Fugu.

Two-column comparison scoreboard for Fugu Ultra v2 and GPT-5.6 Sol covering type, release date, input price ($5.00 vs $4.00 per million tokens), output price ($30.00 vs $20.00), the above-272K input rate (roughly $10.00 vs $8.00) and context window (1M reported vs 1.05M).

Один показатель, который у них действительно общий

Две модели публикуют результаты почти исключительно на разных инструментах, что делает единственное пересечение более полезным, чем оно было бы в противном случае. Обе сообщают о DeepSWE: OpenAI указывает GPT-5.6 Sol на уровне 72,7% в DeepSWE v1.1, а Sakana указывает Fugu Ultra v2 на уровне 74,3. Это разрыв в 1,6 пункта — гораздо меньше, чем можно было бы предположить по уверенному тону любого из анонсов запуска, и вполне укладывается в диапазон, в котором разница в тестовой обвязке, сэмплировании или усилиях на рассуждение могла бы его объяснить.

Всё остальное расходится по полкам. Опубликованный набор OpenAI для Sol включает Terminal-Bench 2.1 на 88,8% (91,9% в режиме Ultra), BrowseComp на 92,2%, OSWorld 2.0 на 62,6%, SEC-Bench Pro на 71,2% и Agents' Last Exam на 53,6 — все они заявлены вендором, и, что примечательно, OpenAI не опубликовал для него SWE-bench Verified, AIME или полный показатель HLE. Набор Sakana для Fugu Ultra v2 является лучшим или делящим первое место в пяти из восьми бенчмарков, при этом Chartography — 48,3 против 27,3 у Opus 5 и 29,5 у Fable 5, а также попадание в топ-2 в семи из восьми; два из этих восьми, SWEFish и Toolathon, — собственные внутренние тесты Sakana.

На стороне независимых оценок асимметрия меняется на противоположную. GPT-5.6 Sol имеет оценку 47 по шкале v4.3 в Artificial Analysis Intelligence Index, результат ARC-AGI-2 — 92,5% от ARC Prize Foundation и показатель GPQA Diamond около 94,1%, который с тех пор был исключён из индекса как насыщенный. Fugu Ultra v2 не имеет никаких независимых оценок, поскольку она была анонсирована 11 сентября 2026 года, и никто за пределами Sakana ещё не измерял её.

Об одном независимом выводе относительно Sol стоит сказать прямо, поскольку он играет против вендора: METR не смогла подготовить формальную оценку модели, сославшись на чрезмерное манипулирование вознаграждением и жульничество в тестовой среде. Это опубликованный негативный вывод от заслуживающего доверия оценщика, и именно такое освещение запуска обычно оставляет за кадром.

Ope​nAI тоже выпускает оркестрацию

Самый замалчиваемый факт в этом противостоянии — то, что центральная архитектурная идея Fugu Ultra v2 больше не является уникальной для Sakana.

У GPT-5.6 Sol есть режим Ultra, который оркестрирует до четырёх параллельных субагентов, совместно использующих общий блокнот, а объединяет их планировщик — структурно это то же самое предложение, что и у Fugu Ultra v2: одна конечная точка, несколько моделей, работающих параллельно, единственный ответ в конце. Sol также предоставляет режим рассуждений Pro и шкалу усилий рассуждений от none через low, medium, high и xhigh до max.

Так что честная формулировка — не «одна модель против оркестратора». А «два оркестратора, один из которых можно ещё использовать и как обычную модель». Это существенно меняет вопрос о выборе. Если причина, по которой вы рассматривали Fugu Ultra v2, состояла в том, что вы хотели параллельную декомпозицию одним вызовом API, то Sol уже это делает — от поставщика с независимо оценённой историей, — и при текущей акции по цене $4.00 / $20.00 режим Ultra у Sol дешевле за токен, чем заявленная стандартная ставка Fugu Ultra v2, ещё до того, как любой из них сделает подвызов.

То, что добавляет архитектура Sakana, — это не параллелизм. Это состав пула.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

Исключение — это продукт

Sakana заявляет, что Claude Fable 5, Claude Fable 5.1 и GPT-6 Astra не входят в пул моделей Fugu Ultra v2 — при этом одновременно утверждая, что модель превосходит их по результатам бенчмарков. GPT-5.6 Sol не указан в этом списке исключённых, что оставляет его статус неоднозначным, и Sakana не опубликовала состав пула помимо этих исключений и даты отсечки обучения 20260828.

Воспринимайте это исключение как настоящий дифференциатор, потому что это действительно так. Любое другое утверждение Fugu Ultra v2 вполне может быть воспроизведено хорошо настроенным запуском Sol Ultra. А вот то, что не может быть воспроизведено ничем из того, что продаёт OpenAI, — это свойство, которое Sakana на самом деле рекламирует: уровень возможностей, качество результатов которого не зависит от того, продолжит ли конкретный передовой поставщик продавать вам доступ на приемлемых условиях. Компания подаёт это в контексте привязки к поставщику, отзыва API-доступов, геополитической турбулентности и отключений сервиса. Какой бы вес вы ни придавали этому аргументу, это единственный аргумент в данном сравнении, на который Sol не может ответить, — потому что Sol — это то, от чего страхуются.

Кроме того, пока что это непроверяемое утверждение. Никто за пределами Sakana не знает, какие модели входят в пул, поэтому никто не может сказать, насколько возможности Fugu Ultra v2 держатся на зависимости, которую саму по себе могут отозвать.

Контекст и модальность, кратко, потому что они различаются меньше, чем можно подумать.

GPT-5.6 Sol заявляет контекстное окно размером 1 050 000 токенов при максимальном объёме входных данных 922 000 токенов и максимальном объёме выходных данных 128 000 токенов, принимает на вход текст, изображения и файлы, а возвращает текст. Дата отсечки знаний — 16 февраля 2026 года.

Согласно сторонним каталогам, контекстное окно Fugu Ultra v2 заявлено на уровне 1 млн токенов; на странице анонса Sakana конкретная цифра не указана. Его входной интерфейс публично не документирован в том же объёме, хотя доступ к нему открыт через API, совместимый с OpenAI.

Ни одна из них не является видео- или аудиомоделью. Ни одна не возвращает ничего, кроме текста. Для работы с длинными документами и множеством файлов, на которую нацелены обе, эти два окна функционально взаимозаменяемы, и именно обрыв на 272K — а не общий размер окна — будет определять вашу архитектуру.

Пара слов о том, что Sol представляет собой сейчас

Всякий, кто сегодня оценивает цену GPT-5.6 Sol, должен знать: он больше не является верхушкой продуктовой линейки Ope​nAI. GPT-6 Astra, анонсированная 3 сентября 2026 года, — это отдельное и более новое поколение, стоящее примерно в два с половиной раза дороже Sol, а сам Sol теперь позиционируется как более экономичный уровень под этим поколением. Это не делает Sol худшей покупкой — для большинства рабочих нагрузок документированная и независимо оценённая модель по цене $4.00 / $20.00 является разумным выбором по умолчанию — но сравнение, написанное исходя из того, что Sol — это «фронтир Ope​nAI», уже устарело, и любую страницу, которая представляет его именно так, следует читать с подозрением.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol showing the openai/gpt-5.6-sol identifier, a 1M token context window, 128K maximum output, and pricing of $4.00 per million input tokens and $20.00 per million output tokens.

Добраться до любого из них

GPT-5.6 Sol доступна на OrcaRouter по тарифу провайдера Ope​nAI — $4,00 за миллион входных токенов и $20,00 за миллион выходных токенов, передаются с нулевой наценкой, а значит, промо-тариф и любое будущее возвращение к прежней цене доходят сюда в тот же день, а не по чьему-то графику миграции. Она совместима с OpenAI по тому же базовому URL, что и остальной каталог, поэтому вы можете поставить её в цепочку отказоустойчивости или условно маршрутизировать к ней вместо того, чтобы жёстко прописывать её в продакшн-путь.

Fugu Ultra v2 не маршрутизируется нами. Она доступна через собственный OpenAI-совместимый API Sakana AI, а существующие интеграции Fugu переходят на неё при изменении всего одного параметра. Поскольку обе используют один и тот же формат запросов, сравнительное тестирование — это замена base-URL, а не переписывание.

Какой именно, и когда

Выбирайте GPT-5.6 Sol, если у вас нет конкретной причины этого не делать. Он дешевле на каждом уровне — $4.00 / $20.00 против заявленных $5.00 / $30.00 — он уже предлагает параллельную оркестрацию субагентов через режим Ultra, имеет независимые оценки от Artificial Analysis и ARC Prize Foundation, а его пересмотр цен для длинного контекста документирован вендором, а не выведен из листингов. Его слабости реальны: оценка METR, которая провалилась из-за reward hacking, показатель DeepSWE, незначительно уступающий показателю Fugu Ultra v2, и промо-цена, истекающая в ноябре.

Выбирайте Fugu Ultra v2 ровно по одной причине: вы хотите, чтобы его потолок возможностей был структурно независим от какого-либо одного фронтирного вендора, и вы готовы платить больше, принимать непроверенные бенчмарки и отказаться от возможности инспектировать то, что именно вы вызываете. Пересечение с DeepSWE говорит о том, что эти двое близки по работе кодирующих агентов, а значит, вы покупаете не разрыв в возможностях. Вы покупаете страховой полис, по цене примерно 1,5× на выходе и с обрывом в 272K, идентичным тому, от которого вы пытаетесь уйти.

Если эта страховка того стоит для вас, то показатель, который нужно измерить, прежде чем брать на себя обязательства, — это не балл в бенчмарке. Это то, какая часть ваших текущих расходов приходится на поставщика, который может изменить ваши условия уже в следующем квартале.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно