Сгенерированная титульная карточка с надписью GPT-6 Sol vs Tencent HY4 Preview, более дешёвая модель обслуживает трафик, карточки статистики с надписями: цена вывода $10.00 против $2.50 за миллион, закрытые веса против открытых весов Apache 2.0, входные данные: текст, изображение, файл против только текста, а также нижний колонтитул с надписью: тарифы GPT-6 Sol по тарифной карте OpenAI; тариф и скорость Tencent HY4 Preview по каталогу OrcaRouter, список поставщиков 6 / 18 юаней за миллион.
Guides & Insights

GPT-6 Sol против Tencent HY4 Preview: более дешёвая модель обслуживает в шестьсот раз больше трафика

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Сравнения между передовой моделью и дешёвой обычно заканчиваются на таблице цен, но у этого есть более удачный финал. Tencent HY4 Preview и GPT-6 Sol оба маршрутизируются через OrcaRouter, а значит, одна и та же телеметрия охватывает обе модели, и за одно и то же скользящее семидневное окно модель HY4 Preview обработала примерно 2,4 млрд токенов против 3,9 млн у GPT-6 Sol. Это не бенчмарк и не вердикт; это скользящее окно по трафику одной платформы, и на следующей неделе оно будет читаться иначе. Но это реальный сигнал о том, к чему на самом деле тянутся люди, которые что-то создают, когда сильная открытая по весам модель стоит четверть закрытой, и это тот вид числа, который не может выдать спецификация.

Эти две модели также представляют собой исследование того, что бенчмарк может и не может вам сказать. GPT-6 Sol, выпущенная 22 сентября 2026 года как средний уровень поколения GPT-6 от OpenAI, имеет независимую оценку Intelligence Index. HY4 Preview, выпущенная и открытая Tencent 28 августа 2026 года, не имеет ни страницы модели на Artificial Analysis, ни стороннего индекса, ни независимой оценки стоимости за задачу вообще. Всё опубликованное о том, насколько хорошо она работает, — это собственные измерения Tencent. Эта асимметрия не делает HY4 Preview более слабой моделью. Она делает её менее проверенной, и это разные утверждения.

Спецификации, включая две, которые определяют большинство развёртываний.

• Цена вывода — GPT-6 Sol $10.00 за миллион токенов против Tencent HY4 Preview $2.50 за миллион токенов
• Цена ввода — GPT-6 Sol $2.00 за миллион токенов против Tencent HY4 Preview $0.83 за миллион токенов
• Кэшированный ввод — GPT-6 Sol $0.20 за миллион токенов против Tencent HY4 Preview $0.04 за миллион токенов
• Веса — GPT-6 Sol закрытые, доступ только через API, против HY4 Preview с открытым исходным кодом под Apache 2.0
• Модальности ввода — GPT-6 Sol текст, изображения и файлы против HY4 Preview только текст
• Контекстное окно — GPT-6 Sol 1,050,000 токенов против HY4 Preview 1,048,576 токенов
• Макс. вывод — GPT-6 Sol 128,000 токенов против HY4 Preview 64,000 токенов
• Ступень цены для длинных запросов — GPT-6 Sol пересчитывает цену всего запроса при превышении 272,000 входных токенов до $4.00 / $15.00 против HY4 Preview без такой ступени в его карточке
• Архитектура — GPT-6 Sol не раскрыта против HY4 Preview 770B общих параметров, 49B активных, 78 слоёв, 256 маршрутизируемых экспертов плюс один общий, нативный слой многотокенного прогнозирования
• Независимая оценка — GPT-6 Sol 47.6 Intelligence Index против HY4 Preview нет опубликованных данных
• Измеренная скорость вывода — GPT-6 Sol примерно 244 токена в секунду против HY4 Preview примерно 54, оба показателя — скользящие семидневные

Две строки, которые определяют большинство реальных развёртываний, — это те, что находятся в самом низу. Первая: HY4 Preview не принимает на вход изображения или файлы, что исключает его из любого конвейера, которому нужно на что-то посмотреть. Вторая — потолок вывода: 64 000 токенов — это половина от 128 000 у GPT-6 Sol, и для модели, заявленное назначение которой — агенты для программирования и длинные цепочки использования инструментов, именно это ограничение команда ощущает первым — не качество, а момент, когда сгенерированный файл больше не помещается в один ответ.

По сравнению с ними четверть цены за вывод и пятая часть цены за кэшированный ввод означают, что можно позволить себе массу повторных попыток. А архитектура HY4 Preview документирована, в отличие от архитектуры GPT-6 Sol: Tencent опубликовала число параметров, число слоёв, схему размещения экспертов и слой спекулятивного декодирования, а значит, характеристики обслуживания как минимум частично предсказуемы по статье, а не наблюдаемы только через API.

Generated comparison scoreboard titled GPT-6 Sol vs Tencent HY4 Preview, the scoreboard, with six matched rows. GPT-6 Sol: input $2.00 per million, output $10.00 per million, modalities text image file, weights closed, context window 1,050,000 tokens, Intelligence Index 47.6. Tencent HY4 Preview: input $0.83 per million, output $2.50 per million, modality text only, weights Apache 2.0 open, context window 1,048,576 tokens, no independent score published. A footer reads Tencent HY4 Preview rates per OrcaRouter's catalogue against a vendor list of 6 / 18 yuan per million; GPT-6 Sol figures per Artificial Analysis v4.3.2 and OpenAI.

Что на самом деле представляет собой таблица бенчмарков HY4 Preview

Опубликованные Tencent показатели сильны, и все они получены самим вендором. На Terminal-Bench 2.1 модель показывает 85,4; на DeepSWE — 64,3; а во внутренней слепой оценке по 203 инженерным задачам она набрала в среднем 2,99 против 2,92 у GLM-5.3 и 2,94 у Kimi K3 — преимущество в семь сотых балла по десятибалльной шкале в исследовании, которое разработал сам Tencent. Она также дебютировала в таблице лидеров WebDev Arena, где, по сообщению Tencent, заняла примерно пятое место в общем зачёте и третье среди моделей с открытыми весами. Результат арены основан на голосовании публики, а не на оценке вендора, и это самое независимое свидетельство в наборе; остальное — утверждение, а утверждение всё ещё стоит читать, если оно обозначено как таковое.

Проблема не в том, что эти числа могут быть завышены — у вендорских тестовых стендов это обычно бывает, причём в обе стороны. Проблема в том, что нет второго измерения, с которым их можно сравнить. Модель со страницей Artificial Analysis можно проверить; модель без неё — нельзя, и эта разница проявляется месяцами позже, когда кто-то обнаруживает, что ключевое число было измерено на стенде, который никто больше не может воспроизвести. Ничто здесь не указывает на то, что это случилось с HY4 Preview. Это лишь означает, что решение о внедрении, опирающееся на 85.4, опирается на один источник.

Практический вывод таков: HY4 Preview следует оценивать на собственном трафике, а не по таблице, и структура затрат делает это дешёвым — при цене в четверть от стоимости вывода GPT-6 Sol неделя теневого трафика на ваших реальных промптах обходится дешевле, чем один обзор тарифного уровня API. Это правильная форма должной проверки для недостаточно измеренной модели, и именно её почти никто на практике не применяет.

Вопрос об открытых весах, который и есть настоящая разделительная линия

HY4 Preview имеет открытый исходный код под лицензией Apache 2.0, а вместе с базовым чекпойнтом поставляется сборка FP8 под разрешительной лицензией. GPT-6 Sol закрыт и не имеет файла лицензии, потому что лицензировать нечего. Всё остальное в этом сравнении — компромисс; а это — разница в категории.

Что это вам даёт — не столько более дешёвый счёт: при цене $2,50 за миллион токенов на выходе хостируемый API уже обходится дешевле, чем большинству команд стоит запуск модели на 770 миллиардов параметров, и если бы стоимость была единственным аргументом, разрешительная лицензия была бы ни при чём. Это даёт развёртывание, не зависящее ни от чьего эндпоинта: веса, которые невозможно ограничить по частоте запросов, чекпоинт, который можно квантовать под имеющееся у вас оборудование, модель, которую можно дообучить, и трафик, который может оставаться внутри сетевого периметра. На все четыре пункта GPT-6 Sol отвечает, что ни один из них вам не должен быть нужен, а это весомый аргумент для вполне реального круга команд и нерелевантный для тех команд, которым они действительно нужны.

Разделение по модальностям и строка лицензии указывают в одну сторону, и это стоит отметить. Модель, которая читает только текст и распространяется под Apache 2.0, создана как компонент — нечто, что вы помещаете внутрь контролируемого вами конвейера, подавая ему текст, который вы уже привели к единому виду. Модель, которая читает текст, изображения и файлы и доступна только через API, создана как точка входа, принимая грязный ввод напрямую. Это разные задачи, и сравнение, которое ранжирует их по единому индексу, отвечает на вопрос, которого не задавал ни один из вендоров.

OrcaRouter model page for Tencent Hy4 preview (tencent/hy4-preview) by Tencent, dated 2026-08-28, tagged Tools, JSON and Reasoning, describing it as Tencent's latest mixture-of-experts flagship with 770 billion total parameters, 49 billion activated per token, 78 layers, 256 routed experts plus one shared expert and a 1M-token context window, text-only, with a list price of $0.83 per million input and $2.50 per million output and a p50 time to first token of 6.18 seconds.

Обслуживание их вместе, и что подразумевает показатель трафика

Обе модели доступны через один ключ OrcaRouter вместе с ещё более чем 200 другими, и схема маршрутизации, которую предполагает это объединение, обратна очевидной. Поставьте HY4 Preview первым — это более дешёвая модель, вчетверо дешевле по выходу, именно у неё документированная архитектура, и на наших маршрутах именно она несёт нагрузку, — а GPT-6 Sol держите позади неё для запросов, которым нужно прочитать изображение, или которым нужно выдать больше 64 000 токенов, или которые не проходят проверку качества. Эта композиция выражается в DSL маршрутизации, а не в коде приложения, поэтому граница между ними — это правило, которое можно изменить без развёртывания.

Показатели скорости заслуживают оговорки, а затем вывода. HY4 Preview в нашем скользящем окне измеряется примерно в 54 выходных токена в секунду против примерно 244 у GPT-6 Sol, и то и другое — наблюдения на общей инфраструктуре, а не контролируемый бенчмарк; показатель Tencent в особенности отражает модель с очень большим числом активных параметров, а 49 миллиардов активных параметров на токен — это много арифметики на каждый выходной токен. Итак, более дешёвая модель оказывается более медленной с большим отрывом — именно такой компромисс пакетный конвейер с радостью принимает, а интерактивный — нет. Хостируемая сборка Tencent также получила оптимизацию производительности 7 сентября 2026 года, которая, по словам поставщика, сокращает число шагов рассуждения и потребление токенов на задачу при том же качестве выполнения задачи — ещё один показатель, заявленный поставщиком, но он предсказывает более низкий счёт, а не более быстрый поток.

Именно отказоустойчивость делает эту связку безопасной в любом порядке. Модель с открытыми весами и 770 миллиардами параметров обслуживается более чем одним поставщиком инфраструктуры, а маршрут, способный переключиться на резервный вариант, означает, что деградировавший хост — это повторная попытка, а не простой. Наш каталог передаёт прайс-листовые цены провайдеров без наценки, а это также означает, что указанный в валюте тариф поставщика не заставляет себя ждать: Tencent указывает HY4 Preview по 6 юаней за ввод и 18 юаней за вывод за миллион, и долларовая цифра на нашей странице — это конвертированный тариф, а не наценка реселлера.

Artificial Analysis model page for GPT-6 Sol (Max), a proprietary OpenAI model released September 2026, carrying a banner noting the model is deprecated and that OpenAI has launched a newer release, GPT-6.1 Sol. The page shows an Intelligence Index of 48, an output speed of 87.9 tokens per second, $2.00 per million input and $10.00 per million output, a 90% cache discount, and a 1M-token context window.

Для чего на самом деле нужна эта пара

Выбирайте Tencent HY4 Preview для больших объёмов, для текстовых пайплайнов, которые вы контролируете, для всего, что должно работать на вашем собственном оборудовании, и для любой нагрузки, где неверный ответ можно поймать и повторить, — цена делает повторные попытки самым дешёвым рычагом качества из доступных вам. Выбирайте GPT-6 Sol, когда на входе изображение или файл, когда один ответ должен вмещать больше 64 000 токенов или когда ответ увидит человек, который начнёт действовать, не проверяя. Берите оба, если в вашем трафике есть и то и другое, а это почти наверняка так.

Две завершающие проверки. HY4 Preview по-прежнему помечена как preview и остаётся самой новой моделью Tencent в нашем каталоге, так что название точное, а не устаревшее, — но предварительная версия может измениться у вас под ногами, а чекпойнт под разрешительной лицензией может быть вытеснен собственным финальным релизом без предупреждения. А GPT-6 Sol уже заменён на GPT-6.1 Sol при идентичных тарифах для короткого контекста, при этом цена кэшированного ввода снижена вдвое — с $0,20 до $0,10, а собственная страница модели OpenAI теперь направляет читателей туда. Если причина, по которой вы взвешиваете Sol, а не модель Tencent, — восьмидневная интеграция, это остаётся в силе. Если же причина в возможностях, то именно для преемника вам и нужно считать цену.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно