
Tencent HY-MT2 1.8B получает размещённый API: облачный переводчик Tencent на 440 МБ
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 426 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 183 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 115 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Tencent HY-MT2 1.8B, компактная модель из переводческого семейства Hy-MT2, чей исходный код Tencent Hunyuan открыла 21 мая 2026 года, теперь доступна через размещённый коммерческий API, а не только для самостоятельного размещения — её API появился 20 августа 2026 года с расценками примерно $0,044 за миллион входных токенов и $0,177 за миллион выходных токенов. Эта дата выхода значит больше, чем обычно, потому что модель 1.8B никогда не была просто очередным открытым чекпоинтом: это модель, которую Tencent создала, чтобы доказать, что квантованная переводческая модель размером 440 МБ может полностью работать на телефоне, и за три месяца после публикации с открытым исходным кодом она также поставляется внутри собственной мини-программы Tencent HyTranslate и выпущенных следом приложений для iOS и Android. Эта статья — о том, что меняет запуск размещённого API, что такое эта модель на самом деле и каким цифрам стоит доверять.
Что на самом деле изменилось 20 августа
До сих пор использование Tencent HY-MT2 1.8B означало одно из двух: либо самостоятельно загружать веса Apache-2.0 в transformers, vLLM, SGLang или llama.cpp, либо использовать потребительские продукты перевода Tencent. Размещённый API — это третий путь: вы отправляете текст по HTTP, а Tencent Cloud обслуживает конечную точку 1.8B. Модель сохраняет контекст на 8 192 токена и максимальный выходной объём в 4 096 токенов, работает только с текстом и оценивается примерно в $0,044 за миллион входных токенов и $0,177 за миллион выходных токенов. Для команд с неравномерным объёмом перевода это убирает нижний порог «необходимости обслуживать GPU» при опробовании модели.

Вторая половина истории — это приложения. Мини-программа HyTranslate, запущенная одновременно с релизом открытого исходного кода в мае, включает голосовой ввод, пресеты стилей и офлайн-режим. Приложения для iOS и Android, которые загружают модель на устройство для перевода без сети, с тех пор вышли. Модель 1.8B — рабочая лошадка этой офлайн-истории: благодаря экстремальному квантованию AngelSlim с разрядностью 1,25 бита она сжимается примерно до 440 МБ хранилища и работает локально на мобильных чипах Apple, Qualcomm и MediaTek, причём Tencent сообщает об ускорении инференса в 1,5 раза по сравнению с 4-битной сборкой предыдущего поколения на Apple A15.
Что за 1.8B
HY-MT2-1.8B — это плотная причинная языковая модель, состоящая только из декодера, построенная на архитектуре hunyuan_v1_dense: на практике в ней около 2 миллиардов параметров, несмотря на название 1.8B. Она использует чат-шаблон и не имеет системного промпта по умолчанию. Модель переводит между 33 языками, а также между пятью парами языков меньшинств и диалектов, включая китайский, английский, японский, корейский, французский, испанский, русский, арабский, тайский, вьетнамский, индонезийский, хинди, бенгальский, тамильский, а также пары тибетского, уйгурского, казахского, монгольского и кантонского диалектов. В отличие от классических моделей перевода архитектуры «энкодер-декодер», эта модель настроена на выполнение инструкций: вы задаёте ей целевой язык и необязательные инструкции, и она может сохранять структуру JSON и HTML, учитывать глоссарий, соблюдать стилистический регистр и использовать окружающий контекст для снятия неоднозначности. Именно этот класс возможностей присущ родственным моделям 7B и 30B-A3B, и именно для его оценки был выпущен бенчмарк IFMTBench от Tencent.
Как обстоят дела с бенчмарками
На заявления о качестве стоит обратить пристальное внимание, поскольку почти все они исходят от самой Tencent и по состоянию на момент написания не воспроизведены независимой лабораторией. Tencent сообщает, что HY-MT2-1.8B достигает 89,9% от среднего показателя Gemini 3.1 Pro в тесте FLORES-200 (7B — 97,9%, 30B-A3B — 98,6%), 96,7% от Gemini на собственном тестовом наборе в стиле GEMBA, приближенном к реальным сценариям, и 96,2% на DomainMTBench в восьми профессиональных доменах. Некоторые публикации в прессе округляли показатель FLORES-200 в меньшую сторону — до 88,1%; в README вендора указано 89,9%. Tencent также утверждает, что модель 1.8B в целом превосходит массовые коммерческие API перевода от таких провайдеров, как Microsoft и Doubao. Независимых воспроизведений пока нет, поэтому ко всему этому стоит относиться как к заявленным вендором ориентировочным данным, а не к проверенным фактам. Что не зависит от вендора: набор из 33+5 языков зафиксирован, лицензия Apache-2.0 реальна, а квантованный чекпойнт размером 440 МБ, работающий на телефоне, можно проверить независимо.

Как им пользоваться и сколько это стоит
• Самостоятельный хостинг — веса Apache-2.0 из Hugging Face или ModelScope; запуск с помощью transformers (>=5.6.0), vLLM, SGLang или GGUF-сборок llama.cpp. Стоимость — это ваш счёт за GPU; 1,25-битная сборка работает на устройствах уровня CPU.

• Хостируемый API — Tencent Cloud предоставляет модель 1.8B примерно за $0,044 за миллион входных токенов и $0,177 за миллион выходных токенов на момент написания; собственный API вендора и несколько сторонних платформ поддерживают её.
• Потребитель — мини-программа HyTranslate и приложения для iOS/Android, включая офлайн-перевод с помощью загруженной модели на устройстве.
Рекомендуемые параметры сэмплирования для 1.8B: температура 0.7, top-p 0.6, top-k 20, штраф за повторения 1.05, максимум токенов 4096.
Если вы строите конвейер перевода, а не выпускаете потребительское приложение, интересная особенность такой модели в том, что её цена — подвижная цель: Tencent уже снизил тариф на API Hy-MT2-Pro в июне. Именно для такого сценария и существует маршрутизатор с нулевой наценкой: поскольку транзит идёт по прейскурантной цене провайдера, снижение цены вендором отражается в счёте за тот же день, а не после того, как ваш шлюз пересчитает цены. Сама модель на момент написания отсутствует в реестре OrcaRouter, поэтому вам придётся либо самостоятельно хостить веса, либо напрямую вызывать API Tencent Cloud; аргумент об отказоустойчивости и едином ключе относится к более широкому стеку перевода, который вы построите вокруг неё, где смешивание небольшой модели на устройстве для дешёвого массового трафика с более крупной моделью для сложных языковых пар — это именно та композиция, для выражения которой и был создан роутинг.
Суть
Tencent HY-MT2 1.8B уже в мае был интересен как переводчик размером с телефон с лицензией Apache-2.0; появление в списке размещенных API 20 августа делает его кандидатом для команд, которые хотят оценить его без развертывания инфраструктуры. Показатели качества приводятся вендором, набор языков намеренно мейнстримный, а не максимальный, и именно компактность при работе на устройстве является по-настоящему отличительной чертой. Если ваши языковые пары входят в эти 33, сейчас дешевле, чем когда-либо, выяснить, подтверждаются ли заявленные характеристики на вашем контенте.
