「Tencent HY-MT2 1.8BがホステッドAPIを獲得」というヒーロータイトルカード。サブタイトルは「Tencentの440MB翻訳ツールがクラウドへ」。言語グリフを表示したスマートフォン、コンパクトな440MBチップを届けるクラウド、33個のドットを備えた地球儀、日付バッジに「2026年5月21日オープンソース化・2026年8月20日ホステッドAPI」と記載され、右下隅にはOrcaRouterのロゴが配置されている。
Guides & Insights

Tencent HY-MT2 1.8BがホステッドAPIに対応:Tencentの440MB翻訳モデルがクラウドへ移行

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Tencent HY-MT2 1.8B、Hy-MT2翻訳ファミリーのコンパクトメンバーで、Tencent Hunyuanが2026年5月21日にオープンソース化したものは、セルフホストのみではなく、ホスト型商用API経由で呼び出し可能になりました。モデルのAPIリストは2026年8月20日に公開され、入力トークン100万あたり約0.044ドル、出力トークン100万あたり約0.177ドルです。このリスト掲載日は通常以上に重要です。なぜなら、1.8Bは単なる別のオープンチェックポイントでは決してなく、440MBの量子化翻訳モデルが完全にスマートフォン上で動作することを証明するためにTencentが構築したモデルであり、オープンソースリリースから3か月間、Tencent自身のHyTranslateミニプログラムと、それに続くiOSおよびAndroidアプリ内にも搭載されて出荷されているからです。この記事では、ホスト型APIの開始によって何が変わるのか、モデルが実際には何なのか、そしてどの数値を信頼すべきかについて説明します。

8月20日に実際に何が変わったのか

これまで、Tencent HY-MT2 1.8B を使うには、Apache-2.0 の重みを transformers、vLLM、SGLang、llama.cpp に自分で読み込むか、Tencent の一般向け翻訳製品を使うかの、どちらかでした。ホスト型 API は第三の道です。HTTP でテキストを送信すると、Tencent Cloud が 1.8B エンドポイントを提供します。このモデルは 8,192 トークンのコンテキストと最大 4,096 トークンの出力を維持し、テキストのみを処理し、価格は入力 100 万トークンあたり約 0.044 米ドル、出力 100 万トークンあたり約 0.177 米ドルです。翻訳量が変動するチームにとって、これにより「GPU を運用しなければならない」という敷居が取り除かれ、モデルを試しやすくなります。

A screenshot of the Tencent Cloud techpedia page for Hy-MT2: High-Performance Multilingual Translation Model (captured Aug 20, 2026), showing the English page header with the Tencent Cloud nav, the title 'Hy-MT2: High-Performance Multilingual Translation Model for Real Use', and the table of contents starting with the model name.

話の残り半分はアプリだ。HyTranslateミニプログラムは、5月のオープンソース公開と同時に、音声入力、スタイルプリセット、オフラインモードを備えて登場した。ネットワーク不要の翻訳のためにオンデバイスモデルをダウンロードするiOS/Androidアプリも、その後リリースされている。1.8Bモデルは、このオフライン戦略の立役者だ。AngelSlimの1.25ビット極限量子化により、ストレージを約440MBにまで縮小し、Apple、Qualcomm、MediaTekのスマートフォン向けシリコン上でローカルに動作する。Tencentによると、Apple A15での推論は前世代の4ビット版と比べて1.5倍高速だという。

1.8Bとは何か

HY-MT2-1.8B は、hunyuan_v1_dense アーキテクチャ上に構築された、高密度(dense)でデコーダーのみの因果言語モデル(causal LM)です。名称は1.8Bですが、実際には約20億のパラメータを持ち、チャットテンプレートを備え、デフォルトのシステムプロンプトはありません。 33言語に加え、5つの少数民族言語・方言ペア(中国語、英語、日本語、韓国語、フランス語、スペイン語、ロシア語、アラビア語、タイ語、ベトナム語、インドネシア語、ヒンディー語、ベンガル語、タミル語、およびチベット語、ウイグル語、カザフ語、モンゴル語、広東語の方言ペアを含む)の間で翻訳を行います。 従来のエンコーダー・デコーダー型の翻訳モデルとは異なり、このモデルは指示チューニング(instruction-tuned)されています。対象言語と任意の指示をプロンプトとして与えると、JSONやHTMLの構造を保持し、用語集を尊重し、文体(レジスター)を合わせ、周囲の文脈を利用して曖昧さを解消できます。 この能力クラスは、同系の7Bモデルと30B-A3Bモデルが共有するものであり、Tencentがその評価のためにIFMTBenchベンチマークを併せて公開したものです。

ベンチマークの現状

品質に関する主張は注意深く読む価値がある。なぜなら、そのほぼすべてがテンセント自身によるものであり、本稿執筆時点では独立したラボによる再現はまだなされていないからである。テンセントは、HY-MT2-1.8BがGe​mini 3.1 Proの平均FLORES-200スコアの89.9%(7Bは97.9%、30B-A3Bは98.6%)、実世界のGEMBAスタイルのテストセットではGe​miniの96.7%、8つの専門領域にわたるDomainMTBenchでは96.2%を達成したと報告している。一部の報道ではFLORES-200の数値を88.1%に切り下げて報じられたが、ベンダーのREADMEには89.9%と記載されている。テンセントはまた、1.8Bが総合的にMicrosoftやDoubaoなどのプロバイダーが提供する主流の商用翻訳APIを上回ると主張している。独立した再現はまだ存在しないため、これらはすべて監査済みの事実ではなく、ベンダー報告による方向性を示す証拠として扱うべきである。ベンダーに依存しない事実としては、33+5の言語セットが固定されていること、Apache-2.0ライセンスが本物であること、そしてスマートフォンで動作する440MBの量子化チェックポイントが独立して観測可能であることが挙げられる。

A single-column spec scoreboard for Tencent HY-MT2 1.8B reading: Params: ~2B dense decoder-only; Languages: 33 + 5 dialect pairs; Released: May 21, 2026 · Apache-2.0; FLORES-200: 89.9% of Gemini 3.1 Pro; On-device: 440MB at 1.25-bit; API: ~$0.044 / $0.177 per 1M tokens; footer 'Benchmark figures vendor-reported; no independent scores yet.'

使い方と、その費用

• セルフホスト型 — Hugging Face または ModelScope から Apache-2.0 のウェイトを入手。transformers (>=5.6.0)、vLLM、SGLang、または llama.cpp の GGUF ビルドで実行できます。コストは GPU 使用料のみで、1.25ビット版は CPU クラスのデバイスでも動作します。

A screenshot of the Hugging Face model card for tencent/Hy-MT2-1.8B (captured Aug 20, 2026) showing the model header, the Tencent attribution, the Translation / Transformers / Safetensors tags, a 36-languages tag, the hunyuan_v1_dense architecture label, the arxiv 2605.22064 link, the apache-2.0 license, and the 2B-params model size.

• ホステッドAPI — Tencent Cloudは、本稿執筆時点で、1.8Bモデルを入力トークン100万個あたり約$0.044、出力トークン100万個あたり約$0.177で提供している。ベンダー自身のAPIと複数のサードパーティプラットフォームがこのモデルを扱っている。

• 消費者向け — HyTranslateミニプログラムおよびiOS/Androidアプリ(ダウンロードしたオンデバイスモデルによるオフライン翻訳を含む)

1.8Bモデルの推奨サンプリング設定: temperature 0.7、top-p 0.6、top-k 20、repetition penalty 1.05、max tokens 4096。

翻訳パイプラインを構築しているのであって、コンシューマー向けアプリを出荷しているわけではない場合、このようなモデルについて興味深いのは、その価格が変動するものだということです。Tencentはすでに6月にHy-MT2-Pro APIのレートを引き下げています。まさにそのようなシナリオのために、0%マークアップのルーターが存在します。パススルーがプロバイダーの定価に基づいているため、ベンダーの価格引き下げは、ゲートウェイが価格を再設定した後ではなく、当日の請求書に反映されるからです。このモデル自体は、本稿執筆時点でOrcaRouterのロースターには載っていないため、ウェイトをセルフホストするか、Tencent CloudのAPIを直接呼び出すことになります。フェイルオーバーとシングルキー方式の利点は、その周囲に構築するより広範な翻訳スタックに当てはまるものであり、そこでは、安価な大量トラフィック用の小型オンデバイスモデルと、困難な言語ペア用の大規模モデルを混在させることが、ルーティングが表現するために作られた構成の一種となります。

結論

Tencent HY-MT2 1.8Bは、5月時点でスマートフォンサイズのApache-2.0翻訳モデルとしてすでに興味深い存在だった。8月20日のホステッドAPI掲載により、インフラを構築せずに評価したいチームにとって有力な候補となった。品質の数値はベンダー報告に基づくものであり、言語セットは最大化ではなく意図的に主流言語に絞られている。そして、デバイス上でのフットプリントの小ささこそが、このモデルの真に際立った特徴である。対象の言語ペアがその33に含まれるなら、自社のコンテンツでその主張が成り立つかどうかを確かめるコストは、これまでで最も低くなっている。