
Tencent HY-MT2 1.8BがホステッドAPIに対応:Tencentの440MB翻訳モデルがクラウドへ移行
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 426 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 183 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 115 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
Tencent HY-MT2 1.8B、Hy-MT2翻訳ファミリーのコンパクトメンバーで、Tencent Hunyuanが2026年5月21日にオープンソース化したものは、セルフホストのみではなく、ホスト型商用API経由で呼び出し可能になりました。モデルのAPIリストは2026年8月20日に公開され、入力トークン100万あたり約0.044ドル、出力トークン100万あたり約0.177ドルです。このリスト掲載日は通常以上に重要です。なぜなら、1.8Bは単なる別のオープンチェックポイントでは決してなく、440MBの量子化翻訳モデルが完全にスマートフォン上で動作することを証明するためにTencentが構築したモデルであり、オープンソースリリースから3か月間、Tencent自身のHyTranslateミニプログラムと、それに続くiOSおよびAndroidアプリ内にも搭載されて出荷されているからです。この記事では、ホスト型APIの開始によって何が変わるのか、モデルが実際には何なのか、そしてどの数値を信頼すべきかについて説明します。
8月20日に実際に何が変わったのか
これまで、Tencent HY-MT2 1.8B を使うには、Apache-2.0 の重みを transformers、vLLM、SGLang、llama.cpp に自分で読み込むか、Tencent の一般向け翻訳製品を使うかの、どちらかでした。ホスト型 API は第三の道です。HTTP でテキストを送信すると、Tencent Cloud が 1.8B エンドポイントを提供します。このモデルは 8,192 トークンのコンテキストと最大 4,096 トークンの出力を維持し、テキストのみを処理し、価格は入力 100 万トークンあたり約 0.044 米ドル、出力 100 万トークンあたり約 0.177 米ドルです。翻訳量が変動するチームにとって、これにより「GPU を運用しなければならない」という敷居が取り除かれ、モデルを試しやすくなります。

話の残り半分はアプリだ。HyTranslateミニプログラムは、5月のオープンソース公開と同時に、音声入力、スタイルプリセット、オフラインモードを備えて登場した。ネットワーク不要の翻訳のためにオンデバイスモデルをダウンロードするiOS/Androidアプリも、その後リリースされている。1.8Bモデルは、このオフライン戦略の立役者だ。AngelSlimの1.25ビット極限量子化により、ストレージを約440MBにまで縮小し、Apple、Qualcomm、MediaTekのスマートフォン向けシリコン上でローカルに動作する。Tencentによると、Apple A15での推論は前世代の4ビット版と比べて1.5倍高速だという。
1.8Bとは何か
HY-MT2-1.8B は、hunyuan_v1_dense アーキテクチャ上に構築された、高密度(dense)でデコーダーのみの因果言語モデル(causal LM)です。名称は1.8Bですが、実際には約20億のパラメータを持ち、チャットテンプレートを備え、デフォルトのシステムプロンプトはありません。 33言語に加え、5つの少数民族言語・方言ペア(中国語、英語、日本語、韓国語、フランス語、スペイン語、ロシア語、アラビア語、タイ語、ベトナム語、インドネシア語、ヒンディー語、ベンガル語、タミル語、およびチベット語、ウイグル語、カザフ語、モンゴル語、広東語の方言ペアを含む)の間で翻訳を行います。 従来のエンコーダー・デコーダー型の翻訳モデルとは異なり、このモデルは指示チューニング(instruction-tuned)されています。対象言語と任意の指示をプロンプトとして与えると、JSONやHTMLの構造を保持し、用語集を尊重し、文体(レジスター)を合わせ、周囲の文脈を利用して曖昧さを解消できます。 この能力クラスは、同系の7Bモデルと30B-A3Bモデルが共有するものであり、Tencentがその評価のためにIFMTBenchベンチマークを併せて公開したものです。
ベンチマークの現状
品質に関する主張は注意深く読む価値がある。なぜなら、そのほぼすべてがテンセント自身によるものであり、本稿執筆時点では独立したラボによる再現はまだなされていないからである。テンセントは、HY-MT2-1.8BがGemini 3.1 Proの平均FLORES-200スコアの89.9%(7Bは97.9%、30B-A3Bは98.6%)、実世界のGEMBAスタイルのテストセットではGeminiの96.7%、8つの専門領域にわたるDomainMTBenchでは96.2%を達成したと報告している。一部の報道ではFLORES-200の数値を88.1%に切り下げて報じられたが、ベンダーのREADMEには89.9%と記載されている。テンセントはまた、1.8Bが総合的にMicrosoftやDoubaoなどのプロバイダーが提供する主流の商用翻訳APIを上回ると主張している。独立した再現はまだ存在しないため、これらはすべて監査済みの事実ではなく、ベンダー報告による方向性を示す証拠として扱うべきである。ベンダーに依存しない事実としては、33+5の言語セットが固定されていること、Apache-2.0ライセンスが本物であること、そしてスマートフォンで動作する440MBの量子化チェックポイントが独立して観測可能であることが挙げられる。

使い方と、その費用
• セルフホスト型 — Hugging Face または ModelScope から Apache-2.0 のウェイトを入手。transformers (>=5.6.0)、vLLM、SGLang、または llama.cpp の GGUF ビルドで実行できます。コストは GPU 使用料のみで、1.25ビット版は CPU クラスのデバイスでも動作します。

• ホステッドAPI — Tencent Cloudは、本稿執筆時点で、1.8Bモデルを入力トークン100万個あたり約$0.044、出力トークン100万個あたり約$0.177で提供している。ベンダー自身のAPIと複数のサードパーティプラットフォームがこのモデルを扱っている。
• 消費者向け — HyTranslateミニプログラムおよびiOS/Androidアプリ(ダウンロードしたオンデバイスモデルによるオフライン翻訳を含む)
1.8Bモデルの推奨サンプリング設定: temperature 0.7、top-p 0.6、top-k 20、repetition penalty 1.05、max tokens 4096。
翻訳パイプラインを構築しているのであって、コンシューマー向けアプリを出荷しているわけではない場合、このようなモデルについて興味深いのは、その価格が変動するものだということです。Tencentはすでに6月にHy-MT2-Pro APIのレートを引き下げています。まさにそのようなシナリオのために、0%マークアップのルーターが存在します。パススルーがプロバイダーの定価に基づいているため、ベンダーの価格引き下げは、ゲートウェイが価格を再設定した後ではなく、当日の請求書に反映されるからです。このモデル自体は、本稿執筆時点でOrcaRouterのロースターには載っていないため、ウェイトをセルフホストするか、Tencent CloudのAPIを直接呼び出すことになります。フェイルオーバーとシングルキー方式の利点は、その周囲に構築するより広範な翻訳スタックに当てはまるものであり、そこでは、安価な大量トラフィック用の小型オンデバイスモデルと、困難な言語ペア用の大規模モデルを混在させることが、ルーティングが表現するために作られた構成の一種となります。
結論
Tencent HY-MT2 1.8Bは、5月時点でスマートフォンサイズのApache-2.0翻訳モデルとしてすでに興味深い存在だった。8月20日のホステッドAPI掲載により、インフラを構築せずに評価したいチームにとって有力な候補となった。品質の数値はベンダー報告に基づくものであり、言語セットは最大化ではなく意図的に主流言語に絞られている。そして、デバイス上でのフットプリントの小ささこそが、このモデルの真に際立った特徴である。対象の言語ペアがその33に含まれるなら、自社のコンテンツでその主張が成り立つかどうかを確かめるコストは、これまでで最も低くなっている。
