Ett hero-titelkort för 'Tencent HY-MT2 1.8B får ett värdbaserat API', med underrubriken 'Tencents 440 MB-översättare går till molnet', som visar en smartphone med en språkikon, ett moln som levererar ett kompakt 440 MB-chip, en glob med 33 punkter, en datumbricka med texten 'Släppt som öppen källkod 21 maj 2026 · Värdbaserat API 20 aug 2026' och OrcaRouter-logotypen i nedre högra hörnet.
Guides & Insights

Tencent HY-MT2 1.8B får ett värdbaserat API: Tencents 440MB-översättare flyttar till molnet

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Tencent HY-MT2 1.8B, den kompakta medlemmen i Hy-MT2-översättningsfamiljen som Tencent Hunyuan släppte som öppen källkod den 21 maj 2026, är nu anropsbar via ett värdbaserat kommersiellt API snarare än enbart självhostat – modellens API-listning gick live den 20 augusti 2026, för ungefär 0,044 USD per miljon inmatningstoken och 0,177 USD per miljon utmatningstoken. Det datumet för listningen spelar större roll än det brukar, eftersom 1.8B aldrig var bara ännu en öppen checkpoint: det är modellen som Tencent byggde för att bevisa att en 440 MB kvantiserad översättningsmodell kan köras helt på en telefon, och under de tre månaderna sedan öppen källkod-släppet har den även levererats i Tencents egen HyTranslate-miniprogram samt iOS- och Android-apparna som följde. Den här artikeln handlar om vad lanseringen av det värdbaserade API:t förändrar, vad modellen faktiskt är och vilka siffror du bör lita på.

Vad var det som faktiskt ändrades den 20 augusti?

Hittills har användning av Tencent HY-MT2 1.8B inneburit ett av två alternativ: att själv ladda Apache-2.0-vikterna i transformers, vLLM, SGLang eller llama.cpp, eller att använda Tencents konsumentprodukter för översättning. Det värdbaserade API:t är en tredje väg — du skickar text över HTTP, och Tencent Cloud tillhandahåller 1.8B-slutpunkten. Modellen behåller sin kontext på 8 192 tokens och ett maxutdata på 4 096 tokens, hanterar endast text och prissätts till cirka 0,044 USD per miljon tokens i indata och 0,177 USD per miljon tokens i utdata. För team med ojämn översättningsvolym tar detta bort tröskeln ”måste driva en GPU” för att prova modellen.

A screenshot of the Tencent Cloud techpedia page for Hy-MT2: High-Performance Multilingual Translation Model (captured Aug 20, 2026), showing the English page header with the Tencent Cloud nav, the title 'Hy-MT2: High-Performance Multilingual Translation Model for Real Use', and the table of contents starting with the model name.

Den andra halvan av historien är apparna. HyTranslate-miniprogrammet lanserades i samband med open source-släppet i maj, med röstinmatning, stilförinställningar och offline-läge. iOS- och Android-apparna — som laddar ner on-device-modellen för nätverksfri översättning — har sedan dess lanserats. 1.8B är arbetshästen i den offline-historien: med AngelSlims extrema 1,25-bitarskvantisering krymper den till cirka 440 MB lagringsutrymme och körs lokalt på mobilkretsar från Apple, Qualcomm och MediaTek, där Tencent rapporterar 1,5 gånger snabbare inferens än förra generationens 4-bitarsbygge på en Apple A15.

Vad 1.8B är

HY-MT2-1.8B är en tät, decoder-only kausal språkmodell byggd på hunyuan_v1_dense-arkitekturen — cirka 2 miljarder parametrar i praktiken trots namnet 1.8B — med en chattmall och inget standardsystemprompt. Den översätter mellan 33 språk plus fem minoritetsspråk- och dialektpar, inklusive kinesiska, engelska, japanska, koreanska, franska, spanska, ryska, arabiska, thailändska, vietnamesiska, indonesiska, hindi, bengali, tamil samt de tibetanska, uiguriska, kazakiska, mongoliska och kantonesiska dialektparen. Till skillnad från de klassiska encoder-decoder-översättningsmodellerna är den instruktionsanpassad: du uppmanar den med målspråket och valfria instruktioner, och den kan bevara JSON- och HTML-struktur, följa en ordlista, matcha en stilnivå och använda omgivande kontext för att disambiguera. Den förmågeklassen är vad syskonmodellerna 7B och 30B-A3B delar, och vad Tencent släppte IFMTBench-riktmärket tillsammans med för att betygsätta.

Var benchmarken står

Kvalitetspåståendena är värda att läsa noggrant, eftersom nästan alla är Tencents egna och inte har reproducerats av ett oberoende labb i skrivande stund. Tencent rapporterar att HY-MT2-1.8B når 89.9% av Ge​mini 3.1 Pros genomsnittliga FLORES-200-poäng (7B-modellen: 97.9%, 30B-A3B: 98.6%), 96.7% av Ge​mini på dess verkliga GEMBA-liknande testset och 96.2% på DomainMTBench inom åtta professionella domäner. Viss pressbevakning avrundade FLORES-200-siffran nedåt till 88.1%; leverantörens README anger 89.9%. Tencent hävdar också att 1.8B-modellen totalt sett överträffar vanliga kommersiella översättnings-API:er från leverantörer som Microsoft och Doubao. Oberoende reproduktioner finns ännu inte, så betrakta allt detta som leverantörsrapporterad vägledande evidens snarare än granskade fakta. Det som inte är leverantörsberoende: språkuppsättningen på 33+5 språk är fastställd, Apache-2.0-licensen är verklig och en kvantiserad kontrollpunkt på 440 MB som körs på en telefon är oberoende observerbar.

A single-column spec scoreboard for Tencent HY-MT2 1.8B reading: Params: ~2B dense decoder-only; Languages: 33 + 5 dialect pairs; Released: May 21, 2026 · Apache-2.0; FLORES-200: 89.9% of Gemini 3.1 Pro; On-device: 440MB at 1.25-bit; API: ~$0.044 / $0.177 per 1M tokens; footer 'Benchmark figures vendor-reported; no independent scores yet.'

Hur du använder det, och vad det kostar

• Självhostad — Apache-2.0-vikter från Hugging Face eller ModelScope; kör med transformers (>=5.6.0), vLLM, SGLang, eller llama.cpp GGUF-byggen. Kostnaden är din GPU-faktura; 1.25-bitarsbygget körs på CPU-klassade enheter.

A screenshot of the Hugging Face model card for tencent/Hy-MT2-1.8B (captured Aug 20, 2026) showing the model header, the Tencent attribution, the Translation / Transformers / Safetensors tags, a 36-languages tag, the hunyuan_v1_dense architecture label, the arxiv 2605.22064 link, the apache-2.0 license, and the 2B-params model size.

Värdbaserat API — Tencent Cloud tillhandahåller 1.8B-modellen för ungefär 0,044 USD per miljon inmatningstokens och 0,177 USD per miljon utdatatokens i skrivande stund; leverantörens eget API och flera tredjepartsplattformar erbjuder den.

• Konsument — HyTranslate-miniprogrammet och iOS/Android-apparna, inklusive offlineöversättning via den nedladdade enhetsmodellen.

Rekommenderad sampling för 1.8B: temperatur 0.7, top-p 0.6, top-k 20, repetitionsstraff 1.05, max tokens 4096.

Om du bygger en översättningspipeline snarare än att leverera en konsumentapp är det intressanta med en sådan här modell att priset är ett rörligt mål — Tencent sänkte redan priset på sitt Hy-MT2-Pro-API i juni. Det är precis det scenario som en router med 0 % påslag finns för: eftersom priset som förs vidare är leverantörens listpris syns en leverantörsprissänkning på samma dags faktura i stället för efter att din gateway prissätter om. Modellen i sig finns inte i OrcaRouters utbud när detta skrivs, så du skulle hosta vikterna själv eller anropa Tencent Clouds API direkt; argumentet om failover och en enda nyckel gäller den bredare översättningsstack du skulle bygga runt den, där en blandning av en liten modell på enheten för billig bulkvolym och en större modell för svåra språkpar är den typ av komposition som routing byggdes för att uttrycka.

Slutsatsen

Tencent HY-MT2 1.8B var redan intressant i maj som en Apache-2.0-översättare i telefonstorlek; listningen bland värdbaserade API:er den 20 augusti gör den till en kandidat för team som vill utvärdera den utan att sätta upp infrastruktur. Kvalitetssiffrorna är leverantörsrapporterade, språkuppsättningen är medvetet mainstream snarare än maximal, och fotavtrycket på enheten är det som är genuint utmärkande med den. Om dina språkpar ingår i dess 33 är det nu billigare än någonsin att ta reda på om påståendena håller för ditt innehåll.