การ์ดไตเติลหลักสำหรับ Tencent HY-MT2 1.8B ที่มี Hosted API คำบรรยาย 'นักแปลขนาด 440MB ของ Tencent ก้าวสู่คลาวด์' แสดงสมาร์ทโฟนที่มีสัญลักษณ์ภาษา เมฆกำลังส่งชิปขนาดกะทัดรัด 440MB ลูกโลกที่มีจุด 33 จุด ป้ายวันที่ระบุ 'เปิดซอร์ส 21 พฤษภาคม 2026 · Hosted API 20 สิงหาคม 2026' และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

Tencent HY-MT2 1.8B เปิดตัว Hosted API: นักแปลขนาด 440MB ของ Tencent ขึ้นคลาวด์

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Tencent HY-MT2 1.8B สมาชิกขนาดกะทัดรัดของตระกูลโมเดลแปลภาษา Hy-MT2 ซึ่ง Tencent Hunyuan เปิดซอร์สเมื่อวันที่ 21 พฤษภาคม 2026 ขณะนี้สามารถเรียกใช้ผ่าน API เชิงพาณิชย์ที่โฮสต์ไว้ได้แล้ว แทนที่จะเป็นแบบโฮสต์ด้วยตัวเองเท่านั้น — รายการ API ของโมเดลเปิดให้บริการจริงเมื่อวันที่ 20 สิงหาคม 2026 ในราคาประมาณ 0.044 ดอลลาร์ต่อล้านโทเคนอินพุต และ 0.177 ดอลลาร์ต่อล้านโทเคนเอาต์พุต วันเปิดให้บริการของรายการนั้นมีความสำคัญมากกว่าปกติ เพราะ 1.8B ไม่เคยเป็นแค่ checkpoint เปิดอีกตัวหนึ่ง: มันคือโมเดลที่ Tencent สร้างขึ้นเพื่อพิสูจน์ว่าโมเดลแปลภาษาแบบควอนไทซ์ขนาด 440MB สามารถทำงานได้ทั้งหมดบนโทรศัพท์ และในช่วงสามเดือนนับตั้งแต่การเปิดซอร์ส มันยังถูกบรรจุอยู่ในมินิโปรแกรม HyTranslate ของ Tencent เอง และแอป iOS และ Android ที่ตามมาด้วย บทความนี้พูดถึงว่าการเปิดตัว API แบบโฮสต์เปลี่ยนแปลงอะไรบ้าง โมเดลนี้แท้จริงคืออะไร และตัวเลขใดที่คุณควรเชื่อถือ

สิ่งที่เปลี่ยนไปจริงๆ เมื่อวันที่ 20 สิงหาคม

จนถึงตอนนี้ การใช้ Tencent HY-MT2 1.8B หมายถึงหนึ่งในสองทางเลือก: โหลดน้ำหนัก Apache-2.0 ลงใน transformers, vLLM, SGLang หรือ llama.cpp ด้วยตัวเอง หรือใช้ผลิตภัณฑ์แปลภาษาสำหรับผู้บริโภคของ Tencent API ที่โฮสต์ไว้นั้นเป็นทางที่สาม — คุณส่งข้อความผ่าน HTTP และ Tencent Cloud ให้บริการเอนด์พอยต์ 1.8B โมเดลยังคงมีบริบท 8,192 โทเคนและเอาต์พุตสูงสุด 4,096 โทเคน รองรับเฉพาะข้อความ และมีราคาประมาณ $0.044 ต่อล้านอินพุตโทเคน และ $0.177 ต่อล้านเอาต์พุตโทเคน สำหรับทีมที่มีปริมาณการแปลไม่สม่ำเสมอ สิ่งนี้ช่วยขจัดข้อกำหนดที่ว่า "ต้องใช้งาน GPU" ออกไปจากการลองใช้โมเดล

A screenshot of the Tencent Cloud techpedia page for Hy-MT2: High-Performance Multilingual Translation Model (captured Aug 20, 2026), showing the English page header with the Tencent Cloud nav, the title 'Hy-MT2: High-Performance Multilingual Translation Model for Real Use', and the table of contents starting with the model name.

อีกครึ่งหนึ่งของเรื่องราวคือแอปพลิเคชัน มินิโปรแกรม HyTranslate เปิดตัวพร้อมกับการเผยแพร่แบบโอเพนซอร์สในเดือนพฤษภาคม โดยมีระบบป้อนเสียง เทมเพลตสไตล์ และโหมดออฟไลน์ แอป iOS และ Android ซึ่งดาวน์โหลดโมเดลลงบนอุปกรณ์เพื่อการแปลแบบไม่ต้องเชื่อมต่อเครือข่าย ได้เปิดตัวแล้วตั้งแต่นั้น โมเดล 1.8B เป็นตัวหลักของเรื่องราวออฟไลน์นั้น: ด้วยการควอนไทซ์ขั้นสุดที่ 1.25 บิตของ AngelSlim ทำให้ขนาดลดลงเหลือประมาณ 440MB ของพื้นที่จัดเก็บ และทำงานบนชิปสมาร์ทโฟนของ Apple, Qualcomm และ MediaTek ได้โดยตรง โดย Tencent รายงานว่าความเร็วในการอนุมานเร็วกว่า 1.5 เท่าเมื่อเทียบกับบิลด์แบบ 4 บิตของรุ่นก่อนหน้าบน Apple A15

1.8B มันคืออะไรกันแน่

HY-MT2-1.8B เป็นโมเดลภาษาประเภท causal แบบ decoder-only ที่มีความหนาแน่น (dense) สร้างขึ้นบนสถาปัตยกรรม hunyuan_v1_dense — ในทางปฏิบัติมีพารามิเตอร์ประมาณ 2 พันล้านแม้ชื่อจะบอกว่า 1.8B — พร้อมเทมเพลตการแชทและไม่มี system prompt เริ่มต้น โดยรองรับการแปลระหว่าง 33 ภาษา รวมถึงคู่ภาษาของชนกลุ่มน้อยและภาษาถิ่นอีกห้าคู่ ได้แก่ จีน อังกฤษ ญี่ปุ่น เกาหลี ฝรั่งเศส สเปน รัสเซีย อาหรับ ไทย เวียดนาม อินโดนีเซีย ฮินดี เบงกาลี ทมิฬ และคู่ภาษาถิ่นทิเบต อุยกูร์ คาซัค มองโกเลีย และกวางตุ้ง ต่างจากโมเดลการแปลแบบ encoder-decoder แบบดั้งเดิม มันถูกปรับแต่งด้วยคำสั่ง (instruction-tuned): คุณสามารถพรอมต์มันด้วยภาษาเป้าหมายและคำสั่งเสริมได้ แล้วมันจะรักษาโครงสร้าง JSON และ HTML ไว้ คำนึงถึงคำศัพท์เฉพาะ (glossary) ปรับให้ตรงกับระดับภาษา (register) และใช้บริบทรอบข้างเพื่อตัดความกำกวม ความสามารถระดับนี้เป็นสิ่งที่โมเดลพี่น้อง 7B และ 30B-A3B มีร่วมกัน และเป็นสิ่งที่เกณฑ์ชี้วัด IFMTBench ของ Tencent ถูกปล่อยออกมาพร้อมกันเพื่อใช้ประเมิน

ผล benchmark อยู่ในระดับใด

ข้อกล่าวอ้างด้านคุณภาพเหล่านี้ควรอ่านอย่างละเอียด เนื่องจากเกือบทั้งหมดเป็นข้อมูลที่ Tencent ระบุเอง ยังไม่มีห้องปฏิบัติการอิสระใดทำการทดสอบซ้ำ ณ เวลาที่เขียนบทความนี้ Tencent รายงานว่า HY-MT2-1.8B ได้คะแนนเฉลี่ย FLORES-200 คิดเป็น 89.9% ของ Ge{{1}}mini{{/1}} 3.1 Pro (รุ่น 7B ได้ 97.9% รุ่น 30B-A3B ได้ 98.6%) ได้ 96.7% ของ Ge{{2}}mini{{/2}} บนชุดทดสอบสไตล์ GEMBA ในโลกจริง และได้ 96.2% บน DomainMTBench ในแปดโดเมนวิชาชีพ สื่อบางสำนักปัดตัวเลข FLORES-200 ลงเหลือ 88.1% ในขณะที่ README ของผู้ผลิตระบุไว้ที่ 89.9% Tencent ยังอ้างว่าโมเดลรุ่น 1.8B โดยรวมเหนือกว่า API แปลภาษาเชิงพาณิชย์กระแสหลักจากผู้ให้บริการอย่าง Microsoft และ Doubao ยังไม่มีการทดสอบซ้ำโดยอิสระ ดังนั้นควรถือว่าข้อมูลทั้งหมดนี้เป็นหลักฐานเชิงทิศทางที่ผู้ผลิตแจ้งไว้ ไม่ใช่ข้อเท็จจริงที่ผ่านการตรวจสอบ สิ่งที่ไม่ขึ้นอยู่กับผู้ผลิตคือ: ชุดภาษาจำนวน 33+5 ภาษาถูกกำหนดไว้ตายตัว สัญญาอนุญาต Apache-2.0 เป็นของจริง และ checkpoint แบบ quantized ขนาด 440MB ที่รันบนโทรศัพท์ได้สามารถตรวจสอบได้โดยอิสระ

A single-column spec scoreboard for Tencent HY-MT2 1.8B reading: Params: ~2B dense decoder-only; Languages: 33 + 5 dialect pairs; Released: May 21, 2026 · Apache-2.0; FLORES-200: 89.9% of Gemini 3.1 Pro; On-device: 440MB at 1.25-bit; API: ~$0.044 / $0.177 per 1M tokens; footer 'Benchmark figures vendor-reported; no independent scores yet.'

วิธีใช้งาน และค่าใช้จ่ายเท่าไร

• โฮสต์ด้วยตนเอง — น้ำหนัก Apache-2.0 จาก Hugging Face หรือ ModelScope; รันด้วย transformers (>=5.6.0), vLLM, SGLang หรือบิลด์ GGUF จาก llama.cpp ค่าใช้จ่ายคือค่า GPU ของคุณ; บิลด์ 1.25-bit รันบนอุปกรณ์ระดับ CPU

A screenshot of the Hugging Face model card for tencent/Hy-MT2-1.8B (captured Aug 20, 2026) showing the model header, the Tencent attribution, the Translation / Transformers / Safetensors tags, a 36-languages tag, the hunyuan_v1_dense architecture label, the arxiv 2605.22064 link, the apache-2.0 license, and the 2B-params model size.

• โฮสต์ API — Tencent Cloud ให้บริการโมเดล 1.8B ในราคาประมาณ $0.044 ต่อล้านโทเคนขาเข้า และ $0.177 ต่อล้านโทเคนขาออก ณ เวลาที่เขียนนี้ โดย API ของผู้ให้บริการเองและแพลตฟอร์มบุคคลที่สามหลายแห่งมีให้บริการ

• ผู้บริโภค — HyTranslate มินิโปรแกรมและแอป iOS/Android รวมถึงการแปลแบบออฟไลน์ผ่านโมเดลบนอุปกรณ์ที่ดาวน์โหลด

ค่าการสุ่มตัวอย่างที่แนะนำสำหรับ 1.8B: อุณหภูมิ 0.7, top-p 0.6, top-k 20, ค่าโทษการซ้ำ 1.05, จำนวนโทเค็นสูงสุด 4096

หากคุณกำลังสร้างไปป์ไลน์การแปลมากกว่าที่จะส่งแอปสำหรับผู้บริโภค สิ่งที่น่าสนใจเกี่ยวกับโมเดลแบบนี้คือราคาของมันเป็นเป้าหมายที่เคลื่อนที่ — Tencent ตัดอัตราค่า API ของ Hy-MT2-Pro ไปแล้วในเดือนมิถุนายน นั่นคือสถานการณ์ที่เราเตอร์แบบมาร์กอัป 0% มีไว้: เนื่องจากการส่งผ่านเป็นราคารายการของผู้ให้บริการ การลดราคาของผู้ขายจะแสดงในบิลของวันเดียวกัน แทนที่จะเป็นหลังจากที่เกตเวย์ของคุณกำหนดราคาใหม่ ตัวโมเดลเองยังไม่ได้อยู่ในรายชื่อของ OrcaRouter ในเวลาที่เขียน ดังนั้นคุณจะโฮสต์น้ำหนักด้วยตัวเองหรือเรียก API ของ Tencent Cloud โดยตรง; ข้อโต้แย้งเรื่องการเฟลโอเวอร์และคีย์เดียวใช้กับสแตกการแปลที่กว้างขึ้นที่คุณจะสร้างรอบ ๆ มัน ซึ่งการผสมโมเดลขนาดเล็กบนอุปกรณ์สำหรับทราฟฟิกจำนวนมากราคาถูกกับโมเดลขนาดใหญ่สำหรับคู่ภาษาที่ยากคือประเภทของการประกอบที่การกำหนดเส้นทางถูกสร้างขึ้นมาเพื่อแสดง

สรุป

Tencent HY-MT2 1.8B น่าสนใจอยู่แล้วตั้งแต่เดือนพฤษภาคม ในฐานะตัวแปลภาษาขนาดเท่าโทรศัพท์ที่ใช้สัญญาอนุญาต Apache-2.0 การปรากฏในรายการ hosted-API เมื่อวันที่ 20 สิงหาคม ทำให้มันเป็นตัวเลือกสำหรับทีมที่ต้องการประเมินโดยไม่ต้องตั้งโครงสร้างพื้นฐานขึ้นมาเอง ค่าคุณภาพเป็นตัวเลขที่ผู้พัฒนารายงานไว้ ชุดภาษาถูกออกแบบให้เป็นภาษากระแสหลักโดยเจตนาแทนที่จะเป็นชุดภาษาที่ครอบคลุมสูงสุด และขนาดการทำงานบนอุปกรณ์คือจุดที่โดดเด่นอย่างแท้จริง หากคู่ภาษาของคุณอยู่ใน 33 ภาษานั้น ตอนนี้การทดสอบว่าข้อกล่าวอ้างเหล่านั้นเป็นจริงกับเนื้อหาของคุณหรือไม่ ก็มีต้นทุนถูกกว่าเดิมมาก

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube