
Tencent HY-MT2 1.8B เปิดตัว Hosted API: นักแปลขนาด 440MB ของ Tencent ขึ้นคลาวด์
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 426 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 183 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 115 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
Tencent HY-MT2 1.8B สมาชิกขนาดกะทัดรัดของตระกูลโมเดลแปลภาษา Hy-MT2 ซึ่ง Tencent Hunyuan เปิดซอร์สเมื่อวันที่ 21 พฤษภาคม 2026 ขณะนี้สามารถเรียกใช้ผ่าน API เชิงพาณิชย์ที่โฮสต์ไว้ได้แล้ว แทนที่จะเป็นแบบโฮสต์ด้วยตัวเองเท่านั้น — รายการ API ของโมเดลเปิดให้บริการจริงเมื่อวันที่ 20 สิงหาคม 2026 ในราคาประมาณ 0.044 ดอลลาร์ต่อล้านโทเคนอินพุต และ 0.177 ดอลลาร์ต่อล้านโทเคนเอาต์พุต วันเปิดให้บริการของรายการนั้นมีความสำคัญมากกว่าปกติ เพราะ 1.8B ไม่เคยเป็นแค่ checkpoint เปิดอีกตัวหนึ่ง: มันคือโมเดลที่ Tencent สร้างขึ้นเพื่อพิสูจน์ว่าโมเดลแปลภาษาแบบควอนไทซ์ขนาด 440MB สามารถทำงานได้ทั้งหมดบนโทรศัพท์ และในช่วงสามเดือนนับตั้งแต่การเปิดซอร์ส มันยังถูกบรรจุอยู่ในมินิโปรแกรม HyTranslate ของ Tencent เอง และแอป iOS และ Android ที่ตามมาด้วย บทความนี้พูดถึงว่าการเปิดตัว API แบบโฮสต์เปลี่ยนแปลงอะไรบ้าง โมเดลนี้แท้จริงคืออะไร และตัวเลขใดที่คุณควรเชื่อถือ
สิ่งที่เปลี่ยนไปจริงๆ เมื่อวันที่ 20 สิงหาคม
จนถึงตอนนี้ การใช้ Tencent HY-MT2 1.8B หมายถึงหนึ่งในสองทางเลือก: โหลดน้ำหนัก Apache-2.0 ลงใน transformers, vLLM, SGLang หรือ llama.cpp ด้วยตัวเอง หรือใช้ผลิตภัณฑ์แปลภาษาสำหรับผู้บริโภคของ Tencent API ที่โฮสต์ไว้นั้นเป็นทางที่สาม — คุณส่งข้อความผ่าน HTTP และ Tencent Cloud ให้บริการเอนด์พอยต์ 1.8B โมเดลยังคงมีบริบท 8,192 โทเคนและเอาต์พุตสูงสุด 4,096 โทเคน รองรับเฉพาะข้อความ และมีราคาประมาณ $0.044 ต่อล้านอินพุตโทเคน และ $0.177 ต่อล้านเอาต์พุตโทเคน สำหรับทีมที่มีปริมาณการแปลไม่สม่ำเสมอ สิ่งนี้ช่วยขจัดข้อกำหนดที่ว่า "ต้องใช้งาน GPU" ออกไปจากการลองใช้โมเดล

อีกครึ่งหนึ่งของเรื่องราวคือแอปพลิเคชัน มินิโปรแกรม HyTranslate เปิดตัวพร้อมกับการเผยแพร่แบบโอเพนซอร์สในเดือนพฤษภาคม โดยมีระบบป้อนเสียง เทมเพลตสไตล์ และโหมดออฟไลน์ แอป iOS และ Android ซึ่งดาวน์โหลดโมเดลลงบนอุปกรณ์เพื่อการแปลแบบไม่ต้องเชื่อมต่อเครือข่าย ได้เปิดตัวแล้วตั้งแต่นั้น โมเดล 1.8B เป็นตัวหลักของเรื่องราวออฟไลน์นั้น: ด้วยการควอนไทซ์ขั้นสุดที่ 1.25 บิตของ AngelSlim ทำให้ขนาดลดลงเหลือประมาณ 440MB ของพื้นที่จัดเก็บ และทำงานบนชิปสมาร์ทโฟนของ Apple, Qualcomm และ MediaTek ได้โดยตรง โดย Tencent รายงานว่าความเร็วในการอนุมานเร็วกว่า 1.5 เท่าเมื่อเทียบกับบิลด์แบบ 4 บิตของรุ่นก่อนหน้าบน Apple A15
1.8B มันคืออะไรกันแน่
HY-MT2-1.8B เป็นโมเดลภาษาประเภท causal แบบ decoder-only ที่มีความหนาแน่น (dense) สร้างขึ้นบนสถาปัตยกรรม hunyuan_v1_dense — ในทางปฏิบัติมีพารามิเตอร์ประมาณ 2 พันล้านแม้ชื่อจะบอกว่า 1.8B — พร้อมเทมเพลตการแชทและไม่มี system prompt เริ่มต้น โดยรองรับการแปลระหว่าง 33 ภาษา รวมถึงคู่ภาษาของชนกลุ่มน้อยและภาษาถิ่นอีกห้าคู่ ได้แก่ จีน อังกฤษ ญี่ปุ่น เกาหลี ฝรั่งเศส สเปน รัสเซีย อาหรับ ไทย เวียดนาม อินโดนีเซีย ฮินดี เบงกาลี ทมิฬ และคู่ภาษาถิ่นทิเบต อุยกูร์ คาซัค มองโกเลีย และกวางตุ้ง ต่างจากโมเดลการแปลแบบ encoder-decoder แบบดั้งเดิม มันถูกปรับแต่งด้วยคำสั่ง (instruction-tuned): คุณสามารถพรอมต์มันด้วยภาษาเป้าหมายและคำสั่งเสริมได้ แล้วมันจะรักษาโครงสร้าง JSON และ HTML ไว้ คำนึงถึงคำศัพท์เฉพาะ (glossary) ปรับให้ตรงกับระดับภาษา (register) และใช้บริบทรอบข้างเพื่อตัดความกำกวม ความสามารถระดับนี้เป็นสิ่งที่โมเดลพี่น้อง 7B และ 30B-A3B มีร่วมกัน และเป็นสิ่งที่เกณฑ์ชี้วัด IFMTBench ของ Tencent ถูกปล่อยออกมาพร้อมกันเพื่อใช้ประเมิน
ผล benchmark อยู่ในระดับใด
ข้อกล่าวอ้างด้านคุณภาพเหล่านี้ควรอ่านอย่างละเอียด เนื่องจากเกือบทั้งหมดเป็นข้อมูลที่ Tencent ระบุเอง ยังไม่มีห้องปฏิบัติการอิสระใดทำการทดสอบซ้ำ ณ เวลาที่เขียนบทความนี้ Tencent รายงานว่า HY-MT2-1.8B ได้คะแนนเฉลี่ย FLORES-200 คิดเป็น 89.9% ของ Ge{{1}}mini{{/1}} 3.1 Pro (รุ่น 7B ได้ 97.9% รุ่น 30B-A3B ได้ 98.6%) ได้ 96.7% ของ Ge{{2}}mini{{/2}} บนชุดทดสอบสไตล์ GEMBA ในโลกจริง และได้ 96.2% บน DomainMTBench ในแปดโดเมนวิชาชีพ สื่อบางสำนักปัดตัวเลข FLORES-200 ลงเหลือ 88.1% ในขณะที่ README ของผู้ผลิตระบุไว้ที่ 89.9% Tencent ยังอ้างว่าโมเดลรุ่น 1.8B โดยรวมเหนือกว่า API แปลภาษาเชิงพาณิชย์กระแสหลักจากผู้ให้บริการอย่าง Microsoft และ Doubao ยังไม่มีการทดสอบซ้ำโดยอิสระ ดังนั้นควรถือว่าข้อมูลทั้งหมดนี้เป็นหลักฐานเชิงทิศทางที่ผู้ผลิตแจ้งไว้ ไม่ใช่ข้อเท็จจริงที่ผ่านการตรวจสอบ สิ่งที่ไม่ขึ้นอยู่กับผู้ผลิตคือ: ชุดภาษาจำนวน 33+5 ภาษาถูกกำหนดไว้ตายตัว สัญญาอนุญาต Apache-2.0 เป็นของจริง และ checkpoint แบบ quantized ขนาด 440MB ที่รันบนโทรศัพท์ได้สามารถตรวจสอบได้โดยอิสระ

วิธีใช้งาน และค่าใช้จ่ายเท่าไร
• โฮสต์ด้วยตนเอง — น้ำหนัก Apache-2.0 จาก Hugging Face หรือ ModelScope; รันด้วย transformers (>=5.6.0), vLLM, SGLang หรือบิลด์ GGUF จาก llama.cpp ค่าใช้จ่ายคือค่า GPU ของคุณ; บิลด์ 1.25-bit รันบนอุปกรณ์ระดับ CPU

• โฮสต์ API — Tencent Cloud ให้บริการโมเดล 1.8B ในราคาประมาณ $0.044 ต่อล้านโทเคนขาเข้า และ $0.177 ต่อล้านโทเคนขาออก ณ เวลาที่เขียนนี้ โดย API ของผู้ให้บริการเองและแพลตฟอร์มบุคคลที่สามหลายแห่งมีให้บริการ
• ผู้บริโภค — HyTranslate มินิโปรแกรมและแอป iOS/Android รวมถึงการแปลแบบออฟไลน์ผ่านโมเดลบนอุปกรณ์ที่ดาวน์โหลด
ค่าการสุ่มตัวอย่างที่แนะนำสำหรับ 1.8B: อุณหภูมิ 0.7, top-p 0.6, top-k 20, ค่าโทษการซ้ำ 1.05, จำนวนโทเค็นสูงสุด 4096
หากคุณกำลังสร้างไปป์ไลน์การแปลมากกว่าที่จะส่งแอปสำหรับผู้บริโภค สิ่งที่น่าสนใจเกี่ยวกับโมเดลแบบนี้คือราคาของมันเป็นเป้าหมายที่เคลื่อนที่ — Tencent ตัดอัตราค่า API ของ Hy-MT2-Pro ไปแล้วในเดือนมิถุนายน นั่นคือสถานการณ์ที่เราเตอร์แบบมาร์กอัป 0% มีไว้: เนื่องจากการส่งผ่านเป็นราคารายการของผู้ให้บริการ การลดราคาของผู้ขายจะแสดงในบิลของวันเดียวกัน แทนที่จะเป็นหลังจากที่เกตเวย์ของคุณกำหนดราคาใหม่ ตัวโมเดลเองยังไม่ได้อยู่ในรายชื่อของ OrcaRouter ในเวลาที่เขียน ดังนั้นคุณจะโฮสต์น้ำหนักด้วยตัวเองหรือเรียก API ของ Tencent Cloud โดยตรง; ข้อโต้แย้งเรื่องการเฟลโอเวอร์และคีย์เดียวใช้กับสแตกการแปลที่กว้างขึ้นที่คุณจะสร้างรอบ ๆ มัน ซึ่งการผสมโมเดลขนาดเล็กบนอุปกรณ์สำหรับทราฟฟิกจำนวนมากราคาถูกกับโมเดลขนาดใหญ่สำหรับคู่ภาษาที่ยากคือประเภทของการประกอบที่การกำหนดเส้นทางถูกสร้างขึ้นมาเพื่อแสดง
สรุป
Tencent HY-MT2 1.8B น่าสนใจอยู่แล้วตั้งแต่เดือนพฤษภาคม ในฐานะตัวแปลภาษาขนาดเท่าโทรศัพท์ที่ใช้สัญญาอนุญาต Apache-2.0 การปรากฏในรายการ hosted-API เมื่อวันที่ 20 สิงหาคม ทำให้มันเป็นตัวเลือกสำหรับทีมที่ต้องการประเมินโดยไม่ต้องตั้งโครงสร้างพื้นฐานขึ้นมาเอง ค่าคุณภาพเป็นตัวเลขที่ผู้พัฒนารายงานไว้ ชุดภาษาถูกออกแบบให้เป็นภาษากระแสหลักโดยเจตนาแทนที่จะเป็นชุดภาษาที่ครอบคลุมสูงสุด และขนาดการทำงานบนอุปกรณ์คือจุดที่โดดเด่นอย่างแท้จริง หากคู่ภาษาของคุณอยู่ใน 33 ภาษานั้น ตอนนี้การทดสอบว่าข้อกล่าวอ้างเหล่านั้นเป็นจริงกับเนื้อหาของคุณหรือไม่ ก็มีต้นทุนถูกกว่าเดิมมาก
