
Tencent Hy-MT2-7B เทียบกับ Tencent Hy-MT2-1.8B: ตัวเลือกคุณภาพฝั่งเซิร์ฟเวอร์ หรือนักแปลขนาด 440MB บนทุกโทรศัพท์
- DeepSeekใหม่DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 ต่อ 1 ล้านโทเค็น
- z-aiใหม่Z.ai: GLM 5.32026-08-1860ความฉลาด75การเขียนโค้ด
- obsidianใหม่Qwen3.8 27B2026-08-1552ความฉลาด68การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekใหม่DeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokใหม่SpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0957ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0961ความฉลาด77การเขียนโค้ด
Tencent Hy-MT2-7B และ Tencent Hy-MT2-1.8B เป็นสองปลายสุดของตระกูลเดียวกัน เปิดซอร์สร่วมกันเมื่อวันที่ 21 พฤษภาคม 2026 และทั้งคู่เริ่มเรียกใช้ผ่าน API โฮสต์ได้ในสัปดาห์นี้ โดยรุ่น 7B ราววันที่ 19 สิงหาคม และรุ่น 1.8B ในวันถัดมา ซึ่งแต่ละรุ่นให้บริการโดย Tencent Cloud พวกมันไม่ใช่คู่แข่งในความหมายทั่วไป เพราะจุดประสงค์การใช้งานแทบไม่ทับซ้อนกัน รุ่น 7B เป็นตัวเลือกด้านคุณภาพ: โมเดลแบบ dense ที่รันบน GPU ตัวเดียวหรือผ่าน API ในราคา $0.074 ต่อล้านโทเคนอินพุต และ $0.295 ต่อล้านโทเคนเอาต์พุต รุ่น 1.8B เป็นตัวเลือกสำหรับรันบนอุปกรณ์: โมเดลที่ถูกควอนไตซ์เหลือ 440 เมกะไบต์ รันบนโทรศัพท์ได้แบบออฟไลน์เต็มรูปแบบ ในราคา $0.044 / $0.177 ต่อล้านโทเคนบนระดับ API หากคุณต้องเลือกระหว่างสองรุ่นนี้ คำตอบส่วนใหญ่ขึ้นอยู่กับว่าการแปลต้องเกิดขึ้นที่ไหน — และรองลงมาคือผล benchmark ซึ่งใกล้กันมากกว่าที่ช่องว่างพารามิเตอร์ 4 เท่าจะบ่งบอก
คำตอบหนึ่งบรรทัด
เลือกใช้รุ่น 7B เมื่อการแปลเกิดขึ้นในศูนย์ข้อมูล และคุณต้องการคุณภาพที่ดีที่สุดต่อค่าใช้จ่ายของเซิร์ฟเวอร์ — ไม่ว่าจะใช้งานผ่าน API หรือบน GPU ระดับ A100 เพียงตัวเดียว เลือกใช้รุ่น 1.8B เมื่อการแปลต้องเกิดขึ้นบนอุปกรณ์ ออฟไลน์ หรือที่ต้นทุนต่อโทเคนต่ำที่สุดเท่าที่จะเป็นไปได้ หากทั้งสองอยู่ในคลาวด์เดียวกันและงบประมาณไม่ใช่ปัจจัยชี้ขาด รุ่น 7B ชนะในด้านคุณภาพ หากเนื้อหาเป็นความลับ อยู่ภายใต้กฎระเบียบ หรือจำเป็นต้องทำงานโดยไม่ต้องใช้เครือข่าย รุ่น 1.8B เป็นเพียงหนึ่งในสองรุ่นที่ทำได้
สเปก, เคียงข้างกัน
• พารามิเตอร์ — 7B dense เทียบกับ 1.8B dense.
• ฟุตพรินต์แบบควอนไทซ์ — FP8 และ GGUF ลดลงเหลือไม่กี่ GB เทียบกับ 440MB ด้วยการควอนไทซ์ 1.25 บิตของ AngelSlim
• FLORES-200 (XX⇔XX) — 86.89 เทียบกับ 79.77 ของ XCOMET-XXL คิดเป็นประมาณ 97.9% เทียบกับ 89.9% ของ Gemini 3.1 Pro (Think) ตามที่ผู้ผลิตแจ้ง
• WMT25 — 7B: 63.86/71.21/82.24; 1.8B ชนะ API เชิงพาณิชย์ของ Microsoft และ Doubao ในทั้งสามเมตริก
• DomainMTBench (GEMBA) — 92.79 เทียบกับ 91.08 ตามที่ผู้จำหน่ายรายงาน
• ราคา API — $0.074 / $0.295 เทียบกับ $0.044 / $0.177 ต่อ 1M โทเคน (อินพุต/เอาต์พุต)
• บริบท — ทั้ง 8,192 โทเค็น
• การปรับใช้ — A100 / RTX 4090 หนึ่งตัวหรือคลาวด์ API เทียบกับชิปบนอุปกรณ์ของ Apple, Qualcomm และ MediaTek แบบออฟไลน์

ช่องว่างด้านคุณภาพมีจริง แต่แคบกว่าช่องว่างด้านขนาด
ต่อไปนี้เป็นการประเมินของ Tencent เองทั้งหมด ไม่ได้มีการทำซ้ำ บน FLORES-200 โมเดล 7B ทำคะแนน XCOMET สูงกว่า 1.8B อยู่แปดจุด (86.89 เทียบกับ 79.77) ซึ่งเป็นช่องว่างที่จุดวางตำแหน่งแบบ "สมดุล" กับ "บนอุปกรณ์" สร้างขึ้นมา แต่บน DomainMTBench ซึ่งเป็นเกณฑ์ชี้วัดการแปลเฉพาะด้านครอบคลุมการเงิน การเมือง และการศึกษา 1.8B ทำคะแนนห่างจาก 7B อยู่เพียง 1.7 จุด GEMBA (91.08 เทียบกับ 92.79) และจุดที่ทำให้คนยังคงประหลาดใจอยู่เสมอคือสถานะของ 1.8B เมื่อเทียบกับโมเดลอื่นในวงกว้าง: Tencent รายงานว่ามันเอาชนะ API การแปลเชิงพาณิชย์ของ Microsoft และ Doubao ได้ในทุกเมตริกของ WMT25 ทั้งสามตัว และยังเหนือกว่า Tower-Plus-72B ซึ่งเป็นโมเดลที่ใหญ่กว่าถึงสี่สิบเท่า ดังนั้นในข้อความเฉพาะด้านทั่วไป โมเดลเล็กจึงใกล้เคียงกับพี่ใหญ่ของมันมากกว่าที่พารามิเตอร์สี่ตัวจะบ่งชี้ จุดแข็งที่แท้จริงของ 7B ปรากฏในส่วนท้ายของการแปลทั่วไปและในคำสั่งที่ยาก ซึ่งความเป็นผู้นำด้าน FLORES และคะแนนงานซับซ้อนที่สูงกว่าบน IFMTBench ทำให้เห็นความแตกต่างอย่างชัดเจนระหว่างทั้งสอง
ฟอร์กการปรับใช้งาน
โมเดล 7B ต้องการโครงสร้างพื้นฐาน ไม่ว่าจะเป็นคลาวด์ API หรือ GPU ระดับ A100 หนึ่งตัว พร้อมด้วยโอเปอเรชันทั่วไปที่เกี่ยวข้อง ส่วนโมเดล 1.8B ที่ขนาด 440MB พร้อมการควอนไทเซชัน 1.25 บิตของ AngelSlim ทำงานบนชิปเดียวกันกับแอปพลิเคชันโทรศัพท์ทั่วไป มีความเร็วสูงกว่าเจนเนอเรชันก่อนหน้าอย่าง Hy-MT1.5 ถึง 1.5 เท่า และไม่จำเป็นต้องใช้เครือข่ายเลย สิ่งนี้เปลี่ยนความเป็นส่วนตัวจากฟีเจอร์ให้กลายเป็นค่าเริ่มต้น: สำหรับสัญญา เวชระเบียน หรือสิ่งใดก็ตามที่อยู่ภายใต้การกำกับดูแล ข้อมูลจะไม่หลุดออกจากอุปกรณ์ ซึ่งเป็นคุณสมบัติที่ไม่อาจซื้อได้ด้วยราคาต่อโทเคนบนฝั่งเซิร์ฟเวอร์ ข้อแลกเปลี่ยนนี้เห็นได้ชัดในการแปลทั่วไปแบบ FLORES ซึ่งความจุที่มากกว่าของ 7B แสดงให้เห็น และในคำสั่งที่ซับซ้อนพอที่จะดันคะแนนรวม 83.14 IFMTBench ของ 1.8B ให้สู้กับเพดานที่สูงกว่าของ 7B

การคำนวณต้นทุน
ในระดับ API ทั้งสองโมเดลมีราคาถูก โดยรุ่น 1.8B ถูกกว่า ที่ราคา $0.044 / $0.177 เทียบกับ $0.074 / $0.295 ต่อล้านโทเคน โมเดลเล็กมีต้นทุนต่ำกว่ารุ่น 7B ประมาณ 40% ในทั้งสองด้านของบิล — ที่อัตราการสร้างโทเคนเอาต์พุตหนึ่งล้านโทเคนต่อวันอย่างsteady จะอยู่ที่ประมาณ $70 ต่อวัน เทียบกับ $118 บนอุปกรณ์ รุ่น 1.8B มีต้นทุนเป็นศูนย์ต่อโทเคน ซึ่งเป็นตัวเลขที่เหนือกว่าการเปรียบเทียบเซิร์ฟเวอร์ใดๆ ในเชิงปริมาณ ข้อโต้แย้งของรุ่น 7B ไม่ใช่เรื่องราคา แต่เป็นเรื่องความเผื่อเหลือ (headroom): หากคลังข้อความของคุณเน้นด้านเทคนิค กฎหมาย หรือคำสั่งที่ซับซ้อน ส่วนต่างคุณภาพของรุ่น 7B คือสิ่งที่แสดงออกมาเป็นจำนวนครั้งที่ต้องแปลซ้ำที่น้อยลง — และการแปลซ้ำคือต้นทุนต่อหน่วยที่แท้จริงในงาน MT ระดับมืออาชีพ

การจัดเส้นทางสองขนาด
ณขณะที่เขียนนี้ ทั้งสองโมเดลยังไม่อยู่ในแคตตาล็อกของ OrcaRouter ดังนั้นการกล่าวถึงอย่างตรงไปตรงมาก็คือ ทั้งสองถูกให้บริการผ่านคลาวด์ของ Tencent เองและแพลตฟอร์มบุคคลที่สามหลายแห่ง การเปรียบเทียบนี้ยังคงให้บทเรียนเรื่องการจัดเส้นทางที่บล็อกนี้สร้างขึ้นมาได้เป็นอย่างดี นั่นคือ เมื่อสองโมเดลมีความสามารถที่ทับซ้อนกันแต่ต่างกันที่ราคาและความหน่วง เหตุผลในการนำไปใช้งานไม่ใช่ "เลือกตัวใดตัวหนึ่ง" แต่คือ "จัดเส้นทางตามปริมาณงาน" — ส่วนที่เป็นปริมาณมากและความยากต่ำส่งให้โมเดลเล็กที่ราคาถูก ส่วนที่ยากส่งให้โมเดลคุณภาพสูง พร้อมกับการเฟลโอเวอร์อัตโนมัติเพื่อให้การขัดข้องของฝั่งใดฝั่งหนึ่งไม่ทำให้ไปป์ไลน์หยุดชะงัก นี่คือรูปแบบที่ routing DSL ของ OrcaRouter เรียบเรียงขึ้นในโมเดลกว่า 200 ตัวที่เรามี โดยราคาของแต่ละผู้ให้บริการถูกส่งผ่านที่มาร์กอัป 0% หากตระกูลโมเดลแปลภาษาของ Tencent เข้ามาอยู่ในแคตตาล็อก มันก็จะเป็นผู้เช่ารายถัดไปโดยธรรมชาติ
คำตัดสิน
หากการแปลเกิดขึ้นในดาต้าเซ็นเตอร์ของคุณ ให้ใช้ Tencent Hy-MT2-7B — ผ่าน API หากต้องการไม่ต้องจัดการอะไรเลย หรือบน GPU ตัวเดียวหากต้องการเป็นเจ้าของ — แล้วหยุดอ่านได้เลย หากการแปลต้องเกิดขึ้นบนอุปกรณ์ แบบออฟไลน์ หรือภายใต้ข้อกำหนดด้านการรักษาความลับ ให้ใช้ Tencent Hy-MT2-1.8B และขนาดเพียง 440MB ก็ชนะขาดโดยปริยาย กรณีที่ยากจริงๆ เพียงกรณีเดียวคือเวิร์กโหลดคลาวด์ปริมาณปานกลาง ซึ่งทั้งคุณภาพของ 7B และราคาของ 1.8B ต่างก็สมเหตุสมผล ในจุดนั้น อย่าตัดสินใจจาก benchmark ของผู้ขาย: ช่องว่าง GEMBA ที่รายงานต่างกันไม่ถึง 2 จุด ดังนั้นให้รันทั้งสองบนข้อความในโดเมนของคุณเอง แล้วให้ข้อมูลของคุณเป็นคนเลือก
