การ์ดไตเติลหลักสำหรับ 'Tencent Hy-MT2-7B เทียบกับ Tencent Hy-MT2-1.8B' พร้อมคำบรรยายใต้ชื่อว่า 'ตัวเลือกคุณภาพฝั่งเซิร์ฟเวอร์หรือนักแปลขนาด 440MB บนทุกโทรศัพท์' แสดงไอคอนเซิร์ฟเวอร์และไอคอนสมาร์ทโฟน โดยมีตราชั่งอยู่ระหว่าง ชิปขนาด 440MB และป้ายชื่อโมเดลสองป้าย โดยมีโลโก้ OrcaRouter อยู่มุมขวาล่าง
Guides & Insights

Tencent Hy-MT2-7B เทียบกับ Tencent Hy-MT2-1.8B: ตัวเลือกคุณภาพฝั่งเซิร์ฟเวอร์ หรือนักแปลขนาด 440MB บนทุกโทรศัพท์

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Tencent Hy-MT2-7B และ Tencent Hy-MT2-1.8B เป็นสองปลายสุดของตระกูลเดียวกัน เปิดซอร์สร่วมกันเมื่อวันที่ 21 พฤษภาคม 2026 และทั้งคู่เริ่มเรียกใช้ผ่าน API โฮสต์ได้ในสัปดาห์นี้ โดยรุ่น 7B ราววันที่ 19 สิงหาคม และรุ่น 1.8B ในวันถัดมา ซึ่งแต่ละรุ่นให้บริการโดย Tencent Cloud พวกมันไม่ใช่คู่แข่งในความหมายทั่วไป เพราะจุดประสงค์การใช้งานแทบไม่ทับซ้อนกัน รุ่น 7B เป็นตัวเลือกด้านคุณภาพ: โมเดลแบบ dense ที่รันบน GPU ตัวเดียวหรือผ่าน API ในราคา $0.074 ต่อล้านโทเคนอินพุต และ $0.295 ต่อล้านโทเคนเอาต์พุต รุ่น 1.8B เป็นตัวเลือกสำหรับรันบนอุปกรณ์: โมเดลที่ถูกควอนไตซ์เหลือ 440 เมกะไบต์ รันบนโทรศัพท์ได้แบบออฟไลน์เต็มรูปแบบ ในราคา $0.044 / $0.177 ต่อล้านโทเคนบนระดับ API หากคุณต้องเลือกระหว่างสองรุ่นนี้ คำตอบส่วนใหญ่ขึ้นอยู่กับว่าการแปลต้องเกิดขึ้นที่ไหน — และรองลงมาคือผล benchmark ซึ่งใกล้กันมากกว่าที่ช่องว่างพารามิเตอร์ 4 เท่าจะบ่งบอก

คำตอบหนึ่งบรรทัด

เลือกใช้รุ่น 7B เมื่อการแปลเกิดขึ้นในศูนย์ข้อมูล และคุณต้องการคุณภาพที่ดีที่สุดต่อค่าใช้จ่ายของเซิร์ฟเวอร์ — ไม่ว่าจะใช้งานผ่าน API หรือบน GPU ระดับ A100 เพียงตัวเดียว เลือกใช้รุ่น 1.8B เมื่อการแปลต้องเกิดขึ้นบนอุปกรณ์ ออฟไลน์ หรือที่ต้นทุนต่อโทเคนต่ำที่สุดเท่าที่จะเป็นไปได้ หากทั้งสองอยู่ในคลาวด์เดียวกันและงบประมาณไม่ใช่ปัจจัยชี้ขาด รุ่น 7B ชนะในด้านคุณภาพ หากเนื้อหาเป็นความลับ อยู่ภายใต้กฎระเบียบ หรือจำเป็นต้องทำงานโดยไม่ต้องใช้เครือข่าย รุ่น 1.8B เป็นเพียงหนึ่งในสองรุ่นที่ทำได้

สเปก, เคียงข้างกัน

พารามิเตอร์ — 7B dense เทียบกับ 1.8B dense.

ฟุตพรินต์แบบควอนไทซ์ — FP8 และ GGUF ลดลงเหลือไม่กี่ GB เทียบกับ 440MB ด้วยการควอนไทซ์ 1.25 บิตของ AngelSlim

FLORES-200 (XX⇔XX) — 86.89 เทียบกับ 79.77 ของ XCOMET-XXL คิดเป็นประมาณ 97.9% เทียบกับ 89.9% ของ Gemini 3.1 Pro (Think) ตามที่ผู้ผลิตแจ้ง

WMT25 — 7B: 63.86/71.21/82.24; 1.8B ชนะ API เชิงพาณิชย์ของ Microsoft และ Doubao ในทั้งสามเมตริก

DomainMTBench (GEMBA) — 92.79 เทียบกับ 91.08 ตามที่ผู้จำหน่ายรายงาน

ราคา API — $0.074 / $0.295 เทียบกับ $0.044 / $0.177 ต่อ 1M โทเคน (อินพุต/เอาต์พุต)

บริบท — ทั้ง 8,192 โทเค็น

การปรับใช้ — A100 / RTX 4090 หนึ่งตัวหรือคลาวด์ API เทียบกับชิปบนอุปกรณ์ของ Apple, Qualcomm และ MediaTek แบบออฟไลน์

A two-column scoreboard titled 'Tencent Hy-MT2-7B vs Tencent Hy-MT2-1.8B — the scoreboard'. Left column Hy-MT2-7B: Params 7B dense; FLORES-200 86.89; DomainMTBench GEMBA 92.79; API price $0.074 / $0.295; Deployment GPU or API; Best for quality in the cloud. Right column Hy-MT2-1.8B: Params 1.8B dense; FLORES-200 79.77; DomainMTBench GEMBA 91.08; API price $0.044 / $0.177; Deployment 440MB on-device; Best for offline and edge. Footer: Figures vendor-reported, unreproduced.

ช่องว่างด้านคุณภาพมีจริง แต่แคบกว่าช่องว่างด้านขนาด

ต่อไปนี้เป็นการประเมินของ Tencent เองทั้งหมด ไม่ได้มีการทำซ้ำ บน FLORES-200 โมเดล 7B ทำคะแนน XCOMET สูงกว่า 1.8B อยู่แปดจุด (86.89 เทียบกับ 79.77) ซึ่งเป็นช่องว่างที่จุดวางตำแหน่งแบบ "สมดุล" กับ "บนอุปกรณ์" สร้างขึ้นมา แต่บน DomainMTBench ซึ่งเป็นเกณฑ์ชี้วัดการแปลเฉพาะด้านครอบคลุมการเงิน การเมือง และการศึกษา 1.8B ทำคะแนนห่างจาก 7B อยู่เพียง 1.7 จุด GEMBA (91.08 เทียบกับ 92.79) และจุดที่ทำให้คนยังคงประหลาดใจอยู่เสมอคือสถานะของ 1.8B เมื่อเทียบกับโมเดลอื่นในวงกว้าง: Tencent รายงานว่ามันเอาชนะ API การแปลเชิงพาณิชย์ของ Microsoft และ Doubao ได้ในทุกเมตริกของ WMT25 ทั้งสามตัว และยังเหนือกว่า Tower-Plus-72B ซึ่งเป็นโมเดลที่ใหญ่กว่าถึงสี่สิบเท่า ดังนั้นในข้อความเฉพาะด้านทั่วไป โมเดลเล็กจึงใกล้เคียงกับพี่ใหญ่ของมันมากกว่าที่พารามิเตอร์สี่ตัวจะบ่งชี้ จุดแข็งที่แท้จริงของ 7B ปรากฏในส่วนท้ายของการแปลทั่วไปและในคำสั่งที่ยาก ซึ่งความเป็นผู้นำด้าน FLORES และคะแนนงานซับซ้อนที่สูงกว่าบน IFMTBench ทำให้เห็นความแตกต่างอย่างชัดเจนระหว่างทั้งสอง

ฟอร์กการปรับใช้งาน

โมเดล 7B ต้องการโครงสร้างพื้นฐาน ไม่ว่าจะเป็นคลาวด์ API หรือ GPU ระดับ A100 หนึ่งตัว พร้อมด้วยโอเปอเรชันทั่วไปที่เกี่ยวข้อง ส่วนโมเดล 1.8B ที่ขนาด 440MB พร้อมการควอนไทเซชัน 1.25 บิตของ AngelSlim ทำงานบนชิปเดียวกันกับแอปพลิเคชันโทรศัพท์ทั่วไป มีความเร็วสูงกว่าเจนเนอเรชันก่อนหน้าอย่าง Hy-MT1.5 ถึง 1.5 เท่า และไม่จำเป็นต้องใช้เครือข่ายเลย สิ่งนี้เปลี่ยนความเป็นส่วนตัวจากฟีเจอร์ให้กลายเป็นค่าเริ่มต้น: สำหรับสัญญา เวชระเบียน หรือสิ่งใดก็ตามที่อยู่ภายใต้การกำกับดูแล ข้อมูลจะไม่หลุดออกจากอุปกรณ์ ซึ่งเป็นคุณสมบัติที่ไม่อาจซื้อได้ด้วยราคาต่อโทเคนบนฝั่งเซิร์ฟเวอร์ ข้อแลกเปลี่ยนนี้เห็นได้ชัดในการแปลทั่วไปแบบ FLORES ซึ่งความจุที่มากกว่าของ 7B แสดงให้เห็น และในคำสั่งที่ซับซ้อนพอที่จะดันคะแนนรวม 83.14 IFMTBench ของ 1.8B ให้สู้กับเพดานที่สูงกว่าของ 7B

A screenshot of the Hugging Face model card for tencent/Hy-MT2-1.8B (captured August 23 2026) showing the model name and the on-device positioning with 33-language support and the 440MB AngelSlim quantization claim.

การคำนวณต้นทุน

ในระดับ API ทั้งสองโมเดลมีราคาถูก โดยรุ่น 1.8B ถูกกว่า ที่ราคา $0.044 / $0.177 เทียบกับ $0.074 / $0.295 ต่อล้านโทเคน โมเดลเล็กมีต้นทุนต่ำกว่ารุ่น 7B ประมาณ 40% ในทั้งสองด้านของบิล — ที่อัตราการสร้างโทเคนเอาต์พุตหนึ่งล้านโทเคนต่อวันอย่างsteady จะอยู่ที่ประมาณ $70 ต่อวัน เทียบกับ $118 บนอุปกรณ์ รุ่น 1.8B มีต้นทุนเป็นศูนย์ต่อโทเคน ซึ่งเป็นตัวเลขที่เหนือกว่าการเปรียบเทียบเซิร์ฟเวอร์ใดๆ ในเชิงปริมาณ ข้อโต้แย้งของรุ่น 7B ไม่ใช่เรื่องราคา แต่เป็นเรื่องความเผื่อเหลือ (headroom): หากคลังข้อความของคุณเน้นด้านเทคนิค กฎหมาย หรือคำสั่งที่ซับซ้อน ส่วนต่างคุณภาพของรุ่น 7B คือสิ่งที่แสดงออกมาเป็นจำนวนครั้งที่ต้องแปลซ้ำที่น้อยลง — และการแปลซ้ำคือต้นทุนต่อหน่วยที่แท้จริงในงาน MT ระดับมืออาชีพ

A generated infographic titled 'The deployment fork' with two branches: a cloud-server card labelled 'Hy-MT2-7B — server: one GPU or the API, $0.074 / $0.295' and a smartphone card labelled 'Hy-MT2-1.8B — on-device: 440MB, offline, free per token', with the footer 'Same family, released May 21 2026; both now API-callable.'

การจัดเส้นทางสองขนาด

ณขณะที่เขียนนี้ ทั้งสองโมเดลยังไม่อยู่ในแคตตาล็อกของ OrcaRouter ดังนั้นการกล่าวถึงอย่างตรงไปตรงมาก็คือ ทั้งสองถูกให้บริการผ่านคลาวด์ของ Tencent เองและแพลตฟอร์มบุคคลที่สามหลายแห่ง การเปรียบเทียบนี้ยังคงให้บทเรียนเรื่องการจัดเส้นทางที่บล็อกนี้สร้างขึ้นมาได้เป็นอย่างดี นั่นคือ เมื่อสองโมเดลมีความสามารถที่ทับซ้อนกันแต่ต่างกันที่ราคาและความหน่วง เหตุผลในการนำไปใช้งานไม่ใช่ "เลือกตัวใดตัวหนึ่ง" แต่คือ "จัดเส้นทางตามปริมาณงาน" — ส่วนที่เป็นปริมาณมากและความยากต่ำส่งให้โมเดลเล็กที่ราคาถูก ส่วนที่ยากส่งให้โมเดลคุณภาพสูง พร้อมกับการเฟลโอเวอร์อัตโนมัติเพื่อให้การขัดข้องของฝั่งใดฝั่งหนึ่งไม่ทำให้ไปป์ไลน์หยุดชะงัก นี่คือรูปแบบที่ routing DSL ของ OrcaRouter เรียบเรียงขึ้นในโมเดลกว่า 200 ตัวที่เรามี โดยราคาของแต่ละผู้ให้บริการถูกส่งผ่านที่มาร์กอัป 0% หากตระกูลโมเดลแปลภาษาของ Tencent เข้ามาอยู่ในแคตตาล็อก มันก็จะเป็นผู้เช่ารายถัดไปโดยธรรมชาติ

คำตัดสิน

หากการแปลเกิดขึ้นในดาต้าเซ็นเตอร์ของคุณ ให้ใช้ Tencent Hy-MT2-7B — ผ่าน API หากต้องการไม่ต้องจัดการอะไรเลย หรือบน GPU ตัวเดียวหากต้องการเป็นเจ้าของ — แล้วหยุดอ่านได้เลย หากการแปลต้องเกิดขึ้นบนอุปกรณ์ แบบออฟไลน์ หรือภายใต้ข้อกำหนดด้านการรักษาความลับ ให้ใช้ Tencent Hy-MT2-1.8B และขนาดเพียง 440MB ก็ชนะขาดโดยปริยาย กรณีที่ยากจริงๆ เพียงกรณีเดียวคือเวิร์กโหลดคลาวด์ปริมาณปานกลาง ซึ่งทั้งคุณภาพของ 7B และราคาของ 1.8B ต่างก็สมเหตุสมผล ในจุดนั้น อย่าตัดสินใจจาก benchmark ของผู้ขาย: ช่องว่าง GEMBA ที่รายงานต่างกันไม่ถึง 2 จุด ดังนั้นให้รันทั้งสองบนข้อความในโดเมนของคุณเอง แล้วให้ข้อมูลของคุณเป็นคนเลือก

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube