بطاقة عنوان رئيسي لـ 'Tencent Hy-MT2-7B Now Has a Hosted API' مع العنوان الفرعي 'What a $0.295-per-Million-Output Translator Changes', تعرض أيقونة خدمة سحابية، ورمز ترجمة، وخط موصل API، وشارة سعر موسومة بـ $0.074 / $0.295 لكل 1M رمزًا، مع شعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

الآن لدى Tencent Hy-MT2-7B واجهة برمجة تطبيقات مستضافة: ما الذي يغيّره مترجم بتكلفة 0.295 دولار لكل مليون مخرج؟

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

أصبح نموذج الترجمة مفتوح المصدر Tencent Hy-MT2-7B، الذي أصدرته Tencent Hunyuan في 21 مايو 2026، قابلاً للاستدعاء عبر واجهة برمجة تطبيقات مستضافة هذا الأسبوع: حوالي 19 أغسطس 2026، أصبح النموذج الكثيف بحجم 7B متاحًا على نقطة النهاية المستضافة في Tencent Cloud بسعر 0.074 دولار لكل مليون رمز إدخال و0.295 دولار لكل مليون رمز إخراج، مع نافذة سياق تبلغ 8,192 رمزًا. لم يصل وحده — بل ظهرت أيضًا Tencent Hy-MT2-1.8B وTencent Hy-MT2-30B-A3B على نفس الخلفية خلال يوم. لقد كانت الأوزان متاحة على Hugging Face وModelScope منذ ثلاثة أشهر؛ الجديد هو أن الفريق يمكنه الآن استدعاء النموذج دون استئجار وحدة معالجة رسومية، أو بناء llama.cpp من المصدر، أو شحن سلسلة أدوات 1.25-بت الخاصة بالأجهزة. بالنسبة لأحمال عمل الترجمة، هذا هو الفرق بين تجربة وقرار منتج.

ما الذي تم شحنه للتو

النقطة التجارية هي نقطة نهاية تينسنت كلاود الخاصة، المكشوفة عبر واجهة برمجة تطبيقات البائع والعديد من منصات الطرف الثالث. تعمل الأحجام الثلاثة كل منها في سياق 8K مع إكمالات تبلغ 4096 رمزًا؛ وتقبل الثلاثة جميعًا إخراجًا منظمًا عبر مخطط JSON في حقل response_format الخاص بها، ولا ينفذ أيٌّ منها استدعاء الدوال. المواصفات العملية، في سطر واحد لكل بُعد:

Tencent Hy-MT2-7B — 0.074$ للإدخال / 0.295$ للإخراج لكل مليون توكن، سياق 8192، كثيف ~7B، يدعم الإخراج المنظم، بدون استدعاءات أدوات.

Tencent Hy-MT2-1.8B — 0.044 دولار للإدخال / 0.177 دولار للإخراج لكل مليون توكن، سياق 8,192، نموذج كثيف بـ1.8 مليار معلمة، بدون استدعاءات أدوات.

Tencent Hy-MT2-30B-A3B — 0.074 دولار للإدخال / 0.295 دولار للإخراج لكل مليون توكن، سياق 8,192، MoE 30B إجمالي / 3B نشط، يدعم المخرجات المنظمة، بدون استدعاء أدوات.

نقطة السعر الرئيسية هي معدل إخراج نموذج 7B: أقل من ثلاثة أعشار السنت لكل ألف رمز إخراج، لنموذج تدّعي تينسنت أنه ينافس نماذج أكبر بعشرة أضعاف. الترجمة هي واحدة من workloads النادرة لنماذج اللغة الكبيرة حيث تشكل رموز الإخراج تقريباً كامل الفاتورة، لذا فإن سعر الإخراج هو الرقم الذي يحدد ما إذا كان خط المعالجة مجدياً على نطاق واسع.

A single-column scoreboard titled 'Tencent Hy-MT2-7B — the scoreboard' listing six rows: Params dense 7B; Price $0.074 / $0.295 per 1M; Context 8,192 tokens; FLORES-200 86.89 (~97.9% of Gemini 3.1 Pro Think); WMT25 63.86 / 71.21 / 82.24; License Apache-2.0, with the footer 'All figures vendor-reported; API price as listed Aug 2026.'

النموذج خلف نقطة النهاية

Hy-MT2 هي عائلة "التفكير السريع" من Tencent: بدلاً من إنفاق سلاسل طويلة من التفكير على كل جملة، صُممت لتتفاعل بالطريقة التي يتصرف بها المترجم المحترف — تتروّى حيث يكون النص المصدر غامضًا، وتسرع حيث لا يكون كذلك. إن إصدار 7B هو الوسط المتوازن للعائلة، نموذج كثيف مرخّص بموجب Apache-2.0، يغطي 33 لغة بالإضافة إلى خمس أزواج من لغات ولهجات الأقليات الصينية (من بينها التبتية، الكازاخية، المنغولية، الأويغورية، والكانتونية). ما يميزه عن نموذج لغوي عام يقوم بالترجمة هو اتباع التعليمات: فهو يحافظ على مصطلح قائمة المصطلحات عبر المستند، ويطبق أسلوبًا محددًا، ويترك الفواصل ومفاتيح JSON دون تغيير، ويتلقى تعليمات التخصيص بلغة بسيطة. أصدرت Tencent IFMTBench، وهو معيار مفتوح لتلك المهارة تحديدًا، إلى جانب الأوزان، والواجهة الاستهلاكية — البرنامج المصغر Tencent Hy Translate، مع تطبيقات iOS وAndroid قيد الإعداد — مبنية على هذه العائلة.

A screenshot of the Hugging Face model card for tencent/Hy-MT2-7B (captured August 23 2026) showing the model name, Apache-2.0 license, and the family description covering 33 languages plus five minority-language and dialect pairs.

الأرقام، مع علامة النجمة المرفقة

كل ما ورد أدناه هو تقييم من تينسنت نفسها، نُشر على بطاقة النموذج وفي التقرير المرافق؛ ولم تتم إعادة إنتاج أيٍّ منه بشكل مستقل وقت كتابة هذا النص. على مسار الترجمة العامة {{1}}XX⇔XX{{/1}} في FLORES-200، يسجّل إصدار 7B درجة 86.89 على XCOMET-XXL، وهو ما تضعه تينسنت عند نحو 97.9% من أداء Gemini 3.1 Pro (Think). ويُدّعى أنه في وضع {{2}}التفكير السريع{{/2}} يتفوّق على النماذج العامة مفتوحة المصدر، بما فيها DeepSeek-V4-Pro وKimi K2.6 وQwen3.5-397B-A17B وGemma4-26B-A4B. وفي WMT25، تتحسّن نتائجه على كل المقاييس مقارنةً بالجيل السابق — 63.86/71.21/82.24 مقابل 61.59/68.85/75.91 لنموذج Hy-MT1.5-7B، مع أكبر مكسب على {{3}}GEMBA{{/3}} — وعلى {{4}}DomainMTBench{{/4}} (المالية والسياسة والتعليم) يسجّل 94.92 XCOMET / 92.79 GEMBA. أما في اتباع التعليمات، فيظهر فيه أوضح انفصال عن نماذج الترجمة اللغوية التي صدرت قبل عام: 89.73 بسيط / 72.67 معقّد / 83.14 إجمالي على {{5}}IFMTBench{{/5}}.

ماذا تغيّر واجهة برمجة تطبيقات مستضافة في خط أنابيب الترجمة

إن استضافة نموذج 7B ذاتيًا سهلة حقًا قياسًا على مثل هذه الأمور — فهو يعمل على بطاقة A100 واحدة أو RTX 4090، وتوجد إصدارات مكمّمة من FP8 وGGUF. لكن "سهولة الاستضافة الذاتية" لا تعني "صفر عمليات تشغيل". مسار GGUF يعتمد حاليًا على llama.cpp مع نواة STQ من Tencent، بينما يحتاج مسار FP8 إلى مجموعة تقنيات مناسبة، ولا بد من شخص يراقبه باستمرار. أما نقطة الوصول المستضافة فتُزيل كل ذلك من الحسبان: لا وحدة GPU، ولا بناء نواة، ولا تخطيط سعة، وسعر ثابت لكل توكن بصرف النظر عن الاستخدام. وبالنسبة لفريق يعالج ملايين الجمل المترجمة يوميًا، فإن هذه القدرة على التنبؤ أهم من معيار الأداء الأبرز — وهذا هو السبب في أن هذا الأسبوع أكثر أهمية من إطلاق مايو.

A screenshot of the Tencent Cloud techpedia page for Hy-MT2 (captured August 23 2026, English) showing the header 'Hy-MT2: High-Performance Multilingual Translation Model', the 2026-05-21 publication date, and a summary line about translating across 33 languages.

سؤال التوجيه الذي لم يطرحه أحد بعد

بما أن عمر النموذج ثلاثة أيام على جانب واجهة برمجة التطبيقات، فإن الطريقة الواقعية لتبنّيه هي الطريقة التي تتبنّى بها أي مزوّد جديد كليًا: ضعه خلف قاعدة توجيه مع تجاوز تلقائي للفشل بحيث لا يمكن لنقطة نهاية غير مختبرة أن تُسقط مسار إنتاج أبدًا، ودَع حجم الاستخدام يقرر ما إذا كان يستحق مكانًا دائمًا. هذا هو بالضبط النمط الذي تصوغه لغة التوجيه الخاصة بمجال OrcaRouter عبر أكثر من 200 نموذج نوفّرها — ومن الجدير أن نكون دقيقين هنا: Tencent Hy-MT2-7B غير موجود في كتالوج OrcaRouter حتى وقت كتابة هذه السطور، لذا فهذه ليست قصة «استدعِه من خلالنا». أما ما هو في صلب الموضوع هنا فهو نموذج التسعير. يمرّر OrcaRouter السعر المعلن لكل مزوّد بهامش ربح 0%، لذا عندما يخفض البائع السعر، يصبح التخفيض ساريًا على المنصة في اليوم نفسه. بالنسبة لأعباء الترجمة عالية الحجم، السؤال الذي يجب طرحه على أي نقطة نهاية ليس «ما هو سعر البوابة اليوم؟» بل «ما هو السعر المعلن الفعلي الذي يفرضه المزوّد لكل رمز، وهل يوجد أي شيء بيني وبينه؟» بسعر 0.295 دولار لكل مليون رمز مخرَج، جعل Tencent Hy-MT2-7B هذا السؤال مثيرًا للاهتمام.

ماذا تشاهد بعد ذلك

ثلاثة أمور تترتب على هذا الأسبوع. أولاً، أصبح النموذجان الشقيقان 1.8B و30B-A3B قابلين للاستدعاء بالتساوي الآن، لذا فإن قرار "أي حجم" هو سؤال API حقيقي وليس قرار استضافة ذاتية (للعائلة صفحات مباريات خاصة بها، لكن النسخة المختصرة هي: 1.8B للأجهزة المحمولة وأرخص فئة، 30B-A3B للمجالات الاحترافية، و7B في المنتصف). ثانيًا، تقدم شراكة Tencent مع WMT26 جوائز للفرق التي تستخدم نماذج Hy-MT في مهمتي الترجمة الآلية العامة وترجمة الترجمة النصية للفيديو — وهي إشارة إلى أن Tencent تعتزم جعل هذه العائلة الخيار الافتراضي المفتوح للترجمة في الترجمة الآلية التنافسية. ثالثًا، تطبيقا iOS وAndroid مع الاستدلال على الجهاز، إذا تم إطلاقهما كما أُعلن، سيجعلان نموذج 1.8B النموذج المفتوح الأكثر تثبيتًا للترجمة في العالم. واجهة برمجة التطبيقات المستضافة هي الجزء الذي تغير هذا الأسبوع؛ مسار العائلة كان محددًا في مايو.

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube