
الآن لدى Tencent Hy-MT2-7B واجهة برمجة تطبيقات مستضافة: ما الذي يغيّره مترجم بتكلفة 0.295 دولار لكل مليون مخرج؟
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianجديدQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenجديدQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekجديدDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokجديدSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1653الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1560الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0952الذكاء71البرمجة
- openaiOpenAI: GPT-5.6 Terra2026-07-0957الذكاء77البرمجة
- openaiOpenAI: GPT-5.6 Sol2026-07-0961الذكاء77البرمجة
أصبح نموذج الترجمة مفتوح المصدر Tencent Hy-MT2-7B، الذي أصدرته Tencent Hunyuan في 21 مايو 2026، قابلاً للاستدعاء عبر واجهة برمجة تطبيقات مستضافة هذا الأسبوع: حوالي 19 أغسطس 2026، أصبح النموذج الكثيف بحجم 7B متاحًا على نقطة النهاية المستضافة في Tencent Cloud بسعر 0.074 دولار لكل مليون رمز إدخال و0.295 دولار لكل مليون رمز إخراج، مع نافذة سياق تبلغ 8,192 رمزًا. لم يصل وحده — بل ظهرت أيضًا Tencent Hy-MT2-1.8B وTencent Hy-MT2-30B-A3B على نفس الخلفية خلال يوم. لقد كانت الأوزان متاحة على Hugging Face وModelScope منذ ثلاثة أشهر؛ الجديد هو أن الفريق يمكنه الآن استدعاء النموذج دون استئجار وحدة معالجة رسومية، أو بناء llama.cpp من المصدر، أو شحن سلسلة أدوات 1.25-بت الخاصة بالأجهزة. بالنسبة لأحمال عمل الترجمة، هذا هو الفرق بين تجربة وقرار منتج.
ما الذي تم شحنه للتو
النقطة التجارية هي نقطة نهاية تينسنت كلاود الخاصة، المكشوفة عبر واجهة برمجة تطبيقات البائع والعديد من منصات الطرف الثالث. تعمل الأحجام الثلاثة كل منها في سياق 8K مع إكمالات تبلغ 4096 رمزًا؛ وتقبل الثلاثة جميعًا إخراجًا منظمًا عبر مخطط JSON في حقل response_format الخاص بها، ولا ينفذ أيٌّ منها استدعاء الدوال. المواصفات العملية، في سطر واحد لكل بُعد:
• Tencent Hy-MT2-7B — 0.074$ للإدخال / 0.295$ للإخراج لكل مليون توكن، سياق 8192، كثيف ~7B، يدعم الإخراج المنظم، بدون استدعاءات أدوات.
• Tencent Hy-MT2-1.8B — 0.044 دولار للإدخال / 0.177 دولار للإخراج لكل مليون توكن، سياق 8,192، نموذج كثيف بـ1.8 مليار معلمة، بدون استدعاءات أدوات.
• Tencent Hy-MT2-30B-A3B — 0.074 دولار للإدخال / 0.295 دولار للإخراج لكل مليون توكن، سياق 8,192، MoE 30B إجمالي / 3B نشط، يدعم المخرجات المنظمة، بدون استدعاء أدوات.
نقطة السعر الرئيسية هي معدل إخراج نموذج 7B: أقل من ثلاثة أعشار السنت لكل ألف رمز إخراج، لنموذج تدّعي تينسنت أنه ينافس نماذج أكبر بعشرة أضعاف. الترجمة هي واحدة من workloads النادرة لنماذج اللغة الكبيرة حيث تشكل رموز الإخراج تقريباً كامل الفاتورة، لذا فإن سعر الإخراج هو الرقم الذي يحدد ما إذا كان خط المعالجة مجدياً على نطاق واسع.

النموذج خلف نقطة النهاية
Hy-MT2 هي عائلة "التفكير السريع" من Tencent: بدلاً من إنفاق سلاسل طويلة من التفكير على كل جملة، صُممت لتتفاعل بالطريقة التي يتصرف بها المترجم المحترف — تتروّى حيث يكون النص المصدر غامضًا، وتسرع حيث لا يكون كذلك. إن إصدار 7B هو الوسط المتوازن للعائلة، نموذج كثيف مرخّص بموجب Apache-2.0، يغطي 33 لغة بالإضافة إلى خمس أزواج من لغات ولهجات الأقليات الصينية (من بينها التبتية، الكازاخية، المنغولية، الأويغورية، والكانتونية). ما يميزه عن نموذج لغوي عام يقوم بالترجمة هو اتباع التعليمات: فهو يحافظ على مصطلح قائمة المصطلحات عبر المستند، ويطبق أسلوبًا محددًا، ويترك الفواصل ومفاتيح JSON دون تغيير، ويتلقى تعليمات التخصيص بلغة بسيطة. أصدرت Tencent IFMTBench، وهو معيار مفتوح لتلك المهارة تحديدًا، إلى جانب الأوزان، والواجهة الاستهلاكية — البرنامج المصغر Tencent Hy Translate، مع تطبيقات iOS وAndroid قيد الإعداد — مبنية على هذه العائلة.

الأرقام، مع علامة النجمة المرفقة
كل ما ورد أدناه هو تقييم من تينسنت نفسها، نُشر على بطاقة النموذج وفي التقرير المرافق؛ ولم تتم إعادة إنتاج أيٍّ منه بشكل مستقل وقت كتابة هذا النص. على مسار الترجمة العامة {{1}}XX⇔XX{{/1}} في FLORES-200، يسجّل إصدار 7B درجة 86.89 على XCOMET-XXL، وهو ما تضعه تينسنت عند نحو 97.9% من أداء Gemini 3.1 Pro (Think). ويُدّعى أنه في وضع {{2}}التفكير السريع{{/2}} يتفوّق على النماذج العامة مفتوحة المصدر، بما فيها DeepSeek-V4-Pro وKimi K2.6 وQwen3.5-397B-A17B وGemma4-26B-A4B. وفي WMT25، تتحسّن نتائجه على كل المقاييس مقارنةً بالجيل السابق — 63.86/71.21/82.24 مقابل 61.59/68.85/75.91 لنموذج Hy-MT1.5-7B، مع أكبر مكسب على {{3}}GEMBA{{/3}} — وعلى {{4}}DomainMTBench{{/4}} (المالية والسياسة والتعليم) يسجّل 94.92 XCOMET / 92.79 GEMBA. أما في اتباع التعليمات، فيظهر فيه أوضح انفصال عن نماذج الترجمة اللغوية التي صدرت قبل عام: 89.73 بسيط / 72.67 معقّد / 83.14 إجمالي على {{5}}IFMTBench{{/5}}.
ماذا تغيّر واجهة برمجة تطبيقات مستضافة في خط أنابيب الترجمة
إن استضافة نموذج 7B ذاتيًا سهلة حقًا قياسًا على مثل هذه الأمور — فهو يعمل على بطاقة A100 واحدة أو RTX 4090، وتوجد إصدارات مكمّمة من FP8 وGGUF. لكن "سهولة الاستضافة الذاتية" لا تعني "صفر عمليات تشغيل". مسار GGUF يعتمد حاليًا على llama.cpp مع نواة STQ من Tencent، بينما يحتاج مسار FP8 إلى مجموعة تقنيات مناسبة، ولا بد من شخص يراقبه باستمرار. أما نقطة الوصول المستضافة فتُزيل كل ذلك من الحسبان: لا وحدة GPU، ولا بناء نواة، ولا تخطيط سعة، وسعر ثابت لكل توكن بصرف النظر عن الاستخدام. وبالنسبة لفريق يعالج ملايين الجمل المترجمة يوميًا، فإن هذه القدرة على التنبؤ أهم من معيار الأداء الأبرز — وهذا هو السبب في أن هذا الأسبوع أكثر أهمية من إطلاق مايو.

سؤال التوجيه الذي لم يطرحه أحد بعد
بما أن عمر النموذج ثلاثة أيام على جانب واجهة برمجة التطبيقات، فإن الطريقة الواقعية لتبنّيه هي الطريقة التي تتبنّى بها أي مزوّد جديد كليًا: ضعه خلف قاعدة توجيه مع تجاوز تلقائي للفشل بحيث لا يمكن لنقطة نهاية غير مختبرة أن تُسقط مسار إنتاج أبدًا، ودَع حجم الاستخدام يقرر ما إذا كان يستحق مكانًا دائمًا. هذا هو بالضبط النمط الذي تصوغه لغة التوجيه الخاصة بمجال OrcaRouter عبر أكثر من 200 نموذج نوفّرها — ومن الجدير أن نكون دقيقين هنا: Tencent Hy-MT2-7B غير موجود في كتالوج OrcaRouter حتى وقت كتابة هذه السطور، لذا فهذه ليست قصة «استدعِه من خلالنا». أما ما هو في صلب الموضوع هنا فهو نموذج التسعير. يمرّر OrcaRouter السعر المعلن لكل مزوّد بهامش ربح 0%، لذا عندما يخفض البائع السعر، يصبح التخفيض ساريًا على المنصة في اليوم نفسه. بالنسبة لأعباء الترجمة عالية الحجم، السؤال الذي يجب طرحه على أي نقطة نهاية ليس «ما هو سعر البوابة اليوم؟» بل «ما هو السعر المعلن الفعلي الذي يفرضه المزوّد لكل رمز، وهل يوجد أي شيء بيني وبينه؟» بسعر 0.295 دولار لكل مليون رمز مخرَج، جعل Tencent Hy-MT2-7B هذا السؤال مثيرًا للاهتمام.
ماذا تشاهد بعد ذلك
ثلاثة أمور تترتب على هذا الأسبوع. أولاً، أصبح النموذجان الشقيقان 1.8B و30B-A3B قابلين للاستدعاء بالتساوي الآن، لذا فإن قرار "أي حجم" هو سؤال API حقيقي وليس قرار استضافة ذاتية (للعائلة صفحات مباريات خاصة بها، لكن النسخة المختصرة هي: 1.8B للأجهزة المحمولة وأرخص فئة، 30B-A3B للمجالات الاحترافية، و7B في المنتصف). ثانيًا، تقدم شراكة Tencent مع WMT26 جوائز للفرق التي تستخدم نماذج Hy-MT في مهمتي الترجمة الآلية العامة وترجمة الترجمة النصية للفيديو — وهي إشارة إلى أن Tencent تعتزم جعل هذه العائلة الخيار الافتراضي المفتوح للترجمة في الترجمة الآلية التنافسية. ثالثًا، تطبيقا iOS وAndroid مع الاستدلال على الجهاز، إذا تم إطلاقهما كما أُعلن، سيجعلان نموذج 1.8B النموذج المفتوح الأكثر تثبيتًا للترجمة في العالم. واجهة برمجة التطبيقات المستضافة هي الجزء الذي تغير هذا الأسبوع؛ مسار العائلة كان محددًا في مايو.
