بطاقة عنوان مولّدة تعرض "GLM-5.3-Flash Revealed" مع عنوان فرعي "نموذج Zhipu المفتوح متعدد الوسائط الرائد هو Ox Alpha المجهول — الآن بعُشر سعر GLM-5.3"، مع أيقونات خطية مسطحة لرقاقة برق، وشارة MIT، وأيقونة صور-فيديو.
Guides & Insights

كشف النقاب عن GLM-5.3-Flash: "Ox Alpha" المجهول كان نموذج Zhipu المفتوح متعدد الوسائط الرائد طوال الوقت

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

النموذج الذي أمضى أسبوعًا في صدارة جداول استخدام منصات البرمجة الخارجية أصبح أخيرًا له اسم وسعر. في 26 أغسطس 2026، أكدت Zhipu AI أن نموذج "Ox Alpha" المجاني الذي ظل المطورون يستخدمونه بكثافة منذ 20 أغسطس هو GLM-5.3-Flash — وهو نموذج خليط الخبراء (Mixture-of-Experts) بإجمالي 320 مليار معامل و18 مليار معامل نشط (320B-A18B)، وأول إصدار متعدد الوسائط أصليًا في سلسلة GLM-5، ومن أرخص النماذج الحدودية على أي بطاقة أسعار عند الإطلاق. تسعّر Zhipu نموذج GLM-5.3-Flash بعُشر سعر واجهة برمجة تطبيقات نموذجها الرئيسي GLM-5.3، أو بعُشرين خلال خصم لفترة محدودة، كما أن الأوزان المفتوحة — المرخصة بموجب MIT — نُشرت على Hugging Face في اليوم نفسه. وعلى عكس GLM-5.3، الذي لا تزال أوزانه معلّقة حتى نهاية الشهر، فإن هذا النموذج يمكنك استضافته ذاتيًا هذا الأسبوع، وليس الأسبوع القادم.

إليك النسخة المختصرة: أطلقت Zhipu نموذجها الكبير الأرخص حتى الآن كمصدر مفتوح، وهو يتفوق على GLM-5.2 الخاص بها في المعايير على الرغم من تشغيل جزء صغير من المعلمات النشطة. وتضع الشركة درجة مؤشر تحليل الذكاء الاصطناعي (Artificial Analysis Intelligence Index) عند 57، بما يعادل درجة Claude Opus 4.8، وفقًا لمواد إطلاق Zhipu. جميع أرقام المعايير المرتبطة بهذا الإطلاق هي أرقام مقدمة من البائع ولم يتم تكرارها حتى وقت كتابة هذا التقرير؛ الأسعار وأعداد المعلمات هي حقائق حالية.

ما الذي تم شحنه فعليًا

GLM-5.3-Flash هو نموذج MoE بإجمالي 320B و18B نشط، ويتكون من 45 طبقة، مما يجعل حجم نشاطه يزيد قليلاً عن نصف المعاملات النشطة البالغة ~32B في GLM-5.2. أبرز قدرة هي تعدد الوسائط: فهو يستقبل النصوص والصور والفيديو بشكل أصلي — وهو أول نموذج من سلسلة GLM-5 يفعل ذلك — بدلاً من توجيه الرؤية عبر محول منفصل. يصل سياق الإدخال إلى مليون رمز، وتدّعي Zhipu أن تكلفة تقديم السياق الطويل تبلغ نحو ثلث تكلفة GLM-5.3.

{{1}}على صعيد البنية{{/1}}، {{2}}تصفه Zhipu{{/2}} بأنه {{3}}أول نموذج رائد مفتوح المصدر{{/3}} {{4}}يستخدم تصميمًا هجينًا يجمع بين الانتباه المتناثر والانتباه الخطي{{/4}}، {{5}}مقترنًا بـ Manifold-Constrained Hyper-Connections (mHC){{/5}} {{6}}للتوسع{{/6}}، {{7}}وآلية IndexPool{{/7}} {{8}}تضغط أربعة متجهات مفاتيح للمفهرس في تجمع واحد مرجح{{/8}} {{9}}لتقليل زمن الاستجابة في السياقات الطويلة{{/9}}. تم التدريب المسبق على مجموعة بيانات متعددة الوسائط مكونة من 30 تريليون رمزًا. {{10}}لم يُدقَّق أي من ذلك بشكل مستقل بعد{{/10}} — {{11}}فهو وصف Zhipu لنموذجها الخاص{{/11}} — {{12}}إلا أن ادعاءات كفاءة التقديم محددة بما يكفي لاختبارها{{/12}} {{13}}بمجرد وضع الأوزان أمام حزمة الاستدلال مفتوحة المصدر{{/13}}.

ورقة مواصفات يوم الإطلاق، في لمحة:

• المعاملات — 320 مليار إجمالاً / 18 مليار نشطة، 45 طبقة، MoE.

• نمط التشغيل — إدخال نص وصور وفيديو بشكل أصلي؛ إخراج نصي.

نافذة السياق — حتى 1,000,000 رمز.

• الترخيص — MIT، الأوزان المفتوحة متاحة على Hugging Face عند الإطلاق.

• السعر — $0.15 / $0.50 لكل مليون توكن (إدخال / إخراج)، و$0.03 لكل مليون توكن إدخال مخزّن مؤقتًا؛ عرض بخصم 50% حتى 9 سبتمبر 2026 يخفض ذلك إلى $0.075 / $0.25 / $0.015. بسعر القائمة، يعادل ذلك تقريبًا عُشر سعر GLM-5.3 البالغ $1.40 / $4.40.

A generated single-model scoreboard titled 'GLM-5.3-Flash — the scoreboard' with rows for AA Index 57 (vendor-reported), Active params 18B, Context 1M tokens, Modality text/image/video, Open weights MIT live now, and Price ~$0.14/$0.44 per 1M (discount $0.07/$0.22); footer notes benchmarks are vendor-reported and pricing is derived from Zhipu's stated ratios.

أسبوع Ox Alpha

يكشف هذا الإعلان عن أسبوعٍ من التكهنات. في 20 أغسطس، ظهر نموذج مجهول الهوية على منصة طرف ثالث لواجهات برمجة تطبيقات الذكاء الاصطناعي، بنافذة سياق تبلغ مليون رمز، ودعم لإدخال النص/الصورة/الفيديو، وبسعر صفري، وسرعان ما أصبح النموذج الأكثر استدعاءً على المخططات الأسبوعية للمنصة. وقد تتبّع المجتمع بصمته إلى عائلة GLM من شركة Zhipu خلال 48 ساعة — وهو النمط نفسه القائم على الإخفاء ثم التبني الذي سبق أن حدد نماذج من مختبرات صينية أخرى — وخمّن المحللون على نطاق واسع أنه نسخة GLM-5.3 بتقنية Flash. وأكّد إعلان 26 أغسطس التخمين، وأضاف تفصيلًا مفاده أن الأسبوع المجاني كان اختبارًا مقصودًا: إذ تقول Zhipu إن التشغيل المجهول حقّق أرقامًا قياسية في حجم الاستدعاءات على منصات البرمجة التي عُرض فيها، مع تقديم كل حركة المرور من رقائق صينية محلية.

سياق الأسبوع المجاني مهم لتوقعات التسعير. نموذج يُمنح مجانًا بسعر 0 دولار لمدة أسبوع، ثم يُطلق بعُشر سعر النموذج الرئيسي مع خصم لفترة محدودة يجعله بسعر العشرين، هو خطوة متعمدة لصناعة السوق في الفئة الاقتصادية — وجزء "لفترة محدودة" هو ما يجب مراقبته. الخصم قرار تسعير يمكن التراجع عنه؛ أما الأوزان المفتوحة برخصة MIT فلا يمكن.

A screenshot of the Z.ai blog page for the GLM-5.3-Flash launch, titled 'GLM-5.3-Flash: Frontier Intelligence, Flash Cost', describing the 320B-total / 18B-active model as the first natively multimodal model in the GLM-5 series, at one-tenth the price, approaching Claude Opus 4.8 on coding benchmarks.

كم تبلغ تكلفته، بالدولار الفعلي

بطاقة أسعار Zhipu صدرت بالدولار الفعلي وليس بالنسب فقط: 0.15 دولار لكل مليون رمز إدخال، و0.50 دولار لكل مليون رمز إخراج، و0.03 دولار لكل مليون رمز إدخال مخزَّن مؤقتًا. وبالمقارنة مع أسعار GLM-5.3 المنشورة البالغة 1.40 / 4.40 دولار، فإن ذلك يضعها عند حوالي عُشر السعر المعلن، ويخفضها عرض الإطلاق الترويجي بخصم 50% والممتد حتى 9 سبتمبر 2026 إلى 0.075 / 0.25 / 0.015 دولار — أي حوالي عُشرين. وتضع Zhipu أيضًا تكلفة النموذج لكل مهمة من مؤشر AA Intelligence Index عند حوالي 0.045 دولار وفقًا لما أبلغت عنه الشركة المصنعة، وهو الرقم الذي تقف خلفه عبارة "1/40 من Opus 4.8". وبالنسبة لنموذج يسجّل في النطاق نفسه الذي تسجّل فيه نماذج تُسعَّر أعلى بـ10–40 ضعفًا، فإن الاقتصاديات المعلنة حقيقية؛ لكن التفاصيل الدقيقة هي أن خصم الإطلاق مؤقت وأن التكلفة لكل مهمة تعتمد على مدى إسهاب النموذج في الإنتاج الفعلي.

إن قصة الكفاءة هي الجانب الذي تدّعي Zhipu أن ميزة التكلفة تنبع منه. وبالمقارنة مع GLM-5.3، يبلّغ البائع عن انخفاض الحوسبة الانتباهية بمقدار 3.0x وانخفاض كاش KV بمقدار 4.4x، ويدّعي امتلاك أقل حوسبة انتباهية بين نماذج الفئة الاقتصادية المقارنة — GLM-5.3 وDeepSeek V4 Flash وKimi K3 — معترفًا بأن كاش KV لديه ما يزال أكبر قليلًا من ذلك الخاص بـ DeepSeek V4 Flash وKimi K3. أما في جانب التقديم (Serving)، فتبلّغ Zhipu عن تحسّن بمقدار 3x في أداء التقديم من البداية إلى النهاية مقارنةً بالخط الأساسي على الرقاقات الصينية المحلية، لتصل إلى تكلفة لكل توكن تصفها بأنها مماثلة لتلك الخاصة بوحدات معالجة الرسوم NVIDIA السائدة. كل هذه الأرقام مُعلنة من البائع ولم يُعِد أحد إنتاجها بشكل مستقل بعد؛ وهي الأرقام الصحيحة التي ينبغي التحقق منها مقابل الأوزان المفتوحة.

لماذا يهم الكشف

أزل المعايير جانبًا، وما زال الإطلاق يغيّر مشهد النماذج المفتوحة بطريقتين. أولاً، إنه نموذج متعدد الوسائط بأوزان مفتوحة في النطاق الحدودي بسعر مناسب للميزانية — فالجمع بين ترخيص MIT، وسياق مليون رمز، وإدخال الصور والفيديو بشكل أصلي، وتكلفة لا تتجاوز بضعة سنتات لكل مهمة لا يوجد له مقابل مباشر من مختبرات الحدود الأمريكية، التي تكلف نماذجها المكافئة متعددة الوسائط أضعافًا مضاعفة وتُطرح مغلقة. ثانيًا، إنه يقوّض النموذج الرائد الخاص بشركة Zhipu نفسه: GLM-5.3 هو النموذج ذو 743 مليار معامل الذي سجّل 60 درجة مقاسة بشكل مستقل على AA Intelligence Index هذا الشهر، وGLM-5.3-Flash يُقدَّم على أنه "ذكاء حدودي، بتكلفة خاطفة" مقابل نفس العائلة. قصة Zhipu هي أن نموذجًا أصغر وأرخص يمكنه التقاط معظم قدرات النموذج الرائد — وهو، إذا صمدت ادعاءات البائع بشأن البرمجة والقدرات الوكيلية، نفس حجة اقتصاد ما بعد التدريب التي تتردد في أرجاء الصناعة طوال العام.

تحفّظ واحد يضع هذا في منظوره الصحيح. درجة GLM-5.3-Flash البالغة 57 في مؤشر AA تأتي من مواد إطلاق Zhipu الخاصة، وليس بعد من لوحة صدارة Artificial Analysis، والمقارنة البرمجية مع Claude Opus 4.8 هي تقييم Zhipu الداخلي عبر Z.ai Code Bench. تعامل مع الرقم 57 ومع التكافؤ البرمجي كادعاءات إلى أن تظهر قياسات مستقلة — فالنموذج خضع لاختبارات واسعة النطاق بشكل مجهول، لذا فإن أرقام الأطراف الثالثة ينبغي أن تصل سريعًا.

جرّبها، وكيف تتناسب طبقة التوجيه

الوصول في اليوم الأول يكون عبر واجهة برمجة التطبيقات الخاصة بـ Zhipu، والأوزان المفتوحة على Hugging Face (zai-org/GLM-5.3-Flash، MIT)، ومنتجات Zhipu للبرمجة — ZCode وخطة GLM للبرمجة، والتي تتضمن مجموعة من بطاقات الخبرة اليومية. أما بالنسبة للاستضافة الذاتية، فإن رخصة MIT بالإضافة إلى دعم vLLM وSGLang تعني أن ادعاءات كفاءة الخدمة المذكورة أعلاه يمكن التحقق منها مباشرةً.

على صعيد التوجيه، فإن GLM-5.3-Flash نفسه غير مدرج بعد في قائمة OrcaRouter حتى وقت هذا التحديث. أما بقية عائلة GLM فكالتالي: أصبح GLM-5.3 متاحًا لدينا في اليوم نفسه الذي فُتحت فيه واجهة برمجة تطبيقات Zhipu، بسعر Zhipu الرسمي مع تمرير بهامش ربح 0%. وهذا التمرير هو بالضبط الآلية المهمة لإطلاق من هذا القبيل — أي تغيير في سعر المورّد، سواء ثَبُت الخصم أو تحرّك جدول الأسعار لاحقًا، يظهر لدينا في اليوم نفسه، دون الحاجة إلى إعادة تفاوض. إذا أردت تشغيل Flash إلى جانب بقية خط GLM على مفتاح واحد بمجرد توفّره، فهذا هو الإعداد؛ وحتى ذلك الحين، تُعد الأوزان على Hugging Face أسرع طريقة لتجربته بنفسك.

A screenshot of the Hugging Face model card for zai-org/GLM-5.3-Flash showing the MIT license badge, the Text Generation tag, and the 320B total / 18B active parameter counts.

ماذا تشاهد بعد ذلك

ثلاثة أمور تحسم القصة الحقيقية في الأسبوعين المقبلين. أولاً، قياس مستقل من Artificial Analysis للطراز 57 — كان النموذج متاحًا بالفعل للاستخدام باسم Ox Alpha، لذا ينبغي أن تلحق لوحة الصدارة سريعًا. ثانيًا، ما إذا كان العرض الترويجي بخصم 50% — والمقرر حاليًا أن ينتهي في 9 سبتمبر 2026 — سيُمتد بعد ذلك التاريخ، لأنه يحدد التكلفة الثابتة لنموذج Flash. ثالثًا، أوزان GLM-5.3، التي لا يزال من المقرر إطلاقها حوالي 28 أغسطس — في نفس الأسبوع الذي ظهرت فيه أوزان MIT لنموذج Flash، مما سيمنح مجتمع الأوزان المفتوحة مستويين من العائلة نفسها للمقارنة في آن واحد.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube