
GLM 5.5 أم GLM 5.3-Vision؟ نموذج مجهول الهوية يطابق بصمة Z.ai ظهر للتو
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 150 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 52 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 250 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
نموذج غير محدد الهوية، يتطابق ملف خدمته — السرعة، وزمن الوصول إلى أول توكن، ومعدل إصابة الكاش — مع حزمة GLM من Z.ai، وقد بدأ يلفت انتباه محللي القدرات الحاسوبية، والتخمين العملي أنه قد يُسمى GLM 5.3-Vision أو GLM 5.5. في العشرين من أغسطس، نشر المحلل المتخصص في الحوسبة والقدرات teortaxesTex أن النموذج المجهول الذي يتتبعه "ليس DeepSeek بوضوح، على الأقل"، وأنه "لا يوجد ما يستبعد GLM حتى الآن"، وأن "السرعة، وزمن الوصول إلى أول توكن، ومعدل إصابة الكاش تتوافق مع GLM أيضًا". قراءته: من المتوقع أن يُطلق عليه GLM 5.3-Vision أو 5.5، بحصوله على نحو 61 نقطة على مؤشر تحليل الذكاء الاصطناعي — أي نقطة واحدة فوق المكان الذي يحتله GLM-5.3 المُصدر اليوم. لا شيء هنا مؤكد. لا توجد بطاقة نموذج، ولا إعلان من Z.ai، ولا واجهة برمجة تطبيقات، وتتعامل هذه الصفحة مع هذه الرؤية على حقيقتها: إشارة تسريب مبكرة وغير مكررة، تستحق المتابعة تحديدًا لأن GLM-5.5 كان النموذج الرئيسي المنتظر من Z.ai طوال الشهر ولم يظهر. بعد خمسة أيام من ذلك المنشور، وصلت نقطة بيانات ثانية، وهذه المرة قابلة للفحص بالكامل: في 25 أغسطس، فتحت vLLM — بيئة تشغيل الاستدلال المسؤولة عن معظم خدمة النماذج واسعة النطاق — طلب سحب من النوع Do-Not-Merge يفعّل دعم نواة MHA المُقنَّعة لأبعاد رؤوس GLM-5. لا يذكر ذلك الطلب أي نوع من النموذج ولا يثبت أي إطلاق؛ إنه عمل تمهيدي في بنية الخدمة، وهو نوع النشاط الخلفي الذي يتركه نموذج جديد وراءه.
ما الذي تقوله الإشارة فعليًا
المصدر هو منشور واحد على منصة X من حساب teortaxesTex، بتاريخ 20 أغسطس — نفس الحساب الذي تحققت إشارته الزمنية "قرابة أسبوع" بشأن إطلاق GLM-5.3 في اليوم المحدد في أغسطس. التأطير صريح بشأن مستوى الأدلة: "أدلة قوية (لم تُكرَّر)." يستبعد المحلل DeepSeek، ولا يجد ما يتعارض مع GLM، ويستشهد بثلاثة قياسات على مستوى الخدمة — الإنتاجية (throughput)، والوقت حتى أول رمز (time-to-first-token)، ومعدل إصابة الذاكرة المؤقتة (cache hit rate) — باعتبارها مطابقة لمكدس Z.ai. ثم الاسمين المرشحين، والنتيجة المتوقعة: "حاليًا أتوقع أن يُسمى GLM 5.3-Vision أو 5.5، ويحرز تقريبًا 61 على AA."
خذ كل جزء على حدة. ادعاءات الهوية (ليست DeepSeek، بل تطابق GLM) هي استدلال بصمة من طريقة تقديم النموذج، وليست بطاقة نموذج. النتيجة توقع وليست قياسًا. الأسماء تخمينات. ما يجعل الإشارة تستحق أكثر من الضوضاء هو أنها متسقة اتجاهيًا مع كل ما نعرفه عن خارطة طريق Z.ai هذا الشهر: GLM-5.3 صدر نصيًا فقط، وكان طلب المجتمع الأعلى صوتًا هو الرؤية (vision)، وقد أفادت عدة منافذ (عبر JPMorgan وReuters وCGTN ومذكرة Goldman بتاريخ 18 أغسطس) أن GLM-5.5 سيصل "خلال أغسطس" — فخاتمة الشهر هي الآن.
لماذا تُعد بصمة التقديم مهمة
زمن أول رمز (TTFT) ومعدل إصابة ذاكرة التخزين المؤقت مؤشران على مستوى البنية التحتية. تُحدَّدان بالطريقة التي يبني بها المزوّد حزمة الاستدلال الخاصة به — المجدول، وتخطيط ذاكرة التخزين المؤقت، وسياسة الدفعات — وليس باسم النموذج الذي يستدعيه الطلب. عندما يقول محلل إن TTFT ومعدل إصابة ذاكرة التخزين المؤقت لنموذج مجهول يطابقان GLM، فهو يعني أن حزمة التقديم التي تقف خلفه تتصرف مثل حزمة Z.ai، وهذا أقرب شيء إلى بصمة يمكن الحصول عليها دون الأوزان أو بطاقة النموذج. إنه ليس إثباتًا. فقد يحاكي مزوّد آخر نفس الحزمة، أو قد تشغّل Z.ai نموذجًا لشريك. لكنه ادعاء محدد وقابل للتحقق، وتحفّظ «لم يتم تكراره» يخبرك أن المحلل لا يعرضه باعتباره أمرًا محسومًا.
يُعد استبعاد DeepSeek مهمًا أيضًا. لقد أصبح DeepSeek V4 Pro متاحًا بشكل عام في 13 أغسطس، وكان إصدار Flash الخاص به هو الإصدار الصيني الآخر مفتوح الوزن عالي السرعة هذا الشهر. نموذج مجهول يستبعد DeepSeek لكنه يشير إلى GLM يضيّق المجال إلى خط إنتاج Z.ai — وخط إنتاج Z.ai يحتوي على عنصرين محتملين، وهذا هو بالضبط التشعب الذي تشير إليه الإشارة.
إشارة ثانية: البنية التحتية للخدمة تُبنى تحسبًا لاهتمام GLM-5
في 25 أغسطس، وصلت نقطة بيانات ثانية — وهذه المرة قابلة للتحقق بالكامل. استقبل vLLM، بيئة تشغيل الاستدلال التي تقف خلف معظم عمليات تقديم النماذج واسعة النطاق، طلب السحب رقم 53785، بعنوان "[Do Not Merge][Attention] Enable masked MHA for GLM-5 head dimensions." وبالتحقق من المستودع، يتيح هذا الطلب مسار التعبئة المسبقة لـ MHA المُقنّع لهندسة الانتباه الخاصة بـ GLM-5: 64 رأسًا، ومرتبة KV بقيمة 512، وبُعد رأس QK بقيمة 192+64، وبُعد رأس V بقيمة 256 — أي تخطيط QK/V بمقاس 256/256، وفقًا لوصف طلب السحب. يعتمد هذا على تغيير في FlashAttention لدعم القناع لبُعد رأس 256، ويُثبّت FlashAttention مؤقتًا عند commit مشتق من fork (وهذا هو السبب في وسم Do Not Merge)، ويضيف عتبات توجيه مُقاسة للأداء للمسار الجديد: حدود FlashMLA للتعبئة المسبقة الخالصة عند 8K/20K/48K/112K رمزًا مع TP 1/2/4/8، وحدًا مقربًا عند 64K لـ FlashInfer عند TP8. ويشير المؤلف إلى أنه لا يوجد طلب سحب مفتوح آخر يغطي دعم MHA المُقنّع لـ GLM-5.
اقرأه على حقيقته: عملٌ تمهيدي في مكدس التقديم، وليس إعلانًا. لا يذكر الـPR اسم GLM 5.5 ولا GLM 5.3-Vision — بل يقول "GLM-5" — كما أن تفعيل مسار prefill لنمط masked-MHA لأبعاد رؤوس GLM-5 هو عمل بنية تحتية على عائلةٍ يعمل عليها النظام البيئي لـ vLLM أصلًا عبر مسار sparse-MLA (وسلالة GLM-5.3 نفسها تُقدَّم هناك اليوم). كما أنه ليس معزولًا: فقد غطّت PRs شقيقة هذا الشهر فحوصات أبعاد MLA في FlashInfer لـ GLM-5، ومسارًا احتياطيًا لـ sparse-MLA عبر Triton لنماذج من فئة GLM-5، ودعم الأبعاد المُبلَّغ عنه في FlashAttention. تفصيلان يُبقيانه على رادار متتبّع التسريبات. أولًا، الهندسة التي يستهدفها — 64 رأسًا، ورتبة KV بقيمة 512، وQK/V بمقاس 256/256 — مختلفة عن 192/128 في DeepSeek، وهذا هو التمييز نفسه — "ليست DeepSeek، بل تطابق GLM" — الذي ترسمه بصمة النموذج المجهول، وأصبح مرئيًا الآن على مستوى نواة الانتباه. ثانيًا، التوقيت: فُتح الـPR في 25 أغسطس، ضمن نافذة أغسطس نفسها التي كان GLM-5.5 متوقَّعًا فيها طوال الشهر. لا شيء من ذلك يُثبت أن النموذج المجهول هو GLM من الجيل التالي — فقد يكون هذا أيضًا هندسةً على النموذج الذي صدر فعلًا — لكنه النوع من النشاط الخلفي الذي تقوم به بيئة التقديم استباقًا لنموذجٍ ما، وهو قابل للتحقق بطريقةٍ لا تتوفر لأي منشور على X.
اسمان، وفرع واحد: GLM 5.3-Vision مقابل GLM 5.5
الهويتان المرشحتان هما منتجان مختلفان فعليًا، والتسريب لا يحسم أيّهما موجود على اللوحة.
• GLM 5.3-Vision سيكون نسخة قادرة على الرؤية من النموذج الذي صدر في 14 أغسطس. GLM-5.3 يدعم إدخال النص فقط — تصنفه Artificial Analysis كنص مدخل ونص مخرج، دون دعم للصور — وهذه الفجوة هي أبرز شكاوى المجتمع. عندما أجرى تانغ جيه من Z.ai حملة ملاحظات عالمية، جاءت التعليقات شبه مجمعة على ضرورة دعم الرؤية، وتمتلك Z.ai بالفعل المكوّنات الأساسية (نموذج GLM-5V-Turbo متعدد الوسائط ومشفر CogVLM) التي لم تدمجها بعد في خط إنتاجها الرئيسي. وسيكون إصدار 5.3-Vision أسرع طريقة لسد تلك الفجوة.
GLM 5.5 هو الرائد نفسه. تشير المواصفات المُبلغ عنها ولكن غير المؤكدة إلى قاعدة تتجاوز تريليون معامل (ارتفاعًا من 743B في GLM-5.3)، وسياق محمول يبلغ 1M رمزًا، وأوزان مفتوحة، وتركيزًا أكبر على الوكلاء والبرمجة. كل مذكرة محلل هذا الشهر تتعامل مع 5.5 على أنه الحدث الأكبر — المركبة التي ألمح المؤسس المشارك لـ Z.ai، تانغ جيه، إلى أنها ستغلق الفجوة مع النماذج المغلقة من فئة Fable. ومن المتوقع إصداره خلال أغسطس، ولم يُطرح بعد وقت كتابة هذا التقرير.
لا يمكن لنفس البصمة أن تخبرك أي من الاثنين هذا — فنسخة 5.3 المضبوطة للرؤية والرائد الجديد كلاهما قد يعملان على نفس حزمة الاستضافة. هذا الغموض هو الحالة الصادقة للإشارة، والاسمان في منشور المحلل يعكسان ذلك بدلاً من حله.
لوحة مقارنة من عمودين بعنوان "GLM 5.5 ضد GLM-5.3 — لوحة النتائج". العمود الأيسر GLM 5.5 (مسرّب): "مؤشر AA ~61 (متوقع، غير مؤكد)"، "الحالة: غير مُصدر"، "الحجم >1 تريليون معامل (شائع)"، "الرؤية: متوقعة"، "السياق: 1M (متوقع)"، "السعر: غير محدد". العمود الأيمن GLM-5.3 (مُطلق): "مؤشر AA 60"، "الحالة: API متاح في 19 أغسطس"، "الحجم 743B MoE / 40B نشط"، "الرؤية: نص فقط"، "السياق: 1M"، "السعر: $1.40 / $4.40". التذييل: "أرقام GLM 5.5 هي توقعات غير مؤكدة؛ GLM-5.3 وفقًا لـ Artificial Analysis."

ما الذي قد يعنيه تسجيل ~61 على مؤشر AA للذكاء
النتيجة المتوقعة هي الجزء الأكثر حدة في التسريب. مؤشر الذكاء الاصطناعي للتحليل (v4.1.1) يضع حاليًا GLM-5.3 عند 60 — متعادلاً مع Kimi K3 لأعلى نتيجة للأوزان المفتوحة، وبفارق 7 نقاط عن GLM-5.2 البالغة 53. وبفارق نقطة واحدة فوق ذلك، عند 61، ستكون منطقة GPT-5.6 Sol، مع Claude Fable 5 عند 62 وClaude Opus 5 عند 63. بعبارة واضحة: نموذج من عائلة GLM يسجل 61 سيكون أعلى نتيجة للأوزان المفتوحة على المؤشر، منفردًا فوق Kimi K3 وGLM-5.3، وعند خط الحدود المغلقة فعليًا.
يجدر التأكيد على ما ليس عليه الرقم 61. إنه توقع teortaxesTex لما ستعيده تقييمات مستقلة، وليس نتيجة منشورة من Artificial Analysis وليس رقمًا من جهة بائعة. يمكن أن يكون التوقع خاطئًا في أي من الاتجاهين — فقد يخسر البديل المرئي نقطة أو نقطتين في المؤشر المتمحور حول النصوص، وقد يسجل الإصدار الرئيسي الأكبر من 1T نتيجة أعلى أو أدنى اعتمادًا على كيفية أداء مرحلة ما بعد التدريب. قيمة الرقم تكمن في الادعاء الذي يحمله: مهما كان هذا النموذج المجهول، فمن المتوقع أن يتفوق على الرائد الحالي للأوزان المفتوحة لا أن يضاهيه فحسب.

ما هو المؤكد، وما هو غير المؤكد؟
أبقِ السجل نظيفًا، لأن القطعة المسرّبة تعيش أو تموت على ذلك.
مؤكد: GLM-5.3 حقيقي، تم شحنه في 14 أغسطس، وواجهة برمجة التطبيقات (API) متاحة في 18/19 أغسطس، وحصل على 60 في مؤشر AA للذكاء (تم قياسه بشكل مستقل بواسطة Artificial Analysis)، وسعره 1.40 دولار / 4.40 دولار لكل مليون رمز، إدخال نصي فقط، مع تأكيد الأوزان المفتوحة ليوم الجمعة 28 أغسطس. هذه الحقائق لا تعتمد على التسريب.
• تم التأكيد: لا يزال GLM-5.5 غير مُصدَر. حتى وقت كتابة هذا المقال، لا توجد بطاقة نموذج، ولا تسعيرة، ولا توفر؛ نافذة أغسطس ورقم المعاملات الذي يتجاوز تريليونًا واحدًا عبارة عن تقديرات محللين، وليست التزامات من Z.ai.
• غير مؤكد: أن النموذج المجهول موجود كمنتج منفصل، وأنه GLM، وأن اسمه سيكون GLM 5.3-Vision أو 5.5، وأنه يحصل على 61. تستند هذه الأمور الأربعة جميعها إلى منشور واحد غير مكرر لمحلل واحد.
• أيضًا غير مؤكد: ما إذا كان هذا النموذج المجهول متميزًا عن GLM-5.3 نفسه. نقطة نهاية GLM-5.3 الحية تحت اسم مستعار غير مُعلَّم ستنتج نفس بصمة التقديم. وإلى أن يظهر اسم أو بطاقة نموذج أو إصدار أوزان لحسم الأمر، فإن قراءة «نموذج جديد» هي الاحتمال الأقوى ولكنها ليست حقيقة.
ماذا تشاهد بعد ذلك
• الجمعة، 28 أغسطس — أوزان GLM-5.3. إذا كان النموذج المجهول في الحقيقة نسخة معاد تسميتها من 5.3 أو 5.3-Vision، فإن إصدار الأوزان وبطاقة النموذج سيحسمان الأمر بسرعة.
• رصد ثانٍ مؤكِّد. بصمة محلّل واحد هي فرضية؛ أما قراءة مستقلة ثانية لنفس المدخلة المجهولة، أو إدراج في Artificial Analysis يسمّيها، فيرفعها إلى مستوى الدليل.
• أي بيان من Z.ai. تم الإبلاغ عن GLM-5.5 لنافذة أغسطس، ويوشك الشهر على الانتهاء. إن التسمية الرسمية، أو صفحة التسعير، أو إدخال سجل تغييرات API هو الحدث الذي يحول هذا التسريب إلى قصة إطلاق.
• ما إذا كانت درجة AA تتحقق عند 61. إذا كان النموذج المجهول حقيقيًا ومن عائلة GLM، فإن نتيجة مؤشر مستقل قريبة من 61 ستكون أول رقم بأوزان مفتوحة يتجاوز 60.
• ما إذا كان عمل الانتباه في vLLM سيحصل على اسم نموذج مُرفق. يستهدف PR #53785 أبعاد رأس "GLM-5" دون تسمية 5.3-Vision أو 5.5؛ إن دمجًا، أو إدخالًا في النماذج المدعومة، أو بطاقة نموذج تزاوج تلك الهندسة مع اسم محدد سيكون أقوى إشارة حتى الآن.
كيف تتعامل مع تسريب كهذا؟
التسريب سبب للاستعداد، وليس لإعادة بناء المنصة. إذا وصل نموذج عائلة GLM القادم إلى قمة لوحة صدارة الأوزان المفتوحة أو اقترب منها، فإن السؤال العملي هو ما إذا كان ينبغي توجيه حركة مرور حقيقية إليه — والنموذج غير المثبت، مع ادعاءات البائع وتوقع محلل واحد، هو بالضبط الحالة التي تحتاج فيها إلى شبكة أمان بدلاً من رهان. نموذج GLM-5.3 الذي صدر الأسبوع الماضي أصبح متاحًا بالفعل على OrcaRouter — تعرض صفحة النموذج سعر $1.26 / $3.96 لكل مليون رمز، بخصم إطلاق 10% عن سعر البائع المعلن البالغ $1.40 / $4.40، ويمرّره بدون أي هامش ربح — وهذا الإعداد للتوجيه هو ما سيرثه نموذج 5.5 أو 5.3-Vision يوم صدوره. وجّه جزءًا من حركة المرور إلى النموذج الجديد عبر الموجّه مع تجاوز تلقائي إلى نموذج مثبت — GLM-5.3 أو DeepSeek V4 Pro أو GPT-5.6 Sol — وستحصل على إشارة جودة على عبء العمل الخاص بك بدلاً من عرض شرائح. إذا كان توقع التسريب صحيحًا، ستكون أول من يعلم؛ وإذا كان خاطئًا، يمتص التجاوز التلقائي الخطأ ولا يُطرح أي شيء معطوب. نفس المفتاح، لا عقد ثانٍ، ولا حاجة للاختيار بين الاسمين المرشحين حتى تفعل Z.ai.
نموذج GLM القادم قادم — السؤال الوحيد المفتوح هو أي اسم سيحمل. سيكون GLM 5.3-Vision بمثابة إغلاق Z.ai للفجوة الأكثر شكوى حول النموذج الذي أطلقته للتو؛ بينما سيكون GLM 5.5 هو الرائد الذي يضم تريليون معامل، وهو ما كان الشهر بأكمله يشير إليه. الإدخال المجهول teortaxesTex الذي تم بصمته في 20 أغسطس هو أول كائن ملموس يشبه أياً منهما، وتوقعه بدرجة 61 على مؤشر AA Intelligence Index سيجعله يتقدم على كل نموذج مفتوح الأوزان موجود حاليًا على اللوحة. بعد خمسة أيام على البصمة، تحركت حزمة الخدمة أيضًا: عمل الانتباه GLM-5 في vLLM هو بالضبط نوع الأساس الذي يتركه نموذج جديد خلفه، حتى وإن لم يسمِّ أي نسخة. لا شيء من ذلك مؤكد، وستُحدَّث هذه الصفحة فور أن يُحسم الاسم أو البطاقة أو الأوزان. وحتى ذلك الحين، الخطوة منخفضة المخاطرة هي تجهيز التوجيه — لا المراهنة على الحزمة بناءً على بصمة.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
