
Ox Alpha: ورقة المواصفات الكاملة لنموذج Stealth الذي يُطرح الآن باسم GLM-5.3-Flash
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 316 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 196 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
أوكس ألفا هو الاسم المجهول الذي GLM-5.3-Flash تمت معاينته تحت، وتم الكشف عنه في 26 أغسطس 2026، وهو ليس نموذجًا يمكنك استدعاؤه اليوم. قائمة المعاينة التي حملت اسم أوكس ألفا لم تعد تخدمه؛ النموذج الذي تحته لديه صفحة بائع، وأوزان مرخصة بموجب MIT، وبطاقة أسعار منشورة، وواجهة API موثقة، وكلها تابعة لـ Z.ai. هذه الصفحة هي المرجع لذلك النموذج — الغلاف، والوسائط، وبطاقة الأسعار، وواجهة نقاط النهاية، وكل رقم قياسي منشور مع المراجعة أو أداة التقييم المرتبطة به، ولأن الاسم المستعار لا يزال يعطي نتيجة بحث ضئيلة ومربكة، بيان واضح لما لم يتم توثيقه في أي مكان. كل ما ورد أدناه تمت قراءته في 28 سبتمبر 2026 من وثائق نموذج Z.ai وصفحة الأسعار الخاصة به، ومن بطاقة نموذج Z.ai على Hugging Face، ومن Artificial Analysis، ومن كتالوجنا الخاص؛ الأرقام التي ينشرها البائع والأرقام التي يقيسها طرف مستقل يتم تصنيفها بشكل منفصل، ولا شيء هنا مستنتج من التشابه.
إلى ماذا يشير اسم Ox Alpha اليوم؟
الاسم المستعار سُحب، والمورّد هو من سحبه. تقول وثائق Z.ai الخاصة بـ GLM-5.3-Flash إن النموذج اختُبر مجهولًا تحت اسم ox-alpha قبل الإصدار، لجمع ملاحظات المستخدمين، وإن التجربة المجهولة أصبحت النموذج الأكثر شعبية في ذلك الأسبوع. المعالم الزمنية القابلة للتأريخ قصيرة ومحددة: أظهر الإدراج الخفي أن Ox Alpha صدر في 20 أغسطس 2026، وحلّ الكشف في 26 أغسطس — وهو التاريخ نفسه الذي تحمله صفحة وثائق Z.ai، وتاريخ الإصدار نفسه الذي يسجله كتالوجنا الخاص لـ z-ai/glm-5.3-flash.
يترتب على ذلك أمران، وكلاهما يهم القارئ الذي بحث عن الاسم.
• الاسم المستعار ليس مسارًا. يُرجع فهرسنا «model not found» عند البحث عن stealth/ox-alpha، وفق قراءة بتاريخ 2026-09-28. لا يوجد شيء يمكن استدعاؤه تحت هذا الاسم، لأن منتج المورّد يحمل اسم المورّد.
• لا يوجد أيضًا مستودع أوزان مملوك للمورّد تحت هذا الاسم المستعار. البحث في Hugging Face عن ox-alpha يعيد عمليات رفع من المجتمع أُنشئت خلال نافذة التخفي في أواخر أغسطس 2026، إضافة إلى مستودع يحتوي على بطاقة فقط من 27 سبتمبر 2026 لا يحمل أي أوزان ويشير إلى الإصدار الرسمي لـ Z.ai. اسم المستودع مجرد تسمية اختارها من رفعه؛ وليس توثيقًا لأي شيء. وتنشر مؤسسة Z.ai نفسها النموذج باسم zai-org/GLM-5.3-Flash، مع إنشاء المستودع في 2026-08-25 بتوقيت UTC.
سؤال المزوّد الذي هيمن على الأسبوع المجهول قد أُغلق، وأُغلق بالطريقة المعتادة: تقدّم مختبر ووضع اسمه على النموذج. وما تبقّى هو مواصفة، وهي ما تتناوله هذه الصفحة. أما قصة الاكتشاف — البصمات التي سبقت الكشف، وسلالة النماذج المجهولة التي ينتمي إليها، والإفصاح عن عتاد الخدمة الذي صاحبها — فهي في مقالتنا السابقة عن تحقيق Ox Alpha، وهذه الصفحة لا تعيد مناقشة أيٍّ من ذلك.
المغلّف، كما يوثّقه المورّد

هذه أرقام مُبلَّغ عنها من Z.ai، مأخوذة من صفحة التوثيق الخاصة بالمورّد بتاريخ 2026-09-28، وثلاثة من أبعاد الغلاف الأربعة مصادَق عليها بشكل مستقل — فسجل نموذج Artificial Analysis يحمل الإجمالي نفسه البالغ 320B، و18B نشطًا، وسياقًا من 1,000,000 رمز، ورخصة MIT، كما تحمل بطاقة الكتالوج الخاصة بنا حدود السياق والإخراج.
• نافذة السياق — 1,000,000 رمز (توثيق Z.ai؛ Artificial Analysis؛ بطاقة الكتالوج الخاصة بنا، التي تُدرج 1,000,000)
• الحد الأقصى للإخراج — 128 ألف رمز (توثيق Z.ai)؛ بطاقتنا تسجّل 128,000
• المدخلات — نص وصورة وفيديو وملف (توثيق Z.ai، تاريخ القراءة 2026-09-28)؛ تسرد بطاقتنا النص والصورة والفيديو، ولا تدّعي وجود إدخال للملفات
• الإخراج — نص فقط، على كل مصدر
• المعلمات — 320B إجمالًا مع تفعيل 18B لكل رمز (وثائق Z.ai وبطاقة النموذج؛ يسجّل Artificial Analysis بشكل مستقل 320B و18B)
• الرخصة — MIT، مع نشر الأوزان على Hugging Face (بطاقة النموذج الخاصة بالمورّد؛ تصنّف Artificial Analysis النموذج كأوزان مفتوحة بموجب رخصة متساهلة)
• البنية المعمارية — مزيج هجين من الانتباه المتناثر والانتباه الخطي، وهو ما تصفه Z.ai بأنه أول نموذج رائد مفتوح المصدر يجمع بين الاثنين، مما يقلل حساب الانتباه بمقدار 3.01× وذاكرة KV المؤقتة بمقدار 4.44× مقارنةً بـ GLM-5.3، إضافة إلى خطوة IndexPool التي تضغط أربعة متجهات مفاتيح للمفهرس في متجه واحد عند السياق الطويل، وManifold-Constrained Hyper-Connections لتحقيق كفاءة التوسّع. كل هذا مذكور من الجهة المورّدة؛ ولا يوجد تدقيق معماري مستقل يمكن الاستشهاد به.
• التدريب المسبق — مجموعة بيانات متعددة الوسائط بحجم 30 تريليون رمز (بحسب ما ذكرته Z.ai). لا ينشر المورّد أي رقم إجمالي لحوسبة التدريب ولا أي تفصيل للمعاملات حسب الطبقة يتجاوز عنوان 320B/18B الرئيسي.
أحد ادعاءات الغلاف قد تقلّص منذ الإطلاق، والوثائق الحالية هي التي ينبغي الاقتباس منها. الإفصاح عن عتاد تقديم الخدمة الذي انتشر في أغسطس قدّر قدرة الأسبوع المجهول بنحو 100,000 شريحة صينية محلية. وثائق Z.ai كما تُقرأ اليوم تقول إن النموذج قُدّم عبر عشرات الآلاف من المسرّعات المطوّرة محليًا، مع تحسّن في تقديم الخدمة من البداية إلى النهاية بمعامل 3× مقارنة بخط الأساس الخاص بالمورّد على العتاد نفسه، وتكلفة لكل رمز يصفها المورّد بأنها مماثلة لوحدات معالجة الرسومات NVIDIA السائدة. عشرات الآلاف هو ما تقوله الصفحة الآن؛ والرقم الأكبر هو رقم حقبة الإطلاق. كلاهما ادعاءان من الشركة، ولم يخضع أي منهما لتدقيق مستقل، واتجاه المراجعة نحو الانخفاض.
بطاقة الأسعار، ولماذا الرقم المُقدَّم هو الرقم الذي يهم
تسرد صفحة الأسعار الخاصة بـ Z.ai سعر GLM-5.3-Flash عند 0.15 دولار لكل مليون رمز إدخال، و0.03 دولار لكل مليون رمز إدخال مخزَّن مؤقتًا، و0.50 دولار لكل مليون رمز إخراج، فيما تأتي الفئة الشقيقة FlashX عند 0.37 / 0.075 / 1.25. هذا هو سعر القائمة لدى المورّد، مقروءًا من صفحة المورّد نفسه بتاريخ 2026-09-28.
السعر المطبَّق فعليًا على مسارنا اليوم أقل، وهذه هي النقطة العملية في هذا القسم. بحسب ما ورد في 2026-09-28، تسعّر بطاقة OrcaRouter الخاصة بـ z-ai/glm-5.3-flash المدخلات عند $0.075 لكل مليون رمز، والمخرجات عند $0.25 لكل مليون وقراءات الذاكرة المؤقتة عند $0.0173 لكل مليون. وهذا نصف السعر المدرج لدى البائع، على النموذج نفسه، في اليوم نفسه — الرقم المخفَّض وليس السعر الرئيسي، دون أي وسم ترويجي على البطاقة. لقد لاحظت تغطيتنا السابقة لهذا النموذج الفجوة نفسها بعد إغلاق النافذة الترويجية المعلنة؛ ولا تزال الملاحظة صحيحة اليوم، وما زلنا عاجزين عن تحديد السبب، لذا نُبلغ عن الرقم المطبَّق ونترك السبب مفتوحًا.
المدخل المُخزَّن مؤقتًا هو محل الاختلاف الواضح بين المصادر الثلاثة، وهو تذكير مفيد بأن "$0.03" في جدول ليست بالضرورة سعرًا يدفعه أي شخص. تقول صفحة المورّد إن $0.03 لكل مليون من رموز الإدخال المخزنة مؤقتًا؛ ويحمل سجل نموذج Artificial Analysis سعر إصابة الذاكرة المؤقتة البالغ $0.026؛ ويقدّم مسارنا قراءات الذاكرة المؤقتة بسعر $0.0173. قُرئت الثلاثة جميعها في أو قبل 2026-09-28 بقليل، وجميعها مُبلَّغ عنها من المورّد أو المنصة. نحن نذكر رقم المورّد المدرج على أنه الرقم المدرج، والرقم المقدَّم على أنه ما يُحاسَب عليه المتصل فعليًا.
أجرِ الحسابات على مهمة وكيل نموذجية — 100,000 رمز إدخال و10,000 رمز إخراج، مع عدم تسجيل أي إصابات في ذاكرة التخزين المؤقت:
• بسعر قائمة المورّد — 100,000 توكن × 0.15 دولار/1 مليون = 0.015 دولار، بالإضافة إلى 10,000 × 0.50 دولار/1 مليون = 0.005 دولار، إذن 0.020 دولار لكل استدعاء
• بالسعر الذي يقدّمه مسارنا اليوم — 0.0075 دولار زائد 0.0025 دولار، أي 0.010 دولار لكل مكالمة، أي نصف بالضبط
هذا هو السبب الكامل للتحقق من السعر المُقدَّم بدلًا من السعر المعلن قبل تحديد حجم عبء العمل: في وكيل طويل المدى يشغّل آلاف الاستدعاءات يوميًا، الفرق بين هذين الرقمين هو الفرق بين ميزانيتين. يمرّر OrcaRouter سعر المزوّد المعلن كما هو دون أي هامش ربح بنسبة 0%، ولهذا يظهر الخصم الذي يقدّمه المورّد على بطاقة أسعارنا بدلًا من أن يُمتص في مكان ما في المنتصف.
الوسائط وسطح نقطة النهاية
توثّق الجهة الموردة شكل واجهة واحدًا ورمزَي نموذج: glm-5.3-flash و glm-5.3-flashx، وكلاهما يُقدَّم عبر واجهة Chat Completion API. تُدرَج الصور ككتلة محتوى من النوع image_url في مصفوفة محتوى الرسالة، سواء عبر رابط URL — وهو ما توصي به الجهة الموردة — أو رابط بيانات base64، ويمكن إرسال عدة كتل صور في رسالة واحدة. البث مدعوم، وتوصي Z.ai بتمكين stream و tool_stream معًا لطلبات البث. استدعاء الأدوات والتخزين المؤقت للسياق وإخراج JSON المنظم كلها قدرات موثّقة؛ التفكير مدعوم لكنه، كما يوضح القسم التالي، ليس اختياريًا.
FlashX هو طبقة خدمة منفصلة للنموذج نفسه وليس قدرة منفصلة: توثّقه Z.ai بسرعة 200 رمز في الثانية، وتذكر أنه ليس متاحًا بعد على خطة GLM Coding Plan. وهي ليست الطبقة التي يتضمنها كتالوجنا، وليست ما تصفه الأرقام الواردة في هذه الصفحة.
في مسارنا، سطح نقاط النهاية أضيق ويجدر ذكره بدقة. تعرض بطاقة z-ai/glm-5.3-flash نقطة النهاية POST /v1/chat/completions — إكمالات الدردشة فقط، دون نقطة نهاية بروتوكول ثانية — وتقبل المعاملات reasoning، وreasoning_effort، وinclude_reasoning، وtools، وtool_choice، وresponse_format، وstream، وtemperature، وtop_p، وmax_tokens، وstop. شارات القدرات على البطاقة هي الرؤية، والأدوات، وJSON، والاستدلال. السياق 1,000,000 توكن، والحد الأقصى للإخراج 128,000، بما يطابق وثائق المورّد.
الجهد والتفكير: الإعدادات التي تثبّت كل رقم في نتائج القياس
هذا هو الجزء من المواصفات الذي يُحدث أكبر تغيير في طريقة قراءتك للنتائج، ويوثّقه المورّد بدقة. يأخذ GLM-5.3-Flash reasoning_effort كمعامل بثلاثة مستويات — low وhigh وmax — ويُضبط افتراضيًا على max إذا لم تمرّر شيئًا، أو إذا مرّرت أي قيمة ليست low أو high. لا يمكن إيقاف التفكير: ينص المورّد على أن thinking.type يدعم enabled فقط. يُضبط العلم clear_thinking في قالب الدردشة افتراضيًا على false، وتوصي Z.ai بتمريره صراحةً كـ true في سيناريوهات الدردشة. إعدادات أخذ العينات الموصى بها من المورّد هي temperature 1 وtop_p 0.95، ويقول صراحةً إن إعادة إنتاج المعايير ولوحات الصدارة ينبغي أن تُبقي على الإعداد الافتراضي max effort.
اقرأ هاتين الحقيقتين معًا، وستكون النتيجة بالنسبة لأي شخص يقارن الأرقام حتمية: النتيجة المقتبسة دون مستوى جهد ليست قياسًا كاملًا، لأن إعدادات low و high و max تمثل نقاط تشغيل مختلفة للنموذج نفسه، والإعداد الافتراضي هو الأكثر تكلفة بين الثلاثة. تعرض بطاقتنا reasoning و reasoning_effort ضمن معاملاتها المدعومة، لذا فإن هذا الإعداد يمكن الوصول إليه عبر المسار، وليس عبر المورّد فقط.
ورقة المعيار، مع المراجعة المرفقة.
تنشر Z.ai جدول معايير لـ GLM-5.3-Flash، وهو بالكامل مبلَّغ من الجهة المورّدة — السجل المستقل لـ Artificial Analysis لا يعيد إنتاج هذه الصفوف. أرقام الجهة المورّدة الرئيسية في البرمجة والعوامل هي DeepSWE v1.1 عند 63.4 مقابل 46.2 لـ GLM-5.2، و AutomationBench v1.0.6 عند 48.8 مقابل 26.2 لـ GLM-5.2. بقية الجدول، كما يحملها كتالوجنا الخاص مع Z.ai كمصدر مسمّى: Humanity's Last Exam مع الأدوات 55.3، Agents' Last Exam 26.3، NL2Repo 56.3، Chartography مع الأدوات 78، CharXiv reasoning مع الأدوات 89.4، وعلى جانب الرؤية MMVU 80.5، و MVBench 77.8، و BabyVision 53.4.
صفّان من صفوف الموردين يستحقان أن تُنقل حواشيهما إلى الجملة، لأنهما الأكثر ترجيحًا أن يقتبسهما القارئ بدونها. التقييم البرمجي الداخلي لـ Z.ai، Z.ai Code Bench v1.0، يضع GLM-5.3-Flash عند 29.0 بأقصى جهد مقابل Claude Opus 4.8 عند 29.5 — شبه تعادل على منصة الاختبار الخاصة بالمورد، التي تعمل على Claude Code 2.1.207، وفقًا لما أبلغ عنه المورد. هذه ليست مقارنة مستقلة وليست مقارنة بجهد متطابق أجراها طرف ثالث؛ بل هي Z.ai تقيّم نموذجها مقابل منافس على تقييمها الخاص. ويستشهد المورد بمؤشر Artificial Analysis Intelligence Index بقيمة 57 بتكلفة 0.045 دولار لكل مهمة، مع تسمية المراجعة بـ v4.1.1.
ذلك الرقم الأخير يحتاج إلى فصله عمّا تنشره Artificial Analysis اليوم، لأن الاثنين لا يمكن وضعهما جنبًا إلى جنب كحركة واحدة. فصفحة Artificial Analysis الخاصة بـ GLM-5.3-Flash، المقروءة في 2026-09-28، تُبلّغ عن مؤشر الذكاء Intelligence Index بقيمة 41.8 على الإصدار v4.3.2، مسجَّلة عند أقصى جهد. ويتضمّن الإصدار v4.3.2 عشر تقييمات — AA-Briefcase v1.1، وGDPval-AA v2.1، وAutomationBench-AA، وTerminal-Bench 4.0، وSciCode، وHumanity's Last Exam، وGDP.pdf، وCritPt، وAA-Omniscience، وAA-LCR v1.1 — بينما لم يتضمّنها الإصدار v4.1.1. مراجعتان للمؤشر، ومجموعتان من المهام، ورقمان. لا أحدهما خاطئ؛ فهما ليسا القياس ذاته، واقتباس الرقم 57 إلى جانب 41.8 وكأن النموذج قد تحرّك سيكون خطأً في كلا الاتجاهين.
ما يؤكده السجل المستقل فعلاً هو الإطار العام وليس الدرجات: يسجّل Artificial Analysis بشكل مستقل 320 مليار معامل إجمالي، و18 مليار معامل مُنشَّط، ونافذة سياق تبلغ 1,000,000 رمز، وترخيص MIT، وأوزانًا مفتوحة، وتاريخ إصدار 2026-08-26، ويسرد تسعير المورّد بواقع 0.15 دولار للإدخال و0.50 دولار للإخراج لكل مليون رمز، مع سعر إصابة ذاكرة التخزين المؤقت البالغ 0.026 دولار. وحين ينشر المورّد درجة ولا ينشرها الطرف المستقل، نذكر ذلك؛ وحين يؤكد الطرف المستقل مواصفة، فتلك أقوى فئة من الحقائق في هذه الصفحة.
لا توجد هنا مواجهة مباشرة متكافئة، وقول ذلك أنفع من إنتاج واحدة. لم ينشر أحد اختبارًا لـ GLM-5.3-Flash مقابل Claude Opus 4.8 أو GPT-6 Sol أو Grok 4.7 عند مستوى جهد معلن على أداة اختبار مشتركة — فمقارنة Z.ai نفسها تجري على منصتها الخاصة، وبأقصى جهد، مقابل الإعداد الافتراضي لمنافس. وإلى أن يتغير ذلك، فإن المقارنة الصادقة بين هذا الطراز وأي شيء آخر تكون على السعر والغلاف وسطح نقاط النهاية، وهي الأمور الثلاثة في هذه الصفحة التي يمكن للجميع قراءتها من الأرقام نفسها.
ما لم يُوثَّق، مذكورًا بوضوح
صفحة مرجعية لنموذج ذي سطح معلوماتي محدود لا تكون مفيدة إلا إذا كانت صادقة بشأن الفجوات، وهذه الصفحة بها عدة فجوات.
• لا يوجد حد معرفة معلن من المورّد. لا يذكر توثيق Z.ai ولا بطاقة نموذج Hugging Face أي حد كذلك، كما يترك سجل Artificial Analysis هذا الحقل بلا قيمة. التقديرات المستمدة من نافذة التخفي هي جهد مجتمعي، وليست رقمًا من المورّد، وهذه الصفحة لا تكرّر أيًا منها كما لو كان رقمًا كذلك.
• لا توجد حواشي أداة الاختبار لمعظم ورقة القياس. تحمل بطاقة النموذج حواشي لتشغيل HLE مع الأدوات — درجة الحرارة 1.0، top_p 0.95، وطول توليد أقصى يبلغ 163,840 رمزًا، وتقييم حتى سياق 300,000 رمز مع استراتيجية لإدارة السياق، وGPT-5.6 Luna بجهد متوسط كنموذج الحكم — وكذلك لـ NL2Repo وDeepSWE، اللذين تقول الشركة المصنعة إنهما شُغِّلا باستخدام أداة mini-swe-agent. الصفوف المتبقية هي نسب مئوية مجردة بدون أي أداة أو جهد مرفق.
• لا يوجد تفسير لتباين سعر الإدخال المخزَّن مؤقتًا. ثلاثة أرقام للكمية نفسها على النموذج نفسه، ولا يذكر أي مصدر سبب اختلافها.
• لا يوجد قياس أداء مستقل لفترة التقديم المجهولة. القائمة المتخفية اختفت؛ وأي شيء قاسته لا يمكن قياسه مرة أخرى، ولم ينشر أي طرف ثالث اختبارًا على الاسم المستعار أثناء نشاطه.
• لا توجد مقارنة من طرف ثالث بجهد مماثل، للسبب المذكور أعلاه.
• لا يوجد تأكيد من المورّد على عدد الشرائح في حقبة الإطلاق. تقول الوثائق إن هناك عشرات الآلاف من المسرّعات المحلية؛ ولا يظهر رقم الـ100,000 في الصفحة.
نقولها بوضوح: ما يقدّمه كتالوجنا، تم التحقق منه اليوم

النموذج الذي يقف خلف Ox Alpha متاح في كتالوجنا باسمه الخاص، وقد جرى التحقق منه اليوم بدلًا من افتراضه. أدت قراءة واجهة برمجة تطبيقات نموذج OrcaRouter الخاصة بـ z-ai/glm-5.3-flash في 2026-09-28 إلى إعادة البطاقة كاملةً: سياق من 1,000,000 رمز، و128,000 كحد أقصى للمخرجات، وإدخال نص وصورة وفيديو مع إخراج نصي، وشارات القدرات: الرؤية، والأدوات، وJSON، والاستدلال، وتاريخ إصدار 2026-08-26، غير مهمَل وغير محذوف من القائمة، بسعر 0.075 دولار لكل مليون رمز إدخال، و0.25 دولار لكل مليون رمز إخراج، و0.0173 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، عبر نقطة النهاية الواحدة POST /v1/chat/completions.
تشير قراءة قياسنا الخاص في ساحة التجربة لمدة سبعة أيام على تلك البطاقة، لنفس الفترة، إلى 61.8 رمز إخراج في الثانية، وزمن أول رمز عند المئين 50 يبلغ 7.39 ثانية، ومعدل خطأ 1.47%. هذه أرقام خاصة بنا عن خدمتنا، وليست أرقام مورّدين ولا اختبارات معيارية مستقلة، وهي أرقام السرعة الوحيدة في هذه الصفحة لهذا السبب.
الاسم المستعار نفسه ليس على المسار. إذا وصلت إلى هنا بعد البحث عن Ox Alpha، فالنموذج الذي يجب استدعاؤه هو z-ai/glm-5.3-flash، وشكل الطلب هو ذاك الموصوف أعلاه. وهو يقع على المفتاح نفسه الذي يقع عليه كل شيء آخر في الكتالوج — واجهة برمجية واحدة عبر أكثر من 200 نموذج، وسعر المزوّد يمرّ كما هو دون أي هامش يُضاف فوقه، وتحويل تلقائي عند تعطّل أي مزوّد، بحيث لا يلزم أن يكون النموذج الذي تجرّبه هو النموذج الذي يعتمد عليه مسار الإنتاج لديك.

توضيح واحد حول ماهية هذه الصفحة، لأن القارئ الذي يصل إليها من اسم النموذج نفسه يستحق ذلك. هذه صفحة مرجعية لنموذج موجود بالفعل في الكتالوج، وليست تقرير إطلاق: يعود GLM-5.3-Flash إلى 26 أغسطس 2026، ومكانه هنا يستند إلى أن اسم Ox Alpha لا يزال يُبحث عنه دون وجود صفحة مخصصة يصل إليها، لا إلى حداثة الإصدار. التاريخ أعلاه يُستخدم لتأريخ النموذج، لا كخبر. ما قد يغيّر هذه الصفحة هو أحد أربعة أمور — إجراء مستقل لمعيار قياس بجهد معلن، أو تاريخ قطع معرفي معلن من المورّد، أو تغيّر في السعر المُقدَّم، أو قرار من Z.ai بالإفصاح عن العدد الفعلي للرقائق في حقبة الإطلاق. وإلى أن يتحقق أحد تلك الأمور، فإن المواصفات أعلاه هي كل ما يوثّقه المورّد، والفجوات المدرجة في القسم السابق جزء من الإجابة بقدر ما هي الأرقام.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
