
GLM 5.3 Prime: نفس أوزان GLM-5.3، بضعف سعر القائمة تمامًا
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 177 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1323 tok/s
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
تبلغ تكلفة GLM 5.3 Prime 2.80 دولار لكل مليون رمز إدخال و8.80 دولار لكل مليون رمز إخراج. أما GLM-5.3، النموذج الذي يعمل عليه، فتبلغ تكلفته 1.40 و4.40 دولار. هذا ليس فرقًا في التقريب ولا فارقًا ترويجيًا — بل هو بالضبط 2.0× على كلا السطرين، وهو الشيء الوحيد الذي يختلف عليه المنتجان. GLM 5.3 Prime ليس نموذجًا جديدًا. فهو يحمل أوزان GLM-5.3 نفسها، تلك التي أتاحتها Z.ai في 25 أغسطس 2026، خلف حزمة تقديم أسرع. وقد أُعلن عن GLM-5.3 نفسه في 14 أغسطس 2026 ووصل إلى API في 18 أغسطس. لم يتغير أي شيء في النموذج الأساسي عندما ظهر معرّف Prime في أواخر سبتمبر. ما تغيّر هو أن أحدهم وضع عليه بطاقة سعر ثانية.
إذا كنت تقرأ هذا لأن قائمة نماذج أظهرت لك اسمًا غير مألوف بجانب اسم مألوف، فالجواب المختصر هو: أنت تنظر إلى طبقة خدمة، وليس إصدارًا. أما الجواب الأطول فيستحق دقيقتين، لأن الحساب نظيف بشكل غير معتاد والمصدر غامض بشكل غير معتاد.
ما هي فئة "Prime"، في فقرة واحدة
طبقة التقديم هي معرّف منتج ثانٍ موجّه إلى نفس الأوزان، مضبوط لتحقيق الإنتاجية بدلاً من التكلفة. لا تحصل على نموذج أكبر، أو سياق أطول، أو وضع استدلال أفضل، أو سطح أدوات أوسع. تحصل على الرموز تخرج بشكل أسرع، وتدفع مقابل هذا الامتياز على كل رمز بدلاً من الوقت الفعلي الذي وفرته. هذه المقايضة حقيقية وأحيانًا صحيحة — حلقة وكيل متعددة الخطوات تقوم بعشر استدعاءات متسلسلة تستفيد حقًا من عودة كل استدعاء بشكل أسرع — لكنه شراء زمن انتقال، وليس شراء قدرة، ويجب تسعيره على هذا الأساس.
يذكر وصف البائع لـ GLM 5.3 Prime الجزء المسكوت عنه مباشرةً: إنه «النسخة عالية السرعة من GLM-5.3 من Z.ai، ترث كامل قدراته بينما تقدّم إنتاجية إخراج تبلغ 1.5–2× عبر تسريع الاستدلال». قدرات كاملة. نافذة السياق نفسها البالغة 1,000,000 رمز. سقف الإخراج نفسه البالغ 131,072 رمزًا. نص يدخل، نص يخرج. الاستدلال إلزامي، مع منخفض، مرتفع و أقصى مستويات الجهد و أقصى كإعداد افتراضي — مطابق للنموذج الأساسي.
بطاقة الأسعار، جنبًا إلى جنب
• المُدخل — GLM 5.3 Prime بسعر $2.80 لكل مليون مقابل GLM-5.3 بسعر $1.40 لكل مليون
• المُخرج — GLM 5.3 Prime بسعر $8.80 لكل مليون مقابل GLM-5.3 بسعر $4.40 لكل مليون
• المُدخل المُخزَّن مؤقتًا — GLM 5.3 Prime بسعر $0.56 لكل مليون مقابل GLM-5.3 بسعر $0.26 لكل مليون
• المُضاعِف — 2.0× على الأسطر الثلاثة جميعها، في كلا الاتجاهين
• السياق — 1,000,000 رمز على كليهما
• الحد الأقصى للمُخرج — 131,072 رمزًا على كليهما
• الاستدلال — إلزامي على كليهما، بمستويات الجهد الثلاثة نفسها، وبالقيمة الافتراضية نفسها
بند التخزين المؤقت هو البند الذي يغفل عنه الناس. قراءة التخزين المؤقت هي أرخص رمز ستشتريه على الإطلاق من نموذج رائد، وهي حيث تنفق أحمال عمل الوكلاء ميزانيتها فعليًا — إذ يُعاد قراءة موجّه النظام، وتعريفات الأدوات، وسجل المحادثة المتنامي في كل دور. مضاعفة سعر التخزين المؤقت تضاعف أكبر بند في جلسة وكيل طويلة، وهذا يعني أن العلاوة الفعلية على حمل عمل حقيقي أقرب إلى 2× مما توحي به الفجوة المعلنة في رموز الإدخال الجديدة. إذا كنت تأمل أن يكون المسار السريع أرخص عمليًا لأنك تستخدم التخزين المؤقت بكثافة، فهو ليس كذلك.
من الذي يبيعه فعليًا؟
هنا يصبح الإدراج مثيرًا للاهتمام، وهنا ينبغي للقارئ المتأني أن يُبطئ من وتيرته. لا تُدرج وثائق Z.ai الخاصة، ولا نظرة عامة نماذجها، ولا صفحة التسعير المنشورة لديها، أي SKU باسم Prime. ابحث في معرّفات نماذج المورّد عن glm-5.3-prime فلن تجد شيئًا. فئة السرعة الخاصة بـ Z.ai هي منتج مختلف على خط مختلف بالكامل — GLM-5.3-FlashX، الذي يقع ضمن عائلة Flash الأرخص، وقد أُطلق في 18 سبتمبر 2026، ويُسعّر بـ 0.37 دولار و1.25 دولار لكل مليون توكن.
إذن، Prime هو منتج منصّي مبني على أوزان Z.ai. وهناك تفصيلان يشيران إلى منصة مَن. الأول هو صياغة «إنتاجية المخرجات 1.5–2×»، وهي نفس الصياغة التي يستخدمها مزود سحابي كبير لوضع الخدمة المعجّل الخاص به — وضع تمكّنه عبر تبديل معرّف النموذج، مع بقاء الإمكانات وحدود الاستخدام دون تغيير صراحةً. والثاني هو أن القائمة تذكر مزودًا واحدًا فقط في المنبع خلف نقطة النهاية. وجود مزود واحد خلف SKU من الفئة السريعة ليس هو الكيفية التي يُقدَّم بها نموذج مفتوح الأوزان؛ بل هو كيف يبدو النشر المعجّل الخاص بالمنصة من الخارج.
لا شيء من ذلك يجعل GLM 5.3 Prime منتجًا سيئًا. إنه يجعله منتجًا بمورّد واحد، وهي مسألة مرونة ينبغي أن تسأل عنها قبل أن توجّه حركة الإنتاج عبره.
ما قيمة ادعاء السرعة

رقم 1.5–2× هو ادعاء بشأن الإنتاجية مقيس في ظل ظروف المورّد نفسه، والإنتاجية هي المقياس الأكثر حساسية لتلك الظروف. عدد رموز الإخراج في الثانية على ذاكرة تخزين مؤقت دافئة مع موجّه قصير وعنقود خامل ليس الرقم الذي يراه وكيل سياق طويل. القياس المستقل للنموذج الأساسي يضع GLM-5.3 عند نحو 61 رمز إخراج في الثانية وGLM-5.3-Flash عند حوالي 46، على مجموعة يبلغ فيها متوسط الفئة 67 — لذا فإن المسار الأرخص هو أيضًا الأبطأ، وهو عكس ما توحي به الأسماء. هذه وسائط عبر مجموعة تقييم موحّدة، وليست قيمًا ذروية.
هناك أيضًا تكلفة أكثر خفاءً. الإعداد الافتراضي لجهد الاستدلال على كلا المعرّفين هو max، وهو الإعداد الذي ينتج أطول سلاسل التفكير. تسحب السرعة والإسهاب في اتجاهين متعاكسين هنا: الطبقة السريعة التي تستدل أيضًا بأقصى طول قد تظل بطيئة من البداية إلى النهاية في مسألة صعبة، لأن عنق الزجاجة هو عدد الرموز التي يقرر النموذج توليدها، وليس المعدل الذي يولّدها به. إذا كان عبء عملك كثيفًا في الاستدلال، فاخفض إلى high أو low قبل أن تدفع 2× مقابل التسريع — سيكون لمستوى الجهد تأثير أكبر على زمن الاستجابة من تأثير طبقة الخدمة.
ثلاث طرق لشراء نفس الطراز

يتوفر GLM-5.3 الآن بثلاث صيغ قابلة للشراء، وهي ليست ثلاثة نماذج:
• GLM-5.3 بسعر 1.40 / 4.40 دولار — بطاقة الأسعار الأساسية، بالقدرات الكاملة، النسخة ذات الأوزان المفتوحة المنشورة التي يمكنك استضافتها بنفسك
• GLM 5.3 Prime بسعر 2.80 / 8.80 دولار — الأوزان نفسها عبر منظومة مُسرَّعة، مورّد واحد في المنبع، ولا تدخل فيها أي أوزان
• GLM-5.3-FlashX بسعر 0.37 / 1.25 دولار — ليس GLM-5.3 على الإطلاق، بل فئة السرعة في عائلة Flash الأرخص، وبفارق كبير أرخص طريقة لشراء زمن الاستجابة
ذلك السطر الثالث هو الجدير بالتحديق فيه. إذا كان ما تريده فعلاً هو رموز أسرع، وكنت مرنًا بشأن أي GLM تحصل عليها منه، فإن FlashX يقدّم تسريعًا على نموذج يكلّف بالفعل نحو عُشر تكلفة الطراز الرائد، مقابل أقل من نصف تكلفة الطراز الرائد غير المسرّع. ولا يكون Prime منطقيًا إلا إذا كنت تحتاج تحديدًا إلى جودة استدلال GLM-5.3، وتحتاج تحديدًا إلى الحصول عليه أسرع.
أين يقع هذا من جانبنا

يجب أن نكون صريحين بشأن أمر واحد: OrcaRouter لا تستضيف GLM 5.3 Prime، ولا نستضيف GLM-5.3-FlashX أيضًا. كلا صفحتي هذين النموذجين تعيدان خطأ 404 على موقعنا. إذا أردت الطبقة المتسارعة، فسيتعين عليك شراؤها من المنصة التي تبيعها، أو من واجهة برمجة التطبيقات الخاصة بالبائع للنموذج الأساسي.
ما نستضيفه هو GLM-5.3 وGLM-5.3-Flash، بسعر القائمة لدى المزوّد دون أي هامش ربح من جانبنا — نفس الـ 1.40 دولار و4.40 دولار التي تراها في جدول أسعار Z.ai نفسه، مُمرَّرة كما هي بدل إعادة تسعيرها. وهذا أهم مما يبدو لطراز تغيّر تسعيره مرتين خلال ستة أسابيع. ولأننا لا نضيف هامشًا سعريًا، فإن أي تغيير في سعر المزوّد يصبح ساريًا لدينا في اليوم نفسه الذي يصبح فيه ساريًا لديهم، دون ترحيل أو تذكرة دعم. كلا المعرّفين يقفان خلف مفتاح API واحد إلى جانب أكثر من 200 طراز آخر، لذا فإن إجراء اختبار A/B بين GLM-5.3 وGLM-5.3-Flash يقتصر على تغيير اسم الطراز في سطر واحد بدل إبرام عقد ثانٍ، ويحميك التحويل التلقائي عند التعطل إذا تراجع مزوّد واحد في المنبع — وهو تحديدًا الخطر الذي تنطوي عليه طبقة سريعة معتمدة على مورّد واحد.
هل ينبغي أن تدفع الضعف؟
ادفع مقابلها إذا كان إنسان أو خدمة في المنبع متوقفًا بانتظار الاستجابة، وكان عبء العمل مقيّدًا بزمن الاستجابة لا بمعدل الإنتاجية، وكنت قد تأكدت بالفعل من أن جهد الاستدلال هو المحرّك الحقيقي لزمن الاستجابة لديك. لا تدفع مقابلها إذا كنت تشغّل توليدًا دفعيًا طوال الليل، أو إذا كان حجم استخدامك مرتفعًا بما يكفي بحيث تتجاوز علاوة الرموز البالغة 2× الوقت الفعلي الذي توفره، أو إذا كنت تأمل أن تكون هذه الطبقة بصمت نموذجًا أفضل. وهي ليست كذلك. إنها GLM-5.3 مع ساعة توقيت تعمل، وساعة التوقيت تحتسب الفاتورة حسب الرمز.
الصياغة الصادقة لعائلة GLM-5.3 بأكملها الآن هي أن Z.ai أطلقت نموذجًا واحدًا في أغسطس، وقد قضى السوق شهر سبتمبر في إعادة تغليفه بأربعة أسعار مختلفة. ويُعد GLM 5.3 Prime الأغلى بين تلك الحزم. وهو أيضًا الأضعف من حيث الأثر الوثائقي، لأن الشركة التي يظهر اسمها على الأوزان لا تُدرجه. هذا ليس سببًا لتجنبه. بل هو سبب لمعرفة ما تشتريه بالضبط قبل أن تضعه على مسار الإنتاج.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
