
GPT-6.1 Sol مقابل GLM-5.3: شُحنت الأوزان، ولم تتحرّك الفاتورة
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
OpenAI released GPT-6.1 Sol on 29 September 2026 at its DevDay keynote, and Z.ai released GLM-5.3 six weeks earlier, on 18 August 2026, then held the checkpoint back for a week. That hold is over: zai-org/GLM-5.3 has been on Hugging Face since 25 August, a BF16/FP8 checkpoint at roughly 753 billion parameters of which about 40 billion are active per token, and it has since passed 1.4 million downloads. So the question most comparisons have been asking since August — is this an open model or a rental? — has an answer, and the answer did not change the arithmetic. On the independent board, GPT-6.1 Sol scores 51.8 and costs $0.72 per completed index task; GLM-5.3 scores 44.8 and costs $2.01. You can now own the cheaper-by-the-token model and still pay nearly three times more per finished job.
ما هو كل نموذج في الواقع
GPT-6.1 Sol is OpenAI's mid-tier GPT-6 model, one rung below the GPT-6 Astra flagship and above the budget GPT-6 Luna. It carries a 1,050,000-token context window with a 128,000-token output ceiling and an April 30, 2026 knowledge cutoff, and it accepts text, images and files as input. Reasoning runs from low to max with a default of medium; the none and minimal values that GPT-6 Sol accepted now return an error, which OpenAI's own migration guidance addresses by telling developers to substitute low. It costs $2.00 per million input tokens and $10.00 per million output, with cached input at $0.10.
GLM-5.3 هو الرائد الحالي لدى Z.ai في هندسة البرمجيات والعمل الوكيلي الطويل الأفق، وهو مبني على القاعدة نفسها القائمة على مزيج الخبراء التي بُني عليها GLM-5.2، مع تحقيق المكاسب من التدريب اللاحق لا من نموذج أكبر. وهو نصي المدخلات ونصي المخرجات — بلا قدرات رؤية، بأي سعر — بنافذة تبلغ مليون رمز، وحد أقصى للمخرجات يبلغ 128,000 رمز، والتفكير مفعّل بشكل دائم. لا يوجد وضع غير استدلالي، وهذا قيد صارم لأي استدعاء حساس لزمن الاستجابة. تدرجه Z.ai بسعر 1.40 دولار للإدخال و4.40 دولار للإخراج لكل مليون رمز، مع إدخال مخزّن مؤقتًا بسعر 0.26 دولار؛ بينما يوفره كتالوجنا الخاص بسعر 1.26 دولار و3.96 دولار مع قراءة من الذاكرة المؤقتة بسعر 0.234 دولار، لذا فإن بطاقة المورّد هي الرقم الأكثر تحفظًا والذي ينبغي الانطلاق منه في الجدال.
بطاقة الأسعار، والسطر الذي يعكسها
سطر واحد لكل بُعد، وكلا الجانبين على كلٍّ منها:
• الإدخال — GPT-6.1 Sol بسعر 2.00 دولار لكل مليون مقابل GLM-5.3 بسعر 1.40 دولار لكل مليون؛ GLM أرخص بنسبة 30%
• الإخراج — GPT-6.1 Sol بسعر 10.00 دولار لكل مليون مقابل GLM-5.3 بسعر 4.40 دولار لكل مليون؛ GLM أرخص بنسبة 56%
• الإدخال المخزّن مؤقتًا — GPT-6.1 Sol بسعر 0.10 دولار لكل مليون مقابل GLM-5.3 بسعر 0.26 دولار لكل مليون؛ ينقلب الترتيب، Sol أرخص بـ 2.6×
• بند السياق الطويل — GPT-6.1 Sol يعيد تسعير الطلب بأكمله فوق 272,000 رمز إدخال عند 2× للإدخال والتخزين المؤقت و1.5× للإخراج مقابل GLM-5.3 مع عدم وجود بند مكافئ على البطاقة المنشورة
• السياق والإخراج — 1,050,000 إدخال / 128,000 إخراج مقابل مليون إدخال / 128,000 إخراج؛ فرق بنسبة 5%، غير جوهري
• الوسائط — نص وصورة وملف كمدخلات، ونص كمخرجات مقابل نص فقط
• الحد الأدنى للاستدلال — GPT-6.1 Sol منخفض، متوسط (افتراضي)، مرتفع، مرتفع جدًا، أقصى مقابل GLM-5.3 مفعّل دائمًا، لا يوجد حد أدنى للهبوط إليه
• الأوزان — مغلقة، API فقط مقابل مفتوحة، قابلة للتنزيل، FP8
• درجة مستقلة، Artificial Analysis v4.3.2 بأقصى جهد — 51.8 مقابل 44.8
• تكلفة مستقلة لكل مهمة في الفهرس — 0.72 دولار مقابل 2.01 دولار
• رموز الإخراج لتشغيل الفهرس — 67 مليون مقابل 210 مليون
img src="2.png" alt="لوحة نتائج مقارنة مولّدة بعمودين بعنوان 'GPT-6.1 Sol مقابل GLM-5.3 - لوحة النتائج'. العمود الأيسر 'GPT-6.1 Sol': صفوف مكتوب فيها 'مؤشر الذكاء: 51.8'، 'التكلفة لكل مهمة مؤشر: $0.72'، 'سعر الإدخال: $2.00 لكل مليون'، 'سعر الإخراج: $10.00 لكل مليون'، 'رموز الإخراج في تشغيل المؤشر: 67 مليون'، 'الأوزان: مغلقة'. العمود الأيمن 'GLM-5.3': صفوف مكتوب فيها 'مؤشر الذكاء: 44.8'، 'التكلفة لكل مهمة مؤشر: $2.01'، 'سعر الإدخال: $1.40 لكل مليون'، 'سعر الإخراج: $4.40 لكل مليون'، 'رموز الإخراج في تشغيل المؤشر: 210 مليون'، 'الأوزان: مفتوحة على Hugging Face'. تذييل مكتوب فيه 'أرقام مستقلة وفق Artificial Analysis v4.3.2 بأقصى جهد؛ أسعار قائمة الموردين.' شعار OrcaRouter في الزاوية السفلية اليمنى." /> هذا الزوج الأخير هو ما يحسم هذه المواجهة، وليس تأثيرًا طفيفًا.

الـ210 مليون توكن
تشغّل Artificial Analysis المجموعة نفسها المكوّنة من عشرة تقييمات على كل نموذج على لوحة الصدارة، وتنشر أعداد الرموز الكامنة وراء كل نتيجة. ولّد GLM-5.3 نحو 210 ملايين رمز إخراج عند إكمال التشغيل. أما GPT-6.1 Sol فقد ولّد 67 مليونًا. وعند قراءة ذلك في مقابل فئة المقارنة الخاصة بكل نموذج على لوحة الصدارة، فإن 210 ملايين الخاصة بـ GLM-5.3 تقع فوق وسيط الفئة البالغ نحو 140 مليونًا، بينما يقع 67 مليونًا الخاصة بـ Sol أدنى بكثير من وسيط فئة النماذج الرائدة البالغ نحو 81 مليونًا، وهي الفئة التي يُقيَّم ضمنها. ولأن الإخراج هو الجانب المكلف في كل بطاقة أسعار، فإن خصم 56% المعلن على بند الإخراج لدى GLM-5.3 لا يصمد أمام القياس: فهو يُصدر 3.1 ضعف عدد الرموز مقابل 0.44 ضعف السعر، و3.1 × 0.44 يساوي 1.37 — أي أن GLM-5.3 هو النموذج الأكثر تكلفة في عبء العمل هذا رغم بطاقة أسعار أقل تكلفة بشكل ملموس.
رقم التكلفة لكل مهمة على اللوحة نفسها يؤكد الاتجاه والحجم التقريبي. 2.01 دولار مقابل 0.72 دولار هو 2.8×، أوسع مما توحي به نسبة التوكنات وحدها، لأن GLM-5.3 يدفع أيضًا أكثر على بنود الإدخال والتخزين المؤقت لكل مهمة. يجدر بنا أن نكون دقيقين بشأن ما يثبته ذلك وما لا يثبته: تشغيل المؤشر يتكون من عشر تقييمات ثابتة، والإسهاب فيها ليس مماثلًا للإسهاب في حركة المرور لديك. لكن بالنسبة للمشتري، التوكنات هي ما يتم إصدار الفاتورة بناءً عليه، وشكل الفرق هو نفسه في أي مجموعة مهام يتعين على النموذج فيها إنتاج إجابة طويلة.
الإزاحة الجزئية هي سطر الإدخال المخزَّن مؤقتًا. قراءة التخزين المؤقت لدى GLM-5.3 هي 0.26 دولار مقابل أساس 1.40 دولار، وقراءة GPT-6.1 Sol هي 0.10 دولار مقابل أساس 2.00 دولار — ويفوز Sol بمعامل 2.6 على معدل يهيمن على أي عبء عمل ذي بادئة ثابتة. إذا كانت حركة المرور لديك عبارة عن مجموعة كبيرة ثابتة مع إجابة من فقرة واحدة، فإن GLM-5.3 هو ببساطة الخيار الأرخص وعليك اختياره. وإذا كانت حركة المرور لديك تشبه حركة المرور التي بُني هذان النموذجان من أجلها — حلقات الوكلاء، والتعديلات بمقياس المستودع، والمخرجات المولَّدة الطويلة — فإن ميزة الإدخال المخزَّن مؤقتًا تتقلص إلى ضجيج بجانب نسبة رموز 3×.
أين تستقر أرقام المورّدين
أرقام إطلاق Z.ai قوية، وكالعادة، غير مُعاد إنتاجها. Terminal-Bench 2.1 عند 88.2، وDeepSWE v1.1 عند 66.9، وCyberGym عند 84.5، وExploitBench عند 54.4، وAutomationBench عند 48.2، وGDPval-AA v2 عند 1769 Elo. الرقم الوحيد الذي يستحق قراءته مرتين هو Terminal-Bench 3.0 عند 28.3 — المعيار اللاحق، والتصحيح لرقم 88.2 على المعيار الأقدم. يمكن للنموذج أن يكون ممتازًا على المعيار الذي استهدفه تدريبه اللاحق وعاديًا على الجيل التالي من المعيار نفسه.
OpenAI's launch numbers for GPT-6.1 Sol are framed entirely around cost per completed task rather than raw score: DeepSWE v1.1 beating GPT-6 Sol's best by 6.4 percentage points at a lower reasoning effort, AutomationBench 1.0.6 at 2.2 points above Claude Opus 5.5 at medium effort, OSWorld 2.0 up seven points on GPT-6 Sol at maximum effort, Terminal-Bench Science 0.1 more than doubling GPT-6 Sol at less than half the cost per task. Note that these are OpenAI's harness at OpenAI's settings on OpenAI's selected benchmark set, and that none of them has been reproduced independently.
The overlap between the two vendors' published sets is thin, and the one direct comparison available is on the same benchmark: Z.ai reports 66.9 on DeepSWE v1.1, OpenAI reports 68.8 for GPT-6 Sol — the model 6.1 replaces — and a 6.4-point improvement for 6.1 Sol over its own predecessor. Two points apart on the vendor-reported comparison, and roughly six apart on OpenAI's own delta. That is close to a controlled comparison, and it says what the independent board says: near parity on capability, a wide gap on what finishing the job costs.
واجهة برمجة تطبيقات واحدة، أم عقدان؟
Both models are on OrcaRouter, which is the unusual part of this pairing. GPT-6.1 Sol landed in the catalogue at OpenAI's own list price on release day — $2.00 and $10.00 per million tokens, cached input $0.10, with the 272,000-token step to $4.00 and $15.00 passed through exactly as the vendor lists it — and GLM-5.3 sits alongside it at $1.26 and $3.96 with a $0.234 cache read. Nothing is added on top of either: the platform passes provider list price through unchanged, which is why a vendor price cut shows up on our side the same day rather than after a reseller renegotiates.

That matters more for this specific pair than for most. The decision between them is not "which is better" — it is a threshold on your own output length, and it will move the first time Z.ai sharpens its rate card or OpenAI changes the 6.1 tier's tier boundary. Holding both behind one key, with automatic failover between them and a routing rule you change in configuration rather than in a deployment, is what lets you test that threshold on real traffic instead of arguing about it. If Sol's cache line wins your workload, route on it; if your answer lengths stay short and GLM-5.3's flat card with no context cliff wins the segment, route on that instead — the same key, no second contract, no second bill.

أيّ واحد، إذا كان عليك الاختيار اليوم
• المخرجات المُولّدة الطويلة، وحلقات الوكلاء، والأعمال كثيفة المخرجات — GPT-6.1 Sol، ويقترب الفارق من ثلاثة أضعاف بمجرد تطبيق أعداد الرموز. هنا تكذب بطاقة الأسعار ولا يكذب القياس.
• بادئة مستقرة، إجابة قصيرة — GLM-5.3. فأسعار المدخلات والمدخلات المخزّنة مؤقتًا أفضل حقًا، ولا تسنح الفرصة للإسهاب ليعضّ.
• أي طلب يتجاوز 272,000 رمز مدخل — GLM-5.3، لأن GPT-6.1 Sol يعيد تسعير الطلب بأكمله عند ذلك الحد، وبطاقة GLM-5.3 لا تحتوي على خطوة مكافئة.
• أي شيء يتضمن صورة أو مستندًا كمدخل مرئي — GPT-6.1 Sol. أما GLM-5.3 فنصّي فقط، والفرق هنا ليس طفيفًا.
• الاستدلال داخل نطاقك الخاص، أو تحوّط ضد تغيّر شروط أحد المورّدين — GLM-5.3، والآن أصبح التنزيل متاحًا فعليًا بدلًا من كونه وعدًا. خصّص ميزانية للأجهزة: فنقطة التحقق ملف FP8 كبير، والاستضافة الذاتية قرار رأسمالي لا قرار API.
• الاستدعاءات الحساسة لزمن الاستجابة — لا هذا ولا ذاك دون حذر. فـ GLM-5.3 لا يملك طريقة لإيقاف الاستدلال؛ وGPT-6.1 Sol له حد أدنى عند منخفض، وقياس زمنه الخاص حتى أول رمز على اللوحة المستقلة بلغ 332 ثانية مقابل وسيط للوحة قدره 3.7.
مقارنات في هذه المقالة3
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
