بطاقة عنوان رئيسية مُولَّدة لمقال بعنوان «Grok 4.7 مقابل Qwen 3.8 Max — رمية عملة على الورق»، مع عنوان فرعي «سعر متطابق، وفارق نقطة مؤشر واحدة، وشكلان متعاكسان»، وشرائح إحصائية تقرأ: مؤشر AA 46 مقابل 45، والسعر 2 دولار/6 دولار في كليهما، والسياق 500K مقابل 984K.
Guides & Insights

Grok 4.7 مقابل Qwen 3.8 Max: السعر نفسه، وبفارق نقطة واحدة، وشكلان متعاكسان

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

نموذجان رائدان مغلقان، كلاهما بسعر 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، وكلاهما يسجّل فارقًا لا يتجاوز نقطة واحدة عن الآخر على المعيار المستقل نفسه، وأُطلقا بفارق تسعة عشر يومًا. Grok 4.7 وصل في 21 سبتمبر 2026 من SpaceXAI؛ Qwen 3.8 Max أطلقته الجهة الموردة في 3 أغسطس 2026 وحدّثته في 2 سبتمبر 2026. على مؤشر Artificial Analysis Intelligence Index الحالي، الإصدار v4.3.2، يسجّل Grok 4.7 درجة 46 ويسجّل Qwen 3.8 Max درجة 45. من حيث السعر والقدرة المقاسة، هذان النموذجان هما الشراء نفسه. وفي كل ما عدا ذلك — السياق، والوسائط، وسرعة الخدمة، والانفتاح، وما اختار كل مورّد تحسينه — لا يمكن أن يكونا أكثر اختلافًا، وهذا ما يجعل هذه المقارنة تستحق الخوض بدلًا من تخطيها.

أولاً، الجدول الزمني، لأن Qwen 3.8 Max له تاريخان

هذا الأمر يربك الكثير من التغطيات، لذا يستحق التوضيح في البداية. أُطلق Qwen 3.8 Max في 3 أغسطس 2026 بوصفه أكبر نموذج من Alibaba وأقدرها، وقد بُني على معمارية Qwen 3.5 للرؤية واللغة وفق تصميم مختلط الخبراء متناثر، مع الإبلاغ عن 2.4 تريليون معامل إجمالي و95 مليار معامل نشط لكل رمز. وفي 2 سبتمبر 2026، أصدرت Alibaba بنية محدّثة — مراجعة 0902، وهي النسخة التي تحمل معرّفات النماذج الحالية والنسخة التي تؤرّخ Artificial Analysis صفحتها على أساسها. إذا كنت قد رأيت تاريخًا في أغسطس وآخر في سبتمبر لـ Qwen 3.8 Max، فهذا هو السبب: أحدهما تاريخ الإطلاق، والآخر هو المراجعة التي يسميها معظم الناس فعليًا اليوم.

يمتلك Grok 4.7 سجلًا أنظف، وخلفه سجل أكثر فوضى. أطلقت SpaceXAI الإصدار في 21 سبتمبر 2026 بعد إطلاق تأجّل مرارًا — كان ماسك قد أشار إلى نوافذ في أواخر أغسطس، وأوائل سبتمبر، ومنتصف سبتمبر قبل أن يصدر النموذج فعليًا. كان الإصدار نفسه محدودًا: نموذج أساسي أكبر من Grok 4.6، وجولة تدريب أطول على التعلم المعزز تستهدف مهامًا تستغرق ساعات، دون أي تغيير في بطاقة أسعار $2/$6 التي حملها Grok 4.6 منذ 12 أغسطس.

ما الذي حسّنه كل مورّد من أجله

اقرأ إعلاني الإطلاق كزوج وستجد أن الرهانات التصميمية متعارضة تمامًا تقريبًا.

حُسِّن SpaceXAI للتنفيذ الوكيلي. تتركز أرقام Grok 4.7 المعلنة من المورّد في العمل على الطرفية والمستودعات: Terminal-Bench 4.0 عند 38.0% مقابل 20.3% لـ Grok 4.6، وCursorBench 4.0 عند 46.3%، وDeepSWE v1.1 عند 71.0% في جهد الاستدلال المرتفع، وEEBench عند 64.0%. يسمّي وصف الشركة نفسه للإصدار التحقق الذاتي والتعامل مع السياق الطويل داخل بيئة Grok Bot كأهداف. يوفّر Grok 4.7 نافذة سياق تبلغ 500,000 رمز، ويستقبل النصوص والصور، ويعيد النصوص، ويتيح جهد الاستدلال من low إلى xhigh. إنه نموذج بُني لإنجاز المهام.

حسّنت Alibaba من أجل مدى الوصول. يقدّم Qwen 3.8 Max نافذة سياق تبلغ نحو 984,000 رمز — أي ما يعادل مليونًا فعليًا — ونقاط قوته المنشورة هي الاتساع لا العمق في مسار واحد: نتيجة Terminal Bench 2.1 البالغة 86.6، وSWE-bench Pro عند 67.7، وPaperBench عند 93.0، وGPQA Diamond عند 92.6، وMMMU-Pro عند 82.3، وOSWorld-Verified عند 86.1. وهو يقبل مدخلات نصية وصورية وفيديو ويعيد نصًا، ويدعم مستويات جهد الاستدلال مع xhigh كإعداد افتراضي، ونقطته الأضعف المنشورة هي Humanity's Last Exam عند 43.6. إنه نموذج مصمّم للتعامل مع أي شيء تعطيه إياه.

كل رقم في تلك الفقرة مصدره الشركة المورِّدة. ولم تُعَد إنتاج أيٍّ من المجموعتين بشكل مستقل، كما أن المجموعتين غير قابلتين للمقارنة المباشرة على أي حال — فمعيارا Terminal-Bench 2.1 وTerminal-Bench 4.0 معياران مختلفان، لذلك لا يجوز أبدًا وضع الرقم 86.6 الخاص بـ Qwen والرقم 38.0 الخاص بـ Grok جنبًا إلى جنب.

• نتيجة مركّبة مستقلة — Grok 4.7 بنتيجة 46 على AA Intelligence Index v4.3.2 مقابل Qwen 3.8 Max بنتيجة 45 على الإصدار نفسه. تعادل إحصائي.

• سعر كل مليون رمز — 2.00 دولار إدخال / 6.00 دولار إخراج لكليهما. خصم ذاكرة Qwen المؤقتة مُدرج عند 88%، ما يعطي معدلًا مدمجًا قدره 1.18 دولار لكل مليون؛ شروط التخزين المؤقت لدى Grok 4.7 غير منشورة على الأساس نفسه.

• نافذة السياق — Grok 4.7 بـ500,000 توكن مقابل Qwen 3.8 Max بحوالي 984,000. تفوز Qwen بما يقارب الضعف، وهذا هو أكبر فرق فردي في المواصفات بينهما.

• طرق الإدخال — Grok 4.7 نص وصورة مقابل Qwen 3.8 Max نص وصورة وفيديو.

• الأوزان — كلاهما مملوك. لا يمكن تنزيل أيٍّ من النموذجين، مما يزيل تمامًا حجة الأوزان المفتوحة المعتادة من هذه المقارنة.

• المعاملات — Grok 4.7 غير معلنة في أي ورقة مواصفات لـ SpaceXAI (رقم 2.1 تريليون تقريبًا هو ادعاء من ماسك) مقابل Qwen 3.8 Max المذكور عند 2.4 تريليون إجمالي مع 95 مليارًا نشطًا، وهو ما لم تؤكده Alibaba في ورقة مواصفات أيضًا.

• سرعة الخدمة — Qwen 3.8 Max عند 38.8 رمز إخراج في الثانية مع 3.08 ثوانٍ للوصول إلى أول رمز، وفقًا لـ Artificial Analysis؛ وتصف SpaceXAI نموذج Grok 4.7 بأنه أسرع بنحو الضعف من النماذج المماثلة، وفقًا لما أوردته الجهة الموردة، مع عدم نشر أي رقم مستقل للإنتاجية حتى الآن.

A generated two-column comparison scoreboard for Grok 4.7 and Qwen 3.8 Max with six rows: AA Intelligence Index 46 vs 45, price $2.00/$6.00 on both, context 500K vs 984K tokens, modalities text and image vs text, image and video, weights proprietary on both, and speed vendor-claimed twice as fast vs 38.8 tokens per second measured, with a footer noting index scores are per Artificial Analysis v4.3.2 and all benchmark figures are vendor-reported.

الفرق في السياق هو القرار الحقيقي

عندما يتطابق السعر والقدرات، يقع القرار على أي شيء آخر يختلف، وهنا يكون السياق هو الفارق. إن مضاعفة النافذة من 500,000 إلى نحو 984,000 رمز ليست مجرد تفصيلة تجميلية في ورقة المواصفات — بل هي الفرق بين تقسيم المستودع إلى أجزاء والاحتفاظ به كاملًا.

تأتي النافذة الأطول لدى Qwen 3.8 Max مصحوبة بتحذير موثّق يهم المشترين: النسخة مفتوحة الأوزان التي أعلنت عنها Alibaba لأسبوع 10 أغسطس 2026 كانت نصية فقط ولم تشمل سياق المليون توكن الكامل. لا يؤثر ذلك على نقطة النهاية المستضافة التي تتناولها هذه المقارنة، لكن من المفيد معرفة ذلك إذا كنت تضع خططك على أساس الإصدار المفتوح.

هناك اعتبار ثانٍ في جانب Grok. لطالما طبّق خط Grok جرفًا تسعيريًا عند 200,000 رمز إدخال، حيث يؤدي الطلب الذي يتجاوز هذه العتبة إلى إعادة تسعير الطلب بأكمله بمعدل مضاعف — 4 دولارات للإدخال و12 دولارًا للإخراج. مع نافذة سعة 500,000 رمز، تقع هذه العتبة في عمق نطاق عمل النموذج. قبل توجيه العمل ذي السياق الطويل إلى Grok 4.7، تأكد من بطاقة الأسعار الحالية للنموذج المنشور، لأن التفاعل بين نافذة كبيرة وجرف إعادة التسعير هو حيث تخطئ فواتير السياق الطويل.

كم تبلغ تكلفة شهر من العمل على كل منها

لأن الأسعار المعلنة متطابقة، فإن مقارنة التكلفة يجب أن تُبنى على سلوك التوكنات وليس على قائمة الأسعار، وهنا يختلف النموذجان اختلافًا قابلًا للقياس.

قامت Artificial Analysis بقياس قيام Grok 4.7 بتوليد 240 مليون رمز إخراج أثناء تشغيل مؤشر Intelligence Index الخاص بها، مقابل وسيط قدره 92 مليونًا عبر الطراز الموجودة على اللوحة — فهو مُستدِلّ مطنِب. وقد ولّد Qwen 3.8 Max 190 مليون رمز إخراج على المؤشر نفسه، بتكلفة تقييم إجمالية قدرها 4,934.79 دولارًا، وبمعدل مُقاس بلغ 38.8 رمزًا في الثانية. وكلاهما أعلى بكثير من وسيط الإطناب، وGrok 4.7 هو الأكثر إطنابًا بين الاثنين.

إذن، عند سعر متطابق قدره $6 لكل مليون من توكنات الإخراج، فإن النموذج الذي ينتج توكنات أكثر لكل مهمة يكلف أكثر لكل مهمة. تشير أرقام الإسهاب المنشورة إلى أن Grok 4.7 سيستهلك توكنات إخراج أكثر مقابل عمل فهرسة مكافئ، ما يعني أن التعادل في السعر هو في الواقع فوز صغير لـ Qwen 3.8 Max من حيث التكلفة لكل مهمة — يعوّضه ما يُقال عن ميزة السرعة لدى Grok 4.7، التي تقصّر الزمن الفعلي وبالتالي التكلفة البشرية لانتظار تشغيل الوكيل. لا يظهر أي من هذين التعويضين على بطاقة الأسعار، وكلاهما يستحق القياس على حركة المرور الخاصة بك بدلًا من الافتراض.

عدم التماثل الوحيد الذي لا خلاف عليه هو التخزين المؤقت. تنشر Qwen 3.8 Max خصمًا بنسبة 88% على التخزين المؤقت وسعرًا مدمجًا قدره 1.18 دولار بمزيج 7:2:1 من إصابة الذاكرة المؤقتة/الإدخال/الإخراج. بالنسبة لأحمال العمل ذات البادئة الكبيرة الثابتة — موجه النظام، أو رأس قاعدة التعليمات البرمجية، أو مجموعة مستندات — فإن هذا الخصم هو حيث توجد الوفورات الحقيقية، ويستحق التحقق من كيفية مقارنة شروط التخزين المؤقت في Grok 4.7 قبل الالتزام بالحجم.

Screenshot of the Artificial Analysis model page for Qwen3.8 Max showing an Intelligence Index of 45 on index version v4.3.2, a context window of approximately 984k tokens, text and image input, listed pricing of $2.00 input and $6.00 output per million tokens, and an output speed of 38.8 tokens per second.

الاختيار، عندما ترفض الأرقام أن تختار عنك

إن حصول أحدهما على 46 والآخر على 45 في المؤشر نفسه، وبالسعر نفسه، هو أقرب ما يمكن أن تنشره هذه المدونة إلى تعادل حقيقي. وهذا يعني أن القرار ينبغي أن يُتخذ بناءً على المحاور التي يختلف فيها الطرازان فعليًا، وهي أربعة.

اختر Grok 4.7 إذا كان عملك قائمًا على البرمجة الوكيلية وتنفيذ الطرفية، وإذا كانت السرعة الزمنية الفعلية في التشغيلات الطويلة تهمك أكثر من سعة السياق، وإذا كنت تريد مِقبض تفكير لكل طلب لإبقاء حركة المرور السهلة رخيصة. اختر Qwen 3.8 Max إذا كنت تتعامل routinely مع مدخلات أكبر من نصف مليون رمز، وإذا كان إدخال الفيديو على خارطة طريقك، وإذا كنت تريد خصم التخزين المؤقت بنسبة 88% لأحمال العمل كثيفة البادئة، أو إذا كنت تريد نموذجًا ينشر مورده مصفوفة تقييم واسعة بدلًا من واحدة مركّزة في مسار واحد.

إذا كانت الإجابة الصادقة هي "بعض من كليهما"، فهذه هي الإجابة الطبيعية، وهي الحالة التي صُمم هذا الزوج من أجلها. Qwen 3.8 Max متاح على OrcaRouter بسعر قائمة Alibaba، وOrcaRouter يمرر أسعار قائمة المزوّدين بهامش ربح 0%، لذا فإن $2/$6 المذكورة أعلاه هي ما تدفعه فعلاً، وأي تغيير في سعر المورّد يسري هنا في نفس اليوم بدلاً من وقت التجديد. مفتاح API واحد يغطي Qwen 3.8 Max بالإضافة إلى أكثر من 200 نموذج آخر، مما يعني أن قرار السياق يصبح قاعدة توجيه لكل طلب بدلاً من التزام بالمنصة: أرسل المدخلات الضخمة إلى نافذة 984k واحتفظ بكل ما تبقى على نقطة النهاية الأسرع والأرخص لتلك المهمة، مع التحويل التلقائي عند الفشل إذا تدهور مزوّد الخدمة. حيث تتطلب مهمة ما كلا الشكلين حقًا — قراءة طويلة السياق تليها تمريرة تنفيذ وكيلية — فإن لغة التوجيه DSL تجمع النماذج في استدعاء واحد بدلاً من إجبارك على اختيار جانب واحد.

توضيح جدير بالذكر، بما أنّ أياً من النموذجين ليس مفتوحاً: لا شيء في هذه المقارنة يتضمّن أوزاناً قابلة للتنزيل. كلاهما نقطتا نهاية مستضافتان، والاستضافة الذاتية ليست خياراً لأيّ منهما.

الرقم الوحيد الذي يجب الاحتفاظ به

ستة وأربعون مقابل خمسة وأربعين ليس سببًا لاختيار نموذج، ولا ينبغي أن يكون كذلك. ما يحسم هذه المقارنة هو نافذة السياق — 500,000 توكن مقابل نحو 984,000 — والشكل الذي اختاره كل بائع: Grok 4.7 مُحسَّن لإنهاء المهام الوكيلية الصعبة بسرعة، وQwen 3.8 Max مُحسَّن للتعامل مع أي شيء تسلّمه إليه. السعر نفسه، والقدرة المقيسة نفسها، ومهام مختلفة. هذا قرار توجيه، وهو نوع القرار الذي ينبغي أن يستغرق عصرًا واحدًا لاختباره بدلًا من ربع سنة لشرائه.

Screenshot of the OrcaRouter model page for Qwen3.8 Max (model ID qwen/qwen3.8-max), showing Alibaba's list pricing of $2.00 per million input tokens and $6.00 per million output tokens, a 1M token context window, and the vision, tools, JSON and reasoning capability tags.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا