
GPT-6.1 Sol مقابل MiniMax M3: بطاقة الأسعار الأرخص تخسر في الفاتورة
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
MiniMax M3 asks for a fraction of what GPT-6.1 Sol asks — $0.30 per million input tokens against $2.00, $1.20 per million output against $10.00 — and by the meter that actually runs, it is cheaper: $0.508 per task against $0.724 on Artificial Analysis's v4.3.2 evaluation. That is a genuine win, and it is also the whole of the argument, because the same measurement that hands M3 the lower bill hands GPT-6.1 Sol a 22.6-point index lead, and the benchmark set that measures whether a model can finish agentic work rather than describe it turns the gap into a wall. The vendor shipped GPT-6.1 Sol on 29 September 2026. The company released M3, its 428-billion-parameter open-weight model, on 31 May 2026.
كلاهما قيد التشغيل، وكلاهما له سعر، وكلاهما لا يفصله سوى استدعاء API واحد. ما يلي هو الحساب الذي يحسم الاختيار بينهما، والموضعان اللذان لا يكون فيهما الحساب هو القصة كاملة.
ما هو كل نموذج في الواقع
GPT-6.1 Sol هو النموذج الرائد الحالي لدى OpenAI في الاستدلال وهندسة البرمجيات — نموذج مغلق، أُطلق بعد أسبوع واحد فقط من GPT-6 Sol الذي يحل محله، ويُباع بسعر القائمة نفسه البالغ 2.00 دولار / 10.00 دولار مثل سلفه. ويتضمن سعرًا للإدخال المخزّن مؤقتًا قدره 0.10 دولار، أي نصف ما كان GPT-6 Sol يتقاضاه مقابل إصابات الذاكرة المؤقتة، وهو النموذج الذي تشير إليه OpenAI عندما تتحدث عن البرمجة الوكيلية بدلًا من الدردشة.
MiniMax M3 هو نموذج خليط الخبراء (mixture-of-experts) يضم 428 مليار معامل إجمالي و23 مليار معامل نشط لكل رمز، نُشر بموجب ترخيص MiniMax Community License — إصدار مفتوح الأوزان بترخيص مخصص ذي طابع غير تجاري، وليس ترخيصًا معتمدًا من OSI. يقدمه مجال واسع من مزودي الاستدلال: تسجل Artificial Analysis خمسة عشر مضيفًا لـ M3 مقابل ثمانية لـ GPT-6.1 Sol. هذا الاتساع هو الميزة العملية للأوزان المفتوحة، وهو أيضًا سبب كون المنافسة السعرية على M3 أسرع من النموذج المغلق.
بطاقة الأسعار، والعدّاد الذي يبطلها

ضع بطاقتي الأسعار المنشورتين جنبًا إلى جنب، وستجد أن الفارق ليس ضئيلًا.
• الإدخال — GPT-6.1 Sol $2.00 لكل مليون مقابل MiniMax M3 $0.30 لكل مليون؛ M3 أرخص بنسبة 85%
• الإخراج — $10.00 لكل مليون مقابل $1.20 لكل مليون؛ M3 أرخص بنسبة 88%
• الإدخال المخزن مؤقتاً — $0.10 لكل مليون مقابل $0.06 لكل مليون
• التكلفة لكل مهمة AA — $0.724 مقابل $0.508؛ M3 أرخص بنسبة 30%، وليس 85%
• رموز الإخراج لكل مهمة — 38,128 مقابل 48,192؛ M3 يكتب 26% أكثر
• الوقت لكل مهمة — 640 ثانية مقابل 486 ثانية
• نافذة السياق — 1,050,000 مقابل 1,048,576 رمزاً؛ متساويان فعلياً
• الحد الأقصى للإخراج — 128,000 رمزاً مقابل 512,000؛ M3 سيكتب إجابة واحدة طويلة جداً
• المدخلات المقبولة — نص وصورة وملف مقابل نص وصورة وفيديو
• ترتيب المؤشر — GPT-6.1 Sol العاشر من 147 نموذجاً مقابل MiniMax M3 الثاني والستون
السطران الرخيصان في الأعلى هما ما تراه ورقة المشتريات. أما السطر الثالث فهو الذي يسدد الفاتورة، ويقول إن ميزة بنسبة 85–88٪ في بطاقة الأسعار تتحول إلى ميزة واقعية بنسبة 30٪، لأن M3 ينتج توكنات أكثر لكل مهمة، ولأن المهمة ليست كمية ثابتة من العمل. بطاقات الأسعار تسعّر التوكنات؛ أما العمل فيُسعّر بالمهام. أي مقارنة تتوقف عند السطرين الأولين إنما تقارن أرقامًا خاطئة، بوحدة خاطئة.
حيث يتوقف الثلاثون بالمئة عن الأهمية
تكلفة المهمة قريبة بما يكفي بحيث تحسم فجوة المؤشر الأمر لأي شيء يتجاوز النص الكمّي. تضع Artificial Analysis كلاً من GPT-6.1 Sol عند 51.83 وMiniMax M3 عند 29.22 — بفارق 22.6 نقطة، وهو فارق غير موزّع بالتساوي عبر مجموعة التقييمات. في التقييمات التي تطلب من النموذج تشغيل طرفية، وتحرير مستودع، والتحقق من عمله بنفسه، فإن النموذجين ليسا في الفئة نفسها:
• Terminal-Bench 4.0 — GPT-6.1 Sol 0.5606 مقابل MiniMax M3 0.0202
• Terminal-Bench Science — 0.5810 مقابل 0.0048
• AA-Omniscience — 41.53 مقابل 1.35
• MMLU-Pro — 0.8595 مقابل 0.7856
• AutomationBench — 0.6487 مقابل 0.2125
• τ²-bench — لم يُنشر لـ GPT-6.1 Sol في هذا التشغيل مقابل 0.8889 لـ M3
• GPQA Diamond — لم يُنشر لـ GPT-6.1 Sol في هذا التشغيل مقابل 0.9293 لـ M3
• CritPT — 0.3171 مقابل 0.0371
اقرأ ذلك بعناية، فهي ليست نتيجة كاسحة كاملة، والاستثناءات هي الجزء المثير. يسجل MiniMax M3 نسبة 0.8889 على τ²-bench، تقييم استخدام الأدوات وحوار خدمة العملاء، و0.9293 على GPQA Diamond — درجة علمية بمستوى الدراسات العليا تتفوق على كل نتيجة لـOpenAI نُشرت في هذه التجربة تحديدًا. M3 نموذج استدلال كفء ومستخدم أدوات حواري جيد. على Terminal-Bench 4.0 يسجل 0.0202. هذا ليس «أسوأ»؛ هذا نموذج لا يستطيع أن يحافظ على تماسك مهمة مستودع متعددة الخطوات إطلاقًا، ولا يجعل أي خصم على الرموز مهمة يفشل فيها النموذج أرخص من مهمة ينجزها.
هناك تكلفة من الدرجة الثانية يخفيها الرقم الخاص بكل مهمة. يسجّل M3 عدد 48,192 رمز إخراج لكل مهمة، وزمنًا حتى أول إجابة قدره 23.0 ثانية مقابل 332.0 ثانية لدى GPT-6.1 Sol — فالنموذج الصغير يبدأ الكلام على الفور تقريبًا ثم يستطرد في التفكير. إذا كان عبء عملك حساسًا لزمن الاستجابة لكنه سطحي، فذلك نقطة لصالح M3. أما إذا كان قائمًا على الوكلاء، فعدد الرموز هو ما تدفع مقابله، والنتيجة النهائية هي ما تحصل عليه.
تحتوي بطاقة النموذج الخاصة بنا لـ GPT-6.1 Sol على الأرقام نفسها بالصيغة التي ستوجّه بها الطلبات فعليًا: سعر 2.00 دولار / 10.00 دولار، ونافذة سياق تبلغ 1,050,000 رمز، وزمن 4.54 ثانية عند النسبة المئوية الخمسين للوصول إلى أول رمز، ومؤشر Artificial Analysis وكتلة المعايير في الصفحة نفسها.

ما قيمة الأوزان المفتوحة هنا
كون M3 قابلاً للتنزيل هو أقوى حجة لصالحه، ويستحق الأمر الدقة بشأن ما يوفره ذلك. فهو يوفر شروط ترخيص تتيح لك تشغيل النموذج داخل حدودك الخاصة — وهو مفيد إذا كانت البيانات لا تستطيع المغادرة — كما يوفر المنافسة السعرية الناتجة عن خمسة عشر مضيفًا مستقلًا. لكنه لا يوفر لك نشرًا رخيصًا: فـ 428 مليار معامل مع 23 مليارًا نشطًا لا تزال تحتاج إلى عتاد استدلال جاد، وترخيص MiniMax Community License هو ترخيص مخصص مرتبط بشروط، وليس ترخيصًا غير مقيّد. بالنسبة لمعظم الفرق، تعني عبارة "الأوزان المفتوحة" سعرًا أفضل للاستدلال المستضاف، لا صندوقًا في الرف.
بطاقة OrcaRouter الخاصة بـ MiniMax M3 هي المكان الذي توجد فيه الأرقام المُقدَّمة: سعر $0.30 / $1.20، ونافذة سياق من 1,048,576 رمزًا، وأقصى إخراج 512,000 رمز، وإدخال نص/صورة/فيديو، وحجم سبعة أيام يبلغ 56.4 مليون رمز عبر المزوّدين الذين يوجّهونها.

كلاهما خلف مفتاح واحد
السبب العملي وراء كون هذه المقارنة تغييرًا في الإعدادات وليس ترحيلًا هو أن كلا النموذجين يمكن الوصول إليهما من نقطة نهاية واحدة في OrcaRouter — واجهة برمجية واحدة لأكثر من 200 نموذج، مع تمرير سعر القائمة الخاص بالمزوّد بهامش ربح 0%، مما يعني أن تغيير سعر MiniMax يظهر على فاتورتك في نفس اليوم الذي ينشره البائع بدلًا من أن ينتظر إعادة تفاوض أحد الموزّعين. وهذا يهم M3 أكثر من منافسه: السبب الكامل وراء التوجيه إلى نموذج مفتوح الأوزان هو أن سعره وقائمة مضيفيه في تغيّر، وعدّاد التمرير هو النوع الوحيد الذي يتتبع هدفًا متحركًا.
التحويل التلقائي عند الفشل هو النصف الآخر. يُخدَم M3 من مزوّدين كثيرين متفاوتي الموثوقية، ويمكن لطبقة التوجيه نقل الطلب إلى مضيف آخر عندما يتدهور أحد المضيفين، دون أن يعرف المستدعي على أي مضيف استقر. تلك هي الطريقة الصادقة لتبنّي نموذج تقول نتيجة Terminal-Bench الخاصة به «ليس مناسبًا للمسار الحرج» — ضعه حيث تكون إعادة المحاولة رخيصة.
أيّ واحد، إذا كان عليك الاختيار اليوم
إذا كان العمل نصًا ضخمًا — استخراجًا، تلخيصًا، تصنيفًا، حوارًا، أو أي شيء يكون ناتجه نصًا نثريًا ويكون نمط فشله جملة خاطئة بدلًا من بناء معطوب — فإن MiniMax M3 هو الخيار الافتراضي الصحيح، ونسبة الثلاثين بالمئة مال حقيقي. استخدم أرقام GPQA و τ²-bench كدليل: هذا نموذج قادر يصادف أنه رخيص.
إذا كان العمل وكيليًا — مستودعات، وطرفيات، وسلاسل أدوات، وأي شيء يتضمن خطوة تحقق — فإن 0.0202 على Terminal-Bench 4.0 يُسقط الأهلية، وGPT-6.1 Sol عند 0.5606 مقابل $0.724 للمهمة هو الصفقة الأفضل حتى مع كونه أغلى بنسبة 85% لكل رمز. لم تكن بطاقة الأسعار أبدًا هي ما كنت تشتريه.
الإجابة المفيدة هي أنك لست مضطرًا إلى الاختيار مرة واحدة. وجّه الطبقة السطحية إلى M3، ووجّه الطبقة الوكيلية إلى GPT-6.1 Sol، وأبقِ كليهما خلف بيانات اعتماد واحدة — إذ تجمع لغة التوجيه DSL بينهما في استدعاء واحد عندما تبدأ المهمة كعملية استخراج ثم تتحول إلى مهمة إصلاح.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
