بطاقة عنوان مُولَّدة لمقالة «Mistral Large 4 vs Gemini 3.1 Pro» تعرض العنوان بخط هندسي عريض بلا زوائد، والعنوان الفرعي «ثمانية أشهر، اتجاهان» أسفله، وصفًّا من ثلاث أيقونات خطية مسطّحة أعلاه — صفحة تقويم، ونافذة طرفية، وإطار صورة — على خلفية بيضاء مع لمسات متدرجة زرقاء وسماوية وشعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

Mistral Large 4 مقابل Gemini 3.1 Pro: ثمانية أشهر، اتجاهان

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Gemini 3.1 Pro متاح في السوق منذ 19 فبراير 2026، ولا يزال يحتل مرتبة قريبة من الصدارة في كل جدول شامل للقدرات، بما في ذلك الجداول التي يُقارَن فيها بنماذج طُرحت هذا الخريف. Mistral Large 4 عمره ثلاثة أسابيع على الأكثر — نسخة معاينة أُعلن عنها في 6 أكتوبر 2026، مع وعد بإتاحة أوزانه بحلول نهاية أكتوبر ودون تسمية أي ترخيص. وفي مؤشر الذكاء الخاص بـ Artificial Analysis، وفق قراءة يوم 6 أكتوبر، يسجّل Gemini 3.1 Pro البالغ من العمر ثمانية أشهر 29.7 مقابل 38.4 للقادم الجديد. تلك هي نقطة البداية الصادقة لهذه المقارنة، وهي نقيض ما توحي به تواريخ الإصدار.

التفسير غامض. فـ«Gemini 3.1 Pro» نموذج رائد من خط الإصدارات التجريبية رقّته Google إلى إصدار مستقر، وصفحة «Artificial Analysis» الخاصة به موسومة بعنوان «Gemini 3.1 Pro Preview» — الصفحة ذاتها التي يجاور فيها مؤشر أدنى نتيجة GPQA Diamond من الطراز الأول. إنه نموذج مبني على الاتساع: نافذة سياق ضخمة جدًا، ومجموعة واسعة من الأنماط، وقدرة استدلال قوية في أسئلة المعرفة. أما «Mistral Large 4» فقد بُني لخريطة عالم مختلفة تمامًا، وسعره يعكس ذلك.

ما هو كل واحد

Gemini 3.1 Pro هو نموذج الاستدلال متعدد الوسائط الرائد من Google، ومعرّفه في واجهة API هو gemini-3.1-pro-preview، مع نافذة سياق تبلغ 1,048,576 رمزًا وسقف للمخرجات يبلغ 65,536 رمزًا. وهو يقبل النصوص والصور والفيديو والصوت والملفات. ويُقدَّم من كتالوج OrcaRouter بأسعار Google نفسها. لا تُدرج وثائق Google أي إصدار غير تجريبي من Gemini 3.1 Pro؛ فاسم المعاينة هو المنتج.

Mistral Large 4 هو مزيج متناثر من الخبراء بمعاملات تبلغ 1.05 تريليون، مع 49 مليار معامل نشط ومُشفّر رؤية مخصص بمعاملات 1.6 مليار، ويُقدَّم باسم "Mistral Large 4 Preview" تحت معرّف API ‏mistral-large-4-0. تذكر وثائق Mistral نافذة سياق بسعة مليون رمز؛ بينما تقرأ Artificial Analysis الرقم 524,288 على التكوين الذي تختبره. لم يُنشر الحد الأقصى للمخرجات. تصف Mistral هذا النموذج بأنه الأكبر والأقدر من بين نماذجها حتى الآن، وتقول إن الأوزان ستصل في نهاية أكتوبر.

الأرقام، مع مصدرها المرفق.

كلا الطرازين لهما صفحات مستقلة، لذا فإن المقارنة أدناه تجري ضمن نفس الإطار بدلًا من مقارنة بين بائع وآخر:

• مؤشر الذكاء v4.3 — Mistral Large 4 Preview 38.4 مقابل Gemini 3.1 Pro 29.7

• التكلفة لكل مهمة فهرسة — 1.13 دولار مقابل 1.30 دولار

• الاستدلال بالسياق الطويل — 81.3% مقابل 82.0%

• GPQA Diamond — لم يُنشر لنسخة المعاينة مقابل 94.1%

• اختبار البشرية الأخير — 35.0% مقابل 47.0%

• Terminal-Bench 4.0 — 26.8% مقابل 4.0%

• SciCode — 54.2% مقابل 58.7%

• AutomationBench، سير عمل الأعمال — 59.9% مقابل 35.4%

• MMMU-Pro، الاستدلال متعدد الوسائط — 76.4% مقابل 82.4%

• نافذة السياق: 1 مليون مُعلنة / 524,288 مقابل 1,048,576 مُقدَّمة

• سقف الإخراج — غير معلن مقابل 65,536 توكن

• السعر لكل مليون، الإدخال / الإخراج — 1.36 دولار / 4.18 دولار بسعر القائمة، 0.68 دولار / 2.09 دولار بالسعر الترويجي، مقابل 2.00 دولار / 12.00 دولار لأقل من 200 ألف رمز و4.00 دولار / 18.00 دولار لما فوق ذلك

• الأوزان — موعودة، الترخيص غير مُسمّى، مقابل احتكارية

A generated two-column scoreboard titled 'Mistral Large 4 vs Gemini 3.1 Pro — the scoreboard'. Left column 'Mistral Large 4 Preview': Intelligence Index v4.3 38.4; cost per index task $1.13; Terminal-Bench 4.0 26.8%; GPQA Diamond not published; MMMU-Pro 76.4%; AutomationBench 59.9%. Right column 'Gemini 3.1 Pro': Intelligence Index v4.3 29.7; cost per index task $1.30; Terminal-Bench 4.0 4.0%; GPQA Diamond 94.1%; MMMU-Pro 82.4%; AutomationBench 35.4%.

الصف الأكثر إثارةً للانتباه على الإطلاق هو Terminal-Bench 4.0. يسجل Gemini 3.1 Pro نسبة 4.0% — وهذا ليس خطأً مطبعيًا، وليس هلوسةً في الجدول: فهو يعكس نموذجًا من فبراير يتم تشغيله على إطار اختبار لوكلاء الطرفية أحدث منه زمنيًا. نسبة Mistral Large 4 البالغة 26.8% أعلى بستة أضعاف في الاختبار نفسه. من استبعد Gemini بناءً على رقم قديم في البرمجة الوكيلية ينبغي أن يعيد إدراجه في الحسبان بناءً على GPQA Diamond الخاص به، ومن استبعد Mistral بناءً على ترتيب المؤشر ينبغي أن ينظر إلى صف الطرفية أولًا.

حيث لا تزال Gemini 3.1 Pro تمتلك اليد العليا

المعرفة والاتساع. إن نتيجة 94.1% في GPQA Diamond هي أعلى رقم في هذا المقال بأكمله، على كلا الجانبين، وهي اختبار معياري علمي بمستوى الدراسات العليا — وليست رقمًا يستطيع نموذج أن يصل إليه بالكلام. وتحكي نتيجة Humanity's Last Exam عند 47.0% مقابل 35.0%، ونتيجة SciCode التي تتقدم بهامش ضئيل على الوافد الجديد، القصة نفسها. إذا كان عبء عملك هو الإجابة عن أسئلة صعبة بدقة انطلاقًا من مجموعة معرفية، فإن Gemini 3.1 Pro يظل النموذج الأقوى بعد ثمانية أشهر من إطلاقه.

اتساع الوسائط هو الميزة الثانية. يستقبل Gemini 3.1 Pro الفيديو والصوت فضلًا عن النصوص والصور. أما Mistral Large 4 فيستقبل النصوص والصور. إذا كانت خطوط معالجتك تستوعب اجتماعات مسجلة، أو تسجيلات شاشة، أو صوت مستشعرات، فإن نموذجًا واحدًا فقط هنا يمكنه رؤية المدخلات كاملة.

سقف الإخراج هو الثالث. 65,536 توكن هو سقف منشور ومضمون؛ أما Mistral فلم تنشر أي سقف له للمعاينة على الإطلاق. لا شيء في منشور إطلاق أكثر احتمالًا أن يلدغك في الإنتاج من حد إخراج غير معلن.

ونافذة سياق Gemini متوفرة فعليًا عند 1,048,576 رمزًا، في حين أن سعة Mistral البالغة 1M هي رقم المورّد مقابل قراءة مستقلة عند 524,288. وبالنسبة لعبء عمل يقع عند الطرف الأقصى من النافذة، فإن الفرق بين رقم معلن ورقم مقيس يعني إعادة كتابة.

أين يغيّر Mistral Large 4 القرار

العمل الوكيلي، وتحديدًا أي شيء يتعامل مع الطرفية، هو حيث يتوقف النموذجان عن كونهما قابلين للمقارنة. منشور الإطلاق الخاص بـ Mistral نفسه يجمع 61.7% على DeepSWE v1.1، و59.4% على SWE-Atlas-QnA، و28.3% على Terminal-Bench 4.0 في مؤشر Coding Agent Index بنسبة 49.8%، ويذكر بوضوح أنه جاء متقدمًا على DeepSeek V4 Pro 0813 وQwen3.8 Max في ذلك المقياس المُجمَّع. هذه الأرقام الثلاثة، وفقًا لكلمات Mistral، هي أرقام قيّمتها Artificial Analysis على نحو خاص قبل أن تصبح منصة اختبارها متاحة للعموم؛ وهي ليست على المؤشر العام بعد، وينبغي تصنيفها على أنها منشورة من البائع إلى أن تصبح كذلك.

تشير الأدلة المستقلة إلى الاتجاه نفسه. على AutomationBench — 657 سير عمل تجاريًا تشمل Gmail وSheets وSlack وSalesforce — يسجل Mistral Large 4 نسبة 59.9%، متقدمًا على Kimi K3 وMiMo-V2.6-Pro وDeepSeek V4 Pro، وعلى منصة الاختبار نفسها لا يظهر Gemini 3.1 Pro على الإطلاق لأن المعيار أحدث منه. صنّفت دراسة بشرية معمّاة أجرتها Surge AI نموذج Mistral Large 4 Preview في المرتبة الثانية من بين خمسة نماذج في جودة البرمجة بدرجة 3.74، متقدمًا على GLM-5.3 وKimi K3 ومتأخرًا فقط عن Claude Opus 5.

الادعاء السيبراني هو الأكثر حدة في منشور Mistral ويستحق أن يُذكر بدقة: 82% في اختبار Artificial Analysis Cyber Index الذي يطلب من النموذج إعادة إنتاج ثغرة أمنية حقيقية ثم إصلاحها، وُصفت بأنها الأعلى بين أي نموذج، مع 93% في 40 تمرينًا تنافسيًا لـ Cybench، وتأكيد Mistral أنها ضمن أفضل خمسة عالميًا في مؤشر Cyber Index الإجمالي بينما تتصدر النماذج مفتوحة الأوزان المطورة خارج الصين. تلك أرقام استشهدت بها الشركة على مؤشر مستقل. ميزتهم العملية هي أن Mistral بنت النموذج للقيام بالعمل بدلاً من رفضه.

أرخص بند في الجدول يخص Mistral أيضًا، لكن بفارق ضيق فقط: 1.13 دولار لكل مهمة مقابل 1.30 دولار، وهي ميزة بنسبة 13% ينتجها السعر الترويجي وتمحوها بطاقة الأسعار. إن Gemini 3.1 Pro طراز من 2026 بتسعير 2026، وليس مكلفًا تشغيل مهمة فهرسة عليه.

عامل الحسم الذي لا يقيس أداءه أحد

هناك أمران مؤثران لا تستطيع الجداول إظهارهما. الأول هو الرخصة. فـ Gemini 3.1 Pro احتكاري وسيبقى كذلك؛ أما Mistral Large 4 فهو إصدار معاينة تقوم حجته بأكملها على أنه سيصبح نموذجًا قابلًا للتنزيل يمكنك تشغيله وفقًا لسياستك الخاصة، على عتادك الخاص، وفي ظل القانون الأوروبي — فقد درّبته Mistral على 3,800 وحدة معالجة رسومات Grace Blackwell في مراكز بياناتها الخاصة، وتقدّم إصدار المعاينة من هناك. لا تساوي هذه الحجة شيئًا حتى يظهر المستودع ويكون للرخصة اسم. لكنها تساوي الكثير يوم يحدث ذلك.

A screenshot of Mistral's own documentation, the Models Overview page at docs.mistral.ai, showing the GENERALIST MODELS card grid with 'Mistral Large 4' listed at v26.10 as 'A state-of-the-art, open-weight, general-purpose multimodal model' and no licence badge, beside a Mistral Large 3 card at v25.12 carrying an APACHE 2.0 badge. Mistral Small 4, Mistral Medium 3.5, Z.ai GLM 5.3 and the Ministral 3 sizes are also visible.

الثاني هو المخاطر التشغيلية. إن نسخة المعاينة التي لا تزال قيد التحسين ستتغير تحتك. على {{1}}OrcaRouter{{/1}}، يمكن الوصول إلى طرفي هذه المقارنة عبر نقطة نهاية واحدة متوافقة مع OpenAI بأسعار المزوّدين المدرجة وهامش ربح 0% — إذ يتوفر {{2}}Gemini 3.1 Pro{{/2}} في الكتالوج بأسعار Google، بينما يجب الوصول إلى {{3}}Mistral Large 4{{/3}} عبر واجهة برمجة Mistral الخاصة وعدة منصات تابعة لجهات خارجية، لأنه ليس مسارًا نقدمه. إن لغة التوجيه DSL هي الجزء المفيد هنا: أرسل التصنيف والاستخراج إلى النموذج الأرخص في ذلك الأسبوع، وصعّد البقايا الصعبة، ودع التحويل التلقائي عند الفشل يستوعب الأيام السيئة لنسخة المعاينة بدلًا من أن تستوعبها مناوبتك.

A screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview, showing the preview model identity, a 1M-token context window, a 65K maximum output, inputs of audio, file, image, text and video with text output, the 2026-02-19 release date, a p-50 time-to-first-token figure of 10.00 seconds, pricing of $2.00 per million input and $12.00 per million output, and a code sample against the api.orcarouter.ai base URL.

الحكم

اسأل عن طبيعة عبء العمل، لا عن أيّ النموذجين أفضل. ففي العمل المعرفي، وإدخال الصوت والفيديو، وسقف إخراج مضمون، ونافذة مليون رمز مخدومة فعليًا، يظل Gemini 3.1 Pro هو النموذج الأقوى، وليس في عمره عيب — بل هو ثمانية أشهر من اكتشاف الآخرين لحدوده. أما في البرمجة الوكيلية، والعمل على الطرفية، والعمليات الأمنية، فيتقدّم Mistral Large 4 بفارق واسع بما يكفي ليصبح ترتيبه في المؤشر مضلِّلًا، وهو الوحيد بين الاثنين الذي قد ينتهي به الأمر قابلًا للاستضافة الذاتية.

الحاسم الذي يجب مراقبته هو نهاية أكتوبر. إذا وصلت الأوزان بموجب ترخيص متسامح، تتوقف Mistral Large 4 عن منافسة Gemini 3.1 Pro على السعر وتبدأ منافستها على التحكم، وتلك معركة مختلفة. وإذا وصلت بموجب ترخيص تقييدي، فإن إجابة هذا المقال لا تتغير كثيرًا — لكن السبب يتغير.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا