بطاقة عنوان رئيسية مكتوب عليها "GPT-6 مقابل Gemini 3.1 Pro"، مع شريحة مكتوب عليها "Gemini 3.1 Pro: قيد المعاينة منذ 2026-02-19"، وسطرا سعر مكتوب عليهما "GPT-6 Sol $2 / $10" و"Gemini 3.1 Pro $2 / $12"، وتذييل مكتوب فيه "أرقام المؤشر وفقًا لـ Artificial Analysis v4.3.2؛ العناصر المبلّغ عنها من البائع لـ GPT-6 موسومة في النص." شعار OrcaRouter مركّب في الزاوية اليمنى السفلى.
Guides & Insights

GPT-6 مقابل Gemini 3.1 Pro: فئة Pro من Google لم تُطلق نموذجًا جديدًا منذ فبراير

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ظل Gemini 3.1 Pro على قائمة أسعار Google لمدة سبعة أشهر ونصف، ولم يغادر مرحلة المعاينة قط. أُعلن عنه في 19 فبراير 2026، ولا يزال يُقدَّم عبر نقطة نهاية تُسمّى Gemini 3.1 Pro Preview، وحتى اليوم لا يوجد أي التزام بالتوافر العام ولا تاريخ لإيقافه — وهما التاريخان اللذان يخبرانك بموقع النموذج في خطة مزوّده نفسه. أما GPT-6 Sol، فقد طُرح في 22 سبتمبر 2026، وفي 7 أكتوبر 2026 أصبح النموذج الذي يقف وراء المستويات المدفوعة في الإطلاق العالمي لـ ChatGPT إلى أكثر من 1.2 مليار مستخدم أسبوعيًا.

إذن، فالمقارنة الرئيسية ليست بين فئتين رائدتين. إنها بين منتج مطروح في الأسواق ومعاينة مفتوحة النهاية، ويتبيّن أن هذا الفارق يساوي أكثر مما تساويه الفجوة في الاختبارات المعيارية. ضعهما جنبًا إلى جنب على مؤشر الذكاء Intelligence Index v4.3.2 من Artificial Analysis، فتسجّل معاينة Google التي أُطلقت قبل سبعة أشهر 29.7 مقابل 47.6 لـ GPT-6 Sol، بينما تتقاضى 1.25× أكثر لكل مهمة مؤشر مكتملة — 1.30 دولار مقابل 1.04 دولار. كلا هذين الرقمين حقيقيان، وكلاهما يحتاج إلى تحفّظ يُرفَق به قبل أن تنفق المال بناءً عليهما.

ما يجعل هذا جديرًا بالقراءة بدلًا من التهوين منه هو أن هذه النسخة الأولية تحقق انتصارات فعلية. فهي تتفوّق على GPT-6 Sol في GPQA Diamond، وفي τ²-Bench لاستخدام الأدوات الوكيلية، وفي أحد قياسات السياق الطويل — كما أنها تستقبل الصوت والفيديو كمدخلات، وهو ما لا يفعله GPT-6 Sol. إن نسخة أولية عمرها سبعة أشهر وما زالت تفوز باثنتين من أربع جولات ليست نموذجًا يمكن الاستهانة به. إنه نموذج تكمن مشكلته في دورة حياته، لا في قدراته.

الأرقام، والتحذير المتعلق بالمراجعة الذي يجب أن يرافقها

تعيد Artificial Analysis تشغيل مجموعة اختباراتها وتعيد نشر الدرجات وفق مراجعة المؤشر الحالية، ما يعني أن النموذج نفسه قد يحمل رقمين مختلفين تبعًا لوقت قراءتك له. وبالنسبة إلى Gemini 3.1 Pro، يكون هذا التفاوت واسعًا على نحو غير معتاد: فقد ذكرت تغطية سابقة لهذا النموذج الرقم 57 على مراجعة أقدم، بينما تعرض الصفحة كما هي اليوم الرقم 29.7 على v4.3.2. كلا الرقمين حقيقيان وكلاهما موجود على الموقع نفسه.

ذلك مهم لأن الأرقام من نفس المراجعة فقط هي القابلة للطرح. والعددان 29.7 و47.6 هما الزوج الواجب استخدامه هنا، لأن كليهما يأتي من v4.3.2 — نفس التشغيل الذي يمنح Claude Opus 5.5 درجة 57.6 وGPT-6 Astra درجة 52.7. القراءة من التشغيل نفسه، سطر واحد لكل بُعد:

• مؤشر الذكاء، الإصدار 4.3.2 — GPT-6 Sol 47.6 مقابل Gemini 3.1 Pro 29.7
• التكلفة لكل مهمة فهرسة مكتملة — Gemini 3.1 Pro ‏$1.30 مقابل GPT-6 Sol ‏$1.04؛ الطراز الأقدم أغلى بنسبة 25% لكل إجابة مكتملة
• سعر الإدخال — $2.00 لكل مليون على كليهما، متعادلان في السعر المعلن
• سعر الإخراج — GPT-6 Sol ‏$10.00 مقابل Gemini 3.1 Pro ‏$12.00؛ Sol أرخص بنسبة 17%
• بند السياق الطويل — GPT-6 Sol يعيد تسعير الطلب بأكمله عند $4.00/$15.00 فوق 272,000 رمز إدخال؛ Gemini 3.1 Pro ينتقل إلى $4.00/$18.00 فوق 200,000
• نافذة السياق — GPT-6 Sol ‏1,050,000 رمز مقابل Gemini 3.1 Pro ‏1,048,576، متعادلان فعليًا
• الحد الأقصى للإخراج — GPT-6 Sol ‏128,000 رمز مقابل Gemini 3.1 Pro ‏65,536؛ Sol يقارب الضعف
• وسائط الإدخال — GPT-6 Sol نص، صورة، ملف مقابل Gemini 3.1 Pro نص، صورة، صوت، فيديو، PDF

A two-column comparison scoreboard for GPT-6 Sol and Gemini 3.1 Pro, showing GPT-6 Sol at an Intelligence Index of 47.6, $1.04 per index task and a 128,000-token output ceiling, against Gemini 3.1 Pro at 29.7, $1.30 and 65,536 tokens, with input and output prices of $2.00/$10.00 against $2.00/$12.00 and a preview-since-2026-02-19 chip. A footer reads "Index figures per Artificial Analysis v4.3.2; Gemini 3.1 Pro is a preview product."

هناك سطران يستحقان التوسّع لأنهما يقلبان القراءة البديهية. يقول سطر التكلفة لكل مهمة إن بطاقة التسعير التي تبدو أرخص تخصّ النموذج الأكثر تكلفة لكل مهمة منجزة — فسعر مخرجات Gemini 3.1 Pro البالغ 12 دولارًا، مضافًا إليه حجم استدلاله، ينجز عملًا أكثر مما يوحي به سعر مدخلاته المعلن البالغ دولارين. ويستحق بند السياق الطويل إعادة القراءة من الجانبين: فشريحة Gemini 3.1 Pro تبدأ عند 200,000 رمز، وهو أقل من 272,000 لدى GPT-6 Sol، لكنه يعيد تسعير المخرجات إلى 18.00 دولارًا حيث يعيد Sol تسعيرها إلى 15.00 دولارًا. لا يمثّل أي منهما بطاقة تسعير موحّدة، ونقاط التقاطع لا تتوافق.

حيث لا تزال المعاينة تتفوق

نموذج Goo​gle ليس أثرًا من الماضي. اسحب التقييمات التي تحملها كلتا البطاقتين:

• GPQA Diamond — Gemini 3.1 Pro 94.1% مقابل GPT-6 Sol، ولا يوجد رقم مماثل منشور في هذه المراجعة
• استخدام الأدوات الوكيلي في τ²-Bench — Gemini 3.1 Pro 95.6% مقابل GPT-6 Sol، غير منشور على اللوحة نفسها
• استرجاع السياق الطويل — Gemini 3.1 Pro 82.0% مقابل GPT-6 Sol 83.7%، بفارق 1.7 نقطة
• SciCode — Gemini 3.1 Pro 58.7% مقابل GPT-6 Sol 57.6%، متعادلان فعليًا
• Terminal-Bench 4.0 — Gemini 3.1 Pro 4.0% مقابل GPT-6 Sol 43.9%؛ الفئة الوحيدة التي لا تكون فيها النسخة المعاينة تنافسية

A screenshot of the Artificial Analysis leaderboard: the top of the table under the Model, Context Window, Creator, Intelligence Index, Cost per Task, Tokens/s, First Chunk and Response headings - Claude Opus 5.5 (max with fallback) at 58, Claude Sonnet 5.5 at 56, Claude Fable 5.1 at 53, GPT-6 Astra (max) at 53 and $3.26, Gemini 4 Argon (high) at 53 and GPT-6.1 Sol (max) at 52 and $0.72 - with the Gemini 3.1 Pro Preview row set below it, showing an index of 30 at $1.30 per index task, 67M tokens generated and 22M output tokens at 23.40 tokens per second.

تُعد نسبة 94.1% في GPQA Diamond ودرجة 95.6% في استخدام الأدوات الوكيلي أرقامًا طليعية، وليست أرقامًا قديمة، وهي السبب في أن فجوة المؤشر البالغة 17.9 نقطة تبالغ في تقدير المسافة العملية. المؤشر مركّب من عشر تقييمات، وتتركز خسائر Gemini 3.1 Pro حيث تكون المجموعة مُرجّحة بشكل كبير نحو هندسة البرمجيات — يُعد Terminal-Bench 4.0 بنسبة 4.0% قيمةً شاذة كارثية مقارنةً بنسبة 58.7% في SciCode و73.8% في Terminal-Bench 2.1. النموذج الذي يسجل قريبًا من القمة في أحد المعايير الوكيلية وقريبًا من القاع في المعيار الذي يخلفه إنما يخبرك عن تاريخ تدريبه، وليس عن سقفه.

يُعدّ إدخال الصوت والفيديو الميزة الملموسة الأخرى، وهو بوابة وليس تدرّجًا. إذا كانت خط أنابيبك يتلقى تسجيل اجتماع أو لقطة شاشة كمدخل، فيمكن لـ Gemini 3.1 Pro الدخول إليه بينما لا يستطيع GPT-6 Sol ذلك. ولا يعوّض عن ذلك أي قدر من الريادة في المؤشرات.

ما الذي تكلفك إياه عبارة "لا يزال في وضع المعاينة"، على نحو ملموس

حالة المعاينة ليست تسمية تجميلية، والتكاليف من النوع الذي لا يظهر إلا بعد أن تكون قد بنيت على شيء ما.

نقطة نهاية المعاينة لا تحمل أي التزام بالتوافر العام، ما يعني أن المورّد لم يَعِد بأن النموذج سيظل متاحًا وفق جدول زمني يمكنك التخطيط على أساسه. كما أنها لا تحمل تاريخ إيقاف تشغيل، وهو ما يبدو الجانب الجيد من ذلك — فلا شيء يُسحب من الخدمة — لكنه يُقرأ على النحو المعاكس أيضًا: لم تنشر Goo​gle دورة حياة لنموذج ظل في هذه الحالة منذ فبراير بينما كانت تطلق نماذج من فئة Flash طوال الفترة نفسها. Gemini 3.8 Flash وGemini 3.5 Flash-Lite وخط 3.6 و3.8 Flash: بقي مستوى Pro حيث كان، وجاء الخلف بدلًا من ذلك في هيئة Gemini 4 Argon، الذي أعلنت عنه Goo​gle في 30 سبتمبر 2026 عبر طرح تدريجي لمجموعة محددة بالاسم من شركاء الأمن، دون إرفاق أي تاريخ للتوافر العام أيضًا.

هذا هو النمط الذي تدور حوله هذه المقارنة حقًا. إذا بنيت خط أنابيب متينًا على Gemini 3.1 Pro Preview، فأنت تبني على نموذج لم يعلن مورده نفسه متى سيتخرج أو يُستبدل أو يُتقاعد. موقف GPT-6 Sol هو العكس: فهو منتج API متاح عمومًا مع بطاقة أسعار منشورة، ومنذ 7 أكتوبر 2026 أصبح أيضًا الافتراضي في التطبيق الذي يستخدمه معظم زملائك. وفقًا لما ذكره المورد ولم يُعَد إنتاجه بعد، تقول OpenAI إن GPT-6 في ChatGPT يؤلف الإجابات باستخدام النصوص والرسومات والمخططات وعناصر التحكم التفاعلية عبر قدرة تسميها Intelligent UI، وإن الإجابات التي تحتاج إلى بحث ويب تبدأ أسرع بنسبة 44% من GPT-5.6 Instant، وإن مستوى الجهد Extra High يبدأ الاستجابة بنفس سرعة GPT-5.6 عند Medium. لا شيء من ذلك يغيّر تكامل API. كل ذلك هو السبب في أن GPT-6 أصبح الآن الافتراضي المحيط بينما المعاينة ليست كذلك.

يوجد أيضًا نسخة مبسطة من الحجة. أنت تدفع 25% أكثر لكل مهمة مكتملة، عند درجة قدرة أقل، مقابل نموذج دورة حياته غير معلنة. الحجة المضادة حقيقية — فأنت تحصل على GPQA Diamond بنسبة 94.1% ومدخلات صوتية — لكنها حجة محددة لعبء عمل معين، وليست سببًا عامًا لتفضيل النموذج الأقدم.

اختبار معاينة دون المراهنة عليها

الخطأ الذي يجب تجنّبه مع نموذج في موقع Gemini 3.1 Pro هو التعامل مع «هل ينبغي أن نستخدمه» بوصفه قرارًا ثنائيًا واحدًا. وهو ليس كذلك.يقع كلٌّ من Gemini 3.1 Pro Preview وGPT-6 Sol في كتالوج OrcaRouterخلف نقطة نهاية واحدة متوافقة مع OpenAI ومفتاح واحد، بهامش ربح 0% فوق سعر القائمة لدى المزوّد — لذا فإن الإصدار التجريبي شيء يمكنك وضعه في مسار طلب حقيقي، وقياسه مقابل أعباء عملك الخاصة، والإبقاء عليه أو الاستغناء عنه دون عقد مورّد ثانٍ أو تغيير في الشيفرة.

التبديل التلقائي عند الفشل هو ما يجعل ذلك آمنًا لنموذج يمر بدورة حياة المعاينة. وجّه حركة الصوت والفيديو إلى Gemini 3.1 Pro حيث يكون الوحيد بين الاثنين القادر على استقبال المدخلات؛ ووجّه حركة هندسة البرمجيات والمخرجات الطويلة إلى GPT-6 Sol؛ واضبط مسار الاحتياط بحيث إذا أصبحت نقطة نهاية المعاينة مهجورة أو مقيّدة المعدل أو أُعيد تسعيرها بهدوء، يصل الطلب إلى نموذج متاح عمومًا بدلًا من أن يفشل. هذا هو الهيكل الذي يستحقه نموذج معاينة عمره سبعة أشهر — ليس تجنبًا، بل مسار لا يعتمد عليه.

إذا أردت المضي أبعد، فإن routing DSL يركّب عدة نماذج في استدعاء منطقي واحد، بحيث يمكن تجربة الطلب على Gemini 3.1 Pro وGPT-6 Sol واختيار الإجابة وفق معاييرك الخاصة بدل معايير مورّد واحد. ويفعل دمج النماذج الشيء نفسه في الاتجاه المعاكس — لجنة من النماذج تجيب عن سؤال واحد — وهو أسلوب معقول لمعرفة أين تستحق نقاط القوة المحددة لإصدار تجريبي أن تدفع مقابله قبل تخصيص مسار إنتاجي له.

A screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview, showing the Google vendor label, a 2026-02-19 release date, a 1M-token context window, a 65K-token maximum output, text, image, audio, video and file input, and pricing of $2.00 per million input tokens and $12.00 per million output tokens.

الحكم، والرقم الجدير بالمتابعة

للعمل الجديد، يُعد GPT-6 Sol الخيار الأكثر أمانًا في أربعة من الأبعاد الستة التي تحدد عملية النشر، وهو أرخص لكل مهمة منجزة بينما يسجل أعلى بـ 17.9 نقطة مؤشر في نفس المراجعة. أما بالنسبة لأعباء العمل التي تحتاج إلى إدخال صوتي أو مرئي، أو حيث تكون نسبة 94.1% في GPQA Diamond هي ما تشتريه، فإن Gemini 3.1 Pro Preview لا يزال يفوز، وتسمية المعاينة تشكل خطرًا يجب إدارته بدلًا من أن تكون سببًا للانسحاب.

الرقم الذي يجب مراقبته ليس المؤشر. بل هو التاريخ الموجود في اسم نقطة نهاية Gemini 3.1 Pro. عندما تُزال لاحقة المعاينة — أو عندما يصل Argon إلى الإتاحة العامة بمعرّف API حقيقي — يتغيّر شكل هذه المقارنة بالكامل، وتصبح الفجوة البالغة سبعة أشهر بين آخر إصدار لفئة Pro واليوم هي محور المقال.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا