بطاقة رئيسية مُولّدة لمقالة 'Reflection Beam مقابل Gemini 3.1 Pro Preview: أحدهما يقرأ الفيديو، والآخر يقرأ النص'، بعنوان 'Reflection Beam مقابل Gemini 3.1 Pro Preview' وعنوان فرعي 'أحدهما يقرأ الفيديو، والآخر يقرأ النص' وثلاث شرائح نصية: 'نص فقط مقابل خمس وسائط'، و'سياق 256K مقابل سياق 1M'، و'بلا سعر مقابل تعرفة متدرجة'.
Guides & Insights

Reflection Beam مقابل Gemini 3.1 Pro Preview: أحدهما يقرأ الفيديو، والآخر يقرأ النص

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ابدأ باللاتماثل الذي لا يذكره أي جدول قياس أداء في هذه المواجهة. Reflection Beam، الذي أُعلن عنه في 5 أكتوبر 2026، هو نموذج خليط خبراء متناثر يضم 501 مليار معامل، مع 23 مليار معامل نشط لكل رمز، ويستقبل النص ويعيد النص. لا شيء آخر. Gemini 3.1 Pro Preview، النموذج الرائد متعدد الوسائط لدى المورّد منذ 19 فبراير 2026، يقبل النص والصور والفيديو والصوت والملفات، وهو النموذج الوحيد في هذه المقارنة الذي تختلف فيه إجابة السؤال «هل يمكنه رؤية الشيء الذي أريد السؤال عنه؟» باختلاف الطرف. كل ما عدا ذلك — نسب التناثر، ونوافذ السياق، وفئات الأسعار — هو جدال. أما ذلك فهو مواصفة.

ويعني ذلك أيضًا أن هذا هو الزوج الأقل تناظرًا في المجموعة، والأكثر فائدة، لأنه يكشف الغرض الفعلي من مقارنة النماذج. إذا كان عبء العمل لديك نصيًا، فإن Beam وGemini 3.1 Pro خياران على طيف يمتد من الرخيص وغير المُقاس إلى المكلف والمُقيَّم تقييمًا شاملًا. وإذا كان عبء العمل لديك يتضمن إطارًا من الفيديو، فلا مجال للمقارنة.

ما هو كل نموذج

Gemini 3.1 Pro Preview هو الطراز الرائد من فئة المعاينة لدى Google: سياق يبلغ 1,048,576 رمزًا، وحدّ أقصى للإخراج يبلغ 65,536 رمزًا، وخمس طرائق إدخال، ونافذة تبلغ مليون رمز يتم الوصول إليها عبر سلّم أسعار بدلًا من سعر موحّد. تضع Google هذا الطراز في مكانةٍ تتيح هندسة برمجيات محسّنة، وموثوقية وكيلية أفضل، واستخدامًا أكثر كفاءةً للرموز في سير العمل المعقّد. وهو ليس مفتوح الأوزان. ولا يزال اسمه يحمل "Preview"، وهي حالة أبقتها Google على هذا الطراز منذ فبراير.

Reflection Beam هو أول نموذج لـ Reflection وبداية سلسلة مفتوحة الأوزان. 501 مليار معامل إجمالي، 23 مليار نشط — حوالي 4.6 بالمائة من النموذج نشط لكل رمز. 23.8 تريليون رمز تدريب مسبق على 6,144 شريحة GB300 في أقل من أربعة أسابيع، ثم حملة تعلم معزز على 10,500 شريحة GB300 لمدة أربعة أسابيع مع أكثر من 100 مليون عملية تشغيل عبر ما يقرب من مليون بيئة. واجهة API الخاصة به متوافقة مع OpenAI على api.reflection.ai/openai/v1 مع Chat Completions وقائمة Models، سياقه 256,000 رمز مع حاشية بيتا، معامل reasoning_effort الخاص به له خمسة مستويات ولا يوجد مفتاح إيقاف، وأوزانه موعودة في وقت لاحق من هذا الشهر تحت Apache 2.0.

• الوسائط — يقبل Gemini 3.1 Pro Preview النص والصورة والفيديو والصوت والملف؛ بينما يقبل Reflection Beam النص فقط.

• السياق والمخرجات — 1,048,576 رمز إدخال و65,536 رمز إخراج لـ Gemini، مقابل 256,000 رمز إدخال و128,000 رمز إخراج لـ Beam.

• السعر — Gemini 3.1 Pro Preview بسعر 2.00 دولار للمدخلات و12.00 دولارًا للمخرجات لكل مليون توكن حتى 200,000 توكن، ويرتفع إلى 4.00 و18.00 دولارًا فوق ذلك، مع قراءات ذاكرة التخزين المؤقت بسعر 0.20 دولار؛ ولا يوجد سعر معلن لـ Reflection Beam.

• سطح الأدوات — استدعاء الأدوات الأصلي، والمخرجات المهيكلة، والاستناد إلى البحث من جانب Google؛ واستدعاء الأدوات والمخرجات المهيكلة من جانب Beam، مع نقطة نهاية مقتصرة على Chat Completions.

• الأوزان — مملوكة لـ Gemini؛ ورخصة Apache 2.0 موعودة لـ Beam، ولم تُصدر بعد.

• درجة مستقلة — Gemini 3.1 Pro Preview يحمل مؤشر Artificial Analysis؛ ولا يوجد لـ Beam صف على اللوحة.

فجوة الوسائط هي الحجة بأكملها

يجدر بنا أن نكون محددين بدلًا من مجرد الإشارة إلى «متعدد الوسائط»، لأن التبعات العملية محددة.

عبء عمل يستقبل تسجيل شاشة، أو صورة منتج، أو عقدًا ممسوحًا ضوئيًا، أو ملفًا صوتيًا لمركز اتصال لا يمكن أن يخدمه Beam بأي سعر، ومع أي موجّه، وعلى أي خطة. لا يوجد حل بديل على مستوى API: فتوثيق Beam يصف نمط إدخال واحدًا ونمط إخراج واحدًا، ولا يُدرج أي مسار للصور أو الصوت. أما Gemini 3.1 Pro Preview فيتعامل مع الخمسة جميعًا، ما يعني أنه النموذج الوحيد هنا الذي يمكن إدراجه في سير عمل يكون فيه الإدخال غير نصي أصلًا.

الحالة العكسية جديرة بالذكر أيضًا، لأنها الحالة التي يخطئ فيها الناس. إذا كان مدخلك نصًا وسيبقى نصًا، فإن الوسائط الخمس لدى Gemini لا تجلب لك أي فائدة، وأنت تدفع ثمن نموذج متعدد الوسائط لتشغيل عبء عمل نصي. وهذا ليس حجة لصالح Beam — بل هو حجة على أن مسألة الوسائط ينبغي حلها قبل مسألة الاختبار المعياري، لأنها تستبعد الخيارات بتكلفة أقل وبموثوقية أكبر مما تفعله أي مقارنة درجات.

معاينتان، معنيان مختلفان

يحمل كلٌّ من اسمَي الطرازين تحفّظًا، والتحفّظان ليسا متشابهين، وهذا هو أكثر ما يثير الاهتمام في هذا الاقتران.

إنّ كلمة "Preview" في «Gemini 3.1 Pro» ليست سوى اصطلاح تسمية لطرازٍ أصبح قابلًا للاستدعاء عمومًا منذ فبراير، وله درجة تقييم مستقلة، وبطاقة أسعار منشورة تتضمن فئة موثّقة للسياق الطويل، وسطح أدوات كامل. وعمليًا، تعني كلمة "preview" هنا أن غوغل تحتفظ بحق استبداله، لا أنه صعب المنال أو غير مُقيَّم.

نسخة Beam التجريبية (بيتا) بوابة حقيقية. فالوصول يتم عبر قائمة انتظار، وقد أُنشئ معرّف النموذج في 5 أكتوبر 2026، ولا توجد قائمة أسعار، ولا تقييم من طرف ثالث، والمواد التي قد تتيح لأي شخص التحقق من الادعاء المركزي — الأوزان، والتقرير الفني، وبطاقة النموذج — موعودة لا مُسلَّمة. ويحمل رقم طول السياق حاشية تحذّر من أنه قد يتغير خلال فترة البيتا، وهو تحوّط لا يحتاجه أي نموذج متاح عمومًا.

النتيجة غير متناظرة على نحوٍ يهم المشتريات. الفريق الذي يتبنّى Gemini 3.1 Pro Preview يقبل مخاطر تقلّب النموذج. والفريق الذي يتبنّى Beam اليوم يقبل سعرًا غير معروف، وتقييمًا مستقلًا غير معروف، وعدم القدرة على تشغيل النموذج بنفسه. هذه فئات مختلفة من المخاطر، والسعر هو العامل الذي يحسم القرار في أغلب الأحيان.

A generated two-column scoreboard titled 'Reflection Beam vs Gemini 3.1 Pro Preview — the scoreboard'. Left column 'Reflection Beam': Input modalities text only; Context 256,000 tokens (beta); Max output 128,000 tokens; Price not published; Availability waitlisted beta; Independent score none yet. Right column 'Gemini 3.1 Pro Preview': Input modalities text, image, video, audio, file; Context 1,048,576 tokens; Max output 65,536 tokens; Price $2.00 / $12.00 to 200K, then $4.00 / $18.00; Availability preview, callable since February 2026; Independent score AA index 29.7. Footer reads 'Beam figures vendor-reported and unaudited. Gemini price is the provider list rate; its index is Artificial Analysis, read 6 October 2026.'

الاختبارات المعيارية، ومشكلة الاستشهاد

لا تتضمن جداول إطلاق Reflection نموذج Gemini 3.1 Pro Preview أو أي نموذج من Google. مجموعة المقارنة الخاصة به مفتوحة وشبه مفتوحة فقط: Inkling، وNemotron 3 Ultra، وGLM 5.2، وGLM 5.3، وKimi K3، وQwen 3.8-Max، وDeepSeek V4.1 Flash. لذلك لم يتم تشغيل النموذجين مطلقًا مقابل بعضهما البعض في جدول منشور، والأرقام أدناه تأتي من أُطر اختبار مختلفة لدى كلا الجانبين.

• مؤشر الذكاء من {{KEEP}}Artificial Analysis{{/KEEP}} — يسجّل {{KEEP}}Gemini 3.1 Pro Preview{{/KEEP}} نتيجة 29.7، في المرتبة 58 من أصل 147 في تشغيله. ولا يملك {{KEEP}}Beam{{/KEEP}} أي صف في المؤشر على الإطلاق.

• GPQA Diamond — Gemini 3.1 Pro Preview بنسبة 94.1 وفقًا لـ Artificial Analysis مقابل 90.5 المُبلَّغ عنها من قِبل مورّد Beam.

• SciCode — 58.7 لـ Gemini مقابل 49.7 المُعلَنة من مورّد Beam.

• Humanity's Last Exam — 47.0 لـ Gemini مقابل 36.2 التي أعلنها المورّد Beam، وهذه الأخيرة صراحةً بدون أدوات.

• Terminal-Bench v2.1 — 73.8 لـ Gemini وفق Artificial Analysis مقابل 80.1 التي أعلنها مورّد Beam. هذا أقوى صف لـ Beam في المواجهة، وهو حصاد ضد نموذج موجود في السوق منذ فبراير.

• استرجاع السياق الطويل — 82.0 لـ Gemini مقابل 79.3 المعلَنة من مورّد Beam على AA-LCR.

• tau-squared Bench — 95.6 لـ Gemini مقابل 78.7 لـ Beam على MCP Atlas و38.0 على tau3 banking. تقييمات مرتبطة باستخدام الأدوات الوكيلية، وليست التقييم نفسه، ولفرق التسمية أهمية.

هناك مشكلة صدق منفصلة في الجانب الخاص بـ Gemini في هذا الجدول تستحق جملة خاصة بها. فقد استُشهد بدرجات مؤشر مستقلة لـ Gemini 3.1 Pro Preview عند 30 و46 و47.7 و57 عبر مصادر مختلفة، كما يعرض Artificial Analysis مراجعات مختلفة للمؤشر على صفحات نماذج مختلفة في اللحظة نفسها. ورقم 29.7 أعلاه هو الرقم الموجود في الصفحة التي قرأناها في 6 أكتوبر 2026، وهو الرقم الوحيد الذي سنقتبسه — لكن أي مقال يضع رقم مؤشر Gemini واحدًا بجانب منافس دون أن يذكر اللقطة المرجعية التي جاء منها فهو يقدّم رقمًا عائمًا كأنه رقم ثابت. وينطبق التحذير نفسه، لكن بالعكس، على Beam، حيث لا توجد لقطة مرجعية على الإطلاق.

السعر، والفئة التي لا يخطط لها أحد

يبلغ سعر Gemini 3.1 Pro Preview دولارين للإدخال و12.00 دولارًا للإخراج لكل مليون توكن حتى 200,000 توكن، و4.00 دولارات و18.00 دولارًا فوق ذلك. تبلغ قراءات ذاكرة التخزين المؤقت 0.20 دولار لكل مليون، وكتابات ذاكرة التخزين المؤقت 0.375 دولار. الحد الفاصل بين الطبقتين هو الجزء الذي يستحق التخطيط على أساسه: فأبرز نقاط البيع في النموذج هي نافذة سياق تبلغ 1,048,576 توكن، وبمجرد أن يتجاوز الطلب 200,000 توكن يتضاعف سعر الإدخال ويرتفع سعر الإخراج بمقدار النصف. وبالتالي، فإن عبء العمل المصمم حول نافذة المليون توكن هو عبء عمل يُسعَّر وفق الطبقة الثانية في معظم حركته، وليس الطبقة الأولى.

لا تملك Beam بطاقة أسعار، لذا لا توجد فئة يمكن نمذجتها ولا شيء يمكن المقارنة به. هذا الغياب ليس محايدًا: فهو يعني أن أرخص تصريح يمكن الدفاع عنه بشأن تكلفة Beam هو أنها مجهولة، وأن الدعم الكمي الوحيد لموقعتها من حيث الكفاءة هو مخطط Reflection نفسه، الذي يقدّر الـFLOPs المولّدة بأنها ضعف عدد المعاملات النشطة مضروبًا في متوسط الرموز المولّدة لكل محاولة عبر DeepSWE وHLE وTerminal-Bench 2.1 — مع تعليق توضيحي يعترف باستبعاد التعبئة المسبقة للمطالبات والانتباه وأعباء تقديم الخدمة. في أحمال العمل التي يكون فيها سياق بمليون رمز مهمًا، ليست التعبئة المسبقة مجرد خطأ في التقريب، وهي بالتحديد الحد الذي تُسقطه المعادلة.

A screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), captured 6 October 2026, showing the model name and id, the INPUT $2.00 and OUTPUT $12.00 pricing tiles, p50 TTFT 10.00 s, p95 TTFT 10.00 s, 13.9M tokens of 7-day traffic, the provenance lines 'Public benchmarks by Google - 2026-02-19' and 'AI Analysis', the summary describing a frontier reasoning model with improved agentic reliability, and a code sample using base_url https://api.orcarouter.ai/v1.

استخدام الأدوات والبحث وأوجه اختلاف التصميمين

تتمثل نقاط القوة المعلَن عنها في Gemini 3.1 Pro Preview في هندسة البرمجيات، والموثوقية الوكيلية، وكفاءة الرموز، كما تشمل واجهة الأدوات المنشورة له استدعاء الدوال، والمخرجات المهيكلة، والاستناد إلى البحث. وهذا البند الأخير هو ما ينبغي ملاحظته لكل من يقارن بين منظومات الوكلاء: فالاستناد إلى البحث قدرة من الطرف الأول لدى Google، وهو يغيّر ما يستطيع وكيل يستخدم الأدوات فعله دون توصيل خدمة استرجاع خارجية به.

قصة أدوات Beam أكثر إثارة للاهتمام مما يوحي به سطر المواصفات وأصعب في التقييم. يُفيد Reflection بأن MCP Atlas عند 78.7، وAutomationBench العام عند 37.0، وtau3 المصرفي عند 38.0، وBrowseComp مع إدارة السياق عند 77.4، وDeepSearchQA مع إدارة السياق عند 80.1 — ويشير إلى أنه أثناء التعلم المعزز تعلم النموذج تلقائيًا أن يستعلم من نماذج لغوية أخرى وأن يستدعي واجهات برمجة تطبيقات OCR عند منحه وصولًا إلى الويب، رغم غياب مهام التصفح من مزيج التدريب. إذا صح هذا التعميم، فهو إشارة حقيقية حول النقل الوكيلي. وهو أيضًا، في هذه المرحلة، ملاحظة مورّد من جولة تدريب، دون أي تحقق مستقل.

في صفوف استخدام الأدوات حيث يمتلك الطرفان أرقامًا، تبدو الصورة مختلطة لا أحادية الجانب. يضع جدول المورّد الخاص بـ Beam إياه متقدمًا على GLM 5.2 في MCP Atlas، ومتعادلًا مع GLM 5.2 وKimi K3 في tau3 banking، بينما تُعد نتيجة Gemini في tau-squared Bench البالغة 95.6 أعلى رقم وكيلي نشره أي من الطرفين. مجموعات اختبار مختلفة، وأطر اختبار مختلفة، ولا يوجد تقييم مشترك — وهذه هي المشكلة المتكررة في هذه المقارنة.

الاختيار، وكيفية التحوّط

قاعدة القرار التي تنتج مما سبق بسيطة بما يكفي لقولها في سطر واحد: إذا كان أي مُدخل ليس نصًا، فإن Beam ليس خيارًا وقد انتهت المقارنة. وإذا كان كل مُدخل نصًا، يصبح السؤال هو ما إذا كان ادعاء Beam بالكفاءة غير الموثّق يستحق سعرًا غير معروف ولا تقييم مستقل، في مقابل نموذج يكلّف 2.00 دولار و12.00 دولار مع سلّم موثّق وسطح أدوات كامل.

Gemini 3.1 Pro Preview متاح في كتالوجنا، بسعر القائمة الخاص بالمزوّد كما هو دون أي إضافة، خلف مفتاح واحد متوافق مع OpenAI على api.orcarouter.ai/v1 إلى جانب أكثر من 200 نموذج آخر — والمفتاح نفسه يخدم النماذج التي تنافسها Beam في السعر، من GLM 5.3 بسعر 1.26 دولار و3.96 دولار إلى DeepSeek V4.1 Flash بسعر 0.15 دولار و0.60 دولار، كما قُرئت مباشرةً هذا الصباح. ولأن الحدّ الفاصل بين الطبقتين عند 200,000 رمز هو مشكلة توجيه لا مشكلة نموذج، فإن لغة التوجيه DSL تتيح لك التعبير عن ذلك مباشرةً: أبقِ الطلبات القصيرة على الطبقة الأرخص، وثبّت الطلبات الطويلة حقًا حيث تكون سعة النافذة هي سبب اختيارك للنموذج، في نداء واحد بدلًا من كود التطبيق.

Reflection Beam ليس أحد مساراتنا، ولن نوجّهك إلى أي شخص يدّعي امتلاكه. إذا وصلت أوزان Apache 2.0 هذا الشهر كما وُعد، تصبح الاستضافة الذاتية خيارًا ثالثًا للعمل النصي فقط، ويصبح ادّعاء الكفاءة قابلًا للاختبار على عتادك الخاص.

A generated single-column card titled 'Reflection Beam — the state of play, 6 October 2026', used as the article's closing fact sheet. Rows read 'Total / active parameters: 501B / 23B', 'Pre-training: 23.8T tokens on 6,144 GB300, under four weeks', 'RL campaign: 10.5K GB300, 4 weeks, 100M+ rollouts', 'API context: 256,000 tokens, beta footnote', 'Reasoning effort: five levels, default medium, no off switch', 'Price: not published anywhere' and 'Independent score: none yet - no Artificial Analysis row'. The footer reads 'Vendor-reported; nothing independently reproduced. Weights, tech report and model card promised later this month.'

ما الذي سيغيّر الإجابة؟

تستند حجة Beam ضد Gemini إلى العنصرين نفسهما اللذين تقوم عليهما كل مقارنة خاصة بـ Beam، وتضيف هذه المواجهة عنصرًا ثالثًا.

سعر. فبدون سعر، لا يمكن تحويل حجة الكفاءة إلى قرار ميزاني، ويصبح النموذج يتنافس على رسم بياني بدلًا من بطاقة أسعار.

نتيجة مستقلة. قالت Artificial Analysis في 5 أكتوبر إن Reflection منحتها حق الوصول وإنها كانت تختبر Beam، وواصفةً المؤشرات المبكرة بأنها تشير إلى أن Beam سيكون واحدًا من أكثر النماذج المفتوحة كفاءةً في استخدام التوكنات التي رأتها بالنسبة لمستوى ذكائه. هذا هو المصدر الصحيح يقول الشيء الصحيح، ومع ذلك لا يزال لا يوجد صف لـ Beam على اللوحة — فصفحات النموذج تُرجع 404، ولا تحمل لوحة الصدارة أي إدخال لـ Beam حتى صباح هذا اليوم.

والشيء الذي لا يتغير: Beam نصي فقط. لا إصدار أوزان، ولا خفض سعر، ولا درجة مؤشر تغيّر ذلك، ما يعني أنه لفئة كاملة من أعباء العمل لن تتحول هذه المقارنة إلى مقارنة على الإطلاق. إذا كان خط أنابيبك يحتوي على فيديو، فقد كانت الإجابة Gemini 3.1 Pro Preview قبل أن يُحمَّل أول اختبار أداء.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا