
Dots مقابل Gemini 3.1 Pro: وكيل يمتلك سطح مكتبًا في مواجهة نموذج يمتلك خمس حواس
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 349 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 210 tok/s
- OrcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- xAISpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
The word "multimodal" hides the real difference between these two, so start with what each one does with the world. Gemini 3.1 Pro Preview is Google's flagship reasoning model, released in preview on February 19, 2026: it accepts text, images, audio, video and files as input and returns text, works across a 1,048,576-token context window with up to 65,536 tokens of output, and costs $2.00 per million input tokens and $12.00 per million output tokens below a 200,000-token prompt, repricing to $4.00 and $18.00 above it. Dots is the company's always-on agent, announced at DevDay on September 29, 2026: an agent with its own cloud computer and browser that works across more than 4,000 connected apps, runs on GPT-6 Astra, and comes included with Pro and Business Premium. Gemini 3.1 Pro watches the world and describes it; a dot acts inside it. Those are different verbs, and almost every practical question about this pair follows from which verb your problem needs.
المدخل ليس هو الفعل
دعم Gemini 3.1 Pro للوسائط واسع حقًا — يمكن أن يصل تسجيل مدته ساعتان، وصورة منتج، وتصدير جدول بيانات، وعقد في الطلب نفسه — لكن كل واحد من هذه المدخلات شيء كان موجودًا بالفعل قبل الاستدعاء. مخرجات النموذج نصية: إجابة، أو استخراج، أو خطة، أو مسودة. لا شيء خارج المحادثة يتغير لأن النموذج عمل.
نقطة تعكس ذلك. مدخلاتها عادية — رسائلك، بيانات تطبيقك، مهمة وصفتها — ومخرجاتها تغيير في العالم: ملف تم نقله، تذكرة تم تحديثها، رسالة أُرسلت بعد موافقتك، صفحة فُتحت في متصفحها الخاص. تصف مواد إطلاق OpenAI أنها تحمل عدة مشاريع إلى الأمام في وقت واحد، وتتعلم من الملاحظات، وتقبل مهامًا جديدة دون سلسلة جديدة. هذا وصف لعامل، وليس لنموذج، وهو يفسر لماذا لم تنشر OpenAI أي معيار قياس له: أنت لا تقيس زميلًا على لوحة صدارة، بل تراقب ما ينجزه وتتحقق من Activity View.
• ما الذي يستقبله — الرسائل وأوصاف المهام وبيانات التطبيقات المتصلة من جهة؛ والنص والصورة والصوت والفيديو والملف من جهة أخرى
• ما ينتجه — تغييرات داخل برامج أخرى، خاضعة لقواعد وبوابات موافقة، مقابل نص تتولى التعامل معه بنفسك بعد ذلك
• أين يعمل — حاسوب OpenAI السحابي المزوّد بمتصفح خاص به، معزول عن جهازك ما لم تربط بينهما، مقابل البنية التحتية لخدمات Google، ويمكن الوصول إليه عبر API من أي مكان تريده
• السياق — غير موثّق بشأن نقطة، مقابل 1,048,576 رمزًا في الإدخال و65,536 رمزًا في الإخراج
• الأدلة — عروض توضيحية من المورّد، دون معيار مرجعي مستقل، مقابل مؤشر الذكاء Artificial Analysis Intelligence Index البالغ 29.7 مع 94.1 على GPQA Diamond و82 على استرجاع السياق الطويل، مُدرَج بشكل مستقل عن Google
ما الذي يجعل Gemini 3.1 Pro يستحق الاقتناء
السبب في الاحتفاظ بنموذج كهذا هو أن الإدراك أمر صعب، ومعظم الوكلاء سيئون فيه. الملف المستقل المنشور لـ Gemini 3.1 Pro غير معتاد: نتيجة 94.1 على GPQA Diamond قريبة من الطليعة، و82 على استرجاع السياق الطويل هو ثاني أفضل رقم في مجموعة النماذج التي ندرجها، و58.7 على SciCode تضعه على قمة ذلك الجدول بعينه. أما حيث لا يتألق فهو في اتخاذ القرارات الوكيلية — درجة 95.6 على τ²-Bench محترمة، لكن شريحته الخاصة بالخدمات المصرفية τ-banking، تلك التي تقيس استخدام الأدوات متعدد الخطوات مع أنظمة بنك ما، تبلغ 21.4. كل هذه قياسات من طرف ثالث مدرجة مقابل مصدرها في فهرسنا، وليست أرقامًا من المورّد، وهذا هو سبب كونها أعلى قيمة من عرض تقديمي للإطلاق.
النصف الآخر من قصة التسعير لكل طلب هو أن النموذج ليس مجانيًا. دخل مرحلة المعاينة في فبراير، قبل أشهر من طرح النموذج الرائد الحالي، وهو مسعّر فوق الفئة الرخيصة: $2.00 و$12.00 لكل مليون توكن يعادلان تقريبًا $0.0006 من الإدخال لكل صفحة من نص كثيف، وهو لا شيء حتى تشغّل استيعاب فيديو على مكتبة كاملة، وعندها يصبح بندًا في الفاتورة. قراءة إطار واحد من الفيديو تكلّف مثل قراءة فقرة، وسيفوتر عليك النموذج الاثنين بكل سرور.

نموذجا تكلفة يرفضان التحوّل
تكلفة dot هي اشتراك بحصة غير معلنة: أول dot مشمول مع Pro أو Business Premium، وتُطبّق حدود موسّعة في الشهر الأول، ولا تستهلك المحادثات مع dot الخاص بك حدود استخدام ChatGPT، ولا يوجد سعر منشور لـ dot ثانٍ، أو لسرعة أو سعة إضافية، أو لمهمة منجزة. يذكر تقرير CNBC عن الكلمة الرئيسية أن سارة فراير تسعّر فئة Pro 500 الجديدة البالغة 500 دولار كحصة استخدام بالإضافة إلى وضع Ultrafast بدلًا من سعر لكل dot، لذا فإن أغلى خطة على قائمة OpenAI لا تنتج أيضًا تكلفة لكل وحدة من عمل الوكيل.
Gemini 3.1 Pro يحوّل كل شيء إلى رموز، بما في ذلك الأجزاء التي ليست نصًا. يتم احتساب الصوت والفيديو والصور كمدخلات، لذا فإن تكلفة المهمة تعتمد على مقدار ما جعلت النموذج ينظر إليه من العالم — خاصية مفيدة، لأنك تستطيع قياسها، وخاصية خطيرة، لأن أكبر رقم في الفاتورة غالبًا ما يكون الرقم الذي لم يخطط له أحد. يساعد توجيه النماذج هنا بطريقة محددة وليست عامة: مع أكثر من 200 نموذج خلف مفتاح واحد بسعر القائمة لدى المزود وبدون هامش ربح، يمكن أن تقع القراءة متعددة الوسائط المكلفة والعمل التالي الرخيص على نماذج مختلفة في نفس خط الأنابيب، ويصل تغيير السعر من Google إلى حسابك في نفس اليوم بدلاً من وقت التجديد.

حيث يعمل الاثنان معًا
الاقتران الطبيعي هو dot ينسّق ونموذج متعدد الوسائط يُدرك. تصل الأعمال، ويقوم dot بتوجيهها: أي شيء يحتاج إلى النظر إليه أو الاستماع إليه يذهب إلى Gemini 3.1 Pro للحصول على وصف منظّم، ثم يعود الوصف إلى سير العمل حيث يمكن لجدول أو قاعدة أن تتخذ إجراءً بشأنه. يتولى dot المتابعة؛ ويتولى النموذج القراءة. هذا الفصل بهذه الطريقة يُبقي أيضًا استدعاءات الوسائط المكلفة قابلة للتدقيق، وهذا مهم لأنها هي التي تفاجئ الناس.
على OrcaRouter، يُوجَّه النموذج بوصفه google/gemini-3.1-pro-preview بسعر قائمة المزوّد المارّ دون أي هامش ربح (0%)، إلى جانب بقية الكتالوج، مع تحويل تلقائي عند الفشل بين المزوّدين upstream عندما يتدهور أحدهم، ولغة توجيه (DSL) لتأليف عدة نماذج في نداء واحد. ومن الدقة أن نوضّح ما لا يشمله ذلك: فـ dots ليست في كتالوجنا، ولا توجد نقطة نهاية (endpoint) لأيٍّ منها، ولا يوجد أي معرّف نموذج يمكن توجيه طلب إليه. إن أردت طبقة الإدراك تحت إدارتك أنت — ونموذج معاينة من فبراير هو بالضبط نوع الاعتماد الجدير بأن يكون تحت إدارتك — فإن النموذج ينتمي إلى ما خلف نقطة النهاية، ويبقى الوكيل حيث استأجرته.
أي فعل تحتاجه مشكلتك؟
إذا تضمّن العمل النظر إلى شيء ما أو الاستماع إليه وإنتاج إجابة، فالأداة هي Gemini 3.1 Pro، وdot هو الشراء الخاطئ. وإذا تضمّن العمل إنجاز شيء ما عبر عدة تطبيقات دون أن تقود العمل بنفسك، فالأداة هي dot، ولا يغني عنها أي قدر من المدخلات متعددة الوسائط. الفرق التي تحسن فعل ذلك تشغّل كليهما وتحافظ على الحد صريحًا: الإدراك على نموذج محدد الاستهلاك يمكنك قياسه، والتنفيذ خلف منتج يمكنك إلغاؤه.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
