بطاقة عنوان رئيسية تحمل النص "Gemini 4 Argon مقابل GPT-6 Astra"، مع شريحة تحمل النص "المؤشر 52.6 مقابل 52.7" وشريحة تحمل النص "التكلفة لكل مهمة مؤشر $1.99 مقابل $3.26"، وسطر تذييل يقول "أرقام Argon كما أبلغ عنها المورّد؛ أرقام المؤشر والتكلفة وفق Artificial Analysis، 2026-09-30."
Guides & Insights

Gemini 4 Argon مقابل GPT-6 Astra: تعادل تام في المؤشر، وخطوة سعرية تقطع ثلثي الطريق نحو الانخفاض

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

نموذجان رائدان، يفصل بينهما 0.11 نقطة على مؤشر Intelligence Index الصادر عن Artificial Analysis. يسجّل Gemini 4 Argon نتيجة 52.56. ويسجّل GPT-6 Astra نتيجة 52.67. إذا كان عليك الاختيار بينهما بناءً على القدرة العامة المقيسة، فيمكنك أن تقلب عملة معدنية، والفرق بين النتيجتين أصغر من فاصل الثقة لأي منهما. هذا موقف نادر حقًا في سوق تمتد فيه أفضل عشرة نماذج على نحو خمس عشرة نقطة إجمالًا، وهو ما يجعل هذه أسهل مواجهات Gemini 4 Argon من حيث التفكير فيها، لأن الحجة المتعلقة بالقدرة تنتهي قبل أن تبدأ، وكل ما يتبقى هو الاقتصاد والوصول.

لكنّ الاثنين ليسا توأمين. أُعلن عن Argon في 2026-09-30 من قبل Google DeepMind، ويُطرح على مراحل، بدءًا من المدافعين السيبرانيين الموثوقين في Fairwind Program. طُرح GPT-6 Astra في أوائل سبتمبر — وتؤرخ بطاقة كتالوجنا له في 2026-09-04، وتدرجه Artificial Analysis في 2026-09-03 — وهو مسار حي يمكنك استدعاؤه بعد ظهر اليوم مقابل 10 دولارات للإدخال و50 دولارًا للإخراج لكل مليون توكن، مع نافذة سياق تبلغ 1,050,000 توكن وسقف إخراج يبلغ 128,000 توكن. أحد هذين النموذجين له سعر يمكن محاسبتك بناءً عليه اليوم.

أين تكون فجوة 0.11 نقطة حقيقية وأين تكون مجرد ضجيج

المؤشر مركّب، لذا فإن نموذجين يتعادلان على المركّب قد يختلفان اختلافًا ذا دلالة في مكوّناته. وهنا تتفق المكوّنات في الغالب، مع ثلاثة استثناءات تجدر الإشارة إليها.

• Terminal-Bench 4.0 — GPT-6 Astra بنسبة 59.1% مقابل Gemini 4 Argon بنسبة 57.1%. تتقدّم Astra بفارق ضيّق.

• الاستدلال طويل السياق — GPT-6 Astra بنسبة 80.7% مقابل Gemini 4 Argon بنسبة 79.7%.

• GPQA Diamond — GPT-6 Astra ‏96.1%. لا تنشر Argon أي رقم على هذه اللوحة.

• CritPt — GPT-6 Astra 31.7% مقابل Gemini 4 Argon 27.1%.

• SciCode — Gemini 4 Argon ‏61.8% مقابل GPT-6 Astra ‏56.5%.

• امتحان البشرية الأخير — Gemini 4 Argon ‏57.1% مقابل GPT-6 Astra ‏54.7%.

• AutomationBench-AA — Gemini 4 Argon ‏77.5% مقابل GPT-6 Astra ‏68.5%.

• GDPval: Gemini 4 Argon 1,611 مقابل GPT-6 Astra 1,542.

• المعرفة الكلية — GPT-6 Astra 43.4 مقابل Gemini 4 Argon 42.4.

• ITBench-SRE — GPT-6 Astra 48.6% مقابل عدم وجود رقم منشور لـ Argon.

• سرعة الإخراج — GPT-6 Astra 51.2 رمزًا في الثانية مقابل Gemini 4 Argon 48.9. متساويان فعليًا.

• زمن استجابة أول رمز على أداة اختبار الفهرس — Gemini 4 Argon 2.8 ثانية مقابل GPT-6 Astra 320.2 ثانية.

تمتلك Astra مزايا في الاستدلال العلمي القائم على الاختيار من متعدد، وفي مسائل الفيزياء المتعلقة بالنقاط الحرجة، وفي معيار SRE. وتمتلك Argon مزايا في البرمجة العلمية، وفي مجموعة المهام الشاملة الأصعب من طرف إلى طرف، وفي العمل المُقيَّم بالناتج المحلي الإجمالي. ولا يتفوق أي منهما بفارق كبير يكفي ليكون أساسًا للترحيل بمفرده.

A two-column scoreboard comparing Gemini 4 Argon and GPT-6 Astra on six dimensions. Gemini 4 Argon reads: AA Intelligence Index 52.6, price $2 / $10 per million tokens, cost per index task $1.99, output ceiling 1M tokens, first token 2.8 s, input modalities text, image, video and files. GPT-6 Astra reads: AA Intelligence Index 52.7, price $10 / $50, cost per index task $3.26, output ceiling 128K tokens, first token 320.2 s, input modalities text, image and files, with a note that its standard rate steps to $20 input and $75 output above 272K input tokens. A footer line reads that Argon figures are vendor-reported and both models' index and cost figures are per Artificial Analysis.

بند الكمون مسألة مختلفة. 320 ثانية حتى أول رمز تعني خمس دقائق ونصفًا من الصمت قبل انبعاث أي شيء، مقابل أقل من ثلاث ثوانٍ لدى Argon. كلاهما يقيس الشيء نفسه — الوقت حتى أول جزء في تشغيلات مؤشر Artificial Analysis — لذا فهذا قابل للمقارنة. استدلال Astra مفعّل دائمًا وقابل للضبط من الجهد المنخفض إلى أقصى جهد؛ وتشغيل بأقصى جهد في مهمة صعبة يفكر حقًا لدقائق قبل أن يتحدث. أما إن كان ذلك عيبًا فيعتمد كليًا على واجهتك. في مهمة دفعية لا يكلف شيئًا. وبالنسبة لأي شيء فيه مستخدم يراقب مؤشر تحميل دوّار، فهو الفرق الأكثر ظهورًا للمستخدم بين هذين النموذجين، وأكبر من أي فجوة في الاختبارات المعيارية على الصفحة.

خطوة السعر، التي هي الموضوع الحقيقي

هنا ينكسر التعادل، وينكسر بطريقة يسهل نمذجتها بشكل خاطئ لأن قائمة أسعار Astra تحتوي على ثلاث شرائح متشابهة.

• قياسي، حتى 272,000 رمز إدخال — GPT-6 Astra ‏10.00 دولار للإدخال / 50.00 دولار للإخراج، والقراءات المخزّنة مؤقتًا بسعر 1.00 دولار، وكتابات الذاكرة المؤقتة بسعر 12.50 دولار.

• سياق طويل، يتجاوز 272,000 رمز إدخال — GPT-6 Astra بسعر 20.00 دولارًا للإدخال / 75.00 دولارًا للإخراج، والقراءات المخزّنة مؤقتًا بسعر 2.00 دولار. يُعاد تسعير الطلب بأكمله وفق الشريحة الأعلى، لا الفائض فقط: ضعف الإدخال و1.5 ضعف الإخراج.

• الوضع السريع — ضعف السعر القياسي المعمول به، أي $20.00 للإدخال / $100.00 للإخراج. هذا هو رقم $100 الذي يُقتبس كما لو كان سعر السياق الطويل؛ لكنه ليس كذلك.

• Gemini 4 Argon — $2.00 للإدخال / $10.00 للإخراج بسعر ثابت على الأساس التمهيدي، والإدخال المخزَّن مؤقتًا بـ $0.10، دون أي شريحة تسعيرية مُعلنة ودون أي فئة سريعة مُعلنة.

إذن، Argon أرخص بخمسة أضعاف في الإدخال وأرخص بخمسة أضعاف في الإخراج من الطبقة القياسية لدى Astra، وأرخص بعشرة أضعاف في الإدخال فوق 272K. وهناك قياسان مستقلان للتكلفة يوضحان النقطة نفسها من زاوية مختلفة: تضع Artificial Analysis تكلفة Argon عند 1.99 دولار لكل مهمة في الفهرس مقابل 3.26 دولار لدى Astra، و2,407 دولار لتشغيل الفهرس بأكمله مقابل 5,324 دولار لدى Astra. نسبة التكلفة لكل مهمة أصغر من نسبة التكلفة لكل رمز للسبب نفسه الذي كان قائمًا في المقارنة مع DeepSeek — إذ يستهلك Argon عددًا أقل من الرموز لإكمال المهمة — لكنها لا تزال 1.6×.

لوحة Vals المرجّحة حسب الناتج المحلي الإجمالي تروي نسخة ثالثة من القصة نفسها: Argon أولًا بنسبة 68.90% و15.68 دولارًا لكل تشغيل، وAstra سادسًا بنسبة 63.13% و18.46 دولارًا. Astra أغلى ثمنًا ويسجّل نتيجة أقل هناك. توضح مواد Google صراحة أن السعر سعر تمهيدي، وهي كلمة تعني أنه يمكن أن يتغيّر، والقراءة الصادقة هي أن ميزة السعر لدى Argon حقيقية، لكن استمرارها غير مضمون.

حقيقتان معماريتان تحدّدان أكثر من المقاييس المرجعية

A capture of the Google DeepMind blog post announcing Gemini 4 Argon, dated Sep 30 2026, credited to Koray Kavukcuoglu, SVP Google DeepMind and Chief AI Architect, with the standfirst describing frontier performance across real-world software engineering, enterprise knowledge work like legal and finance, and cybersecurity defense.

أولاً، سقف الإخراج. يولّد Gemini 4 Argon ما يصل إلى 1,000,000 توكن في مسار واحد — ويشير إعلان Google إلى أن هذه توسعة من 64K في الجيل السابق. أما GPT-6 Astra فيتوقف حده عند 128,000. يمتلك كلاهما نافذة سياق تبلغ نحو مليون توكن، لذا يتعلق الأمر حصراً بمقدار ما يمكن للنموذج كتابته في مرة واحدة. في التوليد الطويل، أو تغييرات الشيفرة على شكل رقعة كاملة، أو صياغة مستند بتمريرة واحدة، يمثل ذلك فرقاً بمقدار ثمانية أضعاف فيما يمكن أن ينتجه نداء واحد. أما في الدردشة والاستخلاص وخطوات الوكيل القصيرة، فكلا السقفين لانهائي عملياً، ولا يكلفك الفرق شيئاً.

الوسائط ثانيًا، وهنا تسير الميزة في الاتجاه المعاكس من ناحية واحدة. يقبل GPT-6 Astra النصوص والصور والملفات. ويقبل Gemini 4 Argon النصوص والصور والفيديو والملفات، وتركز مواد إطلاق Google على فهم الفيديو الطويل تحديدًا — رقم LVBench قدره 91.7% وهو رقم مُصرَّح به من المورّد. إذا كان مسار المعالجة لديك يستقبل الفيديو، فإن Astra ليس بديلاً. كما أن الصوت غير مذكور في قائمة الوسائط المنشورة لـ Argon، فلا تفترض أن الترقية تتضمنه.

ماذا تفعل فعليًا

Astra متاح وArgon غير متاح، وهذا يحسم معظم القرارات خلال الشهر المقبل. المسار الملموس الذي لا يهدر أي عمل: ابنِ على GPT-6 Astra إذا كان عبء العمل لديك يحتاج إلى نموذج استدلال يعمل دائمًا بدقة علمية قوية وسجل مثبت في المهام الوكيلية، وأبقِ اسم النموذج في الإعدادات، واضبط مهل عميلك بناءً على سلوك Astra المقاس لا بناءً على التفاؤل — فتشغيل يستغرق خمس دقائق حتى أول رمز سيتجاوز مهلة افتراضية مدتها 60 ثانية، وبث ينقطع عند 300 ثانية يبدو كأنه انقطاع خدمة. إذا كنت حساسًا للتكلفة فوق 272 ألف رمز إدخال، فاحسب إعادة التسعير صراحةً قبل أن تلتزم، لأن هذه الخطوة تضاعف الإدخال وترفع الإخراج بمقدار النصف عند حد واحد.

A capture of the OrcaRouter model page for OpenAI: GPT-6 Astra, showing the OpenAI provider, a release date of 2026-09-04, a 1,050,000-token context window, a 128,000-token maximum output, text, image and file input, and pricing of $10.00 input / $50.00 output per million tokens.

المسار الأوسط المثير للاهتمام هو أنه لا يتعين عليك اختيار افتراضي واحد. Astra وArgon — عندما يُطلق Argon — هما نفس شكل النموذج الموجه لنفس فئة العمل، مما يجعلهما شريكين طبيعيين في تجاوز الفشل بدلاً من متنافسين على نفس الفتحة. على OrcaRouter، openai/gpt-6-astra متاح بسعر قائمة المزود بدون أي هامش ربح، على نفس نقطة النهاية المتوافقة مع OpenAI مثل أكثر من 200 نموذج آخر، مع تجاوز فشل تلقائي عبر المزودين ولغة DSL للتوجيه للتعبير عن ترتيب أساسي واحتياطي على مفتاح واحد. عندما ينضم Argon إلى الكتالوج بأي معرف تنشره Google، يصبح التبديل مجرد سلسلة نصية — لا عقد ثانٍ، ولا عمل تكامل، ولا إعادة بناء لأي شيء بنيته حول Astra في هذه الأثناء.

ما الذي من شأنه أن يحسم التعادل نهائيًا؟

سعر Argon معلَن بعد الفترة التمهيدية، وإعادة إنتاج مستقلة لادعاءات Google الوكيلية — رقم 77.9% في DeepSWE v1.1 ونتيجة 68% في CWE-bench v1 كلاهما مُبلَّغ عنه من المورّد، ولا يقف خلف أيٍّ منهما تشغيل خارجي. قد يحرّك أيٌّ منهما Argon صعودًا أو هبوطًا بشكل جوهري، لأن تقدمًا بمقدار 0.11 نقطة في المؤشر ليس حاجزًا أمام عيب تكلفة بمقدار 1.6× إذا تبيّن أن ميزة التكلفة مؤقتة، وهو ليس عجزًا إذا حافظت Google على السعر التمهيدي وكانت طبقة السياق الطويل لدى Astra أشدّ وقعًا من المتوقع في الإنتاج.

في الوقت الراهن: من حيث القدرة العامة المقيسة، هذان هما النموذج نفسه في غلافين. Astra هو صاحب المسار الحي، وخطوة السعر المعروفة، ووقفة التفكير التي تبلغ خمس دقائق. Argon هو صاحب البطاقة الأرخص وبلا نقطة نهاية. التعادل حقيقي، وأحد طرفيه قابل للشراء.