بطاقة رئيسية مُولَّدة تقارن بين Intern-S2-397B وGrok 4.6، وتُظهر على اليسار نموذجًا علميًا مفتوح الأوزان مع مفتاح تبديل للتفكير مُعنون enable_thinking وشكل موجي للسلاسل الزمنية، وعلى اليمين نقطة نهاية سحابية مغلقة مع قرص لضبط جهد التفكير وأيقونات أدوات من جهة الخادم، موسومة بالتباين بين تحكم مستضاف ذاتيًا وفق Apache-2.0 وواجهة API محدودة الاستخدام بتسعير $2 / $6، مع شعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

Intern-S2-397B مقابل Grok 4.6: من له حق إدارة المقابض؟

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

طُرح Intern-S2-397B وGrok 4.6 بفارق شهر تقريبًا، ويجيبان عن السؤال الجوهري نفسه بطريقتين متعارضتين: مَن يتحكّم في الاستدلال. يبيعك Grok 4.6، الطراز الرائد من xAI الذي أُطلق في 12 أغسطس 2026، مِقبضًا — تحكّمًا قابلًا للضبط في جهد الاستدلال ضمن واجهة برمجة تطبيقات مغلقة بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج، مع نافذة سياق تبلغ 500,000 رمز، وتُحتسب أدوات xAI من جهة الخادم بتكلفة إضافية. أما Intern-S2-397B، النموذج العلمي متعدد الوسائط ذو 403 مليارات معامل الذي أصدره فريق InternLM في مختبر شنغهاي للذكاء الاصطناعي تحت رخصة Apache-2.0 في 13 سبتمبر، فيسلّمك الآلة كاملة — الأوزان، ومفتاح التفكير، ومسار الرؤية، ورأس السلاسل الزمنية — ويتوقّع منك تشغيله بنفسك. أحدهما مستأجَر بمقابض تحكم؛ والآخر مملوك بالكامل. المقارنة المهمة هنا ليست أيّهما يحقق درجات أعلى في جدول معايير الأداء؛ بل أيّ نوع من التحكم يحتاجه عبء عملك فعليًا، وما تكلفة كل نوع.

قرصان مختلفان

أوضح طريقة للتمييز بين هذين الاثنين هي النظر إلى مكان وجود عناصر التحكم في الاستدلال. يكشف Grok 4.6 عن إعداد جهد الاستدلال عبر واجهة برمجة تطبيقات xAI، وحولها توجد مجموعة من الأدوات من جانب الخادم — استدعاء الدوال، البحث في الويب، البحث في X، تنفيذ الكود — التي تديرها xAI وتُحاسب عليها بشكل منفصل. أنت تضبط الجهد، وتُسلسل الأدوات التي يمنحها لك، ولا تلمس أي وزن أبدًا. سلوك النموذج هو ملكية xAI ومشكلة xAI؛ ذراعك هو معامل في الطلب.

يمنحك Intern-S2-397B مجموعة مختلفة من أدوات التحكم، وهي في مستويات أدنى من المكدّس التقني. التفكير مُفعَّل افتراضيًا، وتُعطِّله لكل طلب باستخدام enable_thinking=False. ولأن النموذج مرخّص بموجب Apache-2.0، يمكنك أيضًا أخذ الأوزان وضبط سلوك الاستدلال نفسه ضبطًا دقيقًا على بياناتك الخاصة، ثم تقديم النتيجة عبر LMDeploy أو vLLM أو SGLang. سطح الإدخال لديه أوسع من واجهة برمجة نصوص وصور: فهو يقبل إشارات السلاسل الزمنية وينتج تنبؤات، وهي قدرة مرتبطة حاليًا بـ LMDeploy فقط، وقد دُرِّب على العمل الوكيلي بعيد المدى في بيئات معزولة. والمقايضة واضحة بالقدر نفسه — فمستوى التحكم هذا لا يكون ذا معنى إلا إذا كنت مستعدًا لتشغيل العتاد ومكدّس الخدمة المصاحب له.

التحكم في الاستدلال — {{1}}Grok 4.6: مقبض ضبط جهد الاستدلال على واجهة برمجة تطبيقات مغلقة{{/1}} مقابل {{2}}Intern-S2-397B: مفتاح enable_thinking إضافةً إلى تحكم كامل على مستوى الأوزان بموجب Apache-2.0.{{/2}}

• الأدوات — Grok 4.6: البحث على الويب من جانب الخادم لدى xAI، والبحث في X، وتنفيذ الكود، وتُفوتَر بشكل منفصل مقابل Intern-S2-397B: استدعاء الأدوات الذي تربطه بنفسك، إضافةً إلى مسار تنبؤ بالسلاسل الزمنية عبر LMDeploy.

• المدخلات — Grok 4.6: نص، صورة، ملف مقابل Intern-S2-397B: نص، صورة، سلاسل زمنية.

• السياق — Grok 4.6: 500,000 رمز مقابل Intern-S2-397B: 256 ألف للاستدلال النصي، و64 ألف للوسائط المتعددة، وكلاهما الرقمان من بطاقة النموذج.

• السعر — Grok 4.6: 2.00 / 6.00 دولار لكل مليون، مع تسعير متدرج إلى 4.00 / 12.00 دولار بعد 200 ألف رمز مقابل Intern-S2-397B: لا توجد بطاقة أسعار؛ استضافة ذاتية أو واجهة Intern API الرسمية.

ما الذي تغطيه الأرقام فعليًا

كل رقم من أرقام Intern-S2-397B الواردة أدناه هو رقم يخصّ InternLM، جرى تشغيله عبر OpenCompass وVLMEvalKit وAgentCompass ونُشر جنبًا إلى جنب مع الأوزان دون أي إعادة إنتاج مستقلة. أما أرقام Grok 4.6 فهي من نوع مختلف: فقد تراكمت عبر الساحة العامة وArtificial Analysis بعد إطلاق النموذج، ولذلك تحمل صفة طرف ثالث.

على الجانب المقاس بشكل مستقل، يقع Grok 4.6 عند 44 على Artificial Analysis Intelligence Index الحالي، مع GPQA Diamond عند 94.9، وHumanity's Last Exam عند 61.0، ودرجة برمجة عند 76.8، وتضع Artificial Analysis رقم TerminalBench 2.1 الخاص به قرب 80.3. وعلى جانب المورّد، تذكر بطاقة Intern-S2-397B نسبة 89.77 على MMLU Pro، و93.56 على HMMT-2026، و81.68 على MMMU Pro، و68.54 على SWE-bench-Pro، إلى جانب صفوف علمية يبدو فيها وكأنه نوع مختلف: 55.71 على Biology-Instructions، و63.28 على SciReasoner 1.5، و53.95 على Mol-Instructions، و62.35 على MolecularIQ. الرقم الوحيد في جدول المورّد الذي ينبغي أن يجعل باني الوكلاء يتراجع هو TerminalBench 2.1 عند 64.04 — رقم يقرّ صانعو النموذج نفسه بخسارته أمام جيل مغلق أقدم بفارق واسع، في مجال العمل الطرفي تحديدًا الذي يكون فيه نموذج حدودي مُستأجر مثل Grok 4.6 في أقوى حالاته.

اقرأ هذا الانقسام كصورة، لا كترتيب. إن Intern-S2-397B متخصص علمي وهو أيضًا نموذج عام كفء؛ أما Grok 4.6 فهو نموذج عام لديه اهتمام عابر بالعلم. كون الصفوف العلمية غير متوازنة أمر متوقع — فلم يُدرَّب أي نموذج عام رائد مسبقًا على صفحات خام من الأدبيات العلمية تتضمن الأشكال والتخطيط والترميز الرمزي معًا، وهذا تحديدًا هو الإطار الذي بُني حوله Intern-S2-397B. لا شيء في أي من قاعدتي الأدلة يدعم أن "Intern-S2-397B بجودة Grok 4.6 في الاستدلال الاعتباطي"، ولا شيء في أدلة Grok 4.6 يشير إلى أنه ضُبط لتحليل تسلسلات الأوميكس المتعدد.

ثمن السيطرة

Grok 4.6 له سعر يمكنك وضعه في جدول بيانات: 2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج، مع ارتفاع السعر إلى 4.00 / 12.00 دولار بمجرد أن يتجاوز الطلب 200,000 رمز، وفئة أولوية اختيارية لاستجابات أسرع.وهو متاح عبر OrcaRouter بسعر xAI المعلن مُمرَّرًا بهامش ربح 0%، لذا يصل أي تغيير في السعر لدى xAI إلى هنا في اليوم نفسه دون فارق من وسيط — تبقى الخطة التي تستأجرها مسعّرة بالطريقة التي يسعّرها بها المزوّد.

لا يملك Intern-S2-397B أي سعر منشور لكل توكن على الإطلاق. تشير بطاقة النموذج إلى واجهة Intern API رسمية، لكن الاقتصاديات التي يريد الناس مقارنتها فعلاً هي اقتصاديات الاستضافة الذاتية: نقطة حفظ (checkpoint) بمعلمات 403B، ونحو 807 GB من الأوزان موزعة على 188 جزءًا (shard) بصيغة BF16، أي عقدة متعددة وحدات GPU جادة، مع نسخة FP8 التي تقلص البصمة إلى النصف تقريبًا. إذا كنت تمتلك هذه السعة بالفعل، فإن التكلفة الحدية للاستعلام العلمي التالي تقترب من تكلفة الكهرباء، وهذا هو جوهر موقف Apache-2.0 بأكمله. وإذا لم تكن تمتلكها، فإن النموذج "المجاني" مشروع تجريبي قائم على نفقات رأسمالية، وليس بندًا في الميزانية.

ما يمنحه الموجّه في هذه المقارنة المحددة هو الحدّ الفاصل لا السعر. يتوفر Grok 4.6 عبر المفتاح الذي لديك بالفعل لحركة الإنتاج العامة؛ أما Intern-S2-397B فليس موجّهًا عبر OrcaRouter — فهو نقطة تحقق جديدة كليًا، وسبيلك إليه هو API المورّد نفسه أو نشر ذاتي الاستضافة. وجّه الاستدلال العام الحساس لزمن الوصول إلى النموذج المدفوع حسب الاستخدام، وأبقِ العمل العلمي على دفعات على النموذج الذي تشغّله، ودع التبديل التلقائي عند الفشل يغطيك عندما تكون نقطة نهاية أي من الجانبين غير سليمة. وتصبح الحدود بينهما قاعدة توجيه بدلًا من تكامل ثانٍ.

A generated two-column scoreboard titled Intern-S2-397B vs Grok 4.6 — the scoreboard. Left column Intern-S2-397B: Weights Apache-2.0 open; Reasoning control toggle plus full weight control; Inputs text, image, time series; Context 256K text / 64K multimodal; Independent score none yet; TerminalBench 2.1 64.04 vendor-reported. Right column Grok 4.6: Weights closed API only; Reasoning control effort dial; Inputs text, image, file; Context 500K tokens; Independent score AA Index 44, GPQA 94.9; TerminalBench 2.1 80.3 per Artificial Analysis. Footer reads Intern-S2-397B figures are InternLM's own, unreproduced; Grok 4.6 figures per Artificial Analysis and the vendor.

أي واحدة تختار؟

اختر Grok 4.6 عندما تكون المهمة عامة، ويكون عليك الحصول على الاستدلال بسرعة ودقة، ولا ترغب في تحمّل مسؤولية تشغيل البنية التي تنتجه. فنافذته البالغة 500 ألف، ونتيجته المقيسة في GPQA Diamond عند 94.9، ومجموعة أدواته كلها ميزات إنتاجية جاهزة، وعدّاد 2$/6$ هو ما تدفعه مقابل ألّا تشغّل أي شيء بنفسك.

اختر Intern-S2-397B عندما تكون المدخلات علمية — ورقة مكتظة بالرسوم، أو مخططًا جزيئيًا، أو إشارة سلاسل زمنية — وعندما يجب أن يحدث الاستدلال على بيانات لا يمكنها مغادرة بيئتك، أو على سلوك تريد ضبطه الدقيق بنفسك. ترخيص Apache-2.0 يجعل ذلك ممكنًا؛ ولا تفعله أي واجهة برمجة تطبيقات مستأجرة. خصّص ميزانية للعتاد، وتوقّع ألا تتوفر لوحة نتائج مستقلة لفترة، واعتبر كل رقم على بطاقته ادعاءً حتى يعيد شخص من خارج InternLM إنتاج أحدها.

A screenshot of the Hugging Face model card for internlm/Intern-S2, captured September 13, 2026, showing the Apache-2.0 licence, the description of Intern-S2-397B as a 403-billion-parameter multimodal foundation model for scientific intelligence and long-horizon agents, and the note that text reasoning benchmarks use a 256K inference length while multimodal benchmarks use 64K.A screenshot of the OrcaRouter model page for Grok 4.6 at orcarouter.ai/models/grok/grok-4.6, captured September 13, 2026, showing the model listing with its provider SpaceXAI, 500,000-token context window, and $2.00 / $6.00 per-million-token pricing displayed alongside the surrounding catalogue.