
Intern-S2-397B مقابل Grok 4.6: من له حق إدارة المقابض؟
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
طُرح Intern-S2-397B وGrok 4.6 بفارق شهر تقريبًا، ويجيبان عن السؤال الجوهري نفسه بطريقتين متعارضتين: مَن يتحكّم في الاستدلال. يبيعك Grok 4.6، الطراز الرائد من xAI الذي أُطلق في 12 أغسطس 2026، مِقبضًا — تحكّمًا قابلًا للضبط في جهد الاستدلال ضمن واجهة برمجة تطبيقات مغلقة بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج، مع نافذة سياق تبلغ 500,000 رمز، وتُحتسب أدوات xAI من جهة الخادم بتكلفة إضافية. أما Intern-S2-397B، النموذج العلمي متعدد الوسائط ذو 403 مليارات معامل الذي أصدره فريق InternLM في مختبر شنغهاي للذكاء الاصطناعي تحت رخصة Apache-2.0 في 13 سبتمبر، فيسلّمك الآلة كاملة — الأوزان، ومفتاح التفكير، ومسار الرؤية، ورأس السلاسل الزمنية — ويتوقّع منك تشغيله بنفسك. أحدهما مستأجَر بمقابض تحكم؛ والآخر مملوك بالكامل. المقارنة المهمة هنا ليست أيّهما يحقق درجات أعلى في جدول معايير الأداء؛ بل أيّ نوع من التحكم يحتاجه عبء عملك فعليًا، وما تكلفة كل نوع.
قرصان مختلفان
أوضح طريقة للتمييز بين هذين الاثنين هي النظر إلى مكان وجود عناصر التحكم في الاستدلال. يكشف Grok 4.6 عن إعداد جهد الاستدلال عبر واجهة برمجة تطبيقات xAI، وحولها توجد مجموعة من الأدوات من جانب الخادم — استدعاء الدوال، البحث في الويب، البحث في X، تنفيذ الكود — التي تديرها xAI وتُحاسب عليها بشكل منفصل. أنت تضبط الجهد، وتُسلسل الأدوات التي يمنحها لك، ولا تلمس أي وزن أبدًا. سلوك النموذج هو ملكية xAI ومشكلة xAI؛ ذراعك هو معامل في الطلب.
يمنحك Intern-S2-397B مجموعة مختلفة من أدوات التحكم، وهي في مستويات أدنى من المكدّس التقني. التفكير مُفعَّل افتراضيًا، وتُعطِّله لكل طلب باستخدام enable_thinking=False. ولأن النموذج مرخّص بموجب Apache-2.0، يمكنك أيضًا أخذ الأوزان وضبط سلوك الاستدلال نفسه ضبطًا دقيقًا على بياناتك الخاصة، ثم تقديم النتيجة عبر LMDeploy أو vLLM أو SGLang. سطح الإدخال لديه أوسع من واجهة برمجة نصوص وصور: فهو يقبل إشارات السلاسل الزمنية وينتج تنبؤات، وهي قدرة مرتبطة حاليًا بـ LMDeploy فقط، وقد دُرِّب على العمل الوكيلي بعيد المدى في بيئات معزولة. والمقايضة واضحة بالقدر نفسه — فمستوى التحكم هذا لا يكون ذا معنى إلا إذا كنت مستعدًا لتشغيل العتاد ومكدّس الخدمة المصاحب له.
التحكم في الاستدلال — {{1}}Grok 4.6: مقبض ضبط جهد الاستدلال على واجهة برمجة تطبيقات مغلقة{{/1}} مقابل {{2}}Intern-S2-397B: مفتاح enable_thinking إضافةً إلى تحكم كامل على مستوى الأوزان بموجب Apache-2.0.{{/2}}
• الأدوات — Grok 4.6: البحث على الويب من جانب الخادم لدى xAI، والبحث في X، وتنفيذ الكود، وتُفوتَر بشكل منفصل مقابل Intern-S2-397B: استدعاء الأدوات الذي تربطه بنفسك، إضافةً إلى مسار تنبؤ بالسلاسل الزمنية عبر LMDeploy.
• المدخلات — Grok 4.6: نص، صورة، ملف مقابل Intern-S2-397B: نص، صورة، سلاسل زمنية.
• السياق — Grok 4.6: 500,000 رمز مقابل Intern-S2-397B: 256 ألف للاستدلال النصي، و64 ألف للوسائط المتعددة، وكلاهما الرقمان من بطاقة النموذج.
• السعر — Grok 4.6: 2.00 / 6.00 دولار لكل مليون، مع تسعير متدرج إلى 4.00 / 12.00 دولار بعد 200 ألف رمز مقابل Intern-S2-397B: لا توجد بطاقة أسعار؛ استضافة ذاتية أو واجهة Intern API الرسمية.
ما الذي تغطيه الأرقام فعليًا
كل رقم من أرقام Intern-S2-397B الواردة أدناه هو رقم يخصّ InternLM، جرى تشغيله عبر OpenCompass وVLMEvalKit وAgentCompass ونُشر جنبًا إلى جنب مع الأوزان دون أي إعادة إنتاج مستقلة. أما أرقام Grok 4.6 فهي من نوع مختلف: فقد تراكمت عبر الساحة العامة وArtificial Analysis بعد إطلاق النموذج، ولذلك تحمل صفة طرف ثالث.
على الجانب المقاس بشكل مستقل، يقع Grok 4.6 عند 44 على Artificial Analysis Intelligence Index الحالي، مع GPQA Diamond عند 94.9، وHumanity's Last Exam عند 61.0، ودرجة برمجة عند 76.8، وتضع Artificial Analysis رقم TerminalBench 2.1 الخاص به قرب 80.3. وعلى جانب المورّد، تذكر بطاقة Intern-S2-397B نسبة 89.77 على MMLU Pro، و93.56 على HMMT-2026، و81.68 على MMMU Pro، و68.54 على SWE-bench-Pro، إلى جانب صفوف علمية يبدو فيها وكأنه نوع مختلف: 55.71 على Biology-Instructions، و63.28 على SciReasoner 1.5، و53.95 على Mol-Instructions، و62.35 على MolecularIQ. الرقم الوحيد في جدول المورّد الذي ينبغي أن يجعل باني الوكلاء يتراجع هو TerminalBench 2.1 عند 64.04 — رقم يقرّ صانعو النموذج نفسه بخسارته أمام جيل مغلق أقدم بفارق واسع، في مجال العمل الطرفي تحديدًا الذي يكون فيه نموذج حدودي مُستأجر مثل Grok 4.6 في أقوى حالاته.
اقرأ هذا الانقسام كصورة، لا كترتيب. إن Intern-S2-397B متخصص علمي وهو أيضًا نموذج عام كفء؛ أما Grok 4.6 فهو نموذج عام لديه اهتمام عابر بالعلم. كون الصفوف العلمية غير متوازنة أمر متوقع — فلم يُدرَّب أي نموذج عام رائد مسبقًا على صفحات خام من الأدبيات العلمية تتضمن الأشكال والتخطيط والترميز الرمزي معًا، وهذا تحديدًا هو الإطار الذي بُني حوله Intern-S2-397B. لا شيء في أي من قاعدتي الأدلة يدعم أن "Intern-S2-397B بجودة Grok 4.6 في الاستدلال الاعتباطي"، ولا شيء في أدلة Grok 4.6 يشير إلى أنه ضُبط لتحليل تسلسلات الأوميكس المتعدد.
ثمن السيطرة
Grok 4.6 له سعر يمكنك وضعه في جدول بيانات: 2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج، مع ارتفاع السعر إلى 4.00 / 12.00 دولار بمجرد أن يتجاوز الطلب 200,000 رمز، وفئة أولوية اختيارية لاستجابات أسرع.وهو متاح عبر OrcaRouter بسعر xAI المعلن مُمرَّرًا بهامش ربح 0%، لذا يصل أي تغيير في السعر لدى xAI إلى هنا في اليوم نفسه دون فارق من وسيط — تبقى الخطة التي تستأجرها مسعّرة بالطريقة التي يسعّرها بها المزوّد.
لا يملك Intern-S2-397B أي سعر منشور لكل توكن على الإطلاق. تشير بطاقة النموذج إلى واجهة Intern API رسمية، لكن الاقتصاديات التي يريد الناس مقارنتها فعلاً هي اقتصاديات الاستضافة الذاتية: نقطة حفظ (checkpoint) بمعلمات 403B، ونحو 807 GB من الأوزان موزعة على 188 جزءًا (shard) بصيغة BF16، أي عقدة متعددة وحدات GPU جادة، مع نسخة FP8 التي تقلص البصمة إلى النصف تقريبًا. إذا كنت تمتلك هذه السعة بالفعل، فإن التكلفة الحدية للاستعلام العلمي التالي تقترب من تكلفة الكهرباء، وهذا هو جوهر موقف Apache-2.0 بأكمله. وإذا لم تكن تمتلكها، فإن النموذج "المجاني" مشروع تجريبي قائم على نفقات رأسمالية، وليس بندًا في الميزانية.
ما يمنحه الموجّه في هذه المقارنة المحددة هو الحدّ الفاصل لا السعر. يتوفر Grok 4.6 عبر المفتاح الذي لديك بالفعل لحركة الإنتاج العامة؛ أما Intern-S2-397B فليس موجّهًا عبر OrcaRouter — فهو نقطة تحقق جديدة كليًا، وسبيلك إليه هو API المورّد نفسه أو نشر ذاتي الاستضافة. وجّه الاستدلال العام الحساس لزمن الوصول إلى النموذج المدفوع حسب الاستخدام، وأبقِ العمل العلمي على دفعات على النموذج الذي تشغّله، ودع التبديل التلقائي عند الفشل يغطيك عندما تكون نقطة نهاية أي من الجانبين غير سليمة. وتصبح الحدود بينهما قاعدة توجيه بدلًا من تكامل ثانٍ.

أي واحدة تختار؟
اختر Grok 4.6 عندما تكون المهمة عامة، ويكون عليك الحصول على الاستدلال بسرعة ودقة، ولا ترغب في تحمّل مسؤولية تشغيل البنية التي تنتجه. فنافذته البالغة 500 ألف، ونتيجته المقيسة في GPQA Diamond عند 94.9، ومجموعة أدواته كلها ميزات إنتاجية جاهزة، وعدّاد 2$/6$ هو ما تدفعه مقابل ألّا تشغّل أي شيء بنفسك.
اختر Intern-S2-397B عندما تكون المدخلات علمية — ورقة مكتظة بالرسوم، أو مخططًا جزيئيًا، أو إشارة سلاسل زمنية — وعندما يجب أن يحدث الاستدلال على بيانات لا يمكنها مغادرة بيئتك، أو على سلوك تريد ضبطه الدقيق بنفسك. ترخيص Apache-2.0 يجعل ذلك ممكنًا؛ ولا تفعله أي واجهة برمجة تطبيقات مستأجرة. خصّص ميزانية للعتاد، وتوقّع ألا تتوفر لوحة نتائج مستقلة لفترة، واعتبر كل رقم على بطاقته ادعاءً حتى يعيد شخص من خارج InternLM إنتاج أحدها.


