
RSI-Jev مقابل Jev 1.13: أحدهما تُنزّله، والآخر تستدعيه
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 361 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
ضع RSI-Jev v6.1-VL 4B و Jev 1.13 جنبًا إلى جنب، وأول ما يلاحظه المستدعي هو أنهما الطلب نفسه. أعطِ أيًّا منهما حالةً ومجموعةً من الأسئلة المحددة الأنواع — سؤال نعم/لا، أو اختيار واحد من k، أو تقييم وفق سلّم تقييم — وسيعيد كلاهما احتمالًا معايرًا لكل خيار، في تمريرة أمامية واحدة، دون نص مولَّد يحتاج إلى تحليل. هذا ليس مصادفة: فقد صُمم RSI-Jev ليتحدث صيغة Jev السلكية عن قصد، لذا فإن أي عميل مكتوب للعمل مع واجهة API الخاصة بـ TypeSafe يعمل معه بمجرد تغيير عنوان URL الأساسي. أما ما ليس متماثلًا فهو كل ما يحيط بالاستدعاء. Jev 1.13 هو نموذج TypeSafe التجاري المغلق، يُخدَم من نقطة نهاية تُحاسَب عليها حسب الاستهلاك؛ أما RSI-Jev v6.1-VL فهو نقطة تفتيش بعدد معاملات يبلغ 4.69B بأوزان خاضعة لرخصة Apache-2.0، تقوم بتنزيلها وتشغيلها على عتادك الخاص. لا يُعد أي منهما إعادة تسمية تجارية للآخر، ولا يوصي أي من المورّدين بالآخر، كما أن كل رقم تقريبًا في هذه المقارنة يأتي من الطرف الذي أنتجه.
تاريخ الموضوع مهم، لأن هذا المشروع يصدر إصدارًا كل يوم تقريبًا. تم نشر RSI-Jev v6.1-VL 4B في 2026-10-07 بواسطة طرف ثالث Shanghua-Gao/RSI-Jev، وهو مشروع — حلقة بحثية ذاتية التحسين تدرّب نماذج قرار بأسلوب Jev وتنشر كل تجربة فشلت إلى جانب تلك التي نجحت. إنه الإصدار الثامن في ثلاثة عشر يومًا على هذا الخط، وهو متوسط مرجّح للإصدار السابق مع ضبط دقيق ثانٍ لنفس Qwen3.5-4B-Base. Jev 1.13 هو نموذج TypeSafe AI، أُطلق في 2026-09-15 ويُتاح في كتالوجنا الخاص منذ 2026-09-24. كلا التاريخين مهمان أدناه، لأن المقارنة مع مشروع يتحرك يوميًا لها عمر افتراضي يُقاس بالأيام.
ما هما عليه حقًا، في سطر واحد لكل منهما
Jev 1.13 هو نموذج قرار مُستضاف خلف نقطة نهاية مخصّصة — POST /v1/system، غير متدفّق، بميزانية إدخال تبلغ نحو 64,000 رمز تشمل الحالة وكل أسئلتك معًا، بسعر $0.042 لكل مليون رمز إدخال، بينما تُحتسب المخرجات بصفر لعدم وجود رموز إخراج. عدد معاملاته وحوسبة تدريبه غير معلنة؛ وقد قالت TypeSafe إن التفاصيل تُحفظ سرية وقد تتبعها ورقة بحثية. أنت لا تشغّله. أنت تستدعيه، وكل استدعاء هو طلب شبكة محاسَب.
RSI-Jev v6.1-VL هو التكوين الآخر كاملًا. إنه برج Qwen3.5-4B-Base مُدرَّبٌ تدريبًا دقيقًا من طرف إلى طرف، مع رؤوس قرار عند الطبقات 16 و20 و32، ويُقدَّم من نقطة تحقق قائمة بذاتها بحجم 9.7 غيغابايت بصيغة bf16. عدد المعاملات 4.69 مليار، ويجدر معرفة أين تذهب: 3.57 مليار في طبقات فك التشفير الـ32، و0.64 مليار في تضمينات الرموز، و0.33 مليار في برج الرؤية، و0.05 مليار في رأس القرار الرئيسي و0.10 مليار في رأسي الخروج المبكر. لا يوجد مزيج من الخبراء ولا نموذج ثانٍ. يمكنك تثبيته باستخدام أمر pip من المستودع، وتشغيل خادمه، ومن تلك اللحظة لا يغادر القرار بنيتك التحتية أبدًا.
• من يُشغّله — نقطة نهاية مستضافة تُحاسَب حسب الاستخدام ولا تتحكم بها مقابل نقطة تفتيش بحجم 9.7 جيجابايت على وحدة معالجة الرسومات الخاصة بك، أو شريحة Apple Silicon، أو وحدة المعالجة المركزية.
• شكل السعر — 0.042 دولار لكل مليون رمز إدخال، والإخراج مجاني، مدفوع لكل استدعاء مقابل الصفر على الهامش بالإضافة إلى تكلفة الجهاز والعمليات.
• ميزانية المدخلات — حوالي 64,000 رمز لكل طلب على النموذج المستضاف مقابل 32,768 رمزًا نصيًا بالإضافة إلى ميزانية صور على نقطة التحقق، مع رفض أي شيء أطول بدلًا من اقتطاعه.
• الأوزان والترخيص — مغلقة، حجم غير معلن مقابل أوزان Apache-2.0، كود MIT، 4.69 مليار معامل.
• الوسائط — نص لعقد Jev مقابل نص بالإضافة إلى ما يصل إلى أربع صور لكل طلب على إصدارات رؤية RSI-Jev.
• الملكية — النموذج التجاري لـ TypeSafe AI مقابل مشروع بحثي تابع لجهة خارجية يذكر في سطر ترخيصه الخاص أنه "غير منتسب إلى TypeSafe AI."
النتيجة على لوحة RSI-Jev الخاصة، ولماذا هي نصف مقارنة فحسب
الرقم الذي يتصدّر به المشروع هو درجة Decision Index 0.3 الخاصة به: 50.98 لـ v6.1-VL 4B، ارتفاعًا من 46.23 للإصدار الذي سبقه. هذه عملية تشغيل كاملة للإعداد الافتراضي — 140,178 طلبًا، تغطية 1.0 — وعلى لوحة المشروع العامة الخاصة به، المؤرخة 2026-10-06، يتعادل مع أفضل نموذج 4B على تلك اللوحة (50.98 مقابل 50.82 لـ ezjev 4B s2، وهو ما تعتبره المجموعة تعادلًا عند 0.25) ويحتل المرتبة 27 من 113 إجمالًا. على درجة Decision Index 0.2.1 الأقدم يسجل 50.74 مقابل 46.24 لـ v6.0-VL. مجموعة اختباره المكوّنة من خمسة عشر معيارًا، والمُبلَّغ عنها دون مهمة open_jev_ood التي وُجد أنها تتداخل مع صفوف التدريب، هي 0.793، ومجموعته المحتجزة هي 0.729.
كل واحد من تلك الأرقام هو رقم خاص بـ RSI-Jev، مقيس على منصة اختبار RSI-Jev. مؤشر القرار هو لوحة معيارية عامة، لكن لا يوجد عليه قراءة لـ Jev 1.13، لأن مجموعة اختبارات المشروع بُنيت لتقييم نقاط قرار مفتوحة، وJev نقطة نهاية مغلقة. لذا فإن إغراء وضع 50.98 مقابل 0.727 الخاص بـ Jev في معيار القرارات المكتوبة وإعلان فائز هو بالضبط الخطأ الذي يجب تجنبه: فهذان الرقمان يأتيان من منصتي اختبار مختلفتين، وحجمي عينة مختلفين، وبيانات مختلفة، ولم يُشغّل أحد منصة اختبار واحدة على كلا النموذجين.

المواجهة المباشرة الوحيدة الموجودة هي مواجهة Laya، وليس مواجهة RSI-Jev.
هناك مقارنة منشورة واحدة تضع رقم Jev إلى جانب نقطة تحقق مفتوحة، ولم يُجرِها أيٌّ من الطرفين هنا. Convai Innovations، مبتكرو نموذج قرار Laya، أدرجوا في جدول أرقام Jev 1.13.0 المنشورة الصادرة عن TypeSafe مقابل أرقامهم الخاصة، وأشاروا هم أنفسهم إلى القيود: أرقام Jev منشورة من طرف ثالث ولم تقم Convai بقياسها قط، وأحجام العينات والمطالبات تختلف، ولا يُدرج المورّد اختباراته المعيارية الخاصة للنموذج. هذا الجدول يستحق القراءة للمعايرة، لا للحكم — وهو لا يتضمن RSI-Jev إطلاقًا، لأن RSI-Jev لم يكن موجودًا عند نشره.
ما يوضحه بالفعل هو شكل مسألة النموذج المستضاف مقابل النموذج المفتوح التي يوازن بينها القارئ فعلاً. يتقدّم النموذج المستضاف حيث تكون مساحة الخيارات واسعة ويجب على النموذج أن يُبقي مجموعة إجابات عريضة مستقرة؛ أما النماذج المفتوحة فتتفوق في زمن الاستجابة الخام لكل استدعاء لأن الشبكة ليست في المسار. لا شيء في هذا النمط يخبرك أي هذين النموذجين تحديداً أفضل في مهمتك، والموقف الصادق هو أن الإجابة غير موجودة بعد علناً.
ما الذي يوفره الـ checkpoint ولا يستطيع الـ endpoint تقديمه
أقوى حجة لصالح RSI-Jev ليست درجة. بل إن الأوزان موجودة على قرصك. فعند اتخاذ قرار توجيه بناءً على سجل طبي، أو مستند قانوني، أو سجل حساب عميل، فإن عبارة «لا تغادر البيانات المبنى» ليست تفضيلًا تقايضه مقابل نقطة معيارية، بل شرطًا صارمًا، ولا تفي بها أي نقطة نهاية مستضافة بأي ثمن. والخاصية نفسها تُلغي حد المعدل: فوثائق المورّد الخاصة بالنموذج المستضاف تشير إلى أن حدوده تُعدَّل ديناميكيًا ويمكن أن تتغير دون إشعار، وليس لنقطة تحقق مستضافة ذاتيًا سقف كهذا عدا ما يفرضه عتادك.
الشيء الثاني الذي تمنحه نقطة التحقق هو التحكم في العمق، وهو أمر غير معتاد. لأن رؤوس القرار تقع عند ثلاثة أعماق، الجهد، الإعداد الذي يحدد عدد الطبقات التي يمكن للطلب استخدامها: منخفض يتوقف عند الطبقة 16 بزمن وسيط يقارب 23 مللي ثانية، متوسط عند 20 بزمن 27 مللي ثانية، مرتفع عند 32 بزمن يقارب 40 مللي ثانية، وتلقائي يجيب عند أول مخرج واثق بما يكفي، بمتوسط 19.5 من 32 طبقة على مجموعة المشروع. هذه الكمونات هي أرقام المشروع نفسه مقاسة على H200 واحد بتنسيق bf16 ولا ينبغي دمجها مع أي رقم من خدمة مستضافة — فتمريرة أمامية محلية واستدعاء API مقنّن ليسا القياس نفسه، وتوثيق RSI-Jev نفسه صريح في أن مقارنته السابقة بزمن الاستجابة المنشور لـ Jev وضعت عمل GPU محلي في مواجهة رحلة ذهاب وإياب عبر الشبكة.
الأمر الثالث هو الصور. عقد Jev هو إدخال نص، وإخراج JSON منظّم. تأخذ إصدارات الرؤية RSI-Jev من صورة واحدة إلى أربع صور لكل طلب كعناوين URL لبيانات base64، حيث تشير الحالة إلى كل صورة عبر علامة، ويسجّل v6.1-VL نتيجة 0.834 على مجموعة الصور المحجوزة للمشروع. إذا كان قرارك هو "هل تُظهر الصورة تلفًا مرئيًا؟"، فهذه قدرة لا يقدّمها العقد المستضاف على الإطلاق.
ما تتنازل عنه حقيقي أيضًا، والمشروع ينشره. ساءت المعايرة في هذا الإصدار، لا تحسّنت: خطأ المعايرة المتوقع النهائي هو 0.048 عند الطبقة 32 و0.055 مع الوضع التلقائي، مقابل 0.036 و0.024 للإصدار السابق. تُشحن العتبة الافتراضية المفردة البالغة 0.95 غير مؤكدة صراحةً — فهي خيار احتياطي لقاعدة اختيار أخفق اختيارها الخاص، 0.85، في بلوغ سقف العمق للمشروع في نصف بيانات تطويره. لا تقرأ المخارج المبكرة سوى النص، لذا فإن أي سؤال مصحوب بصورة يشغّل الطبقات الـ32 كلها بغض النظر عن الجهد. وخمسة من مصادر تدريب الصور غير تجارية أو للبحث فقط، ويصرّح المشروع بوضوح بأن ما إذا كانت الأوزان المدرّبة على بيانات غير تجارية ترث تلك الشروط ليس أمرًا محسومًا.
أين تستدعي النسخة المستضافة، وأين لا
هذا هو الجزء من المقارنة الذي لنا فيه مصلحة، لذا يجدر بنا أن نكون دقيقين. نحن نقدّم النموذج التجاري لـ TypeSafe باسم typesafe/jev-1.13 على نقطة النهاية المخصّصة systemone — عبر POST إلى /v1/systemone وليس على شكل OpenAI chat-completions، دون بثّ، مقابل سياق من 65,536 رمزًا يسرده فهرسنا. وهو نفس شكل الطلب والجواب الذي يطبّقه RSI-Jev، من النموذج الذي ينسخ المشروع عقده. أما RSI-Jev نفسه فلا نستضيفه؛ لا يوجد معرّف rsi-jev ولا معرّف shgao في فهرسنا، والقارئ الذي يريد ذلك النموذج يقوم بتنزيله.
السبب في أن هذا التمييز مهم هنا ضيق وملموس. نادرًا ما تكون طبقة القرار هي سير العمل بأكمله — فهي عادةً تجلس إلى جانب نموذج توليدي يكتب الرد أو الملخص أو الشيفرة. وقد عنى ذلك تاريخيًا عقدين. لم يعد الأمر مضطرًا لذلك بالنسبة للجزء المستضاف: إذ يقع Jev 1.13 على المفتاح نفسه الذي تقع عليه أكثر من 200 من النماذج الأخرى بسعر قائمة أسعار المزوّد المُمرَّر دون أي هامش ربح بنسبة 0%، لذا إذا غيّرت TypeSafe سعرًا، يصبح التغيير ساريًا من جانبنا في اليوم نفسه بدلًا من دورة الفوترة التالية. لم يواجه الجزء المستضاف ذاتيًا هذه المشكلة أبدًا، لأنك أنت المزوّد. الطريقة النظيفة للاختيار بينهما هي تجربة العقد التجاري على مجموعة صغيرة من حالاتك الموسومة أولًا، ورؤية ما إذا كان السلوك الجاهز جيدًا بما يكفي للأتمتة عليه، وعندها فقط تحديد ما إذا كان تشغيل نقطة تفتيش بحجم 4.69B بنفسك يستحق العمليات.

أيّ واحد يجب أن تختاره فعلاً؟
اختر RSI-Jev v6.1-VL 4B إذا كان لا بد أن يبقى القرار داخل نطاقك، أو إذا كنت بحاجة إلى قرار على صورة وكذلك نص، أو إذا كانت مجموعات خياراتك تصل إلى المئات (تقبل نقطة التحقق ما يصل إلى 5,120 خيارًا لكل سؤال)، أو إذا أردت ضبط العمق وزمن الاستجابة لكل طلب. أقدِم على ذلك وأنت تعلم أنك تتبنى مشروعًا تحرّك ثماني مرات في ثلاثة عشر يومًا، وأن إصداره الأحدث قايض المعايرة مقابل الدقة، وأن بطاقته الخاصة تسمّي الأجزاء التي لم يستطع تأكيدها من سياسة الخروج.
اختر Jev 1.13 إذا أردت أن يعمل القرار دون حزمة تقديم، وإذا كنت تقدّر نقطة نهاية يتولى شخص آخر إبقاءها قائمة، وإذا كان سعر 0.042 دولار لكل مليون رمز إدخال — مع عدم وجود رموز إخراج تُحتسب — رخيصًا مقابل حجم استدعاءاتك. أقدِم وأنت تعلم أنك تستدعي نموذجًا مغلقًا حجمه غير معلن، وحدود معدله يمكن أن تتغير دون إشعار، ومعاييره المنشورة ليست شيئًا يمكنك إعادة تشغيله.
القاسم المشترك بينهما أنفع مما يفرقهما، وهو السبب الذي يجعل مقارنة كهذه تستحق الكتابة أصلًا. لا يولّد أي من النموذجين نصًا، لذا لا يُدخل أي منهما فئة الفشل النابعة من نموذج ينسى إغلاق قوس أو يبتكر حقلًا. كلاهما يُعيد احتمالات، وفي كلتا الحالتين يكون الاحتمال هو الجزء الذي عليك التحقق منه على بياناتك الموسومة الخاصة قبل أن تؤتمت بناءً عليه — فزمن الاستجابة أصبح سلعة، وقيمة الثقة هي ما يجب أن يُكتسب لكل عملية نشر. أيًا كان الجانب الذي تقف فيه على الخط الفاصل بين التنزيل والاستدعاء، اختبر المعايرة أولًا.

