بطاقة رئيسية مُولَّدة بعنوان «ما هو TypeSafe AI؟» مع عنوان فرعي «المختبر الذي يقف خلف Jev 1.13 - قرارات محدَّدة الأنواع، لا نثر»، فوق ثلاثة أسطر مُعنونة: «الشركة: TypeSafe AI، سان فرانسيسكو»، «النموذج: Jev 1.13 (typesafe/jev-1.13)، أُطلق في 2026-09-15» و«يُوجَّه عبر OrcaRouter منذ 2026-09-24». شعار OrcaRouter مُركَّب في الزاوية اليمنى السفلية.
Guides & Insights

ما هو TypeSafe AI؟ المختبر الذي يقف خلف Jev 1.13 يتخذ قرارات، لا جملًا

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

TypeSafe AI هو مختبر صغير في سان فرانسيسكو يبيع نموذجًا لا يستطيع كتابة جملة، وJev 1.13 (typesafe/jev-1.13) هو النموذج المعني. يأخذ قطعة من الحالة — بريدًا إلكترونيًا، سطر سجل، تذكرة دعم، كتلة JSON — بالإضافة إلى مجموعة من الأسئلة المسماة، ويعيد إجابة واحدة محددة النوع لكل سؤال، ولكل منها قيمة ثقة خاصة بها. لا نثر، لا كود، لا شرح، ولا صندوق محادثة. أُطلق النموذج نفسه في 2026-09-15، لذا فهو ليس جديدًا، وليس ما هنا قصة إطلاق: هذه الصفحة موجودة بسبب تغيير أصغر قابل للتأريخ. في 2026-09-24، أضاف OrcaRouter النموذج typesafe/jev-1.13 إلى كتالوجه وفتح بطاقة النموذج على عنوانه الخاص، وكانت هذه أول مرة يمكن فيها استدعاء Jev عبر بوابة طرف ثالث بدلاً من فقط عبر نقطة النهاية الخاصة بـ TypeSafe. هذا هو الحدث، عمره ستة أيام حتى 2026-09-30، وهو السبب الذي يسمح للقارئ الذي ليس لديه بالفعل عقد مع TypeSafe بأن يضع نموذج System One على نفس المفتاح مع النماذج التوليدية التي صُمم ليجاورها. كل ما عدا ذلك في هذه الصفحة هو خلفية عن الشركة التي صنعته.

الصياغة الأمينة لتوقيت النشر، لأنها تهمّ في تحديد مقدار ما جرى التحقق منه: أُطلق Jev منذ أكثر من أسبوعين، وهو متاح على نطاق واسع منذ 2026-09-21، حين أزال TypeSafe قائمة الانتظار. ما يقع داخل نافذة السبعة أيام هو تغيير التوجيه، لا النموذج. إن كنت قد جئت إلى هنا متوقعًا مراجعة إطلاق، فقد وقع الإطلاق بالفعل وتناولته بضع مقالات أخرى.

صفحة شركة بها بيان ولا يوجد بها مخطط معماري

تصف TypeSafe نفسها، في الوصف التعريفي الخاص بها، بأنها "مختبر ذكاء اصطناعي يبني بنية تحتية للذكاء الأصيل للآلة من أجل الأتمتة"، وبأن أنظمتها "مصمّمة لاتخاذ القرارات داخل البرمجيات". والصفحة الرئيسية للشركة مختومة بالإصدار 0.01 وفي تذييلها "صُنع في سان فرانسيسكو". وهناك بيان يرى أن أقصر طريق نحو تحوّل اقتصادي متشكّل بالذكاء الاصطناعي يمرّ عبر جعل الذكاء قابلاً للتركيب، بحيث تستطيع البرمجيات استدعاء الحكم الدلالي كما تستدعي دالة؛ وخلاصة الشركة نفسها لخطتها هي أن تُطلق شكل الذكاء الاصطناعي القابل للتركيب والأصيل للآلة، ثم تجعله موثوقاً بما يكفي للأتمتة الحقيقية، ثم تقدّم تجريدات أعلى مستوى مستقرة بما يكفي للبناء عليها. شعارها هو "نحن نبني بيئة الإنتاج، لا إلهًا". وتذكر صفحة الفريق ثلاثة مؤسسين — ديوغو ألميدا بوصفه الرئيس التنفيذي، وساشا شينغ بوصفها مديرة العمليات، وإريك غافني بوصفه مدير التكنولوجيا. هذا كل ما تقوله الشركة عن نفسها: موقف، ومنتج، وثلاثة أسماء، ولا أرقام عن الشركة نفسها.

ما لا يعرضه الموقع هو أول ما يبحث عنه المهندس الذي يقيّم تبعية جديدة. فلا توجد صفحة معمارية، ولا عدد للمعلمات، ولا إفصاح عن حوسبة التدريب، ولا بطاقة نموذج بالمعنى الأكاديمي. ولوحة قياس الأداء الخاصة بـ TypeSafe نفسها لا تزال معلَّمة كقيد الانتظار. وبالنسبة لشركة يقوم عرضها الترويجي على الموثوقية، فإن سطح الإفصاح ضعيف، وهذه حقيقة تتعلق بما نُشر بدلًا من أن تكون اتهامًا بما يجري إخفاؤه.

A headless-browser capture of the TypeSafe AI homepage as it stood on 2026-09-30. A navigation bar reads 'TypeSafe AI | Manifesto | Our Team | Docs | Sign In'. Under it a banner announces 'NO MORE WAITLIST / TypeSafe is now open to everyone' above a 'Create your account' button, next to a blog teaser reading 'TypeSafe announces System One models and Jev' with a 'Read more' link. Lower down, a section headed 'Introducing Jev - the First Public System One Model: Jev Gives AI The Properties Of Code' appears beside a 'Join Discord' button and the tagline fragment 'Intelligence beyond chat'.

System One: الفئة، ولماذا الاسم مُستعار

جيف هو أول ما تسميه TypeSafe نماذج System One. يأتي الاسم من تقسيم دانيال كانمان بين التفكير السريع والحدسي من النوع System 1 والاستدلال البطيء والمتعمد من النوع System 2، ومنشور إطلاق الشركة يقول ذلك مباشرةً — كما يعترف أيضًا بأن «التفكير من النوع System 1» ظل يحمل إيحاءً بأنه معرّض للخطأ، ويجادل بأنه يمكن جعل هذه النماذج أكثر موثوقية من البدائل. لم تصكّ TypeSafe هذا المصطلح ولا تملكه.

المحتوى العملي للفئة هو تقسيم متعمد للعمل: نموذجٌ يقرر ونموذجٌ يكتب. المقصود منك أن تُبقي الحساب وترتيب التواريخ والعدّ ومقارنة السلاسل النصية في شيفرة عادية، حيث تكون دقيقة، وأن تسلّم الحكم الدلالي إلى Jev. هناك ثلاثة أنواع من الأسئلة يمكنه الإجابة عنها:

• noul — حكم صواب/خطأ، يُعاد باحتمال مُعاير

• اختيار — اختر واحدًا من بين ما يصل إلى 255 خيارًا مُسمّى

• الدرجة — قيّم على مقياس مرتّب؛ تنشر بطاقتنا مستويات من 2 إلى 10، وتُظهر وثائق TypeSafe نفسها مثالاً بفهرسة تبدأ من 0، لذا اعتبر مستويات المورّد هي التعريف، و2-10 هي ما تنشره البطاقة

لكل سؤال تعليماته الخاصة، وله معاييره الخاصة للاختيار والدرجة. تُرفض الطلبات التي تتجاوز نحو 64 ألف رمز إدخال قبل أن تصل إلى النموذج، ولا تُبَثّ الردود. ويوثّق المورّد بصورة منفصلة ميزانية الحالة — الحالة زائد أطول سؤال منفرد — عند 32 ألف رمز، وهو رقم أضيق من سياق الـ65,536 رمزًا المذكور على البطاقة، وليس تناقضًا معه.

أطروحتهم، بكلماتهم الخاصة

تطرح TypeSafe الأطروحة أفضل مما قد تفعله أي خلاصة، لذا ها هي بنصها الحرفي: "تنتج النماذج اللغوية الكبيرة كلماتٍ للناس. أما Jev فينتج قرارات ذات أنواع وهو أشبه بالشيفرة: موثوق، سريع، متسق مع ذاته، وآمن من حيث الأنواع." وطريقة التدريب الكامنة وراء ذلك هي ملكها أيضًا، وهو مصطلح يستحق النسبة إليها بدقة لأنه أُخذ في مواضع أخرى كما لو كان عامًا. تسميه TypeSafe التعلم المعزز للقرارات المعايَرة، أو RLCD، وتقابله مع RLHF وRLVR: فبينما تُحسّن تلك تفضيل البشر أو المكافآت القابلة للتحقق برمجيًا، يستهدف RLCD، بعبارة الشركة، "إجابات باحتمالات صادقة معرفيًا في مهام النظام الأول." تعامل مع RLCD باعتباره مصطلحًا مستحدثًا خاصًا بـ TypeSafe، لا اختصارًا راسخًا في الأدبيات.

الأرقام التي يستهلّون بها، ومن اختار عبء العمل

تتصدّر الصفحة الرئيسية بعنوان "أسرع بـ193.6 ضعفًا، وأرخص بـ444.6 ضعفًا"، مع حاشية سفلية تُحيل إلى سير عمل لمهام System One. وتحته مثال عملي: TypeSafe AI عند 0.000081 دولار و0.114 ثانية مقابل نماذج لغوية كبيرة عند 0.013880 دولار و8.566 ثانية. وإلى أسفل، "42 دولارًا لكل مليار رمز إدخال. سعر إدخال أقل بـ238 ضعفًا من Claude Fable 5.1." وهناك قسم بعنوان "صفر هلوسات"، وهو عند التدقيق ادعاء يتعلق بتقديرات الثقة لا برهان على انعدام الأخطاء: فكل قرار من Jev يحمل تقديرًا للثقة، بحيث يمكن للبرمجيات أن تتحرك عندما تكون الثقة عالية وأن تُصعِّد الأمر عندما لا تكون كذلك. وجميع هذه الأرقام الأربعة هي أرقام TypeSafe، على أحمال عمل اختارتها TypeSafe، ولم يُكرِّر أيٌّ منها بشكل مستقل. وتقول منشورة الإطلاق نفسها إن الفريق يتوقع أن يقع رقماه 193.6 ضعفًا و444.6 ضعفًا في الطرف الأعلى من المكاسب على أرض الواقع، وتشير إلى أن سير العمل بناه فريق القدرات التابع لها، مع إجابات مرجعية أنتجتها نماذج منافسة. وبيانات الخدمة الخاصة بنا على مدى سبعة أيام على النموذج نفسه تضع معدل الخطأ عند 0.49%، وهو قياس مختلف على حمل عمل مختلف، ويُعدّ الثقل الموازن الصادق أمام قراءة "صفر" على أنها قيمة مطلقة.

ما لم ينشروه

بنية Jev وعدد معاملاته وحوسبة تدريبه وأوزانه غير منشورة، ولا يوجد مستودع للأوزان في منظمة GitHub الخاصة بالشركة. عند التحقق في 2026-09-30، كانت لدى تلك المنظمة أحد عشر مستودعًا عامًا؛ والمستودعات الجوهرية منها هي أدوات، جميعها بترخيص MIT أو Apache-2.0 — مستودع لمهارات الوكلاء، وحزمة Python SDK، وحزمة TypeScript SDK، ومهايئ عميل جاهز للاستبدال مدعوم بواجهات برمجة تطبيقات LLM أخرى، ومجموعة وحدات Dagger، وبعض التعليمات البرمجية المنشورة لتقييم سير العمل، وعقدة n8n، وموقع المنظمة نفسه. تتغير أعداد النجوم وتواريخ الدفع، لذا اقرأها في يومها بدلًا من هذه الصفحة.

ثلاثة من الأحد عشر هي نسخ متفرعة من مشاريع غير ذات صلة: vLLM، وLLaDA، ومزوّد Pulumi لـ ClickHouse Cloud. وهي نسخ متفرعة من عمل شخص آخر ولا تقول شيئًا عن كيفية بناء Jev — وبشكل خاص، لا شيء عن كون Jev قائمًا على الانتشار. الإجابة في سطر واحد عن ما إذا كان Jev مفتوح المصدر هي أن الأدوات مفتوحة أما النموذج فليس كذلك.

ما يمنحونه لأنفسهم

اعترافان من منشور الإطلاق يستحقان أكثر من معظم تحذيرات المورّدين، لأنهما يسمّيان المواضع الدقيقة التي يكون فيها الدليل ضعيفًا. أما عن السعر: "لا يمكننا إثبات أنه ليس مدعومًا؛ سنحتاج إلى المدى الطويل لإثبات استدامة تسعيرنا (الذي نتوقع أن ينخفض، لا أن يرتفع)." وأما عن السرعة: "تقييماتنا المنشورة تُجرى عمومًا من حواسيبنا المحمولة على الساحل الغربي (حيث تتمركز خدمتنا حاليًا)." وهناك اعتراف ثالث أكثر فائدة لأي شخص يبني على ذلك: بالنسبة لمجموعات الاختيار عالية التعدد، يشغّل Jev نظامًا من مرحلتين يقيّم بشكل مستقل ثم يتخذ اختيارًا صريحًا، "ومن هنا التباطؤ العرضي." ذلك هو المورّد يشرح لماذا لا يكون زمن الاستجابة ثابتًا عبر أنواع الأسئلة، وهو من النوع الذي تتعلمه عادةً من سلسلة دعم.

أين يمكنك الاتصال به فعليًا، اعتبارًا من اليوم

عبر واجهة برمجة التطبيقات الخاصة بـ TypeSafe، حيث يكون النموذج متاحًا بشكل عام، ولا تزال الصفحة الرئيسية تستخدم عبارة المورّد نفسها «الوصول المبكر» — فهذه الصياغة سارية ويستحق الإبقاء عليها، بينما أصبحت «قائمة الانتظار» مهجورة: تنشر المستندات حدودًا تشغيلية ملموسة (100 ألف رمز في الثانية، و40 طلبًا في الثانية، و429 مع تراجع SDK بعد تجاوز أي من الحدين) ولا تحمل أي لغة خاصة بقائمة الانتظار على الإطلاق. ومنذ 2026-09-24، عبر OrcaRouter.

ما نقدّمه يستحق أن يُقال بدقة، لأن شكل الاستدعاء هو الجزء الذي يختلف. مدخل الكتالوج هو typesafe/jev-1.13، واسمه TypeSafe: Jev 1.13، ونوع نقطة النهاية المدعوم هو "systemone" — لذا يُوصَل إليه عبر POST /v1/systemone بدلاً من شكل OpenAI chat-completions، غير متدفّق، إدخال نصي وإخراج JSON منظّم، بما يصل إلى نحو 64K من رموز الإدخال عبر الحالة والأسئلة مجتمعة. الإدخال بسعر $0.042 لكل مليون رمز، والإخراج يُحتسب بصفر، لأنه لا توجد رموز إخراج تُقاس: القرار المصنّف ليس نثرًا. وهذا هو سعر قائمة المزوّد كما هو، بهامش ربح 0%، على المفتاح نفسه المستخدم مع أكثر من 200 طراز آخر في الكتالوج — واجهة API واحدة لأكثر من 200 طراز، بهامش ربح 0% (سعر قائمة المزوّد كما هو، لذا تخفيضات أسعار البائع سارية هنا في اليوم نفسه). إذا كان سبب قراءتك عن TypeSafe AI هو أنك تريد معرفة ما إذا كانت معايرة Jev تصمد على بياناتك أنت قبل أن تلتزم بمسار إنتاجي يعتمد عليه، فإن تشغيله إلى جانب طراز توليدي تثق به بالفعل هو الطريقة الرخيصة لمعرفة ذلك؛ والتحويل الاحتياطي إلى ذلك الطراز عندما تعود ثقة Jev منخفضة هو الطريقة الرخيصة لشحنه.

أرقام الخدمة الخاصة بنا لمدة سبعة أيام للنافذة المنتهية في 2026-09-30، وهي أرقامنا من حركة المرور الخاصة بنا وليس من معيار البائع: p50 151 مللي ثانية، p95 247 مللي ثانية، حوالي 349 توكن إخراج في الثانية، معدل خطأ 0.49%، و76.2 مليون توكن تم تقديمها. تراوح p50 اليومي خلال تلك النافذة بين 175، 170، 163، 161، 170، 147، 143 مللي ثانية، لذا فقد انخفض الوسيط بشكل طفيف. أحد الأيام في السلسلة، 09-28، لديه p95 يبلغ 2,448 مللي ثانية — وهي قيمة شاذة حقيقية في البيانات، وليست القاعدة، وليست رقمًا للتخطيط حولها ميزانية زمن الاستجابة. تُحدَّث هذه يوميًا؛ البطاقة هي المصدر.

A generated two-column figure card titled 'Jev 1.13 - the scoreboard', with the OrcaRouter logo composited in the bottom-right corner. The left column, headed 'LATENCY & RELIABILITY', lists 'p50 151 ms', 'p95 247 ms' and 'Error rate (7d) 0.49%'. The right column, headed 'PRICE & CONTEXT', lists 'Price $42 per billion input tokens', 'Context 65,536 tokens (32K state budget)' and 'Architecture & weights Unpublished'. A footer line reads 'Vendor figures unaudited; latency and error rate are OrcaRouter serving data, 7 days to 2026-09-30.'

حيث يكون النموذج ضعيفًا، وفقًا لـ TypeSafe

ينشر المزوّد صفحة تفاوت في الأداء من أجل Jev 1.13، آخر مراجعة لها 2026-09-17، تُسمّي أنماط الفشل بصراحة أكبر من معظم مواد الإطلاق. إنها الصفحة الصحيحة للقراءة قبل البناء على النموذج، وقائمتها هي على هذا النحو. يجيب Jev عن السؤال الذي كتبته لا عن السؤال الذي قصدته، لذا يجب توضيح كلمات تحديد النطاق والنفي والشروط الضمنية. إنه ليس آلة حاسبة: أداؤه أسوأ في الأسئلة الرياضية منه في الأسئلة الدلالية. يقرأ التواريخ كنص لا ككميات مرتبة، لذا فإن الترتيب والفجوات والانتماء إلى نافذة زمنية غير موثوقة، والأمر أسوأ مع التنسيقات المختلطة. يضر النفي المزدوج والإحالة غير المباشرة متعددة القفزات بالدقة. تنخفض الدقة كلما نمت الحالة بتفاصيل غير ذات صلة — تقول الصفحة إنه "يعاني من تعفّن السياق" — لذا فإن التصفية في الكود أولاً هي الحل. تُعامَل الحالة كبيانات، لا كشيء معادٍ افتراضيًا، لذا يمكن للتعليمات المحقونة أن تؤثر في الإجابات. التعليمات والمعايير غير المتطابقة تربكه. لا تُضمن الثوابت البنيوية: فلا يلزم أن يتوافق مُخرَج noul ومُخرَج اختيار، ولا يلزم أن يساوي مجموع سؤال ونفيه واحدًا، لذا لا ينبغي نقل العتبات بين الاثنين. كما أنه غير مدرَّب على توليد النص — فإجباره على المرور عبر اختيارات متسلسلة "لن ينجح جيدًا وسيكون بطيئًا جدًا".

A headless-browser capture of the TypeSafe model-jaggedness page for Jev 1.13, headed '# Jev 1.13 jaggedness' with the line 'Jev isn't perfect. Here are some jagged edges we are aware of with jev-1.13. Many of these will be fixed in later versions.' and the note 'Applies to jev-1.13 - Last reviewed 2026-09-17'. Below sits a table of nine documented failure modes - literal reading, math and numbers, date and time comparison, indirection, large state full of irrelevant detail, adversarial content, contradictory instructions and criteria, common-sense structural invariants, and generation - followed by explanatory body text on literal reading, counting and math.

كيف نقرأ TypeSafe AI في اليوم السادس من تغيير التوجيه

تقدم الشركة ادعاءً قويًا ومحددًا وقابلًا للتكذيب: أن نموذج قرار ضيق يمكن أن يكون أسرع وأرخص وأكثر موثوقية من نموذج عام في المجموعة الفرعية من العمل حيث تحتاج إلى حكم لا إلى فقرة. الادعاء معقول ومدعوم جزئيًا بأدلة ذاتية — تقديرات الثقة فرق تصميمي حقيقي، والسعر حقيقي، وزمن الاستجابة الذي نقيسه على حركة المرور الخاصة بنا من الرتبة نفسها مقارنةً بما لدى المورّد. ما ينقص هو الجزء الذي سيتيح لشخص خارجي التحقق من الباقي: لا معمارية، ولا معاملات، ولا أوزان، ولا معيار مستقل، وسعر تقول الشركة نفسها إنها لا تستطيع إثبات استدامته. أنماط الفشل موثقة، وهذا أكثر مما تفعله معظم المختبرات، وهو السبب الأفضل الوحيد لأخذ النموذج على محمل الجد.

إذا كنت تقرر ما إذا كان ينبغي أن تولي الأمر اهتمامًا: شغّل Jev على مدخلات لديك موسومة بالفعل، مع إخفاء الوسوم، وانظر إن كانت أرقام ثقته تفصل بين الحالات التي يصيب فيها وتلك التي يخطئ فيها. لا يكاد هذا الاختبار يكلف شيئًا عند 0.042 دولار لكل مليون رمز إدخال، وهو الوحيد الذي يجيب عن السؤال الذي لديك فعلًا. وإذا كنت تقرر ما إذا كان ينبغي أن تثق بالشركة: فالإفصاحات هي ما هي، والجواب الصادق أن الأدلة حاليًا هي كلام المورّد بالإضافة إلى ما تولّده أنت بنفسك.