
היכן Jev 1.13 נשבר: רשימת המגבלות של TypeSafe עצמה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 349 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 208 tok/s
- OrcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 105 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- xAISpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
Jev 1.13 (typesafe/jev-1.13) שוחרר ב-2026-09-15, מה שממקם אותו שבועיים מחוץ לשבעת הימים האחרונים, כך שההשקה שלו אינה הסיפור. האירוע המתוארך הוא 2026-09-24: זה היום שבו OrcaRouter הוסיפה את typesafe/jev-1.13 לקטלוג שלה ופתחה עבורו כרטיס מודל — התמיכה הראשונה בהגשה של Jev בשער צד שלישי, אחרי שבועיים שבהם הדרך היחידה לקרוא לו הייתה נקודת הקצה של TypeSafe עצמה. זה חשוב כאן מסיבה אחת ספציפית. Jev יוצא דופן בכך שהספק שלו מפרסם רשימה של הדרכים שבהן הוא נכשל, ורשימה שאפשר רק לקרוא אותה קל הרבה יותר לדלג עליה מאשר מודל שאפשר למעשה לקרוא לו.
הדף הזה הוא הרשימה ההיא, כשהיא מוגבלת למה ש-TypeSafe עצמה אומרת, ובנוסף מגבלות התפעול והחשבון.
TypeSafe מפרסמת את רשימת המשוננות שלה

docs.typesafe.ai מכיל דף שכותרתו Jev 1.13 חיספוס. הוא חל במפורש על jev-1.13, נושא תאריך סקירה של 2026-09-17, ונפתח בניסוח של הספק עצמו: "Jev אינו מושלם. הנה כמה קצוות מחוספסים שאנו מודעים להם ב-jev-1.13. רבים מאלה יתוקנו בגרסאות מאוחרות יותר." תשעה מצבים בעלי שם עוקבים, כל אחד עם מקרה קונקרטי ותיקון "במקום:". שום דבר למטה אינו מוסק, ושום דבר אינו מרוכך — הניסוח הוא של TypeSafe, ובמקום שבו החברה נותנת דוגמה משלה, המספרים בה הם שלה.
קריאה מילולית: זה עונה על השאלה שכתבת.
מילות היקף, שלילות ותנאים משתמעים נקראים כפשוטם. שאלה נענית על פי המילים שבהנחיה, "בעוד שאדם עשוי היה לקרוא את הכוונה שמאחורי ההוראות."
האבחון של הספק הוא החלק השימושי: כאשר אתה מסתכל על תשובה שגויה ומגלה שאתה מסביר מה באמת התכוונת, ההסבר הזה הוא החצי החסר של ההוראה. הפתרונות הם לציין את התנאי המדויק בהוראות, להכניס מקרי גבול בקריטריונים, ובמקום שבו פרשנות היא באמת בלתי נמנעת, לפצל את השאלה לשתי שאלות מפורשות ולשלב אותן בקוד.
מתמטיקה ומספרים: זה לא מחשבון
TypeSafe אומרת בפשטות ליישם לוגיקה מתמטית בקוד. תחת זאת נמצאים שלושה כשלים ספציפיים:
• ספירה אינה אמינה. זה חל על תווים במילה, על מופעים של מונח בקטע, ועל פריטים ברשימה ארוכה. "המודל מזהה את צורתה של תשובה במקום לספור, והשגיאה גדלה עם גודלו של הדבר הנספר." המבחן של הספק עצמו לקבוע אם בכלל לשאול: אם ביטוי רגולרי או מפרסר יכולים למצוא את היחידה, הספירה שייכת לקוד והמודל לא מוסיף דבר.
• ייצוגים מספריים מתפקדים פחות טוב מייצוגים סמנטיים. שאלות על צבעים המשתמשות בערכי hex גרועות יותר מאותן שאלות המשתמשות בשמות צבע באנגלית; בהינתן שלשות RGB או hex, Jev לא יכול לשפוט באופן מהימן האם שני ערכים קרובים זה לזה. אותו פער מופיע בקוד ברמה נמוכה — אסמבלי, או הוראות מקודדות בינארית — לעומת שפות עיליות. המר או קבץ בקוד, והשאר את המודל לחלק שהוא באמת שיפוט.
• פלטי ציונים אינם נושאים גדלים מדויקים. הספק מציין שרמות הציון של Jev חלשות בכיול מספרי. ניתן להשתמש בתוחלת כדי לבדוק אם משהו עובר סף; לא ניתן להשתמש בה כדי לשחזר את המספר באמצעות אינטרפולציה בין שתי הרמות הקרובות ביותר. זהו לא נחרץ על סוג שלם של שימוש לרעה — קריאת ציון כמדידה.
תאריך ושעה: תאריכים נקראים כטקסט, לא כטקסט
סידור שני תאריכים, מדידת המרחק ביניהם, או החלטה אם אחד מהם נופל בתוך חלון אינו אמין, והוא מידרדר עוד יותר עם פורמטים מעורבים, הפניות יחסיות וגבולות תחום כגון רבעונים, חלונות סליקה ותקופות צבירה.
הפיצול המומלץ הוא נקי. חילוץ הוא שיקול דעת, ולכן יש למסור אותו למודל. כל רכיב של תאריך הוא קבוצה סגורה קטנה — שנים־עשר חודשים, שלושים ואחד ימים אפשריים, טווח מוגבל של שנים — מה שהופך את החילוץ לבחירה מבין אפשרויות מנויות ולא לניתוח חופשי, ונותן לך מקום לשים "לא צוין" מפורש כך שחלק חסר מדווח במקום להיות מנוחש. הקוד מרכיב את החלקים ובעליו של כל מה שאחרי כן, כולל סדר, משך, היסט ויום בשבוע.
עקיפות: שלילות כפולות וצעדי ביניים מיותרים פוגעים בדיוק
הוראות המכילות שלילות כפולות או עקיפות מרובדת נענות באופן פחות מהימן. שאלה על תכונה של תכונה, או כזו שדורשת כמה שלבי הסקה, באה על חשבון הדיוק. הפתרון הוא לנסח הוראות בצורה ישירה ככל האפשר ולנקוב בחלקים הרלוונטיים של המצב במקום לתארם.
מצב גדול מלא בפרטים לא רלוונטיים פוגע בדיוק
הדיוק יורד ככל שהמצב גדל עם תוכן שאינו קשור להחלטה. פרט לא קשור משמש כמסיח, ומצב גדול מקשה לדעת איזה חלק מהקלט הניב תשובה שגויה. התזכורת של TypeSafe עצמה בהערת הסיום בוטה: "Jev סובל מריקבון הקשר, כך שחומר לא קשור במצב עולה לך בדיוק."
אחזר וסנן בקוד תחילה, ושלח רק את השדות שהשאלה צריכה. במקרים שבהם לא ניתן לסנן לפני הבקשה, הספק מציע להשתמש ב-noul כדי לסנן לפי רלוונטיות, ואז לשפוט את השורדים.
תוכן עוין במצב מזיז את התשובה
מצב הוא נתונים, ו-jev-1.13 אינו מתייחס אליו כעוין כברירת מחדל. הוראה מוזרקת, מסגור מטעה במכוון, או טקסט שטוען לסיווג של עצמו יכולים לשנות את התוצאה. זהו המצב היחיד שבו הספק מציג במפורש את התיקון כעבודה עתידית — "אנו מצפים לשפר זאת בעתיד" — והעצה הזמנית היא להיות מפורשים בקריטריונים ולבדוק את האינטגרציה ביסודיות לפני הצגתה בפני משתמשים רבים.
הוראות וקריטריונים סותרים מבלבלים אותו
כאשר ההוראות והקריטריונים מבקשים דברים שונים, המודל עלול להתבלבל. הדוגמה של TypeSafe היא noul שבו true ממופה ל-no ו-false ממופה ל-yes, וזה מתפקד גרוע יותר מאותה שאלה מנוסחת באופן עקבי. ההוראה היא להתייחס לקריטריונים כהרחבה של ההוראה ולהתאים בין השניים בשפה שאדם ממוצע יכול לקרוא ולהבין.
אינוואריאנטים מבניים שאינו מבטיח
זה המצב שסביר ביותר לשבור מערכת שנבנתה על הנחה שאיש לא רשם. Jev עקבי ביותר במובן הרגיל — קלטים דומים מבחינה סמנטית מפיקים פלטים דומים מבחינה כמותית — אך זהויות מבניות שאולי היית מצפה שיתקיימו אינן מובטחות. הספק מפרסם שני מקרים מעובדים.
• שאלה אחת, שני סוגי שאלות. "האם הלקוח מבקש החזר כספי?" נשאלת כ-noul ונשאלת כבחירת כן/לא, בפנייה "אני לא מרוצה מההתאמה. מהן האפשרויות שלי כאן?" מחזירה noul של 0.22, ובחירה של כן 0.01, לא 0.99, ביטחון 0.97. אלו תשובות לאותה שאלה.
• שאלה ושלילתה. "האם הלקוח מבקש החזר כספי?" ו"האם הלקוח מבקש משהו אחר מאשר החזר כספי?", כאשר הם נשאלים כשני nouls על הפנייה "חויבתי פעמיים עבור אותה הזמנה. מישהו יכול לבדוק את זה?", מחזירים 0.72 ו-0.47. הם מסתכמים ל-1.19.
התיקונים הם אופרטיביים, לא רטוריים: אל תסתמכו על אי-השתנות מבנית צפויה, אל תעבירו סף שמכוונן על noul אל בחירה, ואל תדרשו מהמודל זהויות אריתמטיות בין שאלות נפרדות. הסיבה היא שבחירה היא יחסית — היא מכריעה איזו אפשרות — בעוד שכל noul הוא מוחלט ויכול לחזור נמוך עבור כולן.
יצירה: זה לא אומן לכתוב
jev-1.13 אינו מאומן ליצור טקסט. ניתן לכפות פלט על ידי שרשור בחירות, ו-TypeSafe אומרת במפורש ש"זה לא יעבוד היטב ויהיה איטי מאוד". עבור חילוץ, ההנחיה היא לשלוף ערכי מועמדים באמצעות ביטוי רגולרי או מודל גנרטיבי ולתת ל-Jev לבחור את הנכון, או — כאשר מרחב התשובות חסום — להפוך את החילוץ לבחירה מבין האפשרויות במקום לבקש את הערך עצמו.
תקרת 255 האפשרויות בשאלות בחירה

שאלת בחירה: אינטגרציית Jev אינה קצה משונן, היא צורת המוצר. שווה להפריד אותן כי שום כמות של עבודה על הפרומפט לא משנה אותן:
ללא יצירת טקסט. הוא מחזיר החלטה, לא פרוזה. זהו התכנון, לא פגם.
• אין שיחה. Jev הוא מודל החלטות מובנה ולא מודל צ'אט. אתה שולח מצב וקבוצה של שאלות בעלות שמות; הוא מחזיר תשובה מובנית אחת לכל שאלה. אין חילופי תורות לתכנן סביבם.
• אין קלט מולטימודלי. הקלט הוא טקסט בלבד — מחרוזת, אובייקט JSON, או מערך של ערכי טקסט, ללא תמונה, אודיו או וידאו. חומר שאינו טקסט חייב לעבור עיבוד מקדים לטקסט או לשדות מובנים לפני שהוא הופך לחלק מהמצב.
• תגובות ללא זרימה. קיימת תגובה מובנית אחת ואין מצב זרימה. הסיבה שזה לא משנה היא אותה סיבה שבגללה כדאי לציין זאת: אין מה להזרים. להחלטה בעלת טיפוס — ערך בוליאני עם הסתברות, תגית אחת מתוך קבוצה, או רמה בסולם — אין צורה חלקית שכדאי לחשוף טוקן אחר טוקן.
• אנגלית היא השפה העיקרית. שפות אחרות, כולל כתבי CJK, מטופלות אך לא באותה מידה של הצלחה. העצה של TypeSafe היא לבדוק על התוכן שלך לפני הסתמכות על Jev לעומס עבודה שאינו באנגלית, ולהישען על רמת הביטחון בעת ניתוב.
תקרת 255 האפשרויות בשאלות בחירה
שאלת בחירה בוחרת אחת מתוך עד 255 אפשרויות מתויגות, והתקרה הזו היא קשיחה. TypeSafe גם מסבירה מדוע מערכי בחירה גדולים פועלים לאט יותר, במילותיו של הספק עצמו: "עבור בחירות בעלות קרדינליות גבוהה יותר, אנו מיישמים מערכת דו-שלבית של ניקוד באופן עצמאי ואז ביצוע בחירה מפורשת, ומכאן ההאטה המזדמנת." אז עלות השיהוי של מערך אפשרויות גדול היא מבנית ולא מקרית, וזה הספק שמספר לך מאין היא נובעת.
חלון ההגשה שלנו עבור typesafe/jev-1.13, כפי שהוא נקרא מכרטיס המודל ב-2026-09-30, מראה כיצד זה נראה בפועל לאורך שבעה ימים של התעבורה שלנו: חציון של 151 מ״ש ו-p95 של 247 מ״ש, 348 אסימוני פלט בשנייה, ושיעור שגיאות של 0.49% על פני 76.2 מיליון אסימונים שהוגשו. החציונים היומיים נעים בטווח צר — 175, 170, 163, 161, 170, 147 ו-143 מ״ש מ-2026-09-24 עד 2026-09-30 — אך ה-p95 היומי עבור 2026-09-28 הוא 2,448 מ״ש, כפי עשרה בערך מהימים שמשני צדדיו. איננו יכולים לייחס את החריגה החד-יומית הזו לקרדינליות של הבחירות, וגם לא נעשה זאת; הקריאה הכנה היא שהזנב קיים, ותהליך עבודה רגיש לשהיה צריך להיות מתוכנן כנגד הזנב ולא כנגד החציון.
חשבונית הקלט היא החשבונית כולה
הפלט מחויב באפס ב-Jev, מה שלפעמים נקרא כ"Jev בחינם". זה לא כך, משום שהקלט נמדד, ומצב גדול אינו בחינם רק מפני שאין דבר בצד הפלט. מחיר הספק הוא $0.042 למיליון טוקני קלט — אותו מספר ש-TypeSafe מציינת כ-$42 למיליארד — ו-OrcaRouter מעבירה את מחיר המחירון של הספק הלאה בתוספת של 0%, כך שהורדת מחיר של הספק מגיעה לכאן באותו יום.
הנה מה שזה עושה לצורה מציאותית, תוך שימוש בתעריף של הספק עצמו:
• בקשה קטנה. כרטיס תמיכה של 1,200 טוקנים בתוספת כ-300 טוקנים של מחוון ושאלות הם 1,500 טוקני קלט, שהם $0.000063 לכל קריאה.
• בקשה גדולה. חוזה של 55,000 אסימונים בתוספת שאלות שמביאות את הבקשה ל-60,000 אסימונים הוא פי 40 מהאסימונים, לכן $0.0025 לקריאה — עדיין קטן לקריאה, וגדול פי 40 מהמקרה הראשון עבור אותה תשובה אחת.
• בהיקף גבוה. 60,000 טוקנים לקריאה ו-10,000 קריאות ביום הם 600 מיליון טוקני קלט ביום, שהם 0.6 מיליארד, כלומר 25.20 דולר ביום וכ-756 דולר לאורך חודש של 30 יום. אותו מספר קריאות מול בקשת 1,500 טוקנים הוא 15 מיליון טוקנים ביום: 0.63 דולר ביום, כ-18.90 דולר בחודש.
הפער בין שתי השורות האחרונות אינו תעלול תמחור — זהו המצב הנמדד. זו הסיבה שהעצה לסינון במדור ריקבון ההקשר אינה רק מדד לדיוק; צמצום המצב הוא גם המנוף היחיד שמזיז את החשבון.
מגבלות התפעול המפורסמות, כך שאף אחד לא צריך לנחש

עמוד המודלים של TypeSafe מפרסם מספרים קונקרטיים, כך שמתכנן לא צריך להסיק אותם:
• תפוקה וקצב. 100K טוקנים לשנייה ו־40 בקשות לשנייה, לפי docs.typesafe.ai/models.md. בקשה החורגת מאחת מהמגבלות מחזירה 429 Too Many Requests; ערכות ה-SDK של הלקוח של הספק מנסות שוב עם השהיה מדורגת כברירת מחדל ומכבדות את כותרת retry-after כאשר התגובה כוללת אותה.
• המגבלות זזות. הספק מציין שמגבלות הקצב מותאמות באופן דינמי ו״יכולות להשתנות ללא״ ככל שקיבולת חדשה נכנסת לפעילות, כאשר מגבלות גבוהות יותר זמינות בתוכניות מותאמות אישית וארגוניות. התייחסו ל-100K/40 כמספר של היום ולא כחוזה.
• תקציב הקשר. תקציב הבקשה הוא בערך 64,000 טוקנים על פני המצב וכל השאלות גם יחד — כרטיס המודל מפרסם 65,536 — ועמוד המודלים של הספק מגביל בנפרד את המצב בתוספת השאלה היחידה הארוכה ביותר ל-32,000 טוקנים. הנתון השני הוא תקציב המצב, לא גרסה קטנה יותר של הראשון; שניהם אמיתיים ואף אחד מהם אינו סותר את האחר.
• כינויים זזים מתחת לרגליך. jev-latest ו-jev-preview מובילים שניהם היום ל-jev-1.13.0, והספק מציין שאין בילד preview זמין כרגע. כינוי זז כאשר יוצאת מהדורה חדשה, לכן אם כיוונת ספי ביטחון מול גרסה מסוימת, הצמד את מזהה הגרסה ובצע את המעבר לפי לוח הזמנים שלך.
איך מקרה השימוש שלך צריך להיראות
בקריאה מתחילתה ועד סופה, הרשימה של הספק עצמו מתארת כלי צר ושימושי. Jev מתאים כאשר השיפוט מוגבל והחשבון אינו תפקידו של המודל: האם הרשומה הזו בתוך המדיניות, איזו מבין ארבעים התגיות הללו חלה, כיצד זה נקרא בסולם של חמש דרגות — נשאל על מצב שסיננת בעצמך, עם הוראה מפורשת וקריטריונים שמתיישבים איתה, וכאשר כל ספירה, השוואה ומדידת תאריך מבוצעות בקוד סביבו.
זה לא מתאים כאשר המשימה דורשת ספירה, סידור או חשבון תאריכים, כאשר היא דורשת כמה שלבי הסקה, כאשר חומר הקלט אינו טקסט, כאשר המצב הוא ערימת שחת והשאלה היא מחט, או כאשר משהו במקור עוין. אלה אינם פערים בפרומפט; אלה מקומות שבהם המודל לא עובד, ו-TypeSafe הוא הצד שאומר זאת.
עוד דבר אחד שכדאי לדעת לפני שאתם מחברים את זה: ההבדל האמיתי באופן שבו קוראים ל-Jev. ב-OrcaRouter הקטלוג מגיע אל Jev דרך נקודת הקצה הייעודית systemone, POST /v1/systemone, ולא דרך צורת chat-completions של OpenAI. זהו הבדל אמיתי בבקשה שאתם כותבים, וזו הגרסה הנכונה של הטענה הישנה ש-Jev "מדבר במבנה בקשה משלו". כל השאר זהה לכל מודל אחר בחשבון — מפתח אחד ל-200+ מודלים, אין עמלות לפי טוקן מאיתנו, ומעבר אוטומטי לגיבוי אם נתיב מתקלקל. TypeSafe הסירה את רשימת ההמתנה ב-2026-09-21; דף הבית של הספק עצמו עדיין מתאר את Jev כגישה מוקדמת, ועמוד הבנצ'מרק שלו עדיין מסומן כממתין, כך שנתוני הביצועים היחידים בעמוד הזה הם נתוני ההגשה שמדדנו בעצמנו והטענות של הספק עצמו, המסומנות כטענותיו.
