כרטיס כותרת שנוצר עבור המאמר 'Mistral Large 4 הוא תצוגה מקדימה של 1T פרמטרים', המציג את הכותרת בסאנס-סריף גיאומטרי מודגש, את כותרת המשנה 'המשקלים טרם שוחררו' מתחתיה, ומעל הכותרת שורה של שלושה אייקוני קו שטוחים — מנעול סגור, חץ הורדה אפור ומגן — על רקע לבן עם הדגשות בגרדיאנט כחול־ציאן ולוגו OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

Mistral Large 4 הוא תצוגה מקדימה של טריליון פרמטרים: המשקולות טרם שוחררו

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Mistral Large 4 הגיע ב-6 באוקטובר 2026 כתצוגה מקדימה ציבורית — מודל תערובת מומחים עם טריליון פרמטרים, עם 49 מיליארד פרמטרים פעילים, מקודד חזותי עם 1.6 מיליארד פרמטרים, והצהרה מהיצרנית שלפיה זהו המודל החזק ביותר עם משקולות פתוחות שנבנה מחוץ לסין. מה שטרם הגיע הוא החלק שהמילים "משקולות פתוחות" מתארות. אין היום צ׳קפוינטים להורדה, אין קובץ רישיון, ואין מאגר. Mistral אומרת שהמשקולות יגיעו "בסוף החודש הזה", לאחר חלון בדיקות תקיפה שבמהלכו שותפים מאומתים ורשויות לאומיות יקבלו גרסה לא נעולה עם מודרציה מצומצמת ויכולת סייבר מורחבת. לכן התיאור המדויק של Mistral Large 4 השבוע הוא API לתצוגה מקדימה שאפשר לקרוא לו, ומודל שאי אפשר עדיין להחזיק בבעלות עליו.

הפיצול הזה הוא הסיפור, לא הערת שוליים לו. כל מספר שפרסמה Mistral לצד ההכרזה — ציוני הקידוד, ציוני הסייבר, ההערכות הפיננסיות והמשפטיות — הופק על גבי בילד שעדיין משתנה, וכל כותרת שמשווה אותו למודל חזית סגור משווה ארטיפקט שלא יהיה הארטיפקט שתוריד. הדבר המועיל לעשות עם השקה כזו הוא להפריד את מה שאתה יכול לאמת היום ממה שמבקשים ממך לקחת באמונה, והפוסט של mistral.ai עצמו נדיב באופן יוצא דופן לגבי מה שייך למה.

מה בעצם לייב ב-6 באוקטובר

ה-API של התצוגה המקדימה פעיל ב-Mistral Studio תחת מזהה המודל mistral-large-4-0. כרטיס המודל של Mistral עצמה מתאר אותו כ"מודל מולטימודאלי לשימוש כללי, במשקלים פתוחים, מתקדם ביותר" הבנוי על ארכיטקטורת MoE גרגרית, ומפרט את מספר הפרמטרים כ-49 מיליארד פעילים מול 1.05 טריליון בסך הכול, בתוספת המקודד החזותי. החברה אימנה אותו מאפס על 3,800 מעבדי NVIDIA Grace Blackwell במרכזי הנתונים האירופיים שלה, והתצוגה המקדימה מוגשת על אותה תשתית בדיוק — טיעון ריבונות ש-Mistral משמיעה בקול רם לא פחות מהטיעון בדבר הביצועים.

המפרט, כפי שהספק מציג אותו:

סך הפרמטרים לעומת פרמטרים פעילים — 1.05 טריליון סך הכול, 49 מיליארד פעילים לכל טוקן, MoE דליל

• מודאליות — טקסט ותמונה בקלט, טקסט בפלט; מולטימודאלי באופן מובנה ולא כמתאם שהודבק בדיעבד

• חלון הקשר: המסמכים של Mistral מציינים 1M טוקנים; Artificial Analysis קוראת 524,288 בתצורה שהיא בודקת, אז התייחסו ל-1M כתקרה של הספק

• מחיר — $1.36 למיליון טוקני קלט ו-$4.18 למיליון פלט, עם קלט במטמון ב-$0.14, לפי הכרטיס המפורסם של Mistral

• מבצע השקה — אותו כרטיס מציג מבצע עם מחיר מחוק של $0.68 / $2.09, עם קלט במטמון של $0.07, כלומר חצי מחיר

• משקלים — לא שוחררו; "סוף החודש הזה", לפי ההודעה

• רישיון — לא צוין שמו בהודעה ובעמוד התיעוד, אשר מתייג את הערך רק כ"Open"

שתיים מהשורות האלה ראויות להיקרא פעמיים. חלון ההקשר שונה פי שניים בהתאם לשאלה אם קוראים את הספק או את מעבדת צד שלישי, מה שאינו חריג עבור תצוגה מקדימה שתצורת ההגשה שלה עדיין משתנה, אך כדאי לדעת לפני שאתם קובעים את גודלו של עומס עבודה על בסיסו. והמחיר שתשלמו תלוי בשאלה אם התעריף המבצעי ישרוד את חלון ההשקה; $1.36 / $4.18 הוא המספר שמחירון התעריפים של Mistral עצמה מפרט, ואילו $0.68 / $2.09 הוא המספר שהיא גובה כעת. הניחו את הראשון כשאתם בונים מודל של החיוב שלכם.

A generated single-column scoreboard titled 'Mistral Large 4 Preview — the scoreboard', listing the API id mistral-large-4-0 and rows: Intelligence Index v4.3 38.4; cost per index task $1.13; Terminal-Bench 4.0 26.8%; Humanity's Last Exam 35.0%; MMMU-Pro 76.4%; context 1M stated by the vendor against 524,288 tested; input $1.36 now $0.68; output $4.18 now $2.09; cached input $0.14 now $0.07; weights promised end of October; licence unnamed; announced 6 October 2026. The footer reads that index and per-task figures are per Artificial Analysis Intelligence Index v4.3 read 6 October 2026, prices are per the vendor's own rate card, and AA still flags the model isOpenWeights: false.

מספרי הבנצ'מרק, ומי שהריץ אותם

הפוסט של Mistral מקפיד באשר למקור הנתונים, וכדאי לשמר את הזהירות הזו. שלושה מנתוני הדגל של הקידוד הסוכני — 61.7% ב-DeepSWE v1.1, 59.4% ב-SWE-Atlas-QnA, ו-28.3% ב-Terminal-Bench 4.0, שמתאחדים לציון של 49.8% במדד Coding Agent Index — הם, במילותיה של Mistral עצמה, "המספרים שהוערכו באופן פרטי על ידי Artificial Analysis לפני ההשקה הציבורית של מערך הבדיקות". הם עדיין לא מופיעים במדד הציבורי של Artificial Analysis. הם יופיעו בו, כאשר מערך הבדיקות ייצא. עד אז, אלו נתונים שפורסמו על ידי הספק, אשר צד שלישי הפיק אך טרם פרסם, וזהו מקור חזק יותר מרוב טענות ההשקה, אך עדיין לא אותו דבר כמו ציון ציבורי שניתן לשחזר.

A screenshot of Mistral's own documentation, the Models Overview page at docs.mistral.ai, showing the GENERALIST MODELS card grid in which 'Mistral Large 4' is listed with a version tag of v26.10 and the description 'A state-of-the-art, open-weight, general-purpose multimodal model' — the description Mistral Large 3 beside it shares, while only Large 3 carries an APACHE 2.0 licence badge. Mistral Small 4, Mistral Medium 3.5, Z.ai GLM 5.3 and the Ministral 3 sizes are also visible, and the OCR MODELS section begins below.

מה שציבורי ועצמאי כיום, כפי שמופיע בדף המודל של Artificial Analysis ב-6 באוקטובר: Mistral Large 4 Preview מקבל ציון 38.4 ב-Intelligence Index v4.3, כשהוא לוקח כ-507 שניות לכל משימה, עם Terminal-Bench 4.0 ב-26.8% ו-Long-Context Reasoning ב-81.3%. אותו דף מציין אותו כמודל בעל משקולות פתוחות, שלמעשה אינו בעל משקולות פתוחות — הדגל מציין isOpenWeights: false עם הסיווג "proprietary," מכיוון שתצוגה מקדימה המוגשת מהאשכול של הספק עצמו היא מה שקיים. הדגל הזה הוא ההמחשה הבודדת הנקייה ביותר של הפער שהמאמר הזה עוסק בו.

A screenshot of the Artificial Analysis model page for Mistral Large 4 Preview, showing the header describing it as a proprietary model released October 2026, percentile ranks of #64 of 225 for intelligence, #51 for speed, #56 for cost and #105 for verbosity, pricing of $1.36 in and $4.18 out with a 90% cache discount, an Intelligence Index of 38, a cost-per-task figure of $1.13, and a summary paragraph noting a 524k-token context window, text and image input, and roughly 200M tokens generated during the index run.

התוצאה הראויה ביותר לציטוט היא זו שמיסטרל לא הריצה בעצמה. Surge AI, חברת תיוג צד שלישי, הפעילה הערכה אנושית עיוורת של איכות קוד כשזהויות המודלים מוסתרות, ומתייגים מקצועיים דירגו את Mistral Large 4 Preview ב-3.74 בסולם של 1–5 — שני מתוך חמישה, לפני Kimi K3 עם 3.59, GLM-5.3 עם 3.60 ו-GLM-5.2 עם 3.40, ורק אחרי Claude Opus 5 עם 4.22. הערכה אנושית עיוורת שבה מעבדה בשם מוכר נמצאת בצד השני היא סוג אחר של ראיות לעומת מבחן שרץ בעצמו, והיא נקודת הנתונים העצמאית החזקה ביותר בהודעה.

ואז יש את הסייבר, שבו Mistral מציגה את הטענה החדה ביותר שלה. ב-Cyber Index של Artificial Analysis, החברה אומרת ש-Mistral Large 4 מדורגת בחמישייה המובילה העולמית ומובילה מודלים במשקלים פתוחים שפותחו מחוץ לסין. במבחן ספציפי אחד — לשחזר חולשת אבטחה אמיתית בתוכנת קוד פתוח, ואז לתקן אותה — היא משיגה 82%, תוצאה המתוארת כגבוהה ביותר מכל מודל, עם 93% ב-40 תרגילי התחרות של Cybench. Mistral מוסיפה הערה חדה: כמה מודלים סגורים מובילים, Claude Opus 5.5 וGPT-6 Astra שנמנים ביניהם, מקבלים כמעט אפס באותו מבחן כי הם מסרבים למשימה. בלי שהדף של צד שלישי מונח לפניך, ה-82% הוא נתון של ספק; הטיעון בדבר שיעור הסירוב הוא פרשנות של ספק. שניהם סבירים, ואף אחד מהם אינו מאומת באופן בלתי תלוי היום.

מדוע מסגור התצוגה המקדימה משנה את חישובי המחיר

תצוגה מקדימה אינה רק תווית של שלב. היא משמעה שניתן לכוון את המודל מחדש, לתמחר אותו מחדש או להוציא אותו משימוש עם פחות הודעה מוקדמת מאשר מהדורת GA, והיא משמעה שתצורת ההגשה שכנגדה אתה מבצע בנצ'מרק עשויה שלא להיות התצורה שכנגדה אתה פורס. עבור החלטת ניתוב, זוהי עלות ממשית: צינור שעבר כוונון על בסיס הבילד של השבוע נושא עמו חשבון אימות מחדש שלא תיקצבת עבורו.

בOrcaRouter, שבה למעלה מ-200 מודלים יושבים מאחורי נקודת קצה אחת תואמת OpenAI במחיר המחירון של הספק, עם 0% תוספת מחיר שמועברת ישירות הלאה, שינוי מחיר בכרטיס של ספק הוא שינוי מחיר אצלנו באותו היום — וזה חשוב כאן בדיוק מפני שההשקה הזו מגיעה עם שני מחירים, שאחד מהם מחוק. מעבר אוטומטי בעת כשל הוא החצי השני של התשובה לתצוגה מקדימה שאינה מוכחת: הוא מאפשר להעביר חלק מתעבורת הייצור ל-Mistral Large 4 בעוד מודל של צד ראשון מחזיק בשאר, כך שתצוגה מקדימה שמתדרדרת תחת עומס העבודה האמיתי שלך הופכת לניתוב מחדש ולא לתקרית. מה שקוראים זהירים צריכים לא להניח הוא ש-Mistral Large 4 ניתן לניתוב ב-OrcaRouter היום. הוא אינו בקטלוג — התצוגה המקדימה נגישה דרך ה-API של Mistral עצמה וכמה פלטפורמות של צד שלישי, והמשקולות שלה, כשיגיעו, יהיו עניין של אירוח עצמי.

הטענה בדבר משקולות פתוחות היא כרגע הבטחה

המסגור של Mistral הוא ש-Mistral Large 4 "דוחף את גבול הביצועים של משקולות פתוחות", ושמשקולות פתוחות הן המנגנון שבאמצעותו ארגונים שומרים על שליטה במודל. זהו טיעון שניתן להגן עליו עבור המודל ש-Mistral מתכוונת לשחרר. עבור המודל שהיא שחררה השבוע, המנגנון נעדר: אין מאגר Hugging Face, אין טקסט רישיון, אין צ'קפוינט שניתן להוריד. בארגון Hugging Face של החברה עצמה, שנבדק ב-6 באוקטובר, אין דבר חדש מיולי, והרשומות החדשות ביותר בו אינן קשורות לסדרת Large.

זה לא ביקורת על התוכנית; שחרור משקולות מדורג לאחר חלון של רד-טימינג הוא מדיניות קוהרנטית, ו-Mistral מפורשת לגבי זה. זו זהירות בנוגע לשם התואר. "Open-weight" עושה עבודת שיווק בפסקה שבה המשקולות נמצאות במרחק ארבעה שבועות, והרישיון שמסדיר אותם לא צוין בשמו. רישיון מתירני ותנאים בסגנון Apache הם תוצאה אחת; רישיון למחקר בלבד או עם תקרת הכנסה הוא תוצאה אחרת, וההכרזה לא בוחרת ביניהם.

מה לבדוק לפני סוף אוקטובר

חמישה דברים יהפכו את התצוגה המקדימה הזו לעובדה מוגמרת, וכל אחד מהם ניתן לבדיקה בלי לשאול את Mistral דבר:

• מאגר Hugging Face תחת ארגון Mistral הנושא את הצ'קפוינט ואת קובץ הרישיון — המהדורה ש-Mistral התחייבה לה החודש

• שם הרישיון עצמו, שקובע אם "משקולות פתוחות" פירושו חופש בסגנון Apache-2.0 או הענקה עם תקרת שימוש

• האם תעריף המבצע של $0.68 / $2.09 נשמר, או חוזר ל-$1.36 / $4.18 שבכרטיס התעריפים

• האם Artificial Analysis תעביר את נתוני הקידוד שהוערכו באופן פרטי לאינדקס הציבורי שלה כשההרנס יוצא לאור, והאם הם יישארו באותם ערכים

• חלון ההקשר המוגש, המופיע כיום כ-1M מטעם הספק ונקרא כ-524,288 על ידי המעבדה העצמאית

עד שאלה ייפתרו, הגישה הנכונה כלפי Mistral Large 4 היא זו שההשקה שלה עצמה מזמינה: קראו לו, מדדו אותו על עומס העבודה שלכם, והשאירו את נתיב הייצור על מודל שההתנהגות שלו לא מתוכננת להשתנות. המשקולות הן האירוע. התצוגה המקדימה היא הקדימון.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית