כרטיס כותרת ל-Mistral Large 4 מול MiniMax M3, הבנוי סביב פער חודשי של 48 דולר עבור 100 מיליון טוקנים, כאשר MiniMax M3 מקבל קלט וידאו ופלט של 512K, ו-Mistral Large 4 הוא תצוגה מקדימה של תמונות בלבד.
Guides & Insights

Mistral Large 4 לעומת MiniMax M3: מה המחיר של חמישה חודשי התקדמות

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

MiniMax M3 הוא המודל הזול ביותר בקטגוריה הזו, וכך זה מאז 31 במאי 2026. במחיר של $0.30 למיליון אסימוני קלט, $1.20 למיליון אסימוני פלט ו-$0.06 למיליון אסימונים במטמון, הוא זול מ-Mistral Large 4 בבערך חצי בקלט ובפי שניים בפלט — ובשונה מהמודל החדש יותר, אפשר לקנות אותו היום בלי תווית תצוגה מקדימה. Mistral Large 4, מודל עם משקולות פתוחות בעל 1.05 טריליון פרמטרים בתצוגה מקדימה ציבורית מאז 6 באוקטובר 2026, עולה $0.68 ו-$2.09 ומבטיח משקולות עד סוף החודש. שני דגמי דגל עם משקולות פתוחות, בהפרש של חמישה חודשים, וחמשת החודשים נראים במקום אחד בדיוק: ציון ה-Intelligence Index העצמאי של M3, 29.2, לעומת ציון של Mistral Large 4 שעדיין לא קיים.

זו הצורה הכנה של ההשוואה הזאת, והיא מעניינת יותר ממה שטבלת מחירים מרמזת. M3 נבנה סביב הימור ארכיטקטוני ספציפי — MiniMax Sparse Attention, הנשמרת לאורך יותר ממיליון טוקנים של הקשר, עם וידאו כקלט מן המניין — והוא מנצח על הנייר בשתי קטגוריות ש-Mistral Large 4 לא מתחרה בהן: אורך פלט גולמי וווידאו נייטיבי. בכל מקום אחר, המודל החדש יותר הוא זה שקונה היה מעדיף, במחיר שעדיין נמוך מספיק כדי שההבדל רק לעתים רחוקות יכריע את הרכישה.

שתי ארכיטקטורות, שני הימורים

MiniMax M3 הוא מודל הבסיס המוביל עם משקולות פתוחות של MiniMax והראשון לשלב ביצועי קידוד ואייג'נטיות בחזית, חלון הקשר של מיליון טוקנים ורב-מודאליות מקורית במהדורה אחת. הוא מקבל טקסט, תמונות ווידאו ומחזיר טקסט, והוא בנוי על MiniMax Sparse Attention, ארכיטקטורה שנועדה לתמוך בעד 1,048,576 טוקנים של הקשר עם רצפה מובטחת של 512K. צינור האימון המקדים נבנה מחדש כדי להתרחב מעבר ל-100 טריליון טוקנים עם נתונים רב-מודאליים מהשלב הראשון ולא כתוספת שהולבשה מאוחר יותר. הפלט המרבי שלו הוא 512,000 טוקנים.

Mistral Large 4 מהמרת הימור אחר. זהו מודל תערובת-מומחים גרנולרי, 49 מיליארד פרמטרים פעילים מתוך 1.05 טריליון בסך הכול, עם מקודד חזותי בן 1.6 מיליארד פרמטרים, שאומן מאפס על 3,800 מעבדי NVIDIA Grace Blackwell בתוך מרכזי הנתונים האירופיים של Mistral עצמה, על נתונים הפרוסים על יותר מ-160 שפות. הוא קולט טקסט ותמונות — לא וידאו — לאורך הקשר של כמיליון טוקנים, ו-Mistral ממקמת אותו סביב פריסה ריבונית: תשתית אירופית, משקולות פתוחות, והיכולת להריץ אותו תחת המדיניות שלך, עם אבטחת סייבר כמקרה השימוש המוביל.

• חלון הקשר — MiniMax M3 1,048,576 טוקנים לעומת Mistral Large 4 כ-1,000,000

• פלט מקסימלי — MiniMax M3 512,000 טוקנים לעומת Mistral Large 4 שטרם תועד

• מודאליות קלט — MiniMax M3 טקסט, תמונה וווידאו לעומת Mistral Large 4 טקסט ותמונה

• מחיר קלט — MiniMax M3 $0.30 לכל 1M לעומת Mistral Large 4 $0.68 לכל 1M

• מחיר פלט — MiniMax M3 ‏$1.20 לכל מיליון לעומת Mistral Large 4 ‏$2.09 לכל מיליון

• קלט במטמון — MiniMax M3 $0.06 ל-1M לעומת Mistral Large 4 $0.07 ל-1M

• פרמטרים — Mistral Large 4 1.05T סה"כ / 49B פעילים לעומת MiniMax M3 לא ידוע

• שוחרר — MiniMax M3 31 במאי 2026 לעומת Mistral Large 4 6 באוקטובר 2026, תצוגה מקדימה

• משקלים — שניהם ברישיון פתוח, אלה של Mistral Large 4 הובטחו עד סוף אוקטובר 2026

A two-column scoreboard comparing Mistral Large 4 and MiniMax M3 on input and output price, Artificial Analysis Index, input modalities, maximum output and release date.

לוח התוצאות לא צמוד, והוא גם לא הוגן.

ב-Artificial Analysis Intelligence Index v4.3.2, MiniMax M3 מקבל ציון 29.2 ונמצא במקום ה-62 מתוך 147 מודלים. זו תוצאת אמצע טבלה, והיא אינה ביקורת על המודל — האינדקס עודכן לאחר ההשקה של M3 וכולל הערכות שלא היו קיימות כאשר MiniMax עבר אימון. תת-הציון שלו בקידוד מספר סיפור טוב יותר: 58.6 ב-AA Coding index, מקום 46 מתוך 138, ו-65.2% ב-Terminal-Bench 2.1. הוא מחזיק ב-92.9% ב-GPQA Diamond, 83% ב-long-context recall, ו-47.1% ב-SciCode.

ל-Mistral Large 4 אין ציון Index באותו לוח; העמוד פעיל תחת הכותרת "Mistral Large 4 Preview" והמספר חסר. מה שכן מפרסמת Mistral הוא ש-ML4 מוביל את DeepSeek V4 Pro 0813 ואת Qwen3.8 ב-Coding Agent Index המשולב ב-49.8%, וכי ב-AutomationBench — 657 תהליכי עבודה עסקיים ב-Gmail, Sheets, Slack ו-Salesforce — הוא משיג 59.9%, לפני Kimi K3, MiMo-V2.6-Pro ו-DeepSeek V4 Pro. MiniMax אינו מוזכר באף אחת מההשוואות, וזה כשלעצמו אות לגבי איזה מודל Mistral מחשיבה כמתחרה האמיתי.

אז הקריאה ההוגנת היא זו: M3 הוא מודל מוכשר, זול ומתועד היטב, עם ציון כללי באזור אמצע הטבלה ופרופיל קידוד מכובד, בן חמישה חודשים. ML4 הוא מודל בתצוגה מוקדמת עם תקרה מוצהרת גבוהה יותר, בלי ציון כללי שפורסם, ועם סט של נתונים סוכניים ש-Artificial Analysis העריכה באופן פרטי ותפרסם ב-Coding Agent Index כשההרנס הזה ישוחרר. אם אתה צריך מספר היום, M3 נותן לך אחד. אם אתה יכול לחכות כמה שבועות, ML4 ייתן לך אחד גם כן, ו-Mistral מהמרת שהוא יהיה גבוה יותר.

כאשר ל-M3 אין כלל תחרות מצד ML4

שתי שורות ברשימה הזו אינן פשרה, הן היעדר.

קלט וידאו הוא הראשון. M3 מקבל וידאו באופן מובנה, לצד טקסט ותמונות. Mistral Large 4 מקבל טקסט ותמונות ושום דבר אחר — החקירה העמוקה של Mistral עצמה עוסקת בעיגון על תמונות לוויין ברזולוציית ג'יגה-פיקסל ושרטוטים הנדסיים, שזו עדיין עבודת תמונה. אם הצינור שלך קולט הקלטות מסך, צילומי מעקב או תיעוד וידאו, ML4 לא יכול להיות המודל, לא משנה מה המחיר. זה לא פער ש-Mistral תסגור עם תמחור מחדש.

אורך הפלט הוא השני. M3 פולט עד 512,000 אסימונים בתגובה אחת. Mistral לא פרסמה תקרת פלט עבור ML4. יצירת ארטיפקט מובנה ארוך במעבר אחד — דוח מלא, סקריפט מיגרציה גדול, מפרט מלא — היא עומס העבודה שבו תקרה של 512K שווה יותר מנקודת Intelligence Index, ועד ש-Mistral תתעד את המגבלה של ML4, M3 הוא היחיד מבין השניים שאפשר לתכנן סביבו את עומס העבודה הזה.

המספרים האג'נטיים של M3 כפי שדווחו על ידי הספק מחזקים את אותו פרופיל. MiniMax מציבה אותו ב-83.5 ב-BrowseComp למחקר אינטרנט אוטונומי, 70 ב-OSWorld-verified לשימוש במחשב, 74.2 ב-MCP Atlas לשימוש בכלים, 76.7 ב-GDPval rubrics ו-59 ב-SWE Bench Pro. אלה מגיעים מההערכות של MiniMax עצמה ולא שוחזרו באופן עצמאי, והם עומדים באופן מוזר לעומת ציון ה-Index של 29.2 שלו — וזה בדיוק למה חשובה ההבחנה בין ספק לגורם בלתי תלוי. מודל יכול להוביל במדדים שנבחרו על ידי ספק ולנחות באמצע הטבלה בממוצע נייטרלי של עשר הערכות, ושני הדברים יכולים להיות נכונים.

האם ה-2x שווה את זה?

פער המחירים כאן קטן באמת במונחים מוחלטים, מה שמשנה את החישוב לעומת אי-התאמה מול מודל דגל סגור. קחו חודש של מאה מיליון טוקנים בחלוקה של 4:1 בין קלט לפלט: 80 מיליון טוקני קלט ו-20 מיליון פלט. M3 מחייב $24 ועוד $24, סך הכול $48. Mistral Large 4 מחייב $54.40 ועוד $41.80, סך הכול $96.20. הפרמיה היא כ-$48 בחודש — כסף אמיתי בקנה מידה גדול, אבל מסוג הפער שכשל אחד שנמנע משלם עליו.

השימוש במטמון מצמצם את הפער עוד יותר, ולטובת M3 רק באופן שולי: $0.06 לעומת $0.07 למיליון טוקנים במטמון הוא שגיאת עיגול בנקודת מחיר הזו. שניהם זולים מספיק כדי שההחלטה תתקבל על בסיס היכולות וההתאמה ולא על בסיס החשבונית, וזה ההפך מאיך שההשוואה הזו נקראת במבט ראשון.

מה שהפרמיה קונה הוא טווח. ML4 אומן חמישה חודשים מאוחר יותר על נתונים חדשים יותר, בפריסת תערובת מומחים עם טריליון פרמטרים ו-49 מיליארד פעילים, ו-Mistral מריצה עליו למידת חיזוק בקצב מוצהר של 33 מיליארד טוקנים ביום, בהרצה שעדיין לא הגיעה לרוויה. M3 הושלם; ML4 משתפר בקצב שפורסם. כשספק אומר שהמודל שאתם קונים היום הוא הגרסה החלשה ביותר שתשלמו עליה אי-פעם, והפרמיה על פני המודל הקיים היא פחות מדולר למיליון טוקנים, המודל החדש יותר הוא בדרך כלל ברירת המחדל הטובה יותר. היוצא מן הכלל הוא שני עומסי העבודה שלמעלה, שבהם המודל הישן יותר הוא היחיד שמתאים.

ניתוב סביב הפער

A screenshot of the OrcaRouter model page for MiniMax M3, showing the minimax/minimax-m3 route from MiniMax, its text, image and video input, and the $0.30 input and $1.20 output price per million tokens.

זיווג שבו הרצת שניהם אינה גידור אלא התשובה האמיתית, מפני ששני המודלים חזקים במקומות נפרדים. וידאו נכנס, ארטיפקט ארוך יוצא, או לופ של שימוש במחשב: M3. ניתוח מסמכים ותמונות, זרימות עבודה סוכניות, או כל דבר שצריך לרוץ על תשתית אירופית תחת המדיניות שלך: ML4. אין כלל ניתוב שהופך את אחד מהם למיותר.

שניהם יושבים מאחורי נקודת קצה אחת תואמת-OpenAI ב-OrcaRouter עם 0% תוספת מחיר ומחירי המחירון של הספקים מועברים ללא שינוי, מה ששומר על פער מחירים של חמישה חודשים כן — אם MiniMax תחתוך את התעריף של M3 או ש-Mistral תסיים את תעריף התצוגה המקדימה, המספר שמולו הניתוב שלך מוערך משתנה באותו יום. ה-DSL של הניתוב הוא מה שהופך את החוזקות המנותקות למשטח קריאה אחד: כלל שבוחן את המודאליות של הבקשה שולח מטענים הנושאים וידאו אל M3 ואת כל השאר אל ML4, מתוך ביטחון שהבהובים בזמינות של מודל תצוגה מקדימה נספגים על ידי מעבר אוטומטי בעת תקלה במקום להיות מופצים למשתמשים שלך. במקום שבו פלט בודד חשוב יותר ממחיר בודד, מיזוג מודלים יכול להריץ את שניהם ולתת לפאנל לבחור, וזו דרך סבירה לקנות את תקרת הביצועים המוצהרת של Mistral תוך שמירה על ההתנהגות המתועדת של M3 כרצפה.

A decision card headed When each one wins, matching MiniMax M3 to video input and 512K output at $0.30 and $1.20, and Mistral Large 4 to image and document work that runs in Europe.

פסק דין

MiniMax M3 הוא התשובה הנכונה לשני עומסי עבודה ותשובה מוצדקת לשלישי. קלט וידאו, יצירה במעבר יחיד של מאות אלפי טוקנים וסוכני שימוש במחשב הם התחום שלו, המחיר שלו הוא הנמוך מכל דגל בקטגוריה הזו, וציוני אמצע הטבלה שפורסמו שלו אומרים לך בדיוק מה אתה מקבל. גיל של חמישה חודשים אינו גיל מבוגר עבור מודל שלא הוחלף בתחום הנישה שלו.

Mistral Large 4 הוא ברירת המחדל הטובה יותר לכל השאר. חודש של מאה מיליון טוקנים עולה כ-48 דולר יותר, מספר הפרמטרים והרקע האימוני האירופי מצביעים על תקרה גבוהה יותר, הטענות בתחום הסייבר ספציפיות מספיק כדי שניתן לבדוק אותן, והמשקלים הפתוחים המובטחים בתוספת פריסה מקומית מספקים דרישות שסיפור הארגוני של M3, המבוסס על API בלבד, אינו מספק. המחיר של ההימור הזה הוא שאתה מתחייב למודל שציון ה-Independent Intelligence Index שלו טרם פורסם ושהתנהגותו, לפי Mistral, תשתנה באופן משמעותי בתוך שבועות.

שני התאריכים שיכריעו את זה: סוף אוקטובר 2026, כאשר המשקלים של ML4 או יגיעו, או שההבטחה למשקלים פתוחים תתחיל להיראות חלשה, ופרסומו של מדד סוכני הקידוד (Coding Agent Index), שבו 49.8% שהוערכו באופן פרטי של Mistral פוגשים את ציון הקידוד הציבורי 58.6 של M3 באותה מהדורה. עד אז, M3 הוא המודל שאפשר לאמת, ו-ML4 הוא המודל שעליו אתם מהמרים — ובפרמיה חודשית של 48 דולר על מאה מיליון טוקנים, זה לא הימור גדול.