
מהו MiniMax M3? ספינת הדגל הרב-מודלית של MiniMax עם חלון הקשר של 1M
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
MiniMax M3 הוא מודל שפה רב-מודאלי באופן מולד עם משקולות פתוחות, מבית המעבדה הסינית שעומדת מאחורי מודלי הטקסט מסדרת M, מודלי הווידאו Hailuo וסדרת Music. המעבדה הכריזה עליו ב-1 ביוני 2026 והוא תפס את המקום הראשון ברשימת המודלים של החברה עצמה מידי MiniMax M2.7, והביא חלון הקשר של מיליון טוקנים, קלט ילידי של טקסט-תמונה-וידאו, וארכיטקטורת קשב דלילה שהמעבדה מכנה MSA.
ארבעה־עשר מאמרים בארכיון הבלוג הזה מזכירים את MiniMax M3. עד עכשיו, אף אחד מהם לא עסק בו. המודל מופיע כיריב בהשוואה אחר השוואה — נקודת הייחוס עם משקולות פתוחות שדגם חדש יותר של Gemini, Qwen, Grok או GPT נמדד מולה — וכאן לא היה עמוד שקורא יכול לנחות עליו כדי לגלות מהו MiniMax M3 באמת. זהו אותו עמוד.
גיליון המפרט
MiniMax M3 הוא מודל תערובת-מומחים עם כ-428 מיליארד פרמטרים בסך הכול וכ-23 מיליארד פרמטרים מופעלים לכל טוקן, לפי כרטיס המודל ש-MiniMax מפרסמת לצד המשקולות. הוא מולטימודלי באופן מובנה ולא מודל טקסטואלי בלבד שאליו הודבקה ראייה בדיעבד: הכרטיס מתאר אימון על מודאליות משולבות מהשלב הראשון, והמודל מקבל קלט של טקסט, תמונה וווידאו ומחזיר טקסט.
• חלון הקשר: 1,048,576 טוקנים, כאשר הערך בקטלוג שלנו מציין מינימום מובטח של 512,000 טוקנים של הקשר שמיש
• פלט מקסימלי: 512,000 טוקנים בדף הקטלוג שלנו; MiniMax לא מפרסמת נתון פלט מקסימלי בחומרים שלה, ולכן יש להתייחס ל-512K כאל המספר שלנו, לא של הספק
• מודאליות: קלט טקסט, תמונה ווידאו; פלט טקסט
• פרמטרים: ~428B סה"כ, ~23B פעילים לכל טוקן
• שליטה בחשיבה: פרמטר חשיבה עם מצבים מופעל, אדפטיבי ומושבת
• דגימה מומלצת: temperature 1.0, top_p 0.95
• ארכיטקטורה: MiniMax Sparse Attention (MSA), הנושא של מאמר arXiv 2606.13392
• צורת נקודת קצה: השלמות צ'אט תואמות OpenAI
הטענה הארכיטקטונית המרכזית נוגעת לעלות הקשב בהקשר ארוך. לפי MiniMax, MSA מספקת מילוי מוקדם מהיר ביותר מפי 9 ופענוח מהיר ביותר מפי 15 מאשר M2 בחלון של מיליון טוקנים, ומצמצמת את החישוב לכל טוקן לכאחד חלקי עשרים מהדור הקודם. אלה נתוני ספק, ולא ראינו אותם משוחזרים באופן עצמאי.
היכן ממוקם MiniMax M3 בקו המוצרים של MiniMax עצמה
זהו הדגם הבכיר בקו השפה, אבל כדאי להיות מדויקים לגבי מה שכלול בקו הזה, משום ש-MiniMax שומרת על זנב ארוך יותר של דגמים שעדיין מופיעים ברשימה מאשר רוב המעבדות. התיעוד של הספק עצמו לגבי הדגמים מחלק אותם לשניים.
• מודלים נוכחיים: MiniMax M3, MiniMax M2.7, MiniMax M2.7-highspeed
• מודלים מדור קודם, שעדיין מופיעים ברשימה: MiniMax M2.5, MiniMax M2.5-highspeed, MiniMax M2.1, MiniMax M2.1-highspeed, MiniMax M2
• MiniMax M2, הוותיק שבהם, כולל חלון הקשר של 200,000 טוקנים ופלט מקסימלי של 128,000 טוקנים, כולל שרשרת מחשבה
• MiniMax אינה מפרסמת מגבלות הקשר או פלט עבור M2.7 או M2.1 באותו מסמך
הפער הדורי אמיתי אך לא עצום במדד האחד שבו מופיעים שני המודלים. Artificial Analysis נותנת ל-MiniMax M3 ציון 29 בגרסה v4.3.2 של מדד Intelligence Index, ול-MiniMax M2.7 ציון 23 באותה גרסה — 29 מציב את M3 במקום ה-16 מתוך 114 מודלים בטבלה של אותה גרסה, ו-23 מציב את M2.7 במקום ה-36. M2.7 שוחרר במרץ 2026. הזינוק הוא צעד, לא דור, וכדאי לקרוא את שני המספרים מאותה גרסה: המדד הזה כויל מחדש ב-7 בספטמבר 2026, וציונים מלפני תאריך זה אינם ברי השוואה לציונים שאחריו.
כמה זה עולה
MiniMax מתמחרת את M3 לפי גודל הבקשה בכרטיס התעריפים שלה בתשלום לפי שימוש, והתעריפים המפורסמים כוללים הנחה קבועה של 50% לעומת מחיר מחירון גבוה יותר.
• עד 512K טוקנים של קלט: $0.30 למיליון טוקני קלט, $1.20 למיליון טוקני פלט, $0.06 למיליון קריאות מהמטמון — לעומת מחירון של $0.60 / $2.40 / $0.12
• מעל 512K טוקנים של קלט: $0.60 למיליון קלט, $2.40 למיליון פלט, $0.12 למיליון קריאות מהמטמון — לעומת מחירון של $1.20 / $4.80 / $0.24
• שכבת שירות בעדיפות: פי 1.5 מהתעריף הרגיל, כלומר $0.45 / $1.80 / $0.09 בשכבת הבקשות הקטנות, נבחרת על ידי הגדרת service_tier ל-"priority"
• לא מפורסם: MiniMax אינה מציינת מחיר כתיבה למטמון עבור M3, אלא רק מחיר קריאה מהמטמון
OrcaRouter מספקת את MiniMax M3 באותם מספרים — $0.30 לקלט, $1.20 לפלט — ללא תוספת מעל תעריף הספק. זהו מודל מובלט בקטלוג שלנו, והתעבורה אינה מבוטלת: 153.7 מיליון טוקנים נותבו בשבעת הימים האחרונים בזמן כתיבת שורות אלו, עם p50 לזמן עד לטוקן הראשון של 4.26 שניות ו-p95 של 10.00 שניות.

במה MiniMax M3 טוב באופן מדיד
התחל עם המספרים ש-MiniMax מדווחת על עצמה, שכולם מדווחים על ידי הספק, ואף אחד מהם לא ראינו משוחזר על ידי צד שלישי.
• SWE-Bench Pro: 59.0%
• Terminal-Bench 2.1: 66.0%
• SWE-fficiency: 34.8%
• MCP Atlas: 74.2%
• BrowseComp: 83.5, הנתון שהספק מציג בראש ובראשונה בחיפוש סוכני
• Video-MME: 84.6 ב-512 פריימים, כאשר ה-API החיצוני מגביל את מספר הפריימים ל-640
• KernelBench Hard: 28.8%
• OSWorld-Verified: 68.70% ב-100 צעדים מרביים, ועולה ל-70.06% ב-200
התמונה הבלתי־תלויה מסכימה עם הכיוון. Artificial Analysis מציבה את MiniMax M3 במדד אינטליגנציה של 29 בגרסה v4.3.2, במקום ה־16 מתוך 114 מודלים, בעלות של 0.51 דולר להרצת המדד לכל מודל — מקום 21 מתוך 114 במדד עלות זה. מהירות הפלט היא 106.4 טוקנים לשנייה לעומת חציון של 67.1, והזמן עד לטוקן הראשון הוא 1.25 שניות לעומת חציון של 2.33 שניות. שניהם טובים מהמקובל בדרג הזה, והמחיר נמוך בהרבה ממנו.
פרסום חוזר על ידי צד שלישי של אותה משפחת מדדים משלים את תתי-הציונים: SWE-bench Verified ב-80.5%, tau-squared-bench ב-88.9%, AA-GPQA Diamond ב-92.9%, AA-LCR ב-83.0%, AA-IFBench ב-82.9%, OmniDocBench 1.5 ב-91.6%, ו-USAMO 2026 ב-85.7%. הבנת מסמכים ומעקב אחר הוראות נראים כחוזקות אמיתיות, וציון החשיבה בהקשר ארוך תואם את הסיפור הארכיטקטוני.

במה זה גרוע באופן מדיד
החולשות הכנות מתקבצות בשני מקומות, ושתיהן נראות במספרים שפורסמו.
• הפער האייג'נטי הוא הגדול: באותה הפצה מחדש של צד שלישי, MiniMax M3 משיג 58.6 במדד AA Coding Index אך רק 30.8 במדד AA Agentic Index. הוא כותב קוד טוב בהרבה מכפי שהוא מנווט משימה ארוכת-שלבים באופן אוטונומי.
• ידע והזיות: מדד AA-Omniscience של 1.4, דיוק של 16.7%, ושיעור הזיות של 18.4%. זהו מודל שיענה בביטחון על דברים שאינו יודע.
• OSWorld 2.0: 4.6%
• CritPt: 3.7%, הציון המפורסם החלש ביותר שמצאנו עבור M3 בכל מקום
• ResearchClawBench: 19.8%
• פטפטנות: 120 מיליון טוקנים של פלט כדי להשלים את Intelligence Index, דירוג 11 מתוך 114 — זהו מודל פטפטן, ובפרומפטים עתירי-חשיבה זה ניכר בחשבון
• רצפת הציון המשולב: אגרגטור צד שלישי אחד מציב אותו ב-55.28 מתוך 100, דירוג 60 מתוך 505, אם כי על כיסוי חלקי של 50 מדדים מתוך 481, כך שהציון המשולב הזה הוא רצפה ולא פסק דין
מספר דברים פשוט אינם נמדדים, ואנחנו מעדיפים לומר זאת מאשר למלא את הפער. אף אחד מחוץ ל-MiniMax לא שחזר את טבלת הבנצ'מרק של הספק שלעיל. Artificial Analysis אינה מפרסמת בעצמה נתון של Coding Index או Agentic Index עבור M3 — צמד 58.6 ו-30.8 מגיע מצד שלישי שמפרסם מחדש את אותה משפחת מדדים. Artificial Analysis מכנה את AA-Omniscience כמרכיב במדד שלה, אך אינה מפרסמת ציון Omniscience מספרי עבור M3. MiniMax אינה מפרסמת נתון פלט מקסימלי, כך ש-512K בעמוד המודל שלנו הוא שלנו. ובכלל אין מחיר cache-write בכרטיס התעריפים של הספק.
למי כדאי לבחור ב-MiniMax M3, ולמי כדאי לבחור במשהו אחר
בחרו ב-MiniMax M3 כשהמשימה היא הקשר ארוך ומולטימודאליות בעת ובעונה אחת. מיליון טוקנים עם קלט וידאו, משקולות פתוחות שתוכלו להוריד ולהריץ בעצמכם, ומחיר קלט של $0.30 למיליון טוקנים — זהו שילוב ששום דבר אחר בתחום המשקולות הפתוחות לא משתווה לו באופן נקי. ניתוח מסמכים ארוכים, הבנת וידאו, קריאת קוד בקנה מידה של מאגר וצינורות חילוץ מסמכים הם התחומים שבהם נמצאות החוזקות הנמדדות — 91.6% ב-OmniDocBench ו-83.0% ב-AA-LCR הם המספרים שמדברים בעדו.
בחר משהו אחר בשלושה מקרים. אם אינך זקוק לחלון ההקשר או לקלט החזותי, MiniMax M2.7 עולה אותו מחיר, $0.30/$1.20, מקבל 23 לעומת 29 של M3 במהדורת המדד הנוכחית, והוא דבר קטן יותר לתפעול — היתרון של M3 אינו חינם, הוא רק מתומחר באותו מחיר מחירון. אם עומס העבודה שלך הוא סוכנים אוטונומיים ולא קידוד, הפער הסוכני הוא הסיבה לחפש במקום אחר, וטבלת ההשוואה של MiniMax עצמה מצביעה לאותו מקום: ב-PostTrainBench הספק מדווח על 0.37 עבור M3 לעומת 0.42 עבור Opus 4.7 ו-0.39 עבור GPT-5.5, המדד המפורסם היחיד שבו M3 מפסיד לשניהם. ואם אתה זקוק לרישיון ללא תנאים נסתרים, קרא את הפסקה הבאה לפני שאתה מתחייב.
הרישיון הוא המלכוד שסיקורים רבים מדלגים עליו. MiniMax M3 מופץ תחת רישיון הקהילה של MiniMax, ולא תחת Apache או MIT. שימוש שאינו מסחרי הוא בחינם. שימוש מסחרי מותר, אך עליכם להציג באופן בולט "Built with MiniMax M3". מתחת ל-20 מיליון דולר הכנסה שנתית אתם מגישים הודעה חד-פעמית; מעל לכך אתם זקוקים לאישור מוקדם בכתב מ-MiniMax, אותו יש לבקש בדואר אלקטרוני עם הנושא "M3 licensing - authorization request". הרישיון כולל גם נספח של שימושים אסורים. אם אתם משיקים מוצר, מדובר בבדיקה משפטית, ולא בפורמליות.
הסיכום המעשי
MiniMax M3 הוא דגם הדגל הנוכחי של קו השפה של MiniMax: מודל תערובת-מומחים עם ~428 מיליארד פרמטרים, ~23 מיליארד פעילים לכל טוקן, חלון הקשר של מיליון טוקנים, קלט וידאו ותמונה מובנה, וקשב דליל (sparse attention) שהיצרן מייחס לו הפחתה של פי 20 בחישוב לכל טוקן בהקשר מלא. הוא הוכרז ב-1 ביוני 2026, כך שזהו מודל מגובש, לא חדש — השאלה המעניינת בספטמבר 2026 היא לא אם הוא טוב, אלא לאיזה חצי מעומס העבודה שלך הוא טוב.
התשובה שנמדדה היא שהוא חזק בקוד ובמסמכים, בינוני בידע, וחלש בעבודה סוכנית אוטונומית. הוא זול ביחס למה שהוא עושה, והוא המודל הנדיר עם משקולות פתוחות שבו הטענה בדבר הקשר הארוך שורדת בחינה עצמאית. הרישיון הוא החלק שבו רוב הצוותים יצטרכו לנהל משא ומתן עם עצמם.
MiniMax M3 פועל ב-OrcaRouter בתעריף של הספק ללא תוספת מחיר, דרך אותה נקודת קצה תואמת OpenAI כמו כל השאר כאן: מפתח API אחד מגיע ל-200+ מודלים, עם מעבר אוטומטי לגיבוי אם נקודת קצה נופלת, ו-DSL לניתוב כשאתם רוצים לנעוץ או למזג. אם אתם רוצים להשוות אותו לשאר הקטלוג לפני שאתם מתחייבים, בעמוד המודל יש את לוח התעריפים החי, אחוזונים של זמן עד לאסימון הראשון ותעבורה.

השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
