כרטיס הירו שנוצר שכותרתו MiniMax M3.1 Flash Preview, עם כותרת המשנה 'לייב ב-Token Plan, 27 בספטמבר 2026'. שלושה צ'יפים מציגים 'הקשר של 1M טוקנים', 'קלט של טקסט + תמונה + וידאו', ו-'Token Plan בלבד — ללא תשלום לפי שימוש'. כרטיס שמאלי מציג 'אושר על ידי הספק: אותו Subscription Key כמו M3 ו-M2.7, חשיבה פועלת כברירת מחדל, מאמץ מ-low עד max'; כרטיס ימני מציג 'לא פורסם: מחיר לפי טוקן, כרטיס מודל, בנצ'מרקים, משקלים, מדידה עצמאית'. הלוגו של OrcaRouter נמצא בפינה הימנית התחתונה.
Guides & Insights

MiniMax M3.1 Flash Preview זמין כעת ב-Token Plan: מה שהמנוי שלך באמת פותח

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

MiniMax-M3.1-Flash-Preview עלה לאוויר ב-27 בספטמבר 2026, והאופן שבו זה קרה הוא הסיפור. זה לא מודל בתשלום לפי שימוש. הספק הציב את מודל הטקסט החדש ביותר שלו מאחורי אותו Token Plan Subscription Key שמכסה כבר את MiniMax-M3, MiniMax M2.7 וגרסת ה-highspeed של M2.7, כך שאם יש לך מושב שם, אין מפתח חדש להנפיק ואין חוזה שני לחתום עליו. מה גם שאין, נכון להיום, מחיר לפי טוקן, כרטיס מודל, בנצ'מרק מפורסם, או דרך כלשהי לכבות את החשיבה של המודל.

השילוב הזה — גישה נטולת חיכוך לצד כלכלה שלא פורסמה כלל — יוצא דופן מספיק כדי שיהיה שווה לפרק אותו לפני שמישהו מחבר אליו צינור ייצור. שאר המאמר הזה הוא מה שהתיעוד של הספק עצמו באמת אומר, מה שהוא באופן בולט אינו אומר, ושורת הקוד האחת שתבהיר לכם בתוך דקה אם המודל הזה מתאים לאופן שבו אתם עובדים.

מה בעצם נחת ב־27 בספטמבר

תיעוד המפתחים של MiniMax כולל כעת הערה קבועה, המופיעה שוב בכל עמוד של מודל טקסט: MiniMax-M3.1-Flash-Preview זמין לעת עתה רק דרך Token Plan ו-MiniMax Code. המודל מופיע ראשון בטבלת המודלים של הספק עצמו, מעל MiniMax-M3, ומתואר כמודל קידוד מולטימודלי מתקדם עם חלון הקשר של 1M ועומק חשיבה ניתן לכוונון.

• חלון הקשר — 1,000,000 טוקנים, אותה תקרה שיש ל-MiniMax-M3
• מודאליות קלט — טקסט, תמונה ווידאו, מחזיר טקסט
• עומק חשיבה — הגדרת מאמץ המקבלת low, medium, high, xhigh ו-max, כאשר ברירת המחדל היא max כאשר היא מושמטת
• תמיכה בפרוטוקולים — אותו מזהה מודל עובד דרך נקודת הקצה התואמת ל-Anthropic של MiniMax, נקודת הקצה התואמת ל-OpenAI שלה ונקודת הקצה OpenAI Responses שלה
• זמינות — Token Plan ו-MiniMax Code בלבד; לא במסלול pay-as-you-go
• מחיר — לא פורסם שום תעריף לפי טוקן בשום מקום
• משקולות — אין; שני המאגרים הציבוריים העדכניים ביותר של ארגון MiniMaxAI נשארים MiniMax-Music3 ו-MiniMax-H3
• מדדים עצמאיים — אין; למודל אין רשומה במדד המודלים של Artificial Analysis

החברה הכריזה עליו באותו יום בחשבון ה-MiniMaxAgent שלה, והציגה אותו כמיועד לפיתוח יומיומי ולא לעבודת חזית: מהיר ואמין, מתיקוני באגים מהירים ועד פיתוח תכונות מלא. זו הגדרה של דרגת Flash, לא של דגם דגל. סיקור חדשותי של צד שלישי מאת PANews ו-KuCoin תיאר אותו באותם מונחים וציין שמפתחים הבחינו במודל בבורר של MiniMax לפני שהחברה אישרה אותו.

A headless Chromium screenshot of MiniMax's own model documentation page, showing the standing note that MiniMax-M3.1-Flash-Preview is available only through Token Plan and MiniMax Code for now, above the vendor's language-model table in which MiniMax-M3.1-Flash-Preview is listed first with a 1,000,000-token context window and the description 'Frontier multimodal coding model with 1M context window and tunable thinking depth', ahead of MiniMax-M3 with the same 1,000,000-token window, captured 28 September 2026.

איזה מפתח אתה משתמש בו חשוב יותר מהרגיל

זה החלק שבו אנשים נופלים. MiniMax מפעילה שני סוגי אישורים נפרדים, ו-M3.1-Flash-Preview מגיב רק לאחד מהם. ה-Token Plan Subscription Key מגיע מ-Billing > Token Plan ומכסה שימוש במנוי ו-Credits שנרכשו. ה-pay-as-you-go API Key מכסה את המודלים לפי טוקן. התיעוד של הספק מפורש שהשניים אינם ניתנים להחלפה, ושמפתח מסוג Subscription Key יכול להתקיים לפני שמצורף אליו משאב בתשלום כלשהו — ובמקרה כזה הוא מפתח תקף שאין מאחוריו דבר.

אז המבחן המעשי אינו "האם יש לי מפתח API של MiniMax" אלא "האם יש לי מושב ב-Token Plan". מושבים קיימים מכוסים. התיעוד מציין שמפתח מנוי (Subscription Key) הופך לשימושי כאשר מוקצה לו מושב או גישה ל-Credits, ושחריגת Credits נמשכת אוטומטית לאחר שמיצוי מכסת המנוי.

יש גם אי־עקביות בתיעוד שכדאי להכיר, כי היא תבלבל כל מי שיקרא קודם את עמוד התמחור. הערת השוליים על הכיסוי בעמוד התמחור של Token Plan עדיין מפרטת את הרשימה הזכאית כ-M3, M2.7, image ו-speech, כאשר H3 מוחרג — היא לא עודכנה כך שתכלול את M3.1-Flash-Preview. בעמודי המודלים נאמר ההפך: ש-M3.1-Flash-Preview זמין ב-Token Plan ושום דבר אחר. שני העמודים הם עמודי ספק חיים נכון להיום. רק המפתח שבידך מכריע בדבר.

ה-400 שאומר לך איזה סוג של מודל זה

כל דגם מסדרת MiniMax M חושב לפני שהוא עונה, אבל M3.1-Flash-Preview הוא הראשון שמסרב להפסיק. שלח thinking: {"type": "disabled"} או reasoning_effort: "none" וה-API מחזיר HTTP 400 עם ההודעה:

המודל "MiniMax-M3.1-Flash-Preview" דורש חשיבה אדפטיבית; thinking.type="disabled" (כולל reasoning.effort=none) אינו מותר (2013)

ההנחיה של הספק עצמו היא להנמיך את המאמץ במקום לנסות להשבית את החשיבה, והסולם הוא מנוף השהיה: עריכה שגרתית ב-נמוך ושינוי ברמת כל המאגר ב-xhigh הם אותו מודל שמבצע החלפות שונות. שני פרטים נוספים ייחודיים למודל הזה. הפרמטר reasoning_effort מתועד כיעיל עבור MiniMax-M3.1-Flash-Preview בלבד — הוא אינו בקרה כללית של סדרת M. ומתג הפלט reasoning_split, שמפריד את החשיבה לשדה reasoning_content, אינו יכול כרגע להיות מוגדר ל-false במודל הזה.

היכן שטקסט החשיבה מגיע תלוי בפרוטוקול: נקודת הקצה התואמת ל-Anthropic מחזירה אותו בתור thinking בלוק תוכן, נקודת הקצה התואמת ל-OpenAI מחזירה אותו ב-reasoning_content, ונקודת הקצה Responses מחזירה אותו כפריט פלט של הנמקה. אם עסקת בניתוח <think> מתוך פלט MiniMax-M3, העבודה הזו כבר אינה נחוצה במודל החדש — ובשיחות משולבות של שימוש בכלים, יש להוסיף בחזרה את התגובה המלאה, כולל בלוק החשיבה, להיסטוריית ההודעות, אחרת שרשרת ההנמקה נשברת.

המבצע שרץ כרגע

MiniMax Code מריצה מבצע צ׳ק-אין מ-28 בספטמבר עד 7 באוקטובר בשעון UTC+8, ומכפילה את הקרדיטים החינמיים הניתנים עבור התחברויות יומיות ופותחת אותו למשתמשים חדשים וקיימים כאחד. הקרדיטים המדווחים תקפים על פני המודלים הנתמכים, כאשר M3.1-Flash-Preview ומודלי הווידאו H3 מוזכרים כדוגמאות. בנפרד, החברה מסרה כי מכסות Token Plan מתאפסות עבור כל המשתמשים עם ההשקה, וכי איפוסים נוספים מתוכננים במהלך האירוע, כאשר הזכאות מוצגת באפליקציה.

התייחס לשניים האלה כאל הצהרות ספק שהועברו דרך סיקור ההשקה — אלה תנאים שיווקיים עם תאריכים מצורפים, לא התנהגות מוצר, ואותו סיקור מציין שההודעה לא פירטה את מספר הקרדיטים לכל צ׳ק-אין או את הכללים המדויקים לימים שהוחמצו. קל יותר לתאר את הכלכלה במצב היציב: Token Plan מתומחר ב-$22 לחודש עבור Plus, ב-$55 עבור Max וב-$132 עבור Ultra, עם חלונות מכסה מתגלגלים של 5 שעות ומכסות שבועיות, כשהספק מעריך את גודלם בכ-שלושה עד ארבעה, ארבעה עד חמישה ושישה עד שבעה סוכנים במקביל, בהתאמה. Purchased Credits עומדים על 1,000 קרדיטים לדולר ומנוכים לפי מחיר המחירון של תשלום לפי שימוש של כל מודל.

ארבעת הדברים שעדיין אין למודל הזה

אף אחד מהדברים הבאים אינו ביקורת על המודל; כל אחד מהם הוא חור שצוות צריך לתכנן סביבו, וכל הארבעה ניתנים לאימות היום.

• אין מחיר. אין תעריף לכל טוקן עבור M3.1-Flash-Preview בשום עמוד של MiniMax, ולכן לא ניתן להשוות אותו עם M3, שעולה $0.30 למיליון טוקני קלט ו-$1.20 למיליון טוקני פלט, או עם כל דבר אחר, מבחינת עלות לטוקן.
• אין בנצ'מרקים. MiniMax לא פרסמה טבלת הערכה עם השחרור הזה. גם אף אחד אחר לא: המודל נעדר מהאינדקס של Artificial Analysis, כך שהעמודה שלו ריקה ממש ולא רק מוקדמת מדי.
• אין משקולות. MiniMax-M3 שוחרר עם משקולות פתוחות; ל-M3.1-Flash-Preview אין מאגר ואין נקודת ביקורת להורדה.
• אין מדידה בלתי תלויה. אין נתוני מהירות פלט, השהיה או שיעור שגיאות מאף צד שלישי, וגם לא מהטלמטריה של הניתוב שלנו, מפני שהמודל אינו בקטלוג שלנו.

לעומת השקת M3 ביוני 2026, שהגיעה עם מסמך ארכיטקטורה, גיליון בנצ׳מרק וכרטיס תעריפים כבר ביום הראשון, זהו שחרור שקט במכוון. הקריאה הסבירה — וזו קריאה, לא תוכנית מוצהרת — היא ש-MiniMax רוצה שימוש אמיתי בתוך המערכת שלה לפני שהיא תחליט מה עולה המודל והאם לפתוח אותו.

A generated two-column infographic titled 'What the vendor confirms, and what it has not published', for MiniMax M3.1 Flash Preview. The left column, headlined 'Confirmed on day one', lists 'Listed first in MiniMax's own model table, above MiniMax-M3', '1,000,000-token context window', 'Text, image and video input returning text', 'An effort ladder from low to max, defaulting to max', 'Reachable over Anthropic-, OpenAI- and Responses-compatible endpoints', and 'Covered by the existing Token Plan Subscription Key'. The right column, headlined 'Still unpublished', lists 'Per-token price, anywhere on MiniMax's pages', 'A model card or evaluation table', 'Public weights or a downloadable checkpoint', 'Any entry on Artificial Analysis's model index', and 'Output-speed and latency figures from any third party'. A footer reads 'Per platform.minimax.io documentation and the launch announcement, 27 September 2026.'

במה צדק פתק התצוגה המקדימה שהודלף

ארבעה ימים לפני ההשקה הופץ מסמך תצוגה מקדימה שהועתק במאגר שותפים ציבורי, שתיאר MiniMax M3.1 עם קשב דליל, קוונטיזציית קשב Q8KV4, מומחים מנותבים NVFP4, ראש פענוח ספקולטיבי DSpark ושדה reasoning_effort חדש המקבל ערכים מ-max ועד low. באותו זמן כתבנו על כך כלא־מאומת, ובדין: לא היו משקלים, לא כרטיס מודל, לא עמוד תמחור ולא היה מזהה מודל של API.

אחת מחמש הטענות האלה מאושרת כעת על ידי התיעוד של הספק עצמו, והיאreasoning_effort — השדה — כולל סולם מ-max ל-low, שתואם בדיוק את הערכים שסופקו. ארבע האחרות נותרו לא מאושרות. התיאור שפרסמה MiniMax של M3.1-Flash-Preview אומר רק שזהו מודל קידוד מולטימודלי חזיתי עם חלון הקשר של 1M ועומק חשיבה ניתן לכוונון; הוא אינו מתאר את סכמת הקשב, הקוונטיזציה או ראש הפענוח. כל מי שחוזר על טענות הקשב הדליל ו-NVFP4 כמפרט מוסכם חוזר על תעתיק של צד שלישי, וזה בדיוק מה שהשחרור לא אישר.

אם אתה רוצה לנסות את זה בלי להמר פייפליין שלם על זה

החלק המביך בתצוגה מקדימה של Token-Plan בלבד הוא שהדרך הטבעית להעריך מודל חדש — לקרוא לו מתוך הסטאק הקיים שלך ולמדוד — היא הדבר היחיד שאתה לא יכול לעשות בצורה נקייה. אין תעריף לפי טוקן שעליו אפשר לבנות מודל, אין פרופיל ביצועים מפורסם, ואין סיפור failover בתוך המוצר של הספק עצמו אם התצוגה המקדימה מתערערת.

זה המצב ששכבת ניתוב נבנתה עבורו. כל מה שאפשר לקרוא לו היום נמצא מאחורי נקודת קצה אחת תואמת OpenAI ומפתח API אחד, והמודלים הסמוכים לזה כבר נמצאים שם: MiniMax-M3 בתעריף של הספק של $0.30 למיליון טוקני קלט ו-$1.20 למיליון טוקני פלט, MiniMax M2.7 באותו מחיר מחירון עם חלון של 200,000 טוקנים ומשקולות פתוחות, ושכבות ה-Flash של DeepSeek ו-Qwen באותו טווח מחירים. המחירים אצלנו הם מחיר המחירון של הספק כפי שהוא, בתוספת של 0%, כך שכאשר ספק מוזיל תעריף הוא מתעדכן כאן באותו יום, ולא במחזור של משא ומתן מחדש. מעבר אוטומטי לגיבוי פירושו שתלות בדרגת תצוגה מקדימה יכולה לשבת לצד נתיב ייצור ולא מתחתיו, וכאשר MiniMax אכן תפרסם מחירון ונקודת קצה עבור MiniMax-M3.1-Flash-Preview, השאלה הופכת לרשומה בטבלת ניתוב במקום לפרויקט הגירה. MiniMax-M3.1-Flash-Preview עצמו אינו בקטלוג שלנו, והדרך להגיע אליו היום היא תוכנית ה-Token של הספק עצמו ומוצר הקידוד שלו.

הסיכום הישר עבור צוות שקורא את זה ביום ההשקה: המודל פעיל, חינמי בשוליים אם אתם כבר משלמים על מושב ב-Token Plan, וללא תמחור וללא מדידה לחלוטין במונחים שלו עצמו. נסו אותו בתוך MiniMax Code, השאירו את הפייפליין שאתם תלויים בו על מודל עם מחירון ורקורד מוכח, ועקבו אחרי שני הדברים שיהפכו את זה מקוריוז להחלטה — מחיר מפורסם והציונים העצמאיים הראשונים.

A generated scorecard infographic titled 'The models you can call today, and what they cost'. Six rows read: 'MiniMax M3 — $0.30 in / $1.20 out per 1M tokens, 1,048,576-token context, open weights', 'MiniMax M2.7 — $0.30 in / $1.20 out per 1M tokens, 204,800-token context, open weights', 'DeepSeek V4 Flash — $0.22 in / $0.66 out per 1M tokens, 1,048,576-token context', 'DeepSeek V4.1 Flash — routed on the same key in the same price band', 'MiniMax M3.1 Flash Preview — no per-token rate published; Token Plan and MiniMax Code only', and 'One OrcaRouter API key reaches 200+ models with 0% markup on the provider's list price and automatic failover across providers'. A footer reads 'Catalogue figures per OrcaRouter's public model API, 28 September 2026; MiniMax M3.1 Flash Preview is not on the OrcaRouter catalogue.'

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית