כרטיס הירו שנוצר בכותרת MiniMax M3.1 Flash Preview מול DeepSeek V4 Flash, עם כתובית משנה: 'אותו חלון של 1M טוקנים, שתי הצעות מכירה שונות מאוד'. כרטיס שמאלי מציג: 'MiniMax M3.1 Flash Preview: חלון הקשר של 1M, המחיר אינו מפורסם, תוכנית Token בלבד, לא ניתן להשבית את החשיבה'; כרטיס ימני מציג: 'DeepSeek V4 Flash: חלון הקשר של 1M, ‏$0.15/$0.60 בשעות שפל, טקסט בלבד, הוחלף על ידי V4.1 Flash'. כותרת תחתונה מציינת: 'הנתונים של MiniMax לפי platform.minimax.io; הנתונים של DeepSeek לפי לוח התעריפים המפורסם של DeepSeek'.
Engineering & Research

MiniMax M3.1 Flash Preview לעומת DeepSeek V4 Flash: שני כרטיסים זולים לחלון הקשר של מיליון, וכוכבית אחת ענקית

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

אם אתם מחפשים חלון הקשר של מיליון טוקנים במחיר נמוך לכל טוקן, MiniMax-M3.1-Flash-Preview ו-DeepSeek V4 Flash הם שני השמות שכל הזמן עולים — והם ממש לא אותו סוג של מוצר. DeepSeek V4 Flash הוא מודל שהוצא משימוש אך המזהה שלו עדיין עונה, והוא חי בתוך מחירון של ספק שאפשר לקרוא עד הסנט. MiniMax-M3.1-Flash-Preview הוא תצוגה מקדימה חיה בלי מחיר מפורסם בכלל. ההשוואה שלהלן היא לכן חלקה השוואת מפרט וחלקה הדגמה של המידה השונה שבה שני הספקים אלה בוחרים למכור את אותו טווח מחירים.

כדאי להציג במדויק את שני הצדדים של הדבר, כי המספרים שמכריעים בו מפוזרים על פני עמוד תמחור של ספק, עץ תיעוד של ספק והקטלוג שלנו, ואחת הטענות החוזרות ביותר לגבי DeepSeek V4 Flash — המחיר שלו — היא טענה שאותה DeepSeek החליפה מאז.

על מה בעצם תואמים שני דפי המפרט

המפרטים העיקריים דומים מספיק עד כדי כך שאינם הגורם המכריע, למעט יוצא דופן אחד שאיש לא מפרסם.

• חלון הקשר — 1,000,000 טוקנים עבור MiniMax-M3.1-Flash-Preview לעומת 1,048,576 עבור DeepSeek V4 Flash: זהה לכאורה, הפרש של 48,576 טוקנים
• פלט מרבי — לא פורסם עבור MiniMax-M3.1-Flash-Preview; 384,000 טוקנים עבור DeepSeek V4 Flash, דבר יוצא דופן במחיר הזה וזה המספר שאמור להכריע הרבה מאוד ברכישות
• מודאליות קלט — טקסט, תמונה וווידאו עבור MiniMax-M3.1-Flash-Preview; טקסט בלבד עבור DeepSeek V4 Flash
• שליטה בחשיבה — מאמץ סולם מ-נמוך עד מקסימלי, חשיבה פעילה תמיד, עבור MiniMax-M3.1-Flash-Preview; חשיבה או אי-חשיבה ב-DeepSeek V4 Flash, כאשר אי-חשיבה היא אפשרות ממשית
• תמיכה בפרוטוקולים — נקודות קצה תואמות Anthropic, תואמות OpenAI ו-OpenAI Responses עבור MiniMax-M3.1-Flash-Preview; אותם שלושה בתוספת השלמת קידומת צ'אט ב-DeepSeek V4 Flash
• משקלים — אין עבור MiniMax-M3.1-Flash-Preview; המשקלים של DeepSeek V4 Flash פורסמו, אם כי המודל עצמו הוחלף בחדש
• מחיר — לא פורסם עבור MiniMax-M3.1-Flash-Preview; פורסם ונמוך עבור DeepSeek V4 Flash

קרא את הרשימה הזאת פעמיים, כי תקרת הפלט היא זו השקטה. מיליון טוקנים של הקשר עם 384,000 טוקנים של פלט הם חלון יצירה ארוך באמת במעבר יחיד. מיליון טוקנים של הקשר עם תקרת פלט שלא נחשפה הוא הבטחה לגבי קריאה, לא לגבי כתיבה. אם עומס העבודה שלך הוא "קרא מאגר קוד, הפק תוכנית מיגרציה", המספר השני הוא זה שקובע אם המשימה נכנסת לקריאה אחת.

במה כל אחד נמדד

זה הקטע הכי פחות נוח בהשוואה, והוא קצר.

ל-DeepSeek V4 Flash יש שיא בנצ'מרק, והוא עצמאי. Artificial Analysis מעניקה לו ציון 34.3 במדד Intelligence Index — המקום ה-42 מתוך 145 מודלים במדד הזה — עם 69.1 ב-Coding Index ו-90.8% ב-GPQA Diamond. ה-95.0 ב-τ²-Bench, שאיתו מוביל הערך שלנו בקטלוג, הוא אותו נתון שהופיע בחומר ההשקה של DeepSeek, כך שמדובר בנתון של ספק בחברת נתונים עצמאית ולא בנתון שעבר ביקורת. ריקול ההקשר הארוך שלו הוא 79.7%, ונתון ה-terminal-bench שלו הוא 78.7% ב-harness v2.1. אלה מדידות אמיתיות ונותנות להשוואה של מודל ידוע.

ל-MiniMax-M3.1-Flash-Preview אין טבלת הערכה. MiniMax לא פרסמה טבלת הערכה עם ההשקה, וגם לאף גורם שלישי אין כזו — המודל אינו מופיע כלל באינדקס של Artificial Analysis. זה אינו פער במחקר שלנו; זה מצב התיעוד הציבורי כיום, והוא אומר שכל טענת איכות בנוגע למודל החדש יותר היא, ברגע זה, שם תואר שיווקי מטעם הספק. כל מי שימסור לך היום טבלת בנצ'מרקים של MiniMax-M3.1-Flash-Preview או שהוא מצטט את MiniMax-M3 הישן יותר או שהוא ממציא אותה.

A generated two-column scoreboard titled 'MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash — the scoreboard'. The left column, MiniMax M3.1 Flash Preview, reads 'AA Intelligence: none published', 'Coding score: none published', 'Context window: 1M', 'Max output: not published', 'Weights: none', 'Price: not published'. The right column, DeepSeek V4 Flash, reads 'AA Intelligence: 34.3', 'Coding score: 69.1', 'Context window: 1,048,576', 'Max output: 384,000', 'Weights: published', 'Price: $0.15 / $0.60 off-peak'. A footer reads 'MiniMax figures per platform.minimax.io documentation, 27 September 2026; DeepSeek figures per DeepSeek's published rate card and Artificial Analysis. The MiniMax column is empty because nothing has been published, not because a result is pending.'

DeepSeek V4 Flash אינו נמכר במחיר שאתה זוכר

הנה המלכודת. המספר המצוטט בהרחבה עבור DeepSeek V4 Flash — $0.14 למיליון אסימוני קלט ו-$0.28 למיליון פלט — היה כרטיס המחירים שהמודל נשא לפני 10 בספטמבר 2026. באותו תאריך DeepSeek שחררה את DeepSeek-V4.1-Flash, הוציאה מכלל שימוש גם את V4 Flash וגם את הניסוי V4-Flash-Vision-Exp, והורידה מחירים. המזהה של deepseek-v4-flash עדיין עובד, אך התיעוד של DeepSeek מציין שהוא מנותב באופן זמני אל V4.1 Flash ומחויב לפי מחיר Flash. במילים אחרות, עדיין ניתן להקליד את שם המודל הישן; אינך קורא למודל הישן.

אז הכרטיס האמיתי שצריך להשוות אליו הוא הנוכחי, לכל 1M טוקנים — ומחוץ לשעות עומס זה החצי הזול יותר שלו:

• קלט של החמצת מטמון — $0.15 מחוץ לשעות שיא, $0.30 בשעות שיא
• קלט של פגיעת מטמון — $0.003 מחוץ לשעות שיא, $0.006 בשעות שיא
• פלט — $0.60 מחוץ לשעות שיא, $1.20 בשעות שיא
• חלונות שיא — 01:00–04:00 ו-06:00–10:00 UTC, יום שני עד יום שישי, למעט חגים ציבוריים בסין; כל השאר, כולל סופי שבוע מלאים, מחוץ לשעות שיא

לעומת זאת, ל-MiniMax-M3.1-Flash-Preview אין תעריף לפי טוקן מכל סוג שהוא. העלות שלו היא כמה שעולה המושב שלך ב-Token Plan — $22, $55 או $132 לחודש עבור Plus, Max ו-Ultra — והיא נשרפת דרך מאגר מכסה משותף לפי מחיר המחירון של כל מודל בתשלום לפי שימוש, כאשר הספק שומר לעצמו את הזכות לשנות את הרכב המאגר. עבור תקציב חודשי קבוע עם נפח צפוי, זה יכול להיות תמורה מצוינת. עבור פרויקט שצריך לייחס עלות לכל קריאה, זו עמימות בתחפושת של מנוי.

הסיבה שזה חשוב יותר מהרגיל בצד של DeepSeek היא מכפיל השיא. צוות באירופה או באסיה שמנהל את יום העבודה שלו נמצא בתוך חלון שיא עבור חלק משמעותי מהתעבורה שלו ומשלם כפול על הפריווילגיה, מה שהופך תעריף קלט מוצהר של $0.15 ל-$0.30 בדיוק בשעות שבהן רוב המוצרים עמוסים. בנו את התקציב לפי עמודת השיא אלא אם כן התעבורה שלכם באמת פועלת בלילה לפי UTC.

מתי הבחירה ב-MiniMax M3.1 Flash Preview היא שגויה

שלושה מקרים, וקל להחמיץ את שני הראשונים מכיוון שהם מתועדים ולא נגרעים.

תקרת הפלט אינה ידועה. אם המשימה שלך מסתיימת ביצירה ארוכה — מפרט מלא, שכתוב תמלול, דוח עם הערות — אתה בוחר תקציב פלט שאתה לא יכול לראות. DeepSeek V4 Flash מפרסם 384,000. האסימטריה הזו מעדיפה את המודל הישן יותר לכל דבר שכותב הרבה.

אי אפשר לכבות את החשיבה. שלח thinking: {"type": "disabled"} אל MiniMax-M3.1-Flash-Preview ותקבל HTTP 400: המודל מחייב חשיבה אדפטיבית. ב-DeepSeek V4 Flash, מצב ללא חשיבה קיים והוא מתג נתמך. עבור סיווג, ניתוב או חילוץ מובנה קצר בתפוקה גבוהה, מודל שתמיד מבצע הסקה תחילה משלם בהשהיה ובאסימונים שלא ביקשת — והמנוף היחיד שיש לך הוא הורדת effort לlow, לא הסרת את ההסקה.

לא ניתן לקרוא לו במסלול pay-as-you-go. התיעוד של הספק חד-משמעי ש-MiniMax-M3.1-Flash-Preview זמין כעת רק דרך Token Plan ו-MiniMax Code, ואין להחליף את ה-Subscription Key במפתח API במסלול pay-as-you-go. אם כבר יש לך מושב, זה שינוי של שורה אחת. אם לא, הערכת המודל הזה משמעה רכישת מנוי.

כאשר המספר של DeepSeek הוא הבחירה הלא נכונה

התמונה המשתקפת היא ש-DeepSeek V4 Flash הוא טקסט בלבד וכבר הוחלף. הוא מעולם לא קיבל תמונות — העבודה הזו הצריכה את הבנייה הניסיונית הנפרדת, שכעת הוצאה משירות לצדו — ומזהה המודל מספק כעת משקלים שונים מאלה שהשם מרמז עליהם. צינור עיבוד המוצמד אל deepseek-v4-flash לצורך שחזוריות מסתמך על הפניה מחדש ש-DeepSeek מתארת כזמנית.

MiniMax-M3.1-Flash-Preview קולט טקסט, תמונה ווידאו באופן נייטיבי, והוא מודל הטקסט המוביל הנוכחי בטבלה של הספק. קלט וידאו בנקודת מחיר של Flash אינו נפוץ בסגמנט הזה.

שתי ההסתייגויות מצביעות לאותו כיוון עבור כל מי שמעביר תעבורה בפרודקשן: המזהה שעל החשבונית והמודל שענה אינם מובטחים להיות אותו דבר ללא הגבלת זמן, ושכבת ניתוב היא המקום שבו זה מטופל ולא מתגלה.

A generated infographic titled 'The two Flash brackets, side by side' listing six paired rows: 'Sales motion — subscription seat vs per-token rate card', 'Effective input rate — Token Plan quota vs $0.15 off-peak / $0.30 peak', 'Peak surcharge — not applicable vs doubles 01:00-04:00 and 06:00-10:00 UTC', 'Cost attribution — pooled quota vs metered per call', 'Failure mode — no published output ceiling vs identifier now serves a successor', and 'Best fit — fixed-budget teams vs metered pipelines'. A footer reads 'Both models carry a 1M-token context window; neither figure is a quality claim.'

איך להחליט על זה בתוך אחר צהריים אחד

התחל מסוף המשימה ולא מההתחלה.

אם המשימה היא יצירה בפורמט ארוך — כל דבר שמסתיים בכתיבה של עשרות אלפי טוקנים — DeepSeek V4 Flash הוא היחיד מבין השניים שמפרסם תקרה גדולה מספיק כדי להבטיח זאת, והמחירון שלו קטן מספיק כדי שמכפיל השיא יהיה נסבל. תמחר את העלות בשיא, לא בשפל, והתייחס למזהה שהוצא מכלל שימוש כאל הגירה שטרם ביצעת, ולא כאל חוזה יציב.

אם המשימה היא קריאה והסקה על קלט מולטימודלי בתקציב חודשי קבוע — הקלטות מסך, מסמכים סרוקים, סקירת וידאו — הרי ש-MiniMax-M3.1-Flash-Preview הוא הצורה היכולתית יותר, ובתוך מושב של Token Plan זו הדרך הזולה ביותר לקבל קלט וידאו באורך ההקשר הזה. קבלו את העובדה שאתם קונים מודל שאינו מדוד, ותחמו את רדיוס הנזק: השאירו את עומס העבודה שחשוב לכם על משהו עם מחירון מפורסם, ותנו ל-preview לטפל בחצי המחקרי.

אם שני התיאורים מתאימים לצינור שלך, זו בעיית ניתוב ולא בעיית בחירת מודל, וזה בדיוק המקרה שעבורו אנחנו קיימים. DeepSeek V4 Flash ב-OrcaRouterנמצא בתעריף של הספק עם 0% תוספת מחיר — הרשומה שלו בקטלוג מציגה $0.22 למיליון טוקני קלט ו-$0.66 למיליון טוקני פלט, שזה עמודת השיא של כרטיס ה-Flash הנוכחי, מועבר ישירות — לצד MiniMax-M3 ו-MiniMax M2.7 באותה רצועת מחיר על אותו מפתח. נקודת קצה אחת מגיעה ל-200+ מודלים עם מעבר אוטומטי לגיבוי מאחוריה, כך שעומס עבודה יכול לנוע בין רצועות מחיר בלי אינטגרציה נוספת. MiniMax-M3.1-Flash-Preview אינו בקטלוג שלנו; כדי להגיע אליו צריך את ה-Token Plan של הספק ואת מוצר הקידוד שלו.

בשורה אחת: DeepSeek V4 Flash הוא הגודל הידוע עם תקרת הפלט המפורסמת, כרטיס התעריפים הקריא, וממשיך דרכו שנענה בשקט לשמו; MiniMax-M3.1-Flash-Preview הוא החדש יותר, הרב-מודלי, שאינו מדוד, ושעלותו מנוי כדי לנסות אותו. אף אחד מאלה אינו סיבה לבחור באחר — אלה רק העובדות שלא היית מקבל מהשוואת מחיר לכל טוקן שמצטטת כרטיס תעריפים שדיפסיק הוציאה משימוש בספטמבר.

A headless Chromium screenshot of the OrcaRouter model page for deepseek/deepseek-v4-flash, showing the model title 'DeepSeek: DeepSeek V4 Flash', a pricing row reading 0.22 US dollars per million input tokens and 0.66 per million output tokens, a context window of 1,048,576 tokens, and a maximum output of 384,000 tokens, captured 28 September 2026.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית