
LongCat-2.5-Preview מול MiniMax M3: המקום הזול כבר תפוס
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 610 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 189 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
הנחת היסוד של רוב הסיקור של LongCat-2.5-Preview היא ש-Meituan הורידה מחירים מתחת לכל האחרים. לעומת MiniMax M3, ההנחה הזו מתפוגגת במגע. MiniMax M3 רשום בקטלוג שלנו במחיר של $0.30 למיליון טוקני קלט ו-$1.20 למיליון טוקני פלט. המחירון המפורסם של LongCat-2.5-Preview הוא $0.30 למיליון טוקני קלט ללא מטמון ו-$1.20 למיליון טוקני פלט. אלה אינם מספרים דומים; אלה אותם מספרים. המקום היחיד שבו הם נבדלים הוא קלט ממוטמן, שבו Meituan נוקבת במחיר של $0.006 למיליון לעומת $0.06 של השחקן המכהן — פער של פי עשרה על השורה הזולה ביותר בחשבון. אז השאלה המעניינת היא לא אם LongCat-2.5-Preview זול. היא מה אתה קונה ומה אתה מוותר עליו כשמודל חדש מגיע בדיוק במחיר של השחקן המכהן.
התשובה הקצרה: תקרת פלט גדולה בהרבה, בסיס ראיות דק בהרבה, והנחת מטמון.
אותו מחיר כותרת, תקרות מפורסמות שונות מאוד
MiniMax M3 מתועד רשמית מאז 31 במאי 2026. הקטלוג שלנו כולל אותו עם חלון הקשר של 1,048,576 טוקנים ופלט מקסימלי של 512,000 טוקנים — יותר ממה שרוב המודלים מאפשרים, ופי ארבעה מה-131,072 של LongCat-2.5-Preview. הוא מקבל טקסט, תמונות ווידאו כקלט ומחזיר טקסט, עם קריאה לכלים, מצב JSON ויכולת הסקה חשופה.

LongCat-2.5-Preview, הרשום בפלטפורמת LongCat API Platform של Meituan ב-25 בספטמבר 2026, מתאים מבחינת ההקשר עם 1,000,000 טוקנים ומפספס קשות בפלט עם 131,072. פרופיל הקלט שלו הוא השאלה הבוערת: יומן השינויים מציג את הבנת התמונות כתוספת המרכזית שלו, אך תגובת הדוגמה בתיעוד "Retrieve Model" של Meituan עצמה עדיין מציגה input_modalities/ בתור ["text"]/ עם text->text/ מחרוזת מודאליות. MiniMax M3 מקבל גם וידאו, דבר ש-LongCat-2.5-Preview אינו מצהיר עליו כלל. אם הצינור שלך מזין הקלטות מסך או רצפי פריימים, ההשוואה הזו נגמרת כאן.
אסימטריית המטמון פועלת בכיוון ההפוך וראויה לציון לזכות Meituan, מפני שזה הממד היחיד שבו המודל החדש באמת יוצר הבחנה. 0.006 דולר למיליון קלט במטמון לעומת 0.06 דולר הוא יתרון אמיתי לעומסי עבודה של סוכנים ששולחים מחדש את אותה קידומת ארוכה בכל תור — וזה רובם. זה גם הסעיף שסביר ביותר להשתנות ללא הודעה מוקדמת, מאחר ש-Meituan מסמנת את כל הכרטיס כמבצע לזמן מוגבל.
פער הראיות, נמדד בכנות בשני הכיוונים
מיקומו של MiniMax M3 בבנצ'מרקים אינו חזק, ואמירה כזו היא חלק מביצוע ההשוואה הזו כראוי. Artificial Analysis מתעד עבורו Coding Index של 58.6 — המקום הארבעים ושישה מבין המודלים במעקב — ו-Intelligence Index של 29.2 במקום השישים. GPQA Diamond 92.9%, Humanity's Last Exam 39%, SciCode 47.1%, Long-Context Recall 83, τ²-Bench banking 15.3, Terminal-Bench v2.1 65.2. המספרים שפרסמה MiniMax בעצמה מכסים תחום אחר: BrowseComp 83.5, GDPval rubrics 76.7, MCP Atlas 74.2, BankerToolBench 76.1. אלה מספרים המדווחים על ידי הספק ושייכים לעמודה אחרת מזו של המספרים הבלתי־תלויים, אבל הם קיימים, וזו המילה הקובעת.

ל-LongCat-2.5-Preview אין עמודה כלל. אין טבלת בנצ'מרק מפורסמת, אין כרטיס דגם, אין דו"ח טכני, אין מאגר ב-HuggingFace או בארגון ה-GitHub של Meituan, ומטא-נתוני קטלוג הרושמים משקלים פתוחים כלא נכונים. ספירת הפרמטרים של כ-1.6 טריליון סה"כ / 48 מיליארד פעילים מדווחת ממטא-נתוני האתר של Meituan ומסיקור סחר סיני ולא מתיעוד. לכן ההצהרה המדויקת היא: הציונים של M3 בינוניים וממקורות עצמאיים; אלה של LongCat-2.5-Preview נעדרים. דגם שמקבל ציונים בשנות הארבעים במדד הקידוד הוא כמות ידועה שאפשר לתכנן לפיה. דגם ללא ציון הוא סוג אחר של סיכון, והמחיר הזהה מסיר את הפיצוי שבדרך כלל מצדיק לקחת אותו.
כאשר אותו מחיר משנה את מה שעליך לעשות
כאשר מודל חדש חותך את מחירי התחום, הצעד הרציונלי הוא להעריך אותו — היתרון הוא הנחה אמיתית. כאשר מודל חדש מגיע במחיר זהה לחלוטין לזה של שחקן ותיק שנמצא בשילוח מאז מאי, היתרון אינו המחיר. זה היכולת, והיכולת היא הדבר היחיד ש-LongCat-2.5-Preview לא פרסם. זה ממסגר מחדש את ההערכה כולה: אינך בודק אם הוא זול יותר, אתה בודק אם הוא טוב יותר, במשימות שלך, מנקודת התחלה ללא תנופה ובלי שום ראיות שעליהן להישען.
יש פרט מסדר שני שהופך את המבחן הזה לזול ממה שהוא נראה. LongCat-2.5-Preview הוא חינמי וללא הגבלה דרך OpenCode למשך חלון באורך לא מצוין, עם מדיניות אפס-שימור ש-OpenCode מתעדת במפורש — אימון המודל "Not used", שימור נתונים "0 days", לעומת שלושים יום ברשומת ההשוואה. כך שהעלות של יצירת הערכה משלכם קרובה לאפס, ומדיניות השימור אומרת שאפשר להריץ אותה על קוד פרטי. פרט המסגרת היחיד שצריך לסגור קודם הוא שהמודל מחזיר את עקבות החשיבה שלו בשדה reasoning_content משולב; לקוחות שמפרסרים השלמות צ'אט בלי לצפות לכך יזרקו את החשיבה בשקט ויגרמו למודל להיראות גרוע ממה שהוא באמת.

טיעון הניתוב, ספציפי להשוואה באותו מחיר
אנחנו מגישים את MiniMax M3 במחיר המחירון של MiniMax עם אפס תוספת. LongCat-2.5-Preview אינו אחד מהמסלולים שלנו — אנחנו לא מגישים אותו, ואין לקרוא כאן דבר כטענה אחרת.
התמודדות במחיר זהה היא בדיוק המקרה שבו ניתוב מצדיק את עצמו ולא רק נוחות. אם שני מודלים עולים אותו דבר, ההחלטה ביניהם היא לפי בקשה ולפי משימה: M3 עבור תקרת הפלט של 512,000 טוקנים וקלט וידאו, LongCat-2.5-Preview עבור הנחת ה-prefix המטמון בלולאות סוכן ארוכות לאחר ששיכנעת את עצמך לגבי איכותו. מיזוג מודלים הוא המנגנון שהופך זאת למילולי — שלב אחזור ושלב סינתזה יכולים להיות מודלים שונים בבקשה אחת, כך שאינך נאלץ לבחור מנצח לפני שיש לך ראיות. ובגלל שאנחנו מעבירים מחירי מחירון של ספקים ללא תוספת, שינוי תעריף של ספק מגיע לחשבון שלך באותו יום במקום בחידוש החוזה הבא, מה שחשוב יותר מהרגיל כאשר אחד משני הכרטיסים מוצהר במפורש כמבצעי.מעבר אוטומטי לכשל, אם כן, מכסה את המקרה שבו ספק אחד מתדרדר, וזה חשוב ביותר עבור המודל שאין לו היסטוריית שירות לבחון.
נשאל לעתים קרובות
• האם LongCat-2.5-Preview זול יותר מ-MiniMax M3? לא. בכרטיסים המפורסמים תעריפי הקלט והפלט זהים ב-$0.30 ו-$1.20 למיליון. היתרון היחיד במחיר הוא בקלט במטמון, $0.006 לעומת $0.06, ו-Meituan מתייגת את כל הכרטיס שלה כהנחה לזמן מוגבל בלי לומר מה יבוא אחר כך.
• למי יש תפוקה שמישה גדולה יותר? MiniMax M3 בפער עצום: 512,000 טוקנים לעומת 131,072. עבור יצירה ארוכה, חילוץ מובנה ממסמכים גדולים, או כל דבר שכותב יותר מפרק, התקרה הזו היא המפרט המכריע.
• איזה מהם אני יכול לאמת? MiniMax M3, והאימות לא מחמיא לו — Coding 58.6 במקום ה-46 ומדד Intelligence Index של 29.2 במקום ה-60, לפי Artificial Analysis. ל-LongCat-2.5-Preview אין הערכה שפורסמה מאת אף אחד. אם בנצ'מרק של LongCat-2.5-Preview יופיע השבוע, התייחס אליו כבלתי ניתן לאימות עד שתוכל לשייך אותו למעריך בשם.
• מה כדאי לי להעלות לפרודקשן? אף אחד מהם בלי בדיקה משלך. מבין השניים, M3 הוא הבחירה בעלת השונות הנמוכה יותר כי החולשות שלו מתועדות ומודאליות הקלט שלו מאושרות; LongCat-2.5-Preview הוא בעל השונות הגבוהה יותר, עם הצהרת הקשר גדולה יותר, תקרת פלט קטנה בהרבה, הנחת מטמון, ואפס ראיות פומביות. הרץ אותו בחינם כל עוד החלון פתוח, השאר את שניהם מאחורי מפתח אחד, ותן למספרים שלך להכריע.
