כרטיס כותרת הירו מחולל עם הכיתוב 'LongCat-2.5-Preview vs MiniMax M3' ומעליו שורת הכותרת 'המקום הזול כבר תפוס', ושני לוחות: 'LongCat-2.5-Preview: $0.30 / $1.20 לכל 1M, 131,072 פלט מקסימלי' ו-'MiniMax M3: $0.30 / $1.20 לכל 1M, 512,000 פלט מקסימלי'. לוגו OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

LongCat-2.5-Preview מול MiniMax M3: המקום הזול כבר תפוס

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הנחת היסוד של רוב הסיקור של LongCat-2.5-Preview היא ש-Meituan הורידה מחירים מתחת לכל האחרים. לעומת MiniMax M3, ההנחה הזו מתפוגגת במגע. MiniMax M3 רשום בקטלוג שלנו במחיר של $0.30 למיליון טוקני קלט ו-$1.20 למיליון טוקני פלט. המחירון המפורסם של LongCat-2.5-Preview הוא $0.30 למיליון טוקני קלט ללא מטמון ו-$1.20 למיליון טוקני פלט. אלה אינם מספרים דומים; אלה אותם מספרים. המקום היחיד שבו הם נבדלים הוא קלט ממוטמן, שבו Meituan נוקבת במחיר של $0.006 למיליון לעומת $0.06 של השחקן המכהן — פער של פי עשרה על השורה הזולה ביותר בחשבון. אז השאלה המעניינת היא לא אם LongCat-2.5-Preview זול. היא מה אתה קונה ומה אתה מוותר עליו כשמודל חדש מגיע בדיוק במחיר של השחקן המכהן.

התשובה הקצרה: תקרת פלט גדולה בהרבה, בסיס ראיות דק בהרבה, והנחת מטמון.

אותו מחיר כותרת, תקרות מפורסמות שונות מאוד

MiniMax M3 מתועד רשמית מאז 31 במאי 2026. הקטלוג שלנו כולל אותו עם חלון הקשר של 1,048,576 טוקנים ופלט מקסימלי של 512,000 טוקנים — יותר ממה שרוב המודלים מאפשרים, ופי ארבעה מה-131,072 של LongCat-2.5-Preview. הוא מקבל טקסט, תמונות ווידאו כקלט ומחזיר טקסט, עם קריאה לכלים, מצב JSON ויכולת הסקה חשופה.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview, הרשום בפלטפורמת LongCat API Platform של Meituan ב-25 בספטמבר 2026, מתאים מבחינת ההקשר עם 1,000,000 טוקנים ומפספס קשות בפלט עם 131,072. פרופיל הקלט שלו הוא השאלה הבוערת: יומן השינויים מציג את הבנת התמונות כתוספת המרכזית שלו, אך תגובת הדוגמה בתיעוד "Retrieve Model" של Meituan עצמה עדיין מציגה input_modalities/ בתור ["text"]/ עם text->text/ מחרוזת מודאליות. MiniMax M3 מקבל גם וידאו, דבר ש-LongCat-2.5-Preview אינו מצהיר עליו כלל. אם הצינור שלך מזין הקלטות מסך או רצפי פריימים, ההשוואה הזו נגמרת כאן.

אסימטריית המטמון פועלת בכיוון ההפוך וראויה לציון לזכות Meituan, מפני שזה הממד היחיד שבו המודל החדש באמת יוצר הבחנה. 0.006 דולר למיליון קלט במטמון לעומת 0.06 דולר הוא יתרון אמיתי לעומסי עבודה של סוכנים ששולחים מחדש את אותה קידומת ארוכה בכל תור — וזה רובם. זה גם הסעיף שסביר ביותר להשתנות ללא הודעה מוקדמת, מאחר ש-Meituan מסמנת את כל הכרטיס כמבצע לזמן מוגבל.

פער הראיות, נמדד בכנות בשני הכיוונים

מיקומו של MiniMax M3 בבנצ'מרקים אינו חזק, ואמירה כזו היא חלק מביצוע ההשוואה הזו כראוי. Artificial Analysis מתעד עבורו Coding Index של 58.6 — המקום הארבעים ושישה מבין המודלים במעקב — ו-Intelligence Index של 29.2 במקום השישים. GPQA Diamond 92.9%, Humanity's Last Exam 39%, SciCode 47.1%, Long-Context Recall 83, τ²-Bench banking 15.3, Terminal-Bench v2.1 65.2. המספרים שפרסמה MiniMax בעצמה מכסים תחום אחר: BrowseComp 83.5, GDPval rubrics 76.7, MCP Atlas 74.2, BankerToolBench 76.1. אלה מספרים המדווחים על ידי הספק ושייכים לעמודה אחרת מזו של המספרים הבלתי־תלויים, אבל הם קיימים, וזו המילה הקובעת.

A screenshot of OrcaRouter's own model page for MiniMax M3 at /models/minimax/minimax-m3, showing the minimax/minimax-m3 identifier, a 1M-token context window, 512K maximum output, text + image + video input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-05-31, a p50 first-token figure of 3.35 s, $0.30 and $1.20 rate tiles, and the OpenAI-compatible code samples.

ל-LongCat-2.5-Preview אין עמודה כלל. אין טבלת בנצ'מרק מפורסמת, אין כרטיס דגם, אין דו"ח טכני, אין מאגר ב-HuggingFace או בארגון ה-GitHub של Meituan, ומטא-נתוני קטלוג הרושמים משקלים פתוחים כלא נכונים. ספירת הפרמטרים של כ-1.6 טריליון סה"כ / 48 מיליארד פעילים מדווחת ממטא-נתוני האתר של Meituan ומסיקור סחר סיני ולא מתיעוד. לכן ההצהרה המדויקת היא: הציונים של M3 בינוניים וממקורות עצמאיים; אלה של LongCat-2.5-Preview נעדרים. דגם שמקבל ציונים בשנות הארבעים במדד הקידוד הוא כמות ידועה שאפשר לתכנן לפיה. דגם ללא ציון הוא סוג אחר של סיכון, והמחיר הזהה מסיר את הפיצוי שבדרך כלל מצדיק לקחת אותו.

כאשר אותו מחיר משנה את מה שעליך לעשות

כאשר מודל חדש חותך את מחירי התחום, הצעד הרציונלי הוא להעריך אותו — היתרון הוא הנחה אמיתית. כאשר מודל חדש מגיע במחיר זהה לחלוטין לזה של שחקן ותיק שנמצא בשילוח מאז מאי, היתרון אינו המחיר. זה היכולת, והיכולת היא הדבר היחיד ש-LongCat-2.5-Preview לא פרסם. זה ממסגר מחדש את ההערכה כולה: אינך בודק אם הוא זול יותר, אתה בודק אם הוא טוב יותר, במשימות שלך, מנקודת התחלה ללא תנופה ובלי שום ראיות שעליהן להישען.

יש פרט מסדר שני שהופך את המבחן הזה לזול ממה שהוא נראה. LongCat-2.5-Preview הוא חינמי וללא הגבלה דרך OpenCode למשך חלון באורך לא מצוין, עם מדיניות אפס-שימור ש-OpenCode מתעדת במפורש — אימון המודל "Not used", שימור נתונים "0 days", לעומת שלושים יום ברשומת ההשוואה. כך שהעלות של יצירת הערכה משלכם קרובה לאפס, ומדיניות השימור אומרת שאפשר להריץ אותה על קוד פרטי. פרט המסגרת היחיד שצריך לסגור קודם הוא שהמודל מחזיר את עקבות החשיבה שלו בשדה reasoning_content משולב; לקוחות שמפרסרים השלמות צ'אט בלי לצפות לכך יזרקו את החשיבה בשקט ויגרמו למודל להיראות גרוע ממה שהוא באמת.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs MiniMax M3' with the subhead 'Identical headline rates, four times the output ceiling, ten times the cache discount'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'MiniMax M3' (MiniMax, released 2026-05-31, independently scored): 1,048,576-token context, 512,000 max output described as four times as much, text, image and video to text, $0.30 uncached / $0.06 cached input, $1.20 output, coding index 58.6 at rank 46 and intelligence index 29.2 at rank 60 by Artificial Analysis, long-context recall 83. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

טיעון הניתוב, ספציפי להשוואה באותו מחיר

אנחנו מגישים את MiniMax M3 במחיר המחירון של MiniMax עם אפס תוספת. LongCat-2.5-Preview אינו אחד מהמסלולים שלנו — אנחנו לא מגישים אותו, ואין לקרוא כאן דבר כטענה אחרת.

התמודדות במחיר זהה היא בדיוק המקרה שבו ניתוב מצדיק את עצמו ולא רק נוחות. אם שני מודלים עולים אותו דבר, ההחלטה ביניהם היא לפי בקשה ולפי משימה: M3 עבור תקרת הפלט של 512,000 טוקנים וקלט וידאו, LongCat-2.5-Preview עבור הנחת ה-prefix המטמון בלולאות סוכן ארוכות לאחר ששיכנעת את עצמך לגבי איכותו. מיזוג מודלים הוא המנגנון שהופך זאת למילולי — שלב אחזור ושלב סינתזה יכולים להיות מודלים שונים בבקשה אחת, כך שאינך נאלץ לבחור מנצח לפני שיש לך ראיות. ובגלל שאנחנו מעבירים מחירי מחירון של ספקים ללא תוספת, שינוי תעריף של ספק מגיע לחשבון שלך באותו יום במקום בחידוש החוזה הבא, מה שחשוב יותר מהרגיל כאשר אחד משני הכרטיסים מוצהר במפורש כמבצעי.מעבר אוטומטי לכשל, אם כן, מכסה את המקרה שבו ספק אחד מתדרדר, וזה חשוב ביותר עבור המודל שאין לו היסטוריית שירות לבחון.

נשאל לעתים קרובות

• האם LongCat-2.5-Preview זול יותר מ-MiniMax M3? לא. בכרטיסים המפורסמים תעריפי הקלט והפלט זהים ב-$0.30 ו-$1.20 למיליון. היתרון היחיד במחיר הוא בקלט במטמון, $0.006 לעומת $0.06, ו-Meituan מתייגת את כל הכרטיס שלה כהנחה לזמן מוגבל בלי לומר מה יבוא אחר כך.

• למי יש תפוקה שמישה גדולה יותר? MiniMax M3 בפער עצום: 512,000 טוקנים לעומת 131,072. עבור יצירה ארוכה, חילוץ מובנה ממסמכים גדולים, או כל דבר שכותב יותר מפרק, התקרה הזו היא המפרט המכריע.

• איזה מהם אני יכול לאמת? MiniMax M3, והאימות לא מחמיא לו — Coding 58.6 במקום ה-46 ומדד Intelligence Index של 29.2 במקום ה-60, לפי Artificial Analysis. ל-LongCat-2.5-Preview אין הערכה שפורסמה מאת אף אחד. אם בנצ'מרק של LongCat-2.5-Preview יופיע השבוע, התייחס אליו כבלתי ניתן לאימות עד שתוכל לשייך אותו למעריך בשם.

• מה כדאי לי להעלות לפרודקשן? אף אחד מהם בלי בדיקה משלך. מבין השניים, M3 הוא הבחירה בעלת השונות הנמוכה יותר כי החולשות שלו מתועדות ומודאליות הקלט שלו מאושרות; LongCat-2.5-Preview הוא בעל השונות הגבוהה יותר, עם הצהרת הקשר גדולה יותר, תקרת פלט קטנה בהרבה, הנחת מטמון, ואפס ראיות פומביות. הרץ אותו בחינם כל עוד החלון פתוח, השאר את שניהם מאחורי מפתח אחד, ותן למספרים שלך להכריע.