כרטיס כותרת ראשי שנוצר, שעליו כתוב 'LongCat-2.5-Preview מול GPT-5.6 Sol' עם כיתוב עליון 'חלון של 1M שעולה אותו דבר לאורך כל הדרך', ושני פאנלים: 'LongCat-2.5-Preview: $0.30 / $1.20 לכל 1M, פלט מקסימלי של 131,072' ו-'GPT-5.6 Sol: $4.00 / $20.00 לכל 1M, מוכפל לאחר 272K קלט'. לוגו OrcaRouter בפינה הימנית התחתונה.
Engineering & Research

LongCat-2.5-Preview לעומת GPT-5.6 Sol: מה העלות של חלון של 1M טוקנים בכל צד

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הדבר השימושי ביותר שאפשר לומר על LongCat-2.5-Preview לעומת GPT-5.6 Sol הוא לא איזה מהם חכם יותר. אלא ששניהם מפרסמים חלון הקשר של כמיליון טוקנים, ורק אחד מהם גובה אותו תעריף עבור כל החלון. המחיר של Sol מכפיל את עצמו מעבר ל-272,000 טוקני קלט. כרטיס התעריפים המפורסם של LongCat-2.5-Preview, לפי מה ש-Meituan רושמת, אינו מחולק למדרגות כלל. ההבדל המבני הבודד הזה מכריע את מרבית עומסי העבודה האמיתיים של מסמכים ארוכים לפני שמתייעצים עם מדד ביצועים — וזה מסוג הדברים שהשוואת מפרטים לעולם לא תראה לך, כי שני המודלים מציגים "1M" באותו גודל גופן.

הנה מה שלמעשה מתועד לגבי כל אחד, מאורגן לפי השאלות ששווה לשאול.

האם חלון מיליון הטוקנים הוא אותו מוצר בשני הצדדים?

לא, וההבדל אינו החלון — אלא מה שקורה כשממלאים אותו. הקטלוג שלנו מציע את Sol עם חלון הקשר של 1,050,000 טוקנים ועד 128,000 טוקנים של פלט מקסימלי, במחיר של $4.00 למיליון טוקני קלט ו-$20.00 למיליון טוקני פלט עבור בקשות של עד 272,000 טוקנים, כאשר קלט במטמון עולה $0.40 למיליון וכתיבות למטמון עולות $5.00 למיליון. מעל לסף זה התעריפים עולים ל-$8.00 ול-$30.00 למיליון. לכן מעבר על מסמך בן 500,000 טוקנים ב-Sol מחויב בתעריף ההקשר הארוך עבור כל הבקשה, ולא לפי תעריף משולב.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview מציין הקשר של 1,000,000 טוקנים ופלט מקסימלי של 131,072 טוקנים. מחירון התעריפים שלו, שמפורסם בפלטפורמה של Meituan עצמה ומסומן שם כהנחה לזמן מוגבל, הוא 0.30 דולר למיליון טוקני קלט שאינם במטמון, 0.006 דולר למיליון טוקני קלט במטמון ו-1.20 דולר למיליון טוקני פלט. Meituan אינה מפרסמת מדרגה שנייה. זה לא אותו הדבר כמו לומר שלא קיימת כזו — זה אומר שהספק לא תיאר כזו, ומחיר שלא מתואר אינו מחיר שאפשר לתקצב לפיו.

תן לזה מספר. קריאה של 500,000 טוקנים שכותבת בחזרה 20,000 טוקנים עולה בערך $4.60 ב-Sol בדרגת ההקשר הארוך ובערך 17 סנט ב-LongCat-2.5-Preview בתעריף המבצעי המפורסם. שני הנתונים הם אריתמטיקה על מחירונים מפורסמים, לא מדידות. היחס גדול מספיק כדי לשנות מה סביר לנסות מבחינה כלכלית: בתעריפים של Sol להקשר ארוך, הזנת בסיס קוד למודל היא החלטה; ב-LongCat, זה קרוב יותר לברירת מחדל.

לאיזה מהם יש ראיות מאחורי המספר?

Sol, ובפער גדול, וזה החלק שמונע מההשוואה להיות ויכוח על מחיר בלבד. Sol הוא מהדורה מיולי 2026 עם פרופיל עצמאי מלא בקטלוג שלנו: מדד קידוד של 77.4, שלישי מבין המודלים ש-Artificial Analysis עוקבת אחריהם; מדד אינטליגנציה של 47 במקום ה-13; GPQA Diamond ‎94.1%; Humanity's Last Exam ‎49.5%; SciCode ‎57.1%; Terminal-Bench v2.1 ב-88.0; τ²-Bench ב-85.1. כל אלה מקורם ב-Artificial Analysis, ולא ב-OpenAI.

המספר הרלוונטי ביותר עבורו בהשוואה הזו הוא Long-Context Recall: 84. זהו הגבוה ביותר מבין מודלי החזית שאנחנו מציעים, והוא מדד לשאלה אם המודל עדיין משתמש במידע שנמצא עמוק בתוך קלט ארוך — השאלה שחלון הקשר גדול אמור לענות עליה. הוא נלקח גם באורך ההקשר של Sol עצמו, ולפי התנאים של Sol עצמו.

ל-LongCat-2.5-Preview אין מקבילה. רשומת יומן השינויים של Meituan עבור 25 בספטמבר 2026 טוענת ליכולת הבנת תמונות, יכולת קידוד ותאימות עם "Claude Code וסביבות פיתוח מיינסטרימיות אחרות", תוך שהיא מזכירה בשמם את Hermes, OpenClaw, OpenCode ו-Kilo Code. היא אינה מפרסמת טבלת בנצ'מרקים, כרטיס מודל או דוח טכני. כ-1.6 טריליון פרמטרים בסך הכול, עם כ-48 מיליארד פעילים לכל טוקן, מדווחים ממטא-נתונים באתר של Meituan ומסיקור מסחרי סיני ולא מתיעוד. אין מאגר LongCat-2.5-Preview ב-HuggingFace, אין כזה בארגון ה-GitHub של Meituan, והמטא-נתונים של הקטלוג ש-OpenCode מפיצה רושמים משקלים פתוחים כ-false.

A screenshot of OrcaRouter's own model page for OpenAI GPT-5.6 Sol at /models/openai/gpt-5.6-sol, showing the openai/gpt-5.6-sol identifier, a 1.05M-token context window, 128K maximum output, text + image + file input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-07-09, a p50 first-token figure of 10.00 s, $4.00 and $20.00 rate tiles, and the OpenAI-compatible code samples.

האם צד הקלט תואם, או רק צד הפלט?

כאן הפרופיל של Sol רחב יותר, ואילו זה של LongCat שנוי במחלוקת. Sol מקבל טקסט, תמונות וקבצים כקלט בקטלוג שלנו, ומחזיר טקסט. יומן השינויים של LongCat-2.5-Preview מציג את הבנת התמונות כתוספת המרכזית שלו — "לנתח תוכן תמונות לצורך מענה על שאלות חוצות-מודאליות, תמצות תוכן והסקה חזותית מורכבת" — אך תגובת הדוגמה בתיעוד "Retrieve Model" של Meituan עצמה עדיין מציגה input_modalitiesבתור ["text"]עם text->textמחרוזת מודאליות. ייתכן שדוגמה זו פשוט מיושנת. עם זאת, זהו החוזה שפרסם הספק, והקריאה הישרה היא שקליטת תמונות נטענת ולא מאושרת עד שתבחנו אותה.

תוצאה מעשית אחת: עקבות חשיבה מ-LongCat-2.5-Preview מגיעות באופן משולב כשדה reasoning_content ולא כפרמטר שנדגם. הארנסים שמפרסרים השלמות צ'אט בלי לצפות לשדה הזה יזרקו בשקט את החשיבה של המודל — בלי שגיאה, רק תשובה גרועה יותר. יהיה מה שתחליטו לגבי המודל עצמו, בדקו את זה קודם.

איזה מהם הוא מסלול שאפשר באמת לשמור?

Sol הוא אחד משלנו. אנחנו מגישים אותו במחיר המחירון של OpenAI עם ללא תוספת רווח, כך ששינוי מחיר של ספק מגיע לחשבון שלך באותו יום ולא בחידוש הבא, ומעבר אוטומטי לגיבוי מעביר בקשה שנחלשה לספק תקין בלי שהאפליקציה שלך תדע. LongCat-2.5-Preview אינו אחד מהנתיבים שלנו — אנחנו לא מגישים אותו, ואין לקרוא שום דבר בקטע הזה כטענה שאנחנו כן מגישים אותו.

חוסר הסימטריה הזה הוא המקום שבו שכבת הניתוב מצדיקה את מקומה בהשוואה הספציפית הזאת, ולא כהערת אגב כללית. התמחור המדורג של Sol אומר שאותה משימה יכולה לעלות פי שניים רק בגלל אורך הקלט, והסף עומד על 272,000 טוקנים — מספר שהאפליקציה שלך יודעת לפני שהיא שולחת את הבקשה. פיצול עומס עבודה לפי גודל הבקשה בין ספקים הוא בדיוק מה ש-DSL לניתוב נועד לעשות, ומיזוג מודלים הולך רחוק יותר: אפשר להרכיב שני מודלים על בקשה אחת כך שמעבר בהקשר ארוך ושלב סינתזה באיכות גבוהה לא חייבים להיות אותו מודל באותו תעריף. אף אחד מאלה אינו סיבה לבחור מודל בלי בנצ'מרק מפורסם. שניהם סיבות לא לקבע אחד באופן קשיח.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs GPT-5.6 Sol' with the subhead 'Two million-token windows, and only one of them prices the whole window the same'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, no second tier described by the vendor, $1.20 output flagged limited-time, long-context recall not published, no repo and catalogue open_weights false. Right column 'GPT-5.6 Sol' (OpenAI, released 2026-07-09, independently scored): 1,050,000-token context, 128,000 max output, text, image and file to text, $4.00 input up to 272K then $8.00, price doubles at 272,000 input tokens, $20.00 output up to 272K then $30.00, long-context recall 84, coding index 77.4 at rank 3 by Artificial Analysis. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

השורה התחתונה

אם עומס העבודה שלך קצר, Sol הוא הבחירה הישירה: הוא שלישי במדד הקידוד, יש לו מספרים בלתי תלויים בכל התחומים, וצד הקלט שלו מתועד. אם עומס העבודה שלך ארוך, החשבון מתהפך בחדות — דרגת ההקשר הארוך של Sol עולה בערך פי 26 מהתעריף המבצעי של LongCat-2.5-Preview עבור אותה קריאה של 500,000 טוקנים, ו-Sol הוא זה שציון השחזור שלו, 84, למעשה עונה על השאלה אם החלון הארוך עובד. אתה קונה חלון ארוך מדוד במחיר חזיתי מול חלון ארוך לא מדוד במחיר מוזל שהספק כבר סימן כזמני.

מצב הכשל שיש להימנע ממנו הוא להתייחס אל אלה כאפשרויות ברות-השוואה. הם אינם אותו מוצר שנמכר במחירים שונים; הם יכולת מתועדת והבטחה. הדרך הנכונה לסגור את הפער היא להריץ את LongCat-2.5-Preview על משימות ההקשר הארוך שלך בזמן שהוא בחינם דרך OpenCode או בזול דרך Meituan — ולשמור את Sol מאחורי ראוטר כך שביום שבו התעריף המבצעי ייעלם, או שמדרגת ההקשר הארוך תחרוג מהתקציב שלך, המעבר יהיה שורת קונפיגורציה ולא מיגרציה.