
Mercury 2.5 לעומת Mercury 2.5 Preview: מודל דיפוזיה אחד, שני תאריכי השקה
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
הנה קרב ראש-בראש שבו לשני המתמודדים יש כרטיס מודל זהה. Mercury 2.5 Preview של Inception, שיצא ב-31 באוגוסט 2026, ו-Mercury 2.5, שיצא ב-8 בספטמבר 2026, הם אותו מודל שפת דיפוזיה בהפרש של שמונה ימים: ערוץ תצוגה מקדימה ש-Inception פתחה למפתחים, וגרסת הייצור "המוכנה לארגונים" שהושקה כעבור שבוע. Inception לא חשפה checkpoint שונה, נתון מהירות שונה או מחיר שונה עבור Mercury 2.5 — והמספרים שכן השתנו בין שתי ההכרזות נראים כמו ניקיון קוסמטי, לא מודל חדש. נתון ההקשר תוקן מ-256K בדף התצוגה המקדימה ל-260K בזמן ההשקה, והשיפור באינטליגנציה לעומת Mercury 2 נוסח מחדש מ"יותר מ-10 נקודות" (חומרי התצוגה המקדימה) ל"40 אחוז" (חומרי ההשקה). המנוע, טענת ה-1,107 טוקנים לשנייה, וגיליון המחירים זהים. אז זה לא קרב המפרטים הרגיל, ולנפח אחד מהם יהיה לא ישר. ההשוואה שחשובה בין שני השמות היא עניין של אריזה ותזמון: מה השקת גרסת הייצור שינתה בפועל, מה תווית ה-Preview באמת אמרה לך, ובאיזה שם צריכות להשתמש קריאות ה-API שלך כעת.
מדוע מודל מושווה לעצמו
ספקים בדרך כלל משחררים מודל בגרסת תצוגה מקדימה ואז מקפלים אותו בשקט לתוך השם הראשי; הרישום של התצוגה המקדימה נעלם, ואיש לא כותב על ההשוואה. Inception, לעומת זאת, הציגה את שני השמות זה לצד זה במשך שבוע, וזהות התצוגה המקדימה רק עכשיו יוצאת מכלל שימוש — וזו בדיוק הסיבה שיש להשוואה הזו תוכן. ה-Preview היה הדרך המהירה שבה Inception הביאה את ההימור שלה על דיפוזיה לידי מפתחים. הוא הופיע ב-31 באוגוסט עם גיליון המפרטים שהוא כיום גיליון המפרטים של Mercury 2.5: מודל שפה דיפוזי (dLLM) שמייצר ומשכלל בלוקים של טוקנים במקביל במקום לפלוט טוקן אחד בכל פעם; טענה ל-1,107 טוקנים בשנייה על GPUs סטנדרטיים; טענה לזמן עד הטוקן הראשון של פחות מ-300ms; חלון הקשר של 260K טוקנים עם פלט של 65,536 טוקנים; רמות חשיבה הניתנות לכוונון; שימוש מובנה בכלים, קריאות כלים מקבילות ופלט מובנה. כל אחד מהנתונים האלה הוא של Inception עצמה, ושום מעבדה עצמאית לא מדדה את המודל כשה-Preview יצא.
ב-8 בספטמבר השיקה Inception את Mercury 2.5 בתור "הדרג הבא של אינטליגנציה עבור מודלי שפה גדולים מבוססי דיפוזיה" וכמודל ההיסק המהיר ביותר שלה בייצור — מוכן לארגונים, המיועד לסוכני קול, סוכני משנה לקוד, חיפוש ארגוני ועומסי עבודה של תמיכה. אותם מפרטים, אותו מיצוב, אותו מחירון. ההשקה הציגה גם שני אחים שמבהירים לאן Inception פונה: Mercury Voice, מודל dLLM מכוונן לטוקן ראשון של מתחת ל-170ms עבור סוכני קול, ו-Mercury Router, שמנתב פרומפטים בין מודלים לפי איכות, מהירות ועלות. Mercury 2.5 הוא דגל המשפחה שנבנתה עבור עומסי עבודה רגישים לשהות ואג'נטיים, ולא עבור דרג האיכות של מודלים פורצי דרך.
מה ההשקה ב-8 בספטמבר שינתה בפועל
השווה בין שני השמות שורה אחר שורה, והפער אינו המנוע — אלא כל מה שעוטף את המנוע:
• סטטוס — Mercury 2.5 Preview: תצוגה מקדימה סגורה ש״עשויה לשנות התנהגות או זמינות״. Mercury 2.5: גרסת ייצור שהושקה עם התחייבות למוכנות ארגונית, ערוץ מכירות ורישום ייצור עם תאריך.
• זהות — עמוד המודלים של Inception מציג כעת את Mercury 2.5, Mercury Voice ו-Mercury Router, בלי שום Preview באופק, והערת השוליים שלו בנושא תמיכה מונה את Mercury 1, Mercury 2 ו-Mercury Edit 2 כמודלים ש״יישארו נתמכים עבור לקוחות קיימים״. ה-Preview אינו מופיע באף אחת מהרשימות. מבחינת הספק, תווית ה-Preview נטמעה ב-Mercury 2.5.
• נקודת קצה — פלטפורמת הפיתוח של Inception מגישה את המודל בשם mercury-2.5, והרישום היצרני שעלה ב-8 בספטמבר הוא זה שמשרת את התנועה החדשה. בקטלוג שבו הופיע לראשונה ה-Preview בסוף אוגוסט, השם Preview מתפרש כעת ללא נקודת קצה חיה, בעוד הרישום Mercury 2.5 שהוסף ב-8 בספטמבר עונה. כל מי שקודד מול השם Preview צריך להפנות מחדש ל-Mercury 2.5 ולוודא מה הספק שלו למעשה מחייב — המזהה ששילבתם בשבוע הראשון הוא זה שמפסיק לפעול.
• מחיר — רשימה זהה והנחה זהה. שניהם במחיר $0.20 למיליון קלט ו-$0.75 למיליון פלט, עם קלט במטמון ב-$0.02, ושניהם הושקו בהנחה של כ-80%: $0.04 / $0.15, עם קלט במטמון ב-$0.004. ההנחה של Preview הוגבלה במפורש בזמן עד 8 בספטמבר; Mercury 2.5 הושקה עם אותה הצעה של 80%, והתעריף המוזל הוא מה שרישום הייצור שלה עדיין מציג במועד כתיבת שורות אלה. זו המלכודת, שמפורטת להלן.
• Onboarding — ההשקה לייצור הוסיפה מכסת אסימונים בחינם לחשבונות מפתחים חדשים — חומרי ההשקה מציינים 100 מיליון אסימונים — ופתחה מסלול פנייה ארגוני שלא היה קיים בגרסת התצוגה המקדימה.
• ראיות — ללא שינוי. לאף אחד מהשמות אין מדד (benchmark) עצמאי, וטענות הספק הן אותן טענות בניסוח שונה במקצת: "קפיצת אינטליגנציה של יותר מ-10 נקודות" על פני Mercury 2 בחומרי התצוגה המוקדמת הופכת לעלייה של "40 אחוז" בחומרי ההשקה, לצד אותו שוויון מוצהר עם שכבת ה-frontier האופטימלית מבחינת עלות (GPT-5.6 Luna במצב מאמץ נמוך, Gemini 3.5 Flash-Lite, Claude Haiku 4.5) ואותו 79% שדווח על ידי הספק ב-GPQA Diamond ו-77% ב-IFBench. טענה שנוסחה מחדש אינה טענה מאומתת.

מלכודת התמחור שבלב הצימוד
מכיוון שלשני השמות יש אותו מחיר מחירון ואותה הנחת פתיחה של 80%, קל להניח שהם תמיד עולים אותו דבר. הם לא חייבים. ההנחה של Preview נעצרה בחדות ב-8 בספטמבר; הנחת ההשקה של Mercury 2.5 רצה על ספירה חדשה. במשך שבוע היה אפשר בהחלט לשלם $0.20 / $0.75 עבור שיחה ל-Preview, בזמן שאותו מנוע ענה במחיר של $0.04 / $0.15 תחת שמו היצרני — או, סביר יותר, להיות על מזהה Preview שהפסיק בשקט לשרת בעוד החשבון המשיך להגיע. הנחת השקה שתוקפה פג לפי נקודת קצה היא בדיוק סוג האותיות הקטנות שהופך סיפור של "אותו דגם, אותו מחיר" להפרש מחיר אמיתי.
המספר האמין הוא מחיר המחירון, והעצה האמינה היא לתכנן תקציב סביבו: $0.20 / $0.75 למיליון, קלט במטמון $0.02 — זול עבור מודל חשיבה עם הקשר של 260K, בנוחות מתחת לדרגת הדגל, אבל לא ה-$0.04 / $0.15 שמפרסמים באנרי ההשקה. התייחס למחיר המוזל כמחיר נסיעת מבחן עם אורך חיים, ודא מה הספק שלך מחייב עבור מזהה המודל המדויק בקוד שלך, ולא עבור השם בדף השיווק, ואם התחלת להשתמש ב-Preview, העבר ל-Mercury 2.5 לפני שתוקף או נקודת קצה שהוצאה משירות תחליט במקומך.
זוהי גם קטגוריית הבעיות ששכבת ניתוב קיימת כדי להסיר. נתב מודלים שמעביר את מחירי המחירון של הספקים עם תוספת של 0%מציג את המחיר שהספק בפועל מחייב, שמתעדכן באותו היום שבו הנחת השקה נכנסת לתוקף או מסתיימת, ומעבר אוטומטי לגיבוי שומר על רציפות השיחות כאשר נקודת קצה מוסרת מתחתיך. Mercury 2.5 אינו ב-OrcaRouter נכון לכתיבת שורות אלה — Inception משרתת אותו דרך ה-API שלה וכמה פלטפורמות של צד שלישי — ולכן לעת עתה דף המודלים של הספק הוא מקור האמת לתעריף. ברגע שספק מפרסם אותו, המנגנונים האלה של העברה ישירה הם מה שתקבל במפתח אחד, וירידת מחיר או סיום הנחה יופיעו אצלנו באותו היום שבו הם מוכרזים.
בעיית הראיות ששני השמות חולקים
כרטיס הניקוד הכנה להשוואה הזו קצר, כי שתי העמודות הן אותו מודל עם אותו היעדר הוכחות. לא ל-Mercury 2.5 ולא ל-Mercury 2.5 Preview יש ציון מדד עצמאי, הרצה משוכפלת או מיקום בזירה נכון ל-9 בספטמבר 2026. הטענות של Inception עצמה — הזינוק באינטליגנציה לעומת Mercury 2, השקילות לרמת Haiku 4.5, ציון 79% ב-GPQA Diamond, 1,107 הטוקנים לשנייה — הן הצהרה עצמית של החברה בלבד, והן זהות עבור שני השמות משום שהמודל זהה.
חלק הראיות העצמאי היחיד במשפחה מצביע על האופן שבו יש לקרוא את טענת המהירות. Artificial Analysis מדדה את Mercury 2, קודמו, ב-684 אסימונים לשנייה בנקודת הקצה היצרנית, והעניקה לו ציון 22 במדד האינטליגנציה — מהיר באמת, והוכחה לכך שגישת הדיפוזיה אינה אשליה, אך הרבה מתחת לכ-1,000 האסימונים לשנייה ש-Inception מפרסמת עבור אותו דגם על חומרת Blackwell. צפו לפער דומה בין הנתון 1,107 של Mercury 2.5 לבין מה שנקודת קצה משותפת ורב-דיירים מספקת בפועל תחת עומס אמיתי. אותה זהירות חלה גם על האיכות: אסור לקחת דגם דיפוזיה חדש לגמרי שנמדד רק על ידי יוצרו כמובן מאליו בכל הנוגע להשתוות ל-Claude Haiku 4.5, עד שגורם שלישי יריץ אותו.

העקיבות שהחלו לסקר את ההשקה משקפות בדיוק את מצב הדברים הזה. רשומת BenchLM עבור Mercury 2.5, שפורסמה ב-8 בספטמבר, אינה נותנת למודל ציון ציבורי או דירוג ציבורי; היא נושאת את נתוני ה-79% GPQA Diamond ו-77% IFBench של Inception, המסומנים במפורש כמדווחים על ידי הספק, ומציינת שמהירות ריצה עצמאית לא נמדדה. ערך ראשון במדד Artificial Analysis, מיקום ב-LMArena, או ריצת GPQA משוכפלת יהפכו את Mercury 2.5 מטענה לאובייקט בר השוואה — וזה יחול על שני השמות בבת אחת, כי יש רק מודל אחד למדידה.

באיזה שם כדאי לך לקרוא?
• אינטגרציה חדשה, ללא legacy: קראו ל-Mercury 2.5 והתעלמו מה-Preview. השם בפרודקשן כולל את אותו המנוע, את אותה ההנחה (לעת עתה), את תנאי ה-Enterprise, ואת הערובה שזהו ה-ID שהספק מגיש בפועל. ה-Preview מוסיף סיכון לחוסר יציבות, ושום דבר אחר.
• כבר שילבת את ה-Preview: בדוק היום מה הספק שלך משרת תחת השם הזה ומה הוא גובה תמורתו. כוון מחדש את הלקוח שלך למזהה של Mercury 2.5 ואשר את התעריף. השמירה על השם Preview בקוד הייצור היא עכשיו הימור שערוץ Preview עם הגבלת זמן מפורשת ישרוד את הפרישה שלו.
• תעבורה ארגונית או תעבורה קריטית לייצור:Mercury 2.5 מוצע דרך המסלול הארגוני של Inception, לא כתווית preview ללא התחייבות מאחוריה. צורכי קול וניתוב מופנים אל Mercury Voice ואל Mercury Router, בהתאמה, שעדיין נמצאים בעצמם ב-preview.
• כל מי שמעריך את שכבות הדיפוזיה:שני השמות הם אותו יעד הערכה, לכן הריצו את ההערכה שלכם מול Mercury 2.5 פעם אחת והתייחסו לתוצאה כאל תוצאה החלה על קו המודל כולו. תקצבו לפי מחיר המחירון, והתייחסו לטענות הספק כהשערות עד שיתקבל ציון בלתי תלוי.
מה לצפות
שלושה דברים יגדירו את הזיווג הזה בשבועות הקרובים: הראשון — מבחן ההשוואה הבלתי-תלוי הראשון, בין אם מיקום במדד ובין אם ריצה משוכפלת של GPQA או AIME — שיבחן את טענת השוויון שמהווה את ההימור המסחרי כולו. השני — האם זהות ה-Preview תיעלם כליל ממערכת המודלים, כפי שדף המודלים של Inception עצמו רומז כבר עכשיו. השלישי — מה יקרה להנחת ההשקה של 80%, עכשיו שחלף המועד של 8 בספטמבר שאליו היה ה-Preview צמוד: הארכה תהפוך את Mercury 2.5 לזול באופן מבני, בעוד שחזרה ל-$0.20 / $0.75 תהפוך אותו לתחרותי בלבד. עד אז, התשובה הנכונה לשאלה 'Mercury 2.5 או Mercury 2.5 Preview?' היא שמדובר במודל אחד, ועליכם לקרוא לזה שעדיין מוצר.
