
Mercury 2.5 Preview לעומת Grok 4.6: האם Preview של 1,107 אסימונים/שנייה יכול לאתגר את אלוף הערך?
- AlibabaחדשQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiחדשZ.ai: GLM 5.3 Flash2026-08-2658אינטליגנציה72כתיבת קוד
- DeepSeekחדשDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1860אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1552אינטליגנציה68כתיבת קוד
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1261אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
הנה התשובה במשפט אחד: Mercury 2.5 Preview הוא מודל ההיגיון האמין הזול ביותר בייצור כיום במחיר של $0.04 / $0.15 למיליון טוקנים, ו-Grok 4.6 הוא המודל הזול ביותר בחזית האינטליגנציה במחיר של $2.00 / $6.00 — לכן השאלה המעשית ביניהם היא האם מודל דיפוזיה בתצוגה מקדימה ש-Inception רק טוען שהוא "דומה ל" GPT-5.6 Luna (Low) ו-Claude Haiku 4.5 יכול לבצע את העבודות שבהן אחרת היית משלם עבור דרגת החזית. Mercury 2.5 Preview, ששוחרר ב-31 באוגוסט 2026, מייצר טוקנים במקביל וטוען ל-1,107 טוקנים לשנייה על GPUs סטנדרטיים; Grok 4.6, דגל החזית ששוחרר ב-12 באוגוסט 2026, קיבל ציון 61 במדד Artificial Analysis Intelligence Index, והגיע למקום ה-3 העולמי, וכל זה במחיר שחזית האינטליגנציה לא ראתה מעולם. ההתנגשות הזו — הטענה המהירה ביותר בתחתית עקומת המחירים פוגשת את התמורה הטובה ביותר בראשה — היא נושא המאמר הזה.
נקודות עיקריות
• Grok 4.6 ב-$2.00 / $6.00 עם מדד אינטליגנציה AA של 61 הוא אלוף התמורה בשכבת החזית; Mercury 2.5 Preview ב-$0.04 / $0.15 הוא הימור שאיכות טובה מספיק במחיר של 1/50 מנצחת איכות חזית שאתה בקושי צריך.
טענות המהירות והאיכות של Mercury 2.5 Preview הן כולן של Inception; לא היו ציוני benchmark עצמאיים ביום הראשון.
• הנחת ההשקה של 80% על Mercury 2.5 Preview תוקפה עד 8 בספטמבר 2026, ולאחר מכן מחיר המחירון יהיה $0.20 / $0.75 — עדיין זול פי 10 מ-Grok 4.6 על קלט, אבל סיפור קטן יותר.
• Grok 4.6 מנותב היום דרך OrcaRouter במחיר המחירון; Mercury 2.5 Preview אינו מנותב עדיין ומוגש באמצעות ה-API של Inception עצמה ובאמצעות מספר פלטפורמות של צד שלישי.
לוח התוצאות

• בינה — Mercury 2.5 Preview: אין אינדקס עצמאי; Inception טוענת לשוויון עם השכבה הכלכלית. Grok 4.6: AA Intelligence Index 61, בשוויון למקום ה־3 בעולם (לפי Artificial Analysis; הנתונים של המעבדה עצמה מדווחים על ידי הספק).
• מחיר — תצוגה מקדימה של Mercury 2.5: $0.04 / $0.15 לכל 1M (80% הנחה מ-$0.20 / $0.75, עד 8 בספטמבר 2026). Grok 4.6: $2.00 / $6.00 לכל 1M, מכפילים ל-$4.00 / $12.00 עבור פרומפטים של 200K אסימונים ומעלה.
• מהירות — Mercury 2.5 Preview: 1,107 אסימונים לשנייה לפי הצהרת הספק. Grok 4.6: המהירות אינה מפרט ראשי; המודל בנוי לריצות סוכן ארוכות, לא לסטרימינג מהיר.
• הקשר — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.
• עבודה אייג'נטית — Mercury 2.5 Preview: אין ציונים פומביים, אם כי קריאות כלים מקבילות נתמכות. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (דווח על ידי הספק, ברובם לא שוחזרו).
• משקלים — Mercury 2.5 Preview: סגור, קנייני. Grok 4.6: סגור, קנייני.
אלוף הערך ודילוג המחיר
מעמדו של Grok 4.6 יוצא דופן. הוא תופס את המקום השלישי במדד הבינה של Artificial Analysis — בשוויון עם GPT-5.6 Sol Max — ובמקביל הוא זול יותר מכל דגם שנמצא בטווח של עשר נקודות ממנו, וסיקור ההשקה שלו הדגיש ריצות סוכן ארוכות שמסתיימות בעלות ממוצעת של כ-0.84 דולר למשימה בהערכה אחת שנוהלה על ידי ספק. זוהי ההגדרה של אלוף התמורה: יכולות סמוכות לחזית במחיר שהופך את העלויות למשימה לגלויות בגיליון אלקטרוני. Mercury 2.5 Preview לא מנסה להיות כזה. Inception ממקמת אותו מול דגמים כמו GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite ו-Claude Haiku 4.5 — השכבה המותאמת לעלות, לא החזית. אם Inception צודקת, Mercury 2.5 Preview נמוך בשכבה אחת מ-Grok 4.6 ביכולות, ובכמה שכבות נמוך יותר במחיר — וזה מוצר קוהרנטי לחלוטין: דילוג במחיר עבור עומסי עבודה שבהם שכבת החזית היא בזבוז.
מה פענוח מקבילי משנה בפועל
הארכיטקטורה היא החלק שכדאי להבין, כי היא משנה את משמעות "מהיר". מודלים אוטורגרסיביים פולטים טוקן אחד בכל צעד, כך שהתפוקה מוגבלת על ידי השהיה סדרתית; LLM מבוסס דיפוזיה כמו Mercury 2.5 Preview מייצר בלוק של טוקנים במקביל ומשכלל אותם לאורך שלבי דה-נויזינג, מה שמנתק את התפוקה ממספר הטוקנים המיוצרים. זו הסיבה ש-Inception יכולה לטעון ל-1,107 טוקנים לשנייה על GPUs סטנדרטיים — ללא מאיצים מיוחדים, ללא טריקים של ביצוע באצווה — וזו הסיבה שטענת המוצר האמיתית היא זמן-עד-לטוקן-הראשון של פחות מ-300 מילישניות עבור עומסי עבודה אינטראקטיביים. עבור סוכן קולי, צינור חיפוש, או תת-סוכן קידוד שקורא למודל בכל תור, הפרש ההשהיה הזה הוא המוצר: הוא ההבדל בין לולאה קולית שמרגישה חיה לבין לולאה שעוצרת. המלכוד הוא שמודלי שפה מבוססי דיפוזיה הם תחום מחקר צעיר, הנתון 1,107 הוא של Inception, ואף מעבדה עצמאית לא שחזרה את המהירות ולא מדדה את סחיפת האיכות, אם יש כזו, שיצירה מקבילית מכניסה בפרומפטים ארוכים או עוינים.
איפה Grok 4.6 עדיין שולט בתפקיד
שום דבר ב-Mercury 2.5 Preview לא נוגע בחלקים של השוק ש-Grok 4.6 באמת כובש. ההישגים של Grok על פני Grok 4.5 התרכזו במדדי סוכנים וקוד — DeepSWE עלה ב-11.9 נקודות, APEX-Agents ב-10.4, Terminal-Bench ב-10.3 — וחלון ההקשר של 500K קיים עבור סוכנים ארוכי טווח שצריכים להחזיק את כל המשימה בהקשר. Mercury 2.5 Preview מציע קריאות כלים מקבילות, אבל מודל ללא ציוני סוכנות עצמאיים, מגבלת פלט של 65,536 טוקנים, והקשר של 260K אינו הכלי לריצת הנדסת תוכנה בת 50 שלבים. שני המודלים כמעט לא חופפים בשימוש: Grok 4.6 הוא המנוע לעבודה שצריכה באמת להסתיים; Mercury 2.5 Preview הוא המנוע לעבודה שצריכה להרגיש מיידית ולעלות כמעט כלום לכל קריאה.
חלון ההנחה של 80%
לתמחור כאן יש תאריך תפוגה, וזה משנה את ההחלטה. התעריף של Mercury 2.5 Preview, $0.04 / $0.15, הוא הנחה של 80% ממחיר מחירון של $0.20 / $0.75, ו-Inception הצהיר שהמבצע תקף עד 8 בספטמבר 2026. המחיר של Grok 4.6, $2.00 / $6.00, הוא מחיר מחירון יציב עם מבנה נקי — קלט במטמון ב-$0.50, דרגת עדיפות ב-2×, וקפיצת מדרגה להנחיות ארוכות ב-200K טוקנים שמחייבת את כל הבקשה בתעריף הגבוה. אם משווים את המספרים של היום, Mercury נראה זול פי 50 בקלט ופי 40 בפלט; אם ההנחה תפוג כמתוכנן, הפער האמיתי לטווח ארוך הוא פי 10 בקלט ופי 5 בפלט. אף מסגור אינו מטעה — הם רק אופקי זמן שונים, וצנרת שמתומחרת לפי ההנחה ללא נקודת הערכה מחדש היא צנרת שתופתע ב-9 בספטמבר. המחיר של Grok 4.6, $2.00 / $6.00, הוא בדיוק מה שאתה משלם ב-OrcaRouter, שבו מחיר המחירון של הספק עובר ב-0% markup — כשהספק משנה מספר, הוא פעיל על אותו מפתח באותו יום, עם מעבר אוטומטי אם נתיב ספק אחד מגביל קצב.
פסק הדין בשורה אחת
אם העבודה חייבת להסתיים ואתם רוצים יכולת חזיתית במחיר הטוב ביותר בשכבה, קנו את Grok 4.6 — היא אלופת ערך מוכחת, זמינה על OrcaRouter ב-$2.00 / $6.00 היום. אם העבודה היא חשיבה טקסטואלית בנפח גבוה ורגישה לזמן השהיה, שבה תשובות טובות מספיק הן זולות לאימות, Mercury 2.5 Preview ב-$0.04 / $0.15 היא דילוג מחיר ששווה לבדוק בתוך חלון ההנחה — רק זכרו שכל טענה בצד שלה על הלוח היא של Inception, וההוכחה עדיין תלויה ועומדת.


OrcaRouter מעביר את מחירי הרשימה של הספקים ב0% תוספת מחיר עם מעבר אוטומטי, כך ששינוי מחיר של ספק נכנס לתוקף על אותו מפתח באותו יום.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
