כרטיס כותרת ראשי עבור 'Mercury 2.5 Preview נגד Grok 4.6' עם כתובית 'האם תצוגה מקדימה של 1,107 אסימונים/שנייה יכולה להוזיל את אלוף הערך?', המציג שבב בצורת ברק עם תווית '1,107 אסימונים/שנייה', שבב מאזניים עם תווית 'מחיר מול מהירות', שבב גביע עם תווית 'AA #3', ולוגו OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

Mercury 2.5 Preview לעומת Grok 4.6: האם Preview של 1,107 אסימונים/שנייה יכול לאתגר את אלוף הערך?

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הנה התשובה במשפט אחד: Mercury 2.5 Preview הוא מודל ההיגיון האמין הזול ביותר בייצור כיום במחיר של $0.04 / $0.15 למיליון טוקנים, ו-Grok 4.6 הוא המודל הזול ביותר בחזית האינטליגנציה במחיר של $2.00 / $6.00 — לכן השאלה המעשית ביניהם היא האם מודל דיפוזיה בתצוגה מקדימה ש-Inception רק טוען שהוא "דומה ל" GPT-5.6 Luna (Low) ו-Claude Haiku 4.5 יכול לבצע את העבודות שבהן אחרת היית משלם עבור דרגת החזית. Mercury 2.5 Preview, ששוחרר ב-31 באוגוסט 2026, מייצר טוקנים במקביל וטוען ל-1,107 טוקנים לשנייה על GPUs סטנדרטיים; Grok 4.6, דגל החזית ששוחרר ב-12 באוגוסט 2026, קיבל ציון 61 במדד Artificial Analysis Intelligence Index, והגיע למקום ה-3 העולמי, וכל זה במחיר שחזית האינטליגנציה לא ראתה מעולם. ההתנגשות הזו — הטענה המהירה ביותר בתחתית עקומת המחירים פוגשת את התמורה הטובה ביותר בראשה — היא נושא המאמר הזה.

נקודות עיקריות

• Grok 4.6 ב-$2.00 / $6.00 עם מדד אינטליגנציה AA של 61 הוא אלוף התמורה בשכבת החזית; Mercury 2.5 Preview ב-$0.04 / $0.15 הוא הימור שאיכות טובה מספיק במחיר של 1/50 מנצחת איכות חזית שאתה בקושי צריך.

טענות המהירות והאיכות של Mercury 2.5 Preview הן כולן של Inception; לא היו ציוני benchmark עצמאיים ביום הראשון.

• הנחת ההשקה של 80% על Mercury 2.5 Preview תוקפה עד 8 בספטמבר 2026, ולאחר מכן מחיר המחירון יהיה $0.20 / $0.75 — עדיין זול פי 10 מ-Grok 4.6 על קלט, אבל סיפור קטן יותר.

• Grok 4.6 מנותב היום דרך OrcaRouter במחיר המחירון; Mercury 2.5 Preview אינו מנותב עדיין ומוגש באמצעות ה-API של Inception עצמה ובאמצעות מספר פלטפורמות של צד שלישי.

לוח התוצאות

A two-column scoreboard titled 'Mercury 2.5 Preview vs Grok 4.6 — the scoreboard': left column Mercury 2.5 Preview — Intelligence claimed cheap-tier parity, Price $0.04/$0.15 (80% off), Speed 1,107 tok/s (claimed), Context 260K, Agentic no public scores, Weights closed; right column Grok 4.6 — Intelligence AA Index 61 (#3), Price $2.00/$6.00, Speed not a headline spec, Context 500K, Agentic APEX-Agents 57.5, Weights closed; footer 'Mercury figures vendor-reported, unreproduced; Grok per xAI and Artificial Analysis'.

בינה — Mercury 2.5 Preview: אין אינדקס עצמאי; Inception טוענת לשוויון עם השכבה הכלכלית. Grok 4.6: AA Intelligence Index 61, בשוויון למקום ה־3 בעולם (לפי Artificial Analysis; הנתונים של המעבדה עצמה מדווחים על ידי הספק).

מחיר — תצוגה מקדימה של Mercury 2.5: $0.04 / $0.15 לכל 1M (80% הנחה מ-$0.20 / $0.75, עד 8 בספטמבר 2026). Grok 4.6: $2.00 / $6.00 לכל 1M, מכפילים ל-$4.00 / $12.00 עבור פרומפטים של 200K אסימונים ומעלה.

מהירות — Mercury 2.5 Preview: 1,107 אסימונים לשנייה לפי הצהרת הספק. Grok 4.6: המהירות אינה מפרט ראשי; המודל בנוי לריצות סוכן ארוכות, לא לסטרימינג מהיר.

הקשר — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.

עבודה אייג'נטית — Mercury 2.5 Preview: אין ציונים פומביים, אם כי קריאות כלים מקבילות נתמכות. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (דווח על ידי הספק, ברובם לא שוחזרו).

משקלים — Mercury 2.5 Preview: סגור, קנייני. Grok 4.6: סגור, קנייני.

אלוף הערך ודילוג המחיר

מעמדו של Grok 4.6 יוצא דופן. הוא תופס את המקום השלישי במדד הבינה של Artificial Analysis — בשוויון עם GPT-5.6 Sol Max — ובמקביל הוא זול יותר מכל דגם שנמצא בטווח של עשר נקודות ממנו, וסיקור ההשקה שלו הדגיש ריצות סוכן ארוכות שמסתיימות בעלות ממוצעת של כ-0.84 דולר למשימה בהערכה אחת שנוהלה על ידי ספק. זוהי ההגדרה של אלוף התמורה: יכולות סמוכות לחזית במחיר שהופך את העלויות למשימה לגלויות בגיליון אלקטרוני. Mercury 2.5 Preview לא מנסה להיות כזה. Inception ממקמת אותו מול דגמים כמו GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite ו-Claude Haiku 4.5 — השכבה המותאמת לעלות, לא החזית. אם Inception צודקת, Mercury 2.5 Preview נמוך בשכבה אחת מ-Grok 4.6 ביכולות, ובכמה שכבות נמוך יותר במחיר — וזה מוצר קוהרנטי לחלוטין: דילוג במחיר עבור עומסי עבודה שבהם שכבת החזית היא בזבוז.

מה פענוח מקבילי משנה בפועל

הארכיטקטורה היא החלק שכדאי להבין, כי היא משנה את משמעות "מהיר". מודלים אוטורגרסיביים פולטים טוקן אחד בכל צעד, כך שהתפוקה מוגבלת על ידי השהיה סדרתית; LLM מבוסס דיפוזיה כמו Mercury 2.5 Preview מייצר בלוק של טוקנים במקביל ומשכלל אותם לאורך שלבי דה-נויזינג, מה שמנתק את התפוקה ממספר הטוקנים המיוצרים. זו הסיבה ש-Inception יכולה לטעון ל-1,107 טוקנים לשנייה על GPUs סטנדרטיים — ללא מאיצים מיוחדים, ללא טריקים של ביצוע באצווה — וזו הסיבה שטענת המוצר האמיתית היא זמן-עד-לטוקן-הראשון של פחות מ-300 מילישניות עבור עומסי עבודה אינטראקטיביים. עבור סוכן קולי, צינור חיפוש, או תת-סוכן קידוד שקורא למודל בכל תור, הפרש ההשהיה הזה הוא המוצר: הוא ההבדל בין לולאה קולית שמרגישה חיה לבין לולאה שעוצרת. המלכוד הוא שמודלי שפה מבוססי דיפוזיה הם תחום מחקר צעיר, הנתון 1,107 הוא של Inception, ואף מעבדה עצמאית לא שחזרה את המהירות ולא מדדה את סחיפת האיכות, אם יש כזו, שיצירה מקבילית מכניסה בפרומפטים ארוכים או עוינים.

איפה Grok 4.6 עדיין שולט בתפקיד

שום דבר ב-Mercury 2.5 Preview לא נוגע בחלקים של השוק ש-Grok 4.6 באמת כובש. ההישגים של Grok על פני Grok 4.5 התרכזו במדדי סוכנים וקוד — DeepSWE עלה ב-11.9 נקודות, APEX-Agents ב-10.4, Terminal-Bench ב-10.3 — וחלון ההקשר של 500K קיים עבור סוכנים ארוכי טווח שצריכים להחזיק את כל המשימה בהקשר. Mercury 2.5 Preview מציע קריאות כלים מקבילות, אבל מודל ללא ציוני סוכנות עצמאיים, מגבלת פלט של 65,536 טוקנים, והקשר של 260K אינו הכלי לריצת הנדסת תוכנה בת 50 שלבים. שני המודלים כמעט לא חופפים בשימוש: Grok 4.6 הוא המנוע לעבודה שצריכה באמת להסתיים; Mercury 2.5 Preview הוא המנוע לעבודה שצריכה להרגיש מיידית ולעלות כמעט כלום לכל קריאה.

חלון ההנחה של 80%

לתמחור כאן יש תאריך תפוגה, וזה משנה את ההחלטה. התעריף של Mercury 2.5 Preview, $0.04 / $0.15, הוא הנחה של 80% ממחיר מחירון של $0.20 / $0.75, ו-Inception הצהיר שהמבצע תקף עד 8 בספטמבר 2026. המחיר של Grok 4.6, $2.00 / $6.00, הוא מחיר מחירון יציב עם מבנה נקי — קלט במטמון ב-$0.50, דרגת עדיפות ב-2×, וקפיצת מדרגה להנחיות ארוכות ב-200K טוקנים שמחייבת את כל הבקשה בתעריף הגבוה. אם משווים את המספרים של היום, Mercury נראה זול פי 50 בקלט ופי 40 בפלט; אם ההנחה תפוג כמתוכנן, הפער האמיתי לטווח ארוך הוא פי 10 בקלט ופי 5 בפלט. אף מסגור אינו מטעה — הם רק אופקי זמן שונים, וצנרת שמתומחרת לפי ההנחה ללא נקודת הערכה מחדש היא צנרת שתופתע ב-9 בספטמבר. המחיר של Grok 4.6, $2.00 / $6.00, הוא בדיוק מה שאתה משלם ב-OrcaRouter, שבו מחיר המחירון של הספק עובר ב-0% markup — כשהספק משנה מספר, הוא פעיל על אותו מפתח באותו יום, עם מעבר אוטומטי אם נתיב ספק אחד מגביל קצב.

פסק הדין בשורה אחת

אם העבודה חייבת להסתיים ואתם רוצים יכולת חזיתית במחיר הטוב ביותר בשכבה, קנו את Grok 4.6 — היא אלופת ערך מוכחת, זמינה על OrcaRouter ב-$2.00 / $6.00 היום. אם העבודה היא חשיבה טקסטואלית בנפח גבוה ורגישה לזמן השהיה, שבה תשובות טובות מספיק הן זולות לאימות, Mercury 2.5 Preview ב-$0.04 / $0.15 היא דילוג מחיר ששווה לבדוק בתוך חלון ההנחה — רק זכרו שכל טענה בצד שלה על הלוח היא של Inception, וההוכחה עדיין תלויה ועומדת.

A screenshot of the Inception documentation page 'Models, Endpoints, and Pricing' (captured September 1, 2026), showing the Mercury family pricing table — Mercury 2 and Mercury Edit 2 both at $0.25 input / $0.025 cached / $0.75 output per 1M tokens — and a cURL chat-completions API example.A screenshot of the OrcaRouter model page for Grok 4.6 (grok/grok-4.6), showing the model header, the '$2.00' price badge, and the model description noting the August 12, 2026 release.

OrcaRouter מעביר את מחירי הרשימה של הספקים ב0% תוספת מחיר עם מעבר אוטומטי, כך ששינוי מחיר של ספק נכנס לתוקף על אותו מפתח באותו יום.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית

© 2026 OrcaRouter

לספקים

מפעילים פלטפורמת הסקה (inference)? הציגו את המודלים שלכם ב-OrcaRouter.

providers@orcarouter.ai

הצטרפו לקהילה שלנו

Discordsupport@orcarouter.aiXGitHubYouTube