כרטיס כותרת הירו שנוצר עם הכותרת 'GPT-6 Luna מול Grok 4.6' והכתובית 'פי עשרים מהמחיר, וצוק ב-200,000 טוקנים', כותרת תחתונה בנוסח 'מחירים לפי OpenAI ו-xAI; נתוני מדד לפי Artificial Analysis.', והלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

GPT-6 Luna מול Grok 4.6: פער המחירים הוא פי עשרים והחלון הוא ההבדל האמיתי

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

שים את GPT-6 Luna ואת Grok 4.6 על אותו דף, וההשוואה הראשונה נכתבת מעצמה. Luna מוצעת במחיר של 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט. Grok 4.6 מוצע במחיר של 2.00 ו-6.00 דולר עם קריאה מהמטמון ב-0.50 דולר. פי עשרים בקלט, פי שתים עשרה בפלט, ושיעור קלט מהמטמון גבוה פי חמישים במודל של הספק. זה המחיר שעל המדבקה, ולפי המחיר שעל המדבקה התשובה רחוקה מלהיות צמודה.

הסיבה לכך ששווה לכתוב את שאר הקטע הזה היא ששני המודלים חלוקים על משהו מבני יותר מאשר מחיר. Grok 4.6 נושא חלון הקשר של 500,000 טוקנים ומתמחר מחדש את כל הבקשה ברגע שהפרומפט עובר 200,000 טוקנים. GPT-6 Luna נושא 1,050,000 טוקנים ומתמחר מחדש ב-272,000. שני הספים הללו הם צוקים ולא תעריפים שוליים — חצו אחד מהם והבקשה כולה מחויבת במספר הגבוה, לא החלק שמעל לקו. היכן שממוקמים שני הצוקים הללו, ומה קורה לעומס עבודה עם הקשר ארוך בצד הלא נכון של כל אחד מהם, קובע יותר מההשוואה הזו מאשר הכותרת של פי עשרים.

שני מודלים, שתי תנוחות שונות בתכלית

Grok 4.6 הוא המודל של xAI מ-12 באוגוסט 2026, והוא שחרור חזיתי לשימוש כללי: קלט טקסט, פלט טקסט, חלון של 500,000 טוקנים, עלות מפורסמת לכל משימה של $1.86 בלוח העצמאי במאמץ גבוה, ומהירות מדודה של 57.7 טוקני פלט לשנייה. זה מסוג המודלים שצוות מאמץ כי הוא טוב בהרבה דברים והספק משחרר מהר.

GPT-6 Luna הוא העמדה ההפוכה. OpenAI שחררה אותו ב-22 בספטמבר 2026 כדרגת הנפח של משפחת GPT-6, מתחת ל-GPT-6 Sol במחיר $2.00/$10.00 ולדגם הדגל GPT-6 Astra במחיר $10.00/$50.00. קלט טקסט ותמונה, פלט טקסט, חלון של 1,050,000 טוקנים עם קלט מקסימלי של 922,000 טוקנים, תקרת פלט של 128,000 טוקנים, וסולם הסקה שנע מ-none דרך low, medium, high, xhigh ו-max, כאשר medium הוא ברירת המחדל. זה לא מודל שמישהו מאמץ בשל הרוחב שלו. זה מודל ששמים מתחת לעומס עבודה.

אז ההצגה הכנה של הדברים היא לא "איזה מאלה טוב יותר". היא "איזה מאלה מתומחר בהתאם לצורת העבודה שיש לך", ושתי הצורות שונות באמת.

הכרטיסים, שורה אחר שורה

שורה אחת לכל מימד, שני הצדדים בכל אחד:

• קלט לכל 1M — GPT-6 Luna $0.10 לעומת Grok 4.6 $2.00

• פלט לכל 1M — GPT-6 Luna ‏$0.50 לעומת Grok 4.6 ‏$6.00

• קלט במטמון לכל 1M — GPT-6 Luna $0.01 לעומת Grok 4.6 $0.50, עשירית מתעריף הקלט של עצמו לעומת רבע מזה של xAI

• סף הקשר ארוך — GPT-6 Luna 272,000 טוקני קלט לעומת Grok 4.6 200,000 טוקני פרומפט

• תעריפים להקשר ארוך — GPT-6 Luna מתמחרת מחדש את כל הבקשה ל-$0.20 לקלט, $0.75 לפלט, $0.02 למטמון לעומת Grok 4.6 שמתמחר מחדש את כל הבקשה ל-$4.00 לקלט, $12.00 לפלט, $1.00 למטמון

• חלון הקשר — GPT-6 Luna 1,050,000 טוקנים לעומת Grok 4.6 500,000 טוקנים

• פלט מרבי — GPT-6 Luna ‏128,000 טוקנים לעומת Grok 4.6, שלא פורסם כתקרה נפרדת בכרטיס

• מדד Intelligence Index, בלתי־תלוי — GPT-6 Luna 37 במאמץ מקסימלי לעומת Grok 4.6 44 במאמץ גבוה בגרסת מדד v4.3.2

• ציון במאמץ ברירת מחדל — GPT-6 Luna 29 ב־medium שלה כברירת מחדל לעומת Grok 4.6 43 ב־medium, כאשר הלוח גם מודד אותו

• עלות לכל משימת Index, באופן בלתי תלוי — GPT-6 Luna כ-$0.07 לעומת Grok 4.6 ב-$1.86 במאמץ גבוה

• אסימוני פלט בהרצת האינדקס — GPT-6 Luna 150M מול Grok 4.6 94M, לעומת חציון הלוח של 88M

• מהירות פלט, בלתי תלויה — GPT-6 Luna 153.9 טוקנים/שנייה לעומת Grok 4.6 57.7 טוקנים/שנייה במצב גבוה

• זמן עד לטוקן הראשון, בנפרד — Grok 4.6 38.63 שניות, מקצה לקצה 47.31 שניות; GPT-6 Luna מחזיר טוקן ראשון בזמן שמאפשר למשתמש להמתין

• יכולת סייבר, עצמאית — Grok 4.6 משיג ציון 57 בהערכת הסייבר של הלוח; לא פורסם נתון בר-השוואה עבור GPT-6 Luna

• ב-OrcaRouter — GPT-6 Luna לא בקטלוג שלנו לעומת Grok 4.6 שניתן לניתוב במחיר המחירון של xAI

Generated two-column scoreboard titled 'GPT-6 Luna vs Grok 4.6 - the scoreboard'. Left column GPT-6 Luna rows: Price in/out $0.10 / $0.50, Cached input $0.01, Long-context threshold 272,000, Context 1,050,000, AA Index 37 at max effort, Cost per index task $0.07. Right column Grok 4.6 rows: Price in/out $2.00 / $6.00, Cached input $0.50, Long-context threshold 200,000, Context 500,000, AA Index 44 at high effort, Cost per index task $1.86. Footer: 'Prices per OpenAI and xAI; index figures per Artificial Analysis.'

200,000 מול 272,000 הוא כל הטיעון

קראו את שני הספים שליד שני החלונות, וההשוואה מארגנת את עצמה מחדש.

המצוק של Grok 4.6 נמצא ב-200,000 טוקנים בתוך חלון של 500,000 טוקנים — 40% מהדרך פנימה. זה של GPT-6 Luna נמצא ב-272,000 בתוך 1,050,000 — 26% מהדרך פנימה. כך שלא רק שהמודל הזול יותר מתחיל לתמחר מחדש מאוחר יותר, אלא שיש לו יותר מפי שניים מרחב אחרי הסף לפני שהחלון שלו נגמר בכלל.

באופן קונקרטי: בקשה של 450,000 טוקנים נכנסת לשני המודלים. ב-GPT-6 Luna החיוב הוא לפי שכבת ההקשר הארוך: $0.20 ו-$0.75. ב-Grok 4.6 החיוב הוא $4.00 ו-$12.00. כלומר פי עשרים בקלט ופי שש עשרה בפלט עבור אותו פרומפט — וזו בקשה ש-Grok 4.6 יכול לשרת, כך שהבחירה היא אמיתית ולא תיאורטית.

המקרה ההפוך הוא זה שתופס אנשים לא מוכנים. בקשת 190,000 טוקנים נמצאת מתחת לשני הספים ומחויבת בתעריפים הסטנדרטיים בשניהם: $0.10/$0.50 מול $2.00/$6.00 — פי עשרים ופי שתים־עשרה בדיוק. בקשת 210,000 טוקנים נמצאת מעל הקו של Grok 4.6 ומתחת לזה של GPT-6 Luna. היא מחויבת ב-$4.00/$12.00 ב-Grok 4.6 וב-$0.10/$0.50 ב-Luna — פער של פי ארבעים ופי עשרים וארבעה, שנוצר כולו מהפרש של 20,000 טוקנים באורך הפרומפט, בלי שינוי באף אחד מהמודלים.

זה לא סיבה להימנע מ-Grok 4.6. זו סיבה לדעת היכן הפרומפטים שלך באמת נוחתים, כי עומס עבודה שממוצעו 180,000 טוקנים ומזנק ל-220,000 משלם לפי שני תעריפים שונים וייראה כמו שגיאת חיוב בחודש הראשון שזה קורה.

מה קונה פער המחיר בדירקטוריון העצמאי

Grok 4.6 צובר 44 במדד הבינה של Artificial Analysis במאמץ גבוה. GPT-6 Luna צובר 37 במאמץ מקסימלי. שבע נקודות, במדד משולב שבו נקודה בודדת נמצאת בתוך הרעש של הרצה חוזרת — ושני המודלים מופרדים בפי עשרים ושישה בערך בעלות למשימה שהושלמה, $1.86 לעומת כ-$0.07.

שני דברים בזוג המספרים הזה שווה להפריד.

הראשון הוא ברירת המחדל של המאמץ. ה-37 של GPT-6 Luna הוא נתון של מאמץ מרבי, וברירת המחדל שלו היא בינונית, שבה הוא משיג 29. ה-44 של Grok 4.6 הוא נתון של מאמץ גבוה, והלוח גם מודד אותו במאמץ בינוני, שבו הוא משיג 43. אז ההשוואה בתנאים זהים בהגדרות ברירת המחדל היא 29 מול 43 — ארבעה־עשר נקודות, לא שבע, וגרסת ארבעה־עשר הנקודות היא זו שצוות שפורס את שניהם ולא משנה דבר יחווה בפועל. Grok 4.6 מאבד נקודה אחת במעבר מגבוה לבינוני. GPT-6 Luna מאבד שמונה. חוגת המאמץ עולה למודל הזול הרבה יותר ממה שהיא עולה ליקר, והאסימטריה הזו אינה נראית בנתוני המדד הכותרתיים.

השני הוא אריכות דברים, וכאן הכיוון הפוך ממה שיחס המחירים מרמז. GPT-6 Luna ייצר 150 מיליון טוקני פלט בהשלמת האינדקס; Grok 4.6 ייצר 94 מיליון. המודל שמחירו לכל טוקן פלט נמוך פי שנים-עשר צרך 60% יותר טוקנים כדי להגיע לציון נמוך יותר. בכרטיס תמחור לפי פלט זה ההבדל בין פער של פי עשרים ושישה בעלות לכל משימה לבין פער קטן יותר, וזו הסיבה לכך שכל השוואה המבוססת על מחירי מחירון בלבד תפריז בטיעון לטובת השכבה הזולה.

Grok 4.6 מפרסם גם ציון יכולת סייבר של 57 באותו לוח. אין נתון בר-השוואה של GPT-6 Luna, כך שלממד הזה יש צד אחד — אבל זה סוג הנתון שמשנה אם עומס העבודה שלך נוגע בכלי אבטחה, והעדרו במודל הזול יותר הוא מידע ולא פער שיש למלא בהנחה.

השהיה, כאשר השניים אינם קרובים ואינם באותו כיוון

נתוני ההשהיה הבלתי־תלויים של Grok 4.6 הם 38.63 שניות עד לאסימון הראשון ו־47.31 שניות מקצה לקצה במאמץ גבוה. זהו נתון עבור מודל שעורך חשיבה רצינית לפני שהוא מדבר, והוא אינו מתיישב עם אדם שצופה בסמן. הרישום שלנו עבור המודל מתעד p50 של זמן עד לאסימון הראשון של 6.71 שניות ו־p95 של 10.00 שניות על פני חלון של שבעה ימים, שמודד נקודה אחרת בתגובה ואינו בר־השוואה לנתון הבלתי־תלוי — שני המספרים אינם חלוקים בדעה, הם עונים על שאלות שונות.

GPT-6 Luna פועל בקצב של 153.9 אסימוני פלט לשנייה, ומחזיר את האסימון הראשון שלו מהר מספיק כדי לשבת מאחורי משטח אינטראקטיבי. התפוקה שלו גבוהה כמעט פי שלושה מזו של Grok 4.6 במאמץ גבוה. עבור עבודת אצווה, ההבדל הזה הוא נוחות של זמן שעון. עבור כל דבר שמשתמש ממתין לו, זה ההבדל בין מוצר לבין אב-טיפוס.

השילוב יוצא דופן וראוי לנקוב בשמו במפורש: המודל הזול הוא המהיר, המודל היקר הוא האיטי, והמודל היקר מקדים בשבע נקודות בציון המשולב במאמץ תואם. זהו הפרופיל של מודל שנבנה לחשוב לעומק פעם אחת, ושל מודל שנבנה להשיב במהירות פעמים רבות מאוד. אם עומס העבודה שלך הוא קריאה אחת לכל משימה, זמן התגובה של Grok 4.6 הוא סביר. אם הוא אלף קריאות לכל משימה, הוא אינו סביר.

מה שאתה בעצם קונה בצד של xAI

Grok 4.6 עולה בערך פי עשרים ושישה לכל משימה שהושלמה בהשוואה ל-GPT-6 Luna, והוא מקדים בשבע נקודות מדד במאמץ תואם. זהו יחס המרה גרוע לעומס עבודה כללי, והוא סביר לסוג ספציפי של עבודה.

שלושה דברים מצדיקים זאת. ציון הסייבר של 57 הוא יכולת ש-GPT-6 Luna אינה מפרסמת לה מקבילה. ריצת האינדקס של 94 מיליון טוקנים לעומת 150 מיליון של Luna היא יתרון תמציתיות אמיתי בכל משימה שבה הפלט נצרך על ידי אדם ולא על ידי מפרסר. והמודל נמצא בייצור מאז 12 באוגוסט, שישה שבועות יותר מש� GPT-6 Luna קיימת בכלל — וזה לא מדד, אבל זה רקורד, ועבור צוות שכבר בנה מולו, עלות ההגירה של עזיבה היא חלק ממחיר העזיבה.

לעומת זאת, הטיעון של GPT-6 Luna אינו בעיקרו התעריף הנמוך פי עשרים. הוא הסף של 272,000 טוקנים בתוך חלון של מיליון טוקנים, היכולת לקבל הוראה לעצור לחלוטין את החשיבה, תעריף קלט במטמון של סנט אחד למיליון, ונתון תפוקה שהופך אותו לשמיש כרכיב ולא כנקודת קצה. אלה מאפיינים מבניים של השכבה הזולה, ושום כמות של יתרון במדד בצד השני לא מחליפה אותם.

הרצת אחד מהם, או את שניהם

Grok 4.6 זמין ב-OrcaRouter במחיר המחירון של xAI, במסגרת תמחור עבר-דרך שמעביר שינוי בתעריף הספק לצד שלנו באותו יום, במקום להמתין לכך שמפיץ ינהל משא ומתן מחדש. מעבר אוטומטי בין שרתים (failover) הוא החלק שמצדיק את מקומו במיוחד עבור המודל הזה: חלון של 500,000 טוקנים עם צוק של 200,000 טוקנים הוא עומס עבודה שבו בקשה מדי פעם נופלת על הצד הלא נכון של הקו, ונתיב שעובר בין ספקי במעלה הזרם בלי פריסה (deployment) שווה יותר משבריר של סנט לטוקן.

GPT-6 Luna אינו בקטלוג שלנו נכון לכתיבת שורות אלו, ואליו מגיעים דרך ה-API של OpenAI עצמה. לכן צוות שרוצה את שניהם מריץ מפתח אחד עבור Grok 4.6 לצד מה שהוא כבר משתמש בו עבור OpenAI. ה-DSL לניתוב הוא הרכיב שמתאים לזיווג הזה: כלל ששולח פרומפטים מעל סף טוקנים למודל שהם עוברים את הצוק שלו, וכל מה שמתחתיו למודל שמחירו הוא חלק שתים עשרה מהמחיר, ניתן לבטא אותו כקונפיגורציה ולא כענף באפליקציה שלך — מה שמשנה כשהספים קרובים כל כך לגדלים נפוצים של פרומפטים כמו שני אלה.

Screenshot of OpenAI's developer documentation page for GPT-6 Luna, showing the model selector, the description 'Our most efficient model for focused, high-volume tasks', reasoning set to High, speed Fast, price $0.1 · $0.5, text and image input with text output, a 1,050,000-token context window, 128,000 maximum output tokens, a May 18, 2026 knowledge cutoff, and pricing cards of $0.10 input, $0.01 cached input, $0.125 cache writes and $0.50 output per 1M tokens.

איזה מהם, ומתי

קח את GPT-6 Luna אם עומס העבודה שלך הוא בנפח גבוה, נצרך על ידי תוכנית וקצר. סיווג, חילוץ, ניתוב, סיכום בכמות גדולה, הלולאה הפנימית של סוכן. במחיר $0.10/$0.50 עם קריאה ממטמון בסנט אחד, לעומת מודל שעלותו למשימה שהושלמה גבוהה פי עשרים ושישה תמורת שבע נקודות במדד במאמץ מותאם, החשבון לא מתקרב. הגדר את פרמטר המאמץ במפורש — ברירת המחדל היא medium והמספר 37 בכותרות הוא מספר של מאמץ מקסימלי — ושמור על הקריאות הארוכות שלך מתחת ל-272,000 טוקנים.

קח את Grok 4.6 אם אתה זקוק ליכולת הסייבר, אם הפלט שלך נקרא על ידי אדם והתמציתיות שלו שווה את התשלום, או אם יש לך עומס עבודה של 300,000 עד 500,000 טוקנים ש-GPT-6 Luna יכול לשרת אבל שבו אתה מעדיף לא להיות הצוות הראשון שמגלה כיצד הוא מתנהג באורך הזה. הקצה במפורש תקציב לצוק של 200,000 טוקנים, ואל תשים אותו מאחורי משטח אינטראקטיבי במאמץ גבוה — 38 שניות עד הטוקן הראשון זה לא נתון השהיה, זה הצהרה על מה שהמודל נועד לו.

הטעות שההשוואה הזו מזמינה היא להתייחס לשיעור של פי עשרים כאל ההחלטה. עבור צורת עומס אחת, הוא הגורם המכריע. עבור האחרת, ההחלטה מתקבלת ב-200,000 ו-272,000 טוקנים, ויחס המחירים הוא פרט שקוראים בדיעבד.

Screenshot of the OrcaRouter model page for Grok 4.6 showing the xAI vendor label, list pricing of $2.00 input and $6.00 output per 1M tokens, a 500,000-token context window, recorded latency statistics, an uptime chart, and the provider routing section.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית