
Gemini 3.7 Flash נגד Grok 4.6: מלחמת המחירים של Google מול סוכן הבדיקה העצמית של SpaceXAI
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0259אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0258אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0166אינטליגנציה82כתיבת קוד
- AlibabaחדשQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiחדשZ.ai: GLM 5.3 Flash2026-08-2658אינטליגנציה72כתיבת קוד
- DeepSeekחדשDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1860אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1552אינטליגנציה68כתיבת קוד
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1261אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
שלושה שבועות אחרי ש־Gemini 3.6 Flash נכשל במידה רבה, Google הורידה את המחיר בחצי והוציאה את Gemini 3.7 Flash — מהלך שרוב הסיקור פירש כירייה ישירה לעבר Grok 4.6, ספינת הדגל המכווננת לסוכנים ש־SpaceXAI שחררה יום קודם במחיר של $2 ו־$6. התזמון הוא הסיפור: שני מודלים הקרובים לחזית, בהפרש של יום אחד, שניהם מכוונים לאותו קונה — צוות שרוצה קידוד סוכני בלי לשלם מחירי חזית — ומתומחרים בפילוסופיות הפוכות. Google קונה את התגובה עם מבצע לחמישה חודשים. SpaceXAI מוכרת אמון לכל משימה במחיר מחירון קבוע.
Grok 4.6, ששוחרר ב-12 באוגוסט 2026, הוא העידון של SpaceXAI לתשתית Grok 4.5 בעלת 1.5 טריליון פרמטרים, שנבנה עבור סוכנים ארוכי-טווח המאמתים השלמת משימות משנה בעצמם, עם חלון הקשר של 500K, קלט טקסט ותמונה, ותעריף של $2/$6 שמוכפל ב-200K+ אסימוני קלט. Gemini 3.7 Flash, ששוחרר ב-13 באוגוסט 2026, הוא העידון האלגוריתמי של Google ל-Gemini 3.6 Flash — הקשר של 1M, קלט מולטי-מודאלי כולל וידאו ואודיו, ותעריף מבצעי של $0.75/$3.75 שמוכפל ל-$1.50/$7.50 ב-1 בינואר 2027. במדד העצמאי Artificial Analysis Intelligence, Grok 4.6 עומד על 61, צעד ברור מעל לקריאות המוקדמות של כ-56 עבור Gemini 3.7 Flash.
מלחמת המחירים, שורה אחת לכל ממד
• מחיר ל-1M קלט — Gemini 3.7 Flash $0.75 (מחיר היכרות) לעומת Grok 4.6 $2.00. Google זולה ביותר מ-60%.
• מחיר למיליון פלט — Gemini 3.7 Flash $3.75 (השקה) לעומת Grok 4.6 $6.00.
• אחרי 1 בינואר 2027 — Gemini מכפיל ל-$1.50/$7.50 לעומת Grok ללא שינוי ב-$2/$6.
• חלון הקשר — Gemini 3.7 Flash 1M לעומת Grok 4.6 500K.
• חיוב עבור קלט ארוך — Gemini גובה תעריף קבוע לאורך כל החלון שלו; Grok מכפיל ל-$4/$12 בקלט של 200K ומעלה.
• אסימוני חשיבה — Gemini מחייבת עליהם כפלט; העלות של Grok כלולה במדידה עצמאית של כ-$0.84 למשימה.
בשורה אחת: Gemini 3.7 Flash זול יותר בכל שורה במחירון היום, ורוב היתרון הזה מתאדה ב-1 בינואר. Grok 4.6 הוא באותו מחיר באוגוסט כמו שיהיה במרץ.

לאן הלך הכסף של Gemini 3.7 Flash
Google עצמה מדווחת על קפיצות גדולות עבור Gemini 3.7 Flash לעומת 3.6 Flash: 65.3% ב-DeepSWE v1.1 (לעומת 49.0%), 43.6% ב-FrontierCode 1.1 Main (לעומת 34.4%), 85.8% ב-Terminal-bench 2.1 (לעומת 78.0%), ו-Elo של 1588 ב-WebDev Arena (לעומת 1538). אלה נתונים המדווחים על ידי הספק, שלא שוחזרו — סוג של מדד שמודד מגמה, לא פסק דין בין ספקים. אבל המגמה היא הנקודה: התיקונים הגיעו שלושה שבועות לאחר השקה שמבקרים ברובם כבר כתבו אותה ככישלון, וזה אומר לך ש-Google רואה בשכבת ה-Flash את שדה הקרב, לא את הדגל.
הדבר הנוסף שהמבצע של Google עושה הוא לכווץ את חלון הרכישה. במחיר של $0.75/$3.75 המודל זול מספיק כדי לבדוק אותו בכמות; ב-$1.50/$7.50 הוא עדיין תחרותי, אבל כבר לא נשק במלחמת מחירים. כל צוות פיתוח שמאמץ אותו בחלון ההשקה צריך לבחון מחדש את ההיבטים הכלכליים בדצמבר, ולא להניח שהמספר ינוע יחד איתם.
לאן הלך הכסף של Grok 4.6
ההצעה של Grok 4.6 שונה: לא טוקנים זולים יותר, אלא פחות טוקנים מבוזבזים. הוא אומן לבצע אימות עצמי — לבדוק שתת-משימה אכן הושלמה לפני שממשיכים הלאה — ומדידה בלתי תלויה מאשרת את האפקט: Artificial Analysis מעריכה את העלות בכ-0.84 דולר למשימה, עם ציון GDPVal-AA v2 של 1,753 ומדד אינטליגנציה של 61. אלה נתונים של צד שלישי, והם המספר החזק ביותר בקרב הזה, כי הם לוכדים את מה שמחיר לטוקן מפספס: מודל שצריך פחות שלבים כדי לסיים עבודה הוא זול יותר לכל עבודה שהושלמה, גם אם מחיר הטוקן גבוה יותר.
הפשרה היא היכן שלמודל הזול יש מקום. קונטקסט של 500K של Grok 4.6 הוא חצי מה-1M של Gemini 3.7 Flash, והתעריף של $2/$6 שלו מכפיל את עצמו מעל 200K קלט — כך שעומסי עבודה עם קונטקסט ארוך וקלט גבוה הם בדיוק המקום שבו המחיר הרשמי של Grok 4.6 מפסיק להיות תחרותי לעומת התעריף המקודם של Gemini.
כלכלת כל משימה
במחיר השקה, התעריף המשולב של Gemini 3.7 Flash בחלוקת קלט/פלט של 80/20 הוא בערך $1.35 למיליון טוקנים; תג המחיר של Grok 4.6 באותה חלוקה הוא $2.80 למיליון לפני קנס הקלט הארוך שלו. על הנייר, המודל של Google נראה כמנצח בנפח בהפרש גדול. הסיבוך הוא שטוקני החשיבה של Gemini מחויבים כפלט, טענות הבנצ'מרק שלו בנות שבוע, והיעילות שלו למשימה טרם נמדדה באופן בלתי תלוי — בעוד זו של Grok 4.6 כן. טוקנים זולים בתוספת סבבים מבוזבזים יכולים לעלות יותר מטוקנים יקרים שמסיימים את העבודה, וזו התמודדות שבה לצד אחד יש נתונים על השאלה הזו ולצד השני אין.
להמר על המודל החדש מבלי להמר על הצנרת
Grok 4.6 נמצא ב-OrcaRouter במחיר המחירון של SpaceXAI, $2/$6, עם 0% תוספת, כולל את שלב ה-2x מעל 200K, שעמוד המודל מושך בזמן אמת משכבת הניתוב. Gemini 3.7 Flash הוא בן יום אחד וזמין ב-API של Google עצמו; קודמו, Gemini 3.6 Flash, נמצא ב-OrcaRouter במחיר המחירון של Google.


אם השאלה שההשוואה הזו באמת שואלת היא "האם כדאי להמר על צינור הסוכנים שלי לטובת המודל הזול החדש," שכבת הניתוב היא הגידור: כלל failover שמריץ את הסוכן על Grok 4.6 היום ומחליף ל-Gemini 3.7 Flash ביום שהיא מגיעה, או פאנל מיזוג שבו שתי התשובות מוצגות ושופט מיישב ביניהן — סוג ההגדרה ש-DSL הניתוב קיים עבורה, וכזו שאינה דורשת בחירת צד לפני שהראיות נאספות.
הקריאה הכנה
אם אתה רוצה את הטוקן הזול ביותר היום ואתה סומך על זמני האספקה של שלושה שבועות, Gemini 3.7 Flash הוא ההימור האגרסיבי — מלחמת המחירים אמיתית, עליות הביצועים דווחו, וחלון ההשקה הוא הנחה אמיתית. אם אתה רוצה מודל שיעילות הסוכן שלו נמדדת באופן בלתי תלוי, שהמחיר שלו לא משתנה בינואר, ושהלולאת האימות העצמי שלו מתוכננת לעבודה ממושכת, Grok 4.6 הוא הבחירה השמרנית, ונתוני ה-AA מעניקים לו יתרון בעלות לכל משימה שהושלמה. צד אחד הוא מבצע עם ספירה לאחור; הצד השני הוא מחיר עם רקורד מוכח. שתי האפשרויות מוגנות — וזה בדיוק מה שהופך את זה להשוואה אמיתית, לא לפרוטוקול.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
