
Grok 4.7 מול Gemini 3.1 Pro: לוח הדירוג זז, המודל לא
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
ב-19 בפברואר 2026, פרסמה Artificial Analysis מאמר בכותרת "Gemini 3.1 Pro Preview: המוביל החדש ב-AI." הוא הוביל בשישה מתוך עשרה מבחנים והיה בפער של ארבע נקודות מ-Claude Opus 4.6. קראו היום את העמוד של אותו מודל, והמספר הוא 30, במקום השישים ותשעה מתוך 200. הספק לא שינה דבר. מה שהשתנה הוא הסרגל: Artificial Analysis עדכנה את ה-Intelligence Index שלה ל-v4.3.2 ב-19 בספטמבר 2026, וחישבה מחדש ציון לכל מודל בקטלוג לפי מערך הערכה שונה, ומוביל מפברואר הפך לשחקן מרכז שדה בספטמבר בעוד המודל עצמו נותר ללא שינוי במצב Preview. זה הרקע להשוואה מול Grok 4.7 — שהושק על ידי הספק ב-21 בספטמבר 2026 — וזו הסיבה שהעימות הזה עוסק פחות בשאלה איזה מודל חכם יותר ויותר בשאלה על איזה משני אלה אפשר עוד לסמוך שיהיה אותו הדבר בחודש הבא.
מה כל אחד מאלה באמת
Gemini 3.1 Pro הוא המודל החדש ביותר של גוגל ברמת Pro, והוא מעולם לא הגיע לזמינות כללית. הוא שוחרר בתור gemini-3.1-pro-preview ב-19 בפברואר 2026, וטבלת ההתיישנות של גוגל עדיין מפרטת אותו עם "לא הוכרז תאריך כיבוי" — תצוגה מקדימה שנמצאת כעת בתצוגה מקדימה כבר שבעה חודשים, בזמן שגוגל שחררה סולם Flash מתחתיה: 3.5 Flash במאי, 3.6 ביולי, 3.7 באוגוסט, 3.8 בספטמבר. אין מודל Pro ב-GA חדש יותר מ-Gemini 3 Pro. הוא כולל חלון קלט של 1,048,576 טוקנים ותקרת פלט של 65,536 טוקנים, קולט טקסט, תמונות, וידאו, אודיו ו-PDF ומפיק טקסט, וחושף בקרת רמת חשיבה בנמוכה, בינונית וגבוהה, ללא פרמטר תקציב וללא הגדרה מינימלית. המשקולות סגורות.
Grok 4.7 הוא בן יום וגם בעל משקלים סגורים. יש לו חלון הקשר של 500 אלף טוקנים — מחצית מזה של Gemini — והוא מקבל טקסט ותמונות כקלט, ולכן אינו יכול לקלוט וידאו או אודיו כלל, וזהו ההבדל החד ביותר ביכולות בהשוואה הזו. מחירו הרשום הוא 2.00 דולר למיליון טוקני קלט ו-6.00 דולר למיליון טוקני פלט מתחת ל-200 אלף טוקני פרומפט, בעוד שמעל לקו זה הוא עולה ל-4.00 ול-12.00 דולר, עם קריאות מטמון ב-0.50 ו-1.00 דולר; xAI גם מציינת גרסה מהירה יותר בקצב פלט כפול בקירוב ובמחיר כפול. לא פורסם עבורו נתון פלט מקסימלי בתיעוד שנבדק כאן.
הסרגל זז. זה הסיפור.
שני המודלים נמדדים כעת לפי Artificial Analysis Intelligence Index v4.3.2, שהחליף את Terminal-Bench 2.1 ב-Terminal-Bench 4.0 ואת tau3-Banking ב-AutomationBench-AA, ועיגן מחדש את סולם ה-Elo של GDPval-AA. המספר של כל מודל זז כשהוא הושק. המספר של Gemini 3.1 Pro זז יותר משל רוב האחרים, מפני שהחוזקות שלו מפברואר התרכזו בהערכות שהאינדקס החדש או הוציא משימוש או שינה את משקלן. בקריאת שתי העמודות זו לצד זו היום:
• משולב — Grok 4.7 (xhigh): 46 במדד Artificial Analysis Intelligence Index v4.3.2. Gemini 3.1 Pro Preview: 30 באותה גרסה, מדורגת במקום ה-69 מתוך 200.
• הקשר ארוך — Grok 4.7: חלון של 500 אלף, AA-LCR v1.1 77%. Gemini 3.1 Pro: חלון של מיליון — כפול בגודלו — ותקרת פלט של 65 אלף, שהם בערך חצי ממה שסשן סוכני בהקשר ארוך בדרך כלל צריך.
• מודאליות קלט — Grok 4.7: טקסט ותמונה. Gemini 3.1 Pro: טקסט, תמונה, וידאו, אודיו ו-PDF. לא קרוב, וזה לא פער במבחני ביצועים — זה פער ביכולות.
• מהירות — Grok 4.7: אין עדיין מדידה שפורסמה. Gemini 3.1 Pro: 124.4 אסימוני פלט לשנייה, מדורג במקום ה-39 מתוך 200, עם זמן של 63.62 שניות עד לאסימון הראשון דרך Google AI Studio.
• מחיר, שכבה סטנדרטית — Grok 4.7: $2.00 קלט / $6.00 פלט למיליון. Gemini 3.1 Pro: $2.00 קלט / $12.00 פלט. קלט זהה, פלט כפול.
• מחיר, שכבת הקשר ארוך — Grok 4.7: מכפיל את עצמו ל-$4.00 / $12.00 ב-200 אלף טוקני פרומפט. Gemini 3.1 Pro: עולה ל-$4.00 / $18.00 באותו גבול של 200 אלף. אותו קלט, 50% יותר פלט.
• בגרות — Grok 4.7: בן יום אחד, ומדדי הביצועים של הספק לא שוחזרו ברובם. Gemini 3.1 Pro: שבעה חודשים בשוק, אך עדיין גרסת תצוגה מקדימה ללא התחייבות ל-GA וללא תאריך סגירה.

בעיית התצוגה המקדימה היא כעת בעיה אמיתית
תצוגה מקדימה בת שבעה חודשים הייתה מוזרות ולא סיכון אילו דבר לא השתבש בה. משהו השתבש. החל מ-18 בספטמבר 2026 החלו משתמשים לדווח ש-Gemini 3.1 Pro נעלם מבורר המודלים של AI Studio, ולעת כתיבת שורות אלה לא הייתה תגובה מצוות Google, לא הודעת הוצאה משימוש ולא סיבה מוצהרת — אירוע זמינות לא פתור ולא פרישה מאושרת. הציבו זאת לצד היסטוריית ההכרזות: Google אמרה ב-I/O במאי 2026 ש-Gemini 3.5 Pro "ייפרס בחודש הבא", ודיווחים בעיתונות בסוף אוגוסט אמרו שהמודל הזה בוטל משום שמועמדים פנימיים "לא היו טובים מספיק בהשוואה לסדרת Flash". עמוד ה-Pro של Google עצמה עדיין מפרסם "3.5 Pro בקרוב", וזו הסתירה במסך אחד. יהא הפתרון אשר יהא, המשמעות המעשית היא ש-Gemini 3.1 Pro הוא נקודת קצה של תצוגה מקדימה בלי תאריך GA, בלי יורש בשם, ועם סימן שאלה בזמינות נכון לעכשיו.
הסיכון של Grok 4.7 הוא תמונת הראי, והוא קטן יותר מטבעו. הוא בן יום אחד בלבד, ולכן המספרים שלו דלים — Artificial Analysis לא פרסמה שום מדידת מהירות או השהיה, ומערך הבנצ'מרקים של xAI עצמה עבורו לא שוחזר באופן בלתי תלוי. מה שאינו מוטל בספק הוא שהמודל זמין לשימוש כללי, מתומחר, מתועד ויציב בזהותו. מודל שזהותו יציבה ומספריו אינם מוכחים הוא דבר הרבה יותר קל לבנות עליו מאשר מודל שמספריו פורסמו וזמינותו לא.
מה הפיצול עולה בפועל
נניח שאתה בוחר עבור צינור עיבוד מסמכים. עבור 100 אלף טוקנים בקלט ו-8 אלף בפלט, Grok 4.7 עולה $0.20 בקלט ו-$0.048 בפלט — בערך רבע. Gemini 3.1 Pro עולה $0.20 בקלט ו-$0.096 בפלט — בערך שלושים סנט.השניים נמצאים בטווח של עשרים אחוז זה מזה, ואם המסמכים שלך הם סריקות, PDF, אודיו או וידאו, Gemini הוא היחיד מבין השניים שיכול לקרוא אותם בכלל. זה לא טיעון של בנצ'מרק; זה מסיים את ההשוואה עבור עומס העבודה הזה.
כעת נניח שאתה בוחר עבור סוכן עם הקשר ארוך. בקלט של 300k ובפלט של 8k, Grok 4.7 עולה $1.20 בקלט ו-$0.096 בפלט, כ-$1.30. Gemini 3.1 Pro עולה $1.20 בקלט ו-$0.144 בפלט, כ-$1.35. למעשה זהים — וכאן חלון ה-1M ותקרת הפלט של 65K של Gemini הופכים לאילוץ שמכריע את הכף, כי תקרה של 65K היא הנקודה שבה ריצות סוכניות ארוכות קורסות. אף אחד מהמודלים אינו האפשרות הזולה בהתמודדות הזו, ואף אחד מהם אינו יקר לפי הסטנדרטים של מודלי החזית.

ניתוב סביב מטרה נעה
OrcaRouter כולל את Gemini 3.1 Pro, הרשום בעמוד הדגם הייעודי לו בתעריפי הספק — 2.00$ לקלט ו-12.00$ לפלט, עם חלון של 1M ופלט מרבי של 65k — משום שאנחנו מעבירים את מחירי המחירון של הספק ללא תוספת, במרווח של 0%. זה אינו מסר שיווקי במקרה כזה: ל-Google יש גרסת תצוגה מקדימה שתקופת התמחור שלה טרם הוגדרה, ושזמינותה התנדנדה בספטמבר, והדבר המועיל שראוטר עושה הוא לשמור על יציבות האינטגרציה בזמן שהדבר שמאחוריה משתנה. מעבר אוטומטי בעת כשל משמעו שנקודת קצה בתצוגה מקדימה שמפסיקה להשיב הופכת לאירוע ניתוב ולא להשבתה, וה-DSL לניתוב מאפשר לך להרכיב מודל מולטימודלי עם מודל טקסטואלי בלבד בקריאה אחת — וזה בדיוק המבנה שהצמד הזה מרמז עליו, Gemini קורא את הווידאו ו-Grok מבצע את החשיבה על התמלול שלו. Grok 4.7 אינו נמצא בקטלוג של OrcaRouter נכון לכתיבת שורות אלה; לקרוא לו היום משמעו לעבור דרך ה-API של xAI עצמה והפלטפורמות של צד שלישי שנושאות אותו.
התבנית ששווה לבנות: להשאיר את Gemini 3.1 Pro לכל דבר שצריך לקלוט וידאו, אודיו או PDF, ולהתייחס לסטטוס ה-Preview שלו כאל סיכון תפעולי שיש לעקוף ולא כאל סיבה להימנע ממנו. להציב את Grok 4.7 על עבודת טקסט ותמונה, במקומות שבהם מחיר הפלט הנמוך יותר והציון המשולב הגבוה יותר שלו תקפים, ובמקומות שבהם המודל שאתם משלבים היום הוא המודל שתמשיכו לקרוא לו גם בעוד חצי שנה. הדבר האחד שאסור לעשות הוא לקרוא את הדירוג במקום ה-69 כפסק דין על המודל — הוא פסק דין על עדכון בנצ'מרק, ואותו עדכון שהוריד את Gemini 3.1 Pro הוריד גם עשרות מודלים שמעולם לא נגעה בהם Google.
השיחה
במדד הנוכחי, Grok 4.7 מוביל על Gemini 3.1 Pro בשש עשרה נקודות, ובמחיר הפלט הוא חצי מהעלות במסלול הסטנדרטי וזול בשליש במסלול ההקשר הארוך. אם עומס העבודה שלך הוא טקסט ותמונות, זה מספיק כדי להכריע. אם עומס העבודה שלך הוא וידאו, אודיו או מסמכים סרוקים, Gemini 3.1 Pro הוא המועמד היחיד מבין השניים וההשוואה נגמרת שם — אתה קונה יכולת, לא ציון. ההסתייגות שצריכה ללוות את שניהם נוגעת למקור ולא לביצועים: האחד הוא תצוגה מקדימה בת שבעה חודשים ללא תאריך GA ומאחוריו תקרית זמינות מספטמבר, והשני בן יום עם מספר כותרתי וללא שחזור עצמאי של שום דבר אחר. אף אחד מהם אינו בחירה מוגמרת. את שניהם כדאי לנתב ולא להתחייב להם.

השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
