כרטיס כותרת עם הכיתוב „Grok 4.7 vs Gemini 3.1 Pro” וכתובית המשנה „לוח הדירוג זז; המודל לא”, ושלושה כרטיסים: AA Index v4.3.2 46 מול 30, מחיר סטנדרטי לכל 1M $2/$6 מול $2/$12, וסטטוס GA מול preview.
Guides & Insights

Grok 4.7 מול Gemini 3.1 Pro: לוח הדירוג זז, המודל לא

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ב-19 בפברואר 2026, פרסמה Artificial Analysis מאמר בכותרת "Gemini 3.1 Pro Preview: המוביל החדש ב-AI." הוא הוביל בשישה מתוך עשרה מבחנים והיה בפער של ארבע נקודות מ-Claude Opus 4.6. קראו היום את העמוד של אותו מודל, והמספר הוא 30, במקום השישים ותשעה מתוך 200. הספק לא שינה דבר. מה שהשתנה הוא הסרגל: Artificial Analysis עדכנה את ה-Intelligence Index שלה ל-v4.3.2 ב-19 בספטמבר 2026, וחישבה מחדש ציון לכל מודל בקטלוג לפי מערך הערכה שונה, ומוביל מפברואר הפך לשחקן מרכז שדה בספטמבר בעוד המודל עצמו נותר ללא שינוי במצב Preview. זה הרקע להשוואה מול Grok 4.7 — שהושק על ידי הספק ב-21 בספטמבר 2026 — וזו הסיבה שהעימות הזה עוסק פחות בשאלה איזה מודל חכם יותר ויותר בשאלה על איזה משני אלה אפשר עוד לסמוך שיהיה אותו הדבר בחודש הבא.

מה כל אחד מאלה באמת

Gemini 3.1 Pro הוא המודל החדש ביותר של גוגל ברמת Pro, והוא מעולם לא הגיע לזמינות כללית. הוא שוחרר בתור gemini-3.1-pro-preview ב-19 בפברואר 2026, וטבלת ההתיישנות של גוגל עדיין מפרטת אותו עם "לא הוכרז תאריך כיבוי" — תצוגה מקדימה שנמצאת כעת בתצוגה מקדימה כבר שבעה חודשים, בזמן שגוגל שחררה סולם Flash מתחתיה: 3.5 Flash במאי, 3.6 ביולי, 3.7 באוגוסט, 3.8 בספטמבר. אין מודל Pro ב-GA חדש יותר מ-Gemini 3 Pro. הוא כולל חלון קלט של 1,048,576 טוקנים ותקרת פלט של 65,536 טוקנים, קולט טקסט, תמונות, וידאו, אודיו ו-PDF ומפיק טקסט, וחושף בקרת רמת חשיבה בנמוכה, בינונית וגבוהה, ללא פרמטר תקציב וללא הגדרה מינימלית. המשקולות סגורות.

Grok 4.7 הוא בן יום וגם בעל משקלים סגורים. יש לו חלון הקשר של 500 אלף טוקנים — מחצית מזה של Gemini — והוא מקבל טקסט ותמונות כקלט, ולכן אינו יכול לקלוט וידאו או אודיו כלל, וזהו ההבדל החד ביותר ביכולות בהשוואה הזו. מחירו הרשום הוא 2.00 דולר למיליון טוקני קלט ו-6.00 דולר למיליון טוקני פלט מתחת ל-200 אלף טוקני פרומפט, בעוד שמעל לקו זה הוא עולה ל-4.00 ול-12.00 דולר, עם קריאות מטמון ב-0.50 ו-1.00 דולר; xAI גם מציינת גרסה מהירה יותר בקצב פלט כפול בקירוב ובמחיר כפול. לא פורסם עבורו נתון פלט מקסימלי בתיעוד שנבדק כאן.

הסרגל זז. זה הסיפור.

שני המודלים נמדדים כעת לפי Artificial Analysis Intelligence Index v4.3.2, שהחליף את Terminal-Bench 2.1 ב-Terminal-Bench 4.0 ואת tau3-Banking ב-AutomationBench-AA, ועיגן מחדש את סולם ה-Elo של GDPval-AA. המספר של כל מודל זז כשהוא הושק. המספר של Gemini 3.1 Pro זז יותר משל רוב האחרים, מפני שהחוזקות שלו מפברואר התרכזו בהערכות שהאינדקס החדש או הוציא משימוש או שינה את משקלן. בקריאת שתי העמודות זו לצד זו היום:

משולב — Grok 4.7 (xhigh): 46 במדד Artificial Analysis Intelligence Index v4.3.2. Gemini 3.1 Pro Preview: 30 באותה גרסה, מדורגת במקום ה-69 מתוך 200.

הקשר ארוך — Grok 4.7: חלון של 500 אלף, AA-LCR v1.1 ‎77%. Gemini 3.1 Pro: חלון של מיליון — כפול בגודלו — ותקרת פלט של 65 אלף, שהם בערך חצי ממה שסשן סוכני בהקשר ארוך בדרך כלל צריך.

מודאליות קלט — Grok 4.7: טקסט ותמונה. Gemini 3.1 Pro: טקסט, תמונה, וידאו, אודיו ו-PDF. לא קרוב, וזה לא פער במבחני ביצועים — זה פער ביכולות.

מהירות — Grok 4.7: אין עדיין מדידה שפורסמה. Gemini 3.1 Pro: 124.4 אסימוני פלט לשנייה, מדורג במקום ה-39 מתוך 200, עם זמן של 63.62 שניות עד לאסימון הראשון דרך Google AI Studio.

מחיר, שכבה סטנדרטית — Grok 4.7: ‏$2.00 קלט / ‏$6.00 פלט למיליון. Gemini 3.1 Pro: ‏$2.00 קלט / ‏$12.00 פלט. קלט זהה, פלט כפול.

מחיר, שכבת הקשר ארוך — Grok 4.7: מכפיל את עצמו ל-$4.00 / $12.00 ב-200 אלף טוקני פרומפט. Gemini 3.1 Pro: עולה ל-$4.00 / $18.00 באותו גבול של 200 אלף. אותו קלט, 50% יותר פלט.

בגרות — Grok 4.7: בן יום אחד, ומדדי הביצועים של הספק לא שוחזרו ברובם. Gemini 3.1 Pro: שבעה חודשים בשוק, אך עדיין גרסת תצוגה מקדימה ללא התחייבות ל-GA וללא תאריך סגירה.

OrcaRouter model page for Gemini 3.1 Pro Preview showing the google/gemini-3.1-pro-preview identifier, a 1M-token context window, a 65K maximum output, audio, file, image, text and video input with text output, and list rates of $2.00 per 1M input and $12.00 per 1M output.

בעיית התצוגה המקדימה היא כעת בעיה אמיתית

תצוגה מקדימה בת שבעה חודשים הייתה מוזרות ולא סיכון אילו דבר לא השתבש בה. משהו השתבש. החל מ-18 בספטמבר 2026 החלו משתמשים לדווח ש-Gemini 3.1 Pro נעלם מבורר המודלים של AI Studio, ולעת כתיבת שורות אלה לא הייתה תגובה מצוות Google, לא הודעת הוצאה משימוש ולא סיבה מוצהרת — אירוע זמינות לא פתור ולא פרישה מאושרת. הציבו זאת לצד היסטוריית ההכרזות: Google אמרה ב-I/O במאי 2026 ש-Gemini 3.5 Pro "ייפרס בחודש הבא", ודיווחים בעיתונות בסוף אוגוסט אמרו שהמודל הזה בוטל משום שמועמדים פנימיים "לא היו טובים מספיק בהשוואה לסדרת Flash". עמוד ה-Pro של Google עצמה עדיין מפרסם "3.5 Pro בקרוב", וזו הסתירה במסך אחד. יהא הפתרון אשר יהא, המשמעות המעשית היא ש-Gemini 3.1 Pro הוא נקודת קצה של תצוגה מקדימה בלי תאריך GA, בלי יורש בשם, ועם סימן שאלה בזמינות נכון לעכשיו.

הסיכון של Grok 4.7 הוא תמונת הראי, והוא קטן יותר מטבעו. הוא בן יום אחד בלבד, ולכן המספרים שלו דלים — Artificial Analysis לא פרסמה שום מדידת מהירות או השהיה, ומערך הבנצ'מרקים של xAI עצמה עבורו לא שוחזר באופן בלתי תלוי. מה שאינו מוטל בספק הוא שהמודל זמין לשימוש כללי, מתומחר, מתועד ויציב בזהותו. מודל שזהותו יציבה ומספריו אינם מוכחים הוא דבר הרבה יותר קל לבנות עליו מאשר מודל שמספריו פורסמו וזמינותו לא.

מה הפיצול עולה בפועל

נניח שאתה בוחר עבור צינור עיבוד מסמכים. עבור 100 אלף טוקנים בקלט ו-8 אלף בפלט, Grok 4.7 עולה $0.20 בקלט ו-$0.048 בפלט — בערך רבע. Gemini 3.1 Pro עולה $0.20 בקלט ו-$0.096 בפלט — בערך שלושים סנט.השניים נמצאים בטווח של עשרים אחוז זה מזה, ואם המסמכים שלך הם סריקות, PDF, אודיו או וידאו, Gemini הוא היחיד מבין השניים שיכול לקרוא אותם בכלל. זה לא טיעון של בנצ'מרק; זה מסיים את ההשוואה עבור עומס העבודה הזה.

כעת נניח שאתה בוחר עבור סוכן עם הקשר ארוך. בקלט של 300k ובפלט של 8k, Grok 4.7 עולה $1.20 בקלט ו-$0.096 בפלט, כ-$1.30. Gemini 3.1 Pro עולה $1.20 בקלט ו-$0.144 בפלט, כ-$1.35. למעשה זהים — וכאן חלון ה-1M ותקרת הפלט של 65K של Gemini הופכים לאילוץ שמכריע את הכף, כי תקרה של 65K היא הנקודה שבה ריצות סוכניות ארוכות קורסות. אף אחד מהמודלים אינו האפשרות הזולה בהתמודדות הזו, ואף אחד מהם אינו יקר לפי הסטנדרטים של מודלי החזית.

Two-column scoreboard titled “Grok 4.7 vs Gemini 3.1 Pro - the scoreboard”: AA Index 46 vs 30, context 500k vs 1M, input modality “text + image” vs “text + image + video + audio + PDF”, max output “not stated” vs 65k, price per 1M $2/$6 vs $2/$12, and status GA vs preview.

ניתוב סביב מטרה נעה

OrcaRouter כולל את Gemini 3.1 Pro, הרשום בעמוד הדגם הייעודי לו בתעריפי הספק — 2.00$ לקלט ו-12.00$ לפלט, עם חלון של 1M ופלט מרבי של 65k — משום שאנחנו מעבירים את מחירי המחירון של הספק ללא תוספת, במרווח של 0%. זה אינו מסר שיווקי במקרה כזה: ל-Google יש גרסת תצוגה מקדימה שתקופת התמחור שלה טרם הוגדרה, ושזמינותה התנדנדה בספטמבר, והדבר המועיל שראוטר עושה הוא לשמור על יציבות האינטגרציה בזמן שהדבר שמאחוריה משתנה. מעבר אוטומטי בעת כשל משמעו שנקודת קצה בתצוגה מקדימה שמפסיקה להשיב הופכת לאירוע ניתוב ולא להשבתה, וה-DSL לניתוב מאפשר לך להרכיב מודל מולטימודלי עם מודל טקסטואלי בלבד בקריאה אחת — וזה בדיוק המבנה שהצמד הזה מרמז עליו, Gemini קורא את הווידאו ו-Grok מבצע את החשיבה על התמלול שלו. Grok 4.7 אינו נמצא בקטלוג של OrcaRouter נכון לכתיבת שורות אלה; לקרוא לו היום משמעו לעבור דרך ה-API של xAI עצמה והפלטפורמות של צד שלישי שנושאות אותו.

התבנית ששווה לבנות: להשאיר את Gemini 3.1 Pro לכל דבר שצריך לקלוט וידאו, אודיו או PDF, ולהתייחס לסטטוס ה-Preview שלו כאל סיכון תפעולי שיש לעקוף ולא כאל סיבה להימנע ממנו. להציב את Grok 4.7 על עבודת טקסט ותמונה, במקומות שבהם מחיר הפלט הנמוך יותר והציון המשולב הגבוה יותר שלו תקפים, ובמקומות שבהם המודל שאתם משלבים היום הוא המודל שתמשיכו לקרוא לו גם בעוד חצי שנה. הדבר האחד שאסור לעשות הוא לקרוא את הדירוג במקום ה-69 כפסק דין על המודל — הוא פסק דין על עדכון בנצ'מרק, ואותו עדכון שהוריד את Gemini 3.1 Pro הוריד גם עשרות מודלים שמעולם לא נגעה בהם Google.

השיחה

במדד הנוכחי, Grok 4.7 מוביל על Gemini 3.1 Pro בשש עשרה נקודות, ובמחיר הפלט הוא חצי מהעלות במסלול הסטנדרטי וזול בשליש במסלול ההקשר הארוך. אם עומס העבודה שלך הוא טקסט ותמונות, זה מספיק כדי להכריע. אם עומס העבודה שלך הוא וידאו, אודיו או מסמכים סרוקים, Gemini 3.1 Pro הוא המועמד היחיד מבין השניים וההשוואה נגמרת שם — אתה קונה יכולת, לא ציון. ההסתייגות שצריכה ללוות את שניהם נוגעת למקור ולא לביצועים: האחד הוא תצוגה מקדימה בת שבעה חודשים ללא תאריך GA ומאחוריו תקרית זמינות מספטמבר, והשני בן יום עם מספר כותרתי וללא שחזור עצמאי של שום דבר אחר. אף אחד מהם אינו בחירה מוגמרת. את שניהם כדאי לנתב ולא להתחייב להם.

Artificial Analysis page for Grok 4.7 at xhigh reasoning effort: an Artificial Analysis Intelligence Index score of 46, ranked #16 of 655; Speed and Cost both reported as N/A; 240M output tokens from the Intelligence Index run, ranked #140 of 655; a 500k-token context window with text and image input and text output; and comparison charts for intelligence, speed and cost per task.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית