כרטיס כותרת עבור סרטון ההסבר של Gemini 3.1 Pro, שעליו כתוב 'Gemini 3.1 Pro' עם כותרת המשנה 'עדיין תצוגה מקדימה, כעבור שבעה חודשים', מעל ארבע תגיות מפרט שעליהן כתוב קלט של 1M טוקנים, פלט של 65K, $2 / $12 לכל 1M, והוכרז ב-19 בפברואר 2026.
Guides & Insights

מהו Gemini 3.1 Pro? מסלול ה-Pro של Google לא זז כבר שבעה חודשים

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Gemini 3.1 Pro הוא המודל הפעיל היחיד ברמת Pro במשפחה של עצמו. הוא הוכרז ב-19 בפברואר 2026, ושבעה חודשים לאחר מכן התיעוד הרשמי של הספק עדיין מסווג אותו תחת "Preview" בנקודת הקצה gemini-3.1-pro-preview — אין זמינות כללית, אין תאריך השבתה, ואף יורש לא שוחרר. באותם שבעה חודשים הספק הוציא לשוק חמישה שחרורי Flash, והחדש שבהם, Gemini 3.8 Flash, מקבל כעת ניקוד גבוה ב-11 נקודות במדד העצמאי שרוב האנשים מצטטים. הפער הזה הוא הסיבה לכך שעמוד שמסביר מהו Gemini 3.1 Pro חייב להיפתח דווקא במה שהוא אינו.

אם אתם רוצים רק את הגרסה בת שני המשפטים: Gemini 3.1 Pro הוא מודל reasoning רב-מודאלי מלידה עם משקולות סגורות, מבית Google DeepMind, שקורא טקסט, תמונות, וידאו, אודיו וקובצי PDF וכותב טקסט. אתם קוראים לו דרך ה-APIs של גוגל עצמה או דרך ראוטר שנושא אותו, הוא קולט עד 1,048,576 טוקנים של קלט, והוא עולה $2.00 למיליון טוקני קלט ו-$12.00 למיליון טוקני פלט כשהפרומפט קצר מ-200,000 טוקנים. הוא מחזיק מעמד כסוס עבודה רב-מודאלי עם חלון הקשר ארוך. הוא כבר לא המודל שאתם בוחרים בו מפני שהוא החכם ביותר שקיים.

היכן הוא ממוקם במשפחה שלו

זה החלק שרוב הסיקורים מדלגים עליו, וזה החלק שהכי חשוב. משפחת Gemini 3 אינה סולם אחד עם Pro בפסגה. אלו שני סולמות שהפסיקו להיות ברי השוואה.

סולם ה-Flash הוא זה שזז. תיעוד המודלים של Google, שנקרא ב-23 בספטמבר 2026, מפרט את Gemini 3.8 Flash, Gemini 3.8 Live ו-Gemini 3.8 Live Extended Thinking כמהדורות יציבות חדשות, בעוד ש-Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash ו-Gemini 3.5 Flash-Lite נותרו יציבים מאחוריהם. Gemini 3.8 Flash הושק ב-2 בספטמבר 2026 — המהדורה השלישית של Flash בשישה שבועות.

סולם ה-Pro הוא זה שלא התממש. אין Gemini 3.5 Pro, 3.6 Pro, 3.7 Pro או 3.8 Pro בתיעוד של Google. Gemini 3 Pro, הדגם ש-Gemini 3.1 Pro נועד להחליף, רשום כמושבת. Gemini 2.5 Pro שורד, אך הגישה אליו מוגבלת למשתמשים קודמים. זה משאיר את Gemini 3.1 Pro כנקודת הקצה היחידה ברמת Pro של Gemini 3 שאפשר לפנות אליה היום — לא משום שהוא ניצח במירוץ, אלא משום שאף אחד אחר לא השתתף בו.

התוכנית המוצהרת של גוגל בפברואר הייתה שהתצוגה המקדימה תימשך מספיק זמן כדי "לאמת את העדכונים האלה" ולקדם תחומים כמו תהליכי עבודה סוכניים שאפתניים לפני שהמודל יהפוך ל"זמין באופן כללי בקרוב". אלה דבריה של גוגל בהכרזת פברואר. שבעה חודשים לאחר מכן, זה לא קרה, והדיווח סביב העיכוב ראוי להיאמר בבירור כדיווח ולא כעובדה: SemiAnalysis הגיעה למסקנה שהמאמץ של Gemini 3.5 Pro בוטל בשקט, והוול סטריט ג'ורנל, כפי שצוטט בכלי תקשורת משניים, דיווח שהמועמד הפנימי ל-3.5 Pro נזנח משום שהוא לא הצליח להתעלות על סדרת Flash. הקו של גוגל עצמה הוא ש-3.5 Pro נותר בבדיקות שותפים מוגבלות, בלי חודש מאושר. לא הצלחנו למצוא הצהרה של גוגל שמאשרת או מכחישה את הביטול, ואנחנו לא מתכוונים לבחור להם צד.

התוצאה המעשית היא מלכודת שמות. אם תחפשו את "ה-Gemini Pro החדש ביותר", המודל הטרי ביותר בדרגת Pro שתמצאו הוא מפברואר, בעוד שמספרי הגרסאות בצד ה-Flash טיפסו ל-3.8. מספרי גרסאות כאן אינם מדרגים את היכולת בין הדרגות; אלה שני מסלולי שחרור נפרדים.

המפרטים שחשובים

כל נתון להלן מובא מתוך התיעוד של Google עצמה ל-Gemini API מתאריך 23 בספטמבר 2026, אלא אם צוין אחרת.

• הקשר קלט — 1,048,576 טוקנים, אותו חלון של מיליון טוקנים שגוגל מספקת מאז דור 2.5. הפלט מוגבל בנפרד ל-65,536 טוקנים, וזו תקרה על התשובה, לא על השיחה.

• מודאליות קלט — טקסט, תמונה, וידאו, אודיו ו-PDF. מודאליות פלט — טקסט בלבד. אין יצירת אודיו, אין יצירת תמונות, אין Live API, לכן זה אינו המודל עבור סוכן קולי בזמן אמת או צינור עיבוד תמונות. גוגל מספקת וריאנטים נפרדים של Gemini 3.x Flash למשימות האלה.

• חשיבה — נתמכת, עם שליטה ברמת החשיבה. אסימוני חשיבה מחויבים לפי תעריף הפלט, ולכן מחיר הפלט הוא המספר ששולט בחשבון שלך.

• כלים — מטמון, הרצת קוד, קריאה לפונקציות, עיגון חיפוש, עיגון מפות, פלטים מובנים, הקשר URL, ה-Batch API, הסקת flex והסקת עדיפות — כולם רשומים כנתמכים. חיפוש קבצים רשום כנתמך ב-AI Studio בלבד.

• רישיון ומשקלים — קנייני. אין משקלים פתוחים, אין צ'קפוינט להורדה, ואין מסלול לאירוח עצמי. כל מסלול למודל הזה הוא API מתארח.

• נקודות קצה — gemini-3.1-pro-preview הוא קוד המודל. Google גם מפרטת gemini-3.1-pro-preview-customtools וריאנט. נקודת קצה בתצוגה מקדימה יכולה להשתנות מתחת לרגליך בלי העלאת גרסה, וזו הסיבה הסטנדרטית לנעוץ מזהי מודל מדויקים בפרודקשן במקום כינויים.

• תאריך עדכון מתועד — עמוד המודל מציין “עדכון אחרון: פברואר 2026.” לא הצלחנו למצוא תאריך חיתוך ידע שמופיע בעמוד המודל של Google עצמו; רישומים של צד שלישי מציינים ינואר 2025, ואנחנו מסמנים זאת כלא מאושר במקום לחזור על זה כעובדה.

כמה זה עולה

ל-Gemini 3.1 Pro יש צוק מחירים, וזה מסוג הפרטים שהופכים הערכה שנראית זולה לחשבונית מוכפלת. התמחור המפורסם של Google למפתחים מתפצל לפי גודל הפרומפט ולא לפי גרסת המודל.

• מסלול סטנדרטי, פרומפטים של עד 200,000 טוקנים — $2.00 למיליון טוקני קלט, $12.00 למיליון טוקני פלט, כאשר טוקני חשיבה נספרים כפלט.

• מסלול סטנדרטי, פרומפטים מעל 200,000 טוקנים — קלט בעלות $4.00 ופלט בעלות $18.00. שני התעריפים מוכפלים באותו סף. זו המלכודת: עומס עבודה עם הקשר ארוך משלם פי שניים מהתעריף המוצהר בדיוק מפני שהוא משתמש בתכונה שלשמה רכש את המודל.

• מטמון הקשר — $0.20 או $0.40 למיליון טוקנים במטמון, בהתאם לצד של סף 200,000 שבו אתם נמצאים, בתוספת אחסון מטמון בחיוב של $4.50 למיליון טוקנים לשעה.

• מסלולי Batch ו-Flex — קלט של $1.00 ופלט של $6.00 מתחת ל-200,000 טוקנים, $2.00 ו-$9.00 מעל לכך. בערך חצי מחיר עבור עבודה שיכולה להמתין.

• מסלול עדיפות — $3.60 קלט ו-$21.60 פלט מתחת לסף, $7.20 ו-$32.40 מעליו.

• מסלול חינמי — אינו זמין למודל זה. אין מגבלת קצב חינמית לפיתוח אב־טיפוס.

שני דברים כדאי לדעת לגבי מידת האמינות של המספרים האלה. דף התמחור של גוגל עצמה הוא הגורם המוסמך כאן, ואנחנו קוראים אותו ישירות, כך שהנתונים שלמעלה מעודכנים ל-23 בספטמבר 2026. אבל פרסומים של צדדים שלישיים על הדגם הזה ממש לא עקביים — כלי מעקב אחד מפרט תעריף של $2.50 / $15.00, ואחר תעריף משוקלל של $4.50 — והחלוקה למדרגות היא הסיבה לכך. אם עמוד נוקב לך במספר בודד עבור Gemini 3.1 Pro בלי לומר לאיזו רצועת גודל פרומפט הוא מתייחס, המספר הזה לא שמיש להערכה אמיתית.

במה זה טוב באופן מדיד, ובמה זה לא באופן מדיד

התחל במה שגוגל טוענת, ואז השאר אותו מופרד ממה שמעריכים עצמאיים מדדו, כי השניים התפצלו בחדות מאז פברואר.

ההודעה של גוגל עצמה נושאת בדיוק נתון בנצ'מרק אחד: "ציון מאומת של 77.1%" ב-ARC-AGI-2, שאותו גוגל מתארת כיותר מכפול מביצועי החשיבה של Gemini 3 Pro. זהו המספר של הספק, כפי שנקרא מהפוסט של גוגל עצמה, והוא היחיד שיכולנו לאמת שם. סיקורי ההשקה הפיצו סט גדול בהרבה — GPQA Diamond, SWE-bench Verified, Terminal-Bench 2.0, LiveCodeBench, Humanity's Last Exam — אך הנתונים האלה אינם מופיעים בהודעה של גוגל עצמה, והדיווחים המשניים חלוקים ביניהם לגבי אלה שבדקנו (GPQA Diamond מופיע גם כ-94.1 וגם כ-94.3, תלוי את מי קוראים). איננו מפרסמים אותם כתוצאות מבוססות.

התמונה הבלתי־תלויה היא המקום שבו הסיפור מתהפך. במדד Artificial Analysis Intelligence Index בגרסה הפעילה ב-23 בספטמבר 2026, Gemini 3.1 Pro Preview מקבל ציון 30 ומדורג במקום ה-81 מתוך 212 מודלים באותה קטגוריה. המודל החציוני בקטגוריה מקבל ציון 25, כך שהוא נמצא מעל הממוצע — והמוביל באותו תרשים, Claude Opus 5 בהגדרת החשיבה המקסימלית שלו, מקבל ציון 58. המדד עצמו הוא סרגל מדידה מגורסא ולא קבוע: Artificial Analysis עדכנה אותו לאחר ההשקה בפברואר, והערות העדכון שלה עצמה מתעדות הערכות חדשות שהצטרפו למדד המשולב. Gemini 3.1 Pro דווח כמוביל המוחלט במדד כפי שהיה בעת השקתו בפברואר, עם 57 נקודות. זה אינו אותו סרגל מדידה כמו ה-30, ולא נעמיד את שני המספרים זה לצד זה כאילו הם תיארו ירידה.

מה שמיפוי הנוכחי אכן מציג הוא פרופיל אמיתי, והוא לא מאוזן:

• אינטליגנציה — 30 במדד, דירוג 81 מתוך 212. מעל החציון, רחוקה מהחזית.

• מהירות — 116.5 אסימוני פלט לשנייה, דירוג 38 מתוך 212. מהיר במיוחד עבור מודל חשיבה.

• עלות — $0.67 להרצת משימת Intelligence Index אחת, דירוג 31 מתוך 212. זה זול ליחידת עבודה, כי המודל חסכוני בטוקני חשיבה.

• מילוליות — 67M אסימוני פלט להשלמת האינדקס, לעומת חציון קטגוריה של 88M. דירוג 39 מתוך 212; Artificial Analysis מכנה אותו "תמציתי למדי". לשם השוואה, Gemini 3.8 Flash ברמת חשיבה גבוהה שורף 170M אסימונים על אותה חבילה ועולה $1.24 למשימה — יותר מ-Gemini 3.1 Pro, חרף תמחור זול יותר לכל אסימון.

אז הקריאה הכנה אינו „המודל הישן מובס בכל מקום”. Gemini 3.1 Pro מהיר וחסכוני בטוקנים, ובמונחים של עלות לכל משימה הוא מנצח את האח החדש יותר שלו. מה שהוא מפסיד הוא הקצה העליון של היכולת, ובכל עומס עבודה שבו האיכות היא האילוץ המחייב, זהו הציר היחיד שנחשב.

Screenshot of the Artificial Analysis model page for Gemini 3.1 Pro Preview, showing the headline tiles Intelligence 30 (rank 81 out of 212 models), Speed 116.5 output tokens per second (rank 38 out of 212), Cost $0.67 to run one Intelligence Index task (rank 31 out of 212) and Verbosity 67M output tokens (rank 39 of 212), alongside a panel comparing Gemini 3.1 Pro Preview against Claude Opus 5 at maximum reasoning.

שאלת הזמינות של ספטמבר

יש התפתחות חיה אחת סביב המודל הזה, והיא שאלה ולא שחרור. מאז 18 בספטמבר 2026, משתמשים בפורום המפתחים של AI Studio של גוגל עצמה מדווחים ש-Gemini 3.1 Pro נעלם מבורר המודלים של AI Studio — כותרת השרשור מתארכת את השינוי ל-2026-09-18 — כשמשתמשים בתשלום אומרים שהועברו ל-Gemini 3.8 Flash ומשם ל-3.7 ו-3.6 Flash. אף עובד גוגל לא השיב בשרשור שקראנו, אין הודעת הוצאה משימוש, ולא צוינה סיבה. המודל עדיין היה רשום ועדיין ניתן היה לפנות אליו דרך Gemini API ודרך הקטלוג שלנו כשבדקנו ב-23 בספטמבר 2026.

אנחנו מסמנים את זה כדיווחי משתמשים בלתי פתורים בפורום של גוגל עצמה, לא כהוצאה משימוש ולא כהשבתה. אבל אם נתיב הייצור שלך תלוי במודל הזה ספציפית, זו סיבה שיהיה לך גיבוי מוגדר, במקום להניח שנקודת קצה של תצוגה מקדימה היא קבועה.

מי צריך לבחור את זה, ומי לא צריך

בחרו ב-Gemini 3.1 Pro אם הבעיה שלכם ארוכה ורב-מודאלית. חלון מיליון הטוקנים עם קלט וידאו, אודיו ו-PDF נייטיבי הוא עדיין הסיבה להיות כאן, ושום דבר בגילו של המודל לא משנה את זה. באופן קונקרטי: ניתוח של ריפוזיטורי שלם, ביקורת של שעות של פגישות מוקלטות או צילומים, חילוץ נתונים מובנים מתוך אוספי מסמכים רב-מדיה, או כל צינור עיבוד שבו פרומפט בודד עובר באופן לגיטימי את גבול 200,000 הטוקנים והחלופה היא שכבת אחזור שתצטרכו לבנות ולהעריך. היעילות הטוקנית שלו היא טיעון שני אמיתי — הוא מסיים חבילת משימות ב-67M טוקני פלט, בעוד ש-Gemini 3.8 Flash מוציא 170M, כך שחשבון לכל משימה יכול לצאת נמוך יותר, אף שהתעריף לכל טוקן נראה גבוה יותר.

בחר משהו אחר בשלושה מקרים. אם אתה רוצה את התשובה הטובה ביותר של גוגל כרגע לשאלת הסקה קשה או קידוד באופק ארוך, Gemini 3.8 Flash משיג ציון גבוה יותר מ-Gemini 3.1 Pro במדד העצמאי הנוכחי, זמין באופן כללי ולא בתצוגה מקדימה, עולה $0.75 למיליון טוקני קלט ו-$3.75 למיליון טוקני פלט עד 31 בדצמבר 2026, ויש לו שכבה חינמית שאין ל-Gemini 3.1 Pro. הוא שורף יותר טוקני חשיבה כדי להגיע לשם — זו הפשרה, והיא אמיתית. אם אתה צריך את החזית המוחלטת, זה לא מודל של גוגל כרגע: באותו תרשים מדד, Claude Opus 5 בהסקה מקסימלית מוביל עם 58 לעומת 30 של Gemini 3.1 Pro. ואם עומס העבודה שלך רגיש לשהיה או לעלות והוא רדוד — סיווג, חילוץ, ניתוב, תמצות קצר — שכבת Flash-Lite או מודל קטן עם משקלים פתוחים יעשה את העבודה בשבריר מ-$2.00 למיליון טוקני קלט, ותשלום בתעריפי Pro על זה הוא סתם בזבוז.

מה שלא נעשה הוא לבחור ב-Gemini 3.1 Pro כי זה ה-Pro החדש ביותר מבית Google. הוא אינו חדש, ונכון לחודש הזה אין ל-Google יורש שהושק עבורו.

לקרוא לו בלי להמר את כל הסטאק שלך על נקודת קצה בתצוגה מקדימה

החלק המסורבל בתצוגה מקדימה של שבעה חודשים הוא שהיא טובה מספיק כדי לבנות עליה, אך לא יציבה מספיק כדי להניח אותה. שתי הקלות ראויות לציון.

נעץ את קוד הדגם המדויק במקום כינוי. נקודת קצה של תצוגה מקדימה יכולה להתעדכן במקום, כך ש gemini-3.1-pro-preview בקובץ תצורה בטוח יותר מאשר התייחסות צפה ל-"latest Pro", וזה הופך שינוי שקט לגלוי ב-diff.

השאירו את הניתוב מעל למודל. ב-OrcaRouter, Gemini 3.1 Pro הוא google/gemini-3.1-pro-preview, המוגש מאותו מפתח ומאותה נקודת קצה כמו כל מודל אחר שאנו מציעים, כולל מבנה /v1beta/models/{model}:generateContent מקורי עבור קוד שנכתב מול Gemini SDK, ומבנה תואם OpenAI /v1/chat/completions לכל השאר. מכיוון שהתמחור הוא העברה ישירה של העלות עם 0% מרווח, ה-$2.00 / $12.00 שבמחירון של גוגל הוא המספר שאתם משלמים כאן, ושינוי מחיר של ספק נכנס לתוקף באותו יום ולא במחזור החיוב הבא. הסיבה שזה חשוב במיוחד למודל בתצוגה מקדימה היא מעבר לגיבוי (failover): שרשרת גיבוי מוגדרת משמעה שביום ש-Gemini 3.1 Pro אינו זמין, הניסיון החוזר שלכם נוחת על המודל הבא בשרשרת לפני שהתגובה מתחילה, ולא אחרי שהמשתמשים שלכם שמים לב. זה ההבדל בין תצוגה מקדימה שאפשר להשיק עליה לבין תצוגה מקדימה שאפשר רק להדגים.

הרשומה בקטלוג שלנו עבור המודל כוללת את המפרט כפי שאנו מספקים אותו — הקשר של מיליון טוקנים, פלט מקסימלי של 65,536 טוקנים, קלט אודיו/קובץ/תמונה/טקסט/וידאו, פלט טקסט, וזמן חציוני עד לטוקן הראשון של 10.00 שניות בשבעת הימים האחרונים, וזה שווה לדעת לפני שאתם מניחים שזהו מודל עם השהיית צ'אט. הוא לא.

Generated comparison scoreboard titled 'Gemini 3.1 Pro vs Gemini 3.8 Flash — the scoreboard'. Left column, Gemini 3.1 Pro: AA Index 30, cost per index task $0.67, tokens per index run 67M, output speed 116 tok/s, output price $12.00 / 1M, status Preview. Right column, Gemini 3.8 Flash: AA Index 41, cost per index task $1.24, tokens per index run 170M, output speed 287 tok/s, output price $3.75 / 1M, status Stable. Footer reads 'Index per Artificial Analysis v4.3.2; prices and status per Google docs, 23 Sep 2026.'

מה עדיין פתוח?

שלושה דברים שלא הצלחנו לסגור, ומעדיפים לציין אותם מאשר לטשטש. Google לא אמרה אם Gemini 3.1 Pro יגיע אי פעם לזמינות כללית, ולא פורסם תאריך השבתה לאף אחד מהתרחישים. הדיווחים מ-AI Studio נותרו ללא הסבר חמישה ימים לאחר מכן, ולא הצלחנו למצוא תגובת ספק. ושאלת היורש ניתנת למענה רק בשלילה: עמוד ה-Pro של Google מכריז כבר חודשים על שחרור Pro צפוי, הדיווחים אומרים שהמועמד הפנימי נזנח משום שלא הצליח לגבור על קו Flash, ונכון ל-23 בספטמבר 2026 דבר לא שוחרר. אם יגיעו Gemini 3.5 Pro או Gemini 4 Pro, מעמדו של Gemini 3.1 Pro במשפחה הזו ישתנה לראשונה מאז פברואר — וזה, ולא ההשקה המקורית שלו, הוא האירוע ששווה לעקוב אחריו.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview, showing the model identifier google/gemini-3.1-pro-preview, Flagship and Featured badges, the byline 'by Google · 2026-02-19', capability tags for Vision, Audio, Tools, JSON and Reasoning, a 1M-token context and 65K maximum output, input modalities listed as audio, file, image, text and video with text-only output, and pricing tiles reading $2.00 per 1M input tokens and $12.00 per 1M output tokens.

Gemini 3.1 Pro זמין ב-OrcaRouter במחיר המחירון של Google, מאחורי אותו מפתח כמו כל שאר מה שאנו מציעים. ראו את עמוד המודל של Gemini 3.1 Pro לתמחור בזמן אמת, מגבלות הקשר ושרשרת גיבוי שתוכלו להגדיר לפני שהגרסה הבאה של התצוגה המוקדמת תגיע.

השוואות במאמר הזה3

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית