
GPT-6 Sol Pro לעומת Gemini 3.1 Pro Preview: שבעה חודשים של תצוגה מקדימה, ומה זה עולה לך
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
Gemini 3.1 Pro Preview נמצא בתצוגה מקדימה כבר שבעה חודשים. הספק פרסם אותו ב-19 בפברואר 2026 במחיר של $2.00 למיליון אסימוני קלט ו-$12.00 למיליון אסימוני פלט, ונכון לשבוע זה כרטיס המודל עדיין מתאר אותו כ"מוצע בצורת תצוגה מקדימה", מזהיר שהוא "עשוי להיות מוגבל ביציבות או בזמינות בהשוואה למהדורות יציבות", ואומר שהוא "עלול לחוות שינויים או הוצאה משימוש ללא הודעה מוקדמת". אין תאריך זמינות כללית ואין תאריך כיבוי בטבלת ההוצאה משימוש. GPT-6 Sol Pro — התצורה של GPT-6 Sol, המודל שהגיע לזמינות כללית ב-22 בספטמבר 2026 במחיר של $2.00 קלט ו-$10.00 פלט — הוא ההסדר ההפוך: API לייצור עם תמחור מפורסם, חוגת מאמץ מתועדת, וספק שהתחייב למספר.
ההשוואה המעניינת בין שני המודלים האלה אינה טבלת הבנצ'מרק. היא מה שכל ספק הבטיח לך לגבי הרבעון הבא.
שתי שורות מחיר, שאחת מהן היא תצוגה מקדימה
שתיהן רשימות ספקים. המספרים של גוגל ו-OpenAI עצמן, המועברים ללא שינוי על ידי הפלטפורמות שמארחות אותן.
• קלט — GPT-6 Sol $2.00 למיליון טוקנים לעומת Gemini 3.1 Pro Preview $2.00 למיליון טוקנים
• פלט — GPT-6 Sol $10.00 למיליון טוקנים לעומת Gemini 3.1 Pro Preview $12.00 למיליון טוקנים
• הקשר ארוך — Gemini 3.1 Pro Preview מתמחר מחדש קלט ב-$4.00 ופלט ב-$18.00 למיליון טוקנים מעל סף של 200,000 טוקנים; GPT-6 Sol מחיל תמחור מחדש משלו להקשר ארוך מעל סף קלט גבוה יותר
• קריאה מהמטמון — GPT-6 Sol $0.20 למיליון טוקנים לעומת Gemini 3.1 Pro Preview $0.20 למיליון טוקנים
• חלון הקשר — GPT-6 Sol 1,050,000 טוקנים לעומת Gemini 3.1 Pro Preview 1,000,000 טוקנים
• פלט מקסימלי — GPT-6 Sol 128,000 טוקנים לעומת Gemini 3.1 Pro Preview 65,000 טוקנים
• מודאליות קלט — GPT-6 Sol טקסט ותמונה לעומת Gemini 3.1 Pro Preview טקסט, תמונה, אודיו, וידאו וקובץ
• סטטוס זמינות — GPT-6 Sol זמין באופן כללי מאז 22 בספטמבר 2026 לעומת Gemini 3.1 Pro Preview בתצוגה מקדימה מאז 19 בפברואר 2026 ללא תאריך GA מוכרז
המחירים העיקריים קרובים מספיק עד שהם אינם הגורם המכריע. הקלט זהה. הפלט שונה ב-20%. ההבדלים האמיתיים הם אלה בשתי השורות האחרונות: Gemini מקבל ארבע מודאליות קלט נוספות ופי שניים מתקרת הפלט בכיוון ההפוך — 65,000 טוקנים לעומת 128,000 — והוא מופץ כתצוגה מקדימה כבר רוב השנה.

סטטוס התצוגה המקדימה הוא מאפיין תפעולי אמיתי
טקסט הקטלוג של גוגל עצמה אומר לבונים לתכנן לקראת הפסקת התמיכה ב-Preview. המשפט הזה עושה עבודה רבה, וכדאי לקרוא אותו כאילוץ הנדסי ולא כהסתייגות.
מודל בתצוגה מקדימה הוא כזה שאפשר לבנות עליו אך אי אפשר לתכנן סביבו. שלוש השלכות נובעות מכך, ואף אחת מהן אינה מופיעה בטבלת מחירים.
• אין התחייבות ליציבות. הכרטיס מציין במפורש שלמודל עשויות להיות מגבלות ביציבות בהשוואה לגרסאות יציבות, ושא OrcaRouter אינו מספק ערבויות השהיה ספציפיות עבור מודל תצוגה מקדימה זה. הטלמטריה שלנו בדף המודל מראה שזמני p50 ו-p95 עד לאסימון הראשון עומדים שניהם על 10.00 שניות במהלך השבוע האחרון, שמהווה את הקצה העליון של טווח התצוגה ולא חציון מדוד.
• אין תאריך התיישנות. מודל עם תאריך כיבוי יכול להיות מתוזמן מחוץ למפת דרכים. מודל שאין לו לא תאריך GA ולא תאריך כיבוי לא יכול להיות מתוזמן כלל, בשום כיוון — אינך יודע מתי יהיה בטוח להסתמך עליו, ואינך יודע מתי הוא יפסיק לעבוד.
• אין מקום במפת הדרכים. גוגל השיקה דגמי Flash חדשים יותר באותה משפחה, שכעת משיגים ציונים גבוהים יותר מ-Gemini 3.1 Pro במדדים משולבים בלתי־תלויים, כולל Gemini 3.8 Flash ב-2 בספטמבר 2026. דור 3.5 Pro נדחה ולפי הדיווחים הונח בצד. אין Gemini 3.8 Pro. המודל הנושא את השם Pro אינו עוד בעל הציון הגבוה ביותר של הספק שלו, והוא עדיין תצוגה מקדימה.
זה המסגור הכנה לכל מי שבוחר בין השניים. GPT-6 Sol בן שישה ימים, ויש לו מחיר אחיד, מפורסם וקבוע. Gemini 3.1 Pro Preview בן שבעה חודשים, ויש לו שורת סטטוס במקום מפת דרכים.
מה שמראה התיעוד הבלתי תלוי, ולמה תווית הגרסה היא כל הטיעון
Artificial Analysis מפרסמת עמוד השוואה ישירה עבור הצמד המדויק הזה במדד הנוכחי, מה שהופך אותו לאחת מההתמודדויות הבודדות בקבוצה הזו שבהן המספרים הניטרליים הם באמת בני-השוואה. GPT-6 Sol במאמץ מרבי משיג 48 במחיר של 1.06 דולר למשימת מדד. Gemini 3.1 Pro Preview משיג 30 במחיר של 0.67 דולר למשימת מדד.
פער של שמונה עשרה נקודות הוא פער גדול, וזה לא הפער שהיה לדגם בפברואר. בעת ההשקה, Artificial Analysis הציבה את Gemini 3.1 Pro Preview במקום הראשון במדד ה-Intelligence Index שלה עם 57. הדגם לא השתנה מאז. המדד כן — הוא קיבל ציון מחדש ב-19 בספטמבר 2026, ואותו דגם שלא השתנה מציג כעת 30. שני המספרים הם של Artificial Analysis; אף אחד מהם אינו שגוי; הצבתם זה לצד זה בלי הגרסה היא השגיאה הנפוצה ביותר בסיקור של הדגם הזה, וזו הסיבה לכך שכל כך הרבה עמודי השוואה מתארים מוביל מפברואר כשווה-ערך בספטמבר.
העלות לכל משימה מספרת סיפור שני ששווה לעשות עליו את החשבון. Gemini זול יותר לכל משימה — $0.67 לעומת $1.06 — אך הציון שלו נמוך יותר. העלות לנקודת מדד יוצאת $0.022 עבור GPT-6 Sol ו-$0.022 עבור Gemini. לפי המדד הזה, השניים בתיקו מוחלט, וזו הדרך הנקייה ביותר לומר מה בעצם קורה כאן: Gemini אינו דרך זולה יותר לקנות את אותה אינטליגנציה, אלא דרך זולה יותר לקנות פחות ממנה.
שני מספרים בלתי־תלויים אחרים שייכים לצד אלה, ושניהם מסומנים. ב-OSWorld-Verified, בנצ'מרק השימוש במחשב, עמוד ההערכה של גוגל עצמה מדווח על 76.2% עבור Gemini 3.1 Pro. הנתון הזה מופיע בחומרים של גוגל ובסיכומים של צדדים שלישיים שלהם, והוא אינו מופיע בלוח OSWorld המאומת באופן בלתי־תלוי, שבו מפורטים דגמי Gemini אחרים — 3.6 Flash ב-83%, 3.5 Flash ב-78.4% — וכלל אין שורה של 3.1 Pro. בלוח הקשה יותר OSWorld 2.0 המודל משיג 30.6%. וב-GDPval-AA המודל נמצא בסביבות 1,316 Elo, מאחורי Claude Sonnet 4.6 ו-Claude Opus 4.6.
זו אינה האשמה בחוסר תום לב; מספרים שמדווחים על ידי הספק עצמו הם דבר רגיל, ושני הספקים מפרסמים אותם. זהו משפט על מה שתצוגה מקדימה בת שבעה חודשים באמת נותנת לך: מספיק זמן לנתון שמדווח על ידי ספק להסתובב ברבים, ולא מספיק שכפול בלתי תלוי כדי שהנתון ייבדק. לעומת זאת, הרקורד הניטרלי של GPT-6 Sol קצר, חד-משמעי, ובן שישה ימים.
פער ידע של חמישה עשר חודשים שאף אחד לא מזכיר
ל-Gemini 3.1 Pro Preview יש חיתוך ידע של ינואר 2025. זה של GPT-6 Sol הוא 20 באפריל 2026 — חמישה עשר חודשים לאחר מכן.
פער זה נעדר מכל עמוד השוואה על העימות הזה, והוא חשוב יותר מההבדל במחיר התפוקה עבור סוג מסוים של עבודה: כל דבר שמערב API-ים עדכניים, גרסאות ספרייה עדכניות, אירועים עדכניים או עובדות ארגוניות עדכניות. מודל עם תאריך חיתוך של ינואר 2025 יענה בביטחון על עולם שהתקדם בשנה ורבע, ומצב הכשל אינו הודעת שגיאה — אלא תשובה שגויה וסבירה. בעבודה עם תגבור אחזור, תאריך החיתוך כמעט לא רלוונטי מכיוון שההקשר נושא את העובדות. עבור כל דבר שנשען על ידע פרמטרי, זהו האילוץ הראשון שיש לבדוק והאחרון שמישהו בודק.

פער המודאליות הוא הטיעון החזק ביותר בעד Gemini, והוא אמיתי
זה היה קל לכתוב את ההתמודדות הזו כניצחון ברור עבור הדגם החדש יותר. זה לא כך, והסיבה היא שורת הקלט.
Gemini 3.1 Pro Preview מקבל קלט של טקסט, תמונה, אודיו, וידאו וקובץ באופן נייטיבי באותה נקודת קצה. GPT-6 Sol מקבל טקסט ותמונה. עבור עומס עבודה הבנוי סביב הבנת וידאו, תמלול פגישות או עיבוד מסמכים החוצה פורמטים, זה אינו הבדל בתכונות — זה ההבדל בין קריאת API אחת לבין צינור של שלוש, כששלבי הביניים מחויבים בנפרד ומצבי הכשל מתרבים.
ההסתייגות הכנה הנלווית לכך: מודל תצוגה מקדימה עם שיעור שגיאה של 77.6% המוצג בדף המודל המתארח שלו הוא מודל תצוגה מקדימה שהיתרון הרב-מודלי שלו צריך להישקל מול השאלה אם הוא בכלל יענה. הנתון הזה הוא כפי שמוצג בדף, והוא גבוה מספיק כדי להצדיק אימות לפני שמישהו בונה עליו — וזו בדיוק הנקודה. בחלוף שבעה חודשים, העצה הכנה לגבי המודל הזה היא עדיין "מדוד אותו בעצמך", וזה משפט שאף אחד לא כותב על מהדורת GA.
כאשר שכבת ניתוב משנה את האריתמטיקה
Gemini 3.1 Pro Preview נמצא בקטלוג של OrcaRouter במחיר של $2.00 לקלט, $12.00 לפלט ו-$0.20 לקריאת מטמון למיליון טוקנים, עם חלון הקשר של 1,000,000 טוקנים, תקרת פלט של 65,000 טוקנים, נקודות הקצה /v1/chat/completions ו-/v1beta/models/{model}:generateContent, וזמן p50 עד לטוקן הראשון של 10.00 שניות כפי שנמדד בעמוד המודל שלנו במהלך השבוע האחרון. מחירון הספק מועבר כמו שהוא, כאשר אין תוספת מעל.
GPT-6 Sol אינו אחד מהמסלולים שלנו, ולכן אין כאן שום טענה לגבי המחיר שלו דרכנו.

מודל תצוגה מקדימה הוא המקרה הקלאסי לניתוב במקום להתחייב. גם הסיבה לנסות את Gemini 3.1 Pro Preview וגם הסיבה שלא לבנות עליו נתיב ייצור הן אותה תכונה — הוא יכול להשתנות ללא הודעה מוקדמת — ונקודת קצה אחת עם מעבר אוטומטי לגיבוי היא הדרך לקחת את הראשון בלי לקבל את השני. מבנה הבקשה אינו משתנה כאשר המודל שמאחוריה משתנה, ולכן נתיב הגיבוי הוא רשומת תצורה ולא הגירה. זה חשוב כאן יותר מאשר ברוב ההשוואות, מפני שהמודל שסביר ביותר להחליף את זה בשרשרת גיבוי הוא Flash חדש יותר מאותו ספק, באותו מפתח, בשבריר מתעריף הפלט.
כלל ההחלטה
• קלט וידאו, אודיו או פורמט מעורב בקריאה אחת — Gemini 3.1 Pro Preview. שום דבר בעמודה של GPT-6 Sol לא מקבל קובץ וידאו, ואין פער מחירים שמפצה על צינור קליטה שאתה צריך לבנות.
• כל דבר עם התחייבות זמינות מצורפת — GPT-6 Sol. בן שישה ימים, זמין באופן כללי, מחיר מפורסם המתואר כקבוע, וחוגת מאמץ מתועדת. כך נראה משהו שניתן לתזמן.
• פלטים ארוכים — GPT-6 Sol, בתקרת הפלט ולא בקצב. 128,000 טוקנים מול 65,000 הוא האילוץ שמכיש ראשון בעבודת סינתזה, והוא מכיש לפני שהפער של 20% במחיר הפלט עושה זאת.
• להערכת Gemini 3.1 Pro Preview — עשה זאת מאחורי נתיב failover, ומדוד בעצמך את שיעור השגיאות לפני שאתה מגדיר את גודל עומס העבודה. שבעה חודשי תצוגה מקדימה עם שיעור שגיאות מוצג של 77.6% בעמוד המתארח אינם מכשיר מדידה מגובש.
• אם התוכנית שלך תלויה בכך שהמודל הזה יהיה זול ברבעון הבא — אף אחד מהם לא. התצוגה המקדימה של Gemini עשויה לקבל תמחור מחדש או להיות מופסקת ללא הודעה מוקדמת, והמחיר של GPT-6 Sol קבוע רק במובן ש-OpenAI אמרה זאת השבוע. תעריף אחיד הוא התחייבות, לא ערובה; הוא פשוט התחייבות חזקה יותר מזו של כרטיס תצוגה מקדימה.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
