כרטיס הירו שנוצר עבור GPT-6.1 Sol מול Gemini 4 Argon, שכותרתו 'בפער של חצי נקודה, ורק אחד מהם עומד למכירה', עם שני כרטיסי מידע עם הכיתוב 'GPT-6.1 Sol: מדד אינטליגנציה 51.8, $0.72 למשימת מדד, זמין כעת' ו'Gemini 4 Argon: מדד אינטליגנציה 52, $1.99 למשימת מדד, תוכנית Fairwind בלבד, ללא נקודת קצה', כותרת תחתונה עם הכיתוב 'נתוני מדד ועלות-למשימה לפי Artificial Analysis, Intelligence Index v4.3.2; Gemini 4 Argon הוכרז אך אינו זמין באופן כללי.', והלוגו של OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

GPT-6.1 Sol מול Gemini 4 Argon: הפרש של חצי נקודה, ורק אחד מהם עומד למכירה

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

כל מה שאפשר להשוות בין GPT-6.1 Sol לGemini 4 Argon הוא ניתן למדידה, ושום דבר ממנו אינו ניתן לפעולה, כי רק אחד משני המודלים אפשר לקנות. Gemini 4 Argon הוכרז ב-30 בספטמבר 2026 בפוסט של DeepMind המיוחס לקוראי קאווקואולו, במחיר הצהרתי של 2.00 דולר למיליון טוקני קלט ו-10.00 דולר למיליון טוקני פלט, וייפרס תחילה לקבוצה מוגדרת בשמה של מגיני סייבר במסגרת תוכנית Fairwind. אין לו מזהה מודל, אין נקודת קצה של API, אין תעריף מפורסם לפי טוקן שאפשר לחייב בגינו, ואין דף שאפשר להגיע אליו כלקוח. GPT-6.1 Sol שוחרר ב-29 בספטמבר 2026 במחירים של 2.00 ו-10.00 דולר והוא זמין כעת. במדד האינטליגנציה של Artificial Analysis השניים מרוחקים זה מזה 0.8 נקודות — Argon ‏52.6, Sol ‏51.8 — מה שהופך את זה לצימוד הקרוב ביותר באצווה הזו, ובמדד בלבד, לתיקו מוחלט. במטר שקובע פריסות אמיתיות, אחד מהמודלים האלה אינו מועמד כלל.

האסימטריה הזו אינה עניין טכני, והיא גם לא סקופ. זה העובדה שצריכה להכתיב כיצד יש לקרוא את ההשוואה: המספרים של Argon מתארים מודל בפריסה מבוקרת לקבוצה אחת, ואלה של GPT-6.1 Sol מתארים מוצר שנמצא במחירון. עדיין שווה להשוות ביניהם — Argon הוא מה שהספק מוביל איתו כיום, והמדידות שלו אומרות משהו אמיתי על היכן שנמצא החלק העליון של קו Gemini — אבל כל מסקנה חייבת לכלול את הביטוי "אילו היה ניתן לרכישה", ואף אחת מהן אינה כוללת את הביטוי "האם כדאי לך להחליף".

המדד מאפשר בדיוק השוואה אחת, והיא כמעט תיקו

A screenshot of the OrcaRouter model page for openai/gpt-6.1-sol, credited to OpenAI and dated 2026-09-29, showing the model identifier, text, image and file input with text output, a 1,050,000-token context window with a 128K maximum output, and a rate row reading $2.00 input and $10.00 output per million tokens alongside a 4.54-second median time to first token and a 284.2M seven-day traffic figure.

שני המודלים מופיעים ב-Artificial Analysis, ושניהם מציגים ציון ודיווח על מה שעלה להפיק את הציון הזה.

• מדד האינטליגנציה, גרסה 4.3.2 — Gemini 4 Argon 52.6 לעומת GPT-6.1 Sol 51.8, פער של 0.8 נקודות

• עלות לכל משימת אינדקס — Gemini 4 Argon $1.99 לעומת GPT-6.1 Sol $0.72, פער של פי 2.8 עבור אותן 0.8 נקודות

• עלות הרצת החבילה המלאה — Gemini 4 Argon $2,407 לעומת GPT-6.1 Sol $1,082

• אסימוני פלט שהופקו באותה חבילת בדיקות — Gemini 4 Argon 110M לעומת GPT-6.1 Sol 67M, פער של פי 1.6 במילוליות

• מחיר היכרות מוצהר — $2.00 לקלט ו-$10.00 לפלט לכל מיליון טוקנים בשניהם, עם קלט במטמון בהנחה של 95% ב-Argon

• חלון הקשר — GPT-6.1 Sol 1,050,000 טוקנים; Argon טרם פורסם

השורה הרביעית מסבירה את השנייה. פער עלות של פי 2.8 למשימה על תעריפים מוצהרים כמעט זהים נובע מכתיבת פי 1.6 יותר טוקנים במחיר פלט דומה, ובנוסף לכל מה שעולה נפח החשיבה שמאחוריהם. Argon אינו מודל יקר לפי הכרטיס שלו. הוא פטפטן בהערכה, והחשבון נסגר בפלט.

התצורות שונות, וכיוון ההבדל מחמיא למודל הזול יותר. Artificial Analysis מציגה בתרשימים את Gemini 4 Argon בהגדרת המאמץ הגבוהה שלו ואת GPT-6.1 Sol במקסימום — כך ש-Sol נמדד בהגדרה היקרה ביותר שלו ו-Argon במשהו מתחת לתקרה שלו. לכן פער 0.8 הנקודות הוא הגרסה הנדיבה של ההשוואה עבור Sol: אם תיתנו ל-Argon את ההגדרה העליונה שלו, הפער כנראה יגדל; אם תיתנו ל-Sol הגדרה נמוכה יותר, העלות שלו תרד עוד. אף אחד מהמהלכים לא משנה את קו הזמינות, שהוא הקו היחיד שמסיים החלטת פריסה.

לפרש פער של 0.8 נקודות בכלל

הפרש של פחות מנקודה בציון מורכב של עשר הערכות אינו דירוג. מדובר בשני מודלים באותה רצועה.

מה שהאינדקס לא מפרסם עבור Argon הוא פירוט הרכיבים שהיה הופך את רצועת הציונים לקריאה — אילו הערכות הוא מנצח, היכן הוא חלש, כיצד הוא מתנהג על פני תת-הציונים המרכיבים את הציון המשולב. העמוד של GPT-6.1 Sol מכיל את השורות הללו; זה של Argon מכיל כותרת ומחיר. השוואה המבוססת על הכותרת בלבד יכולה לומר ששניהם באותה רמה ולא דבר מעבר לכך, והיא צריכה לומר בדיוק זאת במקום להמציא מנצח מפער של 0.8 נקודות.

יש נקודת נתונים חיצונית אחת שראויה להוספה, והיא מצביעה בכיוון ההפוך. בהערכת קידוד של צד שלישי שהופצה לאחר ההכרזה, Argon דורג במקום השלישי אחרי GPT-6 Astra ו-Claude Opus 5.5 — תוצאה חזקה עבור מודל בהפצה מבוקרת, ואחת שמתיישבת באופן עקבי עם 52.6 בציון המשולב. זהו גם תצפית בודדת מהערכה בודדת, שפורסמה בימים הראשונים של ההכרזה, מה שהופך אותה לראיה ולא לרקורד. תייגו אותה והמשיכו הלאה.

למה שני כרטיסי המחיר באמת מיועדים

השער הנקוב עבור Argon ראוי ליתר תשומת לב מאשר שורת המדד, מפני שיש בו שני מספרים.

תעריף ההיכרות הוא $2.00 לקלט ו-$10.00 לפלט, עם קלט במטמון בהנחה של 95%, אשר על כרטיס תמחור יהפוך את Argon להתאמת מחיר בתנאים זהים ל-GPT-6.1 Sol. הערת השוליים של הספק עצמו קובעת שלאחר תקופת היכרות שהוא אינו מגדיר, התעריף נעשה $4.00 למיליון טוקני קלט ו-$20.00 למיליון טוקני פלט. הזוג השני אינו היפותטי — זהו המספר המפורסם שהמודל צפוי להתייצב עליו — והוא נוחת בדיוק על מחיר המחירון הנוכחי בחזית, ולא מתחתיו. השוואה שמצטטת רק את הזוג ההקדמי מצטטת מחיר מבצעי עבור מודל שטרם זמין באופן כללי, וזה שתי דרגות של ארעיות על שורה אחת.

כרטיס התמחור של GPT-6.1 Sol הוא אובייקט מהסוג ההפוך. $2.00 ו-$10.00 הם התעריף הקבוע, לא מבצע; המדרגה להקשר ארוך ל-$4.00 / $15.00 מעל 272,000 טוקני פרומפט מפורסמת וחלה על גבול מוגדר; קלט במטמון ב-$0.10 פעיל היום וחייב בתשלום. אין בו דבר שמצריך הערת שוליים על תקופה שהספק מסרב להגדיר.

זו המהות שמאחורי שורת הזמינות. לא ש-Argon הוא מודל גרוע יותר — המדד אומר ששניהם באותה רמה — אלא שאחד משני הכרטיסים האלה הוא התחייבות והאחר הוא כוונה.

הפריסה עצמה היא ההשוואה

A screenshot of the Gemini model family page on Google DeepMind's own site, headed 'Our next era of frontier intelligence' with a Gemini 4 Argon card and a Read blog link, captured October 7, 2026. The page carries no model identifier, no endpoint and no per-token price for Argon.

תוכנית Fairwind היא החלק בהודעה של Argon שבדיקה טכנית נוטה לדלג עליו, והוא החלק שהכי חשוב כאן.

הספק מניח את המודל תחילה בידיה של קבוצה מוגדרת בשם של מגיני סייבר, לפני כל השאר, בלי תאריך מוכרז לפתיחה כללית, בלי רשימת המתנה למפתחים, ובלי מזהה מפורסם שלקוח יוכל להצמיד. זוהי דרך לגיטימית לשחרר מודל חזיתי, וזה אינו יוצא דופן ליכולת מהסוג הזה. זה גם אומר שכל טענה לגבי העלות, השהיה, התפוקה והאמינות של Argon בתעבורה אמיתית אינה נמדדת כעת: אין תעבורת ייצור למדוד. הרצת הבנצ'מרק של הספק עצמו קיימת, והמדד המשולב של Artificial Analysis קיים, וביניהן הן הערכה של מעבדה אחת וחבילה של מעריך אחד. זה כל התיעוד.

הרקורד של GPT-6.1 Sol הוא בן שמונה ימים ודל בדרך אחרת: תצורה עצמאית אחת, אין קורפוס של מתרגלים, ומוצר שכבר הושק שאופני הכשל שלו טרם תועדו בשום מקום. אף אחד מהמודלים אינו מגובה היטב בראיות. לאחד מהם, עם זאת, יש חשבונית.

אז בשביל מה ההשוואה הזאת

שלושה שימושים, ואף אחד מהם אינו החלטת רכישה.

ראשית, כיול. אם אתם עוקבים אחר היכן ש-Argon ממוקם מול GPT-6.1 Sol, 52.6 מול 51.8 בפער עלות של פי 2.8 לכל משימה — זו התשובה הנוכחית, והיא אומרת שקו Gemini 4 תחרותי מבחינת יכולות בעודו עדיין מסדיר את התנאים המסחריים שלו. שימו לב לכך שתעריף ההיכרות יוחלף בצמד $4.00 / $20.00, מה שיהפוך התאמת מחיר לפרמיית מחיר כשהיכולת נשארת ללא שינוי.

שנית, עמדת המתנה. מודל שמוכרז, נמדד ואינו ניתן לניתוב הוא המקרה הברור ביותר שיש לשמור על הפשטה בין היישום שלך לבין בחירת המודל שלך. שני המודלים במאמר הזה נגישים באותה דרך מהצד שלנו של הגדר: GPT-6.1 Sol נמצא ב-OrcaRouter במחיר שלו עצמו של $2.00 / $10.00עם קלט שמור במטמון ב-$0.10 ובלי שום תוספת, כך שאפשר לבנות מולו עומס עבודה כבר היום במחיר המחירון של הספק. אם וכאשר Argon יקבל מזהה ומחירון, הערכתו אמורה להיות שינוי תצורה ולא שכתוב — ועד אז, כמות הנדסת התוכנה הנכונה להשקיע ב-Argon היא הכמות ששומרת על זה נכון.

שלישית, רשימת מעקב ניתנת להפרכה. כל אחד מהדברים הבאים היה הופך את זה מכתבה של מה שאנחנו יודעים עד כה להשוואה שאפשר לקנות לפיה: מזהה מודל בתיעוד למפתחים, רשומה באינדקס כרטיסי המודל שלו, פוסט זמינות כללית עם תעריפים מפורסמים לכל טוקן, או פרסום של Artificial Analysis של תצורה שנייה ברמת מאמץ שונה. עד שאחד מאלה יופיע, מאמר שטוען ש-Argon זול, מהיר או טוב יותר מ-GPT-6.1 Sol בסביבת ייצור מתאר מודל שאף אחד מחוץ לקבוצה אחת לא הריץ.

A generated scoreboard titled 'GPT-6.1 Sol vs Gemini 4 Argon — the scoreboard' showing two columns on six shared rows: Intelligence Index 51.8 against 52.6 on v4.3.2; cost per index task $0.72 against $1.99; suite cost $1,082 against $2,407; output tokens on the suite 67M against 110M; index effort setting max against high; availability purchasable now against a controlled rollout with no endpoint or identifier. A footer reads 'Index and cost figures per Artificial Analysis v4.3.2; GPT-6.1 Sol pricing per OpenAI; Gemini 4 Argon figures describe an announced model that is not yet generally available.'

הסיום הישר הוא משפט אחד, והוא עוסק בצורת השאלה ולא בציון. Gemini 4 Argon ו-GPT-6.1 Sol קרובים מספיק בלוח העצמאי היחיד ששניהם מופיעים בו, עד כדי כך שהמדד לא יכול לבחור ביניהם; מה שמכריע ביניהם הוא שאחד זמין והשני הוא הבטחה, והבטחה היא לא משהו שאליו מנתבים תעבורת ייצור. עקוב אחרי Argon, אמץ את Sol אם המחיר והמודאליות מתאימים לעבודה שלך, ושמור על ההפשטה דקה מספיק כך שביום שבו Argon יהפוך למציאות, זה יהיה שורת קונפיגורציה ולא פרויקט.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית