כרטיס גיבור שנוצר בכותרת 'GPT-6.1 Sol מול דור GPT-6', עם כותרת משנה 'דור אחד, פי 48 בעלות', המציג ארבעה שלבים מוערמים המסומנים GPT-6 Astra (אינדקס 52.7, $3.26 למשימה), GPT-6.1 Sol (אינדקס 51.8, $0.72 למשימה), GPT-6 Sol (אינדקס 47.6, $1.05 למשימה) ו-GPT-6 Luna (אינדקס 38.1, $0.07 למשימה), עם כותרת תחתונה האומרת 'נתונים: Artificial Analysis v4.3.2.' ולוגו OrcaRouter בפינה הימנית התחתונה.
Engineering & Research

GPT-6.1 Sol לעומת דור ה-GPT-6: דור של אחד

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הספק הוסיף שם רביעי לקו המודלים שלו ב-29 בספטמבר 2026 וכינה אותו דור, והחשבון של המערך הזה הוא הדבר המעניין ביותר בו: GPT-6.1 Solהוא כל הדור. GPT-6 Luna וGPT-6 Sol, שניהם שוחררו ב-22 בספטמבר 2026, לא השתנו; GPT-6 Astra, שזמין מאז 4 בספטמבר 2026, לא השתנה; רענון 6.1 נגע בדיוק בדרגה אחת. בינתיים GPT-6.1 Sol, במחיר של $2.00 לקלט ו-$10.00 לפלט למיליון טוקנים, משיג 51.83 במדד האינטליגנציה של Artificial Analysis בעלות של $0.724 למשימה — בפער של 0.84 נקודות מ-GPT-6 Astra, שעולה $3.2575 למשימה במחיר של $10.00/$50.00. אותו דור על התווית, ארבע כלכלות שונות מתחת.

זה הופך את "האם עלי להשתמש בדור GPT-6" לשאלה הלא נכונה. המבחר משתרע על פני טווח של פי 48 בעלות לכל משימה וטווח של 14.6 נקודות באינטליגנציה הנמדדת, והתשובה תלויה לחלוטין באיזו דרגה אתה מתכוון. הנה הסולם, נמדד.

ארבע השליבות, כפי שנמדדו

A chart titled 'The GPT-6 ladder - measured', subtitle 'Artificial Analysis Intelligence Index, and the measured cost of one task', with four horizontal bars whose lengths are proportional to the Intelligence Index: GPT-6 Luna Index 38.1 / $0.068 per task, GPT-6 Sol Index 47.6 / $1.05 per task, GPT-6.1 Sol Index 51.8 / $0.72 per task, GPT-6 Astra Index 52.7 / $3.26 per task; footer 'Bar length is proportional to the Intelligence Index (0-60 scale). All figures: Artificial Analysis v4.3.2.' OrcaRouter logo bottom-right.

• GPT-6 Luna — מדד 38.12, $0.10 / $0.50 לכל 1M, $0.01 במטמון, $0.0678 לכל משימה, 50,012 אסימוני פלט, 100.1 שנ׳ לאסימון הראשון
• GPT-6 Sol — מדד 47.63, $2.00 / $10.00, $0.20 במטמון, $1.045 לכל משימה, 31,000 אסימוני פלט, 124.3 שנ׳
• GPT-6.1 Sol — מדד 51.83, $2.00 / $10.00, $0.10 במטמון, $0.724 לכל משימה, 38,128 אסימוני פלט, 332.0 שנ׳
• GPT-6 Astra — מדד 52.67, $10.00 / $50.00, $1.00 במטמון, $3.2575 לכל משימה, 27,206 אסימוני פלט, 400.4 שנ׳

לכל אחד מהם יש חלון הקשר זהה של 1,050,000 טוקנים ואותו פלט מקסימלי של 128,000 טוקנים, וכל אחד מהם מקבל קלט של טקסט, תמונה וקובץ. הדרגות אינן נבדלות לפי דגלי יכולות. הן נבדלות לפי כמה חשיבה אתה מוכן לשלם עבורה, ושני קצוות הסולם רחוקים זה מזה פי 48 לכל משימה.

מה שהרענון של 6.1 בעצם שינה

שלושה דברים, ורק אחד מהם הוא ניקוד.

הציון נע: מ-47.63 ל-51.83, עלייה של 4.2 נקודות, בתוך שבוע. תעריף הקלט במטמון נחתך בחצי, מ-0.20$ ל-0.10$ למיליון, ולכן העלות הנמדדת לכל משימה ירדה מ-1.045$ ל-0.724$, למרות שמחירי המחירון זהים — אותו לוח תעריפים, חשבון שונה. ומספר אסימוני הפלט עלה מ-31,000 ל-38,128 בעוד שזמן שעון הקיר לכל משימה עבר מ-321 שניות ל-640, וזה המקום היחיד שבו הרענון נסוג והכי פחות גלוי בכל דף מפרט.

לעומת Astra, ההשוואה היא זו שמפתיעה אנשים. GPT-6.1 Sol נמצא 0.84 נקודות מדד מאחורי דגם הדגל וזול פי 4.5 לכל משימה. היתרון שנותר ל-Astra אינו ציון המדד שלה; הוא מכלול ההערכות שבהן רק היא נמדדת, והיכולת האחת ש-OpenAI מתארת כייחודית לה — איתור פגיעויות אבטחה חדשות, וזו הסיבה שהמודל מדורג "קריטי" במסגרת ה-Preparedness Framework של הספק עצמו, וההגדרות המתקדמות ביותר שלו מוגבלות לשותפים מאומתים.

כרטיס OrcaRouter עבור GPT-6 Astra הוא הקצה הדגלי של אותו סולם: $10.00 / $50.00, p50 של 1.64 שניות עד לטוקן הראשון, 40.7 מיליון טוקנים על פני שבעה ימים, ואותו חלון הקשר של 1,050,000 טוקנים שכל הדרגות חולקות.

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the $10.00 input and $50.00 output per-million prices, a 1.64 s p50 time to first token, 40.7M tokens over seven days, a 1,050,000-token context window and 128K max output with text/image/file input, above the OpenAI-compatible code sample.

לעומת Sol 6.0, הרענון הוא כמעט שיפור ישיר — יותר אינדקס, פחות כסף — עם הסתייגות שמודל 6.1 הוא מודל שונה ולא צ'קפוינט, והוא פולט מחדש את הנמקתו בפירוט רב יותר. לעומת Luna זה בכלל לא השוואה: פי 10.7 מהעלות עבור 13.7 נקודות אינדקס, שזו עסקה טובה לעבודה קשה ועסקה גרועה לעבודה בנפח גבוה.

מה שהשוק כבר החליט, על פי נתוני הניתוב שלנו עצמנו

דבר אחד שיש בהשוואה הזו ושאין בגיליון מפרט הוא מבט על שימוש בפועל. במהלך שבעת הימים שהסתיימו ב-7 באוקטובר 2026, בשכבת הניתוב שלנו, GPT-6.1 Sol העביר 284.2 מיליון טוקנים, ואילו GPT-6 Sol שאותו הוא החליף העביר 950 אלף — הבדל של פי 300 בין שני מודלים שהפרש הגילאים ביניהם שבוע, וכך נראית החלפת דרג מבפנים. GPT-6 Luna, השכבה הזולה, העביר 641.6 מיליון, יותר משני מודלי Sol גם יחד. GPT-6 Astra העביר 40.7 מיליון.

קרא את זה כשלושה התנהגויות נפרדות. עבודה בנפח גבוה עברה לשכבה הזולה, ובנפח הגדול ביותר. עבודה רצינית התרכזה אל ה-Sol החדש ביותר בתוך שבוע מהשחרור שלו, תוך נטישת המודל שהוא החליף. והדגם המוביל נשאר נישה: המדרגה היכולתית ביותר, בשימוש המועט ביותר, בידי צוותים שהבעיה שלהם היא זו שרק הוא פותר. ההיצע אינו סולם שמטפסים עליו; זהו אוסף כלים שאנשים בוחרים מתוכו, והם בוחרים לפי שכבה ולא לפי דור.

וזו הסיבה שהשכבה שייכת לבקשה, ולא לארכיטקטורה

הבעיה המעשית בדור של ארבעה דרגים היא שהתשובה הנכונה משתנה ממשימה למשימה ומשבוע לשבוע — כפי שמראים נתוני התעבורה שלמעלה, השוק החליט מחדש בתוך שבעה ימים. קידוד קשיח של שם מודל אחד לתוך אפליקציה הוא מה שהופך את ההיצע להתחייבות.

כל ארבעתם נגישים דרך נקודת קצה אחת של OrcaRouter: API יחיד ל-200+ מודלים, כאשר מחיר המחירון של הספק מועבר הלאה במרווח של 0%. החלק האחרון הזה הוא קריטי כאן במיוחד, כי שלושה מבין ארבעת המסלולים חולקים מחיר מחירון או תעריף מטמון שכבר השתנה פעם אחת — תעריף המטמון של GPT-6.1 Sol ירד בחצי בתוך שבוע מההשקה, ומונה העברה הוא זה שמביא את זה לחשבונית שלך באופן אוטומטי.

A screenshot of the OrcaRouter model page for openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128K max output, text/image/file input with text output, the $2.00 input and $10.00 output per-million prices, a 4.54 s p50 time to first token and 284.2M tokens routed over seven days, above the OpenAI-compatible code sample.

שני מאפיינים של שכבת הניתוב ראויים לאזכור עבור המערך המסוים הזה. ה-DSL של הניתוב מאפשר לדרגה להיות פרמטר של הבקשה ולא של הפריסה — דרגה זולה למעבר החילוץ, 6.1 Sol למעבר ההיסק, ו-Astra רק לקריאות שזקוקות למה ש-Astra עושה באופן ייחודי. ומיזוג מודלים מאפשר לפאנל שלהם לענות יחד על שאלה אחת, וזו הדרך ההגונה להשתמש במודל דגל שאין לך אפשרות לנתב אליו הכול: הוא הופך לקול אחד בפאנל במקום החשבון כולו.

מה לעשות עם דור של אחד

אל תקנו את הדור. קנו שליב, וקנו אותו מחדש כשהשליבים זזים.

לעבודה בנפח גבוה ורגישה לשהיה, GPT-6 Luna במחיר $0.0678 למשימה ו-100 שניות עד לטוקן הראשון היא השכבה שכבר נושאת את התעבורה הרבה ביותר, והמחיר נמוך בסדר גודל מכל דבר אחר בסולם. עבור הסקה וקידוד כלליים, GPT-6.1 Sol הוא כעת ברירת המחדל שמודל 6.0 היה פעם — אותו מחיר מחירון, אינדקס טוב יותר, חצי מעלות המטמון, וזמן המשימה של 640 שניות הוא הדבר היחיד שכדאי לבדוק מול עומס העבודה שלך לפני שאתה מניח שהשדרוג הוא בחינם. עבור המשימות שדורשות מדידת חזית או עבודת האבטחה שרק דגם הדגל עושה, GPT-6 Astra נותר השלב היחיד שעושה אותן, במחיר של פי 4.5 מהעלות של השלב שמתחתיו.

מה שכדאי לשים לב אליו הוא אם רענון 6.1 מגיע לדרגים האחרים. אם Luna או Astra יקבלו את אותו יחס, צורת הסולם משתנה, ואיתה החשבון לפי משימה במאמר הזה. עד אז, "GPT-6.1" מציין דגם אחד, וההתייחסות אליו כמשפחה היא הדרך שבה צוותים בסופו של דבר משלמים תעריפי פלאגשיפ עבור חילוץ.