'הירו של ההשוואה Nex-N2.5 Pro נגד GPT-5.6 Sol' — כרטיס כותרת שנוצר, הנושא את הכיתוב 'Nex-N2.5 Pro נגד GPT-5.6 Sol', עם כותרת משנה 'מודל פתוח בן יום אחד מול שיא הייצור העמוק ביותר בענף' וכותרת עליונה 'OpenAI נגד Nex-AGI — ספטמבר 2026'.
Guides & Insights

Nex-N2.5 Pro לעומת GPT-5.6 Sol: נתון היצרן של החדש מפגר אחרי הנתון העצמאי של הוותיק

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

קחו את המדד היחיד שבו לשניהם יש מספר זה לצד זה, וסדר הפעולות שגוי לצורך השקה. כרטיס המודל של Nex-AGI מעניק ל־Nex-N2.5 Pro ציון 56.4 ב־OSWorld-2, שנמדד על גבי רתמת ה־NexCUA של הברית עצמה, שהציבור לא ראה. לוח התוצאות של OSWorld 2.0 של BenchLM, שעודכן ב־29 באוגוסט, מציב את GPT-5.6 Sol על 62.6 — ציון בלתי־תלוי שמנצח את ציון היצרן של החדש באופן מוחלט. במגרש הביתי של המודל בן היום — שימוש במחשב המבוסס על קריאת מסך, הדבר היחיד שלשמו הוא תוכנן — הגנרליסט הבוגר שאליו הוא מושווה לא צריך אפילו כוכבית כדי להקדים. ההתמודדות בין Nex-N2.5 Pro ל־GPT-5.6 Sol אינה תחרות צמודה בשום ממד שנמדד על ידי מישהו אחר מלבד יצרן החדש. זהו מקרה בוחן של מה שווה רקורד ייצור, והוא שווה קריאה רק בשל כך.

שני המודלים הם בקושי יריבים בכוונתם. {{1}}Nex-N2.5 Pro{{/1}}, שהוכרז ב-8 בספטמבר 2026, הוא מודל sparse mixture-of-experts בעל 397 מיליארד פרמטרים, עם כ-17 מיליארד פרמטרים פעילים, מולטי-מודאלי (טקסט ותמונה כקלט, טקסט כפלט), שאומן לאחר מכן מהשושלת של Qwen3.5, ונבנה כדי להפעיל מחשבים ודפדפנים באמצעות לולאת משוב חזותית. משקלי ה-Apache-2.0 שלו עדיין מסומנים כ"בקרוב" ב-Hugging Face, והמבנים הפעילים היחידים שלו הם נקודות קצה מתארחות בחינם ש-Nex-AGI מקשר מכרטיס המודל. {{2}}GPT-5.6 Sol{{/2}} הוא דגל OpenAI עבור "העבודה הקשה ביותר" — חשיבה עמוקה ורב-שלבית, הנדסת תוכנה רחבת היקף, וזרימות עבודה סוכנתיות ארוכות טווח — זמין ב-API מאז 9 ביולי, במשקלים סגורים, וכעת נושא את הנטל של היותו נקודת ההתייחסות הגבולית עד ש-OpenAI שחררה את {{3}}GPT-6 Astra{{/3}} ב-3 בספטמבר. בעוד {{4}}Nex-N2.5 Pro{{/4}} הוא מומחה שעוד לא שחרר משקלים משלו, {{5}}GPT-5.6 Sol{{/5}} הוא כלליסט מוכח שנמצא בשימוש כבר חודשיים תחת תעבורת הייצור התובענית ביותר בענף.

GPT-5.6 Sol הוא המודל עם קובץ

התחל עם מה שיש לסול שאין לנקס-N2.5 פרו: רקורד. מאז ה-9 ביולי, GPT-5.6 סול עבר בדיקות במסגרות עצמאיות, הותקף על ידי חוקרי אבטחה, ונקלט במסגרות סוכן ובזרימות עבודה של Codex. המדידות העצמאיות שלו עמוקות ופומביות: 61 במדד הבינה של Artificial Analysis בנימוק מקסימלי, 88.0 ב-Terminal-Bench 2.1 ו-73.0 ב-DeepSWE שנמדדו על ידי אותה מסגרת עצמאית, ומהירות פלט שנמדדה בסביבות 71 אסימונים לשנייה בעלות של כ-0.95 דולר למשימת מדד הבינה. שום דבר מזה לא הופך אותו לבלתי מנוצח — OpenAI הציבה מאז את GPT-6 אסטרה מעליו — אבל כל אחד מהמספרים האלה הוא מדידה שאדם שאינו מ-OpenAI הפיק. לנקס-N2.5 פרו אין כניסה עצמאית בשום מקום, מסיבה מבנית: אף אחד מחוץ לברית לא יכול להריץ אותו.

המדד היחיד שבו לשניהם יש מספר

ההשוואה ל-OSWorld היא הקריאה הנקייה ביותר הזמינה, ולכן מגיע לה שיצוינו הסייגים שלה לפני שמשתמשים בה. הציון 56.4 של Nex-N2.5 Pro הוא מדידה עצמית של Nex-AGI על OSWorld-2 דרך ה-harness של NexCUA. הציון 62.6 של GPT-5.6 Sol מגיע מלוח התוצאות של BenchLM עבור OSWorld 2.0, תמונת מצב של צד שלישי מ-29 באוגוסט 2026, המונה חמישה עשר דגמים ומציבה את Claude Opus 5 במקום הראשון עם 70.6, את GPT-5.6 Sol במקום השני עם 62.6, ואת GPT-5.6 Terra במקום השלישי עם 50.2. "OSWorld-2" ו-"OSWorld 2.0" הם קרובי משפחה אך לא הוכח שהם זהים, ולכן יש לקרוא את הפער המדויק של ארבע עד שש נקודות ככיווני ולא מדויק. מה ששורד את הסייגים הוא סדר הערכים: לפי המספר הטוב ביותר שכל צד יכול להציג, ציון Sol עצמאי גבוה מציון Nex של ספק במדד ש-Nex בחרה לפרסם. חדש שמספרו שלו נמוך מהמספר העצמאי של בעל התפקיד הנוכחי לא מציג טיעון משכנע למעבר.

A two-column scoreboard titled 'Nex-N2.5 Pro vs GPT-5.6 Sol — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; Weights Apache-2.0 pending; OSWorld 2.0 56.4 vendor-reported; AA Index no score yet; Context 262,144; Price free hosted / no list. Right column GPT-5.6 Sol: Released Jul 9 2026; Weights closed; OSWorld 2.0 62.6 independent; AA Index 61 (max); Context ~1.05M; Price $4.00 / $20.00 per 1M. Footer: 'Nex figures vendor-reported via NexCUA harness; Sol OSWorld per BenchLM Aug 29 and Index per Artificial Analysis.'

מעטפות מפרט

שאר דף המפרט ממשיך באותו כיוון:

שוחרר — Nex-N2.5 Pro: 8 בספטמבר 2026 (נקודות קצה מתארחות פעילות, משקלים בהמתנה). GPT-5.6 Sol: 9 ביולי 2026, בזמינות כללית.

קנה מידה — Nex-N2.5 Pro: 397B סה"כ / ~17B פעיל MoE. GPT-5.6 Sol: מספר הפרמטרים לא פורסם.

מודאליות — Nex-N2.5 Pro: קלט טקסט ותמונה, פלט טקסט, לולאת ראייה לשימוש במחשב. GPT-5.6 Sol: קלט טקסט, תמונה וקבצים, פלט טקסט, עם קריאות לכלים ומצב JSON.

הקשר / פלט — Nex-N2.5 Pro: הקשר של 262,144 טוקנים. GPT-5.6 Sol: הקשר של ~1.05M טוקנים, תקרת פלט של 128K.

בקרת חשיבה — Nex-N2.5 Pro: ללא / בינוני (אדפטיבי, ברירת המחדל) / גבוה. GPT-5.6 Sol: מאמץ החשיבה עד למקסימום, בתוספת שכבת עיבוד מהירה נפרדת.

משקלים — Nex-N2.5 Pro: Apache-2.0, בקרוב. GPT-5.6 Sol: סגור.

מחיר לכל 1M טוקנים — Nex-N2.5 Pro: שכבת אירוח חינמית, ללא מחירון. GPT-5.6 Sol: $4.00 / $20.00 מחירון מבצעי מאז 21 באוגוסט, $0.40 עבור קלט במטמון, דירוג מחדש ל-$8.00 / $30.00 מעל 272K טוקני קלט.

ההקשר של ~1.05M טוקנים ותקרת הפלט של 128K של Sol מאפילים על חלון ה-262K של Nex-N2.5 Pro בעבודה ארוכת טווח, והמחיר של Sol, אף שאינו זול, הוא מספר יציב שתקציב יכול לתכנן לפיו. השכבה החינמית של Nex-N2.5 Pro היא המספר היחיד שעומד לצדה, והוא אינו מחיר.

מה שוויו של ציון בן יום

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

כל טענת אמת-מידה שמצורפת ל־Nex-N2.5 Pro — OSWorld-2 עם 56.4, Terminal-Bench 2.1 עם 82.7, SWE-Bench Pro עם 61.2, BrowseComp עם 89.7 — חולקת תכונה אחת: Nex-AGI הפיקה אותה, באמצעות רתמה שהברית אומרת שתפתח כתוכנת קוד פתוח אך עדיין לא עשתה זאת. אף אחד מהנתונים האלה לא שוחזר באופן בלתי-תלוי, מכיוון שאף אחד מהם לא ניתן לשחזור: המשקולות אינן זמינות להורדה, ושום תאריך לא מצורף לבאנר "בקרוב". זה חשוב יותר בהתמודדות הזאת מאשר ברוב ההתמודדויות, כי המודל ש־Nex-N2.5 Pro מושווה אליו הוא בעל הרקורד הבלתי-תלוי הארוך ביותר בתעשייה. כאשר בסיס הראיות כולו של המתמודד מבוסס על דיווח עצמי ושל הוותיק אינו כזה, נטל ההוכחה מוטל כולו על המתמודד, ונקודת קצה חינמית אינה פוטרת אותו. ברגע שהשברים יונחתו ומעבדה בלתי-תלויה תריץ את Nex-N2.5 Pro, המספרים במאמר הזה יהפכו לניתנים לבדיקה וההשוואה תהפוך לאמיתית. עד אז, "ציון בן יום" הוא המונח המדויק — ציון שאי אפשר לבחון על מודל שאי אפשר להריץ.

מחיר, מסלול וצורת ההחלטה

העלות היא התחום שבו שני הצדדים הכי פחות ניתנים להשוואה, כי רק לצד אחד יש עלות. התעריף של GPT-5.6 Sol — $4.00 / $20.00 — הוא המחיר המבצעי של OpenAI בהתאם למחירון, שנכנס לתוקף ב־21 באוגוסט וצפוי להימשך לפחות עד 21 בנובמבר, ירידה מ־$5.00 / $30.00. קיצוץ שהפך את דגם הדגל לזול משמעותית עבור עבודה סוכנותית בנפח גבוה, וקיצוץ שראוטר במעבר ישיר (pass-through) משקף באותו היום שבו OpenAI מבצעת אותו. Sol זמין ב־OrcaRouter במחיר המחירון הזה, ללא תוספת מחיר, עם שכבת ה־batch ושכבת ה־fast הזמינות תחת אותו מפתח API כמו 200+ מודלים אחרים, כך שצוות יכול לנתב את הבקשות הזקוקות לעומק של OpenAI אל Sol, ואת המודלים הזולים יותר אל כל השאר. ל־Nex-N2.5 Pro אין מחיר מחירון, אלא רק נקודות קצה מתארחות בחינם — וזו דרך מצוינת להעריך מודל, אך בסיס גרוע לתקציב ייצור. אי אפשר לתכנן הוצאה סביב מספר שלא קיים, ואי אפשר לתכנן ארכיטקטורה סביב משקלים (weights) שטרם שוחררו.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), marked FEATURED, showing the header stats $4.00 input and $20.00 output per million tokens and the byline 'by OpenAI - 2026-07-09'.

ההכרעה שהתמודדות זו כופה היא למעשה שאלה של סיכון, לא של יכולת. אם אתם צריכים מודל שעדיין יהיה שם ברבעון הבא, עם מחיר ידוע, פרופיל תקלות ידוע, וחודשים של בדיקות יריבות מאחוריו, GPT-5.6 Sol הוא הבחירה הרציונלית — והעובדה ש-OpenAI משיקה את GPT-6 Astra כמודל שמעליו רק מחזקת את הטיעון, כי Sol הוא כעת סוס העבודה המוכח, עם קיצוץ המחיר שמכוון היישר לנפחי פרודקשן. אם אתם בונים סוכני שימוש במחשב על בסיס משקלים פתוחים ויכולים להרשות לעצמכם לחכות למשהו שניתן לאימות, Nex-N2.5 Pro שווה מעקב — מומחה מולטי-מודאלי עם 17B פרמטרים פעילים הוא בדיוק הסוג של מודל שחתר שוב ושוב מתחת למחירים של החזית הסגורה. אבל מילת המפתח היא 'מעקב'. בכל ממד שנמדד על ידי כל גורם שאינו היצרן שלו, Nex-N2.5 Pro מפגר אחרי המודל שמאחוריו התיעוד, ועד שהמשקלים ישוחררו, שם ההשוואה מסתיימת.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית

© 2026 OrcaRouter

לספקים

מפעילים פלטפורמת הסקה (inference)? הציגו את המודלים שלכם ב-OrcaRouter.

providers@orcarouter.ai

הצטרפו לקהילה שלנו

Discordsupport@orcarouter.aiXGitHubYouTube