כרטיס כותרת הירו עם הכיתוב "GPT-6 לעומת DeepSeek V4 Pro", עם צ'יפ עם הכיתוב "GPT-6 ב-ChatGPT לכולם 2026-10-07", שתי שורות מחיר עם הכיתוב "GPT-6 Sol $2 / $10" ו-"DeepSeek V4 Pro $0.66 / $1.98 שיא", צ'יפ עם הכיתוב "DeepSeek: משקולות MIT, פלט מקסימלי 384K", וכותרת תחתונה עם הכיתוב "פריטים שדווחו על ידי הספק מסומנים בטקסט; נתוני מדד לפי Artificial Analysis." הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

GPT-6 נגד DeepSeek V4 Pro: אחד שאפשר לשכור מכל אחד, ואחד שאפשר לקחת הביתה

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

יש בדיוק דבר אחד שאפשר לעשות עם DeepSeek V4 Pro שאי אפשר לעשות עם GPT-6 Sol: לקחת אותו הביתה. DeepSeek V4 Pro הוא דגל מסוג mixture-of-experts ברישיון MIT — 1.6 טריליון פרמטרים בסך הכול, 49 מיליארד פעילים לכל טוקן — שיצא לאור ב-13 באוגוסט 2026, וה-checkpoint שלו ניתן להורדה. GPT-6 Sol הוא משקולות סגורות, שהושק על ידי OpenAI ב-22 בספטמבר 2026, ונכון ל-7 באוקטובר 2026 הוא גם המודל שנמצא מתחת למסלולים בתשלום של ההשקה העולמית של ChatGPT ביותר מ-1.2 מיליארד משתמשים שבועיים.

כל השאר בהשוואה הזאת הוא עניין של באיזה מכשיר מדידה אתה קורא. בלוח התעריפים השניים רחוקים זה מזה פי ארבעה. לפי מה שזה באמת עלה כדי לייצר תשובה מוגמרת בחבילת ההערכה העצמאית, הם רחוקים זה מזה פי 1.55. ב-Intelligence Index השורות נראות רחוקות זו מזו בשש עשרה נקודות, ולפי המתודולוגיה המתועדת של המעריך עצמו, אין לגרוע ביניהן כלל. לפענח איזה מבין שלושת המספרים האלה אמור להנחות החלטה — זו כל העבודה, והתשובה שונה בהתאם לשאלה אם אתה בוחר ספק או בוחר קובץ.

מהו כל מודל, בפסקה אחת לכל אחד

GPT-6 Sol הוא שכבת הביניים בקו GPT-6 של OpenAI — מתחת לספינת הדגל GPT-6 Astra, ומעל ל-GPT-6 Luna החסכוני — עם חלון הקשר של 1,050,000 טוקנים, תקרת פלט של 128,000 טוקנים, קלט טקסט, תמונה וקבצים, תמיכה מובנית בקריאת כלים, פלטים מובנים, ומאמץ חשיבה שניתן לבחור בחמש רמות, מ־low ועד max. זוהי השכבה שאליה OpenAI מנתבת את ChatGPT Plus, Pro, Business ו-Enterprise, ומחירה עומד על $2.00 למיליון טוקני קלט ו-$10.00 למיליון טוקני פלט, עם שכבת הקשר ארוך שמתמחרת מחדש את כל הבקשה ב-$4.00 ו-$15.00 ברגע שהפרומפט עובר 272,000 טוקני קלט.

DeepSeek V4 Pro הוא דגם דגל טקסטואלי בלבד עם חלון של 1,048,576 טוקנים ופלט מקסימלי של 384,000 טוקנים — פי שלושה מהתקרה של GPT-6 Sol — וללא ראייה בשום מחיר. התיעוד של ה-API של DeepSeek עצמה מפרט אותו ב-$0.66 למיליון טוקני קלט ו-$1.98 למיליון טוקני פלט בשעות שיא, ובשעות שפל מוחצים ל-$0.33 ו-$0.99, עם פגיעות מטמון ב-$0.022 בשעות שפל. שעות השיא הן 01:00–04:00 ו-06:00–10:00 UTC בימי חול; כל השאר, כולל סופי שבוע וחגים ציבוריים בסין, נחשב לשעות שפל.

שלושת המטרים

התחל עם זה שמצוטט ביותר, כי הוא זה שמצוטט לרוב בלי ההקשר שלו. Artificial Analysis מעניקה ל-DeepSeek V4 Pro ציון 36.0 ול-GPT-6 Sol ציון 47.6 במדד Intelligence Index v4.3.2. אחת עשרה וחצי נקודות הן פער מהסוג שמסיים השוואה.

זה לא צריך, והמעריך אומר זאת בעצמו. Artificial Analysis משווה מודלים עם משקולות פתוחות רק כנגד מודלים אחרים עם משקולות פתוחות באותו גודל, עם הגבול ב-150 מיליארד פרמטרים, ומודלים קנייניים כנגד מודלים קנייניים בטווח מחירים ביחס משולב של 3:1 בין קלט לפלט. אלה שתי קבוצות השוואה שונות שמייצרות שני סולמות שונים. 36 ו-47.6 יושבים בשורות סמוכות באותה טבלה אינם השוואה ראש בראש, והמהלך הכנה הוא לומר זאת במקום לחסר אחד מהשני ולקרוא לזה יכולת.

A screenshot of the Artificial Analysis leaderboard showing the rows around DeepSeek V4 Pro, with MiMo-V2.6-Flash at 38 and $0.06 per index task, Claude Haiku 5.5 (high) at 38 and $0.08, and DeepSeek V4 Pro 0813 (max) at 36 and $0.67, each row carrying its creator, index, cost per task, output speed and latency columns.

שני המטרים הניתנים להשוואה אומרים משהו שימושי יותר:

• מחיר משוקלל ביחס 3:1 — GPT-6 Sol 4.00$ לכל 1M לעומת DeepSeek V4 Pro 0.99$ בתעריפי שיא, או 0.50$ בשעות שפל; פער של פי 4 עד פי 8 בהתאם למועד ההרצה
• עלות לכל משימת אינדקס שהושלמה — GPT-6 Sol 1.04$ לעומת DeepSeek V4 Pro 0.67$; פער של פי 1.55
• אסימוני פלט שנוצרו בכל הסוויטה — GPT-6 Sol 76.8M לעומת DeepSeek V4 Pro 162.9M, כך שהמודל כותב פי 2.1 יותר כדי לסיים את אותה עבודה
• פלט מקסימלי — DeepSeek V4 Pro 384,000 אסימונים לעומת GPT-6 Sol 128,000; תקרה של פי 3
• קלט מולטימודלי — GPT-6 Sol מקבל טקסט, תמונות וקבצים לעומת DeepSeek V4 Pro טקסט בלבד
• משקולות — DeepSeek V4 Pro ברישיון MIT וניתן להורדה לעומת GPT-6 Sol סגור

A two-column comparison scoreboard for GPT-6 Sol and DeepSeek V4 Pro, showing GPT-6 Sol at an Intelligence Index of 47.6, $1.04 per index task and a 128,000-token output ceiling, against DeepSeek V4 Pro at 36.0, $0.67 and 384,000 tokens, with input and output prices of $2.00/$10.00 against $0.66/$1.98 and an MIT-weights row. A footer reads "Index figures per Artificial Analysis v4.3.2; row scored in different peer groups, not subtractable."

השורות הרביעית והחמישית מסבירות את השורה השנייה. פער של 4× בכותרת שמצטמצם ל-1.55× בעבודה אמיתית הוא מה שקורה כשהמודל הזול יותר הוא גם המילולי יותר: DeepSeek V4 Pro הפיק 2.1× טוקני פלט מאשר GPT-6 Sol באותו סט הערכה. מילוליות היא מכפיל עלות שלעולם לא מופיע בדף מחירים, והוא המספר היחיד שהכי פחות קוראים בהתמודדות הזו.

היכן שהמודל הפתוח באמת מנצח

שני מקומות, ושניהם מבניים ולא שוליים.

תקרת הפלט היא הראשונה. 384,000 טוקנים לעומת 128,000 הם הבדל של פי שלושה, והוא קובע קטגוריות שלמות של עבודה: יצירת תוצר מובנה גדול בקריאה אחת, כתיבת מסמך ארוך בלי שרשור, והפקת ריפקטור גדול בתגובה אחת. GPT-6 Sol לא יכול לעשות זאת בשום מחיר, כי המגבלה אינה דרגת חיוב — היא המקסימום של המודל.

שימוש בכלים אייג'נטיים הוא השני, לפי מדידה אחת ספציפית. DeepSeek V4 Pro משיג 96.2% ב־τ²-Bench, הערכת השימוש בכלים אייג'נטיים, וזה הנתון ש־DeepSeek מציגה בראש הכרטיס שלה. זה גם המספר שערך הקטלוג של המודל ב־OrcaRouter חוזר עליו, וזו הגרסה של הטענה שהקוראים שלנו עצמם יפגשו. הנתון הדומה של GPT-6 Sol ב־τ²-Bench אינו מפורסם באותו לוח, אז יש להתייחס להשוואה כאל כיוונית: במדד היחיד ש־DeepSeek בחרה להציג בכותרת, המודל הפתוח נמצא בראש התחום, והמודל הסגור לא הציב מספר באותה עמודה.

ולזה של הבעלות, שהוא בכלל לא מדד. צ'קפוינט MIT להורדה אומר שאתם יכולים להריץ את המודל על החומרה שלכם, להחזיק בקשה מחוץ לרשת של כל אחד אחר, לכוונן אותו, לנעוץ גרסה ולדעת שהיא עדיין תהיה שם בעוד שלוש שנים. אף ספק לא יכול להוציא אותו משימוש, לתמחר אותו מחדש או להוריד אותו ממחירון. עבור סוג מסוים של קונים — תעשיות מפוקחות, כל מי שמוגבל במיקום הנתונים, כל מי שכבר נכווה מסגירתו של מודל — זה שווה יותר מאחת עשרה נקודות מדד.

היכן ש-GPT-6 Sol מנצח, וזה לא רק המדד

Terminal-Bench 4.0 הוא השורה הפחות מחמיאה בכרטיס של DeepSeek V4 Pro: 14.1% לעומת 43.9% של GPT-6 Sol. זה לא הבדל של עיגול ספרות, והוא מצביע על פרופיל אמיתי — המודל הפתוח חזק בתזמור כלים רב-תורי וחלש בעבודת טרמינל לטווח ארוך, זו שסוכני קידוד מודרניים בנויים ממנה. אם עומס העבודה שלך הוא סוכן שצריך להחזיק סשן shell יציב למשך עשרים דקות, הערכה בודדת זו מנבאת את החוויה שלך טוב יותר מאשר המדד המשולב.

מולטימודאליות היא השנייה. DeepSeek V4 Pro הוא טקסט־נכנס, טקסט־יוצא. GPT-6 Sol קולט תמונות וקבצים, וזה לא סתם תיבת סימון ברשימת תכונות — עבודה מקצועית עמוסת מסמכים פירושה צילומי מסך, עמודים סרוקים, תרשימים וקובצי PDF, ומודל טקסטואלי בלבד לא יכול להיכנס לקטגוריה הזאת בכלל.

הדבר השלישי הוא מה שקרה השבוע. GPT-6 נחת בלשונית Chat של ChatGPT עבור Plus, Pro, Business ו-Enterprise ב-7 באוקטובר, כאשר Free ו-Go הגיעו בעקבותיו מ-8 באוקטובר, כשהוא נושא יכולת ש-Ope​nAI מכנה Intelligent UI — תשובות שמרכיבות טקסט, גרפיקה, תרשימים, טפסים ופקדים ניתנים להקשה לכל שאלה, במקום להסתמך כברירת מחדל על פרוזה. זהו משטח, לא תכונת API, והוא אינו משנה אף שורה בקוד האינטגרציה שלכם. מה שכן משתנה הוא ברירת המחדל הסביבתית: המודל שהצוות שלכם כבר מחזיק פתוח בלשונית דפדפן הוא כעת GPT-6, ועבודת אב-טיפוס נודדת לעבר המודל שאליו אפשר להגיע בלי מפתח. על פי דיווח הספק וללא שחזור, Ope​nAI גם טוענת ש-GPT-6 ב-Extra High מתחיל להשיב במהירות של GPT-5.6 ב-Medium, ושהגרסה GPT-6 Instant מתחילה להשיב 44% מוקדם יותר בשאלות המבוססות על חיפוש.

להריץ אחד, או להריץ את שניהם

הסיבה לכך שהצירוף המסוים הזה קל יותר לגידור מאשר רוב הצירופים היא ששני המודלים יושבים על אותו קטלוג. OrcaRouter מנתב את GPT-6 Sol ואת DeepSeek V4 Pro — יחד עם יותר מ-200 מודלים אחרים — דרך נקודת קצה אחת תואמת Ope​nAI במפתח אחד, בתוספת של 0% מעל מחיר המחירון של הספק. העברת המחיר הזו היא מה שהופך את מבנה שעות השיא/שעות השפל לקריא ולא למסתורי: ההפחתה בחצי בשעות השפל של Dee​pSeek היא של הספק, אנחנו לא נוגעים בה, וכשספק מתמחר מחדש, השינוי פעיל כאן באותו יום.

זה גם המקום שבו החלטת חלון השיא הופכת להחלטת ניתוב. התעריף של DeepSeek V4 Pro מחוץ לשעות השיא הוא מחצית מתעריף השיא, וחלונות השיא הם שעות UTC קבועות. כדאי לתזמן משימת אצווה שיכולה לזוז סביבם, וכדאי להרחיק מהם מסלול רגיש להשהיה. כששני המודלים מאחורי מפתח אחד, הפיצול הוא קונפיגורציה ולא חוזה ספק שני: נתבו עבודה בכמות גדולה ופלט ארוך ל-DeepSeek V4 Pro מחוץ לשיא, נתבו את התעבורה הרב-מודלית ועתירת החשיבה ל-GPT-6 Sol, ותנו למעבר כשל אוטומטי לכסות מגבלת קצב בכל צד במקום לגלות אותה בסביבת הייצור.

A screenshot of the OrcaRouter model page for openai/gpt-6-sol, showing the OpenAI vendor label, a 2026-09-22 release date, a 1.05M-token context window, a 128K-token maximum output, text, image and file input and tool calling, and pricing of $2.00 per million input tokens and $10.00 per million output tokens.

מה שלמעשה הייתי עושה

אם אתם זקוקים לתמונות, לקבצים או לציון חשיבה פורצת דרך ואתם קונים API, GPT-6 Sol הוא התשובה ואחת-עשרה נקודות האינדקס הן ברובן לא לעניין — שער המולטימודאלי מכריע את הכף לפני שהבנצ'מרקים מקבלים זכות הצבעה. אם אתם זקוקים לפלט של 384,000 טוקנים, לרישיון שאפשר להחזיק, לפריסה מקומית, או לעלות הנמוכה ביותר לכל משימה שהושלמה בלוח, DeepSeek V4 Pro מנצח ופער האינדקס הוא קבוצת ההשוואה של מישהו אחר.

מה שלא הייתי עושה הוא לקרוא ל־36 מול 47.6 כפער ביכולות ולקנות על סמך זה. המדדים בני־ההשוואה — $0.67 מול $1.04 למשימה, ופער מילוליות של פי 2.1 שמסתתר בתוך פער כותרת של פי 4 — מספרים סיפור מדויק יותר משורות האינדקס, והם אלה שמופיעים בחשבונית.

הדבר הבא שכדאי לעקוב אחריו הוא אם Dee​pSeek יסגור את הפער ב-Terminal-Bench ברענון של V4 Pro, מפני שזו המדידה היחידה שבה המודל הפתוח נראה באמת מאחור ולא כאילו קיבל ציון שונה. GPT-6, מצדו, פשוט הפסיק להיות בחירה והפך לברירת מחדל, וקשה להתווכח עם ברירות מחדל גם כשהבנצ'מרק אומר אחרת.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית