
Claude Opus 5.5 מול GPT-6 Sol: בחצי המחיר, עד שההקשר מתארך
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 177 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1323 tok/s
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
Anthropic ו-OpenAI השיקו דגמי דגל מתחרים באותו אחר הצהריים. Claude Opus 5.5 יצא ב-22 בספטמבר 2026 במחיר של 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט — קיצוץ של 20% בשני הסעיפים לעומת Claude Opus 5. GPT-6 Sol יצא באותו יום במחיר של 2 דולר בקלט ו-10 דולר בפלט, קיצוץ ישיר של 50% לעומת GPT-5.6 Sol, שאותו תיארה OpenAI כקבוע ולא כמבצע קידום מכירות. תקראו רק את שני המשפטים האלה, וההתמודדות נראית מוכרעת עוד לפני שהתחילה: המודל של OpenAI הוא בחצי מחיר, וחצי מחיר הוא חצי מחיר. תקראו את שאר לוחות התעריפים של שניהם, והפער כמעט נסגר — לא מפני שאחת הספקיות שינתה משהו, אלא מפני ששני המודלים גובים תוספת תשלום על אותו סוג בקשה, וזה עולה ל-Sol נתח גדול בהרבה מהיתרון שלה ממה שזה עולה ל-Anthropic.
שני כרטיסי תעריפים, לשניהם יש מדרגה
מתחת ל-272,000 טוקני קלט, זו ההשוואה הפשוטה ביותר בחזית הנוכחית:
• קלט — GPT-6 Sol $2.00 למיליון לעומת Claude Opus 5.5 $4.00
• פלט — GPT-6 Sol $10.00 למיליון לעומת Claude Opus 5.5 $20.00
• קלט שמור במטמון — GPT-6 Sol בערך 90% הנחה על החלק השמור במטמון לעומת Claude Opus 5.5 $0.20 למיליון, מכפיל של 5% על קלט הבסיס
• הקשר ופלט — GPT-6 Sol 872K כפי שנמדד על ידי Artificial Analysis, 1M נטען במקומות אחרים, פלט מקסימלי של 128K לעומת Claude Opus 5.5 1M ו-128K
• מועד חיתוך הידע — Claude Opus 5.5 יוני 2026 לעומת GPT-6 Sol לא צוין באותם מונחים
מעל 272,000 טוקני קלט, החשבון משתנה בשני הצדדים, ולא באותה מידה. GPT-6 Sol מתמחר מחדש את כל הבקשה — לא את העודף, את כל הקריאה — בערך כפול מתעריף הקלט ופי אחד וחצי מתעריף הפלט, ומגיע לסמוך ל-$4.00 בקלט ו-$15.00 בפלט. לכרטיס התעריפים של Claude Opus 5.5 אין מדרגת הקשר ארוך: Anthropic מחייבת $4.00 ו-$20.00 על פני מלוא חלון 1M הטוקנים ומצהירה שבקשה של 900K טוקנים עולה אותו דבר לכל טוקן כמו בקשה של 9K טוקנים.
שימו את אלה יחד והסדר מתהפך במקום בלתי צפוי. בשיחה עם הקשר ארוך, תעריפי הקלט מתכנסים לסביבות $4 בשני המודלים — יתרון המחיר החצי של Sol על הקלט נעלם לחלוטין — בעוד שהפלט מצטמצם מפער של פי 2 לבערך $15 מול $20, יתרון של 25% ולא 50%. Sol עדיין זול יותר. הוא כבר לא זול מספיק כדי להיות המספר היחיד בהחלטה, והסיבה היא ששתי התוספות הן בצורות שונות: המודל של Anthropic גובה תעריף אחיד שבמקרה גבוה יותר, וזה של OpenAI גובה קנס שפוגע הכי חזק בדיוק בעומסי העבודה הסוכניים, של קריאת מאגרים ושל ערכות מסמכים, שעבורם שתי החברות מוכרות את המודלים האלה.

הציון העצמאי, שהוא ההשוואה היחידה באותם תנאים

אף אחת משתי טבלאות ההשקה לא מכילה את המודל החדש של האחרת — שתיהן נכתבו לפני שההשקות של אותו יום יצאו — ולכן החומר של הספק לא יכול לדרג את שני אלה כלל. ואילו Artificial Analysis כן יכולה, מפני שהיא מריצה כל מודל בתצורה מפורסמת אחת:
• מדד האינטליגנציה — Claude Opus 5.5 58, מדורג במקום ה-1 מתוך 210 לעומת GPT-6 Sol 48, מדורג במקום ה-18
• תווית תצורה — שניהם דורגו במאמץ מרבי; Claude Opus 5.5 תויג בנוסף כ"גיבוי ברירת מחדל"
• מהירות פלט — GPT-6 Sol 113.3 טוקנים/שנייה, מדורג במקום ה-38 לעומת Claude Opus 5.5 שטרם פורסם
זמן עד לאסימון הראשון — GPT-6 Sol 142.74 שניות לעומת חציון הטבלה של 3.83 שניות; Claude Opus 5.5 טרם פורסם
• מחיר — GPT-6 Sol $2.00 / $10.00 למיליון לעומת Claude Opus 5.5 $4.00 / $20.00
עשר נקודות מדד ושבעה עשר דירוגים הם הפער הרחב ביותר בכל זיווג נוכחי של Claude מול OpenAI, והוא פועל לרעת המודל הזול יותר בפעם השנייה החודש — אותו דפוס הופיע כאשר GPT-6 Sol פגש את Claude Opus 5 בהשוואה קודמת והפסיד בשלוש נקודות בעלות נמוכה ב-60%. שורת המהירות חותכת לכיוון ההפוך וחשובה יותר ממה שהיא נראית: 113.3 טוקנים בשנייה הם בערך פי שניים ממה שדגם הדגל GPT-6 Astra משיג, וזה הנתון המהיר ביותר בקבוצה הזו. בשילוב עם טוקן ראשון של 142 שניות, הפרופיל הוא של מודל שחושב במשך זמן רב ואז כותב במהירות, מה שהופך אותו להתאמה גרועה לכל דבר אינטראקטיבי ולהתאמה סבירה להרצות ארוכות ללא השגחה.
שני הנתונים נושאים את אותה הסתייגות כמו אלו של הספקים: מדובר במדידות במאמץ מקסימלי, וברירת המחדל שבה נשלחים שני המודלים אינה מאמץ מקסימלי. Claude Opus 5.5 מוגדר כברירת מחדל לבינוני בסולם מאמץ הנע מנמוך עד מקסימום; GPT-6 Sol חושף סולם הנע מאפס עד מקסימום. מדד מאמץ מקסימלי הוא דרך הוגנת להשוות תקרות ודרך מטעה לחזות את החשבונית שלך.
מה נשבר כשמחליפים, בשני הכיוונים
חיכוך ההגירה כאן הוא א-סימטרי וכדאי לדעת עליו לפני כל אחד מהמעברים.
Claude Opus 5.5 אינו תחליף ישיר ל-Claude Opus 5. לא ניתן עוד להשבית את החשיבה, כך שקוד שהגדיר מסלול ללא חשיבה יגרום לשגיאה או ישנה התנהגות בשקט. שימוש כפוי בכלים מחזיר שגיאה. בלוקי חשיבה כרוכים במודל ובשיחה שיצרו אותם, ולכן לא ניתן לשחזר אותם בין מודלים. הכלי הישן יותר computer_20251124 מסוג computer-use אינו מתקבל ב-Claude API או ב-Google Cloud. בנפרד, טקסט בין קריאות לכלים מוחזר כעת בתוך בלוקי חשיבה שריקים בהגדרת התצוגה המוגדרת כברירת מחדל, כך שאפליקציה שמזרימה את הטקסט הזה כהתקדמות פשוט תשתוק בין הקריאות בלי לזרוק דבר.
סולם המאמץ של GPT-6 Sol הוא הגמיש מבין השניים: ניתן לשנות אותו באמצע שיחה בלי לפסול את מטמון הפרומפט, כלומר מעבר ראשון זול וניסיון חוזר יקר על אותו הקשר הם דפוס נתמך ולא דפוס שמנפץ את המטמון. זהו יתרון הנדסי אמיתי לכל מי שמריץ חשיבה מדורגת בתוך סשן יחיד, והוא הטיעון החזק ביותר בעד Sol שאינו מופיע באף טבלת מחירים.
להריץ את שניהם, ולהחליט עם המספרים שלך
העמדה הכנה לגבי ההתמודדות הזו היא שטבלאות הספקים אינן יכולות להכריע בשאלה, ומדד עצמאי קובע רק את התקרה. מה שנותר הוא שאלת עומס העבודה — כמה זמן ההקשרים שלך רצים בפועל, וכמה עולה ניסיון כושל — ואת זה אפשר למדוד בתעבורה שלך, במקום להתווכח עליו מתוך הודעה לעיתונות.
ניתן לנתב את שני המודלים מ-OrcaRouter במחיר המחירון של הספק עם 0% תוספת: GPT-6 Sol במחיר של OpenAI — $2.00 / $10.00, ו-Claude Opus 5.5 במחיר של Anthropic — $4.00 / $20.00. מכיוון שההעברה היא מדויקת והמחירים משתנים ביום שבו הספקים משנים אותם, היחס שאתם מודדים ב-staging הוא היחס שאתם משלמים ב-production, בלי שכבת תוספת שיש לחשב מחדש. מפתח אחד מכסה את שניהם, כך שהכלל לניתוב ששולח קריאות מתחת ל-272K ל-Sol וקריאות עם הקשר ארוך למודל שמנצח בהערכות שלכם הוא שינוי תצורה ולא אינטגרציה שנייה — ומעבר אוטומטי לגיבוי אומר שהשקה באותו יום באחד הצדדים היא משהו שאפשר להפנות אליו חלק מהתעבורה, ולא הימור שאתם עושים עם צינור שלם.

הגרסה של זה ששורדת מפגש עם הצעת חוק
GPT-6 Sol הוא המודל הזול יותר בכל שורה, בכל תצורה, ואין על כך מחלוקת. מה שלא שורד הוא ההנחה ש"חצי מחיר" הוא המספר שלפיו יש לתכנן: בקריאה עם הקשר ארוך תעריפי הקלט נפגשים בסביבות $4 ופער הפלט מצטמצם לרבע, וזו החלטה שונה מזו שמתארים דפי ההשקה. שקלו זאת מול פער של עשר נקודות במדד, שבעה-עשר דירוגים, וזמן טוקן ראשון מדוד של 142 שניות, והחלוקה מתבקשת מעצמה עבור רוב עומסי העבודה — Sol כברירת המחדל בנפח גבוה בהקשרים קצרים ובינוניים, Claude Opus 5.5 במקרים שבהם ההקשר מתארך או שהמשימה קשה מספיק עד שניסיון חוזר עולה יותר מהפרש הטוקנים. הטעות שכדאי להימנע ממנה היא לבחור באחד מאלה לפי תעריף הכותרת בלבד, מפני שהמספר השני בכל כרטיס תעריפים הוא שמכריע את המקרה שלשמו נבנו שני המודלים.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
