כרטיס כותרת שנוצר עבור Claude Opus 5.5 מול GPT-6 Sol, עם כתובית "חצי מהמחיר, עד שההקשר מתארך", עם שני אייקוני קו שטוחים (מסמך וענן) ושורת כותרת תחתונה: "מדד לפי Artificial Analysis במאמץ מרבי; מחירים לפי הספקים." הלוגו האמיתי של OrcaRouter מורכב בפינה הימנית התחתונה.
Guides & Insights

Claude Opus 5.5 מול GPT-6 Sol: בחצי המחיר, עד שההקשר מתארך

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Anthropic ו-OpenAI השיקו דגמי דגל מתחרים באותו אחר הצהריים. Claude Opus 5.5 יצא ב-22 בספטמבר 2026 במחיר של 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט — קיצוץ של 20% בשני הסעיפים לעומת Claude Opus 5. GPT-6 Sol יצא באותו יום במחיר של 2 דולר בקלט ו-10 דולר בפלט, קיצוץ ישיר של 50% לעומת GPT-5.6 Sol, שאותו תיארה OpenAI כקבוע ולא כמבצע קידום מכירות. תקראו רק את שני המשפטים האלה, וההתמודדות נראית מוכרעת עוד לפני שהתחילה: המודל של OpenAI הוא בחצי מחיר, וחצי מחיר הוא חצי מחיר. תקראו את שאר לוחות התעריפים של שניהם, והפער כמעט נסגר — לא מפני שאחת הספקיות שינתה משהו, אלא מפני ששני המודלים גובים תוספת תשלום על אותו סוג בקשה, וזה עולה ל-Sol נתח גדול בהרבה מהיתרון שלה ממה שזה עולה ל-Anthropic.

שני כרטיסי תעריפים, לשניהם יש מדרגה

מתחת ל-272,000 טוקני קלט, זו ההשוואה הפשוטה ביותר בחזית הנוכחית:

• קלט — GPT-6 Sol $2.00 למיליון לעומת Claude Opus 5.5 $4.00

• פלט — GPT-6 Sol $10.00 למיליון לעומת Claude Opus 5.5 $20.00

• קלט שמור במטמון — GPT-6 Sol בערך 90% הנחה על החלק השמור במטמון לעומת Claude Opus 5.5 $0.20 למיליון, מכפיל של 5% על קלט הבסיס

• הקשר ופלט — GPT-6 Sol 872K כפי שנמדד על ידי Artificial Analysis, 1M נטען במקומות אחרים, פלט מקסימלי של 128K לעומת Claude Opus 5.5 1M ו-128K

• מועד חיתוך הידע — Claude Opus 5.5 יוני 2026 לעומת GPT-6 Sol לא צוין באותם מונחים

מעל 272,000 טוקני קלט, החשבון משתנה בשני הצדדים, ולא באותה מידה. GPT-6 Sol מתמחר מחדש את כל הבקשה — לא את העודף, את כל הקריאה — בערך כפול מתעריף הקלט ופי אחד וחצי מתעריף הפלט, ומגיע לסמוך ל-$4.00 בקלט ו-$15.00 בפלט. לכרטיס התעריפים של Claude Opus 5.5 אין מדרגת הקשר ארוך: Anthropic מחייבת $4.00 ו-$20.00 על פני מלוא חלון 1M הטוקנים ומצהירה שבקשה של 900K טוקנים עולה אותו דבר לכל טוקן כמו בקשה של 9K טוקנים.

שימו את אלה יחד והסדר מתהפך במקום בלתי צפוי. בשיחה עם הקשר ארוך, תעריפי הקלט מתכנסים לסביבות $4 בשני המודלים — יתרון המחיר החצי של Sol על הקלט נעלם לחלוטין — בעוד שהפלט מצטמצם מפער של פי 2 לבערך $15 מול $20, יתרון של 25% ולא 50%. Sol עדיין זול יותר. הוא כבר לא זול מספיק כדי להיות המספר היחיד בהחלטה, והסיבה היא ששתי התוספות הן בצורות שונות: המודל של Anthropic גובה תעריף אחיד שבמקרה גבוה יותר, וזה של OpenAI גובה קנס שפוגע הכי חזק בדיוק בעומסי העבודה הסוכניים, של קריאת מאגרים ושל ערכות מסמכים, שעבורם שתי החברות מוכרות את המודלים האלה.

A generated graphic titled 'Two rate cards, one step each', with a subtitle reading 'Above 272,000 input tokens the input rates converge and the output gap narrows to about a quarter.' Two panels compare per-million-token input and output rates: below 272,000 input tokens Claude Opus 5.5 is $4.00 / $20.00 against GPT-6 Sol at $2.00 / $10.00, and above 272,000 input tokens Claude Opus 5.5 stays at $4.00 / $20.00 while GPT-6 Sol moves to approximately $4.00 / $15.00 because the whole call reprices. The footer reads 'Per-million-token rates. Sol's step per OpenAI; Opus 5.5 bills its full 1M window at one rate per Anthropic.'

הציון העצמאי, שהוא ההשוואה היחידה באותם תנאים

A two-column scoreboard comparing Claude Opus 5.5 and GPT-6 Sol across six shared rows: Intelligence Index (58, ranked #1 of 210, against 48, ranked #18), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), output speed (not yet published against 113.3 tokens per second), time to first token (not yet published against 142.74s), knowledge cutoff (Jun 2026 against not stated in the same terms) and long-context step (none against the whole call repriced above 272K). The footer reads 'Index, speed and latency figures per Artificial Analysis at max effort; prices and the 272K step per the vendors.'

אף אחת משתי טבלאות ההשקה לא מכילה את המודל החדש של האחרת — שתיהן נכתבו לפני שההשקות של אותו יום יצאו — ולכן החומר של הספק לא יכול לדרג את שני אלה כלל. ואילו Artificial Analysis כן יכולה, מפני שהיא מריצה כל מודל בתצורה מפורסמת אחת:

• מדד האינטליגנציה — Claude Opus 5.5 58, מדורג במקום ה-1 מתוך 210 לעומת GPT-6 Sol 48, מדורג במקום ה-18

• תווית תצורה — שניהם דורגו במאמץ מרבי; Claude Opus 5.5 תויג בנוסף כ"גיבוי ברירת מחדל"

• מהירות פלט — GPT-6 Sol 113.3 טוקנים/שנייה, מדורג במקום ה-38 לעומת Claude Opus 5.5 שטרם פורסם

זמן עד לאסימון הראשון — GPT-6 Sol ‏142.74 שניות לעומת חציון הטבלה של 3.83 שניות; Claude Opus 5.5 טרם פורסם

• מחיר — GPT-6 Sol ‏$2.00 / $10.00 למיליון לעומת Claude Opus 5.5 ‏$4.00 / $20.00

עשר נקודות מדד ושבעה עשר דירוגים הם הפער הרחב ביותר בכל זיווג נוכחי של Claude מול OpenAI, והוא פועל לרעת המודל הזול יותר בפעם השנייה החודש — אותו דפוס הופיע כאשר GPT-6 Sol פגש את Claude Opus 5 בהשוואה קודמת והפסיד בשלוש נקודות בעלות נמוכה ב-60%. שורת המהירות חותכת לכיוון ההפוך וחשובה יותר ממה שהיא נראית: 113.3 טוקנים בשנייה הם בערך פי שניים ממה שדגם הדגל GPT-6 Astra משיג, וזה הנתון המהיר ביותר בקבוצה הזו. בשילוב עם טוקן ראשון של 142 שניות, הפרופיל הוא של מודל שחושב במשך זמן רב ואז כותב במהירות, מה שהופך אותו להתאמה גרועה לכל דבר אינטראקטיבי ולהתאמה סבירה להרצות ארוכות ללא השגחה.

שני הנתונים נושאים את אותה הסתייגות כמו אלו של הספקים: מדובר במדידות במאמץ מקסימלי, וברירת המחדל שבה נשלחים שני המודלים אינה מאמץ מקסימלי. Claude Opus 5.5 מוגדר כברירת מחדל לבינוני בסולם מאמץ הנע מנמוך עד מקסימום; GPT-6 Sol חושף סולם הנע מאפס עד מקסימום. מדד מאמץ מקסימלי הוא דרך הוגנת להשוות תקרות ודרך מטעה לחזות את החשבונית שלך.

מה נשבר כשמחליפים, בשני הכיוונים

חיכוך ההגירה כאן הוא א-סימטרי וכדאי לדעת עליו לפני כל אחד מהמעברים.

Claude Opus 5.5 אינו תחליף ישיר ל-Claude Opus 5. לא ניתן עוד להשבית את החשיבה, כך שקוד שהגדיר מסלול ללא חשיבה יגרום לשגיאה או ישנה התנהגות בשקט. שימוש כפוי בכלים מחזיר שגיאה. בלוקי חשיבה כרוכים במודל ובשיחה שיצרו אותם, ולכן לא ניתן לשחזר אותם בין מודלים. הכלי הישן יותר computer_20251124 מסוג computer-use אינו מתקבל ב-Claude API או ב-Google Cloud. בנפרד, טקסט בין קריאות לכלים מוחזר כעת בתוך בלוקי חשיבה שריקים בהגדרת התצוגה המוגדרת כברירת מחדל, כך שאפליקציה שמזרימה את הטקסט הזה כהתקדמות פשוט תשתוק בין הקריאות בלי לזרוק דבר.

סולם המאמץ של GPT-6 Sol הוא הגמיש מבין השניים: ניתן לשנות אותו באמצע שיחה בלי לפסול את מטמון הפרומפט, כלומר מעבר ראשון זול וניסיון חוזר יקר על אותו הקשר הם דפוס נתמך ולא דפוס שמנפץ את המטמון. זהו יתרון הנדסי אמיתי לכל מי שמריץ חשיבה מדורגת בתוך סשן יחיד, והוא הטיעון החזק ביותר בעד Sol שאינו מופיע באף טבלת מחירים.

להריץ את שניהם, ולהחליט עם המספרים שלך

העמדה הכנה לגבי ההתמודדות הזו היא שטבלאות הספקים אינן יכולות להכריע בשאלה, ומדד עצמאי קובע רק את התקרה. מה שנותר הוא שאלת עומס העבודה — כמה זמן ההקשרים שלך רצים בפועל, וכמה עולה ניסיון כושל — ואת זה אפשר למדוד בתעבורה שלך, במקום להתווכח עליו מתוך הודעה לעיתונות.

ניתן לנתב את שני המודלים מ-OrcaRouter במחיר המחירון של הספק עם 0% תוספת: GPT-6 Sol במחיר של OpenAI — $2.00 / $10.00, ו-Claude Opus 5.5 במחיר של Anthropic — $4.00 / $20.00. מכיוון שההעברה היא מדויקת והמחירים משתנים ביום שבו הספקים משנים אותם, היחס שאתם מודדים ב-staging הוא היחס שאתם משלמים ב-production, בלי שכבת תוספת שיש לחשב מחדש. מפתח אחד מכסה את שניהם, כך שהכלל לניתוב ששולח קריאות מתחת ל-272K ל-Sol וקריאות עם הקשר ארוך למודל שמנצח בהערכות שלכם הוא שינוי תצורה ולא אינטגרציה שנייה — ומעבר אוטומטי לגיבוי אומר שהשקה באותו יום באחד הצדדים היא משהו שאפשר להפנות אליו חלק מהתעבורה, ולא הימור שאתם עושים עם צינור שלם.

A screenshot of OrcaRouter's own model page for openai/gpt-6-sol, headed 'GPT-6 Sol' and credited to OpenAI, showing a 1M-token context, 128K max output, and a stat strip reading INPUT $2.00 and OUTPUT $10.00 per 1M tokens with a 2.25s p50 time to first token and 4.8M tokens of traffic over 7 days.

הגרסה של זה ששורדת מפגש עם הצעת חוק

GPT-6 Sol הוא המודל הזול יותר בכל שורה, בכל תצורה, ואין על כך מחלוקת. מה שלא שורד הוא ההנחה ש"חצי מחיר" הוא המספר שלפיו יש לתכנן: בקריאה עם הקשר ארוך תעריפי הקלט נפגשים בסביבות $4 ופער הפלט מצטמצם לרבע, וזו החלטה שונה מזו שמתארים דפי ההשקה. שקלו זאת מול פער של עשר נקודות במדד, שבעה-עשר דירוגים, וזמן טוקן ראשון מדוד של 142 שניות, והחלוקה מתבקשת מעצמה עבור רוב עומסי העבודה — Sol כברירת המחדל בנפח גבוה בהקשרים קצרים ובינוניים, Claude Opus 5.5 במקרים שבהם ההקשר מתארך או שהמשימה קשה מספיק עד שניסיון חוזר עולה יותר מהפרש הטוקנים. הטעות שכדאי להימנע ממנה היא לבחור באחד מאלה לפי תעריף הכותרת בלבד, מפני שהמספר השני בכל כרטיס תעריפים הוא שמכריע את המקרה שלשמו נבנו שני המודלים.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית