
Claude Opus 5.5 נגד GPT-6.1 Sol: פער שווי המנוי של פי 5, נמדד
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 150 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 127 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 202 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 229 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
במאתיים דולר בחודש אפשר לרכוש או מושב Claude Max 20x או מושב ChatGPT Pro 200. באותו עומס עבודה אג'נטי, אחד מהם מניב $11,726 בחודש בטוקנים שקולים ל-API של צד ראשון, והאחר מניב $2,084 — פער של פי 5.6 בין Claude Opus 5.5 ל-GPT-6.1 Sol. אף אחד מהמודלים האלה אינו מה שהופך את זה לחדשות, ואף אחד מהם אינו חדש: Claude Opus 5.5 שוחרר ב-22 בספטמבר 2026 ו-GPT-6.1 Sol ב-29 בספטמבר 2026, כך שהמודלים עצמם בני שבועיים ושבוע, בהתאמה. מה שחדש הוא שלכלכלת המנויים של הפעלתם יש כעת מספר מדוד, שפורסם על ידי SemiAnalysis ב-5 באוקטובר 2026 — יום אחד לפני הכתבה הזו — לאחר שהחברה בנתה שיטה לתמחור מגבלות שהספקים אינם מפרסמים.
הנתון הכותרתי מסתובב ב-X מאז ערב ה-5 באוקטובר, בדרך כלל כשמסירים ממנו את ההסתייגויות. לכן ההסתייגויות מובאות כבר בהתחלה, כי המספר חסר ערך בלעדיהן. כל ערך בתרשים שלמטה הוא המודל של פרסום מחקרי אחד למדדים פרטיים של מישהו אחר, הנמדדים על פני צורת עומס מוגדרת ומדווחים כטווח, ולא כבנצ'מרק מבוקר. מחירי התוכניות הם מחירי המחירון המפורסמים של התוכניות עצמן. ציוני היכולות המוזכרים בהמשך הם של Artificial Analysis, בתצורות נקובות בשם.מנויים — צורת חיוב עם כללים משלה — ולא על מה שכל אחד מהמודלים עולה לכל טוקן, שהיא שאלה אחרת שיש לה תשובה.
איך מתמחרים תוכנית שאי אפשר לראות את תוכה
גם Anthropic וגם OpenAI מציגות את השימוש במנוי כמד באחוזים, לא כמחיר. קיים חלון של חמש שעות ומגבלה שבועית, ואין חשבונית לכל בקשה. הספקיות מבדילות בין המסלולים באמצעות מכפילים ביחס לתוכניות האחרות שלהן — השמות Max 5x ו-Max 20x של Claude ניתנו להם פשוטו כמשמעו לפי מיקומם לעומת Pro, והמסלולים של ChatGPT שווקו באותו אופן, עד ש-OpenAI הסירה את ניסוח השימוש היחסי מדף התמחור שלה.
לכן לאותו מסלול יש ערך שונה בהתאם למודל שעליו מוציאים אותו, כי קרדיט שנצרך על ידי אסימון קלט שמור במטמון וקרדיט שנצרך על ידי אסימון פלט אינם מתומחרים באותו יחס שבו הספקים גובים ב-API. זו כל התזה של התרגיל: אי אפשר לומר שמסלול שווה $X בפני עצמו. צריך את המסלול, המודל ועומס העבודה יחד.
השיטה של SemiAnalysis ראויה לתיאור משום שהיא קובעת כמה משקל יכולים המספרים לשאת. החברה מריצה קריאות חוזרות שנועדו לבודד סוג טוקן אחד בכל פעם — קטע מתוך מלחמה ושלום עם תג אקראי לכל קריאה עבור קלט שאינו במטמון, אותה הנחיה מסומנת לקישון עבור כתיבות למטמון, תג קבוע עבור קריאות מהמטמון, ומסה טכנית ארוכה כדי לאלץ פלט. כל קריאה מתעדת טוקנים שחויבו על ידי הספק ואת מיקום מד השימוש. מכיוון שבקשה בודדת לעיתים נדירות מזיזה את המד בכלל, הם מודדים בצעדים: סך הטוקנים בין שתי תזוזות של המד נותן את העלות של יחידת מד אחת, צעדים חלקיים בכל קצה נזרקים, והצעדים מצטברים עד שהטווח נמצא בתוך ±5%. קריאות מהמטמון שאינן מזיזות את המד לאחר 500 מיליון טוקנים מטופלות כחינם. תמהיל העומסים מגיע אפוא מיחסי השימוש של החברה עצמה מספטמבר, והערך הוא קיבולת הטוקנים המתקבלת כפולה במחיר ה-API המפורסם של הספק עבור כל סוג טוקן.
הממצא המעניין ביותר בפרק המתודולוגיה אינו עוסק בנדיבותה של אף אחת משתי המעבדות. בעת אימות, SemiAnalysis גילתה שאחד משלושה חשבונות שבחנה באותו מסלול היה בעל מגבלות נמוכות בכ-20% מהשניים האחרים — חשבון ישן יותר. הספק אישר שזה היה מבחן A/B "קטן במיוחד" על מגבלות, והדגיש שלא קיצץ את המגבלות באופן גורף. שני החלקים של זה חשובים: זה מוכיח שאפשר להזיז מגבלות מנוי בשקט בכל עת, וזה מוכיח שהשיטה רגישה מספיק כדי לזהות שינוי של 20% כשהוא מתרחש.
מה מחזירה כל דרגה, ב־$200, $100 ו־$20
שלוש דרגות, שתי המעבדות, עומס עבודה סוכני, שווי מקביל ל-API לחודש לפי תעריפי מחירון רשמיים של הספק:
• $200 בחודש — Claude Opus 5.5 ב-Max 20x מחזיר $11,726 — פי 58.6 מדמי המנוי בטוקנים בשווי API; GPT-6.1 Sol ב-ChatGPT Pro 200 מחזיר $2,084 — פי 10.4 מדמי המנוי. יחס: פי 5.6.
• 100$ לחודש — Claude Opus 5.5 ב-Max 5x מניב 5,725$ (פי 57.3 מדמי המנוי); GPT-6.1 Sol ב-ChatGPT Pro 100 מניב 1,055$ (פי 10.6 מדמי המנוי). יחס: פי 5.4.
• 20$ לחודש — Claude Opus 5.5 ב-Claude Pro מניב 1,178$ (פי 58.9 מהעמלה); GPT-6.1 Sol ב-ChatGPT Plus מניב 211$ (פי 10.6 מהעמלה). יחס: פי 5.6.
העובדה ששלוש השכבות נופלות בין 5.4x ל-5.6x היא הממצא, ולא הסכומים הבודדים. ההשוואה נערכת על השכבה הבינונית של הקטלוג של כל מעבדה — המודל ששתי הספקיות מציבות כנהג היום-יומי ולא כדגלון — והיא נערכת על פני כל סולם המחירים, כך שקורא בתוכנית של $20 מקבל את אותה תשובה כמו קורא בתוכנית של $200. הסיכום של SemiAnalysis עצמו בוטה: בשכבה הזו, Anthropic היא "עסקה טובה לאין ערוך, שמציעה פי ~5 מערך שווה-ערך API בכל התחומים."
צורת עומס העבודה שמאחורי כל שלוש השורות מתויגת, וכדאי לקרוא אותה פעמיים: agentic, 0.4% קלט ללא מטמון, 96.6% קלט מהמטמון, 2.6% כתיבות למטמון, 0.3% פלט. כך נראית לולאת סוכן — מעט הוראות טריות, כמות עצומה של הקשר שנקרא מחדש, ושמץ של טקסט מחולל. זה גם, כפי שמראה הסעיף הבא, התמהיל שמחמיא ל-Anthropic יותר מכול.

Opus 5.5 עולה פי שניים לכל טוקן, ועדיין מנצח פי 5.6
הנה מה שהגרסה המופצת של התרשים מפספסת. Claude Opus 5.5 אינו המודל הזול יותר. הוא המודל היקר יותר, פי שניים.
שני כרטיסי התעריפים פומביים. Claude Opus 5.5 מופיע במחיר של $4.00 למיליון אסימוני קלט, $0.20 למיליון קריאות מטמון, $5.00 למיליון כתיבות מטמון ו-$20.00 למיליון אסימוני פלט. GPT-6.1 Sol מופיע במחיר של $2.00, $0.10, $2.50 ו-$10.00 עבור אותם ארבעת הסעיפים. שקלו אותם לפי התמהיל הסוכני שלמעלה והתעריפים המשוקללים יוצאים בערך $0.399 למיליון אסימונים עבור Claude Opus 5.5 לעומת $0.200 עבור GPT-6.1 Sol — יחס של פי 2.00. החשבון הזה הוא שלנו, מהכרטיסים המפורסמים של שני הספקים, אבל הוא אינו שנוי במחלוקת: הוא נובע ישירות מהמחירים שפורסמו ומהתמהיל המסומן.
חלק את פער הערך של פי 5.6 בפער המחיר של פי 2.0 ותקבל בערך פי 2.8 יותר אסימונים לכל דולר של תוכנית בצד של Claude. אותה חלוקה במסלול של 20 דולר נותנת פי 2.79 — הפער נובע מכך שמונה אחד נדיב בהרבה, כמעט בדיוק באופן אחיד לאורך סולם המחירים, ולא מכך שמודל אחד זול יותר להרצה. מה שאומר שהכותרת של פי 5 היא אמירה על תמחור הקרדיטים של Anthropic, והיא תקפה רק לעומסי עבודה שנראים כמו זה שנמדד.
שנה את התמהיל והמספר זז. התמהיל הוא 96.6% קריאות מהמטמון, כאשר Opus 5.5 גובה $0.20 לעומת $0.10 של Sol. עומס דל מטמון — מסמכים ארוכים וטריים, מעט שימוש חוזר — נשען על שורת הקלט ואותו פי 2 מופיע שם. עבודה עתירת פלט, כמו יצירות ארוכות ולא הרצות סוכן ארוכות, פוגעת בשורה שבה Opus הוא $20.00 לעומת $10.00. ו-SemiAnalysis מפורש בכך שהמדד המועדף עליה יש לו מצב כשל: ערך שווה ערך ל-API "יהיה כמובן מטעה" אם מודל הוא עסקה טובה במיוחד או גרועה במיוחד במחירי API, וזה בדיוק המצב כאן — המודל היקר יותר לכל טוקן הוא זה עם המנוי הטוב יותר. החברה גם מסרבת להישען על תרשימי יעילות טוקנים, באומרה שהיא לא מאמינה שמשימות בנצ'מרק סוכניות טיפוסיות מייצגות עבודה אמיתית, ושהתעשייה חסרה נתוני יעילות מהימנים. קח את פי 5 כאמירה מדודה על צורת עומס אחת מפרסום אחד, לא כמאפיין קבוע של אף אחד מהמודלים.
מה שהופך את הפער לבעיה ממשית ולא לעסקה ניטרלית הוא שהצד של המנוי-והזול הוא גם הצד החזק יותר בלוח הבלתי תלוי. Artificial Analysis מציבה את Claude Opus 5.5 ב-58 במדד האינטליגנציה שלה, בתצורה שעמוד המודל שלה מכנה "max with fallback", הרשומה בבורר הווריאנטים כ-"Claude Opus 5.5 (Max, Default Fallback)" — הגבוה ביותר שהיא מדדה, בפער של כמה נקודות. GPT-6.1 Sol קורא 51.8במאמץ מרבי באותו מדד, גרסת מדד v4.3.2, כאשר GPT-6 Astra עומד על 52.7. כך שקונה השוקל בין שתי התוכניות ב-200 דולר מתבקש לשלם פי 5.6 יותר לדולר של קיבולת שמישה עבור המודל בעל הציון הנמוך יותר. הציונים הם של צד שלישי ובלתי תלויים; נתוני התמורה הם המודל של SemiAnalysis. שניהם מסומנים, ואף אחד מהם אינו מספר של ספק.

מה שינתה OpenAI ב-29 בספטמבר
שום דבר מכל זה לא היה סטטי. הסיבה לכך שהפער נדון השבוע ולא בשבוע שעבר היא ש-OpenAI הזיזה את מכשירי המדידה שלה שמונה ימים לפני שהמדידה פורסמה.
ב-29 בספטמבר 2026, OpenAI פתחה מחדש את מנויי ה-Pro ב-200 דולר למנויים חדשים, ובמקביל לפתיחה מחדש שינתה את אופן חישוב השימוש. במילותיה שלה באותו יום, השינוי "יסתכם בחצי מהדולר בהוצאות API לעומת תוכנית ה-Pro הישנה ב-200 דולר", ופוסט שני באותו יום תיאר הפחתה בחצי של הערך המקביל ל-API של המסלול. זוהי הצהרת ספק על התוכנית של עצמו, מתוארכת, והוא האירוע שהפך מדידת שווי מנוי לראויה לפרסום.
שלוש השלכות, כפי ש-SemiAnalysis מדדה אותן:
• מספר הטוקנים בכל דרגה קוצץ בחצי, והערך של Sol-class ירד אף יותר מכך.OpenAI קיצצה במקביל את תמחור הקלט השמור במטמון של GPT-6.1 Sol — ל-$0.10 למיליון, אשר חשבון המפתחים של OpenAI תיאר ב-29 בספטמבר כ-95% מתחת לתמחור הקלט הסטנדרטי וכ-50% מתחת לתעריף המטמון של GPT-6 Sol — כך שהערך הנמדד בשווה-ערך API של דגמי Sol-class בתוכנית ירד ביותר מ-50% ולא ב-50% שמשתמעים מקיצוץ הטוקנים בלבד.
• הגיעה חבילה ב-500 דולר, והיא לא מחזירה את הערך. תוכנית Pro 500 החדשה מציעה 21% יותר GPT-6 Astra מאשר תוכנית ה-200 דולר הישנה; בגלל הורדת המחיר של Sol, הערך המקביל ל-API בדרגת Sol בחבילת ה-500 דולר דווקא ירד. מצב Ultrafast — שכבת השירות של 300 טוקנים לשנייה — הוא התוספת האמיתית שם, ו-SemiAnalysis אומרת שהמגבלות שלו עדיין נבחנות.
• מנויים קיימים שומרים על המעמד הישן שלהם עד 29 באוקטובר 2026. תוכנית ב-200 דולר שהוחזקה לפני הקיצוץ שומרת על המכסה הישנה והגדולה יותר עד לתאריך זה, ואז עוברת לקטנה יותר במחיר ללא שינוי. עבור כל מי שרכש לפני 29 בספטמבר, ההשוואה במאמר זה חלה על חשבונו מסוף החודש, ולא מהיום.
האיזון מחדש הוא החלק העדין. לפני הקיצוץ, הערך לכל דולר של OpenAI היה מוטה לטובתה שלה בצמרת: Pro 200 הציע בערך פי שניים מהערך לכל דולר של Pro 100 ב-Astra, אשר בתורו הציע בערך פי שניים מזה של Plus. אחרי הקיצוץ, Pro 100, Pro 200 ו-Pro 500 נותנים כולם את אותו מספר טוקנים לכל דולר עבור כל מודל, ו-Plus דומה ב-Sol, אם כי עדיין גרוע יותר יחסית ב-Astra. OpenAI הפכה את הסולם שלה להוגן פנימית בכך שהקטינה בחצי את הכול עד לדרגה התחתונה. Anthropic, לעומת זאת, כבר נתנה את אותו ערך לכל דולר בכל דרגה — ולכן אותו פי 5.6 מופיע בין אם תסתכלו על תוכנית של $20 ובין אם על תוכנית של $200. אם אתם ב-Plus וספרתם על גישה ל-Astra, הקיצוץ הסיר את הערך שבעבר הפך את הדרגה הגבוהה ביותר של OpenAI לכזו ששווה לשאוף אליה.
ל-OpenAI אכן נותר יתרון מבני אמיתי אחד, ו-SemiAnalysis מודה בכך: אף אחת משכבות ה-Pro אינה כוללת חלון של חמש שעות, מה שמקל לצרוך חלק גבוה מהמכסה החודשית בסשן ארוך אחד. הערכתה של החברה היא שהוא אינו מפצה על פער של בערך פי 4 עד פי 5 בערך המקביל ל-API.
שתי כלכלות, שם דגם אחד
יש מלכודת בקריאת כל זה כהצהרה על המודלים. אם אתה משלם לפי טוקן — מפתח API, סטאק בהתארחות עצמית, פלטפורמת סוכנים שאתה בונה — ה-5.6x אינו המספר שלך ומעולם לא היה. המספר שלך הוא המספר המשוקלל 2.00x, ועל בסיס זה GPT-6.1 Sol הוא המודל הזול יותר עבור אותה לולאה סוכנית. השוואת המנויים עונה "איזה מושב כדאי לי לקנות". השוואת ה-API עונה "איזה מודל כדאי לי להפעיל". הם מצביעים לכיוונים מנוגדים עבור שני המודלים האלה, וערבוב ביניהם הוא הטעות הנפוצה ביותר בפרשנות סביב התרשים.
סבב הפחתות המחירים שהזין את מדידת המנוי כבר נמצא בכרטיסי התעריפים של ה-API. Anthropic הורידה את מחירי הקלט והפלט של Opus 5.5 ב-20% לעומת Opus 5 ואת קריאות המטמון ב-60% כשהמודל הושק, ב-25 בספטמבר. OpenAI חתכה בחצי את הקלט המטמון של GPT-6.1 Sol בעת ההשקה ב-29 בספטמבר. אלה שני כרטיסי המחירון שבשימוש לאורך המאמר הזה, והם חלים בין אם אתם קונים מושב או טוקן. שני המודלים נמצאים בקטלוג של OrcaRouter במחיר המחירון של הספק — Claude Opus 5.5 במחיר המחירון של הספק עם 0% תוספת, וGPT-6.1 Sol על אותו מפתח מאחורי נקודת קצה אחת — כך שהפחתה של ספק נכנסת לתוקף באותו זמן שבו היא מפורסמת, במקום להמתין לרענון של טבלת הניתוב.
דבר אחד שכדאי לומר בגלוי: OrcaRouter אינה מוכרת מנויים, כך שהמדידה הזו לא משנה את מה שמשתמש של OrcaRouter משלם. היא משנה איזה מודל כדאי לשלם עליו, והיא מתמחרת את החלופה. צד המסלולים של ההשוואה הוא חומה שאינה בשליטתכם — שתי מעבדות, ששתיהן הוכיחו שהן מזיזות מגבלות, בשקט ובהתראה קצרה, באותו שבוע שבו הן חותכות מחירים. המקבילה לכך ב-API היא היכולת לשלוח את אותה בקשה למקום אחר בלי חוזה חדש, וזה בדיוק מה שמעבר אוטומטי בין ספקים נועד לאפשר. אם אתם מריצים לולאת סוכן עם 96.6% קריאות מהמטמון, מה שאתם באמת רוצים הוא המסלול הזול ביותר שיקבל את הבקשה, והיכולת לשנות את דעתכם כשספק משנה את דעתו.
מי צריך לזוז, ומי לא
אם אתם משלמים על מנוי Claude ומריצים קידוד סוכני או לולאות כלים ארוכות, הטיעון להישאר הוא כעת מדיד ולא אנקדוטי: פי 58.6 מדמי המנוי שלכם חוזרים כקיבולת שוות-ערך ל-API במסלול של 200 דולר, לעומת פי 10.4 במסלול ChatGPT המקביל, וזה מחזיק בכל נקודת מחיר. אם אתם במסלול ChatGPT Pro 200 שנרכש לפני 29 בספטמבר, יש לכם את המכסה הישנה עד 29 באוקטובר 2026, ואת הנמוכה יותר לאחר מכן — בדקו את התאריך לפני שתחליטו משהו, כי בשלושת השבועות הקרובים אתם משווים מול מסלול שכבר לא קיים עבור קונים חדשים.
אם אתה בונה API, התעלם מה-5.6x. נתב לפי התעריף המשוקלל של 2.00x, תמחר לפי משימה ולא לפי טוקן, ותבדוק מחדש אחרי כל שינוי מחיר של ספק, כי ברבעון הזה נוצרו ארבעה כאלה — GPT-6 Sol, Fable 5.1, Opus 5.5 ו-GPT-6.1 Sol בתוך קצת יותר מחודש. המדד החשוב למנוי הוא מונה שאיש מחוץ למעבדה לא יכול לראות. המדד החשוב ל-API הוא לוח תעריפים, והוא פומבי.
מה לשים לב אליו בהמשך: האם מגבלות Opus של Anthropic יחזיקו מעמד לאורך הרבעון, בהתחשב בכך שהמתחרה שלה העבירה את השבוע האחרון בקיצוצים, וששתי המעבדות שומרות על היכולת לכוונן מונים בשקט; האם OpenAI תשחזר ערך ברמת Sol במסלול של 500$ על ידי העלאת מגבלות ולא על ידי הורדת מחירים נוספת; והאם ההסדר המשמר את התנאים הקיימים במסלול של 200$ באמת מסתיים ב-29 באוקטובר כפי שפורסם. SemiAnalysis מתחזקת את המספרים הבסיסיים כלוח מחוונים חי ולא כמחקר קבוע, ולכן הנתונים המצוטטים כאן מייצגים את מצבו של מערך נתונים שנועד להשתנות, נכון ל-5 באוקטובר 2026.

השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
