
Claude Sonnet 5.5 לעומת Grok 4.5: שני תעריפי קלט של $2 והמתנה של שש דקות
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 931 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 192 tok/s
- OrcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- xAISpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
Claude Sonnet 5.5 ו-Grok 4.5 גובים אותו מחיר עבור קלט: $2.00 למיליון טוקנים. כאן נגמרת ההסכמה, ומספר אחד מבהיר את הנקודה טוב יותר מכל טבלת מפרטים. בגרסה v4.3.2 של מדד Intelligence Index של Artificial Analysis, הזמן החציוני עד לטוקן התשובה הראשון עבור Claude Sonnet 5.5 בהגדרת Max Effort שלו הוא 370.8 שניות. עבור Grok 4.5 הוא 6.9 שניות. אותו תעריף קלט. פי חמישים ושלושה זמן ההמתנה לפני שדבר כלשהו חוזר בכלל. Claude Sonnet 5.5, שיצא ב-28 בספטמבר 2026, ו-Grok 4.5, שיצא ב-8 ביולי 2026 ומאז עקפו אותו פעמיים בתוך המשפחה שלו, הם שתי הדרכים הזולות ביותר להיכנס למחצית הקדמית של החזית על הנייר — והנייר מסתיר את ההחלטה שבאמת חשובה, שהיא מה שאתם קונים עם ההמתנה.
הנתון הזה דורש הסתייגות מיד, משום שמספר השהיה בלי תצורה הוא חסר משמעות: 370.8 שניות הן מצב החשיבה המוגדר כברירת מחדל של Anthropic בעוצמה מרבית, שבו היא משקיעה תקציב חשיבה עצום לפני שהיא פולטת טוקן תשובה. מי שמבצע קריאה ורוצה טוקן ראשון מהיר מגדיר משהו אחר. אבל הכיוון אמיתי וזה לא ארטיפקט — ב-Artificial Analysis מודדים את מהירות הפלט של Claude Sonnet 5.5 ב-138.7 טוקנים לשנייה, כשהיא במקום השני אחרי קומץ מודלים בלבד, ואת זו של Grok 4.5 ב-59.2. המודל שממתין הכי הרבה גם כותב הכי מהר. הבחירה שלכם היא בין חשיבה ממושכת שלאחריה תשובה מהירה, לבין חשיבה קצרה שלאחריה תשובה איטית יותר.
מה השתנה ב-28 בספטמבר
Claude Sonnet 5.5 הוא בן יום אחד. Anthropic הוציאה אותו ב-28 בספטמבר 2026 תחת מזהה ה-API claude-sonnet-5-5, לצד Bedrock, Google Cloud ו-Microsoft Foundry, ומתארת אותו כפועל 30% מהר יותר מ-Claude Sonnet 5 ובעלות נמוכה עד 30% לכל משימה ברוב סוגי העבודה. אלו נתוני ספק ולא שוחזרו באופן בלתי תלוי; המחיר שמולו היא מצטטת הוא אמיתי, משום שלוח התעריפים נותר קבוע על 2.00 דולר למיליון טוקני קלט, 10.00 דולר למיליון טוקני פלט, 0.20 דולר לקריאות מטמון ו-2.50 דולר לכתיבות מטמון. החלון הוא 1,000,000 טוקנים עם תקרה של 128,000 טוקנים בפלט סינכרוני, ו-300,000 טוקנים ב-Message Batches API מאחורי הכותרת output-300k-2026-03-24. תאריך הידע האחרון הוא יוני 2026. שמירת נתונים אפסית זמינה מההשקה, ו-Anthropic לא תפסיק את המודל לפני 28 בספטמבר 2027.

התיעוד של Anthropic גם הוא מפורש באופן יוצא דופן לגבי השדרוג: שינויים שוברים מפרידים בין Claude Sonnet 5.3 לבין המודל שרוב סוכני Claude פועלים עליו כיום, והם נדונים בהמשך.
Grok 4.5 הוא ההצעה הישנה יותר והמורכבת יותר. SpaceXAI — החברה שעדיין משווקת תחת המותג xAI בכרטיסי המודלים שלה — הוציאה אותו ב-8 ביולי 2026 כתערובת מומחים בעלת 1.5 טריליון פרמטרים, שאומנה לצד עורך הקוד Cursor, עם חלון של 500,000 טוקנים, קלט טקסט, תמונה וקבצים, ומצגת השקה שנבנתה כמעט כולה על כלכלת טוקנים ולא על ציונים גבוהים. הוא כבר אינו ספינת הדגל. גם Grok 4.6 וגם Grok 4.7 קיימים, לשניהם אותו מחיר מחירון של $2.00 / $6.00, והקטלוג שלנו מפרט את שלושתם. השאלה המעניינת בספטמבר 2026 היא אפוא לא אם Grok 4.5 טוב; אלא אם משהו עדיין מצדיק לפנות אל הוותיק מבין השלושה.
החשבון אינו המחירון
שים את השניים זה לצד זה על הלוח העצמאי וצורת העסקה מתגלה.
• מדד האינטליגנציה, גרסה v4.3.2 — Claude Sonnet 5.5 56 במאמץ מקסימלי לעומת Grok 4.5 39
• עלות לכל משימת Index — Claude Sonnet 5.5 $7.60 לעומת Grok 4.5 $1.04, שניהם נמדדו, לא הוערכו
• תעריף פלט — Claude Sonnet 5.5 $10.00 למיליון לעומת Grok 4.5 $6.00 למיליון
מהירות פלט — Claude Sonnet 5.5 138.7 טוקנים/שנייה לעומת Grok 4.5 59.2 טוקנים/שנייה
• זמן עד לטוקן התשובה הראשון, מאמץ מרבי — Claude Sonnet 5.5 370.8 שנ׳ לעומת Grok 4.5 6.9 שנ׳
• טוקנים שנוצרו לאורך כל הערכת ה-Index — Claude Sonnet 5.5 410M לעומת Grok 4.5 77M
• הקשר — Claude Sonnet 5.5 עם 1,000,000 טוקנים לעומת Grok 4.5 עם 500,000 טוקנים
שורת המילוליות היא המנגנון שמאחורי פער העלות לכל משימה, והיא המספר השימושי ביותר בעמוד הזה. מודל שפולט 410 מיליון טוקנים בהערכה שבה המתחרה שלו פולט 77 מיליון לא זקוק לקצב פלט גבוה ב-67% כדי לעלות פי שבעה לכל משימה — אבל בכל זאת יש לו קצב כזה, ושתי ההשפעות דוחפות לאותו כיוון. הניסוח של Anthropic עצמה מסכים עם הפרשנות ולא סותר אותה: "עד 30% פחות לכל משימה" הוא טענה לגבי מספרי טוקנים, לא לגבי קצבים, משום שהקצבים לא השתנו בין Claude Sonnet 5 ל-Claude Sonnet 5.5. Artificial Analysis מגיעה לאותה מסקנה מהצד השני ומתארת את המודל בשפה פשוטה כמהיר במיוחד אך עתיר מילים מאוד. לעומת מודל חסכני, אותה תכונה בדיוק היא הסיכון התפעולי הגדול ביותר של Claude Sonnet 5.5.

היכן שהתעריף הזול של Grok 4.5 מפסיק להיות זול
השורה של $2.00 / $6.00 היא מדרגת תמחור, לא תעריף. בתיעוד המפתחים של SpaceXAI עצמה, המחיר הזה חל עד 200,000 אסימוני קלט, ומעבר לכך הוא מוכפל ל-$4.00 עבור קלט ו-$12.00 עבור פלט. החלון של Grok 4.5 הוא 500,000 אסימונים, כך שהמחצית השנייה של החלון שהוא מפרסם עולה פי שניים מהמחצית הראשונה. טעינת פרומפט בקנה מידה של מאגר קוד אל תוך Grok 4.5 אינה פעולה של פלט ב-$6; היא פעולה של פלט ב-$12, ובנקודה הזו המודל עם תעריף הפלט ה"יקר" של $10 הוא הזול יותר בכל בקשה שגם פולטת הרבה אסימונים.
ל-Claude Sonnet 5.5 אין רמה מקבילה. התעריף של $2.00 / $10.00 נשמר לאורך כל חלון ה-1,000,000 טוקנים, וקריאות מ-cache מחויבות ב-$0.20 — עשירית מתעריף הקלט — וזה מה שהופך את תרחיש ההקשר הארוך למעשי בפועל ולא רק על הנייר.
גודל החלון הוא החצי השני של הטיעון הזה והוא מצביע לאותו כיוון. החלון של Grok 4.5 הוא 500,000 טוקנים וכל אחד מהם מחויב בתעריף המפורסם. ל-Claude Sonnet 5.5 יש 1,000,000 טוקנים לעבוד איתם, וצורת עומס העבודה היא מה שהופך את זה לחשוב: מאגר קוד שעליו יש להסיק, תמלול סוכן ארוך, ערימת מסמכים שצריכה להישאר בטווח הראייה. תקרה כפולה, בלי שבירת מדרגה במחציתה, וקריאות מטמון בעשירית מתעריף הקלט הם מה שהופכים נשיאה של הקשר כה רב לאורך קריאות רבות לסעיף חיוב במקום לתקציב.
החלוקה המעשית אינה עדינה:
• פרומפטים קצרים עם פלט צפוף — Grok 4.5 מנצח בתעריף ומנצח שוב בהרגלי הטוקנים
• הנחיות החורגות מ-200,000 אסימוני קלט — התעריף של Grok 4.5 מוכפל וזה של Claude Sonnet 5 לא
• עבודה אינטראקטיבית רגישה להשהיה — Grok 4.5 משיב ראשון, בפער ניכר, בהגדרות ברירת המחדל
• ריצות סוכניות לטווח ארוך — הציון המשולב של Claude Sonnet 5.5 ותקרת הפלט של 128K הם מה שאתם משלמים עליו את עלות המשימה הנוספת, ותקרת ה-300K של Batches מאריכה אותו עוד יותר
המיגרציה אינה מחרוזת מודל
כל מי שעובר מ־Claude Sonnet 5 ל־Claude Sonnet 5.5 צריך לקרוא את הערת ההגירה של Anthropic לפני כתיבת קוד, כי חמישה התנהגויות השתנו ורק אחת מהן נכשלת בקול רם במקום ברור.
• ערכים שאינם ברירת מחדל של temperature, top_p או top_k מחזירים כעת 400 — pipeline עתיר דגימה מפסיק לעבוד במקום להידרדר
• thinking: {"type": "disabled"} מחזיר 400 וחייב להפוך ל-between_tools, כאשר effort מוגבל ל-low, medium או high; xhigh ו-max נדחים
• שימוש כפוי בכלי — tool_choice של "any" או כלי בשם — נדחה לחלוטין, כך שלולאה שמאלצת קריאה תקינה לפי סכמה צריכה לעבור ל-auto עם שימוש קפדני בכלים או פלטים מובנים
• הכלי הישן יותר computer_20251124 לשימוש במחשב נדחה ב-Claude API וב-Google Cloud
• בלוקי חשיבה כבולים למודל ולחשבון שיצרו אותם, כך שההיסק ממשיך מ-Claude Sonnet 5 אך לא עובר הצידה אל משפחה אחרת — וכלי היועץ אינו מקבל עוד את Claude Opus 4.8, Claude Opus 4.7 או Claude Sonnet 5 כיועצים מאחורי מריץ Sonnet 5.5
יש שינוי שישי שכלל לא מכשיל שום דבר, וזה מה שהופך אותו למסוכן: טקסט בין קריאות לכלים מוחזר כעת בתוך בלוקי חשיבה. אפליקציה שמזרימה את הטקסט הזה למשתמש משתתקת בין קריאות לכלים, עד שהיא מגדירה ערך תצוגה או מכבה כליל את החשיבה המוקדמת. שום דבר לא מחזיר שגיאה. הפלט פשוט מפסיק להופיע.
Grok 4.5 לא דורש שום דבר מזה. זהו מודל בתבנית OpenAI עם משטח הדגימה שלם, ומעבר אליו מקודמיו של Grok 4.5 עצמו הוא שינוי של מחרוזת מודל. עלות ההגירה נופלת כולה על צד Claude, וזה יום עבודה ולא אחר צהריים.
שניהם על אישור אחד, והמגבלה הכנה של זה
להחזיק השוואה בין שני ספקים בראש זה קל; להפעיל אחת זה המקום שבו העלות מסתתרת. OrcaRouter מציבה יותר מ-200 מודלים מאחורי נקודת קצה אחת תואמת OpenAI, כאשר מחיר המחירון של הספק מועבר כפי שהוא וללא תוספת רווח, כך ששינוי תעריף באחד הצדדים נכנס לתוקף כאן באותו יום ולא בחידוש החוזה הבא, עם מעבר אוטומטי בעת כשל בין ספקים במעלה הזרם ו-DSL לניתוב לצורך הרכבת קריאות. כל קו Grok נמצא בקטלוג בתעריפים של SpaceXAI עצמה, ו-Grok 4.5 ניתן לניתוב כ-grok/grok-4.5 במחיר של $2.00 לקלט ו-$6.00 לפלט למיליון טוקנים על פני חלון של 500,000 טוקנים.
Claude Sonnet 5.5 אינו בקטלוג שלנו, והעמוד הזה לא ירמוז אחרת. הדרך אליו היום היא ה-API של Anthropic עצמה, או Bedrock ו-Google Cloud אם שם כבר יושבת התשתית שלכם. Claude Sonnet 5 ניתן לניתוב כאן מאז 30 ביוני בתעריפים של Anthropic: $2.00 ו-$10.00 והוא נשאר המודל שעליו עוברת רוב התעבורה של Claude API, מה שהופך אותו ליעד ה-failover הטבעי בזמן ש-Claude Sonnet 5.5 עוד בן יומו ומחוץ לכל עדות ייצור.
הסתייגות אחת מתלווה לכל זה, והיא לא קטנה. השורה של Grok 4.5 למעלה היא הפיץ׳ של הספק כפי שהקטלוג שלנו משחזר אותה כעת; מונה התעבורה ברשומה הזו עומד על אפס בשבעת הימים האחרונים, ונתון התפוקה שלה אינו נמדד, כאשר זמן לתגובה ראשונה (time to first token) נמצא ברצפת האחד שמודל שכמעט ואינו נקרא נוטה להציג. מודל בלי תעבורה לאחרונה כאן אינו הוכחה שהמודל גרוע — 4.6 ו-4.7 הם היעד שאליו עברו הקריאות של המשפחה — אבל זה כן אומר שהמספרים התפעוליים בעמוד הזה דלילים, ונתון ההשהיה שראוי לסמוך עליו הוא הקריאה של מסלול חי.

איזה מהם לבחור
Grok 4.5 הוא המודל הנכון כאשר הפרומפט קצר, התשובה צפופה, והאינטגרציה כבר מדברת בשפת OpenAI — וכאשר הבקשה לא תעבור 200,000 טוקני קלט, כי מעבר לקו הזה החשבון עובר לידיים אחרות. זה גם הבחירה הנכונה כאשר הטוקן הראשון צריך להגיע תוך שניות ולא בדקות. מה שזה לא הוא דגם הדגל הנוכחי של Grok; Grok 4.6 ו-Grok 4.7 יושבים מעליו באותו מחיר מחירון, והסיבה לבחור ב-4.5 על פני כל אחד מהם צריכה להיות ספציפית.
Claude Sonnet 5.5 הוא המודל הנכון כאשר הפרומפט עצום, העבודה סוכנית דייה כדי ש-17 נקודות Index ותקרת פלט של 128K יצדיקו עלות גבוהה פי שבעה לכל משימה, או כשהציון המשולב הוא פשוט הדבר שנקנה. פירוט היתר שלו הוא החלטת עיצוב, לא פגם, והוא המספר שיש למדוד על התעבורה שלכם לפני שמתחייבים — כי $7.60 למשימת Index לעומת $1.04 הם ייצוג מקורב לנתון שרק עומס העבודה שלכם יכול להפיק.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
