כרטיס כותרת הירו שנוצר עבור Claude Sonnet 5.5 לעומת Claude Sonnet 5, עם כתובית 'מחירים זהים, חשבונות שונים', המציג $2.00 ו-$10.00 למיליון טוקנים משני הצדדים, עם נתון עלות-למשימה מתפצל מתחת, והלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Claude Sonnet 5.5 לעומת Claude Sonnet 5: מחירים זהים, חיובים שונים

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

שני מודלים מאותו ספק, אותה דרגה, אותו שם, ו— בכל שורה של מחירון שפורסם — אותו מחיר. Claude Sonnet 5 הושק ב-30 ביוני 2026 במחיר של $2.00 למיליון טוקנים בקלט ו-$10.00 למיליון טוקנים בפלט. Claude Sonnet 5.5 הגיע לזמינות כללית ב-28 בספטמבר 2026 במחיר של $2.00 ו-$10.00, עם קריאות מטמון ב-$0.20 וכתיבות מטמון של חמש דקות ב-$2.50 בשניהם. שום דבר במחיר לא השתנה. מה שהשתנה זה כל מה שגיליון מחירים לא מודד, והתוצאה היא שאחד משני המודלים האלה זול משמעותית להפעלה מהשני למרות עלות זהה בדיוק לכל טוקן. הכיתוב של Anthro​pic עצמה עבור ההשקה אומר זאת מבלי לומר זאת במפורש: עד 30% עלות נמוכה יותר עבור רוב העבודות, על מחירון ללא שינוי. הדרך היחידה ששתי המשפטים נכונים היא אם המודל החדש יותר מסיים את אותה עבודה עם פחות טוקנים, וזה מה שהבנצ'מרקים מראים ומה שהנתונים העצמאיים לכל משימה מאשרים.

האם Claude Sonnet 5.5 יקר יותר מ-Claude Sonnet 5?

לא — ובכל זאת כדאי להתייחס לשאלה ברצינות, מפני שמיגרציות רבות מאוד השתבשו בכך שהתייחסו לכרטיס תעריף אחיד כאל חשבון אחיד.

לכל טוקן, שני המודלים זהים: 2.00 דולר בקלט, 10.00 דולר בפלט, 0.20 דולר לקריאת טוקן שמור במטמון, 2.50 דולר לכתיבת טוקן כזה. אין מדרגות תמחור ואין תוספת מחיר עבור הקשר ארוך. יהיה מה שיהיה המודל החדש יותר, זו אינה העלאת מחיר בתחפושת של דור חדש.

לכל משימה שהושלמה, התמונה מתהפכת בהתאם לשאלה את עומס העבודה של מי אתה מתאר. Artificial Analysis מדווחת על עלות של $5.09 למשימה עבור Claude Sonnet 5 ו-$7.60 למשימה עבור Claude Sonnet 5.5 באותה סוויטת Intelligence Index v4.3 — המודל החדש יקר ב-49% להשלמת משימה איתו, במצב זהה. באותו דוח מצוין כי Sonnet 5.5 פלט 410 מיליון טוקנים בכל הסוויטה לעומת 370 מיליון של Sonnet 5, כאשר שניהם לעומת חציון של 88 מיליון עבור התחום הנמדד. בהנחיות הפתוחות של המעריך המודל החדש פשוט כותב יותר, ובמחירים שווים יותר טוקנים פירושם חשבון גדול יותר.

הטענה של Anthropic להיות זולה ב-30% היא טענה של ספק בנוגע לעומסי העבודה שהיא בחרה בעצמה. הנתון של צד שלישי, 7.60 דולר מול 5.09 דולר, הוא מדידה על מערך אחר. שתיהן אינן שגויות; אי-ההסכמה היא כל הסיפור, והגורם המכריע הוא אם המשימות שלכם מגבילות את הפלט שלהן בעצמן.

מה בעצם זז בין שני הדורות

כרטיס התעריפים סטטי; המודל לא. כשהוא מוצג כרשימה אחת, הפערים גדולים ובעיקר חד-כיווניים.

• Terminal-Bench 4.0 — 70.6% עבור Claude Sonnet 5.5 לעומת 10.3% עבור Claude Sonnet 5, הקפיצה הגדולה ביותר בין דורות עוקבים שאנתרופיק פרסמה במבחן הזה

• CursorBench 4.0 — 55.5% לעומת 34.1%

• קרטוגרפיה, ללא כלים — 61.6% לעומת 15.6%

• GDPval-AA v2.1 — 1844 לעומת 1449

• AA-Briefcase v1.1 — 1811 מול 1359

• Humanity's Last Exam, עם כלים — 64.5% לעומת 54.9%

• OSWorld 2.1, השלמה חלקית — 80.1% לעומת 57.0%

• Artificial Analysis Intelligence Index v4.3 — 56 מול 38, פער של שמונה עשרה נקודות בסקאלה של צד שלישי שנמדדה תחת אותה תצורת "Adaptive Reasoning, Max Effort"

צורת הרשימה הזו אינה התקדמות אחידה. המעבר של Chartography מ-15.6% ל-61.6% ושל Terminal-Bench מ-10.3% ל-70.6% נראה כמו יכולות שהיו נעדרות וכעת הן קיימות, לא יכולות שהשתפרו. העלייה של Humanity's Last Exam בעשרה נקודות ושל OSWorld בעשרים ושלושה נקודות במחיר ללא שינוי היא הדפוס של דור שסגר פערים ספציפיים, ולא של דור שנעשה חכם יותר באופן כללי. פער האינדקס של שמונה-עשרה נקודות הוא הממוצע האריתמטי של זה: אמיתי, גדול, ומרוכז בשימוש בכלים, בהרצת קוד ובעבודה חזותית.

הערת שוליים אחת חשובה לכל מי שקורא את טבלת הספקים בעיון. Anthropic מציינת שב-FrontierCode תצורת המאמץ Max מקבלת ציון נמוך יותר מאשר Xhigh, והיא מסמנת שריצות GDPval-AA ו-AA-Briefcase הופעלו בפריסת טרום-שחרור שנושאת באג של פלטים מובנים. המספרים שלעיל הם עדיין הטובים ביותר הזמינים, אך יש להתייחס אליהם כתמונת מצב מפריסה אחת ולא כמאפיין קבוע של המודל.

למה המחיר זהה והחשבון לא

שלושה מנגנונים, בסדר יורד לפי מידת ההשפעה שלהם על חשבונית אמיתית.

הראשון הוא משמעת של אורך הפלט. Sonnet 5.5 הוא סוכן בעל יכולות רבות יותר, כלומר הוא עושה יותר לפני שהוא עונה, ובחבילת בדיקות ללא הגבלת אורך הוא כותב בערך 11% יותר מ-Sonnet 5 בעוד שהעלות לכל טוקן זהה. בעומס עבודה שמגביל את הפלט — חילוץ לסכימה קבועה, סיווג, סיכומים מוגבלים — אותם 11% לעולם לא מתממשים, והטענה על 30% הופכת לאמינה, כי הרווח הוא בהגעה לתשובה בפחות סבבים ולא בפחות טוקנים בכל סבב.

השני הוא התנהגות המטמון, והיא הסיבה לכך שמחיר קריאה מהמטמון שלא השתנה אינו אומר שעלות המטמון לא השתנתה. קריאות וכתיבות למטמון מתומחרות באופן זהה בשני המודלים, כך שכל שינוי בנפח האסימונים המטמונים עובר ישירות לחשבון. מודל שנדרשים לו פחות סבבים כדי להשלים משימה אג'נטית קורא את הקידומת שלו פחות פעמים. זהו חיסכון שאין מאחוריו שום שינוי מחיר, והוא בלתי נראה בכל טבלת השוואה שמפרטת רק שורות מחירון.

השלישי הוא זה שרוב הצוותים טועים בו ביום המיגרציה: ברירת המחדל של effort. Claude Sonnet 5.5 מגדיר חשיבה דרך פרמטר effort עם ההגדרות low, medium, high, xhigh ו-max, כאשר ברירת המחדל היא high בפלטפורמת Claude ו-medium בתוך אפליקציות Claude. אם עברתם מפריסת Sonnet 5 שבה הצמדתם תקציב חשיבה, ייתכן שברירת המחדל החדשה היא בעומק שונה מזה שעבורו שילמתם. מדדו לפני שאתם מניחים חיסכון או עלייה.

יש גם השלכה התנהגותית שראויה לציון לפני ההפצה ולא אחריה. Anthropic מציינת ש-Claude Sonnet 5.5 הוא ה-Sonnet הראשון שמושק עם אמצעי הגנה סייבר ומנגנוני גיבוי באותה מעמד כמו המודלים הבכירים שלה, כך שבקשות סייבר בסיכון גבוה יותר נופלות באופן גלוי חזרה ל-Sonnet הקודם. הלוגים שלך יציגו מודל שלא ביקשת. באופן קשור, אם אתה מריץ את Sonnet עם חשיבה מושבתת, עליך לעבור להתנהגות בין-כלים — שינוי בקוד, לא דגל.

ב-OrcaRouter, anthropic/claude-sonnet-5 ניתן לנתב כבר היום באמצעות אישור גישה אחד במחיר המחירון של הספק עם 0% תוספת, לצד Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro ו-Gemini 3.1 Pro Preview. Claude Sonnet 5.5 עצמו עדיין אינו נתיב בפלטפורמה שלנו, כך שהצורה המעשית של השוואה זו כעת היא שצוות שכבר מריץ Sonnet 5 יכול למדוד את הדלתא ביום שבו הוא יוצע, מבלי לגעת במפתח API, וגם יכול לבצע failover בין שכבות בינתיים על ידי שינוי מחרוזת.

שאלות שאנשים שואלים לפני החלפה

אפשר להריץ את שניהם בו-זמנית ולהשוות על התעבורה שלי? לא דרך קרדנצ׳יאל אחד של OrcaRouter עדיין, מכיוון ש-Claude Sonnet 5.5 אינו נתיב רשום. הפתרון העקיף הוא להריץ את המודל החדש יותר ב-API של Anthropic עצמה ואת הישן יותר דרכנו, ואז להשוות טוקנים לכל משימה שהושלמה ולא עלות לטוקן, כי זה הנתון ששני המודלים באמת נבדלים בו.

האם המחיר ללא שינוי אומר ש-Anthropic אינה גובה עבור היכולת החדשה? זה אומר שמחיר המחירון נשמר קבוע בזמן שהמודל משתפר, וזה אותו דפוס כמו שני הדורות הקודמים של Sonnet. האם זה יימשך היא שאלה מסחרית, לא טכנית, וחלון הפרישה שפורסם — לא לפני ספטמבר 2027 — הוא ההתחייבות היחידה המצורפת.

איזה מספר עליי להאמין לו, ה-30% של Anthropic או ה-49% של צד שלישי?אף אחד מהם כטענה כללית. הנתון של Anthropic מתאר עומסי עבודה שבהם המודל מגיע לתשובה במספר סבבים קטן יותר; הנתון של Artificial Analysis מתאר חבילת מדדים בלתי מוגבלת שבה המילוליות חופשית לגדול. בחרו את זה שדומה לקבוצת הפרומפטים שלכם, ואם אינכם יכולים לדעת מהי, העמימות הזו היא עצמה התשובה — מדדו אותה.

השורה התחתונה

Claude Sonnet 5.5 אינו העלאת מחיר, אך הוא גם לא חיסכון אוטומטי. Anthropic השאירה כל שורה במחירון ללא שינוי והעבירה את המודל מתחתיו, מה שאומר שכל ההצדקה הכלכלית נשענת על טוקנים לכל משימה שהושלמה — מספר שטוב יותר ב-30% בעומסי העבודה שהספק בחר, וגרוע יותר ב-49% במערך המבחנים שנבחר על ידי מעריך עצמאי. אם המשימות שלך מגבילות את הפלט של עצמן, עבור וקח את הרווח. אם לא, המחיר האחיד אינו סיבה לדלג על המדידה, כי אפשר לשלם 50% יותר לכל משימה עבור מודל שהוא טוב יותר באופן חד-משמעי בעבודה.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Sonnet 5 across eight rows. Both columns carry the identical rate card: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output. The rows that differ are AA Intelligence Index v4.3 score 56 for Claude Sonnet 5.5 against 38 for Claude Sonnet 5, $7.60 per task on the index run against $5.09, and Terminal-Bench 4.0 (vendor) 70.6% against 10.3%. The card heading reads "Identical rate cards, different bills: Claude Sonnet 5.5 against Claude Sonnet 5", and a footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Every price line is a tie by design: the two models share one rate card and differ only in what they emit to finish the same task."Screenshot of the OrcaRouter model page for Anthropic Claude Sonnet 5 (anthropic/claude-sonnet-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.24-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-06-30" line, and the $2.00 input and $10.00 output prices per million tokens.Screenshot of Anthropic's newsroom page for Claude Sonnet 5.5, showing the site navigation bar, the publication date September 28, 2026, the model heading "Claude Sonnet 5.5", and an image-led marketing hero beneath it that carries no machine-readable specification figures.