
הדגמות של Claude Opus 5.5 עולות בין $3 ל-$26: כיצד לקרוא את הימים הראשונים של בניות
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 495 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 186 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
שני מספרים מהשבוע הראשון של Claude Opus 5.5 מתארים את אותו מודל ונחלקים זה מזה בסדר גודל. בונה אחד מדווח על מעבדת עדשות אינטראקטיבית מוגמרת — עמוד שבו גוררים טבעת מיקוד וצופים במישור מיקוד זוהר חולף דרך עמק — בעלות של $25.66 בהוצאות API ושעה ו-26 דקות של זמן שעון. סקירה שהופצה בהרחבה של הדגמות ההשקה מתמחרת אנימציית טירה ב-Blender שנבנתה באופן פרוצדורלי, על זיקוקים והשתקפות באגם, ב-$13.30 ו-35 דקות. שרשור שהגיע לעמוד הראשי של r/ClaudeAI אומר $3.21. הספק שחרר את Claude Opus 5.5 ב-22 בספטמבר 2026 במחיר של $4 למיליון טוקני קלט ו-$20 למיליון טוקני פלט, ואף אחד משלושת המספרים האלה אינו שגוי. הם מודדים דברים שונים, ואם אתם בונים תקציב על פיהם, עליכם לדעת איזה מהם.
הפער אינו רעש. הוא ההבדל בין מה שהרצת סוכן מייצרת לבין מה שהיא צורכת, וארבעת הימים האחרונים ייצרו כמות מרשימה של צריכה עם מעט מאוד התחשבנות לגביה. אז הנה החשבון שאיש לא פרסם לצד ההדגמות, ואז החלק של ההשקה שנמצא בפועל במחירון וניתן לבדוק.
מה 25.66$ בעצם קנו
הקצה היקר של הטווח הוא הקצה השימושי ביותר, מפני שהבונה פרסם גם את התוצר וגם את החשבון.
מעבדת העדשות של ריאן סאל, שכותרתה "מישור הפוקוס", היא עמוד אינטראקטיבי יחיד שנבנה מפרומפט אחד בסשן אחד. היא מציבה עדשת מצלמה על המסך, מאפשרת לגרור את טבעת הפוקוס, ומראה לך את הדבר שכל צלם יודע עליו אבל כמעט אף אחד לא ראה: המשטח הדק בעולם שבו תמונה הופכת באמת לחדה. סובב את הטבעת והמשטח זז, אלמנטי הזכוכית מחליקים קדימה או אחורה בתוך צינור העדשה כדי להראות למה, וקונסולה מדווחת את המרחק, הצמצם ואזור החדות — 60 ס"מ, f/2, 1.9 ס"מ עומק, בהגדרות שבהן העמוד נפתח. סגור את הצמצם מ-f/2 ל-f/16 ואזור החדות מתרחב כשחרוט האור מצטמצם. תצוגת פיצוץ מפרידה בין עדשות הזכוכית. אין שום מודל תמונה בשום מקום בתהליך העיבוד, ואין נכסים מורדים: כל אלמנט מצויר ומונפש בקוד, ולכן כל ההדגמה של מעגל הטשטוש היא סימולציה חיה ולא תרשים.
זהו הסבר טוב באמת, והטענה המצורפת אליו מדויקת באופן יוצא דופן: זריקה אחת, שעה ו-26 דקות, שימוש ב-API בסך $25.66, כשהדף פעיל בכתובת lens.lab.sael.net כשקראתי אותו. הנתון מדווח עצמית ואינו ניתן לביקורת, אבל זוהי גם עלות הדמו היחידה במחזור שמגיעה עם אורך סשן שאפשר לחלק לפיו.
הריצו את החישוב לפי המחירון. לפי התעריפים המפורסמים של Claude Opus 5.5, של 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט, 25.66 דולר נמצאים בין 1.28 מיליון טוקנים ל-6.4 מיליון טוקנים, בהתאם לתמהיל — הקצה העליון אם הריצה כללה רק קלט, והקצה התחתון אם כללה רק פלט. בנייה אג'נטית כמו זו נמצאת איפשהו באמצע, והסיבה שהיא נמצאת קרוב יותר לקצה התחתון היא סעיף העלות שרוב האנשים מדלגים עליו: קריאות מטמון ב-Claude Opus 5.5 עולות 0.20 דולר למיליון — חלק ארבעים מתעריף הקלט — כך שסשן ארוך שממשיך לקרוא מחדש את אותו בסיס קוד שהולך וגדל משלם כמעט כלום על התעבורה הזו. עשרה מיליון טוקני קלט במטמון עולים 2 דולר. צד הפלט הוא המקום שבו מצטברת שעה וחצי של מודל שכותב קוד, חושב ומשכתב אותו: בתעריף של 20 דולר למיליון, מיליון טוקני פלט הם 20 דולר, וטוקני חשיבה מחויבים כפלט. המספר של Sael תואם ריצה שהפיקה בסדר גודל של מיליון טוקני פלט מול צד קלט גדול, זול ובמטמון — וזה בדיוק איך שנראית בנייה של 86 דקות ללא השגחה.
שני דברים נובעים מכך. ראשית, הורדת מחיר המחירון שקיבלה את תשומת הלב ביום ההשקה, מ-$5/$25 ל-$4/$20, היא שינוי של 20% לכל טוקן, וכשלעצמה לא הייתה הופכת את ההרצה הזאת לזולה; ההורדה בקריאה מהמטמון מ-$0.50 ל-$0.20 היא הסעיף שהפך לולאה של 90 דקות לבת השגה. שנית, ופחות נוח: שום דבר בדוח של $25.66 לא אומר לך אם ההרצה עברה היטב. הרצה חד-פעמית מבוצעת היטב וסשן שנאבק במשך שעה וחצי ואז הצליח מפיקים את אותה חשבונית.
הנתון של $13.30 אינו מחזיק מעמד בחשבון של עצמו
אמצע הטווח מאלף מסיבה אחרת. סיכום הדגמות השקה שפורסם ב-23 בספטמבר מדווח על עימות ראש בראש שבו Claude Opus 5.5 התבקש לבנות באופן פרוצדורלי אנימציית Blender בת עשר שניות מפרומפט אחד — טירה, השתקפות באגם, זיקוקים — מול GPT-6 Astra, ללא עריכה ידנית, ומדווח על 35 דקות ו-199,600 טוקנים בפלט תמורת כ-13.30 דולר, לעומת 28 דקות וכ-14.50 דולר עבור GPT-6 Astra. ספירת הטוקנים היא החלק המעניין, משום שהיא אינה מתיישבת עם המחיר.
199,600 טוקני פלט במחיר של $20 למיליון של Claude Opus 5.5 הם $3.99, לא $13.30. כדי להגיע ל-$13.30 על פלט בלבד תצטרכו 665,000 טוקנים. הכסף החסר נמצא בעמודות האחרות: קלט ב-$4 למיליון, כתיבות מטמון ב-$5 למיליון עבור נקודת עצירה של חמש דקות ו-$8 למיליון עבור שעה, וכל ניסיון חוזר. זו אינה סתירה בדוח — זה הדוח שמדבר בכנות על ספירת טוקנים שסופרת דבר אחד וחשבון שסופר ארבעה, וזהו הבלבול הנפוץ ביותר בשיח על עלויות בשבוע ההשקה. אם אתם לוקחים מספר אחד מדמו מפורסם, קחו את נתון הדולרים, והתייחסו לכל ספירת טוקנים שלצידו כתיאור חלקי של ההרצה.
בקצה הזול, החשבונאות נעשית דקה עוד יותר. השרשור ב-r/ClaudeAI שמדווח על שימוש ב-API בסך $3.21 עבור בילד מוגמר אופייני לז'אנר: כותרת, סרטון, ואין פירוט. סביר להניח שמדובר בסשן קצר יותר, בארטיפקט קטן יותר, או בהרבה קלט שנשמר במטמון. זה לא משהו שאפשר לתכנן לפיו תקציב, ולא הצלחתי לאמת אף דולר ממנו.
למה כל אחד מהמספרים האלה הוא חסם תחתון
דפוס הכשל כאן אינו שהבונים מסתירים את האמת. הוא סלקציה. הדמואים שמסתובבים הם אלה שהצליחו, ופורסמו בידי האנשים שהם עבדו עבורם, וארבעת הניסיונות שהפיקו עמוד שבור עלו בדיוק כמו זה שלא הפיק כזה. הרשימה המסכמת שאספה את השוואת Blender אומרת זאת במפורש — שאיש לא מפרסם את הכישלונות — והרשומה המפורטת ביותר בה היא דוגמה מובהקת: אתר של מותג שעונים שהחמיץ את הבריף והשתמש בגופן בלתי קריא בניסיון הראשון, ונזקק לניסיון שני כדי להפוך לגרסה שהוצגה.
"One Shot" עושה עבודה שקטה גם באוצר המילים הזה. הוא מתאר סשן בודד, לא ניסיון בודד, ומותר לסשן להכיל כמה תיקונים עצמיים שהמודל מסוגל לייצר — ובהרצה של 86 דקות, זה הרבה מאוד מהם. מודל שמשכתב את הקוד של עצמו פעמיים בתוך חלון הקשר אחד הוא "One Shot" אחד ושני ניסיונות.
אז הקריאה הכנה של ארבעת הימים הראשונים היא שלוש דרגות של ראיות, ואין למצע אותן:
• עלות שדווחה עצמית עם אורך סשן — שימושית לסדר גודל, לא ניתנת לאימות. הנתון של Sael, $25.66 על פני שעה ו-26 דקות, הוא הפריט החזק ביותר בשכבה הזו.
• עלות שדווחה עצמית עם ספירת טוקנים — לא עקבית פנימית ברוב המקרים, כפי שמראה הנתון של $13.30.
• נתון דולרי בלי שום דבר מאחוריו — סימן שמישהו בנה משהו, ולא יותר מזה.
החלק של ההשקה שמופיע בכרטיס תעריפים
הסר את טענות ההדגמה, והתמונה הניתנת לאימות היא צרה וברורה. כל הנתונים שלהלן הם התעריפים המפורסמים של Anthropic, כפי שנקראו מתוך תיעוד המודלים של החברה עצמה ומההכרזה מ-25 בספטמבר 2026:
• קלט — 4 דולר למיליון טוקנים. פלט — 20 דולר למיליון, כאשר טוקני חשיבה מחויבים כפלט, והחשיבה האדפטיבית של Claude Opus 5.5 תמיד פעילה ובלתי אפשרית לכיבוי.
• קריאות מטמון — 0.20 דולר למיליון, מכפיל של פי 0.05. כתיבות מטמון — 5 דולר למיליון בנקודת השבירה של חמש דקות, 8 דולר למיליון בשעה אחת. Batch API — 50% הנחה בשני הכיוונים, 2 ו-10 דולר.
• מצב מהיר — 8 דולר קלט ו-40 דולר פלט למיליון, עד פי 2.5 מהמהירות, ו-Anthropic עדיין מתייגת אותו כתצוגה מקדימה מחקרית.
• מעטפת — חלון הקשר של 1M טוקנים, 128K טוקני פלט באופן סינכרוני ו-300K ב-Batch API עם כותרת בטא, נקודת חיתוך ידע אמינה של יוני 2026, ומאמץ ברירת מחדל בינוני במקום הרמה הגבוהה שאליה הגיעה ברירת המחדל של Claude Opus 5.
• זמינות — Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry ו-Claude Platform ב-AWS, עם התחייבות לפרישה לא לפני 22 בספטמבר 2027.
טענות הביצועים של הספק עצמו, המתויגות כטענות: Claude Opus 5.5 פועל ברמה של Claude Fable 5.1 ברוב העבודות, עולה כ-40% פחות להרצה מאשר Claude Opus 5, ומייצר פלט מהר יותר ביותר מ-30%. ה-40% הוא ממוצע של עומסי עבודה שהספק בחר, ולא מספר מתעריף מחירים, ואין לצטט את השניים כאילו היו אותו סוג של עובדה.
הבדיקה הבלתי־תלויה קטנה יותר מטבלת הספק ומצביעה לאותו כיוון בפער קטן יותר. Artificial Analysis נותנת ל-Claude Opus 5.5 ציון 57.6 במדד האינטליגנציה שלה, לצד 61.4 ב-Humanity's Last Exam, 66.9 ב-SciCode ו-84.7 בזיכרון של הקשר ארוך בנתונים שמופיעים בעמוד המודל שלה. במדידת סוכן הקידוד של אותו פרסום, המדווחת על עלות למשימה ולא עלות לטוקן, המספר נע בכיוון ההפוך: במאמץ מרבי העלות למשימה עולה לכ-13.04 דולר, לעומת 10.79 דולר עבור Claude Opus 5 באותה תשתית בדיקה. טוקן זול יותר שהמודל מוציא ממנו יותר אינו משימה זולה יותר. זהו אותו לקח שחשבונות הדמו מלמדים, המגיע מצד שלישי.
מה לעשות אחרת בשבוע השני
אם המספר $25.66 הוא זה שגרם לך לרצות לנסות את זה, הצעד המועיל אינו לתקצב $25.66 — אלא לגרום להרצה שלך להפיק מספר שתוכל להסביר.
הגדירו את רמת המאמץ (effort) במפורש במקום להסתפק בברירת המחדל, כי זו החוגה שמשפיעה על מספר הטוקנים לכל משימה יותר מאשר בחירת המודל, וברירת המחדל במודל הזה השתנתה מזו של Claude Opus 5. נצלו את המטמון לקידומת היציבה במכוון: הפרומפט המינימלי שניתן לשמור במטמון ב-Claude Opus 5.5 הוא 512 טוקנים, לעומת 1,024 קודם לכן, כך שגם קידומות משותפות קצרות שמעולם לא נשמרו במטמון — עכשיו נשמרות. השאירו מרווח נשימה בכל משימה ארוכת-טווח ב-max_tokens, מכיוון שהחשיבה היא חלק מהתקציב הזה ואי אפשר עוד לכבות אותה — הנחיות ההגירה של Anthropic עצמה מציעות להתחיל מ-64K לעבודה ברמות המאמץ הגבוהות ביותר ומשם לכוונן. ובצעו מדידה (instrumentation) בסוף הריצה, לא בהתחלה: קראו את שדה ה-model ברמה העליונה בכל תגובה, כי בפרומפטים שהמסווגים שלה מסמנים, Anthropic מנתבת מחדש את הבקשה בתוך אותה קריאה, ומחרוזת המודל ששלחתם אינה מתארת את מה שהשיב.
הנקודה האחרונה היא המקום שבו ראוטר מפסיק להיות רק עניין של נוחות. בילד שרץ ללא השגחה במשך שעה וחצי דרך גבול הגנה יכול לחזור לאחר שסיים בשקט כמה סבבים על מודל קטן יותר, והדרך היחידה לגלות זאת היא להסתכל. Claude Opus 5.5 נמצא ב-OrcaRouter במחיר המחירון של Anthropic עצמה עם תוספת מחיר של 0% — תעריף הספק מועבר ישירות, כך ששינוי מחיר של ספק נכנס לתוקף כאן באותו היום שבו הוא מתפרסם — וזה הדבר הפחות מעניין שרוטינג עושה כאן. הדבר המעניין הוא שAPI אחד ליותר מ-200 מודלים מעמיד את כל הניסוי על מפתח אחד, כך ש"הרץ אותו על מודל החזית, ועבור לגיבוי במקום להיכשל" הוא שורת קונפיגורציה אחת במקום חוזה נוסף ושכתוב. מעבר אוטומטי לגיבוי הוא מה שהופך מודל לא מוכר לבטוח להצבה על מסלול שאכפת לך ממנו, וסירוב שאתה יכול לעקוף הוא סירוב שלא מסיים את הריצה שלך בדקה ה-70.
המספר הבא שיזוז
Anthropic אמרה ש-Claude Sonnet 5.5 ו-Claude Haiku 5.5 יגיעו "בשבועות הקרובים", וזה יתמחר מחדש כל אחת מההדגמות האלה בלי לשנות את צורתן: תעריף זול יותר לכל טוקן מול מספר טוקנים שאיש לא יכול לחזות מראש. אותה אי-ודאות שהפכה את המספרים של השבוע הראשון לבלתי שמישים תחול גם על אלה של הדור הבא, וזו הסיבה לפתח את ההרגל עכשיו ולא אחרי שהורדת המחיר תיכנס שוב לתוקף.
נכון לרגע זה, הסיכום הישר הוא קצר. Claude Opus 5.5 הוא אמיתי, זמין באופן כללי, ומתומחר ב-$4 וב-$20, עם קריאות המטמון הזולות ביותר שהקו הזה נשא אי פעם. הדמואים שהפיק בארבעת ימיו הראשונים מרשימים, ותגי המחיר שלהם הם אנקדוטות. אם אתה רוצה עלות עבור עומס העבודה שלך, המכשיר היחיד שמודד אותה הוא ההרצה שלך, עם תקרה, וקריאת החשבונית לאחר מכן.



השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
