כרטיס כותרת לתמחור של Claude Opus 5.5, המציג את התעריפים הראשיים: $4.00 למיליון טוקני קלט, $20.00 למיליון טוקני פלט, ו-$0.20 למיליון טוקנים לקריאה מהמטמון.
Guides & Insights

תמחור Claude Opus 5.5: כרטיס התעריפים המלא, שורת ה-Cache, וכמה באמת עולה משימה

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Claude Opus 5.5 מתומחר ב-4.00 דולר למיליון טוקנים בקלט ו-20.00 דולר למיליון בפלט, קיטון אחיד של 20% לעומת ה-5.00/25.00 שClaude Opus 5נשא עד כה, כאשר קריאות מהמטמון ירדו ב-60% ל-0.20 דולר למיליון. אלה המחירים המפורסמים של Anthropic, כפי שהם מופיעים בתיעוד התמחור של Anthropic עצמה ב-24 בספטמבר 2026, יומיים אחרי שהמודל הושק. המחירון הוא החלק הקל. Anthropic גם אומרת שהמודל עולה "כ-40% פחות להפעלה" בעומסי עבודה טיפוסיים, ומספר זה אינו מופיע בגיליון המחירים — מדובר בתיאור מטעם הספק, שנבנה מהקיטון במחיר לטוקן בתוספת הנחה שהמודל צורך פחות טוקנים ופחות סבבים כדי להשלים את אותה משימה. הדף הזה מפריד בין השניים: כל תעריף שאפשר לאמת בגיליון היום, והחשבון שמאחורי זה שאי אפשר. Claude Fable 5.1, שכבת ה-10/50 דולר שמעליו, מופיע לאורך כל הדף כהשוואה ש-Anthropic עצמה עורכת.

המחירון המלא, כל שורה כפי ש-Anthropic מפרסמת אותו

כל מה שמופיע בסעיף זה נקרא מתוך תיעוד התמחור של Anthropic באתר platform.claude.com ובאתר claude.com בתאריך 24 בספטמבר 2026. שום דבר כאן אינו מועתק מכתיבה אחרת.

קלט — $4.00 למיליון טוקנים (התעריף המפורסם של Anthropic).

פלט — $20.00 למיליון טוקנים. טוקני חשיבה מחויבים כטוקני פלט, והחשיבה האדפטיבית של Claude Opus 5.5 פועלת תמיד ולא ניתן להשבית אותה.

קריאה מהמטמון — $0.20 למיליון טוקנים. Anthropic מתעדת זאת כ־0.05x ממחיר הקלט הבסיסי, הסתייגות בהערת שוליים משלה עבור המודל הזה.

כתיבת מטמון של 5 דקות — $5.00 למיליון טוקנים, מכפיל הקלט הבסיסי הסטנדרטי של פי 1.25 ש-Anthropic מחילה על כל מודל בגיליון.

כתיבת מטמון של שעה אחת — $8.00 למיליון טוקנים, מכפיל הקלט הבסיסי הסטנדרטי של פי 2.

Batch API — 50% הנחה בשני הכיוונים:‏ 2.00$ לקלט ו-10.00$ לפלט למיליון. Ant​hropic מפרסמת את המספרים המוזלים ישירות, במקום שתצטרכו לחצות אותם בעצמכם.

מצב מהיר — 8.00$ קלט ו-40.00$ פלט למיליון, בדיוק פי 2 מהסטנדרט. התיעוד של Ant​hropic נותן לעמוד את הכותרת "מצב מהיר (תצוגה מקדימה למחקר)".

הסקה בארה"ב בלבד — מכפיל של פי 1.1 על קלט, פלט, כתיבות מטמון וקריאות מטמון כאשר inference_geo: "us" מוגדר. ניתוב גלובלי, ברירת המחדל, משתמש בתמחור רגיל.

הקשר ותקרת הפלט — מיליון טוקנים של הקשר ו-128K של פלט סינכרוני בתמחור סטנדרטי, ללא תוספת תשלום על הקשר ארוך. Anthropic מציינת שבקשה בת 900 אלף טוקנים מחויבת באותו תעריף לכל טוקן כמו בקשה בת 9,000 טוקנים. ב-Batch API תקרת הפלט עולה ל-300K מאחורי כותרת הבטא output-300k-2026-03-24.

Anthropic מציינת גם כי מכפילי המטמון "מצטברים עם משני תמחור אחרים כגון הנחת Batch API ושהות נתונים" — כך שבקשה מרוכזת באצווה, שמורה במטמון ומוצמדת לארה"ב מכפילה את שלושתם, והחישוב מצטבר ולא מחליף.

הנה מה שקוראי שני המודלים בעצם שוקלים עלות באותו גיליון:

Claude Opus 5 — $5.00 לקלט, $25.00 לפלט, $0.50 לקריאה מהמטמון, $6.25 לכתיבה למטמון של 5 דקות, $10.00 לכתיבה של שעה, $2.50/$12.50 ב-Batch (התעריפים המפורסמים של Ant​hropic, נקראו ב-2026-09-24).

Claude Fable 5.1 — $10.00 קלט, $50.00 פלט, $0.25 קריאת מטמון, $12.50 לכתיבת מטמון של 5 דקות, $20.00 לכתיבה של שעה, $5.00/$25.00 ב-Batch (התעריפים המפורסמים של Ant​hropic, נקראו 2026-09-24).

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

שורת המטמון היא המקום שבו חיוב הסוכן נקבע בפועל

סיקור ההשקה מתייחס לקריאה מהמטמון כהערת שוליים. זהו המנוף הגדול ביותר בגיליון עבור כל עומס עבודה ששולח מחדש קידומת גדולה, שהם רוב עומסי העבודה של קידוד וסוכנים.

ההערת השוליים של Anthropic עצמה מפורשת באופן יוצא דופן לגבי היחסים: פגיעות מטמון ורענונים עולים פי 0.1 ממחיר הקלט הבסיסי ברוב דגמי Claude, פי 0.025 ב-Claude Fable 5.1, ופי 0.05 ב-Claude Opus 5.5. לכן יחס המטמון של Claude Opus 5.5 גרוע פי שניים מהסטנדרטי, וגרוע פי שניים מזה של Claude Fable 5.1.

בדולרים זה בכל מקרה מנצח, וזה החלק ששווה להפנים: מכפיל טוב יותר לא מנצח בדולרים כשהשיעור הבסיסי גבוה פי שניים וחצי.

• Claude Fable 5.1 — 2.5% מבסיס של $10.00 מסתכמים ב$0.25 לכל מיליון טוקנים במטמון.

• Claude Opus 5.5 — 5% מבסיס של $4.00 הם $0.20 למיליון טוקנים במטמון.

• Claude Opus 5 — 10% מבסיס של $5.00 הם $0.50 למיליון טוקנים במטמון.

אותו היפוך חל גם על כתיבות. Claude Fable 5.1 גובה $12.50 עבור כתיבת מיליון טוקנים אל מטמון של 5 דקות ו-$20.00 עבור חלון של שעה; Claude Opus 5.5 גובה $5.00 ו-$8.00. קריאות מהמטמון הן השורה היחידה שבה Claude Opus 5.5 מנצח את שני האחים שלו בדולרים מוחלטים למרות שיש לו את יחס הביניים.

שני כללים קובעים אם בכלל שווה לשלם על הכתיבה. התיעוד של Ant​hropic אומר שכתיבה של 5 דקות עולה פי 1.25 מקלט הבסיס, ולכן היא משתלמת לאחר קריאת מטמון אחת, ואילו כתיבה של שעה עולה פי 2 מקלט הבסיס וזקוקה לשתי קריאות כדי להשתלם. והמטמון קשור לתחילית שיצרה אותו: Ant​hropic מציינת שמעבר בין מהירות מהירה למהירות סטנדרטית מבטל את המטמון, מכיוון שבקשות במהירויות שונות אינן חולקות תחיליות שנשמרו במטמון. לשינוי המודל, רמת המאמץ או הגדרות הכלים יש אותה השפעה. מודל זול יותר שמאלץ כתיבה מחדש של התחילית בכל החלפה יכול לעלות יותר מהמודל היקר שהוא החליף.

כמה באמת עולה לולאת סוכן ארוכה

קח סוכן קידוד של 40 תורים ששולח מחדש קידומת של 120,000 טוקנים — הנחיית מערכת, סכמות כלים, עץ קבצים — בכל תור, מוסיף 1,000 טוקני קלט חדשים בכל תור מתוצאות כלים, ומייצר 800 טוקני פלט בכל תור. ההחלפה היא העיקר כאן: שנה כל אחד מארבעת המספרים האלה כך שיתאימו לתעבורה שלך, והחשבון שלמטה עדיין תקף.

על Claude Opus 5.5:

• כתיבת מטמון, פעם אחת — 120,000 טוקנים ב-$5.00 למיליון = $0.60

• קריאות מטמון, 39 סבבים — 4,680,000 טוקנים במחיר $0.20 למיליון = $0.94

• קלט חדש, 40 סבבים — 40,000 טוקנים ב-4.00 דולר למיליון = $0.16

• פלט, 40 סבבים — 32,000 אסימונים במחיר $20.00 למיליון = $0.64

סה״כ הסשן — $2.34, כאשר קריאות מהמטמון מהוות כ-40% ממנו.

ב-Claude Opus 5, עם מספרי טוקנים זהים: $0.75 של כתיבה למטמון, $2.34 של קריאות מהמטמון, $0.20 של קלט חדש ו-$0.80 של פלט — $4.09.

ב-Claude Fable 5.1, עם מספרי טוקנים זהים: $1.50 של כתיבה למטמון, $1.17 של קריאות מהמטמון, $0.40 של קלט חדש ו-$1.60 של פלט — $4.67.

אותם טוקנים, אותם סבבים, ואין צורך בשום טענת יעילות: Claude Opus 5.5 יוצא 43% מתחת ל-Claude Opus 5 ו-50% מתחת ל-Claude Fable 5.1. ומ-1.40$ מתוך פער של 1.75$ לעומת Claude Opus 5 — שמונים אחוזים מהחיסכון — מגיעים משורת קריאת המטמון בלבד, ולא מתעריף הקלט המוצהר.

כעת הרץ את הצורה ההפוכה: קריאה בודדת עם 20,000 טוקני קלט ו-8,000 פלט, ללא מטמון. Claude Opus 5.5 עולה $0.08 עבור קלט ועוד $0.16 עבור פלט — $0.24. Claude Opus 5 עולה $0.10 ועוד $0.20 — $0.30. זה בדיוק הקיצוץ של 20% במחיר המחירון, ולא נקודת אחוז אחת יותר.

אז המחירון לבדו מניב אי שם בין 20% ל-43%, תלוי בכמה מהחשבון שלך הוא קריאות מטמון. כל טענה מעל לטווח הזה מגיעה מספירת טוקנים, לא ממחירים.

מאיפה מגיע ה״כ-40% זול יותר להפעלה״ של Anthropic

חומרי ההשקה של Ant​hropic אומרים ש-Claude Opus 5.5 "דורש פחות מחשוב כדי לשרת מאשר Opus 5", ושהבדיקות שלו מראות שהוא "יעלה 40% פחות מ-Opus 5 בעומסי עבודה טיפוסיים" בהגדרות ברירת מחדל. הפירוק ש-Ant​hropic מספקת הוא שהמודל "עולה פחות לכל טוקן מ-Opus 5 ומשתמש בפחות טוקנים לכל משימה, מה שמסתכם לירידה של 40% בעלויות."

תייג את זה כפי שזה: אפיון ספק של ממוצע על פני עומסי עבודה אשר Anthropic בחרה, לא תוצאה מבוקרת ולא תעריף שמפורסם בגיליון המחירים. החצי שניתן לאימות הוא החצי הראשון — 20% הנחה על קלט ופלט, 60% הנחה על קריאות מטמון, שתיהן קריאות בגיליון היום. החצי השני תלוי בכך שהמודל מוציא פחות טוקנים ופחות תורות על שלךעומס העבודה, שניתן לבדוק רק על ידי הרצה שלו, שהוא

הראיות ש-Ant​hropic מציעה עבור חצי הטוקן הן אוסף של הצהרות לקוחות מזמן ההשקה. כל הבאים פורסמו על ידי הספק ומתארים עומסי עבודה שהספק ולקוחותיו בחרו בהם:

Box — המודל "השתמש בשליש מהטוקנים ש-Opus 5 השתמש בהם", עם תשובות "פחות מילוליות ב-40% בלי לאבד דיוק".

Kiro — הוא "פתר יותר מ-Opus 5 תוך ביצוע כ-40% פחות קריאות ושימוש במחצית מהטוקנים."

Factory — הוא "השתווה ל-Opus 5 במאמץ גבוה, בעודו משתמש ב-20 עד 25% פחות טוקנים בפלט."

GitHub — הוא "השתמש באחד ממספרי הטוקנים והשלבים הקטנים ביותר שמדדנו", וב-VS Code "פתר יותר משימות טרמינל מ-Opus 5 בפחות ממחצית מהשלבים".

ניתוח מיזוגים, דוגמה מעובדת אחת — שתי חברות פיקטיביות לתוכנה לניהול משאבי אנוש, כשכל מודל בונה מודל אקסל ומצגת להנהלה. Anthropic מדווחת כי Claude Opus 5.5 סיים ב-63 דקות לעומת 93 של Claude Opus 5 ו"עלה 50% פחות להפקה". דיווח ספק, n=1.

המשקל הנגדי הבלתי־תלוי חשוב כאן, משום שהוא מצביע לכיוון ההפוך. Artificial Analysis מדדה את Claude Opus 5.5 במאמץ מקסימלי ב־כ־119,000 אסימוני פלט לכל משימת Intelligence Index, לעומת כ־73,000 עבור Claude Opus 5 במאמץ מקסימלי — מספר האסימונים נע כלפי מעלה, לא כלפי מטה. הסיכום שלה של אותה תצורה הוא ש-Claude Opus 5.5 נמצא באותה רמה כמו Opus 5 מבחינת עלות למשימה למרות פי 1.6 מאסימוני הפלט, בעלות שפורסמה של $5.98 לכל משימת Intelligence Index. זוהי מדידה בלתי־תלויה במאמץ מקסימלי, והיא אינה סתירה לטענת Anthropic — זהו הקצה האחר של סולם המאמץ.

מה שמעלה את ההסתייגות שחלה על כל מספר בסעיף הזה. Anthropic מציינת שאם לא צוין אחרת, כל תוצאות Claude Opus 5.5 שלה משתמשות בחשיבה אדפטיבית בעוצמת מאמץ מקסימלי. ברירת המחדל של Claude Opus 5.5 היא בינונית; ברירת המחדל של Claude Opus 5 הייתה גבוהה, ואותה רמה בשמה אינה אותו תקציב חשיבה בשני המודלים. לכן טבלת ספק שהורצה במאמץ מקסימלי וטבלה בלתי תלויה שהורצה במאמץ מקסימלי עם הפעלת נפילה לברירת מחדל אינן אותה תצורה, וגם הגדרת ברירת המחדל אינה מה שקורא היה פורש בפועל. ממוצע של 40% שנמדד על פני סט נבחר של עומסי עבודה, בהגדרות שאולי לא תשתמשו בהן, הוא השערת מוצא — לא שורת תקציב.

מצב מהיר הוא תצוגה מקדימה מחקרית, לא רמה

מצב מהיר ב-Claude Opus 5.5 הוא 8.00$ למיליון טוקני קלט ו-40.00$ למיליון טוקני פלט — בדיוק כפול מהתמחור הסטנדרטי — עבור עד פי 2.5 יותר טוקני פלט בשנייה. הוא אינו משפר את הזמן עד לטוקן הראשון; הרווח הוא במהירות הפלט, והוא ניכר ביותר עם סטרימינג.

אמור את השאר בפשטות, כי קל לתקצב את זה כמדרגה כשהוא אינו כזו. Ant​hropic מכנה את המצב המהיר כתצוגה מקדימה מחקרית. הגישה מתבקשת דרך מנהל חשבון או רשימת ההמתנה. השימוש בו דורש את fast-mode-2026-02-01 כותרת הבטא, ואת speed: "fast" על הבקשה. הוא זמין ב-Claude API בלבד — לא ב-Amazon Bedrock, Goo​gle Cloud, Microsoft Foundry, או Claude Platform on AWS. לא ניתן לשלב אותו עם Batch API או עם התחייבות ל-Priority Tier. הוא כן מצטבר עם מטמון פרומפט ומכפילי מיקום נתונים, כך שבקשה במצב מהיר, שמורה במטמון ומוצמדת לארה״ב, משלמת 1.1x על גבי 2x. והחלפה של עומס עבודה בין מצב מהיר למהירות רגילה מבטלת את מטמון הפרומפט, מה שבלולאת סוכן ארוכה יכול לעלות יותר ממה שהמהירות חוסכת.

Claude Opus 5 ו-Claude Opus 4.8 תומכים גם במצב מהיר, במחיר של $10.00/$50.00. Claude Opus 4.7 דוחה את הפרמטר לחלוטין.

היחידה שקובעת את החשבון היא עלות לכל משימה שהושלמה

כל תעריף שמופיע לעיל הוא מחיר לכל טוקן. איש אינו קונה טוקנים. מחיר לכל טוקן הופך לעלות רק כשמכפילים אותו במספר הטוקנים שמשימה צורכת ובמספר הניסיונות שנדרשים כדי לסיים אותה.

הרץ את החישוב על דוגמת ה-cache-light מהקודם. במחיר של $0.24 לכל מעבר, מודל שמסיים משימה בניסיון הראשון עולה $0.24. אותה משימה אצל מתחרה ב-$0.30 לכל מעבר עולה $0.30 — כך שהמודל הזול נראה ביתרון של 20%. כעת נניח שהמודל הזול זקוק ל-1.2 מעברים לכל משימה שהושלמה, שזה שיעור הצלחה נדיב לעבודת סוכנים: 1.2 × $0.24 הוא $0.288, לעומת $0.30 לחלופה של מעבר יחיד. החיסכון נעלם. בשלושה מעברים זה $0.72, והמודל שנראה זול ב-20% לכל טוקן הוא יקר ב-140% לכל משימה שהושלמה.

זו הסיבה לכך שטענות היעילות של Ant​hropic עצמה — פחות טוקנים, פחות קריאות, פחות שלבים — מנוסחות ביחידה הנכונה. זו גם הסיבה לכך שאף אחת מהן לא צריכה להילקח כשורת תקציב עד שתשחזרו אותן. הבדיקה מכנית: מחיר לכל מעבר, כפול מספר המעברים לכל משימה מוגמרת, נמדד בתעבורה שלכם. את שני המספרים תצטרכו להפיק בעצמכם, ואף ספק לא מפרסם את המספר השני עבור עומס העבודה שלכם.

אם אתם מחפשים נקודת התייחסות אחת מגורם חיצוני לספק, Artificial Analysis מציבה את Claude Opus 5.5 ב-5.98 דולר לכל משימת Intelligence Index בתצורת max-effort שלו — נתון בלתי תלוי בהגדרה שרוב תעבורת הייצור לא תשתמש בה, שימושי כתקרה ולא כתחזית.

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

שורות שתעריף הכותרת אינו כולל

תושבות. הסקה בארה״ב בלבד היא פי 1.1 בכל קטגוריית טוקנים, כולל קריאה וכתיבה של מטמון. היא מצטברת עם מצב מהיר ועם הנחת Batch.

הגדרות כלים. Anthropic מפרסמת תקורה של הנחיית מערכת לשימוש בכלים לכל מודל: הצהרה על כלים מוסיפה 286 טוקנים לכל בקשה של Claude Opus 5.5. זה קטן ב-4.00 דולר למיליון, אך זה מחויב לפי בקשה, ולולאת סוכנים שולחת המון בקשות.

ביטול תוקף המטמון. קידומת שנכתבת מחדש לאחר שינוי במודל, ברמת המאמץ, בהגדרת כלים או במהירות תחויב לפי תעריף הכתיבה — 5.00$ או 8.00$ למיליון ב-Claude Opus 5.5 — ולא לפי תעריף הקריאה של 0.20$.

המודל שמתחתיו.Claude Sonnet 5 עומד על $2.00 לקלט ו-$10.00 לפלט למיליון, והערת השוליים בתמחור של Anthropic מאשרת שזהו כעת המחיר הסטנדרטי ולא תעריף ההיכרות כפי שהוא הוכרז. Claude Opus 5.5 הוא בדיוק פי 2 מ-Sonnet 5 בשני הכיוונים.

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

קריאה ל-Claude Opus 5.5 במחיר המחירון של Anthropic

Claude Opus 5.5 נמצא ב-OrcaRouter בכתובת anthropic/claude-opus-5.5 תמורת $4.00 לקלט ו-$20.00 לפלט לכל מיליון — מחיר המחירון של Ant​hropic עצמה, מועבר הלאה�תוספת 0% תוספת. ראוי לציין את ההעברה הזו במדויק בדף תמחור: מכיוון שתעריף הספק מועבר הלאה ולא נשמר במטמון בטבלה, שינוי בתעריף של ספק נכנס לתוקף כאן באותו יום שבו הוא מתפרסם, ולא לאחר חלון סנכרון. אם Ant​hropic תשנה את המחירון הזה, המספר שאליו אתה מתקשר ינוע יחד איתו.

אותו מפתח מגיע לשכבות שדף זה משווה אותו אליהן — anthropic/claude-opus-5 במחיר $5.00/$25.00 ו-anthropic/claude-fable-5.1 במחיר $10.00/$50.00 — לצד שאר מצע Claude ו-יותר מ-200 מודלים אחרים, כך שבדיקת השאלה האם תעריף נמוך יותר לכל טוקן שורד מפגש עם ספירות המעברים שלך אינה מצריכה חוזה נוסף או שינוי בקוד. מעבר אוטומטי בעת כשל קיים למקרה שבו ברצונך להריץ מודל לא מוכר בנתיב ייצור בלי להמר על הנתיב.

התשובה בשתי שורות למה שהעמוד הזה עוסק בו: מחירון התעריפים הוא $4.00 לקלט, $20.00 לפלט ו-$0.20 למיליון קריאות מהמטמון, והקיצוץ של 20% הוא אמיתי וניתן לאימות כבר היום. ה-40% הוא הממוצע של Anthropic על פני עומסי העבודה שהיא בחרה. הרץ אחת מלולאות הסוכנים שלך דרכו לפני שאתה מתקצב לפי המספר השני.

השוואות במאמר הזה3

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית