
Claude Haiku 5.5 מול GPT-6 Luna: אותו מחיר מחירון, פי שלושה החשבון
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Claude Haiku 5.5 וGPT-6 Luna מתומחרים באופן זהה על הנייר: $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט, אותם שני מספרים עד לסנט האחרון, משני ספקים שכמעט nunca מסכימים על שום דבר. פוסט ההשקה של Anthropic אף מציג את הציונים של Luna בעמודה שלצד שלו עצמו, דבר שספקים לא עושים עם מודלים שהם רואים בהם איום.
שני הכרטיסים נבדלים בכל מה שהמדבקה מסתירה. Luna שומרת על התעריף הזה עד 272,000 טוקנים לפני שהיא עולה מדרגה; Claude Haiku 5.5 עולה מדרגה ב־100,000. Claude Haiku 5.5 משיג 43.40 ב־Artificial Analysis Intelligence Index v4.3.2, לעומת 38.12 של Luna — ועולה $0.21 לכל משימת Index שהושלמה, לעומת $0.07 של Luna. אותו מחיר, חשבון גבוה פי שלושה, חמש נקודות יותר אינטליגנציה. זו כל העסקה, והיא נקייה יותר מרוב ההשוואות ראש בראש בטווח הזה.
שני כרטיסים, זה לצד זה
למיליון טוקנים בדולר אמריקאי, לפי התעריפים המפורסמים של Anthropic ו-OpenAI כפי שהם משתקפים בקטלוג שלנו, עם מדידות בלתי תלויות המיוחסות ל-Artificial Analysis. נשמר במטמון 2026-10-08.

• קלט — Claude Haiku 5.5 $0.10 עד 100,000 טוקנים, $0.50 מעל זה. GPT-6 Luna $0.10 עד 272,000 טוקנים, $0.20 מעל זה.
• פלט — Claude Haiku 5.5 $0.50 עד 100,000 טוקנים, $2.50 מעל זה. GPT-6 Luna $0.50 עד 272,000 טוקנים, $0.75 מעל זה.
• קלט וכתיבה במטמון — שניהם ב-$0.01 וב-$0.125 מתחת לסף הראשון, כאשר Claude Haiku 5.5 עובר ל-$0.05 ול-$0.625 מעבר ל-100,000 טוקנים ו-GPT-6 Luna ל-$0.02 ול-$0.25 מעבר ל-272,000.
• הקשר ופלט — 1M טוקנים לשניהם; 128,000 פלט מקסימלי לשניהם. שני אלה באמת באותה צורה.
• חשיבה — אדפטיבית בשניהם, ושניהם עם פרמטר מאמץ. רמת המאמץ המוגדרת כברירת מחדל של Claude Haiku 5.5 היא בינונית; לא כל הציונים שפורסמו נמצאים בהגדרה הזו.
• ציון עצמאי — Claude Haiku 5.5 (Max) 43.40, שני מתוך 182 מודלים. GPT-6 Luna (Max) 38.12, שמיני מתוך 182.
• עלות עצמאית לכל משימה — $0.21 לעומת $0.07.
• מהירות — 241.9 אסימוני פלט לשנייה לעומת 129.4, כפי שנמדד על ידי אותו מעריך.
הסף הוא המקום שבו נמצא ההבדל
שני הספקים בנו מחירון דו-שכבתי. הם עשו זאת במקומות שונים מאוד, והמיקום חשוב הרבה יותר מהמספר שבראש.
המדרגה של Anthropic עומדת על 100,000 טוקנים. מתחתיה אתם משלמים $0.10 ו-$0.50; מעליה, פי חמישה ופי חמישה — $0.50 ו-$2.50. Anthropic אומרת שפרומפטים מתחת לסף היוו כ-90% מהבקשות למודל Haiku הקודם שלה, וזה תמהיל התעבורה של הספק עצמו ותיאור סביר של עומסי עבודה של קריאות קצרות בכלל.
המדרגה של OpenAI עומדת על 272,000 טוקנים. מתחתיה, $0.10 ו-$0.50 — זהים לאלה של Anthropic. מעליה, $0.20 ו-$0.75, הכפלה ועלייה של 50%. זו מדרגה מתונה בהרבה, והיא מתחילה כמעט פי שלושה רחוק יותר.
קחו פרומפט של 200,000 טוקנים, גודל סביר לצינור עיבוד של מסמכים ארוכים וסביר לחלוטין בחלון של מיליון טוקנים. ב-Claude Haiku 5.5 הבקשה הזו מחויבת לפי המדרגה השנייה: 0.50 דולר לקלט, 2.50 דולר לפלט. ב-GPT-6 Luna היא עדיין במדרגה הראשונה: 0.10 דולר לקלט, 0.50 דולר לפלט. פי חמישה מתעריף הקלט ופי חמישה מתעריף הפלט, על אותה בקשה, בין שני מודלים עם אותו מחיר מוצהר. זה לא ניואנס — עבור עומס עבודה של פרומפטים ארוכים זו כל ההשוואה.
מדוע אותו תעריף מניב חשבון גבוה פי שלושה
העלות לכל משימה היא המספר שאמור להכריע בצינור עיבוד בנפח גבוה, וכאן נפרדות דרכיהם של שני המודלים באופן שכרטיס התעריפים אינו יכול להסביר.
Artificial Analysis מציבה את GPT-6 Luna (Max) על $0.07 לכל משימת Intelligence Index ואת Claude Haiku 5.5 (Max) על $0.21 — פי שלושה, על בסיס תעריפי מחירון זהים, עבור פער של 5.28 נקודות בציון. הסיבה נמצאת באותו עמוד והיא לא עדינה. Claude Haiku 5.5 יצר 440 מיליון טוקני פלט בעת הרצת ה-Index מול חציון של 100 מיליון, והמעריך מכנה אותו רב-מלל מאוד. GPT-6 Luna יצר 140 מיליון מול אותו חציון של 100 מיליון, ותואר כרב-מלל במידה מסוימת. פי שלושה טוקני פלט הם פי שלושה בחשבון כאשר הפלט הוא המדד השולט.
המספרים של Anthropic עצמה מצביעים לאותו כיוון. תרשימי העלות מול דיוק של הספק מציגים את Haiku 5.5 על פני כל טווח המאמץ, והציטוט המובלט מההשקה הוא ש-Sonnet 5.5 ו-Opus 5.5 נותרו הבחירות הטובות יותר לעבודת קידוד אג'נטית מורכבת, בעוד Haiku 5.5 ממוקם במקום זאת לדחיסה, סיכום ותת-סוכנים. ככל שהמשימה קטנה יותר, כך קונים פחות מאותה בעיית מילוליות — וזה בדיוק עומס העבודה שהמודל נבנה עבורו, ובדיוק עומס העבודה שבו פער עלות של פי שלושה שווה לבדוק מול הלוגים שלכם ולא מול לוח.
עוד רשומה אחת בספר החשבונות, מהתיעוד של Anthropic ולא מהתיעוד של המעריך: Claude Haiku 5.5 משתמש בטוקנייזר החדש יותר המשותף עם Claude 4.7 ואילך, כך שאותו טקסט נספר בערך כ-30% יותר טוקנים מאשר ב-Haiku הקודם. התעריף זהה לזה של Luna; הטוקנייזר לא.

מה שהטבלה של Anthropic עצמה אומרת על Luna
דף ההשקה של Anthropic מציג את GPT-6 Luna כעמודה בטבלת הבנצ'מרק שלו, והדרך הכנה לדווח על כך היא עם הייחוס מצורף: אלה ההערכות של Anthropic, שהורצו על תשתית ההערכה של Anthropic, מול המודל של מתחרה. הן מדווחות על ידי הספק, ולא שוחזרו באופן בלתי תלוי, וספק שמריץ את מערכת הבדיקות שלו מול הציונים של יריב הוא השוואה שיש לשקול ולא לקבל כמובן מאליו.
• עבודת ידע — GDPval-AA v2.1 ב-1620 עבור Claude Haiku 5.5 לעומת 1437 עבור GPT-6 Luna. AA-Briefcase v1.1 ב-1578 לעומת 1336.
• שימוש במחשב — תת-קבוצה לא מקוונת של OSWorld 2.1 ב-72.4% לעומת 48.9%.
• קידוד אייג'נטי — Terminal-Bench 4.0 ב-39.2% לעומת 16.4%; FrontierCode 1.1 (Main) ב-46.4% לעומת 42.4%.
• חשיבה חזותית — Chartography עם 46.4% ללא כלים לעומת 29.1%.
במערכת הבדיקות של הספק עצמו, Claude Haiku 5.5 מוביל בכל שורה. בלוח העצמאי הוא מוביל בפער קטן יותר — 43.40 לעומת 38.12 — וזהו היחס הרגיל בין טבלה של ספק לזו של צד שלישי, והסיבה ששניהם מוצגים כאן. השניים מסכימים על הכיוון וחלוקים על גודל הפער.
הצעת החוק היא ההצבעה המכריעה
העמידו את ארבע העובדות שבאמת חשובות זו מול זו, והבחירה מפסיקה להיות צמודה עבור רוב עומסי העבודה.
GPT-6 Luna זול יותר לכל משימה שהושלמה פי שלושה במדידה העצמאית, מדרגת המחיר הראשונה שלו מגיעה פי שמונה־עשרה רחוק יותר במעלה חלון ההקשר, שיעורי החריגה מעל הסף שלו נמוכים יותר בשני המדדים, והוא היחיד מבין השניים שקנס ההקשר הארוך שלו הוא הכפלה ולא קפיצה של פי חמישה. Claude Haiku 5.5 מוביל באינטליגנציה הנמדדת בפער שהוא אמיתי וצנוע, מהיר יותר בפי כמעט שניים בפלט, ו—בהרנס של הספק עצמו, שבו הפער הוא הרחב ביותר—מוביל בכל שורת בנצ׳מרק שפורסמה.
אם הקריאות שלך קצרות, אם התפוקה היא האילוץ, או אם פער האיכות מתגלה בהערכה שלך עצמך — שלם את המחיר המשולש. אם הקריאות שלך ארוכות, אם הן נוצרות על ידי מכונה ואף פעם לא נקראות בידי אדם, או אם אתה מריץ שכבת סיווג שמופעלת מיליון פעמים ביום, אותם $0.10 ו-$0.50 יקנו לך חשבון בגודל שליש בצד השני, והיכולת שאתה מוותר עליה היא חמישה נקודות בלוח ששני המודלים יושבים בו סמוך לצמרת.
קריאה לאחד מהם ממקום אחד
הדבר המועיל בהשוואה כה צמודה הוא שאינכם אמורים להסתמך על המילה של איש, כולל שלנו. GPT-6 Luna נמצאת היום בקטלוג של OrcaRouter בתעריף של הספק עם 0% תוספת — אותו מבנה תעריפים שמודפס למעלה, מועבר כמו שהוא ולא ממוזג — וכך גם Claude Sonnet 5.5 ו-Claude Opus 5.5, מה שהופך בדיקת הסלמה מרגל זול לדרגת ביניים לקונפיגורציה ולא לפרויקט. מפתח אחד, SDK אחד, מעבר אוטומטי לגיבוי מתחת למכסה, וה-DSL של הניתוב אם ההסלמה שייכת לנתיב ולא לאפליקציה שלכם.
Claude Haiku 5.5 אינו בקטלוג עדיין. לומר זאת בפשטות מועיל יותר מאשר לרמוז אחרת: ניתן לקרוא לצד Luna של השוואה הזו מאיתנו הבוקר, ואל צד Anthropic יש להגיע דרך Anthropic עד שזה לא יהיה כך.

מה ישנה את התשובה
שני דברים, ושניהם כדאי לראות במקום להעריך.
הראשון הוא אם המילוליות משתנה. העלות למשימה של Claude Haiku 5.5 היא פונקציה של מספר הטוקנים שהוא מוציא לכל תשובה במאמץ מקסימלי, ופרמטר המאמץ הוא המנוף על כך. צוות שקובע מאמץ נמוך יותר — ברירת המחדל של המודל עצמו היא בינונית, לא מקסימלית — יראה נתון עלות-למשימה קרוב יותר לשל Luna, וגם ציון קרוב יותר לשל Luna. הפשרה זמינה; מה שזה שווה הוא שאלה לגבי ההערכה שלך, לא לגבי המודל.
השנייה היא האם מספרי העלות-למשימה הבלתי-תלויים מחזיקים מעמד כששני המודלים צוברים עוד ריצות מדודות. מיקום בודד בטבלה הוא תמונת מצב, ופער פי שלושה שמופיע בתמונת מצב אחת שווה אימות מול החשבונית שלך לפני שבונים מחדש צינור עיבוד סביבו. לשם כך נועדה נקודת הקצה המשותפת.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
