כרטיס hero מחולל עבור 'תעריפים זהים, פי שלושה בחשבון', עם תג 'אותה מדבקה' וקיקר 'שני מודלים, $0.10 ו-$0.50, שאלה אחת' וכתובית 'Claude Haiku 5.5 מול GPT-6 Luna: אותם שני מספרים, וספים שונים מאוד.' ארבעה צ'יפים מציגים '$0.10 / $0.50 שניהם', '100K מול 272K', '$0.21 מול $0.07' ו-'43.40 מול 38.12'. שני כרטיסים למטה מסומנים 'אותו דבר' ('$0.10 קלט ו-$0.50 פלט תחת השכבה הראשונה, וחלון של 1M טוקנים בשניהם') ו'לא אותו דבר' ('המדרגה נמצאת ב-100,000 טוקנים לעומת 272,000, והעלות למשימה שונה פי שלושה'). כותרת תחתונה מציינת 'תעריפי מחירון מפורסמים של ספקים; מדידות עצמאיות מ-Artificial Analysis, נכון ל-8 באוקטובר 2026.' הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Claude Haiku 5.5 מול GPT-6 Luna: אותו מחיר מחירון, פי שלושה החשבון

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Claude Haiku 5.5 וGPT-6 Luna מתומחרים באופן זהה על הנייר: $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט, אותם שני מספרים עד לסנט האחרון, משני ספקים שכמעט nunca מסכימים על שום דבר. פוסט ההשקה של Ant​hropic אף מציג את הציונים של Luna בעמודה שלצד שלו עצמו, דבר שספקים לא עושים עם מודלים שהם רואים בהם איום.

שני הכרטיסים נבדלים בכל מה שהמדבקה מסתירה. Luna שומרת על התעריף הזה עד 272,000 טוקנים לפני שהיא עולה מדרגה; Claude Haiku 5.5 עולה מדרגה ב־100,000. Claude Haiku 5.5 משיג 43.40 ב־Artificial Analysis Intelligence Index v4.3.2, לעומת 38.12 של Luna — ועולה $0.21 לכל משימת Index שהושלמה, לעומת $0.07 של Luna. אותו מחיר, חשבון גבוה פי שלושה, חמש נקודות יותר אינטליגנציה. זו כל העסקה, והיא נקייה יותר מרוב ההשוואות ראש בראש בטווח הזה.

שני כרטיסים, זה לצד זה

למיליון טוקנים בדולר אמריקאי, לפי התעריפים המפורסמים של Anthropic ו-OpenAI כפי שהם משתקפים בקטלוג שלנו, עם מדידות בלתי תלויות המיוחסות ל-Artificial Analysis. נשמר במטמון 2026-10-08.

A generated scoreboard titled 'Claude Haiku 5.5 vs GPT-6 Luna - two cards, side by side'. Claude Haiku 5.5 reads input $0.10 under the first tier and $0.50 past 100,000, output $0.50 and $2.50 past 100,000, maximum output 128,000 tokens, Intelligence Index v4.3.2 43.40, cost per task $0.21, output speed 241.9 tokens per second. GPT-6 Luna reads input $0.10 under the first tier and $0.20 past 272,000, output $0.50 and $0.75, maximum output 128,000 tokens, Intelligence Index v4.3.2 38.12, cost per task $0.07, output speed 129.4 tokens per second. A footer reads 'Vendors' published list rates; independent measurements from Artificial Analysis.'

• קלט — Claude Haiku 5.5 $0.10 עד 100,000 טוקנים, $0.50 מעל זה. GPT-6 Luna $0.10 עד 272,000 טוקנים, $0.20 מעל זה.

• פלט — Claude Haiku 5.5 $0.50 עד 100,000 טוקנים, $2.50 מעל זה. GPT-6 Luna $0.50 עד 272,000 טוקנים, $0.75 מעל זה.

• קלט וכתיבה במטמון — שניהם ב-$0.01 וב-$0.125 מתחת לסף הראשון, כאשר Claude Haiku 5.5 עובר ל-$0.05 ול-$0.625 מעבר ל-100,000 טוקנים ו-GPT-6 Luna ל-$0.02 ול-$0.25 מעבר ל-272,000.

• הקשר ופלט — 1M טוקנים לשניהם; 128,000 פלט מקסימלי לשניהם. שני אלה באמת באותה צורה.

• חשיבה — אדפטיבית בשניהם, ושניהם עם פרמטר מאמץ. רמת המאמץ המוגדרת כברירת מחדל של Claude Haiku 5.5 היא בינונית; לא כל הציונים שפורסמו נמצאים בהגדרה הזו.

• ציון עצמאי — Claude Haiku 5.5 (Max) 43.40, שני מתוך 182 מודלים. GPT-6 Luna (Max) 38.12, שמיני מתוך 182.

• עלות עצמאית לכל משימה — $0.21 לעומת $0.07.

• מהירות — 241.9 אסימוני פלט לשנייה לעומת 129.4, כפי שנמדד על ידי אותו מעריך.

הסף הוא המקום שבו נמצא ההבדל

שני הספקים בנו מחירון דו-שכבתי. הם עשו זאת במקומות שונים מאוד, והמיקום חשוב הרבה יותר מהמספר שבראש.

המדרגה של Anthropic עומדת על 100,000 טוקנים. מתחתיה אתם משלמים $0.10 ו-$0.50; מעליה, פי חמישה ופי חמישה — $0.50 ו-$2.50. Anthropic אומרת שפרומפטים מתחת לסף היוו כ-90% מהבקשות למודל Haiku הקודם שלה, וזה תמהיל התעבורה של הספק עצמו ותיאור סביר של עומסי עבודה של קריאות קצרות בכלל.

המדרגה של OpenAI עומדת על 272,000 טוקנים. מתחתיה, $0.10 ו-$0.50 — זהים לאלה של Ant​hropic. מעליה, $0.20 ו-$0.75, הכפלה ועלייה של 50%. זו מדרגה מתונה בהרבה, והיא מתחילה כמעט פי שלושה רחוק יותר.

קחו פרומפט של 200,000 טוקנים, גודל סביר לצינור עיבוד של מסמכים ארוכים וסביר לחלוטין בחלון של מיליון טוקנים. ב-Claude Haiku 5.5 הבקשה הזו מחויבת לפי המדרגה השנייה: 0.50 דולר לקלט, 2.50 דולר לפלט. ב-GPT-6 Luna היא עדיין במדרגה הראשונה: 0.10 דולר לקלט, 0.50 דולר לפלט. פי חמישה מתעריף הקלט ופי חמישה מתעריף הפלט, על אותה בקשה, בין שני מודלים עם אותו מחיר מוצהר. זה לא ניואנס — עבור עומס עבודה של פרומפטים ארוכים זו כל ההשוואה.

מדוע אותו תעריף מניב חשבון גבוה פי שלושה

העלות לכל משימה היא המספר שאמור להכריע בצינור עיבוד בנפח גבוה, וכאן נפרדות דרכיהם של שני המודלים באופן שכרטיס התעריפים אינו יכול להסביר.

Artificial Analysis מציבה את GPT-6 Luna (Max) על $0.07 לכל משימת Intelligence Index ואת Claude Haiku 5.5 (Max) על $0.21 — פי שלושה, על בסיס תעריפי מחירון זהים, עבור פער של 5.28 נקודות בציון. הסיבה נמצאת באותו עמוד והיא לא עדינה. Claude Haiku 5.5 יצר 440 מיליון טוקני פלט בעת הרצת ה-Index מול חציון של 100 מיליון, והמעריך מכנה אותו רב-מלל מאוד. GPT-6 Luna יצר 140 מיליון מול אותו חציון של 100 מיליון, ותואר כרב-מלל במידה מסוימת. פי שלושה טוקני פלט הם פי שלושה בחשבון כאשר הפלט הוא המדד השולט.

המספרים של Ant​hropic עצמה מצביעים לאותו כיוון. תרשימי העלות מול דיוק של הספק מציגים את Haiku 5.5 על פני כל טווח המאמץ, והציטוט המובלט מההשקה הוא ש-Sonnet 5.5 ו-Opus 5.5 נותרו הבחירות הטובות יותר לעבודת קידוד אג'נטית מורכבת, בעוד Haiku 5.5 ממוקם במקום זאת לדחיסה, סיכום ותת-סוכנים. ככל שהמשימה קטנה יותר, כך קונים פחות מאותה בעיית מילוליות — וזה בדיוק עומס העבודה שהמודל נבנה עבורו, ובדיוק עומס העבודה שבו פער עלות של פי שלושה שווה לבדוק מול הלוגים שלכם ולא מול לוח.

עוד רשומה אחת בספר החשבונות, מהתיעוד של Ant​hropic ולא מהתיעוד של המעריך: Claude Haiku 5.5 משתמש בטוקנייזר החדש יותר המשותף עם Claude 4.7 ואילך, כך שאותו טקסט נספר בערך כ-30% יותר טוקנים מאשר ב-Haiku הקודם. התעריף זהה לזה של Luna; הטוקנייזר לא.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table, with the per-million-token input, output and cache rates and the 100,000-token threshold at which the second tier begins.

מה שהטבלה של Anthropic עצמה אומרת על Luna

דף ההשקה של Ant​hropic מציג את GPT-6 Luna כעמודה בטבלת הבנצ'מרק שלו, והדרך הכנה לדווח על כך היא עם הייחוס מצורף: אלה ההערכות של Ant​hropic, שהורצו על תשתית ההערכה של Ant​hropic, מול המודל של מתחרה. הן מדווחות על ידי הספק, ולא שוחזרו באופן בלתי תלוי, וספק שמריץ את מערכת הבדיקות שלו מול הציונים של יריב הוא השוואה שיש לשקול ולא לקבל כמובן מאליו.

• עבודת ידע — GDPval-AA v2.1 ב-1620 עבור Claude Haiku 5.5 לעומת 1437 עבור GPT-6 Luna. AA-Briefcase v1.1 ב-1578 לעומת 1336.

• שימוש במחשב — תת-קבוצה לא מקוונת של OSWorld 2.1 ב-72.4% לעומת 48.9%.

• קידוד אייג'נטי — Terminal-Bench 4.0 ב-39.2% לעומת 16.4%; FrontierCode 1.1 (Main) ב-46.4% לעומת 42.4%.

• חשיבה חזותית — Chartography עם 46.4% ללא כלים לעומת 29.1%.

במערכת הבדיקות של הספק עצמו, Claude Haiku 5.5 מוביל בכל שורה. בלוח העצמאי הוא מוביל בפער קטן יותר — 43.40 לעומת 38.12 — וזהו היחס הרגיל בין טבלה של ספק לזו של צד שלישי, והסיבה ששניהם מוצגים כאן. השניים מסכימים על הכיוון וחלוקים על גודל הפער.

הצעת החוק היא ההצבעה המכריעה

העמידו את ארבע העובדות שבאמת חשובות זו מול זו, והבחירה מפסיקה להיות צמודה עבור רוב עומסי העבודה.

GPT-6 Luna זול יותר לכל משימה שהושלמה פי שלושה במדידה העצמאית, מדרגת המחיר הראשונה שלו מגיעה פי שמונה־עשרה רחוק יותר במעלה חלון ההקשר, שיעורי החריגה מעל הסף שלו נמוכים יותר בשני המדדים, והוא היחיד מבין השניים שקנס ההקשר הארוך שלו הוא הכפלה ולא קפיצה של פי חמישה. Claude Haiku 5.5 מוביל באינטליגנציה הנמדדת בפער שהוא אמיתי וצנוע, מהיר יותר בפי כמעט שניים בפלט, ו—בהרנס של הספק עצמו, שבו הפער הוא הרחב ביותר—מוביל בכל שורת בנצ׳מרק שפורסמה.

אם הקריאות שלך קצרות, אם התפוקה היא האילוץ, או אם פער האיכות מתגלה בהערכה שלך עצמך — שלם את המחיר המשולש. אם הקריאות שלך ארוכות, אם הן נוצרות על ידי מכונה ואף פעם לא נקראות בידי אדם, או אם אתה מריץ שכבת סיווג שמופעלת מיליון פעמים ביום, אותם $0.10 ו-$0.50 יקנו לך חשבון בגודל שליש בצד השני, והיכולת שאתה מוותר עליה היא חמישה נקודות בלוח ששני המודלים יושבים בו סמוך לצמרת.

קריאה לאחד מהם ממקום אחד

הדבר המועיל בהשוואה כה צמודה הוא שאינכם אמורים להסתמך על המילה של איש, כולל שלנו. GPT-6 Luna נמצאת היום בקטלוג של OrcaRouter בתעריף של הספק עם 0% תוספת — אותו מבנה תעריפים שמודפס למעלה, מועבר כמו שהוא ולא ממוזג — וכך גם Claude Sonnet 5.5 ו-Claude Opus 5.5, מה שהופך בדיקת הסלמה מרגל זול לדרגת ביניים לקונפיגורציה ולא לפרויקט. מפתח אחד, SDK אחד, מעבר אוטומטי לגיבוי מתחת למכסה, וה-DSL של הניתוב אם ההסלמה שייכת לנתיב ולא לאפליקציה שלכם.

Claude Haiku 5.5 אינו בקטלוג עדיין. לומר זאת בפשטות מועיל יותר מאשר לרמוז אחרת: ניתן לקרוא לצד Luna של השוואה הזו מאיתנו הבוקר, ואל צד Anthropic יש להגיע דרך Anthropic עד שזה לא יהיה כך.

A screenshot of the OrcaRouter catalogue page for GPT-6 Luna, showing the model identifier openai/gpt-6-Luna, the provider OpenAI, a 1M-token context window, 128,000 maximum output, the release date September 22 2026, the $0.10 per million input and $0.50 per million output rates and a p50 time to first token of 1.49 seconds.

מה ישנה את התשובה

שני דברים, ושניהם כדאי לראות במקום להעריך.

הראשון הוא אם המילוליות משתנה. העלות למשימה של Claude Haiku 5.5 היא פונקציה של מספר הטוקנים שהוא מוציא לכל תשובה במאמץ מקסימלי, ופרמטר המאמץ הוא המנוף על כך. צוות שקובע מאמץ נמוך יותר — ברירת המחדל של המודל עצמו היא בינונית, לא מקסימלית — יראה נתון עלות-למשימה קרוב יותר לשל Luna, וגם ציון קרוב יותר לשל Luna. הפשרה זמינה; מה שזה שווה הוא שאלה לגבי ההערכה שלך, לא לגבי המודל.

השנייה היא האם מספרי העלות-למשימה הבלתי-תלויים מחזיקים מעמד כששני המודלים צוברים עוד ריצות מדודות. מיקום בודד בטבלה הוא תמונת מצב, ופער פי שלושה שמופיע בתמונת מצב אחת שווה אימות מול החשבונית שלך לפני שבונים מחדש צינור עיבוד סביבו. לשם כך נועדה נקודת הקצה המשותפת.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית