
GPT-5.6 Luna לעומת Claude Haiku 4.5: דרגה זולה, שני חשבונות שונים בתכלית
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
GPT-5.6 Luna ו-Claude Haiku 4.5 הם השכבות הזולות של שתי משפחות דגמים חזיתיות שונות, והפער ביניהם תלוי לחלוטין באיזה מספר תסתכלו. לפי מחיר המחירון זהו מפלה מוחצת: $0.20 למיליון טוקני קלט מול $1.00. לפי העלות של Artificial Analysis לכל משימת Intelligence Index שהושלמה, היא $0.18 מול $0.21 — הבדל של כ-14%. אותם שני מודלים, שתי תשובות כנות, והסיבה שהן נבדלות היא הדבר האחד המועיל ביותר להבין לפני שבוחרים באחד.
הגרסה הקצרה: Luna הוא המודל החזק יותר על הנייר והמהיר יותר בתפוקה, אבל הוא חושב באריכות ומחייב על כך. Haiku 4.5 הוא ישן יותר, קטן יותר בהיקף, והרבה יותר צפוי מבחינת מה שבקשה תעלה. איזה מאלה חשוב יותר הוא מאפיין של עומס העבודה שלך, לא של המודלים.
במבט חטוף
• שוחרר — 9 ביולי 2026 לעומת 15 באוקטובר 2025
• חלון הקשר — 1M טוקנים לעומת 200K טוקנים
• פלט מקסימלי — 128K אסימונים לעומת 64K אסימונים
• קלט — טקסט, תמונה וקובץ לעומת טקסט, תמונה ו-PDF
• מחיר למיליון טוקנים — $0.20 קלט / $1.20 פלט לעומת $1.00 קלט / $5.00 פלט
• מדד האינטליגנציה של Artificial Analysis — 38, מקום 4 מתוך 177 לעומת 18, מקום 138 מתוך 200 (שניהם בתצורת חשיבה)
• עלות לכל משימת Intelligence Index — $0.18 לעומת $0.21
• מהירות פלט — 109.4 טוקנים לשנייה לעומת 84.7 טוקנים לשנייה
• שליטה בהסקה — חוגת מאמץ מ"ללא" עד "מקסימום" לעומת חשיבה מורחבת שמופעלת ידנית, ללא פרמטר מאמץ
• תאריך עדכון הידע האמין — פברואר 2026 לעומת פברואר 2025 (נתוני אימון עד יולי 2025)
• התחייבות לפרישה — לא פורסמה לעומת לא לפני 15 באוקטובר 2026
איפה GPT-5.6 Luna באמת מנצחת

יכולת, ובפער עצום. ציון Intelligence Index של 38 לעומת 18 אינו תוצאה צמודה. Luna מדורגת מעל Haiku במדד המשולב ש-Artificial Analysis בונה מהערכות של הסקה, ידע, מתמטיקה וקידוד, וזאת בעודו המודל הזול יותר לכל טוקן. מי שהשווה לאחרונה את שתי המשפחות הללו במדד שלפני ספטמבר — שבו Luna הציגה 51 ו-52 — צריך לשים לב שכל הסקאלה דורגה מחדש בספטמבר 2026, והיתרון של Luna שרד את הדירוג מחדש.
הקשר, פי חמישה. חלון של 1M טוקנים מול 200K מכריע קטגוריית עבודה בפני עצמו: מעברים על כל המאגר, מערכי מסמכים ארוכים, תמלולי סוכנים מורחבים שהיו מחייבים סיכום ב-Haiku. אם היישום שלך מוגדר לפי כמות ההקשר שעליו להחזיק, ההשוואה מסתיימת כאן.
מרווח פלט, פי שניים. מקסימום של 128K טוקני פלט לעומת 64K חשוב ליצירה ארוכה ולמחזורי סוכנים שמחזירים תוכניות מובנות ולא תשובות של שורה אחת.
תפוקה. 109.4 אסימוני פלט לשנייה לעומת 84.7 הוא הבדל אמיתי עבור ממשקי סטרימינג, אם כי זה לא אותו דבר כמו היענות — ראו את סעיף השהיה שלמטה.
המחיר, על המדבקה.מחיר נמוך פי חמישה בקלט ופי ארבעה בערך בפלט אינו שגיאת עיגול, ולעבודה עם פלט קצר זה כל ההחלטה.
היכן ש-Claude Haiku 4.5 עדיין מצדיק את מקומו
עלות צפויה. ההיסק של Haiku 4.5 הוא חשיבה מורחבת שאתה מפעיל ידנית. כשהיא כבויה, הוא עונה ישירות ומחייב באופן צפוי. חוגת המאמץ של GPT-5.6 Luna מגיעה עד למקסימום, וכל עלייה מדרגה היא עוד אסימוני פלט בתעריף הפלט. צוות שרוצה תקרת עלות שאפשר להצהיר עליה מראש ימצא ש-Haiku קל יותר לחשיבה, אפילו במחיר מחירון גבוה יותר.
תצורת אי-החשיבה היא ממש זולה להרצה.Artificial Analysis מדרגת את תצורת אי-החשיבה של Claude 4.5 Haiku במדד אינטליגנציה של 15, בלי נתון מפורסם של עלות למשימה, והיא מתאימה במידה סבירה למשימות שהרף בהן הוא פשוט "לפרסר את זה נכון" — סיווג כוונות, חילוץ שדות, החלטות ניתוב, טריאז' מודרציה. במשימות האלה הפער במדד בין 15 ל-38 הוא ברובו לא רלוונטי, משום שאף אחד מהמודלים לא מתבקש לחשוב.
המטמון והנחות האצווה הם תחום בוגר. Haiku 4.5 מגלם הנחה של 90% על קריאה ממטמון הפרומפטים והנחה של 50% ב-Batch API. ל-Luna כלכלת מטמון דומה, כך שזה קרוב יותר לתיקו מאשר ליתרון — אבל אם הפייפליין שלכם כבר פועל באצוות דרך הכלים של Anthropic, עלות ההגירה מ-Haiku היא עלות ממשית, והיא לא תופיע באף בנצ'מרק.
רקורד תפעולי מוכח. Haiku 4.5 נמצא בייצור מאז אוקטובר 2025 ונושא התחייבות פרישה פומבית שלא לפני 15 באוקטובר 2026. Luna בת חודשיים. עבור עומס עבודה שבו המודל הוא פרט ולא המוצר, היסטוריית ייצור של אחד עשר חודשים שווה משהו שבנצ'מרק לא יכול לבטא.
זהו המודל האמיתי יותר, בציר היחיד שמודד זאת.ההשוואה הישירה של Artificial Analysis מציבה את Luna בחזית כמעט בכל שורת יכולת — AA-Briefcase 1,339 מול 614, GDPval-AA v2 1,489 מול 854, AutomationBench-AA 50% מול 3%, Humanity's Last Exam 39% מול 10%, GDPpdf 24% מול 4%. היוצא מן הכלל הוא AA-Omniscience, שמעניש תשובות שגויות שנמסרו בביטחון על שאלות ידע: Luna מקבלת בו -10, לעומת -4 של Haiku. ציון שלילי פירושו שהעונש על הזיות עולה על הקרדיט על דיוק, והעונש של Luna גדול יותר. מדד משולב גבוה יותר אינו אותו דבר כמו תשובה מהימנה יותר, ובהערכה היחידה שנבנתה כדי להפריד בין שני הדברים האלה, המודל הישן יותר מצליח יותר.
חישוב העלויות על עומס עבודה אמיתי
קחו פייפליין שצורך 100 מיליון טוקני קלט ופולט 20 מיליון טוקני פלט בחודש.
• GPT-5.6 Luna — 100 × $0.20 = $20, ועוד 20 × $1.20 = $24. סה״כ $44 לחודש.
• Claude Haiku 4.5 — 100 × $1.00 = $100, ועוד 20 × $5.00 = $100. סה״כ $200 לחודש.
ביחסים האלה לונה זולה פי 4.5 בערך, וזה החישוב שרוב ההשוואות מפרסמות. כעת שנו הנחה אחת. אם מעלים את מאמץ החשיבה של לונה, אסימוני הפלט שלה גדלים, והפלט הוא הצד היקר — ב-1.20 דולר הוא עולה פי שישה ממה שעולה הקלט. דחפו את לונה לנקודה שבה היא פולטת 150 מיליון אסימוני פלט עבור אותה כמות עבודה, כמו שהיא עושה בסט ההערכה של Artificial Analysis, והסכום של 44 דולר הופך בנוחות ליותר מ-180 דולר. היתרון של פי 4.5 קורס לעבר שוויון.
הלקח אינו ש-Luna יקרה. הלקח הוא שהיתרון המחירי של Luna הוא פונקציה של כמה היא מדברת, וזהו פרמטר שאתה שולט בו. הנמך את ההסקה עבור חילוץ וסיווג וההנחה אמיתית. השאר אותה על מקסימום עבור הכול, וקנית מודל בעל יכולת גבוהה יותר במחיר שכבר אינו דומה למחיר שעל התווית שלו.
השהיה, ומספר שאסור לסמוך עליו
נתוני זמן עד לאסימון הראשון שפורסמו עבור שני המודלים הללו קרובים לחסרי תועלת, וכדאי להבין מדוע. ב-Artificial Analysis, תצורות החשיבה של שני המודלים מציגות השהיות של האסימון הראשון בסדר גודל של עשרות או אפילו מאות שניות, מכיוון שההרנס אינו פולט אסימון עד שהמודל מסיים את החשיבה. הנתון הזה מודד את מערך ההערכה, לא את המגיבוּת של המודל.
טלמטריית ניתוב היא מקור טוב יותר, מכיוון שהיא מודדת את המודל בייצור. הנתונים של OrcaRouter עצמה מציבים את GPT-5.6 Luna בחציון של 1.83 שניות לאסימון ראשון ובאחוזון ה-95 של 10.00 שניות, לעומת Claude Haiku 4.5 עם חציון של 3.81 שניות ו-9.47 שניות באחוזון ה-95. קריאה נכונה אומרת שהשניים קרובים יותר ממה שהלוחות מציעים: Luna מנצחת בבקשה האופיינית, והזנבות נמצאים בטווח של כחצי שנייה זה מזה. אם הדאגה שלך היא המקרה הגרוע ביותר ולא הממוצע, יש מעט מאוד ביניהם.
איזה אחד לבחור?
בחרו ב-GPT-5.6 Luna אם אתם מחזיקים הקשר ארוך, אם המשימה מרוויחה מהסקה אמיתית, אם הפלט ארוך או מובנה, או אם אתם רוצים את המודל החזק ביותר הזמין בתחתית טווח המחירים. זו גם הבחירה הטבעית יותר אם שאר הסטאק שלכם כבר פועל לפי ההתנהגות של משפחת OpenAI.
בחר ב-Claude Haiku 4.5אם העבודה שלך מתאפיינת בפלט קצר ובנפח גבוה, אם דרושה לך תקרת עלות שאפשר להצהיר עליה לפני שהבקשה רצה, אם צינור העיבוד שלך כבר בנוי סביב העיבוד באצוות והשמירה במטמון של Anthhropic, או אם עדיף לך מודל עם היסטוריית ייצור ומחזור חיים מפורסם על פני אחד בן חודשיים.
אל תבחרו באף אחד מהשניים עבור משימה שמודל הסקה קטן או מסווג מכוונן יכול לבצע. חלק ניכר מהתעבורה ששתי השכבות הללו סופגות הוא סיווג וחילוץ שהיו רצים בזול יותר על משהו צר יותר — והמודל הזול ביותר הוא תמיד זה שלא הייתם צריכים.
הרצת שניהם על מפתח אחד

ההשוואה מפסיקה להיות בלעדית ברגע ששניהם זמינים דרך נקודת קצה אחת. ב-OrcaRouter, Claude Haiku 4.5 ו-GPT-5.6 Luna נמצאים מאחורי אותה כתובת URL בסיסית תואמת OpenAI — API אחד ליותר מ-200 מודלים, מפתח אחד, שורת חיוב אחת, בלי חוזה שני, ובלי שינוי בקוד מעבר למזהה המודל. עבור החלטת שכבה שעדיין אינכם בטוחים בה, זה הופך מיגרציה לערך קונפיגורציה.
שני מאפיינים עושים כאן עבודה אמיתית. מעבר אוטומטי בין ספקים (failover) פירושו שמסלול בעלות נמוכה יכול לשאת תעבורת ייצור בלי תלות בספק אחד — שימושי כשהמודל זול מספיק כדי שתשלחו לו אלפי קריאות בשעה ולא קריאה אחת חשובה. וה-DSL לניתוב מאפשר לכם להרכיב קריאה מכמה מודלים: לנתב את הרוב הישיר של הבקשות אל Luna, להסלים את השאר אל GPT-5.6 Terra, ולהשאיר את Haiku 4.5 במאגר כגיבוי לכשת�רצו תשובה מספק שני ולא ניסיון חוזר.
בדוק את התעריף החי לכל טוקן ב-GPT-5.6 Luna וב-Claude Haiku 4.5 לפני שאתה מתחייב לאחד מהם למסלול ייצור — שני התעריפים מועברים הלאה עם תוספת של 0%, כך שהם משתנים ביום שהספק משנה אותם, ומעקבי מחירים של צד שלישי מפגרים בימים עד שבועות.
שאלות שבאמת שווה לענות עליהן
האם GPT-5.6 Luna באמת זול פי חמישה מ-Claude Haiku 4.5?במונחי טוקני קלט, כן — $0.20 מול $1.00. מבחינת העלות של השלמת אותה משימה מוערכת, לא: $0.18 מול $0.21. הפער בין שתי האמירות הללו הוא מילות היתר של Luna. היא מייצרת בערך פי שניים טוקני פלט ממה ש-Haiku מייצר כדי להשלים את אותה עבודה, וטוקני פלט עולים פי שישה מטוקני קלט. עבור תשובות קצרות המחיר הנקוב הוא בגדול הוגן. עבור עבודה עתירת הסקה הוא אינו.
האם אני יכול לכוונן עלות באותה צורה בשניהם? לא, וזהו ההבדל המדווח-פחות מכל ביניהם. Luna חושפת חוגת מאמץ חשיבה עם הגדרות מ-none ועד max, כך שעלות ואיכות מתחלפות באופן מפורש לכל בקשה. החשיבה המורחבת של Haiku 4.5 או מופעלת, עם תקציב טוקנים, או שלא — אין פרמטר מאמץ. אם שליטה בעלות לכל בקשה חשובה לך, רק אחד מהשניים נותן לך את המנוף הזה.
מה לגבי מסווג בנפח גבוה שמבצע כמה מיליון קריאות ביום?אף אחד מהמודלים לא צריך חשיבה בשביל זה. הריצו את Haiku 4.5 עם חשיבה מורחבת כבויה, או את Luna עם effort set to none, והשוו לפי השהיה ואורך הפלט ולא לפי המדד המשולב — בשלב הזה השאלות הרלוונטיות הן כמה מהר מגיע הטוקן הראשון וכמה טוקנים התשובה דורשת, ומבחני הבינה מפסיקים להבדיל ביניהם.

איזה מהם עוד יהיה כאן בעוד שנה?Claude Haiku 4.5 נושא התחייבות מפורסמת שלא יופסק לפני 15 באוקטובר 2026. OpenAI אינה מפרסמת תאריך מקביל עבור GPT-5.6 Luna, ולסדרת GPT-5.6 כבר יש דור חדש יותר מעליה ב-GPT-6 Astra. שום אחד מהשניים אינו סיבה להימנע מ-Luna, אבל אם מפת הדרכים שלך מניחה אופק תכנון של אחד עשר חודשים, זו סיבה להשאיר את מזהה המודל בהגדרות ולא כמקודד קשיח.
תעריף חי לפי טוקן עבור GPT-5.6 Luna על אותו מפתח, מועבר הלאה בתוספת של 0% וללא מערכת חיוב שנייה.
תעריף לכל טוקן בזמן אמת עבור Claude Haiku 4.5 באותה נקודת קצה, כך שניתן להשוות בין שתי השכבות ללא חוזה נוסף.
