
Claude Haiku 5.5 מול GPT-6 Luna Pro: מודל נגד מצב
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
צד אחד של ההשוואה הזו הוא מודל, והצד השני הוא הגדרה. Claude Haiku 5.5הפך לזמין באופן כללי ב-7 באוקטובר 2026 במחיר של 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט, ב-Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry ו-Claude Platform on AWS. GPT-6 Luna Proאינו מודל כלל: הדרך להגיע אליו היא לקרוא ל-GPT-6 Luna — זמין מאז 22 בספטמבר 2026 באותם 0.10 ו-0.50 דולר — עם reasoning.mode מוגדר ל-pro במקום standard. אין gpt-6-luna-proמזהה בעמוד המודלים של OpenAI. לכן הניסוח ההגון של ההתמודדות הזו אינו "איזה מודל מנצח" אלא "מהי הדרך הטובה יותר להוציא עשרה סנט למיליון טוקני קלט": מודל קטן עם חוגת מאמץ, או מודל גדול שמופעל במצב שעושה יותר עבודה ומחייב אותך על הטוקנים שהוא לא מראה לך. לעבודה קצרה בנפח גבוה התשובה היא בדרך כלל הראשונה. לעבודה קשה ומזדמנת היא יכולה להיות השנייה — והמספר שמכריע בכך, OpenAI לא פרסמה.
מהו "pro", מבחינה מכנית
מדריך החשיבה של OpenAI קובע שמודלים GPT-5.6 ו-GPT-6 תומכים בשני מצבים ב-Responses API, standard (ברירת המחדל) ו-pro, הנבחרים דרך reasoning.mode. מצב הוא בקרה שונה מ-reasoning.effort: המצב קובע כמה עבודה המודל עושה לפני שהוא מתחייב לתשובה, והמאמץ קובע כמה חשיבה מתרחשת בתוך המצב שבחרת. ערכי המאמץ המתועדים של GPT-6 Luna הם none, low, medium (ברירת המחדל), high, xhigh ו-max, וכל אחד מהם יכול להיות משולב עם מצב pro.
בכל הנוגע לחיוב, המדריך מפורש וקצת מנוגד לאינטואיציה. מצב Pro מאגד את כל עבודת המודל שמאחורי התשובה הסופית ומחייב על הטוקנים האלה "בתעריפי הטוקנים הסטנדרטיים של המודל הנבחר". אין תוספת מחיר של Pro במחירון. העלות מופיעה כנפח, כי מצב Pro "מבצע יותר עבודת מודל ממצב סטנדרטי, מה שמגדיל את השימוש בטוקנים ואת העלות" — וטוקני חשיבה מחויבים כטוקני פלט תוך שהם מופיעים רק באובייקט השימוש תחת output_tokens_details.reasoning_tokens. אם לא קוראים את השדה הזה, העלייה בלתי נראית עד שהחשבונית מגיעה.
שתי השוואות נובעות מכך, וכדאי להפריד ביניהן. לעומת GPT-6 Luna במצב רגיל, מצב pro הוא אותו מודל עם מכפיל לא ידוע על צריכת הטוקנים. לעומת Claude Haiku 5.5, זהו גם מודל אחר בקנה מידה אחר — 1,050,000 טוקנים של הקשר לעומת 1M, תקרת קלט של 922,000 טוקנים ומועד ידע של 18 במאי 2026, ברמה שתיעוד ההשקה של Anthropic עצמה ממקם מעט מעל ה-Haiku בעבודה סוכנית קשה. שני ההבדלים מושכים לאותו כיוון בכל הנוגע לעלות ובכיוונים מנוגדים בכל הנוגע ליכולת, ולכן אין להסיק אף אחד מהם מרשימת מחירים.
כרטיסי התעריפים, זה לצד זה
שני המודלים מחויבים בשתי מדרגות, והספים נמצאים במקומות שונים — מה שחשוב יותר מהתעריף המוצהר, מפני ששני התעריפים המוצהרים זהים.
• קלט — Claude Haiku 5.5 $0.10 למיליון עד 100,000 טוקנים, $0.50 מעל זה. GPT-6 Luna $0.10 עד 272,000 טוקנים, $0.20 מעל זה.
• פלט — Claude Haiku 5.5 $0.50 עד 100,000 טוקנים, $2.50 מעל זה. GPT-6 Luna $0.50 עד 272,000 טוקנים, $0.75 מעל זה.
• מטמון — קריאות מטמון של Claude Haiku 5.5 עולות $0.01 וכתיבות $0.125 מתחת לרף, ו-$0.05 ו-$0.625 מעליו. קריאות מטמון של GPT-6 Luna עולות $0.01 וכתיבות $0.125 מתחת ל-272,000 טוקנים, ו-$0.02 ו-$0.25 מעליו.
• הקשר ופלט — מיליון אסימונים ופלט מרבי של 128,000 עבור Claude Haiku 5.5; 1,050,000 אסימונים עם תקרת קלט של 922,000 אסימונים ופלט מרבי של 128,000 עבור GPT-6 Luna.
• חשיבה — אדפטיבי בשניהם. ברירת המחדל של Claude Haiku 5.5 היא מאמץ בינוני; ברירת המחדל של GPT-6 Luna היא מאמץ בינוני ומצב סטנדרטי, כאשר מצב pro הוא אפשרות אופציונלית נוספת.
• הנחות עבור Batch ומטמון — Claude Haiku 5.5 זוכה ל-50% הנחה ב-Message Batches API; GPT-6 Luna זוכה ל-50% הנחה ב-Batch וב-Flex, מכפיל את המחיר במצב Fast, ומוסיף תוספת של 10% עבור עיבוד אזורי.
הדבר היחיד שאינו באותה צורה הוא הטוקנייזר. התיעוד של Anthropic מציין ש-Claude Haiku 5.5 משתמש בטוקנייזר החדש יותר שמשותף עם Claude 4.7 ואילך, כך שאותו טקסט נספר בכ-30% יותר טוקנים מאשר ב-Claude Haiku 4.5. זה לא משנה את התעריף; זה משנה כמה מהר פרומפט מגיע למדרגת 100,000 הטוקנים, וזהו הבדל עלות אמיתי שאף לוח תעריפים לא מציג. פרומפט של 90,000 טוקנים נמדד בכ-117,000 ומשלם $0.50 למיליון טוקני קלט במקום $0.10 — תעריף גבוה פי חמישה על פרומפט שנראה כאילו הוא בנוחות מתחת לרף.
כמה עולה מצב פרו, ביחידות היחידות שכל אחד יכול להשתמש בהן
כיוון שהמכפיל אינו מפורסם, הדבר המועיל לציין הוא מה העלות של כל טוקן נוסף, ואחר כך מה הטווחים הסבירים עושים בהיקפים גדולים.
• בתעריף של GPT-6 Luna, 0.50 דולר למיליון אסימוני פלט, כל 10,000 אסימוני פלט נוספים לכל משימה עולים 0.005 דולר. אם מריצים 100,000 משימות ביום, התוספת הזו היא מיליארד אסימונים נוספים — כ-500 דולר ביום, או 15,000 דולר בחודש, על מודל שהמחיר המוצהר שלו הוא 10 סנט למיליון אסימוני קלט.
• לצורך המחשה, GPT-6 Luna במאמץ מקסימלי כבר צורך 140 מיליון טוקנים של פלט בהרצת Intelligence Index, לעומת חציון של 100 מיליון — מה שהמעריך מתאר כרדundant מילולי למדי. Anthropic's launch table, run on Anthropic's own harness, puts GPT-6 Luna at 16.4% on Terminal-Bench 4.0 and 42.4% on FrontierCode 1.1, against 39.2% and 46.4% for Claude Haiku 5.5 — vendor-reported, one vendor's suite, a competitor's model.
• בלוח העצמאי סדר הדירוג צר יותר. Artificial Analysis מעניקה ל-Claude Haiku 5.5 ציון 43 ב-Max effort במדד Intelligence Index v4.3.2, מקום שני מתוך 182, ול-GPT-6 Luna (Max) ציון 38, מקום שמיני מתוך 182. שני המספרים הם ממצב standard-mode, ברמת max-effort. אין הערכה עצמאית ל-GPT-6 Luna במצב pro: בעמוד שלו אין רשומת pro, ו-Artificial Analysis אינה מפרטת כזו.
הבעיה המבנית של מצב Pro היא האינטראקציה בין שתי הנקודות האחרונות האלה. כל יתרון העלות של GPT-6 Luna על פני Claude Haiku 5.5 נובע מיעילות טוקנים — 140 מיליון טוקני פלט לעומת 440 מיליון עבור אותה חבילת בדיקות, באותם תעריפים, וזו הסיבה שאותה הערכה עולה $0.07 למשימה בצד אחד ו-$0.21 בצד האחר. מצב Pro הוא, בהגדרה, מצב שמפיק יותר טוקנים. הפעלתו היא כיבוי הדבר שהפך את המודל לזול בהשוואה הזו, והמכפיל שיגיד לך בכמה אינו מפורסם. זו אינה טענה שמצב Pro הוא עסקה גרועה — במשימות קשות יותר עבודה היא בדרך כלל עבודה טובה יותר — זו טענה שמצב Pro מתחרה על יכולת, לא על מחיר, ויש להעריך אותו מול מודלים בדרג הביניים שבקרבתם הוא מתומחר, ולא מול השכבה הזולה שהוא נמצא בתוכה.

איפה כל אחד למעשה מנצח
פשוט את זה עד להחלטה והחלוקה נקייה, אם כי אף צד לא חף מהסתייגויות.
Claude Haiku 5.5 מחזיק בקצה הזול. הוא מהיר יותר בשני המובנים החשובים: 241.9 אסימוני פלט בשנייה לפי מדידה של Artificial Analysis, לעומת 123.0 עבור GPT-6 Luna, וזמן של 295 שניות לאסימון הראשון בהרצת ה-Index, שהוא תוצר של משך החשיבה לפני המענה במאמץ Max ולא נתון רשת. טבלת התעריפים שלו מגיעה למדרגה השנייה ב-100,000 אסימונים, והטוקנייזר שלו מנפח פרומפטים בכ-30%, כך שעומסי עבודה עם פרומפטים ארוכים משלמים יותר ממה שמחיר המחירון מרמז, משתי הבחינות. מה שהוא מחזיר בתמורה הוא יתרון של חמש נקודות באינטליגנציה במדד העצמאי, וחוגת מאמץ — Low עד Max — שהיא בקרת העלויות השימושית ביותר מבין מה ששני הספקים השיקו עם ההשקות האלה. קיבוע המאמץ למטה הוא הדרך להחליף חלק מאותו יתרון של חמש נקודות בנתון עלות-למשימה הקרוב יותר לזה של GPT-6 Luna.
GPT-6 Luna Pro שולט בקצה הקשה, עם חשבון שלא כומת. המודל שמתחתיו זול יותר לכל טוקן מעל 272,000 טוקני קלט מאשר Claude Haiku 5.5 מעל 100,000, בפקטור של שניים וחצי בקלט ושלושה ושליש בפלט, והדרגה הראשונה שלו מגיעה פי שמונה עשרה רחוק יותר בחלון ההקשר. מצב Standard זול באופן מדיד לכל משימה שהושלמה. מצב Pro מחליף זאת ביותר עבודה לכל תשובה באותם תעריפים, והאם הוא מנצח את Claude Haiku 5.5 במאמץ Max או מודל מדרג ביניים במשימה נתונה היא שאלה שאף מספר שפורסם לא עונה עליה. הדרך לענות עליה היא להריץ את המשימה בשתי הדרכים ולקרוא את שדה טוקני החשיבה.

לנסות כל אחד מהם בלי להמר על זה
החלק המסובך בהשוואה הזו הוא שהמספר החשוב ביותר שלה — העלות האמיתית של מצב pro — יכול להיווצר רק על ידי הרצת התעבורה שלך דרכו, והעלות האפקטיבית של המודל הקטן יותר תלויה במקום שבו הפרומפטים שלך נוחתים ביחס לקו של 100,000 טוקנים לאחר טוקניזציה מחדש. שתיהן בעיות מדידה, ושתיהן זולות יותר בנקודת קצה משותפת מאשר בין שני לקוחות של ספקים.
GPT-6 Luna נמצא היום בקטלוג של OrcaRouter במחיר המחירון של הספק עם 0% תוספת מחיר שעוברת הלאה, כך שקו הבסיס במצב סטנדרטי להשוואה הזו ניתן לקריאה ממפתח אחד, ושינוי מחיר של ספק נוחת אצלנו באותו יום ולא במחזור החיוב הבא. Claude Haiku 5.5 עדיין לא בקטלוג; שכבת Anthropic שאנחנו כן מנתבים היום היא Claude Haiku 4.5, Claude Sonnet 5.5 ו-Claude Opus 5.5, מה שהופך בדיקת הסלמה מרגל זול למעלה דרך שכבת ביניים לכלל ניתוב ולא לשינוי קוד. מעבר אוטומטי לגיבוי שמתחת הוא מה שמאפשר למודל בן יומיים לשאת תעבורת פרודקשן בזמן שאתה עדיין מודד אותו: ספק שמתחיל להיכשל מנותב סביבו במקום להפיל את הבקשה, וזה ההבדל בין פיילוט שאפשר להריץ השבוע לבין מעבר שאתה צריך לתזמן.
מה מכריע את זה
שלושה דברים, לפי מידת ההשפעה שלהם על התשובה. פרסום של OpenAI של מכפיל טוקנים במצב pro, או pro slug עם שורת מחיר משלו, יהפוך את הלא־נודע המרכזי לאריתמטיקה. הרצה מחדש של GPT-6 Luna בידי Artificial Analysis במצב pro ובמאמץ תואם תעשה זאת מהצד הבלתי תלוי. והרצה בלתי תלויה שנייה של Claude Haiku 5.5 ב־medium ולא ב-Max תספר לך מה המודל באמת עולה בהגדרת ברירת המחדל שלו, שהיא התצורה שרוב האנשים יעלו לאוויר — ה-$0.21 למשימה בלוח הוא נתון של Max-effort, ו-Max אינו ברירת המחדל.
עד אז, הסיכום המדויק הוא צר. Claude Haiku 5.5 הוא מודל שאפשר לקרוא לו, לתמחר ולבצע עליו בנצ׳מרק היום, ובנפחים שהשכבה שלו נבנתה עבורם הוא התשובה הזולה יותר, עם דרך מתועדת להיות זול עוד יותר. GPT-6 Luna Pro הוא תצורה של מודל שאפשר לקרוא לו, כרטיס התעריפים שלו אינו הבעיה, צריכת הטוקנים שלו אינה מבוקרת, וכל הטיעון בעדו נשען על משימות קשות מספיק שההוצאה של יותר טוקנים היא העיקר. קנה אותו עבור המשימות האלה, מדוד אותו לפני שאתה עושה זאת, ואל תכניס אותו למסלול בנפח גבוה עד שמישהו יפרסם את המכפיל.

