
GPT-5.6 Luna: מה באמת שינתה הורדת המחיר של OpenAI ב-80%
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
GPT-5.6 Luna זול ב-80% ממחיר ההשקה שלו מאז סוף יולי, ו-OpenAI החלה להתייחס לכך כאל טיעון ולא כאל הנחה. המודל — השכבה המהירה והזולה של משפחת GPT-5.6 — הפך לזמין באופן כללי ב-9 ביולי 2026 במחיר של 1.00 דולר למיליון טוקנים בקלט ו-6.00 דולר למיליון בפלט. כיום הוא מחויב ב-0.20 דולר ו-1.20 דולר. ב-9 בספטמבר אמרה סמנכ"לית הכספים של OpenAI, שרה פריאר, בוועידת Communacopia של גולדמן זאקס, שהקיצוץ הביא לעלייה של פי עשרה בערך בשימוש, ושפריסת Luna זולה יותר מהרצת GLM 5.3 של Z.ai בשכבת ענן.
הטענה האחרונה היא של OpenAI עצמה, שנאמרה על ידי מנהל בכיר בכנס משקיעים, ומגיע לה אותו יחס כמו לכל נתון אחר של ספק: שווה לדווח עליו, שווה לבדוק אותו, ולא שווה לחזור עליו כעובדה מוגמרת. המחיר עצמו הוא עניין אחר. הוא פומבי, והוא לא נסוג.
מה בעצם השתנה, ומתי
דבר לא השתנה בספטמבר בכל הנוגע ליכולות של GPT-5.6 Luna, לחלון ההקשר או לזמינות. מה שהשתנה הוא האופן שבו OpenAI משווקת אותו, ומאחורי השינוי הזה עומדים חמישה תאריכים.
• 26 ביוני 2026 — OpenAI הכריזה על משפחת GPT-5.6 (GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna) בתצוגה מקדימה מוגבלת בפני קבוצה קטנה של שותפים, לאחר תיאום עם סוכנויות ממשלת ארצות הברית.
• 9 ביולי 2026 — זמינות כללית. Sol, Terra ו-Luna הגיעו ל-API במחירים של $5/$30, $2.50/$15 ו-$1/$6 למיליון טוקנים של קלט/פלט בהתאמה.
• סוף יולי 2026 — הקיצוץ של 80% ב-Luna בלבד, ל-$0.20 בקלט ול-$1.20 בפלט. קריאות קלט מהמטמון מתבצעות בהנחה של כ-90%. מעל סף ההקשר הארוך, התעריף כמעט מכפיל את עצמו, לכ-$0.40/$1.80.
• 6–7 באוגוסט 2026 — לונה החליפה את GPT-5.5 Instant כמודל ברירת המחדל של ChatGPT Free ו-Go, עם צ'אטים טקסטואליים ללא הגבלה וכפתור "Think" להסקה מעמיקה יותר שיגיע בשבוע שלאחר מכן. ההערכה הפנימית של OpenAI הציבה את שיעור התגובות של לונה שהכילו לפחות שגיאה עובדתית אחת נמוך בכ-62% מזה של GPT-5.5 Instant בפרומפטים פיננסיים, רפואיים ומשפטיים — נתון שמדווח על ידי הספק, ולא נתון בלתי תלוי.
• 9 בספטמבר 2026 — הערותיו של פריאר, שהעמידו לראשונה מספרים פומביים על השפעת הקיצוץ: שימוש גבוה פי 10 בערך, הכנסות ארגוניות עלו ב-32% מיוני ליולי לעומת צמיחה שנתית כוללת של 20%, ו-Codex עם 25 מיליון משתמשים.
בקריאה משותפת, התאריכים האלה מתארים מהלך של חודשיים שבו שכבה זולה הפכה לאסטרטגיית נפח. Luna תמיד הייתה השכבה שנועדה לספוג עבודה בנפח גבוה ובמורכבות נמוכה — סיווג, חילוץ, ניתוב, טיוטות ראשוניות. הקיצוץ הפך את החשבון שמאחורי המיצוב הזה לקשה בהרבה להתווכח איתו.
המספר שחשוב יותר ממחיר הטוקן

מחירי המחירון הם המקום שבו רוב ההשוואות נעצרות, ובמקרה של Luna הם מחמיאים לה. במחיר $0.20/$1.20 היא חותכת מתחת ל-Claude Haiku 4.5 של Anthropic — הדבר הקרוב ביותר שיש לה למתחרה ישיר — בפי 5 בערך בקלט ופי 4 בפלט.
Artificial Analysis מודדת משהו פחות נוח: עלות לכל משימה שהושלמה במדד ה-Intelligence Index, הכוללת את מספר הטוקנים שמודל באמת שורף כדי להשלים את אותה עבודה. במדד הנוכחי, תצורת החשיבה של GPT-5.6 Luna עומדת על $0.18 למשימה. Claude Haiku 4.5 בתצורת החשיבה שלו מגיע ל-$0.21.
זהו פער של כ-14%, לא פי 5. הסיבה היא אריכות. להשלמת מערך ההערכה הזה נדרשו מ-Luna בערך 150 מיליון טוקני פלט לעומת 78 מיליון של Haiku. Luna מנמקת באריכות, וטוקני פלט מחויבים בשיעור של פי שישה מתעריף הקלט.
הקריאה המעשית מתפצלת בצורה נקייה. עבור עבודה עם פלט קצר ונפח גבוה — סיווג, תיוג, חילוץ, ניתוב בקשות, טיוטות ראשוניות — הקיצוץ של 80% הוא אמיתי, גדול, ומופיע ישירות בחשבונית. עבור עבודה שבה המודל מנמק לפני שהוא עונה, חלק ניכר מההנחה נצרך על ידי אסימוני פלט נוספים. שתי האמירות נכונות בו-זמנית, והשנייה היא החלק שהכיסוי של הקיצוץ השמיט.
כדאי גם לדעת מה האינדקס אומר על היכולות, משום שהדירוגים אינם קרובים זה לזה. Artificial Analysis מעניקה כיום ל-GPT-5.6 Luna ציון 38, המקום הרביעי מתוך 177 מודלים בקטגוריה שלה. תצורת החשיבה של Claude Haiku 4.5 מקבלת ציון 18, המקום ה-138 מתוך 200. שתי הסתייגויות לגבי המספרים האלה. ראשית, האינדקס דורג מחדש בספטמבר 2026, ולכן נתוני מועד ההשקה — כולל 51 ו-52 שעדיין מוזכרים לגבי Luna — מצוטטים מסולם שהוצא משימוש. שנית, Artificial Analysis אימצה את GPT-5.6 Luna כמעריך היחיד לכמה מההערכות שלה עצמה, וזה ראוי לציון בקריאת הציונים שלה.
מדוע OpenAI מעלה את הטיעון הזה כעת
קיצוץ של 80% שהוכרז בסוף יולי לא היה צריך סמנכ״לית כספים שתדון בו מחדש בספטמבר. העובדה שהיא כן עשתה זאת אומרת לך לשם מה נועד הקיצוץ.
מודלים סיניים בעלי משקלים פתוחים העבירו את 2026 בלחיצה מתמדת בדיוק על הציר שלונה תופסת: איכות מספקת במחיר שהופך את החישוב לפי טוקן לגורם המכריע. לחתוך את המחיר מתחת לכך בפריסה בענן קשה יותר לטעון מאשר לחתוך אותו במשקלים, וזו הטענה ש-OpenAI בחרה — כשציינה במפורש את GLM 5.3 במקום לרמוז באופן כללי על "מודלים פתוחים".
הנתונים הארגוניים שפרייר צירף לכך מצביעים לאותו כיוון. הכנסות ארגוניות שצומחות ב-32% מחודש לחודש לעומת 20% בסך הכול — כך נראית חברה שמוכרת לתוך מחזורי רכש, ומחזורי רכש הם המקום שבו סעיף תקציבי מוטל בספק. היא גם אישרה ש-OpenAI מתנסה בתמחור מבוסס תוצאות, שקושר את התשלומים לתוצאות עסקיות ולא לצריכת טוקנים. זו הודאה משמעותית עבור חברה שכל מודל ההכנסות שלה מבוסס על תשלום לפי טוקן: היא מרמזת שבקצה הזול של השוק, הנתון של תשלום לפי טוקן הופך לטיעון מכירתי חלש יותר ממה שהמודל משלים.
אף אחד מאלה לא הופך את השוואת ה-GLM למאומתת. הטענה של פרייאר נשענת על השוואת פריסה בענן ש-OpenAI לא פרסמה בפירוט, ו"זול יותר מאשר להריץ X בעצמך על שכבת ענן" תלוי לחלוטין באיזה ענן, באיזה מופע, ובאיזו הנחת ניצול תבחר. התייחס לזה כאל טענה ממוצבת מצד גורם בעל אינטרס, ובחן אותה מול עומס העבודה שלך לפני שהיא משנה משהו שאתה בונה.
מה זה משנה אם אתה כבר מנתב בין מודלים

שלושה דברים חשובים כאן יותר מהמחיר המוצהר.
הורדות מחירים נכנסות לתוקף ביום שבו הן קורות. OrcaRouter מעבירה הלאה את מחיר המחירון של הספק במרווח של 0%, כך שכאשר ספק משנה תעריף, התעריף בצד שלנו משתנה יחד איתו — בלי פנייה לתמיכה, בלי חוזה מחדש, בלי מערכת חיוב שנייה. זו כל הסיבה לכך�הורדת יולי שווה לכתוב עליה ולא רק לציין אותה: עבור כל מי שקורא ל-Luna דרך API אחד ל-200+ מודלים, היא הייתה פעילה באותו יום.
הכינוי הוא מלכודת. המזהה ללא סיומת gpt-5.6 מפוענח לשכבת הדגל Sol, ולא ל-Luna, כך שכל אינטגרציה שרוצה את המודל הכלכלי של Luna חייבת להצמיד במפורש את gpt-5.6-luna זה מתועד במדריכי המפתחים של המשפחה, וזו עדיין אחת הדרכים הנפוצות ביותר שבהן הגירה של "שכבה זולה" מחויבת בשקט בתעריפי הדגל.
שכבות זולות עושות מעבר גיבוי היטב. מודל בנקודת מחיר כזו מבצע לעתים קרובות עבודה שבה 503 קצר הוא יקר — אלפי קריאות סיווג, ולא השלמה חשובה אחת. ניתוב אותה בקשה בין ספקים מרובים של GPT-5.6 Luna עם מעבר אוטומטי לגיבוי הוא ההבדל בין תור ניסיונות חוזרים לבין השבתה, וזו התכונה שהופכת שכבה בעלות נמוכה לבטוחה להצבה בנתיב ייצור.
אתה יכול לראות את התעריף הנוכחי ואת נתוני p50/p95 של זמן עד לאסימון הראשון בדף GPT-5.6 Luna ב-OrcaRouter — כדאי להסתכל, כי דפי התמחור של הספקים מפגרים אחרי הורדות מחירים, וגם כלי מעקב של צד שלישי מפגרים אחרי שניהם.
מה לצפות בהמשך
שלושה דברים היו הופכים את זה מסיפור תמחור לסיפור אחר.
קיצוץ נוסף. סיקור פיננסי בשפה הסינית בתחילת ספטמבר הציג את OpenAI כמי שמתכונן להתאים שוב את התמחור כדי לעמוד בתחרות של מודלים במשקלים פתוחים. הדיווח הזה צופה פני עתיד ואינו מאומת, אך הוא עולה בקנה אחד עם חברה שכבר הסכימה להפחתה של 80% במדרגת הנפח שלה וכעת מתווכחת בפומבי על עלות לכל פריסה.
תמחור מבוסס תוצאות הופך למציאות. אם OpenAI תתחיל למכור את Luna לפי תוצאה עסקית ולא לפי טוקן, ההשוואה לפי טוקן שכל השוק הזה מתבסס עליה תפסיק להיות לוח התוצאות הרלוונטי — וכל אומדן עלות למשימה, כולל אלה שלמעלה, צריך להיגזר מחדש.
יורש מוכשר באותו מחיר. GPT-6 Astra כבר קיים מעל קו GPT-5.6, והמעמד של Luna עצמה תלוי בכך ש-OpenAI ישאיר אותה במקומה. ברגע שדרגה קטנה חדשה יותר תגיע במחיר $0.20/$1.20, השאלה המעניינת מפסיקה להיות אם Luna זולה והופכת להיות אם היא עדיין הדבר הזול ביותר ששווה לנתב אליו.

לעת עתה המצב פשוט באופן יוצא דופן. GPT-5.6 Luna הוא מודל בן חודשיים שהמחיר שלו, ולא היכולת שלו, הוא הידיעה — ומחיר הטוקן הוא הדרך המחמיאה ביותר להסתכל עליו, לא המדויקת ביותר.
