כרטיס כותרת לניתוח של הורדת המחיר של 80% של GPT-5.6 Luna, המציג חץ גדול כלפי מטה המסומן כהורדה של 80%, את התעריף לפני ההורדה של $1.00 למיליון אסימוני קלט ו-$6.00 למיליון פלט, ואת התעריפים הנוכחיים של $0.20 לקלט ו-$1.20 לפלט.
Guides & Insights

GPT-5.6 Luna: מה באמת שינתה הורדת המחיר של OpenAI ב-80%

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

GPT-5.6 Luna זול ב-80% ממחיר ההשקה שלו מאז סוף יולי, ו-OpenAI החלה להתייחס לכך כאל טיעון ולא כאל הנחה. המודל — השכבה המהירה והזולה של משפחת GPT-5.6 — הפך לזמין באופן כללי ב-9 ביולי 2026 במחיר של 1.00 דולר למיליון טוקנים בקלט ו-6.00 דולר למיליון בפלט. כיום הוא מחויב ב-0.20 דולר ו-1.20 דולר. ב-9 בספטמבר אמרה סמנכ"לית הכספים של OpenAI, שרה פריאר, בוועידת Communacopia של גולדמן זאקס, שהקיצוץ הביא לעלייה של פי עשרה בערך בשימוש, ושפריסת Luna זולה יותר מהרצת GLM 5.3 של Z.ai בשכבת ענן.

הטענה האחרונה היא של Open​AI עצמה, שנאמרה על ידי מנהל בכיר בכנס משקיעים, ומגיע לה אותו יחס כמו לכל נתון אחר של ספק: שווה לדווח עליו, שווה לבדוק אותו, ולא שווה לחזור עליו כעובדה מוגמרת. המחיר עצמו הוא עניין אחר. הוא פומבי, והוא לא נסוג.

מה בעצם השתנה, ומתי

דבר לא השתנה בספטמבר בכל הנוגע ליכולות של GPT-5.6 Luna, לחלון ההקשר או לזמינות. מה שהשתנה הוא האופן שבו Open​AI משווקת אותו, ומאחורי השינוי הזה עומדים חמישה תאריכים.

26 ביוני 2026 — OpenAI הכריזה על משפחת GPT-5.6 (GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna) בתצוגה מקדימה מוגבלת בפני קבוצה קטנה של שותפים, לאחר תיאום עם סוכנויות ממשלת ארצות הברית.

9 ביולי 2026 — זמינות כללית. Sol, Terra ו-Luna הגיעו ל-API במחירים של $5/$30, $2.50/$15 ו-$1/$6 למיליון טוקנים של קלט/פלט בהתאמה.

סוף יולי 2026 — הקיצוץ של 80% ב-Luna בלבד, ל-$0.20 בקלט ול-$1.20 בפלט. קריאות קלט מהמטמון מתבצעות בהנחה של כ-90%. מעל סף ההקשר הארוך, התעריף כמעט מכפיל את עצמו, לכ-$0.40/$1.80.

6–7 באוגוסט 2026 — לונה החליפה את GPT-5.5 Instant כמודל ברירת המחדל של ChatGPT Free ו-Go, עם צ'אטים טקסטואליים ללא הגבלה וכפתור "Think" להסקה מעמיקה יותר שיגיע בשבוע שלאחר מכן. ההערכה הפנימית של OpenAI הציבה את שיעור התגובות של לונה שהכילו לפחות שגיאה עובדתית אחת נמוך בכ-62% מזה של GPT-5.5 Instant בפרומפטים פיננסיים, רפואיים ומשפטיים — נתון שמדווח על ידי הספק, ולא נתון בלתי תלוי.

9 בספטמבר 2026 — הערותיו של פריאר, שהעמידו לראשונה מספרים פומביים על השפעת הקיצוץ: שימוש גבוה פי 10 בערך, הכנסות ארגוניות עלו ב-32% מיוני ליולי לעומת צמיחה שנתית כוללת של 20%, ו-Codex עם 25 מיליון משתמשים.

בקריאה משותפת, התאריכים האלה מתארים מהלך של חודשיים שבו שכבה זולה הפכה לאסטרטגיית נפח. Luna תמיד הייתה השכבה שנועדה לספוג עבודה בנפח גבוה ובמורכבות נמוכה — סיווג, חילוץ, ניתוב, טיוטות ראשוניות. הקיצוץ הפך את החשבון שמאחורי המיצוב הזה לקשה בהרבה להתווכח איתו.

המספר שחשוב יותר ממחיר הטוקן

Screenshot of the Artificial Analysis model page for GPT-5.6 Luna (max), showing an Intelligence Index of 38 ranked 4th of 177 models, output speed of 109.4 tokens per second, input pricing of $0.20 and output pricing of $1.20 per million tokens, a cache discount of 90%, and a cost of $0.18 per Intelligence Index task.

מחירי המחירון הם המקום שבו רוב ההשוואות נעצרות, ובמקרה של Luna הם מחמיאים לה. במחיר $0.20/$1.20 היא חותכת מתחת ל-Claude Haiku 4.5 של Anthropic — הדבר הקרוב ביותר שיש לה למתחרה ישיר — בפי 5 בערך בקלט ופי 4 בפלט.

Artificial Analysis מודדת משהו פחות נוח: עלות לכל משימה שהושלמה במדד ה-Intelligence Index, הכוללת את מספר הטוקנים שמודל באמת שורף כדי להשלים את אותה עבודה. במדד הנוכחי, תצורת החשיבה של GPT-5.6 Luna עומדת על $0.18 למשימה. Claude Haiku 4.5 בתצורת החשיבה שלו מגיע ל-$0.21.

זהו פער של כ-14%, לא פי 5. הסיבה היא אריכות. להשלמת מערך ההערכה הזה נדרשו מ-Luna בערך 150 מיליון טוקני פלט לעומת 78 מיליון של Haiku. Luna מנמקת באריכות, וטוקני פלט מחויבים בשיעור של פי שישה מתעריף הקלט.

הקריאה המעשית מתפצלת בצורה נקייה. עבור עבודה עם פלט קצר ונפח גבוה — סיווג, תיוג, חילוץ, ניתוב בקשות, טיוטות ראשוניות — הקיצוץ של 80% הוא אמיתי, גדול, ומופיע ישירות בחשבונית. עבור עבודה שבה המודל מנמק לפני שהוא עונה, חלק ניכר מההנחה נצרך על ידי אסימוני פלט נוספים. שתי האמירות נכונות בו-זמנית, והשנייה היא החלק שהכיסוי של הקיצוץ השמיט.

כדאי גם לדעת מה האינדקס אומר על היכולות, משום שהדירוגים אינם קרובים זה לזה. Artificial Analysis מעניקה כיום ל-GPT-5.6 Luna ציון 38, המקום הרביעי מתוך 177 מודלים בקטגוריה שלה. תצורת החשיבה של Claude Haiku 4.5 מקבלת ציון 18, המקום ה-138 מתוך 200. שתי הסתייגויות לגבי המספרים האלה. ראשית, האינדקס דורג מחדש בספטמבר 2026, ולכן נתוני מועד ההשקה — כולל 51 ו-52 שעדיין מוזכרים לגבי Luna — מצוטטים מסולם שהוצא משימוש. שנית, Artificial Analysis אימצה את GPT-5.6 Luna כמעריך היחיד לכמה מההערכות שלה עצמה, וזה ראוי לציון בקריאת הציונים שלה.

מדוע Open​AI מעלה את הטיעון הזה כעת

קיצוץ של 80% שהוכרז בסוף יולי לא היה צריך סמנכ״לית כספים שתדון בו מחדש בספטמבר. העובדה שהיא כן עשתה זאת אומרת לך לשם מה נועד הקיצוץ.

מודלים סיניים בעלי משקלים פתוחים העבירו את 2026 בלחיצה מתמדת בדיוק על הציר שלונה תופסת: איכות מספקת במחיר שהופך את החישוב לפי טוקן לגורם המכריע. לחתוך את המחיר מתחת לכך בפריסה בענן קשה יותר לטעון מאשר לחתוך אותו במשקלים, וזו הטענה ש-Open​AI בחרה — כשציינה במפורש את GLM 5.3 במקום לרמוז באופן כללי על "מודלים פתוחים".

הנתונים הארגוניים שפרייר צירף לכך מצביעים לאותו כיוון. הכנסות ארגוניות שצומחות ב-32% מחודש לחודש לעומת 20% בסך הכול — כך נראית חברה שמוכרת לתוך מחזורי רכש, ומחזורי רכש הם המקום שבו סעיף תקציבי מוטל בספק. היא גם אישרה ש-OpenAI מתנסה בתמחור מבוסס תוצאות, שקושר את התשלומים לתוצאות עסקיות ולא לצריכת טוקנים. זו הודאה משמעותית עבור חברה שכל מודל ההכנסות שלה מבוסס על תשלום לפי טוקן: היא מרמזת שבקצה הזול של השוק, הנתון של תשלום לפי טוקן הופך לטיעון מכירתי חלש יותר ממה שהמודל משלים.

אף אחד מאלה לא הופך את השוואת ה-GLM למאומתת. הטענה של פרייאר נשענת על השוואת פריסה בענן ש-Open​AI לא פרסמה בפירוט, ו"זול יותר מאשר להריץ X בעצמך על שכבת ענן" תלוי לחלוטין באיזה ענן, באיזה מופע, ובאיזו הנחת ניצול תבחר. התייחס לזה כאל טענה ממוצבת מצד גורם בעל אינטרס, ובחן אותה מול עומס העבודה שלך לפני שהיא משנה משהו שאתה בונה.

מה זה משנה אם אתה כבר מנתב בין מודלים

Screenshot of the OrcaRouter model page for GPT-5.6 Luna, showing the model identifier openai/gpt-5.6-luna, a release date of 2026-07-09, a 1M-token context window, 128K maximum output, input pricing of $0.20 per million tokens, output pricing of $1.20, a median time to first token of 1.83 seconds and a 95th percentile of 10.00 seconds.

שלושה דברים חשובים כאן יותר מהמחיר המוצהר.

הורדות מחירים נכנסות לתוקף ביום שבו הן קורות. OrcaRouter מעבירה הלאה את מחיר המחירון של הספק במרווח של 0%, כך שכאשר ספק משנה תעריף, התעריף בצד שלנו משתנה יחד איתו — בלי פנייה לתמיכה, בלי חוזה מחדש, בלי מערכת חיוב שנייה. זו כל הסיבה לכך�הורדת יולי שווה לכתוב עליה ולא רק לציין אותה: עבור כל מי שקורא ל-Luna דרך API אחד ל-200+ מודלים, היא הייתה פעילה באותו יום.

הכינוי הוא מלכודת. המזהה ללא סיומת gpt-5.6 מפוענח לשכבת הדגל Sol, ולא ל-Luna, כך שכל אינטגרציה שרוצה את המודל הכלכלי של Luna חייבת להצמיד במפורש את gpt-5.6-luna זה מתועד במדריכי המפתחים של המשפחה, וזו עדיין אחת הדרכים הנפוצות ביותר שבהן הגירה של "שכבה זולה" מחויבת בשקט בתעריפי הדגל.

שכבות זולות עושות מעבר גיבוי היטב. מודל בנקודת מחיר כזו מבצע לעתים קרובות עבודה שבה 503 קצר הוא יקר — אלפי קריאות סיווג, ולא השלמה חשובה אחת. ניתוב אותה בקשה בין ספקים מרובים של GPT-5.6 Luna עם מעבר אוטומטי לגיבוי הוא ההבדל בין תור ניסיונות חוזרים לבין השבתה, וזו התכונה שהופכת שכבה בעלות נמוכה לבטוחה להצבה בנתיב ייצור.

אתה יכול לראות את התעריף הנוכחי ואת נתוני p50/p95 של זמן עד לאסימון הראשון בדף GPT-5.6 Luna ב-OrcaRouter — כדאי להסתכל, כי דפי התמחור של הספקים מפגרים אחרי הורדות מחירים, וגם כלי מעקב של צד שלישי מפגרים אחרי שניהם.

מה לצפות בהמשך

שלושה דברים היו הופכים את זה מסיפור תמחור לסיפור אחר.

קיצוץ נוסף. סיקור פיננסי בשפה הסינית בתחילת ספטמבר הציג את Open​AI כמי שמתכונן להתאים שוב את התמחור כדי לעמוד בתחרות של מודלים במשקלים פתוחים. הדיווח הזה צופה פני עתיד ואינו מאומת, אך הוא עולה בקנה אחד עם חברה שכבר הסכימה להפחתה של 80% במדרגת הנפח שלה וכעת מתווכחת בפומבי על עלות לכל פריסה.

תמחור מבוסס תוצאות הופך למציאות. אם Open​AI תתחיל למכור את Luna לפי תוצאה עסקית ולא לפי טוקן, ההשוואה לפי טוקן שכל השוק הזה מתבסס עליה תפסיק להיות לוח התוצאות הרלוונטי — וכל אומדן עלות למשימה, כולל אלה שלמעלה, צריך להיגזר מחדש.

יורש מוכשר באותו מחיר. GPT-6 Astra כבר קיים מעל קו GPT-5.6, והמעמד של Luna עצמה תלוי בכך ש-Open​AI ישאיר אותה במקומה. ברגע שדרגה קטנה חדשה יותר תגיע במחיר $0.20/$1.20, השאלה המעניינת מפסיקה להיות אם Luna זולה והופכת להיות אם היא עדיין הדבר הזול ביותר ששווה לנתב אליו.

A summary card for GPT-5.6 Luna listing its July 9, 2026 release date, its current price of $0.20 per million input tokens and $1.20 per million output, its launch price of $1.00 and $6.00, an Artificial Analysis Intelligence Index of 38 ranked 4th of 177, a cost of $0.18 per index task, and Claude Haiku 4.5's comparative figure of $0.21 per index task.

לעת עתה המצב פשוט באופן יוצא דופן. GPT-5.6 Luna הוא מודל בן חודשיים שהמחיר שלו, ולא היכולת שלו, הוא הידיעה — ומחיר הטוקן הוא הדרך המחמיאה ביותר להסתכל עליו, לא המדויקת ביותר.