
OpenAI הורידה את מחירי ה-API של GPT-5.6: מה השתנה, למה, ואיך להשיג את זה
- qwenחדשQwen: Qwen3.8 Max2026-08-03$2.00 / $6.00 לכל 1M טוקנים · 55 tok/s
- deepseekחדשDeepSeek: DeepSeek V4 Flash 07312026-07-3150אינטליגנציה69כתיבת קוד
- qwenחדשQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים · 206 tok/s
- orcaחדשOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicחדשAnthropic: Claude Opus 52026-07-2461אינטליגנציה78כתיבת קוד
- googleחדשGoogle: Gemini 3.6 Flash2026-07-2150אינטליגנציה69כתיבת קוד
- googleחדשGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1651אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1557אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0951אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0955אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0959אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0854אינטליגנציה72כתיבת קוד
- tencentTencent: Hy32026-07-0641אינטליגנציה59כתיבת קוד
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232אינטליגנציה42כתיבת קוד
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226אינטליגנציה39כתיבת קוד
- anthropicAnthropic: Claude Sonnet 52026-06-3053אינטליגנציה72כתיבת קוד
- klingKling: Kling 3.0 Turbo2026-06-1757אינטליגנציה52כתיבת קוד57מתמטיקה
- z-aiZ.ai: GLM 5.22026-06-1651אינטליגנציה69כתיבת קוד60מתמטיקה
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242אינטליגנציה61כתיבת קוד61מתמטיקה
ב-30 ביולי 2026, OpenAI הורידה את מחירי ה-API של שני דגמי GPT-5.6 הזולים יותר — תוך הפחתה חדה של השכבה הזולה ביותר וקיצוץ בשכבה הבינונית, בעוד שהדגם הדגל נותר ללא שינוי. מדובר בצעד בולט במלחמת מחירים שמתעצמת, והוא נכנס מיד לכרטיס התעריפים שפורסם. מאמר זה מסביר בדיוק מה השתנה, ההנדסה שמאחורי המהלך, כיצד המחירים החדשים משתווים למתחרים, העלויות הנסתרות שכדאי לשים לב אליהן, כיצד להפחית עוד יותר את החשבון — וכיצד המחירים הנמוכים כבר פעילים בOrcaRouter ברווח של 0%.
כל נתון להלן מסומן לפי מקור. התמחור הוא למיליון טוקנים (קלט / פלט) ומשקף את מחירון OpenAI מ-30 ביולי 2026, כפי שדווח על ידי כלי תקשורת ובהם Unite.AI, וכן את דפי מודל המעבר של OrcaRouter; נתוני מתחרים מוצגים עם ייחוס. המחירים משתנים — יש לאמת לפני שבונים.
TL;DR. OpenAI הורידה את GPT-5.6 Luna ל-$0.20 / $1.20 (מ-$1 / $6, הנחה של כ-80%) ואת GPT-5.6 Terra ל-$2 / $12 (מ-$2.50 / $15, הנחה של כ-20%), בעוד ש-GPT-5.6 Sol נשאר ב-$5 / $30. שני שיפורי יעילות מימנו את המהלך: ליבות GPU שנכתבו מחדש (כ-20% פחות עלות אספקה) ומודל דראפט מהיר יותר לפענוח ספקולטיבי (ייצור טוקנים מהיר ב-15% ומעלה). הקיצוץ דוחף את Luna מתחת ל-Haiku 4.5 של Anthropic ולכיוון הרצפה הזולה של מודלים פתוחים שנקבעה על ידי DeepSeek ו-GLM. אם אתם מנתבים דרך נקודת קצה נייטרלית-ספקית עם 0% תוספת כמו OrcaRouter, התעריפים החדשים כבר פעילים — אותו מחיר, API אחד תואם-OpenAI, כשכל מודל מתחרה לצדו להשוואה וניתוב.
נקודות עיקריות
• GPT-5.6 Luna: כעת $0.20 / $1.20 ל-1M טוקנים, ירידה מ-$1 / $6 — קיצוץ של כ-80%.
• GPT-5.6 Terra: כעת $2 / $12, ירידה מ-$2.50 / $15 — קיצוץ של כ-20%.
• GPT-5.6 Sol (דגל): ללא שינוי במחיר $5 / $30.
• למה: כתיבה מחדש של ליבות GPU הייצוריות (הפחתה של כ-20% בעלות השירות) ועיצוב מחדש של מודל הטיוטה לפענוח ספקולטיבי (שיפור של 15%+ ביעילות יצירת טוקנים), לפי הפוסט ההנדסי של OpenAI מ-29 ביולי.
• כיצד להשיג: ההנחה כבר משתקפת ב-OrcaRouter (ללא תוספת מחיר) — Luna ב-$0.20 / $1.20 — דרך נקודת קצה אחת תואמת OpenAI.
מה בדיוק השתנה?
משפחת GPT-5.6 של OpenAI פועלת כסולם דרגות: Luna (מהירה, הזולה ביותר), Terra (בינונית), ו-Sol (דגל). הקיצוץ ב-30 ביולי פגע בשתי הדרגות הזולות יותר. לפי כרטיס המחירים שדווח, GPT-5.6 Luna ירדה מ-$1 / $6 ל-$0.20 / $1.20 למיליון טוקנים של קלט/פלט — הפחתה של כ-80% הן בקלט והן בפלט — ו-GPT-5.6 Terra ירדה מ-$2.50 / $15 ל-$2 / $12, בערך 20%. GPT-5.6 Sol, דגל הדגל שנבנה לחשיבה הקשה ביותר ולקידוד סוכני, נשארה על $5 / $30. דרגות הנפח הפכו לזולות משמעותית; הדרגה העליונה לא זזה.
התעריף הבסיסי לכל טוקן אינו הסיפור המלא. תמחור GPT-5.6 כולל גם דרגות אורך קלט (הקשרים ארוכים מאוד עוברים לתעריף גבוה יותר), הנחת מטמון להנחיות (קלט שמור במטמון זול בהרבה מקלט חדש), ואפשרות אצווה (משימות אסינכרוניות בהנחה). כל שלושתם ממשיכים לחול גם לאחר הקיצוץ, כך שהמחיר האפקטיבי עבור עומס עבודה כבד במטמון או באצווה יכול להיות נמוך עוד יותר. שים לב לדרגת ההקשר הארוך בכיוון ההפוך: הזנת הנחיות ענקיות יכולה להעלות אותך לדרגה גבוהה יותר.

שתי האופטימיזציות שמאחורי הקיצוץ
זו לא הייתה מחווה של מכירה בהפסד — OpenAI הציגה אותה כדיבידנד של יעילות. בפוסט הנדסי מ-29 ביולי 2026, חברי הצוות הטכני של OpenAI תיארו אופטימיזציות על פני שכבת ה-inference ורתמת הסוכן (agent harness) שמאחורי Codex ו-ChatGPT Work. שניים בולטים במיוחד. ראשית, שכתוב של GPU kernels על פני תשתית הייצור — כשסול (Sol), שרץ בתוך Codex, משמש לשכתב את הקרנלים של החברה עצמה — שלפי OpenAI קיצצו את עלויות השרת מקצה לקצה בכ-20%. שנית, מודל draft שעוצב מחדש ל-speculative decoding, שדווח כי שיפר את יעילות הפקת הטוקנים ביותר מ-15%. עלות שרת נמוכה יותר, שמתורגמת ללקוחות כמחירים נמוכים יותר בשכבות הנפח הגבוהות, היא הסיפור — וזו הצצה ללולאת משוב שכל התעשייה רודפת אחריה: שימוש במודלים מתקדמים כדי לייעל את התשתית שמשרתת אותם.
כיצד המחירים החדשים משתווים
הקיצוץ במחירים מכוון ישירות למתחרים. לפי הדיווח של Unite.AI, המחירים החדשים של Luna — $0.20 / $1.20 — נמוכים מה-Haiku 4.5 של Anthropic בפי 5 בערך בקלט ובפי 4 בערך בפלט, והמחירים החדשים של Terra — $2 / $12 — נופלים מתחת לתמחור הסטנדרטי של Claude Sonnet 5 (שמדווח על $3 / $15, ונכנס לתוקף אחרי 31 באוגוסט 2026). ביחס לשדה המודלים פתוחי המשקולות, Luna נמצאת כעת קרובה לרצפת החישוב הזול שמציבה סדרת V4 של DeepSeek וקו GLM-5.2 של Zhipu (בערך $1.20 / $4.10), כשהדרגות של Qwen של Alibaba ושל Gemini Flash של Google נמצאות באותה שכונה. במילים אחרות, OpenAI הורידה את דרגות הנפח שלה למקום שבו המודלים הזולים והמסוגלים ביותר כבר חיים — ובכך הצמצמה את פרמיית המחיר על בחירה במודל קנייני לעומת מודל פתוח.
ההיסק ממשיך להיות זול יותר
במבט-על, הקיצוץ הזה משתלב במגמה רבת-שנים: העלות של רמת יכולות נתונה ירדה בחדות, דור אחרי דור, כשהמעבדות מפיקות יותר תפוקה מאותה חומרה. רמות התמחור הוותיקות יותר של OpenAI עצמה ממחישות את הירידה ההדרגתית לאורך זמן, וכל פריצת דרך ביעילות — קרנלים טובים יותר, פענוח ספקולטיבי, קשב זול יותר — נוטה להתבטא כהורדת מחיר בתוך חודשים. עבור הלקוחות, המשמעות המעשית היא לתכנן בהתאם לעולם שבו ההיסק נהיה זול יותר בקצב צפוי: לא להתחייב יתר על המידה לתמחור של מודל אחד, ולשמור על עלות מעבר נמוכה.
העלות הנסתרת שכדאי לשים לב אליה: אסימוני חשיבה
מודלי GPT-5.6 הם מודלי חשיבה, וזה מעצב את ההוצאה בעולם האמיתי. כאשר החשיבה מופעלת, המודל פולט אסימוני חשיבה פנימיים שמחויבים כפלט — כך שהעלות האפקטיבית של הפלט יכולה להיות גבוהה יותר ממה שהערכה נאיבית של "מילים בתשובה" מציעה, במיוחד עבור הנחיות קשות עם מאמץ חשיבה גבוה. הפתרון הוא לכוונן את מאמץ החשיבה לפי המשימה (נמוך או כבוי לקריאות פשוטות), להגביל את הפלט היכן שאפשר, ולמדוד את ניצול האסימונים בפועל במקום להניח. תעריף זול יותר לאסימון עוזר, אבל שליטה במספר האסימונים שאתה מייצר עוזרת יותר.
מה זה אומר למפתחים
אם אתם משתמשים ב-GPT-5.6 Luna או Terra לעבודה בהיקף גדול — סיווג, חילוץ, ניתוב, סוכנים קלים, צ'אט — החשבון שלכם פשוט ירד, בחלק מהמקרים ברוב ערכו, בלי צורך בשינוי קוד. זה הופך את דרגות הנפח לאטרקטיביות עוד יותר עבור עומסים רגישים לעלות ומצמצם את פער המחירים מול מודלים פתוחים זולים. ההיגיון הכלכלי של דגם הדגל לא השתנה: Sol במחיר של $5 / $30 עדיין בחירת פרימיום למשימות הקשות ביותר. הדפוס המנצח הוא לנתב לפי רמת קושי — דרגות זולות (או מודלים פתוחים זולים) עבור 80% מהמשימות הקלות, ודגם הדגל רק היכן שהוא מצדיק את עלותו.
איך לקצץ עוד בחשבון שלך
הפחתת המחיר היא קרקע לבנייה, לא קו הסיום. המנופים הנוספים הגדולים ביותר: מטמון הנחיות (לעשות שימוש חוזר בהנחיית מערכת יציבה או בהקשר ארוך ולשלם את תעריף הקלט השמור במטמון הנמוך בהרבה); אפשרות ה-batch (הרצת משימות לא דחופות באופן אסינכרוני בהנחה); ניתוב לפי דרגה ומודל (שליחת כל בקשה למודל הזול ביותר שיכול לטפל בה, כולל מודלים פתוחים); ו-בקרת חשיבה (אל תשלמו עבור חשיבה עמוקה בקריאות טריוויאליות). בשילוב, אלה מקצצים בקביעות חשבונות אמיתיים הרבה יותר מכל שינוי תעריף בודד. כנקודת עיגון קונקרטית: ב-10 מיליון טוקנים בחודש עם נתח של 70% קלט, התעריפים החדשים של Luna מסתכמים בכ-5 דולר לחודש (כ-4.37 דולר עם שמירה במטמון); אותו נפח ב-Sol הוא כ-125 דולר לחודש — הטיעון הברור ביותר לניתוב לפי קושי.
איך לתפוס את המחירים הנמוכים מיד
הנה החלק שמחבר את הכל. a href="https://www.orcarouter.ai/">OrcaRouter/a> גובה תוספת של 0% ומעביר את תמחור הספקים ישירות, כך שהתעריפים של OpenAI כבר פעילים ב-OrcaRouter: GPT-5.6 Luna מציג $0.20 / $1.20 ו-Terra $2 / $12 בדפי המודלים ממש עכשיו — אותם תעריפים כמו בכרטיס של OpenAI עצמה, נגישים דרך נקודת קצה אחת תואמת-OpenAI לצד 185+ מודלים אחרים. אתה מקבל את התעריפים בלי שום מיגרציה, ואתה יכול להשוות מחירים בין Luna ו-Terra לבין DeepSeek, GLM, Qwen, Gemini ו-Claude במקום אחד, ואז לנתב כל בקשה למה שהכי זול עבור העבודה. יש גם מסלול חינמי ודף Offers לחיסכון נוסף.

הקיצוץ כבר פעיל ב-OrcaRouter: GPT-5.6 Luna ב-$0.20 / $1.20 למיליון טוקנים, מועבר במרווח של 0%.
תכנן מסלול לפי קושי וחסוך אפילו יותר
החשבון הזול ביותר אינו מודל אחד — הוא המודל הנכון לכל בקשה. מכיוון ש-OrcaRouter חושף את כל המגוון דרך נקודת קצה אחת, אתה יכול לשלוח קריאות פשוטות בנפח גבוה ל-Luna או למודל פתוח זול, ולשמור את Sol או מודל דגל אחר לבעיות הקשות, תוך מעבר באמצעות שינוי קונפיגורציה במקום אינטגרציה מחדש. הוזלת מחיר על Luna הופכת את אסטרטגיית הניתוב לפי קושי לזולה עוד יותר, בלי שתצטרך לחבר מחדש שום דבר.

שאלות נפוצות
בכמה הורידה OpenAI את המחירים של GPT-5.6?
GPT-5.6 Luna ירדה מ-$1 / $6 ל-$0.20 / $1.20 למיליון טוקנים (כ-80%), ו-GPT-5.6 Terra מ-$2.50 / $15 ל-$2 / $12 (כ-20%). GPT-5.6 Sol נשארה על $5 / $30.
מתי נכנסה לתוקף הפחתת המחיר?
30 ביולי 2026, תועד ביומן השינויים של ה-API של OpenAI ומופיע בכרטיס התעריפים שפורסם.
מדוע OpenAI הורידה את המחירים?
OpenAI מייחסת זאת לאופטימיזציות הסקה — ליבות GPU ייצור שנכתבו מחדש (עלות הגשה נמוכה בכ-20%) ומודל טיוטה שעוצב מחדש לדיקוד ספקולטיבי (יעילות יצירת טוקנים של 15%+) — לפי פוסט הנדסי מ-29 ביולי 2026.
האם הדגל (Sol) ירד במחיר?
לא. GPT-5.6 Sol נשאר $5 / $30 למיליון טוקנים. רק שתי הרמות הזולות יותר, Luna ו-Terra, קוצצו.
איך המחירים החדשים משתווים ל-Anthropic ולמודלים פתוחים?
לפי הדיווחים, Luna כעת זולה מ-Haiku 4.5 של Anthropic בפי כ-5 על קלט / פי 4 על פלט, וטרה נמצאת מתחת למחיר הסטנדרטי של Claude Sonnet 5 (3$ / 15$). Luna גם ממוקמת קרוב לרצפת המחירים הזולה של מודלים פתוחים שנקבעה על ידי DeepSeek ו-GLM-5.2.
מה המלכוד עם אסימוני חשיבה?
GPT-5.6 הם מודלים של חשיבה; אסימוני חשיבה פנימיים מחויבים כפלט, כך שעלות הפלט האפקטיבית יכולה לחרוג מהערכה נאיבית. כוונן את מאמץ החשיבה והגבל את הפלט כדי לשלוט בכך.
איך אני משיג את המחירים הנמוכים החדשים?
הם כבר זמינים ב-API של OpenAI, וברווח של 0%, ב-OrcaRouter — שבו GPT-5.6 Luna מציג $0.20 / $1.20 — דרך נקודת קצה אחת תואמת OpenAI, ללא צורך בשינוי קוד.
השורה התחתונה
הקיצוץ של OpenAI ב-30 ביולי הופך את GPT-5.6 Luna ו-Terra לזולים משמעותית עבור עבודה בנפח גבוה — דיבידנד יעילות משכתיבת קרנל ומרווחי פענוח ספקולטיבי, ותגובה ברורה למלחמת מחירים אמיתית שכעת פוגעת בשכבות הזולות יותר של Anthropic ומתקרבת לרצפת המודלים הפתוחים. ה-Sol הדגל נותר ללא שינוי, אז נתבו לפי קושי, הסתמכו על קאשינג ובאצ'ינג, ושלוט בטוקיני חשיבה כדי לחסוך הכי הרבה. ובגלל ש-OrcaRouter מעביר את תמחור הספקים ב-0% עילוי, התעריפים הנמוכים כבר פעילים שם — אותו מחיר, נקודת קצה אחת תואמת OpenAI, כל שדה המודלים במקום אחד. קחו את הקיצוץ בלי לשנות שורת קוד, ותנו לכל בקשה לבחור את המודל הזול ביותר שיכול לבצע את העבודה.
