
תמחור API של GPT-5.6: שכבות Sol, Terra ו-Luna, עלות אמיתית, ואיך לקרוא לכל אחת
- qwenחדשQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaחדשOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicחדשAnthropic: Claude Opus 52026-07-2461אינטליגנציה78כתיבת קוד
- googleחדשGoogle: Gemini 3.6 Flash2026-07-2150אינטליגנציה69כתיבת קוד
- googleחדשGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaחדשMeta: Muse Spark 1.12026-07-1651אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1557אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0951אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0955אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0959אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0854אינטליגנציה72כתיבת קוד
- tencentTencent: Hy32026-07-0641אינטליגנציה59כתיבת קוד
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232אינטליגנציה42כתיבת קוד
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226אינטליגנציה39כתיבת קוד
- anthropicAnthropic: Claude Sonnet 52026-06-3053אינטליגנציה72כתיבת קוד
- klingKling: Kling 3.0 Turbo2026-06-1757אינטליגנציה52כתיבת קוד57מתמטיקה
- z-aiZ.ai: GLM 5.22026-06-1651אינטליגנציה69כתיבת קוד60מתמטיקה
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242אינטליגנציה61כתיבת קוד61מתמטיקה
- anthropicAnthropic: Claude Fable 52026-06-0960אינטליגנציה77כתיבת קוד
- qwenQwen: Qwen3.7 Plus2026-06-0139אינטליגנציה56כתיבת קוד59מתמטיקה
GPT-5.6 היא משפחת הדגלים של OpenAI מיולי 2026, והדבר החשוב למפתחים הוא שאין לה מחיר אחיד. היא מושקת בשלוש רמות – Sol, Terra ו-Luna. ב-OpenAI API, Sol עולה 5 דולר למיליון טוקנים בקלט ו-30 דולר למיליון טוקנים בפלט, Terra עולה 2.50 דולר ו-15 דולר, ו-Luna עולה 1 דולר ו-6 דולר. לכל רמה יש הנחת קלט במטמון, שלושתן מקבלות קלט תמונה בנוסף לטקסט, וחלון ההקשר הוא כ-1.05 מיליון טוקנים עם עד 128,000 טוקנים בפלט.
המחיר המפורסם הוא רק ההתחלה של העלות האמיתית. איזו רמה אתם באמת צריכים, כמה מטמון אתם משתמשים, כמה פלט המודל מייצר, וכמה כללי תמחור שרוב המדריכים מדלגים עליהם—הנחיות מעל 272K אסימונים, תוספת עלות עבור מגורי נתונים, ורמות שירות—קובעים את החשבון הרבה יותר מהמחיר הכותרתי. מדריך זה מפרק את המחיר של כל רמה, למה היא מיועדת, איך היא מדורגת, איך לבצע הגירה מ-GPT-5.5, איך לקרוא לה, ואיך היא משתווה ל-Claude, GLM, Gemini, DeepSeek ו-Grok.
תשובה מהירה: מחירי GPT-5.6 במבט חטוף
- שלוש רמות (למיליון אסימונים, קלט/פלט): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.
- קלט במטמון: 0.50$ (Sol), 0.25$ (Terra), 0.10$ (Luna) למיליון טוקנים; עלות כתיבה למטמון היא פי 1.25 משיעור הקלט הלא־מטמון.
- מיקום: Sol לעבודת ההסקה הקשה והסוכנותית ביותר, Terra כברירת המחדל המאוזנת, Luna למשימות בעלות נפח גבוה ורגישות לעלות.
- אופן: רב-מודאלי — GPT-5.6 מקבל קלט תמונה לצד טקסט. הקשר ~1.05M טוקנים, פלט מקסימלי 128K.
- שני כללי תמחור שכדאי לתכנן עבורם: הנחיות (prompts) מעל 272K אסימוני קלט מחויבות בתעריף של פי 2 עבור קלט ופי 1.5 עבור פלט לכל הבקשה, ונקודות קצה של מגורי נתונים (data-residency endpoints) מוסיפות תוספת של 10%.
- דרכים לשלם פחות: באץ' (Batch) ב-50% הנחה מהתעריף הרגיל, קאשינג (caching) מקטין קלט חוזרי לעשירית, וניתוב עבודה שגרתית לשכבה נמוכה יותר מונע את הפלט של Sol במחיר 30 דולר.
- אינטליגנציה: Artificial Analysis ממקם את GPT-5.6 Sol קרוב לראש מדד האינטליגנציה שלו (ציון 59).
תמחור API של GPT-5.6, לפי דרגות

OpenAI מתמחרת GPT-5.6 במיליון טוקנים, והפלט יקר בהרבה מהקלט בכל רמה. המחירים המפורסמים הנוכחיים הם:
- GPT-5.6 Sol: $5.00 קלט, $0.50 קלט במטמון, $30.00 פלט (כתיבות מטמון $6.25).
- GPT-5.6 Terra: $2.50 קלט, $0.25 קלט במטמון, $15.00 פלט.
- GPT-5.6 Luna: $1.00 קלט, $0.10 קלט במטמון, $6.00 פלט.
שני פרטים חשובים לפני שאתה מתכנן תקציב. ראשית, קצב הפלט שולט ברוב החשבונות האמיתיים, במיוחד בעבודה של חשיבה וסוכנותית שבה המודל מייצר עקבות ארוכות, קריאות לכלים, ותיקונים לפני תשובה סופית. שנית, אין שורת מחיר נפרדת של "Sol Ultra" בדף התמחור; "Sol Ultra" היא תצורה של חשיבה גבוהה יותר של Sol (הגדרה של מספר סוכנים), לא שכבה עצמאית – תקציב סביב Sol, Terra, ו-Luna.
למה מיועדת כל דרגה בפועל
לונה: נפח גבוה ורגישות לעלות
לונה היא השכבה הכלכלית במחיר של $1 קלט ו-$6 פלט. זוהי ברירת המחדל המתאימה לסיווג, חילוץ, ניתוב, סיכום, ניסוח טיוטות, וכמות גדולה של עבודה שגרתית שבה הבדל איכות קטן אינו משנה את התוצאה. בשישה דולר למיליון טוקנים של פלט, היא זולה מספיק כדי לפעול בקנה מידה גדול וכדי לדגום שוב ושוב.
Terra: ברירת המחדל המאוזנת
טרה נמצאת באמצע ב-$2.50 וב-$15. עבור רוב עבודות האפליקציה והקידוד, זוהי נקודת ההתחלה ההגיונית: חזקה באופן ניכר מלונה במשימות קשות יותר, אבל בחצי ממחיר התפוקה של סול. התחל כאן, ואז העבר מטלה לסול רק כשטרה נכשלת בה באופן גלוי.
Sol: ההיגיון הקשה ביותר ועבודה סוכנית
Sol הוא הדגל במחיר של 5 ו-30 דולרים, ו-Artificial Analysis ממקמת אותו קרוב לראש מדד האינטליגנציה שלה. שמור אותו לארכיטקטורה קשה, דיבוג מורכב, סוכנים לטווח ארוך, וניתוחים בעלי סיכון גבוה שבהם כישלון אחד שנמנע שווה את הפרמיה. שימוש ב-Sol לעבודה שגרתית הוא הדרך הנפוצה ביותר לבזבז יתר על GPT-5.6.
מגיע מ-GPT-5.5? איזו דרגה חוסכת הכי הרבה
GPT-5.6 Sol מתומחר באופן זהה ל-GPT-5.5 במחיר של 5$ קלט ו-30$ פלט, כך שהעברת עומס עבודה של GPT-5.5 ישירות ל-Sol משנה מעט בחשבון. החיסכון הוא בשתי השכבות הנמוכות החדשות. Terra מספקת איכות בערך ברמה של GPT-5.5 ברוב המשימות במחצית המחיר, כך שההגירה הפשוטה ביותר היא לשלוח תעבורת GPT-5.5 קיימת ל-Terra ורק להעלות בחזרה ל-Sol את המשימות שנכשלות.
תוכנית ההגירה המעשית היא שלושה שלבים: להפנות קריאות GPT-5.5 ל-Terra, להריץ את ערכת ההערכה שלך, ולהעלות רק את הכשלונות ל-Sol תוך דחיפת עבודה שגרתית ברורה ל-Luna. רוב עומסי העבודה של GPT-5.5 יוצאים זולים יותר בדרך זו ללא אובדן איכות שניתן למדוד.
איך הדרגות מדורגות בפועל


מחיר חשוב רק ביחס ליכולת. על פי המספרים של OpenAI עצמה ב-Terminal-Bench 2.1, הרמות נפרדות בערך כפי שניתן לצפות: Sol 88.8%, Sol Ultra 91.9%, Terra 87.4%, ו-Luna 84.7%. בהקשר לאותה טבלה, GPT‑5.5 קולע 85.6%, Claude Opus 4.8 הוא 78.9%, Claude Fable 5 הוא 83.1%, ו- Gemini 3.1 Pro (תצוגה מקדימה) הוא 70.7%. Artificial Analysis נותן בנפרד ל-Sol מדד אינטליגנציה של 59, קרוב לראש הדירוג שלו.
קראו את אלה כמדווחים על ידי הספק וכיווניים. OpenAI פרסמה מערכת מוגבלת של הערכות עבור GPT-5.6 ולא, בזמן כתיבת שורות אלה, אמות מידה מסורתיות לקידוד והסקה כמו SWE-bench Verified או GPQA, אז השתמשו בציונים אלה כדי להחליט מה לבדוק על עומס העבודה שלכם במקום בתור פסק דין סופי.

שיעור הקריאה של קלט מהמטמון בכל דרג הוא עשירית משיעור הקלט הטרי: $0.50 ב‑Sol, $0.25 ב‑Terra, $0.10 ב‑Luna. כתיבה למטמון, לעומת זאת, עולה פי 1.25 משיעור הקלט הלא‑מטומטם (כ‑$6.25 למיליון ב‑Sol), כך שהמטמון משתלם רק כשקידומת יציבה בשימוש חוזר מספר פעמים מספיקות כדי להחזיר את הפרמיה על הכתיבה – הוראות מערכת, מסמך גדול, כללי מאגר, או טקסונומיה של מוצרים. שים חומר יציב בתחילת ההנחיה ואת השאלה המשתנה בסופה, והימנע מהחדרת חותמות זמן או מזהים אקראיים לפני ההקשר הניתן לשימוש חוזר.
שמירה במטמון מפחיתה את עלות הקלט החוזר; היא אינה עושה דבר עבור הפלט. מכיוון שהפלט הוא הצד היקר בכל שכבה, שני המנופים שמשפיעים הכי הרבה על חשבון GPT-5.6 הם שמירת קידומת יציבה במטמון ושליטה בכמה המודל כותב.
איזו רמה כדאי לבחור?

אל תבחר דרגה לפי מוניטין. בחר אותה לפי מבחן. בנה סט קטן של משימות מייצגות עם קריטריוני קבלה ברורים, הרץ אותן תחילה על Luna, וקדם רק את המשימות שנכשלות ל-Terra, ואז ל-Sol. מדוד עלות לכל משימה שהתקבלה, לא מחיר אסימון ממוצע, כי דרגה זולה יותר שדורשת שלושה ניסיונות יכולה לעלות יותר מדרגה חזקה יותר שמצליחה בניסיון אחד.
הרגל תפעולי אחד חוסך כסף אמיתי: ציין את מזהה דגם השכבה המדויק בכל קריאה במקום להסתמך על כינוי גולמי, כך שבקשה שגרתית לעולם לא תרוץ בשקט על השכבה היקרה ביותר. עומס עבודה מעורב בדרך כלל מתפרש ל-Luna עבור טרנספורמציה וניסוח שגרתיים, Terra עבור יישום וניתוח יומיומיים, ו-Sol שמור למיעוט הקשה—רוב הבקשות אינן זקוקות כלל לדגם הדגל.
GPT-5.6 לעומת המתחרים במחיר
GPT-5.6 אינה קיימת בבידוד. השוו מול התחום הנוכחי (למיליון טוקנים, קלט/פלט, אמצע 2026): Claude Opus 4.8 הוא $5 / $25, Claude Fable 5—המודל הציבורי החזק ביותר של Anthropic—הוא $10 / $50, GLM 5.2 הוא $1.40 / $4.40 ב-Z.AI (מארחים של צד שלישי יכולים להיות זולים יותר), Grok 4.5 הוא $2 / $6, של Google Gemini 3.5 Flash הוא בערך $1.50 / $9, ו-DeepSeek V4-Pro הוא בערך $0.44 / $0.87. יש לאשר כל אחד בעמוד של הספק עצמו, מכיוון שאלה משתנים.
המסקנות הספציפיות. GPT-5.6 Sol תואם ל‑Opus 4.8 בקלט אך יקר יותר בפלט ($30 לעומת $25), כך שבעבודה אג׳נטית כבדת פלט, Opus מעט זול יותר לטוקן בעוד ש‑Sol מוביל במדד האינטליגנציה. Terra זול יותר משני דגמי הדגל והוא הבחירה החסכונית במשפחת OpenAI. Luna מתחרה בדגמים זולים יותר במחיר, אם כי Grok 4.5, GLM 5.2, ובמיוחד DeepSeek נמצאים נמוך עוד יותר. אף שכבה או ספק לא מנצחים בהכל, וזה בדיוק הסיבה שניתוב לפי רמת קושי עדיף על התחייבות לאחד.
חשבון חודשי מעובד

שים מספרים על זה. עבור חודש בינוני-כבד של 50M אסימוני קלט ו-10M אסימוני פלט, במחיר הרשימה לפני שמירת מטמון ושימוש בכלים, עלות המודל מסתכמת בערך:
- GPT-5.6 Luna: כ-110 דולר.
GPT-5.6 Terra: כ-$275.
- GPT-5.6 Sol: בערך 550 דולר.
- להשוואה: GLM 5.2 כ-$114, Grok 4.5 כ-$160, Claude Opus 4.8 כ-$500, Claude Fable 5 כ-$1,000.
אותן משימות המנותבות בצורה חכמה—Luna ו-Terra עבור העיקר, Sol עבור המיעוט הקשה—מגיעות קרוב הרבה יותר לטווח $110–$275 מאשר ל-$550 הקבוע של Sol-for-everything. הפער הזה, כשהוא מוכפל על פני שנה, הוא כל הטיעון לניתוב מבוסס שכבות.
עלויות נסתרות שצריך לתכנן עבורן
כמה כללי תמחור אינם מופיעים בשיעור הרשום הראשי ומפתיעים צוותים מאוחר יותר:
- הודעות ארוכות: בקשה עם מעל 272K אסימוני קלט מחויבת בפי 2 עבור קלט ופי 1.5 עבור פלט עבור כל הבקשה, כך שקריאות עם הקשר גדול ו-RAG גדול יכולות להכפיל את העלות ביותר מפי שניים.
- נפח פלט: הפלט הוא עד פי שישה מקצב הקלט, ולכן פלט ללא הגבלה או בעל חשיבה גבוהה הוא סיכון ההוצאה העליון.
- רמת שירות: עיבוד עדיפות הוא בערך כפול מהתעריף הסטנדרטי (בערך $10 קלט / $60 פלט על Sol); Flex ו-Batch זולים יותר. בחר את הרמה בכוונה באמצעות הגדרת service_tier.
- מגורי נתונים: נקודות קצה לעיבוד אזורי מוסיפות תוספת של 10% לדגמים ששוחררו ב-5 במרץ 2026 או לאחר מכן, הכוללת את GPT-5.6.
- לולאות סוכן וניסיונות חוזרים: ההנחיות, הכלים וההיסטוריה נשלחים מחדש בכל תור, ובקשה ארוכה שנכשלה מבזבזת את הקלט שכבר שילמת עבורו.
- סחף דרגות: להשאיר הכל על Sol "כדי להיות בטוח" הוא ההרגל היקר ביותר.
דרכים לשלם פחות
שלוש מנופים חותכים חשבון GPT-5.6 מבלי לשנות את מה שאתה בונה. **Batch**: בקשות אסינכרוניות דרך שכבות ה-Batch זולות ב־50% מהתמחור הסטנדרטי, אידיאליות לעבודה בהיקף גבוה של Luna שאינה רגישה להשהיה. **Caching**: שימוש חוזר בקידומת יציבה מספיק פעמים כדי לנצח את הפרמיה של 1.25x על כתיבה, וירידות חוזרות של קלט מצטמצמות לעשירית. **Routing**: שלח עבודה שגרתית ל-Luna או ל-Terra, והסלף רק את המיעוט הקשה ל-Sol, ושמור על פרומפטים מתחת לסף של 272K כאשר אפשר.
איך לקרוא ל-GPT-5.6
GPT-5.6 זמין דרך OpenAI API ודרך שערים תואמי OpenAI, כך שהאינטגרציה נשארת יציבה בזמן שאתה משנה את המודל או השכבה שמאחוריה. להלן תבנית סטנדרטית תואמת OpenAI; אמת את מזהה המודל הנוכחי לפני שימוש בייצור, וקבע את השכבה המדויקת במקום כינוי חשוף.
from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "בצע רפקטורינג למודול זה והסבר את הסיכונים."}],
)
print(response.choices[0].message.content)
החלפת דרגות היא שינוי של שורה אחת בשדה המודל, וזה מה שהופך ניתוב מבוסס-קושי למעשי: שלח קריאות שגרתיות ל-Luna או Terra והעלה רק את הקשות ל-Sol.
בדיקת GPT-5.6 דרך OrcaRouter
שער מקל על אימוץ GPT-5.6 משתי סיבות. ראשית, אותו לקוח תואם OpenAI יכול לקרוא לכל שלושת השכבות ולדגמי השוואה כמו Claude Opus 4.8, GLM 5.2 ו-Grok 4.5, כך שתוכל להריץ סט הערכה אחד על הכל מבלי לשכתב קוד אינטגרציה ולמדוד עלות אמיתית לכל משימה מאושרת—עמלות כלים, ניסיונות חוזרים ותוספת של 272K כלולים. שנית, שער יכול לעבור בין ספקים (fail over) ולאכוף מגבלת תקציב, כך שבעיית קיבולת זמנית או קריאת Sol תועה לא תפוצץ את החודש. אשר את המסלול הישיר של GPT-5.6 ואת מזהי השכבה הנוכחיים לפני שאתה בונה עליהם תקציב.

השלב הבא: הירשם ל-OrcaRouter והפעל את השוואת דרגות GPT-5.6 משלך באמצעות נקודת קצה API אחת.
שאלות נפוצות
מה ההבדל בין GPT-5.6 Sol, Terra, ו-Luna?
הן שלוש שכבות של אותה משפחה במחירים ורמות יכולות שונות. Sol היא הדגל לעבודה הקשה ביותר ($5/$30), Terra היא ברירת המחדל המאוזנת ($2.50/$15), ו-Luna היא השכבה הכלכלית למשימות בנפח גבוה ($1/$6). בחר את הנמוכה ביותר שעוברת את הבדיקות שלך.
האם יש רמת תמחור של GPT-5.6 Sol Ultra?
לא. "Sol Ultra" היא תצורה מרובת-סוכנים של Sol בעלת יכולת חשיבה גבוהה יותר, ולא שורה נפרדת בדף התמחור. היא משתמשת ביותר טוקנים ועולה יותר לכל משימה, אבל אתה מתקצב אותה כ-Sol במאמץ גבוה יותר.
למה החשבונית שלי על GPT-5.6 חרגה מאומדן פשוט?
בדרך כלל אסימוני פלט, תוספת תשלום עבור הנחיות ארוכות של 272K (2x קלט, 1.5x פלט), רמת שירות Priority, תוספת נתונים אזוריים, או ניסיונות חוזרים. רשום את שרשרת הבקשות המלאה ומדוד עלות לכל משימה שהתקבלה ולא לכל הנחיה.
האם אני יכול לכוון עדין את GPT-5.6, והאם יש רמה חינמית?
לא בשניהם. GPT-5.6 אינו תומך ב-fine-tuning, ול-API אין שכבה חינמית – החיוב מתחיל בטוקן הראשון. גישה חינמית קיימת רק בתוך תוכניות ChatGPT מסוימות, שהן מוצר נפרד מה-API.
איזו תוכנית של ChatGPT יכולה להשתמש באיזו דרגה?
משתנה לפי מוצר. ב-ChatGPT Work וב-Codex, Free ו-Go יכולים להשתמש ב-Terra, בעוד Plus ומעלה יכולים לבחור בין Sol, Terra ו-Luna; הגדרת העל הגבוהה ביותר מוגבלת ל-Pro ו-Enterprise. יש להתייחס לתוכניות ה-API וה-ChatGPT כנפרדות—מפתח API אינו יורש את הגישה של מנוי.
השורה התחתונה
סיפור התמחור של GPT-5.6 הוא הריבוד. Sol ב-$5/$30 מוביל את דירוג האינטליגנציה, Terra ב-$2.50/$15 הוא ברירת המחדל לערך והבית הטבעי לתנועה הקודמת של GPT-5.5, ו-Luna ב-$1/$6 מטפל בנפח. שמירה במטמון מקטינה קלט חוזר לעשירית (אחרי פרמיה של 1.25x על כתיבה), Batch במחצית המחיר, אבל הפלט הוא הצד היקר בכל רובד והנחיות ארוכות מעל 272K נושאות תוספת תשלום.
התייחס לשלוש השכבות כאל בעיית ניתוב, לא כרכישה בודדת: ברירת מחדל נמוכה, הסלמה בכשל, שמירה במטמון של הקשר יציב, שימוש ב-Batch היכן שהשהייה מאפשרת, ושמירה על מודל השוואתי נגיש דרך אותו endpoint. זה מניב עלות נמוכה בהרבה לכל משימה מאושרת מאשר תשלום תעריפי דגל עבור עבודה שגרתית.
