
תמחור GPT-6.1 Sol: כרטיס התעריפים, המונה האחד שזז, וצוק ה-272K
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
עמוד זה הוא כרטיס התעריפים. GPT-6.1 Sol עולה $2.00 למיליון אסימוני קלט, $0.10 למיליון אסימוני קלט במטמון, $2.50 למיליון אסימוני כתיבה למטמון ו-$10.00 למיליון אסימוני פלט במסלול הסטנדרטי של הספק, וגם GPT-6 Sol — המדרגה שהמודל הזה מחליף, וזו שהקטלוג שלנו משרת — מציג $2.00, $0.20, $2.50 ו-$10.00 עבור אותם ארבעה מדדי חיוב. מספר אחד שונה בין שני הכרטיסים, הסף שמעליו שניהם מתומחרים מחדש נמצא באותו מקום, וההנחות מתחת למחיר המחירון הן מכפילים ולא רשימת מחירים שנייה. כל מה שבדף זה נלקח מדף התמחור למפתחים של הספק עצמו ומשני דפי המודלים שלו עבור GPT-6.1 Sol ו-GPT-6 Sol, כולם נקראו ב-7 באוקטובר 2026, ומכרטיסי המודלים שלנו עצמנו כאשר נתון מסומן כשלנו. אין כאן חזרה על נרטיב ההשקה; אם אתם רוצים את מה שיצא, זה עמוד אחר.
כרטיס התעריפים, כשארבעת המונים של GPT-6 Sol נמצאים ממש מתחתיו
OpenAI מפרסמת את אלה כמחירים למיליון טוקנים בשכבת העיבוד הסטנדרטית, עבור בקשה של עד 272,000 טוקני קלט. שתי השורות המשמעותיות סמוכות זו לזו בכוונת מכוון, מפני שכל הטיעון של הפרסום נראה לעין בצמד: קראו לאורך כל מדד בתורו, ובדיוק אחד מהם משתנה.
• קלט GPT-6.1 Sol — $2.00 למיליון טוקנים, ללא שינוי מ-GPT-6 Sol.
• קלט מטמון GPT-6.1 Sol — $0.10 למיליון טוקנים, מחצית מ-$0.20 של GPT-6 Sol.
• כתיבת מטמון GPT-6.1 Sol — $2.50 למיליון טוקנים, ללא שינוי מ-GPT-6 Sol.
• פלט GPT-6.1 Sol — $10.00 למיליון טוקנים, ללא שינוי מ-GPT-6 Sol.
• קלט GPT-6 Sol — $2.00 למיליון טוקנים.
• קלט במטמון של GPT-6 Sol — $0.20 למיליון טוקנים.
• כתיבה למטמון של GPT-6 Sol — $2.50 למיליון טוקנים.
• פלט GPT-6 Sol — $10.00 למיליון טוקנים.
שלוש מבין שמונה השורות האלה הן אותו מספר שנכתב פעמיים, וזו הנקודה: זה אינו תמחור מחדש, זה מד אחד שזז על מודל אחד. כתיבות מטמון הן 1.25× מקצב הקלט ללא מטמון בשני הכרטיסים, כך ש-$2.50 הוא $2.00 × 1.25 בשניהם — תוספת הכתיבה היא תכונה של המשפחה, לא של הגרסה. קריאות ממטמון הן השורה היחידה שבה שני המודלים נבדלים: ב-GPT-6.1 Sol קריאה ממטמון היא 5% מקצב הקלט, ב-GPT-6 Sol היא 10%, ו-OpenAI מציינת את שתיהן כשברים מקצב הקלט ולא כמחירים עצמאיים.
הערה אחת על האופן שבו העמוד הזה מציג נתונים. OpenAI מפרסמת את לוח התעריפים כמחיר מחירון אחיד לכל מטר, כאשר שום מסייג של מאמץ הסקה אינו מצורף לאף אחת משמונה השורות שלמעלה, ולכן אף אחת מהן אינה נקובה ברמת מאמץ מסוימת. מאמץ משנה כמה טוקנים משימה מוציאה, לא את עלותו של טוקן, וזו הסיבה שלוח התעריפים אינו תלוי במאמץ ואילו החשבונית שלך כן. שום דבר בעמוד הזה אינו השוואה ראש-בראש במאמץ מותאם מול מודל מתחרה, ואין בשום מקום בהמשך שום רמז להשוואה כזו — במקום שבו נתון תלוי במאמץ, העמוד הזה מציין את המאמץ שבו הוא הופק.

השורה היחידה שהשתנתה: קלט שמור במטמון, מ-$0.20 ל-$0.10
מדד קלט שמור במטמון מתמחר את החלק של בקשה שלא השתנה. כאשר קידומת יציבה וארוכה — הנחיית מערכת, קבוצה של סכמות כלים, קורפוס שנשלף, תמלול מצטבר של לולאה — נשמרת במכוון כך שהבקשה הבאה תוכל לעשות בה שימוש חוזר, הטוקנים המשמשים מחדש מחויבים בתעריף המטמון במקום בתעריף הקלט, והטוקנים שנשמרים מלכתחילה מחויבים בתעריף כתיבת המטמון. מדובר בהנחה על חזרתיות, והיא קיימת משום שהחלופה עבור הספק היא לחשב מחדש את אותה קידומת מאפס בכל קריאה.
חציית המונה הזה היא לא אותו סוג של חדשות כמו חציית מונה הקלט, וכדאי לדייק בהבדל. תעריף הקלט הוא העלות של כל טוקן שאינו במטמון במשפחה, כך שחצייתו תהיה תמחור מחדש של כל קו הקטלוג. תעריף המטמון הוא עומק הנחה — עד כמה מתחת לתעריף הקלט נמצא טוקן בשימוש חוזר — כך שהזזתו היא שינוי בתגמול עבור התנהגות מסוימת ולא שינוי בקו הבסיס. תעריף הקלט של GPT-6.1 Sol הוא $2.00, בדיוק מה ש-GPT-6 Sol גובה, כך שבקשה ללא קידומת במטמון מחויבת באופן זהה בשני המודלים. חציית מונה המטמון מעבירה את ההנחה מ-90% הנחה על הקלט ל-95% הנחה על הקלט, וזה מגיע בדיוק לעומסי העבודה שהקידומות שלהם ארוכות מספיק ונעשה בהן שימוש חוזר לעתים קרובות מספיק כדי להירשם במונה בכלל. קראו את המונה שהוזז כ"אותה משימה עולה פחות אם אתם משתמשים במטמון" ולא כ"המודל נעשה זול יותר", והכרטיס מפסיק להיות מפתיע.
החשבון נובע משתי השורות ולא משום דבר אחר. מיליון טוקני קלט במטמון עולה $0.10 ב-GPT-6.1 Sol ו-$0.20 ב-GPT-6 Sol, כך שהשחרור שווה עשרה סנט לכל מיליון טוקנים במטמון — נתון שהוא זניח בקריאה בודדת ומשמעותי בהרצה ארוכה, מפני שקידומת במטמון נקראת פעם אחת בכל תור. כתיבות למטמון נותרו ללא שינוי ב-$2.50, כך שנקודת האיזון של שימוש במטמון בכלל אינה משתנה בעקבות השחרור: ההחזר על פרמיית הכתיבה מגיע משימוש חוזר בקידומת, ולא מהשאלה איזה משני תעריפי המטמון חל.
מעל 272,000 טוקני קלט, הבקשה כולה מתומחרת מחדש
לשני הכרטיסים יש דרגת הקשר ארוך, ובעמוד התמחור של OpenAI מנוסח אותו כלל באופן זהה לשניהם: פרומפטים עם יותר מ-272K אסימוני קלט מתומחרים ב-2× תעריפי קלט ומטמון וב-1.5× פלט עבור הבקשה כולה. הבקשה כולה מתומחרת מחדש — לא רק האסימונים שמעבר לקו. זה המשפט שכדאי לקחת מהקטע הזה, כי כאן כרטיס התעריפים מפסיק להיות טבלת חיפוש: ב-272,001 אסימוני קלט, הבקשה כולה, כולל האסימון הראשון, מחויבת לפי עמודות ההקשר הארוך.
הכרטיס המתומחר מחדש עבור GPT-6.1 Sol, מעל 272,000 אסימוני קלט:
• קלט — $4.00 למיליון טוקנים, פי 2 מתעריף ההקשר הקצר.
• קלט במטמון — $0.20 למיליון טוקנים, פי 2 מתעריף ההקשר הקצר.
• כתיבה למטמון — $5.00 למיליון טוקנים, פי 2 מתעריף ההקשר הקצר.
• פלט — $15.00 למיליון טוקנים, פי 1.5 מתעריף ההקשר הקצר.
ואותה דרגה ב-GPT-6 Sol, כך שניתן לקרוא את שתי השורות זו מול זו:
• קלט — $4.00 למיליון טוקנים.
• קלט במטמון — $0.40 למיליון טוקנים.
• כתיבה למטמון — $5.00 למיליון טוקנים.
• פלט — $15.00 למיליון טוקנים.
שוב, כל הבקשה מתומחרת מחדש, לא העודף, כך שפרומפט של 273,000 טוקנים מחויב בקלט של $4.00 עבור כל 273,000 הטוקנים, ולא ב-$2.00 עבור 272,000 הראשונים וב-$4.00 עבור אלף האחרונים. זה הופך את חציית הסף למדרגה ולא לשיפוע, וזה גורם לשינוי בקלט השמור להיראות שונה מעל הקו מאשר מתחתיו. $0.20 ש-GPT-6.1 Sol גובה עבור קריאה מהמטמון מעל 272K הוא בדיוק התעריף ש-GPT-6 Sol גובה מתחתיו, כך שעומס עבודה עם קלט שמור בהקשר ארוך על המודל החדש משלם את המחיר מלפני ההשקה. החיסכון נשמר במונחים יחסיים מעל הקו — $0.20 מול $0.40 של GPT-6 Sol הוא עדיין הפחתה בחצי — אבל עשרת הסנטים הכותרתיים לא חלים על הבקשה שחוצה את הסף, כי הבקשה הזו לא מחויבת לפי כרטיס ההקשר הקצר בכלל.

מדרגות ההנחה, כמכפילים
כל מה שמתחת למחיר המחירון הסטנדרטי הוא מכפיל שמוחל על הכרטיס שלמעלה, ולא רשימת מחירים נפרדת. הצגתם כמכפילים היא מה שהופך אותם לניידים: אותם שלושה גורמים חלים על כל ארבעת המונים בשני הדגמים, כך שלקורא שיש לו את הכרטיס הסטנדרטי יש את כל מבנה השכבות.
• Batch — 50% מהתעריף הרגיל. התמחור של OpenAI עבור Batch הוא בדיוק מחצית בכל ארבעת המונים בשני המודלים: $1.00 קלט, $0.05 קלט במטמון, $1.25 כתיבה למטמון ו-$5.00 פלט למיליון ב-GPT-6.1 Sol, ו-$1.00, $0.10, $1.25 ו-$5.00 ב-GPT-6 Sol.
• Flex — 50% מהתעריף הרגיל, וזהה ל-Batch בשני המודלים שורה בשורה, כך שהבחירה ביניהם היא בחירה בתזמון ולא בחירה במחיר.
• מצב Fast — פי 2 מהתעריף הרגיל בכל ארבעת המונים בשני הכרטיסים, בלי יוצא מן הכלל שרשום באף אחת משתי טבלאות התמחור. מצב Fast הוא $4.00 קלט, $0.20 קלט במטמון, $5.00 כתיבה למטמון ו-$20.00 פלט למיליון ב-GPT-6.1 Sol, לעומת $4.00, $0.40, $5.00 ו-$20.00 ב-GPT-6 Sol — שתי השורות נבדלות רק בשורת המטמון, ורק באותו גורם של פי 2 שכבר נושא בו התעריף הרגיל של המטמון בכל אחד מהמודלים.
• עיבוד אזורי — תוספת של 10% על גבי השכבה הרלוונטית, עבור מודלים שיצאו ב-5 במרץ 2026 ואילך, בכל מקום תושבות שאינו ברירת המחדל.
למצב Fast יש מגבלת זמינות אחת שהמחיר לבדו אינו מספר לך עליה. עמוד המודל של OpenAI עצמה עבור GPT-6.1 Sol מציין שמצב Fast אינו זמין עם שהות נתונים באיחוד האירופי, והנחיות שהות הנתונים שלה מפרטות את GPT-6.1 Sol בין המודלים שתומכים בשהות נתונים באיחוד האירופי עם עיבוד Standard, Flex ו-Batch. לכן בתוך האיחוד האירופי סולם השכבות קצר בשתי שליבות, לא באחת: השכבות במחיר מחצית קיימות, והשכבה במחיר כפול אינה קיימת. קורא שמשווה פריסה אירופית לפריסה אמריקאית צריך להשוות אותה ל-Standard, מפני שזו השכבה המהירה ביותר הזמינה לה — ציטוט נתון של מצב Fast עבור עומס עבודה באיחוד האירופי מתאר תצורה שהספק אינו מציע.
שום דבר בכרטיס הזה אינו מבצעי, ולשום דבר אין תאריך תפוגה.
השורות של GPT-6.1 Sol שלמעלה הן תעריף המחירון. עמוד התמחור של OpenAI אינו מצרף להן שום הסתייגות מבצעית ושום תאריך סיום, ואף אחד מארבעת המונים, לא בכרטיס ההקשר הקצר ולא בכרטיס ההקשר הארוך, אינו מסומן כנתון לזמן מוגבל. כדאי לומר זאת במפורש, משום שלמשפחה יש דוגמה נגדית שנמצאת באותו עמוד: לתמחור המבצעי של GPT-5.6 Sol מצורפת הערת שוליים שמחייבת אותו לפחות עד 21 בנובמבר 2026, כלומר כל מחיר GPT-5.6 Sol שמצוטט היום הוא מחיר שאליו מצורפת נקודת בחינה ידועה. לשום דבר ב-GPT-6.1 Sol אין צורה כזאת.
המשמעות המעשית היא שהעמוד הזה לא זקוק להסתייגות של בדיקת תאריך על המספרים עצמם — הסתייגות כזו נדרשת בעמוד שאתה קורא, משום שתעריף מחירון יכול להשתנות בלי שתאריך תפוגה הופעל. הדבר גם אומר שכרטיס GPT-6.1 Sol הוא השורה הנכונה שעליה לבנות מודל עלויות אם אתה בוחר בין שני דרגי Sol ורוצה שההשוואה תישאר יציבה: מונה המטמון של GPT-6 Sol בסך $0.20 הוא גם תעריף מחירון רגיל בלי מבצע מצורף, ולכן הפער של עשרה סנטים ביניהם הוא הבדל מבני בכרטיסים ולא הנחה זמנית שאחד המודלים מפעיל מול האחר.
איך לקרוא את טענת המחיר של GPT-6.1 Sol של מישהו אחר
שתי שאלות מכריעות כמעט כל מחלוקת בנוגע למה שעולה מודל מסוג Sol, ושתיהן ניתנות למענה מן הכרטיס ולא מן הפרוזה שסביבו.
• איזה מונה מצוטט? קלט, קלט במטמון, כתיבה למטמון ופלט הם ארבעה מספרים שונים באותה בקשה, ומחיר כותרת בודד הוא כמעט תמיד מונה הקלט, כששלושת האחרים נותרים מרומזים. טענה שנקראת כעלות כוללת היא בדרך כלל תעריף קלט כפול תערובת טוקנים משוערת, והתערובת המשוערת היא המקום שבו שוכנת המחלוקת.
• איזו דרגת הקשר הונחה? כרטיסי ההקשר הקצר וההקשר הארוך נבדלים פי 2 בקלט ובמטמון ופי 1.5 בפלט, והדרגה נבחרת לפי כל הבקשה ולא לפי העודף, כך שנתון המצוטט בלי דרגה הוא נתון שמשתנה ברגע שהבקשה חוצה 272,000 טוקני קלט.
• איזו דרגת עיבוד הונחה? Standard, Batch, Flex ו-Fast נבדלים בפערים של פי 2 ופי 50%, ומחיר המצוטט בלי לומר איזו מהן הוא מחיר שטומן בחובו פי ארבעה של עמימות עוד לפני שנשאלת שאלת מונה כלשהי.
• איזו רמת מאמץ הונחה, אם מדובר במספר טוקנים? התעריפים אינם תלויים במאמץ, אבל מספרי הטוקנים כן, כך שכל נתון עלות למשימה יורש את מאמץ החשיבה שבו נמדד — והשוואה בין שני מודלים בהגדרות מאמץ שונות אינה השוואה של המחירים שלהם.
ענה על ארבעת אלה, וטענת מחיר או שהיא שורדת או שהיא לא. מה שהיא לא צריכה לעשות הוא להיות מושווית מול ארבעת המטרים של העמוד הזה בלי לנקוב תחילה בשם הדרגה והמטר, מפני ששני הכרטיסים סמוכים בדיוק כדי שהקו הנע היחיד ייראה ושום דבר אחר לא יוחלף בו בטעות.

היכן מוגש שלב ה-GPT-6 Sol
OrcaRouter מגישה את דרג GPT-6 במחיר המחירון של OpenAI עצמה, בלי שום תוספת. עמוד המודל בכתובת https://www.orcarouter.ai/models/openai/gpt-6-sol מציג את GPT-6 Sol במחיר $2.00 לקלט ו-$10.00 לפלט למיליון טוקנים, תואם לכרטיס שלמעלה שורה בשורה, ב-0% תוספת, והקטלוג מחזיק יותר מ-200 מודלים באותם תנאים. הכרטיס שלנו עבור המסלול הזה מציג את אותם נתונים של $0.20 לקלט במטמון ו-$2.50 לכתיבה למטמון ש-OpenAI מפרסמת, כך שהמספרים תואמים בדיוק זה לזה; התייחסו לכל נתון מטמון בעמוד הזה כאל הצגה מחדש של התעריף שפרסמה OpenAI, ולא כאל הצעת מחיר עצמאית מצדנו. GPT-6.1 Sol מופיע גם בקטלוג שלנו — הכרטיס החי עבור openai/gpt-6.1-sol נושא תאריך שחרור של 29 בספטמבר 2026, שני מדרגי התמחור משקפים את אלה של OpenAI, וספירת טוקנים של שבעה ימים בסדר גודל של מאות מיליונים — כך שמי שרוצה את הדרג החדש יותר צריך לקרוא את המספרים של אותו עמוד בעצמו, ולא להתייחס לעמוד הזה כאל המילה האחרונה בנוגע אליהם. מחירים משתנים; העמוד הוא הציטוט.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
