כרטיס כותרת מרכזי שנוצר, שעליו הכיתוב 'GPT-6 Luna נגד Claude Opus 5', עם כתובית משנה 'פי חמישים מהמחיר. אחד מהם כבר אינו הדגם שהספק שלו מוכר.', עם שבבים המציגים את Luna במחיר $0.10/$0.50 לכל 1M, את Opus 5 במחיר $5.00/$25.00 לכל 1M, ואת Opus 5.5 שמשוחרר באותו אחר הצהריים במחיר $4.00/$20.00, והלוגו של OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

GPT-6 Luna מול Claude Opus 5: פי חמישים מהמחיר ואותו אחר הצהריים

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

GPT-6 Luna עולה $0.10 למיליון טוקנים בקלט ו-$0.50 למיליון בפלט. Claude Opus 5 עולה $5.00 ו-$25.00. זהו פער של פי חמישים משני צדי כרטיס התעריפים, וזה הדבר הראשון שכל אחד מבחין בו בזיווג הזה — מודל שהספק הוציא ב-22 בספטמבר 2026, מתומחר מול מודל שהחברה שחררה ב-24 ביולי 2026, שנמצא בשוק כבר חודשיים. המספר פי חמישים אמיתי. הוא גם קרוב להיות העובדה הכי פחות שימושית בהשוואה הזו, מפני ששני אלה לא מתחרים על אותה קריאה, ובגלל משהו שקרה בצד של המודל השני של המתרס באותו אחר הצהריים שבו לונה הושקה.

GPT-6 Luna הוא הדרג הנמוך של הדור GPT-6 של OpenAI, ממוקם מתחת ל-GPT-6 Sol במחיר $2.00/$10.00 והרבה מתחת לדגל ה-GPT-6 Astra במחיר $10.00/$50.00. Claude Opus 5 היה הדגל של Anthropic עד 22 בספטמבר, אז השיקה Anthropic את Claude Opus 5.5 במחיר $4.00/$20.00 והורידה את Opus 5 דרגה אחת. שני הדגמים הנזכרים בכותרת המאמר הזה נמצאים, נכון להיום, צעד אחד מתחת לראש הסולם של הספק שלהם — מסיבות שאין להן שום קשר זו לזו. זה חשוב יותר מיחס המחירים, ומכאן מתחיל המאמר.

אחר הצהריים שבו שני הספקים שלחו את הסחורה

OpenAI הכריזה על GPT-6 Sol ועל GPT-6 Luna ב-22 בספטמבר. שעות קודם לכן, Anthropic הכריזה על Claude Opus 5.5. שניים מבין שלושת המודלים במשפט הזה הורידו מחירים בכמחצית לעומת קודמיהם, וזה לא כל כך צירוף מקרים כמו שזה שוק: שמונת-עשר החודשים הקודמים של שחרורים של משקולות פתוחות ממעבדות סיניות כבר דחפו בכוח כלפי מטה את עלותו של אסימון ברמה מספקת, ושני הספקים הגיבו לאותו לחץ.

ההשלכה המעשית לכל מי שמחזיק בפריסה של Claude Opus 5 היא שהמודל שהם בנו מולו הוא כבר לא המודל ש-Anthropic מוכרת אותו הכי חזק. Claude Opus 5.5 הוא $4.00/$20.00 — הורדה של 20% במחיר המחירון — כשקלט במטמון עומד על $0.20 למיליון, ירידה מ-$0.50 של Opus 5, ו-Artificial Analysis מודדת אותו ב-58 במדד ה-Intelligence Index שלה במאמץ מקסימלי, הנתון הגבוה ביותר שהיא רשמה. Claude Opus 5 נמדד ב-51 באותו מדד. אם אתם מריצים Opus 5 היום, השוואת פי החמישים שבכותרת המאמר הזה היא לא זו שלפניכם. זו שלפניכם היא האם לעבור ל-Opus 5.5, והתשובה לכך היא חישוב נפרד מכל מה ש-GPT-6 Luna עושה.

עם זאת, המספר של פי חמישים עדיין מכריע החלטה אמיתית, מפני שסוגי העומס ש-GPT-6 Luna נבנתה עבורם הם בדיוק סוגי העומס שבהם חשבון של Claude Opus 5 נעשה לא נוח. שתי העובדות יכולות להיות נכונות בו-זמנית.

מה בעצם כל אחד מהשניים האלה

המפרטים, שורה אחת לכל מימד, שני הצדדים בכל אחד:

• מחיר למיליון טוקנים — GPT-6 Luna ‏$0.10 קלט / $0.50 פלט לעומת Claude Opus 5 ‏$5.00 קלט / $25.00 פלט

• קלט במטמון — GPT-6 Luna $0.01 ל־1M, הנחה של 90% לעומת Claude Opus 5 $0.50 ל־1M בכרטיס Opus 5, שהופחת ל־$0.20 ב-Opus 5.5

• חלון הקשר — GPT-6 Luna 1,050,000 סה״כ עם 922,000 קלט מרבי לעומת Claude Opus 5 1M, כששניהם מוגבלים ל-128,000 אסימוני פלט

• תמחור מחדש להקשר ארוך — GPT-6 Luna מכפילה את הקלט ואת המטמון ומעלה את הפלט פי 1.5 מעל 272K אסימוני קלט, מיושם על כל הבקשה לעומת Claude Opus 5 שאחיד לאורך החלון שלו

• AA Intelligence Index — GPT-6 Luna 37 במאמץ מקסימלי לעומת Claude Opus 5 51

• מדד הבינה של AA, בהתאמת מאמץ — GPT-6 Luna 29 במאמץ הבינוני המוגדר כברירת מחדל שלו לעומת Claude Opus 5 51 במאמץ מקסימלי, ההגדרה היחידה שבה Anthropic מודדת אותו

• מהירות פלט — GPT-6 Luna 153.9 טוקנים/שנייה לעומת Claude Opus 5 53.6 טוקנים/שנייה

• עלות הרצת האינדקס — GPT-6 Luna $122.39 לעומת Claude Opus 5 $7,274.74

• מתג כיבוי חשיבה — GPT-6 Luna מציע ללא, נמוך, בינוני, גבוה, xhigh ומקסימום לעומת Claude Opus 5 שיש לו חשיבה אדפטיבית ותמיד פעילה

• שוחרר — GPT-6 Luna 2026-09-22 לעומת Claude Opus 5 2026-07-24

A generated single-panel scoreboard card headed 'The two rate cards' with six rows: GPT-6 Luna $0.10 in / $0.50 out per 1M; Claude Opus 5 $5.00 in / $25.00 out per 1M; Luna cached input $0.01 per 1M; Opus 5 cached input $0.50 per 1M, $0.20 on Opus 5.5; Intelligence Index Luna 37 at max and 29 at default against Opus 5's 51; and cost to run the full index, Luna $122.39 against Opus 5's $7,274.74. Footer: 'Index and index-run cost per Artificial Analysis; prices per OpenAI and Anthropic.'

שלוש מהשורות האלה עושות עבודה רבה יותר מהאחרות, והראשונה היא שורת המאמץ. ה-37 של GPT-6 Luna הוא הציון שלה במאמץ מקסימלי. ברירת המחדל שלה היא בינונית, ובבינונית הציון שלה הוא 29. ה-51 של Claude Opus 5 הוא ציון במאמץ מקסימלי, מכיוון ש-Anthropic אינה חושפת הגדרה נמוכה יותר ש-Artificial Analysis מודדת. אז פער הכותרת של ארבע עשרה נקודות הוא השוואה בין התקרה של מודל אחד לתקרה של מודל אחר — וצוות שמתקין את GPT-6 Luna ולא משנה דבר מריץ את ה-29, לא את ה-37. זהו פער של עשרים ושתיים נקודות, לא של ארבע עשרה נקודות, והוא בלתי נראה אלא אם כן יוצאים לחפש את ברירת המחדל של המאמץ.

השנייה היא שורת עלות המדד. זה לא הצעת מחיר — זה מה ש-Artificial Analysis הוציאה בפועל מכספה שלה על הרצת מערך ההערכה המלא על כל מודל. $122.39 לעומת $7,274.74 הם פער של פי חמישים ותשעה בעלות של לגלות כמה טוב המודל, וזהו הפרוקסי הנקי ביותר הזמין לאיך שהשניים מתנהגים בהיקף גדול. Claude Opus 5 הפיק 140 מיליון טוקנים במהלך אותה הרצה; GPT-6 Luna הפיק 150 מיליון. המודל הזול היה יותר מילולי ועדיין עלה פי חמישים ותשעה פחות.

השלישי הוא מתג הכיבוי. אפשר להורות ל-GPT-6 Luna שלא לבצע היסק כלל. ל-Claude Opus 5 אי אפשר. שורת המפרט הבודדת הזאת היא הסיבה לכך שאחד מהמודלים האלה יכול לשבת מאחורי מסווג, נתב או מסך מודרציה, ואילו האחר לא, והיא מסבירה חלק גדול מההבדל במחיר בלי להיזקק ליכולת בכלל.

היכן שהמסלול הזול מפסיק להיות זול

יש צוק במחירון של GPT-6 Luna, והוא הדבר היקר ביותר לפספס. בקשות שחורגות מ-272,000 אסימוני קלט מחויבות בכפול משיעורי הקלט והמטמון ובפי 1.5 משיעור הפלט — עבור הבקשה כולה, לא רק החלק שחצה את הקו. קריאה בת 300,000 אסימונים ב-GPT-6 Luna מחויבת ב-$0.20 למיליון אסימוני קלט עבור כל 300,000 האסימונים, כי היא חרגה ב-28,000. פצלו את אותו מסמך לשתי קריאות והעלות יורדת בחצי ללא שינוי בפרומפט.

ל-Claude Opus 5 אין סעיף מקביל. ה-$5.00/$25.00 שלו אחיד לאורך כל חלון ה-1M, כלומר יחס פי חמישים הוא יחס פי חמישים בכל מקום — פרט למעל 272K אסימוני קלט, שם שיעור הקלט האפקטיבי של GPT-6 Luna מוכפל ל-$0.20 ושיעור הפלט שלו עולה ל-$0.75, והפער מצטמצם לפי עשרים וחמישה. עדיין עצום. עדיין שווה לדעת, מפני שהעומסים שסביר ביותר שיהיה להם הקשר עבודה של 300,000 אסימונים הם בדיוק העומסים הסוכניים ששני הספקים מוכרים להם.

הדבר השני לתמחור הוא מאמץ. הפעלת GPT-6 Luna במאמץ מקסימלי עבור משימה שהייתה בסדר במאמץ בינוני היא הדרך הנפוצה ביותר לבזבז את החיסכון שזה עתה השגת. הפער בין 37 ל-29 הוא גודל העונש עבור ההגדרה הלא נכונה, ובשונה מסעיף מחיר הוא לא מופיע בשום מקום בחשבונית — הוא מופיע כנפח טוקנים, שנראה כמו הצלחה.

הפיצול שבאמת מכריע

הגרסה הכנה של ההשוואה הזאת היא ששני המודלים אינם תחליפים, ויחס המחירים הוא הסחת דעת משאלת עומס עבודה שיש לה תשובה ברורה בכל מקרה.

GPT-6 Luna שייך בכל מקום שבו את הפלט צורך תוכנה ולא אדם, והנפח הוא העיקר. סיווג, חילוץ, החלטות ניתוב, סיכום בכמות גדולה, הלולאה הפנימית של סוכן שמבצע אלף קריאות קטנות לכל משימה. במחיר של $0.10/$0.50 עם תעריף קלט במטמון של סנט אחד, ועם Batch ו-Flex במחצית מהתעריף הרגיל, הכלכלה אינה צמודה מול שום דבר בסדרת Opus. Artificial Analysis מסמן רגרסיה אמיתית אחת שכדאי להכיר לפני שאתם עוברים: מדד Coding Agent של GPT-6 Luna ירד בשתי נקודות ל-41 לעומת 43 של GPT-5.6 Luna, כאשר הירידות התרכזו ב-SWE-Atlas-QnA וב-DeepSWE v1.1. הוא גם מסמן שיפור אמיתי אחד באותו סדר גודל — שיעור ההזיות של המודל ב-AA-Omniscience ירד מכ-93% ל-77%, בעוד שהדיוק שלו בקושי זז. הוא נמנע מלענות לעתים קרובות יותר במקום לדעת יותר, ולכל דבר שיש לו צרכן במורד הזרם זה החצי היקר יותר של העסקה.

Claude Opus 5 שייך למקום שבו הפלט הוא המוצר. התוצאות שפרסמה Anthropic בעצמה — מדווחות בידי הספק, ולא שועתקו באופן בלתי תלוי — מעמידות אותו על 96.0% ב-SWE-bench Verified ועל 79.2% ב-SWE-bench Pro, ופער המדד של ארבעה-עשר נקודות הוא מסוג השוליים שמכריעים אם סוכן בעל אופק ארוך מסיים משימה או פשוט עוצר בשקט באמצע הדרך. אם אתם בקצה היכולת של המודל, מודל שזול פי חמישים ומפגר בעשרים ושתיים נקודות במאמץ ברירת המחדל אינו גרסה זולה יותר של אותו דבר.

להריץ את שניהם בלי לבחור

הסיבה שההשוואה הזו אינה מתגבשת להמלצה אחת היא שהגבול בין שתי עומסי העבודה אינו יציב. הוא זז בכל פעם שאחד מהספקים משחרר גרסה, והוא זז פעמיים בשלושת השבועות שלפני מאמר זה — פעם אחת כאשר Anthropic הורידה את תעריף Opus ל-$4.00/$20.00, ופעם אחת כאשר OpenAI חתכה בחצי את המחיר של כל שכבת המודלים הקטנים שלה. צוות שקיבע מנצח בקוד ביולי מריץ היום תצורה שגויה.

Claude Opus 5 נמצא ב-OrcaRouter במחיר המחירון של Anthropic, במסגרת תמחור מעבר (pass-through) שפירושו ששינוי בתעריף הספק נכנס לתוקף אצלנו באותו יום, במקום להמתין שמשווק ינהל מחדש משא ומתן — וזו הסיבה הקונקרטית לכך שההורדה של Opus 5.5 נכנסה לקטלוג שלנו בלי פרויקט אינטגרציה. GPT-6 Luna אינו נמצא ב-OrcaRouter נכון לכתיבת שורות אלה; מגיעים אליו דרך ה-API של OpenAI עצמה. לכן ההגדרה הכנה לצוות שרוצה את שניהם היא מפתח אחד ל-Claude Opus 5 לצד מה שאתם כבר משתמשים בו ל-OpenAI, עם מעבר גיבוי אוטומטי שמכסה את הפער כשספק נחלש. העברת נתיב בין מסווג בעלות סנט אחד למנוע הסקה בעלות עשרים וחמישה דולרים באמצעות שינוי בקונפיגורציה ולא בנתיב קוד שווה יותר מאשר לבחור נכון בספטמבר.

A screenshot of the Artificial Analysis page for GPT-6 Luna (max), showing an Intelligence rank of 6th of 183 models, a Speed rank of 35th, a Cost rank of 20th and a Verbosity rank of 36th, input pricing of $0.10 and output of $0.50 per 1M tokens, an Intelligence Index score of 37 against a comparable-model median of 12, 150M output tokens generated during the index run, 153.9 tokens per second, and a total of $122.39 spent evaluating the model.

מה לעשות השבוע

אם אתה מריץ את Claude Opus 5, הפער של פי חמישים בכותרת הוא מספר אמיתי שמצביע על ההחלטה הלא נכונה. ההחלטה שלך היא Opus 5.5 — קיצוץ של 20% ברשימה, ציון אינדקס גבוה יותר, ושיעור קלט שמור שנפל ב-60% — ו-GPT-6 Luna היא שאלה אחרת שבמקרה נמצאת באותו עמוד.

אם אתם מריצים צינור סיווג או חילוץ בנפח גבוה על מודל בדרגת Opus, GPT-6 Luna הוא מהלך העלות הבודד הגדול ביותר הזמין לכם החודש, וההגירה קטנה יותר ממה שקיצוץ המחיר מרמז: אותה מחלקת הקשר של 1M, אותה תקרת פלט של 128,000, ותעריף לכל טוקן שנמוך פי חמישים בשני הצדדים. בדקו אותו במאמץ בינוני לפני שאתם מניחים את ברירת המחדל, הציבו את קריאות ההקשר הארוך שלכם בצד הנכון של 272,000 טוקנים, ובדקו את הרגרסיה בקוד מול ההערכה שלכם ולא מול תרשים של ספק.

ואם אתה מריץ את שניהם, הדבר שצריך לתקן הוא לא איזה מהם בחרת. זה ששינוי דעתך כרגע עולה פריסת קוד.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5), showing the Vision, Tools, JSON and Reasoning badges, a 2026-07-24 catalogue date, a 1M-token context with 128K maximum output and text, image and file input, list pricing of $5.00 input and $25.00 output per 1M tokens, a p50 time to first token of 5.61s, and the description of Claude Opus 5 as Anthropic's flagship model for demanding reasoning, coding and long-horizon agentic work.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית