כרטיס כותרת הירואי עבור "Qwen 4 Max vs Claude Opus 5" עם כותרת משנה "הבנצ'מרק שזז מתחת לשניהם", שלושה תגים בצורת גלולה עם הכיתוב "עדכון אינדקס v4.3.2", "51 נגד 53" ו-"$5.00 ו-$25.00", והלוגו של OrcaRouter בפינה הימנית התחתונה.
Engineering & Research

Qwen 4 Max לעומת Claude Opus 5: הבנצ'מרק שזז מתחת לשניהם

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Qwen 4 Max הוצג בתצוגה מקדימה בכנס Yunqi בהאנגג'ואו ב-22 בספטמבר 2026 — דרגת הדגל של קו Qwen 4 בן ארבעה מודלים, שהוכרז אך טרם שוחרר, ללא מחיר, ללא חלון הקשר וללא ציון מפורסם. Claude Opus 5 זמין באופן כללי מאז 24 ביולי 2026 במחיר של 5.00 דולר למיליון טוקני קלט ו-25.00 דולר למיליון טוקני פלט, והוא היה היעד שאליו כוון כל דגם דגל מאז שחרור Qwen3.8-Max. הדרך המובנת מאליה לכתוב את ההשוואה הזו היא טבלת מפרטים עם עמודה אחת ריקה. הדרך המועילה היא לשים לב לכך שב-19 בספטמבר 2026, שלושה ימים לפני ההכרזה, Artificial Analysis נתנה ציון מחדש למדד ה-Intelligence Index שלה, ו-Claude Opus 5 הפסיק להיות המודל שבראשו. השינוי היחיד הזה ממסגר מחדש את מה ש-Qwen 4 Max צריך לגבור עליו.

מה השתנה ב-19 בספטמבר

Artificial Analysis פרסמה מהדורת אינדקס v4.3.2 ב-19 בספטמבר 2026. במהדורה הנוכחית Claude Opus 5 מקבל 51 במדד האינטליגנציה במאמץ החשיבה המרבי שלו — 50 ב-xhigh, 48 ב-high, 45 ב-medium ו-39 ב-low — והוא ממוקם מאחורי Claude Fable 5.1 ו-GPT-6 Astra, שניהם ב-53. העלות לכל משימה במדד הזה היא $5.86.

אם זה נקרא כמו הורדה בדרגה, זה לא כזה. המודל לא השתנה. המדד כן. הסיקור שלנו עצמו במהלך יולי ואוגוסט ציטט את Claude Opus 5 בציון 61 עד 63 ובראש הטבלה, והמספרים האלה היו נכונים לפי התיקונים שהיו בתוקף באותה עת. כל מי שעדיין מצטט אותם בלי תאריך עדכון מצטט נתון שאינו בתוקף, וזו הטעות הנפוצה ביותר בהשוואות שנכתבו החודש. ההשלכה המעשית היא שטענה כמו "Claude Opus 5 הוא המודל בעל הציון הגבוה ביותר הזמין" אינה נכונה עוד, והשוואה שנבנתה עליה מתמוטטת.

עבור צד Qwen ההשלכה חדה עוד יותר. דרגת דגל שהוכרזה בספטמבר 2026 מכוונת ליעד שהוגדר מחדש בספטמבר 2026. כל מה שאליבאבא תפרסם בסופו של דבר עבור Qwen 4 Max ייבחן מול לוח דירוג שבו 53 הוא המספר שצריך להכות, לא 63.

A two-column scoreboard titled "Qwen 4 Max vs Claude Opus 5 - the scoreboard". Left column Qwen 4 Max: Status announced, no date; Input price not published; Output price not published; Context window not published; Independent score none exists; Open weights not published. Right column Claude Opus 5: Status generally available; Input price $5.00 per 1M tokens; Output price $25.00 per 1M tokens; Context window 1M tokens; Independent score 51 on index v4.3.2; Open weights none. Footer reads "Claude Opus 5 from Anthropic published pricing and Artificial Analysis index v4.3.2, September 19 2026.", with the OrcaRouter logo bottom-right.

ההשוואה, כפי שנאמרה בכנות

צד אחד של הטבלה הזו שלם והצד האחר ריק, ולהעמיד פנים אחרת יהיה כל אופן הכשל של המאמר הזה. הנה מה שידוע בפועל:

• סטטוס — Claude Opus 5 זמין באופן כללי מאז 24 ביולי 2026, לעומת Qwen 4 Max שהוכרז ב-22 בספטמבר 2026 ללא תאריך שחרור

• מחיר קלט — Claude Opus 5 $5.00 ל-1M טוקנים, לעומת Qwen 4 Max שלא פורסם

• מחיר פלט — Claude Opus 5 $25.00 לכל מיליון טוקנים, לעומת Qwen 4 Max, שלא פורסם

• קלט במטמון — Claude Opus 5 $0.50 לכל מיליון טוקנים בקריאת מטמון, לעומת Qwen 4 Max שלא פורסם

• הקשר — Claude Opus 5 עם 1M טוקנים כברירת המחדל ובמקסימום, לעומת Qwen 4 Max שלא פורסם

• תקרת פלט — Claude Opus 5 128K טוקנים באופן סינכרוני ו-300K ב-Batches API עם כותרת בטא, לעומת Qwen 4 Max שלא פורסם

• מודאליות — Claude Opus 5 קלט טקסט, תמונה וקובץ עם פלט טקסט, לעומת Qwen 4 Max שלא פורסמה

• תמחור הקשר ארוך — ל-Claude Opus 5 אין תוספת תשלום, כך שבקשה של 900,000 טוקנים מחויבת באותו תעריף לכל טוקן כמו בקשה של 9,000 טוקנים, לעומת Qwen 4 Max שלא פורסם

• ציון בלתי־תלוי — Claude Opus 5‏ 51 במדד Artificial Analysis Intelligence Index v4.3.2 במאמץ מרבי, לעומת Qwen 4 Max שלא קיימת עבורו הערכה בלתי־תלויה

• ציונים שדווחו על ידי הספק — Claude Opus 5 SWE-bench Verified 96.0%, SWE-bench Pro 79.2%, OSWorld 2.0 70.6%, Terminal-Bench 2.1 באמצע שנות ה-80, תלוי בהרנס, לעומת Qwen 4 Max שעבורו לא דווח דבר

• שליטה בהיסק — Claude Opus 5 עם חשיבה אדפטיבית פעילה כברירת מחדל ועם סולם מאמץ בן חמישה שלבים, לעומת Qwen 4 Max שלא פורסם

עשר שורות של "לא פורסם" אינן אמצעי רטורי. זהו מצב הראיות, והמסקנה הכנה מכך היא שאיש עדיין לא יכול לערוך השוואת יכולות בין שני המודלים האלה.

החלק בפער שלא ייסגר

התמחור וההקשר יפורסמו בסופו של דבר. הבדל אחד ישרוד את ההשקה, וכדאי להחליט לגביו כבר עכשיו ולא בשבוע שבו Qwen 4 Max יוצא לשוק: שני המודלים נבנו כך שיירכשו בדרכים שונות.

Claude Opus 5 הוא מודל סגור יחיד במחיר יחיד מספק יחיד, עם התחייבות פרישה מפורסמת שלא לפני 24 ביולי 2027. זהו יעד יציב לתכנון קיבולת. Qwen 4 Max הוא ספינת הדגל של משפחה שאליבאבא שחררה שוב ושוב על פני טווח מחירים רחב בהרבה — דור Qwen 3.8 משתרע מדגל חזית במחיר קלט של 2.00 דולר ומדרגת Flash נמוכה בהרבה ממנו — ודרגת הדגל של קו Qwen הייתה היסטורית זו עם תוחלת החיים השימושית הקצרה ביותר לפני שדרגה זולה יותר סוגרת עליה את הפער.

ההבדל האחר הוא משקלים פתוחים, והוא מצביע בכיוון ההפוך. דור Qwen 3.8 פרסם משקלים עבור המודל הגדול ביותר שלו תחת רישיון Qwen מותאם אישית, וזה מה שמאפשר בכלל כיוונון עדין, קוונטיזציה ואירוח עצמי. ל-Claude Opus 5 אין שחרור משקלים וגם לא יהיה לו אחד. אם עומס העבודה שלכם דורש מודל שתוכלו להריץ בתוך ההיקף שלכם, או לשנות אותו, זהו יתרון מבני ששום עדכון בנצ'מרק לא יכול לקחת מ-Alibaba — וזו הסיבה החזקה ביותר להתעניין בהשוואה הספציפית הזו במקום לראות בה דגם דגל אחד מול דגם דגל אחר.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, English UI), showing the 1M token context badge, the model ID anthropic/claude-opus-5, a 128K maximum output, text plus image plus file input with text output, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24 credited to Anthropic, a p50 time-to-first-token of 5.75s, the OpenAI-compatible code sample, the Public benchmarks block, and the opening of the model description calling Claude Opus 5 Anthropic flagship for demanding reasoning, coding and long-horizon agentic work.

איך להריץ את ההשוואה הזאת היום

Claude Opus 5 זמין כעת, וOrcaRouter מנתב אותו בתור anthropic/claude-opus-5 במחיר המחירון של Anthropic עם 0% תוספת מחיר — התעריף של הספק מועבר ללא שינוי, כך שהמספרים $5.00 ו-$25.00 שלמעלה הם מה שמחויב לך ולא סכום מקביל עם תוספת. זה חשוב יותר מהרגיל עבור מודל בטווח מחירים זה: שולי פלטפורמה של 10 אחוזים על תעריף פלט של $25.00 הם $2.50 למיליון טוקנים, שזה יותר מכל עלות הקלט של רוב החלופות עם משקלים פתוחים. לצידו, הקטלוג כולל קרוב ל-200 מודלים בנקודת קצה אחת תואמת OpenAI, עם מעבר אוטומטי כאשר מסלול של ספק מתדרדר ו-DSL לניתוב להבעת המדיניות באופן מפורש במקום לקודד שם מודל ישירות באפליקציה.

מה ש-OrcaRouter לא מציע הוא Qwen 4 Max, או כל דרגה של Qwen 4. בקטלוג אין ולו ערך אחד עבור המשפחה, וזה בדיוק מה שהייתם מצפים לו ממודל שהוכרז ולא שוחרר. כאשר הדרגות כן ישוחררו הן יופיעו באותו מקום, ועד אז מודל Qwen ששווה להשוות מול Claude Opus 5 הוא זה שאפשר למעשה לקרוא לו: Qwen3.8-Max, זמין באופן כללי מאז 3 באוגוסט 2026 במחיר של 2.00 דולר לקלט ו-6.00 דולר לפלט למיליון טוקנים, עם משקלים מפורסמים וציון אינטליגנציה עצמאי מתועד של 56 בעלות של 1.14 דולר למשימה — נתון שנצבר תחת גרסה קודמת של המדד, כך שיש להשוות אותו ל-51 של Claude Opus 5 רק עם הסתייגות זו.

מה לעשות עם זה לפני שכרטיס מודל קיים

אין כאן הכרעה לתת, מפני שאחד משני המודלים אינו קיים כמוצר. מה שכן ניתן לומר הוא שההשוואה שינתה צורה ב-19 בספטמבר 2026 בלי שאף אחד מהספקים עשה דבר: Claude Opus 5 אינו עוד המודל בעל הניקוד הגבוה ביותר במדד העצמאי שרוב ההשוואות נשענות עליו, והוא נמצא כעת שתי נקודות מאחורי שני מודלים אחרים. השקה של Qwen 4 Max תיכנס לאותה טבלה, לא לזו מיולי.

אז ההחלטה לחודשים הקרובים אינה Qwen 4 Max מול Claude Opus 5. היא Claude Opus 5 מול מודל Qwen שכבר שוחרר — דגם מוביל במחיר של חמישית ממחיר הקלט, עם משקולות מפורסמות — וההשוואה הזו זמינה כעת, עם מספרים אמיתיים משני הצדדים. חזרו אליה כאשר Alibaba תפרסם כרטיס מודל, והתייחסו לכל טבלת בנצ'מרק של Qwen 4 Max שתראו לפני כן כבלתי מאומתת.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, the OpenAI-compatible Python code sample, and the model description naming Qwen3.8-Max Alibaba newest flagship and highest-capability tier to date.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית