כרטיס כותרת הירו עבור "Qwen 4 Max vs DeepSeek V4 Pro" עם כותרת המשנה "95 מיליארד פרמטרים פעילים לעומת 49 מיליארד", שלושה תגים בצורת גלולה שעליהם "$2.00 ו-$6.00", "$0.66 ו-$1.98" ו-"1 מתוך 25 מול 1 מתוך 33", שורת פוטר עם "Alibaba הודיעה ב-22 בספטמבר 2026; DeepSeek נרשמה ב-24 באפריל 2026", והלוגו של OrcaRouter בפינה הימנית התחתונה.
Engineering & Research

Qwen 4 Max לעומת DeepSeek V4 Pro: 95 מיליארד פרמטרים פעילים לעומת 49 מיליארד

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ההכרזה על Qwen 4 Max בכנס Yunqi ב-22 בספטמבר 2026 נתנה לתעשייה שם ומבנה דירוגים ושום דבר אחר — ללא משקלות, ללא מחיר, ללא חלון הקשר, ללא תאריך. DeepSeek V4 Pro רשומה מאז 24 באפריל 2026 כתערובת מומחים בעלת 1.6 טריליון פרמטרים, עם 49 מיליארד פרמטרים פעילים לכל טוקן, הקשר של מיליון טוקנים, ומחיר מחוץ לשיא של $0.66 למיליון טוקני קלט ו-$1.98 למיליון טוקני פלט. המספר ששווה להעמיד זה לצד זה אינו סך כל הפרמטרים אלא מספר הפרמטרים הפעילים: Qwen3.8-Max האחרון שפורסם מפעיל 95 מיליארד פרמטרים לכל טוקן, בערך פי שניים מ-49 מיליארד הפרמטרים הפעילים ש-DeepSeek V4 Pro מריצה, והנתון האחד הזה מסביר את רוב הפער במחירים — פי שלושה — בין שתי המעבדות לפני שנבדק אפילו בנצ'מרק אחד.

שני הימורים שונים על דלילות

שתי המעבדות בונות מודלים של תערובת מומחים דלילה. הן חלוקות בדעתן, ובחריפות, בשאלה עד כמה דלילה. Qwen3.8-Max — ספינת הדגל של Qwen שנשלחת לשוק, והבסיס המוחשי היחיד לאיך ייראה Qwen 4 Max — הוא מודל בעל 2.4 טריליון פרמטרים שמפעיל 95 מיליארד פרמטרים לכל טוקן, יחס של בערך אחד לעשרים וחמישה. DeepSeek V4 Pro הוא מודל בעל 1.6 טריליון פרמטרים שמפעיל 49 מיליארד, יחס של בערך אחד לשלושים ושלושה, והוא מאחסן את משקולות המומחים שלו ב-FP4 בעוד ששכבות הקשב, הניתוב והנרמול נשארות ב-FP8, מה שדוחק שוב מטה את החישוב לכל טוקן.

אלה לא הבדלי כיוונון. אלה שתי תשובות שונות לאותה שאלה — כמה מודל חזית צריך להשקיע לכל טוקן:

• סך הפרמטרים — Qwen 3.8 דגם הדגל 2.4T לעומת DeepSeek V4 Pro 1.6T

• פעיל לכל טוקן — Qwen 3.8 דגם הדגל 95B לעומת DeepSeek V4 Pro 49B

• יחס הפעלה — בערך 1 מתוך 25 לעומת בערך 1 מתוך 33

• מחיר קלט, מחוץ לשעות שיא — Qwen3.8-Max $2.00 ל-1M לעומת DeepSeek V4 Pro $0.66 ל-1M

• מחיר פלט, בשעות שפל — Qwen3.8-Max $6.00 ל-1M לעומת DeepSeek V4 Pro $1.98 ל-1M

• משקלים מובילים — Qwen 3.8 המוביל תחת רישיון Qwen מותאם אישית לעומת DeepSeek V4 Pro שמפורסם תחת MIT

• הקשר — Qwen3.8-Max עם מיליון טוקנים לעומת DeepSeek V4 Pro עם מיליון טוקנים

• מודאליות — קלט טקסט, תמונה ווידאו ב-Qwen3.8-Max לעומת DeepSeek V4 Pro שתומך בטקסט בלבד ברשומה שלו

• השהיה נצפית — Qwen3.8-Max p50 זמן עד לאסימון הראשון 3.29s לעומת DeepSeek V4 Pro 3.52s על אותו קטלוג

הפעם, הבדל הדלילות והבדל המחיר מצביעים לאותו כיוון, וזה לא הכיוון שספירת הפרמטרים הכוללת מרמזת עליו. Qwen מפעיל בערך פי שניים פרמטרים לכל טוקן לעומת DeepSeek וגובה בערך פי שלושה, והדלילות לבדה לא סוגרת את הפער הזה. מה שסוגר את השאר הוא המודאליות: דגם הדגל של Qwen כולל מקודדי ראייה וווידאו, משלמים עליהם בכל בקשה בין אם יש בה תמונה ובין אם לא, ולכן תעריף הקלט נמצא במקום שבו הוא נמצא. DeepSeek V4 Pro מקבל טקסט ומחזיר טקסט, והוא מתומחר כמו מודל שעושה רק את זה.

מסייג אחד צריך להופיע בעמודת DeepSeek לפני שהיא משמשת לכל דבר. DeepSeek מתמחרת לפי לוח זמנים של שעות עומס ושעות שפל: הנתונים $0.66 ו-$1.98 הם תעריפי שפל, ובחלונות העומס — 01:00 עד 04:00 ו-06:00 עד 10:00 UTC בימי חול, למעט חגים ציבוריים בסין — אותו מודל מחויב ב-$1.32 עבור קלט ו-$3.96 עבור פלט. כל השאר, כולל כל סופי השבוע והחגים, הוא שפל. התעריף שאתם משלמים הוא אפוא פונקציה של מתי התעבורה שלכם פועלת, ומודל עלויות שנבנה על נתון השפל בלבד יהיה שגוי עבור כל עומס עבודה שיש בו רכיב של בוקר בימי חול.

A two-column scoreboard titled "Qwen 4 Max vs DeepSeek V4 Pro - the scoreboard". Left column Qwen 4 Max: Total parameters 2.4T, Active per token 95B, Input price off-peak $2.00 per 1M tokens, Output price off-peak $6.00 per 1M tokens, Context window 1M tokens, Modality text, image, video in. Right column DeepSeek V4 Pro: Total parameters 1.6T, Active per token 49B, Input price off-peak $0.66 per 1M tokens, Output price off-peak $1.98 per 1M tokens, Context window 1M tokens, Modality text-only. Footer reading "DeepSeek V4 Pro figures from its catalogue listing; Qwen figures from the Qwen3.8-Max model card, September 22 2026.", with the OrcaRouter logo bottom-right.

העמודה של Qwen 4 Max ריקה, וזה לא מצב זמני

מפתה למלא את ההשוואה בהנחה ש-Qwen 4 Max ינחת קרוב למספרים של Qwen 3.8 ובמחיר נמוך מהם. התנגדו לכך. אליבאבא תיארה את הארכיטקטורה של Qwen 4 כדור חדש ואמרה שהיא באימון; הפריט היחיד שפורסם המתאר את הארכיטקטורה הזו הוא Qwen3.8-Flash-Next, שהופץ בקוד פתוח בסוף אוגוסט 2026 ומסומן בכרטיס המודל שלו כתצוגה מקדימה של עיצוב Qwen 4. זהו מודל ראשי בעל 125 מיליארד פרמטרים, עם 51 מיליארד פרמטרים של הטמעות N-gram שמפעילות כ-6 מיליארד בכל צעד, עם קשב דליל QSA, שאריות שעריות והקשר מקורי של 262,000 טוקנים שניתן להרחיבו לעבר מיליון.

אם התכנון הזה יתרחב לשכבת Max, הספירה הפעילה אמורה להישאר בעשרות מיליארדים במקום לטפס לעבר הסך הכולל של DeepSeek — שמירה על חישוב כמעט קבוע לכל צעד ככל שהפרמטרים הכוללים גדלים היא כל המטרה של QSA ושל הטמעות N-gram שנשלפות ולא מחושבות בצפיפות. זהו כיוון ולא מפרט, ואין להדפיס אותו ככזה.

מה שניתן לדעת כעת הוא האסימטריה התפעולית. מודל שקיים ניתן למדוד על עומס העבודה שלך; מודל שלא קיים לא ניתן למדוד על שום דבר. Qwen 4 Max יהיה נגיש, כשהוא יושק, דרך ה-API של הספק עצמו ומספר פלטפורמות של צד שלישי — אותו מסלול שכל דגם דגל של Alibaba נקט בו. הוא לא נמצא ב-OrcaRouter היום: בקטלוג יש אפס רשומות עבור משפחת Qwen 4. DeepSeek V4 Pro נמצא ב-OrcaRouter כעת, וכך גם תמונת מצב מתוארכת שלו.

שחזוריות היא הטיעון שאף אחד לא מעלה

DeepSeek משחררת תמונות מצב מתוארכות ומשאירה אותן ניתנות להפניה. הקטלוג מכיל גם את המזהה הצף DeepSeek V4 Pro וגם וריאנט מקובע 2026-08-13 — כאשר תאריך זה הוא הבנייה ש-DeepSeek עצמה הגדירה כמהדורת הזמינות הכללית. זה לא זוהר וזה חשוב יותר מאשר דלתא של בנצ'מרק לכל מי שמריץ מערך הערכה או צינור מבוקר תאימות: כאשר אתה מקבע את תמונת המצב, מערך הרגרסיה שלך מודד את הקוד שלך ולא את קצב השחרורים של הספק.

הדור של Qwen 3.8 עשה את אותו הדבר — יש תמונת מצב מתוארכת של Qwen3.8-Max באותו קטלוג לצד השם הצף — ואין סיבה לחשוב ש-Alibaba תפסיק. אבל זו תכונה של מודלים ששוחררו, וכדאי לומר בבירור שביום שבו יוכרז Qwen 4 Max, לא תהיה לו תמונת מצב לנעוץ, לא מזהה יציב לבדוק מולו, ולא דרך להריץ לפני ואחרי על הנתונים שלך. כל השוואה שתרצה לעשות, תעשה אותה מאוחר יותר.

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro, English UI), showing the FLAGSHIP badge, the 1M token context badge, the model ID deepseek/deepseek-v4-pro, a 384K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-04-24 credited to DeepSeek, a p50 time-to-first-token of 3.52s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description describing a 1.6T total / 49B active flagship MoE with 1M context and top-tier reasoning and agentic tool use.

הרצת את שניהם בלי להריץ שני סטאקים

OrcaRouter מנתב את DeepSeek V4 Pro בתור deepseek/deepseek-v4-pro במחיר של $0.66 לקלט ו-$1.98 לפלט למיליון טוקנים, שזהו מחיר המחירון של DeepSeek עצמה בשעות שפל, המועבר הלאה עם 0% תוספת. החלק האחרון שווה כאן יותר מאשר במקומות אחרים במקבץ הזה, כי $1.98 לפלט כבר קרוב לרצפה עבור מודל ברמת חזית: מרווח פלטפורמה של אפילו עשרה אחוזים יהיה חמישית מההפרש בין המודל הזה לחלופה ברמה בינונית, וב-0% תוספת התעריף שאתם רואים בעמוד הוא התעריף ש-DeepSeek מפרסמת — כולל הפיצול בין שעות שיא לשעות שפל, שמועבר לפי אותו לוח זמנים במקום להתמצע לתעריף אחיד.

אותה נקודת קצה נושאת את משפחת Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash ו-Qwen3.8-27B — לצד DeepSeek V4 Pro על API אחד תואם OpenAI עם כמעט 200 מודלים, עם מעבר אוטומטי לגיבוי כשנתיב של ספק מתדרדר, ו-DSL לניתוב שהופך את הבחירה למפורשת במקום לקבוע אותה בקוד קשיח. אם DeepSeek מוריד את התעריף, השינוי נוחת על המפתח שלך באותו יום, כי אין שכבת מרווח שהקיצוץ יכול להיתקע מאחוריה. כשעולה דרג של Qwen 4, אותו קטלוג הוא המקום שבו הוא יופיע.

איפה זה משאיר אותך

DeepSeek V4 Pro מנצח בהשוואה הזו בניצחון טכני, וכדאי להיות מדויקים לגבי הסיבה לכך במקום לייפות אותה. הוא זול יותר בשני הצירים בפקטור של בערך שלושה, הוא מפעיל פי חמישה יותר פרמטרים לכל טוקן, חלון ההקשר שלו תואם, ויש לו תמונת מצב מתוארכת שאפשר לקבע. ל-Qwen 4 Max יש שם של דרגה ומשבצת בכנס.

ההשוואה שמתקיימת בפועל היא בין DeepSeek V4 Pro ל-Qwen3.8-Max, וזו תחרות אמיתית ולא תבוסה מוחצת: DeepSeek הוא מודל טקסט בלבד בכשליש מהמחיר בערך, כשהמשקלים שלו מפורסמים תחת MIT ופרופיל ההפעלה שלו לכל טוקן רזה יותר, ומודל הדגל של Qwen קולט קלט תמונה וווידאו ב-$2.00 וב-$6.00. בחרו לפי מודאליות ולפי עלות מדודה לכל משימה שהושלמה, לא לפי מספרי פרמטרים, והריצו מחדש את ההשוואה כאשר Alibaba תפרסם כרטיס מודל — ואז השאלה המעניינת תהיה אם Qwen 4 Max מתמחר את היכולת הרב-מודאלית שלו מעל תעריף הטקסט של DeepSeek בפער קטן יותר ממה שהוא עושה היום.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

השוואות במאמר הזה4

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית