כרטיס כותרת ראשי שנוצר עם הכיתוב 'Solar Mini 4 vs Qwen3.8-Max', כותרת משנה 'מה עלו בפועל עשרים נקודות המדד האחרונות' ושתי תגיות עם הכיתוב '24.1 מול 45.4 במדד' ו-'$0.36 מול $5.41 לכל משימה'.
Guides & Insights

Solar Mini 4 מול Qwen3.8-Max: מה עולות בפועל עשרים נקודות האינדקס האחרונות

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Solar Mini 4 עולה $0.10 למיליון טוקני קלט ו-$0.40 למיליון טוקני פלט. Qwen3.8-Max, המודל שרוב האנשים מתכוונים אליו כשהם מקלידים "Qwen 3.8" ומבקשים את ה-API, עולה $2.00 ו-$6.00. במחירון זה נקרא כפער של פי עשרים במחיר הקלט. בהערכה הבלתי תלויה ששני המודלים עברו עד כה, הנתון הכנה הוא ש-Qwen3.8-Max מקבל ציון 45.4 במדד Artificial Analysis Intelligence Index לעומת 24.1 של Solar Mini 4 — בערך פי שניים מהיכולת הנמדדת — בעוד שהוא עולה בערך פי חמישה עשר לכל משימה שהושלמה. כל מה שכדאי לדעת על הצימוד הזה נמצא בפער בין שני היחסים האלה, ובכך שהמודל של Upstage פועל במהירות 204 טוקנים לשנייה בעוד שדגם הדגל של Alibaba פועל במהירות 39.

הערת שמות אחת לפני המספרים, כי היא משנה את מה שאתם קונים. Qwen 3.8 הוא דור, לא מודל: דגם הדגל המתארח הוא Qwen3.8-Max, שרוענן כסנאפשוט מתוארך 0902, והחבר להורדה באותו דור הוא Qwen3.8-2.4T-A95B, המשקולות בעלות 2.4 טריליון הפרמטרים שאליבאבא פרסמה ב-12 באוגוסט 2026. Solar Mini 4, שיצא ב-22 בספטמבר 2026, הוא תערובת מומחים דלילה של Upstage עם 35 מיליארד פרמטרים, שכשלושה מיליארד פרמטרים ממנה פעילים לכל טוקן, וללא משקולות פתוחות בשום מחיר.

שתי העמודות, על הממדים שקובעים את הרכש

• Intelligence Index 45.4 עבור Qwen3.8-Max (0902) לעומת 24.1 עבור Solar Mini 4, שניהם לפי Intelligence Index v4.3.2.

• עלות לכל משימה שהושלמה — 5.41 דולר עבור Qwen3.8-Max לעומת 0.36 דולר עבור Solar Mini 4. בערך פי חמישה עשר, והיחס שאיש לא מצטט.

• כרטיס תעריפים — $2.00 / $6.00 למיליון טוקנים, קלט במטמון $0.25, עבור Qwen3.8-Max לעומת $0.10 / $0.40, קלט במטמון $0.01, עבור Solar Mini 4.

• הקשר — 1,000,000 טוקנים בשניהם, וזה הממד היחיד שבו המודל הזול אינו מפסיד דבר. Artificial Analysis מציין 983,616 עבור Qwen3.8-Max ו-1,048,576 עבור Solar Mini 4; התיעוד של Upstage עצמה אומר 512K, כך שהתקרה של המודל הקטן היא הפחות בטוחה מבין השתיים.

• משקולות — Qwen3.8-Max הוא קנייני ומתארח; אחיו הפתוח Qwen3.8-2.4T-A95B ניתן להורדה תחת רישיון מותאם אישית ומקבל ציון 39.9 באותו מדד עם 262,000 טוקנים של הקשר. Solar Mini 4 הוא קנייני ללא אח פתוח.

• תפוקה — 204 טוקני פלט לשנייה עבור Solar Mini 4 לעומת 39.5 עבור Qwen3.8-Max, כפי שנמדד באותה מעבדה. המודל שמחירו לכל משימה נמוך פי 15 הוא מהיר פי חמישה בביצועה.

מה קונים בעשרים ואחת נקודות מדד

A two-column comparison scoreboard titled 'Solar Mini 4 vs Qwen3.8-Max', subtitled 'Roughly twice the capability at about fifteen times the task cost'. Solar Mini 4: Intelligence Index 24.05; cost per index task $0.36; rate card per 1M $0.10 in / $0.40 out; cached input $0.01 per 1M; context 1.05M listed and 512K claimed; output speed 204 tokens per second; output per task 88,300 tokens; long-context reasoning 83.3% on AA-LCR v1.1. Qwen3.8-Max: Intelligence Index 45.42; cost per index task $5.41; rate card per 1M $2.00 in / $6.00 out; cached input $0.25 per 1M; context 983,616; output speed 39.5 tokens per second; output per task 107,700 tokens; long-context reasoning 80.3% on AA-LCR v1.1.

הם קונים את הקצה הקשה של ההתפלגות. במבחן Humanity's Last Exam, Qwen3.8-Max עונה נכון על 43.1% מהפריטים, לעומת 25.8% של Solar Mini 4. בקידוד מדעי זה 52.1% לעומת 47.6%. בעבודת ידע סוכנית הפער מתרחב לקטגוריה אחרת: Qwen3.8-Max מגיע ל-1663 Elo ב-GDPval-AA, בעוד Solar Mini 4 מסתפק ב-1072 — כמעט שש מאות נקודות Elo, וזה אינו הבדל של עיגול אלא שינוי במה שאפשר לסמוך על המודל שיעשה ללא השגחה.

ההערכה היחידה שבה המודל הקטן לא רק מחזיק מעמד אלא אף מנצח היא הסקה בהקשר ארוך. Solar Mini 4 משיג 83.3% ב-AA-LCR v1.1 ו-Qwen3.8-Max משיג 80.3%. זהו הטיעון החזק ביותר לטובת Solar Mini 4 בכל ההשוואה הזאת: במבחן שנבנה כדי לבחון "לקרוא מסמך ארוך מאוד ולהסיק מסקנות מתוכו", מחיר גבוה פי חמישה עשר למשימה קונה תוצאה גרועה יותר בשלוש נקודות.

התחום שבו אף אחד מהמודלים אינו הכלי המתאים הוא עבודת טרמינל אוטונומית. Solar Mini 4 משיג 1% ב-Terminal-Bench 4.0; Qwen3.8-Max משיג 38.9%. מודל שמשלים שמונה מתוך עשרים משימות טרמינל קשות הוא באמת שמיש שם, והשני אינו, וזו הדוגמה הברורה ביותר בהשוואה הזאת לפער בסוג ולא במידה.

מדוע החשבון לכל משימה של דגם הדגל גרוע כל כך הרבה יותר ממה שמחיר הטוקנים שלו מרמז

Qwen3.8-Max מפיק יותר פלט לכל משימה מאשר Solar Mini 4 — 107,700 טוקנים לעומת 88,300 — והוא מפיק אותם במחיר של $6.00 למיליון ולא $0.40. זה רוב הפער ממש שם, לפני שמתחשבים בהתנהגות המטמון. Alibaba כן מציעה תעריף של $0.25 לקלט במטמון, וזו הנחה אמיתית לעומת מחיר הקלט שלה של $2.00, וה"אח" הפתוח במשפחה, Qwen3.8-2.4T-A95B, הוא מודל דליל עם 2.4 טריליון פרמטרים, שכ-95 מיליארד מהם פעילים, כך שכל טוקן שהוא מייצר מיוצר על ידי מכונה גדולה בהרבה. אין בכך שום ביקורת. זו הסיבה לכך שקיים מכפיל של פי חמישה עשר לכל משימה, והסיבה לכך שהשוואת מחירים לפי טוקן בין שני המודלים האלה מטעה בשני הכיוונים.

התוצאה המעשית: Solar Mini 4 אינו "ה-Qwen 3.8 החסכוני". הוא מומחה שבמקרה גם זול, מהיר וחזק בדיוק בציר אחד — מסמכים ארוכים — וחלש בציר שהטעות בו יקרה ביותר, והוא אמינות סוכנית. Qwen3.8-Min? לא, זה אומר "Qwen3.8-Min"? המכליל שיתרונו מתגלה בדיוק במקום שבו תשובה שגויה יקרה.

להריץ את הצמד במקום לבחור ביניהם

זהו המקרה יוצא הדופן בסדרת Solar Mini 4 שבו שני צדי ההשוואה הם מסלולים שאנחנו באמת יכולים למכור לך. Qwen3.8-Max ותמונת המצב שלו מתאריך 0902 נמצאים ב-OrcaRouter במחירון של הספק עצמו, $2.00 / $6.00, לצד Qwen3.8-Flash במחיר $0.15 / $0.47 ו-Qwen3.8-27B במחיר $0.33 / $2.40 — שלוש דרגות של אותו דור, מפתח אחד, בלי חוזה שני ובלי שינוי קוד מעבר למחרוזת מודל. נכון ל-1 באוקטובר 2026, המדידה שלנו בסביבת הניסויים מציבה את Qwen3.8-Max ב-p50 של 2.5 שניות עם 87.7 אסימוני פלט לשנייה בשבעת הימים האחרונים; החלון הזה מתגלגל, אז קראו את כרטיס המודל החי ולא את המשפט הזה. המודלים של Upstage אינם זמינים דרכנו, ו-Solar Mini 4 צריך להיות נגיש דרך ה-API של Upstage עצמו.

A screenshot of the OrcaRouter model page for Qwen3.8-Max, showing the model id qwen/qwen3.8-max at $2.00 input and $6.00 output per million tokens, text, image and video input with text output, vision, tools, JSON and reasoning capability flags, a 2.5-second median time to first token from our own playground, and the description of Alibaba's newest flagship model in the Qwen line.

מה שזה מאפשר הוא הפיצול שעבורו טוענת ההשוואה הזו: לשלוח את תעבורת המסמכים הארוכים, השפה הקוריאנית וחילוץ הנתונים המובנה למקום זול, לנתב את הבקשות עתירות החשיבה והשימוש בכלים לדגם הדגל, ולתת למעבר הגיבוי לכסות את הספק שחווה אחר צהריים רע. זה גם המקום שבו ה-DSL לניתוב מצדיק את מקומו — הרכבה של מודלים לקריאה אחת משמעותה שמעבר ראשוני זול ומעבר אימות יקר יכולים להיות בקשה אחת מול נקודת קצה אחת במקום שתי אינטגרציות שיש לסנכרן ביניהן.

הגרסה הקצרה

A screenshot of the Artificial Analysis model page headed 'Qwen3.8 Max (0902) Intelligence, Performance & Price Analysis', marked as an Alibaba proprietary model released September 2026, ranked 32nd of 223 on intelligence, 172nd on speed and 101st on cost, with $2.00 input, $6.00 output and cached pricing rows, 39.5 output tokens per second, a $5.41 cost figure and a verbosity readout.

אם עומס העבודה שלך הוא הקשר ארוך, צורת פלט קבועה ותקציב השהיה סביר, Solar Mini 4 נותן לך 83% מתוצאת ההקשר הארוך בעלות של חלק חמישה עשר מעלות המשימה ובתפוקה של פי חמישה, ונקודות האינדקס החסרות – עשרים ואחת – לעולם לא יופיעו בלוח המחוונים שלך. אם עומס העבודה שלך כולל כלים, סוכנים מרובי-שלבים או שאלות שבהן תשובה שגויה ובטוחה בעצמה גרועה מאי-תשובה, הנקודות החסרות הן המוצר כולו ו-Qwen3.8-Max שווה פי חמישה עשר מהמחיר. כל נתון המיוחס ל-Artificial Analysis לעיל הוא מדידה עצמאית של אותו ארגון; השמות ותאריכי ההפצה של Qwen3.8 הם של Alibaba, ונתוני ההגשה של OrcaRouter הם מדידת סביבת הניסוי שלנו בחלון מתגלגל של שבעה ימים.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית