
Solar Mini 4 מול Qwen3.8-Max: מה עולות בפועל עשרים נקודות האינדקס האחרונות
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 לכל 1M טוקנים
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 לכל 1M טוקנים · 159 tok/s
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 220 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Solar Mini 4 עולה $0.10 למיליון טוקני קלט ו-$0.40 למיליון טוקני פלט. Qwen3.8-Max, המודל שרוב האנשים מתכוונים אליו כשהם מקלידים "Qwen 3.8" ומבקשים את ה-API, עולה $2.00 ו-$6.00. במחירון זה נקרא כפער של פי עשרים במחיר הקלט. בהערכה הבלתי תלויה ששני המודלים עברו עד כה, הנתון הכנה הוא ש-Qwen3.8-Max מקבל ציון 45.4 במדד Artificial Analysis Intelligence Index לעומת 24.1 של Solar Mini 4 — בערך פי שניים מהיכולת הנמדדת — בעוד שהוא עולה בערך פי חמישה עשר לכל משימה שהושלמה. כל מה שכדאי לדעת על הצימוד הזה נמצא בפער בין שני היחסים האלה, ובכך שהמודל של Upstage פועל במהירות 204 טוקנים לשנייה בעוד שדגם הדגל של Alibaba פועל במהירות 39.
הערת שמות אחת לפני המספרים, כי היא משנה את מה שאתם קונים. Qwen 3.8 הוא דור, לא מודל: דגם הדגל המתארח הוא Qwen3.8-Max, שרוענן כסנאפשוט מתוארך 0902, והחבר להורדה באותו דור הוא Qwen3.8-2.4T-A95B, המשקולות בעלות 2.4 טריליון הפרמטרים שאליבאבא פרסמה ב-12 באוגוסט 2026. Solar Mini 4, שיצא ב-22 בספטמבר 2026, הוא תערובת מומחים דלילה של Upstage עם 35 מיליארד פרמטרים, שכשלושה מיליארד פרמטרים ממנה פעילים לכל טוקן, וללא משקולות פתוחות בשום מחיר.
שתי העמודות, על הממדים שקובעים את הרכש
• Intelligence Index 45.4 עבור Qwen3.8-Max (0902) לעומת 24.1 עבור Solar Mini 4, שניהם לפי Intelligence Index v4.3.2.
• עלות לכל משימה שהושלמה — 5.41 דולר עבור Qwen3.8-Max לעומת 0.36 דולר עבור Solar Mini 4. בערך פי חמישה עשר, והיחס שאיש לא מצטט.
• כרטיס תעריפים — $2.00 / $6.00 למיליון טוקנים, קלט במטמון $0.25, עבור Qwen3.8-Max לעומת $0.10 / $0.40, קלט במטמון $0.01, עבור Solar Mini 4.
• הקשר — 1,000,000 טוקנים בשניהם, וזה הממד היחיד שבו המודל הזול אינו מפסיד דבר. Artificial Analysis מציין 983,616 עבור Qwen3.8-Max ו-1,048,576 עבור Solar Mini 4; התיעוד של Upstage עצמה אומר 512K, כך שהתקרה של המודל הקטן היא הפחות בטוחה מבין השתיים.
• משקולות — Qwen3.8-Max הוא קנייני ומתארח; אחיו הפתוח Qwen3.8-2.4T-A95B ניתן להורדה תחת רישיון מותאם אישית ומקבל ציון 39.9 באותו מדד עם 262,000 טוקנים של הקשר. Solar Mini 4 הוא קנייני ללא אח פתוח.
• תפוקה — 204 טוקני פלט לשנייה עבור Solar Mini 4 לעומת 39.5 עבור Qwen3.8-Max, כפי שנמדד באותה מעבדה. המודל שמחירו לכל משימה נמוך פי 15 הוא מהיר פי חמישה בביצועה.
מה קונים בעשרים ואחת נקודות מדד

הם קונים את הקצה הקשה של ההתפלגות. במבחן Humanity's Last Exam, Qwen3.8-Max עונה נכון על 43.1% מהפריטים, לעומת 25.8% של Solar Mini 4. בקידוד מדעי זה 52.1% לעומת 47.6%. בעבודת ידע סוכנית הפער מתרחב לקטגוריה אחרת: Qwen3.8-Max מגיע ל-1663 Elo ב-GDPval-AA, בעוד Solar Mini 4 מסתפק ב-1072 — כמעט שש מאות נקודות Elo, וזה אינו הבדל של עיגול אלא שינוי במה שאפשר לסמוך על המודל שיעשה ללא השגחה.
ההערכה היחידה שבה המודל הקטן לא רק מחזיק מעמד אלא אף מנצח היא הסקה בהקשר ארוך. Solar Mini 4 משיג 83.3% ב-AA-LCR v1.1 ו-Qwen3.8-Max משיג 80.3%. זהו הטיעון החזק ביותר לטובת Solar Mini 4 בכל ההשוואה הזאת: במבחן שנבנה כדי לבחון "לקרוא מסמך ארוך מאוד ולהסיק מסקנות מתוכו", מחיר גבוה פי חמישה עשר למשימה קונה תוצאה גרועה יותר בשלוש נקודות.
התחום שבו אף אחד מהמודלים אינו הכלי המתאים הוא עבודת טרמינל אוטונומית. Solar Mini 4 משיג 1% ב-Terminal-Bench 4.0; Qwen3.8-Max משיג 38.9%. מודל שמשלים שמונה מתוך עשרים משימות טרמינל קשות הוא באמת שמיש שם, והשני אינו, וזו הדוגמה הברורה ביותר בהשוואה הזאת לפער בסוג ולא במידה.
מדוע החשבון לכל משימה של דגם הדגל גרוע כל כך הרבה יותר ממה שמחיר הטוקנים שלו מרמז
Qwen3.8-Max מפיק יותר פלט לכל משימה מאשר Solar Mini 4 — 107,700 טוקנים לעומת 88,300 — והוא מפיק אותם במחיר של $6.00 למיליון ולא $0.40. זה רוב הפער ממש שם, לפני שמתחשבים בהתנהגות המטמון. Alibaba כן מציעה תעריף של $0.25 לקלט במטמון, וזו הנחה אמיתית לעומת מחיר הקלט שלה של $2.00, וה"אח" הפתוח במשפחה, Qwen3.8-2.4T-A95B, הוא מודל דליל עם 2.4 טריליון פרמטרים, שכ-95 מיליארד מהם פעילים, כך שכל טוקן שהוא מייצר מיוצר על ידי מכונה גדולה בהרבה. אין בכך שום ביקורת. זו הסיבה לכך שקיים מכפיל של פי חמישה עשר לכל משימה, והסיבה לכך שהשוואת מחירים לפי טוקן בין שני המודלים האלה מטעה בשני הכיוונים.
התוצאה המעשית: Solar Mini 4 אינו "ה-Qwen 3.8 החסכוני". הוא מומחה שבמקרה גם זול, מהיר וחזק בדיוק בציר אחד — מסמכים ארוכים — וחלש בציר שהטעות בו יקרה ביותר, והוא אמינות סוכנית. Qwen3.8-Min? לא, זה אומר "Qwen3.8-Min"? המכליל שיתרונו מתגלה בדיוק במקום שבו תשובה שגויה יקרה.
להריץ את הצמד במקום לבחור ביניהם
זהו המקרה יוצא הדופן בסדרת Solar Mini 4 שבו שני צדי ההשוואה הם מסלולים שאנחנו באמת יכולים למכור לך. Qwen3.8-Max ותמונת המצב שלו מתאריך 0902 נמצאים ב-OrcaRouter במחירון של הספק עצמו, $2.00 / $6.00, לצד Qwen3.8-Flash במחיר $0.15 / $0.47 ו-Qwen3.8-27B במחיר $0.33 / $2.40 — שלוש דרגות של אותו דור, מפתח אחד, בלי חוזה שני ובלי שינוי קוד מעבר למחרוזת מודל. נכון ל-1 באוקטובר 2026, המדידה שלנו בסביבת הניסויים מציבה את Qwen3.8-Max ב-p50 של 2.5 שניות עם 87.7 אסימוני פלט לשנייה בשבעת הימים האחרונים; החלון הזה מתגלגל, אז קראו את כרטיס המודל החי ולא את המשפט הזה. המודלים של Upstage אינם זמינים דרכנו, ו-Solar Mini 4 צריך להיות נגיש דרך ה-API של Upstage עצמו.

מה שזה מאפשר הוא הפיצול שעבורו טוענת ההשוואה הזו: לשלוח את תעבורת המסמכים הארוכים, השפה הקוריאנית וחילוץ הנתונים המובנה למקום זול, לנתב את הבקשות עתירות החשיבה והשימוש בכלים לדגם הדגל, ולתת למעבר הגיבוי לכסות את הספק שחווה אחר צהריים רע. זה גם המקום שבו ה-DSL לניתוב מצדיק את מקומו — הרכבה של מודלים לקריאה אחת משמעותה שמעבר ראשוני זול ומעבר אימות יקר יכולים להיות בקשה אחת מול נקודת קצה אחת במקום שתי אינטגרציות שיש לסנכרן ביניהן.
הגרסה הקצרה

אם עומס העבודה שלך הוא הקשר ארוך, צורת פלט קבועה ותקציב השהיה סביר, Solar Mini 4 נותן לך 83% מתוצאת ההקשר הארוך בעלות של חלק חמישה עשר מעלות המשימה ובתפוקה של פי חמישה, ונקודות האינדקס החסרות – עשרים ואחת – לעולם לא יופיעו בלוח המחוונים שלך. אם עומס העבודה שלך כולל כלים, סוכנים מרובי-שלבים או שאלות שבהן תשובה שגויה ובטוחה בעצמה גרועה מאי-תשובה, הנקודות החסרות הן המוצר כולו ו-Qwen3.8-Max שווה פי חמישה עשר מהמחיר. כל נתון המיוחס ל-Artificial Analysis לעיל הוא מדידה עצמאית של אותו ארגון; השמות ותאריכי ההפצה של Qwen3.8 הם של Alibaba, ונתוני ההגשה של OrcaRouter הם מדידת סביבת הניסוי שלנו בחלון מתגלגל של שבעה ימים.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
