
Solar Pro 4 לעומת Qwen 3.8 Max: סוכן ב-$0.03 מול ההימור הפתוח של עליבאבא על 2.4T
- metaחדשMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekחדשDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxחדשMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים · 2147 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0957אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0961אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0856אינטליגנציה72כתיבת קוד
- tencentTencent: Hy32026-07-0642אינטליגנציה59כתיבת קוד
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232אינטליגנציה42כתיבת קוד
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226אינטליגנציה39כתיבת קוד
- anthropicAnthropic: Claude Sonnet 52026-06-3055אינטליגנציה72כתיבת קוד
- klingKling: Kling 3.0 Turbo2026-06-1757אינטליגנציה52כתיבת קוד57מתמטיקה
בשבוע של 3 באוגוסט 2026, Alibaba השיקהQwen 3.8 Max, דגם MoE דליל עם 2.4 טריליון פרמטרים, שמדורג #2 בעולם בלוח המובילים של Arena ו-#12 במדד הקידוד של Artificial Analysis, במחיר של $2.00 למיליון טוקני קלט ו-$6.00 למיליון טוקני פלט. שבעה ימים לאחר מכן, Upstage השיקהSolar Pro 4, דגם דגל סוכן במשקל סגור (closed-weight) במחיר של $0.03 ו-$0.12. שניהם משווקים כמודלים "סוכניים" (agentic) הבנויים לעבודה ארוכה ורב-שלבית. אחד הוא הדגם החזק ביותר במשקל פתוח של הקיץ הסיני, והשני הוא התווית המסחרית הזולה ביותר של "מודל סוכן" ב-2026. הם לא באמת מתחרים על יכולות — הם מתחרים על מה שמפתח רשאי להניח לגבי מודל לפני שהטוקן הראשון מושקע.
שתי השקות, שתי הנחות
Qwen 3.8 Max יצא מהמעבדות של עליבאבא ב-3 באוגוסט עם כל הסממנים של השקה חלוצית: 2.4 טריליון פרמטרים בסך הכול (כ-95 מיליארד פעילים לכל טוקן), הקשר של מיליון טוקנים, קלט טקסט-תמונה-וידאו מקורי, דירוג Arena במקום השני, ומדד Artificial Analysis Intelligence Index מאומת של 58. על פי ראיות בלתי תלויות, הוא נמצא בשכבה העליונה העולמית של מודלים עם משקלים פתוחים. עליבאבא הצהירה שהמשקלים ישוחררו, בהתאם לדפוס של Qwen, מה שיהפוך אותו ל-Qwen הראשון ממחלקת Max בקוד פתוח. שום דבר מזה לא זול במובן החלוצי — $2/$6 — אבל הוא זול יחסית למודלים החלוציים הקנייניים.
Solar Pro 4 הגיע ב-10 באוגוסט עם סט הנחות שונה. חומרי ההשקה של Upstage מתארים שיפורים בנימוק למסמכים ארוכים, שימוש בכלים רב-שלביים וביצועי משימות מסוף לעומת Solar Pro 3, ללא גילוי מספר הפרמטרים וללא מדד בלתי תלוי. מבדל היחיד כולו הוא המחיר: $0.03/$0.12 הוא בערך פי 66 זול יותר בקלט ופי 50 זול יותר בפלט מאשר Qwen 3.8 Max. בעוד ש-Qwen 3.8 Max מבקש ממך להאמין במודל של 2.4T עם ציונים שעברו ביקורת, Solar Pro 4 מבקש ממך להאמין במחיר.

לוח התוצאות, בקריאה כנה
• מדד האינטליגנציה — Qwen 3.8 Max: 58 (AA, מבוקר); Solar Pro 4: לא פורסם דבר
• מדד קידוד — Qwen 3.8 Max: 71.8 (#12 מתוך 126, AA); Solar Pro 4: עדיין לא נמדד
הקשר — Qwen 3.8 Max: 1M טוקנים; Solar Pro 4: 524K
• מצבי קלט — Qwen 3.8 Max: טקסט, תמונה, וידאו; Solar Pro 4: ממוקד טקסט
• משקלים — Qwen 3.8 Max: שחרור פתוח הובטח; Solar Pro 4: סגור
• מחיר — Qwen 3.8 Max: $2.00/$6.00 למיליון; Solar Pro 4: $0.03/$0.12 למיליון

הפער בולט, וזו אינה אשמתה של Solar Pro 4. Qwen 3.8 Max ניתן למדידה מאז 3 באוגוסט; Solar Pro 4 ניתנת למדידה מאז 10 באוגוסט. מודל שלא נמדד אינו מודל רע — הוא מודל שלא נמדד. אבל ההשוואה הספציפית הזו, כרגע, היא "ראיות מבוקרות" מול "טענת מחיר השקה," והדרך הכנה לקרוא כל השוואה ישירה היא לומר זאת בדיוק.
מה בעצם קונה הפער של פי 100
המספר המעניין כאן אינו המחיר לטוקן; הוא מה שהמחיר לטוקן פותח מבחינה ארכיטקטונית. בתעריפים של Solar Pro 4, השארת מערך מסמכים מלא של 500K טוקנים בקונטקסט לכל פנייה בלולאת סוכן מפסיקה להיות החלטה עלות. הרצת אותה פרומפט עם שלוש טמפרטורות שונות ושמירה על הטוב ביותר — טריק קלאסי של מודלים זולים — הופכת לחינמית. זוהי עמדת פיתוח שונה באמת: אתה מתכנן כאילו מחשוב הוא כמעט חינם, כמו שנהגו צוותים עם המודלים הזולים הראשונים מסוג GPT-3.5.
המחיר הוא שאתה מהמר על עומס עבודה בייצור על טענת איכות לא מאומתת. מדד האינטליגנציה 58 של Qwen 3.8 Max והדירוג #2 Arena אינם הסיפור המלא — ערכת המדדים של Alibaba עצמה כוללת מספרים פנימיים שצריך לקרוא עם אותה תווית של דיווח ספק — אבל הם משהו. ל-Solar Pro 4 אין עדיין שום דבר כזה. אם האיכות שלו קרובה לזו של Qwen, זו העסקה הטובה ביותר על הלוח. אם לא, המחיר של $0.03 יראה בדיוק למה הוא עולה $0.03.

הפיצול בעל המשקולות הפתוחות
זו הנקודה שבה שני הדגמים מתפצלים מבחינה מבנית, וזה הדבר שיכריע את הקרב הזה בעוד שישה חודשים. השחרור הפתוח של Qwen 3.8 Max, כשהוא יגיע, הופך אותו לנכס שניתן לפריסה: לארח אותו בעצמך, לכוונן אותו, לשרת אותו בעלות שולית, ולשמור את הנתונים שלך על חומרה משלך. Solar Pro 4 לעולם לא יהיה כזה — סגור הוא סגור. עבור ארגון עם דרישות שהות נתונים או עקומת עלות ארוכת טווח, "Qwen 3.8 Max יכול בסופו של דבר לחיות באשכול משלך" הוא אופציה אסטרטגית ששום מחיר לפי אסימון לא יכול להשתוות אליה.
עבור הצוות שפשוט רוצה לקרוא למודל היום, השאלה הפתוחה היא אקדמית. שניהם מאחורי ממשקי API תואמי OpenAI, ושניהם זמינים דרך ה-API של הספק עצמו וכמה פלטפורמות צד שלישי. התשובה של הניתוב — API אחד על פני יותר מ-200 מודלים, מחיר המחירון של הספק מועבר במרווח אפס, מעבר אוטומטי למקרה תקלה — מאפשרת לך להתייחס לזה כאל גרף עלויות במקום החלטת נאמנות: תעבורה סיטונאית זולה למודל ב-$0.03, חשיבה בסיכון גבוה ל-Qwen 3.8 Max, ו-DSL הניתוב כדי לומר איזה עומס עבודה הולך לאן.
השורה התחתונה
Qwen 3.8 Max הוא הדגם הטוב יותר, הדגם שמגובה בראיות רבות יותר, והדגם עם עתיד שאתה יכול להחזיק בו. Solar Pro 4 הוא המחיר הטוב יותר בשני סדרי גודל, עם הכוכבית הכנה שטענות האיכות שלו לא שוכפלו באופן בלתי תלוי נכון לשבוע זה. אם עומס העבודה שלך דורש ביצועי קצה מבוקרים, שלם עבור Qwen 3.8 Max. אם עומס העבודה שלך מוגבל נפח וסובלני לכשלים, הסוכן ב-$0.03 הוא ההימור הרציונלי — בדוק אותו שוב כשהנתונים העצמאיים הראשונים של Solar Pro 4 ינחתו, וזה גם הרגע שבו ההשוואה הזו מפסיקה להיות השוואה בין תפוחים לתפוזים והופכת לבחירה אמיתית.
