
Intern-S2-397B מול Qwen3.8-Max: שני דגמי דגל סיניים, הימורים כלכליים הפוכים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
Intern-S2-397B ו-Qwen3.8-Max הם שתי ההשקות הסיניות הדגליות המשמעותיות ביותר של תחילת ספטמבר 2026, והם עשו הימורים כלכליים מנוגדים. Intern-S2-397B, המודל המדעי הרב-מודלי בעל 403 מיליארד פרמטרים שצוות InternLM של מעבדת הבינה המלאכותית של שנגחאי שחרר תחת Apache-2.0 ב-13 בספטמבר, מהמר שמשקלים פתוחים הם הדרך לנצח עומסי עבודה מדעיים וסוכניים: ללא מחיר לפי טוקן, משקלים ב-Hugging Face, והחומרה שלך כמדד. Qwen3.8-Max, הדגל בעל 2.4 טריליון הפרמטרים של אליבאבא שיצא ל-GA ב-3 באוגוסט ורוענן ב-2 בספטמבר, מהמר על API בתמחור של $2.00 למיליון טוקני קלט ו-$6.00 למיליון טוקני פלט על פני חלון הקשר של 1M טוקנים, כשמשקלים פתוחים מגיעים שבוע לאחר GA וציון עצמאי של Artificial Analysis כבר על הלוח. ההתמודדות ביניהם היא פחות על מי מנצח במדדים ויותר על איזה הימור — בעלות או נקודת קצה מדודה — מתאים לצורת עומס העבודה שלך.
שני דגלים, שני הימורים
Qwen3.8-Max הוא הדרג בעל היכולות הגבוהות ביותר של Alibaba בקו Qwen, מודל תערובת מומחים דלילה (sparse mixture-of-experts) עם 2.4 טריליון פרמטרים בסך הכול וכ-95 מיליארד פעילים לכל טוקן על פני 512 מומחים, עם 10 פעילים ועוד מומחה משותף. יש לו חלון הקשר של 1M טוקנים (983,616 טוקנים כשמצב חשיבה מופעל ב-API המתארח), תקרת פלט של 131,072 טוקנים, קלט טקסט, תמונה ווידאו, והוא מוגש דרך אנדפוינט תואם OpenAI. מהלך התמחור המאפיין שלו הוא תעריף אחיד: אותו תעריף של $2.00 / $6.00 בין אם ההנחיה שלך היא 5,000 טוקנים או 900,000, כשקלט במטמון מתומחר נמוך יותר — בלי תוספת תשלום על הקשר ארוך, וזה בדיוק המנוף שרוב המתחרים עדיין גובים עליו. Alibaba מציבה אותו ישירות מול GPT-5.5, Claude Opus 4.7 ו-Gemini 3.1 Pro במדריך ההגירה שלה.
Intern-S2-397B הוא פלאגשיפ מסוג אחר. זהו מודל תערובת מומחים עם 60 שכבות ו-512 מומחים (10 פעילים לכל טוקן), חלון הקשר של 256K להסקה טקסטואלית ו-64K למולטימודאל, משטח קלט של טקסט, תמונה וסדרות עתיות, ופרדיגמת אימון מקדים שקוראת דפים גולמיים של ספרות מדעית — איורים, פריסה, סימון סמלי ופרוזה — במקום לפרסר טקסט תחילה. למידת החיזוק שלו משתרעת על פני יותר מעשרים תחומים מדעיים, והוא אומן לעבודת סוכנים בטווח ארוך בסביבות סנדבוקס. התמחור שלו אינו כרטיס תעריפים אלא היעדרו של כזה: ארחו בעצמכם את המשקלים תחת Apache-2.0, או בקשו גישה ל-Intern API הרשמי.
• מחיר — Intern-S2-397B: אין כרטיס תעריפים; אירוח עצמי או Intern API לעומת Qwen3.8-Max: $2.00 / $6.00 למיליון בתעריף קבוע, קלט במטמון נמוך יותר.
• היקף — Intern-S2-397B: סה"כ 403B, 512 מומחים / 10 פעילים לעומת Qwen3.8-Max: סה"כ 2.4T, 95B פעילים, 512 מומחים / 10 + 1 משותף.
• הקשר — Intern-S2-397B: 256K טקסט / 64K מולטימודאלי לעומת Qwen3.8-Max: מיליון טוקנים, במחיר אחיד.
• קלטים — Intern-S2-397B: טקסט, תמונה, סדרות זמן לעומת Qwen3.8-Max: טקסט, תמונה, וידאו.
• משקולות — Intern-S2-397B: Apache-2.0, פתוח ביום ההשחרור לעומת Qwen3.8-Max: רישיון Qwen3.8-Max מותאם אישית, נפתח ב-12 באוגוסט לאחר GA.
• ציון עצמאי — Intern-S2-397B: אין עדיין לעומת Qwen3.8-Max: AA Intelligence Index 40, GPQA Diamond 92.7.
שתי הטבלאות הן טבלאות ספקים, ורק לאחת יש שופט.
שני המודלים הושקו עם טבלאות בנצ'מרק שהורצו על ידי הספק, מה שהופך את משמעת איסוף הנתונים לזהה ואת הרקורד לשונה. המספרים העצמאיים של Qwen3.8-Max הצטברו מאז: Artificial Analysis מציב אותו ב-40 ב-Intelligence Index הנוכחי שלו, עם GPQA Diamond של 92.7, HLE של 43.0 וציון קידוד עצמאי של 71.8, בעלות של כ-2.67 דולר למשימת מדד בסולם הנוכחי. אלה מספרים מדודים מגורם מעקב חיצוני — השופט האמיתי הראשון שהיה לאחד משני דגמי הדגל הללו.
הראיות של Intern-S2-397B הן הכרטיס של עצמו, שהורץ דרך OpenCompass, VLMEvalKit ו-AgentCompass, ופורסם לצד המשקלים: MMLU Pro 89.77, MMMU Pro 81.68, HMMT-2026 93.56, SWE-bench-Pro 68.54, ו-TerminalBench 2.1 עם 64.04, נתון שהכרטיס עצמו מציג כמפסיד לדור סגור ישן יותר. השורות המדעיות שלו הן הסיבה לכך שטיעון המומחה קיים: Biology-Instructions 55.71, SciReasoner 1.5 63.28, Mol-Instructions 53.95, MolecularIQ 62.35. כל אחד מאלה הוא של InternLM עצמה, ולא שוחזר. כשמציבים אותם זה לצד זה, שני בסיסי הראיות מספרים את אותו סיפור משני כיוונים מנוגדים: מודל אחד הוא מומחה עם שורות כלליות מכובדות ובלי מדידה חיצונית, והאחר הוא גנרליסט עם ציון עצמאי ובלי כיוונון מדעי.

מה שצורות הכסף בעצם קונות
התעריף האחיד של $2 / $6 הוא המהלך המזוהה של Qwen3.8-Max, וכדאי לפרט מה הוא נותן. סוכן לניתוח ריפו שמעביר 200,000 טוקנים של הקשר קוד בקריאה אחת משלם אותו תעריף לכל טוקן כמו בצ'אט קצר — ללא תוספת מחיר על פרומפט ארוך — ועם מטמון, הקשר קוד יציב מוריד את מחיר הקלט האפקטיבי באופן דרמטי בתעבורה חוזרת. המודל גם ניתן להפעלה כמשקולות פתוחות תחת רישיון מותאם אישית של Alibaba, המתיר שימוש מסחרי עם ייחוס בתוספת שערים מבוססי קנה מידה מעל 100 מיליון משתמשים פעילים חודשיים או 20 מיליון דולר הכנסה חודשית, והסכם נפרד לעסקים גדולים של מודל כשירות.
הכלכלה של Intern-S2-397B היא ההיפוך: אין מונה כלל, אלא הוצאת הון. המשקולות הן כ-807 GB ב-BF16 על פני 188 רסיסים — צומת רציני עם ריבוי GPU — כאשר גרסת FP8 מקטינה את התפוסה בכמחצית. אם הקיבולת הזו כבר בבעלותך, העלות השולית של השאילתה המדעית הבאה מתקרבת לעלות החשמל, וזה ההימור: הבעלות הופכת את המומחה לזול בשוליים. אם החומרה אינה בבעלותך, המודל ה"חינמי" הוא פיילוט, וה-API הרשמי של Intern הוא החלופה היחידה עם מונה.
שני דגמי הדגל יכולים לחלוק תפר אחד אם תנתב. Qwen3.8-Max נמצא ב-OrcaRouter במחיר המחירון של Alibaba, כשהוא מועבר הלאה בתוספת של 0%, ולכן התעריף האחיד של $2 / $6 וכל הורדת מחיר עתידית מגיעים לכאן באותו יום. Intern-S2-397B אינו מנותב — זהו צ'קפוינט חדש לגמרי, והדרך אליו היא ה-API של הספק עצמו או פריסה באירוח עצמי. שלח את התעבורה הכללית, בעלת יכולת הווידאו וההקשר הארוך, למודל הנמדד באמצעות המפתח שכבר יש לך; השאר את עבודת האצווה המדעית על המודל שאתה מפעיל; ותן למעבר האוטומטי לגיבוי לכסות אותך כשנקודת הקצה של אחד מהצדדים אינה תקינה. הגבול הוא כלל ניתוב ולא אינטגרציה שנייה.

פסק הדין
בחרו ב-Qwen3.8-Max עבור הסקה כללית ועבודות הפקה עם יכולות וידאו, שבהן תעריף אחיד על פני מיליון טוקנים מנצח כל מה שהמתחרים גובים, ושבהן לוח ניקוד עצמאי מפחית את הסיכון לבנות עליו. המשקולות שלו פתוחות מספיק כדי להיות משמעותיות תחת רישיון שרוב הצוותים כבר נמצאים בתחומו, ומד התעריף שלו של $2 / $6 הוא המחיר האגרסיבי ביותר על הלוח מבין ספינות הדגל בחזית.
בחרו ב-Intern-S2-397B לעומסי עבודה מדעיים — מאמרים עתירי תרשימים, דיאגרמות מולקולריות, אותות של סדרות זמן — שבהם הקלט הוא מולטימודלי באופן שמודל כללי מעולם לא כוונן עבורו, ושבהם שהות נתונים או כיוונון עדין על תוצאות קנייניות הופכים את Apache-2.0 לתכונה המכרעת. תקצבו עבור החומרה, הריצו הערכה משלכם, והתייחסו למספרים שלו כאל טענות עד שיופיע שופט בלתי תלוי.
סיכום כן הוא ששני מוצרי הדגל האלה אינם ממש תחליפים. האחד הוא מכשיר מדעי בבעלות עם יכולת כללית מכובדת; האחר הוא כללן שכור בעל דירוג בלתי תלוי, עם תעריף אחיד ועניין חולף במדע. צוותים שזקוקים לשניהם צריכים להתייחס לגבול כאל החלטת ניתוב — וצריכים להריץ מחדש את בדיקות ההערכה שלהם על Intern-S2-397B לפני שהם מאמינים למספר כלשהו בשקופית של מי מהספקים.

