כרטיס הירו שנוצר המשווה בין Intern-S2 ל-Gemini 3.1 Pro, המציג בצד שמאל עמוד איור מדעי ותרשים המזינים מודל מולטימודאלי, וארבעה אייקוני קלט עבור תמונה, אודיו, וידאו וטקסט סביב כרטיס API סגור בצד ימין, עם תווית של הניגוד בין מולטימודאליות מדעית Apache-2.0 לבין פלאגשיפ מולטימודאלי כללי סגור עם הקשר של 1M, עם הלוגו של OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

Intern-S2 מול Gemini 3.1 Pro: ההתמודדות הרב-מודלית ש-InternLM באמת מדדה

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

רוב ההתמודדויות בסדרה הזו דורשות לחבר יחד טענות של שני ספקים. זו לא. Intern-S2, המודל המולטימודלי Apache-2.0 בעל 397 מיליארד פרמטרים ש-InternLM שחררה היום, ו-Gemini 3.1 Pro, מודל ההסקה המוביל של Google, מופיעים שניהם כעמודות מדודות באותה טבלת בנצ'מרק — מה שהופך את זה לראש בראש ההוגן ביותר בסט, ולא במקרה, לזה שבו למודל הפתוח יש הכי הרבה לתת עליו את הדין. Gemini 3.1 Pro קורא טקסט, תמונות, אודיו ווידאו, מחזיק הקשר של 1M טוקנים, ונקרע לגזרים על ידי מעבדות עצמאיות ותעבורת ייצור מאז שנכנס לתצוגה מקדימה ב-19 בפברואר 2026. Intern-S2 קורא טקסט, תמונות וסדרות זמן, הועלה ל-Hugging Face הבוקר, ואין לו ציון של צד שלישי מכל סוג שהוא. בשורות שבהן שניהם נמדדו, המודל של Google מנצח ביותר מהן מאשר לא.

שניהם קוראים תמונות. שם נגמר הדמיון.

המילה "מולטימודאלי" גורמת למודלים האלה להישמע כמו שווים. הם לא שווים, וההבדל הוא במה שכל אחד מהם נבנה להסתכל עליו.

מסלול הראייה של Intern-S2 אומן לצרוך עמודים גולמיים של ספרות מדעית — איורים, משוואות, דיאגרמות מבניות, פריסה — כייצוג משותף יחיד במקום לחלץ טקסט תחילה. המדדים המולטימודליים שלו הם מדעיים: VQA של מיקרוסקופיה ביולוגית, חישה מרחוק, מענה על שאלות בתרשימים מדעיים. הוא גם מקבל נתוני סדרות עתיות ויכול להפיק תחזיות, שזה סוג קלט שכמעט אף דגם דגל כללי לא מטפל בו כלל.

הרב-מודאליות של Gemini 3.1 Pro היא כלל-מטרית ורחבה יותר בסוגה: טקסט, תמונה, אודיו וווידאו, במודל אחד, המכוונת לכל טווח משימות הייצור שבהן מפנים מודל לקובץ ושואלים שאלה. הקלטת פגישה, צילום מסך של ממשק משתמש, תרשים ב-PDF, קטע וידאו — הכול קביל, וכולם עם שישה חודשים של הערכה ציבורית מאחוריהם.

אם הקלט שלך הוא איור מדעי, Intern-S2 נבנה במיוחד לשם כך, ויש לו את הנתונים מהספק כדי להציג את טענתו. אם הקלט שלך הוא כל דבר אחר, Gemini 3.1 Pro תומך באודיו ובווידאו, ו-Intern-S2 לא תומך באף אחד מהם. זה פותר חלק ניכר מהשאלות "במה עליי להשתמש" לפני שמחיר או מבחני ביצועים נכנסים לתמונה, וכל מי שאומר לך שהשניים ניתנים להחלפה לא קרא את רשימת הקלט.

מה שהטבלה המשותפת מציגה, קראו ביושר

מכיוון ש-InternLM בחנה את שניהם, זהו אחד המקומות הבודדים שבהם השוואה ישירה היא לגיטימית ולא מלוקטת. ההסתייגות לא משתנה וכדאי לציין אותה פעם אחת: כל נתון של Intern-S2 הוא דיווח של הספק, שהורץ על ידי InternLM בהרנס שלה באמצעות OpenCompass, VLMEvalKit ו-AgentCompass, בלי שחזור עצמאי. הנתונים של Gemin​i​ בטבלה ההיא גם הם מההרצה של InternLM של ההשוואה, אם כי ל-Gemin​i​ יש רקורד עצמאי נרחב מחוצה לה.

• ידע מולטימודלי — Gemini 3.1 Pro 83.99 ב-MMMU Pro לעומת Intern-S2 81.68.

• שאלות ותשובות על תרשימים מדעיים — Gemini 3.1 Pro 71.18 ב-ChartQAPro לעומת Intern-S2 71.12. תיקו מוחלט עד שתי ספרות עשרוניות.

• חישה מרחוק — Gemini 3.1 Pro 54.27 ב-XLRS-Bench לעומת Intern-S2 51.38.

• מיקרוסקופיה VQA — Gemini 3.1 Pro 71.02 על MicroVQA לעומת Intern-S2 69.67.

• משימות מולטימודליות מדעיות — Intern-S2 60.74 ב-SFE לעומת Gemini 3.1 Pro 59.57. הניצחון המולטימודלי היחיד של Intern-S2.

• ידע כללי — Gemini 3.1 Pro 91.00 ב-MMLU Pro לעומת Intern-S2 89.77.

• מתמטיקה ברמת תיכון — Gemini 3.1 Pro 94.70 ב-HMMT-2026 לעומת Intern-S2 93.56.

• הסקה בספרות מדעית — Intern-S2 55.71 ב-Biology-Instructions לעומת Gemini 3.1 Pro 13.87, ו-53.95 לעומת 38.84 ב-Mol-Instructions.

• בעיות אולימפיאדת מדעים — Intern-S2 87.00 ב-FrontierScience-Olympiad לעומת Gemini 3.1 Pro 79.00.

• שליטה בטרמינל — Gemini 3.1 Pro 73.80 ב-TerminalBench 2.1 לעומת Intern-S2 64.04.

הקריאה הכנה: Gemini 3.1 Pro מנצח בשורות המולטימודאליות הרחבות בפערים צרים, Intern-S2 מנצח בשורות הספרות המדעית העמוקה בפערים עצומים, ואף אחת מהתוצאות אינה מפתיעה בהינתן מה שכל אחד מהם אומן עליו. המצומצמות של ההפסדים המולטימודאליים היא, אפשר לטעון, הממצא המעניין יותר — צ'קפוינט פתוח מאותו יום שנוחת בטווח של שתי נקודות ממודל דגל סגור בן חצי שנה ב-MMMU Pro וב-ChartQAPro היא תוצאה חזקה יותר עבור InternLM מכל אחד מהמספרים המדעיים המרשימים שלו.

הקשר, פלט ושאלת התצוגה המקדימה

סיפור הקלט הארוך מתפצל בצורה נקייה. Gemini 3.1 Pro מחזיק חלון הקשר של 1M טוקנים עם תקרת פלט של 64K — מספיק למערך מסמכים ארוך ולתשובה מהותית. Intern-S2 מוערך בעד 256K טוקנים להסקת טקסט ו-64K לרב-מודאלי, ואינו מפרסם תקרת פלט; התייחס לחלון השמיש שלו כקטן מזה של Gemini עד שמישהו ימדוד אותו באופן עצמאי.

יש הסתייגות תפעולית אחת בצד של Goog​le שמקומה בכל השוואה הוגנת. Gemini 3.1 Pro הוא עדיין מודל בתצוגה מקדימה, לא מהדורת GA. מודלים בתצוגה מקדימה נושאים ציפיות אמינות נמוכות יותר, ולוח שיעור שגיאות של 7 ימים בעמוד של מודל הוא תזכורת מתמדת לעקוף חוסר יציבות במקום לבנות נתיב קריטי על גביו. Intern-S2 הוא מהדורה מלאה של Apache-2.0 עם משקלים שאפשר לקבע — מה שבאופן מנוגד לאינטואיציה הופך את המודל הפתוח החדש לגמרי ליציב יותר תפעולית מבין השניים במובן החשוב ביותר: אף אחד לא יכול לשנות אותו מתחת לרגליים שלך.

• הקשר — Intern-S2 עם 256K טקסט / 64K מולטימודאלי, הוערך לעומת Gemini 3.1 Pro עם 1M טוקנים.

• קלטים — Intern-S2 טקסט, תמונה, סדרות זמן לעומת Gemini 3.1 Pro טקסט, תמונה, אודיו, וידאו.

• משקלים — Intern-S2 Apache-2.0, ניתן להורדה לעומת Gemini 3.1 Pro סגור.

• בגרות — Intern-S2 בן שעות ספורות, אין ציון בלתי־תלוי מול Gemini 3.1 Pro preview מאז פברואר 2026, נבדק רבות ובאופן בלתי־תלוי.

• מחיר — ל-Intern-S2 אין מחירון פומבי; אירוח עצמי או Intern API הרשמי לעומת Gemini 3.1 Pro: $2.00 לקלט / $12.00 לפלט למיליון, ועולים ל-$4.00/$18.00 מעל 200K טוקני קלט.

A generated two-column scoreboard titled 'Intern-S2 vs Gemini 3.1 Pro — the scoreboard.' Left column Intern-S2-397B lists Weights Apache-2.0, Context 256K text / 64K multimodal, Inputs text image time series, Independent score none yet, Price self-host or Intern API, MMMU Pro 81.68. Right column Gemini 3.1 Pro lists Weights closed, Context 1M in / 64K out, Inputs text image audio video, Independent score 57 at launch on the then-current scale, Price $2.00 / $12.00 per 1M, MMMU Pro 83.99. Footer reads 'Intern-S2 figures are InternLM's own, unreproduced; both MMMU Pro rows as measured in InternLM's comparison table. Gemini 3.1 Pro figures per Google and independent trackers.'

מחיר ואיפה כל אחד גר

ג'מיני 3.1 Pro מחייב 2.00$ למיליון טוקני קלט ו-12.00$ למיליון טוקני פלט במסלול הסטנדרטי, ועולה ל-4.00$/18.00$ ברגע שבקשה חוצה 200 אלף טוקני קלט — תוספת מחיר להקשר ארוך שנושכת בדיוק כשמשתמשים בחלון של מיליון הטוקנים שמצדיק את הבחירה בו. אפשר לנתב אותו ב-OrcaRouter באותו מחיר מחירון, בהעברה ישירה עם 0% תוספת, על מפתח שנושא גם יותר מ-200 מודלים אחרים; ההעברה הישירה חשובה כאן משום ששינוי מחיר של גוגל נוחת בצד שלנו באותו יום ולא אחרי מחזור תמחור מחדש. ה-DSL לניתוב הוא החלק השימושי בהתאמה המסוימת הזו: אפשר לשלוח עבודות תמונה ווידאו לג'מיני 3.1 Pro וקבוצות של מסמכים מדעיים ל-Intern-S2 המתארח בעצמך, ולהחזיק את שניהם מאחורי נקודת קצה אחת בלי חוזה נוסף או שינוי בקוד.

ל-Intern-S2 אין מחיר API מפורסם. אירוח עצמי של משקולות Apache-2.0 הוא המסלול שרוב הצוותים יבחרו בו בפועל, ועם 403B פרמטרים זו התחייבות חומרתית אמיתית. ה-API הרשמי של Intern קיים עבור צוותים שמעדיפים לא להריץ GPUs, אבל בלי מחירון ציבורי, השוואת העלויות ל-$2/$12 של Gemin​i היא לא משהו שאפשר לעשות על הנייר — צריך לבקש מכסה ולעשות את החשבון בעצמך.

A screenshot of the Hugging Face model card for internlm/Intern-S2, captured September 13, 2026, showing the Apache-2.0 licence badge, the tags image-text-to-text and qwen3_5_moe, the model size of 403B parameters in BF16/F32, the Intern-S2-397B heading, an inference providers panel reading 'This model isn't deployed by any Inference Provider,' and the collection listing nine items.

השיחה

יש לבחור ב-Gemini 3.1 Pro אם אתם זקוקים למודל מולטימודלי כללי שקולט אודיו וווידאו, מכיל מיליון טוקנים, עבר חודשים של אימות בלתי־תלוי, וניתן לשכור אותו לפי טוקן כבר היום. זהו המודל עם הראיות הטובות יותר והיכולות הרחבות יותר, ותג ה-preview הוא הסתייגות של אמינות ולא של יכולת.

בחר ב-Intern-S2 אם הקלט הרב-מודלי שלך הוא מדעי והנתונים שלך אינם יכולים לצאת מהתשתית שלך. זהו היחיד מבין השניים שקורא דפי ספרות גולמיים באופן ילידי, מבצע תחזיות מאותות של סדרות זמן, וניתן לכוונן אותו על נתונים ניסיוניים קנייניים תחת רישיון מתירני. קבל את העובדה שאתה האדם הראשון שמריץ אותו, ושטבלת הבנצ'מרק שמצדדת בו נכתבה על ידי האנשים שיצרו אותו.

A screenshot of the OrcaRouter model page for Gemini 3.1 Pro at orcarouter.ai/models/google/gemini-3.1-pro-preview, captured September 13, 2026, showing the model tagged FLAGSHIP and FEATURED by Google dated 2026-02-19 with Vision, Audio, Tools, JSON and Reasoning tags, a 1M-token context window and 65K max output, and pricing tiles reading input $2.00 and output $12.00 per 1M tokens.

אף אחד מהמודלים לא מנצח כאן באופן מוחלט, והטבלה מוכיחה זאת טוב יותר מכל הכרעה. האחד הוא ג'נרליסט שבמקרה טוב במדע; האחר הוא מכשיר מדעי שבמקרה תחרותי בעבודה מולטימודלית כללית — ובשחרור פתוח באותו יום, "תחרותי" הוא התוצאה המפתיעה יותר.

כדי להכיל את שני החצאים של ההשוואה הזו בלי חוזה נוסף: מפתח API יחיד שמכסה יותר מ-200 מודלים מעמיד את דגם הדגל המולטימודאלי הסגור וכל חלופה מאחורי נקודת קצה אחת, כך שתוכל לנתב עבודות של תמונות וווידאו בדרך אחת ואצוות מסמכים בדרך האחרת.