
Kolibri לעומת Solar Mini 4: אותו תקציב אקטיבי של 3B, שני הימורים שונים מאוד
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 217 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 117 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 52 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 100 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
שני מודלים שוחררו בהפרש של שבעה עשר יום זה מזה, ושניהם כווננו לצרוך בערך שלושה מיליארד פרמטרים פעילים לכל טוקן, ובכל זאת אין כמעט דמיון ביניהם בכל הנוגע לאימוץ בפועל. Kolibri של Aleph Alpha הוא 78.1 מיליארד פרמטרים במשקולות Apache-2.0 שאותן מורידים ומגישים בעצמכם: לא קיים נקודת קצה מתארחת, ונכון להיום אין לו אפילו ציון עצמאי אחד בשום מקום. Solar Mini 4 של Upstage הוא 35 מיליארד פרמטרים שאותם אי אפשר להוריד כלל — הוא קיים רק כנקודת קצה בתשלום לפי שימוש, והוא כבר נושא מדד אינטליגנציה של Artificial Analysis של 24.05. מספר הפרמטרים הפעילים אומר לכם כמה עולה להריץ כל אחד מהם. שום דבר אחר במספר הזה לא אומר לכם כמה עולה לכם להתחיל.
הסיבה שהסכומים הכוללים נבדלים עד כדי כך — 78.1B לעומת 35B עם כמעט אותו חלק פעיל — היא ששניהם עיצובי mixture-of-experts דלילים, ושתי המעבדות קיבלו החלטות הפוכות לגבי כמה קיבולת מומחים להשאיר ברזרבה. Kolibri מכיל 384 מומחים ומנתב אל מומחה משותף אחד ועוד 6 מהם לכל טוקן. Solar Mini 4 חושף פיצול של 35B/3B ואינו מוסר דבר על מספר המומחים שלו. כאשר שני מודלים מפורסמים עם אותו נתון פעיל, הסך הכולל של הפרמטרים, ולא הנתון הפעיל, הוא שקובע את חשבון החומרה שלך — וכאן זה הבדל של פי 2.2 באותו תקציב מחשוב מוצהר.
מה כל אחד הוא בפועל
• סך הפרמטרים — Kolibri 78.10B לעומת Solar Mini 4 35B
• פרמטרים פעילים לכל טוקן — Kolibri 3.46B לעומת Solar Mini 4 3B
• משקלים — Kolibri Apache 2.0, משקלים מלאים ב-Hugging Face לעומת Solar Mini 4 סגור; API בלבד
• הקשר — Kolibri 1,048,576 טוקנים מאומתים לעומת Solar Mini 4 512K לפי המסמכים של Upstage, 1,048,576 לפי כרטיס המודל של Artificial Analysis
• פלט מקסימלי — Kolibri אינו מוגבל על ידי הספק לעומת Solar Mini 4 עם 128,000 טוקנים
• שפות — Kolibri גרמנית ואנגלית לעומת Solar Mini 4 אנגלית, קוריאנית ויפנית
• תאריך עדכון הידע — Kolibri 18 ביוני 2026 לעומת Solar Mini 4 בפברואר 2026
• אספקה — Kolibri באירוח עצמי (vLLM) לעומת Solar Mini 4 המתארח ב-Console, Playground וב-On-Premises של Upstage
• הערכה בלתי תלויה — Kolibri: לא פורסמה לעומת Solar Mini 4 AA Intelligence Index 24.05
קוליברי: 78 מיליארד פרמטרים, ואף אחד מחוץ למעבדה לא נתן לו ציון
Aleph Alpha פרסמה את Kolibri ב-3 באוקטובר 2026, במכוון ביום איחוד גרמניה, כ�ראשון במשפחה חדשה וכממשיך של Kolibri Origin. כרטיס המודל מפרט באופן לא שגרתי את מה שנכנס אליו: 20 טריליון טוקנים של אימון מקדים, 3.44 טריליון של אימון ביניים ו-201 מיליארד של אימון הקשר ארוך, שהורצו על פני 768 מעבדי B200 במשך 21 ימים תמורת כ-6.4×10²³ FLOPs וכ-950 MWh. המוכר גם מתנדב למסור את מספר הכשלים — 38 הפסקות לא מתוכננות, בערך אחת לכל 10,000 שעות GPU — וזה מסוג המספרים שמעבדות בדרך כלל משמיטות.

הארכיטקטורה היא סיפור MoE דליל ונקי. חמישים שכבות עם יחס 4:1 של תשומת לב בחלון מחליק (חלונות של 512 טוקנים) לעומת תשומת לב גלובלית, שמופעלת רק בכל שכבה חמישית. משקולות FP8 עם סקיילינג בלוקים של 128×128 ומטמון KV מסוג FP8. Kolibri Origin, לשם השוואה, השתמש ב-128 מומחים בניתוב ברוחב 8, ממד חבוי של מומחים ברוחב 768 ותשומת לב מלאה בכל שכבה, על נתונים באנגלית עם חיתוך בספטמבר 2024. Kolibri עובר ל-384 מומחים בניתוב ברוחב 6 עם ממד חבוי ברוחב 512, ודוחף את שני מועדי החיתוך הלשוניים ל-18 ביוני 2026.
הפייפליין הגרמני הוא החלק שבאמת קשה לקנות במקום אחר. Aleph Alpha אימנה בעצמה את הטוקנייזר UniBPE שלה ומדווחת על טקסט גרמני בקצב של 4.90 בתים לטוקן, לעומת 4.35 עבור GPT-5, 4.17 עבור Qwen3.5 ו-4.13 עבור Gemini. זהו טוקנייזר שמצהיר על דחיסה גרמנית טובה יותר מזו של כל אחד מהמודלים הרב-לשוניים המובילים, והוא המנגנון הקונקרטי שמאחורי הפיץ' של פריסה ריבונית: פחות טוקנים לכל מסמך גרמני פירושו פחות טוקנים מחויבים וחלון אפקטיבי ארוך יותר על אותה חומרה.
כל נתון ביצועים שקיים עבור Kolibri מגיע מכרטיס המודל של Aleph Alpha עצמה, וכך יש לקרוא אותו. הטבלה המדווחת על ידי הספק מציבה את Kolibri בציון כולל של 75.5 בהערכות באנגלית ו-70.8 בגרמנית, 84.3 ב-GPQA Diamond באנגלית לעומת 81.3 בגרמנית, 21.5 ב-Humanity's Last Exam באנגלית לעומת 15.9 בגרמנית, 66.4 ב-SWE-Bench Verified, 85.9 ב-LiveCodeBench v6 ו-68.3 ב-AA-LCR. אלה מספרים שלא עברו ביקורת. אין עמוד Artificial Analysis עבור Kolibri — כתובת ה-URL של המודל של כלי המעקב מחזירה 404 — כך ששום דבר בטבלה הזו לא שוחזר באופן עצמאי, והמאמר שאתם קוראים לא יכול להפוך אותו למוצק יותר ממה שהוא.
מה שהכרטיס כן מבסס היטב הוא סיפור ההגשה. רצפת החומרה היא שני כרטיסי A100 80GB, או שני כרטיסי H100 SXM5, או כרטיס יחיד מדגם H200, B200 או B300. מתכון vLLM שפורסם מריץ אותו עם --kv-cache-dtype fp8 ומפענחים ייעודיים לחשיבה ולקריאות לכלים, בטמפרטורה 1.0, top-p 0.97 ו-top-k 128, עם חוגת reasoning_effort הנעה בין none, low, medium ו-high. B300 יחיד שמגיש מודל 78B בהקשר מאומת של 1M טוקנים הוא הצורה הקונקרטית של ההצעה: אתה קונה את הקופסה, ואז אתה הבעלים של העלות השולית של כל טוקן.
Solar Mini 4: אתה שוכר את הפרוסה הפעילה של 3B במקום לקנות אותה
Solar Mini 4 הגיע ב-22 בספטמבר 2026 — תמונת מצב solar-mini4-260922, כינוי solar-mini4 — בתור המודל הקטן של Upstage המיועד לסוכנים: 35B סה"כ, 3B פעילים, חיתוך פברואר 2026, אנגלית, קוריאנית ויפנית, עם מצבי צ'אט, הסקה, פלט מובנה וקריאה לכלים. הוא זמין דרך ה-Console וה-Playground של Upstage, וכן לפריסה באתר הלקוח, אך אין הורדת משקולות ואין רישיון לבדיקה. התיעוד של Upstage גם מציין "Data not collected" עבורו, וזו שורת התאימות שחשובה אם מציבים אותו מול תעבורה אמיתית.

שלא כמו Kolibri, Solar Mini 4 עבר ארנס עצמאי. Artificial Analysis מציבה אותו ב-Intelligence Index של 24.05, עם 1.01% שנמדדו ב-Terminal-Bench 4.0, 47.6% ב-SciCode, 83.3% ב-AA-LCR ו-25.8% ב-Humanity's Last Exam. פוסט ההשקה של Upstage מציג את 24.1 כמדד הגבוה ביותר בקרב מודלים עם 3B פרמטרים פעילים, לפני Qwen3.6 35B A3B עם 18 ו-Nemotron 3.5 Lightning עם 13 — הצגה הוגנת עד כמה שהיא הולכת, וראוי לציין שהיא צרה בדיוק כפי שזה נשמע, מכיוון שזו טענה על המחלקה של 3B פרמטרים פעילים ולא על מודלים קטנים בכלל.
המדד שאמור לעצב את האופן שבו תתקצבו עבורו אינו ה-Index. פירוט העלויות לפי משימה של Artificial Analysis מציב את Solar Mini 4 בערך ב-$0.36 לכל משימת Intelligence-Index, וכ-$0.30 מתוך זה — כ-82% — הוא מטמון הפרומפט עבור כתיבות. קריאות מטמון הן $0.03 ופלט מיוצר הוא רק $0.035. המודל מפיק כ-88,300 טוקני פלט לכל משימה, מתוכם כ-71,600 הם טוקני חשיבה. במילים אחרות: זהו מודל זול שהחיוב שלו נשלט על ידי כתיבה מחדש של הקשר ארוך, ולא על ידי הטוקנים שהוא כותב בחזרה. עלויות לכל הערכה נעות בין $1.63 עבור Terminal-Bench 4.0 ל-$0.95 עבור AA-Briefcase. מהירות פלט חציונית היא 198 טוקנים לשנייה בזמן של 1.58 שניות עד לגוש הראשון.
המחיר של כל מסלול
Solar Mini 4 אינו מתומחר לפי מחיר המחירון היום. עמוד התמחור של Upstage עצמה מציג עבורו סולם מתוארך: $0.03 למיליון טוקנים בקלט, $0.003 לקלט שמור במטמון ו-$0.12 בפלט — הנחה של 70% בהשקה — עד 10 באוקטובר 2026 UTC, ואז $0.05 / $0.005 / $0.20 מ-11 באוקטובר, ולבסוף $0.10 / $0.01 / $0.40 לפי המחירון מ-23 באוקטובר. הפוסט של Upstage על ההשקה מתאר את ההנחה באופן רופף יותר מלוח הזמנים של עמוד התמחור עצמו; הסולם שלמעלה הוא הגרסה עם התאריכים, והוא זה שכדאי לתכנן לפיו. שימו לב היכן נמצאת ההנחה התלולה ביותר: קלט שמור במטמון יורד לעשירית משיעור הקלט, מה שמתגמל בדיוק את עומס העבודה של הקשר ארוך ויציב שעבורו פרופיל עלות כתיבת המטמון שלמעלה גובה.
המחיר של Kolibri הוא הזמנת רכש. אין תעריף למיליון טוקנים להשוואה, משום שאין מונה בשירות מתארח — אתם משלמים על כרטיסי GPU וחשמל, ואות העלות הציבורי היחיד של הספק הוא ריצת האימון עצמה: כ-950 MWh כדי לייצר את המודל. אם כבר יש לכם קיבולת הסקה, העלות השולית של Kolibri לטוקן מתקרבת לעלות החשמל; אם אין לכם, כרטיס הכניסה הוא מכונה עם שני A100 או טוב יותר. זו צורה שונה מיסודה של התחייבות מזו של מודל שאפשר לקרוא לו לפי מיליוני טוקנים ולהפסיק לקרוא לו מחר, וזו ההחלטה הממשית ששתי האפשרויות מציגות.
היכן שהם חופפים, והיכן שההשוואה נשברת
• מחשוב פעיל — כמעט זהה: 3.46B לעומת 3B לכל טוקן
• כל מה שנובע מכך — אינו בר־השוואה, כי רק לאחד מהשניים יש ראיות מאומתות כלשהן
• הציון הנמדד הטוב ביותר — ל-Solar Mini 4 יש Index מבוקר של 24.05; ל-Kolibri יש טבלת ספקים וללא ציון מבוקר כלל
• גרמנית — קוליברי הוא היחיד מבין השניים שאומן לכך, ב-4.90 בייטים לטוקן; Solar Mini 4 אינו מפרט זאת
• קוריאנית ויפנית — Solar Mini 4 מפרט את שתיהן; Kolibri לא מפרט אף אחת מהן
• הקשר ארוך — Kolibri מאמת 1,048,576 טוקנים שלמים; המסמכים של Solar Mini 4 עצמם אומרים 512K בעוד שכרטיס ה-Artificial Analysis שלו מציין 1M, לכן יש להתייחס לתקרה כתלויה בספק
• זמן עד לטוקן הראשון — ב-Solar Mini 4 מדובר בדקות, כי נרשמים; ב-Kolibri מדובר בימים, כי מרכיבים קופסה בארון
• מודל עלויות — לפי טוקן, יורד בהתאם לסולם ההנחות, מול עלות הון ועלות חשמל
סיכום כן הוא שזו אינה התמודדות שמכריעים אותה בלוח מובילים. טבלת הספק של Kolibri כוללת אפילו סט השוואה משלה — GLM-4.7 Flash 30B-A3B בציון כולל באנגלית של 64.7, Nemotron 3 Nano 30B-A3B ב-65.6, Qwen3.5 35B-A3B ב-74.7, Qwen3.6 35B-A3B ב-71.4, Gemma 4 26B-A4B IT ב-71.9, כולם מול 75.5 של Kolibri עצמה — וכל אחת מהשורות האלה היא מספר של Aleph Alpha עצמה, שהופק על ידי אותה מעבדה במערכת הבדיקות שלה. זו מפה שימושית של סביבת ה-3B הפעילה. זהו לא דירוג עצמאי.
אם מה שאתה רוצה הוא MoE עם 3B פעילים על מפתח היום
אף אחד מהמודלים בהשוואה הזו אינו נמצא ב-OrcaRouter, וכדאי לדייק לגבי הסיבה. ל-Kolibri אין עדיין הסקה מתארחת מכל סוג שהוא — אלו משקלים ומתכון vLLM, כך שאין דבר שנתב יכול להצביע עליו. Solar Mini 4 מוגש על ידי Upstage ועל ידי הערוץ המקומי של Upstage עצמה; אנחנו לא מנתבים אותו, ואנחנו לא מנתבים שום מודל של Upstage. אם אתם רוצים אחד מהשניים, תשיגו אותו מהספקים עצמם.
מה שאנחנו מנתבים אליו הוא הקטגוריה הסובבת — קטגוריית מודלי ה-MoE הקטנים והדלילים ששני המודלים האלה מתחרים בתוכה. Gemma 4 26B-A4B IT נמצאת בקטלוג במחיר 0.06$ לקלט ו-0.33$ לפלט למיליון טוקנים, עם חלון של 262,144 טוקנים. Qwen3.5 35B-A3B עומדת על 0.057$ / 0.459$ ו-Qwen3.6 35B-A3B על 0.248$ / 1.485$, עם חלון של 262,144 טוקנים ופלט מרבי של 65,536 טוקנים. אלה בדיוק אותו סחר שהשניים שלמעלה מבצעים — פרוסה פעילה של 3B עד 4B הנקנית במחיר של מודל קטן — זמין על מפתח API אחד כשמחיר המחירון של הספק מועבר בתוספת של 0%, כך ששינוי מחיר של ספק נוחת על החשבונית שלכם באותו יום שבו הוא מוכרז, ולא בחידוש החוזה הבא. מעבר אוטומטי לגיבוי חשוב כאן יותר מהרגיל: כשאתם בוחנים מודל דליל שטרם הוכח, נתיב שני מאחורי אותו מפתח הוא מה שמונע מאחר צהריים גרוע להפוך להשבתה.

מה לעשות, ומה לראות
בחר ב-Kolibri אם עומס העבודה שלך הוא גרמנית או אנגלית, אם הנתונים לא יכולים לצאת מהראק שלך, ואם יש לך — או שאתה מוכן לקנות — את כרטיסי ה-GPU כדי לשרת 78B ב-FP8. בתצורה הזו הוא היחיד מבין שני הדגמים האלה שאפילו בא בחשבון, וההקשר המאומת של 1M טוקנים עם טוקנייזר גרמני של 4.90 בתים לטוקן הוא יתרון אמיתי, גם אם נמדד על ידי הספק. בחר ב-Solar Mini 4 אם אתה רוצה להיות בסביבת ייצור השבוע, אם קוריאנית או יפנית מופיעות במפת הדרכים, ואם עומס העבודה שלך הוא הקשר ארוך ויציב שהנחת המטמון מתגמלת; הקצה תקציב לכתיבות מטמון, לא לטוקני פלט.
השאלה הפתוחה זהה לשניהם, והיא שאלה של ראיות ולא של יכולת. הציונים 75.5 ו-84.3 של Kolibri הם המספרים של Aleph Alpha עצמה על ההרנס שלה, ועד שכלי מעקב בלתי־תלוי יריץ אותו, כל מי שמצטט אותם מצטט את המעבדה. הציון 24.05 של Solar Mini 4 הוא אמיתי ומשוחזר, אבל האינדקס הוא תמונת מצב של מודל שנמצא עדיין באמצע מדרג ההנחות, כאשר מחיר המחירון לא יגיע עד 23 באוקטובר. שימו לב להערכה הבלתי־תלויה הראשונה של Kolibri, ושימו לב כמה Solar Mini 4 באמת יעלה כשהמדרג ייגמר — כי במחיר של $0.10 / $0.40 הכלכלה של שכירת פרוסת ה-3B נראית שונה מ-$0.03 / $0.12 שמצוטטים לכם היום.
