
Kolibri נגד Qwen 3.8: המודל הגרמני מפסיד בטבלה של עצמו, וזה בדיוק העניין
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 218 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 115 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 982 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 47 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 105 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 215 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
התחל במשפט שרוב סיקור ההשקה של Kolibri השמיט. בטבלת הביצועים שאלף אלפא פרסמה עם המודל שלה ב-3 באוקטובר 2026, המודל שמולו הוא נמדד לרוב אינו מתחרה אירופי ולא אמריקאי. זהו Qwen3.8 27B, הדגם בעל המשקולות הפתוחות של אותו דור, שיצא ב-13 באוגוסט 2026 — ולפי המספרים של אלף אלפא עצמה, הוא מנצח. Qwen3.8 27B משיג 80.2 בממוצע האנגלי ו-79.9 בממוצע הגרמני של אותו מערך הערכה שנותן ל-Kolibri 75.5 ו-70.8. הוא מוביל ב-GPQA Diamond, 89.2 לעומת 84.3. הוא מוביל ב-LiveCodeBench v6, 93.8 לעומת 85.9. הוא מוביל ב-SWE-Bench Verified, 72.6 לעומת 66.4, ובשני מבחני ההקשר הארוך, 76.9 לעומת 64.5 ב-LongBench Pro ו-81.3 לעומת 68.3 ב-AA-LCR. מודל צפוף סיני עם 27 מיליארד פרמטרים, שהוערך על ידי מעבדה גרמנית, מנצח את ספינת הדגל של אותה מעבדה עם 78 מיליארד פרמטרים ברוב הטבלה שלה עצמה. זה לא שערורייה. זוהי העובדה השימושית ביותר בהשקה, כי היא מכריחה את השאלה מהי המטרה האמיתית של Kolibri.
הבהרה אחת לפני שההשוואה תתקדם הלאה, משום ש"Qwen 3.8" הוא שם של משפחה ולא של מודל, וההבחנות חשובות כאן. Qwen3.8-Max הוא מודל הדגל המתארח של Alibaba, פעיל מאז 3 באוגוסט 2026 עם חלון הקשר של 1M טוקנים במחיר של $2.00 למיליון טוקני קלט ו-$6.00 לפלט. Qwen3.8-27B הוא שכבת המשקולות הפתוחות, ששוחררה ב-13 באוגוסט 2026 עם חלון של 262,144 טוקנים. Qwen3.8-Flash הוא שכבת הנפח, ששוחררה ב-26 באוגוסט 2026 עם חלון של 1M טוקנים ומחירים נמוכים בהרבה. ו-Qwen3.8 סתם — שהוכרז ב-19 ביולי 2026 כדגל משקולות פתוחות עם 2.4 טריליון פרמטרים — לא שוחרר; הוא קיים כדף מעקב בקטלוג והכרזה. כל מה שלהלן עוסק בזה שאת המשקולות שלו אפשר להוריד ולהריץ, שהוא ה-27B.
היכן ש-Kolibri באמת מנצחת, אפשר לקרוא ישירות מאותה טבלה.
השורות שבהן Kolibri מוביל על Qwen3.8 27B אינן מפוזרות באקראי. הן מתקבצות, והאשכול הוא המוצר.
• הימנעות — ב-RGB Negative, Kolibri משיגה 85.6 לעומת 70.6. כאשר ההקשר אינו מכיל את התשובה, Kolibri אומרת זאת בתדירות גבוהה בהרבה.
• קריאה לכלים תחת אילוץ — ב-τ²-bench telecom, 94.7 לעומת 82.5; בסוויטה האנכית של ספקי הרכב, 99.0 לעומת 97.3.
• הקשר ארוך מאוד — ב-SealQA ללא מסיחים מעל 24 אלף טוקנים, 100.0 לעומת 94.4.
• כלכלת הגשה גרמנית — טוקנייזר דו-לשוני ב-4.90 בייטים בממוצע לטוקן על טקסט אינטרנט גרמני, לעומת 4.17 עבור משפחת Qwen3.5–3.8 במדידה של Aleph Alpha עצמה. פחות טוקנים לכל מסמך גרמני הוא הפחתה ישירה בעלות ההסקה שמופיעה בחשבונית ולא באף שורת בנצ'מרק.
שלושה מארבעת אלה עוסקים בהתנהגות ולא ביכולת. הימנעות, קריאה מוגבלת לכלים ואחזור מעוגן בהקשר ארוך הם מה שאתה צריך ממודל שקורא את החומר של הארגון שלך ואמור להודות כשהחומר אינו עונה על השאלה. Aleph Alpha בנתה את כל המהדורה סביב ההימור הזה, והטבלה מראה שההימור מתממש.

השורות שבהן Qwen3.8 27B מנצח עוסקות ברוחב: ידע בשתי השפות, שאלות מדע ברמת תואר שני, תכנות תחרותי, הנדסת תוכנה ברמת מאגר, הבנת מסמכים ארוכים. אם הדרישה שלך היא מודל כללי חזק במחיר נמוך לטוקן עם משקלים פתוחים, Qwen3.8 27B הוא המודל הטוב יותר והטבלה אומרת זאת בדיו של הספק עצמו.
הקריאה הזו מאומתת במקום שבו זו של Kolibri אינה כזו. Artificial Analysis מדדה את Qwen3.8 27B באופן בלתי תלוי, בתצורת החשיבה Xhigh שלה, ומדווחת על Intelligence Index של 34 במקום ה-1 מבין 142 המודלים באותה השוואה, 45.4 אסימוני פלט בשנייה, חלון הקשר של 256,000 אסימונים ורישיון Apache 2.0. ההערה שלהן אינה מחמיאה בדרך מוכרת — מילולית מאוד עם 200 מיליון אסימונים שנוצרו במהלך הערכת המדד לעומת חציון של 82 מיליון, ואיטית — אבל הציון עצמו הוא מדידה של צד שלישי של היריב. ל-Kolibri אין כלל דף ב-Artificial Analysis. כך שהמודל החזק ביותר בהשוואה הזו אומת באופן בלתי תלוי, והחלש יותר הוא בגדר דברי הספק — ההיפך מהאופן שבו נהוג למסגר ספינת דגל אירופית מדור ראשון.
שני סוגים של טענות בנוגע לשרשרת האספקה, המצביעות לכיוונים מנוגדים
שתי המהדורות האלה הן טיעונים על מהיכן מגיע מודל, והטיעונים הם תמונות מראה זו של זו.
המקרה של Aleph Alpha הוא תיעוד מקור כפיצ'ר. Kolibri אומן על ידי צוותים גרמניים על תשתית בגרמניה ובפינלנד, בכפוף לחוקי האיחוד האירופי ולחוק הגרמני. הכרטיס חושף את תמהיל האימון המקדים — 20 טריליון טוקנים, כאשר כ-62.5 אחוז מהם אנגלית, 23.9 אחוז גרמנית ו-13.6 אחוז קוד — את תקציבי אימון הביניים וההקשר הארוך, את כוח החישוב המדויק: 768 NVIDIA B200s על פני 96 צמתי HGX במשך 21 ימים, וצריכה מוערכת של 9.5×10² MWh אנרגיה, כולל תקורת מרכז נתונים. הוא מפרט את שיטת האימון עד לרמת השכבה: טרנספורמר mixture-of-experts בן 50 שכבות, עם חלוקה של 4:1 בין קשב sliding-window לקשב grouped-query, Muon ו-Exact Quantile Balancing על פני 384 מומחים, עם מומחה משותף אחד ו-6 מנותבים. שנים-עשר אלף מילים של חשיפות המצורפות להורדה בגודל 78 GB, ועמדה מוצהרת כחתום על קוד ההתנהגות של האיחוד האירופי לבינה מלאכותית למטרות כלליות.
מקרה של Alibaba שונה במהותו: לא "אנחנו יכולים לתת דין וחשבון על כל החלטה" אלא "הנה המשקלים, קח אותם". משקלים פתוחים ברישיון Apache בקנה מידה ואיכות שהפכו את Qwen לברירת המחדל האפקטיבית ברחבי העולם, אוצר מילים של 248,077 טוקנים המכסה הרבה יותר ממאה שפות, ומערכת אקולוגית של הגשה שכויילה סביב נקודות ביקורת אלו מספיק זמן כך שכמעט כל מחסנית הסקה תומכת בהן באופן מובנה. טיעון הריבונות שם עוסק בזמינות: אף ספק לא יכול למשוך את המודל, כי כבר יש לך את הקובץ.
שתי הטענות כנות והן עונות לחששות שונים. קונה מהמגזר הציבורי בבאדן-וירטמברג מודאג מתחום שיפוט ומאפשרות ביקורת, וקוליברי פונה בדיוק לחשש הזה. קבוצת מחקר בניירובי או בסאו פאולו מודאגת מכך שמודל חסום מאחורי כרטיס אשראי במטבע שהם לא יכולים לשלם בו, ומשקלות Qwen הפתוחים פונים לחשש הזה. מה שאינו כן הוא להעמיד פנים שכל אחת מהן היא השוואת יכולות, כי טבלת היכולות כבר נתנה את תשובתה.

פער הרישוי הוא אמיתי אך צר מכפי שהוא נשמע
Kolibri הוא Apache 2.0. Qwen3.8 27B הוא משקולות פתוחות ברישיון Apache. שניהם מגיעים ללא נספח שימוש מקובל, ללא סף משתמשים פעילים חודשיים וללא תנאים מסחריים נפרדים — מה שמציב אותם בקבוצה קטנה ופירושו שאף אחד מהם אינו דורש בדיקה משפטית לפני שימוש מסחרי.
מה שמבדיל ביניהם הוא כל מה שבא אחרי הרישיון. Kolibri מגיע עם תוסף vLLM וחבילת parser מהספק, תמונת קונטיינר, ארבע רמות מאמץ חשיבה הניתנות להגדרה דרך תבנית הצ'אט, התנהגות הימנעות מפורשת, ותצורת דגימה מומלצת. Qwen3.8 27B מגיע כמשקלים ש-Transformers, vLLM ו-SGLang כבר יודעים לשרת, עם פורמט לקריאה לכלים שלמערכת האקולוגית הרחבה היו חודשים להסתגל אליו.
חומרת הפריסה נבדלת באופן דומה. משקולות ה-FP8 של Kolibri תופסות ~78 GB, עם מינימום של שני כרטיסי A100 80 GB, שני H100 SXM5, H200 אחד, B200 אחד או B300 אחד. Qwen3.8 27B ב-bfloat16 הוא כ-54 GB של משקולות, שזהו מאיץ יחיד של 80 GB בדיוק מלא, או בילד מכומת על פחות חומרה באופן ניכר. המודל הגרמני דורש יותר חומרה ומניב פחות בנצ'מרק עבורה. זו עסקה גרועה רק אם היית קונה בנצ'מרק.
מה תגי המחיר כן אומרים לך ומה לא
ל-Kolibri אין מחיר, מכיוון ש-Aleph Alpha אינה מוכרת הסקה עבורו. השחרור הוא משקלים, דוח טכני וכרטיס; אין SKU מתארח. כל נתון עלות עבור Kolibri הוא חישוב אמור�יזציה של חומרה שאתה עורך בעצמך.
Qwen3.8 מתומחר בפומבי בשלוש רמות, והרמה האמצעית היא זו שחשובה לצוות שמשווה בין אירוח עצמי לשכירות.
• Qwen3.8-Max — $2.00 למיליון טוקני קלט ו-$6.00 פלט, הקשר של 1M טוקנים, קריאות מטמון ב-$0.25, שוחרר ב-3 באוגוסט 2026.
• Qwen3.8-27B — 0.33$ לקלט ו-2.40$ לפלט, חלון הקשר של 262,144 טוקנים, שוחרר ב-13 באוגוסט 2026. אלה המשקלים הפתוחים, כך שזה המחיר שאתם משלמים אם תעדיפו שלא להריץ אותם בעצמכם.
• Qwen3.8-Flash — $0.15 קלט ו-$0.47 פלט עם חלון של 1M טוקנים, שוחרר ב-26 באוגוסט 2026.
אלו הם מחירי המחירון של הספקים ב-OrcaRouter, מועברים הלאה בלי שום תוספת לכל טוקן, וזו התכונה המועילה כשהשאלה היא אם פריסה באחסון עצמי מחזירה את ההשקעה: אפשר למדוד את נפח הטוקנים האמיתי שלכם בשכבות המתארחות לפני שמתחייבים לחומרה. אנחנו לא מוסיפים מרווח, כך שהורדת מחיר של ספק נכנסת לתוקף אצלנו באותו יום. כל שלוש שכבות Qwen3.8 ניתנות לניתוב היום ב-מפתח יחיד תואם OpenAI עם מעבר אוטומטי בין ספקים, ול-Qwen3.8 הקרוב עם 2.4 טריליון פרמטרים יש דף קטלוג שממתין למשקולות במקום ממלא מקום שמעמיד פנים שהוא מגיש אותן.
Kolibri אינו ניתן לניתוב. בדקנו את הקטלוג בכל איות של ספק ודגם והוא נעדר — כך שהדרך היחידה לקרוא לו היא ההורדה של 78 GB. אם ברצונך לדעת מה יעלה הדגם הגרמני עבור עומס העבודה שלך, התשובה היא ארון שרתים ואדם שיכול להריץ vLLM, ואף צד שלישי לא יכול כרגע לתת לך הצעת מחיר אחרת.

מי צריך לקנות מה
ההחלטה אינה תלויה באיכות, משום ששאלה זו הוכרעה על ידי הטבלה של הספק עצמו לטובת Alibaba. היא תלויה בשאלה מפני איזה סיכון אתם קונים ביטוח.
• בחרו ב-Kolibri אם האילוץ המחייב הוא תחום שיפוט, תיעוד מקור או יכולת ביקורת — אם אתם צריכים להיות מסוגלים להשיב מהיכן הגיעו נתוני האימון, היכן רצה החישוב ובאיזה חוק, ואם עומס העבודה הוא מסמכים בגרמנית ובאנגלית המעובדים בתוך המתחם שלכם. אתם משלמים על כך פרמיית יכולת, והפרמייה נראית בטבלה שלמעלה.
• בחרו ב-Qwen3.8 27B אם האילוץ המחייב הוא יכולת ביחס למחיר, רוחב השפות או תמיכה באקוסיסטם. זהו המודל החזק יותר בהערכה של Aleph Alpha עצמה, הוא ברישיון Apache, הוא פועל על מאיץ אחד, והמסלולים המתארחים מתחילים ב-$0.33 למיליון טוקני קלט אם תעדיפו לא להריץ אותו בכלל.
• שקול את שניהם באותה ארכיטקטורה אם לעומס העבודה יש ליבה רגולטורית ופריפריה כללית. מסמכים שאינם יכולים לצאת מהבניין הולכים לנקודת קצה Kolibri באירוח עצמי; עבודות הסיכום, התרגום והקוד הולכות לשכבה מנותבת של Qwen3.8 בשליש סנט לאלף טוקנים. מפתח API אחד, כלל ניתוב אחד, מחירי המחירון של הספקים מועברים כמו שהם, והמעבר לגיבוי מטופל עבורך — וזהו הסדר שימושי בהרבה מלבחור אחד מהשניים ולהעמיד פנים שהשני אינו קיים.
