
MiniCPM5-2B-DSpark לעומת LFM2.5-2.6B-Base: אחד הוא מרכיב להגשה, ואחד הוא מרכיב לאימון
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
שניים מהשחרורים המעניינים ביותר של דגמים קטנים בסוף קיץ 2026 חולקים מאפיין משותף: אף אחד מהם לא עובד ישירות מהקופסה, ושני הספקים אומרים זאת במשפטים הראשונים של כרטיסי המוצר שלהם. MiniCPM5-2B-DSpark הוא checkpoint דראפט מסוג DSpark ש-OpenBMB פרסמה בשקט ב-Hugging Face ב-6 בספטמבר 2026 — מלווה בעל 323.8M פרמטרים ל-MiniCPM5-2B, דגם ה-on-device הצפוף בעל 2.52B פרמטרים ש-ModelBest הכריזה עליו ב-WAIC ב-19 ביולי 2026 — והוא לא עושה דבר עד שטוענים אותו לצד אותו יעד במנוע פענוח ספקולטיבי. LFM2.5-2.6B-Base הוא checkpoint טקסט מאומן מראש של Liquid AI, שנמצא ב-Hugging Face מאז 1 באוגוסט 2026, וכרטיס של Liquid עצמה מכנה אותו "checkpoint הטקסט המאומן מראש" שמומלץ רק למשימות הדורשות כיוונון עדין כבד. האחד הוא מרכיב להגשת מודל מוגמר מהר יותר; השני הוא מרכיב לאימון מודל משלך מלכתחילה. הם יושבים על מדפים שונים, והטעות של הבונה תהיה לקחת את הלא נכון.
מה שהופך אותם לראויים להשוואה הוא שהם מכוונים לאותה חומרה ולאותה שאיפה של 2026 — בינה מלאכותית מסוגלת בטלפונים, במחשבים ניידים ובמכשירי קצה — מקצוות מנוגדים של תהליך הבנייה. אם אתה רוצה מודל פריסה על-המכשיר בתוספת האצה חינמית, המחסנית של OpenBMB מוסרת לך את הכל פתוח. אם אתה רוצה לשלוט בשלב ה-post-training בעצמך, Liquid נותנת לך את התשתית ואת העבודה. מאמר זה עוסק בשאלה באיזו שכבה אתה בעצם קונה.
שני כרטיסים שעליהם כתוב "לא לשימוש ישיר" בניבים שונים
קראו את שני כרטיסי המודל זה לצד זה, והסימן הוא בשפת ההתאמה. כרטיס המודל MiniCPM5-2B-DSpark כתוב כולו במונחים של מודל אחר: מטרה, טוקנייזר משותף, שכבות דראפט, אורכי קבלה, פקודת הרצה של SGLang שמקבלת נתיב מטרה ונתיב דראפט. לדראפט אין זהות משל עצמו — חמש שכבות אטנציה מלאה, 323,776,001 פרמטרים, גודל בלוק של שבע, אומן במשך שש אפוקות על 7.05 מיליארד טוקנים מתגובות שנוצרו על ידי MiniCPM5-2B, ושוחרר תחת Apache-2.0 עם ראשי הביטחון והמרקוב של שיטת DSpark (arXiv 2607.05147) מופעלים. מטרתו היא תפוקה: להציע עד שבעה טוקנים, לגרום למטרת ה-2.52B לאמת את הבלוק במעבר אחד, ולשמור את מה שהיא מקבלת.

הכרטיס openbmb/MiniCPM5-2B-DSpark שלמעלה הוא מלוא החשיפה הציבורית של המהדורה — אביזר הגשה שלא צורפה לו כל הכרזה, המדווח על אורך קבלה אך לא על האצה מקצה לקצה.
הכרטיס של LFM2.5-2.6B-Base כתוב במונחים של מודל שעדיין לא קיים: שלך. הדגם ההיברידי 2.69B נערם על שמונה שכבות של קשב עם שאילתות מקובצות (grouped-query-attention) על גבי עשרים ושתיים בלוקים דו-שעריים של קונבולוציה קצרה — הארכיטקטורה של Liquid לפריסה על-גבי מכשיר — שאומן על כ־34 טריליון טוקנים בשש־עשרה שפות, עם קונטקסט של 128K. הוא תומך בטקסט בלבד, אינו כולל כוונון הוראות, ואינו מפרסם אף מדד־ביצועים משל עצמו, משום שמודל בסיס מאומן מראש אינו נמדד; המוצרים המכווננים־עדין (fine-tuned) היוצאים ממנו הם שנמדדים. תפקידו הוא לשמש בסיס להמשך אימון־מראש (continued pre-training) או לביצוע SFT על הנתונים שלך, ולאחר מכן כל מה שתשחרר יורש את תנאי הרישיון שלו.

הכרטיס LiquidAI/LFM2.5-2.6B-Base שלמעלה מציג את טבלת המשפחה — הבסיס לעומת המודל הסוכני LFM2.5-2.6B שאומן לאחר מכן — ואת ההערה "נקודת ביקורת מאומנת מראש לטקסט בלבד", שמגדירה את הבסיס כחומר גלם.
המאגרים, ממד אחר ממד
• תפקיד — MiniCPM5-2B-DSpark: מאיץ יעד קיים ומוגמר. LFM2.5-2.6B-Base: המצע שאותו אתה מאמן לאחר מכן לכדי מודל מוגמר.
• פרמטרים — MiniCPM5-2B-DSpark: דראפט של 324M עבור מטרה צפופה של 2.52B. LFM2.5-2.6B-Base: היברידי של 2.69B (בלוקי קשב + קונבולוציה קצרה).
• הקשר — MiniCPM5-2B מטרה: 128K ילידי. LFM2.5-2.6B-Base: 128K ילידי.
• מה שעליך להוסיף — MiniCPM5-2B-DSpark: מנוע הגשה (SGLang DSPARK) ומודל היעד. LFM2.5-2.6B-Base: ריצת כוונון עדין, ערכת הערכה ומחסן הסקה.
• אמות מידה — MiniCPM5-2B-DSpark: דווח רק על אורך הקבלה ב־repo (ערך מצרפי בפענוח חמדן: 5.52 לכל שלב), ללא נתון האצה. LFM2.5-2.6B-Base: לא פורסם דבר עבור הבסיס עצמו.
• רישיון — MiniCPM5-2B-DSpark: Apache-2.0, ללא התניות. LFM2.5-2.6B-Base: LFM Open License v1.0 — שימוש מסחרי חופשי עד להכנסה שנתית של 10 מיליון דולר, והמגבלה עוברת בירושה לכל מודל שתכוונן.

לוח התוצאות שלמעלה הוא מדף הרכיבים המצויר ככרטיס: עמודה אחת היא תוספת הגשה למודל מוגמר, והשנייה היא מצע אימון למודל שאינו קיים עד שתבנה אותו.
ההבדל של 10 מיליון דולר
עבור מפתח, פער הרישוי הוא השורה הפחות זוהרת והמכרעת ביותר ברשימה זו. ModelBest ו-OpenBMB שחררו את MiniCPM5-2B ואת המודל המקדים (draft) שלו תחת רישיון Apache-2.0: אתה יכול לשרת את מודל היעד, להריץ את המודל המקדים, ולבנות מוצר מסחרי על בסיסו ללא תקרת הכנסות וללא התחייבות תורשתית מעבר לייחוס. רישיון LFM Open License v1.0 של Liquid מתיר שימוש מסחרי אך מגביל אותו — חינם עד $10 מיליון בהכנסות שנתיות, והמגבלה עוברת אל עבודת הנגזרת שלך, כך שמוצר שאתה מכוונן (fine-tune) מ-LFM2.5-2.6B-Base נושא את אותה תקרה. הדבר אינו הופך את הרישיון של Liquid לבלתי סביר; הוא הופך אותו לתנאי שסטארטאפ השואף לצמוח מעבר לתקרה חייב לתכנן סביבו מהיום הראשון. אם שאיפת ההכנסות של הפרויקט שלך קטנה או שאתה מעריך מחקר, התקרה אינה בעיה. אם אתה בונה משהו שאתה מתכוון לגדל, Apache-2.0 הוא סוג אחר של חומר גלם.
הפיצול בין פיתוח לרכישה עבור מפתחים
נסחו זאת כהחלטה של "לבנות או לקנות" לגבי המודל עצמו, והבחירה מפסיקה להיות מבלבלת. MiniCPM5-2B-DSpark הוא מסלול ה"קנייה": העבודה הקשה — אימון משלים (post-training) של מודל על‑גבי‑המכשיר למשימות סוכנות (agentic) עם קונטקסט ארוך — כבר נעשתה ב‑MiniCPM5-2B, והטיוטה (draft) היא שכבת האצה ללא רישיון נוסף שמעל. אתם קונים מודל מוגמר והאצה, ושניהם תחת רישיון Apache-2.0; כל שנותר לכם הוא ה‑serving וההערכה. השאלה הפתוחה היא כמותית: OpenBMB מדדה את קצב הקבלה של הטיוטה (5.52 טוקנים לכל שלב אימות בגישת greedy), אבל לא את זמן‑האמת (wall-clock) שלה, ולכן עליכם עדיין לבחון את הפריסה של SGLang על החומרה שלכם כדי לדעת מה קניתם.
LFM2.5-2.6B-Base הוא נתיב ה"בנייה": אתה קונה את מצע האימון המקדים ועושה את הפוסט־אימון בעצמך, וזו הסיבה היחידה הכנה לבחור בגרסת Base על פני הגרסה האחות LFM2.5-2.6B שכבר עברה פוסט־אימון, ש־Liquid מוכרת. הנתיב הזה הגיוני כשיש לך תחום, שפה או פרופיל התנהגות שמודלים מוכנים מהמדף לא מכסים — אתה לוקח את הארכיטקטורה של Liquid ואת הבסיס של 34 טריליון טוקנים והופך אותו לשלך. זה ללא ספק יותר עבודה, זה מתחיל עם אפס מדדים שפורסמו, וזה נושא את תקרת ההכנסות קדימה. התמורה היא מודל שאין לאף אחד אחר.
מציאות הניתוב
אף אחד משני ה-checkpoints לא מופיע היום בשום קטלוג מתארח, כולל זה של OrcaRouter — ה-draft הוא, בהגדרתו, אביזר הגשה מקומי, והבסיס של Liquid הוא פרויקט fine-tuning באירוח עצמי. כאן בדיוק שכבת ניתוב נותרת שימושית מבלי להעמיד פנים שהיא מארחת אף אחד מהם: ברגע שהגשת או כיווננת (fine-tuned) את אחד המודלים, השכבה שעומדת מול ה-endpoints שלך היא שהופכת את ההתנסות בהם להפיכה. כוון נתיב בדיקה אל build של SGLang המבוסס על MiniCPM5-2B-plus-draft, בעוד שהייצור נשאר על מה שאתה מגיש היום, תן ל-failover האוטומטי לתפוס את התקיעה, והמשך להעביר את מחירי המחירון של הספקים ב-0% markup עבור המודלים המתארחים שאתה משווה אליהם. מטרת השכבה כאן אינה הגשה — היא שאף אחד מהמרכיבים אינו מחייב אותך באופן בלתי הפיך.
באיזו מדף אתם קונים?
בחרו ב-MiniCPM5-2B-DSpark (עם היעד שלו) כשאתם רוצים מודל מוגמר, ברישיון Apache-2.0, שפועל על המכשיר כבר היום, וגם טיוטה שאולי תהפוך אותו למהיר יותר — מתוך קבלה שאתם חייבים למדוד בעצמכם את האצת הביצועים של הטיוטה, מאחר שהיצרן לא מדד אותה. בחרו ב-LFM2.5-2.6B-Base כשאתם מתכוונים לאמן בעצמכם מודל לאחר האימון ורוצים את הארכיטקטורה ההיברידית של Liquid ואת תשתית 16 השפות כנקודת מוצא — מתוך קבלה של חשבון כוונון העדין, של אפס מדדים שפורסמו, ושל מגבלת ההכנסות של 10 מיליון דולר שתתלווה לכל מוצר שתשלחו. השניים אינם מתחרים על אותה משימה; הם שתי משימות שונות על אותה חומרה, והבחירה השגויה היחידה היא לקנות את האחד מתוך אמונה שקונים את האחר.
