
Qwen3.8-27B ב-Hugging Face: המאגר הרשמי, מה יש בפנים, ואיך להוריד אותו
- obsidianחדשQwen3.8 27B Uncensored (Aggressive)2026-08-15$0.40 / $4.21 לכל 1M טוקנים · 22 tok/s
- qwenחדשQwen: Qwen3.8 27B (free)2026-08-1349 tok/s
- deepseekחדשDeepSeek: DeepSeek V4 Pro 08132026-08-1253אינטליגנציה69כתיבת קוד
- grokחדשSpaceXAI: Grok 4.62026-08-1261אינטליגנציה77כתיבת קוד
- metaחדשMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים · 284 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0957אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0961אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0856אינטליגנציה72כתיבת קוד
- tencentTencent: Hy32026-07-0642אינטליגנציה59כתיבת קוד
Qwen3.8 27B נמצא ב-Hugging Face בכתובת Qwen/Qwen3.8-27B, שפורסם על ידי ארגון Qwen ב-14 באוגוסט 2026 תחת רישיון Apache 2.0. המאגר מכיל 55.6 GB של קבצי safetensors בפורמט BF16 המחולקים ל-18 shards, בתוספת הטוקנייזר, תבנית הצ'אט והקונפיגורציה שמגיעים איתו — חינם להורדה, חינם לשימוש מסחרי, וללא תשלום לפי אסימון. שני דברים שמכשילים אנשים: המאגר הרשמי כולל safetensors בלבד, בעוד שקוונטיזציות ה-GGUF שאנשים מריצים על GPUs צרכניים נמצאות במאגרים קהילתיים נפרדים; ומאגרי חיקוי הופיעו לפני ההשקה, כך שרק העותק של ארגון Qwen הוא האמיתי. מאמר זה הוא מדריך ההורדה: מה יש במאגר, שלוש הדרכים להוריד אותו, וכיצד לוודא שקיבלתם את המשקולות האמיתיות.
העובדות המהירות, נבדקו ב-15 באוגוסט 2026
• מאגר — Qwen/Qwen3.8-27B ב־Hugging Face, בהוצאת ארגון Qwen; משוקף גם ב־Qwen/Qwen3.8-27B ב־ModelScope.
• שוחררו — המשקלים הפכו לזמינים ב-14 באוגוסט 2026; סיקור תלוי-אזור-זמן מזכיר גם את 13 באוגוסט, וכתבות טרום-שחרור מהשבוע שלפני דיווחו עליהם כממתינים.
• רישיון — Apache 2.0: הורדה, שינוי והפצה מחדש, כולל שימוש מסחרי.
• גודל — 55.57 GB של safetensors ב-18 חלקים (2.1–3.99 GB כל אחד); דף המאגר מעגל את הסכום ל-55.6 GB.
• דגם — 27B פרמטרים צפופים (28B אם סופרים את מקודד הראייה), 64 שכבות, גודל חבוי 5,120, אוצר מילים 248,320.
• קשב — היברידי: 48 שכבות Gated DeltaNet (קשב ליניארי) לעומת 16 שכבות Gated Attention מלאות, עם אימון חיזוי רב-טוקנים — הפיצול 3:1 הוא הסיבה לכך ש-262,144 טוקנים של הקשר טבעי רצים על 27B.
• הקשר — 262,144 אסימונים במקור, ניתנים להרחבה ל-1,000,000 באמצעות סקיילינג של YaRN RoPE.
• קלט — תמונה ווידאו מובנים לצד טקסט; מחזיר טקסט.
• Signal — 91,917 הורדות במונה המתגלגל של 30 יום בכרטיס המודל, נבדק ב-15 באוגוסט 2026.
כל הנתונים שלמעלה מגיעים מדף המודל של Hugging Face, מעץ המאגר, ומקובץ התצורה עבור Qwen3.8 27B, שנקראו ב-15 באוגוסט 2026. טענות המידוד בכרטיס (SWE-bench Pro 61.7, LiveCodeBench v6 90.3, OSWorld-Verified 84.3) הן מדווחות על ידי Alibaba; נכון להיום, אף מעבדה עצמאית לא שחזרה אותן.
למה להוריד את זה: שאלת הלוקל מול ה-API
משקלים פתוחים הם הקטגוריה היחידה של מודלים שבה העלות השולית של הרצת טוקן היא בדיוק עלות החשמל שלך. ללא דמי רישיון, ללא מחיר לטוקן, ללא הגבלת קצב, ושום דבר לא יוצא מהמחשב שלך. Qwen3.8 27B מופץ תחת רישיון Apache 2.0, ולכן החופש הזה הוא קבוע: Alibaba לא יכולה למשוך את המשקלים, להחליף את הרישיון שלהם, או לחייב אותך עבורם.
הפשרה היא חומרה והתקנה. משקלי ה-BF16 המלאים דורשים GPU ברמה של 80 GB בדיוק מלא, ומדובר בהורדה רצינית של 55.6 GB. אם ברצונך להעריך את המודל לפני שמתחייבים לכך, מסלול ה-API מהיר יותר: Qwen3.8 27B מוגש ב-OrcaRouter במחיר של Qwen: $0.33 למיליון אסימוני קלט ו-$2.40 למיליון אסימוני פלט, מועבר ללא תוספת מחיר — ו-OrcaRouter מציעה גם מסלול חינמי מוגבל בקצב לאותו מודל, כך שבדיקת עשן ללא עלות אינה דורשת הורדה כלל. אבל ה-API הוא נוחות, לא תלות — המשקלים הם המוצר, והם חינמיים.
מה בעצם יש במאגר
המאגר אינו רק משקלים. הוא חבילה מלאה וניתנת להרצה: 18 שארדים בתוספת קבצי המטא-דאטה ש-Transformers, vLLM ו-SGLang זקוקים להם. נעבור עליו מלמעלה למטה:
• model-00001-of-00018.safetensors … model-00018-of-00018.safetensors — המשקלים, 2.1–3.99 GB לכל שרד, 55.57 GB בסך הכול.
• model.safetensors.index.json — ממפה כל טנזור ל-shard שלו; זה מה שהטוען קורא תחילה.
• config.json — הארכיטקטורה: 64 שכבות, גודל חבוי 5,120, אוצר מילים 248,320, ופריסת Gated DeltaNet / Gated Attention.
• tokenizer.json (12.8 MB), tokenizer_config.json, vocab.json (6.72 MB), merges.txt (3.35 MB) — הטוקנייזר.
• chat_template.jinjaתבנית הצ'אט, כולל בלוק החשיבה; llama.cpp דורש שהיא תועבר כתבנית jinja, אחרת המודל יענה לך בתגי חשיבה.
• preprocessor_config.json ו-video_preprocessor_config.json — עיבוד מקדים של תמונות ווידאו.
• crc32.txt — סכומי בדיקה לכל shard; אמתו הורדה מול הקובץ והעברה פגומה כבר לא תהיה תעלומה.
• README.md (כרטיס המודל בגודל 65 קילו-בייט), LICENSE (Apache 2.0), generation_config.json, .gitattributes (מסמן את קבצי המשקולות כ-Git LFS).

השלכה אחת של פריסה זו חשובה לבעיית המאגר המזויף שלהלן. עותק אמיתי של מאגר זה הוא כבד ושלם. מאגר מציין מיקום עם "Qwen3.8" בשם ושום דבר מלבד README אינו הורדה שנכשלה — הוא מאגר שונה וריק.
איך להוריד אותו — שלוש דרכים
שיטה ראשונה, huggingface-cli, היא הדרך הנקייה ביותר. המודל הוא ציבורי, כך שלא נדרשת התחברות; פעולה זו מושכת את כל 18 החלקים ואת המטא-דאטה לתיקייה:
huggingface-cli download Qwen/Qwen3.8-27B --local-dir Qwen3.8-27B
עבור העברה של 55.6 GB, ה-hf_transfer backend שווה התקנה — הוא מקביל את ההורדה ובדרך כלל מקצר את הזמן בצורה משמעותית:
התקן את hf_transfer באמצעות pip
HF_HUB_ENABLE_HF_TRANSFER=1 huggingface-cli download Qwen/Qwen3.8-27B --local-dir Qwen3.8-27B
שיטה שתיים, git clone, מעניקה לך את המאגר כעותק עבודה עם היסטוריה. דורשת Git LFS:
התקן את git lfs
git clone https://huggingface.co/Qwen/Qwen3.8-27B
שיטה שלישית, הדפדפן — פתח את לשונית Files והורד את השארדים בנפרד. הגיוני רק כשצריך קובץ אחד (למשל, רק config.json כדי לבדוק את הארכיטקטורה). עבור המאגר המלא מדובר ב-18 הורדות ידניות ובדיקת checksum; השתמש ב-CLI.

אילו קבצים באמת כדאי להוריד
המאגר הרשמי הוא BF16 safetensors — דיוק מלא, 55.6 GB — הארטיפקט הנכון אם יש לך GPU ברמת 80 GB, או אם אתה רוצה לכמת למטה בעצמך מאוחר יותר. אין GGUF רשמי. בניית ה‑GGUF שאנשים מריצים בפועל על כרטיסים לצרכן הם שחרורים קהילתיים: Hugging Face מפרט 303 מודלים מכומתים שנבנו מהבסיס הזה (נבדק ב‑15 באוגוסט 2026), והבניינים ש‑runbooks מפנים אליהם הם בנייני unsloth ו‑lmstudio-community. הסולם המשוער:
• BF16 safetensors — 55.6 ג"ב, דורש GPU מסוג 80 ג"ב בדיוק המקורי.
• GGUF Q8_0 — בערך 29 GB, מתאים לכרטיס 48 GB.
• GGUF Q4_K_M — בערך 17 GB, הבחירה הסטנדרטית לכרטיס 24 GB.
• GGUF 2-bit — בערך 9 ג״ב, נדחס לכרטיסים של 12 ג״ב עם אובדן איכות ניכר.
אם אתה רוצה לקבל יכולות ראייה ממבנה GGUF, תצטרך גם את קובץ ה-mmproj הנפרד עבור מקודד הראייה, המתועד בכרטיס הקהילה של כל דגם. לפירוט המלא של הקוונטיזציה וההרצה — כולל אזהרת תבנית הצ'אט של llama.cpp — המדריך שלנו להרצת Qwen3.8 27B מקומית מכיל את הפרטים.
איך להבחין בין הריפו האמיתי לבין המזויפים
לפני שהמשקולות ירדו, החיפוש ב־Hugging Face היה מלא במאגרי "Qwen3.8" ללא קבצי משקולות — כרטיסי מציין מקום ופורקאות שחונים כדי לתפוס אנשים שמחפשים מוקדם. חלקם עדיין קיימים. רשימת הבדיקה לאימות:
• בדקו את המוציא לאור, לא את השם. המאגר האמיתי נמצא תחת הארגון Qwen: Qwen/Qwen3.8-27B. מאגר בשם Qwen3.8 27B תחת חשבון אחר אינו הגרסה הרשמית, לא משנה כמה מקצועי הוא נראה.
• השתמשו באוסף הרשמי. Qwen מתחזקת את huggingface.co/collections/Qwen/qwen38; כל מאגר בו הוא שלהם.
• בדוק את שדה הרישיון. הכרטיס האמיתי אומר Apache 2.0.
• בדוק את הגודל והצורה.המאגר האמיתי כולל 18 חלקי safetensors בהיקף כולל של כ-55.6 GB, קובץ צ’קסאם crc32.txt, ו-README בגודל 65 kB. אפס קבצי משקל פירושו מאגר ריק, לא הורדה שבורה.
• התייחסו למספר ההורדות כאינדיקציה, לא כהוכחה. המאגר האמיתי עבר 91,000 הורדות בתוך יום, מה שאומר לך לאן כולם מצביעים. אבל גם מזויף ניתן להוריד; המפרסם הוא הערובה.
לאחר ההורדה, אמת את התקינות: בדוק את ה-CRC32 של כל shard מול crc32.txt, או טען את המודל עם Transformers וודא ש-state dict נטען ללא אזהרות. כך תתפוס גם העברה מושחתת וגם מודל שגוי שנארז מחדש.
כשההורדה היא הצעד הלא נכון
הורדת 55.6 ג'יגה-בייט אינה הפעולה הנכונה עבור כולם, והגרסה הכנה של המאמר הזה אומרת זאת במפורש.
אתה רק רוצה להעריך את המודל.מסלול ה-API מהיר יותר — בדיקה מובנית עולה סנטים ואורכת דקות, לא הורדה ואחר צהריים של הגדרה.
אין לך GPU קרוב ל-80 GB. הורדת BF16 היא הארטיפקט הלא נכון עבורך. בחר קוונטיזציה של GGUF או את ה-API.
אתה צריך אמות מידה מאומתות. כל נתון עיקרי עבור Qwen3.8 27B הוא מדווח על ידי Alibaba נכון ל-15 באוגוסט 2026. אם ההחלטה שלך תלויה במספרים שמעבדה בלתי תלויה שחזרה, חכה להם — המשקולות עדיין יהיו כאן.
אתה בונה על מודל בן מספר ימים. המשקולות שוחררו ב-14 באוגוסט. דף המודל של OrcaRouter, שנקרא היום, מציג שיעור שגיאות של 33.3% במשך שבעת הימים האחרונים וזמן אחזור חציוני (p50) לאסימון ראשון של 225 אלפיות שנייה — מודל חדש לגמרי תחת עומס מוקדם, לכן התייחסו לנתונים המוקדמים כזמניים. מי שמארח בעצמו צריך לנעול את ה-commit שהוריד ולשמור על גיבוי; משתמשי API צריכים לשמור על כלל מעבר (failover) כאותה הגנה.

אתה רוצה חוזה תמיכה. Apache 2.0 הוא רישיון מתירני, אבל רישיון אינו SLA. אם עומס העבודה שלך זקוק לתמיכת ספק, מסלול ה-API המתארח הוא הבחירה הבטוחה יותר.
השורה התחתונה
המודל האמיתי Qwen3.8 27B נמצא ב-Hugging Face בכתובת Qwen/Qwen3.8-27B, תחת רישיון Apache 2.0, שוחרר ב-14 באוגוסט 2026, ומכיל 55.6 GB של קבצי safetensors בפורמט BF16 ב-18 shards. הורד אותו באמצעות huggingface-cli או git clone, ודא שהמוציא לאור הוא ארגון Qwen, ואז יש בידיך מודל 27B בעל משקלים פתוחים מהמתקדמים ביותר, שאיש לא יוכל לקחת ממך או לחייב אותך עליו. אם זו התחייבות גדולה יותר ממה שמקרה השימוש שלך דורש, אותו מודל נמצא במרחק כמה סנטים דרך ה-API. המשקלים הם העיקר — והם חינמיים.
