
Qwen3.8-27B-Uncensored-FP8: מה ששיחררנו, ולמה זה מיועד למחקר בלבד
- obsidianחדשQwen3.8 27B Uncensored (Aggressive)2026-08-15$0.40 / $4.21 לכל 1M טוקנים · 18 tok/s
- qwenחדשQwen: Qwen3.8 27B (free)2026-08-1335 tok/s
- deepseekחדשDeepSeek: DeepSeek V4 Pro 08132026-08-1253אינטליגנציה69כתיבת קוד
- grokחדשSpaceXAI: Grok 4.62026-08-1261אינטליגנציה77כתיבת קוד
- metaחדשMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים · 2341 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0957אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0961אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0856אינטליגנציה72כתיבת קוד
- tencentTencent: Hy32026-07-0642אינטליגנציה59כתיבת קוד
שחררנו את Qwen3.8-27B-Uncensored-FP8 היום — גרסת block-FP8 מקומית ומנוטרלת של Qwen3.8 27B של Qwen, המתארחת ב-orcarouter/Qwen3.8-27B-Uncensored-FP8 ב-Hugging Face. הפוסט הזה הוא הגרסה הכנה של מה שהוא, מה עשינו, ו— החשוב ביותר — למה הוא לא מיועד.
מהו המודל הזה
Qwen3.8 27B הוא מודל ראייה-שפה (vision-language) מקורי, צפוף, בעל 27 מיליארד פרמטרים, עם מנגנון קשב היברידי (Gated DeltaNet linear + full attention), בקרת חשיבה גמישה, יכולת קריאה לכלים (tool-calling), וראש פענוח ספקולטיבי (MTP speculative-decoding head). מבנה ה-FP8 מבצע קוונטיזציה מחדש לסכמת ה-FP8 המדויקת של Qwen3.8-27B-FP8 הרשמי, כך שהוא פועל על אותו נתיב קרנל (kernel) של vLLM — קונטקסט של 262K, כלים, חשיבה ו-MTP נשמרים כולם.
מה שמייחד את הבנייה הזו הוא המילה שלפני FP8: לא מצונזר. יישמנו abliteration — אורתוגונליזציה של כיוון הסירוב מתוך זרם השיירים — כדי להסיר את סירובי יישור הבטיחות של המודל. התוצאה היא מודל שייענה לבקשות שהמודל המקורי היה מסרב להן.
שני פריטי מפתח:
• מאגר Hugging Face — orcarouter/Qwen3.8-27B-Uncensored-FP8 — safetensors, Apache 2.0, block-FP8 E4M3, image-text-to-text.
• כרטיס מודל על OrcaRouter — פעיל תחת קו הקטלוג Obsidian שלנו, עם תמחור ומדדי ביצועים.
למה שחררנו את זה
מכיוון שמנגנוני סירוב הם נושא מחקר לגיטימי. צוותי פרשנות חוקרים כיצד כיווני סירוב מקודדים בזרם השיורי. חוקרי בטיחות בוחנים מה קורה כאשר יישור מוסר. פעילות של צוות אדום דורשת מודלים שאינם מסרבים, כדי שתוכל לבדוק את המעקות שלך נגד משהו שמנסה באופן אקטיבי לעקוף אותם. מודלים מסורסים (abliterated) הם כלי סטנדרטי בערכה זו.
בנינו את זה על המשקלים הפתוחים של Qwen (Apache 2.0) ושחררנו אותו מחדש תחת אותה רישיון. המטרה היא לתת לחוקרים baseline abliterated ידוע ובר-שחזור — אותה ארכיטקטורה, אותו נתיב הגשת FP8, רק משתנה אחד שונה.
החלק שחובה לקרוא לפני ההורדה
יישור הבטיחות של מודל זה הוסר במידה ניכרת. ליתר דיוק:
• הוא ייענה לבקשות מזיקות, לא אתיות, פוגעניות או בלתי חוקיות, שאליהן ה-Qwen3.8 27B המקורי היה מסרב. אין לו מנגנוני הגנה מובנים משמעותיים.
• הוא משוחרר אך ורק למחקר לגיטימי — חקר יכולת פרשנות, בטיחות בינה מלאכותית וחקר מנגנוני סירוב, רד־טימינג, הערכת חוסן, וניסויים מבוקרים.
• אתה נושא באחריות מלאה ובחבות מלאה לאופן השימוש שלך בו ולכל מה שהוא מייצר. אל תפרוס אותו למשתמשי קצה או בסביבת ייצור מבלי להוסיף שכבות אבטחה, ניטור ומניעת שימוש לרעה משלך.
השימוש חייב לעמוד ברישיון Apache 2.0.
אם מקרה השימוש שלך הוא מוצר ייצור, צ'אטבוט, או כל דבר שמשרת משתמשי קצה — זה לא המודל בשבילך. השתמש ב-Qwen3.8 27B הסטנדרטי, ששומר על יישור הבטיחות שלו.
איך להשתמש בזה
אם אתה עורך מחקר לגיטימי ומבין את האמור לעיל:
• הורד אותו מ-Hugging Face: orcarouter/Qwen3.8-27B-Uncensored-FP8
• או גש אליו דרך כרטיס המודל שלנו, הכולל את פרטי התמחור והמדדים.
• הוא פועל על נתיב הגרעין הסטנדרטי של vLLM עם הקשר של 262K, כלים, חשיבה ו-MTP בשלמותם.
אנחנו משחררים את זה כי מחקר על הסרת סירוב הוא אמיתי וחסר התייחסות. אנחנו גם משחררים אותו עם כתב ויתור שלא מסתיר את מהותו. קראו אותו, הבינו אותו, והשתמשו בו בגבולות שנועדו לו.
עבור מחקר לגיטימי, המשקלים נמצאים ב-Hugging Face: משוך אותו מ-Hugging Face
