
Qwen-Image-2.1-Turbo: צ׳קפוינט בן 8 שלבים שהעביר את לוח הזמנים אל תוך המשקולות
- OrcaחדשOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 לכל 1M טוקנים · 69 tok/s
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 120 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 367 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
המאגר של Qwen-Image-2.1-Turbo הופיע ב-Hugging Face ב-9 באוקטובר 2026, והדבר המעניין ביותר בו אינו מספר הצעדים. יש בו משקולות bfloat16, כרטיס מודל עם קוד שניתן להריץ, קובץ רישיון, שמונה תמונות תצוגה, ושורה אחת ברשימת החדשות ב-GitHub של פרויקט Qwen-Image-2.1 שמכריזה על ההשחרור. אין פוסט בלוג משלו, אין טבלת בנצ'מרקים, אין גל תקשורתי, ואין כל שינוי בתנאים שבהם Qwen-Image-2.1 מופץ. Turbo הוא צ'קפוינט מואץ של Qwen-Image-2.1 ליצירת תמונות מטקסט ולעריכת תמונות שרץ בשמונה צעדי הסרת רעש במקום ארבעים שהדוגמאות של מודל הבסיס עצמו משתמשות בהן. הוא גם משנה בשקט מאין מגיע לוח הזמנים של הדגימה — וזה החלק שישבור קוד.
מה נמצא בפועל במאגר
הכרטיס קצר וספציפי באופן יוצא דופן, מה שמקל להפריד בין מה שמאושר לבין מה שמשתמע.
• מה זה: הכרטיס מתאר את Qwen-Image-2.1-Turbo כ"נקודת ביקורת מואצת של Qwen-Image-2.1 ליצירת תמונות מטקסט ולעריכת תמונות עם 8 צעדי הסרת רעש". זוהי אינה ארכיטקטורה חדשה ואינה משפחת מודלים חדשה. זהו אותו רכיב יצירה חזותית בגודל 7B, ארוז מחדש סביב מסלול דגימה קצר בהרבה.
• איך זה נטען: דרך QwenImage21Pipeline ב-Diffusers, אותה מחלקת pipeline שהמודל הבסיסי משתמש בה, כששם ה-checkpoint מוחלף. המטא-נתונים של המאגר עצמו מצהירים על base_model: Qwen/Qwen-Image-2.1 ו-library_name: diffusers, ונושאים base_model:finetune:Qwen/Qwen-Image-2.1 כתג שני. כלומר, הספק מתאר זאת ככוונון עדין (fine-tune) של ה-checkpoint הבסיסי, ולא כאח.
• מה הוא משמר: אותה ארכיטקטורת יצירה חזותית 7B, אותן שבע הגדרות רזולוציה מוגדרות מראש כמו ב-Qwen-Image-2.1 (ריבוע 2048 × 2048, 4:3 ב-2400 × 1792, 3:4 ב-1792 × 2400, 3:2 ב-2528 × 1696, 2:3 ב-1696 × 2528, 16:9 ב-2752 × 1536 ו-9:16 ב-1536 × 2752), ואת אותן שתי היכולות — יצירת תמונה מטקסט ועריכת תמונה מונחית הוראות. התצוגה של הכרטיס מאורגנת לפי קטגוריה: צילום פורטרטים, תנוחות ותנועה של בני אדם, יצירת RGBA שקופה, טיפוגרפיה ועיצוב פוסטרים, ממשק משתמש ופריסת מידע, טרנספורמציה של תמונה בודדת, קומפוזיציה מרובת הפניות, וקומפוזיציית פנים בת ארבע תמונות.
• מה שהוא לא כולל: שום מספר הערכה. אין ציון Qwen-Image-Bench עבור ה-checkpoint של Turbo על הכרטיס, ואין השוואה מול מודל הבסיס. הציון היחיד בכל מקום בסדרת Qwen-Image-2.1 נשאר תוצאת ה-Qwen-Image-Bench של מודל הבסיס עצמו, שהוא נתון שדווח על ידי הספק ונמדד על checkpoint הבסיס — לא על זה.

לוח הזמנים חי כעת במשקלים, וזהו השינוי האמיתי.
הנה המשפט החשוב ביותר בכרטיס, והוא קבור מתחת להוראות ההתקנה: הצ'קפוינט "כולל את לוח זמני הדגימה המומלץ שלו, כך שהוא מוכן לשימוש בלי להגדיר ידנית את המתזמן."
ואז התוצאה, שנאמרת בפשטות בסעיף הדגימה: "לוח זמני הדגימה המומלץ של 8 שלבים נשמר עם נקודת הביקורת ונטען אוטומטית. הגדרת num_inference_steps לבדה אינה עוקפת אותו."
קרא את זה פעמיים. במוסכמה של Diffusers שרוב האנשים נושאים בראשם, מספר הצעדים הוא ארגומנט בזמן קריאה — אתה מעביר num_inference_steps=40 עבור מודל הבסיס, num_inference_steps=4 עבור צ'קפוינט מזוקק, והפייפליין בונה לוח זמנים בהתאם. Qwen-Image-2.1-Turbo שובר את המוסכמה הזו. לוח הזמנים של שמונה צעדים הוא מטא-נתונים של הצ'קפוינט, לא פרמטר בקשה. אתה יכול להעביר מספר שלם אחר והפייפליין עדיין ישתמש בלוח הזמנים השמור. הכרטיס אומר שהדרך היחידה לעקוף אותו היא להעביר ארגומנט sigmas מפורש בזמן הקריאה, ומוסיף שלוחות זמנים אחרים "לא הוערכו עבור הצ'קפוינט הזה".
המשמעות המעשית היא מלכודת שחזור. קוד שנלקח מכרטיס המודל של Qwen-Image-2.1 ומופנה אל מאגר Turbo ירוץ, לא יפיק שגיאה, ולא יפיק את הפלטים שמציגה התצוגה של Turbo. הוא גם ידרוש בנייה של Diffusers שמבינה סיגמות דגימה המוגדרות בתצורת ה-pipeline — תמיכה שנוספה ב-Diffusers PR #14950, שנכון לזמן כתיבת הדברים נמצאת בעץ המקור ולא במהדורה מתויגת. ההתקנה המוצהרת היא בנייה של PyTorch תואמת CUDA בתוספת git+https://github.com/huggingface/diffusers.git, transformers>=5.17.0, accelerate ו-pillow.
שתי ברירות מחדל נוספות מגיעות מהכרטיס ולא ממשהו שהגדרתם: היצירה משתמשת כברירת מחדל ב-CFG 1, ומטמון KV של הקידומת „עושה שימוש חוזר בהקשר של הטקסט ותמונת ההפניה לאורך שלבי ה-denoising”. CFG 1 פירושו ללא מעבר classifier-free guidance, וזה חלק גדול מהאופן שבו המסלול מתקצר בלי לקרוס — וזו גם הסיבה לכך שהכרטיס לא טורח להציע המלצה לגבי guidance scale. מטמון ה-KV של הקידומת הוא הירושה של מודל הבסיס: אותו מנגנון שבו Qwen-Image-2.1 משתמש כדי לעשות שימוש חוזר בהקשר של טקסט ותמונת הפניה, מה שחשוב יותר, ולא פחות, כאשר לולאת ה-denoising היא באורך שמונה איטרציות בלבד.
הוכרז ביומן שינויים, סופק כמאגר
המסגור המתאים לגרסה הזו אינו "השקה" ואינו "הדלפה". מדובר בארטיפקט שנכנס לריפוזיטורי, עם שורה מתוארכת ברשימת חדשות. רשימת החדשות ב-GitHub של פרויקט Qwen-Image-2.1 כוללת שני ערכים מתוארכים ל-2026.10.09: אחד עבור צ'קפוינט Turbo, ואחד שמציין שממשקי ה-API של Qwen-Image-2.1 Pro ו-Turbo "זמינים כעת באופן רשמי" ב-Alibaba Cloud Model Studio. אין פוסט בלוג נפרד ל-Turbo; קישור הבלוג בכרטיס מפנה לבלוג של Qwen-Image-2.1 מ-20 בספטמבר 2026.
השוו זאת לאופן שבו הגיע מודל הבסיס שלושה שבועות קודם לכן. ברשימת החדשות של Qwen-Image-2.1 יש רשומה מתוארכת עבור המשקלים, ואחריה חמש נוספות באותו היום: תמיכת Diffusers מהיום הראשון דרך PR #14804, תמיכה נייטיבית ב-ComfyUI מהיום הראשון, תמיכת vLLM-Omni עם הרצה צעד-אחר-צעד ומטמון KV של prefix וכימות FP8 ומקבוליות טנזורים, תמיכת SGLang עם Cache-DiT וגרפי CUDA, והאצה מהיום הראשון מ-LightX2V. לצ'קפוינט Turbo אין דבר מכל זה. כל אחת מרשומות האקוסיסטם האלה מתייחסת ל-Qwen-Image-2.1.

מוני המאגר מספרים את אותו סיפור על בגרות ולא על ערך, והם תמונת מצב ולא פסק דין: בזמן כתיבת שורות אלה, Qwen-Image-2.1 מציג 122,311 הורדות בחודש האחרון ו-3,142 לייקים, ואילו Qwen-Image-2.1-Turbo — בן כמה שעות — מציג 33 לייקים. הורדות הן מדד מאחר, ומספר ה-Turbo ישתנה. מה שזה אומר לך היום הוא רק שאף אחד עוד לא הספיק להריץ אותו.
מה ששמונה שלבים לא מספרים לך
מספר הצעדים הוא הכותרת והמספר הכי פחות שימושי בפרסום, משלוש סיבות שראוי לציין אותן בפשטות.
• צעדים אינם שניות. לא הכרטיס ולא המאגר מפרסמים תפוקה, השהיה או זיכרון עבור Turbo checkpoint. שמונה צעדים ב-2048 × 2048 על מודל 7B bfloat16 הם עומס עבודה שונה משמונה צעדים על מודל קטן יותר, והכרטיס לא מציין על איזו חומרה הוא נמדד מכיוון שהוא לא מדווח על מדידה בכלל.
• עדיין אין עוגן איכות. אין ציון מפורסם עבור Turbo, אין השוואה זה לצד זה מול צ'קפוינט הבסיס, ואין הערכה בלתי תלויה לאף אחד מהם. תמונות התצוגה הן פלטים שנבחרו בידי הספק בהגדרות המומלצות של הספק. הן עדות לכך שהמודל מפיק תמונות; הן אינן עדות למידת האיכות שהוקרבה בתמורה להפחתת הצעדים, והן אינן תחליף לבנצ'מרק.
• הנחיות זיכרון חסרות. הכרטיס של המודל הבסיסי כולל מדור לאופטימיזציית זיכרון; כרטיס ה-Turbo מתעד התקנה, יצירה, עריכה, דגימה ויחסי גובה-רוחב, ועצירות. אם אתם מתכננים להריץ זאת כשירות, תכננו למדוד.

הרישיון נשאר ללא שינוי, וזו הכותרת עבור כל מי שמשיק
Qwen-Image-2.1-Turbo ניתן ברישיון במסגרת הסכם רישיון Qwen Research. המטא-נתונים של המאגר מציינים license: other עם license_name: qwen-research ו-license_link: LICENSE, וקובץ LICENSE קיים במאגר לצד המשקלים. מקטע הרישיון של הכרטיס עצמו אומר משפט אחד: המודל ניתן ברישיון במסגרת הסכם רישיון Qwen Research.
האצה לא משנה דבר בנוגע לכך. רישיון מחקר לא-מסחרי על המודל הבסיסי אינו הופך לרישיון מסחרי בגלל שהצ'קפוינט מהיר יותר, ומאגר ה-Turbo הוא הורדה נפרדת באותם תנאים. אם העניין שלך ביצירה בשמונה שלבים הוא בכך שהיא הופכת את המודל לזול מספיק כדי לשלב אותו במוצר, הרישיון הוא המגבלה, לא מספר השלבים. השאלה הזו צריכה להיות מופנית לספק; היא אינה נענית בשום מקום במאגר הזה.
הנתיב המתארח, והיכן ש-OrcaRouter יושב בו
OrcaRouter לא מנתב את Qwen-Image-2.1-Turbo, והוא לא מנתב את Qwen-Image-2.1. אף אחד מהשניים אינו מופיע בקטלוג שלנו, ואין לקרוא דבר במאמר זה כהצעה לספק אותם. אם אתם רוצים את אחד מהשניים, הדרכים הן ממשקי ה-API של הספק עצמו ומספר פלטפורמות של צד שלישי, או המשקלים עצמם עם בילד של Diffusers חדש מספיק כדי לטעון את לוח הזמנים השמור של הצ'קפוינט Turbo.
מה שאנחנו מציגים בחזית הוא קו התמונות המאוחסנות שלנו, וכדאי לדעת מה נמצא בו כדי שתוכל להעמיד אותו לצד הניסוי באחסון עצמי. OrcaRouter מציב למעלה מ-200 מודלים מאחורי נקודת קצה אחת תואמת OpenAI במחיר המחירון של הספק וללא תוספת — כך שכאשר ספק מוזיל מחיר, ההנחה פעילה אצלנו באותו יום במקום להמתין לסבב תמחור מחדש. הוא מוסיף מעבר אוטומטי לגיבוי כאשר ספק נחלש, שפת DSL לניתוב לציון אילו מודלים וספקים בקשה רשאית להשתמש בהם, ומיזוג מודלים לשילוב כמה מודלים לקריאה אחת. מודלי התמונות שאנחנו מנתבים הם משפחת GPT-Image של OpenAI, דרגות Imagen 4 של Google כולל וריאנטי fast ו-ultra, נקודות הקצה לתצוגה מקדימה של תמונות Gemini של Google, ונקודת הקצה לתמונות Grok Imagine של xAI.
הצורה הכנה של ההחלטה: אם אתה צריך מודל 7B עם משקולות פתוחות בשמונה שלבים שאתה יכול לבחון ולשנות, Turbo הוא עבודה באירוח עצמי, והרישיון הוא הדבר שצריך להסדיר קודם. אם אתה צריך נקודת קצה לתמונות בפרודקשן השבוע, זו רכישה אחרת, והיא זו שאנחנו מוכרים.
מה ניתן לומר, ומה לא ניתן
• מאושר על ידי המאגר עצמו: צ'קפוינט מואץ 7B של Qwen-Image-2.1 שמבצע יצירת טקסט-לתמונה ועריכת תמונות בשמונה שלבי הסרת רעש; לוח זמני דגימה שמור ש-num_inference_steps אינו עוקף; CFG 1 כברירת מחדל; מטמון KV מקדים עבור הקשר טקסט ותמונת ייחוס; אותם שבעה פריסטים של רזולוציה כמו במודל הבסיס; נתיב טעינה של QwenImage21Pipeline; רשומת מהדורה מתוארכת ל-9 באוקטובר 2026 ברשימת החדשות של הפרויקט עצמו; ואותו הסכם רישיון Qwen Research License Agreement כמו במודל הבסיס.
• לא נקבע בשום מקום:שום מדידת איכות עבור צ'קפוינט Turbo, שום מדידת מהירות או זיכרון, שום הערכה בלתי תלויה של צ'קפוינט הבסיס שממנו הוא נגזר, שום הצהרה לגבי תנאים מסחריים מעבר לרישיון המחקרי, ושום תמיכת פריימוורק מהיום הראשון מהסוג ש-Qwen-Image-2.1 הגיעה איתו.
שמונת הצעדים הם המספר שיצוטט. לוח הזמנים שעבר לתוך המשקולות הוא הפרט שקובע אם ההרצה הראשונה שלך משחזרת משהו.
