
Dots מול Qwen 3.8 Max: ההבדל הוא היכן שמותר לך להזיז אותו
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 349 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 210 tok/s
- OrcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- xAISpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
Qwen 3.8 Max פורסם ב-3 באוגוסט 2026 והוא הדרג בעל היכולות הגבוהות ביותר של Alibaba עד היום: רב-מודלי באופן ילידי, מקבל טקסט, תמונות וווידאו ומחזיר טקסט, על פני חלון הקשר של 1,000,000 טוקנים, מוגש דרך שלושה פורמטי תקשורת — תואם OpenAI, תואם Anthropic ו-DashScope נייטיב — מבייג'ינג, סינגפור, טוקיו, פרנקפורט ווירג'יניה, במחיר של $2.00 למיליון טוקני קלט ו-$6.00 למיליון טוקני פלט, עם קריאות מהמטמון ב-$0.25. Dots הוא הסוכן שפועל תמיד של החברה, שהוכרז ב-DevDay ב-29 בספטמבר 2026: יש לו מחשב ענן ודפדפן משלו, הוא מגיע ליותר מ-4,000 אפליקציות, פועל על GPT-6 Astra, והוא כלול ב-Pro וב-Business Premium. כשמציבים אותם זה לצד זה, השאלה המעניינת אינה מי מהשניים בעל היכולות הרבות יותר. אלא בכמה מקומות כל אחד מהם רשאי להיות, ומי מחליט.
זו אינה הבחנה מופשטת. היא זו שמכריעה אם כלי יהיה זמין בכלל בשוק שלך, אם צוות התאימות שלך יוכל לבצע בו ביקורת, ואם העבודה שאתה בונה עליו תשרוד שינוי בתנאים. היכולת היא החלק הקל בהשוואה הזו; ניידות היא החלק שנקבע מאוחר ובמחיר גבוה.
שלוש דרכים לקרוא למודל אחד
פורמט תקשורת נשמע כמו פרט הנדסי קטן, עד שאתם צריכים להעביר אפליקציה בין ספקים. המשטח התואם ל-OpenAI אומר שספריות לקוח קיימות עובדות בלי שכבת תרגום. המשטח התואם ל-Anthropic אומר שבסיס קוד שנכתב מול מבנה ההודעות של ספק אחר לא צריך להיכתב מחדש. ממשק DashScope המקורי חושף את מלוא מערך התכונות, כולל מתג החשיבה. שלושה משטחים עבור מודל אחד אומרים שהעלות של מעבר היא כתובת בסיס ומפתח, לא ריפקטור.
זה מה שהכי משנה כשזה נעדר. שום דבר בנקודה לא מציע פורמט, כתובת URL או מפתח, כי נקודה היא לא משהו שאתה קורא לו — היא משהו שאתה מדבר איתו בתוך הממשק של מישהו אחר. העברת לוגיקת הסוכן שלך למקום אחר משמעה לבנות אותה מחדש, ואז לחבר מחדש את ארבעת אלפי המחברים שהיא הייתה תלויה בהם, ואז לגלות אילו מהם התנהגו בדרכים שלא רשמת.
• מה שאתה קונה — עובד מתארח בתוך ChatGPT, Slack ו-Teams (Dots) לעומת נקודת קצה של מודל שאתה יכול לקרוא לה מכל מקום (Qwen 3.8 Max)
• ממשקים — לא פורסם אף אחד עבור dot, מול משטחים תואמי OpenAI, תואמי Anthropic ומשטחי DashScope מקוריים (Qwen 3.8 Max)
היכן זה פועל — המחשב בענן של OpenAI עם הדפדפן שלו (Dots) מול חמישה אזורי שירות ברחבי אסיה, אירופה וצפון אמריקה (Qwen 3.8 Max)
• שליטה בהסקה — לא נחשפת עבור נקודה, לעומת enable_thinking כמתג, או reasoning.effort ב-Responses API (Qwen 3.8 Max)
• עלות ליחידה — הנקודה הראשונה כלולה ב-Pro או Business Premium, המכסה אינה מפורסמת (Dots) לעומת $2.00 למיליון קלט ו-$6.00 למיליון פלט, קריאות מהמטמון $0.25 (Qwen 3.8 Max)
• ראיות בלתי־תלויות — הדגמות ספקים והצהרות על יכולות, בלי בנצ׳מרק ולו נקודה אחת, לעומת Artificial Analysis Intelligence Index של 45.4 במקום ה-15 מתוך 145 מודלים שנמדדו ו-92.8 ב-GPQA Diamond (Qwen 3.8 Max)
היכן המודל נוחת, במספרים שאפשר לבדוק
הפרופיל שפורסם של Qwen 3.8 Max הוא פרופיל של חזית ביניים, וכדאי לקרוא אותו בדיוק ולא לפי רושם. מדד AA Intelligence של 45.4, שממקם אותו במקום ה-15 מתוך 145 מודלים שנמדדו, מציב אותו בתוך עשרת האחוזים העליונים בלי להציב אותו בפסגה. מדד AA Coding של 76.2 במקום התשיעי מתוך 138 חזק יותר, ו-88.8 ב-Terminal-Bench 2.1 הוא נתון ביצוע סוכני גבוה באמת — גבוה מ-88.0 של GPT-5.6 Sol באותו לוח. היכן שהוא חלש יחסית הוא בשליפת הקשר ארוך עם 80.3, שנמצא מתחת ל-88.7 של Kimi K3 ול-83 של MiniMax M3 למרות גודל חלון דומה, וב-SciCode עם 52.1.
המיצוב של Alibaba עצמה, במדריך ההגירה שלה, מציב את המודל ישירות מול GPT-5.5, Claude Opus 4.7 ו-Gemini 3.1 Pro, והקריאה הכנה של המספרים היא שזהו מודל שאליו פונים כאשר שילוב של ביצוע אייג'נטי חזק וקלט מולטימודלי חשוב יותר מאשר להיות ראשון בלוח האינטליגנציה. כל הנתונים האלה הם מדידות של צד שלישי המובאות יחד עם המקורות שלהן בקטלוג שלנו, ולא טענות של הספק — וזו הסיבה שהן שוות יותר ממצגת השקה.
מספר אחד חסר ויש לומר אותו בקול רם במקום למלא אותו: הקטלוג שלנו אינו מפרט אורך פלט מקסימלי עבור הדגם הזה. הקשר של מיליון טוקנים מתועד; תקרת פלט לכל תגובה אינה מתועדת.

מה Dots לא מספר לך, ולמה זו בחירה עיצובית
OpenAI פרסמה משפט אחד על כמה עולה נקודה, והוא אינו מכיל מספר: הנקודה הראשונה כלולה ב-Pro וב-Business Premium, עם מגבלות מורחבות בחודש הראשון וללא גריעה ממגבלות השימוש של ChatGPT בשיחות איתה. מעבר לכך אין נתון מכסה, אין מחיר לנקודה שנייה, אין תעריף לקיבולת נוספת, ואין עלות לכל משימה. מסלול Pro 500 ב-500 דולר לחודש הוא מכסת שימוש בתוספת מצב Ultrafast ולא תעריף לנקודה, כך שאפילו התוכנית היקרה ביותר אינה מתורגמת לעלות ליחידת עבודת סוכן.
מפתה לפרש זאת כפער תיעודי. מדויק יותר לפרש זאת כקטגוריה: מוצר בתמחור לפי מושבים לא יכול להיות בעל מחיר ליחידה, מפני שכל הרעיון של מושב הוא שהעלות השולית של השימוש בו אינה נראית. זה ממש נוח לעבודת חקר וממש לא נוח לכל דבר שעליך לייחס לפרויקט, ללקוח או לשורת תקציב.
שימו לב למה ששני המוצרים ממוטבים עבורו. Qwen 3.8 Max ממוטב להיקרא מכל מקום, על ידי כל דבר, ובכל פורמט שהקורא כבר מדבר בו. נקודה ממוטבית לשימוש במקום אחד, על ידי ממשק אחד, כשהצנרת מוסתרת. שניהם עיצובים קוהרנטיים; הם רק עונים על שאלות שונות, ואחד מהם עונה לשאלה "האם אוכל להעביר את זה אחר כך" ב"לא".

שתי תשובות ל"מה אם הספק הזה ישתנה"
שאלת הניידות הופכת קונקרטית ברגע שספק משנה מחיר, מפסיק לתמוך במזהה או משנה את מה שכלול במנוי. עבור מודל מחויב לפי שימוש עם שלושה פורמטי תקשורת, התגובה מכנית: הפנו את הלקוח לכתובת בסיס אחרת, או שנו מחרוזת מודל אחת, והאפליקציה ממשיכה לעבוד. אין שום דבר אחר להסב, כי המודל מעולם לא היה אלא קריאה.
עבור dot, התגובה לשינוי בתנאים היא להפסיק. המחשב, הדפדפן, המחברים והמכסה כולם שייכים ל-OpenAI, ואף אחד מהם לא ניתן לייצוא. זו אינה ביקורת על המוצר; זהו תיאור כן של שכירות. אבל זה כן אומר שעבודה שאתה בונה כולה בתוך dot יש לה מסלול הגירה שעובר דרך שכתוב מחדש, וזו עובדה שכדאי לקחת בחשבון לפני שאתה בונה משהו שאתה מתכוון להיות תלוי בו לשנה.
OrcaRouter בנוי למקרה הראשון. Qwen 3.8 Max מנותב כ-qwen/qwen3.8-max במחיר המחירון של הספק של Alibaba, מועבר עם 0% תוספת, בתוך אותו קטלוג כמו יותר מ-200 מודלים אחרים מאחורי מפתח אחד, עם מעבר אוטומטי בין ספקים במעלה הזרם ו-DSL לניתוב להרכבת מספר מודלים לבקשה אחת. זה מה שהופך את שאלת שלושת האזורים לכזו שניתן לענות עליה מצידך ולא מצד הספק: אותו מזהה מגיע למודל בכל מקום שבו הוא מוגש, ושינוי תעריף מ-Alibaba מגיע לחשבון שלך באותו יום במקום בחידוש הבא. מה שזה לא מגיע אליו הוא כל דבר בתוך נקודה — אין נקודת קצה לאחת, אין מזהה, ואין תחליף אינטליגנציה להחליף.
השאלה שצריך לשאול לפני שאתם מתחייבים
שאל מה יקרה לעבודה שלך ביום שבו הספק ישנה משהו שאין לך שליטה עליו. אם התשובה היא "אנחנו משנים מחרוזת וממשיכים הלאה", אתה קונה מודל, והמודל בתשלום לפי שימוש הוא הקנייה הטובה יותר. אם התשובה היא "נצטרך לבנות אותו מחדש", אתה קונה מוצר, וכדאי שתקנה אותו בכוונה תחילה — בידיעה שהנוחות שאתה משלם עליה נקנית במחיר היכולת לחזור בך.
אף אחת מהתשובות אינה שגויה. לקנות ניידות שלעולם לא תשתמש בה בזבזני כמו לקנות נוחות שתצטרך להימלט ממנה. הטעות היא לא לדעת איזו מהן קנית.

השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
