תמונת מצב מתאריך 2 בספטמבר 2026 של Qwen3.8 Max, דגם ההסקה המולטי-מודאלי הדגל של Alibaba: קלט של טקסט + תמונה + וידאו, פלט של טקסט, והקשר של 1M טוקנים. אותן יכולות ואותו תמחור כמו דגם הבסיס; הצמד אותו לקבלת התנהגות ניתנת לשחזור.
Qwen3.8 Max (0902) הוא ערך מודל ב-OrcaRouter מספק בשם qwen, שפורסם עם מזהה המודל qwen/qwen3.8-max-0902. הסימון 0902 מוצג ברישום, אך העובדות שסופקו אינן מסבירות אם הוא מציין תאריך שחרור, checkpoint,…
המודל תומך בחלון הקשר של 1,000,000 טוקנים. זהו סך הקלט שהמודל יכול להתייחס אליו בבקשה אחת, כולל תוכן הטקסט, התמונות והווידאו שבהנחיה. אין מגבלה נוספת שניתנה בעובדות, ולכן המגבלות המעשיות תלויות באופן שבו OrcaRouter וספק השירות אוכפים טוקניזציה ומגבלות זמן לבקשות. עבור טקסט ארוך, 1,000,000 טוקנים מאפשרים שילוב מסמכים מהותיים רבים בהנחיה אחת, מה שמפחית את הצורך בפיצול או בסיכום לפני קריאה למודל. עבור וידאו, העובדות אינן מציינות כמה טוקנים נצרכים לשנייה, לפריים או לקובץ וידאו, ולכן יש להעריך לפי מטא-דאטה או לפי קריאות בדיקה. חשוב גם לזכור שגודל חלון ההקשר אינו מעיד על מידת הדיוק של המודל בהנחיה של 1,000,000 טוקנים; לא סופקו נתוני בנצ'מרק. אם היישום שלך דורש איכות מדויקת להקשר ארוך, הערך על מדגם מסמכים משלך לפני שעוברים לייצור.
בהתחשב בכך שטקסט, תמונה ווידאו מתקבלים כקלטים, ניתן לבקש מהמודל לחשוב על חומר מקור שמשלב סוגים אלה באותה בקשה. דוגמאות כוללות קריאת הוראות בטקסט, בחינת תמונה והתייחסות לווידאו בעת הפקת תשובה. דף העובדות של הספק אינו מפרט יכולות ספציפיות למשימה כגון OCR, זיהוי עצמים או חשיבה זמנית על וידאו, ולכן אין להניח התנהגויות אלה. מה שניתן לצפות מהמודל תלוי בעיקר ביכולותיו המאומנות, שאינן מתועדות בעובדות שסופקו. התכנון הבטוח הוא להשתמש בו למשימות הדורשות פלט טקסט מהנחיה עם מודאליות מעורבת, ושביכולתן לשאת בעלות אחסון תמונות ווידאו כאסימוני קלט. אם עומס העבודה הוא טקסט בלבד, מודל אחר ללא קלט תמונה ווידאו עשוי להיות פשוט יותר. אם משימה דורשת פעולות וידאו ברמת חותמת זמן מדויקת, כרטיס המודל אינו מספק ראיות לכך שהתנהגות כזו אמינה.
בחירה במודל זול יותר הגיונית כאשר המשימה אינה דורשת את התכונות שמגדירות רישום זה. שאלת טקסט קצרה אינה זקוקה להקשר של 1,000,000 אסימונים או לתקרת פלט של 131,072 אסימונים. זרימת עבודה מבוססת טקסט בלבד אינה זקוקה לקלט של תמונות או וידאו. OrcaRouter מחייב עבור מודל זה $2.00 לכל 1,000,000 אסימוני קלט ו-$6.00 לכל 1,000,000 אסימוני פלט. אם לחלופה זולה יותר יש מחירים נמוכים יותר לאסימון, ותמיכה הולמת בהקשר ובמודאליות, היא תפחית את העלות. אין בעובדות המסופקות מדדי השוואה של איכות או מהירות, ולכן לא ניתן להצדיק בחירה במודל זה על פני מודלים אחרים באמצעות דיוק מדוד; יש להצדיק אותה לפי דרישות מוצר מפורשות: הקשר גדול, קלט מעורב של טקסט/תמונה/וידאו, או פלט ארוך ביצירה אחת. מכיוון שמחיר הקלט חל על כל אסימון בהקשר, קריאות עם הקשר גדול מאוד עשויות לעלות יותר מקריאות קטנות יותר, אפילו כששאלת המשתמש קצרה, לכן הימנעו מהוספת תוכן עודף להנחיות.
הנתונים המוצהרים עבור Qwen3.8 Max (0902) אינם כוללים ציוני benchmark, ערכות הערכה או נתוני דיוק. לכן, כל אמירה על איכות המודל תהיה ספקולציה, ו-OrcaRouter אינה מפרסמת ציונים משוערים. אם אתה צריך מספר כדי להשוות מועמדים, הרץ בדיקות משלך על קלטים מייצגים, כולל מקרי התמונה והווידאו שאתה מצפה לשלוח. benchmark כגון מבחן ידע ציבורי לא יגלה לך עד כמה המודל מתמודד עם prompt וידאו ספציפי של 1,000,000 token. זכור ששם מודל כמו Max הוא תווית, לא עדות לאיכות. הדברים המדידים ברישום זה הם חלון ההקשר, אורך הפלט המרבי, מודאליות הקלט והמחיר. מאפיינים אלה משפיעים על האם עומס עבודה מתאים, אך הם אינם מתארים דיוק, עומק חשיבה, מעקב אחר הוראות או התנהגות בטיחותית. התייחס ליכולות בתחומים אלה כלא מאומתות אלא אם כן תבצע הערכה.
הנתונים על המודל אינם כוללים קצבי אסימונים לשנייה, נתוני זמן עד לתגובה הראשונה, הנחיות לזמן קצוב לבקשות, או כל מדידת ביצועים אחרת. OrcaRouter אינה מצהירה על נתון השהיה עבור מודל ספק זה. המהירות תהיה תלויה בתשתית השרתים של הספק, בגודל הקלט, ובכמות הפלט המבוקשת. קלט של 1,000,000 אסימונים ופלט של 131,072 אסימונים צפויים להימשך זמן רב יותר מבקשה קצרה, אך הרישום אינו מציין קשר מספרי מדויק. קלט וידאו עלול גם הוא להחמיר את ההשהיה, כיוון שיש לעבד אותו לאסימונים לפני שהמודל יכול להתייחס אליו; הנתונים אינם מכמתים שלב זה. סוקרים לא צריכים להניח שתמחור נמוך לאסימון מרמז על פענוח מהיר. ההחלטה היחידה הקשורה למהירות שנתמכת על ידי הנתונים היא לבדוק גדלי בקשות מייצגים תחת העומס הצפוי לכם. אין להסיק התאמה לזמן אמת מגודל חלון ההקשר או משם המודל.
החוזקות המוצהרות הן מבניות. למודל יש חלון הקשר של 1,000,000 טוקנים, פלט מקסימלי גבוה של 131,072 טוקנים, והוא מקבל קלטי טקסט, תמונה ווידאו. תכונות אלה שימושיות ליישומים שצריכים קריאה אחת למודל כדי לצפות בגוף חומר גדול או מעורב לפני כתיבת תגובה ארוכה. המגבלות גם קלות יותר לציון מהעובדות מאשר החוזקות. לא פורסמו מדדי איכות, ולכן דיוק, חשיבה ובטיחות אינם מתועדים. אין רישום נפרד לנתוני האימון, הערות השחרור או מתודולוגיית העדכון מאחורי התווית 0902. קלט תמונה ווידאו אינו מבטיח הבנה חזותית או זמנית מדויקת. מגבלות ההקשר והפלט הן מקסימום, לא שימוש מומלץ; פלטים גדולים מאוד עשויים להיות יקרים במחיר של $6.00 לכל 1,000,000 טוקני פלט. בקשה שממלאת את הקשר של 1,000,000 טוקנים תצרוך $2.00 של טוקני קלט לפני שנוצר פלט כלשהו, דבר שהוא עלות תפעולית משמעותית.
המחירים ליחידה הרשומים הם $2.00 עבור כל 1,000,000 טוקני קלט ו-$6.00 עבור כל 1,000,000 טוקני פלט. OrcaRouter מחייב עבור המודל בתעריף הספק ללא תוספת מחיר, ולכן המחיר המוצהר הוא תעריף הספק שמועבר ישירות. טוקיני קלט כוללים את טוקני הטקסט, התמונה והווידאו שנשלחים בהנחיה (prompt). טוקיני פלט הם טוקני התשובה שנוצרים. בתעריפים אלה, 1,000,000 טוקיני קלט עולים $2.00; 1,000,000 טוקיני פלט עולים $6.00. בקשה קטנה יותר עולה פחות באופן יחסי: 100,000 טוקיני קלט יעלו $0.20 ו-100,000 טוקיני פלט יעלו $0.60, ובלבד שכמויות אלה נמדדות על ידי הספק. כרטיס המודל (model card) אינו כולל תמחור נפרד עבור קלט במטמון (cached input), בקשות אצווה (batched requests) או מסלולים אינטראקטיביים, ולכן אין להניח קיומם של מחירים כאלה. יש לבדוק את ספירות הטוקנים המדויקות שחויבו מתוך תגובת השימוש או הלוגים של OrcaRouter עבור כל קריאה.
כאשר OrcaRouter אומרת שמודל מחויב לפי תעריף הספק ללא תוספת מחיר (zero markup), הכוונה היא ש-OrcaRouter אינה מוסיפה עמלת פר-טוקן משלה מעל לתעריף הספק עבור רישום זה. לכן, הסכום הסופי עבור שימוש בטוקנים צריך להתבסס על המחירים המוצהרים של $2.00 לקלט ו-$6.00 לפלט לכל 1,000,000 טוקנים. אין זה אומר בהכרח שלחשבונית הסופית אין חיובים אחרים; מסים או עמלות ברמת החשבון עשויים לחול בהתאם להסדר שלך, אך אין תיעוד לעמלות כאלה בעובדות אלה. זה גם לא אומר שהמודל חינמי לשרת, כי התעריף הפר-טוקן עדיין חל. בעת השוואת ספקים, המחיר ש-OrcaRouter מציגה עבור מודל זה אמור לייצג את אותן יחידות כמו ברישום זה. אם שער גישה (gateway) אחר מצטט מחיר שונה, ההבדל הוא במבנה החיוב, לא בשינוי בחלון ההקשר (context window) של המודל.
ניהול עלויות צריך להתחיל מאורך ה-prompt. מכיוון שעלות הקלט היא $2.00 לכל 1,000,000 טוקנים, כל טוקן נוסף מעלה את החיוב על הקלט, וכל תמונה או וידאו הנשלחים בבקשה מומרים לטוקנים באמצעות כללים שאינם מסופקים ברשימה זו. קיצור חומר מקור לא רלוונטי יכול להפחית עלות. הפלט הוא פי שלושה ממחיר היחידה של הקלט, ולכן הגבלת אורך הפלט המבוקש גם היא שולטת בעלות. מודל עם מגבלת פלט של 131,072 טוקנים יכול לייצר תגובות שעולות כסף; במחיר של $6.00 לכל 1,000,000 טוקנים, 131,072 טוקני פלט יעלו כ-$0.79 רק בטוקני הפלט. יצירת מספר כה גדול של טוקנים אינה אוטומטית, משום שה-prompt שולט בגודל התגובה. אין מחיר מטמון (cache) שפורסם עבור מודל זה, ולכן אין להניח שהקשר חוזר זוכה להנחה. היעדר תמחור מטמון או עיבוד אצווה (batch) בנתונים אינו הוכחה לכך שאפשרויות כאלה אינן קיימות; זה פשוט אומר שהן אינן חלק מרשימה זו.
Qwen3.8 Max (0902) חשוף דרך ה-API התואם OpenAI של OrcaRouter. הגדר את כתובת ה-base URL של הלקוח ל-https://api.orcarouter.ai/v1 והשתמש במזהה המודל המדויק qwen/qwen3.8-max-0902. עם SDK תואם OpenAI, מבנה הבקשה זהה בעצם לכל קריאת chat-completions: העבר מפתח API עבור OrcaRouter, את ה-base URL שלמעלה, ואת מזהה המודל ב-body. אין להשתמש בשם גנרי כמו Qwen3.8 Max או qwen3.8; הרישום דורש qwen/qwen3.8-max-0902. אותו מזהה מודל צריך לשמש גם בבקשות HTTP ישירות ל-base URL, כאשר הנתיב וה-payload עוקבים אחר החוזה התואם OpenAI שנחשף על ידי OrcaRouter. כיוון שזה תואם OpenAI, קוד קיים שנכתב עבור OpenAI chat completions ניתן בדרך כלל להמיר על ידי שינוי הפרמטרים base_url ו-model, אם כי פרטי האימות חייבים להתאים לדרישות של OrcaRouter.
עבור השלמת צ'אט תואמת OpenAI, פרמטרים כמו מודל, הודעות ומגבלת אסימוני פלט מטופלים כמו במודלים תואמים אחרים. העובדות נותנות מקסימום פלט של 131,072 אסימונים, כך שאם תגדיר מגבלת פלט, היא לא תעלה על 131,072; מגבלת הפלט המוגדרת כברירת מחדל אינה מצוינת בעובדות. טמפרטורה, top-p, stop ופרמטרי דגימה אחרים אינם מתועדים בעובדות המודל שסופקו, לכן עקוב אחר תיעוד ה-API של OrcaRouter וסמנטיקות הפרמטרים הסטנדרטיות של OpenAI. עבור קלט תמונה ווידאו, השתמש בפורמט התוכן המולטי־מודאלי שמצפה ה-API של OrcaRouter; העובדות אינן מספקות דוגמה. אם ה-API מחזיר שגיאה לגבי שמות פרמטרים לא נתמכים, בדוק אם ה-SDK שלך שולח פרמטרים מדור קודם. חלון ההקשר הוא 1,000,000 אסימונים, ולכן ההנחיה חייבת לשמור על כל אסימוני הקלט, כולל אסימוני תמונה ווידאו, מתחת למגבלה זו. התגובות נספרות בנפרד מול המקסימום של 131,072 אסימונים.
מכיוון ש-OrcaRouter מציעה API תואם-OpenAI בכתובת https://api.orcarouter.ai/v1, ההעברה היא בעיקר שינוי תצורה. החלף את כתובת ה-base URL לכתובת https://api.orcarouter.ai/v1, החלף את שדה מפתח ה-API במפתח של OrcaRouter, וקבע את המודל ל-qwen/qwen3.8-max-0902. אם הקוד שלך משתמש בספריית לקוח תואמת-OpenAI, עדכן את base_url ו-api_key של הלקוח והשאר את רוב מבני ההודעות ללא שינוי, בהנחה שפורמט המולטימודלי תואם למודל זה. העובדות אינן מציינות האם מודל זה תומך בכל פרמטר ספציפי של OpenAI, לכן לפני ההעברה, סקור את הפרמטרים שהיישום שלך שולח. כמו כן, מכיוון שמגבלת ההקשר היא 1,000,000 והפלט המקסימלי הוא 131,072, התאם את לוגיקת קיצוץ הבקשות למגבלות אלה. כל קוד קיים שהגדיר בקידוד קשיח אורך הקשר מקסימלי שונה עשוי להזדקק לעדכון. לבסוף, ודא שהציפיות של היישום שלך בנוגע לטיפול בנתונים תואמות לתנאים של OrcaRouter, מכיוון שעובדות המודל עצמן אינן דנות בשמירת נתונים.
הבסיס העיקרי להשוואה הוא תנאי הקלט. Qwen3.8 Max (0902) מקבל טקסט, תמונה ווידאו, כך שחלופה טקסטואלית בלבד תבטל את אופני הקלט הללו. אם עומס העבודה בפועל שלך מכיל רק טקסט, מודל טקסט בלבד עם חלון הקשר גדול מספיק הוא ככל הנראה התאמה ישירה יותר וייתכן שיהיו לו תמחור שונה. נתוני המודל אינם כוללים השוואות דיוק או מהירות מול כל מודל אחר, כך שלא ניתן לבחור על בסיס ציוני איכות ציבוריים. ניתן להשוות מאפיינים מבניים: לחלופה טקסטואלית בלבד עשוי להיות הקשר קטן יותר, מגבלת פלט קצרה יותר או מחיר קלט נמוך יותר. OrcaRouter גובה עבור מודל זה $2.00 לקלט ו-$6.00 לפלט לכל 1,000,000 טוקנים. העובדה שיש לו קלט תמונה ווידאו שימושית רק אם נעשה שימוש בקלטים אלה. אם לא נעשה שימוש בקלטים אלה, ייתכן שאתה משלם על יכולת מולטי-מודאלית שאינה רלוונטית למשימה.
בחר ב-Qwen3.8 Max (0902) כאשר פרופיל המשימה תואם לתכונות המפורטות. ראשית, אתה צריך הקשר של 1,000,000 אסימונים (tokens) מכיוון שלא ניתן לקצר את חומר המקור כך שיתאים לחלון קטן יותר. שנית, אתה צריך קלט תמונה ווידאו באותה הודעה (prompt), או שאתה מצפה למודאליויות אלה בבקשות עתידיות. שלישית, אתה רוצה מקסימום פלט של עד 131,072 אסימונים. אם עומס העבודה שלך אינו כולל אף אחת מהדרישות האלה, רבים מהיתרונות של רישום זה אינם מנוצלים. אל תבחר בו רק בגלל שהשם Max נשמע חזק; הרישום אינו כולל ראיות benchmark. מכיוון ש-OrcaRouter חושף מודלים דרך אותה API תואמת OpenAI, החלפת מזהי מודלים היא קלה, כך שתוכל לבדוק מודל זה מול מועמד אחר על המשימה שלך. רק זכור שמחירי הקלט והפלט שונים, ולא צוין תמחור מטמון (cache) עבור מודל זה.
כשמשווים עלות, ראשית נרמל לאותו בסיס טוקנים. מודל זה גובה $2.00 לכל 1,000,000 טוקני קלט ו-$6.00 לכל 1,000,000 טוקני פלט, מחירים שמועברים מהספק ללא תוספת. מודל מתחרה עם מחיר נמוך יותר לטוקן קלט עשוי להיות זול יותר בפועל עבור בקשה עם קונטקסט מלא, אך יש להתחשב גם בגודל חלון הקונטקסט ובפלט המרבי. לדוגמה, בקשה של 1,000,000 טוקנים יכולה להשתמש בקונטקסט המלא של מודל זה בקריאה אחת; מודל עם קונטקסט של 200,000 טוקנים ידרוש קריאות מרובות, ומעברי הפלט הנוספים או התקצור יכולים לשנות את המחיר הכולל. הנתונים שסופקו אינם מספקים ערכים אובייקטיביים לדיוק או לזמן השהיה, ולכן כל השוואת עלות-לכל-תשובה-נכונה חייבת להגיע מהבדיקות שלך. כמו כן, בדוק אם מודל מתחרה גובה חיובים נפרדים עבור טוקני תמונה או וידאו, מכיוון שהם אינם מתוארים כאן. במקרה של ספק, הרץ עומס עבודה אופייני על OrcaRouter והשווה את צריכת הטוקנים הנמדדת ואת איכות התגובה, במקום להסתמך רק על מחירי המחירון.
תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="qwen/qwen3.8-max-0902",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)enable_thinkinginclude_reasoningmax_tokenspresence_penaltyreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p| קלט / 1M טוקנים | $2.00 |
| פלט / 1M tokens | $6.00 |
| קריאת מטמון / 1M | $0.250 |
| כתיבה למטמון / 1M | $2.50 |
| מטבע | USD |
הערכה מבוססת מחיר מחירון
הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.
על מה מפתחים מדברים השבוע
GET /api/public/models/qwen/qwen3.8-max-0902פתיחה @misc{orcarouter_qwen3_8_max_0902,
title = {Qwen3.8 Max (0902) API},
author = {Qwen},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902}
}Qwen. (2026). Qwen3.8 Max (0902) API. OrcaRouter. https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902