Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct
מאת Qwen · 2025-09-23

Qwen3-VL 235B-A22B Instruct — מודל ראייה-שפה במשקל פתוח, 235B סך הכל / 22B פרמטרים פעילים, 256k הקשר, ללא מצב חשיבה.

נקודות קצה:/v1/chat/completions
p50 TTFT10.00 s
קלט$0.40/ 1M טוקנים
פלט$1.60/ 1M טוקנים
p50 TTFT10.00 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה77.1Kטוקנים / 7 ימים

Qwen3 VL 235B A22B Instruct הוא גרסת ראייה-שפה מסדרת דגמי Qwen3, שנבנתה על ידי Alibaba Cloud. הוא משתמש בעיצוב mixture-of-experts עם 235 מיליארד פרמטרים בסך הכל, מתוכם כ-22 מיליארד פעילים בכל מעבר…

מה זה בדיוק Qwen3 VL 235B A22B Instruct?

למי המודל הזה הכי מתאים?

אילו מודליות תומך המודל?

איך OrcaRouter מספק את המודל הזה?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-235b-a22b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

תמחור

קלט / 1M טוקנים$0.400
פלט / 1M tokens$1.60
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $7.60

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.000805

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
10.00 s
מהירות פלט
70.3 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
0%

מבחני ביצועים ציבוריים

16.5
AA Coding
טוב יותר מ-11% מהמודלים שהושוו
#109 מתוך 123
14.3
AA Intelligence
טוב יותר מ-15% מהמודלים שהושוו
#106 מתוך 125
70.7
AA Math
טוב יותר מ-64% מהמודלים שהושוו
#29 מתוך 81
AIME 2025
70.7
GPQA Diamond
71.2
Humanity's Last Exam
6.3
IFBench
42.7
LiveCodeBench
59.4
Long-Context Recall
31.7
MMLU-Pro
82.3
SciCode
35.9
TerminalBench Hard
6.8
τ²-Bench
35.1
מקור: artificialanalysis.ai

איך זה משתווה

Qwen3 VL 235B A22B Instructqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
קלט $/מיליון$0.40$0.86$0.17$0.12
פלט $/מיליון$1.60$3.44$1.03$0.69
הקשר262K33K1.0M
איכות8/108/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מהי העלות בדולרים למיליון טוקנים עבור דגם זה ב-OrcaRouter?
עלות אסימוני קלט היא $0.40 למיליון ועלות אסימוני פלט היא $1.60 למיליון. אסימוני תמונה מחויבים בתעריף הקלט. אין תוספת תשלום.
מה גודל חלון ההקשר של Qwen3 VL 235B A22B Instruct?
אורך חלון ההקשר המדויק לא מסופק בעובדות הזמינות. בדרך כלל, מודלי Qwen3 VL תומכים באורכי הקשר גדולים (לדוגמה, 32K tokens), אך יש לאמת זאת עם התיעוד הרשמי של הספק.
מהן החוזקות העיקריות של המודל בהשוואה למודלי VL אחרים?
ארכיטקטורת ה-MoE שלו מספקת איזון טוב בין קיבולת לעלות. ציון ה-MMLU-Pro של 82.3 מצביע על ידע כללי חזק. זהו גם אחד מהמודלים המולטימודליים הגדולים והמשתלמים ביותר הזמינים דרך OrcaRouter.
איך המודל הזה משתווה ל-GPT-4V מבחינת ביצועים?
השוואות בנצ'מרק ישירות אינן מסופקות, אך ציון MMLU-Pro של Qwen3 VL הוא 82.3. הביצועים של GPT-4V באותו בנצ'מרק אינם מתוקננים באופן ציבורי. התמחור מעדיף את Qwen3 VL, שהוא זול משמעותית לכל טוקן.
האם OrcaRouter מטפל בנתונים שלי כשאני שולח תמונות או טקסט?
מדיניות הטיפול בנתונים של OrcaRouter אינה מפורטת כאן. באופן כללי, השער מעביר נתונים לספק. עליך לעיין במדיניות הפרטיות ובתנאי השימוש של OrcaRouter לפרטים על אחסון, שמירה ושיתוף נתונים.
איך אני יכול לקרוא למודל הזה דרך API תואם OpenAI?
השתמש בכתובת הבסיס https://api.orcarouter.ai/v1 עם מזהה המודל "qwen/qwen3-vl-235b-a22b-instruct". שלח בקשת POST אל /chat/completions עם מערך messages המכיל תוכן טקסט ותמונה. השתמש במפתח ה-API שלך מ-OrcaRouter לאימות.
האם יש רמה חינמית או ניסיון לשימוש במודל זה ב-OrcaRouter?
העובדות הזמינות אינן מזכירות שכבה חינמית. סביר להניח ש-OrcaRouter גובה תשלום לפי שימוש. כדאי לבדוק באתר שלהם הצעות עדכניות או קרדיט ניסיון.
אילו פורמטים של תמונות נתמכים וכיצד מחייבים עליהם?
המודל מקבל פורמטי תמונה נפוצים כגון JPEG ו-PNG (רשימה מדויקת מהספק). התמונות מומרות לטוקנים בהתבסס על רזולוציה והגדרת פירוט. טוקנים אלו נספרים כקלט בעלות של 0.40$ למיליון טוקנים.
האם ניתן להשתמש במודל זה עבור יישומים בזמן אמת?
השהייה גבוהה יותר מאשר במודלים קטנים יותר בשל 235 מיליארד הפרמטרים הכוללים שלו. ייתכן שהוא אינו מתאים לשימוש בזמן אמת עם השהייה נמוכה במיוחד. להסקה מולטימודלית קרובה לזמן אמת, שקלו להשתמש במודל קטן יותר הזמין ב-OrcaRouter.
האם המודל הזה תומך בקלט של תמונות מרובות?
כן, מודלי Qwen3 VL תומכים בדרך כלל במספר תמונות בשיחה אחת. ניתן לכלול מספר כתובות URL של תמונות או נתוני base64 בהודעה אחת או במספר פניות.

הטמעת התג הזה

Qwen: Qwen3 VL 235B A22B Instruct$0.40/M in10000ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg" alt="Qwen: Qwen3 VL 235B A22B Instruct ב-OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 235B A22B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3-vl-235b-a22b-instructפתיחה
קריא למכונה:/llms.txt/llms-full.txt