Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
ראייהכליםJSON
מאת Qwen · 2025-10-14

Qwen3-VL 8B Instruct — מודל ראייה-שפה קטן בעל משקלים פתוחים, 8B פרמטרים, הקשר של 128k, ללא מצב חשיבה.

נקודות קצה:/v1/chat/completions
הקשר131K tokens
מקסימום פלט32K
קלטtext + image + video
פלטtext
p50 TTFT3.31 s
קלט$0.18/ 1M טוקנים
פלט$0.70/ 1M טוקנים
p50 TTFT3.31 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה652.1Kטוקנים / 7 ימים

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

תמחור

תמחור
קלט / 1M טוקנים$0.180
פלט / 1M tokens$0.700
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $3.36

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.000352

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
3.31 s
מהירות פלט
242 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
60.3%

מבחני ביצועים ציבוריים

7.3
AA Coding
טוב יותר מ-0% מהמודלים שהושוו
#138 מתוך 138
7.3
AA Intelligence
טוב יותר מ-7% מהמודלים שהושוו
#135 מתוך 147
27.3
AA Math
טוב יותר מ-7% מהמודלים שהושוו
#76 מתוך 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
מקור: artificialanalysis.ai

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News0 אזכורים · 7 ימים

איך זה משתווה

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
קלט $/מיליון$0.18$2.00$2.00$0.86
פלט $/מיליון$0.70$6.00$6.00$3.44
הקשר131K1.0M1.0M262K
איכות4/109/109/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

כמה עולה Qwen: Qwen3 VL 8B Instruct ב-OrcaRouter?
Qwen: Qwen3 VL 8B Instruct מתומחר ב-$0.18 לכל 1M טוקני קלט ו-$0.70 לכל 1M טוקני פלט דרך OrcaRouter. התמחור נמשך בזמן אמת משכבת הניתוב.
מהו חלון ההקשר של Qwen: Qwen3 VL 8B Instruct?
Qwen: Qwen3 VL 8B Instruct תומך בחלון הקשר של 131K טוקנים. השתמש בתכונות הקשר ארוך (RAG, סיכום) עד לגבול זה.
איך אני קורא ל-Qwen: Qwen3 VL 8B Instruct דרך OpenAI SDK?
הגדר את base_url של OpenAI ל-https://api.orcarouter.ai/v1, ספק את מפתח ה-API של OrcaRouter שלך, והעבר את model="qwen/qwen3-vl-8b-instruct" בקריאה ל-chat.completions.create.
האם OrcaRouter מגביל קצב ל-Qwen: Qwen3 VL 8B Instruct?
מגבלות קצב לפי מודל עוקבות אחרי תוכנית OrcaRouter שלך. רמות חינמיות מגיעות עם מגבלות שמרניות; רמות בתשלום מסירות אותן. בדוק /pricing עבור המכסות הנוכחיות.

הטמעת התג הזה

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct ב-OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3-vl-8b-instructפתיחה
קריא למכונה:/llms.txt/llms-full.txt