Qwen3 VL 8B Thinking

qwen/qwen3-vl-8b-thinking
ראייהכליםJSONהיגיון
מאת Qwen · 2025-10-14

Qwen3-VL 8B Thinking — מודל חשיבה קטן של ראייה-שפה במשקל פתוח, 8B פרמטרים, 128k הקשר.

נקודות קצה:/v1/chat/completions
הקשר131K tokens
מקסימום פלט40K
קלטtext + image + video
פלטtext
p50 TTFT3.95 s
קלט$0.18/ 1M טוקנים
פלט$2.10/ 1M טוקנים
p50 TTFT3.95 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה1.4Mטוקנים / 7 ימים

Qwen3 VL 8B Thinking הוא מודל שפה רב-מודאלי בעל 8 מיליארד פרמטרים שפותח על ידי צוות Qwen ב-Alibaba Cloud, ומתארח ב-OrcaRouter תחת הספק qwen. הוא שייך למשפחת Qwen3 של מודלים של ראייה-שפה, עם הסיומת…

מה זה Qwen3 VL 8B Thinking?

מי צריך להשתמש במודל זה?

באילו מודאליות הוא תומך?

איך גרסת ה-'Thinking' שונה מ-Qwen3 VL הסטנדרטי?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-thinking",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

תמחור

קלט / 1M טוקנים$0.180
פלט / 1M tokens$2.10
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $7.56

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.001052

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
3.95 s
מהירות פלט
56.1 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
16.1%

מבחני ביצועים ציבוריים

מקור: Design Arena

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News0 אזכורים · 7 ימים

איך זה משתווה

Qwen3 VL 8B ThinkingQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
קלט $/מיליון$0.18$2.00$0.86$0.17
פלט $/מיליון$2.10$6.00$3.44$1.03
הקשר131K1.0M262K33K
איכות4/109/108/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מהי העלות למיליון טוקנים עבור Qwen3 VL 8B Thinking ב-OrcaRouter?
קלט: $0.18 למיליון אסימונים. פלט: $2.10 למיליון אסימונים. אלו הם תעריפי הספק שמועברים ללא תוספת מחיר.
מהם חלון ההקשר ומספר האסימונים המקסימלי של הפלט?
חלון הקשר הוא 131,072 אסימונים. מספר אסימוני הפלט המרבי הוא 40,960 אסימונים.
מה הן החוזקות העיקריות של המודל הזה?
היא מטפלת בשלוש אופני קלט (טקסט, תמונה, וידאו), מציעה הקשר רחב ואורך פלט גדול, וכוללת יכולת חשיבה (שרשרת מחשבה) המשפרת ביצועים במשימות חשיבה מורכבות.
איך המודל הזה משתווה ל-Qwen2 VL 7B?
יש לו הקשר רחב יותר (131K לעומת 32K), תפוקה מקסימלית גדולה יותר (40K לעומת 2K), ומוסיף יכולות חשיבה. התמחור גבוה במקצת אך מציע היגיון משופר והבנה רב-מודאלית.
האם OrcaRouter שומר במטמון נתוני משתמש כלשהם בעת שימוש במודל זה?
OrcaRouter אינה מדווחת על מנגנון שמירה במטמון (קאש) האוגר הנחיות (prompts) או תמונות; טיפול בנתונים מתבצע לפי נוהלי API סטנדרטיים. יש לעיין במדיניות הפרטיות של OrcaRouter לפרטים נוספים.
כיצד ניתן לקרוא למודל זה באמצעות API תואם ל-OpenAI?
שלח POST לכתובת https://api.orcarouter.ai/v1/chat/completions עם המודל "qwen/qwen3-vl-8b-thinking" ומפתח ה-API שלך. השתמש במערך תוכן עם ערכי text ו-image_url עבור קלט רב-מודלי.
האם המודל יכול לעבד קלט וידאו?
כן, וידאו מתקבל על ידי שליחת פריימים שחולצו כערכי image_url נפרדים. למודל אין תמיכה מובנית במקודד וידאו; הוא עובד על קבוצות פריימים סטטיות.
האם יש הגבלה על מספר התמונות לבקשה?
לא, חוץ מזה שסך כל מספר הטוקנים (כולל טוקני טקסט ותמונה) חייב להיות בתוך מגבלת ההקשר של 131,072. אין מגבלת תמונה נפרדת.
באלו שפות תכנות או ספריות ניתן להשתמש כדי לגשת למודל זה דרך OrcaRouter?
כל שפה שתומכת בבקשות HTTP ובפורמט ה-API של OpenAI. Python עם הספרייה openai, JavaScript עם fetch, וכו'. פשוט הגדר את כתובת הבסיס (base URL) ואת מזהה המודל.
גרסת החשיבה אינה תמיד מחזירה נימוק שלב-אחר-שלב (chain-of-thought); זה תלוי בהנחיה ובהגדרות המודל. ניתן לעודד התנהגות זו באמצעות בקשה מפורשת, אך היא אינה מובטחת בכל מצב.
המודל משתמש באופן פנימי בחשיבה שלב אחר שלב לפני יצירת התשובה הסופית, אך הפלט שאתה רואה הוא התגובה השלמה. אינך יכול לחלץ את אסימוני החשיבה הביניים בנפרד.

הטמעת התג הזה

Qwen: Qwen3 VL 8B Thinking$0.18/M in3950ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-thinking" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-thinking.svg" alt="Qwen: Qwen3 VL 8B Thinking ב-OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Thinking](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-thinking.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-thinking)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3-vl-8b-thinkingפתיחה
קריא למכונה:/llms.txt/llms-full.txt