Qwen3 VL 8B Thinking

qwen/qwen3-vl-8b-thinking
رؤيةأدواتJSONاستدلال
بواسطة Qwen · 2025-10-14

Qwen3-VL 8B Thinking — نموذج تفكير بصري-لغوي صغير مفتوح الأوزان، 8 مليار معلمة، سياق 128 ألف.

نقاط النهاية:/v1/chat/completions
سياق131.1K رمز
أقصى إخراج41K
الإدخالtext + image + video
الإخراجtext
p50 TTFT5.00 s
الإدخال$0.18/ مليون رمز
الإخراج$2.10/ مليون رمز
p50 TTFT5.00 s7 أيام
p95 TTFT8.55 s7 أيام
حركة المرور108.8Kرموز / 7 أيام

Qwen3 VL 8B Thinking هو نموذج لغوي متعدد الوسائط يحتوي على 8 مليارات معلمة، تم تطويره بواسطة فريق Qwen في Alibaba Cloud، ومُستضاف على OrcaRouter تحت مزود qwen. ينتمي إلى عائلة Qwen3 من نماذج الرؤية…

ما هو Qwen3 VL 8B Thinking؟

من ينبغي أن يستخدم هذا النموذج؟

ما هي الأنماط التي يدعمها؟

كيف يختلف المتغير "Thinking" عن Qwen3 VL القياسي؟

عينات الكود

استدعِ من أي SDK

متوافق مع OpenAI — أبقِ على SDK الحالي

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-thinking",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

المعلمات المدعومة

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

الأسعار

الإدخال / 1M توكن$0.180
الإخراج / 1M توكن$2.10
العملةUSD

حاسبة التكلفة

الرموز / الشهر10MM
نسبة الإدخال70%%
تقديري / الشهر $7.56

تقدير بناءً على السعر المُعلن

مقدّر الرموز والتكلفة

رموز الإدخال: 13التكلفة لكل طلب: $0.001052

تقدير فقط — يعتمد العدد الفعلي للرموز على مُجزّئ الرموز الخاص بالمزوّد.

الأداء

p50 TTFT
5.00 s
سرعة الإخراج
64.6 tok/s
p95 TTFT
8.55 s
معدل الخطأ
0%

المعايير العامة

المصدر: Design Arena

المقارنة

Qwen3 VL 8B Thinkingqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
الإدخال $/مليون$0.18$0.86$0.17$0.12
الإخراج $/مليون$2.10$3.44$1.03$0.69
السياق131K262K33K1.0M
الجودة4/108/108/108/10
مقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنب

المزيد من Qwen

الأسئلة الشائعة

ما هي التكلفة لكل مليون رمز لـ Qwen3 VL 8B Thinking على OrcaRouter؟
رموز الإدخال: $0.18 لكل مليون رمز. رموز الإخراج: $2.10 لكل مليون رمز. هذه هي أسعار المزود التي تم تمريرها بدون أي هامش ربح.
ما هي نافذة السياق والحد الأقصى لعدد الرموز المخرجة؟
نافذة السياق هي 131,072 رمزًا. الحد الأقصى لرموز الإخراج هو 40,960 رمزًا.
ما هي نقاط القوة الرئيسية لهذا النموذج؟
يتعامل مع ثلاث طرائق إدخال (نص، صورة، فيديو)، ويوفر سياقًا كبيرًا وطول إخراج، ويتضمن قدرة تفكير (سلسلة أفكار) تعزز الأداء في مهام التفكير المعقدة.
كيف يقارن هذا النموذج مع Qwen2 VL 7B؟
لديها سياق أكبر (131K مقابل 32K)، وإخراج أقصى أكبر (40K مقابل 2K)، وتضيف قدرات التفكير. السعر أعلى قليلاً ولكنه يوفر تحسينًا في الاستدلال والفهم متعدد الوسائط.
هل يقوم OrcaRouter بتخزين أي بيانات مستخدم مؤقتة عند استخدام هذا النموذج؟
لا يُبلغ OrcaRouter عن أي آلية تخزين مؤقت تخزّن المطالبات أو الصور؛ تتبع معالجة البيانات الممارسات القياسية لواجهة برمجة التطبيقات. اطلع على سياسة الخصوصية الخاصة بـ OrcaRouter للحصول على التفاصيل.
كيف يمكنني استدعاء هذا النموذج عبر واجهة API المتوافقة مع OpenAI؟
أرسل طلب POST إلى https://api.orcarouter.ai/v1/chat/completions مع النموذج "qwen/qwen3-vl-8b-thinking" ومفتاح API الخاص بك. استخدم مصفوفة محتوى تحتوي على إدخالات نصية وimage_url للإدخال متعدد الوسائط.
هل يمكن للنموذج معالجة إدخال الفيديو؟
نعم، يتم قبول الفيديو عن طريق إرسال الإطارات المستخرجة كمدخلات image_url منفصلة. النموذج لا يدعم ترميز الفيديو الأصلي؛ فهو يعمل على مجموعات الإطارات الثابتة.
هل هناك أي قيود على عدد الصور لكل طلب؟
لا، باستثناء أن عدد الرموز الإجمالي (بما في ذلك رموز النصوص والصور) يجب أن يكون ضمن حد السياق البالغ 131,072. لا يوجد حد منفصل للصور.
ما هي لغات البرمجة أو المكتبات التي يمكنني استخدامها للوصول إلى هذا النموذج عبر OrcaRouter؟
أي لغة تدعم طلبات HTTP وتنسيق OpenAI API. بايثون مع مكتبة openai، وجافا سكريبت مع fetch، إلخ. فقط قم بتعيين عنوان URL الأساسي ومعرف النموذج.
هل متغير التفكير يعيد دائمًا تسلسل الاستدلال؟
يستخدم النموذج داخليًا التفكير خطوة بخطوة قبل إنشاء الإجابة النهائية، لكن المخرجات التي تراها هي الاستجابة الكاملة. لا يمكنك استخراج رموز التفكير الوسيطة بشكل منفصل.

تضمين هذه الشارة

Qwen: Qwen3 VL 8B Thinking$0.18/M in5000ms p50عبر OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-thinking" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-thinking.svg" alt="Qwen: Qwen3 VL 8B Thinking على OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Thinking](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-thinking.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-thinking)

بطاقة النموذج كبيانات

GET /api/public/models/qwen/qwen3-vl-8b-thinkingفتح
قابل للقراءة آليًا:/llms.txt/llms-full.txt