Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
VisionVerktygJSON
av Qwen · 2025-10-14

Qwen3-VL 8B Instruct — open-weight liten syn-språkmodell, 8B parametrar, 128k kontext, inget tankeläge.

ctx131K tokens
Max output32K
Inmatningtext + image + video
Utdatatext
p50 TTFT2.71 s
INMATNING$0.18/ 1M token
UTDATA$0.70/ 1M token
p50 TTFT2.71 s7d
p95 TTFT8.89 s7d
TRAFIK832.5Ktokens/7d

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Priser

Inmatning / 1M token$0.180
Utdata / 1M tokens$0.700
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $3.36

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000353

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
2.71 s
Utdatahastighet
70.8 tok/s
p95 TTFT
8.89 s
Felfrekvens
14.7%

Offentliga benchmarks

7.3
AA Coding
Bättre än 0% av jämförda modeller
#133 av 133
8.2
AA Intelligence
Bättre än 8% av jämförda modeller
#124 av 135
27.3
AA Math
Bättre än 7% av jämförda modeller
#76 av 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Källa: artificialanalysis.ai

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Så jämför den sig

Qwen3 VL 8B InstructQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Input $/M$0.18$2.00$0.86$0.17
Output $/M$0.70$6.00$3.44$1.03
Kontext131K1.0M262K33K
Kvalitet4/109/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar Qwen: Qwen3 VL 8B Instruct på OrcaRouter?
Qwen: Qwen3 VL 8B Instruct prissätts till $0.18 per 1M inmatningstokens och $0.70 per 1M utmatningstokens via OrcaRouter. Prissättningen hämtas live från routningslagret.
Vad är Qwen: Qwen3 VL 8B Instruct:s kontextfönster?
Qwen: Qwen3 VL 8B Instruct stöder ett kontextfönster på 131K tokens. Använd långkontext-funktioner (RAG, sammanfattning) upp till den gränsen.
Hur anropar jag Qwen: Qwen3 VL 8B Instruct via OpenAI SDK?
Ställ in OpenAI base_url till https://api.orcarouter.ai/v1, ange din OrcaRouter API-nyckel, och skicka model="qwen/qwen3-vl-8b-instruct" i anropet till chat.completions.create.
Begränsar OrcaRouter hastigheten för Qwen: Qwen3 VL 8B Instruct?
Per-modell hastighetsbegränsningar följer din OrcaRouter-plan. Gratisnivåer levereras med konservativa gränser; betalnivåer lyfter dem. Kolla /pricing för aktuella kvoter.

Bädda in denna badge

Qwen: Qwen3 VL 8B Instruct$0.18/M in2710ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Modellkort som data

GET /api/public/models/qwen/qwen3-vl-8b-instructÖppna