Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
VisionVerktygJSON
av Qwen · 2025-10-14

Qwen3-VL 8B Instruct — open-weight liten syn-språkmodell, 8B parametrar, 128k kontext, inget tankeläge.

ctx131K tokens
Max output32K
Inmatningtext + image + video
Utdatatext
p50 TTFT3.31 s
INMATNING$0.18/ 1M token
UTDATA$0.70/ 1M token
p50 TTFT3.31 s7d
p95 TTFT10.00 s7d
TRAFIK652.1Ktokens/7d

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Priser

Priser
Inmatning / 1M token$0.180
Utdata / 1M tokens$0.700
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $3.36

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000353

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
3.31 s
Utdatahastighet
242 tok/s
p95 TTFT
10.00 s
Felfrekvens
60.3%

Offentliga benchmarks

7.3
AA Coding
Bättre än 0% av jämförda modeller
#138 av 138
7.3
AA Intelligence
Bättre än 7% av jämförda modeller
#135 av 147
27.3
AA Math
Bättre än 7% av jämförda modeller
#76 av 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Källa: artificialanalysis.ai

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Så jämför den sig

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Input $/M$0.18$2.00$2.00$0.86
Output $/M$0.70$6.00$6.00$3.44
Kontext131K1.0M1.0M262K
Kvalitet4/109/109/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar Qwen: Qwen3 VL 8B Instruct på OrcaRouter?
Qwen: Qwen3 VL 8B Instruct prissätts till $0.18 per 1M inmatningstokens och $0.70 per 1M utmatningstokens via OrcaRouter. Prissättningen hämtas live från routningslagret.
Vad är Qwen: Qwen3 VL 8B Instruct:s kontextfönster?
Qwen: Qwen3 VL 8B Instruct stöder ett kontextfönster på 131K tokens. Använd långkontext-funktioner (RAG, sammanfattning) upp till den gränsen.
Hur anropar jag Qwen: Qwen3 VL 8B Instruct via OpenAI SDK?
Ställ in OpenAI base_url till https://api.orcarouter.ai/v1, ange din OrcaRouter API-nyckel, och skicka model="qwen/qwen3-vl-8b-instruct" i anropet till chat.completions.create.
Begränsar OrcaRouter hastigheten för Qwen: Qwen3 VL 8B Instruct?
Per-modell hastighetsbegränsningar följer din OrcaRouter-plan. Gratisnivåer levereras med konservativa gränser; betalnivåer lyfter dem. Kolla /pricing för aktuella kvoter.

Bädda in denna badge

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Modellkort som data

GET /api/public/models/qwen/qwen3-vl-8b-instructÖppna