Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
VisieToolsJSON
door Qwen · 2025-10-14

Qwen3-VL 8B Instruct — open-gewicht klein visie-taalmodel, 8B parameters, 128k context, geen denkmodus.

ctx131K tokens
Max. uitvoer32K
Invoertext + image + video
Uitvoertext
p50 TTFT3.31 s
INPUT$0.18/ 1M tokens
OUTPUT$0.70/ 1M tokens
p50 TTFT3.31 s7d
p95 TTFT10.00 s7d
VERKEER652.1Ktokens / 7d

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Prijzen

Prijzen
Invoer / 1M tokens$0.180
Uitvoer / 1M tokens$0.700
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $3.36

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000354

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
3.31 s
Outputsnelheid
242 tok/s
p95 TTFT
10.00 s
Foutpercentage
60.3%

Openbare benchmarks

7.3
AA Coding
Beter dan 0% van de vergeleken modellen
#138 van 138
7.3
AA Intelligence
Beter dan 7% van de vergeleken modellen
#135 van 147
27.3
AA Math
Beter dan 7% van de vergeleken modellen
#76 van 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Bron: artificialanalysis.ai

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News0 vermeldingen · 7 d

Vergelijking

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Invoer $/M$0.18$2.00$2.00$0.86
Uitvoer $/M$0.70$6.00$6.00$3.44
Context131K1.0M1.0M262K
Kwaliteit4/109/109/108/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Hoeveel kost Qwen: Qwen3 VL 8B Instruct op OrcaRouter?
Qwen: Qwen3 VL 8B Instruct is geprijsd op $0.18 per 1M invoertokens en $0.70 per 1M uitvoertokens via OrcaRouter. De prijzen worden live opgehaald van de routinglaag.
Wat is Qwen: Qwen3 VL 8B Instruct's contextvenster?
Qwen: Qwen3 VL 8B Instruct ondersteunt een contextvenster van 131K tokens. Gebruik lange-contextfuncties (RAG, samenvatting) tot die limiet.
Hoe roep ik Qwen: Qwen3 VL 8B Instruct aan via de OpenAI SDK?
Stel OpenAI base_url in op https://api.orcarouter.ai/v1, lever uw OrcaRouter API-sleutel, en geef model="qwen/qwen3-vl-8b-instruct" mee in de chat.completions.create aanroep.
Past OrcaRouter een snelheidsbeperking toe op Qwen: Qwen3 VL 8B Instruct?
Per-model snelheidslimieten volgen uw OrcaRouter-plan. Gratis abonnementen worden geleverd met conservatieve limieten; betaalde abonnementen verhogen deze. Controleer /pricing voor huidige quota's.

Sluit deze badge in

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct op OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Modelkaart als data

GET /api/public/models/qwen/qwen3-vl-8b-instructOpenen
Machineleesbaar:/llms.txt/llms-full.txt