Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
VisionToolsJSON
von Qwen · 2025-10-14

Qwen3-VL 8B Instruct — Open-Weight kleines Vision-Language-Modell, 8B Parameter, 128k Kontext, kein Denkmodus.

Ktx131K Tokens
Max. Ausgabe32K
Eingabetext + image + video
Ausgabetext
p50 TTFT3.36 s
EINGABE$0.18/ 1M Tokens
AUSGABE$0.70/ 1M Tokens
p50 TTFT3.36 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR1.1MTokens / 7 T

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preise

Eingabe / 1M Tokens$0.180
Ausgabe / 1M Tokens$0.700
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $3.36

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000355

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
3.36 s
Ausgabegeschwindigkeit
82.0 tok/s
p95 TTFT
10.00 s
Fehlerquote
10.3%

Öffentliche Benchmarks

7.3
AA Coding
Besser als 0 % der verglichenen Modelle
Nr. 133 von 133
8.2
AA Intelligence
Besser als 8 % der verglichenen Modelle
Nr. 124 von 135
27.3
AA Math
Besser als 7 % der verglichenen Modelle
Nr. 76 von 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Quelle: artificialanalysis.ai

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News0 Erwähnungen · 7 T

Im Vergleich

Qwen3 VL 8B InstructQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Eingabe $/M$0.18$2.00$0.86$0.17
Ausgabe $/M$0.70$6.00$3.44$1.03
Kontext131K1.0M262K33K
Qualität4/109/108/108/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Wie viel kostet Qwen: Qwen3 VL 8B Instruct auf OrcaRouter?
Qwen: Qwen3 VL 8B Instruct kostet $0.18 pro 1M Eingabetokens und $0.70 pro 1M Ausgabetokens über OrcaRouter. Die Preise werden live von der Routing-Schicht abgerufen.
Was ist das Kontextfenster von Qwen: Qwen3 VL 8B Instruct?
Qwen: Qwen3 VL 8B Instruct unterstützt ein Kontextfenster von 131K Token. Verwenden Sie Langkontextfunktionen (RAG, Zusammenfassung) bis zu diesem Limit.
Wie rufe ich Qwen: Qwen3 VL 8B Instruct über das OpenAI SDK auf?
Setzen Sie die OpenAI base_url auf https://api.orcarouter.ai/v1, geben Sie Ihren OrcaRouter API-Schlüssel an und übergeben Sie model="qwen/qwen3-vl-8b-instruct" im Aufruf von chat.completions.create.
Rate-limitiert OrcaRouter Qwen: Qwen3 VL 8B Instruct?
Modellspezifische Ratenbegrenzungen richten sich nach Ihrem OrcaRouter-Plan. Kostenlose Tarife haben konservative Obergrenzen; kostenpflichtige Tarife heben diese an. Siehe /pricing für aktuelle Kontingente.

Dieses Abzeichen einbetten

Qwen: Qwen3 VL 8B Instruct$0.18/M in3363ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct auf OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Modellkarte als Daten

GET /api/public/models/qwen/qwen3-vl-8b-instructÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt