Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
VisiAlatJSON
oleh Qwen · 2025-10-14

Qwen3-VL 8B Instruct — model visi-bahasa kecil dengan bobot terbuka, 8B parameter, konteks 128k, tanpa mode berpikir.

ctx131K token
Output maks32K
Masukantext + image + video
Keluarantext
p50 TTFT3.31 s
INPUT$0.18/ 1M token
OUTPUT$0.70/ 1M token
p50 TTFT3.31 s7h
p95 TTFT10.00 s7h
LALU LINTAS652.1Ktoken / 7h

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Harga

Harga
Input / 1M token$0.180
Output / 1M token$0.700
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $3.36

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000353

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
3.31 s
Kecepatan output
242 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
60.3%

Benchmark publik

7.3
AA Coding
Lebih baik dari 0% model yang dibandingkan
#138 dari 138
7.3
AA Intelligence
Lebih baik dari 7% model yang dibandingkan
#135 dari 147
27.3
AA Math
Lebih baik dari 7% model yang dibandingkan
#76 dari 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Sumber: artificialanalysis.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News0 sebutan · 7 hr

Perbandingan

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Input $/M$0.18$2.00$2.00$0.86
Output $/M$0.70$6.00$6.00$3.44
Konteks131K1.0M1.0M262K
Kualitas4/109/109/108/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa harga Qwen: Qwen3 VL 8B Instruct di OrcaRouter?
Qwen: Qwen3 VL 8B Instruct dihargai $0.18 per 1M token input dan $0.70 per 1M token output melalui OrcaRouter. Harga ditarik langsung dari lapisan perutean.
Apa jendela konteks dari Qwen: Qwen3 VL 8B Instruct?
Qwen: Qwen3 VL 8B Instruct mendukung jendela konteks 131K token. Gunakan fitur konteks panjang (RAG, peringkasan) hingga batas tersebut.
Bagaimana cara memanggil Qwen: Qwen3 VL 8B Instruct melalui OpenAI SDK?
Atur base_url OpenAI menjadi https://api.orcarouter.ai/v1, berikan kunci API OrcaRouter Anda, dan teruskan model="qwen/qwen3-vl-8b-instruct" dalam panggilan chat.completions.create.
Apakah OrcaRouter membatasi laju Qwen: Qwen3 VL 8B Instruct?
Batas kecepatan per model mengikuti paket OrcaRouter Anda. Tingkat gratis hadir dengan batas konservatif; tingkat berbayar menaikkannya. Periksa /pricing untuk kuota saat ini.

Sematkan lencana ini

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct di OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Kartu model sebagai data

GET /api/public/models/qwen/qwen3-vl-8b-instructBuka