Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
WizjaNarzędziaJSON
przez Qwen · 2025-10-14

Qwen3-VL 8B Instruct — mały model wizyjno-językowy o otwartych wagach, 8B parametrów, 128k kontekstu, bez trybu myślenia.

Punkty końcowe:/v1/chat/completions
kont.131K tokenów
Maks. wyjście32K
Wejścietext + image + video
Wyjścietext
p50 TTFT3.31 s
WEJŚCIE$0.18/ 1M tokenów
WYJŚCIE$0.70/ 1M tokenów
p50 TTFT3.31 s7 d
p95 TTFT10.00 s7 d
RUCH652.1Ktokenów / 7 d

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Cennik

Cennik
Wejście / 1M tokenów$0.180
Wyjście / 1M tokenów$0.700
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $3.36

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000353

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
3.31 s
Prędkość wyjścia
242 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
60.3%

Publiczne benchmarki

7.3
AA Coding
Lepszy niż 0% porównywanych modeli
138 z 138
7.3
AA Intelligence
Lepszy niż 7% porównywanych modeli
135 z 147
27.3
AA Math
Lepszy niż 7% porównywanych modeli
76 z 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Źródło: artificialanalysis.ai

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News0 wzmianek · 7 dni

Porównanie

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Wejście $/M$0.18$2.00$2.00$0.86
Wyjście $/M$0.70$6.00$6.00$3.44
Kontekst131K1.0M1.0M262K
Jakość4/109/109/108/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje Qwen: Qwen3 VL 8B Instruct na OrcaRouter?
Qwen: Qwen3 VL 8B Instruct jest wyceniany na $0.18 za 1M tokenów wejściowych i $0.70 za 1M tokenów wyjściowych za pośrednictwem OrcaRouter. Ceny są pobierane na żywo z warstwy routingu.
Jakie jest okno kontekstowe Qwen: Qwen3 VL 8B Instruct?
Qwen: Qwen3 VL 8B Instruct obsługuje okno kontekstu o wielkości 131K tokenów. Używaj funkcji długiego kontekstu (RAG, streszczanie) do tego limitu.
Jak wywołać Qwen: Qwen3 VL 8B Instruct za pomocą OpenAI SDK?
Ustaw base_url OpenAI na https://api.orcarouter.ai/v1, podaj swój klucz API OrcaRouter i przekaż model="qwen/qwen3-vl-8b-instruct" w wywołaniu chat.completions.create.
Czy OrcaRouter ogranicza przepustowość Qwen: Qwen3 VL 8B Instruct?
Limity szybkości na model są zgodne z Twoim planem OrcaRouter. Darmowe plany mają niskie limity; płatne plany je podnoszą. Sprawdź /pricing, aby zobaczyć aktualne limity.

Osadź tę odznakę

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct w OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Karta modelu jako dane

GET /api/public/models/qwen/qwen3-vl-8b-instructOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt