Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
비전도구JSON
제공 Qwen · 2025-10-14

Qwen3-VL 8B Instruct — 오픈 웨이트 소형 비전-언어 모델, 8B 파라미터, 128k 컨텍스트, 생각 모드 없음.

엔드포인트:/v1/chat/completions
컨텍스트131K 토큰
최대 출력32K
입력text + image + video
출력text
p50 TTFT3.31 s
입력$0.18/ 100만 토큰
출력$0.70/ 100만 토큰
p50 TTFT3.31 s7일
p95 TTFT10.00 s7일
트래픽652.1K토큰 / 7일

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

가격

가격
입력 / 1M tokens$0.180
출력 / 1M tokens$0.700
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $3.36

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000352

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
3.31 s
출력 속도
242 tok/s
p95 TTFT
10.00 s
오류율
60.3%

공개 벤치마크

7.3
AA Coding
비교된 모델 중 0%보다 우수
138개 중 138위
7.3
AA Intelligence
비교된 모델 중 7%보다 우수
147개 중 135위
27.3
AA Math
비교된 모델 중 7%보다 우수
82개 중 76위
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
소스: artificialanalysis.ai

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News0 회 언급 · 7일

비교

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
입력 $/100만$0.18$2.00$2.00$0.86
출력 $/100만$0.70$6.00$6.00$3.44
컨텍스트131K1.0M1.0M262K
품질4/109/109/108/10
나란히 비교나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Qwen: Qwen3 VL 8B Instruct 비용은 얼마인가요?
Qwen: Qwen3 VL 8B Instruct는 OrcaRouter를 통해 1M 입력 토큰당 $0.18, 1M 출력 토큰당 $0.70에 가격이 책정되어 있습니다. 가격은 라우팅 레이어에서 실시간으로 가져옵니다.
Qwen: Qwen3 VL 8B Instruct의 컨텍스트 윈도우는 얼마인가요?
Qwen: Qwen3 VL 8B Instruct는 131K 토큰의 컨텍스트 윈도우를 지원합니다. 해당 제한까지 롱 컨텍스트 기능(RAG, 요약)을 사용하세요.
OpenAI SDK를 통해 Qwen: Qwen3 VL 8B Instruct를 호출하려면 어떻게 하나요?
OpenAI base_url을 https://api.orcarouter.ai/v1로 설정하고, OrcaRouter API 키를 제공한 후, chat.completions.create 호출에서 model="qwen/qwen3-vl-8b-instruct"를 전달하세요.
OrcaRouter가 Qwen: Qwen3 VL 8B Instruct를 속도 제한합니까?
모델별 속도 제한은 OrcaRouter 플랜을 따릅니다. 무료 티어는 보수적인 한도로 제공되며, 유료 티어는 한도를 높입니다. 현재 할당량은 /pricing에서 확인하세요.

이 배지 임베드

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="OrcaRouter 의 Qwen: Qwen3 VL 8B Instruct" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

모델 카드를 데이터로

GET /api/public/models/qwen/qwen3-vl-8b-instruct열기
기계 판독 가능:/llms.txt/llms-full.txt