Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
VisãoFerramentasJSON
por Qwen · 2025-10-14

Qwen3-VL 8B Instruct — modelo pequeno de visão-linguagem de pesos abertos, 8B parâmetros, contexto de 128k, sem modo de pensamento.

ctx131K tokens
Saída máx.32K
Entradatext + image + video
Saídatext
p50 TTFT3.31 s
ENTRADA$0.18/ 1M tokens
SAÍDA$0.70/ 1M tokens
p50 TTFT3.31 s7 d
p95 TTFT10.00 s7 d
TRÁFEGO652.1Ktokens / 7 d

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preços

Preços
Entrada / 1M tokens$0.180
Saída / 1M tokens$0.700
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $3.36

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000353

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
3.31 s
Velocidade de saída
242 tok/s
p95 TTFT
10.00 s
Taxa de erro
60.3%

Benchmarks públicos

7.3
AA Coding
Melhor que 0% dos modelos comparados
nº 138 de 138
7.3
AA Intelligence
Melhor que 7% dos modelos comparados
nº 135 de 147
27.3
AA Math
Melhor que 7% dos modelos comparados
nº 76 de 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Fonte: artificialanalysis.ai

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News0 menções · 7 d

Comparativo

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Entrada $/M$0.18$2.00$2.00$0.86
Saída $/M$0.70$6.00$6.00$3.44
Contexto131K1.0M1.0M262K
Qualidade4/109/109/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa Qwen: Qwen3 VL 8B Instruct no OrcaRouter?
Qwen: Qwen3 VL 8B Instruct tem o preço de $0.18 por 1M tokens de entrada e $0.70 por 1M tokens de saída via OrcaRouter. Os preços são obtidos em tempo real da camada de roteamento.
Qual é a janela de contexto de Qwen: Qwen3 VL 8B Instruct's?
Qwen: Qwen3 VL 8B Instruct suporta uma janela de contexto de 131K tokens. Use recursos de contexto longo (RAG, sumarização) até esse limite.
Como chamar Qwen: Qwen3 VL 8B Instruct via o SDK da OpenAI?
Defina o base_url do OpenAI como https://api.orcarouter.ai/v1, forneça sua chave de API do OrcaRouter e passe model="qwen/qwen3-vl-8b-instruct" na chamada chat.completions.create.
O OrcaRouter limita a taxa de Qwen: Qwen3 VL 8B Instruct?
Os limites de taxa por modelo seguem o seu plano OrcaRouter. Os planos gratuitos vêm com limites conservadores; os planos pagos os aumentam. Verifique /pricing para as cotas atuais.

Incorporar este selo

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct no OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Ficha do modelo como dados

GET /api/public/models/qwen/qwen3-vl-8b-instructAbrir
Legível por máquina:/llms.txt/llms-full.txt