Qwen3 VL 8B Instruct

qwen/qwen3-vl-8b-instruct
ЗрениеИнструментыJSON
от Qwen · 2025-10-14

Qwen3-VL 8B Instruct — небольшая визуально-языковая модель с открытыми весами, 8B параметров, контекст 128k, без режима размышлений.

Эндпоинты:/v1/chat/completions
конт.131K токенов
Макс. вывод32K
Вводtext + image + video
Выводtext
p50 TTFT3.31 s
ВХОД$0.18/ 1M токенов
ВЫХОД$0.70/ 1M токенов
p50 TTFT3.31 s7 д
p95 TTFT10.00 s7 д
ТРАФИК652.1Kтокенов / 7 д

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-8b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • enable_search
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Цены

Цены
Ввод / 1M токенов$0.180
Вывод / 1M токенов$0.700
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $3.36

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000353

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
3.31 s
Скорость вывода
242 tok/s
p95 TTFT
10.00 s
Частота ошибок
60.3%

Публичные тесты

7.3
AA Coding
Лучше, чем 0% сравниваемых моделей
138 из 138
7.3
AA Intelligence
Лучше, чем 7% сравниваемых моделей
135 из 147
27.3
AA Math
Лучше, чем 7% сравниваемых моделей
76 из 82
AIME 2025
27.3
GPQA Diamond
42.7
Humanity's Last Exam
2.7
IFBench
32.3
LiveCodeBench
33.2
Long-Context Recall
16.7
MMLU-Pro
68.6
SciCode
17.4
TerminalBench Hard
2.3
τ²-Bench
29.2
Источник: artificialanalysis.ai

Обсуждения в сообществе

О чём говорят разработчики на этой неделе

Hacker News0 упоминаний · 7 дн

Сравнение

Qwen3 VL 8B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Ввод $/млн$0.18$2.00$2.00$0.86
Вывод $/млн$0.70$6.00$6.00$3.44
Контекст131K1.0M1.0M262K
Качество4/109/109/108/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от Qwen

FAQ

Сколько стоит Qwen: Qwen3 VL 8B Instruct на OrcaRouter?
Qwen: Qwen3 VL 8B Instruct стоит $0.18 за 1M входных токенов и $0.70 за 1M выходных токенов через OrcaRouter. Цены берутся в реальном времени из уровня маршрутизации.
Какое контекстное окно у Qwen: Qwen3 VL 8B Instruct?
Qwen: Qwen3 VL 8B Instruct поддерживает контекстное окно в 131K токенов. Используйте функции длинного контекста (RAG, суммаризация) до этого предела.
Как вызвать Qwen: Qwen3 VL 8B Instruct через OpenAI SDK?
Установите OpenAI base_url равным https://api.orcarouter.ai/v1, укажите свой API-ключ OrcaRouter и передайте model="qwen/qwen3-vl-8b-instruct" в вызове chat.completions.create.
Ограничивает ли OrcaRouter скорость Qwen: Qwen3 VL 8B Instruct?
Ограничения скорости для каждой модели соответствуют вашему плану OrcaRouter. Бесплатные тарифы имеют скромные лимиты; платные тарифы их увеличивают. Текущие квоты смотрите в /pricing.

Встроить значок

Qwen: Qwen3 VL 8B Instruct•$0.18/M in•3312ms p50•через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg" alt="Qwen: Qwen3 VL 8B Instruct в OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 8B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-8b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-8b-instruct)

Карточка модели в виде данных

GET /api/public/models/qwen/qwen3-vl-8b-instructОткрыть
Машиночитаемо:/llms.txt/llms-full.txt