Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct
от Qwen · 2025-09-23

Qwen3-VL 235B-A22B Instruct — визуально-языковая модель с открытым весом, 235B всего / 22B активных параметров, контекст 256k, без режима размышления.

Эндпоинты:/v1/chat/completions
p50 TTFT700 ms
ВХОД$0.40/ 1M токенов
ВЫХОД$1.60/ 1M токенов
p50 TTFT700 ms7 д
p95 TTFT8.45 s7 д
ТРАФИК8.3Kтокенов / 7 д

Qwen3 VL 235B A22B Instruct — это визуально-языковая версия серии моделей Qwen3, созданная Alibaba Cloud. В ней используется архитектура смеси экспертов (MoE) с общим количеством параметров в 235…

Что именно такое Qwen3 VL 235B A22B Instruct?

Для кого лучше всего подходит эта модель?

Какие модальности поддерживает модель?

Как OrcaRouter доставляет эту модель?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-235b-a22b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Цены

Цены
Ввод / 1M токенов$0.400
Вывод / 1M токенов$1.60
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $7.60

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000808

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
700 ms
Скорость вывода
29.7 tok/s
p95 TTFT
8.45 s
Частота ошибок
35.0%

Публичные тесты

16.5
AA Coding
Лучше, чем 10% сравниваемых моделей
124 из 138
9.9
AA Intelligence
Лучше, чем 12% сравниваемых моделей
128 из 147
70.7
AA Math
Лучше, чем 63% сравниваемых моделей
30 из 82
AIME 2025
70.7
GPQA Diamond
71.2
Humanity's Last Exam
6.6
IFBench
42.7
LiveCodeBench
59.4
Long-Context Recall
32.7
MMLU-Pro
82.3
SciCode
35.9
TerminalBench Hard
6.8
τ²-Bench
35.1
Источник: artificialanalysis.ai

Обсуждения в сообществе

О чём говорят разработчики на этой неделе

Hacker News0 упоминаний · 7 дн

Сравнение

Qwen3 VL 235B A22B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Ввод $/млн$0.40$2.00$2.00$0.86
Вывод $/млн$1.60$6.00$6.00$3.44
Контекст—1.0M1.0M262K
Качество—9/109/108/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от Qwen

FAQ

Какова стоимость в долларах за миллион токенов для этой модели на OrcaRouter?
Входные токены стоят $0.40 за миллион, а выходные токены стоят $1.60 за миллион. Токены изображений оплачиваются по ставке входных токенов. Никакой дополнительной наценки нет.
Каков размер контекстного окна Qwen3 VL 235B A22B Instruct?
Точная длина контекстного окна не указана в доступных данных. Обычно модели Qwen3 VL поддерживают большую длину контекста (например, 32K токенов), но следует проверить это по официальной документации поставщика.
Каковы основные сильные стороны модели по сравнению с другими VL моделями?
Её архитектура MoE обеспечивает хороший баланс емкости и стоимости. Показатель MMLU-Pro 82.3 свидетельствует о высоком уровне общих знаний. Это также одна из самых доступных крупных мультимодальных моделей, доступных через OrcaRouter.
Как эта модель соотносится с GPT-4V по производительности?
Прямые сравнения по бенчмаркам не приводятся, но показатель Qwen3 VL в MMLU-Pro составляет 82,3. Производительность GPT-4V в том же бенчмарке не стандартизирована публично. Ценообразование благоприятствует Qwen3 VL, который значительно дешевле за токен.
Обрабатывает ли OrcaRouter мои данные, когда я отправляю изображения или текст?
Политики обработки данных OrcaRouter здесь не описаны. Как правило, шлюз передает данные провайдеру. Вам следует ознакомиться с политикой конфиденциальности и условиями предоставления услуг OrcaRouter для получения подробной информации о хранении, сроках хранения и обмене данными.
Как я могу вызвать эту модель через API, совместимый с OpenAI?
Используйте базовый URL https://api.orcarouter.ai/v1 с идентификатором модели "qwen/qwen3-vl-235b-a22b-instruct". Отправьте POST-запрос к /chat/completions с массивом сообщений, содержащим текст и изображения. Используйте ваш ключ API OrcaRouter для аутентификации.
Есть ли бесплатный тариф или пробный период для использования этой модели на OrcaRouter?
Доступные факты не упоминают бесплатный тариф. OrcaRouter, вероятно, взимает плату за использование. Вам следует проверить их веб-сайт на предмет текущих предложений или пробных кредитов.
Какие форматы изображений поддерживаются и как они оплачиваются?
Модель принимает распространенные форматы изображений, такие как JPEG и PNG (точный список предоставляется провайдером). Изображения преобразуются в токены в зависимости от разрешения и настройки детализации. Эти токены учитываются как входные по цене $0.40 за миллион токенов.
Могу ли я использовать эту модель для приложений реального времени?
Задержка выше, чем у меньших моделей, из-за его 235B общих параметров. Он может не подходить для использования в реальном времени с очень низкой задержкой. Для многомодального вывода, близкого к реальному времени, рассмотрите использование меньшей модели, доступной на OrcaRouter.
Поддерживает ли эта модель ввод нескольких изображений?
Да, модели Qwen3 VL обычно поддерживают несколько изображений в одном разговоре. Вы можете включить несколько URL-адресов изображений или данные в формате base64 в одно сообщение или в нескольких сообщениях.

Встроить значок

Qwen: Qwen3 VL 235B A22B Instruct•$0.40/M in•700ms p50•через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg" alt="Qwen: Qwen3 VL 235B A22B Instruct в OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 235B A22B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct)

Карточка модели в виде данных

GET /api/public/models/qwen/qwen3-vl-235b-a22b-instructОткрыть
Машиночитаемо:/llms.txt/llms-full.txt