Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct
от Qwen · 2025-09-23

Qwen3-VL 235B-A22B Instruct — визуально-языковая модель с открытым весом, 235B всего / 22B активных параметров, контекст 256k, без режима размышления.

Эндпоинты:/v1/chat/completions
p50 TTFT10.00 s
ВХОД$0.40/ 1M токенов
ВЫХОД$1.60/ 1M токенов
p50 TTFT10.00 s7 д
p95 TTFT10.00 s7 д
ТРАФИК77.1Kтокенов / 7 д

Qwen3 VL 235B A22B Instruct — это визуально-языковая версия серии моделей Qwen3, созданная Alibaba Cloud. В ней используется архитектура смеси экспертов (MoE) с общим количеством параметров в 235…

Что именно такое Qwen3 VL 235B A22B Instruct?

Для кого лучше всего подходит эта модель?

Какие модальности поддерживает модель?

Как OrcaRouter доставляет эту модель?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-235b-a22b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Цены

Ввод / 1M токенов$0.400
Вывод / 1M токенов$1.60
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $7.60

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000808

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
10.00 s
Скорость вывода
70.3 tok/s
p95 TTFT
10.00 s
Частота ошибок
0%

Публичные тесты

16.5
AA Coding
Лучше, чем 11% сравниваемых моделей
109 из 123
14.3
AA Intelligence
Лучше, чем 15% сравниваемых моделей
106 из 125
70.7
AA Math
Лучше, чем 64% сравниваемых моделей
29 из 81
AIME 2025
70.7
GPQA Diamond
71.2
Humanity's Last Exam
6.3
IFBench
42.7
LiveCodeBench
59.4
Long-Context Recall
31.7
MMLU-Pro
82.3
SciCode
35.9
TerminalBench Hard
6.8
τ²-Bench
35.1
Источник: artificialanalysis.ai

Сравнение

Qwen3 VL 235B A22B Instructqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Ввод $/млн$0.40$0.86$0.17$0.12
Вывод $/млн$1.60$3.44$1.03$0.69
Контекст262K33K1.0M
Качество8/108/108/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от Qwen

FAQ

Какова стоимость в долларах за миллион токенов для этой модели на OrcaRouter?
Входные токены стоят $0.40 за миллион, а выходные токены стоят $1.60 за миллион. Токены изображений оплачиваются по ставке входных токенов. Никакой дополнительной наценки нет.
Каков размер контекстного окна Qwen3 VL 235B A22B Instruct?
Точная длина контекстного окна не указана в доступных данных. Обычно модели Qwen3 VL поддерживают большую длину контекста (например, 32K токенов), но следует проверить это по официальной документации поставщика.
Каковы основные сильные стороны модели по сравнению с другими VL моделями?
Её архитектура MoE обеспечивает хороший баланс емкости и стоимости. Показатель MMLU-Pro 82.3 свидетельствует о высоком уровне общих знаний. Это также одна из самых доступных крупных мультимодальных моделей, доступных через OrcaRouter.
Как эта модель соотносится с GPT-4V по производительности?
Прямые сравнения по бенчмаркам не приводятся, но показатель Qwen3 VL в MMLU-Pro составляет 82,3. Производительность GPT-4V в том же бенчмарке не стандартизирована публично. Ценообразование благоприятствует Qwen3 VL, который значительно дешевле за токен.
Обрабатывает ли OrcaRouter мои данные, когда я отправляю изображения или текст?
Политики обработки данных OrcaRouter здесь не описаны. Как правило, шлюз передает данные провайдеру. Вам следует ознакомиться с политикой конфиденциальности и условиями предоставления услуг OrcaRouter для получения подробной информации о хранении, сроках хранения и обмене данными.
Как я могу вызвать эту модель через API, совместимый с OpenAI?
Используйте базовый URL https://api.orcarouter.ai/v1 с идентификатором модели "qwen/qwen3-vl-235b-a22b-instruct". Отправьте POST-запрос к /chat/completions с массивом сообщений, содержащим текст и изображения. Используйте ваш ключ API OrcaRouter для аутентификации.
Есть ли бесплатный тариф или пробный период для использования этой модели на OrcaRouter?
Доступные факты не упоминают бесплатный тариф. OrcaRouter, вероятно, взимает плату за использование. Вам следует проверить их веб-сайт на предмет текущих предложений или пробных кредитов.
Какие форматы изображений поддерживаются и как они оплачиваются?
Модель принимает распространенные форматы изображений, такие как JPEG и PNG (точный список предоставляется провайдером). Изображения преобразуются в токены в зависимости от разрешения и настройки детализации. Эти токены учитываются как входные по цене $0.40 за миллион токенов.
Могу ли я использовать эту модель для приложений реального времени?
Задержка выше, чем у меньших моделей, из-за его 235B общих параметров. Он может не подходить для использования в реальном времени с очень низкой задержкой. Для многомодального вывода, близкого к реальному времени, рассмотрите использование меньшей модели, доступной на OrcaRouter.
Поддерживает ли эта модель ввод нескольких изображений?
Да, модели Qwen3 VL обычно поддерживают несколько изображений в одном разговоре. Вы можете включить несколько URL-адресов изображений или данные в формате base64 в одно сообщение или в нескольких сообщениях.

Встроить значок

Qwen: Qwen3 VL 235B A22B Instruct$0.40/M in10000ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg" alt="Qwen: Qwen3 VL 235B A22B Instruct в OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 235B A22B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct)

Карточка модели в виде данных

GET /api/public/models/qwen/qwen3-vl-235b-a22b-instructОткрыть
Машиночитаемо:/llms.txt/llms-full.txt