Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct
przez Qwen · 2025-09-23

Qwen3-VL 235B-A22B Instruct — model wizyjno-językowy o otwartych wagach, 235B łącznie / 22B aktywnych parametrów, kontekst 256k, brak trybu myślenia.

Punkty końcowe:/v1/chat/completions
p50 TTFT10.00 s
WEJŚCIE$0.40/ 1M tokenów
WYJŚCIE$1.60/ 1M tokenów
p50 TTFT10.00 s7 d
p95 TTFT10.00 s7 d
RUCH77.1Ktokenów / 7 d

Qwen3 VL 235B A22B Instruct to wariant wizyjno-językowy serii modeli Qwen3, stworzony przez Alibaba Cloud. Wykorzystuje architekturę mieszanki ekspertów (MoE) z 235 miliardami parametrów ogółem, z…

Czym dokładnie jest Qwen3 VL 235B A22B Instruct?

Dla kogo ten model jest najbardziej odpowiedni?

Jakie modalności obsługuje model?

Jak OrcaRouter dostarcza ten model?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-235b-a22b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Cennik

Wejście / 1M tokenów$0.400
Wyjście / 1M tokenów$1.60
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $7.60

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000808

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
10.00 s
Prędkość wyjścia
70.3 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
0%

Publiczne benchmarki

16.5
AA Coding
Lepszy niż 11% porównywanych modeli
109 z 123
14.3
AA Intelligence
Lepszy niż 15% porównywanych modeli
106 z 125
70.7
AA Math
Lepszy niż 64% porównywanych modeli
29 z 81
AIME 2025
70.7
GPQA Diamond
71.2
Humanity's Last Exam
6.3
IFBench
42.7
LiveCodeBench
59.4
Long-Context Recall
31.7
MMLU-Pro
82.3
SciCode
35.9
TerminalBench Hard
6.8
τ²-Bench
35.1
Źródło: artificialanalysis.ai

Porównanie

Qwen3 VL 235B A22B Instructqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Wejście $/M$0.40$0.86$0.17$0.12
Wyjście $/M$1.60$3.44$1.03$0.69
Kontekst262K33K1.0M
Jakość8/108/108/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Jaki jest koszt w dolarach za milion tokenów dla tego modelu na OrcaRouter?
Tokeny wejściowe kosztują 0,40 $ za milion, a tokeny wyjściowe 1,60 $ za milion. Tokeny obrazów są rozliczane według stawki wejściowej. Nie ma żadnej dodatkowej marży.
Jaki jest rozmiar okna kontekstowego modelu Qwen3 VL 235B A22B Instruct?
Dokładna długość okna kontekstu nie jest podana w dostępnych faktach. Zazwyczaj modele Qwen3 VL obsługują duże długości kontekstu (np. 32K tokenów), ale powinieneś zweryfikować to w oficjalnej dokumentacji dostawcy.
Jakie są główne mocne strony modelu w porównaniu do innych modeli VL?
Jego architektura MoE zapewnia dobrą równowagę między pojemnością a kosztem. Wynik MMLU-Pro wynoszący 82,3 wskazuje na silną wiedzę ogólną. Jest to również jeden z najtańszych dużych modeli multimodalnych dostępnych za pośrednictwem OrcaRouter.
Jak ten model wypada w porównaniu do GPT-4V pod względem wydajności?
Nie podano bezpośrednich porównań benchmarków, ale wynik Qwen3 VL w MMLU-Pro wynosi 82,3. Wydajność GPT-4V w tym samym benchmarku nie jest publicznie ustandaryzowana. Ceny sprzyjają Qwen3 VL, które jest znacznie tańsze za token.
Czy OrcaRouter obsługuje moje dane, gdy wysyłam obrazy lub tekst?
Zasady postępowania OrcaRouter z danymi nie są tutaj szczegółowo opisane. Ogólnie rzecz biorąc, brama przekazuje dane do dostawcy. Powinieneś zapoznać się z polityką prywatności i warunkami korzystania z usługi OrcaRouter, aby poznać szczegóły dotyczące przechowywania, retencji i udostępniania danych.
Jak mogę wywołać ten model za pomocą API kompatybilnego z OpenAI?
Użyj podstawowego adresu URL https://api.orcarouter.ai/v1 z identyfikatorem modelu "qwen/qwen3-vl-235b-a22b-instruct". Wyślij żądanie POST do /chat/completions z tablicą wiadomości zawierającą treść tekstową i graficzną. Do uwierzytelnienia użyj swojego klucza API OrcaRouter.
Czy istnieje darmowy poziom lub okres próbny dla korzystania z tego modelu na OrcaRouter?
Dostępne fakty nie wspominają o darmowym poziomie. OrcaRouter prawdopodobnie pobiera opłaty za użytkowanie. Powinieneś sprawdzić ich stronę internetową, aby poznać aktualne oferty lub kredyty próbne.
Jakie formaty obrazów są obsługiwane i jak są one rozliczane?
Model akceptuje popularne formaty obrazów, takie jak JPEG i PNG (dokładna lista od dostawcy). Obrazy są konwertowane na tokeny na podstawie rozdzielczości i ustawienia szczegółowości. Te tokeny są wliczane do wejścia po $0.40 za milion tokenów.
Czy mogę użyć tego modelu do zastosowań czasu rzeczywistego?
Opóźnienie jest wyższe niż w przypadku mniejszych modeli ze względu na swoje 235B parametrów łącznych. Może nie być odpowiedni do zastosowań wymagających bardzo niskiego opóźnienia w czasie rzeczywistym. Do wnioskowania multimodalnego w czasie bliskim rzeczywistemu rozważ użycie mniejszego modelu dostępnego w OrcaRouter.
Czy ten model obsługuje wprowadzanie wielu obrazów?
Tak, modele Qwen3 VL generalnie obsługują wiele obrazów w jednej konwersacji. Możesz dołączyć kilka image URLs lub base64 data w jednej wiadomości lub w wielu turach.

Osadź tę odznakę

Qwen: Qwen3 VL 235B A22B Instruct$0.40/M in10000ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg" alt="Qwen: Qwen3 VL 235B A22B Instruct w OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 235B A22B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct)

Karta modelu jako dane

GET /api/public/models/qwen/qwen3-vl-235b-a22b-instructOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt