Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct
av Qwen · 2025-09-23

Qwen3-VL 235B-A22B Instruct — öppen vikt vision-språkmodell, 235B totalt / 22B aktiva parametrar, 256k kontext, inget tankeläge.

p50 TTFT10.00 s
INMATNING$0.40/ 1M token
UTDATA$1.60/ 1M token
p50 TTFT10.00 s7d
p95 TTFT10.00 s7d
TRAFIK77.1Ktokens/7d

Qwen3 VL 235B A22B Instruct är en vision-språk-variant av Qwen3-modellserien, byggd av Alibaba Cloud. Den använder en mixture-of-experts-design med 235 miljarder totala parametrar, varav cirka 22…

Vad är exakt Qwen3 VL 235B A22B Instruct?

Vem är denna modell bäst lämpad för?

Vilka modaliteter stödjer modellen?

Hur levererar OrcaRouter denna modell?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-235b-a22b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Priser

Inmatning / 1M token$0.400
Utdata / 1M tokens$1.60
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $7.60

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000807

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
10.00 s
Utdatahastighet
70.3 tok/s
p95 TTFT
10.00 s
Felfrekvens
0%

Offentliga benchmarks

16.5
AA Coding
Bättre än 11% av jämförda modeller
#109 av 123
14.3
AA Intelligence
Bättre än 15% av jämförda modeller
#106 av 125
70.7
AA Math
Bättre än 64% av jämförda modeller
#29 av 81
AIME 2025
70.7
GPQA Diamond
71.2
Humanity's Last Exam
6.3
IFBench
42.7
LiveCodeBench
59.4
Long-Context Recall
31.7
MMLU-Pro
82.3
SciCode
35.9
TerminalBench Hard
6.8
τ²-Bench
35.1
Källa: artificialanalysis.ai

Så jämför den sig

Qwen3 VL 235B A22B Instructqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Input $/M$0.40$0.86$0.17$0.12
Output $/M$1.60$3.44$1.03$0.69
Kontext262K33K1.0M
Kvalitet8/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden i dollar per miljon tokens för denna modell på OrcaRouter?
Inmatningstoken kostar $0.40 per miljon och utmatningstoken kostar $1.60 per miljon. Bildtokens debiteras enligt inmatningstaxan. Det finns inget ytterligare påslag.
Vad är kontextfönstrets storlek för Qwen3 VL 235B A22B Instruct?
Den exakta kontextfönsterlängden anges inte i de tillgängliga fakta. Vanligtvis stöder Qwen3 VL-modeller långa kontextfönster (t.ex. 32K tokens), men du bör verifiera med leverantörens officiella dokumentation.
Vad är modellens främsta styrkor jämfört med andra VL-modeller?
Dess MoE-arkitektur ger en bra balans mellan kapacitet och kostnad. MMLU-Pro-poängen 82.3 indikerar stark allmänkunskap. Den är också en av de mest prisvärda stora multimodala modellerna som finns tillgängliga via OrcaRouter.
Hur jämför sig den här modellen med GPT-4V prestandamässigt?
Direkta benchmark-jämförelser tillhandahålls inte, men Qwen3 VL:s MMLU-Pro-poäng är 82.3. GPT-4V:s prestanda på samma benchmark är inte offentligt standardiserad. Prissättningen gynnar Qwen3 VL, som är betydligt billigare per token.
Hanterar OrcaRouter mina data när jag skickar bilder eller text?
OrcaRouter's datahanteringspolicyer beskrivs inte här. Generellt sett överför gatewayen data till leverantören. Du bör granska OrcaRouter's integritetspolicy och användarvillkor för detaljer om datalagring, lagringstid och delning.
Hur kan jag anropa denna modell via ett OpenAI-kompatibelt API?
Använd bas-URL:en https://api.orcarouter.ai/v1 med modell-ID "qwen/qwen3-vl-235b-a22b-instruct". Skicka en POST-förfrågan till /chat/completions med en messages-array som innehåller text- och bildinnehåll. Använd din OrcaRouter API-nyckel för autentisering.
Finns det någon gratisnivå eller provperiod för att använda den här modellen på OrcaRouter?
De tillgängliga fakta nämner ingen gratissnivå. OrcaRouter tar troligen betalt per användning. Du bör kontrollera deras webbplats för aktuella erbjudanden eller testkrediter.
Vilka bildformat stöds och hur faktureras de?
Modellen accepterar vanliga bildformat som JPEG och PNG (exakt lista från leverantör). Bilder omvandlas till tokens baserat på upplösning och detaljinställning. Dessa tokens räknas som indata till $0,40 per miljon tokens.
Kan jag använda den här modellen för realtidsapplikationer?
Latensen är högre än hos mindre modeller på grund av dess 235B totala parametrar. Den kanske inte är lämplig för användning i realtid med mycket låg latens. För nästan-realtid multimodal inferens, överväg att använda en mindre modell som finns tillgänglig på OrcaRouter.
Stöder denna modell flerbildsinmatning?
Ja, Qwen3 VL-modeller stöder generellt flera bilder i en enda konversation. Du kan inkludera flera bild-URL:er eller base64-data i ett meddelande eller över flera turer.

Bädda in denna badge

Qwen: Qwen3 VL 235B A22B Instruct$0.40/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg" alt="Qwen: Qwen3 VL 235B A22B Instruct på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 235B A22B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct)

Modellkort som data

GET /api/public/models/qwen/qwen3-vl-235b-a22b-instructÖppna