Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct
oleh Qwen · 2025-09-23

Qwen3-VL 235B-A22B Instruct — model visi-bahasa dengan bobot terbuka, 235B total / 22B parameter aktif, 256k konteks, tanpa mode berpikir.

p50 TTFT700 ms
INPUT$0.40/ 1M token
OUTPUT$1.60/ 1M token
p50 TTFT700 ms7h
p95 TTFT8.45 s7h
LALU LINTAS8.3Ktoken / 7h

Qwen3 VL 235B A22B Instruct adalah varian vision-language dari seri model Qwen3, yang dibangun oleh Alibaba Cloud. Model ini menggunakan desain mixture-of-experts dengan total 235 miliar parameter,…

Apa sebenarnya Qwen3 VL 235B A22B Instruct?

Untuk siapa model ini paling cocok?

Apa saja modalitas yang didukung oleh model ini?

Bagaimana OrcaRouter memberikan model ini?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-235b-a22b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Harga

Harga
Input / 1M token$0.400
Output / 1M token$1.60
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $7.60

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000807

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
700 ms
Kecepatan output
29.7 tok/s
p95 TTFT
8.45 s
Tingkat kesalahan
35.0%

Benchmark publik

16.5
AA Coding
Lebih baik dari 10% model yang dibandingkan
#124 dari 138
9.9
AA Intelligence
Lebih baik dari 12% model yang dibandingkan
#128 dari 147
70.7
AA Math
Lebih baik dari 63% model yang dibandingkan
#30 dari 82
AIME 2025
70.7
GPQA Diamond
71.2
Humanity's Last Exam
6.6
IFBench
42.7
LiveCodeBench
59.4
Long-Context Recall
32.7
MMLU-Pro
82.3
SciCode
35.9
TerminalBench Hard
6.8
τ²-Bench
35.1
Sumber: artificialanalysis.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News0 sebutan · 7 hr

Perbandingan

Qwen3 VL 235B A22B InstructQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Input $/M$0.40$2.00$2.00$0.86
Output $/M$1.60$6.00$6.00$3.44
Konteks—1.0M1.0M262K
Kualitas—9/109/108/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya dalam dolar per juta token untuk model ini di OrcaRouter?
Biaya token masukan adalah $0.40 per juta dan token keluaran adalah $1.60 per juta. Token gambar ditagih dengan tarif masukan. Tidak ada markup tambahan.
Berapa ukuran jendela konteks dari Qwen3 VL 235B A22B Instruct?
Panjang jendela konteks yang tepat tidak disediakan dalam fakta yang tersedia. Biasanya, model Qwen3 VL mendukung panjang konteks yang besar (misalnya, 32K token), tetapi Anda harus memverifikasi dengan dokumentasi resmi penyedia.
Apa keunggulan utama model ini dibandingkan dengan model VL lainnya?
Arsitektur MoE-nya memberikan keseimbangan yang baik antara kapasitas dan biaya. Skor MMLU-Pro sebesar 82,3 menunjukkan pengetahuan umum yang kuat. Model ini juga merupakan salah satu model multimodal besar yang paling terjangkau yang tersedia melalui OrcaRouter.
Bagaimana model ini dibandingkan dengan GPT-4V dalam hal kinerja?
Perbandingan benchmark langsung tidak disediakan, tetapi skor MMLU-Pro Qwen3 VL adalah 82.3. Performa GPT-4V pada benchmark yang sama tidak terstandarisasi secara publik. Harga lebih menguntungkan Qwen3 VL, yang secara signifikan lebih murah per token.
Apakah OrcaRouter menangani data saya ketika saya mengirim gambar atau teks?
Kebijakan penanganan data OrcaRouter tidak dirinci di sini. Umumnya, gateway meneruskan data ke penyedia. Anda harus meninjau kebijakan privasi dan persyaratan layanan OrcaRouter untuk informasi spesifik tentang penyimpanan, retensi, dan pembagian data.
Bagaimana cara memanggil model ini melalui API yang kompatibel dengan OpenAI?
Gunakan URL dasar https://api.orcarouter.ai/v1 dengan model ID "qwen/qwen3-vl-235b-a22b-instruct". Kirim permintaan POST ke /chat/completions dengan array pesan yang berisi konten teks dan gambar. Gunakan kunci API OrcaRouter Anda untuk autentikasi.
Apakah ada tingkat gratis atau uji coba untuk menggunakan model ini di OrcaRouter?
Fakta yang tersedia tidak menyebutkan adanya tingkatan gratis. OrcaRouter kemungkinan mengenakan biaya per penggunaan. Anda harus memeriksa situs web mereka untuk penawaran terkini atau kredit uji coba.
Format gambar apa yang didukung dan bagaimana cara penagihannya?
Model ini menerima format gambar umum seperti JPEG dan PNG (daftar pastinya dari penyedia). Gambar dikonversi menjadi token berdasarkan resolusi dan pengaturan detail. Token-token tersebut dihitung sebagai input sebesar $0.40 per juta token.
Bisakah saya menggunakan model ini untuk aplikasi real-time?
Latensi lebih tinggi daripada model yang lebih kecil karena total parameternya 235B. Mungkin tidak cocok untuk penggunaan real-time dengan latensi sangat rendah. Untuk inferensi multimodal hampir real-time, pertimbangkan menggunakan model yang lebih kecil yang tersedia di OrcaRouter.
Apakah model ini mendukung input multi-gambar?
Ya, model Qwen3 VL umumnya mendukung beberapa gambar dalam satu percakapan. Anda dapat menyertakan beberapa URL gambar atau data base64 dalam satu pesan atau di beberapa giliran.

Sematkan lencana ini

Qwen: Qwen3 VL 235B A22B Instruct•$0.40/M in•700ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg" alt="Qwen: Qwen3 VL 235B A22B Instruct di OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 235B A22B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct)

Kartu model sebagai data

GET /api/public/models/qwen/qwen3-vl-235b-a22b-instructBuka