Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct
bởi Qwen · 2025-09-23

Qwen3-VL 235B-A22B Instruct — mô hình ngôn ngữ-thị giác trọng số mở, 235B tổng / 22B tham số hoạt động, ngữ cảnh 256k, không có chế độ suy nghĩ.

Điểm cuối:/v1/chat/completions
TTFT p5010.00 s
ĐẦU VÀO$0.40/ 1M token
ĐẦU RA$1.60/ 1M token
TTFT p5010.00 s7 ngày
p95 TTFT10.00 s7 ngày
LƯU LƯỢNG77.1Ktokens / 7 ngày

Qwen3 VL 235B A22B Instruct là một biến thể ngôn ngữ thị giác của dòng mô hình Qwen3, được xây dựng bởi Alibaba Cloud. Nó sử dụng thiết kế hỗn hợp chuyên gia (mixture-of-experts) với tổng số 235 tỷ…

Chính xác thì Qwen3 VL 235B A22B Instruct là gì?

Mô hình này phù hợp nhất với đối tượng nào?

Mô hình hỗ trợ những phương thức nào?

OrcaRouter phân phối mô hình này như thế nào?

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3-vl-235b-a22b-instruct",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Giá

Đầu vào / 1M tokens$0.400
Đầu ra / 1M tokens$1.60
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $7.60

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.000807

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
10.00 s
Tốc độ đầu ra
70.3 tok/s
p95 TTFT
10.00 s
Tỷ lệ lỗi
0%

Benchmark công khai

16.5
AA Coding
Tốt hơn 11% số mô hình được so sánh
#109 / 123
14.3
AA Intelligence
Tốt hơn 15% số mô hình được so sánh
#106 / 125
70.7
AA Math
Tốt hơn 64% số mô hình được so sánh
#29 / 81
AIME 2025
70.7
GPQA Diamond
71.2
Humanity's Last Exam
6.3
IFBench
42.7
LiveCodeBench
59.4
Long-Context Recall
31.7
MMLU-Pro
82.3
SciCode
35.9
TerminalBench Hard
6.8
τ²-Bench
35.1
Nguồn: artificialanalysis.ai

So sánh

Qwen3 VL 235B A22B Instructqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Đầu vào $/M$0.40$0.86$0.17$0.12
Đầu ra $/M$1.60$3.44$1.03$0.69
Ngữ cảnh262K33K1.0M
Chất lượng8/108/108/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí tính bằng đô la trên mỗi triệu token cho mô hình này trên OrcaRouter là bao nhiêu?
Chi phí token đầu vào là $0.40 mỗi triệu và chi phí token đầu ra là $1.60 mỗi triệu. Token hình ảnh được tính theo giá đầu vào. Không có phụ phí nào thêm.
Kích thước cửa sổ ngữ cảnh của Qwen3 VL 235B A22B Instruct là bao nhiêu?
Độ dài cửa sổ ngữ cảnh chính xác không được cung cấp trong các sự kiện có sẵn. Thông thường, các mô hình Qwen3 VL hỗ trợ độ dài ngữ cảnh lớn (e.g., 32K tokens), nhưng bạn nên xác minh với tài liệu chính thức của nhà cung cấp.
Các điểm mạnh chính của mô hình so với các mô hình VL khác là gì?
Kiến trúc MoE của nó cung cấp sự cân bằng tốt giữa dung lượng và chi phí. Điểm MMLU-Pro là 82.3 cho thấy kiến thức tổng quát mạnh mẽ. Nó cũng là một trong những mô hình đa phương thức lớn có giá cả phải chăng nhất hiện có thông qua OrcaRouter.
Mô hình này so sánh thế nào với GPT-4V về mặt hiệu suất?
So sánh trực tiếp trên benchmark không được cung cấp, nhưng điểm MMLU-Pro của Qwen3 VL là 82,3. Hiệu suất của GPT-4V trên cùng một benchmark không được chuẩn hóa công khai. Về giá cả, Qwen3 VL có lợi thế hơn, rẻ hơn đáng kể mỗi token.
OrcaRouter có xử lý dữ liệu của tôi khi tôi gửi hình ảnh hoặc văn bản không?
Chính sách xử lý dữ liệu của OrcaRouter không được nêu chi tiết tại đây. Thông thường, gateway chuyển dữ liệu tới nhà cung cấp. Bạn nên xem lại chính sách bảo mật và điều khoản dịch vụ của OrcaRouter để biết chi tiết về lưu trữ, duy trì và chia sẻ dữ liệu.
Làm cách nào để gọi mô hình này qua API tương thích với OpenAI?
Sử dụng URL cơ sở https://api.orcarouter.ai/v1 với ID mô hình "qwen/qwen3-vl-235b-a22b-instruct". Gửi yêu cầu POST đến /chat/completions với mảng messages chứa nội dung văn bản và hình ảnh. Sử dụng khóa API OrcaRouter của bạn để xác thực.
Có gói miễn phí hoặc bản dùng thử nào để sử dụng mô hình này trên OrcaRouter không?
Các sự kiện có sẵn không đề cập đến gói miễn phí. OrcaRouter có thể tính phí theo mức sử dụng. Bạn nên kiểm tra trang web của họ để biết các ưu đãi hiện tại hoặc tín dụng dùng thử.
Những định dạng hình ảnh nào được hỗ trợ và chúng được tính phí như thế nào?
Mô hình chấp nhận các định dạng hình ảnh phổ biến như JPEG và PNG (danh sách chính xác từ nhà cung cấp). Hình ảnh được chuyển đổi thành token dựa trên độ phân giải và cài đặt chi tiết. Các token đó được tính vào đầu vào với giá $0.40 cho mỗi triệu token.
Tôi có thể sử dụng mô hình này cho các ứng dụng thời gian thực không?
Độ trễ cao hơn so với các mô hình nhỏ hơn do có tổng số 235B tham số. Nó có thể không phù hợp cho các ứng dụng thời gian thực có độ trễ rất thấp. Để suy luận đa phương thức gần thời gian thực, hãy cân nhắc sử dụng một mô hình nhỏ hơn có sẵn trên OrcaRouter.
Mô hình này có hỗ trợ đầu vào nhiều ảnh không?
Có, các mô hình Qwen3 VL thường hỗ trợ nhiều hình ảnh trong một cuộc trò chuyện. Bạn có thể bao gồm nhiều URL hình ảnh hoặc dữ liệu base64 trong một tin nhắn hoặc qua nhiều lượt tương tác.

Nhúng huy hiệu này

Qwen: Qwen3 VL 235B A22B Instruct$0.40/M in10000ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg" alt="Qwen: Qwen3 VL 235B A22B Instruct trên OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 VL 235B A22B Instruct](https://www.orcarouter.ai/embed/qwen/qwen3-vl-235b-a22b-instruct.svg)](https://www.orcarouter.ai/models/qwen/qwen3-vl-235b-a22b-instruct)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/qwen/qwen3-vl-235b-a22b-instructMở
Máy đọc được:/llms.txt/llms-full.txt