qwen/qwen3.5-flash

qwen/qwen3.5-flash
Thị giácCông cụJSONSuy luận
bởi qwen

Qwen3.5 Flash — trò chuyện đa phương thức (văn bản/hình ảnh/video) tối ưu hóa chi phí, ngữ cảnh 1M.

Điểm cuối:/v1/chat/completions
ngữ cảnh1M token
Đầu ra tối đa65K
Đầu vàotext + image + video
Đầu ratext
TTFT p502.71 s
ĐẦU VÀO$0.10/ 1M token
ĐẦU RA$0.40/ 1M token
TTFT p502.71 s7 ngày
p95 TTFT10.00 s7 ngày
LƯU LƯỢNG1.3Mtokens / 7 ngày

Qwen3.5 Flash là mô hình ngôn ngữ đa phương thức thuộc dòng Qwen, được thiết kế để suy luận nhanh và chi phí thấp. Mô hình chấp nhận đầu vào dạng văn bản, hình ảnh và video, đồng thời tạo ra phản hồi…

Qwen3.5 Flash là gì?

Mô hình này dành cho ai?

Tổng quan thông số kỹ thuật chính

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Giá

Đầu vào / 1M tokens$0.100
Đầu ra / 1M tokens$0.400
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $1.90

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.000202

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
2.71 s
Tốc độ đầu ra
206 tok/s
p95 TTFT
10.00 s
Tỷ lệ lỗi
7.3%

Benchmark công khai

Thảo luận cộng đồng

Điều các nhà phát triển đang nói tuần này

Hacker News0 lượt nhắc · 7 ngày

So sánh

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Đầu vào $/M$0.10$2.00$0.86$0.17
Đầu ra $/M$0.40$6.00$3.44$1.03
Ngữ cảnh1.0M1.0M262K33K
Chất lượng6/109/108/108/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí sử dụng Qwen3.5 Flash trên OrcaRouter là bao nhiêu?
Chi phí là $0.10 cho mỗi 1 triệu token đầu vào và $0.40 cho mỗi 1 triệu token đầu ra. Đây là mức giá của nhà cung cấp, không có bất kỳ khoản chênh lệch nào từ OrcaRouter. Bạn trả chính xác số tiền mà nhà cung cấp tính, không có thêm phí nào.
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Cửa sổ ngữ cảnh là 1.048.576 token (khoảng 1 triệu token). Điều này bao gồm cả token đầu vào và đầu ra trên toàn bộ lịch sử hội thoại. Số lượng đầu ra tối đa mỗi lần sinh là 65.536 token.
Điểm mạnh của Qwen3.5 Flash là gì?
Các điểm mạnh bao gồm đầu vào đa phương thức (văn bản, hình ảnh, video), cửa sổ ngữ cảnh rất lớn 1M, đầu ra dài 65K token, chi phí thấp trên mỗi token, và suy luận nhanh so với các mô hình Qwen lớn hơn. Nó lý tưởng cho các tác vụ đa phương thức khối lượng lớn hoặc thời gian thực.
Nó so sánh như thế nào với các mô hình Qwen lớn hơn?
Các mô hình Qwen lớn hơn như Qwen3.5-72B mang lại độ chính xác cao hơn trong suy luận phức tạp nhưng chậm hơn và đắt hơn. Qwen3.5 Flash đánh đổi một phần độ chính xác để lấy tốc độ và hiệu quả chi phí, trong khi vẫn giữ nguyên các khả năng đa phương thức và ngữ cảnh dài.
OrcaRouter có tăng giá của nhà cung cấp không?
Không. Giá được chuyển qua theo mức giá của nhà cung cấp, không có phụ phí. Bạn trả chính xác $0.10 cho mỗi 1M token đầu vào và $0.40 cho mỗi 1M token đầu ra cho Qwen3.5 Flash qua OrcaRouter.
Tôi có thể gọi Qwen3.5 Flash bằng API tương thích với OpenAI không?
Có. OrcaRouter cung cấp một endpoint tương thích OpenAI tại https://api.orcarouter.ai/v1. Sử dụng ID mô hình "qwen/qwen3.5-flash" với khóa API OrcaRouter của bạn. Định dạng yêu cầu và phản hồi khớp với API chat completions của OpenAI.
OrcaRouter xử lý dữ liệu như thế nào?
Chính sách xử lý dữ liệu được xác định bởi OrcaRouter và Qwen. Mục nhập danh mục không cung cấp chi tiết cụ thể. Người dùng nên xem xét chính sách bảo mật của OrcaRouter và các điều khoản sử dụng dữ liệu của Qwen trước khi gửi dữ liệu nhạy cảm.
Mô hình hỗ trợ những phương thức nào?
Nó hỗ trợ đầu vào văn bản, hình ảnh và video. Hình ảnh có thể được cung cấp dưới dạng URL hoặc dữ liệu base64 trong tin nhắn người dùng. Đầu vào video thường được gửi dưới dạng một chuỗi các khung hình (hình ảnh). Mô hình chỉ tạo ra đầu ra dạng văn bản.
Có yêu cầu về số lượng token tối thiểu hoặc tối đa không?
Không có số token tối thiểu. Số token đầu vào tối đa (bao gồm lịch sử hội thoại) là 1.048.576 token. Số token đầu ra tối đa cho mỗi phản hồi là 65.536. Sử dụng tham số max_tokens để kiểm soát độ dài đầu ra.
Làm thế nào để bắt đầu gọi mô hình này thông qua OrcaRouter?
Đăng ký OrcaRouter để nhận khóa API. Thiết lập base URL thành https://api.orcarouter.ai/v1 trong mã của bạn. Sử dụng model ID "qwen/qwen3.5-flash" và gửi một yêu cầu hoàn thành chat tiêu chuẩn với nội dung đa phương thức của bạn. Xem tài liệu OrcaRouter để biết các ví dụ.

Nhúng huy hiệu này

qwen/qwen3.5-flash$0.10/M in2705ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash trên OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/qwen/qwen3.5-flashMở
Máy đọc được:/llms.txt/llms-full.txt