qwen/qwen3.5-flash

qwen/qwen3.5-flash
WizjaNarzędziaJSONRozumowanie
przez qwen

Qwen3.5 Flash — multimodalny czat (tekst/obraz/wideo) zoptymalizowany pod kątem kosztów, kontekst 1M.

Punkty końcowe:/v1/chat/completions
kont.1M tokenów
Maks. wyjście65K
Wejścietext + image + video
Wyjścietext
p50 TTFT2.71 s
WEJŚCIE$0.10/ 1M tokenów
WYJŚCIE$0.40/ 1M tokenów
p50 TTFT2.71 s7 d
p95 TTFT10.00 s7 d
RUCH1.3Mtokenów / 7 d

Qwen3.5 Flash to multimodalny model językowy z rodziny Qwen, zaprojektowany z myślą o szybkim wnioskowaniu i niskich kosztach. Akceptuje wejście w postaci tekstu, obrazu i wideo, a generuje…

Czym jest Qwen3.5 Flash?

Dla kogo jest ten model?

Kluczowe specyfikacje w skrócie

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Cennik

Wejście / 1M tokenów$0.100
Wyjście / 1M tokenów$0.400
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $1.90

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000202

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
2.71 s
Prędkość wyjścia
206 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
7.3%

Publiczne benchmarki

Źródło: Design Arena

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News0 wzmianek · 7 dni

Porównanie

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Wejście $/M$0.10$2.00$0.86$0.17
Wyjście $/M$0.40$6.00$3.44$1.03
Kontekst1.0M1.0M262K33K
Jakość6/109/108/108/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Jaki jest koszt używania Qwen3.5 Flash na OrcaRouter?
Koszt wynosi $0.10 za 1 milion tokenów wejściowych i $0.40 za 1 milion tokenów wyjściowych. Jest to stawka dostawcy z zerową marżą OrcaRouter. Płacisz dokładnie tyle, ile pobiera dostawca, bez dodatkowych opłat.
Jaki jest rozmiar okna kontekstu?
Okno kontekstu ma 1,048,576 tokenów (około 1 miliona tokenów). Obejmuje to zarówno tokeny wejściowe, jak i wyjściowe w całej historii konwersacji. Maksymalny wynik na generację to 65,536 tokenów.
Jakie są mocne strony Qwen3.5 Flash?
Zalety obejmują multimodalne wejście (tekst, obraz, wideo), bardzo duże okno kontekstowe o wielkości 1M, długie wyjście 65K tokenów, niski koszt na token oraz szybkie wnioskowanie w porównaniu z większymi modelami Qwen. Jest idealny do zadań multimodalnych o dużej objętości lub w czasie rzeczywistym.
Jak wypada w porównaniu z większymi modelami Qwen?
Większe modele Qwen, takie jak Qwen3.5-72B, oferują wyższą dokładność w złożonym rozumowaniu, ale są wolniejsze i droższe. Qwen3.5 Flash poświęca część dokładności na rzecz szybkości i efektywności kosztowej, zachowując jednocześnie te same możliwości multimodalne i obsługę długiego kontekstu.
Czy OrcaRouter narzuca marżę na ceny dostawcy?
Nie. Ceny są przekazywane według stawki dostawcy bez żadnej marży. Płacisz dokładnie $0.10 za 1M tokenów wejściowych i $0.40 za 1M tokenów wyjściowych dla Qwen3.5 Flash przez OrcaRouter.
Czy mogę wywołać Qwen3.5 Flash za pomocą API zgodnego z OpenAI?
Tak. OrcaRouter udostępnia kompatybilny z OpenAI endpoint pod adresem https://api.orcarouter.ai/v1. Użyj identyfikatora modelu "qwen/qwen3.5-flash" wraz z kluczem API OrcaRouter. Format żądań i odpowiedzi jest zgodny z API OpenAI do uzupełniania czatów.
Jak działa przetwarzanie danych w OrcaRouter?
Polityki dotyczące przetwarzania danych są określane przez OrcaRouter i Qwen. Wpis w katalogu nie zawiera szczegółowych informacji. Użytkownicy powinni zapoznać się z polityką prywatności OrcaRouter i warunkami korzystania z danych Qwen przed wysłaniem wrażliwych danych.
Jakie modalności obsługuje model?
Obsługuje wejścia tekstowe, obrazowe i wideo. Obrazy mogą być dostarczane jako URL-e lub dane base64 w wiadomości użytkownika. Wejścia wideo są zazwyczaj wysyłane jako sekwencja klatek (obrazów). Model generuje tylko tekst na wyjściu.
Czy istnieje minimalna lub maksymalna liczba tokenów wymagana?
Nie ma minimalnej liczby tokenów. Maksymalna liczba tokenów wejściowych (włączając historię konwersacji) wynosi 1,048,576 tokenów. Maksymalna liczba tokenów wyjściowych na odpowiedź wynosi 65,536. Użyj parametru max_tokens, aby kontrolować długość odpowiedzi.
Jak zacząć wywoływać ten model za pomocą OrcaRouter?
Zarejestruj się w OrcaRouter, aby uzyskać klucz API. Ustaw podstawowy URL na https://api.orcarouter.ai/v1 w swoim kodzie. Użyj ID modelu "qwen/qwen3.5-flash" i wyślij standardowe żądanie zakończenia czatu z treścią multimodalną. Zobacz dokumentację OrcaRouter, aby zobaczyć przykłady.

Osadź tę odznakę

qwen/qwen3.5-flash$0.10/M in2705ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash w OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Karta modelu jako dane

GET /api/public/models/qwen/qwen3.5-flashOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt