qwen/qwen3.5-flash

qwen/qwen3.5-flash
VisionVerktygJSONResonemang
av qwen

Qwen3.5 Flash — multimodal chatt (text/bild/video) optimerad för kostnad, 1M kontext.

ctx1M tokens
Max output65K
Inmatningtext + image + video
Utdatatext
p50 TTFT2.71 s
INMATNING$0.10/ 1M token
UTDATA$0.40/ 1M token
p50 TTFT2.71 s7d
p95 TTFT10.00 s7d
TRAFIK1.3Mtokens/7d

Qwen3.5 Flash är en multimodal språkmodell från Qwen-familjen, utformad för snabb inferens och låg kostnad. Den accepterar text-, bild- och videoinmatningar och genererar textsvar. Kontextfönstret på…

Vad är Qwen3.5 Flash?

Vem är den här modellen till för?

Nyckelspecifikationer i korthet

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Priser

Inmatning / 1M token$0.100
Utdata / 1M tokens$0.400
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $1.90

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000202

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
2.71 s
Utdatahastighet
206 tok/s
p95 TTFT
10.00 s
Felfrekvens
7.3%

Offentliga benchmarks

Källa: Design Arena

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Så jämför den sig

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Input $/M$0.10$2.00$0.86$0.17
Output $/M$0.40$6.00$3.44$1.03
Kontext1.0M1.0M262K33K
Kvalitet6/109/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden för att använda Qwen3.5 Flash på OrcaRouter?
Kostnaden är $0,10 per 1 miljon indatatokens och $0,40 per 1 miljon utdatatokens. Detta är leverantörspriset utan någon påslag från OrcaRouter. Du betalar exakt vad leverantören tar ut, utan extra avgifter.
Vad är storleken på kontextfönstret?
Kontextfönstret är 1 048 576 token (ungefär 1 miljon token). Detta inkluderar både inmatnings- och utmatningstoken över hela konversationshistoriken. Den maximala utmatningen per generation är 65 536 token.
Vilka är styrkorna hos Qwen3.5 Flash?
Styrkor inkluderar multimodal inmatning (text, bild, video), ett mycket stort kontextfönster på 1M, lång utmatning på 65K tokens, låg kostnad per token och snabb inferens jämfört med större Qwen-modeller. Den är idealisk för högvolym- eller realtidsmultimodala uppgifter.
Hur jämför den sig med större Qwen-modeller?
Större Qwen-modeller som Qwen3.5-72B erbjuder högre noggrannhet vid komplex resonemang men är långsammare och dyrare. Qwen3.5 Flash byter en del noggrannhet mot hastighet och kostnadseffektivitet, samtidigt som den behåller samma multimodala och långkontextuella kapacitet.
Lägger OrcaRouter på ett pålägg på leverantörernas priser?
Nej. Priset överförs till leverantörens taxa utan påslag. Du betalar exakt $0.10 per 1M inmatningstokens och $0.40 per 1M utmatningstokens för Qwen3.5 Flash via OrcaRouter.
Kan jag anropa Qwen3.5 Flash med ett OpenAI-kompatibelt API?
Ja. OrcaRouter tillhandahåller en OpenAI-kompatibel slutpunkt på https://api.orcarouter.ai/v1. Använd modell-ID:t "qwen/qwen3.5-flash" med din OrcaRouter API-nyckel. Förfrågnings- och svarsformaten matchar OpenAI:s chat completions API.
Hur fungerar datahantering med OrcaRouter?
Datahanteringspolicyer bestäms av OrcaRouter och Qwen. Katalogposten ger inga specifika detaljer. Användare bör granska OrcaRouters integritetspolicy och Qwens dataanvändningsvillkor innan de skickar känsliga uppgifter.
Vilka modaliteter stödjer modellen?
Den stöder text-, bild- och videoinmatning. Bilder kan anges som URL:er eller base64-data i användarmeddelandet. Videoinmatning skickas vanligtvis som en sekvens av bildrutor (bilder). Modellen genererar endast textutdata.
Finns det ett minsta eller högsta antal tokens som krävs?
Det finns inget minimiantal token. Det maximala antalet indata-token (inklusive konversationshistorik) är 1,048,576 token. Det maximala antalet utdata-token per svar är 65,536. Använd parametern max_tokens för att styra utdata-längden.
Hur kommer jag igång med att anropa den här modellen via OrcaRouter?
Registrera dig för OrcaRouter för att få en API-nyckel. Ställ in bas-URL till https://api.orcarouter.ai/v1 i din kod. Använd model-ID "qwen/qwen3.5-flash" och skicka en standard chattkompletteringsförfrågan med ditt multimodala innehåll. Se OrcaRouter-dokumentationen för exempel.

Bädda in denna badge

qwen/qwen3.5-flash$0.10/M in2705ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash på OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Modellkort som data

GET /api/public/models/qwen/qwen3.5-flashÖppna