Qwen3.6 Flash

qwen/qwen3.6-flash
VisionVerktygJSONResonemang
av Qwen · 2026-04-27

Qwen3.6 Flash — multimodal chatt (text/bild/video) optimerad för kostnad, 1M kontext, nästan flaggskeppskapacitet.

ctx1.05M tokens
Max output65.5K
Inmatningtext + image + video
Utdatatext
p50 TTFT6.67 s
INMATNING$0.25/ 1M token
UTDATA$1.50/ 1M token
p50 TTFT6.67 s7d
p95 TTFT10.00 s7d
TRAFIK114.2Ktokens/7d

Qwen3.6 Flash är en medlem i Qwen 3.6-modellfamiljen från Qwen, designad för effektiv multimodalinferens. Den bearbetar text-, bild- och videoinmatningar genom en transformerbaserad arkitektur…

Vad är Qwen3.6 Flash?

Vilka bör använda Qwen3.6 Flash?

Vilka modaliteter stöder Qwen3.6 Flash?

Hur passar Qwen3.6 Flash in i Qwen-modellfamiljen?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3.6-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Priser

NivåInmatning / 1M tokenUtdata / 1M tokens
256K$0.250$1.50
1.0M$1.00$4.00
Nivå väljs utifrån antalet inmatningstoken per förfrågan

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $6.25

Uppskattning baserad på listpris

Skiktad prissättning — den här uppskattningen använder priser för basnivån.

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000754

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
6.67 s
Utdatahastighet
2347 tok/s
p95 TTFT
10.00 s
Felfrekvens
0%

Offentliga benchmarks

58.0
AA Coding
Bättre än 74% av jämförda modeller
#32 av 123
60.0
AA Intelligence
Bättre än 97% av jämförda modeller
#4 av 125
58.0
AA Math
Bättre än 36% av jämförda modeller
#52 av 81
GPQA Diamond
55.0 index
MMLU-Pro
64.0 index
τ²-Bench
50.0 index
Källa: artificialanalysis.ai

Så jämför den sig

Qwen3.6 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Input $/M$0.25$0.86$0.17$0.12
Output $/M$1.50$3.44$1.03$0.69
Kontext1.0M262K33K1.0M
Kvalitet7/108/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad kostar det att använda Qwen3.6 Flash på OrcaRouter?
Specifik per-token-prissättning för Qwen3.6 Flash ingår inte i de angivna fakta. Prisinformation finns på OrcaRouters officiella prissida eller genom att kontakta deras säljteam. Kostnaden beror på antalet in- och utdata-tokens och kan variera baserat på cachelagring eller rabatter.
Vad är kontextfönstrets storlek för Qwen3.6 Flash?
Kontextfönstret är 1,048,576 tokens (ungefär 1 miljon tokens). Detta inkluderar både indata- och utdatatokens tillsammans. Den maximala utdatan är 65,536 tokens per begäran.
Vilka är styrkorna hos Qwen3.6 Flash?
Baserat på kända fakta inkluderar styrkorna ett 1M-tokens kontextfönster, stöd för text-, bild- och videoinmatning, en hög utdatagräns (65K tokens) och snabb inferens tack vare sin flash-arkitektur. Den är idealisk för långkontext- och multimodala uppgifter som kräver låg latens.
Hur jämför sig Qwen3.6 Flash med de icke-flash Qwen-modellerna?
Qwen3.6 Flash är optimerad för hastighet och genomströmning, medan icke-flash-varianter (t.ex. Qwen3.6 Plus) sannolikt erbjuder bättre resonemangsprestanda. Exakta skillnader i arkitektur och benchmark-prestanda anges inte. Välj Flash för höghastighetstillämpningar; välj en icke-flash-modell för uppgifter som kräver djupare resonemang.
Stöder Qwen3.6 Flash bild- och videoinmatning?
Ja. Den accepterar text-, bild- och videomodaliteter. Bilder kan tillhandahållas som base64 eller URL:er. Video bearbetas som bildrutor. Ljudinmatning stöds inte inbyggt.
Hur kan jag anropa Qwen3.6 Flash via ett OpenAI-kompatibelt API?
Ställ in bas-URL:en till https://api.orcarouter.ai/v1 och använd modell-ID:t "qwen/qwen3.6-flash". Autentisera med din OrcaRouter API-nyckel. API:et är helt OpenAI-kompatibelt för chattkompletteringar.

Bädda in denna badge

Qwen: Qwen3.6 Flash$0.25/M in6666ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.6-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.6-flash.svg" alt="Qwen: Qwen3.6 Flash på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.6 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.6-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.6-flash)

Modellkort som data

GET /api/public/models/qwen/qwen3.6-flashÖppna