Qwen3.8 Flash

qwen/qwen3.8-flash
NyUtvalt
VisionVerktygJSONResonemang
av Qwen · 2026-08-26

Qwen3.8 Flash är en multimodal resonemangsmodell från Alibaba. Den är lämplig för kodningshjälp, agentiska arbetsflöden, visuell förståelse, analys av dokument och kodbaser, skrivbordsinteraktion, diagramanalys och analys av långa videor.

ctx1M tokens
Max output131K
Inmatningtext + image + video
Utdatatext
p50 TTFT4.25 s
INMATNING$0.15/ 1M token
UTDATA$0.47/ 1M token
p50 TTFT4.25 s7d
p95 TTFT10.00 s7d
TRAFIK1.0Mtokens/7d

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Priser

Inmatning / 1M token$0.150
Utdata / 1M tokens$0.470
Cacheläsning / 1M$0.018
Cache-skrivning / 1M$0.230
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $2.46 · Med promptcachning $2.00

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000238

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
4.25 s
Utdatahastighet
119 tok/s
p95 TTFT
10.00 s
Felfrekvens
0%

Offentliga benchmarks

Källa: Design Arena

Community-buzz

Vad utvecklare säger den här veckan

Hacker News9 omnämnanden · 7dupp 9 jämfört med föregående vecka

Så jämför den sig

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Input $/M$0.15$2.00$0.86$0.17
Output $/M$0.47$6.00$3.44$1.03
Kontext1.0M1.0M262K33K
Kvalitet7/109/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar Qwen: Qwen3.8 Flash på OrcaRouter?
Qwen: Qwen3.8 Flash prissätts till $0.15 per 1M inmatningstokens och $0.47 per 1M utmatningstokens via OrcaRouter. Prissättningen hämtas live från routningslagret.
Vad är Qwen: Qwen3.8 Flash:s kontextfönster?
Qwen: Qwen3.8 Flash stöder ett kontextfönster på 1M tokens. Använd långkontext-funktioner (RAG, sammanfattning) upp till den gränsen.
Hur anropar jag Qwen: Qwen3.8 Flash via OpenAI SDK?
Ställ in OpenAI base_url till https://api.orcarouter.ai/v1, ange din OrcaRouter API-nyckel, och skicka model="qwen/qwen3.8-flash" i anropet till chat.completions.create.
Begränsar OrcaRouter hastigheten för Qwen: Qwen3.8 Flash?
Per-modell hastighetsbegränsningar följer din OrcaRouter-plan. Gratisnivåer levereras med konservativa gränser; betalnivåer lyfter dem. Kolla /pricing för aktuella kvoter.

Bädda in denna badge

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Modellkort som data

GET /api/public/models/qwen/qwen3.8-flashÖppna