Qwen3.8 Flash

qwen/qwen3.8-flash
NieuwUitgelicht
VisieToolsJSONRedeneren
door Qwen · 2026-08-26

Qwen3.8 Flash is een multimodaal redeneermodel van Alibaba. Het is geschikt voor codeerondersteuning, agentische workflows, visueel begrip, analyse van documenten en codebases, desktopinteractie, grafiekanalyse en analyse van lange video's.

ctx1M tokens
Max. uitvoer131K
Invoertext + image + video
Uitvoertext
p50 TTFT4.25 s
INPUT$0.15/ 1M tokens
OUTPUT$0.47/ 1M tokens
p50 TTFT4.25 s7d
p95 TTFT10.00 s7d
VERKEER1.0Mtokens / 7d

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Prijzen

Invoer / 1M tokens$0.150
Uitvoer / 1M tokens$0.470
Cache lezen / 1M$0.018
Cache schrijven / 1M$0.230
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $2.46 · Met prompt-caching $2.00

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000238

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
4.25 s
Outputsnelheid
119 tok/s
p95 TTFT
10.00 s
Foutpercentage
0%

Openbare benchmarks

Bron: Design Arena

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News9 vermeldingen · 7 d9 meer dan vorige week

Vergelijking

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Invoer $/M$0.15$2.00$0.86$0.17
Uitvoer $/M$0.47$6.00$3.44$1.03
Context1.0M1.0M262K33K
Kwaliteit7/109/108/108/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Hoeveel kost Qwen: Qwen3.8 Flash op OrcaRouter?
Qwen: Qwen3.8 Flash is geprijsd op $0.15 per 1M invoertokens en $0.47 per 1M uitvoertokens via OrcaRouter. De prijzen worden live opgehaald van de routinglaag.
Wat is Qwen: Qwen3.8 Flash's contextvenster?
Qwen: Qwen3.8 Flash ondersteunt een contextvenster van 1M tokens. Gebruik lange-contextfuncties (RAG, samenvatting) tot die limiet.
Hoe roep ik Qwen: Qwen3.8 Flash aan via de OpenAI SDK?
Stel OpenAI base_url in op https://api.orcarouter.ai/v1, lever uw OrcaRouter API-sleutel, en geef model="qwen/qwen3.8-flash" mee in de chat.completions.create aanroep.
Past OrcaRouter een snelheidsbeperking toe op Qwen: Qwen3.8 Flash?
Per-model snelheidslimieten volgen uw OrcaRouter-plan. Gratis abonnementen worden geleverd met conservatieve limieten; betaalde abonnementen verhogen deze. Controleer /pricing voor huidige quota's.

Sluit deze badge in

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash op OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Modelkaart als data

GET /api/public/models/qwen/qwen3.8-flashOpenen
Machineleesbaar:/llms.txt/llms-full.txt