Qwen3.8 Flash

qwen/qwen3.8-flash
NeuEmpfohlen
VisionToolsJSONReasoning
von Qwen · 2026-08-26

Qwen3.8 Flash ist ein multimodales Reasoning-Modell von Alibaba. Es eignet sich für Code-Unterstützung, agentische Workflows, visuelles Verständnis, Dokument- und Codebase-Analyse, Desktop-Interaktion, Diagrammanalyse und Langvideo-Analyse.

Ktx1M Tokens
Max. Ausgabe131K
Eingabetext + image + video
Ausgabetext
p50 TTFT4.25 s
EINGABE$0.15/ 1M Tokens
AUSGABE$0.47/ 1M Tokens
p50 TTFT4.25 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR1.0MTokens / 7 T

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Preise

Eingabe / 1M Tokens$0.150
Ausgabe / 1M Tokens$0.470
Cache-Lesen / 1M$0.018
Cache-Schreiben / 1M$0.230
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $2.46 · Mit Prompt-Caching $2.00

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000239

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
4.25 s
Ausgabegeschwindigkeit
119 tok/s
p95 TTFT
10.00 s
Fehlerquote
0%

Öffentliche Benchmarks

Quelle: Design Arena

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News9 Erwähnungen · 7 T9 mehr als in der Vorwoche

Im Vergleich

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Eingabe $/M$0.15$2.00$0.86$0.17
Ausgabe $/M$0.47$6.00$3.44$1.03
Kontext1.0M1.0M262K33K
Qualität7/109/108/108/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Wie viel kostet Qwen: Qwen3.8 Flash auf OrcaRouter?
Qwen: Qwen3.8 Flash kostet $0.15 pro 1M Eingabetokens und $0.47 pro 1M Ausgabetokens über OrcaRouter. Die Preise werden live von der Routing-Schicht abgerufen.
Was ist das Kontextfenster von Qwen: Qwen3.8 Flash?
Qwen: Qwen3.8 Flash unterstützt ein Kontextfenster von 1M Token. Verwenden Sie Langkontextfunktionen (RAG, Zusammenfassung) bis zu diesem Limit.
Wie rufe ich Qwen: Qwen3.8 Flash über das OpenAI SDK auf?
Setzen Sie die OpenAI base_url auf https://api.orcarouter.ai/v1, geben Sie Ihren OrcaRouter API-Schlüssel an und übergeben Sie model="qwen/qwen3.8-flash" im Aufruf von chat.completions.create.
Rate-limitiert OrcaRouter Qwen: Qwen3.8 Flash?
Modellspezifische Ratenbegrenzungen richten sich nach Ihrem OrcaRouter-Plan. Kostenlose Tarife haben konservative Obergrenzen; kostenpflichtige Tarife heben diese an. Siehe /pricing für aktuelle Kontingente.

Dieses Abzeichen einbetten

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash auf OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Modellkarte als Daten

GET /api/public/models/qwen/qwen3.8-flashÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt