Qwen3.8 Flash ist ein multimodales Reasoning-Modell von Alibaba. Es eignet sich für Code-Unterstützung, agentische Workflows, visuelles Verständnis, Dokument- und Codebase-Analyse, Desktop-Interaktion, Diagrammanalyse und Langvideo-Analyse.
OpenAI-kompatibel — behalte dein bisheriges SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)enable_thinkingfrequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_logprobstop_p| Eingabe / 1M Tokens | $0.150 |
| Ausgabe / 1M Tokens | $0.470 |
| Cache-Lesen / 1M | $0.018 |
| Cache-Schreiben / 1M | $0.230 |
| Währung | USD |
Schätzung auf Basis des Listenpreises
Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.
Worüber Entwickler diese Woche sprechen
GET /api/public/models/qwen/qwen3.8-flashÖffnen @misc{orcarouter_qwen3_8_flash,
title = {Qwen3.8 Flash API},
author = {Qwen},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/qwen/qwen3.8-flash}
}Qwen. (2026). Qwen3.8 Flash API. OrcaRouter. https://www.orcarouter.ai/models/qwen/qwen3.8-flash