Qwen3.8 Flash

qwen/qwen3.8-flash
NouveauEn vedette
VisionOutilsJSONRaisonnement
par Qwen · 2026-08-26

Qwen3.8 Flash est un modèle de raisonnement multimodal d'Alibaba. Il convient à l'assistance au codage, aux flux de travail agentiques, à la compréhension visuelle, à l'analyse de documents et de bases de code, à l'interaction de bureau, à l'analyse de graphiques et à l'analyse de vidéos longues.

Points de terminaison:/v1/chat/completions
ctx1M tokens
Sortie max131K
Entréetext + image + video
Sortietext
p50 TTFT4.25 s
ENTRÉE$0.15/ 1M tokens
SORTIE$0.47/ 1M tokens
p50 TTFT4.25 s7 j
TTFT p9510.00 s7 j
TRAFIC1.0Mtokens / 7 j

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Tarifs

Entrée / 1M tokens$0.150
Sortie / 1M tokens$0.470
Lecture cache / 1M$0.018
Écriture cache / 1M$0.230
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $2.46 · Avec cache de prompt $2.00

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000238

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
4.25 s
Vitesse de sortie
119 tok/s
TTFT p95
10.00 s
Taux d'erreur
0%

Benchmarks publics

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News9 mentions · 7 jen hausse de 9 vs la semaine précédente

Comparatif

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrée $/M$0.15$2.00$0.86$0.17
Sortie $/M$0.47$6.00$3.44$1.03
Contexte1.0M1.0M262K33K
Qualité7/109/108/108/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Qwen: Qwen3.8 Flash sur OrcaRouter ?
Qwen: Qwen3.8 Flash est facturé à $0.15 par 1M tokens d'entrée et $0.47 par 1M tokens de sortie via OrcaRouter. La tarification est extraite en direct de la couche de routage.
Quelle est la fenêtre de contexte de Qwen: Qwen3.8 Flash ?
Qwen: Qwen3.8 Flash prend en charge une fenêtre de contexte de 1M tokens. Utilisez les fonctionnalités de contexte long (RAG, résumé) jusqu’à cette limite.
Comment appeler Qwen: Qwen3.8 Flash via le SDK OpenAI ?
Définissez base_url d'OpenAI sur https://api.orcarouter.ai/v1, fournissez votre clé API OrcaRouter et passez model="qwen/qwen3.8-flash" dans l'appel chat.completions.create.
OrcaRouter limite-t-il le débit de Qwen: Qwen3.8 Flash ?
Les limites de débit par modèle suivent votre forfait OrcaRouter. Les offres gratuites sont assorties de plafonds conservateurs ; les offres payantes les relèvent. Consultez /pricing pour connaître les quotas actuels.

Intégrer ce badge

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash sur OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Fiche du modèle en données

GET /api/public/models/qwen/qwen3.8-flashOuvrir
Lisible par machine:/llms.txt/llms-full.txt