Qwen3.8 Flash

qwen/qwen3.8-flash
NuovoIn evidenza
VisioneStrumentiJSONRagionamento
di Qwen · 2026-08-26

Qwen3.8 Flash è un modello di ragionamento multimodale di Alibaba. È adatto per assistenza alla programmazione, flussi di lavoro agentici, comprensione visiva, analisi di documenti e codebase, interazione desktop, analisi di grafici e analisi di video lunghi.

ctx1M token
Output max131K
Inputtext + image + video
Outputtext
p50 TTFT4.25 s
INGRESSO$0.15/ 1M token
USCITA$0.47/ 1M token
p50 TTFT4.25 s7 g
p95 TTFT10.00 s7 g
TRAFFICO1.0Mtoken / 7 g

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Prezzi

Input / 1M token$0.150
Output / 1M token$0.470
Lettura cache / 1M$0.018
Scrittura cache / 1M$0.230
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $2.46 · Con cache dei prompt $2.00

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000238

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
4.25 s
Velocità di output
119 tok/s
p95 TTFT
10.00 s
Tasso di errore
0%

Benchmark pubblici

Fonte: Design Arena

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News9 menzioni · 7 gg9 in più rispetto alla settimana scorsa

A confronto

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Input $/M$0.15$2.00$0.86$0.17
Output $/M$0.47$6.00$3.44$1.03
Contesto1.0M1.0M262K33K
Qualità7/109/108/108/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Quanto costa Qwen: Qwen3.8 Flash su OrcaRouter?
Qwen: Qwen3.8 Flash ha un prezzo di $0.15 per 1 milione di token in input e $0.47 per 1 milione di token in output tramite OrcaRouter. I prezzi vengono recuperati in tempo reale dal livello di routing.
Qual è la finestra di contesto di Qwen: Qwen3.8 Flash?
Qwen: Qwen3.8 Flash supporta una finestra di contesto di 1M token. Usa le funzionalità per contesti lunghi (RAG, summarisation) fino a tale limite.
Come posso chiamare Qwen: Qwen3.8 Flash tramite l'SDK OpenAI?
Imposta base_url di OpenAI su https://api.orcarouter.ai/v1, fornisci la tua chiave API OrcaRouter e passa model=\"qwen/qwen3.8-flash\" nella chiamata chat.completions.create.
OrcaRouter limita la velocità di Qwen: Qwen3.8 Flash?
I limiti di velocità per modello seguono il tuo piano OrcaRouter. I piani gratuiti vengono forniti con limiti conservativi; i piani a pagamento li aumentano. Controlla /pricing per le quote attuali.

Incorpora questo badge

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash su OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Scheda del modello come dati

GET /api/public/models/qwen/qwen3.8-flashApri
Leggibile dalle macchine:/llms.txt/llms-full.txt