Qwen3.8 Flash

qwen/qwen3.8-flash
NovoDestaque
VisãoFerramentasJSONRaciocínio
por Qwen · 2026-08-26

Qwen3.8 Flash é um modelo de raciocínio multimodal da Alibaba. É adequado para assistência de codificação, fluxos de trabalho agênticos, compreensão visual, análise de documentos e bases de código, interação com desktop, análise de gráficos e análise de vídeos longos.

ctx1M tokens
Saída máx.131K
Entradatext + image + video
Saídatext
p50 TTFT4.25 s
ENTRADA$0.15/ 1M tokens
SAÍDA$0.47/ 1M tokens
p50 TTFT4.25 s7 d
p95 TTFT10.00 s7 d
TRÁFEGO1.0Mtokens / 7 d

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Preços

Entrada / 1M tokens$0.150
Saída / 1M tokens$0.470
Leitura de cache / 1M$0.018
Escrita de cache / 1M$0.230
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $2.46 · Com cache de prompt $2.00

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000237

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
4.25 s
Velocidade de saída
119 tok/s
p95 TTFT
10.00 s
Taxa de erro
0%

Benchmarks públicos

Fonte: Design Arena

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News9 menções · 7 d9 a mais que na semana anterior

Comparativo

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrada $/M$0.15$2.00$0.86$0.17
Saída $/M$0.47$6.00$3.44$1.03
Contexto1.0M1.0M262K33K
Qualidade7/109/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa Qwen: Qwen3.8 Flash no OrcaRouter?
Qwen: Qwen3.8 Flash tem o preço de $0.15 por 1M tokens de entrada e $0.47 por 1M tokens de saída via OrcaRouter. Os preços são obtidos em tempo real da camada de roteamento.
Qual é a janela de contexto de Qwen: Qwen3.8 Flash's?
Qwen: Qwen3.8 Flash suporta uma janela de contexto de 1M tokens. Use recursos de contexto longo (RAG, sumarização) até esse limite.
Como chamar Qwen: Qwen3.8 Flash via o SDK da OpenAI?
Defina o base_url do OpenAI como https://api.orcarouter.ai/v1, forneça sua chave de API do OrcaRouter e passe model="qwen/qwen3.8-flash" na chamada chat.completions.create.
O OrcaRouter limita a taxa de Qwen: Qwen3.8 Flash?
Os limites de taxa por modelo seguem o seu plano OrcaRouter. Os planos gratuitos vêm com limites conservadores; os planos pagos os aumentam. Verifique /pricing para as cotas atuais.

Incorporar este selo

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash no OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Ficha do modelo como dados

GET /api/public/models/qwen/qwen3.8-flashAbrir
Legível por máquina:/llms.txt/llms-full.txt