Qwen3.8 Flash

qwen/qwen3.8-flash
NuevoDestacado
VisiónHerramientasJSONRazonamiento
por Qwen · 2026-08-26

Qwen3.8 Flash es un modelo de razonamiento multimodal de Alibaba. Está diseñado para asistencia en codificación, flujos de trabajo agénticos, comprensión visual, análisis de documentos y bases de código, interacción con escritorio, análisis de gráficos y análisis de videos largos.

ctx1M tokens
Salida máx.131K
Entradatext + image + video
Salidatext
p50 TTFT4.25 s
ENTRADA$0.15/ 1M tokens
SALIDA$0.47/ 1M tokens
p50 TTFT4.25 s7 d
p95 TTFT10.00 s7 d
TRÁFICO1.0Mtokens / 7 d

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Precios

Entrada / 1M tokens$0.150
Salida / 1M tokens$0.470
Lectura caché / 1M$0.018
Escritura caché / 1M$0.230
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $2.46 · Con caché de prompts $2.00

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000238

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
4.25 s
Velocidad de salida
119 tok/s
p95 TTFT
10.00 s
Tasa de error
0%

Pruebas de referencia públicas

Fuente: Design Arena

Actividad de la comunidad

De qué hablan los desarrolladores esta semana

Hacker News9 menciones · 7 d9 más que la semana anterior

Comparativa

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrada $/M$0.15$2.00$0.86$0.17
Salida $/M$0.47$6.00$3.44$1.03
Contexto1.0M1.0M262K33K
Calidad7/109/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuánto cuesta Qwen: Qwen3.8 Flash en OrcaRouter?
Qwen: Qwen3.8 Flash tiene un precio de $0.15 por cada 1M tokens de entrada y $0.47 por cada 1M tokens de salida a través de OrcaRouter. Los precios se obtienen en tiempo real desde la capa de enrutamiento.
¿Cuál es la ventana de contexto de Qwen: Qwen3.8 Flash?
Qwen: Qwen3.8 Flash admite una ventana de contexto de 1M tokens. Utilice las funciones de contexto largo (RAG, resumen) hasta ese límite.
¿Cómo llamo a Qwen: Qwen3.8 Flash mediante el SDK de OpenAI?
Establece base_url de OpenAI en https://api.orcarouter.ai/v1, proporciona tu clave API de OrcaRouter y pasa model="qwen/qwen3.8-flash" en la llamada chat.completions.create.
¿OrcaRouter rate-limita Qwen: Qwen3.8 Flash?
Los límites de tarifas por modelo siguen tu plan de OrcaRouter. Los niveles gratuitos vienen con límites conservadores; los niveles de pago los eliminan. Consulta /pricing para las cuotas actuales.

Insertar esta insignia

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash en OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Ficha del modelo como datos

GET /api/public/models/qwen/qwen3.8-flashAbrir
Legible por máquina:/llms.txt/llms-full.txt