Qwen3.7 Flash

qwen/qwen3.7-flash
NuevoDestacado
VisiónHerramientasJSONRazonamiento
por Qwen · 2026-07-27

Qwen3.7 Flash es el modelo rápido y extremadamente rentable de Alibaba en la familia Qwen3.7, situándose por debajo de Qwen3.7-Plus y Qwen3.7-Max como el nivel de alto rendimiento. Es nativamente multimodal en el lado de entrada — aceptando texto, imágenes y video con salida de texto — y ofrece una ventana de contexto de 1 millón de tokens con hasta 64K tokens de salida, por lo que los documentos largos, capturas de pantalla y fotogramas de video permanecen al alcance incluso con el precio del nivel Flash. A aproximadamente $0.03 por millón de tokens de entrada en el nivel base, es uno de los modelos multimodales con contexto de 1M más baratos disponibles, lo que lo convierte en una opción natural para clasificación, extracción, enrutamiento, resumen, agentes ligeros y cualquier pipeline ejecutado a muy alto volumen. Admite modo de razonamiento, llamada nativa a herramientas, salidas estructuradas mediante response_format y los controles de muestreo habituales (temperature / top_p / seed / logprobs). Tenga en cuenta que el precio se segmenta por longitud del prompt: los costos aumentan por encima de 32K y nuevamente por encima de 256K tokens de entrada, por lo que agrupar solicitudes cortas es materialmente más barato que rellenar las largas. Use Flash como el caballo de batalla de volumen y escale a Qwen3.7-Plus o Max cuando una tarea realmente necesite más capacidad.

ctx1M tokens
Salida máx.65K
Entradatext + image + video
Salidatext
p50 TTFT2.83 s
ENTRADA$0.03/ 1M tokens
SALIDA$0.13/ 1M tokens
p50 TTFT2.83 s7 d
p95 TTFT9.64 s7 d
TRÁFICO13.5Mtokens / 7 d

Qwen3.7 Flash es un modelo de lenguaje grande multimodal creado por el equipo de Qwen y puesto a disposición a través de OrcaRouter. Procesa entradas de texto, imagen y video y admite una ventana de…

¿Qué es Qwen3.7 Flash y quién debería usarlo?

¿Qué modalidades de entrada admite Qwen3.7 Flash?

¿Cuál es el tamaño de la ventana de contexto de Qwen3.7 Flash?

¿Cómo se accede a Qwen3.7 Flash a través de OrcaRouter?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Precios

NivelEntrada / 1M tokensSalida / 1M tokensLectura caché / 1MEscritura caché / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
El nivel se selecciona por el número de tokens de entrada de cada solicitud

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $0.600 · Con caché de prompts $0.516

Estimación según precio de lista

Precios por niveles: esta estimación usa las tarifas del nivel base.

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000066

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
2.83 s
Velocidad de salida
333 tok/s
p95 TTFT
9.64 s
Tasa de error
0%

Pruebas de referencia públicas

Fuente: Design Arena

Actividad de la comunidad

De qué hablan los desarrolladores esta semana

Hacker News0 menciones · 7 d

Comparativa

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Entrada $/M$0.03$0.86$0.17$0.12
Salida $/M$0.13$3.44$1.03$0.69
Contexto1.0M262K33K1.0M
Calidad7/108/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuánto cuesta Qwen3.7 Flash en OrcaRouter?
No se proporciona un precio específico para Qwen3.7 Flash en los datos disponibles. OrcaRouter suele cobrar por token tanto para entrada como para salida. Al ser un modelo Flash, es probable que tenga un precio más bajo que los modelos insignia. Visite la página de precios de OrcaRouter o contacte al soporte para conocer las tarifas actuales.
¿Cuál es el tamaño de la ventana de contexto de Qwen3.7 Flash?
La ventana de contexto es de 1,000,000 tokens. Esto permite que el modelo procese documentos muy largos, conversaciones extendidas o grandes conjuntos de imágenes/videos en una sola instrucción.
¿Cuáles son las fortalezas de Qwen3.7 Flash?
Sus fortalezas incluyen un contexto de 1M de tokens, soporte de entrada multimodal (texto, imagen, video), 65k de tokens de salida máxima, y una arquitectura 'Flash' optimizada que equilibra velocidad y costo. Es muy adecuado para el análisis de documentos largos y la comprensión multimodal.
¿Cómo se compara Qwen3.7 Flash con GPT-4o-mini?
Qwen3.7 Flash ofrece una ventana de contexto significativamente más grande (1M frente a 128k) y una salida máxima más alta (65k frente a 16k). GPT-4o-mini puede tener un soporte de ecosistema más amplio. No se proporcionan ni precios ni puntos de referencia para una comparación directa.
¿OrcaRouter almacena en caché los prompts para reducir costos?
OrcaRouter puede ofrecer almacenamiento en caché de prompts, pero su política específica para Qwen3.7 Flash no se detalla en los hechos. Consulte la documentación de OrcaRouter para obtener indicadores de aciertos de caché e información de descuentos.
¿Cómo llamo a Qwen3.7 Flash usando una API compatible con OpenAI?
Establece la URL base en https://api.orcarouter.ai/v1 y utiliza el ID del modelo "qwen/qwen3.7-flash". Incluye tu clave API de OrcaRouter. El endpoint de completaciones de chat funciona con los parámetros estándar de OpenAI. Para entrada multimodal, añade objetos de imagen o video en el arreglo de contenido del mensaje.
¿Qué modalidades de entrada admite Qwen3.7 Flash?
Admite entradas de texto, imagen y video. Esto permite tareas como analizar imágenes junto con texto, resumir videos y combinar múltiples tipos de medios en un solo mensaje.
¿Puedo afinar Qwen3.7 Flash con mis propios datos?
Los hechos disponibles no mencionan las capacidades de ajuste fino. Como modelo accesible mediante API a través de OrcaRouter, es probable que no se admita el ajuste fino. Para ajuste fino personalizado, considere alternativas de código abierto.
¿Cuál es la longitud máxima de salida de Qwen3.7 Flash?
La salida máxima es de 65,536 tokens. Esto permite la generación de respuestas, informes o código muy largos en una sola llamada a la API.
¿Cómo manejo las entradas de video con Qwen3.7 Flash?
No se proporcionan detalles específicos sobre el manejo de video. Por lo general, las entradas de video se procesan como secuencias de fotogramas. Es posible que deba preprocesar los videos en una serie de imágenes y pasarlas como URL de imágenes o datos base64. Consulte la documentación de OrcaRouter para conocer el formato exacto.

Insertar esta insignia

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash en OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

Ficha del modelo como datos

GET /api/public/models/qwen/qwen3.7-flashAbrir
Legible por máquina:/llms.txt/llms-full.txt