qwen/qwen3.5-flash

qwen/qwen3.5-flash
VisiónHerramientasJSONRazonamiento
por qwen

Qwen3.5 Flash — chat multimodal (texto/imagen/video) optimizado para costo, contexto de 1M.

ctx1M tokens
Salida máx.65K
Entradatext + image + video
Salidatext
p50 TTFT2.71 s
ENTRADA$0.10/ 1M tokens
SALIDA$0.40/ 1M tokens
p50 TTFT2.71 s7 d
p95 TTFT10.00 s7 d
TRÁFICO1.3Mtokens / 7 d

Qwen3.5 Flash es un modelo de lenguaje multimodal de la familia Qwen, diseñado para inferencia rápida y bajo costo. Acepta entradas de texto, imagen y video, y genera respuestas de texto. Su ventana…

¿Qué es Qwen3.5 Flash?

¿Para quién es este modelo?

Especificaciones clave de un vistazo

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Precios

Entrada / 1M tokens$0.100
Salida / 1M tokens$0.400
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $1.90

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000202

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
2.71 s
Velocidad de salida
206 tok/s
p95 TTFT
10.00 s
Tasa de error
7.3%

Pruebas de referencia públicas

Fuente: Design Arena

Actividad de la comunidad

De qué hablan los desarrolladores esta semana

Hacker News0 menciones · 7 d

Comparativa

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrada $/M$0.10$2.00$0.86$0.17
Salida $/M$0.40$6.00$3.44$1.03
Contexto1.0M1.0M262K33K
Calidad6/109/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuál es el costo de usar Qwen3.5 Flash en OrcaRouter?
El costo es de $0.10 por cada 1 millón de tokens de entrada y $0.40 por cada 1 millón de tokens de salida. Esta es la tarifa del proveedor sin margen por parte de OrcaRouter. Pagas exactamente lo que cobra el proveedor, sin tarifas adicionales.
¿Cuál es el tamaño de la ventana de contexto?
La ventana de contexto es de 1,048,576 tokens (aproximadamente 1 millón de tokens). Esto incluye tanto los tokens de entrada como los de salida en todo el historial de la conversación. La salida máxima por generación es de 65,536 tokens.
¿Cuáles son las fortalezas de Qwen3.5 Flash?
Las fortalezas incluyen entrada multimodal (texto, imagen, video), una ventana de contexto muy grande de 1M, salida larga de 65K tokens, bajo costo por token e inferencia rápida en comparación con modelos Qwen más grandes. Es ideal para tareas multimodales de alto volumen o en tiempo real.
¿Cómo se compara con los modelos Qwen más grandes?
Los modelos Qwen más grandes, como Qwen3.5-72B, ofrecen mayor precisión en razonamientos complejos, pero son más lentos y costosos. Qwen3.5 Flash intercambia algo de precisión por velocidad y eficiencia de costos, manteniendo las mismas capacidades multimodales y de contexto largo.
¿OrcaRouter aplica un margen al precio del proveedor?
No. El precio se transmite a la tarifa del proveedor sin margen de beneficio. Usted paga exactamente $0.10 por 1M de tokens de entrada y $0.40 por 1M de tokens de salida para Qwen3.5 Flash a través de OrcaRouter.
¿Puedo llamar a Qwen3.5 Flash usando una API compatible con OpenAI?
Sí. OrcaRouter proporciona un endpoint compatible con OpenAI en https://api.orcarouter.ai/v1. Usa el ID de modelo "qwen/qwen3.5-flash" con tu clave de API de OrcaRouter. Los formatos de solicitud y respuesta coinciden con la API de chat completions de OpenAI.
¿Cómo funciona el manejo de datos con OrcaRouter?
Las políticas de manejo de datos son determinadas por OrcaRouter y Qwen. La entrada del catálogo no proporciona detalles específicos. Los usuarios deben revisar la política de privacidad de OrcaRouter y los términos de uso de datos de Qwen antes de enviar datos sensibles.
¿Qué modalidades admite el modelo?
Admite entradas de texto, imagen y video. Las imágenes pueden proporcionarse como URLs o datos base64 en el mensaje del usuario. Las entradas de video generalmente se envían como una secuencia de fotogramas (imágenes). El modelo genera solo salida de texto.
¿Se requiere un número mínimo o máximo de tokens?
No hay un recuento mínimo de tokens. El máximo de tokens de entrada (incluyendo el historial de la conversación) es de 1,048,576 tokens. El máximo de tokens de salida por respuesta es de 65,536. Usa el parámetro max_tokens para controlar la longitud de la salida.
¿Cómo empiezo a llamar a este modelo a través de OrcaRouter?
Regístrate en OrcaRouter para obtener una clave API. Establece la URL base como https://api.orcarouter.ai/v1 en tu código. Usa el ID del modelo "qwen/qwen3.5-flash" y envía una solicitud estándar de finalización de chat con tu contenido multimodal. Consulta la documentación de OrcaRouter para ver ejemplos.

Insertar esta insignia

qwen/qwen3.5-flash$0.10/M in2705ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash en OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Ficha del modelo como datos

GET /api/public/models/qwen/qwen3.5-flashAbrir
Legible por máquina:/llms.txt/llms-full.txt