qwen/qwen3.5-flash

qwen/qwen3.5-flash
VisãoFerramentasJSONRaciocínio
por qwen

Qwen3.5 Flash — chat multimodal (texto/imagem/vídeo) otimizado para custo, contexto de 1M.

ctx1M tokens
Saída máx.65K
Entradatext + image + video
Saídatext
p50 TTFT2.71 s
ENTRADA$0.10/ 1M tokens
SAÍDA$0.40/ 1M tokens
p50 TTFT2.71 s7 d
p95 TTFT10.00 s7 d
TRÁFEGO1.3Mtokens / 7 d

Qwen3.5 Flash é um modelo de linguagem multimodal da família Qwen, projetado para inferência rápida e baixo custo. Ele aceita entradas de texto, imagem e vídeo e gera respostas em texto. Sua janela…

O que é Qwen3.5 Flash?

Para quem é este modelo?

Principais especificações de relance

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preços

Entrada / 1M tokens$0.100
Saída / 1M tokens$0.400
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $1.90

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000202

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
2.71 s
Velocidade de saída
206 tok/s
p95 TTFT
10.00 s
Taxa de erro
7.3%

Benchmarks públicos

Fonte: Design Arena

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News0 menções · 7 d

Comparativo

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrada $/M$0.10$2.00$0.86$0.17
Saída $/M$0.40$6.00$3.44$1.03
Contexto1.0M1.0M262K33K
Qualidade6/109/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo para usar o Qwen3.5 Flash no OrcaRouter?
O custo é de $0,10 por 1 milhão de tokens de entrada e $0,40 por 1 milhão de tokens de saída. Esta é a taxa do provedor com margem zero da OrcaRouter. Você paga exatamente o que o provedor cobra, sem taxas adicionais.
Qual é o tamanho da janela de contexto?
A janela de contexto é de 1,048,576 tokens (cerca de 1 milhão de tokens). Isso inclui tokens de entrada e saída em todo o histórico da conversa. A saída máxima por geração é de 65,536 tokens.
Quais são os pontos fortes do Qwen3.5 Flash?
Os pontos fortes incluem entrada multimodal (texto, imagem, vídeo), uma janela de contexto muito grande de 1M, saída longa de 65K tokens, baixo custo por token e inferência rápida em comparação com modelos Qwen maiores. É ideal para tarefas multimodais de alto volume ou em tempo real.
Como ele se compara aos modelos Qwen maiores?
Modelos Qwen maiores, como o Qwen3.5-72B, oferecem maior precisão em raciocínio complexo, mas são mais lentos e caros. O Qwen3.5 Flash troca alguma precisão por velocidade e eficiência de custo, mantendo as mesmas capacidades multimodais e de contexto longo.
O OrcaRouter adiciona margem sobre o preço do provedor?
Não. O preço é repassado à taxa do provedor com margem zero. Você paga exatamente $0,10 por 1M de tokens de entrada e $0,40 por 1M de tokens de saída para o Qwen3.5 Flash via OrcaRouter.
Posso chamar o Qwen3.5 Flash usando uma API compatível com OpenAI?
Sim. O OrcaRouter fornece um endpoint compatível com OpenAI em https://api.orcarouter.ai/v1. Use o ID do modelo "qwen/qwen3.5-flash" com sua chave de API do OrcaRouter. O formato das requisições e respostas corresponde à API de chat completions do OpenAI.
Como funciona o tratamento de dados com o OrcaRouter?
As políticas de tratamento de dados são determinadas pelo OrcaRouter e Qwen. A entrada do catálogo não fornece detalhes específicos. Os usuários devem revisar a política de privacidade do OrcaRouter e os termos de uso de dados da Qwen antes de enviar dados sensíveis.
Quais modalidades o modelo suporta?
Suporta entradas de texto, imagem e vídeo. As imagens podem ser fornecidas como URLs ou dados base64 na mensagem do usuário. As entradas de vídeo são geralmente enviadas como uma sequência de quadros (imagens). O modelo gera apenas saída de texto.
Existe um número mínimo ou máximo de tokens necessário?
Não há contagem mínima de tokens. O número máximo de tokens de entrada (incluindo histórico da conversa) é de 1,048,576 tokens. O número máximo de tokens de saída por resposta é de 65,536. Use o parâmetro max_tokens para controlar o comprimento da saída.
Como começo a chamar este modelo via OrcaRouter?
Inscreva-se no OrcaRouter para obter uma chave de API. Defina a URL base para https://api.orcarouter.ai/v1 no seu código. Use o ID do modelo "qwen/qwen3.5-flash" e envie uma solicitação padrão de conclusão de chat com seu conteúdo multimodal. Consulte a documentação do OrcaRouter para ver exemplos.

Incorporar este selo

qwen/qwen3.5-flash$0.10/M in2705ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash no OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Ficha do modelo como dados

GET /api/public/models/qwen/qwen3.5-flashAbrir
Legível por máquina:/llms.txt/llms-full.txt