qwen/qwen3.5-flash

qwen/qwen3.5-flash
VisioneStrumentiJSONRagionamento
di qwen

Qwen3.5 Flash — chat multimodale (testo/immagine/video) ottimizzata per i costi, contesto da 1M.

ctx1M token
Output max65K
Inputtext + image + video
Outputtext
p50 TTFT2.71 s
INGRESSO$0.10/ 1M token
USCITA$0.40/ 1M token
p50 TTFT2.71 s7 g
p95 TTFT10.00 s7 g
TRAFFICO1.3Mtoken / 7 g

Qwen3.5 Flash è un modello linguistico multimodale della famiglia Qwen, progettato per inferenza veloce e basso costo. Accetta input di testo, immagini e video e genera risposte testuali. La sua…

Cos'è Qwen3.5 Flash?

A chi è destinato questo modello?

Specifiche chiave a colpo d'occhio

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Prezzi

Input / 1M token$0.100
Output / 1M token$0.400
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $1.90

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000202

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
2.71 s
Velocità di output
206 tok/s
p95 TTFT
10.00 s
Tasso di errore
7.3%

Benchmark pubblici

Fonte: Design Arena

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News0 menzioni · 7 gg

A confronto

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Input $/M$0.10$2.00$0.86$0.17
Output $/M$0.40$6.00$3.44$1.03
Contesto1.0M1.0M262K33K
Qualità6/109/108/108/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per utilizzare Qwen3.5 Flash su OrcaRouter?
Il costo è di $0.10 per 1 milione di token di input e $0.40 per 1 milione di token di output. Questa è la tariffa del fornitore con ricarico zero da parte di OrcaRouter. Paghi esattamente ciò che il fornitore addebita, senza commissioni aggiuntive.
Qual è la dimensione della finestra di contesto?
La finestra di contesto è di 1,048,576 token (circa 1 milione di token). Questo include sia i token di input che quelli di output nell'intera cronologia della conversazione. L'output massimo per generazione è di 65,536 token.
Quali sono i punti di forza di Qwen3.5 Flash?
I punti di forza includono input multimodale (testo, immagine, video), una finestra di contesto molto ampia di 1M, output lungo di 65K token, basso costo per token e inferenza rapida rispetto ai modelli Qwen più grandi. È ideale per attività multimodali ad alto volume o in tempo reale.
Come si confronta con i modelli Qwen più grandi?
I modelli Qwen più grandi, come Qwen3.5-72B, offrono una maggiore accuratezza nel ragionamento complesso ma sono più lenti e costosi. Qwen3.5 Flash scambia un po' di accuratezza per velocità ed efficienza dei costi, mantenendo le stesse capacità multimodali e di contesto lungo.
OrcaRouter applica un ricarico sul prezzo del fornitore?
No. Il prezzo è trasmesso al tasso del fornitore senza alcun ricarico. Paghi esattamente $0.10 per 1M token in input e $0.40 per 1M token in output per Qwen3.5 Flash tramite OrcaRouter.
Posso chiamare Qwen3.5 Flash usando un'API compatibile con OpenAI?
Sì. OrcaRouter fornisce un endpoint compatibile con OpenAI all'indirizzo https://api.orcarouter.ai/v1. Utilizza l'ID modello "qwen/qwen3.5-flash" con la tua chiave API OrcaRouter. I formati di richiesta e risposta corrispondono all'API di completamento chat di OpenAI.
Come funziona la gestione dei dati con OrcaRouter?
Le politiche di gestione dei dati sono determinate da OrcaRouter e Qwen. La voce del catalogo non fornisce dettagli specifici. Gli utenti dovrebbero rivedere l'informativa sulla privacy di OrcaRouter e i termini di utilizzo dei dati di Qwen prima di inviare dati sensibili.
Quali modalità supporta il modello?
Supporta input di testo, immagini e video. Le immagini possono essere fornite come URL o dati base64 nel messaggio dell'utente. Gli input video vengono tipicamente inviati come sequenza di fotogrammi (immagini). Il modello genera solo output testuale.
C'è un numero minimo o massimo di token richiesti?
Non esiste un numero minimo di token. Il numero massimo di token in input (inclusa la cronologia della conversazione) è di 1.048.576 token. Il numero massimo di token in output per risposta è di 65.536. Utilizzare il parametro max_tokens per controllare la lunghezza dell'output.
Come posso iniziare a chiamare questo modello tramite OrcaRouter?
Iscriviti a OrcaRouter per ottenere una chiave API. Imposta l'URL di base su https://api.orcarouter.ai/v1 nel tuo codice. Usa l'ID modello "qwen/qwen3.5-flash" e invia una richiesta di chat completion standard con il tuo contenuto multimodale. Consulta la documentazione di OrcaRouter per esempi.

Incorpora questo badge

qwen/qwen3.5-flash$0.10/M in2705ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash su OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Scheda del modello come dati

GET /api/public/models/qwen/qwen3.5-flashApri
Leggibile dalle macchine:/llms.txt/llms-full.txt