qwen/qwen3.5-flash

qwen/qwen3.5-flash
VisieToolsJSONRedeneren
door qwen

Qwen3.5 Flash — multimodale chat (tekst/afbeelding/video) geoptimaliseerd voor kosten, 1M context.

ctx1M tokens
Max. uitvoer65K
Invoertext + image + video
Uitvoertext
p50 TTFT2.71 s
INPUT$0.10/ 1M tokens
OUTPUT$0.40/ 1M tokens
p50 TTFT2.71 s7d
p95 TTFT10.00 s7d
VERKEER1.3Mtokens / 7d

Qwen3.5 Flash is een multimodaal taalmodel uit de Qwen-familie, ontworpen voor snelle inferentie en lage kosten. Het accepteert tekst-, afbeeldings- en video-invoer en genereert tekstreacties. Het…

Wat is Qwen3.5 Flash?

Voor wie is dit model?

Kernspecificaties in één oogopslag

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Prijzen

Invoer / 1M tokens$0.100
Uitvoer / 1M tokens$0.400
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $1.90

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000202

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
2.71 s
Outputsnelheid
206 tok/s
p95 TTFT
10.00 s
Foutpercentage
7.3%

Openbare benchmarks

Bron: Design Arena

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News0 vermeldingen · 7 d

Vergelijking

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Invoer $/M$0.10$2.00$0.86$0.17
Uitvoer $/M$0.40$6.00$3.44$1.03
Context1.0M1.0M262K33K
Kwaliteit6/109/108/108/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Wat zijn de kosten om Qwen3.5 Flash te gebruiken op OrcaRouter?
De kosten zijn $0.10 per 1 miljoen invoertokens en $0.40 per 1 miljoen uitvoertokens. Dit is het tarief van de provider zonder opslag door OrcaRouter. U betaalt precies wat de provider in rekening brengt, zonder extra kosten.
Wat is de grootte van het contextvenster?
Het contextvenster is 1.048.576 tokens (ongeveer 1 miljoen tokens). Dit omvat zowel invoer- als uitvoertokens over de volledige gespreksgeschiedenis. De maximale uitvoer per generatie is 65.536 tokens.
Wat zijn de sterke punten van Qwen3.5 Flash?
Sterke punten zijn onder andere multimodale invoer (tekst, afbeelding, video), een zeer groot contextvenster van 1M, lange uitvoer van 65K tokens, lage kosten per token, en snelle inferentie vergeleken met grotere Qwen-modellen. Het is ideaal voor hoogvolume of realtime multimodale taken.
Hoe verhoudt het zich tot grotere Qwen-modellen?
Grotere Qwen-modellen zoals Qwen3.5-72B bieden een hogere nauwkeurigheid bij complexe redeneringen, maar zijn trager en duurder. Qwen3.5 Flash wisselt wat nauwkeurigheid in voor snelheid en kostenefficiëntie, terwijl het dezelfde multimodale en langetermijncontextmogelijkheden behoudt.
Verhoogt OrcaRouter de prijzen van de provider?
Nee. De prijzen worden doorberekend tegen het provider-tarief zonder opslag. U betaalt precies $0,10 per 1M invoertokens en $0,40 per 1M uitvoertokens voor Qwen3.5 Flash via OrcaRouter.
Kan ik Qwen3.5 Flash aanroepen met een OpenAI-compatible API?
Ja. OrcaRouter biedt een OpenAI-compatibel eindpunt op https://api.orcarouter.ai/v1. Gebruik het model-ID "qwen/qwen3.5-flash" met uw OrcaRouter API-sleutel. De aanvraag- en antwoordformaten komen overeen met de OpenAI chat completions API.
Hoe werkt gegevensverwerking met OrcaRouter?
Het beleid voor gegevensverwerking wordt bepaald door OrcaRouter en Qwen. De catalogusvermelding geeft geen specifieke details. Gebruikers dienen het privacybeleid van OrcaRouter en de gegevensgebruiksvoorwaarden van Qwen te bekijken voordat ze gevoelige gegevens verzenden.
Welke modaliteiten ondersteunt het model?
Het ondersteunt tekst-, afbeelding- en video-invoer. Afbeeldingen kunnen worden verstrekt als URL's of base64-gegevens in het bericht van de gebruiker. Video-invoer wordt meestal verzonden als een reeks frames (afbeeldingen). Het model genereert alleen tekstuitvoer.
Is er een minimum of maximum aantal tokens vereist?
Er is geen minimum aantal tokens. De maximale invoertokens (inclusief gespreksgeschiedenis) is 1.048.576 tokens. De maximale uitvoertokens per antwoord is 65.536. Gebruik de parameter max_tokens om de lengte van de uitvoer te regelen.
Hoe begin ik met het aanroepen van dit model via OrcaRouter?
Meld je aan voor OrcaRouter om een API-sleutel te krijgen. Stel de basis-URL in op https://api.orcarouter.ai/v1 in je code. Gebruik model-ID "qwen/qwen3.5-flash" en stuur een standaard chatvoltooiingsverzoek met je multimodale inhoud. Zie de OrcaRouter-documentatie voor voorbeelden.

Sluit deze badge in

qwen/qwen3.5-flash$0.10/M in2705ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash op OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Modelkaart als data

GET /api/public/models/qwen/qwen3.5-flashOpenen
Machineleesbaar:/llms.txt/llms-full.txt