qwen/qwen3.5-flash

qwen/qwen3.5-flash
VisionToolsJSONReasoning
von qwen

Qwen3.5 Flash — multimodaler Chat (Text/Bild/Video), kostenoptimiert, 1M Kontext.

Ktx1M Tokens
Max. Ausgabe65K
Eingabetext + image + video
Ausgabetext
p50 TTFT2.71 s
EINGABE$0.10/ 1M Tokens
AUSGABE$0.40/ 1M Tokens
p50 TTFT2.71 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR1.3MTokens / 7 T

Qwen3.5 Flash ist ein multimodales Sprachmodell der Qwen-Familie, das für schnelle Inferenz und niedrige Kosten entwickelt wurde. Es akzeptiert Text-, Bild- und Videoeingaben und erzeugt…

Was ist Qwen3.5 Flash?

Für wen ist dieses Modell?

Wichtige Spezifikationen auf einen Blick

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preise

Eingabe / 1M Tokens$0.100
Ausgabe / 1M Tokens$0.400
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $1.90

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000203

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
2.71 s
Ausgabegeschwindigkeit
206 tok/s
p95 TTFT
10.00 s
Fehlerquote
7.3%

Öffentliche Benchmarks

Quelle: Design Arena

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News0 Erwähnungen · 7 T

Im Vergleich

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Eingabe $/M$0.10$2.00$0.86$0.17
Ausgabe $/M$0.40$6.00$3.44$1.03
Kontext1.0M1.0M262K33K
Qualität6/109/108/108/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was kostet die Nutzung von Qwen3.5 Flash auf OrcaRouter?
Die Kosten betragen $0.10 pro 1 Million Eingabe-Token und $0.40 pro 1 Million Ausgabe-Token. Dies ist der Anbieterpreis ohne Aufschlag von OrcaRouter. Sie zahlen genau das, was der Anbieter berechnet, ohne zusätzliche Gebühren.
Wie groß ist das Kontextfenster?
Der Kontextfenster hat 1.048.576 Token (etwa 1 Million Token). Dies umfasst sowohl Eingabe- als auch Ausgabetoken über die gesamte Konversationshistorie hinweg. Die maximale Ausgabe pro Generierung beträgt 65.536 Token.
Was sind die Stärken von Qwen3.5 Flash?
Zu den Stärken gehören multimodaler Input (Text, Bild, Video), ein sehr großes 1M-Kontextfenster, lange Ausgabe von 65K Token, niedrige Kosten pro Token und schnelle Inferenz im Vergleich zu größeren Qwen-Modellen. Es ist ideal für hochvolumige oder Echtzeit-multimodale Aufgaben.
Wie schneidet es im Vergleich zu größeren Qwen-Modellen ab?
Größere Qwen-Modelle wie Qwen3.5-72B bieten eine höhere Genauigkeit bei komplexem Denken, sind aber langsamer und teurer. Qwen3.5 Flash tauscht etwas Genauigkeit gegen Geschwindigkeit und Kosteneffizienz ein, während es die gleichen multimodalen und Langkontext-Fähigkeiten beibehält.
Erhebt OrcaRouter einen Aufschlag auf die Preise des Anbieters?
Nein. Die Preise werden zum Anbietertarif ohne Aufschlag durchgereicht. Sie zahlen exakt $0.10 pro 1M Input-Tokens und $0.40 pro 1M Output-Tokens für Qwen3.5 Flash über OrcaRouter.
Kann ich Qwen3.5 Flash über eine OpenAI-kompatible API aufrufen?
Ja. OrcaRouter bietet einen OpenAI-kompatiblen Endpunkt unter https://api.orcarouter.ai/v1. Verwenden Sie die Modell-ID "qwen/qwen3.5-flash" mit Ihrem OrcaRouter-API-Schlüssel. Die Anfrage- und Antwortformate entsprechen der OpenAI Chat Completions API.
Wie funktioniert die Datenverarbeitung mit OrcaRouter?
Die Richtlinien zur Datenverarbeitung werden von OrcaRouter und Qwen festgelegt. Der Katalogeintrag enthält keine spezifischen Details. Benutzer sollten die Datenschutzrichtlinie von OrcaRouter und die Datennutzungsbedingungen von Qwen überprüfen, bevor sie sensible Daten senden.
Welche Modalitäten unterstützt das Modell?
Es unterstützt Text-, Bild- und Videoeingaben. Bilder können als URLs oder base64-Daten in der Benutzernachricht bereitgestellt werden. Videoeingaben werden typischerweise als eine Sequenz von Einzelbildern (Bildern) gesendet. Das Modell generiert nur Textausgabe.
Ist eine Mindest- oder Höchstanzahl von Token erforderlich?
Es gibt keine minimale Token-Anzahl. Die maximale Anzahl an Eingabe-Tokens (einschließlich Gesprächsverlauf) beträgt 1.048.576 Tokens. Die maximale Anzahl an Ausgabe-Tokens pro Antwort beträgt 65.536. Verwenden Sie den Parameter max_tokens, um die Ausgabelänge zu steuern.
Wie fange ich an, dieses Modell über OrcaRouter aufzurufen?
Melden Sie sich bei OrcaRouter an, um einen API-Key zu erhalten. Setzen Sie die Basis-URL in Ihrem Code auf https://api.orcarouter.ai/v1. Verwenden Sie die Modell-ID „qwen/qwen3.5-flash“ und senden Sie eine Standard-Chat-Completion-Anfrage mit Ihren multimodalen Inhalten. Weitere Beispiele finden Sie in der OrcaRouter-Dokumentation.

Dieses Abzeichen einbetten

qwen/qwen3.5-flash$0.10/M in2705ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash auf OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Modellkarte als Daten

GET /api/public/models/qwen/qwen3.5-flashÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt