Qwen3.7 Flash

qwen/qwen3.7-flash
NieuwUitgelicht
VisieToolsJSONRedeneren
door Qwen · 2026-07-27

Qwen3.7 Flash is Alibaba's snelle, uiterst kostenefficiënte model in de Qwen3.7-familie, lager gepositioneerd dan Qwen3.7-Plus en Qwen3.7-Max als de hoge-doorvoerlaag. Het is native multimodaal aan de invoerzijde — accepteert tekst, afbeeldingen en video met tekstuitvoer — en biedt een contextvenster van 1M tokens met maximaal 64K uitvoertokens, zodat lange documenten, screenshots en videoframes binnen bereik blijven, zelfs tegen Flash-niveau prijzen. Met ruwweg $0,03 per miljoen invoertokens op het basisniveau is het een van de goedkoopste 1M-context multimodale modellen beschikbaar, waardoor het een natuurlijke keuze is voor classificatie, extractie, routering, samenvatting, lichtgewicht agents en elke pijplijn die op zeer hoge volumes draait. Het ondersteunt redeneermodus, native tool-aanroeping, gestructureerde uitvoer via response_format en de gebruikelijke sampling-instellingen (temperature / top_p / seed / logprobs). Let op: de prijzen zijn trapsgewijs per promptlengte: de kosten stijgen boven 32K en opnieuw boven 256K invoertokens, dus het bundelen van korte verzoeken is aanzienlijk goedkoper dan het opvullen van lange. Gebruik Flash als het werkpaard voor hoge volumes en schakel over naar Qwen3.7-Plus of Max wanneer een taak echt meer capaciteit nodig heeft.

ctx1M tokens
Max. uitvoer65K
Invoertext + image + video
Uitvoertext
p50 TTFT2.83 s
INPUT$0.03/ 1M tokens
OUTPUT$0.13/ 1M tokens
p50 TTFT2.83 s7d
p95 TTFT9.64 s7d
VERKEER13.5Mtokens / 7d

Qwen3.7 Flash is een multimodaal groot taalmodel, gemaakt door het Qwen-team en beschikbaar gesteld via OrcaRouter. Het verwerkt tekst-, beeld- en video-invoer en ondersteunt een contextvenster van…

Wat is Qwen3.7 Flash en voor wie is het bedoeld?

Welke invoermodaliteiten ondersteunt Qwen3.7 Flash?

Wat is de contextvenstergrootte van Qwen3.7 Flash?

Hoe wordt Qwen3.7 Flash benaderd via OrcaRouter?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Prijzen

NiveauInvoer / 1M tokensUitvoer / 1M tokensCache lezen / 1MCache schrijven / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
Niveau bepaald door het aantal invoertokens van elk verzoek

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $0.600 · Met prompt-caching $0.516

Schatting op basis van catalogusprijs

Gelaagde prijzen — deze schatting gebruikt de basistarieven.

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000066

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
2.83 s
Outputsnelheid
333 tok/s
p95 TTFT
9.64 s
Foutpercentage
0%

Openbare benchmarks

Bron: Design Arena

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News0 vermeldingen · 7 d

Vergelijking

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Invoer $/M$0.03$0.86$0.17$0.12
Uitvoer $/M$0.13$3.44$1.03$0.69
Context1.0M262K33K1.0M
Kwaliteit7/108/108/108/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Hoeveel kost Qwen3.7 Flash op OrcaRouter?
Er is geen specifieke prijsinformatie voor Qwen3.7 Flash beschikbaar in de bekende feiten. OrcaRouter rekent doorgaans per token voor invoer en uitvoer. Als Flash-model is het waarschijnlijk goedkoper dan vlaggenschipmodellen. Bezoek de prijspagina van OrcaRouter of neem contact op met de ondersteuning voor actuele tarieven.
Wat is de contextvenstergrootte van Qwen3.7 Flash?
Het contextvenster is 1.000.000 tokens. Dit stelt het model in staat om zeer lange documenten, uitgebreide gesprekken of grote sets afbeeldingen/video's in één enkele prompt te verwerken.
Wat zijn de sterke punten van Qwen3.7 Flash?
De sterke punten zijn onder andere een context van 1M tokens, ondersteuning voor multimodale invoer (tekst, afbeelding, video), maximaal 65k uitvoertokens en een geoptimaliseerde 'Flash'-architectuur die snelheid en kosten in balans houdt. Het is zeer geschikt voor analyse van lange documenten en multimodaal begrip.
Hoe verhoudt Qwen3.7 Flash zich tot GPT-4o-mini?
Qwen3.7 Flash biedt een aanzienlijk groter contextvenster (1M vs. 128k) en een hogere maximale uitvoer (65k vs. 16k). GPT-4o-mini heeft mogelijk bredere ecosysteemondersteuning. Er worden geen prijzen of benchmarks verstrekt voor directe vergelijking.
Cacht OrcaRouter prompts om kosten te verlagen?
OrcaRouter biedt mogelijk prompt caching aan, maar het specifieke beleid voor Qwen3.7 Flash wordt niet in de feiten vermeld. Raadpleeg de documentatie van OrcaRouter voor cache-hit-indicatoren en kortingsinformatie.
Hoe roep ik Qwen3.7 Flash aan met een OpenAI-compatibele API?
Stel de basis-URL in op https://api.orcarouter.ai/v1 en gebruik het model-ID "qwen/qwen3.7-flash". Voeg uw OrcaRouter API-sleutel toe. Het chatcompletions-eindpunt werkt met standaard OpenAI-parameters. Voeg voor multimodale invoer afbeeldingen of video-objecten toe in de inhoudsarray van het bericht.
Welke invoermodaliteiten ondersteunt Qwen3.7 Flash?
Het ondersteunt tekst-, afbeeldings- en video-invoer. Dit maakt taken mogelijk zoals het analyseren van afbeeldingen naast tekst, het samenvatten van video's en het combineren van meerdere mediatypen in één prompt.
Kan ik Qwen3.7 Flash finetunen op mijn eigen data?
De beschikbare feiten vermelden geen fine-tuning mogelijkheden. Als een via API toegankelijk model via OrcaRouter, wordt fine-tuning waarschijnlijk niet ondersteund. Voor custom fine-tuning, overweeg open-source alternatieven.
Wat is de maximale uitvoerlengte van Qwen3.7 Flash?
De maximale output is 65,536 tokens. Dit maakt het mogelijk om zeer lange antwoorden, rapporten of code te genereren in één enkele API-aanroep.
Hoe verwerk ik video-invoer met Qwen3.7 Flash?
Er worden geen specifieke details over videoverwerking gegeven. Typisch worden video-ingangen verwerkt als reeksen van frames. Mogelijk moet u video's voorbewerken tot een reeks afbeeldingen en deze doorgeven als afbeeldings-URL's of base64-gegevens. Raadpleeg de documentatie van OrcaRouter voor de exacte opmaak.

Sluit deze badge in

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash op OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

Modelkaart als data

GET /api/public/models/qwen/qwen3.7-flashOpenen
Machineleesbaar:/llms.txt/llms-full.txt