Qwen3.7 Flash

qwen/qwen3.7-flash
NyUtvalt
VisionVerktygJSONResonemang
av Qwen · 2026-07-27

Qwen3.7 Flash är Alibabas snabba, extremt kostnadseffektiva modell i Qwen3.7-familjen, placerad under Qwen3.7-Plus och Qwen3.7-Max som höggenomströmningsnivån. Den är naturligt multimodal på ingångssidan – accepterar text, bilder och video med textutdata – och erbjuder ett 1M-tokens kontextfönster med upp till 64K utdatatokens, så att långa dokument, skärmdumpar och videorutor fortfarande är inom räckhåll även till Flash-nivåns prissättning. Till ungefär $0,03 per miljon inmatningstokens på basnivån är den en av de billigaste 1M-kontext multimodala modellerna som finns, vilket gör den till ett naturligt val för klassificering, extrahering, routing, sammanfattning, lätta agenter och alla pipelines som körs i mycket hög volym. Den stöder resonemangsläge, inbyggt verktygsanrop, strukturerade utdata via response_format och de vanliga styrparametrarna (temperature / top_p / seed / logprobs). Observera att prissättningen är nivåindelad efter promptlängd: kostnaderna ökar över 32K och igen över 256K inmatningstokens, så att batcha korta förfrågningar är avsevärt billigare än att fylla ut långa. Använd Flash som volymarbetshäst och eskalera till Qwen3.7-Plus eller Max när en uppgift verkligen kräver mer kapacitet.

ctx1M tokens
Max output65K
Inmatningtext + image + video
Utdatatext
p50 TTFT2.83 s
INMATNING$0.03/ 1M token
UTDATA$0.13/ 1M token
p50 TTFT2.83 s7d
p95 TTFT9.64 s7d
TRAFIK13.5Mtokens/7d

Qwen3.7 Flash är en multimodal stor språkmodell skapad av Qwenteamet och tillgängliggjord via OrcaRouter. Den bearbetar text-, bild- och videoindata och stöder ett kontextfönster på 1,000,000 tokens,…

Vad är Qwen3.7 Flash och vem bör använda det?

Vilka inmatningsmodaliteter stöder Qwen3.7 Flash?

Vad är kontextfönstrets storlek för Qwen3.7 Flash?

Hur nås Qwen3.7 Flash via OrcaRouter?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Priser

NivåInmatning / 1M tokenUtdata / 1M tokensCacheläsning / 1MCache-skrivning / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
Nivå väljs utifrån antalet inmatningstoken per förfrågan

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $0.600 · Med promptcachning $0.516

Uppskattning baserad på listpris

Skiktad prissättning — den här uppskattningen använder priser för basnivån.

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000066

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
2.83 s
Utdatahastighet
333 tok/s
p95 TTFT
9.64 s
Felfrekvens
0%

Offentliga benchmarks

Källa: Design Arena

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Så jämför den sig

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Input $/M$0.03$0.86$0.17$0.12
Output $/M$0.13$3.44$1.03$0.69
Kontext1.0M262K33K1.0M
Kvalitet7/108/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad kostar Qwen3.7 Flash på OrcaRouter?
Ingen specifik prissättning för Qwen3.7 Flash finns i tillgängliga fakta. OrcaRouter tar vanligtvis betalt per token för in- och utdata. Som en Flash-modell är den sannolikt prissatt lägre än flaggskeppsmodeller. Besök OrcaRouters prissida eller kontakta supporten för aktuella priser.
Vad är kontextfönstrets storlek för Qwen3.7 Flash?
Kontextfönstret är 1 000 000 tokens. Detta gör att modellen kan bearbeta mycket långa dokument, utökade konversationer eller stora uppsättningar bilder/videor i en enda prompt.
Vad är styrkorna med Qwen3.7 Flash?
Dess styrkor inkluderar en 1M-tokens kontext, stöd för multimodal inmatning (text, bild, video), 65k max output-tokens och en optimerad 'Flash'-arkitektur som balanserar hastighet och kostnad. Den är väl lämpad för analys av långa dokument och multimodal förståelse.
Hur jämförs Qwen3.7 Flash med GPT-4o-mini?
Qwen3.7 Flash erbjuder ett betydligt större kontextfönster (1M vs. 128k) och högre maxutdata (65k vs. 16k). GPT-4o-mini kan ha bredare ekosystemstöd. Varken prissättning eller riktmärken tillhandahålls för direkt jämförelse.
Cachar OrcaRouter prompts för att minska kostnaderna?
OrcaRouter kan erbjuda promptcaching, men dess specifika policy för Qwen3.7 Flash framgår inte i fakta. Kontrollera OrcaRouters dokumentation för cache-träffindikatorer och rabattinformation.
Hur anropar jag Qwen3.7 Flash med ett OpenAI-kompatibelt API?
Ställ in bas-URL till https://api.orcarouter.ai/v1 och använd modell-ID "qwen/qwen3.7-flash". Inkludera din OrcaRouter API-nyckel. Chat-kompletteringsslutpunkten fungerar med standard OpenAI-parametrar. För multimodal inmatning, lägg till bild- eller videoobjekt i meddelandeinnehållsarrayen.
Vilka inmatningsmodaliteter stöder Qwen3.7 Flash?
Den stöder text-, bild- och videoinmatningar. Detta möjliggör uppgifter som att analysera bilder tillsammans med text, sammanfatta videor och kombinera flera medietyper i en enda prompt.
Kan jag finjustera Qwen3.7 Flash på min egen data?
Tillgängliga fakta nämner inte finjusteringsmöjligheter. Som en API-åtkomlig modell via OrcaRouter är finjustering sannolikt inte möjlig. För anpassad finjustering, överväg öppen källkodsalternativ.
Vad är den maximala utdatalängden för Qwen3.7 Flash?
Den maximala utmatningen är 65 536 token. Detta möjliggör generering av mycket långa svar, rapporter eller kod i ett enda API-anrop.
Hur hanterar jag videoingångar med Qwen3.7 Flash?
Specifika detaljer för videohantering anges inte. Vanligtvis bearbetas videoinmatningar som sekvenser av bildrutor. Du kan behöva förbehandla videor till en serie bilder och skicka dem som bild-URL:er eller base64-data. Se OrcaRouters dokumentation för exakt formatering.

Bädda in denna badge

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

Modellkort som data

GET /api/public/models/qwen/qwen3.7-flashÖppna