Qwen3.7 Flash

qwen/qwen3.7-flash
NowyPolecane
WizjaNarzędziaJSONRozumowanie
przez Qwen · 2026-07-27

Qwen3.7 Flash to szybki, niezwykle efektywny kosztowo model z rodziny Qwen3.7 od Alibaby, plasujący się poniżej Qwen3.7-Plus i Qwen3.7-Max jako warstwa o wysokiej przepustowości. Jest natywnie multimodalny po stronie wejściowej — przyjmuje tekst, obrazy i wideo z wyjściem tekstowym — i obsługuje okno kontekstowe o długości 1 miliona tokenów z możliwością wygenerowania do 64 tys. tokenów, co sprawia, że długie dokumenty, zrzuty ekranu i klatki wideo pozostają w zasięgu nawet przy cenach warstwy Flash. Przy cenie około 0,03 USD za milion tokenów wejściowych w podstawowej warstwie jest to jeden z najtańszych multimodalnych modeli z kontekstem 1M, co czyni go naturalnym wyborem do klasyfikacji, ekstrakcji, routingu, streszczania, lekkich agentów oraz wszelkich potoków o bardzo dużej skali. Obsługuje tryb wnioskowania, natywne wywoływanie narzędzi, ustrukturyzowane dane wyjściowe za pomocą `response_format` oraz standardowe parametry próbkowania (temperature / top_p / seed / logprobs). Uwaga: ceny są stopniowane w zależności od długości promptu — koszty rosną powyżej 32 tys. tokenów i ponownie powyżej 256 tys. tokenów wejściowych, więc grupowanie krótkich zapytań jest znacznie tańsze niż dopełnianie długich. Używaj Flash jako konia roboczego przy dużej objętości, a przechodź na Qwen3.7-Plus lub Max, gdy zadanie wymaga rzeczywiście większych możliwości.

kont.1M tokenów
Maks. wyjście65K
Wejścietext + image + video
Wyjścietext
p50 TTFT2.83 s
WEJŚCIE$0.03/ 1M tokenów
WYJŚCIE$0.13/ 1M tokenów
p50 TTFT2.83 s7 d
p95 TTFT9.64 s7 d
RUCH13.5Mtokenów / 7 d

Qwen3.7 Flash to multimodalny duży model językowy stworzony przez zespół Qwen i udostępniany za pośrednictwem OrcaRouter. Przetwarza dane wejściowe w postaci tekstu, obrazu i wideo oraz obsługuje…

Czym jest Qwen3.7 Flash i kto powinien go używać?

Jakie sposoby wprowadzania danych obsługuje Qwen3.7 Flash?

Jaka jest wielkość okna kontekstowego Qwen3.7 Flash?

Jak uzyskać dostęp do Qwen3.7 Flash przez OrcaRouter?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Cennik

PoziomWejście / 1M tokenówWyjście / 1M tokenówOdczyt cache / 1MZapis cache / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
Poziom wybierany na podstawie liczby tokenów wejściowych każdego żądania

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $0.600 · Z cache promptów $0.516

Szacunek na podstawie cennika

Ceny progowe — ten szacunek używa stawek progu podstawowego.

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000066

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
2.83 s
Prędkość wyjścia
333 tok/s
p95 TTFT
9.64 s
Wskaźnik błędów
0%

Publiczne benchmarki

Źródło: Design Arena

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News0 wzmianek · 7 dni

Porównanie

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Wejście $/M$0.03$0.86$0.17$0.12
Wyjście $/M$0.13$3.44$1.03$0.69
Kontekst1.0M262K33K1.0M
Jakość7/108/108/108/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje Qwen3.7 Flash na OrcaRouter?
Nie podano konkretnych cen dla Qwen3.7 Flash w dostępnych informacjach. OrcaRouter zwykle pobiera opłatę za token za wejście i wyjście. Jako model Flash jest prawdopodobnie wyceniony niżej niż modele flagowe. Odwiedź stronę cenową OrcaRouter lub skontaktuj się z obsługą, aby poznać aktualne stawki.
Jaka jest wielkość okna kontekstowego Qwen3.7 Flash?
Okno kontekstowe wynosi 1 000 000 tokenów. Pozwala to modelowi na przetwarzanie bardzo długich dokumentów, rozszerzonych rozmów lub dużych zestawów obrazów/filmów w jednym prompcie.
Jakie są mocne strony Qwen3.7 Flash?
Do jego zalet należą: kontekst 1M tokenów, obsługa multimodalnych danych wejściowych (tekst, obraz, wideo), maksymalnie 65k tokenów wyjściowych oraz zoptymalizowana architektura 'Flash', która równoważy szybkość i koszt. Jest dobrze przystosowany do analizy długich dokumentów i multimodalnego rozumienia.
Jak Qwen3.7 Flash wypada w porównaniu z GPT-4o-mini?
Qwen3.7 Flash oferuje znacznie większe okno kontekstowe (1M vs. 128k) oraz wyższą maksymalną długość odpowiedzi (65k vs. 16k). GPT-4o-mini może zapewniać szersze wsparcie ekosystemu. Nie podano jednak ani cen, ani benchmarków umożliwiających bezpośrednie porównanie.
Czy OrcaRouter buforuje podpowiedzi, aby obniżyć koszty?
OrcaRouter może oferować buforowanie promptów, ale jego szczegółowa polityka dla Qwen3.7 Flash nie jest opisana w faktach. Sprawdź dokumentację OrcaRouter w poszukiwaniu wskaźników trafień pamięci podręcznej i informacji o zniżkach.
Jak wywołać Qwen3.7 Flash za pomocą API zgodnego z OpenAI?
Ustaw bazowy URL na https://api.orcarouter.ai/v1 i użyj ID modelu "qwen/qwen3.7-flash". Dołącz swój klucz API OrcaRouter. Endpoint czatowych uzupełnień działa ze standardowymi parametrami OpenAI. W przypadku danych multimodalnych dodaj obiekty obrazu lub wideo w tablicy treści wiadomości.
Jakie sposoby wprowadzania danych obsługuje Qwen3.7 Flash?
Obsługuje wprowadzanie tekstu, obrazów i wideo. Umożliwia to zadania takie jak analizowanie obrazów wraz z tekstem, podsumowywanie filmów oraz łączenie wielu typów mediów w jednym zapytaniu.
Czy mogę dostroić Qwen3.7 Flash na własnych danych?
Dostępne fakty nie wspominają o możliwościach fine-tuningu. Jako model dostępny przez API za pośrednictwem OrcaRouter, fine-tuning prawdopodobnie nie jest obsługiwany. W przypadku niestandardowego fine-tuningu rozważ alternatywy open-source.
Jaka jest maksymalna długość wyjścia Qwen3.7 Flash?
Maksymalna liczba tokenów na wyjściu wynosi 65 536. Umożliwia to generowanie bardzo długich odpowiedzi, raportów lub kodu w ramach jednego wywołania API.
Jak obsługiwać wejścia wideo w Qwen3.7 Flash?
Nie podano szczegółowych informacji dotyczących obsługi wideo. Zazwyczaj wejścia wideo są przetwarzane jako sekwencje klatek. Może być konieczne wstępne przetworzenie filmów na serię obrazów i przekazanie ich jako adresy URL obrazów lub dane base64. Aby uzyskać dokładny format, zapoznaj się z dokumentacją OrcaRouter.

Osadź tę odznakę

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash w OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

Karta modelu jako dane

GET /api/public/models/qwen/qwen3.7-flashOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt