Qwen3.8 Flash

qwen/qwen3.8-flash
NowyPolecane
WizjaNarzędziaJSONRozumowanie
przez Qwen · 2026-08-26

Qwen3.8 Flash to wielomodalny model rozumowania firmy Alibaba. Nadaje się do wspomagania kodowania, przepływów pracy agentowych, rozumienia wizualnego, analizy dokumentów i baz kodu, interakcji z pulpitem, analizy wykresów oraz analizy długich materiałów wideo.

Punkty końcowe:/v1/chat/completions
kont.1M tokenów
Maks. wyjście131K
Wejścietext + image + video
Wyjścietext
p50 TTFT4.25 s
WEJŚCIE$0.15/ 1M tokenów
WYJŚCIE$0.47/ 1M tokenów
p50 TTFT4.25 s7 d
p95 TTFT10.00 s7 d
RUCH1.0Mtokenów / 7 d

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Cennik

Wejście / 1M tokenów$0.150
Wyjście / 1M tokenów$0.470
Odczyt cache / 1M$0.018
Zapis cache / 1M$0.230
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $2.46 · Z cache promptów $2.00

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000238

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
4.25 s
Prędkość wyjścia
119 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
0%

Publiczne benchmarki

Źródło: Design Arena

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News9 wzmianek · 7 dniwzrost o 9 wobec poprzedniego tygodnia

Porównanie

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Wejście $/M$0.15$2.00$0.86$0.17
Wyjście $/M$0.47$6.00$3.44$1.03
Kontekst1.0M1.0M262K33K
Jakość7/109/108/108/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje Qwen: Qwen3.8 Flash na OrcaRouter?
Qwen: Qwen3.8 Flash jest wyceniany na $0.15 za 1M tokenów wejściowych i $0.47 za 1M tokenów wyjściowych za pośrednictwem OrcaRouter. Ceny są pobierane na żywo z warstwy routingu.
Jakie jest okno kontekstowe Qwen: Qwen3.8 Flash?
Qwen: Qwen3.8 Flash obsługuje okno kontekstu o wielkości 1M tokenów. Używaj funkcji długiego kontekstu (RAG, streszczanie) do tego limitu.
Jak wywołać Qwen: Qwen3.8 Flash za pomocą OpenAI SDK?
Ustaw base_url OpenAI na https://api.orcarouter.ai/v1, podaj swój klucz API OrcaRouter i przekaż model="qwen/qwen3.8-flash" w wywołaniu chat.completions.create.
Czy OrcaRouter ogranicza przepustowość Qwen: Qwen3.8 Flash?
Limity szybkości na model są zgodne z Twoim planem OrcaRouter. Darmowe plany mają niskie limity; płatne plany je podnoszą. Sprawdź /pricing, aby zobaczyć aktualne limity.

Osadź tę odznakę

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash w OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Karta modelu jako dane

GET /api/public/models/qwen/qwen3.8-flashOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt