Qwen3.8 Flash

qwen/qwen3.8-flash
Polecane
WizjaNarzędziaJSONRozumowanie
przez Qwen · 2026-08-26

Qwen3.8 Flash to wielomodalny model rozumowania firmy Alibaba. Nadaje się do wspomagania kodowania, przepływów pracy agentowych, rozumienia wizualnego, analizy dokumentów i baz kodu, interakcji z pulpitem, analizy wykresów oraz analizy długich materiałów wideo.

kont.1M tokenów
Maks. wyjście131K
Wejścietext + image + video
Wyjścietext
p50 TTFT8.43 s
WEJŚCIE$0.15/ 1M tokenów
WYJŚCIE$0.47/ 1M tokenów
p50 TTFT8.43 s7 d
p95 TTFT10.00 s7 d
RUCH790.7Mtokenów / 7 d

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Cennik

Cennik
Wejście / 1M tokenów$0.150
Wyjście / 1M tokenów$0.470
Odczyt cache / 1M$0.018
Zapis cache / 1M$0.230
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $2.46 · Z cache promptów $2.00

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000238

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
8.43 s
Prędkość wyjścia
389 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
0.27%

Publiczne benchmarki

Źródło: Design Arena

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News2 wzmianek · 7 dnispadek o 2 wobec poprzedniego tygodnia

Porównanie

Qwen3.8 FlashQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Wejście $/M$0.15$2.00$2.00$0.86
Wyjście $/M$0.47$6.00$6.00$3.44
Kontekst1.0M1.0M1.0M262K
Jakość7/109/109/108/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje Qwen: Qwen3.8 Flash na OrcaRouter?
Qwen: Qwen3.8 Flash jest wyceniany na $0.15 za 1M tokenów wejściowych i $0.47 za 1M tokenów wyjściowych za pośrednictwem OrcaRouter. Ceny są pobierane na żywo z warstwy routingu.
Jakie jest okno kontekstowe Qwen: Qwen3.8 Flash?
Qwen: Qwen3.8 Flash obsługuje okno kontekstu o wielkości 1M tokenów. Używaj funkcji długiego kontekstu (RAG, streszczanie) do tego limitu.
Jak wywołać Qwen: Qwen3.8 Flash za pomocą OpenAI SDK?
Ustaw base_url OpenAI na https://api.orcarouter.ai/v1, podaj swój klucz API OrcaRouter i przekaż model="qwen/qwen3.8-flash" w wywołaniu chat.completions.create.
Czy OrcaRouter ogranicza przepustowość Qwen: Qwen3.8 Flash?
Limity szybkości na model są zgodne z Twoim planem OrcaRouter. Darmowe plany mają niskie limity; płatne plany je podnoszą. Sprawdź /pricing, aby zobaczyć aktualne limity.

Osadź tę odznakę

Qwen: Qwen3.8 Flash•$0.15/M in•8429ms p50•przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash w OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Karta modelu jako dane

GET /api/public/models/qwen/qwen3.8-flashOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt