DeepSeek V4 Flash

deepseek/deepseek-v4-flash
NarzędziaJSONRozumowanie
przez DeepSeek · 2026-04-24

DeepSeek V4 Flash wydajny MoE — 284B całkowitych / 13B aktywnych parametrów, kontekst 1M, zoptymalizowany pod kątem szybkich codziennych obciążeń.

kont.1M tokenów
Maks. wyjście384K
Wejścietext
p50 TTFT1.95 s
WEJŚCIE$0.22/ 1M tokenów
WYJŚCIE$0.66/ 1M tokenów
p50 TTFT1.95 s7 d
p95 TTFT10.00 s7 d
RUCH11962.8Mtokenów / 7 d

DeepSeek V4 Flash to duży model językowy od chińskiej firmy AI DeepSeek. Przetwarza wyłącznie wejścia tekstowe i jest zaprojektowany do scenariuszy wymagających dużego okna kontekstu (1,048,576…

Czym jest DeepSeek V4 Flash?

Kto powinien używać DeepSeek V4 Flash?

Jakie tryby wejściowe obsługuje DeepSeek V4 Flash?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Cennik

Cennik
Wejście / 1M tokenów · Poza szczytem$0.220
Wyjście / 1M tokenów · Poza szczytem$0.660
Odczyt cache / 1M · Poza szczytem$0.0070
Godziny szczytu01:00–04:00, 06:00–10:00 ×2 (UTC)
Wejście / 1M tokenów · ×2$0.440
Wyjście / 1M tokenów · ×2$1.32
Odczyt cache / 1M · ×2$0.014
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $3.52 · Z cache promptów $2.77

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000334

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
1.95 s
Prędkość wyjścia
170 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
17.5%

Publiczne benchmarki

69.1
AA Coding
Lepszy niż 79% porównywanych modeli
28 z 138
34.3
AA Intelligence
Lepszy niż 69% porównywanych modeli
44 z 147
50.0
AA Math
Lepszy niż 26% porównywanych modeli
61 z 82
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
79.7
MMLU-Pro
57.0 index
SciCode
50.3
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
terminalbench_v4_0
12.1
τ²-Bench
95.0
Źródło: artificialanalysis.ai

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News1 wzmianek · 7 dnispadek o 1 wobec poprzedniego tygodnia

Porównanie

DeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4.1 FlashDeepSeek V4 Flash Vision (Exp)
Wejście $/M$0.22$0.66$0.15$0.22
Wyjście $/M$0.66$1.98$0.60$0.66
Kontekst1.0M1.0M1.0M1.0M
Jakość7/108/108/107/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje DeepSeek V4 Flash na OrcaRouter?
Tokeny wejściowe kosztują $0.14 za 1 milion tokenów, a tokeny wyjściowe kosztują $0.28 za 1 milion tokenów. OrcaRouter pobiera dokładnie stawkę dostawcy bez marży.
Jakie jest okno kontekstu DeepSeek V4 Flash?
Okno kontekstu ma 1 048 576 tokenów (1 milion tokenów). Maksymalna liczba tokenów na odpowiedź to 384 000.
Jakie są główne zalety DeepSeek V4 Flash?
Jego mocnymi stronami są bardzo duże okno kontekstowe i wysoki limit tokenów wyjściowych, w połączeniu z niską ceną oraz silnym wynikiem 95,0 na τ²-Bench, co wskazuje na dobre umiejętności rozumowania i korzystania z narzędzi.
Jak DeepSeek V4 Flash wypada w porównaniu z GPT-4 lub Claude?
DeepSeek V4 Flash oferuje znacznie większy kontekst (1M vs 128k/200k) i długość odpowiedzi (384k vs ~4k) przy ułamku kosztów. Jest jednak wyłącznie tekstowy i może mieć mniej szeroką wiedzę ogólną lub mniejsze dostrojenie bezpieczeństwa.
Czy OrcaRouter narzuca marżę na cenę DeepSeek V4 Flash?
Nie. OrcaRouter przekazuje stawkę dostawcy z zerową marżą. Płacisz $0.14 za 1M wejścia i $0.28 za 1M wyjścia, dokładnie tak, jak pobiera DeepSeek.
Jak wywołać DeepSeek V4 Flash za pośrednictwem API OrcaRouter?
Użyj kompatybilnego z OpenAI bazowego URL https://api.orcarouter.ai/v1, ustaw parametr modelu na "deepseek/deepseek-v4-flash" i dołącz swój klucz API OrcaRouter w nagłówku Authorization.
Jakie polityki dotyczące danych obowiązują dla DeepSeek V4 Flash?
Dane przechodzą przez OrcaRouter do serwerów DeepSeek w Chinach. Zapoznaj się z polityką prywatności OrcaRouter i warunkami DeepSeek. Nie są oferowane żadne dodatkowe zabezpieczenia danych.
Czy DeepSeek V4 Flash jest multimodalny?
Nie, akceptuje tylko tekst. W przypadku obrazów, dźwięku lub wideo musisz przetworzyć je na tekst lub użyć innego modelu.
Jakie parametry mogę ustawić podczas korzystania z DeepSeek V4 Flash?
Standardowe parametry zakończeń czatu OpenAI: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, itd. Wartość max_tokens nie może przekraczać 384 000.
Które przypadki użycia najlepiej pasują do DeepSeek V4 Flash?
Analiza długich dokumentów, generowanie kodu z rozszerzonym rozumowaniem, rozmowy wieloobrotowe wymagające głębokiego kontekstu oraz zadania produkujące duże wyniki, takie jak szczegółowe raporty lub plany.

Osadź tę odznakę

DeepSeek: DeepSeek V4 Flash•$0.22/M in•1946ms p50•przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg" alt="DeepSeek: DeepSeek V4 Flash w OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash)

Karta modelu jako dane

GET /api/public/models/deepseek/deepseek-v4-flashOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt