DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
NowyPolecane
NarzędziaJSONRozumowanie
przez DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731 to oficjalne wydanie DeepSeek po ponownym dotrenowaniu wydajnego modelu mixture-of-experts V4 Flash — 284B całkowitych / 13B aktywnych parametrów, identycznego pod względem architektury i rozmiaru z kwietniowym wydaniem V4 Flash, z treningiem końcowym wykonanym od zera. Udostępnia okno kontekstu 1M tokenów z możliwością wygenerowania do 384K tokenów, obsługuje tryby myślenia i bez myślenia (domyślnie włączony jest tryb myślenia), a także wyjście JSON i wywołania narzędzi, oraz natywnie obsługuje Responses API z ukierunkowaną adaptacją dla agentów kodujących w stylu Codex. Rewizja 0731 to znaczący krok naprzód w możliwościach agentów — w opublikowanych benchmarkach agentowych DeepSeek osiąga wyniki wyższe nawet niż DeepSeek V4 Pro Preview: 82,7 w Terminal Bench 2.1, 76,7 w Cybergym, 70,3 w Toolathlon Verified, 54,4 w DeepSWE i 54,2 w NL2Repo. W autorskim API DeepSeek to właśnie tę rewizję obsługuje obecnie identyfikator modelu deepseek-v4-flash; identyfikator z datą wskazuje tę samą rewizję dla wywołań odwołujących się do niej po dacie. To solidny wybór dla agentów kodujących, obciążeń terminalowych i związanych z użyciem narzędzi oraz wielkoskalowych potoków agentowych w cenie poziomu flash.

kont.1M tokenów
Maks. wyjście384K
Wejścietext
Wyjścietext
p50 TTFT791 ms
WEJŚCIE$0.15/ 1M tokenów
WYJŚCIE$0.29/ 1M tokenów
p50 TTFT791 ms7 d
p95 TTFT1.42 s7 d
RUCH4.3Mtokenów / 7 d

DeepSeek V4 Flash 0731 to model językowy obsługujący wyłącznie tekst od dostawcy deepseek, dostępny przez OrcaRouter pod identyfikatorem modelu deepseek/deepseek-v4-flash-0731. Jego główne parametry…

Czym jest DeepSeek V4 Flash 0731?

Dla kogo jest ten model?

Gdzie ten model plasuje się w rodzinie DeepSeek na OrcaRouter?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Cennik

Wejście / 1M tokenów$0.147
Wyjście / 1M tokenów$0.295
Odczyt cache / 1M$0.020
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $1.91 · Z cache promptów $1.47

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000150

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
791 ms
Prędkość wyjścia
101 tok/s
p95 TTFT
1.42 s
Wskaźnik błędów
0%

Publiczne benchmarki

69.1
AA Coding
Lepszy niż 85% porównywanych modeli
18 z 124
49.9
AA Intelligence
Lepszy niż 80% porównywanych modeli
24 z 126
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
Źródło: artificialanalysis.ai, api-docs.deepseek.com

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News7 wzmianek · 7 dniwzrost o 7 wobec poprzedniego tygodnia

Porównanie

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
Wejście $/M$0.15$0.44$0.15$0.15
Wyjście $/M$0.29$0.88$0.29$0.29
Kontekst1.0M1.0M1.0M1.0M
Jakość6/108/107/105/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje DeepSeek V4 Flash 0731?
Koszt wynosi $0.15 za 1,000,000 tokenów wejściowych i $0.29 za 1,000,000 tokenów wyjściowych. OrcaRouter rozlicza według stawek dostawcy z zerową marżą, więc są to stawki, które płacisz. Karta modelu nie opisuje cen za wejścia z pamięci podręcznej ani rabatów za przetwarzanie wsadowe.
Jakie okno kontekstu i limit wyjściowy obsługuje?
Obsługuje 1 048 576 tokenów kontekstu wejściowego i do 384 000 tokenów wyjścia. Modalność wejścia to wyłącznie tekst. Karta modelu nie określa osobnego łącznego limitu tokenów poza tymi dwoma limitami.
W czym model jest najlepszy?
Na podstawie dostarczonych faktów, jego mocną stroną jest wykonywanie zadań w terminalu i wierszu poleceń, na co wskazuje wynik 82.7 w Terminal Bench 2.1. Duży kontekst i duże limity wyjściowe wspierają również przetwarzanie długich dokumentów tekstowych i generowanie długich form. Nie podano innych wyników benchmarków.
Jak wypada w porównaniu z innymi modelami?
Podane fakty dotyczą wyłącznie tego modelu. Porównaj kandydatów w katalogu OrcaRouter pod względem okna kontekstowego, maksymalnej długości odpowiedzi, modalności oraz cen za 1M tokenów. Ten model obsługuje wyłącznie tekst, ma okno kontekstowe 1M tokenów, maksymalną długość odpowiedzi 384K i kosztuje 0,15/0,29 USD za 1M tokenów.
Jak dane są obsługiwane podczas korzystania z tego modelu za pośrednictwem OrcaRouter?
Dostępne fakty nie opisują retencji danych, wykorzystania do trenowania ani przechowywania dla tego modelu. Przetwarzanie danych podlega warunkom OrcaRouter i politykom dostawcy deepseek. Przed wysłaniem poufnych danych zapoznaj się z dokumentacją OrcaRouter.
Jak mam wywołać ten model?
Użyj API OrcaRouter zgodnego z OpenAI pod adresem bazowym https://api.orcarouter.ai/v1 z identyfikatorem modelu deepseek/deepseek-v4-flash-0731. Wysyłaj standardowe żądania uzupełniania czatu z kluczem API OrcaRouter i wiadomościami zawierającymi wyłącznie tekst.
Czy obsługuje strumieniowanie lub wywoływanie funkcji?
Dostępne fakty nie określają, czy obsługiwane jest strumieniowanie lub wywoływanie funkcji. API jest kompatybilne z OpenAI, więc przetestuj te funkcje, zanim zaczniesz na nich polegać. Ustaw max_tokens w ramach limitu 384 000 tokenów wyjściowych.
Czy to jest model multimodalny?
Nie. Modalność wejścia to wyłącznie tekst. W przypadku obrazów, dźwięku lub wideo będziesz potrzebować modelu multimodalnego w katalogu OrcaRouter lub osobnego etapu wstępnego przetwarzania.

Osadź tę odznakę

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="DeepSeek: DeepSeek V4 Flash 0731 w OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

Karta modelu jako dane

GET /api/public/models/deepseek/deepseek-v4-flash-0731Otwórz
Odczyt maszynowy:/llms.txt/llms-full.txt