DeepSeek V4 Flash (Free)

deepseek/deepseek-v4-flash-free
Gratis
ToolsJSONReasoning
von DeepSeek

DeepSeek V4 Flash effizientes MoE — 284B insgesamt / 13B aktive Parameter, 1M Kontext, optimiert für schnelle alltägliche Workloads.

Ktx1M Tokens
Max. Ausgabe384K
Eingabetext
p50 TTFT387 ms
PREISKostenlosratenbegrenzt · Modellnutzung zu 0 $
p50 TTFT387 ms7 T
p95 TTFT730 ms7 T
DATENVERKEHR825.3KTokens / 7 T

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-free",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Preise

$0
Pro Anfrage$0
AbrechnungDie Modellnutzung wird nie vom Guthaben abgebucht
Bei ÜberschreitungHTTP 429, sobald ein Limit greift

Ohne diese Limits nötig? deepseek/deepseek-v4-flash·So funktionieren die Gratis-Limits

Leistung

p50 TTFT
387 ms
Ausgabegeschwindigkeit
18.4 tok/s
p95 TTFT
730 ms
Fehlerquote
13.0%

Öffentliche Benchmarks

69.1
AA Coding
Besser als 83 % der verglichenen Modelle
Nr. 21 von 127
51.8
AA Intelligence
Besser als 78 % der verglichenen Modelle
Nr. 27 von 129
50.0
AA Math
Besser als 26 % der verglichenen Modelle
Nr. 60 von 81
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
74.3
MMLU-Pro
57.0 index
SciCode
49.9
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
τ²-Bench
95.0
Quelle: artificialanalysis.ai

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News2 Erwähnungen · 7 T2 mehr als in der Vorwoche

FAQ

Wie viel kostet DeepSeek: DeepSeek V4 Flash (Free) auf OrcaRouter?
DeepSeek: DeepSeek V4 Flash (Free) kostet $0.0000 pro Anfrage über OrcaRouter (Pauschalgebühr pro Aufruf, Abrechnung pro Generierung statt pro Token).
Was ist das Kontextfenster von DeepSeek: DeepSeek V4 Flash (Free)?
DeepSeek: DeepSeek V4 Flash (Free) unterstützt ein Kontextfenster von 1M Token. Verwenden Sie Langkontextfunktionen (RAG, Zusammenfassung) bis zu diesem Limit.
Wie rufe ich DeepSeek: DeepSeek V4 Flash (Free) über das OpenAI SDK auf?
Setzen Sie die OpenAI base_url auf https://api.orcarouter.ai/v1, geben Sie Ihren OrcaRouter API-Schlüssel an und übergeben Sie model="deepseek/deepseek-v4-flash-free" im Aufruf von chat.completions.create.
Rate-limitiert OrcaRouter DeepSeek: DeepSeek V4 Flash (Free)?
Modellspezifische Ratenbegrenzungen richten sich nach Ihrem OrcaRouter-Plan. Kostenlose Tarife haben konservative Obergrenzen; kostenpflichtige Tarife heben diese an. Siehe /pricing für aktuelle Kontingente.

Dieses Abzeichen einbetten

DeepSeek: DeepSeek V4 Flash (Free)Preis ausstehend387ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-free" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-free.svg" alt="DeepSeek: DeepSeek V4 Flash (Free) auf OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash (Free)](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-free.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-free)

Modellkarte als Daten

GET /api/public/models/deepseek/deepseek-v4-flash-freeÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt