DeepSeek V3

deepseek/deepseek-chat
VerktygJSONResonemang
av DeepSeek · 2024-12-26

DeepSeek-alias för V4 Flash icke-tänkande läge — 1M kontext, stark instruktionsföljning och kodning (legacy-alias, planerad för avveckling).

ctx1M tokens
Max output384K
Inmatningtext
Utdatatext
p50 TTFT399 ms
INMATNING$0.15/ 1M token
UTDATA$0.29/ 1M token
p50 TTFT399 ms7d
p95 TTFT4.14 s7d
TRAFIK957.7Ktokens/7d

DeepSeek V3 är en Mixture-of-Experts-textmodell från DeepSeek, utformad för uppgifter som kräver förståelse och generering över mycket långa kontexter. Dess 1,048,576-token-kontextfönster möjliggör…

Vad är DeepSeek V3 och vem är den till för?

Vilka inmatningsmodaliteter stöder DeepSeek V3?

Hur jämför sig DeepSeek V3 med andra stora kontextmodeller?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-chat",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Priser

Inmatning / 1M token$0.147
Utdata / 1M tokens$0.295
Cacheläsning / 1M$0.020
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $1.91 · Med promptcachning $1.47

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000150

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
399 ms
Utdatahastighet
68.2 tok/s
p95 TTFT
4.14 s
Felfrekvens
2.7%

Offentliga benchmarks

Rankingfördelning9090 turneringar
2300
Första
2676
Andra
2636
Tredje
1478
Fjärde
Kategoriprestanda
3DElo: 1166WebbplatsElo: 1163KodkategorierElo: 1158UI-komponentElo: 1149DatavisualiseringElo: 1141SpelutvecklingElo: 1121SVGElo: 1034
3DTopp 54%
1166Elo
50.7%Vinst
43.2sSnitt
Topp 54%Rank
WebbplatsTopp 62%
1163Elo
48.5%Vinst
79.6sSnitt
Topp 62%Rank
KodkategorierTopp 66%
1158Elo
48.5%Vinst
74.0sSnitt
Topp 66%Rank
UI-komponentTopp 66%
1149Elo
52.8%Vinst
47.2sSnitt
Topp 66%Rank
DatavisualiseringTopp 69%
1141Elo
51.4%Vinst
47.6sSnitt
Topp 69%Rank
SpelutvecklingTopp 73%
1121Elo
43.9%Vinst
70.9sSnitt
Topp 73%Rank
SVGTopp 94%
1034Elo
38.8%Vinst
15.2sSnitt
Topp 94%Rank
Källa: Design Arena

Community-buzz

Vad utvecklare säger den här veckan

Hacker News4 omnämnanden · 7d

Så jämför den sig

DeepSeek V3DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash 0731
Input $/M$0.15$0.44$0.15$0.15
Output $/M$0.29$0.88$0.29$0.29
Kontext1.0M1.0M1.0M1.0M
Kvalitet5/108/107/106/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden per token för DeepSeek V3 på OrcaRouter?
$0.14 per 1 miljon tokens. Utmatning: $0.28 per 1 miljon tokens. Faktureras till leverantörens taxa utan påslag via OrcaRouter.
Hur stor är kontextfönstret för DeepSeek V3?
1 048 576 tokens (ungefär 1 miljon). Maximal utdata är 384 000 tokens.
Vilka är de främsta styrkorna hos DeepSeek V3?
Extremt kontextfönster (1M tokens), hög utdatagräns, MoE-effektivitet vilket leder till lägre kostnad per token, stark prestanda i resonemangs- och kodningsuppgifter.
Hur jämför DeepSeek V3 sig med andra stora språkmodeller?
Den erbjuder ett större kontextfönster än GPT-4o (128k) eller Claude 3.5 Sonnet (200k) och är ofta billigare per token. Men den är endast textbaserad, medan vissa alternativ stöder bilder. MoE-arkitekturen ger hastighetsfördelar.
Lagrar OrcaRouter min data när jag använder DeepSeek V3?
OrcaRouter fungerar som en gateway och lagrar inte prompts eller completions. Datahantering följer DeepSeeks policyer; se OrcaRouters integritetspolicy för detaljer.
Hur anropar jag DeepSeek V3 via ett OpenAI-kompatibelt API?
Ställ in base_url till https://api.orcarouter.ai/v1 och model till 'deepseek/deepseek-chat'. Använd standard OpenAI-klientbibliotek.
Vilka parametrar kan jag justera för DeepSeek V3?
Alla standardparametrar för chattkomplettering: temperature, top_p, max_tokens (upp till 384,000), stop, frequency_penalty, presence_penalty, etc.
Är DeepSeek V3 multimodal?
Nej, den stöder endast textinmatning och textutmatning. Ingen bild-, ljud- eller videobearbetning.
Kan jag streama svar från DeepSeek V3 på OrcaRouter?
Ja, strömning stöds via standard OpenAI-strömningsgränssnittet.
Vad är den typiska latensen för DeepSeek V3?
Latens varierar med in-/utdatalängd och belastning. MoE-arkitektur resulterar generellt i snabbare generering per token jämfört med täta modeller av liknande storlek. Inga specifika siffror anges.

Bädda in denna badge

DeepSeek: DeepSeek V3$0.15/M in399ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-chat" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-chat.svg" alt="DeepSeek: DeepSeek V3 på OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V3](https://www.orcarouter.ai/embed/deepseek/deepseek-chat.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-chat)

Modellkort som data

GET /api/public/models/deepseek/deepseek-chatÖppna