DeepSeek V3

deepseek/deepseek-chat
AlatJSONPenalaran
oleh DeepSeek · 2024-12-26

DeepSeek alias untuk mode non-thinking V4 Flash — konteks 1M, kemampuan mengikuti instruksi yang kuat dan coding (alias warisan, dijadwalkan untuk dihentikan).

ctx1M token
Output maks384K
Masukantext
Keluarantext
p50 TTFT382 ms
INPUT$0.15/ 1M token
OUTPUT$0.29/ 1M token
p50 TTFT382 ms7h
p95 TTFT580 ms7h
LALU LINTAS3.4Mtoken / 7h

DeepSeek V3 adalah model teks Mixture-of-Experts dari DeepSeek, yang dirancang untuk tugas-tugas yang memerlukan pemahaman dan pembangkitan konteks yang sangat panjang. Jendela konteks 1.048.576…

Apa itu DeepSeek V3 dan untuk siapa?

Apa saja modalitas input yang didukung oleh DeepSeek V3?

Bagaimana DeepSeek V3 dibandingkan dengan model konteks besar lainnya?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-chat",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Harga

Input / 1M token · Di luar jam sibuk$0.147
Output / 1M token · Di luar jam sibuk$0.295
Baca cache / 1M · Di luar jam sibuk$0.020
Jam sibuk01:00–04:00, 06:00–10:00 ×2 (UTC)
Input / 1M token · ×2$0.294
Output / 1M token · ×2$0.590
Baca cache / 1M · ×2$0.040
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $1.91 · Dengan cache prompt $1.47

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000150

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
382 ms
Kecepatan output
69.9 tok/s
p95 TTFT
580 ms
Tingkat kesalahan
0.30%

Benchmark publik

Distribusi Peringkat9090 turnamen
2300
Pertama
2676
Kedua
2636
Ketiga
1478
Keempat
Performa per Kategori
3DElo: 1166Situs WebElo: 1163Kategori KodeElo: 1158Komponen UIElo: 1149Visualisasi DataElo: 1141Pengembangan GameElo: 1121SVGElo: 1034
3DTop 54%
1166Elo
50.7%Menang
43.2sRata-rata
Top 54%Peringkat
Situs WebTop 62%
1163Elo
48.5%Menang
79.6sRata-rata
Top 62%Peringkat
Kategori KodeTop 66%
1158Elo
48.5%Menang
74.0sRata-rata
Top 66%Peringkat
Komponen UITop 66%
1149Elo
52.8%Menang
47.2sRata-rata
Top 66%Peringkat
Visualisasi DataTop 69%
1141Elo
51.4%Menang
47.6sRata-rata
Top 69%Peringkat
Pengembangan GameTop 73%
1121Elo
43.9%Menang
70.9sRata-rata
Top 73%Peringkat
SVGTop 94%
1034Elo
38.8%Menang
15.2sRata-rata
Top 94%Peringkat
Sumber: Design Arena

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News7 sebutan · 7 hrnaik 3 dari minggu lalu

Perbandingan

DeepSeek V3DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash Vision (Exp)
Input $/M$0.15$0.44$0.15$0.15
Output $/M$0.29$0.88$0.29$0.29
Konteks1.0M1.0M1.0M1.0M
Kualitas5/108/107/107/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya per token untuk DeepSeek V3 di OrcaRouter?
$0.14 per 1 juta token. Keluaran: $0.28 per 1 juta token. Ditagih sesuai tarif penyedia tanpa markup melalui OrcaRouter.
Seberapa besar jendela konteks untuk DeepSeek V3?
1,048,576 token (sekitar 1 juta). Output maksimum adalah 384,000 token.
Apa kekuatan utama dari DeepSeek V3?
Jendela konteks ekstrem (1M token), batas keluaran tinggi, efisiensi MoE yang menghasilkan biaya per token lebih rendah, performa kuat dalam tugas penalaran dan coding.
Bagaimana perbandingan DeepSeek V3 dengan model bahasa besar lainnya?
Ia menawarkan jendela konteks yang lebih besar daripada GPT-4o (128k) atau Claude 3.5 Sonnet (200k) dan seringkali lebih murah per token. Namun, ia hanya teks, sementara beberapa alternatif mendukung gambar. Arsitektur MoE memberikan keuntungan kecepatan.
Apakah OrcaRouter menyimpan data saya saat menggunakan DeepSeek V3?
OrcaRouter bertindak sebagai gateway dan tidak menyimpan prompt atau completion. Penanganan data mengikuti kebijakan DeepSeek; lihat kebijakan privasi OrcaRouter untuk detailnya.
Bagaimana cara memanggil DeepSeek V3 melalui API yang kompatibel dengan OpenAI?
Atur base_url ke https://api.orcarouter.ai/v1 dan model ke 'deepseek/deepseek-chat'. Gunakan pustaka klien OpenAI standar.
Parameter apa yang bisa saya sesuaikan untuk DeepSeek V3?
Semua parameter penyelesaian obrolan standar: temperature, top_p, max_tokens (hingga 384,000), stop, frequency_penalty, presence_penalty, dll.
Apakah DeepSeek V3 multimodal?
Tidak, ini hanya mendukung input dan output teks. Tidak ada pemrosesan gambar, audio, atau video.
Bisakah saya melakukan streaming respons dari DeepSeek V3 di OrcaRouter?
Ya, streaming didukung melalui antarmuka streaming OpenAI standar.
Berapa latensi tipikal untuk DeepSeek V3?
Latensi bervariasi tergantung pada panjang input/output dan beban. Arsitektur MoE umumnya menghasilkan generasi yang lebih cepat per token dibandingkan model padat dengan ukuran serupa. Tidak ada angka spesifik yang diberikan.

Sematkan lencana ini

DeepSeek: DeepSeek V3$0.15/M in382ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-chat" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-chat.svg" alt="DeepSeek: DeepSeek V3 di OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V3](https://www.orcarouter.ai/embed/deepseek/deepseek-chat.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-chat)

Kartu model sebagai data

GET /api/public/models/deepseek/deepseek-chatBuka