deepseek/deepseek-reasoner

deepseek/deepseek-reasoner
JSON
di deepseek

Alias di DeepSeek per la modalità di pensiero V4 Flash — contesto da 1M, ragionamento a catena di pensiero aperto (alias legacy, destinato alla deprecazione).

ctx1M token
Output max384K
Inputtext
p50 TTFT376 ms
INGRESSO$0.24/ 1M token
USCITA$0.73/ 1M token
p50 TTFT376 ms7 g
p95 TTFT491 ms7 g
TRAFFICO7.3Mtoken / 7 g

DeepSeek Reasoner è un modello di ragionamento basato solo su testo di DeepSeek, ottimizzato per compiti che richiedono deduzione logica profonda e comprensione contestuale estesa. È accessibile…

Che cos'è DeepSeek Reasoner?

Chi dovrebbe usare questo modello?

Come gestisce i contesti lunghi?

Cosa lo rende un modello 'ragionatore'?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-reasoner",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • max_tokens
  • response_format
  • stream

Prezzi

Prezzi
Input / 1M token · Fuori punta$0.242
Output / 1M token · Fuori punta$0.726
Lettura cache / 1M · Fuori punta$0.0077
Ore di punta01:00–04:00, 06:00–10:00 ×2 (UTC)
Input / 1M token · ×2$0.484
Output / 1M token · ×2$1.452
Lettura cache / 1M · ×2$0.015
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $3.87 · Con cache dei prompt $3.05

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000367

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
376 ms
Velocità di output
219 tok/s
p95 TTFT
491 ms
Tasso di errore
1.9%

Benchmark pubblici

Fonte: Design Arena

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News1 menzioni · 7 gg1 in più rispetto alla settimana scorsa

A confronto

deepseek/deepseek-reasonerDeepSeek V4 ProDeepSeek V4.1 FlashDeepSeek V4 Flash
Input $/M$0.24$0.66$0.15$0.22
Output $/M$0.73$1.98$0.60$0.66
Contesto1.0M1.0M1.0M1.0M
Qualità5/108/108/107/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per eseguire DeepSeek Reasoner su OrcaRouter?
Il costo è di $0,44 per 1 milione di token di input e $0,87 per 1 milione di token di output. OrcaRouter applica un markup pari a zero, quindi paghi esattamente la tariffa del fornitore. Non ci sono costi aggiuntivi.
Qual è la dimensione della finestra di contesto?
La finestra di contesto è di 1.048.576 token (circa 750.000 parole). Il modello può inoltre produrre fino a 384.000 token per richiesta.
Quali sono i principali punti di forza di DeepSeek Reasoner?
I suoi punti di forza principali sono i limiti di contesto e di output estremamente ampi, combinati con un'attenzione al ragionamento passo-passo. Eccelle in compiti di matematica, codice e analisi che richiedono un ragionamento logico a catena e l'elaborazione di documenti lunghi.
Come si confronta con GPT-4?
DeepSeek Reasoner ha una capacità di contesto e di output maggiore a un costo per token inferiore. GPT-4 supporta input multimodali e potrebbe avere una conoscenza più ampia, ma DeepSeek Reasoner è più conveniente per compiti di ragionamento su contesti lunghi.
Supporta l'input di immagini o audio?
No. DeepSeek Reasoner accetta solo input di testo. Non elabora immagini, audio o video.
Come faccio a chiamare DeepSeek Reasoner tramite un'API compatibile con OpenAI?
Utilizza l'URL di base https://api.orcarouter.ai/v1 e imposta il modello su "deepseek/deepseek-reasoner". Sono supportati tutti i parametri standard di completamento chat di OpenAI. Includi la tua chiave API di OrcaRouter nell'intestazione Authorization.
Posso usare lo streaming con questo modello?
Sì. L'API supporta lo streaming tramite il parametro 'stream'. Imposta stream=true per ricevere i token in modo incrementale, seguendo lo stesso formato dello streaming di OpenAI.
Il modello è adatto per applicazioni in tempo reale?
A causa della sua ampia finestra di contesto e della profondità di ragionamento, la latenza per il primo token potrebbe essere più alta rispetto a modelli più piccoli. È più adatto per attività batch o asincrone che per applicazioni in tempo reale a bassa latenza.

Incorpora questo badge

deepseek/deepseek-reasoner$0.24/M in376ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-reasoner" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-reasoner.svg" alt="deepseek/deepseek-reasoner su OrcaRouter" /> </a>
Markdown [![deepseek/deepseek-reasoner](https://www.orcarouter.ai/embed/deepseek/deepseek-reasoner.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-reasoner)

Scheda del modello come dati

GET /api/public/models/deepseek/deepseek-reasonerApri
Leggibile dalle macchine:/llms.txt/llms-full.txt