deepseek/deepseek-reasoner

deepseek/deepseek-reasoner
JSON
por deepseek

DeepSeek apelido para o V4 Flash thinking mode — 1M de contexto, raciocínio em cadeia de pensamento aberto (apelido legado, com previsão de descontinuação).

ctx1M tokens
Saída máx.384K
Entradatext
p50 TTFT376 ms
ENTRADA$0.24/ 1M tokens
SAÍDA$0.73/ 1M tokens
p50 TTFT376 ms7 d
p95 TTFT491 ms7 d
TRÁFEGO7.3Mtokens / 7 d

DeepSeek Reasoner é um modelo de raciocínio exclusivamente textual da DeepSeek, otimizado para tarefas que exigem dedução lógica profunda e compreensão de contexto estendido. Ele é acessível por meio…

O que é DeepSeek Reasoner?

Quem deve usar este modelo?

Como ele lida com contextos longos?

O que faz dele um modelo 'reasoner'?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-reasoner",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • max_tokens
  • response_format
  • stream

Preços

Preços
Entrada / 1M tokens · Fora de pico$0.242
Saída / 1M tokens · Fora de pico$0.726
Leitura de cache / 1M · Fora de pico$0.0077
Horário de pico01:00–04:00, 06:00–10:00 ×2 (UTC)
Entrada / 1M tokens · ×2$0.484
Saída / 1M tokens · ×2$1.452
Leitura de cache / 1M · ×2$0.015
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $3.87 · Com cache de prompt $3.05

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000367

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
376 ms
Velocidade de saída
219 tok/s
p95 TTFT
491 ms
Taxa de erro
1.9%

Benchmarks públicos

Fonte: Design Arena

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News1 menções · 7 d1 a mais que na semana anterior

Comparativo

deepseek/deepseek-reasonerDeepSeek V4 ProDeepSeek V4.1 FlashDeepSeek V4 Flash
Entrada $/M$0.24$0.66$0.15$0.22
Saída $/M$0.73$1.98$0.60$0.66
Contexto1.0M1.0M1.0M1.0M
Qualidade5/108/108/107/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo para executar o DeepSeek Reasoner no OrcaRouter?
O custo é de $0.44 por 1M tokens de entrada e $0.87 por 1M tokens de saída. OrcaRouter cobra margem zero, então você paga exatamente a taxa do provedor. Não há taxas adicionais.
Qual é o tamanho da janela de contexto?
A janela de contexto é de 1,048,576 tokens (aproximadamente 750,000 palavras). O modelo também pode produzir até 384,000 tokens por solicitação.
Quais são os principais pontos fortes do DeepSeek Reasoner?
Suas principais vantagens são os limites extremamente grandes de contexto e saída, combinados com um foco em raciocínio passo a passo. Ele se destaca em tarefas de matemática, código e análise que exigem raciocínio lógico em cadeia e processamento de documentos longos.
Como ele se compara ao GPT-4?
O DeepSeek Reasoner tem uma capacidade maior de contexto e saída a um custo menor por token. O GPT-4 suporta entrada multimodal e pode ter um conhecimento mais amplo, mas o DeepSeek Reasoner é mais econômico para tarefas de raciocínio de contexto longo.
Ele suporta entrada de imagem ou áudio?
Não. O DeepSeek Reasoner aceita apenas entrada de texto. Ele não processa imagens, áudio ou vídeo.
Como faço para chamar o DeepSeek Reasoner através de uma API compatível com OpenAI?
Use a URL base https://api.orcarouter.ai/v1 e defina o modelo como "deepseek/deepseek-reasoner". Todos os parâmetros padrão de conclusão de chat do OpenAI são suportados. Inclua sua chave de API do OrcaRouter no cabeçalho Authorization.
Posso usar streaming com este modelo?
Sim. A API suporta streaming através do parâmetro 'stream'. Defina stream=true para receber tokens incrementalmente, seguindo o mesmo formato do streaming da OpenAI.
O modelo é adequado para aplicações em tempo real?
Devido ao seu grande tamanho de janela de contexto e profundidade de raciocínio, a latência para o primeiro token pode ser maior do que em modelos menores. É mais adequado para tarefas em lote ou assíncronas do que para aplicações em tempo real e de baixa latência.

Incorporar este selo

deepseek/deepseek-reasoner$0.24/M in376ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-reasoner" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-reasoner.svg" alt="deepseek/deepseek-reasoner no OrcaRouter" /> </a>
Markdown [![deepseek/deepseek-reasoner](https://www.orcarouter.ai/embed/deepseek/deepseek-reasoner.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-reasoner)

Ficha do modelo como dados

GET /api/public/models/deepseek/deepseek-reasonerAbrir
Legível por máquina:/llms.txt/llms-full.txt