Ilustração editorial flat-vector para o hero de um blog de tecnologia sobre preços de modelos: um grande chip de modelo arredondado em azul profundo com um brilho suave ciano, uma etiqueta de preço de papel presa ao seu canto, três fluxos de tokens fluindo para um medidor de preço circular e uma folha de calendário fina deslizando para o quadro, sobre um fundo azul-claro suave com amplo espaço vazio no terço inferior. Sem texto.
Guides & Insights

Preços da API do DeepSeek V4 Pro: US$ 0,73/US$ 2,18 fora de pico, e por que o desligamento de 14 de setembro foi cancelado

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O DeepSeek V4 Pro não será descontinuado. Em 11 de setembro de 2026, a DeepSeek disse que continuará a disponibilizar o modelo por meio de sua API após 14 de setembro, com o método de cobrança inalterado — revertendo um plano anunciado dois dias antes, segundo o qual toda solicitação ao deepseek-v4-pro teria sido redirecionada para DeepSeek V4.1 Flash e cobrada com as tarifas do Flash. Para qualquer pessoa cujos prompts, configurações de temperatura e esquemas de chamada de ferramentas estejam calibrados para o V4 Pro, esse é o fato que importa nesta semana: o modelo em relação ao qual você desenvolveu sua solução permanece onde está, e a migração que você talvez tenha agendado para segunda-feira não precisa acontecer.

O preço é outra história, e esta página o apresentou errado por um mês. O DeepSeek V4 Pro não custa mais US$ 0,44/US$ 0,88 por milhão de tokens. Fora de pico, a cobrança é de US$ 0,726 de entrada e US$ 2,178 de saída por 1M de tokens no OrcaRouter, dobrando para US$ 1,452/US$ 4,356 dentro das janelas de pico, com leituras de cache a US$ 0,024. Os fins de semana agora são inteiramente fora de pico. E a própria tabela de tarifas do fornecedor — a que está na documentação da API do DeepSeek — traz o aviso de continuação como nota de rodapé da mesma tabela de preços, o que é praticamente o mais próximo de uma fonte primária que uma página de preços pode chegar.

O que a Deep​Seek realmente disse, e o que isso desfaz

A cronologia importa, porque dois dos três anúncios eram o inverso um do outro, e o do meio é o que as pessoas lembram.

• 9 de setembro — A DeepSeek informou aos usuários que, até o lançamento do V4.1 Pro, as solicitações ao V4 Pro seriam encaminhadas para o DeepSeek V4.1 Flash e cobradas com base nas tarifas do V4.1 Flash.

• 10 de setembro — O V4.1 Flash foi lançado, e a DeepSeek moveu a troca para um momento fixo: 12:00 no horário de Pequim em 14 de setembro de 2026, depois do qual o V4 Pro ficaria offline e seu tráfego seria servido pelo Flash.

• 11 de setembro — DeepSeek voltou atrás. Seu texto, agora reproduzido literalmente como nota de rodapé na página Modelos e Preços da sua própria documentação da API: "Em resposta à demanda dos usuários, decidimos continuar fornecendo serviços de API para o DeepSeek V4 Pro após 14 de setembro de 2026, com o método de cobrança permanecendo inalterado. Forneceremos aviso adicional caso haja quaisquer alterações."

Isso é o fornecedor falando sobre o próprio produto, e é a fonte mais forte disponível aqui — mas leia o que isso resolve e o que não resolve. Resolve a continuidade e o faturamento: o V4 Pro permanece, nas tarifas já em vigor. Não promete um prazo. Enviaremos aviso adicional é a totalidade do compromisso, e a mesma frase deixa a porta aberta para o plano voltar. Se você está assumindo um compromisso de vários trimestres, planeje para o modelo do qual você consegue sair, e não para aquele que você consegue manter.

A reação negativa que forçou a reversão vale a pena entender, porque ela se relaciona com uma decisão que você mesmo pode estar prestes a tomar. Os desenvolvedores não objetaram ao V4.1 Flash — que, segundo a DeepSeek, supera o V4 Pro em desempenho, preço, velocidade e tempo total de tarefa —, mas à substituição automática. Trocar o modelo por trás de um ID de modelo estável altera o comportamento sem mudar o código: um prompt ajustado, uma temperatura que funciona e um esquema de chamada de ferramenta que é interpretado corretamente são todas propriedades de um checkpoint específico. A cobertura do CLS (科创板日报), do 36Kr, do IT之家 e do ifeng, e em inglês no TheBlockBeats, descreve a DeepSeek primeiro adiando e depois abandonando o plano; os próprios documentos da DeepSeek mostram o contraste claramente, porque os nomes legados deepseek-v4-flash foram descontinuados e agora servem o V4.1 Flash, e essa troca pegou. A troca do Pro não pegou.

O preço de hoje, conferido com a tabela de preços do próprio fornecedor

Price card titled 'DeepSeek V4 Pro — price per 1M tokens', sourced 'OrcaRouter directory, checked 2026-08-15'. Three highlight cells read Input $0.442, Output $0.884 and Cache read $0.060 USD at zero markup. A row reads DeepSeek official rate (CNY, today): ¥3 in, ¥6 out, cache hit ¥0.025. Two columns show the August 17 change: off-peak input ¥4.5, output ¥13.5, cache hit ¥0.15; peak input ¥9, output ¥27, cache hit ¥0.30. Footer: peak output is 4.5x today's ¥6, off-peak is half of peak, peak windows Beijing weekdays 09:00-12:00 and 14:00-18:00.

Duas cifras importam, e elas são o mesmo preço de tabela em duas moedas.

• Fora de pico (todas as horas fora das janelas de pico abaixo) — entrada $0,726 por 1M em caso de cache miss, ou ¥4,5; saída $2,178, ou ¥13,5; entrada em caso de cache hit $0,024, ou ¥0,15.

• Pico — exatamente o dobro. Entrada $1.452 / ¥9, saída $4.356 / ¥27, entrada com acerto de cache $0.048 / ¥0.30.

• A própria conversão em dólar da DeepSeek — a documentação do fornecedor exibe a mesma lista em yuan como US$ 0,66 de entrada / US$ 1,98 de saída fora de pico e US$ 1,32 / US$ 3,96 no pico, com acertos de cache a US$ 0,022 e US$ 0,044. A diferença em relação aos valores em dólar da OrcaRouter é a taxa de câmbio usada por cada lado na conversão, não uma taxa adicional por token: a OrcaRouter repassa a tarifa do provedor sem markup, então o número na listagem é o número que você paga.

• Não há plano gratuito para o V4 Pro. Existe um plano Flash gratuito no diretório, mas o carro-chefe é apenas pago.

• A ficha técnica, para contexto — o V4 Pro é um modelo de pesos abertos sob licença MIT, com 1,6T de parâmetros totais e 49B ativos por token, uma janela de contexto de 1M de tokens e até 384K tokens de saída, com limite de concorrência de 500. A Artificial Analysis registra 72,3 tokens de saída por segundo.

A versão do modelo por trás de tudo isso é o DeepSeek-V4-Pro-0813, inalterada desde o lançamento de disponibilidade geral de 13 de agosto — e é justamente esse o ponto. Nada no checkpoint mudou em 11 de setembro; apenas a decisão sobre o seu futuro mudou.

Pico, fora de pico e a regra de fim de semana que muda a matemática

O regime de pico/fora de pico que a versão anterior desta página descrevia como chegando em 17 de agosto já tem um mês e foi alterado uma vez desde então.

• Períodos de pico — 01:00–04:00 e 06:00–10:00 UTC, de segunda a sexta-feira. No horário de Pequim, isso é 09:00–12:00 e 14:00–18:00, o próprio dia de trabalho da Deep​Seek. As tarifas fora de pico são exatamente metade das de pico, não uma faixa de desconto sobre elas.

• Os fins de semana são totalmente fora de pico. A partir das 00:00 no horário de Pequim de 23 de agosto de 2026, a Deep​Seek deixou de aplicar tarifas de pico aos sábados e domingos. Se o seu trabalho em lote puder ser transferido, movê-lo para o fim de semana corta a conta pela metade — e, para equipes que atendem usuários nas Américas, a maior parte da semana de trabalho já cai fora do pico sem nenhum tipo de agendamento.

• O que a mudança custou, frente aos ¥3/¥6 com que o modelo foi lançado em 13 de agosto — a saída fora de pico hoje é 2,25× a taxa de lançamento, e a saída em pico é 4,5×; a entrada com cache hit em pico é 12× o antigo ¥0,025.

Há uma assimetria aqui que explica por que a questão da migração continua surgindo mesmo depois de o desligamento ter sido cancelado. O preço do V4 Pro subiu em agosto, enquanto o do seu sucessor caiu: a DeepSeek reduziu os preços da API da série Flash em até 60%, em vigor a partir de 10 de setembro. A pressão para migrar nunca foi realmente sobre o aviso de 14 de setembro; o aviso apenas a tornou urgente.

O que uma solicitação realmente custa

Três exemplos práticos com as tarifas fora de pico de hoje. Cada um deles dobra dentro de uma janela de pico.

• 100K de entrada + 50K de saída — $0.0726 + $0.1089 ≈ $0.18.

• 1M de entrada + 1M de saída — $0,726 + $2,178 = $2,90. Essa mesma chamada custa $5,81 no pico, e era $1,32 em meados de agosto.

• Sessão agêntica, 500K de entrada + 200K de saída — $0.363 + $0.4356 ≈ $0.80.

A visão mensal está na página do modelo e é o teste honesto para verificar se a manchete antiga ainda descreve a sua fatura: com 10 milhões de tokens por mês e uma proporção de entrada de 70%, a calculadora de custos chega a US$ 11,62, ou cerca de US$ 9,16 com o prompt caching ativado. Se o seu orçamento foi feito com base em US$ 0,44, agora ele cobre cerca de 60% da fatura.

Cache é a alavanca que ninguém põe na mesa.

O cache de prompts ficou mais valioso, e não menos, quando as tarifas subiram — e a direção dos dois números é a razão. Na OrcaRouter, uma leitura de cache agora é cobrada a US$ 0,024 por 1 milhão de tokens, contra US$ 0,726 sem cache, um desconto de 96,7% em qualquer entrada que você reenvie. Na versão anterior desta página, a tarifa de cache era de US$ 0,060 contra um preço de entrada de US$ 0,442, um desconto de 86%. O preço de leitura de cache caiu mais da metade, enquanto o preço da entrada sem cache subiu 64%, de modo que a diferença efetiva entre um token em cache e um token sem cache aumentou consideravelmente.

Para um agente que reenvia um grande prompt de sistema e um contexto longo a cada turno, a entrada em cache é a diferença entre uma fatura que escala com o comprimento da conversa e uma que não escala. A regra prática permanece a mesma e vale a pena repetir: coloque o prompt de sistema estável e o material de referência primeiro e o conteúdo volátil por último, para que o prefixo que você reenvia realmente atinja o cache. Neste modelo, essa única escolha estrutural vale mais do que qualquer decisão de roteamento ou escalonamento abaixo dela.

Como o preço do V4 Pro se compara à concorrência

Comparison table card titled 'USD per 1M tokens — the field', sourced to the OrcaRouter directory checked 2026-08-15, with an input/output column pair per model: DeepSeek V4 Flash $0.15/$0.29; DeepSeek V4 Pro $0.44/$0.88 highlighted with a 'THIS PAGE' tag; MiniMax M3 $0.30/$1.20; Gemini 3.6 Flash $1.50/$7.50; Grok 4.5 $2.00/$6.00; Qwen 3.8 Max $2.00/$6.00; GPT-5.6 Terra $2.00/$12.00; Kimi K3 $3.00/$15.00; Claude Opus 5 $5.00/$25.00; GPT-5.6 Sol $5.00/$30.00; Claude Fable 5 $10.00/$50.00. Footer: V4 Pro is the cheapest 1M-context flagship, roughly 23x cheaper on input and 57x cheaper on output than Claude Fable 5.

Preços de tabela do diretório para entrada/saída por 1M de tokens, verificados em 12/09/2026, comparados com os US$ 0,726/US$ 2,178 fora de pico do V4 Pro. Dois deles mudaram desde que esta página foi publicada pela primeira vez, e um deles altera a conclusão.

• Claude Fable 5 — $10 / $50. O V4 Pro é 13,8× mais barato na entrada e 23× na saída.

• Claude Opus 5 — $5 / $25. 6,9× / 11,5×.

• GPT-5.6 Sol — $4 / $20 até 272K de contexto, $8 / $30 além disso. 5,5× / 9,2× na faixa mais curta, 11× / 13,8× na mais longa.

• Kimi K3 — $3 / $15. 4,1× / 6,9×.

• Qwen3.8 Max — US$ 2 / US$ 6. 2,8× / 2,8×.

• Grok 4.5 — US$ 2 / US$ 6. 2,8× / 2,8×.

• Gemini 3.6 Flash — $0,75 / $3,75. Praticamente paridade na entrada, a 1,03×, e 1,7× na saída. Seu preço caiu pela metade desde que esta página foi escrita.

• MiniMax M3 — $0.30 / $1.20. Mais barato que o V4 Pro em ambas as linhas agora: o V4 Pro custa 2,4× mais na entrada e 1,8× mais na saída, com a mesma janela de 1M tokens.

• DeepSeek V4 Flash — $0,242 / $0,726 no diretório. Cerca de 3× mais barato nas duas linhas, mesmo contexto de 1M.

Portanto, o enquadramento honesto mudou, e esta página deve dizê-lo em vez de manter o antigo superlativo. O DeepSeek V4 Pro já não é o modelo mais barato com contexto de 1M na lista: o Gemini 3.6 Flash e o MiniMax M3 são ambos mais baratos do que ele, e o MiniMax M3 consegue-o igualando a janela de contexto. O que o V4 Pro ainda é, por mais de uma ordem de magnitude, é a opção mais barata no nível de fronteira — todos os modelos ocidentais de classe flagship nessa lista custam múltiplos dele em ambas as linhas. Se a pergunta for "chamada mais barata possível com contexto de 1M", a resposta já não é este modelo. Se a pergunta for "modelo mais barato que se comporta como um modelo de fronteira", por enquanto ainda é.

Quando o V4 Pro é a escolha errada

• Se o seu tráfego for mais intenso durante o horário diurno de Pequim. As horas de pico dobram a tarifa, e as janelas de pico coincidem exatamente com o dia de trabalho da China. Se os seus usuários estão nas Américas, a maior parte do seu tráfego já ocorre fora do pico, o que é uma verdadeira vantagem estrutural. Se você está criando para usuários na China, modele explicitamente a fatura de pico antes de se comprometer — e verifique se a regra de fim de semana ajuda você a deslocar alguma coisa.

• Se os seus prompts forem curtos. Abaixo de aproximadamente 10K tokens de contexto, o nível flagship é capacidade desperdiçada. O DeepSeek V4 Flash a $0.242/$0.726 no diretório processa o mesmo contexto de 1M por cerca de um terço do preço, e para tarefas genuinamente curtas um modelo mais barato ainda ganha.

• Se você precisa de visão. O V4 Pro é somente texto — sem entrada de imagem ou áudio — e a Artificial Analysis lista sua modalidade de entrada como texto. Gemini 3.6 Flash ou Claude Fable 5 são as opções mais adequadas se a modalidade for o ponto. A própria API da DeepSeek também vale a pena mencionar aqui: agora ela atende seus nomes de modelos flash legados com o V4.1 Flash, que aceita imagens.

• Se está a comprar pontuação bruta no topo dos benchmarks em vez de preço por contexto. Na escala atual da Artificial Analysis, o V4 Pro obtém 36 no Intelligence Index — 8.º de 113 modelos no momento da redação — e 69 no índice de Coding, conforme consta no diretório OrcaRouter. Isto é competitivo, não líder: Claude Fable 5, Claude Opus 5 e GPT-5.6 Sol superam-no todos em coding. A proposta do V4 Pro é capacidade próxima da fronteira a uma fração do preço por token, não o topo de todos os gráficos.

Como chamá-lo no OrcaRouter

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (model ID deepseek/deepseek-v4-pro): FLAGSHIP FEATURED badge, '1M tokens' context and 384K max output, input and output price per 1M tokens (output shown at $0.88), /v1/chat/completions and /v1/responses endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

O DeepSeek V4 Pro está hospedado no OrcaRouter sob o ID de modelo deepseek/deepseek-v4-pro, servido através do endpoint compatível com OpenAI em api.orcarouter.ai/v1, à tarifa do provedor e sem qualquer margem acrescida. Migrar de um cliente OpenAI existente resume-se a alterar o URL base e o ID de modelo, e nada mais.

A reversão muda o que você deve fazer a respeito. Se você tinha uma migração em 14 de setembro no calendário — redirecionando de V4 Pro para DeepSeek V4.1 Flash porque o Pro seria descontinuado —, você pode removê-la do calendário ou, pelo menos, rebaixá-la de prazo final para teste. Ambos os modelos ficam atrás de uma única chave do OrcaRouter, então compará-los é uma mudança de ID de modelo em uma requisição, em vez de um segundo contrato e um segundo SDK; e, se você realmente quiser avaliar o V4.1 Flash com tráfego real sem apostar um caminho de produção nele, o failover automático é a forma de baixo risco de dar a ele requisições ao vivo enquanto o V4 Pro permanece como fallback. Essa é a forma prática da decisão de 11 de setembro: a escolha continua sendo sua, e continua reversível.

A nota de honestidade que importa para uma página de preços: nós encaminhamos para o modelo, não definimos o preço dele. Os números de $0.726/$2.178 fora de horário de pico são as tarifas da Deep​Seek repassadas, e mudam quando a Deep​Seek as muda — que é exatamente por isso que esta página é datada, e por isso a versão que você está lendo foi reescrita em vez de receber acréscimos.

Fontes e data

Os preços e as especificações desta página foram reverificados em 12 de setembro de 2026. Os valores em dólares do DeepSeek V4 Pro e de todos os modelos da comparação são lidos de o diretório de modelos do OrcaRouter, verificados no mesmo dia; a contagem de parâmetros, a licença, a janela de contexto, a modalidade e os números de velocidade vêm da página do modelo DeepSeek V4 Pro 0813 no Artificial Analysis. As tarifas em yuan, as janelas de pico e o aviso de continuação de 11 de setembro vêm da própria documentação Models & Pricing da DeepSeek, que traz a declaração na íntegra como nota de rodapé da tabela de preços. A sequência de anúncios em três etapas — o aviso de encaminhamento de 9 de setembro, o adiamento de 10 de setembro para as 12h00 do horário de Pequim de 14 de setembro e a reversão de 11 de setembro — é noticiada pelo CLS (科创板日报), 36Kr, IT之家 e ifeng, e, em inglês, pelo TheBlockBeats. A regra de cobrança de fim de semana de 23 de agosto e o corte de preço do Flash em 10 de setembro vêm dos anúncios da DeepSeek conforme noticiados pelo IT之家, The Paper e 21st Century Business Herald.

Uma observação final sobre confiabilidade, porque este preço específico mudou três vezes em um mês — preços de lançamento em 13 de agosto, pico/fora de pico em 17 de agosto, a alteração de fim de semana em 23 de agosto. Considere inutilizável qualquer página de "preços do V4 Pro" sem data. A versão anterior desta cotava US$ 0,44/US$ 0,88 e um índice Artificial Analysis Intelligence de 44,3; ambos estavam corretos quando foram escritos, e nenhum dos dois sobreviveu ao mês.

Comparados neste artigo3

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente