
Preços da API do DeepSeek V4 Pro: US$ 0,73/US$ 2,18 fora de pico, e por que o desligamento de 14 de setembro foi cancelado
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 223 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
O DeepSeek V4 Pro não será descontinuado. Em 11 de setembro de 2026, a DeepSeek disse que continuará a disponibilizar o modelo por meio de sua API após 14 de setembro, com o método de cobrança inalterado — revertendo um plano anunciado dois dias antes, segundo o qual toda solicitação ao deepseek-v4-pro teria sido redirecionada para DeepSeek V4.1 Flash e cobrada com as tarifas do Flash. Para qualquer pessoa cujos prompts, configurações de temperatura e esquemas de chamada de ferramentas estejam calibrados para o V4 Pro, esse é o fato que importa nesta semana: o modelo em relação ao qual você desenvolveu sua solução permanece onde está, e a migração que você talvez tenha agendado para segunda-feira não precisa acontecer.
O preço é outra história, e esta página o apresentou errado por um mês. O DeepSeek V4 Pro não custa mais US$ 0,44/US$ 0,88 por milhão de tokens. Fora de pico, a cobrança é de US$ 0,726 de entrada e US$ 2,178 de saída por 1M de tokens no OrcaRouter, dobrando para US$ 1,452/US$ 4,356 dentro das janelas de pico, com leituras de cache a US$ 0,024. Os fins de semana agora são inteiramente fora de pico. E a própria tabela de tarifas do fornecedor — a que está na documentação da API do DeepSeek — traz o aviso de continuação como nota de rodapé da mesma tabela de preços, o que é praticamente o mais próximo de uma fonte primária que uma página de preços pode chegar.
O que a DeepSeek realmente disse, e o que isso desfaz
A cronologia importa, porque dois dos três anúncios eram o inverso um do outro, e o do meio é o que as pessoas lembram.
• 9 de setembro — A DeepSeek informou aos usuários que, até o lançamento do V4.1 Pro, as solicitações ao V4 Pro seriam encaminhadas para o DeepSeek V4.1 Flash e cobradas com base nas tarifas do V4.1 Flash.
• 10 de setembro — O V4.1 Flash foi lançado, e a DeepSeek moveu a troca para um momento fixo: 12:00 no horário de Pequim em 14 de setembro de 2026, depois do qual o V4 Pro ficaria offline e seu tráfego seria servido pelo Flash.
• 11 de setembro — DeepSeek voltou atrás. Seu texto, agora reproduzido literalmente como nota de rodapé na página Modelos e Preços da sua própria documentação da API: "Em resposta à demanda dos usuários, decidimos continuar fornecendo serviços de API para o DeepSeek V4 Pro após 14 de setembro de 2026, com o método de cobrança permanecendo inalterado. Forneceremos aviso adicional caso haja quaisquer alterações."
Isso é o fornecedor falando sobre o próprio produto, e é a fonte mais forte disponível aqui — mas leia o que isso resolve e o que não resolve. Resolve a continuidade e o faturamento: o V4 Pro permanece, nas tarifas já em vigor. Não promete um prazo. Enviaremos aviso adicional é a totalidade do compromisso, e a mesma frase deixa a porta aberta para o plano voltar. Se você está assumindo um compromisso de vários trimestres, planeje para o modelo do qual você consegue sair, e não para aquele que você consegue manter.
A reação negativa que forçou a reversão vale a pena entender, porque ela se relaciona com uma decisão que você mesmo pode estar prestes a tomar. Os desenvolvedores não objetaram ao V4.1 Flash — que, segundo a DeepSeek, supera o V4 Pro em desempenho, preço, velocidade e tempo total de tarefa —, mas à substituição automática. Trocar o modelo por trás de um ID de modelo estável altera o comportamento sem mudar o código: um prompt ajustado, uma temperatura que funciona e um esquema de chamada de ferramenta que é interpretado corretamente são todas propriedades de um checkpoint específico. A cobertura do CLS (科创板日报), do 36Kr, do IT之家 e do ifeng, e em inglês no TheBlockBeats, descreve a DeepSeek primeiro adiando e depois abandonando o plano; os próprios documentos da DeepSeek mostram o contraste claramente, porque os nomes legados deepseek-v4-flash foram descontinuados e agora servem o V4.1 Flash, e essa troca pegou. A troca do Pro não pegou.
O preço de hoje, conferido com a tabela de preços do próprio fornecedor

Duas cifras importam, e elas são o mesmo preço de tabela em duas moedas.
• Fora de pico (todas as horas fora das janelas de pico abaixo) — entrada $0,726 por 1M em caso de cache miss, ou ¥4,5; saída $2,178, ou ¥13,5; entrada em caso de cache hit $0,024, ou ¥0,15.
• Pico — exatamente o dobro. Entrada $1.452 / ¥9, saída $4.356 / ¥27, entrada com acerto de cache $0.048 / ¥0.30.
• A própria conversão em dólar da DeepSeek — a documentação do fornecedor exibe a mesma lista em yuan como US$ 0,66 de entrada / US$ 1,98 de saída fora de pico e US$ 1,32 / US$ 3,96 no pico, com acertos de cache a US$ 0,022 e US$ 0,044. A diferença em relação aos valores em dólar da OrcaRouter é a taxa de câmbio usada por cada lado na conversão, não uma taxa adicional por token: a OrcaRouter repassa a tarifa do provedor sem markup, então o número na listagem é o número que você paga.
• Não há plano gratuito para o V4 Pro. Existe um plano Flash gratuito no diretório, mas o carro-chefe é apenas pago.
• A ficha técnica, para contexto — o V4 Pro é um modelo de pesos abertos sob licença MIT, com 1,6T de parâmetros totais e 49B ativos por token, uma janela de contexto de 1M de tokens e até 384K tokens de saída, com limite de concorrência de 500. A Artificial Analysis registra 72,3 tokens de saída por segundo.
A versão do modelo por trás de tudo isso é o DeepSeek-V4-Pro-0813, inalterada desde o lançamento de disponibilidade geral de 13 de agosto — e é justamente esse o ponto. Nada no checkpoint mudou em 11 de setembro; apenas a decisão sobre o seu futuro mudou.
Pico, fora de pico e a regra de fim de semana que muda a matemática
O regime de pico/fora de pico que a versão anterior desta página descrevia como chegando em 17 de agosto já tem um mês e foi alterado uma vez desde então.
• Períodos de pico — 01:00–04:00 e 06:00–10:00 UTC, de segunda a sexta-feira. No horário de Pequim, isso é 09:00–12:00 e 14:00–18:00, o próprio dia de trabalho da DeepSeek. As tarifas fora de pico são exatamente metade das de pico, não uma faixa de desconto sobre elas.
• Os fins de semana são totalmente fora de pico. A partir das 00:00 no horário de Pequim de 23 de agosto de 2026, a DeepSeek deixou de aplicar tarifas de pico aos sábados e domingos. Se o seu trabalho em lote puder ser transferido, movê-lo para o fim de semana corta a conta pela metade — e, para equipes que atendem usuários nas Américas, a maior parte da semana de trabalho já cai fora do pico sem nenhum tipo de agendamento.
• O que a mudança custou, frente aos ¥3/¥6 com que o modelo foi lançado em 13 de agosto — a saída fora de pico hoje é 2,25× a taxa de lançamento, e a saída em pico é 4,5×; a entrada com cache hit em pico é 12× o antigo ¥0,025.
Há uma assimetria aqui que explica por que a questão da migração continua surgindo mesmo depois de o desligamento ter sido cancelado. O preço do V4 Pro subiu em agosto, enquanto o do seu sucessor caiu: a DeepSeek reduziu os preços da API da série Flash em até 60%, em vigor a partir de 10 de setembro. A pressão para migrar nunca foi realmente sobre o aviso de 14 de setembro; o aviso apenas a tornou urgente.
O que uma solicitação realmente custa
Três exemplos práticos com as tarifas fora de pico de hoje. Cada um deles dobra dentro de uma janela de pico.
• 100K de entrada + 50K de saída — $0.0726 + $0.1089 ≈ $0.18.
• 1M de entrada + 1M de saída — $0,726 + $2,178 = $2,90. Essa mesma chamada custa $5,81 no pico, e era $1,32 em meados de agosto.
• Sessão agêntica, 500K de entrada + 200K de saída — $0.363 + $0.4356 ≈ $0.80.
A visão mensal está na página do modelo e é o teste honesto para verificar se a manchete antiga ainda descreve a sua fatura: com 10 milhões de tokens por mês e uma proporção de entrada de 70%, a calculadora de custos chega a US$ 11,62, ou cerca de US$ 9,16 com o prompt caching ativado. Se o seu orçamento foi feito com base em US$ 0,44, agora ele cobre cerca de 60% da fatura.
Cache é a alavanca que ninguém põe na mesa.
O cache de prompts ficou mais valioso, e não menos, quando as tarifas subiram — e a direção dos dois números é a razão. Na OrcaRouter, uma leitura de cache agora é cobrada a US$ 0,024 por 1 milhão de tokens, contra US$ 0,726 sem cache, um desconto de 96,7% em qualquer entrada que você reenvie. Na versão anterior desta página, a tarifa de cache era de US$ 0,060 contra um preço de entrada de US$ 0,442, um desconto de 86%. O preço de leitura de cache caiu mais da metade, enquanto o preço da entrada sem cache subiu 64%, de modo que a diferença efetiva entre um token em cache e um token sem cache aumentou consideravelmente.
Para um agente que reenvia um grande prompt de sistema e um contexto longo a cada turno, a entrada em cache é a diferença entre uma fatura que escala com o comprimento da conversa e uma que não escala. A regra prática permanece a mesma e vale a pena repetir: coloque o prompt de sistema estável e o material de referência primeiro e o conteúdo volátil por último, para que o prefixo que você reenvia realmente atinja o cache. Neste modelo, essa única escolha estrutural vale mais do que qualquer decisão de roteamento ou escalonamento abaixo dela.
Como o preço do V4 Pro se compara à concorrência

Preços de tabela do diretório para entrada/saída por 1M de tokens, verificados em 12/09/2026, comparados com os US$ 0,726/US$ 2,178 fora de pico do V4 Pro. Dois deles mudaram desde que esta página foi publicada pela primeira vez, e um deles altera a conclusão.
• Claude Fable 5 — $10 / $50. O V4 Pro é 13,8× mais barato na entrada e 23× na saída.
• Claude Opus 5 — $5 / $25. 6,9× / 11,5×.
• GPT-5.6 Sol — $4 / $20 até 272K de contexto, $8 / $30 além disso. 5,5× / 9,2× na faixa mais curta, 11× / 13,8× na mais longa.
• Kimi K3 — $3 / $15. 4,1× / 6,9×.
• Qwen3.8 Max — US$ 2 / US$ 6. 2,8× / 2,8×.
• Grok 4.5 — US$ 2 / US$ 6. 2,8× / 2,8×.
• Gemini 3.6 Flash — $0,75 / $3,75. Praticamente paridade na entrada, a 1,03×, e 1,7× na saída. Seu preço caiu pela metade desde que esta página foi escrita.
• MiniMax M3 — $0.30 / $1.20. Mais barato que o V4 Pro em ambas as linhas agora: o V4 Pro custa 2,4× mais na entrada e 1,8× mais na saída, com a mesma janela de 1M tokens.
• DeepSeek V4 Flash — $0,242 / $0,726 no diretório. Cerca de 3× mais barato nas duas linhas, mesmo contexto de 1M.
Portanto, o enquadramento honesto mudou, e esta página deve dizê-lo em vez de manter o antigo superlativo. O DeepSeek V4 Pro já não é o modelo mais barato com contexto de 1M na lista: o Gemini 3.6 Flash e o MiniMax M3 são ambos mais baratos do que ele, e o MiniMax M3 consegue-o igualando a janela de contexto. O que o V4 Pro ainda é, por mais de uma ordem de magnitude, é a opção mais barata no nível de fronteira — todos os modelos ocidentais de classe flagship nessa lista custam múltiplos dele em ambas as linhas. Se a pergunta for "chamada mais barata possível com contexto de 1M", a resposta já não é este modelo. Se a pergunta for "modelo mais barato que se comporta como um modelo de fronteira", por enquanto ainda é.
Quando o V4 Pro é a escolha errada
• Se o seu tráfego for mais intenso durante o horário diurno de Pequim. As horas de pico dobram a tarifa, e as janelas de pico coincidem exatamente com o dia de trabalho da China. Se os seus usuários estão nas Américas, a maior parte do seu tráfego já ocorre fora do pico, o que é uma verdadeira vantagem estrutural. Se você está criando para usuários na China, modele explicitamente a fatura de pico antes de se comprometer — e verifique se a regra de fim de semana ajuda você a deslocar alguma coisa.
• Se os seus prompts forem curtos. Abaixo de aproximadamente 10K tokens de contexto, o nível flagship é capacidade desperdiçada. O DeepSeek V4 Flash a $0.242/$0.726 no diretório processa o mesmo contexto de 1M por cerca de um terço do preço, e para tarefas genuinamente curtas um modelo mais barato ainda ganha.
• Se você precisa de visão. O V4 Pro é somente texto — sem entrada de imagem ou áudio — e a Artificial Analysis lista sua modalidade de entrada como texto. Gemini 3.6 Flash ou Claude Fable 5 são as opções mais adequadas se a modalidade for o ponto. A própria API da DeepSeek também vale a pena mencionar aqui: agora ela atende seus nomes de modelos flash legados com o V4.1 Flash, que aceita imagens.
• Se está a comprar pontuação bruta no topo dos benchmarks em vez de preço por contexto. Na escala atual da Artificial Analysis, o V4 Pro obtém 36 no Intelligence Index — 8.º de 113 modelos no momento da redação — e 69 no índice de Coding, conforme consta no diretório OrcaRouter. Isto é competitivo, não líder: Claude Fable 5, Claude Opus 5 e GPT-5.6 Sol superam-no todos em coding. A proposta do V4 Pro é capacidade próxima da fronteira a uma fração do preço por token, não o topo de todos os gráficos.
Como chamá-lo no OrcaRouter

O DeepSeek V4 Pro está hospedado no OrcaRouter sob o ID de modelo deepseek/deepseek-v4-pro, servido através do endpoint compatível com OpenAI em api.orcarouter.ai/v1, à tarifa do provedor e sem qualquer margem acrescida. Migrar de um cliente OpenAI existente resume-se a alterar o URL base e o ID de modelo, e nada mais.
A reversão muda o que você deve fazer a respeito. Se você tinha uma migração em 14 de setembro no calendário — redirecionando de V4 Pro para DeepSeek V4.1 Flash porque o Pro seria descontinuado —, você pode removê-la do calendário ou, pelo menos, rebaixá-la de prazo final para teste. Ambos os modelos ficam atrás de uma única chave do OrcaRouter, então compará-los é uma mudança de ID de modelo em uma requisição, em vez de um segundo contrato e um segundo SDK; e, se você realmente quiser avaliar o V4.1 Flash com tráfego real sem apostar um caminho de produção nele, o failover automático é a forma de baixo risco de dar a ele requisições ao vivo enquanto o V4 Pro permanece como fallback. Essa é a forma prática da decisão de 11 de setembro: a escolha continua sendo sua, e continua reversível.
A nota de honestidade que importa para uma página de preços: nós encaminhamos para o modelo, não definimos o preço dele. Os números de $0.726/$2.178 fora de horário de pico são as tarifas da DeepSeek repassadas, e mudam quando a DeepSeek as muda — que é exatamente por isso que esta página é datada, e por isso a versão que você está lendo foi reescrita em vez de receber acréscimos.
Fontes e data
Os preços e as especificações desta página foram reverificados em 12 de setembro de 2026. Os valores em dólares do DeepSeek V4 Pro e de todos os modelos da comparação são lidos de o diretório de modelos do OrcaRouter, verificados no mesmo dia; a contagem de parâmetros, a licença, a janela de contexto, a modalidade e os números de velocidade vêm da página do modelo DeepSeek V4 Pro 0813 no Artificial Analysis. As tarifas em yuan, as janelas de pico e o aviso de continuação de 11 de setembro vêm da própria documentação Models & Pricing da DeepSeek, que traz a declaração na íntegra como nota de rodapé da tabela de preços. A sequência de anúncios em três etapas — o aviso de encaminhamento de 9 de setembro, o adiamento de 10 de setembro para as 12h00 do horário de Pequim de 14 de setembro e a reversão de 11 de setembro — é noticiada pelo CLS (科创板日报), 36Kr, IT之家 e ifeng, e, em inglês, pelo TheBlockBeats. A regra de cobrança de fim de semana de 23 de agosto e o corte de preço do Flash em 10 de setembro vêm dos anúncios da DeepSeek conforme noticiados pelo IT之家, The Paper e 21st Century Business Herald.
Uma observação final sobre confiabilidade, porque este preço específico mudou três vezes em um mês — preços de lançamento em 13 de agosto, pico/fora de pico em 17 de agosto, a alteração de fim de semana em 23 de agosto. Considere inutilizável qualquer página de "preços do V4 Pro" sem data. A versão anterior desta cotava US$ 0,44/US$ 0,88 e um índice Artificial Analysis Intelligence de 44,3; ambos estavam corretos quando foram escritos, e nenhum dos dois sobreviveu ao mês.
Comparados neste artigo3
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
