Um cartão hero gerado intitulado 'DeepSeek V4 Pro vs Kimi K3', com um ícone de velocímetro à esquerda rotulado 'DeepSeek V4 Pro' e com o selo '~81 tok/s · /bin/bash.66/.98', e um ícone de cérebro à direita rotulado 'Kimi K3' e com o selo 'Index 44 · .00/5.00', com um divisor sutil de pista de corrida entre eles e o rodapé 'Velocidade e preço contra um teto de raciocínio'.
Guides & Insights

DeepSeek V4 Pro vs Kimi K3: Velocidade e preço contra um teto de raciocínio de 44 pontos

Autor

Gideon Frost

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

DeepSeek V4 Pro e Kimi K3 são os dois principais modelos de raciocínio de pesos abertos com uma janela de um milhão de tokens, e a competição entre eles se consolidou em um formato estável há um mês: o Kimi K3 (modelo de 2,8 trilhões de parâmetros da Moonshot AI, lançado em 16 de julho de 2026) é o líder em inteligência, e o DeepSeek V4 Pro (lançado em 13 de agosto de 2026) é o líder em velocidade e preço. O que há de novo é que a metade barata desse par quase foi eliminada na primeira metade de setembro — a DeepSeek colocou o V4 Pro em uma trajetória de aposentadoria para 14 de setembro no dia 8, adiou, e então, no dia 11, cancelou a aposentadoria de vez, comprometendo-se a continuar servindo o modelo com cobrança inalterada. Isso importa mais para este confronto do que para a maioria, porque "barato, rápido, contexto de 1M, pesos abertos" é uma combinação difícil de substituir quando a alternativa custa cinco vezes mais.

Os números independentes são medições da Artificial Analysis. Os próprios benchmarks de lançamento da Deep​Seek e da Moonshot são rotulados como relatados pelo fornecedor, porque nenhum dos dois foi reproduzido de forma independente.

Kimi K3 ganha o índice; V4 Pro ganha na conta

O placar independente é inequívoco sobre quem é mais inteligente. O Kimi K3, no esforço máximo, pontua 44 no Índice de Inteligência da Artificial Analysis, ranqueado em 2º lugar entre modelos comparáveis. O DeepSeek V4 Pro pontua 36, ranqueado em 7º lugar na sua categoria. É essa diferença de nove pontos que explica por que alguém paga os preços do Kimi K3. E os preços são a razão pela qual o confronto não é decidido apenas pelo índice: o Kimi K3 está listado a US$ 3,00 por milhão de tokens de entrada e US$ 15,00 por milhão de tokens de saída, enquanto o V4 Pro está listado a US$ 0,66/US$ 1,98 fora de pico (US$ 1,32/US$ 3,96 no pico). Na saída, isso é aproximadamente 7,5x — antes do desconto de cache. As leituras de cache do V4 Pro custam cerca de US$ 0,02 por milhão de tokens fora de pico, um desconto de 97%; o desconto de cache de 90% do Kimi K3 parte de uma base muito mais alta. Para uma carga de trabalho com muitos tokens, a diferença efetiva se amplia para perto de dez vezes.

• Índice de Inteligência — Kimi K3 44 (#2/113) vs V4 Pro 36 (#7/113)

• Preço — Kimi K3 $3.00/$15.00 por 1M vs V4 Pro $0.66/$1.98 fora de pico ($1.32/$3.96 em pico)

• Velocidade — V4 Pro ~81 tokens/seg vs Kimi K3 ~35 tokens/seg

• Contexto — ambos com 1M tokens

• Parâmetros — Kimi K3 2.8T no total / 104B ativos vs V4 Pro 1.6T no total / 49B ativos

• Pesos — ambos abertos (Kimi K3 com pesos abertos, V4 Pro MIT)

• Entrada — Kimi K3 texto e imagem vs V4 Pro somente texto

A velocidade é a parte que todos subestimam.

A lacuna sobre a qual ninguém fala é a taxa de transferência. O V4 Pro produz cerca de 81 tokens por segundo medidos de forma independente; o Kimi K3 consegue cerca de 35. Em um loop de agente em que o modelo escreve vários milhares de tokens por etapa, essa é a diferença entre uma tarefa que termina em minutos e uma que se arrasta por uma tarde inteira — e a diferença de custo agrava isso, porque você está pagando US$ 15 por milhão de tokens de saída a aproximadamente metade da velocidade. Para assistentes de codificação interativos, processamento de documentos em massa e qualquer carga de trabalho em que o tempo de relógio seja um item de orçamento, a combinação do V4 Pro de 2,3x de velocidade a um sétimo do preço de saída é a resposta dominante.

Quando os nove pontos valem a pena

O argumento honesto a favor do Kimi K3 é o teto de raciocínio. Seu custo de avaliação no Intelligence Index foi de cerca de $3,658 pela execução — um reflexo de cadeias de raciocínio genuinamente longas e caras, não de uma peculiaridade de precificação. Se sua carga de trabalho é raciocínio difícil — provas matemáticas profundas, planejamento de longo horizonte, tarefas agênticas de várias horas em que nove pontos extras no índice se traduzem em menos falhas —, o Kimi K3 justifica seu prêmio. O argumento honesto contra ele é todo o resto: a vazão, a economia de cache, o simples preço por token.

A outra razão pela qual a reviravolta de setembro importa aqui: há um mês, o conselho sensato era "se você vai padronizar no modelo aberto barato e rápido, tenha um plano B — ele pode ser descontinuado". A partir de 15 de setembro, esse plano B está obsoleto. A DeepSeek comprometeu-se publicamente, com a promessa de aviso caso algo mude, a manter o V4 Pro na API, e a licença MIT significa que o modelo continua podendo ser implantado no seu próprio hardware, independentemente do que a DeepSeek faça com sua API. Os pesos abertos do Kimi K3 dão a mesma liberdade do outro lado, o que faz disto uma comparação genuína entre dois pesos abertos, em vez de uma disputa entre um serviço e um produto.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at .32 input and .96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Ambos os modelos estão no OrcaRouter — DeepSeek V4 Pro e Kimi K3 são roteados pela plataforma em uma única chave, com os preços de tabela dos provedores repassados sem markup — e a DSL de roteamento é a forma natural de dividir este confronto: roteie as tarefas de raciocínio de horizonte longo para o Kimi K3, onde os nove pontos compensam, e roteie o trabalho de throughput intensivo em tokens para o DeepSeek V4 Pro, onde a diferença de preço de 7,5x e a diferença de velocidade de 2,3x fazem o trabalho por você. Os dois são tão frequentemente complementares quanto concorrentes, e a plataforma faz com que executar os dois seja o mesmo trabalho que executar um.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of /bin/bash.66 and output price of .98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Kimi K3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price /bin/bash.66/.98 off-peak, Speed ~81 tok/s, Context 1M, Active params 49B/1.6T, Weights MIT; right column Kimi K3 rows AA Index 44 (#2/113), Price .00/5.00, Speed ~35 tok/s, Context 1M, Active params 104B/2.8T, Weights open; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

O resultado final

Kimi K3 é o modelo de pesos abertos mais inteligente, nove pontos de índice à frente, e seu prêmio — 7,5x nos tokens de saída, aproximadamente metade da velocidade — é um custo real, não um erro de arredondamento. DeepSeek V4 Pro é o cavalo de batalha rápido, barato e durável, e depois de 11 de setembro não é mais um risco de fuga. A resposta prática é a que ambas as colunas de preço apontam: se suas tarefas exigem raciocínio difícil, compre Kimi K3; se são intensivas em tokens e sensíveis ao tempo, compre DeepSeek V4 Pro; e se você tem os dois tipos, execute ambos e roteie por tarefa.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente