
DeepSeek V4 Pro vs Kimi K3: Velocidade e preço contra um teto de raciocínio de 44 pontos
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiNOVOOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleNOVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenNOVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligência72Código
- anthropicNOVOAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligência69Código
DeepSeek V4 Pro e Kimi K3 são os dois principais modelos de raciocínio de pesos abertos com uma janela de um milhão de tokens, e a competição entre eles se consolidou em um formato estável há um mês: o Kimi K3 (modelo de 2,8 trilhões de parâmetros da Moonshot AI, lançado em 16 de julho de 2026) é o líder em inteligência, e o DeepSeek V4 Pro (lançado em 13 de agosto de 2026) é o líder em velocidade e preço. O que há de novo é que a metade barata desse par quase foi eliminada na primeira metade de setembro — a DeepSeek colocou o V4 Pro em uma trajetória de aposentadoria para 14 de setembro no dia 8, adiou, e então, no dia 11, cancelou a aposentadoria de vez, comprometendo-se a continuar servindo o modelo com cobrança inalterada. Isso importa mais para este confronto do que para a maioria, porque "barato, rápido, contexto de 1M, pesos abertos" é uma combinação difícil de substituir quando a alternativa custa cinco vezes mais.
Os números independentes são medições da Artificial Analysis. Os próprios benchmarks de lançamento da DeepSeek e da Moonshot são rotulados como relatados pelo fornecedor, porque nenhum dos dois foi reproduzido de forma independente.
Kimi K3 ganha o índice; V4 Pro ganha na conta
O placar independente é inequívoco sobre quem é mais inteligente. O Kimi K3, no esforço máximo, pontua 44 no Índice de Inteligência da Artificial Analysis, ranqueado em 2º lugar entre modelos comparáveis. O DeepSeek V4 Pro pontua 36, ranqueado em 7º lugar na sua categoria. É essa diferença de nove pontos que explica por que alguém paga os preços do Kimi K3. E os preços são a razão pela qual o confronto não é decidido apenas pelo índice: o Kimi K3 está listado a US$ 3,00 por milhão de tokens de entrada e US$ 15,00 por milhão de tokens de saída, enquanto o V4 Pro está listado a US$ 0,66/US$ 1,98 fora de pico (US$ 1,32/US$ 3,96 no pico). Na saída, isso é aproximadamente 7,5x — antes do desconto de cache. As leituras de cache do V4 Pro custam cerca de US$ 0,02 por milhão de tokens fora de pico, um desconto de 97%; o desconto de cache de 90% do Kimi K3 parte de uma base muito mais alta. Para uma carga de trabalho com muitos tokens, a diferença efetiva se amplia para perto de dez vezes.
• Índice de Inteligência — Kimi K3 44 (#2/113) vs V4 Pro 36 (#7/113)
• Preço — Kimi K3 $3.00/$15.00 por 1M vs V4 Pro $0.66/$1.98 fora de pico ($1.32/$3.96 em pico)
• Velocidade — V4 Pro ~81 tokens/seg vs Kimi K3 ~35 tokens/seg
• Contexto — ambos com 1M tokens
• Parâmetros — Kimi K3 2.8T no total / 104B ativos vs V4 Pro 1.6T no total / 49B ativos
• Pesos — ambos abertos (Kimi K3 com pesos abertos, V4 Pro MIT)
• Entrada — Kimi K3 texto e imagem vs V4 Pro somente texto
A velocidade é a parte que todos subestimam.
A lacuna sobre a qual ninguém fala é a taxa de transferência. O V4 Pro produz cerca de 81 tokens por segundo medidos de forma independente; o Kimi K3 consegue cerca de 35. Em um loop de agente em que o modelo escreve vários milhares de tokens por etapa, essa é a diferença entre uma tarefa que termina em minutos e uma que se arrasta por uma tarde inteira — e a diferença de custo agrava isso, porque você está pagando US$ 15 por milhão de tokens de saída a aproximadamente metade da velocidade. Para assistentes de codificação interativos, processamento de documentos em massa e qualquer carga de trabalho em que o tempo de relógio seja um item de orçamento, a combinação do V4 Pro de 2,3x de velocidade a um sétimo do preço de saída é a resposta dominante.
Quando os nove pontos valem a pena
O argumento honesto a favor do Kimi K3 é o teto de raciocínio. Seu custo de avaliação no Intelligence Index foi de cerca de $3,658 pela execução — um reflexo de cadeias de raciocínio genuinamente longas e caras, não de uma peculiaridade de precificação. Se sua carga de trabalho é raciocínio difícil — provas matemáticas profundas, planejamento de longo horizonte, tarefas agênticas de várias horas em que nove pontos extras no índice se traduzem em menos falhas —, o Kimi K3 justifica seu prêmio. O argumento honesto contra ele é todo o resto: a vazão, a economia de cache, o simples preço por token.
A outra razão pela qual a reviravolta de setembro importa aqui: há um mês, o conselho sensato era "se você vai padronizar no modelo aberto barato e rápido, tenha um plano B — ele pode ser descontinuado". A partir de 15 de setembro, esse plano B está obsoleto. A DeepSeek comprometeu-se publicamente, com a promessa de aviso caso algo mude, a manter o V4 Pro na API, e a licença MIT significa que o modelo continua podendo ser implantado no seu próprio hardware, independentemente do que a DeepSeek faça com sua API. Os pesos abertos do Kimi K3 dão a mesma liberdade do outro lado, o que faz disto uma comparação genuína entre dois pesos abertos, em vez de uma disputa entre um serviço e um produto.

Ambos os modelos estão no OrcaRouter — DeepSeek V4 Pro e Kimi K3 são roteados pela plataforma em uma única chave, com os preços de tabela dos provedores repassados sem markup — e a DSL de roteamento é a forma natural de dividir este confronto: roteie as tarefas de raciocínio de horizonte longo para o Kimi K3, onde os nove pontos compensam, e roteie o trabalho de throughput intensivo em tokens para o DeepSeek V4 Pro, onde a diferença de preço de 7,5x e a diferença de velocidade de 2,3x fazem o trabalho por você. Os dois são tão frequentemente complementares quanto concorrentes, e a plataforma faz com que executar os dois seja o mesmo trabalho que executar um.


O resultado final
Kimi K3 é o modelo de pesos abertos mais inteligente, nove pontos de índice à frente, e seu prêmio — 7,5x nos tokens de saída, aproximadamente metade da velocidade — é um custo real, não um erro de arredondamento. DeepSeek V4 Pro é o cavalo de batalha rápido, barato e durável, e depois de 11 de setembro não é mais um risco de fuga. A resposta prática é a que ambas as colunas de preço apontam: se suas tarefas exigem raciocínio difícil, compre Kimi K3; se são intensivas em tokens e sensíveis ao tempo, compre DeepSeek V4 Pro; e se você tem os dois tipos, execute ambos e roteie por tarefa.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
