Kimi K3 vs DeepSeek V4: Os Dois Titãs de Peso Aberto, Comparados
Guides & Insights

Kimi K3 vs DeepSeek V4: Os Dois Titãs de Peso Aberto, Comparados

Autor

Fengya Tian

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Esta é a principal disputa de pesos abertos de 2026. Kimi K3 e DeepSeek V4 são ambos grandes modelos de mistura de especialistas com pesos abertos, aproximadamente 1 milhão de tokens de contexto e preços agressivos, e ambos vêm de laboratórios chineses. Se você decidiu que quer um modelo de classe fronteiriça aberto e auto-hospedável, esses são seus dois finalistas.

As diferenças são reais, mas específicas: DeepSeek V4 é apenas texto e tem o preço mínimo absoluto (com uma sobretaxa de horário de pico que a maioria das pessoas perde); Kimi adiciona visão nativa e, em índices independentes, supera DeepSeek em inteligência geral. O licenciamento também é diferente, DeepSeek é totalmente MIT, Kimi é MIT Modificado. Aqui está como escolher.

Uma nota de honestidade primeiro: em 15 de julho de 2026, a Moonshot não publicou especificações ou benchmarks oficiais do K3. O vazamento do material promocional de lançamento é real, os números não estão confirmados. Então, quando comparamos capacidade, usamos a linha de produtos em distribuição da Kimi, K2.6 e K2.7 Code, como a base a partir da qual se espera que o K3 evolua, e dizemos isso a cada vez. Trate cada dado do K3 como rumor até que a ficha do modelo esteja disponível.

Veredito rápido

- Abertura: ambos são de peso aberto e auto-hospedáveis. DeepSeek V4 é totalmente MIT; Kimi é MIT Modificado (adiciona requisitos de marca em escala muito grande). DeepSeek é a licença mais permissiva.

- Preço: DeepSeek V4-Pro é o mais barato a ~$0,435 de entrada / $0,87 de saída por 1M fora do pico, mas horários de pico adicionam aproximadamente uma sobretaxa de 2x. A linha da Kimi é de ~$0,60-$0,95 / $2,80-$4,00. DeepSeek vence no preço bruto; cuidado com o preço de pico.

- Inteligência (independente): Kimi K2.6 lidera em pesos abertos no Índice de Inteligência Artificial Analysis (54) logo à frente do DeepSeek V4-Pro (52).

- Modalidade: Kimi tem visão nativa; DeepSeek V4 é apenas texto. Se você precisar de entrada de imagem em um modelo aberto, Kimi vence.

- Codificação: muito próximo, DeepSeek V4-Pro relata SWE-Bench Verified 80.6 e LiveCodeBench 93.5; Kimi K2.6 relata SWE-Bench Verified 80.2 e liderança em código aberto SWE-Bench Pro 58.6 (vs 55.4 do DeepSeek).

- Veredito: escolha DeepSeek V4 pelo custo absoluto mais baixo apenas para texto e pela licença mais permissiva; escolha Kimi K3 pela visão nativa, uma ligeira vantagem em inteligência independente e (rumor) contexto mais longo. Muitas equipes devem manter ambos e rotear.

Num relance

- Kimi K3 (esperado, baseado em K2.6/K2.7): MoE de pesos abertos, MIT Modificado; rumores de 2,5T-4T parâmetros; rumores de 1M de contexto; visão nativa; preço não anunciado (linha ~$0,60-$0,95 / $2,80-$4,00).

- DeepSeek V4-Pro: MoE de pesos abertos, MIT; 1,6T total / 49B ativos; contexto de 1M / até 384K de saída; apenas texto; ~US$ 0,435 in / US$ 0,87 out fora do pico (cache-hit ~US$ 0,0036), aproximadamente o dobro nos horários de pico; lançado em 24 de abril de 2026. (Uma versão mais leve V4-Flash, 284B/13B, custa ~US$ 0,14/US$ 0,28.)

- Nota: Os nomes de API legados da DeepSeek (deepseek-chat / deepseek-reasoner) estão obsoletos a partir de 24 de julho de 2026, planeje a migração se você os utiliza.

Preço e a captura no horário de pico

No papel, o DeepSeek V4-Pro é o modelo aberto mais barato disponível, com cerca de $0,435 por milhão de tokens de entrada e $0,87 de saída, com cache hits quase gratuitos. A linha da Kimi é um pouco mais cara, com $0,60-$0,95 por entrada e $2,80-$4,00 por saída. Para volume de texto puro, o DeepSeek vence na guerra de preços.

A pegadinha que os concorrentes raramente mencionam: a DeepSeek transformou seu antigo desconto de horário de baixa demanda em uma sobretaxa de pico, então durante o horário comercial chinês (aproximadamente das 09:00 às 12:00 e das 14:00 às 18:00) os preços ficam cerca do dobro. Se o seu tráfego é intermitente e alinhado com o horário diurno da China, sua conta real da DeepSeek pode chegar mais perto da da Kimi do que o título sugere. Este é precisamente o tipo de detalhe de custo total que só aparece quando você mede o gasto por hora, não por token.

Benchmarks: um verdadeiro empate

Estes dois estão mais próximos do que qualquer outro par nesta série. Em codificação, o DeepSeek V4-Pro relata SWE-Bench Verified 80.6, LiveCodeBench 93.5 e uma notável classificação Codeforces de 3206; o Kimi K2.6 relata SWE-Bench Verified 80.2, LiveCodeBench v6 89.6 e um SWE-Bench Pro líder de código aberto de 58.6 contra 55.4 do DeepSeek. Em ciência e matemática, eles trocam golpes (GPQA Diamond ~90 cada; AIME 2026 Kimi 96.4 vs DeepSeek 94.3).

Os desempates são independentes e estruturais. No Artificial Analysis Intelligence Index, o Kimi K2.6 (54) supera o DeepSeek V4-Pro (52) como o melhor modelo de peso aberto. Mas o DeepSeek é apenas texto, enquanto a visão nativa do Kimi e o alegado mais longoKimi K3contexto ampliam o que ele pode fazer. Os números de codificação de primeira parte de ambos os fornecedores merecem sua própria verificação.

Licenciamento, modalidade e auto-hospedagem

Se você está escolhendo um modelo aberto, três pontos práticos decidem isso. Licença: a MIT simples da DeepSeek é a mais permissiva, a MIT Modificada da Kimi adiciona requisitos de marca visível apenas em escala muito grande (100M+ usuários ou receita de $20M+/mês), irrelevante para a maioria das equipes, mas vale a pena notar. Modalidade: a Kimi lida com imagens nativamente; a DeepSeek é apenas texto. Auto-hospedagem: ambos são pesados, DeepSeek V4-Pro e Kimi de qualidade total precisam cada um de cerca de 8x GPUs de ponta, então muitas equipes os executarão por meio de hosts de jurisdição neutra (OpenRouter, DeepInfra) em vez de locais. Ambas as APIs de primeira parte estão sob jurisdição chinesa, portanto, encaminhe de acordo se a residência de dados for importante.

Qual você deve usar?

Escolha o DeepSeek V4 quando quiser o menor custo possível apenas de texto e a licença mais permissiva, e seu tráfego não estiver concentrado nos horários de pico da China. Escolha o Kimi K3 quando precisar de visão nativa, quiser a ligeira vantagem de inteligência independente ou esperar usar o suposto contexto mais longo. Para muitas equipes, a resposta certa são ambos, eles são baratos o suficiente para manter como opções redundantes de peso aberto.

Essa redundância é uma funcionalidade quando ambos estão por trás de um único endpoint do OrcaRouter. Você pode rotear envios de apenas texto para o que for mais barato na hora atual (evitando automaticamente a sobretaxa de pico da DeepSeek), enviar tarefas de imagem para o Kimi e fazer failover entre eles se algum provedor limitar a taxa, tudo com custo e latência por modelo em um único painel. Dois modelos abertos, uma integração, e o mais barato sempre na frente.

Perguntas Frequentes

Qual é mais barato, Kimi K3 ou DeepSeek V4?

DeepSeek V4-Pro é mais barato no papel (~$0,435/$0,87 fora do pico vs ~$0,60-$0,95/$2,80-$4,00 do Kimi), mas sua sobretaxa de ~2x no horário de pico pode diminuir a diferença para o tráfego alinhado ao período diurno da China.

Qual é mais capaz?

Muito próximo. Kimi K2.6 supera DeepSeek V4-Pro no índice independente Artificial Analysis Intelligence Index (54 vs 52) e no SWE-Bench Pro; DeepSeek lidera na classificação do Codeforces e no LiveCodeBench. Espera-se que o K3 aumente os números da Kimi, verifique no lançamento.

Ambos suportam imagens?

Não. O Kimi tem visão nativa; o DeepSeek V4 é apenas texto. Se você precisar de entrada de imagem em um modelo aberto, escolha o Kimi.

Posso executar ambos e alternar automaticamente?

Sim, esse é um padrão forte. Um gateway como o OrcaRouter pode rotear para qualquer modelo aberto que seja mais barato ou mais adequado por tarefa e fazer failover entre eles por trás de um único endpoint.

Kimi K3 ainda não tem benchmarks oficiais, posso confiar nessa comparação?

Pergunta justa. Em 15 de julho de 2026, o K3 não está confirmado, então esta comparação usa a linha K2.6/K2.7 de envio da Kimi como base e rotula todos os números do K3 como rumor. O consenso da comunidade é "animados, mas esperem pelos números reais", e os rankings independentes geralmente levam de três a seis semanas para serem publicados após um lançamento. A jogada de baixo risco: tratar o veredito como direcional, configurar o roteamento baseado em tarefas agora e reavaliar no dia em que os números oficiais do K3 da Moonshot chegarem.

O resultado final

O Kimi K3 e o DeepSeek V4 são os dois melhores modelos de peso aberto de 2026, e são suficientemente próximos para que você possa usar ambos de forma razoável. Escolha o DeepSeek para custo baixíssimo apenas com texto e uma licença mais limpa, escolha o Kimi para visão nativa e uma ligeira vantagem em capacidade, e se não tiver certeza, roteie entre eles e deixe o modelo mais barato e mais adequado vencer cada solicitação.




© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

Fale conosco

Junte-se à comunidade

DiscordEmailXGitHubYouTube