Um cartão hero gerado intitulado 'GPT-6 Sol vs DeepSeek V4 Pro', com a manchete '12 pontos do índice', com duas linhas contrastando 'API fechada a US$ 2,00/US$ 10,00 por 1M' contra 'pesos abertos sob licença MIT a US$ 1,32/US$ 3,96 por 1M', e o logotipo da OrcaRouter no canto inferior direito.
Guides & Insights

GPT-6 Sol vs DeepSeek V4 Pro: Uma diferença de doze pontos no índice por quatro vezes o preço

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Eis a aritmética que ninguém coloca numa página de lançamento. O DeepSeek V4 Pro obtém 36 no Índice de Inteligência da Artificial Analysis. O GPT-6 Sol obtém 48. O GPT-6 Sol custa US$ 2,00 por milhão de tokens de entrada e US$ 10,00 por milhão de saída. O DeepSeek V4 Pro custa US$ 1,32 e US$ 3,96 na mesma tabela — e sua própria tabela de preços publicada, convertida, chega a cerca de US$ 0,42 e US$ 0,87. Portanto, a diferença de doze pontos entre o GPT-6 Sol e o DeepSeek V4 Pro é comprada a algo entre uma vez e meia e quatro vezes o preço, dependendo de qual tabela de preços você consulta, e o modelo do lado mais barato é aquele que você pode baixar e executar por conta própria.

É essa a decisão inteira, e ela é genuinamente mais acirrada do que o placar sugere. O DeepSeek V4 Pro foi lançado em 13 de agosto de 2026 como um modelo de mistura de especialistas licenciado sob a licença MIT, com 1,6 trilhão de parâmetros totais e 49 bilhões ativos por token. O GPT-6 Sol foi lançado em 22 de setembro de 2026 como um modelo de fronteira de pesos fechados pela metade do preço de seu próprio antecessor. Um é uma commodity que você pode hospedar; o outro é uma capacidade que você aluga. Ambos têm uma janela de contexto de um milhão de tokens. Ambos são modelos de raciocínio. Nenhum dos dois é obviamente a compra errada.

O número que decide isto

Comece pelo ponto em que ambos os fornecedores concordam: contexto. O DeepSeek V4 Pro tem uma janela de contexto de 1M com saída máxima de 384K. O GPT-6 Sol é listado com 872.000 tokens pela Artificial Analysis contra um teto de 1,05M, com um limite de saída de 128K em outros materiais da OpenAI. O DeepSeek oferece três vezes mais espaço de saída e uma janela de entrada comparável.

Então, aquilo que só um deles tem: um penhasco de reprecificação em contexto longo. A tarifa de US$ 2/US$ 10 do GPT-6 Sol mantém-se abaixo de 272.000 tokens de entrada. Acima disso, a solicitação inteira é reprecificada — a entrada aproximadamente dobra para US$ 4, e a saída aumenta pela metade, para cerca de US$ 15. O DeepSeek V4 Pro não tem um degrau equivalente; suas tarifas publicadas aplicam-se em toda a janela, com uma tabela de horário de pico e fora de pico introduzida em 17 de agosto, que altera o preço conforme a hora do dia, e não conforme o comprimento do contexto.

Junte tudo isso e a comparação se inverte no topo da escala. Uma requisição ao DeepSeek V4 Pro carregando 400K tokens de contexto custa a sua tarifa normal. A mesma requisição no GPT-6 Sol custa aproximadamente o dobro do preço anunciado. Se a sua carga de trabalho é de contexto longo por natureza — análise de documentos, agentes em repositórios grandes, raciocínio sobre transcrições extensas —, a diferença efetiva de preço entre esses dois modelos é muito maior do que $2 contra $1,32 sugere.

A generated two-column scoreboard titled 'GPT-6 Sol vs DeepSeek V4 Pro — the scoreboard'. Left column GPT-6 Sol: Price $2.00/$10.00, AA Index 48, Weights 'closed', Max output 128K, Terminal-Bench 2.1 'n/a', Context 872K. Right column DeepSeek V4 Pro: Price $1.32/$3.96, AA Index 36, Weights 'MIT', Max output 384K, Terminal-Bench 2.1 87.9, Context 1M. Footer: 'DeepSeek figures per DeepSeek and Artificial Analysis.'

Onde o DeepSeek V4 Pro é genuinamente competitivo

Os resultados agênticos e de codificação da DeepSeek não são uma concessão orçamentária. Pelos números que o fornecedor publicou:

• Terminal-Bench 2.1 — DeepSeek V4 Pro 87,9

• Toolathlon-Verified — DeepSeek V4 Pro 74,1

• DeepSWE — DeepSeek V4 Pro 62.7

• SWE-bench Verified — DeepSeek V4 Pro 80,6

• AA Intelligence Index — DeepSeek V4 Pro 36, classificado em 8º entre 114 modelos avaliados

• Velocidade de saída — DeepSeek V4 Pro 67,8 tokens/seg

• Licença — MIT, pesos abertos, auto-hospedável

O ranking do Index merece uma segunda olhada. Trinta e seis pontos colocam o DeepSeek V4 Pro em oitavo lugar entre 114 modelos no quadro, o que é uma posição forte para um modelo com pesos baixáveis e uma licença MIT. A diferença para o GPT-6 Sol é real, mas é uma diferença entre "muito bom" e "fronteira", não entre "utilizável" e "não utilizável".

A licença MIT é a parte que não tem equivalente no GPT-6 Sol. Se a sua restrição é residência de dados, implantação air-gapped, um custo por token que tende a zero em alta utilização, ou simplesmente não querer que uma descontinuação de fornecedor seja um evento de migração, o DeepSeek V4 Pro é o único destes dois que responde à questão. O GPT-6 Sol é somente API e continuará sendo.

Onde o GPT-6 Sol se distancia

Doze pontos do Índice são uma margem ampla neste fim da tabela. O GPT-6 Sol ocupa a 18ª posição entre 212 modelos avaliados, contra a 8ª posição da DeepSeek entre 114, e alcança essa posição com um conjunto de resultados agênticos publicados pelo fornecedor que a DeepSeek não contesta:

• AutomationBench — GPT-6 Sol 33,2% a US$ 0,27 por tarefa

• Último Exame dos Agentes — GPT-6 Sol 56,4%

• DeepSWE v1.1 — GPT-6 Sol 68,8%

• OSWorld 2.0 — GPT-6 Sol 60,5%

• Velocidade de saída — GPT-6 Sol 104,4 tokens/seg, contra os 67,8 do DeepSeek V4 Pro

Esses são relatos de fornecedores e a OpenAI executou sua própria estrutura de avaliação, então trate-os como alegações, e não como medições. Duas ressalvas merecem ser lembradas. A OpenAI usou pontuações publicadas de concorrentes em várias linhas, em vez de executar novamente o modelo do concorrente, e seu ponto no gráfico do Agents' Last Exam para Claude Fable 5.1 exclui fallbacks do Opus 5 que foram acionados em cerca de 40% das tarefas. Nenhuma das ressalvas afeta diretamente a comparação com o DeepSeek, mas são o motivo para encarar a tabela inteira com cautela.

A leitura independente é mais ponderada do que a de qualquer um dos fornecedores. A Artificial Analysis constatou que o GPT-6 Sol reduz aproximadamente pela metade o custo por tarefa em comparação com o GPT-5.6 Sol, ao mesmo tempo que produz uma mistura de ganhos e regressões — incluindo regressões no GDPval-AA v2.1. Um modelo que troca capacidade em alguns pontos por uma grande redução de custos é um modelo que muda o que você pode se dar ao luxo de executar, não um que eleva o teto em toda parte.

E o perfil de latência do GPT-6 Sol é uma verdadeira desvantagem. O tempo até o primeiro token é de 107,18 segundos, contra uma mediana do ranking de 3,87. Esse é o primeiro token mais lento do ranking, por uma grande margem. O DeepSeek V4 Pro também não é um modelo rápido, mas não está nesse patamar, e, para qualquer superfície interativa, a diferença é desqualificadora em apenas uma direção.

Pesos abertos versus uma fronteira alugada

Esta é a dimensão em que os dois modelos não estão realmente competindo. O DeepSeek V4 Pro é um MoE de 1,6 trilhão de parâmetros, com 49 bilhões de parâmetros ativos, licenciado sob MIT e disponível para download. Isso significa um custo fixo que se dilui a quase nada em volume, uma implantação que você controla e um modelo que não pode ser descontinuado à sua revelia. Também significa que você é dono da pilha de serving, da conta de GPU e de cada regressão.

O GPT-6 Sol é a aposta oposta. Você paga por token para sempre, obtém capacidade de ponta sem possuir hardware, e a OpenAI pode mudar o preço, a tabela de tarifas ou a disponibilidade com um post de blog — como fez em 22 de setembro, quando reduziu pela metade o preço do seu próprio carro-chefe. Não existe uma versão do GPT-6 Sol que você possa fixar.

A maneira correta de pensar nisso não é “qual é melhor”, mas “qual risco você prefere”. Risco de fornecedor contra risco operacional. Para uma startup sem equipe de infraestrutura e com tráfego volátil, a API é obviamente a escolha certa. Para uma organização com capacidade de GPU já existente, uma fronteira de conformidade ou uma carga de trabalho cujo volume torna o preço por token absurdo, os pesos abertos vencem só pela economia, e doze pontos do Index é um preço que vale a pena pagar.

Se você quiser parar de escolher

Há uma versão desta decisão que não exige compromisso. O DeepSeek V4 Pro está no OrcaRouter pelo preço de tabela da DeepSeek, com o modelo de repasse, o que significa que uma alteração de preço da DeepSeek — incluindo o horário de pico e fora de pico — é refletida do nosso lado no mesmo dia, em vez de depois de o revendedor renegociar. O GPT-6 Sol não está no nosso catálogo no momento em que escrevemos; é acessível pela própria API da OpenAI, portanto, uma rota que abrange ambos significa uma chave para o DeepSeek V4 Pro e uma integração direta para a OpenAI.

Essa divisão vale a pena por um motivo específico: esses dois modelos falham de maneiras diferentes. Uma implantação de pesos abertos falha quando o seu hardware falha; uma API falha quando o fornecedor falha. O failover automático entre provedores é o que transforma isso em uma tarde degradada em vez de uma indisponibilidade, e poder mover uma rota entre um modelo barato de alto rendimento e um modelo caro e cuidadoso editando uma configuração em vez de um caminho de código é o que permite acompanhar a curva de preços em vez de apostar nela.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

Quem deve escolher qual

Escolha o DeepSeek V4 Pro se você tiver infraestrutura, uma fronteira de conformidade ou um problema de volume. Ele tem licença MIT, é o oitavo de 114 no índice independente, carrega 384K de espaço de saída, e sua tabela de preços não tem precipício de contexto. É a resposta correta para quem tem como restrição vinculante o custo em escala ou o controle sobre a implantação, e a diferença de doze pontos para o GPT-6 Sol é o preço disso.

Escolha o GPT-6 Sol se você precisa da fronteira e seu contexto fica abaixo de 272K tokens. Ele pontua 48 contra 36, gera tokens cerca de 50% mais rápido e, a US$ 2/US$ 10, é o modelo de topo mais barato que a OpenAI já fez. Só saiba o que está comprando: uma espera de cem segundos pelo primeiro token, uma camada de contexto longo que dobra a tarifa e um modelo cuja avaliação independente é uma mistura de ganhos e regressões, em vez de um avanço claro.

E se a resposta for "ambos, dependendo da solicitação", isso não é indecisão. É a arquitetura correta para um mercado em que dois fornecedores reduziram pela metade os preços de seus produtos carro-chefe em um intervalo de seis semanas entre si, e nenhum dos dois parou de se movimentar.

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro), showing the Tools, JSON and Reasoning badges, a 1M-token context with 384K maximum output and text-only input, a 3.56s p50 time to first token, and the description of DeepSeek V4 Pro as a flagship MoE with 1.6T total / 49B active parameters built for top-tier reasoning and agentic tool use.

Comparados neste artigo3

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente