
GPT-6 Sol vs DeepSeek V4 Pro: Uma diferença de doze pontos no índice por quatro vezes o preço
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Eis a aritmética que ninguém coloca numa página de lançamento. O DeepSeek V4 Pro obtém 36 no Índice de Inteligência da Artificial Analysis. O GPT-6 Sol obtém 48. O GPT-6 Sol custa US$ 2,00 por milhão de tokens de entrada e US$ 10,00 por milhão de saída. O DeepSeek V4 Pro custa US$ 1,32 e US$ 3,96 na mesma tabela — e sua própria tabela de preços publicada, convertida, chega a cerca de US$ 0,42 e US$ 0,87. Portanto, a diferença de doze pontos entre o GPT-6 Sol e o DeepSeek V4 Pro é comprada a algo entre uma vez e meia e quatro vezes o preço, dependendo de qual tabela de preços você consulta, e o modelo do lado mais barato é aquele que você pode baixar e executar por conta própria.
É essa a decisão inteira, e ela é genuinamente mais acirrada do que o placar sugere. O DeepSeek V4 Pro foi lançado em 13 de agosto de 2026 como um modelo de mistura de especialistas licenciado sob a licença MIT, com 1,6 trilhão de parâmetros totais e 49 bilhões ativos por token. O GPT-6 Sol foi lançado em 22 de setembro de 2026 como um modelo de fronteira de pesos fechados pela metade do preço de seu próprio antecessor. Um é uma commodity que você pode hospedar; o outro é uma capacidade que você aluga. Ambos têm uma janela de contexto de um milhão de tokens. Ambos são modelos de raciocínio. Nenhum dos dois é obviamente a compra errada.
O número que decide isto
Comece pelo ponto em que ambos os fornecedores concordam: contexto. O DeepSeek V4 Pro tem uma janela de contexto de 1M com saída máxima de 384K. O GPT-6 Sol é listado com 872.000 tokens pela Artificial Analysis contra um teto de 1,05M, com um limite de saída de 128K em outros materiais da OpenAI. O DeepSeek oferece três vezes mais espaço de saída e uma janela de entrada comparável.
Então, aquilo que só um deles tem: um penhasco de reprecificação em contexto longo. A tarifa de US$ 2/US$ 10 do GPT-6 Sol mantém-se abaixo de 272.000 tokens de entrada. Acima disso, a solicitação inteira é reprecificada — a entrada aproximadamente dobra para US$ 4, e a saída aumenta pela metade, para cerca de US$ 15. O DeepSeek V4 Pro não tem um degrau equivalente; suas tarifas publicadas aplicam-se em toda a janela, com uma tabela de horário de pico e fora de pico introduzida em 17 de agosto, que altera o preço conforme a hora do dia, e não conforme o comprimento do contexto.
Junte tudo isso e a comparação se inverte no topo da escala. Uma requisição ao DeepSeek V4 Pro carregando 400K tokens de contexto custa a sua tarifa normal. A mesma requisição no GPT-6 Sol custa aproximadamente o dobro do preço anunciado. Se a sua carga de trabalho é de contexto longo por natureza — análise de documentos, agentes em repositórios grandes, raciocínio sobre transcrições extensas —, a diferença efetiva de preço entre esses dois modelos é muito maior do que $2 contra $1,32 sugere.

Onde o DeepSeek V4 Pro é genuinamente competitivo
Os resultados agênticos e de codificação da DeepSeek não são uma concessão orçamentária. Pelos números que o fornecedor publicou:
• Terminal-Bench 2.1 — DeepSeek V4 Pro 87,9
• Toolathlon-Verified — DeepSeek V4 Pro 74,1
• DeepSWE — DeepSeek V4 Pro 62.7
• SWE-bench Verified — DeepSeek V4 Pro 80,6
• AA Intelligence Index — DeepSeek V4 Pro 36, classificado em 8º entre 114 modelos avaliados
• Velocidade de saída — DeepSeek V4 Pro 67,8 tokens/seg
• Licença — MIT, pesos abertos, auto-hospedável
O ranking do Index merece uma segunda olhada. Trinta e seis pontos colocam o DeepSeek V4 Pro em oitavo lugar entre 114 modelos no quadro, o que é uma posição forte para um modelo com pesos baixáveis e uma licença MIT. A diferença para o GPT-6 Sol é real, mas é uma diferença entre "muito bom" e "fronteira", não entre "utilizável" e "não utilizável".
A licença MIT é a parte que não tem equivalente no GPT-6 Sol. Se a sua restrição é residência de dados, implantação air-gapped, um custo por token que tende a zero em alta utilização, ou simplesmente não querer que uma descontinuação de fornecedor seja um evento de migração, o DeepSeek V4 Pro é o único destes dois que responde à questão. O GPT-6 Sol é somente API e continuará sendo.
Onde o GPT-6 Sol se distancia
Doze pontos do Índice são uma margem ampla neste fim da tabela. O GPT-6 Sol ocupa a 18ª posição entre 212 modelos avaliados, contra a 8ª posição da DeepSeek entre 114, e alcança essa posição com um conjunto de resultados agênticos publicados pelo fornecedor que a DeepSeek não contesta:
• AutomationBench — GPT-6 Sol 33,2% a US$ 0,27 por tarefa
• Último Exame dos Agentes — GPT-6 Sol 56,4%
• DeepSWE v1.1 — GPT-6 Sol 68,8%
• OSWorld 2.0 — GPT-6 Sol 60,5%
• Velocidade de saída — GPT-6 Sol 104,4 tokens/seg, contra os 67,8 do DeepSeek V4 Pro
Esses são relatos de fornecedores e a OpenAI executou sua própria estrutura de avaliação, então trate-os como alegações, e não como medições. Duas ressalvas merecem ser lembradas. A OpenAI usou pontuações publicadas de concorrentes em várias linhas, em vez de executar novamente o modelo do concorrente, e seu ponto no gráfico do Agents' Last Exam para Claude Fable 5.1 exclui fallbacks do Opus 5 que foram acionados em cerca de 40% das tarefas. Nenhuma das ressalvas afeta diretamente a comparação com o DeepSeek, mas são o motivo para encarar a tabela inteira com cautela.
A leitura independente é mais ponderada do que a de qualquer um dos fornecedores. A Artificial Analysis constatou que o GPT-6 Sol reduz aproximadamente pela metade o custo por tarefa em comparação com o GPT-5.6 Sol, ao mesmo tempo que produz uma mistura de ganhos e regressões — incluindo regressões no GDPval-AA v2.1. Um modelo que troca capacidade em alguns pontos por uma grande redução de custos é um modelo que muda o que você pode se dar ao luxo de executar, não um que eleva o teto em toda parte.
E o perfil de latência do GPT-6 Sol é uma verdadeira desvantagem. O tempo até o primeiro token é de 107,18 segundos, contra uma mediana do ranking de 3,87. Esse é o primeiro token mais lento do ranking, por uma grande margem. O DeepSeek V4 Pro também não é um modelo rápido, mas não está nesse patamar, e, para qualquer superfície interativa, a diferença é desqualificadora em apenas uma direção.
Pesos abertos versus uma fronteira alugada
Esta é a dimensão em que os dois modelos não estão realmente competindo. O DeepSeek V4 Pro é um MoE de 1,6 trilhão de parâmetros, com 49 bilhões de parâmetros ativos, licenciado sob MIT e disponível para download. Isso significa um custo fixo que se dilui a quase nada em volume, uma implantação que você controla e um modelo que não pode ser descontinuado à sua revelia. Também significa que você é dono da pilha de serving, da conta de GPU e de cada regressão.
O GPT-6 Sol é a aposta oposta. Você paga por token para sempre, obtém capacidade de ponta sem possuir hardware, e a OpenAI pode mudar o preço, a tabela de tarifas ou a disponibilidade com um post de blog — como fez em 22 de setembro, quando reduziu pela metade o preço do seu próprio carro-chefe. Não existe uma versão do GPT-6 Sol que você possa fixar.
A maneira correta de pensar nisso não é “qual é melhor”, mas “qual risco você prefere”. Risco de fornecedor contra risco operacional. Para uma startup sem equipe de infraestrutura e com tráfego volátil, a API é obviamente a escolha certa. Para uma organização com capacidade de GPU já existente, uma fronteira de conformidade ou uma carga de trabalho cujo volume torna o preço por token absurdo, os pesos abertos vencem só pela economia, e doze pontos do Index é um preço que vale a pena pagar.
Se você quiser parar de escolher
Há uma versão desta decisão que não exige compromisso. O DeepSeek V4 Pro está no OrcaRouter pelo preço de tabela da DeepSeek, com o modelo de repasse, o que significa que uma alteração de preço da DeepSeek — incluindo o horário de pico e fora de pico — é refletida do nosso lado no mesmo dia, em vez de depois de o revendedor renegociar. O GPT-6 Sol não está no nosso catálogo no momento em que escrevemos; é acessível pela própria API da OpenAI, portanto, uma rota que abrange ambos significa uma chave para o DeepSeek V4 Pro e uma integração direta para a OpenAI.
Essa divisão vale a pena por um motivo específico: esses dois modelos falham de maneiras diferentes. Uma implantação de pesos abertos falha quando o seu hardware falha; uma API falha quando o fornecedor falha. O failover automático entre provedores é o que transforma isso em uma tarde degradada em vez de uma indisponibilidade, e poder mover uma rota entre um modelo barato de alto rendimento e um modelo caro e cuidadoso editando uma configuração em vez de um caminho de código é o que permite acompanhar a curva de preços em vez de apostar nela.

Quem deve escolher qual
Escolha o DeepSeek V4 Pro se você tiver infraestrutura, uma fronteira de conformidade ou um problema de volume. Ele tem licença MIT, é o oitavo de 114 no índice independente, carrega 384K de espaço de saída, e sua tabela de preços não tem precipício de contexto. É a resposta correta para quem tem como restrição vinculante o custo em escala ou o controle sobre a implantação, e a diferença de doze pontos para o GPT-6 Sol é o preço disso.
Escolha o GPT-6 Sol se você precisa da fronteira e seu contexto fica abaixo de 272K tokens. Ele pontua 48 contra 36, gera tokens cerca de 50% mais rápido e, a US$ 2/US$ 10, é o modelo de topo mais barato que a OpenAI já fez. Só saiba o que está comprando: uma espera de cem segundos pelo primeiro token, uma camada de contexto longo que dobra a tarifa e um modelo cuja avaliação independente é uma mistura de ganhos e regressões, em vez de um avanço claro.
E se a resposta for "ambos, dependendo da solicitação", isso não é indecisão. É a arquitetura correta para um mercado em que dois fornecedores reduziram pela metade os preços de seus produtos carro-chefe em um intervalo de seis semanas entre si, e nenhum dos dois parou de se movimentar.

Comparados neste artigo3
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
