
GPT-6 Sol vs Grok 4.7: O token mais barato que custa três vezes mais
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Dois modelos foram lançados com um dia de diferença em setembro de 2026 e, no preço de tabela, eles não estão nem perto. Grok 4.7 chegou em 21 de setembro a US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída. GPT-6 Sol chegou em 22 de setembro com os mesmos US$ 2,00 de entrada e US$ 10,00 de saída. A saída do Grok é 40% mais barata. Essa é a base inteira pela qual a maioria das comparações vai escolhê-lo, e é o número errado de se observar.
O número que decide este emparelhamento não está em nenhuma das tabelas de preços. É 240 milhões contra 77 milhões — os tokens de saída que cada modelo gerou enquanto a Artificial Analysis executava seu Intelligence Index. O Grok 4.7 consumiu pouco mais de três vezes mais tokens para responder ao mesmo conjunto de perguntas. Multiplique isso pela tarifa por token e o modelo com a saída mais barata acaba custando $3.74 por tarefa concluída contra $1.06. Mais barato por token, mais de três vezes a conta.
O que cada modelo realmente é
Grok 4.7 é o sucessor do Grok 4.6 da xAI, posicionado como seu modelo mais forte de programação e trabalho intelectual, com uma janela de contexto de 500.000 tokens, entrada de texto e imagem, saída de texto e esforço de raciocínio configurável entre baixo, médio, alto e xhigh. A xAI não divulgou o número de parâmetros. Ele aceita uma data de corte de pré-treinamento relatada como junho de 2026, com treinamento complementar até agosto.
GPT-6 Sol é o modelo GPT-6 de gama média da OpenAI — abaixo do carro-chefe GPT-6 Astra, acima do econômico GPT-6 Luna — com uma janela de contexto de 1.050.000 tokens, entrada máxima de 922.000 tokens, teto de saída de 128.000 tokens e data de corte de conhecimento em 20 de abril de 2026. Ele recebe texto e imagem e gera texto, com esforço de raciocínio de nenhum a máximo, e a OpenAI descreveu seu preço como permanente, e não promocional.
As janelas de contexto não estão nem perto. A do Sol é aproximadamente o dobro. Isso importa para exatamente uma classe de carga de trabalho, e não é a classe que a maioria das pessoas executa.
A tabela de tarifas, e a linha que a inverte
• Entrada — GPT-6 Sol US$ 2,00 por milhão de tokens vs Grok 4.7 US$ 2,00 por milhão de tokens; idêntico
• Saída — GPT-6 Sol US$ 10,00 por milhão de tokens vs. Grok 4.7 US$ 6,00 por milhão de tokens; Grok é 40% mais barato
• Entrada em cache — GPT-6 Sol $0,20 por milhão de tokens vs Grok 4.7 $0,50 por milhão de tokens; a leitura de cache do Sol é mais barata por um fator de dois e meio, o que é o oposto do que a tarifa de saída implica
• Gravações de cache — GPT-6 Sol $2,50 por milhão de tokens vs Grok 4.7, uma tarifa não publicada na mesma planilha
• Janela de contexto — GPT-6 Sol 1.050.000 tokens vs Grok 4.7 500.000 tokens
• Sobretaxa de contexto longo — O GPT-6 Sol repreficica uma solicitação acima de 272.000 tokens de entrada cobrando 2× as tarifas de entrada e de cache e 1,5× a tarifa de saída para toda a solicitação, em comparação com o Grok 4.7, que dobra todas as tarifas a 200.000 tokens de entrada, também para toda a solicitação
• Data de corte de conhecimento — GPT-6 Sol, 20 de abril de 2026 vs. Grok 4.7, um corte de pré-treinamento relatado como junho de 2026, com treinamento suplementar até agosto
• Esforço de raciocínio — GPT-6 Sol nenhum, baixo, médio (padrão), alto, xhigh, máx vs Grok 4.7 baixo, médio (padrão), alto, xhigh
• Modalidade — texto e imagem como entrada, texto como saída, para ambos
A linha de cache é aquela em que um comprador deve se concentrar. A tarifa de saída do Grok é menor, mas sua entrada em cache é duas vezes e meia a do Sol, e a entrada em cache é onde vivem históricos longos de agentes e prompts de sistema repetidos. Uma carga de trabalho que consiste majoritariamente em reler um contexto grande e estável verá os dois muito mais próximos do que $6 contra $10 sugere — e, quando a proporção de volume de tokens é aplicada por cima disso, a ordem se inverte.

Por que 240 milhões de tokens é a história completa
A Artificial Analysis mediu o Grok 4.7 no xhigh gerando aproximadamente 240 milhões de tokens de saída ao longo de sua execução de índice, contra uma mediana de cerca de 88 milhões para os modelos no mesmo painel. O próprio resumo da Artificial Analysis chama o modelo de "notavelmente lento e muito prolixo". O GPT-6 Sol, medido no mesmo harness, gerou 77 milhões — descrito no painel como "razoavelmente conciso".
O painel também informa a consequência diretamente. O Grok 4.7 marca 46 no Intelligence Index a US$ 3,74 por tarefa. Na configuração alta, a pontuação também é 46 e o custo é de US$ 2,73 por tarefa. O GPT-6 Sol marca 48 a US$ 1,06 por tarefa. Mesmo índice, mesma estrutura de avaliação, e uma diferença de custo de duas a três vezes e meia que nenhuma tabela de preços mostra.
Duas ressalvas antes de tratar esses números como uma comparação direta limpa. As duas páginas foram capturadas no mesmo dia, mas os rankings trazem totais diferentes — a página do Grok mostra uma classe de 212 modelos, e uma listagem separada do Grok informa uma posição num universo de 655 —, então não há garantia de que as duas pontuações estejam no mesmo build do índice. E nenhum dos valores é um número divulgado pelo fornecedor: a Artificial Analysis executa o próprio harness, o que é justamente o ponto, mas as configurações de raciocínio diferem entre as duas listagens (xhigh para o Grok, max para o Sol), então trate a diferença de custo de quinhentos por cento como o resultado principal e a diferença de dois pontos no índice como aproximada.

O que a xAI publicou, e o que ninguém verificou
Os próprios números de lançamento da xAI são fortes e, como todos os números de lançamento de fornecedores, não reproduzidos. CursorBench 4.0 a 46,3% em xhigh, contra 40,4% do Grok 4.6. Terminal-Bench 4.0 a 38,0%, contra 20,3% — o maior ganho individual do lançamento. DeepSWE v1.1 a 71,0% em high, contra 65,2%. EEBench a 64,0%, contra 53,0%. Esses são o ambiente de testes da xAI, as configurações da xAI, os relatórios da xAI.
Os números da OpenAI para o GPT-6 Sol seguem o mesmo padrão e merecem o mesmo desconto. A diferença é que o Sol tem uma evidência independente a mais do que o Grok: o valor de custo por tarefa da Artificial Analysis, que é calculado a partir do consumo de tokens medido, e não da tabela de pontuação de um fornecedor. Esse é o número que sobrevive a esta comparação.
O que ninguém publicou para nenhum dos dois modelos é uma comparação direta nas mesmas tarefas, com o mesmo harness e a mesma configuração de esforço. Se você vir uma, verifique qual dessas três variáveis mudou.
Precificando um mês de tráfego de agente em cache
Considere uma carga de trabalho com contexto majoritariamente estável: um agente de programação com um prompt de sistema e resumo de repositório de 60.000 tokens, relido em 5.000 chamadas por mês, cada uma retornando 4.000 tokens de saída. Presuma que o cache funciona e que o prefixo estável é cobrado à tarifa de cache.
No GPT-6 Sol: 300 milhões de tokens de entrada em cache a $0,20 por milhão dá $60,00. Vinte milhões de tokens de saída a $10,00 por milhão dá $200,00. Total: $260,00.
No Grok 4.7: os mesmos 300 milhões de tokens de entrada em cache a $0,50 por milhão totalizam $150,00. Vinte milhões de tokens de saída a $6,00 por milhão totalizam $120,00. No total, $270,00.
Praticamente idêntico — e isso com o volume de tokens mantido constante, que é a suposição generosa. A verbosidade medida do Grok 4.7 na execução do índice foi três vezes a do Sol. Aplique até mesmo um multiplicador de 1,5× ao volume de saída e a conta do Grok vai para US$ 330,00 contra US$ 320,00 do Sol, e a diferença aumenta a partir daí. A tarifa de saída mais barata não sobrevive ao cache somado à verbosidade; mal sobrevive apenas ao cache.
Nada aqui é uma afirmação sobre o preço de qualquer um dos modelos através da OrcaRouter — nenhum dos dois está no nosso catálogo. O GPT-6 Sol é acessível através da própria API da OpenAI e o Grok 4.7 através da xAI; o resto da linha Grok, incluindo o Grok 4.6, é encaminhável através de nós ao preço de tabela da xAI no modelo de repasse. O objetivo da aritmética é que a regra de escalonamento que escrever deve basear-se no custo por tarefa concluída no seu próprio tráfego, não na tabela de preços — e uma camada de encaminhamento é o que lhe permite testar essa regra sem um segundo contrato.

Onde cada um pertence
• Trabalho de agente de alto volume com contexto em cache — GPT-6 Sol. A linha de entrada em cache está 2,5× a favor do Sol, e a linha de volume de saída é pior do que isso na do Grok, e elas se acumulam.
• Trabalho de programação em que você quer a melhoria publicada mais forte no Terminal-Bench nesta versão — Grok 4.7 é o modelo com o número, e é um número grande. Apenas calcule o orçamento para os tokens, não para a taxa.
• Documentos longos acima de 500.000 tokens — GPT-6 Sol, e não é nem de perto. A janela do Grok termina onde a do Sol está na metade.
• Caminhos sensíveis à latência — nenhum dos dois. A Artificial Analysis lista o Grok 4.7 com 39,2 tokens de saída por segundo, o que descreve como notavelmente lento. Confira o próprio valor de velocidade do Sol na tabela atual antes de presumir que ele é melhor.
• Se lhe mostraram uma comparação por token que termina com "então o Grok é mais barato" — ela terminou um passo cedo demais. O próximo passo é a contagem de tokens.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
