Cartão de título de destaque para a página de referência do Grok 4.7: o título "Grok 4.7: A Página de Referência" acima do subtítulo "O modelo de raciocínio carro-chefe da SpaceXAI, lançado em 21 de setembro de 2026", depois três cartões arredondados com os textos "Contexto: 500K tokens", "Preço por 1M: $2.00 entrada / $6.00 saída" e "Inteligência AA: 46", com uma linha de rodapé lendo "Especificações e preço conforme os documentos da SpaceXAI; Índice AA conforme a Artificial Analysis v4.3.2." e o logotipo da OrcaRouter no canto inferior direito.
Guides & Insights

O que é o Grok 4.7? Especificações, preço, janela de contexto e benchmarks

Autor

Gideon Frost

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Grok 4.7 é o modelo principal atual da SpaceXAI: um modelo de raciocínio que recebe texto e imagens, retorna texto, possui uma janela de contexto de 500.000 tokens e custa US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída, com esforço de raciocínio selecionável em quatro níveis. Ele sucede Grok 4.6, iguala-o exatamente em preço e contexto, e é voltado para o trabalho de longo horizonte — codificação de várias horas, loops de ferramentas agênticas, trabalho de conhecimento profissional — em torno do qual a empresa agora vende toda a sua linha de produtos. Esta página é a entrada de referência para ele: o que o modelo é, onde se situa, o que aceita, quanto custa, e então duas coisas mantidas deliberadamente separadas — o que a SpaceXAI diz sobre seu próprio modelo, e o que um avaliador independente mediu.

Por que isto é uma página de referência e não uma notícia de lançamento. O Grok 4.7 foi lançado em 21 de setembro de 2026, e esse lançamento já foi abordado neste blog (veja o artigo grok-4-7-release-date para a leitura do primeiro dia), então a data abaixo é usada como um fato que data o modelo, não como um evento sendo noticiado novamente. O leitor para quem esta página existe é aquele que digita o nome simples do modelo em uma caixa de busca e quer o modelo, não a notícia: nos 28 dias até 25 de setembro de 2026, os dados do nosso próprio Search Console registram 31.934 impressões na consulta exata "grok 4.7" e 34.160 em todas as grafias que se reduzem a esse nome, alcançando uma posição média de 7,8 sem nenhuma página dedicada para onde direcionar. Isso é uma medição do que as pessoas digitam — não diz nada sobre quão bom o modelo é — e é por isso que a página começa com a pergunta mais simples possível. Cada número neste artigo é rotulado pela sua origem: relatado pelo fornecedor para qualquer coisa dos próprios documentos, post de lançamento ou página de preços da SpaceXAI, independente para a Artificial Analysis, e nosso próprio para o que nosso catálogo e nossos dados de busca mostram.

Onde o Grok 4.7 se posiciona na linha Grok

O fornecedor agora escreve seu nome como SpaceXAI tanto na documentação para desenvolvedores quanto na página de notícias, enquanto a própria API continua sendo servida a partir de api.x.ai e o identificador do modelo ainda é um grok. O Grok 4.7 está no topo da linha de texto e é a própria recomendação padrão do fornecedor: quando perguntado qual modelo escolher, a página de modelos responde que, para tudo exceto trabalhos de áudio, imagem e vídeo — "incluindo código" — você deve usar o Grok 4.7, porque "é o modelo mais capaz que já construímos". Seus irmãos, segundo as próprias tarifas publicadas pelo fornecedor por milhão de tokens, são:

• Grok 4.6 — contexto de 500K, US$ 2,00 de entrada / US$ 0,50 em cache / US$ 6,00 de saída, lançado em agosto de 2026. O antecessor direto e o modelo em relação ao qual o 4.7 é precificado.

• Grok 4.5 — contexto de 500K, US$ 2,00 de entrada / US$ 0,30 em cache / US$ 6,00 de saída, lançado em julho de 2026. Mesmo preço de tabela que seus sucessores, mas uma taxa de cache mais barata, que agora é a única razão concreta para ainda escolhê-lo.

• Grok 4.3 — contexto de 1M, US$ 1,25 de entrada / US$ 0,20 em cache / US$ 2,50 de saída. Metade do preço do atual carro-chefe e o dobro da janela de contexto dele.

• Grok 4.20 (variantes de raciocínio, sem raciocínio e multiagente) — contexto de 1M, US$ 1,25 de entrada / US$ 0,20 em cache / US$ 2,50 de saída.

• Grok Build 0.1 — contexto de 256K, $1,00 de entrada / $0,20 em cache / $2,00 de saída. Um especialista em programação em vez de um modelo generalista, e o modelo padrão do agente Grok Build é o Grok 4.7, não este.

Então, o formato da linha atual é um trade-off entre capacidade e janela: o carro-chefe oferece 500K de contexto a $2/$6, e o nível 4.3/4.20 oferece um milhão inteiro de tokens a aproximadamente metade do preço de entrada e menos da metade do preço de saída. Nada na documentação do fornecedor sugere que o Grok 4.7 seja uma arquitetura diferente do Grok 4.6 — o que o lançamento descreve é um modelo base maior, uma execução de aprendizado por reforço mais longa e ponderada para tarefas que levam muitas horas para serem concluídas, melhor autoverificação, melhor tratamento de contexto longo e treinamento no harness do Grok Bot para que o modelo se comporte melhor em trabalho conversacional e de conhecimento geral. Uma alegação de melhoria, não um novo design. A SpaceXAI não publica nenhuma contagem de parâmetros para o Grok 4.7 nem em sua página de modelo nem em sua tabela de preços, e esta página não vai adivinhar uma.

Quando foi lançado, e o que veio com ele.

O post de lançamento está datado de 21 de setembro de 2026, e a página do modelo para desenvolvedores traz a mesma data de sua última atualização, o que é o máximo de precisão que se consegue — a SpaceXAI não publica um carimbo de data e hora de lançamento além do dia. O que foi lançado naquele dia não foi apenas um identificador de modelo. grok-4.7 slug entrou no ar tanto na Responses API quanto no Chat Completions com uma janela de contexto de 500.000 tokens, um corte de conhecimento de maio de 2026, quatro níveis de raciocínio, incluindo uma nova configuração máxima, uma variante Fast restrita a duas superfícies próprias, um endpoint regional exclusivo para os EUA e preços de tabela idênticos aos do Grok 4.6. Ele foi simultaneamente definido como o modelo padrão do agente de programação Grok Build e disponibilizado no Cursor em todos os planos. Se você quer a reação do primeiro dia em vez da especificação, o grok-4-7-release-date aborda esse assunto; esta página toma a mesma data como um fato sobre o modelo e segue para o que ele realmente fará por você.

O envelope: o que você pode enviar e quanto dele

Tudo o que se segue vem da própria página do modelo e da página de modelos da SpaceXAI, lidas em 28 de setembro de 2026, salvo indicação em contrário.

Screenshot of SpaceXAI's developer documentation page for grok-4.7, showing the model identifier grok-4.7, the tagline describing it as SpaceXAI's frontier model built for coding, agentic tasks and knowledge work, an At a glance block with Context, Modalities, Training data and Pricing rows, an Important details section, a Fast variant note, and a Where it runs list, plus a Python code sample setting the model name to grok-4.7 in the xai_sdk client.

• Janela de contexto — 500.000 tokens. Igual ao Grok 4.6, metade do que o Grok 4.3 e a família 4.20 oferecem.

• Data de corte de conhecimento — maio de 2026, três meses depois do Grok 4.6. Qualquer coisa mais recente exige uma ferramenta de busca ativada; o modelo não tem percepção em tempo real por padrão.

• Entrada — texto e imagem. As imagens podem ser JPG/JPEG ou PNG, de até 20 MiB cada, e o fornecedor não documenta nenhum limite para o número de imagens em uma solicitação; imagem e texto podem aparecer em qualquer ordem.

• Saída — apenas texto. Não há geração de imagem, áudio ou vídeo neste modelo; esses são modelos separados da linha SpaceXAI.

• Teto de saída — o fornecedor afirma que não há nenhum limite de saída de texto. A nossa própria ficha de modelo do OrcaRouter para o grok-4.7 indica uma saída máxima de 450 000 tokens, e os dois valores não coincidem. Estamos a assinalá-lo em vez de escolher um deles em silêncio: a documentação da SpaceXAI é a autoridade sobre o modelo da SpaceXAI, e a leitura honesta é que o fornecedor não publica um limite de saída de texto.

• Controle de raciocínio — reasoning_effort aceita low, medium, high (o padrão do fornecedor) ou xhigh. O xhigh é novo nesta geração; o Grok 4.6 também oferecia quatro níveis, e os números de benchmark publicados para o 4.7 são citados em xhigh.

• Ferramentas — chamada de funções, pesquisa na web, pesquisa no X e execução de código, todas documentadas como ferramentas do lado do servidor.

• Saída estruturada — o fornecedor documenta uma capacidade de saídas estruturadas junto com a geração de texto; nossa própria página a expõe como response_format e structured_outputs.

• Parâmetros que nossa página aceita — include_reasoning, logprobs, max_tokens, reasoning, reasoning_effort, response_format, seed, structured_outputs, temperature, tool_choice, tools, top_logprobs e top_p. Uma ressalva que vale a pena saber antes de basear-se em logprobs: a página de modelos da SpaceXAI afirma que logprobs e top_logprobs não são suportados por grok-4.20 e modelos mais recentes e "serão silenciosamente ignorados se definidos", o que abrange o Grok 4.7. O fato de nossa página listá-los não é uma promessa de que o upstream os retorne.

• Endpoints — a API de Chat Completions compatível com a OpenAI e a API Responses.

• Cache de prompt — o fornecedor recomenda definirprompt_cache_key na API Responses (o cabeçalho x-grok-conv-id no Chat Completions) para que as requisições de uma conversa cheguem ao mesmo servidor; sem isso, a documentação alerta, você muitas vezes paga o preço cheio de entrada em um servidor com cache frio. A entrada em cache é cobrada a $0,50 por milhão de tokens abaixo do limite de 200K.

• Raciocínio criptografado — na API Responses, o Grok 4.7 sempre retorna reasoning.encrypted_content, mesmo quando você não solicita isso, para que chamadas de vários turnos mantenham o raciocínio do modelo sem configuração extra. Chat Completions permanece inalterado.

A tabela de preços, na íntegra

A precificação é escalonada pelo tamanho do prompt, e o limite passa a valer para a solicitação inteira assim que é ultrapassado, não apenas para os tokens acima da linha. Todos os valores aqui são publicados pelo fornecedor, extraídos da página de preços da SpaceXAI em 28 de setembro de 2026:

• Padrão, prompts com menos de 200K tokens — $2,00 de entrada / $0,50 de entrada em cache / $6,00 de saída por milhão de tokens.

Contexto longo, prompts de 200K ou mais — US$ 4,00 de entrada / US$ 1,00 em cache / US$ 12,00 de saída por milhão de tokens.

• Grok 4.7 Fast — o mesmo modelo em infraestrutura mais rápida, com o dobro das tarifas padrão: US$ 4,00 / US$ 1,00 / US$ 12,00 abaixo de 200K, e US$ 6,00 / US$ 1,50 / US$ 18,00 acima disso. Ele está disponível apenas através do Cursor e do Grok Build, não está na API pública de forma alguma, e o nível gratuito do Grok Build não o inclui.

• US regional endpoint — https://us.api.x.ai/v1 keeps inference in the United States and bills at 1.1×, which works out to $2.20 / $0.55 / $6.60 per million below 200K and $4.40 / $1.10 / $13.20 above. Only grok-4.7 and grok-4.6 are served there today.

Lido em comparação com o restante do mercado, o interessante não é a tarifa anunciada — US$ 2 de entrada e US$ 6 de saída é exatamente o que o Grok 4.6 cobrava e o que o Grok 4.5 ainda cobra —, mas sim o desconto de cache, que o fornecedor divulga como 75% de desconto sobre a entrada para prefixos de prompt repetidos. Para um loop de agente longo que reenvia o mesmo prompt de sistema e contexto de arquivo a cada turno, esse desconto é a diferença entre o preço de tabela e a conta. É também a única linha em que o Grok 4.7 é pior que seu irmão mais velho: o Grok 4.5 faz cache a US$ 0,30 por milhão, contra US$ 0,50 do Grok 4.7.

O Grok 4.7 está no OrcaRouter como grok/grok-4.7 ao preço de tabela da própria SpaceXAI com 0% de markup — o preço do provedor é repassado, então uma mudança de preço do fornecedor entra em vigor aqui no mesmo dia, e não após uma passagem de reajuste. Isso importa mais do que o de costume em um modelo com limite de prompt de dois níveis e uma taxa de cache, porque ambos alteram o que você realmente paga. É uma única chave e um único endpoint compatível com OpenAI para toda a linha Grok, então trocar uma carga de trabalho do Grok 4.7 para o Grok 4.5 ou 4.3 para testar a diferença de custo é uma mudança de string em vez de um segundo contrato.

O que a SpaceXAI reivindica para isso

Tudo nesta seção foi relatado pelo fornecedor. Nada disso foi reproduzido de forma independente, e a configuração de esforço importa — a tabela no post de lançamento cita Grok 4.7 em xHigh, Grok 4.6 em High, e os dois modelos de comparação em Max, o que não é uma comparação pareada.

• CursorBench 4.0 — 46,3% para o Grok 4.7 em xHigh, contra 40,4% para o Grok 4.6 em High. A própria caracterização do post de lançamento é que é aqui que o Grok 4.7 está "na fronteira em preço-desempenho".

• Terminal-Bench 4.0 — 37,6%, contra 20,3% do Grok 4.6. O maior delta isolado do lançamento, e o que corresponde à afirmação de "RL mais longo em tarefas mais difíceis".

• DeepSWE v1.1 — 71,0%, marcado na própria tabela do fornecedor como uma pontuação de alto esforço, contra 65,2% do Grok 4.6.

• AA Briefcase v1.1 — 1.657, contra 1.546 do Grok 4.6. Observe a colisão de nomes aqui: este é o fornecedor citando um benchmark que a Artificial Analysis também executa, e o resultado independente é discutido na próxima seção.

• EEBench — 64,0%, contra 53,0% do Grok 4.6.

• Harvey Legal Agent Benchmark — 19,6%, contra 15,8% do Grok 4.6.

• HealthBench Professional — 56,7%, contra 48,5% do Grok 4.6.

• GDPval — 1.695 Elo em xhigh, contra 1.605 do Grok 4.6 em high.

As alegações de segurança também são relatadas pelo fornecedor e são excepcionalmente específicas: a SpaceXAI diz que o Grok 4.7 foi construído sobre uma nova pilha de salvaguardas, que lidera o benchmark de biossegurança da LatchBio com 62,4% e que, em seu próprio HackerBench v0.3, deixa passar apenas 3,3% dos prompts arriscados de uso dual, ao mesmo tempo que raramente bloqueia trabalho de segurança legítimo. A empresa também diz que começou a dar a parceiros selecionados de cibersegurança acesso apenas por convite às capacidades de red team do modelo. Trate tudo isso como testes do próprio fornecedor sobre o próprio modelo — é um conjunto de alegações específico o suficiente para ser verificado mais tarde, o que não é o mesmo que verificado agora. O posicionamento em uma linha no post de lançamento, "duas vezes mais rápido, pela metade do preço de modelos comparáveis", é marketing sobre rivais, e não uma medição do Grok 4.7, e o número independente de velocidade abaixo não sustenta a metade "duas vezes mais rápido" disso.

A single-column scoreboard card for Grok 4.7 titled "Grok 4.7 - the scoreboard" with six rows: Context window 500K tokens; Knowledge cutoff May 2026; Reasoning levels low / medium / high / xhigh; Price per 1M $2.00 in / $6.00 out; AA Intelligence Index 46, #21 of 211; Output speed 82.6 tokens/sec. Footer: "Rows 1-4 vendor-reported; AA Index and speed per Artificial Analysis v4.3.2, xhigh configuration."

O que um avaliador independente mediu

A Artificial Analysis é a única fonte nesta história sem nenhum interesse no modelo, e sua página do Grok 4.7 é explicitamente a configuração xhigh. Leitura em 28 de setembro de 2026:

• Inteligência — 46 no Artificial Analysis Intelligence Index, versão do índice v4.3.2, o que o coloca em 21º entre 211 modelos nesse ranking e bem acima da mediana de 26 do índice. Esse índice é um composto de dez avaliações: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience e AA-LCR v1.1.

• Custo — US$ 3,74 para executar o Intelligence Index uma vez, com o mesmo avaliador divulgando o desconto de cache em 75% e uma tarifa de entrada/saída igual à do fornecedor (US$ 2,00 / US$ 6,00). O próprio comentário é que o modelo tem um "preço razoável quando comparado a outros modelos de preço semelhante".

• Verbosidade — 240M tokens de saída gerados no Intelligence Index, contra uma mediana de 88M. A Artificial Analysis chama isso de "muito verboso", e este é o número mais útil aqui para quem faz orçamento: um modelo que pensa em cadeias mais longas custa mais por tarefa mesmo a uma taxa fixa de tokens.

• Velocidade — 82,6 tokens de saída por segundo, 83º de 211 naquele quadro, que o avaliador, ainda assim, rotula como "mais lento que a média". Duas ressalvas antes de levar este número a qualquer lugar. A Artificial Analysis mudou sua carga de trabalho padrão de benchmarking para uma entrada de 10.000 tokens, a fim de refletir melhor o uso em produção, e sua leitura de velocidade publicada para este modelo variou significativamente entre snapshots, então trate-a como um instantâneo de uma carga de trabalho, e não como uma constante. Do lado dos provedores de API, o mesmo avaliador tem apenas um provedor listado para o modelo — a própria SpaceXAI —, então sua latência medida e seu preço combinado são valores de origem própria, e não um spread de mercado.

Nosso próprio catálogo traz mais três resultados da Artificial Analysis para o Grok 4.7, avaliados em 21 de setembro de 2026: 43,1% no Humanity's Last Exam, 76,7% na avaliação de recall de contexto longo e 57,4% no SciCode. Esses são rotulados como independentes porque vêm da Artificial Analysis, e vale a pena lê-los lado a lado com as alegações de autoverificação do fornecedor, em vez de como confirmação delas.

A nota honesta de comparação: os números da SpaceXAI e os números da Artificial Analysis foram produzidos em harnesses diferentes, com configurações de esforço diferentes, e os dois não foram executados frente a frente em uma configuração equivalente. Onde o mesmo nome de benchmark aparece nos dois lados — AA Briefcase, Terminal-Bench 4.0 —, trata-se de um nome compartilhado, não de uma execução compartilhada. Qualquer pessoa que cite um número de fornecedor ao lado de um número independente como se fossem uma única medição está fazendo uma aritmética que as evidências não sustentam.

Onde você pode realmente chamar isso.

O Grok 4.7 pode ser chamado desde o dia do lançamento por meio da própria API da SpaceXAI em api.x.ai, usando a Responses API ou o Chat Completions, e pelo endpoint regional exclusivo dos EUA, com um acréscimo de 10%. É o modelo padrão do agente de codificação Grok Build e está disponível no Cursor em todos os planos, com a variante Fast — o mesmo modelo pelo dobro da tarifa — restrita a essas duas superfícies e ausente da API pública. Além do acesso primário, o fornecedor descreve-o como disponível por meio de harnesses de codificação de terceiros, roteadores de modelos e plataformas de nuvem.

Do nosso lado especificamente: grok/grok-4.7 já está disponível no catálogo da OrcaRouter hoje, com preço nas tarifas de tabela da própria xAI, com 0% de markup e pode ser chamado em qualquer um dos endpoints através da mesma chave que o resto da linha Grok. Se você está avaliando-o em comparação com o Grok 4.6 — mesmo preço, mesma janela, um modelo diferente por baixo — rotear ambos através de um único endpoint com uma cadeia de failover automática é a maneira barata de descobrir qual deles a sua carga de trabalho realmente prefere, em vez de comprometer um caminho de produção com o modelo mais novo com base na tabela de um fornecedor.

Screenshot of the OrcaRouter model page for grok/grok-4.7, showing the SpaceXAI provider label, the 500K-token context window and 450K maximum output, capability tags for Vision, Tools, JSON and Reasoning, the $2.00 per million input and $6.00 per million output rates, the Public benchmarks panel dated 2026-09-21 with an AA Intelligence figure of 46.4, and the /v1/chat/completions and /v1/responses endpoints.

O que observar, dado quão escasso o histórico ainda é. A SpaceXAI não publicou nenhuma contagem de parâmetros, e a questão do teto de saída está genuinamente em aberto — o "sem limite de saída de texto" do fornecedor em contraste com os 450K que nossa própria página mostra é uma discrepância que ninguém resolveu ainda. Não há um confronto direto com harness pareado contra os modelos com os quais é vendido. E a leitura de velocidade acima é o número com maior probabilidade de mudar, porque já mudou. Esses são os três pontos em que esta página precisará de edição conforme o histórico for preenchido, e é melhor dizer isso do que fingir que a especificação está definida.

O Grok 4.7 já pode ser roteado no OrcaRouter hoje, e o mesmo vale para o Grok 4.6, o Grok 4.5, o Grok 4.3 e a família Grok 4.20. OrcaRouter repassa o preço de tabela do provedor sem nenhuma margem, então o limite de prompt de dois níveis da SpaceXAI e sua taxa de cache chegam ao nosso lado no mesmo dia em que mudam no lado deles, e testar uma carga de trabalho com os modelos Grok mais antigos e mais baratos é uma mudança de string, não um segundo contrato.

Comparados neste artigo3

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente