
O que é o Grok 4.5? O carro-chefe V9 que vendeu economia de tokens em vez de pontuações máximas
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok 4.5 é um modelo de raciocínio de mistura de especialistas com 1,5 trilhão de parâmetros do fornecedor — a empresa que agora distribui e comercializa sob a marca SpaceXAI — lançado em 8 de julho de 2026. Ele recebe texto e imagens, retorna texto, tem uma janela de contexto de 500.000 tokens e custa US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de saída. Foi o modelo que colocou "tokens por tarefa concluída" na frente de um slide de lançamento, e é o modelo sobre o qual o laboratório construiu, desde então, dois novos carros-chefe.
Essa última cláusula é a razão pela qual esta página precisa ser escrita. Pesquise por "Grok 4.5" e você encontra a cobertura de lançamento de julho: a parceria com o Cursor, a citação "classe Opus", a alegação de 80 tokens por segundo. O que você não encontra é uma resposta direta à pergunta que um desenvolvedor realmente tem no final de setembro, que é se o Grok 4.5 ainda vale a pena ser integrado em qualquer coisa quando o Grok 4.6 e o Grok 4.7 existem pelo mesmo preço de tabela. Portanto, esta página é uma entrada de referência, não uma matéria jornalística: o que o modelo é, onde ele se posiciona, o que ele faz comprovadamente bem, o que ele faz comprovadamente mal, e quem deveria escolher outra coisa. Nada aqui é apresentado como um lançamento, porque não é um.
Sobre a procedência das informações, já que ela importa mais do que o habitual em uma página como esta: cada número abaixo é rotulado de acordo com sua origem. Os números que a xAI publicou sobre seu próprio modelo estão marcados como relatados pelo fornecedor. Os números da Artificial Analysis são medições independentes, lidas diretamente da página do modelo em 23 de setembro de 2026. Quando um número não pôde ser confirmado em uma fonte primária, a página diz isso em vez de estimar.
Onde o Grok 4.5 se posiciona em sua própria família — e não é o topo
O erro mais comum e mais frequente na cobertura do Grok 4.5 é tratá-lo como o modelo principal. Ele foi, por cerca de cinco semanas. Desde então, a xAI lançou o Grok 4.6 em 12 de agosto de 2026 e o Grok 4.7 no início de setembro, ambos ainda com preço de US$ 2,00 e US$ 6,00 por milhão de tokens. O Grok 4.5 agora está no meio da pilha: mais capaz que o nível barato, duas gerações atrás da linha de frente e — esta é a parte que importa — o único modelo na atual linha Grok cuja tarifa de entrada em cache é mais barata que a de seus sucessores. O Grok 4.5 cobra US$ 0,30 por milhão de tokens para cache; o Grok 4.6 e o Grok 4.7 cobram US$ 0,50, segundo a própria tabela de preços da xAI.
Aqui está a linha como a documentação de preços do fornecedor atualmente a lista, todos os valores por milhão de tokens e todos publicados pelo fornecedor:
• Grok 4.20 (três variantes: multiagente, raciocínio, sem raciocínio) — contexto de 1M, $1,25 de entrada / $2,50 de saída, $0,20 em cache, lançado em 31 de março de 2026
• Grok 4.3 — 1M de contexto, $1,25 de entrada / $2,50 de saída, $0,20 em cache, além de desconto em lote; a forma mais barata de obter um milhão de tokens de contexto do Grok
• Grok 4.5 — 500K de contexto, $2.00 de entrada / $6.00 de saída, $0.30 em cache, lançado em 8 de julho de 2026
• Grok 4.6 — contexto de 500K, $2,00 de entrada / $6,00 de saída, $0,50 em cache, lançado em 12 de agosto de 2026
• Grok 4.7 — contexto de 500K, US$ 2,00 de entrada / US$ 6,00 de saída, US$ 0,50 em cache, lançado no início de setembro de 2026
• Grok Build 0.1 — contexto de 256K, US$ 1,00 de entrada / US$ 2,00 de saída, um especialista em programação em vez de um modelo generalista
Duas coisas decorrem dessa lista. Primeiro, o Grok 4.5 não sofreu redução de preço quando deixou de ser o carro-chefe — manteve o preço de carro-chefe, o que significa que o Grok 4.6 é agora estritamente melhor custo-benefício pelo mesmo dinheiro, a menos que você queira especificamente a taxa de cache mais barata ou esteja preso ao snapshot do 4.5. Segundo, o Grok 4.5 tem metade do contexto do Grok 4.3 e da família 4.20, pelo dobro do preço de entrada. A base V9 é a razão: 1,5 trilhão de parâmetros, aproximadamente três vezes o tamanho do Grok 4.3, e um modelo base maior foi o que comprou a capacidade ao custo da janela.
Se o que você realmente precisa é de contexto longo com orçamento limitado, o Grok 4.3 é a resposta honesta dentro desta família, e o Grok 4.5 não é. Essa troca — capacidade versus janela — é a decisão decisiva na linha Grok, e vale a pena afirmá-la sem rodeios em vez de fingir que o número mais novo é melhor em tudo.
A ficha técnica

Estas são as especificações que a xAI publica na página do seu próprio modelo, não estimativas de terceiros:
• Identificador do modelo — grok-4.5, com os aliases grok-4.5-latest e grok-build-latest
• Modalidade — texto e imagem como entrada, texto como saída. Imagens são aceitas como entrada; o modelo não as gera
• Janela de contexto — 500.000 tokens, compartilhados entre o prompt e a resposta, em vez de 500 mil de entrada mais uma cota de saída separada.
• Licença — proprietária. Não há pesos abertos nem checkpoint disponível para download; você acessa o Grok 4.5 por meio de uma API ou dos próprios produtos do fornecedor
• Preço de tabela — $2,00 por milhão de tokens de entrada, $6,00 por milhão de saída, $0,30 de entrada em cache
• Preços para contexto longo — a partir de 200.000 tokens de prompt, a tarifa passa para US$ 4,00 de entrada / US$ 12,00 de saída / US$ 0,60 em cache, e a tarifa mais alta se aplica a cada token na solicitação, não apenas aos tokens que ultrapassam o limite. Este é o detalhe mais caro de se deixar passar nesta página.
• Controle de raciocínio — quatro níveis, baixo, médio, alto e xhigh, com padrão alto. O raciocínio não pode ser desativado completamente, e os tokens de raciocínio são cobrados como tokens de saída
• Suporte a ferramentas e formatos — chamadas de funções e saídas estruturadas são suportadas nativamente. Ferramentas de pesquisa do lado do servidor são cobradas além do uso de tokens; não foi possível confirmar as taxas atuais por chamada na página do modelo do fornecedor, apenas que elas existem
• Limites de taxa — 150 requisições por segundo e 50 milhões de tokens por minuto
• Batch API — não suportada no Grok 4.5, ao contrário do Grok 4.3
• Regiões de serviço — us-east-1 e us-west-2 no lançamento. A disponibilidade europeia foi explicitamente indicada como indisponível no primeiro dia e foi descrita pelo fornecedor como prevista para meados de julho de 2026; não encontramos uma declaração posterior de fonte primária que confirmasse a data exata em que foi aberta, portanto, considere a linha do tempo da UE como não confirmada aqui
Uma discrepância que vale registrar em vez de atenuar: a própria entrada de catálogo da OrcaRouter para grok/grok-4.5 mostra uma taxa de leitura de cache de US$ 0,50 por milhão, que corresponde ao que a xAI cobra pelo Grok 4.6 e pelo Grok 4.7, e não aos US$ 0,30 que a tabela de preços do fornecedor apresenta para o Grok 4.5. A documentação do fornecedor é a autoridade no que diz respeito ao preço; nossa página parece estar exibindo a taxa de cache do sucessor, e isso foi sinalizado em vez de ser repetido silenciosamente aqui.
No que o Grok 4.5 é mensuravelmente bom
A alegação principal no lançamento era a economia de tokens, e é a única alegação na página de lançamento que tem um mecanismo por trás dela, em vez de apenas uma pontuação. No SWE-bench Pro, a xAI relata que o Grok 4.5 gasta em média 15.954 tokens de saída por tarefa resolvida, contra 67.020 do Claude Opus 4.8 rodando em esforço máximo — cerca de 4,2 vezes menos tokens para concluir o mesmo trabalho. Menos tokens de saída por tarefa resolvida é a diferença entre um modelo que é mais barato e um modelo que é mais barato emais rápido em termos de tempo real, porque os tokens de saída são o que você espera. Relatado pelo fornecedor, no próprio harness do fornecedor, e não reproduzido por ninguém independente — mas é uma alegação estrutural, não uma porcentagem escolhida a dedo.
A tabela de benchmark do fornecedor, publicada junto com o modelo e, portanto, com dados reportados pelo próprio fornecedor em todos os casos, apresenta-se assim em comparação com os mesmos modelos:
• DeepSWE 1.0 — Grok 4.5 62,0%, atrás do Claude Fable 5, com 66,1%, e do GPT-5.5, com 64,31%, à frente do Claude Opus 4.8, com 55,75%
• SWE Marathon, taxa de resolução — Grok 4.5 29,0%, à frente de Claude Opus 4.8 com 26,0% e de Claude Fable 5 com 24,0%. Este é o único benchmark de programação em que o Grok 4.5 liderou o campo
• Terminal-Bench 2.1 — Grok 4.5 83,3%, efetivamente no mesmo nível de Claude Fable 5, com 84,3%, e GPT-5.5, com 83,4%, à frente de Claude Opus 4.8, com 78,9%
• DeepSWE 1.1 — Grok 4.5 53%, atrás do Claude Fable 5 com 70% e do GPT-5.5 com 67%
• SWE-bench Pro — Grok 4.5 64,7%, atrás do Claude Fable 5 com 80,4% e do Claude Opus 4.8 com 69,2%
A leitura honesta é que o Grok 4.5 vence na resolução de tarefas de longo horizonte e na economia de concluir uma tarefa, e perde nos benchmarks de programação de tiro único mais difíceis. É um bom modelo para loops de agentes e um medíocre para problemas difíceis de tiro único — e essa distinção é exatamente o que o número de eficiência de tokens prevê que deveria ser.

O panorama independente é mais escasso, e é aqui que esta página precisa ter cuidado. A Artificial Analysis atualmente lista o Grok 4.5 (high) com uma pontuação de 39 no Intelligence Index, classificado em #52 de 212 modelos, na versão v4.3.2 do índice — acima da mediana de 25 para modelos comparáveis, mas não perto da frente. Se você viu uma pontuação de 54 ou 56 citada para este modelo na cobertura de julho, não a compare com 39: a Artificial Analysis revisou o índice desde o lançamento e os dois números vêm de revisões diferentes. Este é exatamente o tipo de comparação de números desatualizados que torna as tabelas de benchmarks não confiáveis, e é por isso que esta página cita a versão do índice junto com a pontuação.
Em que o Grok 4.5 é mensuravelmente ruim
A Artificial Analysis relata uma velocidade de saída de 55,1 tokens por segundo, classificada em #126 de 212 modelos e abaixo da mediana de 74 — muito longe dos 80 tokens por segundo que a xAI citou no lançamento e ainda mais longe dos ~340 tokens por segundo que os modelos atuais mais rápidos apresentam. Ela também relata um tempo até o primeiro token de 10,94 segundos contra uma mediana de 3,86 segundos. Esses dois números juntos descrevem o custo real de um modelo de raciocínio que tem o nível alto por padrão e não pode ser desativado: você espera, e depois ele fala devagar. Deixe o nível de raciocínio no padrão e o Grok 4.5 vai parecer o modelo mais lento que você tem na sua key.
Mais três negativos mensurados, em ordem de quanto deveriam afetar uma decisão:
• A Artificial Analysis sinalizou o Grok 4.5 como obsoleto e afirma que continua avaliando apenas a carga de trabalho padrão de entrada de 10.000 tokens para ele. Isso é um terceiro dizendo que parou de medir integralmente o modelo que você está considerando, e recomenda o Grok 4.6 em vez dele. Estar obsoleto em um ranking não significa estar indisponível em uma API — significa que a base de evidências independentes está congelada
• Ele perde os dois benchmarks que mais se assemelham à codificação difícil de tentativa única: DeepSWE 1.1 e SWE-bench Pro, ambos para o Claude Fable 5 e para o GPT-5.5, segundo a própria tabela da xAI
• Tem metade do contexto do Grok 4.3 pelo dobro do preço de entrada, e nenhuma API de lote. Se sua carga de trabalho for processamento de documentos longos ou inferência em lote offline, o Grok 4.5 é o modelo errado dentro da própria família
Em relação a alucinação e calibração, esta página não pôde confirmar um número independente atual. A cobertura de julho divulgou uma taxa de alucinação em torno de 54%, mas não conseguimos verificar esse número na página do modelo da Artificial Analysis que lemos, e ele também não aparece na página do fornecedor. Em vez de repetir um número cuja fonte não podemos confirmar, estamos registrando-o como não medido aqui.
Quem deve escolher o Grok 4.5, e quem deve escolher outra coisa?
Escolha o Grok 4.5 se você estiver executando loops agênticos nos quais o custo por tarefa concluída importa mais do que o custo por token, e já tiver medido que o comportamento de economia de tokens do V9 se mantém na sua carga de trabalho. Ele também é a escolha certa se você precisar de um snapshot da família Grok com uma taxa de $0.30 para entrada em cache em um prefixo grande, estável e atingido repetidamente — essa taxa de cache é genuinamente mais barata do que o que o Grok 4.6 e o Grok 4.7 cobram, e, em uma carga de trabalho com muito uso de cache, essa diferença pode superar duas gerações de capacidade.
Escolha o Grok 4.6 ou o Grok 4.7 em vez disso para quase todo o resto. Mesmo preço de tabela, mesma janela de 500K, treinamento mais recente, melhores pontuações independentes e a recomendação da própria Artificial Analysis. Não existe uma versão de "quero o melhor Grok" em que a resposta hoje seja o 4.5.
Escolha o Grok 4.3 se o contexto for a restrição: 1M de tokens a $1,25 e $2,50, com um desconto de lote que o Grok 4.5 não oferece. RAG de documentos longos e análise de repositórios completos ainda são o seu território.
Escolha algo fora da família se você está otimizando para pontuação máxima em vez de preço por tarefa — Claude Fable 5 lidera todos os benchmarks de codificação na própria tabela comparativa da xAI, e GPT-5.5 fica à frente do Grok 4.5 no DeepSWE 1.0 e 1.1. Se você quer pesos abertos e pode aceitar um modelo menor, essa é uma compra totalmente diferente, e nenhum modelo Grok compete por ela.
Chamando o Grok 4.5 sem um segundo contrato
O Grok 4.5 já está no OrcaRouter pelo preço de tabela da xAI, com a tarifa do provedor repassada sem nenhuma margem — então os $2.00 e $6.00 acima são o que você paga, e uma mudança de preço do fornecedor chega ao nosso lado no mesmo dia em que chega ao lado deles. Isso importa mais do que o habitual para este modelo em particular, porque a decisão diante da maioria dos leitores não é "Grok 4.5 ou nada", mas sim "Grok 4.5 ou Grok 4.6 ou Grok 4.3", e comparar três modelos de uma mesma família é exatamente o que um único endpoint com mais de 200 modelos torna barato. Uma única chave, nenhum segundo contrato e um teste A/B que é uma mudança de string em vez de uma integração.
O argumento do failover é incomumente concreto aqui. O Grok 4.5 ainda é roteável, mas já não é submetido a benchmarks completos pelos rastreadores independentes nem é mais o carro-chefe do fornecedor — um modelo que você talvez queira em uma cadeia de fallback, em vez de como seu único caminho. O failover automático entre provedores é o mecanismo que permite mantê-lo para aquilo em que ele é bom sem apostar uma rota de produção em um snapshot que o ecossistema começou a deixar para trás.
O que esta página não vai fazer é fingir que a escolha é óbvia. O Grok 4.5 é um bom modelo com um ponto forte específico, inserido numa família em que o mesmo dinheiro agora compra um mais recente. Se está a começar do zero hoje, a recomendação honesta é o Grok 4.6. Se já está a executar o Grok 4.5 num loop de agente e ele está a concluir tarefas com as contagens de tokens que tinha orçamentado, a recomendação honesta é não mudar nada e voltar a medir dentro de um trimestre.

O Grok 4.5 pode ser roteado no OrcaRouter hoje, assim como o Grok 4.6, o Grok 4.7 e o Grok 4.3. OrcaRouter repassa o preço de lista do provedor sem margem adicional, então uma alteração de preço do fornecedor chega ao nosso lado no mesmo dia em que chega ao lado deles, e mover uma carga de trabalho entre dois modelos Grok é uma alteração de string em vez de um segundo contrato.
Comparados neste artigo4
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
