Um cartão hero gerado com o título 'Dots vs Grok 4.6', com o subtítulo 'O agente que agenda as próprias reuniões contra o modelo que responde'. Uma linha vertical divide o cartão: o painel esquerdo, rotulado 'Dots', traz 'computador próprio, navegador, 4.000+ apps'; o direito, rotulado 'Grok 4.6', traz 'contexto de 500K - 88.4 Terminal-Bench - $2.00 / $6.00'. O logotipo da OrcaRouter está composto no canto inferior direito.
Guides & Insights

Dots vs Grok 4.6: O agente que marca as próprias reuniões contra o modelo que responde

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Tente escrever um número de telefone para um dot e você vai falhar, e essa falha é a coisa mais útil deste pareamento. Dots é o agente sempre ativo da empresa, anunciado no DevDay em 29 de setembro de 2026: cada dot ganha seu próprio computador em nuvem e navegador, conecta-se a mais de 4.000 aplicativos e pode ser acessado dentro do ChatGPT, do Slack e do Teams, rodando no GPT-6 Astra e incluído no Pro e no Business Premium sem cobrança separada. O Grok 4.6 é o modelo de fronteira da SpaceXAI, publicado em 12 de agosto de 2026, e é um tipo de objeto completamente diferente: uma janela de contexto de 500.000 tokens, entrada de texto, imagem e arquivo com saída de texto, esforço de raciocínio configurável, chamada nativa de ferramentas e saídas estruturadas, com preço de US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída para prompts abaixo de 200.000 tokens, e o dobro disso acima desse valor. Um deles é um colega com uma agenda. O outro é uma função que você chama.

Ambos são genuinamente fortes em trabalho agêntico, e é isso que torna a confusão comum. O Grok 4.6 marca 88,4 no Terminal-Bench 2.1 e 50,7 no recorte de uso de ferramentas do τ-banking — o tipo de número que faz um modelo ser descrito como "um agente". Ele não é um. Ele é o motor de raciocínio a partir do qual você construiria um.

O que cada um realmente é

• Identidade — um produto hospedado sem identificador de modelo que você possa endereçar (Dots) em contraste com um modelo nomeado e roteável, com uma string estável que você pode colocar em um arquivo de configuração (Grok 4.6)

• Onde a execução acontece — no computador em nuvem da OpenAI, com seu próprio navegador, isolado da sua máquina, a menos que você os vincule (Dots), em contraste com onde quer que você execute a chamada: um contêiner que você controla, um worker de fila, um cron job (Grok 4.6)

• Alcance — 4.000+ aplicativos por meio dos conectores da OpenAI (Dots), em comparação com quaisquer ferramentas que você mesmo conecte, porque a chamada de ferramentas é um protocolo, e não um diretório (Grok 4.6)

• Memória de uma tarefa — carregada pelo produto ao longo de dias, entre aplicativos, entre novas conversas (Dots), em contraste com uma janela de 500.000 tokens e com o que quer que você persista por conta própria (Grok 4.6)

• Custo — incluído numa subscrição, franquia não publicada (Dots) em comparação com $2,00 e $6,00 por milhão de tokens, duplicando após 200.000 tokens de entrada, com leituras em cache a $0,50 (Grok 4.6)

• Evidências — demonstração do fornecedor e declarações de capacidade, sem benchmark independente (Dots) em comparação com um Artificial Analysis Coding Index de 76,8, quinto entre 138 modelos medidos, e 94,9 no GPQA Diamond (Grok 4.6)

O número que decide a maioria das questões: a mesada

A OpenAI publicou um preço para os dots e ele não é um preço em nenhuma unidade na qual se possa medir trabalho. O primeiro dot está incluído no Pro ou no Business Premium; conversas com ele não consomem os limites de uso do ChatGPT; limites estendidos se aplicam no primeiro mês. Essa é toda a estrutura de custos publicada. Nenhum valor de franquia, nenhum preço para o segundo dot, nenhuma tarifa por tarefa, nenhum preço empresarial para os dots especializados que, segundo relatos, estão em testes internos. A reportagem da CNBC sobre a apresentação principal mostra a diretora financeira Sarah Friar precificando o nível Pro 500, de US$ 500 por mês, como uma cota de uso mais o novo modo Ultrafast, e não como uma tarifa por dot, o que significa que o plano mais caro da tabela da OpenAI ainda não resulta em um custo por unidade de trabalho de agente.

O Grok 4.6 segue o caminho oposto e publica tudo, inclusive a parte que dói. O limite de faixa em 200.000 tokens de entrada é um precipício: uma requisição com 199.000 tokens é cobrada pela metade da tarifa de uma com 201.000. Isso não é uma armadilha oculta, é um número na tabela de tarifas, e muda a forma como você projeta um trabalho de contexto longo. Ou você divide em blocos no limite, ou aceita a segunda faixa conscientemente.

A screenshot of the OrcaRouter model page for Grok 4.6, showing the identifier 'grok/grok-4.6' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-12, a description of it as SpaceXAI's smartest model to date and the current flagship of the Grok line with a 500K-token context window, a side panel reading 500K tokens of context over text, image and file input, and a price strip reading $2.00 and $6.00 with tiered rates above a 200,000-token prompt.

Um sucessor foi lançado enquanto este par estava sendo comparado

Grok 4.7 foi publicado em 21 de setembro de 2026 e agora é o carro-chefe da linha Grok, com o mesmo contexto de 500.000 tokens, a mesma superfície de entrada, o mesmo preço base e uma saída máxima muito maior, de 450.000 tokens. O Grok 4.6 continua disponível e ainda listado como um modelo atual — um aumento de versão não é uma aposentadoria —, mas qualquer pessoa que escolha um modelo Grok hoje deveria escolher entre o 4.6 e o 4.7, em vez de presumir que o 4.6 é a fronteira. O motivo de dizer isso claramente é que o artigo que você está lendo é sobre uma comparação que sobrevive à transição: qualquer que seja o nome dado ao topo da linha Grok no próximo trimestre, ele ainda é um modelo com cobrança por uso e uma tabela de preços, e o Dot ainda é uma assinatura com uma franquia não divulgada.

Esse também é o argumento para encaminhar suas chamadas de modelo através de uma abstração, em vez de um fornecedor codificado diretamente. Quando o sucessor chegar, trocar o modelo é uma edição de uma linha, e não uma migração.

A generated scoreboard titled 'Dots vs Grok 4.6 - product against protocol', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; computer its own cloud computer and browser; connectors 4,000+ apps; channels ChatGPT, Slack, Teams; independent benchmark none. The right column, 'Grok 4.6', lists: context 500,000 tokens; input text, image, file; price $2.00 in / $6.00 out per 1M; above 200K input $4.00 in / $12.00 out per 1M; cached reads $0.50 per 1M; AA Coding Index 76.8, 5th of 138. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Grok 4.6 figures from independent listings as carried in the OrcaRouter catalogue.'

Construir o agente em vez de alugá-lo

A consequência interessante desse emparelhamento é que o Grok 4.6 permite que você construa o que a Dots vende, mal e depois melhor. Um loop que lê uma fila, chama o modelo com ferramentas anexadas, grava resultados e tenta novamente em caso de falha não é difícil; o difícil são as partes que um dot oferece de graça — um navegador que se comporta como o de uma pessoa, conectores que foram escritos pelos fornecedores dos aplicativos, um fluxo de aprovação e um registro de atividades. Elas valem uma assinatura justamente porque são tediosas.

Onde o lado cobrado por uso vence é no momento em que o trabalho deixa de ser genérico. O momento em que você precisa que a mesma chamada seja executada em um fornecedor diferente no próximo trimestre, seja reproduzida a partir de um log, tenha o preço calculado ao centavo, ou faça failover para um modelo irmão mais barato durante a execução quando um provedor upstream oscila. Na OrcaRouter, o Grok 4.6 é servido como grok/grok-4.6 pelo preço de tabela da SpaceXAI com 0% de markup em cima — a tarifa do próprio provedor, repassada, então um corte de preço do fornecedor chega à sua fatura no mesmo dia — no mesmo catálogo que mais de 200 outros modelos atrás de uma única chave, com failover automático e uma DSL de roteamento para compor vários modelos em uma única chamada. Não há equivalente para um ponto: nenhum endpoint, nenhum identificador, nada de onde fazer failover.

O teste a aplicar

Pergunte se o trabalho ainda existiria se ninguém olhasse para ele. Se a resposta for sim — ele precisa acontecer segundo uma programação, em várias ferramentas, sem que uma pessoa abra uma janela de chat —, o dot é o produto moldado para isso, e o modelo com medição é um componente dentro de qualquer coisa que você construir. Se a resposta for não, se alguém está esperando o resultado e o resultado tem um formato e um prazo, então um modelo com medição é a compra certa e um agente é um desvio caro.

O erro que vale a pena evitar é comprar um dot para conseguir uma resposta melhor. Um dot não é um modelo mais inteligente; é uma coleira mais longa em um modelo. E o segundo erro é pagar por uma assinatura para obter uma capacidade que uma tabela de preços já vende por token, com a aritmética visível de antemão.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with model cards visible in a grid beneath.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente