
Dots vs Grok 4.6: O agente que marca as próprias reuniões contra o modelo que responde
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 349 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 210 tok/s
- OrcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Tente escrever um número de telefone para um dot e você vai falhar, e essa falha é a coisa mais útil deste pareamento. Dots é o agente sempre ativo da empresa, anunciado no DevDay em 29 de setembro de 2026: cada dot ganha seu próprio computador em nuvem e navegador, conecta-se a mais de 4.000 aplicativos e pode ser acessado dentro do ChatGPT, do Slack e do Teams, rodando no GPT-6 Astra e incluído no Pro e no Business Premium sem cobrança separada. O Grok 4.6 é o modelo de fronteira da SpaceXAI, publicado em 12 de agosto de 2026, e é um tipo de objeto completamente diferente: uma janela de contexto de 500.000 tokens, entrada de texto, imagem e arquivo com saída de texto, esforço de raciocínio configurável, chamada nativa de ferramentas e saídas estruturadas, com preço de US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída para prompts abaixo de 200.000 tokens, e o dobro disso acima desse valor. Um deles é um colega com uma agenda. O outro é uma função que você chama.
Ambos são genuinamente fortes em trabalho agêntico, e é isso que torna a confusão comum. O Grok 4.6 marca 88,4 no Terminal-Bench 2.1 e 50,7 no recorte de uso de ferramentas do τ-banking — o tipo de número que faz um modelo ser descrito como "um agente". Ele não é um. Ele é o motor de raciocínio a partir do qual você construiria um.
O que cada um realmente é
• Identidade — um produto hospedado sem identificador de modelo que você possa endereçar (Dots) em contraste com um modelo nomeado e roteável, com uma string estável que você pode colocar em um arquivo de configuração (Grok 4.6)
• Onde a execução acontece — no computador em nuvem da OpenAI, com seu próprio navegador, isolado da sua máquina, a menos que você os vincule (Dots), em contraste com onde quer que você execute a chamada: um contêiner que você controla, um worker de fila, um cron job (Grok 4.6)
• Alcance — 4.000+ aplicativos por meio dos conectores da OpenAI (Dots), em comparação com quaisquer ferramentas que você mesmo conecte, porque a chamada de ferramentas é um protocolo, e não um diretório (Grok 4.6)
• Memória de uma tarefa — carregada pelo produto ao longo de dias, entre aplicativos, entre novas conversas (Dots), em contraste com uma janela de 500.000 tokens e com o que quer que você persista por conta própria (Grok 4.6)
• Custo — incluído numa subscrição, franquia não publicada (Dots) em comparação com $2,00 e $6,00 por milhão de tokens, duplicando após 200.000 tokens de entrada, com leituras em cache a $0,50 (Grok 4.6)
• Evidências — demonstração do fornecedor e declarações de capacidade, sem benchmark independente (Dots) em comparação com um Artificial Analysis Coding Index de 76,8, quinto entre 138 modelos medidos, e 94,9 no GPQA Diamond (Grok 4.6)
O número que decide a maioria das questões: a mesada
A OpenAI publicou um preço para os dots e ele não é um preço em nenhuma unidade na qual se possa medir trabalho. O primeiro dot está incluído no Pro ou no Business Premium; conversas com ele não consomem os limites de uso do ChatGPT; limites estendidos se aplicam no primeiro mês. Essa é toda a estrutura de custos publicada. Nenhum valor de franquia, nenhum preço para o segundo dot, nenhuma tarifa por tarefa, nenhum preço empresarial para os dots especializados que, segundo relatos, estão em testes internos. A reportagem da CNBC sobre a apresentação principal mostra a diretora financeira Sarah Friar precificando o nível Pro 500, de US$ 500 por mês, como uma cota de uso mais o novo modo Ultrafast, e não como uma tarifa por dot, o que significa que o plano mais caro da tabela da OpenAI ainda não resulta em um custo por unidade de trabalho de agente.
O Grok 4.6 segue o caminho oposto e publica tudo, inclusive a parte que dói. O limite de faixa em 200.000 tokens de entrada é um precipício: uma requisição com 199.000 tokens é cobrada pela metade da tarifa de uma com 201.000. Isso não é uma armadilha oculta, é um número na tabela de tarifas, e muda a forma como você projeta um trabalho de contexto longo. Ou você divide em blocos no limite, ou aceita a segunda faixa conscientemente.

Um sucessor foi lançado enquanto este par estava sendo comparado
Grok 4.7 foi publicado em 21 de setembro de 2026 e agora é o carro-chefe da linha Grok, com o mesmo contexto de 500.000 tokens, a mesma superfície de entrada, o mesmo preço base e uma saída máxima muito maior, de 450.000 tokens. O Grok 4.6 continua disponível e ainda listado como um modelo atual — um aumento de versão não é uma aposentadoria —, mas qualquer pessoa que escolha um modelo Grok hoje deveria escolher entre o 4.6 e o 4.7, em vez de presumir que o 4.6 é a fronteira. O motivo de dizer isso claramente é que o artigo que você está lendo é sobre uma comparação que sobrevive à transição: qualquer que seja o nome dado ao topo da linha Grok no próximo trimestre, ele ainda é um modelo com cobrança por uso e uma tabela de preços, e o Dot ainda é uma assinatura com uma franquia não divulgada.
Esse também é o argumento para encaminhar suas chamadas de modelo através de uma abstração, em vez de um fornecedor codificado diretamente. Quando o sucessor chegar, trocar o modelo é uma edição de uma linha, e não uma migração.

Construir o agente em vez de alugá-lo
A consequência interessante desse emparelhamento é que o Grok 4.6 permite que você construa o que a Dots vende, mal e depois melhor. Um loop que lê uma fila, chama o modelo com ferramentas anexadas, grava resultados e tenta novamente em caso de falha não é difícil; o difícil são as partes que um dot oferece de graça — um navegador que se comporta como o de uma pessoa, conectores que foram escritos pelos fornecedores dos aplicativos, um fluxo de aprovação e um registro de atividades. Elas valem uma assinatura justamente porque são tediosas.
Onde o lado cobrado por uso vence é no momento em que o trabalho deixa de ser genérico. O momento em que você precisa que a mesma chamada seja executada em um fornecedor diferente no próximo trimestre, seja reproduzida a partir de um log, tenha o preço calculado ao centavo, ou faça failover para um modelo irmão mais barato durante a execução quando um provedor upstream oscila. Na OrcaRouter, o Grok 4.6 é servido como grok/grok-4.6 pelo preço de tabela da SpaceXAI com 0% de markup em cima — a tarifa do próprio provedor, repassada, então um corte de preço do fornecedor chega à sua fatura no mesmo dia — no mesmo catálogo que mais de 200 outros modelos atrás de uma única chave, com failover automático e uma DSL de roteamento para compor vários modelos em uma única chamada. Não há equivalente para um ponto: nenhum endpoint, nenhum identificador, nada de onde fazer failover.
O teste a aplicar
Pergunte se o trabalho ainda existiria se ninguém olhasse para ele. Se a resposta for sim — ele precisa acontecer segundo uma programação, em várias ferramentas, sem que uma pessoa abra uma janela de chat —, o dot é o produto moldado para isso, e o modelo com medição é um componente dentro de qualquer coisa que você construir. Se a resposta for não, se alguém está esperando o resultado e o resultado tem um formato e um prazo, então um modelo com medição é a compra certa e um agente é um desvio caro.
O erro que vale a pena evitar é comprar um dot para conseguir uma resposta melhor. Um dot não é um modelo mais inteligente; é uma coleira mais longa em um modelo. E o segundo erro é pagar por uma assinatura para obter uma capacidade que uma tabela de preços já vende por token, com a aritmética visível de antemão.

Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
