
Dots vs GLM-5.2: As Duas Pontas da Cadeia de Suprimentos de Agentes
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 349 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 210 tok/s
- OrcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Dots e GLM-5.2 estão em extremos opostos da mesma cadeia de suprimentos, e nenhum dos dois é rival do outro. Dots é a superfície de agente que a empresa anunciou no DevDay em 29 de setembro de 2026 — um trabalhador sempre ativo com seu próprio computador na nuvem e navegador, conexões com mais de 4.000 aplicativos, acessível no ChatGPT, Slack e Teams, alimentado pelo GPT-6 Astra e incluído no Pro e no Business Premium sem custo extra. GLM-5.2 é o modelo de texto carro-chefe de pesos abertos da Z.ai, lançado em 16 de junho de 2026, com uma janela de contexto de um milhão de tokens, até 128.000 tokens de saída e uma tarifa publicada de US$ 1,40 por milhão de tokens de entrada e US$ 4,40 por milhão de tokens de saída. Uma é a camada que você aluga e não consegue ver por dentro; a outra é a camada que você pode baixar, inspecionar e precificar por token. Se você está decidindo como executar agentes neste trimestre, esse é o par de decisões diante de você.
O que cada um é, em uma única passagem
• O que é — um agente hospedado sempre ativo, sem identificador de modelo próprio (Dots), em comparação com um modelo de texto baixável com pesos publicados (GLM-5.2)
• Quem o produz — OpenAI, anunciado no DevDay em 29/09/2026, contra Z.ai (Zhipu AI), lançado em 16/06/2026
• Onde ele é executado — o computador em nuvem e o navegador da OpenAI, isolados da sua máquina, a menos que você os vincule, em contraste com onde você o implanta: seu próprio hardware, uma nuvem de sua escolha ou nosso endpoint
• Modelo subjacente — GLM-6 Astra, nomeado pela OpenAI em seus materiais de lançamento (declarado pelo fornecedor), contra o próprio GLM-5.2, um modelo de mistura de especialistas que a Z.ai lançou com pesos abertos
• Modalidade — mensagens, dados de aplicativos e um navegador de um lado, contra apenas entrada e saída de texto, sem entrada de imagem ou áudio
• Capacidade — limites de resposta não documentados para um ponto, contra 1.000.000 de tokens de contexto e 128.000 tokens de saída máxima
• Preço — o primeiro ponto incluído no Pro ou Business Premium, franquia não publicada, contra $1,40 por milhão de entrada e $4,40 por milhão de saída, conforme listado no nosso catálogo
• Evidência — demonstrações de fornecedores, nenhum benchmark independente para o dots, frente a um Artificial Analysis Intelligence Index de 33,7 e a um 99,1 relatado pelo fornecedor no τ²-Bench, ambos acompanhados de suas respectivas fontes em nosso catálogo
A metade de pesos abertos, e o problema imediato
A proposta do GLM-5.2 é a habitual de pesos abertos, e aqui é mais forte do que o costume porque o modelo é barato por qualquer medida e os pesos significam que a decisão de implantação é sua. Os resultados publicados pela própria Z.ai começam pelo uso de ferramentas agênticas — 99,1 no τ²-Bench, 76,8 no MCP-Atlas e 74,4 no FrontierSWE — e esses são números do fornecedor, o que vale a pena dizer claramente, porque são os números que fazem o modelo parecer uma pechincha. A medição independente é mais comedida: um Artificial Analysis Intelligence Index de 33,7 coloca-o a meio da tabela nesse ranking, uma fatia τ-banking de 34,6 é modesta, e 78,3 em recuperação de contexto longo fica atrás dos líderes atuais. O nosso catálogo tem 123,2 milhões de tokens de tráfego neste modelo nos últimos sete dias, o que é o sinal mais claro disponível de que as pessoas realmente o executam.
Aqui está o senão, e é a razão pela qual este artigo existe em vez de ser uma comparação direta de especificações. A Artificial Analysis marca o GLM-5.2 como obsoleto em favor de um lançamento mais recente, o GLM-5.3, e sua página ativa diz isso no topo: o modelo ainda é roteável e ainda tem disponibilidade geral, mas o roteiro do fornecedor avançou e os números do índice atribuídos ao GLM-5.2 são um instantâneo, e não uma medição permanente. Seus outros números independentes permanecem estáticos pelo mesmo motivo — o aviso da AA explica que, após a descontinuação, ela continua a fazer benchmark apenas da carga de trabalho padrão do modelo, e os resultados de todo o resto se tornam históricos.

Duas lições decorrem disso, e ambas se aplicam muito além deste modelo. Primeiro, um preço e uma licença são fatos duradouros de um lançamento de pesos abertos; uma posição em ranking é algo móvel, e um modelo pode ser barato, disponível para download e, ainda assim, ser superado. Segundo, o sucessor já está aqui: a Z.ai lançou o GLM-5.3 como seu atual carro-chefe, com preço abaixo do GLM-5.2, a US$ 1,26 de entrada e US$ 3,96 de saída por milhão, com um Intelligence Index independente de 44,8 contra 33,7 do GLM-5.2. Quem está construindo agora deve precificar o modelo mais novo primeiro e tratar o GLM-5.2 como o piso mais barato sob ele, não como a fronteira da família.
Quanto custa um ponto, e por que nenhum de vocês consegue prever isso no orçamento
A OpenAI publicou um preço para dots — o primeiro está incluído no Pro e no Business Premium, com limites estendidos no primeiro mês e conversas que não consomem os limites de uso do ChatGPT. Nenhum número de franquia, nenhum preço para um segundo dot, nenhuma tarifa para velocidade ou capacidade extra, nenhum custo por tarefa concluída e nenhum preço empresarial para os dots especializados atualmente em testes internos. A cobertura do keynote da CNBC tem a diretora financeira Sarah Friar precificando o novo nível Pro 500 de US$ 500 como uma franquia de uso mais o modo Ultrafast, e não como uma tarifa por dot; o plano mais caro na tabela da OpenAI também não se converte em um custo por unidade de trabalho de agente.
O GLM-5.2 tem o problema oposto, que é o melhor problema: números demais, todos verificáveis. A tabela de preços é de US$ 1,40 e US$ 4,40 por milhão de tokens, com leituras em cache a US$ 0,26, e o modelo pode ser baixado, então o custo marginal de uma requisição que você mesmo executa é hardware e eletricidade, em vez da fatura de um fornecedor. Esse é o trade-off em uma frase. A dot lhe dá um trabalhador e nenhum medidor; o GLM-5.2 lhe dá um medidor e nenhum trabalhador.

Colocando um modelo com medição sob um agente que você aluga
A forma útil de manter os dois é dar a cada um a metade do trabalho que ele faz bem. O dot cuida da coordenação: observar um projeto, correr atrás das pessoas e dos sistemas envolvidos, voltar com algo concluído. O GLM-5.2 — ou o sucessor com o qual você comparou preços — cuida do raciocínio que você precisa dominar: a passagem de extração sobre um arquivo de um milhão de tokens, a geração longa, a fila de classificação, a parte em que uma resposta errada custa mais do que os tokens que economizou.
Essa separação exige que a metade do raciocínio seja portável, o que é um problema de roteamento, e não um problema de modelo. O OrcaRouter disponibiliza o GLM-5.2 como z-ai/glm-5.2 ao preço de tabela do fornecedor, repassado com 0% de margem — nada acrescentado por cima, por isso um corte de preço da Z.ai chega à sua conta no mesmo dia — em um catálogo de mais de 200 modelos acessíveis através de uma única chave, com as ferramentas de failover e roteamento que permitem que uma tarefa passe para o modelo mais recente ou mais barato sem alterar o código. O que não oferece é um ponto: não há endpoint de dots, nem identificador de modelo para o agente, e não há forma de substituir a inteligência que corre dentro dele. A fronteira é real, e fingir o contrário seria o único slide desonesto nesta comparação.
A recomendação, declarada uma vez
Se você quer que o trabalho aconteça sem que você o conduza, compre o dot — ele não custa nada além de uma assinatura que você talvez já tenha, e sua limitação é que você ainda não consegue provar o quanto ele economizou. Se você quer saber quanto custa o seu raciocínio e poder movê-lo depois, coloque o GLM-5.2 ou o seu sucessor por trás do seu próprio endpoint e faça a medição. As equipes que estão acertando isso no final de 2026 estão fazendo as duas coisas, e a disciplina que faz isso funcionar é recusar-se a deixar que a camada alugada possua qualquer coisa que elas não seriam capazes de substituir.

Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
