Um card de título gerado com o texto 'o agent da OpenAI: o vazamento do DevDay, rotulado', com a linha de status 'Noticiado como um agente sempre ativo para os planos ChatGPT Pro - sem página de produto, sem preço, sem ID de modelo, sem comunicado da OpenAI'. Três cards dizem: 'A referência - identificada como um nome de exibição e um sufixo de e-mail, segundo um relatório'; 'A janela - DevDay 2026, 29 de setembro, Fort Mason Center'; 'A lacuna - tarefas, permissões, memória, agendamento e disponibilidade, tudo sem relato'. Uma linha de rodapé diz 'Vazamento de fonte única. Nada aqui é um anúncio da OpenAI.' O logotipo da OrcaRouter fica no canto inferior direito.
Guides & Insights

Agente "o" da OpenAI: O que o vazamento do DevDay 2026 realmente diz, e o que não diz

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O nome relatado é a parte menos interessante. O que o vazamento diz sobre o agente sempre ativo da empresa é que ele se chamará "o", que ele ficará dentro de cada nível ChatGPT Pro, e que um Fast Mode — rodando em silício da Cerebras — está atrelado a ele. O detalhe que merece atenção é menor e mais estranho do que isso: a referência foi supostamente encontrada na página de upgrade do plano Pro de $100, não o de $200, no mesmo mês em que a empresa deixou de vender o plano de $200 de vez. Não há página de produto, nem preço, nem identificador de modelo, nem declaração da empresa usando a letra como nome de produto. O post por trás deste artigo é o resumo de uma conta sobre o que ela diz ter visto, e a conferência em que ele se baseia é real: o DevDay 2026 acontece em 29 de setembro no Fort Mason Center, em São Francisco. O agente com o qual ele compete também é real — Gro​k Bot, o produto de colaborador digital que a SpaceXAI colocou em beta inicial em 11 de agosto. O modelo no qual o agente presumivelmente rodaria é real e datado: GPT-6 Astra, disponível em geral desde 3 de setembro. Quase nada mais na afirmação é.

Do que o vazamento realmente consiste, ordenado por peso

Três coisas estão sendo relatadas, e elas não merecem ser lidas como uma única alegação.

As referências em capturas de tela são a parte mais forte. Uma reportagem publicada em 26 de setembro afirma que referências a "O" aparecem em toda a própria configuração do ChatGPT — como nome de exibição e como sufixo de e-mail escrito como "-o" — e que a mesma string foi recentemente listada como um benefício na página de upgrade do plano ChatGPT Pro de $100. Esses são artefatos com formato de implantação, e não invenção: superfícies de configuração são onde uma empresa prepara um produto antes de anunciá-lo, da mesma forma que as feature flags. Também são o tipo mais fraco de artefato disponível, porque uma string preparada pode ser renomeada, reaproveitada ou abandonada, e não carrega nenhum comportamento consigo. O relatório é explícito sobre essa lacuna: o que o agente faz, a que pode acessar, se agenda alguma coisa, por quanto tempo se lembra e quem o recebe são todos pontos não declarados.

O nome é a reivindicação de segunda ordem. Uma conta @o suspensa no X é citada como uma possível reserva. Um handle suspenso é um dado sobre a intenção em determinado momento, não sobre o que o produto é, e a mesma letra já passou pelo departamento de nomes da OpenAI uma vez — mais sobre isso abaixo.

A terceira camada é a parte que veio do sinal desta semana, e não da reportagem: que "o" aparece em todos os planos Pro, que o Fast Mode está confirmado, que ele presumivelmente está incluído em um nível de assinatura de $500, e que o silício da Cerebras é o que torna a velocidade possível. "Presumably" está fazendo um trabalho visível nessa frase. O próprio post do sinal está truncado na captura que o radar fez — seu quinto item começa com "shared m…" e para — então leia a lista como incompleta, e não como cinco pontos estabelecidos.

O problema de nomenclatura que ninguém verificou

A OpenAI já usou a letra. Seus modelos de raciocínio foram lançados sob o1, o3, o3-mini e o4-mini ao longo de 2024 e 2025, e a linha foi encerrada em vez de ampliada: o4-mini foi retirado do ChatGPT em fevereiro de 2026, GPT-4.5 saiu em junho, e o3 recebeu um prazo de 90 dias para descontinuação, anunciado nas notas de lançamento do modelo em 28 de maio — uma desativação que este blog noticiou na época, porque os usuários estavam relatando respostas que desapareciam antes do prazo.

Então, um simples "o" como nome de um agente para consumidores colidiria com o histórico recente da própria empresa e seria ambíguo no único lugar em que a ambiguidade sai cara: um seletor de modelos. Isso não é prova de que o vazamento esteja errado — fornecedores reciclam letras, e um codinome interno muitas vezes morre na revisão de nomes —, mas é um motivo para tratar o nome como a parte mais descartável da história. Se "o" for lançado sob outro rótulo, todo fato datado abaixo continua válido.

Por que o timing é crível mesmo que o produto não seja

A evidência mais forte de um lançamento de agente no DevDay não é o vazamento. É o que a OpenAI já colocou em prática nas quatro semanas anteriores a ele.

• 3 de setembro — GPT-6 Astraalcançou disponibilidade geral como o modelo de fronteira da OpenAI: contexto de 1,05 milhão de tokens, saída máxima de 128K, listado a US$ 10,00 por milhão de tokens de entrada e US$ 50,00 por milhão de saída, com entrada em cache a US$ 1,00 e gravações de cache a US$ 12,50. Nosso próprio catálogo traz o mesmo modelo sob uma data de listagem de 2026-09-04; a Artificial Analysis data o lançamento como 3 de setembro.

• 10 de setembro — A OpenAI abriu a Agents API em beta público, vendendo aos desenvolvedores o harness Codex gerenciado: a OpenAI executa a orquestração, a compactação de contexto e a recuperação, e o desenvolvedor fornece a tarefa, o modelo, as ferramentas e o ambiente. Essa é a infraestrutura de um agente sempre ativo, vendida como um produto para desenvolvedores.

• 10 de setembro — no mesmo dia, novas inscrições e upgrades para o plano ChatGPT Pro de US$ 200 foram pausados, sendo a demanda pelo GPT-6 Astra apontada como o motivo. O nível de US$ 100, Plus, Go, Business e Enterprise, e a API, permaneceram abertos.

• 22 de setembro — GPT-6 Sol e GPT-6 Luna foram lançados por US$ 2,00 / US$ 10,00 e US$ 0,10 / US$ 0,50 por milhão de tokens, o que a OpenAI descreveu como permanente, e não promocional, ampliando a faixa mais barata da linha da qual o agente se serviria para trabalho rotineiro.

• 26 de setembro — a documentação do nível de serviço Ultrafast foi ampliada, com um seletor de velocidade que oferece Standard, Fast e Ultrafast, identificado de forma não publicada no Playground da Responses API, e relatos apontando para um lançamento mais amplo em torno do DevDay.

• 29 de setembro — DevDay 2026, keynote transmitida ao vivo, com abertura de Sam Altman. A conta de desenvolvedores da OpenAI publicou "72 horas para o OpenAI DevDay" no mesmo fim de semana em que o relatório do agente foi divulgado.

Screenshot of the OrcaRouter model page for OpenAI GPT-6 Astra, showing a 1.05M-token context window, input pricing of $10.00 and output pricing of $50.00 per million tokens with $1.00 cached input and $12.50 cache writes, and a second pricing row above 272,000 input tokens at double the input and cache rates and 1.5x the output rate, plus capability tags for Vision, Tools, JSON and Reasoning.

Leia essas seis linhas em conjunto e a forma da história é coerente: a OpenAI transformou o harness de agente em produto, vendeu-o aos desenvolvedores, racionou o plano de consumidor que inclui o seu melhor modelo, e tem uma keynote daqui a quatro dias. Uma versão voltada para o consumidor desse mesmo harness — vendida como assinatura em vez de um endpoint por token — é o próximo movimento óbvio. Nada disso faz com que o nome, o nível ou a ligação à Cerebras sejam verificados. Isso torna o timing plausível, o que é uma afirmação diferente e mais fraca.

Fast Mode, Ultrafast e a afirmação da Cerebras

O sinal diz que o Fast Mode está "confirmado" e que o chip Cerebras "entra em ação". Ambos precisam ser separados um do outro, porque um é infraestrutura de plataforma documentada e o outro é uma inferência sobre qual chip atende qual produto.

O Fast mode é um nível real e tarifado na API da OpenAI para a linha GPT-6: é cobrado ao dobro da tarifa padrão e proporciona cerca de 2,5× a velocidade de saída, e é o mesmo nível que foi renomeado de Priority processing em 30 de julho de 2026 — a API aceita tanto service_tier: "fast" quanto service_tier: "priority". Ele não está disponível com residência de dados na UE em pelo menos um modelo da linha. Dentro do pacote de assinaturas do ChatGPT, relatos sobre a estrutura de créditos da assinatura colocam o Fast mode em 2,5× a taxa de créditos, em vez do 2× da API, o que torna a configuração mais rápida um negócio um pouco pior dentro do ChatGPT do que fora dele — um detalhe que vale a pena saber antes de presumir que um benefício do Fast mode vale o que parece.

O Ultrafast é o nível da Cerebras e é uma fera diferente. A OpenAI o anunciou em 13 de agosto de 2026 como o primeiro produto de sua parceria de computação com a Cerebras — um acordo noticiado em cerca de US$ 10 bilhões ao longo de três anos — e ele entrega até 14× a taxa de transferência padrão e até 750 tokens de saída por segundo no GPT-5.6 Sol, o modelo ao qual ele está atualmente restrito. O acesso é controlado, não há preço publicado e, até esta semana, ele ainda é um nível de lista de espera, e não um de disponibilidade geral. A referência da API Responses lista ultrafast como um valor para o parâmetro service_tier, com a ressalva de que ele "está atualmente disponível para gpt-5.6-sol".

É exatamente por isso que a frase sobre a Cerebras no vazamento deve ser tratada como um palpite com uma base plausível, e não como uma confirmação. Um agente para consumidores que rodasse continuamente teria como fatores dominantes a latência e o custo por tarefa, e a velocidade de classe Cerebras é uma resposta genuína à primeira metade disso. Mas ainda não há nenhum caminho Ultrafast documentado para qualquer modelo GPT-6, nenhuma tabela de preços para isso, e nada da OpenAI vinculando um agente para consumidores àquele silício. A direção da inferência é razoável; a certeza na formulação não se justifica.

O que "disponível em todos os planos Pro" lhe custaria

Esta é a parte da afirmação que um leitor pode realmente avaliar, porque a estrutura de níveis subjacente a ela é publicada.

• Preços mensais — os planos ChatGPT Pro de $100 e $200 estiveram ambos à venda até setembro; novas assinaturas do plano de $200 estão pausadas desde 10 de setembro e a OpenAI não publicou nenhum limiar de reabertura.

• A versão medida do mesmo recurso — o GPT-6 Pro está limitado a 200 mensagens por semana no plano de $200 e a 50 por semana no plano de $100, sendo esta última retirada de uma cota compartilhada com o GPT-5.6 Sol Pro. Os planos Business ficam mais abaixo. Esses são os números publicados pela OpenAI e representam o limite real do que vale um "benefício na página de upgrade".

• Aritmética de tokens no modelo subjacente — a US$ 10,00 / US$ 50,00 por milhão, US$ 500 de API do GPT-6 Astra equivalem a cerca de 50M tokens de entrada ou 10M tokens de saída, caindo novamente pela metade em trabalho efetivo acima do limiar de 272 mil tokens de entrada, onde a requisição inteira é reprecificada a US$ 20,00 / US$ 2,00 / US$ 75,00.

• A metade mais barata da linha — os mesmos US$ 500 compram cerca de 250M tokens de entrada ou 50M de saída no GPT-6 Sol a US$ 2,00 / US$ 10,00, e dez vezes isso no GPT-6 Luna a US$ 0,10 / US$ 0,50.

Se o agente vier dentro de uma assinatura existente, a comparação deixa de ser sobre o preço de tabela e passa a ser sobre qual assento você já paga. Se vier como um item próprio na fatura, a OpenAI tem de justificá-lo diante de uma categoria em que um concorrente já entrega há seis semanas. De qualquer forma, um agente sempre ativo muda o formato da fatura: um assistente que continua trabalhando enquanto você dorme consome tokens sem um humano no circuito, e essa é a carga de trabalho que um nível cobrado por uso pune e que um assento absorve. É também a carga de trabalho em que o input em cache, a um décimo do input novo, decide o total — um agente persistente reenvia um contexto quase inalterado a cada turno, que é exatamente o padrão para o qual um desconto de cache foi criado.

Essa é a camada em que a OrcaRouter opera, e vale a pena ser claro sobre o que ela não cobre. Roteamos os modelos da OpenAI por token com o preço de lista do provedor repassado com 0% de margem, então uma mudança de preço do fornecedor entra em vigor aqui no mesmo dia, com failover automático entre provedores e uma DSL de roteamento para compor chamadas. GPT-6 Astra, GPT-5.6 Sol, GPT-6 Sol e GPT-6 Luna estão todos em uma única chave. O que não podemos vender a você é uma assinatura do ChatGPT ou um agente que ainda não existe — não há nada para rotear até que a OpenAI lance um.

A barra que o agente precisa superar é mais baixa do que parece.

O Gro​k Bot é a comparação que o próprio vazamento faz, e a leitura honesta dela é que a SpaceXAI definiu um padrão baixo. Ele entrou em beta inicial em 11 de agosto em uma configuração de entrada de US$ 120 por assento, incluída no Cursor Premium Teams, com níveis individuais de US$ 200 e US$ 300 por mês e uso além dos limites incluídos cobrado ao custo do token. Cada bot recebe sua própria VM na nuvem com um navegador, um sistema de arquivos e um terminal; ele faz login em aplicativos que não têm API; ele salva fluxos de trabalho demonstrados como rotinas e continua funcionando depois que o laptop é fechado.

A parte que resolveria qualquer dúvida é justamente a que não foi publicada. A SpaceXAI não divulgou nenhum benchmark independente nem dados de confiabilidade sobre ele, o roteador de modelos por trás dele é automático e os usuários não podem fixar um modelo, os primeiros testadores demonstraram publicamente não estar impressionados, e os avaliadores observam a ausência de uma camada de controle empresarial — sem permissões com escopo, regras de escalonamento ou trilha de auditoria. O Muse da Meta chegou depois, em 8 de setembro, a uma categoria que agora conta com três produtos.

A two-column scoreboard titled 'o vs Grok Bot - the scoreboard'. The left column, 'o (reported)', reads: Status reported for DevDay, Sept 29; Evidence a display name and a mail suffix, per one report; Tiers reported as all Pro tiers, unconfirmed; Speed mode reported Fast Mode on Cerebras, unconfirmed; Behaviour unreported; Benchmarks none. The right column, 'Grok Bot (shipped)', reads: Status early beta since Aug 11, 2026; Evidence vendor product page; Tiers from $120 per seat per month, bundled with Cursor Premium Teams; Speed mode vendor-managed, model not pinnable; Behaviour cloud VM with browser, filesystem and terminal; Benchmarks none published. A footer line reads 'o column is single-source reporting; Grok Bot figures per SpaceXAI. Neither side has published independent reliability data.'

Essa última linha é o ponto de toda a comparação. Não existe um índice da Artificial Analysis para "o agente concluiu a tarefa sem fazer algo catastrófico", então um agente persistente é comprado com as mesmas evidências com que um chatbot era comprado em 2023: demos e vibes. A única restrição datada que ninguém nesta história menciona é a própria postura de segurança da OpenAI. O GPT-6 Astra atingiu o limiar Crítico de capacidade de cibersegurança da empresa, e a OpenAI alertou que o monitoramento pode retardar, pausar ou parar tarefas legítimas — incluindo explicitamente trabalhos de longa duração. Um agente sempre ativo é, por definição, um trabalho de longa duração, na plataforma que já disse que pode interromper um.

O que tornaria isto verificável, e quando

Rumores sobre um produto a quatro dias do lançamento saem baratos, e as verificações são específicas.

• Uma página da OpenAI, nota de versão ou entrada no centro de ajuda que use o nome como nome de produto. Até agora, nada apareceu, e o histórico da letra dentro da OpenAI torna este o teste com maior margem para falhar.

• Uma superfície de configuração que sobrevive a um recarregamento — um plano de fato comprável, uma cota listada, uma página de configurações — em vez de uma string de exibição encenada em um build.

• Qualquer especificação de comportamento, seja qual for: o que pode lhe ser concedido, o que agenda, por quanto tempo se lembra, se tem sua própria identidade de e-mail em produção ou apenas em um arquivo de configuração.

• Um preço. "Em todos os níveis Pro" não é um preço, e um nível de US$ 500 não se torna um fato porque um relatório separado encontrou strings de assinatura de US$ 500 em um lugar diferente.

• O link da Cerebras ou aparecendo na própria documentação de serviço da OpenAI para o nível, tal como ocorreu com a restrição do Ultrafast ao GPT-5.6 Sol, ou não aparecendo de forma alguma.

A two-column card titled 'The o agent - verified vs claimed'. The left column, 'Verified and dated', reads: DevDay 2026 on September 29 at Fort Mason Center; GPT-6 Astra generally available September 3 at $10 / $50 per million; Agents API public beta September 10; ChatGPT Pro $200 sign-ups paused September 10; GPT-6 Sol and GPT-6 Luna shipped September 22 at $2 / $10 and $0.10 / $0.50; Ultrafast documented as access-controlled on GPT-5.6 Sol; Grok Bot in early beta since August 11. The right column, 'Claimed and unverified', reads: the product name 'o'; an announcement at DevDay; availability in all Pro tiers; Fast Mode bundled into a $500 tier; Cerebras serving the agent; tasks, permissions, memory and scheduling; any published price. A footer line reads 'Left column per OpenAI, SpaceXAI and Artificial Analysis; right column single-source reporting.'

A decisão com que isto deixa o leitor é menor do que a fuga de informação sugere, e não é sobre a carta. Se está a avaliar um agente sempre ativo para o trabalho, o produto que existe hoje é o Gro​k Bot, e o passo sensato é um teste curto ao seu próprio fluxo de trabalho em vez de um compromisso de assentos — o seu nível de entrada de $120 é um piso, não um teto, e a utilização para além dos limites incluídos é faturada ao custo por token. Se está a construir, a Agents API está em beta pública desde 10 de setembro e é a parte desta história que pode realmente testar hoje, com o harness, o sandbox e a faturação todos documentados.

E se estiver a calcular quanto custaria executar qualquer uma destas coisas, faça-o com base nos modelos, e não no boato. O GPT-6 Astra a $10.00 / $50.00 por milhão de tokens está disponível no OrcaRouter ao preço de tabela da própria OpenAI, sem qualquer margem acrescentada; o GPT-6 Sol e o GPT-6 Luna estão lá a $2.00 / $10.00 e $0.10 / $0.50, e a taxa de leitura de cache — $1.00 contra $10.00 para o Astra — é a linha que decide quanto custa, na prática, uma carga de trabalho persistente. Um agente que a OpenAI não anunciou não pode ser avaliado por benchmark, roteado nem comprado. Os tokens que lhe estão subjacentes podem, hoje, e o medidor que construir com base neles continuará a ser o medidor certo se o nome na caixa vier a revelar-se algo diferente de uma única letra.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente