Um cartão hero gerado com o título 'Três posts de profundidade' e o subtítulo 'GPT-6.1 Ultrafast é Pro $500 apenas no ChatGPT — aberto a todos os usuários da API', chips com os textos 'plano Pro $500', 'elegível para Enterprise e Edu' e 'todos os usuários da API', e um rodapé com o texto 'Disponibilidade conforme a documentação da OpenAI, 8 de outubro de 2026'.
Guides & Insights

GPT-6.1 Ultrafast é Pro por apenas $500, e esse detalhe estava enterrado a três posts de profundidade.

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

GPT-6.1 Sol Ultrafast chegou em 8 de outubro de 2026 com a coisa mais rara que um nível de velocidade pode trazer: um preço publicado. US$ 12,00 por milhão de tokens de entrada, US$ 60,00 por milhão de tokens de saída, exatamente seis vezes o que custa GPT-6.1 Sol — o modelo que a OpenAI lançou em 29 de setembro de 2026 em sua keynote do DevDay 2026 — na via padrão. O que a thread do anúncio não destacou logo de cara é onde um assinante do ChatGPT pode de fato ativá-lo, e a resposta, três posts mais abaixo, é o plano Pro de US$ 500. Essa ordem merece mais atenção do que recebeu, porque a metade da API e a metade da assinatura deste lançamento estão restringidas de maneiras opostas, e a diferença decide se o Ultrafast é algo que você pode experimentar esta semana ou algo pelo qual você precisa comprar um plano.

Nada sobre o modelo mudou. GPT-6.1 Sol Ultrafast é o mesmo checkpoint, a mesma janela de contexto de 1.050.000 tokens, o mesmo teto de saída de 128.000 tokens, a mesma data de corte de conhecimento de 30 de abril de 2026 e as mesmas respostas que o GPT-6.1 Sol. Ultrafast é um nível de serviço — uma prioridade de agendamento que você solicita —, não um segundo modelo. O produto inteiro é a latência, vendida a um múltiplo, e as únicas duas perguntas que importam são quanta dela você recebe e quem tem permissão para comprá-la.

O que o registro realmente diz, na ordem em que o diz

A versão de queixa desta história é que a OpenAI enterrou o portão. A versão exata é mais específica e pode ser verificada linha por linha em relação à própria documentação da OpenAI.

O changelog do desenvolvedor contém a entrada datada de 8 de outubro: a adição do modo Ultrafast para o GPT-6.1 Sol na API Responses, solicitado ao enviar model: "gpt-6.1-sol" com service_tier: "ultrafast", descrito como reduzindo o tempo entre tokens de saída gerados, e declarado como disponível para todos os usuários da API, sujeito a limites de taxa, com processamento global e residência de dados nos EUA e na UE. Lido por si só, isso é um lançamento irrestrito a um preço publicado.

A documentação da camada de serviço diz que Ultrafast é a camada de serviço mais rápida da API, amplamente disponível para GPT-6 Astra e GPT-6.1 Sol, com acesso de pré-visualização para GPT-5.6 Sol, e recomenda WebSockets para ela. Ainda não há menção a um plano.

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

O detalhe da assinatura está na página de velocidade do lado do ChatGPT, e são três limitações empilhadas em um único parágrafo: o Ultrafast está disponível no Codex e no ChatGPT Work, no Pro de $500 e em planos Enterprise e Edu elegíveis. Os administradores do Enterprise o recebem desativado por padrão e precisam habilitá-lo por usuário ou por workspace. E a superfície de consumo do Chat não recebe esse nível de forma alguma — o próprio GPT-6.1 Sol vive no Work e no Codex, então o Chat nunca esteve no escopo.

Junte as três páginas e o quadro fica claro. Uma chave de API é um ingresso. Uma assinatura do ChatGPT é um ingresso apenas se for a mais cara que a OpenAI vende, ou se um administrador a tiver habilitado para você. Ninguém que leia o primeiro post do anúncio adivinharia isso.

Por que o portão existe, e ele não é arbitrário.

A leitura óbvia é que a OpenAI está usando a via rápida para vender planos de US$ 500. O mecanismo por trás é menos cínico e mais útil: Ultrafast é um medidor caro, e um plano de US$ 500 é o único plano de consumidor em que um medidor de 8x cabe dentro do uso incluído.

Numa subscrição, a utilização incluída é consumida a oito vezes a taxa padrão quando se utiliza o Ultrafast, pelo que um único turno Ultrafast consome a mesma quota que oito turnos padrão. Isto é uma consequência daquilo que o nível faz — compra tempo de relógio ao gastar capacidade de serviço, e uma subscrição é um produto de capacidade fixa. Cobre a mesma quota por oito vezes o consumo de capacidade e a economia do plano quebra aos $20 por mês. Cobre oito vezes a quota e o nível torna-se simplesmente pouco atrativo num plano pequeno. De qualquer forma, o nível acaba onde a quota é suficientemente grande para o absorver.

A API não tem essa restrição, porque é medida por consumo. Lá, o Ultrafast tem seu próprio orçamento de limite de taxa, separado dos orçamentos do Standard e do Fast, e a OpenAI descreve esses limites como definidos por organização, em vez de publicados na página do nível. Essa é uma segunda coisa a observar que o anúncio não destacou: mudar uma carga de trabalho para o Ultrafast não apenas multiplica a conta, mas também move a carga de trabalho para um teto diferente, e, se você aumentar o tráfego além do que foi concedido à organização, os próprios limites do nível se tornam o modo de falha.

A aritmética de comprar velocidade de duas maneiras diferentes

Aqui está a decisão em números, e é a parte que vale a pena fazer com suas próprias contagens de tokens, não com as minhas. Considere uma sessão de agente que envia 30.000 tokens de entrada e recebe 1.500 tokens de saída por turno, ao longo de 40 turnos.

• Total de tokens por execução — 1.200.000 de entrada, 60.000 de saída, distribuídos por 40 requisições que cada uma fica confortavelmente abaixo do limite de 272.000 tokens onde a OpenAI reajusta o preço da requisição inteira.

• No GPT-6.1 Sol padrão — 1,2 milhão de tokens a US$ 2,00 por milhão dá US$ 2,40, mais 60.000 a US$ 10,00 por milhão dá US$ 0,60. Três dólares por execução.

• No GPT-6.1 Sol Ultrafast — 1,2 milhão a US$ 12,00 dá US$ 14,40, mais 60.000 a US$ 60,00 dá US$ 3,60. Dezoito dólares por execução.

• A diferença — US$ 15,00 por execução para remover a maior parte do tempo de geração em uma tarefa que, fora isso, não muda.

Esses US$ 15,00 por execução são o número a comparar com a assinatura. Se o único motivo de você estar considerando o plano Pro for o Ultrafast, aproximadamente 33 execuções por mês com essas contagens de tokens é onde os US$ 500 do plano e o medidor por token da API se cruzam — abaixo disso, o medidor é a forma mais barata de comprar o mesmo nível, e acima disso o plano começa a ganhar. Suas contagens de tokens vão deslocar esse ponto de cruzamento, às vezes bastante, então faça suas próprias contas antes de tratar 33 como um limiar. É nossa aritmética sobre uma carga de trabalho declarada, não um ponto de equilíbrio publicado.

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>Duas notas estruturais que sobrevivem a qualquer contagem de tokens.

A alegação relativa à velocidade é emprestada, e é a única coisa a ler com atenção.

Ultrafast é vendido com o argumento de "até 8x mais rápido", e a única medição específica de modelo que a OpenAI publica por trás dessa frase pertence a um modelo diferente. A frase em sua documentação diz que o GPT-6 Astra Ultrafast gera tokens até 8x mais rápido do que o GPT-6 Astra no modo Standard no Codex. Esse é um número do Astra, medido no Codex. A documentação do nível do GPT-6.1 Sol o descreve como algo que reduz o tempo entre tokens e aponta para uma tabela de tarifas; ela não informa um número, e nenhuma parte independente publicou uma medição de tokens por segundo para a variante Sol tampouco.

Pode muito bem se sustentar. Ambos os modelos rodam na mesma stack de serving e o mecanismo de tier é o mesmo, então um múltiplo da Astra é um prior razoável para o Sol. Mas "até 8x" é um teto do fornecedor, não reproduzido, tirado de um modelo irmão — e o "até" está fazendo um trabalho de verdade nessa frase. Trate o múltiplo como uma hipótese que você testa nos seus próprios prompts, porque a documentação do próprio tier nunca testa isso para você.

A mesma ressalva é mais fácil de fazer para os níveis mais antigos. O Ultrafast sobre o GPT-5.6 Sol foi anunciado em 13 de agosto de 2026 como "até 14x mais rápido que o processamento Standard", em pré-visualização limitada, e três meses depois a documentação ainda fala em acesso de pré-visualização, enquanto a tabela de tarifas do Ultrafast traz exatamente duas linhas — GPT-6 Astra e GPT-6.1 Sol. Um número de 14x sem preço publicado e sem disponibilidade geral é uma alegação, não um produto, e serve como um lembrete útil de quanto dessa escada de níveis ainda é apenas aspiracional.

Se o plano de $500 não vai acontecer

Para quem não vai comprar o Pro $500 para testar uma camada de latência, a medida útil é separar as duas coisas que o anúncio empacotou. A camada está disponível na API para todos os usuários da API, então a via rápida pode ser comprada sem uma assinatura — a $12,00 e $60,00 por milhão de tokens, com seu próprio orçamento de limite de taxa, em uma carga de trabalho pequena o suficiente para medir. Teste-a lá primeiro, com seus próprios prompts, em comparação com a via padrão.

A via padrão é a que existe sem nada disto. A OrcaRouter serve o GPT-6.1 Sol como openai/gpt-6.1-sol aos preços de tabela da própria OpenAI — $2.00 por milhão de tokens de entrada e $10.00 por milhão de tokens de saída — com 0% de margem e o preço do fornecedor repassado diretamente, pelo que uma alteração de preços do fornecedor chega ao nosso lado no mesmo dia. Ultrafast não é algo que vendemos: é um sinalizador de nível de serviço faturado na sua própria conta OpenAI, e preferimos dizê-lo claramente em vez de deixar uma página de modelo sugerir o contrário. O que uma única chave compra é a capacidade de encaminhar a via padrão e o resto do catálogo — mais de 200 modelos por trás de um único endpoint compatível com OpenAI — e de fazer failover automático entre fornecedores quando um está degradado, que é o seguro mais barato disponível se estiver prestes a colocar um nível de latência à frente de um caminho de produção.

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

E se você estiver no Plus ou no Team e a resposta que procurava era "posso simplesmente ativar isso", a resposta é não, com um formato específico. Codex e ChatGPT Work no Pro de US$ 500 ou em um plano Enterprise ou Edu elegível, habilitado por um administrador se for do tipo empresarial. Todo o restante acessa o Ultrafast por meio da API e paga por token.

O que assistir em seguida

Três coisas transformariam isto de um lançamento restrito em um comum, e todas as três são observáveis. Um limite de taxa publicado do Ultrafast para o GPT-6.1 Sol acabaria com a especulação sobre se o teto do próprio nível se impõe antes da fatura. Uma medição de velocidade específica do modelo — ou uma independente — substituiria o número emprestado do Astra por algo pelo qual o nível Sol possa ser avaliado. E o Ultrafast chegar ao ChatGPT Plus significaria que os cálculos de capacidade mudaram, o que é o sinal de que a restrição era escassez de lançamento, e não a forma permanente do nível.

Até então, o resumo honesto é limitado e verificável. O GPT-6.1 Sol foi lançado em 29 de setembro de 2026 e permanece inalterado. Em 8 de outubro de 2026, ele ganhou uma via rápida com um preço real, aberta a usuários da API e restrita no ChatGPT ao plano de $500 — um detalhe que merecia o primeiro post, e não o terceiro, e que decide, para a maioria dos leitores, se isto é um item de linha ou um pedido de compra.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente