
GPT-6.1 Ultrafast é Pro por apenas $500, e esse detalhe estava enterrado a três posts de profundidade.
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
GPT-6.1 Sol Ultrafast chegou em 8 de outubro de 2026 com a coisa mais rara que um nível de velocidade pode trazer: um preço publicado. US$ 12,00 por milhão de tokens de entrada, US$ 60,00 por milhão de tokens de saída, exatamente seis vezes o que custa GPT-6.1 Sol — o modelo que a OpenAI lançou em 29 de setembro de 2026 em sua keynote do DevDay 2026 — na via padrão. O que a thread do anúncio não destacou logo de cara é onde um assinante do ChatGPT pode de fato ativá-lo, e a resposta, três posts mais abaixo, é o plano Pro de US$ 500. Essa ordem merece mais atenção do que recebeu, porque a metade da API e a metade da assinatura deste lançamento estão restringidas de maneiras opostas, e a diferença decide se o Ultrafast é algo que você pode experimentar esta semana ou algo pelo qual você precisa comprar um plano.
Nada sobre o modelo mudou. GPT-6.1 Sol Ultrafast é o mesmo checkpoint, a mesma janela de contexto de 1.050.000 tokens, o mesmo teto de saída de 128.000 tokens, a mesma data de corte de conhecimento de 30 de abril de 2026 e as mesmas respostas que o GPT-6.1 Sol. Ultrafast é um nível de serviço — uma prioridade de agendamento que você solicita —, não um segundo modelo. O produto inteiro é a latência, vendida a um múltiplo, e as únicas duas perguntas que importam são quanta dela você recebe e quem tem permissão para comprá-la.
O que o registro realmente diz, na ordem em que o diz
A versão de queixa desta história é que a OpenAI enterrou o portão. A versão exata é mais específica e pode ser verificada linha por linha em relação à própria documentação da OpenAI.
O changelog do desenvolvedor contém a entrada datada de 8 de outubro: a adição do modo Ultrafast para o GPT-6.1 Sol na API Responses, solicitado ao enviar model: "gpt-6.1-sol" com service_tier: "ultrafast", descrito como reduzindo o tempo entre tokens de saída gerados, e declarado como disponível para todos os usuários da API, sujeito a limites de taxa, com processamento global e residência de dados nos EUA e na UE. Lido por si só, isso é um lançamento irrestrito a um preço publicado.
A documentação da camada de serviço diz que Ultrafast é a camada de serviço mais rápida da API, amplamente disponível para GPT-6 Astra e GPT-6.1 Sol, com acesso de pré-visualização para GPT-5.6 Sol, e recomenda WebSockets para ela. Ainda não há menção a um plano.

O detalhe da assinatura está na página de velocidade do lado do ChatGPT, e são três limitações empilhadas em um único parágrafo: o Ultrafast está disponível no Codex e no ChatGPT Work, no Pro de $500 e em planos Enterprise e Edu elegíveis. Os administradores do Enterprise o recebem desativado por padrão e precisam habilitá-lo por usuário ou por workspace. E a superfície de consumo do Chat não recebe esse nível de forma alguma — o próprio GPT-6.1 Sol vive no Work e no Codex, então o Chat nunca esteve no escopo.
Junte as três páginas e o quadro fica claro. Uma chave de API é um ingresso. Uma assinatura do ChatGPT é um ingresso apenas se for a mais cara que a OpenAI vende, ou se um administrador a tiver habilitado para você. Ninguém que leia o primeiro post do anúncio adivinharia isso.
Por que o portão existe, e ele não é arbitrário.
A leitura óbvia é que a OpenAI está usando a via rápida para vender planos de US$ 500. O mecanismo por trás é menos cínico e mais útil: Ultrafast é um medidor caro, e um plano de US$ 500 é o único plano de consumidor em que um medidor de 8x cabe dentro do uso incluído.
Numa subscrição, a utilização incluída é consumida a oito vezes a taxa padrão quando se utiliza o Ultrafast, pelo que um único turno Ultrafast consome a mesma quota que oito turnos padrão. Isto é uma consequência daquilo que o nível faz — compra tempo de relógio ao gastar capacidade de serviço, e uma subscrição é um produto de capacidade fixa. Cobre a mesma quota por oito vezes o consumo de capacidade e a economia do plano quebra aos $20 por mês. Cobre oito vezes a quota e o nível torna-se simplesmente pouco atrativo num plano pequeno. De qualquer forma, o nível acaba onde a quota é suficientemente grande para o absorver.
A API não tem essa restrição, porque é medida por consumo. Lá, o Ultrafast tem seu próprio orçamento de limite de taxa, separado dos orçamentos do Standard e do Fast, e a OpenAI descreve esses limites como definidos por organização, em vez de publicados na página do nível. Essa é uma segunda coisa a observar que o anúncio não destacou: mudar uma carga de trabalho para o Ultrafast não apenas multiplica a conta, mas também move a carga de trabalho para um teto diferente, e, se você aumentar o tráfego além do que foi concedido à organização, os próprios limites do nível se tornam o modo de falha.
A aritmética de comprar velocidade de duas maneiras diferentes
Aqui está a decisão em números, e é a parte que vale a pena fazer com suas próprias contagens de tokens, não com as minhas. Considere uma sessão de agente que envia 30.000 tokens de entrada e recebe 1.500 tokens de saída por turno, ao longo de 40 turnos.
• Total de tokens por execução — 1.200.000 de entrada, 60.000 de saída, distribuídos por 40 requisições que cada uma fica confortavelmente abaixo do limite de 272.000 tokens onde a OpenAI reajusta o preço da requisição inteira.
• No GPT-6.1 Sol padrão — 1,2 milhão de tokens a US$ 2,00 por milhão dá US$ 2,40, mais 60.000 a US$ 10,00 por milhão dá US$ 0,60. Três dólares por execução.
• No GPT-6.1 Sol Ultrafast — 1,2 milhão a US$ 12,00 dá US$ 14,40, mais 60.000 a US$ 60,00 dá US$ 3,60. Dezoito dólares por execução.
• A diferença — US$ 15,00 por execução para remover a maior parte do tempo de geração em uma tarefa que, fora isso, não muda.
Esses US$ 15,00 por execução são o número a comparar com a assinatura. Se o único motivo de você estar considerando o plano Pro for o Ultrafast, aproximadamente 33 execuções por mês com essas contagens de tokens é onde os US$ 500 do plano e o medidor por token da API se cruzam — abaixo disso, o medidor é a forma mais barata de comprar o mesmo nível, e acima disso o plano começa a ganhar. Suas contagens de tokens vão deslocar esse ponto de cruzamento, às vezes bastante, então faça suas próprias contas antes de tratar 33 como um limiar. É nossa aritmética sobre uma carga de trabalho declarada, não um ponto de equilíbrio publicado.

p>Duas notas estruturais que sobrevivem a qualquer contagem de tokens.
A alegação relativa à velocidade é emprestada, e é a única coisa a ler com atenção.
Ultrafast é vendido com o argumento de "até 8x mais rápido", e a única medição específica de modelo que a OpenAI publica por trás dessa frase pertence a um modelo diferente. A frase em sua documentação diz que o GPT-6 Astra Ultrafast gera tokens até 8x mais rápido do que o GPT-6 Astra no modo Standard no Codex. Esse é um número do Astra, medido no Codex. A documentação do nível do GPT-6.1 Sol o descreve como algo que reduz o tempo entre tokens e aponta para uma tabela de tarifas; ela não informa um número, e nenhuma parte independente publicou uma medição de tokens por segundo para a variante Sol tampouco.
Pode muito bem se sustentar. Ambos os modelos rodam na mesma stack de serving e o mecanismo de tier é o mesmo, então um múltiplo da Astra é um prior razoável para o Sol. Mas "até 8x" é um teto do fornecedor, não reproduzido, tirado de um modelo irmão — e o "até" está fazendo um trabalho de verdade nessa frase. Trate o múltiplo como uma hipótese que você testa nos seus próprios prompts, porque a documentação do próprio tier nunca testa isso para você.
A mesma ressalva é mais fácil de fazer para os níveis mais antigos. O Ultrafast sobre o GPT-5.6 Sol foi anunciado em 13 de agosto de 2026 como "até 14x mais rápido que o processamento Standard", em pré-visualização limitada, e três meses depois a documentação ainda fala em acesso de pré-visualização, enquanto a tabela de tarifas do Ultrafast traz exatamente duas linhas — GPT-6 Astra e GPT-6.1 Sol. Um número de 14x sem preço publicado e sem disponibilidade geral é uma alegação, não um produto, e serve como um lembrete útil de quanto dessa escada de níveis ainda é apenas aspiracional.
Se o plano de $500 não vai acontecer
Para quem não vai comprar o Pro $500 para testar uma camada de latência, a medida útil é separar as duas coisas que o anúncio empacotou. A camada está disponível na API para todos os usuários da API, então a via rápida pode ser comprada sem uma assinatura — a $12,00 e $60,00 por milhão de tokens, com seu próprio orçamento de limite de taxa, em uma carga de trabalho pequena o suficiente para medir. Teste-a lá primeiro, com seus próprios prompts, em comparação com a via padrão.
A via padrão é a que existe sem nada disto. A OrcaRouter serve o GPT-6.1 Sol como openai/gpt-6.1-sol aos preços de tabela da própria OpenAI — $2.00 por milhão de tokens de entrada e $10.00 por milhão de tokens de saída — com 0% de margem e o preço do fornecedor repassado diretamente, pelo que uma alteração de preços do fornecedor chega ao nosso lado no mesmo dia. Ultrafast não é algo que vendemos: é um sinalizador de nível de serviço faturado na sua própria conta OpenAI, e preferimos dizê-lo claramente em vez de deixar uma página de modelo sugerir o contrário. O que uma única chave compra é a capacidade de encaminhar a via padrão e o resto do catálogo — mais de 200 modelos por trás de um único endpoint compatível com OpenAI — e de fazer failover automático entre fornecedores quando um está degradado, que é o seguro mais barato disponível se estiver prestes a colocar um nível de latência à frente de um caminho de produção.

E se você estiver no Plus ou no Team e a resposta que procurava era "posso simplesmente ativar isso", a resposta é não, com um formato específico. Codex e ChatGPT Work no Pro de US$ 500 ou em um plano Enterprise ou Edu elegível, habilitado por um administrador se for do tipo empresarial. Todo o restante acessa o Ultrafast por meio da API e paga por token.
O que assistir em seguida
Três coisas transformariam isto de um lançamento restrito em um comum, e todas as três são observáveis. Um limite de taxa publicado do Ultrafast para o GPT-6.1 Sol acabaria com a especulação sobre se o teto do próprio nível se impõe antes da fatura. Uma medição de velocidade específica do modelo — ou uma independente — substituiria o número emprestado do Astra por algo pelo qual o nível Sol possa ser avaliado. E o Ultrafast chegar ao ChatGPT Plus significaria que os cálculos de capacidade mudaram, o que é o sinal de que a restrição era escassez de lançamento, e não a forma permanente do nível.
Até então, o resumo honesto é limitado e verificável. O GPT-6.1 Sol foi lançado em 29 de setembro de 2026 e permanece inalterado. Em 8 de outubro de 2026, ele ganhou uma via rápida com um preço real, aberta a usuários da API e restrita no ChatGPT ao plano de $500 — um detalhe que merecia o primeiro post, e não o terceiro, e que decide, para a maioria dos leitores, se isto é um item de linha ou um pedido de compra.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
