Um cartão hero gerado com o título "Um nível, três modelos", com três chips exibindo "GPT-6.1 Sol Ultrafast: disponível, $12,00 / $60,00", "GPT-6 Astra Ultrafast: disponível, $60,00 / $300,00" e "GPT-5.6 Sol Ultrafast: somente prévia, sem preço publicado", sobre um rodapé que diz "Conforme lido na documentação da OpenAI em 9 de outubro de 2026".
Guides & Insights

GPT-6.1 Sol Ultrafast vs GPT-5.6 Sol Ultrafast: Um nível, três modelos, um deles ainda em espera

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

GPT-6.1 Sol Ultrafast e GPT-5.6 Sol Ultrafast são o mesmo nível de serviço aplicado a duas gerações diferentes do Sol e, após 8 de outubro de 2026, encontram-se em estados opostos. GPT-6.1 Sol passou de "em breve" para uma tabela de preços publicada — US$ 12,00 por milhão de tokens de entrada, US$ 60,00 por milhão de tokens de saída, seis vezes o Standard —, disponível para todos os usuários da API e para usuários do Codex e do ChatGPT Work no plano Pro de US$ 500. GPT-5.6 Sol continua onde o Ultrafast começou: um nível anunciado, em prévia limitada, sem nenhuma linha na página de preços. Mesmo nome, mesmo mecanismo, e apenas um deles é algo que você pode comprar.

Essa é a versão resumida. A versão mais longa importa porque os números de velocidade de destaque do nível estão atrelados a modelos diferentes, medidos em superfícies diferentes e, em um caso, desatualizados há três meses.

O que "Ultrafast" é de fato em cada modelo

Em nenhum dos modelos o Ultrafast é um checkpoint separado. Você envia o mesmo id de modelo e alterna um nível de serviço — model: "gpt-6.1-sol" com service_tier: "ultrafast" na API Responses — e a O​penAI agenda sua requisição no caminho de baixa latência. Os pesos, as respostas e a janela de contexto permanecem inalterados. No GPT-6.1 Sol, essa janela é de 1.050.000 tokens, com entrada máxima de 922.000 tokens e saída máxima de 128.000; o GPT-5.6 Sol tem a janela e o teto de saída idênticos e difere principalmente no corte de conhecimento (16 de fevereiro de 2026 contra 30 de abril de 2026) e na escada de raciocínio, em que o GPT-5.6 Sol ainda aceita none e o GPT-6.1 Sol não.

Portanto, a comparação não é "qual modelo é mais rápido a pensar". É "qual geração do mesmo nível está disponível para ti", e a resposta mudou há quatro dias.

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the WebSockets recommendation warning that network overhead can reduce the latency gains without a persistent connection, the note that Ultrafast has separate rate limits from Standard and Fast modes, the line that GPT-6.1 Sol supports US and EU data residency, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

Os múltiplos publicados, e o único número que permaneceu em 14x

A OpenAI publicou duas alegações de velocidade sobre este nível, em dois modelos, e nenhuma delas é uma declaração geral sobre “Ultrafast”.

• GPT-6 Astra Ultrafast — "gera tokens até 8 vezes mais rápido do que o GPT-6 Astra no modo Standard no Codex". Esta é a manchete atual do nível, repetida na documentação de velocidade do lado do ChatGPT.

• GPT-5.6 Sol Ultrafast — anunciado em 13 de agosto de 2026 como sendo "até 14x mais rápido que o processamento Standard", em pré-visualização limitada para clientes selecionados.

Observe o que está faltando. Não há múltiplo de velocidade publicado para o GPT-6.1 Sol Ultrafast. Sua página de documentação descreve o nível, fornece seus limites de taxa e postura de residência de dados, e aponta para a tabela de preços — mas o único múltiplo específico de modelo em todo o conjunto de documentos pertence ao Astra. A posição honesta é que "até 8x" é a medição do Astra, na mesma pilha de serviço, e é o número com base no qual o lançamento está sendo vendido sem ter sido reproduzido para o Sol por ninguém, dentro ou fora da OpenAI.

O número 14x merece mais desconfiança do que costuma receber, por ser tão antigo. Anunciado em meados de agosto para um nível que ainda não alcançou a disponibilidade geral, ele permaneceu sem revisão por cerca de dois meses, enquanto o próprio nível foi reconstruído em torno de dois outros modelos. Nesse período, a coisa óbvia de se esperar — que o Ultrafast do 5.6 Sol saísse da prévia e tivesse um preço definido — nunca aconteceu. Em vez disso, o GPT-6 Astra o recebeu em 29 de setembro, e o GPT-6.1 Sol o recebeu em 8 de outubro. Um número que só existe em um anúncio, vinculado a uma configuração que ninguém pode comprar, é texto de marketing até que esteja em uma tabela de preços.

Lado a lado: quanto custa cada um e quem pode acessá-lo

• Tarifa padrão — GPT-6.1 Sol $2,00 de entrada / $0,10 em cache / $2,50 de gravação em cache / $10,00 de saída por 1M de tokens vs GPT-5.6 Sol $4,00 / $0,40 / $5,00 / $20,00

• Taxa Ultrafast — GPT-6.1 Sol $12,00 / $0,60 / $15,00 / $60,00, publicada pela regra 6x-Standard e sua própria linha na tabela de preços Ultrafast vs GPT-5.6 Sol, sem taxa publicada

Contexto longo acima de 272K tokens de entrada — GPT-5.6 Sol com preços reajustados em 2x para entrada e taxas de cache e 1,5x para saída em toda a solicitação, oferecendo uma linha Ultrafast de contexto longo de $24,00 / $1,20 / $30,00 / $90,00 vs o equivalente Ultrafast do GPT-5.6 Sol, que ninguém publicou

• Disponibilidade do nível — GPT-6.1 Sol: todos os usuários da API, sujeitos a limites de taxa separados, e o Codex mais o ChatGPT Work no Pro de $500 e em planos Enterprise e Edu elegíveis vs GPT-5.6 Sol: pré-visualização limitada para clientes selecionados da API

• Limites de taxa no lançamento — o GPT-6.1 Sol tem seu próprio orçamento Ultrafast, separado dos limites Standard e Fast, definido por organização e aumentado sob solicitação em relação ao GPT-5.6 Sol, não publicado

• Residência de dados — GPT-6.1 Sol oferece suporte a residência nos EUA e na UE e processamento global nos modos Fast e Ultrafast, em comparação com GPT-5.6 Sol, com residência nos EUA e processamento global

• Múltiplo de velocidade — GPT-6.1 Sol, nenhum publicado vs GPT-5.6 Sol, "até 14x" no anúncio de agosto, não reproduzido

• Contexto e limite máximo de saída — 1.050.000 e 128.000 para ambos

Uma assimetria nessa lista merece destaque. GPT-6.1 Sol é a única configuração Ultrafast com residência de dados na UE: o Ultrafast da Astra é exclusivo dos EUA, e o 5.6 Sol não está aberto de forma alguma. Se sua carga de trabalho estiver vinculada ao processamento na UE, 8 de outubro é a primeira data em que este nível esteve disponível para você de qualquer forma.

Em uma assinatura, a diferença é o plano, não o modelo.

No Codex e no ChatGPT Work, ambas as gerações se comportam da mesma forma em termos estruturais — Ultrafast é um ajuste de velocidade num modelo que você já tem —, mas a barreira de acesso à frente dele é nova. O Ultrafast está disponível no Pro de US$ 500 e em planos Enterprise e Edu elegíveis, e fica desativado por padrão em espaços de trabalho Enterprise até que um administrador o habilite. Dentro de uma assinatura, o uso incluído é consumido a 8x a tarifa Standard, e créditos comprados ou o modelo pay-as-you-go do Enterprise são cobrados a 6x; na API, o multiplicador é o 6x fixo em todas as linhas de preço.

Especificamente para o GPT-5.6 Sol, nada disso está acessível ainda. Não há caminho por assinatura — a documentação de velocidade do lado do ChatGPT lista o Ultrafast como compatível com o GPT-6 Astra e o GPT-6.1 Sol — e o caminho via API continua barrado por trás de uma coorte de pré-visualização. Seja o que for que o número de 14x prometa, ele o promete a um conjunto de contas que não se ampliou em dois meses.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing exactly two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

Qual deles realmente usar, e quando esperar

Se você estiver começando hoje, a pergunta praticamente se responde sozinha: o GPT-6.1 Sol Ultrafast está disponível para compra, tem preço definido e está documentado, e o GPT-5 Sol Ultrafast não está. O motivo para recorrer ao modelo mais antigo não é de forma alguma o nível — é que o GPT-5 Sol está em circulação desde 9 de julho de 2026 e, se você tem suítes de prompts, avaliações e modelos de custo construídos com base nele, o custo de migrar para uma atualização do Sol com um corte de conhecimento diferente e uma escada de raciocínio estritamente mais estreita é real, mesmo com o preço reduzido pela metade. Faça essa migração conforme o seu próprio cronograma, não porque uma configuração de velocidade finalmente chegou.

A regra de decisão do próprio nível é a que a Astra sugere e a Sol valida: seis vezes o preço por uma redução de latência é uma boa troca quando um humano ou um agente está bloqueado à espera do resultado, e uma má quando uma tarefa pode esperar até de manhã. Nada no lançamento do GPT-6.1 Sol muda essa aritmética; ele apenas a disponibiliza em um modelo base mais barato, no qual o custo absoluto de um turno rápido é menor.

E se quiser o nível Fast em vez disso, pode deduzi-lo apenas pela tabela de preços: 2x Standard, e o Fast tem sido a opção intermédia estável desde que a OpenAI renomeou o Priority processing em 30 de julho de 2026. O Ultrafast continua a ser o nível em que se compra uma promessa não medida e, do lado do GPT-5.6 Sol, um que não se pode comprar de todo.

Chamar qualquer um deles a partir de uma única tecla

O GPT-5.6 Sol e o GPT-6.1 Sol de nível standard estão ambos no OrcaRouter — openai/gpt-5.6-sola US$ 4,00 de entrada e US$ 20,00 de saída por milhão de tokens, openai/gpt-6.1-sola US$ 2,00 e US$ 10,00 — servidos com 0% de markup, com o preço de tabela do fornecedor repassado, para que uma alteração de preço do fornecedor chegue à sua fatura no mesmo dia em que chega à tabela de preços. Isso importa mais do que o habitual neste par, porque o preço de US$ 4,00 / US$ 20,00 do GPT-5.6 Sol é explicitamente promocional e a OpenAI afirma que estará disponível pelo menos até 21 de novembro de 2026. Quando essa janela se fechar, a diferença entre as duas gerações diminui, e uma plataforma de repasse significa que você descobre isso nos seus números de utilização, e não num e-mail de renovação.

A mesma chave e o mesmo endpoint carregam mais de 200 modelos, portanto comparar as duas gerações do Sol no seu próprio tráfego não exige duas integrações nem dois contratos, e o failover automático mantém um caminho de produção em pé se um provedor degradar. Quando uma única resposta não basta, a DSL de roteamento compõe vários modelos em uma só chamada e a fusão de modelos coloca um painel por trás dela.

O que não servimos é o Ultrafast. Em qualquer dos modelos, é uma flag de nível de serviço numa conta O​penAI, em vez de um modelo separadamente roteável, por isso permanece dentro da sua integração direta com a O​penAI — e no GPT-5.6 Sol, nem sequer está disponível de forma geral lá. Dizemos isso claramente porque a alternativa é implicar uma capacidade que não temos. O que não é uma frase que queremos neste blog.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1,050,000-token context window, 128K maximum output, text and image input with text output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.36 s, a 2.86 s figure and 85.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente