
GPT-6.1 Sol Ultrafast vs GPT-5.6 Sol Ultrafast: Um nível, três modelos, um deles ainda em espera
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
GPT-6.1 Sol Ultrafast e GPT-5.6 Sol Ultrafast são o mesmo nível de serviço aplicado a duas gerações diferentes do Sol e, após 8 de outubro de 2026, encontram-se em estados opostos. GPT-6.1 Sol passou de "em breve" para uma tabela de preços publicada — US$ 12,00 por milhão de tokens de entrada, US$ 60,00 por milhão de tokens de saída, seis vezes o Standard —, disponível para todos os usuários da API e para usuários do Codex e do ChatGPT Work no plano Pro de US$ 500. GPT-5.6 Sol continua onde o Ultrafast começou: um nível anunciado, em prévia limitada, sem nenhuma linha na página de preços. Mesmo nome, mesmo mecanismo, e apenas um deles é algo que você pode comprar.
Essa é a versão resumida. A versão mais longa importa porque os números de velocidade de destaque do nível estão atrelados a modelos diferentes, medidos em superfícies diferentes e, em um caso, desatualizados há três meses.
O que "Ultrafast" é de fato em cada modelo
Em nenhum dos modelos o Ultrafast é um checkpoint separado. Você envia o mesmo id de modelo e alterna um nível de serviço — model: "gpt-6.1-sol" com service_tier: "ultrafast" na API Responses — e a OpenAI agenda sua requisição no caminho de baixa latência. Os pesos, as respostas e a janela de contexto permanecem inalterados. No GPT-6.1 Sol, essa janela é de 1.050.000 tokens, com entrada máxima de 922.000 tokens e saída máxima de 128.000; o GPT-5.6 Sol tem a janela e o teto de saída idênticos e difere principalmente no corte de conhecimento (16 de fevereiro de 2026 contra 30 de abril de 2026) e na escada de raciocínio, em que o GPT-5.6 Sol ainda aceita none e o GPT-6.1 Sol não.
Portanto, a comparação não é "qual modelo é mais rápido a pensar". É "qual geração do mesmo nível está disponível para ti", e a resposta mudou há quatro dias.

Os múltiplos publicados, e o único número que permaneceu em 14x
A OpenAI publicou duas alegações de velocidade sobre este nível, em dois modelos, e nenhuma delas é uma declaração geral sobre “Ultrafast”.
• GPT-6 Astra Ultrafast — "gera tokens até 8 vezes mais rápido do que o GPT-6 Astra no modo Standard no Codex". Esta é a manchete atual do nível, repetida na documentação de velocidade do lado do ChatGPT.
• GPT-5.6 Sol Ultrafast — anunciado em 13 de agosto de 2026 como sendo "até 14x mais rápido que o processamento Standard", em pré-visualização limitada para clientes selecionados.
Observe o que está faltando. Não há múltiplo de velocidade publicado para o GPT-6.1 Sol Ultrafast. Sua página de documentação descreve o nível, fornece seus limites de taxa e postura de residência de dados, e aponta para a tabela de preços — mas o único múltiplo específico de modelo em todo o conjunto de documentos pertence ao Astra. A posição honesta é que "até 8x" é a medição do Astra, na mesma pilha de serviço, e é o número com base no qual o lançamento está sendo vendido sem ter sido reproduzido para o Sol por ninguém, dentro ou fora da OpenAI.
O número 14x merece mais desconfiança do que costuma receber, por ser tão antigo. Anunciado em meados de agosto para um nível que ainda não alcançou a disponibilidade geral, ele permaneceu sem revisão por cerca de dois meses, enquanto o próprio nível foi reconstruído em torno de dois outros modelos. Nesse período, a coisa óbvia de se esperar — que o Ultrafast do 5.6 Sol saísse da prévia e tivesse um preço definido — nunca aconteceu. Em vez disso, o GPT-6 Astra o recebeu em 29 de setembro, e o GPT-6.1 Sol o recebeu em 8 de outubro. Um número que só existe em um anúncio, vinculado a uma configuração que ninguém pode comprar, é texto de marketing até que esteja em uma tabela de preços.
Lado a lado: quanto custa cada um e quem pode acessá-lo
• Tarifa padrão — GPT-6.1 Sol $2,00 de entrada / $0,10 em cache / $2,50 de gravação em cache / $10,00 de saída por 1M de tokens vs GPT-5.6 Sol $4,00 / $0,40 / $5,00 / $20,00
• Taxa Ultrafast — GPT-6.1 Sol $12,00 / $0,60 / $15,00 / $60,00, publicada pela regra 6x-Standard e sua própria linha na tabela de preços Ultrafast vs GPT-5.6 Sol, sem taxa publicada
Contexto longo acima de 272K tokens de entrada — GPT-5.6 Sol com preços reajustados em 2x para entrada e taxas de cache e 1,5x para saída em toda a solicitação, oferecendo uma linha Ultrafast de contexto longo de $24,00 / $1,20 / $30,00 / $90,00 vs o equivalente Ultrafast do GPT-5.6 Sol, que ninguém publicou
• Disponibilidade do nível — GPT-6.1 Sol: todos os usuários da API, sujeitos a limites de taxa separados, e o Codex mais o ChatGPT Work no Pro de $500 e em planos Enterprise e Edu elegíveis vs GPT-5.6 Sol: pré-visualização limitada para clientes selecionados da API
• Limites de taxa no lançamento — o GPT-6.1 Sol tem seu próprio orçamento Ultrafast, separado dos limites Standard e Fast, definido por organização e aumentado sob solicitação em relação ao GPT-5.6 Sol, não publicado
• Residência de dados — GPT-6.1 Sol oferece suporte a residência nos EUA e na UE e processamento global nos modos Fast e Ultrafast, em comparação com GPT-5.6 Sol, com residência nos EUA e processamento global
• Múltiplo de velocidade — GPT-6.1 Sol, nenhum publicado vs GPT-5.6 Sol, "até 14x" no anúncio de agosto, não reproduzido
• Contexto e limite máximo de saída — 1.050.000 e 128.000 para ambos
Uma assimetria nessa lista merece destaque. GPT-6.1 Sol é a única configuração Ultrafast com residência de dados na UE: o Ultrafast da Astra é exclusivo dos EUA, e o 5.6 Sol não está aberto de forma alguma. Se sua carga de trabalho estiver vinculada ao processamento na UE, 8 de outubro é a primeira data em que este nível esteve disponível para você de qualquer forma.
Em uma assinatura, a diferença é o plano, não o modelo.
No Codex e no ChatGPT Work, ambas as gerações se comportam da mesma forma em termos estruturais — Ultrafast é um ajuste de velocidade num modelo que você já tem —, mas a barreira de acesso à frente dele é nova. O Ultrafast está disponível no Pro de US$ 500 e em planos Enterprise e Edu elegíveis, e fica desativado por padrão em espaços de trabalho Enterprise até que um administrador o habilite. Dentro de uma assinatura, o uso incluído é consumido a 8x a tarifa Standard, e créditos comprados ou o modelo pay-as-you-go do Enterprise são cobrados a 6x; na API, o multiplicador é o 6x fixo em todas as linhas de preço.
Especificamente para o GPT-5.6 Sol, nada disso está acessível ainda. Não há caminho por assinatura — a documentação de velocidade do lado do ChatGPT lista o Ultrafast como compatível com o GPT-6 Astra e o GPT-6.1 Sol — e o caminho via API continua barrado por trás de uma coorte de pré-visualização. Seja o que for que o número de 14x prometa, ele o promete a um conjunto de contas que não se ampliou em dois meses.

Qual deles realmente usar, e quando esperar
Se você estiver começando hoje, a pergunta praticamente se responde sozinha: o GPT-6.1 Sol Ultrafast está disponível para compra, tem preço definido e está documentado, e o GPT-5 Sol Ultrafast não está. O motivo para recorrer ao modelo mais antigo não é de forma alguma o nível — é que o GPT-5 Sol está em circulação desde 9 de julho de 2026 e, se você tem suítes de prompts, avaliações e modelos de custo construídos com base nele, o custo de migrar para uma atualização do Sol com um corte de conhecimento diferente e uma escada de raciocínio estritamente mais estreita é real, mesmo com o preço reduzido pela metade. Faça essa migração conforme o seu próprio cronograma, não porque uma configuração de velocidade finalmente chegou.
A regra de decisão do próprio nível é a que a Astra sugere e a Sol valida: seis vezes o preço por uma redução de latência é uma boa troca quando um humano ou um agente está bloqueado à espera do resultado, e uma má quando uma tarefa pode esperar até de manhã. Nada no lançamento do GPT-6.1 Sol muda essa aritmética; ele apenas a disponibiliza em um modelo base mais barato, no qual o custo absoluto de um turno rápido é menor.
E se quiser o nível Fast em vez disso, pode deduzi-lo apenas pela tabela de preços: 2x Standard, e o Fast tem sido a opção intermédia estável desde que a OpenAI renomeou o Priority processing em 30 de julho de 2026. O Ultrafast continua a ser o nível em que se compra uma promessa não medida e, do lado do GPT-5.6 Sol, um que não se pode comprar de todo.
Chamar qualquer um deles a partir de uma única tecla
O GPT-5.6 Sol e o GPT-6.1 Sol de nível standard estão ambos no OrcaRouter — openai/gpt-5.6-sola US$ 4,00 de entrada e US$ 20,00 de saída por milhão de tokens, openai/gpt-6.1-sola US$ 2,00 e US$ 10,00 — servidos com 0% de markup, com o preço de tabela do fornecedor repassado, para que uma alteração de preço do fornecedor chegue à sua fatura no mesmo dia em que chega à tabela de preços. Isso importa mais do que o habitual neste par, porque o preço de US$ 4,00 / US$ 20,00 do GPT-5.6 Sol é explicitamente promocional e a OpenAI afirma que estará disponível pelo menos até 21 de novembro de 2026. Quando essa janela se fechar, a diferença entre as duas gerações diminui, e uma plataforma de repasse significa que você descobre isso nos seus números de utilização, e não num e-mail de renovação.
A mesma chave e o mesmo endpoint carregam mais de 200 modelos, portanto comparar as duas gerações do Sol no seu próprio tráfego não exige duas integrações nem dois contratos, e o failover automático mantém um caminho de produção em pé se um provedor degradar. Quando uma única resposta não basta, a DSL de roteamento compõe vários modelos em uma só chamada e a fusão de modelos coloca um painel por trás dela.
O que não servimos é o Ultrafast. Em qualquer dos modelos, é uma flag de nível de serviço numa conta OpenAI, em vez de um modelo separadamente roteável, por isso permanece dentro da sua integração direta com a OpenAI — e no GPT-5.6 Sol, nem sequer está disponível de forma geral lá. Dizemos isso claramente porque a alternativa é implicar uma capacidade que não temos. O que não é uma frase que queremos neste blog.

Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
