
GPT-6 Astra Ultrafast vs GPT-5.6 Sol Ultrafast: um está na tabela de preços, o outro não
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 349 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 210 tok/s
- OrcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Os dois níveis Ultrafast não são gêmeos, e a diferença entre eles não é um benchmark. O GPT-6 Astra Ultrafast roda no GPT-6 Astra, o carro-chefe da empresa, que foi lançado em 3 de setembro de 2026 e ficou amplamente disponível no nível Ultrafast em 29 de setembro de 2026. O GPT-5.6 Sol Ultrafast roda no GPT-5.6 Sol, o modelo que ocupou o topo da linha da empresa desde 9 de julho de 2026, e está em prévia limitada desde 13 de agosto de 2026 — o estado em que ainda se encontra hoje. Leia a documentação de API da própria empresa em 30 de setembro de 2026 e a frase é inequívoca: Ultrafast "está amplamente disponível para o GPT-6 Astra, com acesso de prévia para o GPT-5.6 Sol."
Essa única frase produz toda a comparação e produz uma assimetria que uma tabela de especificações feita de duas linhas idênticas ocultaria. Ambos os níveis expõem os mesmos pesos de seus modelos pais, ambos são o mesmo conceito de serviço e, ainda assim, um deles tem um preço na tabela de preços da OpenAI e o outro não. Um comprador que decide entre eles, portanto, não está escolhendo entre dois preços. Está escolhendo entre um preço e uma lista de espera, o que é um tipo diferente de decisão e exige uma página diferente.
O que é, na verdade, a mesma coisa?
Comece pelas partes que não diferem, porque são a maior parte da substância e são o que torna a nomenclatura confusa em primeiro lugar.
• Os pesos — GPT-6 Astra Ultrafast é o GPT-6 Astra padrão em um caminho de serviço mais rápido, e GPT-5.6 Sol Ultrafast é o GPT-5.6 Sol padrão em um caminho de serviço mais rápido. Nenhum dos dois é um destilado, um ajuste fino ou um checkpoint separado. O esquema de requisição da OpenAI para o nível define model para o id do modelo base e adiciona service_tier: "ultrafast"; não há gpt-6-astra-ultrafast string de modelo.
• As respostas — o mesmo checkpoint na mesma configuração de esforço devem retornar o mesmo conteúdo, a menos da amostragem. Se as suas duas faixas divergirem em um prompt idêntico com configurações idênticas, isso é um achado que vale a pena investigar, e não um recurso que você comprou.
• A superfície de chamada — ambas são acessíveis pela API Responses, e a OpenAI recomenda WebSockets para qualquer uma delas, alertando que a sobrecarga de rede por requisição pode corroer a latência que o nível está pagando.
• A restrição de residência de dados — O Ultrafast oferece suporte apenas à residência de dados nos EUA e ao processamento global, e não oferece suporte a endpoints de processamento regionais da UE ou de outras regiões fora dos EUA. Isso se aplica ao nível, não ao modelo, portanto restringe ambos os lados igualmente.
Onde eles divergem verdadeiramente
Tudo o que separa estas duas vidas está nas colunas que o material de marketing não imprime lado a lado.
• Disponibilidade — O GPT-6 Astra Ultrafast está disponível para todos os usuários da API hoje, com baixos limites de taxa iniciais. O GPT-5.6 Sol Ultrafast é uma prévia limitada para um grupo seleto; a orientação da OpenAI hoje é entrar em contato com a equipe da sua conta para solicitar limites de taxa mais altos ou acesso à prévia do GPT-5.6 Sol.
• Preço — O GPT-6 Astra Ultrafast está na tabela de preços publicada a US$ 60,00 de entrada, US$ 6,00 de entrada em cache, US$ 75,00 de gravações em cache e US$ 300,00 de saída por 1 milhão de tokens para solicitações de até 272.000 tokens de entrada, passando para US$ 120,00 / US$ 12,00 / US$ 150,00 / US$ 450,00 acima desse limite. O GPT-5.6 Sol Ultrafast não tem nenhuma tabela de preços publicada. A tabela de preços Ultrafast da OpenAI tem exatamente uma linha, e a linha é gpt-6-astra.
• Preço do nível padrão logo abaixo — O GPT-6 Astra cobra $10,00 / $50,00 no padrão, o GPT-5.6 Sol $4,00 / $20,00, com a tarifa do Sol descrita na própria página da OpenAI como promocional e disponível pelo menos até 21 de novembro de 2026. O Sol é 2,5x mais barato em ambos os eixos antes de aplicar qualquer nível de velocidade.
• Teto de throughput — A documentação do Ultrafast da OpenAI afirma ser até 8x mais rápido que o modo Standard. O número atribuído à pré-visualização do Ultrafast do Sol é de até 14x, com até 750 tokens de saída por segundo, e é essa a cifra que o anúncio de 13 de agosto de 2026 trazia. São duas afirmações diferentes sobre dois modelos diferentes, não uma revisão de uma única afirmação.
• Hardware — o anúncio de pré-visualização nomeia a Cerebras como a parceira por trás do Ultrafast, com os pesos do modelo próximos ao silício. Nada na documentação atual associa uma alegação de hardware especificamente ao nível Astra; a história da Cerebras está documentada para a pré-visualização do Sol.
• Limites de taxa — O Ultrafast para GPT-6 Astra está documentado em 500.000 tokens por minuto para os níveis de API 1 a 3, 1.000.000 para o nível 4 e 5.000.000 para o nível 5. Não existe uma tabela publicada equivalente para Sol no Ultrafast, porque ele não está disponível de forma geral.
Um fato adjacente que vale a pena saber antes de presumir que o modelo mais novo herda a via rápida: a página de preços da OpenAI também traz o gpt-6.1-sol, e a seção Ultrafast também não tem uma linha para ele. O nível rápido é, hoje, uma capacidade da Astra com uma prévia do Sol anexada.

Lendo o 8x e o 14x juntos
Os dois números de velocidade são a parte mais citada incorretamente desta comparação, por isso vale a pena ser preciso sobre o que cada um representa.
O número de 14x e o de 750 tokens por segundo vêm da prévia do Ultrafast no GPT-5.6 Sol, divulgada pela OpenAI em 13 de agosto de 2026. Como está escrito nessa página, o Ultrafast "executa o GPT-5.6 Sol até 14x mais rápido que o processamento Standard" e "gera até 750 tokens de saída por segundo". Ambos são tetos de taxa de transferência de saída, medidos pelo fornecedor, em uma prévia limitada.
O valor de 8x é o que a página de documentação do Ultrafast da OpenAI afirma hoje como a descrição do próprio nível: "nosso nível de serviço de API mais rápido, com velocidades até 8x mais rápidas do que o modo Standard." O modelo amplamente disponível dessa página é o GPT-6 Astra.
A interpretação que resiste ao escrutínio é que o teto publicado do tier é 8x e o teto publicado do preview do Sol é 14x. Se a Astra no Ultrafast consegue atingir o número mais alto não é algo que a OpenAI tenha publicado, e nenhum dos números é uma promessa de latência para o seu tráfego — o tempo ponta a ponta ainda inclui processamento de entrada, chamadas de ferramentas e sua própria orquestração. Conte com 8x para a Astra, trate 14x como um número do preview do Sol que pode ou não se transferir, e verifique com seus próprios traces, em vez de um slide.

Para se ter uma noção, vale a pena manter em vista os níveis abaixo desses dois: Batch e Flex têm preço de 50% do Standard no GPT-6 Astra, e o Fast mode — renomeado de Priority processing em 30 de julho de 2026 — custa 2x o Standard, com um teto documentado de até 2,5x mais velocidade. Assim, a escada vai de 0,5x, 1x e 2x a até 2,5x de velocidade, e 6x a até 8x de velocidade. O salto de 2x para 6x compra cerca de 3,2x mais velocidade por 3x mais dinheiro, o que é uma troca aproximadamente linear, e não a mudança de patamar que o destaque de 8x sugere.
Tudo o que importa acontece no nível padrão
Existe uma versão desta comparação em que os níveis rápidos não decidem nada, e é a versão em que a maioria das equipes deveria estar.
Ambos os pais compartilham uma janela de contexto de 1.050.000 tokens e um teto de saída de 128.000 tokens, ambos aceitam entrada de texto e imagem e retornam texto, e ambos suportam a mesma superfície de chamada de funções e saída estruturada. As diferenças entre eles são as comuns entre duas gerações da mesma linha: o GPT-6 Astra traz um corte de conhecimento de 30 de abril de 2026 contra o de 16 de fevereiro de 2026 do Sol, e expõe esforço de raciocínio de low a max, enquanto o Sol oferece de none a max. Nos benchmarks independentes que o catálogo do OrcaRouter traz da Artificial Analysis, conforme lidos em 30 de setembro de 2026, o GPT-6 Astra registra 96,1 no GPQA Diamond e 54,7 no Humanity's Last Exam, contra 94,1 e 49,5 do GPT-5.6 Sol, com uma lacuna mais estreita em codificação — 76,9 contra 77,4 no AA Coding Index — e paridade quase total no Terminal-Bench v2.1, com 88,39 contra 88,01. Esses são números de uma única execução de um único avaliador, são obtidos na configuração padrão de cada modelo, e a Artificial Analysis refaz o recorte de seus índices, então trate-os como um instantâneo, e não como um valor permanente.
O objetivo de colocá-los aqui é que nenhum desses números muda quando você adiciona o Ultrafast. O nível rápido lhe entrega o mesmo modelo mais cedo, então, se sua decisão é qualidade por token, ela é resolvida inteiramente no nível padrão e o nível rápido nunca entra na discussão. Qual modelo você quer, a $10 / $50 ou a $4 / $20? Essa pergunta tem uma resposta que você pode testar hoje. Se você também quer pagar seis vezes a tarifa para obter a resposta desse modelo mais cedo é uma questão separada e muito mais restrita, e, para o GPT-5.6 Sol, é uma pergunta para a qual atualmente você não pode comprar uma resposta de jeito nenhum.
A decisão de compra, dita sem rodeios
Se você precisa de velocidade hoje, o GPT-6 Astra Ultrafast é o único desses dois que você realmente pode ter. Ele está disponível de forma geral para qualquer usuário de API nos limites de taxa documentados, e seu custo pode ser conhecido de antemão: $60 / $300 em contexto curto, $120 / $450 em contexto longo, com leituras em cache a $6,00 por milhão e gravações em cache a $75,00. A regra de decisão segue o múltiplo fixo de 6x — o nível justifica seu preço em trabalho interativo, no qual uma pessoa está esperando, e em loops nos quais a velocidade comprovadamente elimina turnos cobrados, mas não o justifica em trabalho em formato de lote ou limitado por throughput, em que Batch e Flex ficam pela metade do padrão na mesma tabela.
Se você quer velocidade no GPT-5.6 Sol, a resposta honesta é que ainda não é possível comprá-lo, e a própria página da OpenAI diz isso. A prévia existe, os números de 14x e 750 tokens por segundo foram publicados, e o acesso passa por uma equipe de contas. Qualquer pessoa que lhe diga um preço para o GPT-5.6 Sol Ultrafast está extrapolando; a tabela de preços publicada tem uma linha Ultrafast e ela não é a do Sol. A posição prática é manter o nível padrão do modelo que se encaixa na sua carga de trabalho em produção agora e tratar a prévia do Sol como um item de pipeline a ser revisitado quando ela se tornar comprável.
Onde ficam as rotas
Uma observação operacional, já que nenhum desses níveis rápidos é um modelo endereçável separadamente. O GPT-5.6 Sol no serviço padrão está disponível no OrcaRouter como openai/gpt-5.6-sol à própria tarifa do provedor — US$ 4,00 de entrada e US$ 20,00 de saída por milhão de tokens, com o escalonamento de contexto longo para US$ 8,00 / US$ 30,00 acima de 272K — e o GPT-6 Astra está disponível como openai/gpt-6-astra a US$ 10,00 / US$ 50,00 com seu próprio escalonamento de contexto longo. Ambos são servidos com 0% de markup, o que significa que o preço de tabela do provedor é repassado diretamente, então uma mudança de preço do fornecedor chega à sua fatura no mesmo dia, em vez de na renovação do contrato, e ambos ficam atrás de uma única chave ao lado de mais de 200 outros modelos com failover automático, para que você possa compará-los no seu próprio tráfego sem uma segunda integração.
Os níveis Ultrafast não são rotas que servimos. Eles são sinalizadores de nível de serviço controlados por acesso em uma conta da OpenAI — definidos pelo chamador em uma solicitação para o ID do modelo base, cobrados pela OpenAI pelas tarifas acima — e, para o GPT-5.6 Sol, condicionados a uma solicitação de pré-visualização. Dizer isso com precisão importa mais do que insinuar uma capacidade que não existe: se você está executando o Ultrafast, ele está na sua integração direta com a OpenAI, e o lugar sensato para o tráfego de nível padrão que você encaminha ao lado dele é um gateway que repassa o preço de tabela.

O que assistir
Duas coisas mudariam esta página, e nenhuma delas é um rumor a ser antecipado. A primeira é uma tabela de preços: no momento em que a OpenAI publicar um preço Ultrafast para o GPT-5.6 Sol, a comparação torna-se uma questão direta de seis vezes contra não se sabe o quê, e a aritmética que esbocei acima precisaria ser refeita com base nos $4 / $20 do Sol, em vez dos $10 / $50 do Astra. A segunda é a disponibilidade geral do preview do Sol, o que deslocaria a metade "você não pode comprar isto" da página. Até que uma dessas coisas se concretize, o resumo honesto é que o GPT-6 Astra Ultrafast é uma via rápida com preço definido, comprável e disponível de forma geral no modelo principal mais caro e mais recente, e o GPT-5.6 Sol Ultrafast é um preview documentado no modelo mais barato, com uma velocidade de destaque maior e nenhum preço.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
