
Data de lançamento, recursos, preços e guia de acesso do GPT-5.6
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-10$0.15 / $0.60 por 1M de tokens
- openaiNOVOOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleNOVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenNOVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligência72Código
- anthropicNOVOAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligência69Código
O GPT-5.6 Sol acaba de ganhar um nível de velocidade Ultrafast — até 14X mais rápido que o processamento Standard, em prévia na API da OpenAI esta semana — enquanto o GPT-5.6 Terra e o GPT-5.6 Luna continuam a expansão da família no ChatGPT. Dois meses após o lançamento da API, a geração GPT-5.6 está amplamente disponível e ainda ampliando suas capacidades: o mesmo carro-chefe que supera o GPT-5.5 em raciocínio agora pode ser testado em prévia com até 750 tokens de saída por segundo. Na mesma semana, a OpenAI também expandiu seu programa de cibersegurança Daybreak, criando o Daybreak Blue para defensores e o Daybreak Red, com tecnologia de um novo modelo GPT-5.6-Cyber construído sobre o Sol para pesquisa autorizada de vulnerabilidades.
OpenAI lançou a família de modelos GPT-5.6 em 9 de julho de 2026 e, em 6 de agosto, colocou o modelo principal no ChatGPT com uma atualização focada em confiabilidade e acesso gratuito expandido. Não se trata apenas de mais uma atualização de modelo único. É uma família em camadas projetada para dar aos desenvolvedores escolhas mais claras entre inteligência, velocidade e custo — e agora também é a experiência padrão para usuários gratuitos do ChatGPT.
O problema é que “GPT-5.6” significa coisas diferentes em lugares diferentes.
A API está no ar desde 9 de julho com preços públicos para todos os três níveis. O lançamento do ChatGPT é faseado: o Sol atualizado chegou aos usuários Plus e Pro em 6 de agosto, o GPT-5.6 Luna torna-se o padrão para contas Free e Go esta semana, e os chats somente de texto nesses níveis passam a ser ilimitados na semana de 10 de agosto. O Sol por trás das superfícies Work e Codex do ChatGPT não foi alterado pela atualização. A prévia Ultrafast é separada novamente: um novo nível de velocidade na API, anunciado em 13 de agosto, inicialmente limitado a um pequeno grupo de clientes.
Então, o GPT-5.6 é oficial, está em distribuição e é amplamente acessível — e seu modelo principal é agora o modelo de fronteira mais rápido no papel. Para os desenvolvedores, a parte interessante continua sendo a decisão de roteamento: Sol para os raciocínios mais difíceis, Terra para trabalho de produção equilibrado, Luna para alto volume — e, quando a prévia for aberta, um nível Ultrafast para cargas de trabalho Sol críticas em latência — com preços que mudaram para dois dos três níveis no final de julho.
Este guia explica o que é o GPT-5.6, o que está oficialmente confirmado, como Sol, Terra e Luna se diferenciam, como funciona o preço, o que significa a pré-visualização Ultrafast e por que o GPT-5.6 torna o roteamento de modelos mais importante.
Resposta rápida
O GPT-5.6 foi lançado?Sim. A API foi lançada em 9 de julho de 2026, e o acesso ao ChatGPT está sendo distribuído gradualmente — Sol atualizado para Plus/Pro desde 6 de agosto, Luna como padrão do plano gratuito/Go esta semana.
Posso usar o GPT-5.6 no ChatGPT?Sim. O GPT-5.6 Sol é agora o padrão atualizado na experiência de Chat Plus/Pro (com um novo controle deslizante de pensamento), e o GPT-5.6 Luna está se tornando o modelo padrão para contas Free e Go esta semana.
Posso usar o GPT-5.6 através da API? Sim. Sol, Terra e Luna estão todas ativas na API pública com preços publicados, e no OrcaRouter com margem de 0%.
O que é o modo Ultrafast do GPT-5.6 Sol? É um nível de velocidade em pré-visualização na API que executa o GPT-5.6 Sol até 14X mais rápido que o processamento Standard, a até 750 tokens de saída por segundo. Inicialmente, está limitado a um pequeno grupo de clientes, e a OpenAI não publicou preços para ele.
Existe uma lista de espera? Para acesso base, não — a API é pública e o acesso ao ChatGPT está sendo liberado gradualmente em todos os níveis, então não há nada para aderir. O modo Ultrafast é diferente: é uma prévia limitada, inicialmente aberta a um pequeno grupo de clientes, com inscrição para notificação conforme a capacidade aumenta.
Quando o GPT-5.6 será disponibilizado de forma geral? Já está, em etapas: a API entrou no ar em 9 de julho de 2026, o Sol atualizado chegou ao ChatGPT Plus/Pro em 6 de agosto, a Luna se torna o padrão do free/Go esta semana, e os chats de texto gratuitos ilimitados chegam na semana de 10 de agosto.
Você deve esperar pelo GPT-5.6?Não, se você quiser usá-lo — ele já está no ar. A verdadeira questão é para qual nível encaminhar cada tarefa e quanto raciocínio permitir, porque é isso que agora determina o seu custo por tarefa.
O que é GPT-5.6?
GPT-5.6 é a mais nova família de modelos da OpenAI e a geração sucessora do GPT-5.5.
A palavra-chave é família.
Em vez de lançar um modelo para cada caso de uso, a OpenAI está introduzindo três níveis:
- GPT-5.6 Solé o modelo principal para os trabalhos mais difíceis: raciocínio profundo, codificação com agentes, pesquisa, trabalho de conhecimento profissional e tarefas complexas que exigem muitas ferramentas.
- GPT-5.6 Terra é o modelo equilibrado para o trabalho do dia a dia. Ele foi projetado para oferecer forte capacidade a um custo menor, tornando-o mais adequado para aplicativos de produção que não podem enviar todas as solicitações para o modelo principal.
- GPT-5.6 Luna é o nível mais rápido e econômico. Ele é destinado a tarefas de alto volume, automação leve, resumos, classificação, roteamento e outras cargas de trabalho em que velocidade e custo importam mais do que profundidade máxima de raciocínio.
Isso muda a principal pergunta que os desenvolvedores precisam fazer.
A pergunta não é mais: Devo usar GPT-5.6?
A melhor pergunta é: Qual modelo GPT-5.6 deve lidar com essa tarefa?
Nem toda requisição precisa de Sol. Algumas tarefas exigem raciocínio máximo. Algumas precisam de menor latência. Algumas precisam do modelo confiável mais barato. O GPT-5.6 torna esse trade-off explícito.
O que está oficialmente confirmado?

O GPT‑5.6 não deve ser tratado como um apanhado de boatos. A OpenAI confirmou oficialmente a família de modelos e o acesso de preview.
Os pontos confirmados são:
GPT-5.6 é uma família de modelos com Sol, Terra e Luna.
Foi lançado na API em 9 de julho de 2026, com todos os três níveis com preços públicos.
- O acesso ao ChatGPT está sendo liberado gradualmente: Sol atualizado para Plus/Pro (6 de agosto), Luna como o padrão gratuito/Go (esta semana), chats de texto gratuitos ilimitados (semana de 10 de agosto).
A OpenAI informa que o Sol atualizado comete ~68% menos erros factuais do que o GPT-5.5 Instant em avaliações internas dos domínios financeiro, médico e jurídico (números divulgados pelo fornecedor; ~62% para o Luna).
Os usuários Plus e Pro ganham um novo controle deslizante de pensamento para controlar quanto raciocínio cada resposta gasta.
- O preço da API é público — e Terra e Luna foram cortadas no final de julho de 2026 (Sol inalterado).
GPT-5.6 introduz cache de prompt mais previsível.
- GPT-5.6 Sol inclui um novo esforço máximo de raciocínio.
O GPT-5.6 introduz um modo ultra que utiliza subagentes para trabalhos complexos.
- A OpenAI apresentou em prévia o modo Ultrafast para o GPT-5.6 Sol na API em 13 de agosto de 2026 — até 14X mais rápido que o processamento padrão, com até 750 tokens de saída por segundo, inicialmente para um pequeno grupo de clientes. Os números de velocidade são informados pelo fornecedor e ainda não foram reproduzidos de forma independente.
A OpenAI expandiu o Daybreak, seu programa de cibersegurança verificado, em dois níveis em 10 de agosto de 2026: Daybreak Blue (GPT-5.6 Sol com proteções cibernéticas removidas, para trabalho defensivo) e Daybreak Red (GPT-5.6-Cyber, um modelo baseado em Sol treinado especificamente para pesquisa autorizada de vulnerabilidades). O acesso é restrito a clientes verificados e parceiros de segurança, não à API pública.
As questões em aberto são diferentes:
Como o Sol ajustado para ChatGPT se comparará ao API Sol em tarefas reais?
Qual será a velocidade em fluxos de trabalho reais de produção? A prévia Ultrafast é o primeiro ponto de dados real e ainda está disponível somente para convidados.
- Com que frequência as salvaguardas adicionarão atrito?
- Como Sol, Terra e Luna se compararão em tarefas reais?
Quanto raciocínio é suficiente, e como você mede o novo controle deslizante de pensamento?
- Como o nível Ultrafast será precificado, e com que rapidez a oferta da Cerebras consegue acompanhar a demanda por ele?
Por isso, a abordagem correta é a preparação, e não a migração cega.
Data de lançamento e acesso do GPT-5.6

A resposta mais simples: {{1}}GPT-5.6{{/1}} foi lançado na API em 9 de julho de 2026, e o acesso ao ChatGPT está sendo liberado gradualmente ao longo de agosto.
O acesso à API agora está aberto a qualquer desenvolvedor com preços publicados. O que ainda varia é a superfície: o Sol ajustado para a experiência de Chat do ChatGPT não é o mesmo que o modelo da API — a OpenAI diz que a versão que alimenta Work e Codex permanece inalterada — então o comportamento pode diferir entre o aplicativo de consumidor e a API.
Para os usuários do ChatGPT, o cenário de junho está invertido. Usuários Plus e Pro recebem o Sol atualizado com um novo controle deslizante de pensamento na web, no celular e no desktop, que troca profundidade de resposta por latência. Usuários Free e Go recebem Luna como padrão esta semana, além de um botão Think para perguntas mais difíceis, com chats somente de texto ilimitados chegando na semana de 10 de agosto.
A parte mais recente da história de acesso é a prévia Ultrafast. Anunciada em 13 de agosto de 2026, ela é um novo nível de velocidade na API para o GPT-5.6 Sol — até 14X mais rápida que o processamento Standard (declarado pelo fornecedor) — e está começando com um pequeno grupo de clientes, em vez de um lançamento aberto. A OpenAI diz que está testando o nível em codificação, comércio, pesquisa financeira, suporte ao cliente e aplicações interativas para descobrir onde a velocidade cria valor real antes de expandir o acesso. Outros clientes podem se inscrever para serem notificados quando a capacidade aumentar.
Para desenvolvedores, a formulação segura agora é: GPT-5.6 é uma família de APIs lançada e com preço definido. A incerteza restante é comportamental — o quanto cada nível pensa, o quão verboso ele é, e quanto isso custa por tarefa concluída — e não se você consegue acesso. O nível Ultrafast é o único lugar onde o acesso ainda é a questão.
Essa distinção é importante. Não planeje um lançamento em torno de uma data de acesso ao GPT‑5.6; planeje em torno do comportamento do tier e do custo por tarefa. Monte seu conjunto de avaliação, meça o esforço de raciocínio e mantenha uma rota alternativa.
GPT-5.6 Sol, Terra e Luna explicados

GPT-5.6 Sol
Sol é o modelo para testar quando a qualidade importa mais do que o custo.
Use para:
- engenharia de software complexa
fluxos de trabalho de codificação agênticos
- uso de ferramentas de longo horizonte
depuração difícil
análise de pesquisa
raciocínio empresarial de alto risco
defesa de cibersegurança e pesquisa de vulnerabilidades
Sol é o nível principal, mas isso não significa que ele deva lidar com todas as solicitações.
Em 6 de agosto de 2026, a OpenAI também ajustou o Sol que roda na experiência de Chat do ChatGPT para conversas do dia a dia — mais confiável com fatos, respostas mais diretas e um tom consistente entre Instant e Thinking. As avaliações internas da OpenAI, não um laboratório independente, apontaram erros factuais cerca de 68% menores que o GPT-5.5 Instant em prompts financeiros, médicos e legais. O ajuste do ChatGPT é separado do modelo da API; o Sol por trás do Work e do Codex não foi alterado.
Sol é também o nível que está recebendo a prévia do Ultrafast. Em 13 de agosto de 2026, a OpenAI apresentou uma prévia de um modo Ultrafast para Sol na API que executa o mesmo modelo até 14X mais rápido do que o processamento Standard (segundo a fornecedora), voltado para trabalhos em que a latência é crítica. Ainda não está amplamente disponível — a prévia começa com um pequeno grupo de clientes —, mas é o primeiro sinal de que a qualidade da Sol não precisa vir com a latência do nível Standard.
Sol é também o modelo por trás do programa Daybreak da OpenAI: o Daybreak Blue fornece o GPT-5.6 Sol com defesas cibernéticas removidas para defensores credenciados, e o GPT-5.6-Cyber é treinado especificamente na Sol para pesquisa autorizada de vulnerabilidades. Ambos os níveis têm acesso restrito e estão fora da API pública.
GPT-5.6 Terra
Terra é a opção equilibrada.
Use para:
assistentes de IA do dia a dia
redação e análise de negócios
ferramentas de conhecimento interno
fluxos de trabalho de suporte ao cliente
- ajuda de codificação que não precisa de raciocínio máximo
- processamento de documentos
automação de média complexidade
Terra pode se tornar o nível GPT-5.6 mais prático para muitos aplicativos de produção, porque equilibra capacidade e preço.
GPT-5.6 Luna
Luna é o nível rápido e acessível.
Use para:
solicitações de alto volume
- classificação
- roteamento
sumarização
transformações simples
passos de agente leve
- respostas de fallback
- geração de rascunho
Luna é útil quando a tarefa é tão simples que pagar por Sol seria desperdício.
Luna também é agora o padrão para os consumidores: a OpenAI tornou o GPT-5.6 Luna o modelo por trás das contas Free e Go do ChatGPT na semana de 3 de agosto de 2026, substituindo o GPT-5.5 Instant. Um novo botão Think permite que esses usuários solicitem raciocínio mais avançado, e os chats somente de texto se tornam ilimitados na semana de 10 de agosto.
Preços e cache do GPT-5.6
O preço do GPT-5.6 já é público.
GPT-5.6 Sol
- Entrada: $5 por 1 milhão de tokens
- Saída: $30 por 1M tokens
- Melhor para raciocínio de ponta, codificação complexa e trabalho agêntico profundo.
GPT-5.6 Terra
$2 por 1M de tokens (reduzido de $2,50 no final de julho de 2026)
- Saída: US$ 12 por 1M de tokens (reduzido de US$ 15)
- Melhor para trabalho equilibrado do dia a dia
GPT-5.6 Luna
- Entrada: US$ 0,20 por 1M de tokens (reduzido de US$ 1)
Saída: $1.20 por 1M tokens (reduzido de $6)
- Melhor para cargas de trabalho rápidas, acessíveis e de alto volume
A OpenAI cortou os preços da Terra em 20% e da Luna em 80% no final de julho de 2026, citando ganhos de eficiência de inferência; a Sol permaneceu em US$ 5/US$ 30. Como o OrcaRouter repassa os preços dos provedores com margem de 0%, esses cortes aparecem em nossas páginas de modelos no mesmo dia em que são lançados.
A prévia do Ultrafast ainda não tem preço publicado. É uma prévia limitada para um pequeno grupo de clientes, e a OpenAI não disse como o nível será cobrado — então não assuma que a taxa de $5/$30 Sol se aplica a ela. Isso vale a pena acompanhar junto com os números de velocidade: se um nível de velocidade premium chegar com uma taxa premium, a matemática de custo por token para cargas de trabalho críticas de latência muda.
O preço deixa uma coisa clara: o GPT-5.6 não foi feito para ser usado como um modelo padrão para todas as tarefas.
Uma estratégia de roteamento sensata poderia ser assim:
- use Luna para tarefas simples e de alto volume;
- use Terra para raciocínio cotidiano e fluxos de trabalho empresariais;
- use Sol para as tarefas mais difíceis de codificação, pesquisa ou agentivas;
- armazenar agressivamente em cache o contexto repetido;
evitar enviar todas as solicitações para Sol por padrão.
GPT-5.6 também introduz um cache de prompt mais previsível, incluindo pontos de interrupção de cache explícitos e uma vida útil mínima de cache de 30 minutos. Para fluxos de trabalho de longa duração, agentes de codificação e assistentes empresariais, isso pode fazer muita diferença.
A lição prática: Meça o custo por tarefa concluída, não apenas o custo por token.
Um modelo mais caro pode ser mais barato se concluir o trabalho em menos tentativas. Um modelo mais barato pode ser melhor quando a tarefa é simples e de alto volume.
O que há de novo no GPT-5.6?
O GPT-5.6 não deve ser descrito principalmente por números de janela de contexto rumorejados ou logs internos vazados.
As mudanças importantes são as que a OpenAI confirmou.
Uma família de modelos de três camadas
Sol, Terra e Luna tornam a seleção de modelos mais estruturada. Os desenvolvedores podem encaminhar tarefas com base em dificuldade, latência e custo, em vez de enviar tudo para um modelo principal.
Fluxos de trabalho agentivos e de codificação mais fortes
O GPT-5.6 Sol está posicionado em torno de codificação agentiva, fluxos de trabalho de linha de comando, planejamento, iteração e coordenação de ferramentas.
Isso é importante porque os agentes de codificação modernos fazem mais do que escrever trechos. Eles inspecionam repositórios, executam comandos, entendem falhas de teste, aplicam patches em arquivos, verificam alterações e repetem até que a tarefa seja concluída.
Novo esforço máximo de raciocínio
Sol apresenta um novo esforço máximo de raciocínio para tarefas mais difíceis.
Isto não deve ser usado em toda parte. O raciocínio avançado pode aumentar o custo e a latência, por isso deve ser reservado para trabalhos onde um planejamento mais profundo vale a pena: depuração complexa, migrações, síntese de pesquisa, revisão de segurança ou análise de dados difícil.
Modo Ultra com subagentes
GPT-5.6 apresenta um modo ultra que utiliza subagentes para tarefas complexas.
Isso aponta para um futuro onde os modelos não apenas respondem a comandos. Eles coordenam o trabalho em várias etapas ou agentes especializados.
Modo ultrarrápido: GPT-5.6 Sol com velocidade de até 14X
Em 13 de agosto de 2026, a OpenAI apresentou o Ultrafast, um novo nível de serviço na API que executa o GPT-5.6 Sol até 14 vezes mais rápido que o processamento Standard, gerando até 750 tokens de saída por segundo. A OpenAI afirma que o nível oferece a mesma inteligência que o GPT-5.6 Sol Standard — a aceleração está relacionada à latência, não a um modelo menor ou mais fraco. Esses números de velocidade são fornecidos pelo fornecedor: a OpenAI os anunciou em conjunto com sua parceira de inferência Cerebras, e nenhum laboratório independente os reproduziu ainda.
A velocidade vem de uma pilha de inferência diferente, não de um modelo diferente. O Ultrafast roda na arquitetura Wafer-Scale Engine da Cerebras, que mantém os pesos do modelo no chip (44 GB de SRAM por chip do tamanho de um wafer) e elimina o gargalo de largura de banda de memória que limita a inferência baseada em GPU. Para este nível, a OpenAI está usando o hardware da Cerebras em vez do seu próprio.
Ultrafast é inicialmente uma prévia limitada. Um pequeno grupo de clientes obtém acesso primeiro, e a OpenAI afirma que está testando o nível em codificação, comércio, pesquisa financeira, suporte ao cliente e aplicativos interativos para aprender onde a velocidade cria valor. Outros clientes podem se inscrever para serem notificados quando a capacidade for expandida. Não há preço publicado nem data de disponibilidade geral ainda.
OpenAI e Cerebras também publicaram números de comparação, todos fornecidos pelos fornecedores e baseados em dados de velocidade de saída do Artificial Analysis: a Ultrafast afirma ser 5X mais rápida que o Claude Opus 4.8 no modo Fast e 11X mais rápida que o Claude Fable 5; no conjunto de 2.500 perguntas do Humanity’s Last Exam, diz-se que ela termina em pouco mais de 11 horas, contra mais de três dias para o Claude Fable 5, com precisão comparável; e no GDP-Val (petições jurídicas, modelos financeiros, relatórios de engenharia) ela alega uma aceleração de ponta a ponta de 5.6X, sem perda de qualidade. Trate essas afirmações como sendo da OpenAI e da Cerebras até que execuções independentes as confirmem.
O nível também levanta duas questões em aberto. Primeiro, capacidade: o fornecimento em escala de wafer da Cerebras é a restrição, e se a prévia permanecerá somente por convite após o final de 2026 indicará se o hardware consegue acompanhar a demanda. Segundo, estrutura de preços: um nível premium de velocidade poderia segmentar a precificação da API de maneiras que importam para equipes sensíveis a custos.
Salvaguardas mais fortes
O GPT-5.6 também vem com salvaguardas mais fortes, especialmente em relação a fluxos de trabalho de cibersegurança e biológicos. Algumas solicitações podem levar mais tempo ou não retornar conteúdo enquanto verificações de segurança adicionais são executadas.
Para equipes legítimas de defesa ou pesquisa, isso não torna o GPT-5.6 inutilizável. Mas significa que fluxos de trabalho em domínios sensíveis devem ser testados cuidadosamente antes da migração para produção.
Daybreak Blue e Red: GPT-5.6 com salvaguardas reduzidas para equipes verificadas
O outro lado de salvaguardas mais fortes é que a OpenAI agora também oferece acesso com menos barreiras de proteção à mesma família de modelos. Em 10 de agosto de 2026, ela expandiu o Daybreak — seu programa de cibersegurança avaliado — em duas camadas. O Daybreak Blue oferece aos defensores aprovados o GPT-5.6 Sol com as salvaguardas cibernéticas de nível de sistema removidas, para descoberta de vulnerabilidades, revisão segura de código, análise de malware, engenharia de detecção, resposta a incidentes e validação de patches. A OpenAI o descreve como o ponto de partida recomendado para a maioria dos defensores.
Daybreak Red vai além. Ele fornece acesso ao GPT-5.6-Cyber, um modelo treinado especificamente no GPT-5.6 Sol para descoberta de vulnerabilidades zero-day e desenvolvimento de cadeias de exploração. O acesso é fortemente restrito e monitorado — verificação de identidade, restrições de uso aprovado e declarações legais — e a OpenAI afirma que contas individuais do Daybreak devem adotar chaves de segurança de hardware a partir de 1º de setembro de 2026.
Os números de capacidade são relatados pelos fornecedores. Na Taxa Interna de Conclusão de Cibersegurança Avançada da OpenAI, o GPT-5.6-Cyber concluiu 95% das tarefas sensíveis que lhe foram solicitadas, contra 57,3% do seu antecessor GPT-5.5-Cyber — enquanto a Sol, por meio do Daybreak Blue, completou 2,0% (1,5% com salvaguardas padrão). A OpenAI enquadra a mudança como uma alteração na taxa de recusa mais do que um salto de inteligência: o modelo subjacente responde em vez de recusar. A OpenAI também afirma que o modelo ajudou a revelar duas vulnerabilidades anteriormente desconhecidas no mecanismo V8 do Chrome, divulgadas ao Google e corrigidas como CVE-2026-15903.
Daybreak não é um produto de API pública. O acesso ocorre por meio do programa da OpenAI e de uma rede de parceiros de fornecedores de segurança, portanto a maioria das equipes o encontrará indiretamente — em melhores ferramentas de defesa e no sinal de que a OpenAI agora oferece um modelo cuja função é atacar sistemas em nome dos defensores.
Sol no ChatGPT: um ajuste de confiabilidade e um controle deslizante de pensamento.
O anúncio de 6 de agosto de 2026 foi sobre a experiência do consumidor. A OpenAI ajustou o Sol na experiência de Chat do ChatGPT para ser mais confiável com fatos — datas, números, fontes, regras e suposições — e mais direto nas respostas cotidianas, ao mesmo tempo que aproximou as experiências Instant e Thinking. Os números por trás de “mais confiável” são avaliações internas da própria OpenAI, não de um laboratório independente: em prompts financeiros, médicos e jurídicos, respostas com erros factuais foram cerca de 68% menos comuns com o Sol (e 62% menos com a Luna) do que com o GPT-5.5 Instant.
Os usuários Plus e Pro também ganham um novo controle deslizante de raciocínio na web, no celular e no desktop, escolhendo quanto de raciocínio cada resposta gasta — desde respostas rápidas para perguntas do dia a dia até planejamento, pesquisa, escrita, codificação ou decisões mais profundas. A OpenAI diz que a versão do Sol por trás do Work e do Codex não mudou; o ajuste se aplica à experiência do Chat.
Free and Go: Luna por padrão, conversas de texto ilimitadas
OpenAI tornou o GPT-5.6 Luna o modelo padrão para contas Free e Go do ChatGPT esta semana, substituindo o GPT-5.5 Instant. A partir da semana de 10 de agosto, conversas somente de texto nesses planos são ilimitadas — sem limites de taxa, sujeitas a proteções contra abuso — enquanto limites ainda se aplicam a uploads de arquivos, imagens, geração de imagens e voz. Um novo botão Think dá aos usuários Free e Go uma maneira de pedir que a Luna raciocine com mais profundidade, também sem limite para conversas somente de texto. A OpenAI também adicionou treinamento de segurança para usuários menores de 18 anos, incluindo limites em torno de roleplay romântico e conteúdo restrito por idade.
GPT-5.6 vs GPT-5.5
Em comparação com o GPT-5.5, o GPT-5.6 é o que mais importa em seis áreas:
- Escolha de modelo: o GPT-5.6 introduz Sol, Terra e Luna em vez de um único modelo padrão.
- Trabalho de agentes: Sol está posicionado de forma mais forte para agentes de codificação e fluxos de trabalho com muitas ferramentas.
- Controle de raciocínio: o esforço máximo de raciocínio e o modo ultra oferecem mais opções aos desenvolvedores para tarefas difíceis.
- Flexibilidade de custos: Terra e Luna facilitam evitar o uso excessivo do modelo principal.
- Opções de velocidade: a GPT-5.6 Sol antecipa um nível Ultrafast a até 14X a velocidade Standard; a GPT-5.5 foi lançada com uma única classe de velocidade.
Estratégia de lançamento: GPT-5.6 chegou em fases — primeiro a API, depois o ChatGPT — então as equipes ainda precisam de alternativas à medida que o comportamento e os preços mudam.
O ponto principal é simples: GPT-5.6 não é apenas um modelo melhor. É uma razão para parar de embutir um único modelo no seu aplicativo.
Como se preparar para GPT-5.6
Você pode se preparar com o acesso que já tem: Luna é o padrão gratuito do ChatGPT, Sol está na experiência Plus/Pro, e a API é pública. A preparação é sobre roteamento e medição, não sobre esperar.
Primeiro, crie um conjunto de avaliação real. Não teste o GPT-5.6 apenas com prompts triviais. Use problemas reais da base de código, tickets de suporte, documentos de clientes, tarefas de pesquisa e falhas de automação.
Segundo, projete para o roteamento de modelos. A Luna pode lidar com resumos simples e classificação. A Terra pode lidar com fluxos de trabalho cotidianos voltados ao usuário. A Sol deve ser reservada para raciocínio complexo, codificação e pesquisa. Se a latência é um requisito no seu roadmap, trate a prévia Ultrafast como um motivo para projetar uma camada de roteamento sensível à velocidade agora, em vez de codificar rigidamente um único nível — o nível que vence em latência hoje ainda pode estar em prévia, mas a decisão de roteamento que isso implica já está visível.
Terceiro, monitore o custo por tarefa concluída. Para fluxos de trabalho agênticos, uma solicitação do usuário pode acionar várias chamadas de modelo. O preço de token mais barato nem sempre é o fluxo de trabalho concluído mais barato.
Quarto, prepare-se para o cache. Se seu aplicativo envia repetidamente o mesmo repositório, documento de política ou base de conhecimento, estruture os prompts para que o contexto estável possa ser reutilizado.
Por fim, mantenha um plano de contingência. Modelos de raciocínio são verbosos e os preços oscilam — Terra e Luna caíram ambas no final de julho. Sistemas de produção devem ser capazes de recorrer a outro nível do GPT-5.6, ao GPT-5.5 ou a um provedor diferente quando a latência, o custo ou o comportamento mudarem.
Onde o OrcaRouter se encaixa

GPT-5.6 torna o roteamento de modelos mais importante.
OpenAI já não apresenta a nova geração como um único modelo. O GPT-5.6 vem como uma família: Sol para o trabalho de raciocínio mais difícil e de agente, Terra para cargas de trabalho equilibradas do dia a dia, e Luna para tarefas rápidas e de menor custo.
Isso cria uma questão prática para os desenvolvedores: Qual modelo deve lidar com cada requisição?
Nem toda tarefa precisa do Sol. Um resumo simples pode ser melhor atendido pela Luna. Um fluxo de trabalho normal de negócios pode se adequar ao Terra. Uma tarefa difícil de agente de codificação pode justificar o Sol.
E mesmo com acesso aberto, aplicativos em produção ainda precisam de opções alternativas quando a latência, os limites de taxa ou o custo por tarefa mudam — os cortes de preço do final de julho são um lembrete de que a tabela de preços é um alvo móvel, e a prévia do Ultrafast é um lembrete de que as opções de atendimento também estão mudando.
É aqui que o OrcaRouter se encaixa.
OrcaRouter oferece aos desenvolvedores um único endpoint compatível com OpenAI para roteamento entre vários modelos, com roteamento inteligente, failover automático, observabilidade e markup zero de tokens. Em vez de reconstruir sua integração toda vez que um novo modelo é lançado, você pode manter um único padrão de API e rotear tarefas com base em qualidade, custo, latência e disponibilidade.
Para GPT-5.6, isso significa que você pode construir a camada de modelo agora, em vez de esperar que o acesso se estabilize.
Todos os três níveis padrão estão hoje no OrcaRouter: GPT-5.6 Sol por US$ 5/US$ 30, GPT-5.6 Terra por US$ 2/US$ 12 e GPT-5.6 Luna por US$ 0,20/US$ 1,20 — repassados com margem de 0%, então os cortes de preço do fim de julho estão valendo aqui no dia em que foram lançados. O nível Ultrafast ainda não está amplamente disponível, então não faz parte dessa lista — quando for aberto, passa a ser mais um nível de serviço para roteamento, e é nesse mesmo endpoint que essa escolha é feita. Daybreak Blue e Red são um programa separado de acesso restrito, e não níveis públicos de API, portanto também não podem ser roteados pelo OrcaRouter — a decisão de roteamento está nos níveis padrão.
O acesso ao GPT-5.6 ainda está em definição, mas sua estratégia de roteamento não precisa esperar.
Usando GPT-5.6 através do OrcaRouter

GPT-5.6 é exatamente o tipo de família que os desenvolvedores querem usar.
Mas a implementação criou um problema prático: o acesso foi expandido em fases, os preços mudaram para dois níveis no final de julho, o ajuste do ChatGPT difere do modelo da API, e agora um nível de velocidade está em pré-visualização. As equipes precisam de uma camada que absorva essas mudanças.
OrcaRouter expõe todos os três níveis do GPT-5.6 por meio de um endpoint compatível com OpenAI, além de mais de 200 outros modelos — para que você possa testar Sol, Terra e Luna contra GPT-5.5, Claude, Gemini e o restante em um só lugar, sem reintegração.
Isto é útil se você quiser:
- roteie cada requisição para o nível mais barato que a atenda;
- teste Sol, Terra e Luna lado a lado com seu stack atual;
- encaminhar tarefas simples para modelos mais baratos;
- reserve modelos emblemáticos para trabalhos mais difíceis;
- compare GPT-5.6 com sua stack de produção atual;
- manter modelos de reserva prontos quando o comportamento ou os preços mudarem.
O GPT-5.6 já está no ar no OrcaRouter — Sol, Terra e Luna — com markup de 0% e failover automático, para que uma camada recém-lançada ou com preço reajustado nunca derrube um caminho de produção.
Invoque qualquer nível GPT-5.6 por meio de uma API no OrcaRouter e roteie pelo restante do catálogo com a mesma chave.
Veredito final
O GPT-5.6 é real, oficial e importante.
Mas não é mais uma prévia que você espera: a API está no ar desde 9 de julho, e o acesso ao ChatGPT está sendo liberado para todos os níveis neste mês.
A maior mudança não é apenas uma inteligência melhor. É a transição de um modelo padrão para uma família de modelos roteados: Sol, Terra e Luna.
Para desenvolvedores, a oportunidade não é simplesmente atualizar para o GPT-5.6. A oportunidade é construir uma camada de modelo mais inteligente:
- Luna para tarefas rápidas e baratas;
- Terra para cargas de trabalho de produção balanceadas;
Sol para as tarefas mais difíceis de raciocínio e codificação;
- cache para contexto repetido;
- modelos de fallback para confiabilidade.
Se você está lançando hoje, não precisa mais esperar: Luna é o padrão gratuito do ChatGPT, Sol está na experiência Plus/Pro, e a API é pública.
{{1}}Se você está construindo agentes de codificação, copilotos empresariais ou fluxos de trabalho de IA de longa duração, a preparação agora significa roteamento, medição de esforço de raciocínio e custo por tarefa — não acesso.{{/1}} {{2}}E a prévia do Ultrafast é um lembrete de que a família ainda está em movimento:{{/2}} {{3}}o carro-chefe que você avalia hoje pode ter um nível mais rápido — ou, com o Daybreak, uma variante cibernética treinada para fins específicos — quando você lançar.{{/3}}
Perguntas Frequentes
O GPT-5.6 já foi lançado?
Sim. A API foi lançada em 9 de julho de 2026, e o acesso ao ChatGPT está sendo liberado gradualmente — Sol atualizado para Plus/Pro desde 6 de agosto, Luna como padrão do Free/Go nesta semana.
Posso usar GPT-5.6 no ChatGPT?
Sim. O GPT-5.6 Sol está disponível na experiência de chat Plus/Pro com um novo controle deslizante de pensamento, e o GPT-5.6 Luna está se tornando o padrão para contas Free e Go esta semana, com conversas ilimitadas somente de texto a partir da semana de 10 de agosto.
Posso usar o GPT-5.6 através da API?
Sim. Todos os três níveis estão na API pública com preços publicados — Sol $5/$30, Terra $2/$12, Luna $0.20/$1.20 — e através do OrcaRouter com margem de 0%.
O que é o modo Ultrafast do GPT-5.6 Sol?
É uma camada de velocidade em pré-visualização na API da OpenAI que executa o GPT-5.6 Sol até 14X mais rápido que o processamento Standard, com até 750 tokens de saída por segundo, com a mesma inteligência do modelo padrão (segundo o fornecedor). Inicialmente, é limitada a um pequeno grupo de clientes, e a OpenAI não publicou preços para ela.
Existe uma lista de espera pública para o GPT-5.6?
Para os níveis básicos, não — a API é pública e o acesso ao ChatGPT está sendo disponibilizado gradualmente em todos os níveis, portanto não há nada para aderir. A prévia do Ultrafast é a exceção: ela é limitada inicialmente a um pequeno grupo de clientes, com inscrição para notificação à medida que a capacidade aumenta.
Quando o GPT-5.6 estará geralmente disponível?
Já está, em etapas. A API foi ao ar em 9 de julho de 2026; a Sol atualizada chegou ao ChatGPT Plus/Pro em 6 de agosto; a Luna se torna o padrão do Free/Go esta semana; chats de texto gratuitos ilimitados chegam na semana de 10 de agosto.
O que são GPT-5.6 Sol, Terra e Luna?
Sol é o modelo principal, Terra é o modelo equilibrado para o trabalho diário, e Luna é o modelo rápido e acessível.
Quanto custa o GPT-5.6?
GPT-5.6 Sol custa $5 por 1M de tokens de entrada e $30 por 1M de tokens de saída. GPT-5.6 Terra custa $2 por 1M de entrada e $12 por 1M de saída. GPT-5.6 Luna custa $0.20 por 1M de entrada e $1.20 por 1M de saída. Terra e Luna tiveram seus preços reduzidos no final de julho de 2026; Sol permaneceu inalterado. No OrcaRouter, esses preços são repassados com markup de 0%. A prévia do Ultrafast ainda não tem um preço publicado.
Devo trocar do GPT-5.5 para o GPT-5.6?
Não às cegas. Mantenha um fallback estável, mas o cálculo mudou: o preço da Luna a torna a escolha padrão para trabalho de texto de alto volume, e o ajuste fino do ChatGPT vale a pena testar para assistentes do dia a dia. Faça benchmark nas suas próprias tarefas e roteie por nível.
Posso acessar o GPT-5.6 através do OrcaRouter?
Sim. GPT-5.6 Sol, Terra e Luna estão todos no OrcaRouter por meio de um endpoint compatível com OpenAI, com markup de 0% e failover automático. Você pode testá-los contra GPT-5.5, Claude, Gemini e outros modelos sem alterar as integrações.
O que são Daybreak Blue e Daybreak Red?
Eles são as duas camadas do programa de segurança cibernética credenciado da OpenAI, expandido em 10 de agosto de 2026. O Daybreak Blue oferece aos defensores aprovados o GPT-5.6 Sol com as salvaguardas de segurança cibernética removidas, para trabalho defensivo como resposta a incidentes, análise de malware e revisão de código seguro. O Daybreak Red fornece o GPT-5.6-Cyber, um modelo baseado em Sol treinado especificamente para pesquisa de vulnerabilidades autorizada e trabalho de exploração, para equipes credenciadas separadamente. Nenhum deles é um produto de API pública.
Comparados neste artigo4
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
