Curso
Nota: a OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026 e o GPT-6 Sol e Luna em 23 de setembro de 2026.
O GPT-5.6 é uma série com três modelos que hoje entra em um preview limitado, coordenado com o governo dos EUA.
Ainda não está disponível para uso amplo, mas já há muito sobre capacidades para explorar, especialmente em código, biologia e cibersegurança — temas que vamos abordar.
Se quiser voltar no tempo pelos lançamentos de modelos da OpenAI, temos um histórico com análises de cada versão: GPT-5.5 Instant, GPT-5.3 Instant e GPT-5.2.
E, se quiser comparar o GPT-5.6 com os modelos mais recentes disponíveis, também temos artigos sobre: Gemini 3.1 Pro, Claude Opus 5, Claude Mythos 5, Claude Fable 5.
O que é o GPT-5.6?
O GPT-5.6 é a nova geração de modelos da OpenAI. Na prática, é uma família com três modelos e, finalmente, um novo padrão de nomenclatura.
No novo sistema, o número indica a geração (5.6) e o nome indica o nível de capacidade (Sol, Terra, Luna). Uma vantagem do novo padrão é que cada nível pode evoluir no seu próprio ritmo, com menos confusão. "Instant" não era o melhor nome para indicar o modelo subjacente mais recente.
O que é o GPT-5.6 Sol?
Sol é o carro-chefe e o modelo mais forte e capaz da série. É o nível que a OpenAI destaca em todos os benchmarks do lançamento e o único que desbloqueia o novo esforço de raciocínio max e o modo ultra (mais sobre ambos abaixo).
É também onde os avanços em cibersegurança e biologia ficam mais evidentes. Sol é o modelo indicado se você busca o teto mais alto para problemas difíceis e de múltiplas etapas e não se importa em pagar mais por token.
Nós o comparamos com os novos carros-chefe da Anthropic e da SpaceXAI, Claude Opus 5 e Grok 4.6.
O que é o GPT-5.6 Terra?
Terra é o modelo equilibrado para o dia a dia. Pense nele como o padrão. O desempenho do Terra é competitivo com o do GPT-5.5, custando cerca de 2x menos. É provável que vejamos esse padrão com frequência: qualidade parecida com a do carro-chefe da geração anterior, por um preço intermediário.
O que é o GPT-5.6 Luna?
Luna é o nível rápido e acessível. É voltado para cargas de trabalho de alto volume, sensíveis à latência ou com orçamento apertado. Como a tabela de benchmarks abaixo mostra, "mais barato" não significa necessariamente "mais fraco" em toda tarefa. Vale o destaque para você não subestimá-lo.
Em resumo:
- Sol é o modelo mais forte, com a pilha de segurança mais robusta
- Terra é semelhante ao GPT‑5.5, só que mais barato
- Luna tem o menor custo.
O que mais é novo no GPT-5.6?
Esta atualização também traz novas formas de intensificar o raciocínio, além de ganhos amplos de capacidade em alguns domínios específicos.
Duas novas maneiras de forçar mais o modelo
O GPT-5.6 apresenta dois novos controles:
-
Esforço de raciocínio
max: uma nova configuração que dá ao Sol mais tempo para pensar sobre o problema. -
Modo
ultra: este é mais interessante. Em vez de um único agente trabalhando na tarefa, oultrausa subagentes.
Nos benchmarks abaixo, você vai ver o ultra como uma linha própria ("GPT-5.6 Sol Ultra"), com a melhor pontuação.
Mais forte em código
O GPT-5.6 Sol estabeleceu um novo estado da arte no Terminal-Bench 2.1, lançado há cerca de seis semanas. A versão mais recente do Terminal-Bench testa fluxos de trabalho em linha de comando que exigem iteração e coordenação de ferramentas. Vamos aos números na seção de benchmarks.
Mais forte em biologia
Este é um teste de benchmark menos conhecido: GeneBench v1. Ele avalia análises de genômica e biologia quantitativa de longo horizonte. Segundo o release, o GPT-5.6 Sol apresenta resultados melhores que o GPT-5.5 usando menos tokens.
Cibersegurança mais forte (e mais bem controlada!)
A OpenAI chama o GPT-5.6 Sol de seu modelo mais capaz até agora em cibersegurança e dedica bastante espaço a isso no release. O Sol desloca a fronteira de desempenho e eficiência em tarefas de segurança de longo horizonte, incluindo pesquisa e exploração de vulnerabilidades. O release também cita êxitos em benchmarks menos conhecidos:
- No ExploitBench, a OpenAI diz que o GPT-5.6 Sol é competitivo com o (não lançado) Mythos Preview usando apenas cerca de um terço dos tokens de saída.
- No ExploitGym, benchmark criado por pesquisadores de Berkeley, os três modelos mostram ganhos sólidos em ciber à medida que o raciocínio aumenta.


Resultados de benchmark do GPT-5.6
O destaque entre os benchmarks é o resultado no Terminal-Bench 2.1, já mencionado. Veja como os modelos se posicionam, do maior para o menor score:
| Modelo | Terminal-Bench 2.1 |
|---|---|
| GPT-5.6 Sol Ultra | 91,9% |
| GPT-5.6 Sol | 88,8% |
| GPT-5.5 | 88,0% |
| GPT-5.6 Luna | 84,3% |
| Claude Mythos 5 | 84,3% |
| Claude Fable 5 | 83,4% |
| GPT-5.6 Terra | 82,5% |
| Claude Opus 4.8 | 78,9% |
| Gemini 3.1 Pro Preview | 70,7% |
Alguns pontos chamam atenção:
-
O modo
ultrafaz diferença. O GPT-5.6 Sol Ultra (91,9%) fica claramente acima do Sol padrão (88,8%), a evidência mais limpa de que a abordagem com subagentes funciona — pelo menos aqui. -
A ordenação por níveis não segue este benchmark à risca. Note que o GPT-5.6 Luna pontua acima do GPT-5.6 Terra, embora o Terra seja posicionado como nível superior. E o Terra fica abaixo do GPT-5.5 (88,0%) neste teste, apesar de a OpenAI descrevê-lo como "competitivo com o GPT-5.5" no geral. O aprendizado aqui: os níveis equilibram inteligência/velocidade/custo em muitas tarefas, em média; não é garantia em um único benchmark.
A pilha de segurança e o preview limitado
É aqui que o GPT-5.6 mais se afasta de um lançamento comum. Em vez de testarmos o modelo por conta própria (já explico por que não dá), a parte mais relevante é como ele está sendo disponibilizado.
Uma pilha de salvaguardas em camadas
O argumento da OpenAI é que nenhuma salvaguarda isolada resiste a usos maliciosos determinados ou adaptativos; por isso, empilha várias. No preview do GPT-5.6, as camadas incluem:
- Treinamento em nível de modelo para recusar assistência cibernética proibida, inclusive tentativas de mascarar intenção ou fazer jailbreak no modelo.
- Classificadores em tempo real para uso indevido em ciber e biologia que avaliam a saída à medida que é gerada. Em casos de maior risco, a geração pode ser pausada enquanto um modelo de raciocínio maior revisa toda a conversa, e a saída pode ser retida antes mesmo de chegar até você.
- Revisão em nível de conta que analisa conversas e sinais de risco de um usuário para distinguir comportamento malicioso persistente de trabalho legítimo de segurança de duplo uso.
- Acesso diferenciado, monitoramento, aplicação e testes contínuos.
A OpenAI deixa claro que, especialmente durante o preview, alguns pedidos podem ser bloqueados ou recusados, e outros podem simplesmente demorar mais porque a geração foi pausada para revisão. Também reconhece que as salvaguardas podem, ocasionalmente, travar em trabalhos legítimos de duplo uso, em que atividades defensivas e ofensivas podem parecer similares à primeira vista.
Red teaming em escala
Para reforçar tudo isso, a OpenAI afirma que alocou uma quantidade incomum de computação para segurança: mais de 700.000 horas de GPU equivalentes a A100 em red teaming automatizado, visando encontrar jailbreaks universais, ataques que se generalizam por muitos prompts e contextos, em vez de funcionarem só em um cenário estreito. Isso foi combinado com red teaming humano de terceiros, em andamento durante o preview, além de um processo de resposta rápida para reproduzir e corrigir jailbreaks recém-descobertos e incorporá-los a testes futuros.
Por que o rollout é tão cauteloso
A OpenAI diz que apresentou os planos e capacidades do GPT-5.6 ao governo dos EUA antes do lançamento e, a pedido do governo, está começando com um preview limitado para um pequeno grupo de parceiros confiáveis.
É a segunda vez no mês que o governo dos EUA interfere em um lançamento de modelo de fronteira, pois, há duas semanas, uma diretriz de controle de exportação obrigou a Anthropic a retirar do ar o Claude Fable 5 e o Mythos 5 para todos os clientes no mundo.
Minha leitura: a OpenAI observou o que aconteceu com a Anthropic e preferiu entregar as chaves logo de início, em vez de ter um modelo retirado após o lançamento.
Uma nota sobre testes
Nas nossas análises usuais, este seria o momento de colocar o modelo novo à prova, na prática, em raciocínio, busca na web e alguns prompts críticos. Ainda não conseguimos fazer isso. O GPT-5.6 está em um preview limitado a um pequeno conjunto de parceiros confiáveis, então não está amplamente disponível para testes.
Como acessar o GPT-5.6?
Durante o preview, os modelos GPT-5.6 estão disponíveis via API e Codex para um grupo seleto de parceiros e organizações de confiança. A OpenAI afirma que pretende disponibilizá-los em breve de forma mais ampla no ChatGPT, no Codex e na API.
Preços
O GPT-5.6 é tarifado por 1M de tokens nos três níveis:
| Modelo | Entrada (por 1M de tokens) | Saída (por 1M de tokens) |
|---|---|---|
| GPT-5.6 Sol | US$ 5,00 | US$ 30,00 |
| GPT-5.6 Terra | US$ 2,50 | US$ 15,00 |
| GPT-5.6 Luna | US$ 1,00 | US$ 6,00 |
Alguns detalhes importantes sobre preços:
- Cache de prompt mais previsível, com suporte a pontos de quebra explícitos e vida mínima de cache de 30 minutos.
- Para o GPT-5.6 e posteriores, gravações no cache são cobradas a 1,25x a taxa de entrada sem cache do modelo, enquanto leituras mantêm o desconto de 90% na entrada em cache.
Velocidade via Cerebras
A OpenAI também afirma que vai lançar o GPT-5.6 Sol no Cerebras com até 750 tokens por segundo em julho, com acesso inicialmente restrito a alguns clientes, conforme a capacidade aumenta. O foco é reduzir a latência em trabalhos sensíveis a tempo, onde esperar por um modelo de fronteira é o gargalo.
Considerações finais
O GPT-5.6 traz pontos positivos: uma família mais clara em três níveis, duas novas formas de intensificar o raciocínio (max e ultra) e ganhos em código, biologia e cibersegurança.
Ainda assim, o modelo está em preview fechado, então ninguém independente pode verificar tudo por enquanto. A narrativa da OpenAI — de que o GPT-5.6 é "tão capaz que tivemos que coordenar com o governo" — soa como o marketing mais favorável possível. Mas isso não a torna falsa, e toda cautela em cibersegurança é bem-vinda.
Por ora, o resumo honesto é: os números parecem fortes, o acesso é restrito e o teste real, literalmente, virá quando os modelos forem amplamente disponibilizados. Assine nossa newsletter e nós vamos manter você por dentro.

Perguntas frequentes
O que é o GPT-5.6?
O GPT-5.6 é a mais nova geração de modelos da OpenAI. Em vez de um único modelo, ele chega como uma família de três: Sol (o carro-chefe), Terra (um modelo equilibrado para o dia a dia) e Luna (um modelo rápido e de baixo custo).
Qual a diferença entre Sol, Terra e Luna?
São níveis de capacidade. Sol é o modelo mais forte e capaz. Terra é o intermediário, posicionado como competitivo com o GPT-5.5 custando cerca de 2x menos. Luna é o nível econômico, projetado para oferecer boa capacidade com o menor custo. No novo sistema de nomes da OpenAI, o número (5.6) é a geração e o nome (Sol/Terra/Luna) é o nível estável, então cada nível pode avançar no seu próprio ritmo.
Posso usar o GPT-5.6 agora?
Ainda não, de forma geral. No lançamento, o GPT-5.6 está em preview limitado via API e Codex para um pequeno grupo de parceiros e organizações confiáveis. A OpenAI diz que pretende disponibilizar os modelos mais amplamente no ChatGPT, no Codex e na API em breve.
Por que o rollout do GPT-5.6 é tão limitado?
A OpenAI diz que apresentou os planos e capacidades dos modelos ao governo dos EUA antes do lançamento e, a pedido do governo, está começando com um preview limitado para parceiros cuja participação foi compartilhada com o governo. A OpenAI afirmou que não acredita que esse tipo de processo de acesso deva virar o padrão de longo prazo e o enquadra como um passo de curto prazo rumo à disponibilidade mais ampla, enquanto trabalha com a Administração em um framework de ordem executiva de ciber.
Quanto custa o GPT-5.6?
Por 1M de tokens: Sol custa US$ 5 na entrada / US$ 30 na saída; Terra custa US$ 2,50 na entrada / US$ 15 na saída; e Luna custa US$ 1 na entrada / US$ 6 na saída. O GPT-5.6 também traz cache de prompt mais previsível, com gravações cobradas a 1,25x a taxa de entrada sem cache e leituras mantendo o desconto de 90% na entrada em cache.
O que são os modos max e ultra?
São duas novas maneiras de forçar mais o modelo. max é uma configuração de esforço de raciocínio que dá ao Sol mais tempo para pensar com profundidade. O ultra vai além, usando subagentes para acelerar trabalhos complexos além do que um único agente consegue. No release, o "GPT-5.6 Sol Ultra" alcança o topo no Terminal-Bench.
Como o GPT-5.6 se sai nos benchmarks?
No Terminal-Bench 2.1 (fluxos de trabalho em linha de comando/código), o GPT-5.6 Sol Ultra lidera com 91,9%, com o Sol padrão em 88,8%, à frente do GPT-5.5 (88,0%) e de concorrentes como Claude Mythos 5 (84,3%), Claude Fable 5 (83,4%), Claude Opus 4.8 (78,9%) e Gemini 3.1 Pro Preview (70,7%). A OpenAI também relata ganhos em biologia no GeneBench v1 e em cibersegurança no ExploitBench e no ExploitGym, com uma avaliação mais completa prometida para o lançamento amplo.
Como o GPT-5.6 é diferente do GPT-5.5?
O GPT-5.6 é uma nova geração com família em três níveis e novos controles de raciocínio max/ultra, além de ganhos em código, biologia e cibersegurança. Ele também chega com uma pilha de segurança mais pesada e um rollout mais cauteloso, coordenado com o governo. Já o GPT-5.5 foi uma atualização amplamente disponível do modelo padrão, focada em qualidade de conversa, menos alucinações e personalização.
Quando o GPT-5.6 chega ao ChatGPT?
A OpenAI não deu uma data exata; disse apenas que pretende levar os modelos ao ChatGPT, ao Codex e à API "em breve" e ampliar a disponibilidade "nas próximas semanas". Uma versão do Sol hospedada no Cerebras (até 750 tokens/segundo) também está prevista para julho, inicialmente para clientes selecionados.



