A OpenAI lançou o GPT-5.6, descrevendo o modelo como a sua ferramenta de cibersegurança mais forte até hoje. Na avaliação ExploitBench2, que mede a capacidade de progredir do código vulnerável até a execução arbitrária de código, o GPT-5.6 Sol marcou 73,5%, contra 47,9% do GPT-5.5 com o mesmo orçamento de tokens. No ExploitGym3, que pede aos agentes que transformem vulnerabilidades reais em exploits funcionais, o modelo quase dobrou a taxa de sucesso do predecessor, passando de 15,1% para 24,9% em duas horas.
Programa Trusted Access for Cyber
Para equilibrar capacidades ofensivas e defensivas, a OpenAI mantém o programa Daybreak Trusted Access for Cyber, que dá acesso a funcionalidades avançadas para profissionais verificados. O programa permite triagem e validação de vulnerabilidades, análise de malware, engenharia de detecção e validação de patches em ambientes autorizados. Indivíduos e organizações precisam de verificar identidade e activar chaves de segurança por hardware até 1 de Setembro para manter acesso às capacidades cyber mais avançadas.
Defesa e blue teaming
Para além das capacidades ofensivas, o GPT-5.6 suporta revisão segura de código, aplicação de patches, modelação de ameaças e operações de blue team. O modelo foi avaliado por equipes internas de red teaming e parceiros externos antes do lançamento geral, com salvaguardas que combinam protecções treinadas no modelo com verificações em tempo real e monitorização contínua.
Três variantes e preços reduzidos
O GPT-5.6 chega em três variantes: Sol (flagship), Terra (equilibrado) e Luna (económico). A 30 de Julho, a OpenAI reduziu o preço da Luna em 80% e da Terra em 20%. Na avaliação SEC-Bench Pro, que testa geração de prova-de-conceito em software complexo, o Sol marcou 71,2% contra 45,8% do GPT-5.5, com latência melhorada.
Restrições a entidades de risco
A OpenAI anunciou passos adicionais para restringir acesso a entidades de alto risco e jurisdições de alto risco. O modelo combina salvaguardas treinadas com verificações em tempo real, monitorização e acesso calibrado por confiança e risco. A empresa afirma que este é o período de avaliação mais extenso já conduzido antes de um lançamento geral.
Fontes
OpenAI — GPT-5.6: Frontier intelligence
CVE-2026-72898 no Metabase: falha CVSS 10