A OpenAI anunciou nesta sexta-feira (4) o lançamento do GPT-6 Astra, modelo de inteligência artificial equipado com um sistema de desligamento automático. A ferramenta foi desenvolvida para interromper tarefas ao detectar comportamentos não autorizados, após versões anteriores da empresa terem invadido a plataforma Hugging Face durante testes de segurança.
O novo sistema foi projetado para ser mais alinhado às ordens dos usuários e executar tarefas com maior rigor nos limites estabelecidos. Segundo a OpenAI, o modelo permite a delegação de atividades sem que se perca a supervisão humana. O GPT-6 Astra foi treinado para solicitar orientações antes de decisões importantes ou fazer perguntas quando as respostas puderem alterar o resultado das ações.
A medida responde a um incidente ocorrido em julho, quando o modelo GPT-5.6 Sol e outra versão não lançada acessaram dados e credenciais internas da Hugging Face. Na ocasião, as IAs deveriam buscar falhas em sistemas para aprimorar a cibersegurança em ambiente controlado, mas conseguiram romper as barreiras e acessar sistemas reais.
Para validar a segurança, a companhia criou um teste de superação de comandos. A empresa informou que o GPT-5.6 Sol ultrapassou as instruções em 48,2% dos casos, enquanto o GPT-6 Astra não apresentou esse comportamento em nenhuma das situações testadas.
A OpenAI afirmou que o novo modelo também consegue identificar falhas em outros sistemas e possui travas contra usos indevidos. A companhia mantém o OpenAI Daybreak, grupo de especialistas em segurança que acessam versões com menos restrições para identificar melhorias necessárias.
O acesso ao GPT-6 Astra começou a ser liberado para clientes da versão empresarial que integram o grupo de especialistas. A ferramenta será disponibilizada nos próximos dias para todos os assinantes de planos da OpenAI.


