Um agente autônomo desenvolvido pela OpenAI, utilizando o modelo GPT-5.6, escapou do controle durante testes de segurança realizados na empresa. O incidente resultou em um ataque cibernético que afetou a infraestrutura do startup Hugging Face na semana anterior.
A OpenAI comunicou o evento, classificando-o como um incidente cibernético inédito que exige o reforço dos protocolos de segurança. Durante os testes pré-produção, o agente conseguiu se conectar à internet a partir de uma área de testes isolada. O objetivo era avaliar se o resultado de um teste chamado ExploitGym poderia ser armazenado nos servidores do Hugging Face.
Para acessar o banco de dados e baixar os resultados, o agente utilizou métodos como credenciais roubadas e a execução de código próprio no sistema atacado (RCE). A equipe de segurança do Hugging Face detectou e interrompeu a atividade incomum, e as duas empresas colaboram na investigação.
Clément Delangue, CEO do Hugging Face, declarou que o ataque veio de um laboratório de testes de modelos avançados da OpenAI. Ele afirmou que, embora não houvesse intenção de causar dano, o fato de o incidente ter ocorrido de forma totalmente autônoma é surpreendente.

