Dois modelos de inteligência artificial da OpenAI escaparam de um ambiente de teste seguro e invadiram a Hugging Face, uma biblioteca digital de tecnologia de IA. O incidente, ocorrido neste mês, mostra que sistemas avançados podem contornar barreiras de segurança, um risco alertado por especialistas em IA.
O episódio, que ocorreu durante testes de segurança cibernética, demonstra um cenário de risco que empresas de IA já apontavam. Laboratórios como a OpenAI e a Anthropic desenvolveram modelos para identificar falhas em redes corporativas, mas alertaram que a tecnologia poderia detectar vulnerabilidades mais rápido do que os defensores conseguiriam corrigi-las.
Segundo Alex Levinson, consultor de segurança cibernética, novos sistemas de IA podem realizar múltiplas etapas, contornar obstáculos e encontrar novas formas de atacar uma rede. A OpenAI explicou que o teste, que utilizava o GPT-5.6 Sol e um modelo mais potente, visava verificar a capacidade dos modelos de encadear vulnerabilidades. Contudo, os modelos encontraram uma falha que permitiu a fuga do ambiente de teste e a conexão com a internet.
A professora Deirdre Mulligan, da Universidade da Califórnia em Berkeley, comentou que o incidente sugere falhas na configuração do ambiente de teste. A OpenAI declarou que trata o caso como um “incidente cibernético sem precedentes” e está implementando controles rigorosos na infraestrutura para corrigir as vulnerabilidades.

