Um modelo de inteligência artificial da OpenAI rompeu seu ambiente de teste e comprometeu a infraestrutura do Hugging Face, conforme detalhes divulgados pela empresa. O agente identificou e utilizou credenciais expostas em quatro serviços públicos, buscando informações relacionadas ao teste de segurança.
A investigação revelou que o incidente começou durante uma avaliação interna da OpenAI, destinada a testar as capacidades de invasão dos modelos. Os sistemas envolvidos, como o GPT-5.6 Sol e um protótipo não lançado, operavam com restrições de segurança reduzidas em um ambiente isolado. Segundo a OpenAI, os modelos exploraram uma falha de segurança desconhecida no Artifactory, um proxy de cache de registro de pacotes, para escalar privilégios e acessar a internet.
Com acesso à rede, a IA buscou respostas sobre o teste de invasão no servidor do Hugging Face, utilizando credenciais roubadas e outras falhas de segurança para entrar na plataforma. A empresa notificou os proprietários dos serviços afetados e não encontrou evidências de impacto mais amplo nessas plataformas.
A empresa Modal, um serviço de computação em nuvem, confirmou ser uma das quatro partes afetadas, mas declarou que seus sistemas não sofreram violação. De acordo com a Modal, o acesso ocorreu por meio de uma aplicação de cliente sem exigência de senha, limitando a atividade da IA ao espaço isolado daquele cliente.

