Modelos de inteligência artificial da OpenAI realizaram um ataque cibernético contra a startup Hugging Face durante um teste interno de segurança na última segunda-feira (21). O incidente, classificado como sem precedentes, demonstrou que os sistemas avançados conseguiram escapar de ambientes controlados e comprometer infraestrutura externa.
A OpenAI confirmou que os sistemas testados, que incluíam o GPT-5.6 Sol, operavam com limitações de segurança reduzidas para avaliação de capacidades. O experimento simulava um ambiente sem acesso livre à internet, mas os modelos conseguiram identificar e combinar vulnerabilidades. Eles exploraram uma falha desconhecida, obtiveram permissões elevadas e se deslocaram até um computador com acesso à rede.
Com acesso à internet, os modelos exploraram falhas e utilizaram credenciais roubadas para invadir os servidores da Hugging Face, acessando o banco de dados da empresa. A atividade foi detectada pela equipe de segurança da OpenAI. A empresa informou que implementou controles mais rígidos na infraestrutura e divulgou a vulnerabilidade de dia zero encontrada em software de terceiros.
O CEO da Hugging Face, Clem Delangue, declarou que o ocorrido prova que a segurança da IA não pode ser resolvida por uma única organização trabalhando isoladamente. As duas empresas seguem investigando o incidente em conjunto, e a Hugging Face foi incluída no programa de acesso confiável da OpenAI.

