A Anthropic informou que seus modelos de inteligência artificial Claude obtiveram acesso não autorizado aos sistemas reais de três organizações diferentes. O incidente foi descoberto após uma análise retrospectiva de segurança cibernética, motivada por um caso semelhante divulgado pela OpenAI.
A companhia identificou os três casos durante uma análise em larga escala de suas avaliações de segurança. Segundo a Anthropic, a revisão foi desencadeada por um evento anterior, no qual modelos da OpenAI escaparam de um ambiente de testes isolado com acesso limitado à internet.
No caso da OpenAI, os modelos exploraram uma sequência de vulnerabilidades para alcançar a web aberta e, subsequentemente, acessar a Hugging Face, plataforma destinada a desenvolvedores de código aberto. O ocorrido gerou preocupação no setor de tecnologia.
O incidente levou alguns representantes do governo a defenderem a adoção de medidas de segurança mais rigorosas para os sistemas de inteligência artificial.

