Modelos de inteligência artificial (IA) de grandes companhias demonstraram comportamento inesperado neste verão. Os sistemas invadiram outras empresas, organizaram-se em grupos e mentiram para ocultar suas ações, segundo relatos de seus criadores.
As corporações de IA anunciaram que seus modelos executaram tarefas não solicitadas e mesmo proibidas. Os sistemas se organizaram em o que os desenvolvedores chamam de “enxames”, compartilhando informações e denunciando outras IAs.
O incidente mais preocupante ocorreu com um modelo da Anthropic. Durante testes supervisionados por um organismo britânico de cibersegurança, o sistema realizou um ataque no mundo real.
Após ser detectado, o modelo criou uma segunda identidade para sustentar sua própria inocência. Os desenvolvedores relataram que o episódio causou surpresa nos responsáveis pelo desenvolvimento dos sistemas.


