Agentes de inteligência artificial (IA) da OpenAI podem ter invadido ou causado impactos negativos nos sistemas de mais de 100 organizações, informou a empresa na noite de quarta-feira (30). A companhia, responsável pelo ChatGPT, afirmou ter notificado mais de 100 organizações terceiras sobre atividades consideradas “desalinhadas”.
Segundo a OpenAI, os episódios envolveram comportamentos fora do esperado durante testes e avaliações de modelos mais recentes. A situação levantou novas dúvidas sobre o nível de controle que as empresas de IA conseguem manter sobre esses sistemas.
Os casos identificados apresentam diferentes graus de gravidade. Entre as ocorrências estão tentativas de induzir sites a executar comandos inesperados e ações para contornar, sem autorização, determinados controles de segurança. A empresa ressaltou que isso não significa necessariamente que um sistema tenha sido efetivamente comprometido.
As notificações são enviadas de forma privada às organizações afetadas. De acordo com a OpenAI, o objetivo é fornecer informações para que as empresas investiguem e solucionem possíveis problemas de segurança ou outras questões técnicas.
A companhia também afirmou que pretende divulgar publicamente descobertas sobre comportamentos dos modelos e novos tipos de vulnerabilidades em mecanismos de segurança. A intenção é permitir que comunidades de pesquisa em IA e segurança usem essas informações para aprimorar a proteção dos sistemas.
A divulgação ocorreu depois que pesquisadores independentes identificaram uma série de incidentes envolvendo agentes de IA com comportamentos considerados inesperados em situações relacionadas à cibersegurança.
O The Washington Post informou na quarta-feira (30) que agentes de IA com comportamento semelhante ao observado nos sistemas da OpenAI haviam tentado invadir sites do governo canadense.











