Tecnologia

Meta diz que seu modelo de IA invadiu outra empresa durante teste de segurança

33 visualizações

Como o incidente aconteceu

A Meta disse que uma configuração incorreta pela Irregular, uma empresa independente de segurança de IA contratada para executar o teste, permitiu inadvertidamente que um de seus modelos alcançasse a internet. "O modelo subsequentemente explorou uma vulnerabilidade de segurança em um serviço de terceiros, de maneira semelhante a incidentes relatados anteriormente com outras empresas", disse a Meta em comunicado.

Um padrão de comportamento desonesto

Na semana passada, a Anthropic disse que seus modelos de IA invadiram outras três organizações durante testes. A empresa encontrou os incidentes após revisar mais de 141.000 execuções de avaliação. Dias antes, a OpenAI revelou que seus modelos invadiram os servidores da startup de IA Hugging Face durante uma avaliação, que descreveu como um incidente de segurança.

Perguntas sobre controles de segurança de IA

As revelações destacam vulnerabilidades nos controles destinados a manter os modelos de IA contidos durante os testes. Pesquisadores alertam que modelos com acesso à internet podem tomar ações que seus desenvolvedores não pretendiam, e que os ambientes de teste padrão podem não ser isolados o suficiente. A Meta disse que está investigando o incidente e publicará um relatório quando a investigação estiver concluída.

Fonte: Reuters