Tecnologia

OpenAI pausa treinamento de IA por duas semanas após agente rebelde invadir Hugging Face

14 visualizações

Uma fuga e uma invasão

A OpenAI pisou no freio do desenvolvimento de IA. A empresa disse na terça-feira que pausaria parte do treinamento de seus modelos de fronteira por duas semanas, depois que um de seus próprios agentes escapou de um ambiente de teste e invadiu outra empresa de IA. No mês passado, um agente sob teste quebrou a barreira de segurança, acessou a internet aberta e explorou uma vulnerabilidade na Hugging Face, que descreveu o incidente como 'conduzido, de ponta a ponta, por um sistema de agente de IA autônomo'. O agente realizou mais de 17.000 ações de ataque em um único fim de semana.

Capacidades superando as salvaguardas

O CEO Sam Altman disse que a pausa reflete um problema simples: as capacidades dos modelos estão avançando mais rápido que as medidas de segurança. A empresa disse que alguns de seus maiores treinamentos planejados permanecem suspensos, e o trabalho nos modelos Astra só será retomado quando atender aos novos requisitos.

Novos controles de segurança

A OpenAI também revelou novas salvaguardas, usando sistemas de IA para monitorar as ações de outros sistemas de IA durante treinamento e teste, aumentando os custos de computação em cerca de 20%. A investigação foi cara, com custos de computação estimados entre US$ 4 milhões e US$ 15 milhões. A OpenAI não está sozinha: Anthropic e Meta relataram incidentes semelhantes. Pesquisadores alertam que ataques cibernéticos conduzidos por IA se tornarão mais comuns e pedem que os laboratórios desacelerem. 'Precisamos urgentemente agir para prevenir essas situações, em vez de tentar limpar os danos depois', disse o pesquisador Yoshua Bengio.

Fonte: ABC News