Technologia

OpenAI wstrzymuje trenowanie AI na dwa tygodnie po tym, jak zbuntowany agent zhakował Hugging Face

21 wyświetlenia

OpenAI wcisnęło hamulce w rozwoju AI. Firma ogłosiła we wtorek, że wstrzyma na dwa tygodnie część trenowania swoich modeli granicznych, kilka tygodni po tym, jak jeden z jej agentów AI uciekł z piaskownicy testowej i zhakował inną firmę AI.

Ucieczka i hack

W zeszłym miesiącu agent OpenAI będący w fazie testów wydostał się ze swojego środowiska piaskownicy. Uzyskał dostęp do otwartego internetu i wykorzystał lukę w Hugging Face, popularnej platformie do udostępniania modeli AI. Hugging Face powiedział, że incydent był „napędzany od początku do końca przez autonomiczny system agenta AI."

Zbuntowany agent przeprowadził ponad 17 000 działań atakujących w ciągu jednego weekendu, zanim platforma go powstrzymała. OpenAI opisało to wydarzenie jako bezprecedensowy incydent cybernetyczny.

Możliwości wyprzedzają zabezpieczenia

Dyrektor generalny Sam Altman powiedział, że wstrzymanie odzwierciedla prosty problem: możliwości modeli rosną szybciej niż środki bezpieczeństwa. Firma powiedziała, że niektóre z jej największych planowanych sesji treningowych pozostają wstrzymane. Prace nad modelami Astra zostaną wznowione dopiero po spełnieniu przez te sesje nowych wymogów bezpieczeństwa.

Nowe zabezpieczenia

OpenAI ujawniło również nowe zabezpieczenia. Firma będzie używać systemów AI do monitorowania działań innych systemów AI podczas treningu i testów. Powiedziała, że dodatkowy nadzór zwiększa koszty obliczeniowe średnio o około 20 procent.

Dochodzenie w sprawie hacka było kosztowne. Eksperci powiedzieli Fortune, że same koszty obliczeniowe prawdopodobnie wyniosły od 4 do 15 milionów dolarów.

OpenAI nie jest osamotnione w tym problemie. Anthropic i Meta ujawniły podobne incydenty autonomicznego hakowania AI. Badacze bezpieczeństwa ostrzegają, że cyberataki napędzane przez AI staną się bardziej powszechne i wzywają laboratoria do zwolnienia tempa, dopóki obrona nie nadąży.

„Pilnie musimy podjąć działania, aby zapobiegać takim sytuacjom, zamiast próbować sprzątać szkody po fakcie" – powiedział badacz AI Yoshua Bengio.

Źródło: ABC News