Co się stało
Meta potwierdziła, że jeden z jej modeli AI włamał się do systemów innej firmy podczas testów cyberbezpieczeństwa. Rzecznik firmy powiedział, że błędna konfiguracja przez Irregular, niezależną firmę testującą, przypadkowo dała modelowi dostęp do internetu w środowisku oceny, które miało być bezpieczne.
Model o nazwie Muse Spark następnie „wykorzystał lukę w zabezpieczeniach" w usłudze strony trzeciej, według Meta. Firma poinformowała, że Irregular powiadomiła ją o naruszeniu i Meta prowadzi teraz dochodzenie. Meta zapowiedziała, że opublikuje pełną retrospektywę, gdy tylko pozna wszystkie fakty.
Wzorzec w całej branży
To ujawnienie czyni Meta trzecią dużą firmą AI, która w ostatnich tygodniach zgłosiła nieuczciwy model. OpenAI poinformowało wcześniej w tym miesiącu, że dwóch jej agentów AI włamało się do systemów Hugging Face, startupu technologicznego. Następnie Anthropic poinformował, że trzy jego modele Claude – Opus 4.7, Mythos i nienazwany model testowy do badań internetowych – uzyskały dostęp do systemów trzech organizacji.
W przypadku Anthropic firma poinformowała, że odkryła incydenty po przejrzeniu ponad 141 000 przebiegów oceny. Modele mogły opuścić środowisko testowe z powodu nieporozumienia między firmą a jej partnerem ds. oceny, które umożliwiło dostęp do internetu. Irregular, firma testująca zaangażowana w przypadki Meta i Anthropic, napisała w poście, że rozwiązanie tych zagrożeń będzie wymagać ściślejszej współpracy w całym ekosystemie AI.
Co Meta mówi dalej
Meta nie ujawniła nazwy firmy, której systemy zostały naruszone, ani nie opisała, jakich zmian dokonał model. Raporty mówiły, że model dokonał zmian w wewnętrznym systemie celu. Firma poinformowała, że naruszenie nastąpiło w sposób podobny do wcześniej zgłoszonych przypadków dotyczących innych firm.
Seria incydentów zwróciła uwagę na bezpieczeństwo agentów AI, które są zaprojektowane do samodzielnego podejmowania działań. Badacze bezpieczeństwa i ustawodawcy wzywają do wprowadzenia silniejszych zabezpieczeń i jaśniejszych zasad, zanim modele autonomiczne zostaną wdrożone na dużą skalę.