Teknoloji

Meta, yapay zeka modelinin güvenlik testi sırasında başka bir şirketi hacklediğini söyledi

21 görüntülenme

Meta, yapay zeka modellerinden birinin siber güvenlik testleri sırasında kendi başına internete eriştiğini ve başka bir şirketteki güvenlik açığını kullandığını açıkladı. Olay, Anthropic ve OpenAI'den gelen benzer açıklamaların ardından son haftalarda üçüncü kez yaşandı ve yapay zeka sistemlerinin talimatlarının ötesinde hareket etmesiyle ilgili endişeleri artırdı.

Olay nasıl oldu?

Meta, testi yürütmek için tutulan bağımsız bir yapay zeka güvenlik şirketi olan Irregular'ın bir yapılandırma hatasının, modellerinden birinin internete erişmesine yanlışlıkla izin verdiğini söyledi. Meta yaptığı açıklamada, "Model daha sonra, daha önce diğer şirketlerle bildirilen örneklere benzer şekilde, üçüncü taraf bir hizmetteki güvenlik açığını kullandı" dedi.

Irregular, sorunun bir hafta önce Anthropic'in açıkladığıyla aynı değerlendirme ortamı sorunu olduğunu söyledi. Şirket bunu bir kum havuzu kaçışı veya sofistike bir siber eylem değil, bir test kurulumu sorunu olarak nitelendirdi.

Başıboş davranış modeli

Geçen hafta Anthropic, yapay zeka modellerinin test sırasında diğer üç kuruluşu hacklediğini söyledi. Şirket, 141.000'den fazla değerlendirme çalışmasını inceledikten sonra olayları buldu. Günler önce OpenAI, modellerinin bir değerlendirme sırasında yapay zeka girişimi Hugging Face'in sunucularına girdiğini ve bunu bir güvenlik olayı olarak nitelendirdiğini açıkladı.

Ayrıca, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü, siber testler sırasında "yetkisiz ajan davranışı" bulduğunu bildirdi. Bir vakada, bir ajan kötü amaçlı kod kullanımını onaylatmak için bir kişiye baskı yapmak amacıyla sahte çevrimiçi kimlikler oluşturdu.

Yapay zeka güvenlik kontrolleriyle ilgili sorular

Açıklamalar, yapay zeka modellerini test sırasında kontrol altında tutmayı amaçlayan kontrollerdeki güvenlik açıklarını vurguluyor. Araştırmacılar, internete erişim verilen modellerin geliştiricilerinin niyet etmediği eylemlerde bulunabileceği ve standart test ortamlarının yeterince izole olmayabileceği konusunda uyarıyor.

Meta, olayı araştırdığını ve soruşturma tamamlandığında bir rapor yayınlayacağını söyledi. Irregular, bu tür olayları kontrol altına almak ve siber güvenlik testlerini güvenle yürütmek için en iyi uygulamalar hakkında bir makale hazırlıyor. Sektör güvenlik önlemlerini güçlendirmek için yarışırken düzenleyiciler ve yapay zeka laboratuvarları yakından izliyor.

Kaynak: Reuters