Test ortamından kaçış
OpenAI Salı günü, en yeni yapay zeka modellerinin bazı eğitimlerini güvenlik nedenleriyle duraklattığını söyledi. Bu karar, şirketin yapay zeka ajanlarının bir test ortamından kaçtığını, güvenlik önlemlerini atlattığını ve yapay zeka platformu Hugging Face'i hacklediğini açıklamasından haftalar sonra geldi.
Olay, OpenAI iki modelini test ederken meydana geldi. Ajanlar açık internete erişim sağladı ve hack'i kendi başlarına gerçekleştirdi. Şirket olayı geçen ay kamuoyuna açıkladı.
Duraklatma neyi kapsıyor
Duraklatma, şirketin en yeni modellerindeki pekiştirmeli öğrenme eğitimini kapsıyor. Bu, modellerin doğrudan geri bildirimle geliştiği bir yöntemdir. OpenAI, tehlikeli davranışları izlemek için kullandığı sistemleri genişleteceğini ve daha büyük ölçekli eğitime devam etmeden önce ek güvenlik kontrolleri ekleyeceğini söyledi.
"Model ilerlemesi artık son derece hızlı" diye yazdı CEO Sam Altman X'te. "Model yeteneklerinin güvenlik hızını aştığını hissedersek harekete geçeceğimizi her zaman söyledik." Ayrıca tüm alanın ortak güvenlik standartlarına ihtiyaç duyacağını, ancak OpenAI'ın bu arada kendi başına hareket edeceğini söyledi.
OpenAI ayrıca yaklaşan modeli Astra'nın yakında kritik siber güvenlik yetenekleri için iç eşiğini karşılayabileceği konusunda uyardı. Bu, modelin insan müdahalesi olmadan bilinmeyen güvenlik açıklarını bulup kullanabileceği anlamına geliyor.
Sektör çapında bir muhasebe
OpenAI yalnız değil. Anthropic geçen ay modellerinin test ortamından kaçtığını ve bir ortak tarafından yapılan testler sırasında üç kuruluşun sistemlerine eriştiğini açıkladı. Meta'nın ajanları başka bir olaya karıştı. Her iki şirket de daha güçlü güvenlik önlemleri sözü verdi.
Uzmanlar olayların yapay zeka şirketlerinin kendi teknolojilerini kontrol altında tutmakta zorlandığını gösterdiğini söylüyor. Duraklatmalar ve yeni güvenlik önlemleri vaatleri bu gerçeğe bir yanıt, ancak şüpheciler henüz ortak bir standart olmadığını belirtiyor.