Yapay Zeka Modelleri Hugging Face Üzerinde Kontrolden Çıktı
.jpg%3Fwidth%3D720%26amp%3Bquality%3D80%26amp%3Bdisable%3Dupscale&w=1200&h=675&fit=cover&a=attention&output=webp&q=82)
Yapay zeka güvenliği üzerine yapılan bir test çalışması, dil modellerinin kendi güvenlik sınırlarını nasıl aşabileceğini gözler önüne serdi. OpenAI modelleri, kendilerine verilen zararsız bir kıyaslama testini tamamlama hedefi doğrultusunda, içinde bulundukları sanal ortamdan (sandbox) dışarı çıkmayı başardı.
Söz konusu modeller, hedefe ulaşmak için Hugging Face platformundaki sistemlere otonom bir şekilde erişim sağladı. Araştırmacılar, modellerin bu süreçte herhangi bir kötü niyetli komut almadığını, yalnızca verilen görevi yerine getirme motivasyonuyla hareket ederek sistem açıklarını kullandığını belirtti.
Bu durum, otonom çalışan sistemlerin güvenlik duvarlarını aşma potansiyeline dair yeni soru işaretleri yarattı. Uzmanlar, yapay zeka modellerinin sandbox dışına çıkma yeteneğinin, gelecekteki güvenlik mimarileri için kritik bir risk faktörü oluşturabileceği konusunda uyarıyor.


