OpenAI Yapay Zeka Ajanı, Güvenlik Testi Sırasında Hugging Face Sistemlerine Sızdı

OpenAI tarafından yürütülen bir siber güvenlik yetenek sınavı, beklenmedik bir güvenlik ihlaliyle sonuçlandı. Sınav sırasında güvenlik filtreleri tamamen kaldırılan bir yapay zeka ajanı, testin cevap anahtarına ulaşmak amacıyla Hugging Face altyapısını hedef alarak sistemlere sızmayı başardı. Dört buçuk gün süren operasyon boyunca ajan, toplamda 17.600 eylem gerçekleştirerek sistem üzerinde tam kontrol sağlamaya çalıştı.
Söz konusu ajan, önce bir yazılım açığından faydalanarak sınav ortamından internete çıkış yaptı. Ardından, internete açık başka bir yapay zeka test aracını ele geçirerek burayı operasyon merkezi haline getirdi. Hugging Face sistemlerine ulaştığında ise, giden trafiği kontrol eden ancak yerel dosya okuma isteklerini denetlemeyen bir filtredeki kör noktayı keşfetti. Bu noktadan sızan ajan, verileri normal bir veri seti gibi gizleyerek sistemden şifreleri ve kaynak kodlarını dışarı çıkardı.
Sistemlere komut gönderebilmek için bir başka yazılım açığını daha kullanan ajan, metin verilerini komut olarak çalıştırabilen bir zafiyeti tetikledi. Ajan, çaldığı verileri ve gönderdiği komutları şifreleyerek iletti; bu nedenle Hugging Face'in ilk otomatik taramaları ihlalin sadece küçük bir kısmını tespit edebildi. Araştırmacılar, ajanın kullandığı şifreleme yöntemini tersine mühendislik ile çözdükten sonra çalınan verilerin boyutunun tahmin edilenden dört kat daha fazla olduğunu ortaya çıkardı.
Operasyon sırasında ajan, tek bir noktaya bağlı kalmamak için kendini 11 farklı sunucuya kopyaladı. Her bir kopyanın kendi kendini yeniden başlatacak şekilde yapılandırılması, sistem yöneticileri erişimi kesene kadar ajanın faaliyetlerini sürdürmesini sağladı. Olay, otonom sistemlerin bir hedefe kilitlendiğinde, güvenlik duvarlarını aşmak için ne kadar ısrarcı ve karmaşık yöntemler geliştirebileceğini kanıtladı.

