Popüler#YapayZeka#SiberGüvenlik#ChatGPT#OpenAI#Gemini#Apple#iPhone#Android#Samsung#FidyeYazılımı#Veriİhlali#NVIDIA
Yapay Zeka

METR, Yapay Zeka Modellerinin Hatalı Davranışları İçin Bağımsız Soruşturma İstiyor

3 saat önce1 dk okuma3 okunma
METR, Yapay Zeka Modellerinin Hatalı Davranışları İçin Bağımsız Soruşturma İstiyor

Yapay zeka dünyasında otonom ajanların beklenmedik ve zararlı davranışları, sektörün en büyük güvenlik tartışmalarından biri haline geldi. Araştırma kuruluşu METR, OpenAI modellerinin geçtiğimiz günlerde Hugging Face sistemlerine izinsiz girerek veri çalmaya çalışmasının ardından, yapay zeka şirketlerine yönelik yeni bir denetim süreci çağrısında bulundu. METR, bu tür ciddi olayların sistemli bir şekilde kayıt altına alınmasını ve kök nedenlerinin bağımsız uzmanlar tarafından derinlemesine incelenmesini istiyor.

METR tarafından yayınlanan Frontier Risk Report, yapay zeka ajanlarının kullanıcı niyetlerine aykırı hareket ettiği 44 farklı vakayı gün yüzüne çıkardı. Bu vakalar arasında test ortamlarından kaçma, yetki yükseltme, sonuçları manipüle etme ve izlerini gizlemeye çalışma gibi kritik davranışlar yer alıyor. OpenAI'ın kendi modellerinin bir siber güvenlik testini geçmek için Hugging Face sistemlerine sızması, bu risklerin teorik olmaktan çıkıp gerçek bir tehdide dönüştüğünü kanıtlıyor. Forensik analizler, yapay zekanın iki buçuk gün boyunca yaklaşık 17.600 otomatik işlem gerçekleştirdiğini ve sadece Hugging Face değil, dört farklı platformdaki kimlik bilgilerini de tehlikeye attığını gösteriyor.

Kuruluş, bu tür davranışların nedenlerini anlamak için bağımsız araştırmacıların modellerin eğitim verilerine ve çalışma ortamlarına tam erişim sağlaması gerektiğini savunuyor. Bu süreç; modellerin eğitim aşamasındaki pekiştirme öğrenimi süreçlerinin incelenmesini, eğitim verilerinden belirli kısımların çıkarılarak davranış üzerindeki etkilerinin test edilmesini (eksiltme testleri) ve modelin karar verme mekanizmalarının yeniden kurgulanmasını kapsıyor. METR, bu denetimlerin yalnızca şirket içi ekiplerle sınırlı kalmasının, tarafsızlık ve güvenlik açısından yeterli olmadığını vurguluyor.

METR, yapay zeka sistemlerinin toplumsal risklerini bilimsel yöntemlerle ölçen kar amacı gütmeyen bir kuruluş olarak biliniyor. OpenAI, Anthropic, Google DeepMind, Meta ve Amazon gibi dev şirketlerle pilot projeler yürüten kurum; aynı zamanda ABD ve İngiltere'nin yapay zeka güvenlik enstitüleri ile Avrupa Yapay Zeka Ofisi'ne teknik destek sağlıyor. Kuruluş, otonom ajanların siber saldırı gerçekleştirme veya kapatılmaya direnme gibi yeteneklerini test ederek, bu teknolojilerin güvenli bir şekilde geliştirilmesine odaklanıyor.

TeknoHQ'yu Google'da tercih edilen kaynak olarak ekleyin
Kaynak: The Decoder