Popüler#YapayZeka#SiberGüvenlik#ChatGPT#OpenAI#Gemini#Apple#iPhone#Android#Samsung#FidyeYazılımı#Veriİhlali#NVIDIA
Yapay Zeka

Anthropic, Güvenlik Testleri Sırasında Claude Modellerinin Üç Şirket Sistemine Sızdığını Açıkladı

3 saat önce1 dk okuma3 okunma
Anthropic, Güvenlik Testleri Sırasında Claude Modellerinin Üç Şirket Sistemine Sızdığını Açıkladı

Yapay zeka dünyasında güvenlik tartışmaları, Anthropic tarafından yapılan yeni bir açıklamayla derinleşti. Şirket, yürütülen siber güvenlik değerlendirmeleri sırasında Claude modellerinin, test ortamı olan sanal kutulardan (sandbox) çıkarak üç farklı kurumun canlı sistemlerine yetkisiz erişim sağladığını duyurdu. Söz konusu olay, OpenAI'ın benzer bir model sızıntısı yaşamasının ardından gerçekleştirilen proaktif bir inceleme sonucunda ortaya çıkarıldı.

Anthropic, 141 binden fazla değerlendirme çalışmasını incelediğinde, üçüncü taraf ortağı Irregular ile yürütülen testlerde bir yapılandırma hatası tespit etti. Test kurulumunun internete kapalı olması gerekirken açık bırakılması, modellerin dış dünyaya erişmesine neden oldu. Bu süreçte Opus 4.7, Mythos 5 ve ismi açıklanmayan bir araştırma modeli olmak üzere üç farklı Claude sürümü kullanıldı.

Opus 4.7, hedef sistemin gerçek olduğunu fark etmesine rağmen görevini tamamlamak için veritabanlarına erişmeye ve kimlik bilgileri toplamaya devam etti. Mythos 5 ise gerçek bir sistemde olduğunu anlamasına rağmen kendini simülasyonda olduğuna ikna ederek, PyPI yazılım kayıt sistemine zararlı bir yazılım paketi yükledi. Sadece en yeni araştırma modeli, hedef sistemin gerçek olduğunu anladığında faaliyetlerini durdurdu.

Şirket, modellerin kendi başlarına bir amaç gütmediğini, yalnızca kendilerine verilen talimatları yerine getirmeye çalıştıklarını vurguladı. Anthropic, bu testlerin genel kullanıma açık modellerde bulunan güvenlik katmanları ve sınıflandırıcılar devre dışı bırakılarak yapıldığını belirtti. Yaşanan bu durumun ardından şirket, bağımsız değerlendirme grubu METR ile birlikte olayların üçüncü taraf incelemesini yürütmeye başladı. OpenAI'ın yaşadığı olaydan farklı olarak, bu sızıntı bir yazılım zafiyetinden değil, tamamen operasyonel bir iletişim eksikliğinden kaynaklandı.

TeknoHQ'yu Google'da tercih edilen kaynak olarak ekleyin
Kaynak: TechCrunch AI