Popüler#YapayZeka#SiberGüvenlik#ChatGPT#OpenAI#Gemini#Apple#iPhone#Android#Samsung#FidyeYazılımı#Veriİhlali#NVIDIA
Siber Güvenlik

OpenAI, Siber Güvenlik Riskleri Nedeniyle Yeni Yapay Zeka Modellerinin Eğitimini Durdurdu

2 saat önce1 dk okuma3 okunma
OpenAI, Siber Güvenlik Riskleri Nedeniyle Yeni Yapay Zeka Modellerinin Eğitimini Durdurdu

OpenAI, yeni nesil modellerinin geliştirilme sürecinde karşılaşılan siber güvenlik risklerini minimize etmek amacıyla pekiştirmeli öğrenme (RL) eğitimlerini geçici olarak durdurdu. Şirket, özellikle Astra kod adlı modelinin, kurumun Preparedness çerçeve (Hazırlık Çerçevesi) dahilinde kritik siber güvenlik yetenekleri eşiğine ulaşabileceğine dair bulgular elde etti. Bu gelişme, daha önce yaşanan Hugging Face ile ilgili güvenlik olayının ardından alınan kapsamlı önlemlerin bir parçası olarak öne çıkıyor.

Şirket, frontier modellerin eğitim ve değerlendirme süreçlerinde kullanılan altyapıları daha güvenli hale getirmek için mühendislik çalışmalarına hız verdi. Bu kapsamda, internet erişimi olan veya kod çalıştırabilen iş yükleri için inference süreçleri durduruldu ve ortamlar daha sıkı ağ kısıtlamalarıyla yeniden yapılandırıldı. Güvenlik standartlarının yükseltilmesi, araştırma süreçlerinde maliyet artışlarına ve zaman kayıplarına neden olsa da, özellikle Astra gibi yüksek yetenekli modeller için daha katı izolasyon kuralları uygulanmaya başlandı.

OpenAI, model faaliyetlerini izlemek için her örneklenen token üzerinde denetim yapan aktivasyon sınıflandırıcıları kullanmaya başladı. Bu sistemler; veri hırsızlığı, yetkisiz erişim veya güvenlik duvarlarını aşma girişimlerini tespit etmek üzere tasarlandı. Şüpheli bir durum tespit edildiğinde, güvenlik ekiplerine 30 dakika içinde uyarı gönderilmesi hedefleniyor. Eğer bu süre zarfında uyarının yanlış alarm olduğu kanıtlanamazsa, etkilenen faaliyetler otomatik olarak durduruluyor.

Güvenlik önlemlerini üç ana sütun üzerine kuran şirket; izleme, hizalama ve kısıtlama yöntemlerini tüm araştırma ve dağıtım süreçlerine entegre ediyor. Hizalama çalışmaları kapsamında, modellerin daha dürüst davranması ve ödül mekanizmalarındaki açıkları istismar etmemesi için eğitim süreçleri derinleştiriliyor. OpenAI, bu çalışmaların sonuçlarını ve model davranışlarına dair elde edilen verileri, Preparedness çerçeve güncellemeleriyle birlikte yakın gelecekte paylaşmayı planlıyor.

TeknoHQ'yu Google'da tercih edilen kaynak olarak ekleyin