OpenAI ve Anthropic Yapay Zeka Modellerinde Güvenlik Stratejilerini Değiştiriyor
OpenAI, henüz piyasaya sürülmemiş olan Astra modelinin kritik siber güvenlik yeteneklerine sahip olabileceğini kabul ederek, bu sistem için yeni güvenlik protokollerini duyurdu. Şirket, modelin geliştirme aşamasında dahi ciddi riskler barındırabileceğini belirterek, Preparedness çerçeve kapsamında daha sıkı denetimler uygulayacağını açıkladı.
Şirket, Astra'nın kodlama ve siber güvenlik alanındaki yeteneklerinin gelişmiş olduğunu belirterek, bu süreçte izole test ortamları, kısıtlı ağ erişimi ve gelişmiş şifreleme yöntemleri kullanacağını bildirdi. Ayrıca, modelin Chain of Thought (Düşünce Zinciri) sürecini izleyecek bir denetim mekanizması kurulacağı ifade edildi. Bu sistem, yüksek riskli faaliyetleri tespit ettiğinde güvenlik yanıtlarını tetikleyerek işlemleri durdurma yetkisine sahip olacak.
Diğer taraftan Anthropic, Fable modeli üzerindeki bazı kısıtlamaları gevşetme kararı aldı. Şirket, özellikle biyoloji alanındaki sorgularda kullanıcıların karşılaştığı reddetme oranlarını düşürerek modelin işlevselliğini artırmayı hedefliyor. Daha önce güvenlik endişeleri nedeniyle araştırmacıların kullanımını zorlaştıran bu kısıtlamaların, rekabetçi piyasa koşulları ve kullanıcı talepleri doğrultusunda yeniden düzenlendiği belirtiliyor.
OpenAI, gelişmiş siber yeteneklere sahip modellerin savunma amaçlı kullanılabileceğini savunsa da, bu tür teknolojilerin kötü niyetli aktörlerin eline geçme riski sektördeki tartışmaların merkezinde yer almaya devam ediyor.


