Anthropic, Yapay Zeka Geliştirme Süreçlerinde Claude'un Rolünü Açıkladı

Yapay zeka geliştirme süreçlerinde şeffaflığı artırmayı hedefleyen Anthropic, kendi modellerini oluştururken yapay zekanın ne kadar sorumluluk üstlendiğine dair yeni metrikler yayınladı. Şirket, Ağustos 2026 itibarıyla araştırma çalışmalarının yüzde 26'sının AL4 seviyesinde, yani yapay zekanın süreci yönettiği aşamada olduğunu açıkladı. Şubat ayında yüzde 1'in altında olan bu oran, geliştirme süreçlerinde otomasyonun hızla arttığını gösteriyor.
Anthropic'in kullandığı AL4 seviyesi, yapay zekanın bir hata raporunu analiz edip çözüm üretebildiği ancak nihai onay ve yönlendirme için insana ihtiyaç duyduğu bir aşamayı temsil ediyor. Şirket, bu skorlamayı bizzat Claude modellerine yaptırdı. Ancak bu durum, değerlendirmenin taraflı olabileceği eleştirilerini de beraberinde getiriyor. Şirket içi yapılan çapraz kontrollerde, çalışanların ve yapay zekanın aynı görev için aynı seviyeyi belirleme oranının sadece yüzde 59'da kaldığı görüldü.
Şirket, iç platformlarında aynı anda yaklaşık 30.000 yapay zeka ajanı çalıştırdığını belirtti. Bu ajanların faaliyetlerini denetlemek için kullanılan gerçek zamanlı bir izleme sistemi, Ağustos ayında gerçekleşen bir milyardan fazla kararın sadece yüzde 0,002'sini engelledi. Ayrıca, yapay zeka araştırmaları için harcanan toplam işlem gücünün yüzde 6'sının güvenlik çalışmalarına ayrıldığı ifade edildi.
Anthropic, güvenlik ve yetenek araştırmaları arasındaki çizginin belirsiz olduğunu ve geliştiricilerin bu ayrımı kendi lehine yorumlama eğiliminde olabileceğini kabul ediyor. Şirket, bu verilerin sektörün gelişim hızını koordine etmek ve kamuoyuna daha fazla içgörü sunmak adına bir başlangıç noktası oluşturmasını hedefliyor.


