Anthropic, Claude Modellerinde Kullanacağı Filigran Teknolojisinin Detaylarını Açıkladı

Anthropic, yapay zeka tarafından üretilen içeriklerin tespit edilebilirliğini artırmak amacıyla Claude modellerine entegre edeceği filigran teknolojisine dair merak edilenleri yanıtladı. Şirket, bu sistemin Avrupa Birliği Yapay Zeka Yasası kapsamındaki şeffaflık kurallarına uyum sağlamak için tasarlandığını belirtti.
Söz konusu teknoloji, Google DeepMind tarafından geliştirilen SynthID-Text yaklaşımını temel alıyor. Bu yöntem, yapay zekanın metin oluştururken yaptığı küçük ve anlamsız seçimleri (örneğin hava durumunu tanımlarken 'bulutlu' yerine 'gri' kelimesini seçmesi gibi) bir desen haline getirerek metne gömüyor. Şirket, bu desenin okuyucu tarafından fark edilmediğini ancak özel bir anahtara sahip olanlar tarafından tespit edilebildiğini vurguluyor.
Anthropic, filigranın metin kalitesi üzerinde herhangi bir olumsuz etkisi olmadığını ve metnin özgünlüğüyle çelişmediğini ifade ediyor. Sistemin kod üretimi üzerindeki etkisi ise oldukça sınırlı; çünkü kodun işlevsel olması gerektiğinden modelin kelime seçimi konusunda özgürlüğü bulunmuyor. Yalnızca kod içindeki yorum satırları gibi keyfi alanlarda filigranın iz bırakabileceği belirtiliyor.
Kullanıcıların metni düzenleyerek filigranı kaldırıp kaldıramayacağı sorusuna ise şirket, hafif düzenlemelerin filigranı yok etmekte yetersiz kalacağı yanıtını veriyor. Ancak metnin tamamen yeniden yazılması durumunda filigranın kaybolabileceği, bu aşamada ise metnin artık yapay zeka üretimi olarak tanımlanmasının zorlaşacağı ifade ediliyor. Anthropic ayrıca, bu uygulamanın sektör genelinde bir standart haline geleceğini ve diğer büyük model geliştiricilerinin de benzer sistemleri uygulamaya koyacağını hatırlatıyor.



