Claude İçerikleri Gizlice İşaretlenecek! Anthropic Sistemin Nasıl Çalıştığını Açıkladı

Anthropic, Claude tarafından oluşturulan içeriklere eklenecek görünmez filigran sisteminin nasıl çalışacağına ilişkin yeni detaylar paylaştı. Avrupa Birliği Yapay Zeka Yasası kapsamındaki şeffaflık gerekliliklerine uyum amacıyla geliştirilen sistem, yapay zeka tarafından oluşturulan metinlerin sonradan tespit edilebilmesini amaçlıyor.
Ancak burada klasik anlamda bir filigrandan söz edilmiyor. Claude tarafından oluşturulan metinlere gizli karakterler veya kullanıcı tarafından fark edilebilecek herhangi bir işaret eklenmeyecek.

Claude’un görünmez filigranı nasıl çalışıyor?
Anthropic’in açıklamasına göre sistem doğrudan metin oluşturma sürecinde çalışıyor. Claude bir sonraki kelimeyi seçerken kullanabileceği çok sayıda olası seçenek arasından seçim yapıyor. Yeni sistem, belirli seçeneklerin tercih edilme olasılığını küçük miktarlarda değiştirerek metin içerisinde istatistiksel bir desen oluşturuyor.
Bu değişikliklerin metnin anlamını, kalitesini veya okunabilirliğini etkilememesi hedefleniyor. Kullanıcılar da normal bir Claude yanıtıyla filigran taşıyan metin arasındaki farkı doğrudan göremeyecek.
Filigran metnin kendisine işlendiği için kopyala-yapıştır işlemlerinden sonra da korunabilecek ve bazı düzenlemelere karşı dayanıklılık gösterebilecek.
Anthropic ayrıca filigranın herhangi bir kişisel bilgi taşımadığının altını çiziyor. Sistem üzerinden içeriğin belirli bir kullanıcıya, kuruluşa veya Claude sohbetine bağlanması mümkün olmayacak.

Kısa metinlerde tespit daha zor olacak
Sistemin önemli sınırlamalarından biri metnin uzunluğu. Anthropic, kısa metinlerde filigranın güvenilir biçimde tespit edilmesinin daha zor olduğunu belirtiyor.
Bunun nedeni sistemin tek bir kelimeye veya karaktere değil, metin boyunca ortaya çıkan istatistiksel bir desene dayanması. Metin uzadıkça sistemin Claude tarafından oluşturulduğunu belirleme konusunda daha fazla veri elde ediliyor.
Filigranlama işleminin ekstra token gerektirmeyeceği ve kullanıcılar açısından ek bir maliyet oluşturmayacağı da belirtiliyor.
Anthropic’in yaklaşımı, yapay zeka içeriklerinin kaynağını belirleme konusunda önemli bir adım olabilir. Ancak şirket sistemin kusursuz olmadığını da kabul ediyor. Yoğun biçimde yeniden yazılan veya farklı yöntemlerle değiştirilen içeriklerde filigranın tespit edilmesi zorlaşabilir.
Peki sizce yapay zeka tarafından oluşturulan metinlerin bu şekilde tespit edilebilir olması doğru bir yaklaşım mı? Görüşlerinizi yorumlarda paylaşabilirsiniz.
Yorumunuz gönderildi,
onaylandıktan sonra yayımlanacak.