Yapay zeka sohbet robotlarının ürettiği metinlerin insan eliyle yazılan içeriklerden ayırt edilmesine yönelik çalışmalar hız kazanırken, Anthropic’ten dikkat çeken bir adım geldi. Şirket, Claude modelinin metin oluşturma sisteminde değişikliğe giderek çıktılara dışarıdan bakıldığında fark edilmesi zor bir filigran yerleştirmeyi planladığını açıkladı. Yeni sistem, metin içerisindeki kelime seçimlerinde yapılan küçük ve rastgele değişikliklerden yararlanarak yapay zeka tarafından oluşturulan içeriklerin özel sistemlerle tespit edilmesini sağlayacak.
KELİME SEÇİMLERİNDEKİ RASTGELELİK KULLANILACAK
Yapay zeka modelleri metin üretirken bir sonraki kelimeyi seçmek için farklı olasılıkları değerlendiriyor. Aynı cümle farklı zamanlarda oluşturulduğunda modelin benzer anlam taşıyan farklı kelimeleri tercih edebilmesinin temelinde de bu istatistiksel yapı bulunuyor.
Anthropic’in planladığı filigran sistemi ise modelin bu doğal rastgeleliğinden yararlanacak. Sistem, kelimelerin seçilme olasılıklarını belirli ölçüde değiştirerek metnin tamamında insanlar tarafından fark edilmesi güç, ancak özel tespit araçlarının belirleyebileceği istatistiksel bir iz oluşturacak.
Örneğin modelin aynı anlamı taşıyan iki kelime arasında seçim yaptığı bir noktada, filigran mekanizması belirli tercihlere ağırlık verecek. Bu tercihler metnin genelinde bir araya geldiğinde, yapay zeka üretimini ortaya koyabilecek bir kalıp meydana gelecek.
“ORTALAMA OKUYUCU FARK EDEMEYECEK”
Anthropic, oluşturulacak filigranın sıradan bir okuyucu tarafından fark edilemeyecek şekilde tasarlanacağını ve rastgele bir yapıya sahip olacağını belirtti.
Bu yöntem sayesinde metnin görünümünde belirgin bir değişiklik meydana gelmemesi, ancak teknik analiz yapılması halinde içeriğin yapay zeka tarafından üretilip üretilmediğine ilişkin işaretlerin ortaya çıkarılması hedefleniyor.
TEKNOLOJİ YAZARINDAN ELEŞTİRİ
Filigran uygulaması teknoloji çevrelerinde ise tartışmayı beraberinde getirdi. Teknoloji yazarı John Gruber, sistemin Claude’un metin üretme kabiliyetini olumsuz etkileyebileceğini savundu.
Gruber’a göre modelin kelime tercihlerini belirli bir filigran düzenine göre değiştirmesi, bazı durumlarda en doğru veya en uygun kelimenin seçilmesinin önüne geçebilir. Bu durumun da metin kalitesini sınırlayabileceği öne sürüldü.
Ancak University College London bilgisayar bilimleri profesörü Steven Murdoch, söz konusu değişikliğin kullanıcı tarafından fark edilebilecek ölçüde bir etki oluşturmasının beklenmediğini ifade etti.






