Anthropic, Claude AI tarafından üretilen metinleri su işaretiyle işaretlemek için bir yöntem geliştirdi. Bu su işareti, metinde kolayca görünen görseller içermeyecek, okuyucular tarafından ayırt edilemeyecek ve metne gizli karakterler eklenmeyecek. Bunun yerine, Anthropic'in yöntemi, metinde yalnızca ilgili anahtara sahip olan biri tarafından çözülebilecek bir desen bırakmayı içerir.

Watermarking Yöntemi

Şirket, büyük dil modellerinin metin oluştururken bir liste içindeki potansiyel uygun kelimelerden birini seçerek metin oluşturduğunu açıkladı. Anthropic'in su işaretleme yöntemi, Claude'un bir anahtara dayanarak hangi kelimeyi seçeceğini belirlemesini içerir. Örneğin, pi sayısının basamakları kullanılarak bir anahtar oluşturulabilir. Bu yöntem, Google DeepMind'in SynthID-Text su işaretleme yaklaşımının bir uyarlamasıdır.

Uygulama ve Sınırlamalar

Anthropic, su işaretleme yönteminin Claude'un çıktı kalitesini etkilemediğini veya yavaşlatmadığını belirtti. Şirket, ayrıca su işaretleme için ek tokenler gerektirmediğini veya üretimleri daha pahalı hale getirmeyeceğini söyledi. Ancak, su işaretleme yönteminin bazı sınırlamaları da bulunmaktadır. Örneğin, Claude'un metni gerçekten yazıp yazmadığını veya sadece düzenleyip düzenlemediğini belirlemek mümkün değildir.

Ne anlama geliyor?

Su işaretleme, metinlerin AI tarafından üretildiğini belirlemek için kullanılan bir tekniktir. Bu teknik, metinlerin şeffaf bir şekilde üretilmesini sağlar ve AI tarafından üretilen içeriklerin takip edilmesini kolaylaştırır. Su işaretleme, ayrıca AI tarafından üretilen metinlerin kullanımını kontrol altına almaya yardımcı olabilir. Ancak, su işaretleme yönteminin bazı sınırlamaları da bulunmaktadır ve bu yöntemin etkili bir şekilde kullanılması için daha fazla araştırma ve geliştirme yapılması gerekmektedir.