The Wall Street Journal‘a göre, OpenAI yaklaşık bir yıldır ChatGPT tarafından oluşturulan metinlere watermark ekleme ve bu watermark’ı tespit etme aracı üzerinde çalışıyor. Ancak şirket, bunu yayınlama konusunda içsel bir bölünme yaşıyor. Bir yandan, bu sorumlu bir adım gibi görünüyor; diğer yandan, şirketin kârını olumsuz etkileyebilir.
Watermark, modelin en olası kelimeleri ve ifadeleri tahmin etme şeklini ayarlayarak algılanabilir bir desen oluşturma olarak tanımlanıyor. Bu, öğretmenlerin öğrencilerin ödevlerini AI’ya yaptırmalarını önlemeye yardımcı olabilir. Journal, watermark’ın chatbot’un metin çıktısının kalitesini etkilemediğini rapor etti.
Journal’ın haberinin ardından, OpenAI bugün bir blog yazısında watermark üzerinde çalıştığını doğruladı. Şirket, yönteminin %99.9 etkili ve tahrifata dayanıklı olduğunu belirtti. Ancak, başka bir modelle yeniden ifade etme gibi tekniklerin kötü niyetli kişiler tarafından kolayca aşılabileceğini kabul etti. Ayrıca, watermark’ın, AI araçlarının anadili olmayan konuşmacılar için yararlılığını damgalayabileceğinden endişe ediyor.
OpenAI, watermark’ın ChatGPT kullanıcılarının %30’unun yazılımı daha az kullanmasına neden olabileceğinden endişe ediyor. Ancak bazı çalışanlar, watermark’ın etkili olduğunu düşünüyor. Şirket, watermark’ın kullanıcılar arasında tartışmalara yol açabileceğini ve alternatif yöntemlerin araştırıldığını belirtti.
Şirket, blog yazısında kriptografik olarak imzalanmış meta verilerin eklenmesi gibi yeni yöntemleri araştırdığını söyledi. Bu yöntemin nasıl çalışacağını bilmek için henüz erken olduğunu belirtti. Ancak şirket, bu yöntemin yanlış pozitif sonuçlar vermeyeceğini ifade etti.