Anthropic, Claude'nin yeni filigranlarının nasıl çalışacağına ilişkin daha fazla ayrıntı paylaşıyor

Özgün başlık: Anthropic shares more details about how Claude’s new watermarks will work
Anthropic Cuma günü, sohbet robotu Claude tarafından oluşturulan metni nasıl filigranlayacağına ilişkin bazı temel soruları yanıtlamayı amaçlayan bir blog yazısı yayınladı. Örneğin: Filigranlama gerçekte nasıl çalışacak? Düzenleme ile gizlenebilir mi? Peki bu kodu nasıl etkiler? Claude kullanıcılar, şirketin bu hafta başında bu filigranı, yapay zeka şirketlerinin yapay zeka tarafından oluşturulan içeriği tanımlamayı mümkün kılan sistemler kullanmasını gerektiren AB Yapay Zeka Yasası Şeffaflık Koduna uymak için yapacağını açıklamasından bu yana bu hareketi tartışıyor. Örneğin Reddit'teki bir poster bunu masum Claude kullanıcılarına karşı bir komplo olarak nitelendirirken, bir diğeri şunu iddia ediyordu: "Bunu istememenizin tek nedeni insanlara yalan söylemektir." Ve Business Insider, X'teki "düzinelerce" kullanıcının sonuç olarak Claude aboneliklerini iptal ettiklerini iddia ettiğini bildirdi. Anthropic'in yeni gönderisi, filigran konseptine genel bir bakışla başlıyor ve "düşük riskli seçimler" yaparken - hava durumunu tanımlamak için "bulutlu" ve "gri" kelimeleri arasında seçim yapmak gibi - Claude yanıtlarında "okuyucu tarafından algılanamayan, ancak onu kodlayan bir anahtara sahip olan herkes tarafından algılanabilen" bir model oluşturabileceğini açıklıyor. Şirket, "Filigranlama Claude'nin çıktısının kalitesini etkilemez" dedi.
"Bir okuyucu için filigranlı bir yanıt, filigransız bir yanıttan ayırt edilemez." Daha spesifik olarak Anthropic, Google DeepMind ekibinin 2024'te özetlediği SynthID-Text yaklaşımını kullanacağını ve bir filigran algılama API'si yayınlamayı planladığını söyledi.