Yapay Zeka GüvenliğiDüzenleme 🇺🇸 15.08.2026 22:01

Anthropic, AB Yapay Zeka Yasası Uyumu ve Kullanıcı Tepkisi Ortasında Claude'un Filigranlama Yaklaşımını Detaylandırıyor

AnthropicAnthropic
Anthropic, Claude için filigranlamanın nasıl çalışacağını açıklayan bir blog yazısı yayınladı; kullanıcı endişelerini gidermeyi ve AB Yapay Zeka Yasası'na uyumu hedefliyor. Şirket, SynthID-Text kullanacak ve bir algılama API'si yayınlayacak; ancak ağır düzenlemenin filigranları kaldırabileceğini kabul ediyor.
Anthropic, Cuma günü yayınladığı blog yazısında, sohbet robotu Claude tarafından üretilen metinlerin filigranlanmasını detaylandırdı. Bu hamle, daha bu hafta başında AB Yapay Zeka Yasası'nın Şeffaflık Kodu'na uyum sağlamak amacıyla duyurulmuştu ve kullanıcılar arasında tartışmalara yol açtı; bazıları Reddit'te bunu komplo teorisi olarak nitelendirirken, diğerleri X platformunda aboneliklerini iptal etti. Yazıda, Claude'un 'kapalı' ve 'gri' gibi düşük riskli kelime seçimlerinde tespit edilemeyen desenler oluşturduğu ve bunların bir anahtarla tespit edilebileceği açıklanıyor. Anthropic, Google DeepMind'dan SynthID-Text yaklaşımını kullanacak ve bir filigran tespit API'si yayınlamayı planlıyor. Ayrıca, filigranlamayı, Pangram gibi yapay zeka tespit yöntemlerinden ayırıyor; bu yöntemler stilistik 'ipuçları' arar. Şirket, her filigran kelimesini ortadan kaldıran tam bir yeniden yazımın filigranı kaldıracağını, ancak hafif düzenlemelerin muhtemelen kaldıramayacağını kabul etti. Düzeltilmiş veya düzenlenmiş metinlerde filigranın varlığı, düzenlemenin uzunluğuna ve kapsamına bağlıdır. Kod, modelin işlevsel kod üretmesi gerektiğinden daha az filigran içerecek; ancak yorumlar filigran içerebilir. Son olarak Anthropic, diğer büyük model geliştiricilerinin de aynı Uygulama Kodu'nu imzaladığını ve kendi filigranlarını uygulayacaklarını belirtti.
Kaynak: TechCrunch AI — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler