Psikolojik yöntemler yapay zeka güvenlik testlerindeki büyük zayıflıkları ortaya çıkarıyor

Özgün başlık: Psychological methods reveal major weaknesses in AI security testing
Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü'ndeki araştırmacılar, dil modelleri için popüler güvenlik kriterlerinin tek bir tutarlı özelliği ölçmediğini göstermek için psikometrik yöntemler kullandı. İsteklerin tamamen engellenmesi, model gün geçtikçe daha az kullanışlı hale gelse bile güvenlik puanını yapay olarak artırabilir. Çalışma aynı zamanda testler sırasında normal kullanımda olduğundan daha temkinli davranan modellerin yakalanmasına yönelik bir yöntem de sunuyor. Psikolojik yöntemler yapay zeka güvenlik testlerindeki büyük zayıflıkları ortaya koyuyor makalesi ilk olarak The Decoder'da yayınlandı.
✳ Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗
Akış içinde yorumlarla aç