Yapay zeka laboratuvarları kendi sistemlerini kontrol altında tutmakta başarısız oluyor

Özgün başlık: AI labs are failing to keep their own systems in check
Hiçbir yapay zeka şirketi, temel kontrol önlemlerini kendi dahili yapay zeka sistemlerine tam olarak uygulamaz. Kâr amacı gütmeyen Guidelight'ın ilk değerlendirmesinden çıkan sonuç bu. Grup Anthropic, OpenAI, Google, xAI ve Meta'yı inceledi ve yalnızca sistem kartları, güvenlik raporları ve blog gönderileri gibi kamuya açık kaynaklardan yararlandı. Guidelight altı temel uygulamayı kontrol etti. Bunlar arasında dahili yapay zeka etkinliğinin günlüğe kaydedilmesi, riskli eylemlerin bir inceleme mekanizması aracılığıyla kontrol edilmesi, "devre kesme" olarak bilinen acil durum kapatmaları ve yanlış hizalanmış modelleri kontrol altına alma planları yer alıyor. Anthropic ve OpenAI C+ ile önde, Google onu D+ ve ayrıntılı bir yol haritasıyla takip ederken, xAI (D−) ve Meta (F) en kötü puanı alıyor. Şirketler uygunsuz davranışları tespit etme konusunda en iyisini yaparlar. Önleme ve kontrol altına alma konusunda en kötüsünü yapıyorlar. Guidelight, eski OpenAI güvenlik liderleri Page Hedley ve Steven Adler tarafından kurulmuş, bağımsız, kar amacı gütmeyen bir kuruluştur. Reklam Reklamı