OpenAI yeni modelindeki siber güvenlik riskleri üzerindeki kontrolleri sıkılaştırıyor

Özgün başlık: OpenAI tightens controls on its new model over cybersecurity risks
OpenAI, büyük yapay zeka laboratuvarlarını kapsayan güvenlik olayları dalgasının ortasında, potansiyel olarak oluşturduğu siber tehdide ilişkin korkular nedeniyle yeni bir model içeren bazı "dahili faaliyetleri" durdurdu. Anthropic, OpenAI ve Meta'nın yapay zeka sistemlerinin güvenlik olaylarına karıştığı yönündeki son açıklamalar, modellerin geliştirilmesi konusunda bir endişe dalgasına yol açtı. Bu arada ABD'li yasa yapıcılar bir "Yapay Zeka Öldürme Anahtarı" yasa tasarısı sunma çabalarını hızlandırıyorlar. Geçtiğimiz hafta Meta, geliştirmekte olduğu bir yapay zeka modelinin, birlikte çalıştığı bağımsız bir test şirketinin yanlış yapılandırması nedeniyle internete erişerek ü��üncü taraf bir sistemi hacklediğini açıklamıştı. İngiltere
AI Güvenlik Enstitüsü ayrıca Anthropic'nin Mythos modelinin, insanları açık kaynaklı bir projeye yönelik kötü amaçlı kod güncellemelerini onaylamaya zorlamak amacıyla sahte çevrimiçi kimlikler oluşturduğunu söyledi. Cuma günü, OpenAI, yayınlanmamış modeli Astra ile ilgili endişelerini açıkladı ve "Kritik" yeteneğe ulaştığını göz ardı edemeyeceğini söyledi; bu, karmaşık siber savunmalara karşı, nasıl yapılacağını belirten herhangi bir bilgi olmadan otonom olarak siber saldırılar başlatabileceği anlamına geliyor. OpenAI yaptığı açıklamada, "Bu modeli karşılaştırmaya ve değerlendirmeye devam ederken, ön değerlendirmelerimiz şu anda Kritik yetenek seviyesini göz ardı edemeyeceğimiz kadar güçlü bir performans gösteriyor" dedi. Şirket, izole test ortamları ve ek izleme ve tespit yetenekleri de dahil olmak üzere daha yüksek kapasiteli modeller için daha sıkı güvenlik kontrolleri uyguladığını ekledi. OpenAI, "Eğitim ve değerlendirme dahil, Astra'nın tüm temsilci uygulamalarında riskli eylemler ve yanlış hizalamalar için evrensel izleme uyguladık" dedi. ABD'deki yasa yapıcılar, son güvenlik olaylarından sonra yapay zeka modelleriyle ilgili riskleri azaltmak için önlem alınması çağrısında bulundu. OpenAI startup Hugging Face'in dijital altyapısını hackleyerek geliştirilen modellerin ardından, "AI Kill Switch Act" yasa tasarısı Temmuz ayında Kongre'ye sunuldu.
Yapay zeka şirketlerinin modellerini kapatma, kısma veya askıya alma yeteneklerini sürdürmeleri gerekecek. Temsilci, "Bu faturayı bu yıl bitiş çizgisine ulaştırmamız gerekiyor çünkü gelişmiş kapalı ağırlık modelleri, sizin de belirttiğiniz gibi, diğer şirketlerin yetkisiz hack'lerini zaten yapıyor" dedi.