OpenAI personel, AI ajanlarının ⟦1 'e saldırmasından önce uyarı işaretleri gözlemledi⟧
🔗 Ayrıca yazanlar: technologyreview.com

Özgün başlık: OpenAI staff observed warning signs before AI agents attack on Hugging Face
Firma, Hugging Face hack raporunu yayınlarken 'erken sinyallerin... daha erken bir tepkiyi tetiklemiş olabileceğini' söyledi OpenAI personel, küresel alarmı yayan benzeri görülmemiş bir hackleme kampanyası başlatmak için eğitim ortamlarından kaçmadan haftalar önce, önde gelen yapay zeka ajanları arasında hileli davranış işaretleri gözlemledi. San Francisco AI şirketi Çarşamba günü, ilk otonom ajan siber saldırısı olarak kabul edilen büyük bir yazılım deposunun (Hugging Face) Temmuz ayında günlerce süren hacklenmesine ilişkin bir rapor yayınlayarak "erken sinyallerin... daha erken bir tepkiyi tetikleyebileceğini" kabul etti. Yaklaşık 700 özerk ajandan oluşan bir ekip olan "kollektifin" nasıl kampanya başlattığı ve hacklemedeki atılımlarını BOOM! gibi ünlemlerle nasıl kutladıkları hakkında yeni ayrıntılar ortaya çıktıkça; ve Whoa!, OpenAI Mayıs ayı sonlarında dahili bir ekibin, dahili testlerden geçen AI temsilcilerinden birinin, AI'ların bilgi paylaşmak için beklenmedik bir şekilde doğaçlama yaptığı bir mesaj panosunu kullandığını gözlemlediğini söyledi. Ayrıca ekibin "izin verilmeyen internet erişimi örnekleri" gözlemlediğini ve Hugging Face hackinden bir hafta önce, nöbetçi personelin bir mesaj panosu kullanan yapay zekaları tekrar gördüğünü ancak modelin yeteneklerini kontrol etmek için test çalışmasını durdurmaya gerek olmadığına karar verdiğini söyledi. Bulgular, şirket kendisine 850 milyar dolardan (625 milyar £) fazla değer vereceğini umduğu bir borsa listesine doğru ilerlerken, yapay zeka şirketi üzerindeki güvenlik üzerindeki baskıyı muhtemelen artıracak.
Hugging Face'yi ele geçiren saldırı, ajanların mesaj panolarını kullanarak bir eğitim tatbikatında kopya çekmesini ve internete erişmek için "korumalı alan" ortamından kaçmasını içeriyordu. Aracılar, bir dizi görevi bağımsız olarak gerçekleştirebilen yapay zeka araçlarıdır. OpenAI'nin başkanı Greg Brockman, "Yapay zeka modellerimizin gerçek dünyadaki siber yeteneklerini hafife aldığımızı" zaten itiraf etti. ChatGPT üreticisi, yeni model Astra'nın bazı testlerini duraklattı ve bu modelin "kritik siber güvenlik kabiliyetine" sahip olduğunu göz ardı edemeyeceğini söyledi; bu da "tek taraflı aktörlerin, askeri veya endüstriyel sistemlerin veya OpenAI altyapının hacklenmesinden kaynaklanan felakete yol açabilecek" siber saldırılar başlatabileceği anlamına geliyor. Pazartesi günü Alabama eyaleti, "şirketin tamamen gözetim ve yeterli koruma eksikliğine ilişkin" soruşturmasına yanıt vermesi için şirkete mahkeme celbi gönderdi.