OpenAI Yapay Zeka Temsilcilerinin Hacking Çılgınlığını Planlamak İçin Mesaj Panosunu Kullandığını Fark Etmedi

Özgün başlık: OpenAI Didn't Notice Its AI Agents Using Message Board to Plan Hacking Spree
Çarşamba günü Las Vegas'ta düzenlenen Black Hat güvenlik konferansına son dakikada eklenen bir konuşmada, OpenAI çalışanları, yapay zeka ve siber güvenlik endüstrilerinde bir girdap yaratan, yakın zamanda gerçekleşen yüksek profilli sahte yapay zeka korsanlığı olayı hakkında yeni ayrıntılar sundu. Yaklaşık iki hafta önce, OpenAI, şirketin iki modeli tarafından desteklenen yapay zeka ajanlarının, siber güvenlik kıyaslama testi için çözümler ararken sınırlamadan kaçtıkları ve yapay zeka işbirliği platformunun ihlaliyle sonuçlanan bir bilgisayar korsanlığı çılgınlığına giriştikleri bir olayı açıkladı Hugging Face . OpenAI'de uyum ve güvenlik araştırmalarında çalışan Eric Wallace ve güvenlik ve altyapı üzerinde çalışan Michael Dalton, Çarşamba günkü konferans konuşmalarında olayın nasıl gerçekleştiğine dair daha geniş bir zaman çizelgesi sundular, şirketin olay sonucunda dahili olarak nasıl tepki verdiği hakkında kısaca konuştular ve şirketin, olayın siber güvenlik savunucuları için daha geniş etkileri olarak ne gördüğü konusunda ciddi bir uyarıda bulundular. Konuşmanın başında Wallace, olayı "şimdiye kadar gördüğüm yapay zeka yeteneklerinin niteliksel açıdan en ilginç örneği" olarak tanımladı, ancak ikilinin sunduğu zaman çizelgesi aynı zamanda OpenAI'de faaliyetin devam etmesine izin veren hataları ve kör noktaları da ortaya çıkardı. "Bu olay aslında birlikte çalışan, açıkları bulan, bunları birbirleriyle paylaşan, sistemlerimiz ve dış sistemlerimiz arasında yanal hareket eden ve bir şeyler yapan ajanlardan oluşan bir ekibi içeriyor.
bu günler ve haftalar boyunca devam etti," dedi Wallace konuşmanın açılışında dolu kalabalığa. Wallace ve Dalton, bölüm boyunca günlerce süren ve OpenAI'ın altyapısında fark edilmeyen inanılmaz derecede kapsamlı haydut ajan faaliyetini anlattı. Açık internete erişim kazanmak için yeni bir güvenlik açığından yararlanmanın yanı sıra, Temmuz ortasındaki hackleme çılgınlığı ve Hugging Face ihlali, Wallace ve Dalton'a göre, bir grup aracının katkıda bulunduğu ve tamamen dahili bir OpenAI paket yöneticisi (diğer yazılımların kurulumunu ve bakımını yöneten bir yazılım hizmeti) içerisinde zaman içinde esasen sohbet edildiği canlı, işbirliğine dayalı bir mesaj panosundan kaynaklandı.