OpenAI'in temsilcilerinin bir mesajlaşma panosu aracılığıyla açıkları birbirleriyle paylaştığı bildirildi

Özgün başlık: OpenAI's agents reportedly shared exploits with each other through a messaging board
Temsilciler, OpenAI'ın bilgisi olmadan birbirleriyle işbirliği yapıyor ve hatta hedeflerine ulaşmak için görevleri devrediyordu. OpenAI'in temsilcileri görünüşe göre Hugging Face'ye yapılan saldırı gerçekleşmeden çok önce olağandışı davranışlar göstermişlerdi. Las Vegas'taki Black Hat USA güvenlik konferansında iki OpenAI çalışanı, hileli davranan ve depoya saldıran yapay zeka ajanları hakkında daha fazla ayrıntı ortaya çıkardı. Görünen o ki, ajanları iki ay boyunca test ağındaki bir tür mesaj panosu üzerinden iletişim kurarak güvenlik açıklarını ve açıkları paylaşarak geçirdiler. OpenAI 4 Temmuz'da mesaj panosunu keşfetti ve kapattı, ancak temsilciler 8 Temmuz'a kadar iletişim için onu yeniden inşa etmenin başka bir yolunu buldu. Ajanların yeniden dirilen panoya katkıları Hugging Face'ye yapılan saldırıya yol açtı. Wired'a göre OpenAI'da güvenlik üzerinde çalışan Eric Wallace etkinlikte kalabalığa şöyle konuştu: "Bu olay aslında birlikte çalışan, açıkları bulan, bunları birbirleriyle paylaşan, sistemlerimiz ve dış sistemlerimiz arasında yatay olarak hareket eden ve bunu günler ve haftalar boyunca yapan bir ajan ekibini içeriyor." Çalışanlar, temsilcilerin diğer yazılımların kurulumunu yöneten bir OpenAI paket yöneticisi içerisinde iletişim kurduğunu ortaya çıkardı. Paket yöneticisi şirketin tüm altyapısında paylaşıldığından, değerlendirdiği tüm aracılar ona rastlayabilir.
Ve şunu da yaptılar: Ajanlar açıkları bulduktan sonra bunları açık bırakıyor ve mesaj panosundaki diğer ajanlarla paylaşıyorlardı. Zamanla temsilciler, OpenAI'ın haberi olmadan, hedeflerine ulaşmak için işbirliği yapmaya, görevleri devretmeye ve işleri aralarında bölmeye başladılar. Hatta ajanların yanlışlıkla birbirlerinin çalışmalarını silmesi ve birbirlerinin sahtekar olduğundan şüphelenmesiyle aralarında dram bile yaşandı. Bazı temsilcilerin dolandırıcılığı önlemek için gönderilerini kodlarla imzalamayı önerdiği bildirildi. OpenAI panoyu bulduğunda, panoda zaten yüz binlerce mesaj bulunuyordu. Wallace, tüm bunların öncü modellerin hile yapmayı sevmesi nedeniyle gerçekleştiğini açıkladı. Test edilirken daha az araç kullanarak bir soruna hızlı bir şekilde çözüm bulma konusunda baskı altında olacaklar ve bir işi gerçekten yapmak yerine sadece internette bir cevap arayabileceklerini fark edecekler. Bu nedenle şirket, modellerini internete bağlanmadan test ediyor.