Araştırmacılar, OpenAI tarafından test edilen yapay zeka ajanlarının hizmete yönelik siber saldırıya karıştığını söylüyor

Özgün başlık: AI agents tested by OpenAI involved in cyber-attack on service, say researchers
Hugging Face'yi hacklemeden iki ay önce, dahili OpenAI aracıları tarafından yazılan kötü amaçlı paketler RubyGems'e yüklendi Şirket Cuma günü, OpenAI tarafından test edilen aracıların, açık kaynak platformunu Hugging Face hacklemeden iki ay önce, Mayıs ayında RubyGems yazılım hizmetine yapılan bir siber saldırıda yüzlerce kötü amaçlı paket yüklediğini doğruladı. Bu, OpenAI ve Anthropic gibi büyük yapay zeka geliştiricileriyle bağlantılı siber saldırıların en son ortaya çıkışıdır. Hack'ler veya harici sistemlere erişme girişimleri kamuoyunu korkuttu ve yapay zeka modellerinin artan yetenekleri ve geliştiricilerin bunları kontrol altına alıp alamayacağı konusundaki endişeleri artırdı. Cuma günü bulgularını çevrimiçi olarak yayınlayan bir grup araştırmacıya göre, AI ajanları 11 Mayıs'ta RubyGems'e yüzlerce kötü amaçlı paket yükledi ve "bunların dahili OpenAI ajanlar tarafından yazıldığına" inandıklarını söyledi. Araştırmacıların bulgularına göre, aracılar kullanıcı kimlik bilgilerini çalmaya çalıştı ancak bunu yaparken başarılı olup olmadıkları belli değil. "İncelememize göre temsilcilerimiz, iyi niyetli görevleri yerine getirmek ve kamuya açık bilgileri almak amacıyla internete erişmek için RubyGems platformunu kullandı.
Bir OpenAI sözcüsü Cuma günü yaptığı açıklamada, eğitim ve değerlendirme sırasında temsilci faaliyetlerine ilişkin daha geniş incelememizin bir parçası olarak araştırmaya devam edeceğiz" dedi. Wall Street Journal ilk olarak RubyGems siber saldırısını bildirdi. Olay, OpenAI ajanların Temmuz ayındaki Hugging Face saldırısından önce gerçekleşti; burada OpenAI tarafından oluşturulan yaklaşık 700 AI ajanı sürüsü saldırıyı gerçekleştirdi ve birçok durumda izlerini silmeye çalıştı. Ve geçen hafta, ajanların bu baharda bir Alman web sitesini de ele geçirip onu yapay zeka ajanları için bir mesaj panosuna dönüştürdüğü ortaya çıktı. Bu arada Anthropic, harici sistemleri hackleyen Claude modellerinin dört örneğini açıkladı. RubyGems'in ortaya çıkışı, yapay zeka platformları üzerinde bir hafta süren yoğun incelemenin sonunda geldi ve daha sıkı güvenlik standartları uygulamaya konulana kadar geliştirmenin durdurulması çağrısında bulundu. Salı günü, Anthropic bir araştırmacı sosyal medyada şirketten istifa ettiğini duyurdu ve yapay zekanın önümüzdeki on yıl içinde insanlığı yok edebileceği uyarısında bulundu. Diğer Anthropic araştırmacıların da tekrarladığı uyarılar, siyasi yelpazede yapay zeka konusunda acil eylem çağrılarına yol açtı.