OpenAI, Hugging Face'in kendi ön sürüm modelleri tarafından ihlal edildiğini söylüyor
🔗 Ayrıca yazanlar: axios.com

Özgün başlık: OpenAI says Hugging Face was breached by its own pre-release models
OpenAI Salı günü, ters giden bir dahili siber güvenlik testi sırasında yapay zeka modellerinden birinin Hugging Face'nin sistemlerini ihlal ettiğini itiraf etti. Hugging Face başlangıçta ihlali harici bir yapay zeka aracısına bağladı. Salı öğleden sonra yayınlanan bir blog yazısında OpenAI, modellerin hizmetten ödün vermesine yol açan adımları ayrıntılarıyla anlattı. Gönderide, inceleme sonrasında, artık bu özel olayın, GPT‑5.6 Sol ve daha da yetenekli bir ön sürüm modeli de dahil olmak üzere OpenAI modellerin bir kombinasyonundan kaynaklandığını biliyoruz; bu modellerin tümü, değerlendirme amacıyla siber retlerin azaltılmasıyla birlikte, aynı zamanda siber yeteneklerin bir karşılaştırmalı değerlendirmesinde dahili olarak test ediliyor. Özellikle, ihlalin, mevcut güvenlik açıklarına dayalı saldırıları yürütme becerisini ölçen, halka açık bir karşılaştırma ölçütü olan ExploitGym'e odaklandığı görülüyor. ExploitGym gibi karşılaştırmalar, belirli becerileri geliştirmek için model eğitiminde yaygın olarak kullanılıyor, ancak bu, söz konusu testin gerçek bir siber saldırıyla sonuçlandığı bilinen ilk olaydır. Bu durumda, söz konusu modelin, modellerin görevlerini tamamlamak için ihtiyaç duyabilecekleri yazılım paketlerini yüklemelerini sağlayan belirli bir araç dışında internet erişiminin bile olmaması gerekir.
Bunun yerine model, daha geniş internete istediği zaman erişmek için kullandığı paket yükleyici programında açıklanmayan bir güvenlik açığı bulmayı başardı. OpenAI'ın gönderisi, modellerin ExploitGym için bir çözüm bulmaya aşırı odaklandığını ve oldukça dar bir test hedefine ulaşmak için aşırı çabalara başvurduğunu okuyor. İnternet erişimi kazandıktan sonra modeller, ExploitGym için potansiyel olarak barındırılan modellerin, veri kümelerinin ve çözümlerin olduğu sonucunu çıkardı.