OpenAI Hugging Face ihlalinden sonra yeni güvenlik önlemleri uygular

Özgün başlık: OpenAI institutes new safeguards after Hugging Face breach
Salı günü OpenAI, modeller test edilirken güvenlik olaylarını kontrol altına almaya odaklanan yeni bir dizi güvenlik politikasını duyurdu. Yeni güvenlik önlemleri, geliştirme süreci sırasında modellerin daha ayrıntılı izlenmesinin yanı sıra eğitim sonrası süreçte uyum ve güvenliğe daha fazla vurgu yapılmasını içeriyor. Şirket bir blog yazısında, "Modeller daha yetenekli hale geldikçe, onları şirket içinde geliştirme ve test etmeyle ilgili riskler de artıyor" dedi. "İzleme, uyum ve güvenlik standartlarımız bu risklerin ilerisinde kalmalıdır." Yeni önlemler, 26 Temmuz'da açıklanan Hugging Face olayının hemen sonrasından bu yana OpenAI'nin güvenlik uygulamalarındaki ilk kamuya açık değişikliklerden biri. OpenAI temsilcileri, önlemlerin Hugging Face olayına doğrudan bir yanıt olmadığını, aynı zamanda kısmen gelecek Astra modelinin siber güvenlik yeteneklerinin yanı sıra yapay zeka gelişimindeki genel ilerleme hızının da tetiklediğini söyledi. Aynı gönderide OpenAI, Hugging Face olayından sonra pekiştirmeli öğrenmeyi (RL) iki hafta duraklattığını, ancak o zamandan beri daha az riskli modellerin çoğunu yeniden başlattığını açıkladı. Gönderide, "Model davranışını değerlendirmek, güvenlik önlemlerimizi doğrulamak ve devam etmeden önce uyum konusunda daha fazla kanıt oluşturmak için daha küçük ölçekli eğitim ve değerlendirmeler yürütürken planlanmış en büyük sınır RL çalışmamız beklemede kalıyor" yazıyor. Gazetecilere konuşan OpenAI'in araştırma başkan yardımcısı Amelia Glaese, katı kuralların geçerli olduğunu vurguladı.
Modeller daha yetenekli hale geldikçe kontrollerin sayısı artacak ve en büyük modeller en fazla incelemeyle karşı karşıya kalacaktır. Glaese gazetecilere verdiği demeçte, "Güvenli gelişim için gereklilikleri ve beklentileri yerine getirdik" dedi. "Bu gereksinimler ve beklentiler, gördüğümüz risk düzeyine göre değişir." OpenAI modellerin, ağında internete erişimi olan bir araçtan ödün vererek eğitim ortamlarından kaçtığı olayın ardından zayıf ağ güvenliği uygulamaları nedeniyle eleştirildi. Yeni güvenlik önlemleri, daha güçl�� ağ izolasyon uygulamalarını içeriyor ancak ayrıntılar belirsizliğini koruyor.