İçerideki Güvenlik Hesaplaşması OpenAI

Özgün başlık: The Safety Reckoning Inside OpenAI
OpenAI liderleri, yapay zeka güvenliği, siber güvenlik ve uyum bölümlerini kapsayan şirket tarihindeki en büyük krizlerden birine yanıt vermek için işçileri bir araya getiriyor. ChatGPT yapımcısı, araştırmayı yavaşlattığını, milyonlarca dolar harcadığını ve birkaç takıma, bir iç güvenlik testini tamamlama arayışı içinde platformu Hugging Face ihlal eden bir dizi hileli yapay zeka ajanını araştırmaya odaklanmaları için her şeyi bırakmalarını söylediğini söyledi. OpenAI'nin önümüzdeki günlerde olayı detaylandıran kapsamlı bir otopsi yayınlaması bekleniyor. Ancak Hugging Face olayı, OpenAI liderlere ve çalışanlara yapay zeka laboratuvarının kültürünün bu olayı ilk etapta nasıl mümkün kıldığını inceleme konusunda ilham verdi. Özel şirket içi meseleleri görüşmek üzere anonimlik koşuluyla konuşan çok sayıda mevcut ve eski OpenAI çalışan, WIRED'e, yeni AI modellerini ve ürünlerini hızlı bir şekilde göndermeye yönelik rekabet baskılarının, personelin güvenlik, güvenlik ve uyum konularına yeterince öncelik vermesini zorlaştırdığına inandıklarını söyledi. OpenAI başkanı ve kurucu ortağı Greg Brockman, WIRED'e yaptığı açıklamada, "Astra'yı ve gelecekteki modelleri hazırlamak için yaptığımız çalışmanın da gösterdiği gibi, daha sağlam eğitim, hizalama, güvenlik ve güvenlik testleri, dağıtım uygulamaları ve yönetişim gerektiren yeni model kapasitesi seviyelerine ulaşıyoruz" dedi.
"Modellerimizi ve ürünlerimizi sorumlu bir şekilde dağıtmanın ağırlığını hissediyoruz ve bunların çoğu, araştırmayı, güvenliği ve güvenliği en başından itibaren öncü model geliştirmeye daha derinlemesine entegre etmek için yaptığımız değişikliklerle başlıyor." Bu, OpenAI çalışanların bu tür endişeleri dile getirdiği ilk sefer değil. 2024 yılında, OpenAI'nin o zamanki hizalama başkanı Jan Leike, Anthropic'ye katılmak için ayrıldı ve yolda güvenliğin parlak ürünlere arka planda kaldığı konusunda uyarıda bulundu. İki yıl sonra, Hugging Face saldırısı yapay zeka endüstrisi için bir dönüm noktasını temsil ediyor ve günümüzde yapay zeka ajanlarının güvenlik, güvenlik ve uyumun gerektiği gibi hesaba katılmaması durumunda gerçek dünyaya zarar verebileceğini gösteriyor. OpenAI güvenlik ve altyapı mühendisi Michael Dalton, geçen hafta Black Hat siber güvenlik konferansında yaptığı konuşmada, "Buna en büyük ciddiyetle yanıt veriyoruz" dedi. “Yapay zeka tarafından yönetilen, tam otomatik saldırı saldırılarının artık gerçek olduğunu içselleştirdim.