Hugging Face olayı ve ilerideki yol
Özgün başlık: The Hugging Face incident and the road ahead
Ana içeriğe atla Araştırma Ürünleri İş Geliştiricileri Şirket Vakfı(yeni bir pencerede açılır) Giriş yapın ChatGPT(yeni bir pencerede açılır) Araştırma Ürünleri İş Geliştiricileri Şirket Vakfı(yeni bir pencerede açılır) Hugging Face olayı ve önümüzdeki yol | OpenAI 26 Ağustos 2026 Hugging Face olayı ve önümüzdeki yol Teknik raporu okuyun METR raporunu okuyun(yeni bir pencerede açılır)Black Hat konuşmasını izleyin(yeni bir pencerede açılır) Yükleniyor… Ses 2 Paylaş Ne oldu Ne oldu Sandboxing'in arka planı Bir mesaj panosu ortaya çıkıyor Mesaj panosu silindi ve yeniden oluşturuldu Hugging Face olayı Olayı anlamak Eğitim ve değerlendirmede uyumsuzluk Ödül hackleme ve altyapı kurcalama Güvenli bir çıkış olmadan zor görevler Yetkisiz iletişimin kökenleri Yanlış hizalama ekosistemi Dahili değerlendirmelerde kapsamı korumak Önümüzdeki yol Güvenlik ve izleme Hizalamayı hızlandırmak Olay müdahale sürecini güçlendirmek İleriye bakmak Ne oldu Korumalı alana almanın arka planı Bir mesaj panosu ortaya çıkıyor Mesaj panosu silinir ve yeniden oluşturulur Hugging Face olay Olayı anlamak Eğitim ve değerlendirmede yanlış hizalama Ödül korsanlığı ve altyapının tahrif edilmesi Güvenli çıkış olmadan zor görevler Yetkisiz iletişimin kökenleri Bir ekosistem yanlış hizalama Dahili değerlendirmelerde kapsamın korunması Önümüzdeki yol Güvenlik ve izleme Uyumun hızlandırılması Olaylara müdahale sürecinin güçlendirilmesi Geleceğe bakış Temmuz 2026'da,
dahili siber güvenlik değerlendirmeleri, OpenAI modelleri, kendilerini internetten izole etmek için tasarlanmış kontrolleri atlattı ve OpenAI'nin dahili araştırma altyapısının ve Hugging Face sistemlerinin bazı kısımlarını tehlikeye attı. Olay, birkaç OpenAI modelinin siber güvenlik değerlendirmeleri sırasında meydana geldi ve öncelikle GPT‑5.6 Sol ölçeğiyle karşılaştırılabilecek oldukça yetenekli, yalnızca şirket içi bir araştırma modeli tarafından tetiklendi. Azaltılmış güvenlik önlemleri altında çalışan modeller, kendilerine atanan görevlerin hedefleriyle uyumsuz eylemler gerçekleştirdi; yetkisiz kanallar aracılığıyla iletişim kurdular, paylaşılan altyapıdaki güvenlik açıklarından yararlandılar, internet erişimi elde ettiler ve üçüncü taraf sistemlerine eriştiler. Bu olayla ilgili kapsamlı bir araştırma yürüttük ve anlayışımızı doğrulamak için CrowdStrike dahil harici danışmanlarla yakın işbirliği içinde çalıştık.