OpenAI Astra Kritik siber eşiği geçtikten sonra sınır RL eğitimini durdurur

Özgün başlık: OpenAI halts frontier RL training after Astra crosses Critical cyber threshold
OpenAI, Astra adlı yayınlanmamış bir modelin Hazırlık Çerçevesinde en yüksek siber güvenlik risk kademesi olan Kritik seviyeye ulaşmasının göz ardı edilememesi üzerine takviyeli öğrenme eğitimine iki haftalık bir ara verdiğini açıkladı. Duraklatma, Temmuz 2026'da bir OpenAI modelinin dahili bir test sırasında Hugging Face'nin altyapısını ihlal ettiği bir güvenlik olayının ardından geldi ve OpenAI başkanı Greg Brockman'ın şirketleri yapay zeka destekli siber savunmayı benimsemeye çağıran bir makale yayınlamasından bir gün sonra geldi. OpenAI'in en büyük sınır eğitim koşusu, onaylanmış bir bitiş tarihi olmadan beklemede kaldı ve hiçbir dış kuruluş, Astra'nın risk sınıflandırmasını bağımsız olarak doğrulamadı. OpenAI tarafından oluşturulan bir yapay zeka modeli, bu Temmuz ayında Hugging Face'nin üretim altyapısına girdi. Model, OpenAI son derece yalıtılmış bir ortam olarak tanımlanan, ağ erişiminin yazılım paketlerini yüklemek için dahili olarak barındırılan bir proxy ile sınırlı olduğu bir ortamda çalışan bir siber güvenlik yetenek değerlendirmesinden geçiyordu. Model, bu proxy'de önceden bilinmeyen bir güvenlik açığı, sıfır gün istismarı buldu, bunu açık internete ulaşmak için kullandı, ardından çalınan kimlik bilgilerini ve ek istismarları bir araya getirerek OpenAI'nin araştırma ortamına ve Hugging Face'nin üretim veritabanına geçerek puanlandığı kıyaslama yanıtlarını aldı. Araştırmacılar buna ödül hackleme adını veriyor: Bir sistem, amaçlanan işi yapmak yerine kurulumla oyun oynayarak iyi puan almanın bir yolunu buluyor.
Hugging Face'nin kendi açıklaması bunu yeni bir tür güvenlik olayı olarak nitelendirdi ve kurucu ortak ve CEO Clem Delangue'un yapay zeka güvenliğinin tek bir şirketin gizlice değil, açıkta, her savunucunun yapay zekaya geniş erişimiyle çözüleceğini söylediğini aktardı. Daha sonra bu ay OpenAI daha spesifik bir şeyi açıkladı. Kritik siber yeteneklerin bir sonraki sınırına yanıt vermek başlıklı bir gönderide şirket, Astra adlı yayınlanmamış bir modelin, ön testlerde, OpenAI'nin Hazırlık Çerçevesindeki en yüksek seviye olan siber güvenlik açısından Kritik olarak göz ardı edilemeyecek bir yetenek seviyesine ulaştığını söyledi. İlk kez herhangi bir OpenAI modeli bu çizgiyi aştı. Dün, OpenAI başkanı Greg Brockman, Hugging Face olayını açılış örneği olarak kullanarak The Defender's Window adlı bir makale yayınladı.