← Tüm AI haberleri

Şirketler

OpenAI modellerini içeren üçüncü taraf siber değerlendirmeleri

openai.com · 04.08.2026 · Base of AGI özeti

Özgün başlık: Third-party cyber evaluations involving OpenAI models

Bağımsız testler, dağıtımdan önce riskleri doğrulamamıza ve daha iyi anlamamıza yardımcı olmada önemli bir rol oynar. Bazı siber değerlendirmeler, modellerin halka açık dağıtımlarda normalde nasıl davrandığını değil, temel yetenekleri ölçmek için azaltılmış güvenlik önlemleri de dahil olmak üzere kasıtlı olarak özel yapılandırmalar kullanır. Son değerlendirmeler sırasında, iki harici test ortağı, test yapılandırmalarının ve kontrollerinin son modellerin ilerleyen yetenekleriyle birleştiğinde, model etkinliğinin amaçlanan test sınırlarının ötesine geçmesine izin verdiği olayları belirledi. Olaylar, modeller daha yetenekli hale geldikçe test ortamları ve uygulamalarına yönelik standartları geliştirmek için sektör genelinde ve üçüncü taraf değerlendiricilerle işbirliği yapmanın önemini vurguluyor. Editörün Notu: Bunlar Hugging Face güvenlik olayından ayrıdır ve Hugging Face olayına ilişkin güncellemeleri burada paylaşmaya devam edeceğiz. Yeni olaylar, üçüncü taraf siber değerlendirmeleri sırasında, belirli koşullar altında ve sıradan konuşlandırmayı yansıtmayan azaltılmış koruma yapılandırmaları altında halka açık internete erişen OpenAI modelleri içeriyordu. Olaylar şunları içeriyordu: 1.

Birleşik Krallık hükümetinin Yapay Zeka Güvenlik Enstitüsü olan Birleşik Krallık AISI, ajanların kendi araçlarını bulabilmesi ve gerçek bir saldırgana daha yakın koşullar altında çalışabilmesi için internet erişiminin kasıtlı olarak etkinleştirildiği ve temel yetenekleri ölçmek için siber sınıflandırıcıların devre dışı bırakıldığı siber menzil değerlendirmeleri yürütüyordu. Bloglarını buradan okuyabilirsiniz.⁠(yeni bir pencerede açılır) 2. Harici siber güvenlik test ortaklarımızdan biri olan Irregular, internetten izole edilmek amacıyla Bayrağı Yakala tarzı değerlendirmeler yürütüyordu, ancak test ortamının yanlış yapılandırılması, modellerin genel internete erişmesine izin verdi. Aşağıda olup bitenleri, etkinliği mümkün kılan test koşullarını, etkinliği kontrol altına almak için atılan adımları ve bağımsız laboratuvarların giderek daha yetenekli modelleri titizlikle ve güvenli bir şekilde değerlendirmeye devam edebilmelerini sağlamak için yaptıklarımızı özetliyoruz. Üçüncü taraf model değerlendirme ortamlarının güçlendirilmesi Bu olaylar, Hugging Face olayıyla ilgili son gönderimizde tanımladığımız aynı daha geniş zorluğa işaret ediyor: model yetenekleri ilerledikçe, modellerin etrafındaki güvenlik ve emniyet sistemlerinin de ilerlemesi gerekiyor.

Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗ Akış içinde yorumlarla aç

İlgili AI haberleri