OpenAI, yapay zekasının başıboş kaldığını ve 'benzeri görülmemiş' bir siber saldırı başlattığını söylüyor

Özgün başlık: OpenAI says its AI went rogue and launched 'unprecedented' cyber-attack
OpenAI, en gelişmiş yapay zeka modellerinden bazılarının, bir güvenlik testi sırasında kontrolünü kaybettikten sonra hileye başvurduğunu ve bir start-up'ı hacklediğini ortaya çıkardı. ChatGPT yapımcısı, insan talimatı sonrasında tek başına çalışabilen bir yapay zeka sistemi olan aracısının kontrollü bir ortamda test edildiğini ancak zayıf yönleri bulduktan sonra test sınırlarından kaçmayı başardığını söyledi. Yapay zeka modellerinin paylaşıldığı dünyanın en büyük merkezlerinden biri olan Hugging Face'yi hedef alarak bazı şirket içi sistemlere erişim sağladılar. OpenAI, olayın "eşi görülmemiş" olduğunu ve Hugging Face ile birlikte bir soruşturma yürüttüğünü söyledi; patronu Clement Delangue, X'teki bir gönderide "tüm bunların özerk bir şekilde gerçekleşmesinin akıllara durgunluk veren" olduğunu söyledi. Delangue, "Soruşturma devam ediyor ve türünün ilk örneği olabilecek olaydan daha fazla bilgi paylaşacağız" diye ekledi. Bir hükümet sözcüsü, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü'nün olayda görülen yapay zeka sisteminin davranışını incelediğini ve koruma önlemlerini iyileştirmek için OpenAI ve diğer laboratuvarlarla çalışmaya devam ettiğini söyledi. Kuruluşların, hükümet destekli Siber Temeller sertifikasyon programına kaydolmak gibi adımlar atarak siber savunmalarını artırmaları gerektiğini söylediler. Cambridge Üniversitesi Minderoo Teknoloji ve Demokrasi Merkezi başkanı Gina Neff, BBC Radio 4'ün Today programına, sandbox adı verilen güvenlik testlerinin "modellerin neler yapabileceğini görebileceğiniz güvenli ortamlar olması gerektiğini" söyledi. "Bu durumda öyle görünüyor
OpenAI yeterince güvenli bir sanal alan yaratmamış gibi" diye ekledi. Bunun yerine ajanlar, sanal alana karşı kendi siber saldırılarını oluşturdular ve kısıtlamalardan kaçmalarına olanak tanıyan bir güvenlik açığı buldular. Dışarı çıktıklarında AI, testte aradıkları cevapların muhtemel kaynağı olarak Hugging Face'yi belirledi ve erişim sağlamaya çalıştı. Cambridge Üniversitesi'nde makine öğrenimi profesörü Neil Lawrence, bunu "etkileyici bir başarı" olarak nitelendirdi, ancak bunun yüksek güçlü yapay zeka modellerinin "mevcut neslin bilinen yetenekleri dahilinde oldukça iyi olduğu" konusunda uyardı. OpenAI'nin kendisini borsada listelemek istediğini ve kendi güçlü yapay zeka aracı Mythos ile manşetlere çıkan rakip firma Anthropic'nin yoğun baskısıyla karşı karşıya olduğunu belirtti. "OpenAI artık yetişmeye çalışıyorlar, siber güvenlik konusunda kendi sistemlerinin yeteneklerini göstermeye çalışıyorlar." "Bu bize gösteriyor ki Op