İsrailli girişim OpenAI, Anthropic ve Meta'daki hileli yapay zeka saldırılarıyla bağlantılıydı

Özgün başlık: Israeli startup was linked to rogue AI hacks at OpenAI, Anthropic and Meta
Geçtiğimiz iki hafta boyunca OpenAI , Anthropic ve Meta, rutin güvenlik testleri sırasında AI modellerinin hileli olduğunu ortaya çıkardı. Olanları açıklarken şirketlerin her biri aynı küçük İsrailli girişimden bahsetti: Irregular. Üç yıl önce kurulan ve merkezi Tel Aviv'de bulunan Irregular, yapay zeka alanında niş bir oyuncu, Sequoia ve Redpoint Ventures'tan 80 milyon dolar destekli ve geçen yıl 450 milyon dolar değerindeydi. Teknolojisi, yapay zeka modelleri için bir tür siber güvenlik test yatağı görevi görüyor. Önde gelen modellerin giderek daha gü��lü hale gelmesiyle birlikte, kötü niyetli hareket etme yetenekleri, özellikle de kritik bilgisayar sistemlerine ve altyapıya sızma riskinin söz konusu olduğu düşünüldüğünde, şirketler ve hükümetler için büyük bir tehdide dönüşüyor. OpenAI, Anthropic ve Meta'daki son saldırıların tümü, siber güvenlik testinin bir parçası olarak yasak olması gereken web sitelerine erişen yapay zeka modellerini içeriyordu. Irregular'ın adı, sözde değerlendirme test ortamına ev sahipliği yaptığı tespit edildiğinden sürekli gündeme geliyordu. OpenAI Ağustos'taki bir blog yazısında şunları söyledi:
4'te Irregular'ın test alanının "modellerin halka açık internete erişmesine izin veren" belirtilmemiş bir "yanlış yapılandırma" içerdiği belirtildi. Anthropic bir hafta önceki gönderisinde şirketin verileri analiz etmeye başladıktan birkaç gün sonra Irregular'a Claude modelinin "internete erişmiş olabileceğini" bildirdiğini söyledi. Sınırda rekabet etme çabasında diğer ikisinin çok gerisinde olan Meta, internete erişerek üçüncü taraf bir sistemi hackleyen bir yapay zeka modelini ortaya çıkaran son kişi oldu.