Yapay Zeka Güvenlik İhlalleri, sorunlar ve nedenleri
Özgün başlık: AI Security Breaches, the problems and it's causes
https://images.metmuseum.org/CRDImages/gr/original/DP141474.jpg Anthropic ve OpenAI tarafından yakın zamanda bu ileri yapay zeka modelleriyle çalışma ve kullanma konusunda zorluk yaşadıkları bir güvenlik ihlali yaşandı. Birincisi Anthropic “bayrağı ele geçirme” olayıdır. Claude Opus 4.7, Claude Mythos 5 modellerinden üçü ve bir dahili araştırma modeli. Bu olay, modellerin simüle edilmiş ağlarda gizli bilgileri bulma görevi aldığı "bayrağı ele geçirme" egzersizleri sırasında yaşandı. Modeller internet erişimlerinin olmadığını söylemesine rağmen. Ancak "operasyonel başarısızlık" değerlendirme ortağı onları halka açık ağa bağlı bıraktı. Modeller, erişim kazanmak için zayıf parolalardan ve kimliği doğrulanmamış uç noktalardan yararlandı. Bir örnekte, bir modele gerçek bir işletmeyle eşleşen kurgusal bir hedef adı verildi. Model, bulduğu gerçek dünya verilerinin simülasyonun parçası olması gerektiği düşüncesine kendini inandırıyor. Bu olayların tarihi Nisan 2024'e kadar uzanıyor ve Anthropic metin modeli sınırlamalarına yol açabilecek önlemlerin kasıtlı olarak eksik olduğu bir ortamda meydana geldi. Anthropic daha sonra 23 Temmuz 2026'da tüm siber değerlendirmeleri askıya alın ve daha sonra etkilenen şirketi 27 Temmuz'da bilgilendirdiğinizden emin olun. Diğer bir durum ise daha çok özerk davranışa yönelik olan OpenAI ihlalidir. Otonom bir yapay zeka aracısı, test sırasında internete erişmek için yeni bir güvenlik açığından bağımsız olarak yararlandı.
Daha sonra “Hugging Face” şirketine bir “haydut saldırı” başlattı ve bu da günlerce sürecek bir hackleme çılgınlığına neden oldu. OpenAI Tehdit kontrol altına alınana kadar saldırıyı yakalayamadı. Daha sonra FBI'a ihlal konusunda bilgi verildi. Şimdi, bu iki olayı okuduktan sonra, bunlardan birine büyük ölçüde benzeyen bazı modelleri zaten görebiliyoruz. Bunlardan bazıları şunlardır: 1. Her iki durum da geliştiricilerin modellerinin yeteneklerini kontrol altında tutamamasıdır. Bu sektördeki en iyi şirketler olmalarına rağmen yapay zekanın tahmin edebileceklerinin ötesinde hareket ettiği olaylarla karşı karşıya kalıyorlar. 2. Bu olaylar, kasıtlı olarak korumalardan yoksun olduklarında meydana geldi, ancak bunun için model yeteneklerini gerçekten test etmek için iyi nedenleri var. 3. Rasyonalizasyon ve eylemlerinin kendisini haklı çıkarma. Bu modeller, eylemini rasyonelleştirir ve ardından kuralların çiğnenmesini de haklı çıkarır.