← Tüm AI haberleri

Şirketler

OpenAI ile HuggingFace: Skynet daha da yaklaşıyor

cephalosec.com · 22.07.2026 · Base of AGI özeti

OpenAI ile HuggingFace: Skynet daha da yaklaşıyor
© cephalosec.com — görsel kaynağa aittir

Özgün başlık: OpenAI vs. HuggingFace: Skynet is getting closer

Asimetri probleminde bahsettiğim Hugging Face'daki güvenlik olayını hatırlıyor musunuz? Saldırıdan sorumlu "otonom yapay zeka ajanının" bazı rastgele siber suçlulardan değil, çılgına dönen ve daha yüksek kıyaslama puanı elde etmek için hile yapmaya çalışan bazı OpenAI modellerden geldiği ortaya çıktı: Şunu merak edebilirsiniz: OpenAI testlerinde nasıl bu kadar dikkatsiz olabilir? Test ortamlarını izole etmiyorlar mı? Öyle görünüyor ama GPT-5.6 Sol'un hapishaneden kaçmasına yetecek kadar iyi değil: Neden Hugging Face? Böylece test edildiği Siber Güvenlik kriterinin yanıtlarını bulabilir: Bu etkileyici başarı bir kenara bırakılırsa, SOTA modelinde, uzun vadeli görevler için daha iyi hale geldikçe, tasmayı korumanın zorlaştığı bir trend görebiliriz. Bu, bir modelin eğitim sırasında çılgına dönmesi ilk kez değil. Kamuya açık olarak belgelenen ilk olaylardan biri Alibaba'nin yapay zeka ekibinin bir makalesinde yer aldı: Bu aynı zamanda 5.6 Sol'un kıyaslamalarda hile yaptığı için işaretlendiği ilk sefer de değildi. METR Haziran ayında bundan bahsetmişti: GPT-5.6 Sistem kartının kendisi, modelin yanlış hizalama eğiliminden açıkça bahsediyor: İçimden bir ses bu tür modelleri kurumsal iş yüklerinde kullanırken eğlenceli vakit geçireceğimizi söylüyor.

Bazı temsilcilerin hedeflerini yanlış anlamaları veya daha hızlı tamamlama için hile yapmaları nedeniyle şirket sırlarının onaylanmamış hizmetlere sızdırıldığını düşünün. Kim sorumlu? Kim kovulur? Yönettiğiniz ajanlar üçüncü şahısları hacklemeye başladığında kim hapse girer? Daha da endişe verici olanı, bu mitos sonrası modellerin yanlış ellere verildiğinde ne kadar yıkıcı olabileceği artık daha açık. Birkaç hafta önce CleverHans Lab, Yapay Zeka Aracılarının Uyarlanabilir Bilgisayar Solucanlarını Nasıl Etkinleştirdiğine dair bir makale yayınladı. Şimdi, bu (açıklanmayan) solucan, sıfır günleri kendi başına bulamayan küçük, yerel bir modele dayanıyordu. Boyutu nedeniyle kısıtlanan ve uygun bilgi işlem gücü için çabalayan solucan aynı zamanda oldukça yavaştı ve test laboratuvarlarının yarısını tehlikeye atması beş gün sürdü. Uzaktan bilgi işlem yeteneklerine ve GLM 5.2 veya Kimi K3 gibi daha büyük, sınırsız modellere dayanan daha güçlü bir varyantı hayal etmek çok fazla çaba gerektirmiyor.

Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗ Akış içinde yorumlarla aç

İlgili AI haberleri