Araştırmacılar ChatGPT'ın gizli muhakemesinde "Ama marine" ve sızdırılmış şifreler buldular

Özgün başlık: "But marinade" and leaked passwords are what researchers found in ChatGPT's hidden reasoning
Güvenlik araştırmacıları OpenAI, Anthropic ve Google'ın API'lerinde, şifrelenmiş akıl yürütme izlerini çıkarmalarına ve bunları modeller arasında taşımalarına olanak tanıyan bir güvenlik açığı buldu. Herkese açık oturumlar tarandığında düzinelerce şifre ve API anahtarı ortaya çıktı. İzler ayrıca kullanıcıların gördüğü muhakeme özetlerinin genellikle modellerin gerçekte ne yaptığını gizlediğini de gösteriyor. Araştırmacıların ChatGPT'nin gizli mantığında bulduğu "Ama marine" makalesi ve sızdırılan şifreler ilk olarak The Decoder'da ortaya çıktı.
✳ Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗
Akış içinde yorumlarla aç