Her başarılı GPT-Red saldırısı, savunucu eğitim verisi haline geliyor

Özgün başlık: Every successful GPT-Red attack becomes defender training data
GPT‑Red, rakibin kendi kendine oynaması yoluyla öğrenir; burada amacı, çeşitli zorlu savunmacı modellerini harekete geçirmektir. GPT-Red'in bulduğu her başarılı saldırı, bu savunucuları iyileştirmek için kullanılır ve GPT-Red'i sürekli olarak daha geniş ve daha karmaşık başarısızlıklar bulmaya zorlar.
✳ Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗
Akış içinde yorumlarla aç