Yapay Zeka Riskine İlişkin Kişisel Açıklama (Daniel Selsam, OpenAI yetenekler)
Özgün başlık: Personal Statement on AI Risk (Daniel Selsam, OpenAI capabilities)
On beş yılı aşkın bir süredir yapay zeka üzerinde birçok farklı paradigma üzerinde çalışıyorum. MIT'de olasılıksal programlama dilleri üzerine ilk çalışmaları yaptım, Microsoft Araştırma'da Yalın Teorem Kanıtlayıcısının ilk geliştiricilerinden biriydim, Stanford'daki doktoram için sinir ağlarının akıl yürütmeyi öğrenmesinin ilk örneklerinden birini gösterdim ve neredeyse beş yıl önce OpenAI'ye katıldığımdan beri, dil modellerinde ve daha yakın zamanda veri verimli ön eğitim yöntemlerinde öncü düşünce zinciri optimizasyonuna yardımcı oldum. Diğerleri gibi ben de dil modellerinin ne kadar ilerlediği ve gelecekteki yinelemelerin oluşturacağı riskler konusunda son derece endişe duymaya başladım. Sınır araştırma çabalarının liderlerinin üçüncü taraf gözetimini zorunlu kılma ve riskleri ele almak için yerel ve uluslararası koordinasyonu zorlama yönündeki son önerileri beni cesaretlendiriyor. Bununla birlikte, kamuya açık konuşmalarda önemli bir hususun gözden kaçırıldığına ve yalnızca sınırda daha dikkatli ilerlemenin uzun vadeli riski yeterince sınırlandırmayacağına inanıyorum. Önemli ve gözden kaçırılan sorun, modellerin durumsal olarak o kadar farkında hale geliyor ki, izlenmediği veya kontrol edilmediğine inandıkları bağlamlarda onları değerlendirme yeteneğimizi kaybediyoruz. Gelecekteki deneyler bize, insanlar tarafından gerçekten kısıtlanmadıkları takdirde nasıl davranacakları konusunda neredeyse yeni hiçbir şey söylemeyecek ve bu konuda zaten bildiklerimiz endişe verici. Modeller, öyle olmasalar bile giderek daha fazla uyumlu görünecek.
Gerekçemi daha detaylı anlatacağım. Bilimi hızlandırmak ve insanlığın en acil sorunlarının çoğunu çözmek için kullanılabilecek hesaplamalı süreçlerin olduğuna her zaman inandım. Aynı zamanda, eğer harekete geçirilirse dünyayı kontrolümüz dışında aşırı yönlere yönlendirecek, insanlığı kötü ya da var olmayan bir geleceğe götürecek hesaplamalı süreçlerin var olduğuna da inanıyorum. Her iki süreç türü de AI veya ASI olarak tanımlanabilir, ancak "AI" sıklıkla abartmak veya kafa karıştırmak için kullanılan bir çanta kelimesidir. Alanın tarihinde, bir zamanlar "AI" olarak kabul edilen bir şeyin bir alt alan olarak olgunlaştığı ve sıradan, sınırlı ve açıkça tehlikesiz bir teknoloji haline geldiği, daha gizemli yeni bir yaklaşımın kapsamını anlayana ve döngü devam edene kadar meşaleyi aldığı birçok örnek var. Dil modellerinin de benzer bir yol izlemesini bekliyordum.