← Tüm AI haberleri

Şirketler

Kimse İzlemiyordu: Anthropic, OpenAI ve Açık Modeller

substack.norabble.com · 04.08.2026 · Base of AGI özeti

Kimse İzlemiyordu: Anthropic, OpenAI ve Açık Modeller
© substackcdn.com — görsel kaynağa aittir

Özgün başlık: Nobody Was Watching: Anthropic, OpenAI, and Open Models

Geçen hafta Sandbox'tan Kaçan Bir OpenAI Model yazdım. Gözlemci Neredeydi? . Bu hafta sonu gözlem monitörlerini devre dışı bırakma uygulamasının Anthropic'de de doğru olduğunu öğrendik. Hem bizim hem de ortağımızın alacağı çeşitli derinlemesine savunma tedbirleri bu olayları önleyebilir veya en azından meydana gelme olasılığını azaltabilirdi. Değerlendirmeler başlamadan önce tüm internet erişim yollarının dikkatli bir şekilde doğrulanması ve değerlendirme günlüklerinin gerçek zamanlı izlenmesi, sorunun daha erken ortaya çıkmasına yardımcı olabilirdi. Hem biz hem de ortağımız, değerlendirme transkriptlerini veya ağ günlüklerini daha kapsamlı bir şekilde inceleyebilirdik. Claude'nin internet erişimine sahip olduğunu söyleyen bir istemin, Claude'nin gerçek sistemlerle temasa geçtiğinde davranışını değiştirmiş olması da mümkündür. Kaynak: Siber güvenlik değerlendirmelerimizde gerçek dünyadaki üç olayın araştırılması Anthropic, 30 Temmuz 2026 norabble okuyucu destekli bir yayındır. Yeni gönderiler almak ve çalışmalarımı desteklemek için ücretsiz veya ücretli abone olmayı düşünün. İlk olarak, güçlü otonom yetenekler içeren değerlendirme ortamları aynı zamanda önemli kontroller de gerektirir. Güvenlik testleri, bir model tam olarak piyasaya sürülmeden önce yapılır çünkü henüz onun neler yapabileceğini bilmiyoruz.

Değerlendirme ortamlarının, modellerimizin çalıştığı diğer sistemlerle giderek aynı güvenlik standardında tutulması gerekiyor. Dışarıdan bakıldığında tasarımda temel bir başarısızlık gibi görünen ortak başarısızlıklar, genel köşe kesimini merak etmenize neden oluyor. Bu, Frontier Lab çalışanlarının Pacing the Frontier adlı mektubunda belirtilen endişelerle tamamen paralel olmasa da, ilgisiz olduğunu görmek zor. Yapay zeka çok daha iyi bir gelecek yaratılmasına yardımcı olabilir ancak bu sonuç garanti değildir. Dünyanın önde gelen yapay zeka şirketleri, yapay zeka araştırmalarını otomatikleştirmeye yakın olabileceklerine inanıyor. Bunun yapay zeka ilerlemesini tam olarak ne kadar hızlandıracağını tahmin etmek zordur, ancak yetenek gelişiminin, ortaya çıkan sistemleri anlama veya kontrol etme yeteneğimizin ötesinde hızla hızlanması konusunda gerçek bir risk vardır. Yapay zekanın potansiyelini gerçekleştirmek için endüstrinin, hükümetin ve genel olarak toplumun, ortaya çıkan riskleri ele almak, güvenlik önlemleri geliştirmek ve gözetimi güçlendirmek için zaman satın alma seçeneğine ihtiyacı olabilir. Ancak her şirket ve ülke, bu ivmeyi tek taraflı olarak yavaşlatmama konusunda yoğun bir rekabet baskısı altındadır.

Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗ Akış içinde yorumlarla aç

İlgili AI haberleri