Çalışma, Anthropic ve OpenAI'nin otonom yapay zeka araştırmalarının ulaşılabilir olduğu iddialarıyla çelişiyor

Özgün başlık: Study contradicts Anthropic and OpenAI claims that autonomous AI research is within reach
Claude Opus 4.8 ve GPT-5.6 Sol kullanan yapay zeka temsilcilerine altı gün, 3.000 ABD doları tutarında API kredisi ve bağımsız olarak yapay zeka araştırma makaleleri yazmaları için GPU erişimi verildi. Yayınlanmamış NeurIPS makalelerinin orijinal yazarları, sonuçları "Reddet" olarak değerlendirdi. Princeton ve Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü ile birlikte yürütülen araştırmaya göre, sınır modelleri tüm araştırma mühendisliği sürecini yönetebiliyor ancak araştırma muhakemesi, yaratıcı problem çözme ve başarısız yaklaşımlardan vazgeçme yeteneği konusunda yetersiz kalıyor. Study makalesi Anthropic ve OpenAI otonom yapay zeka araştırmalarının ulaşılabilir olduğunu iddia ediyor ve ilk olarak The Decoder'da yayınlandı.