← Tüm AI haberleri

AI

Nvidia artık gerçek kahramanın yapay zeka modeli değil koşum takımı olduğunu gösterdi

techcrunch.com · 21.08.2026 · Base of AGI özeti

Nvidia artık gerçek kahramanın yapay zeka modeli değil koşum takımı olduğunu gösterdi
© techcrunch.com — görsel kaynağa aittir

Özgün başlık: Nvidia just showed that the harness, not the AI model, is now the real hero

Nvidia Cuma günü, bir yapay zekadan uzun vadeli görevler yapmasını isterken temel modelden çok koşum takımının çok daha önemli olduğunu öne süren bazı ilginç yeni araştırmalar yayınladı. Kablo demeti, bir yapay zeka modelinin etrafındaki yazılım paketidir; araçlar, bellek yönetimi ve ham modeli kendi başına hareket edebilen bir şeye dönüştüren kurallar. TL;DR: Araştırmacılar, hafızayı iyi bir şekilde idare edecek şekilde ayarlanan ve yönetici patron benzeri bir bileşen içeren özel bir donanım kullanarak, etkileşimli muhakeme kriteri ARC-AGI-3'te %100 puan elde etmek için Claude Opus 5'i elde ettiler - modelin, tıpkı bir insanın yapacağı gibi, nasıl oynayacağını ve kazanacağını bulması gereken, talimatları olmayan bir 2 boyutlu oyun seti. (Bu, rakip sınır laboratuvarını özellikle rahatsız eden bir kıyaslamadır OpenAI.) Koşum takımı olmadan, Opus 5 %30 puan aldı ve bu, test edilen tüm modeller arasında en yüksek sonuçtu. Nvidia'in araştırması, model seçimi önemli olmakla birlikte, modelin kendisinin - aracının beyni olarak görev yapan kısım - özellikle uzun vadeli görevler için, birçok yapay zeka kullanıcısının fark ettiğinden daha küçük bir aracı sistemin parçası olduğunun bir başka göstergesidir. Bir modeli aracı yapan şey koşum takımıdır: Belleği, bağlamı ve geri bildirimi yönetir. Nvidia'in AI biriminde (yukarıda resimde görülen) ürün başkan yardımcısı Adel El Hallak, TechCrunch'a genel olarak konuşursak, dünyanın bir aracıyı neredeyse modelin bir API'si olarak yorumladığını söylüyor. Ancak bir temsilci aslında bundan daha fazlasıdır. Bu modeldir.

Koşum dediğimiz modelin etrafındaki iskele, yani kullandığı aletler takımıdır. Erişimine izin verdiğimiz şey çalışma zamanı ve ilgili beceriler ve kütüphanelerdir. Uzun ufuklu görevler, tamamlanmış bir iş ortaya çıkarmak için birçok kararın bazen günlerce bir araya getirilmesini gerektiren görevlerdir. Bu, yapay zekanın yalnızca bir istem karşısında yanıt vermesinin tersidir. Bir yapay zekanın dikkati dağılmadan ve la-la diyarına gitmeden uzun ufuklu görevleri yapmasını sağlamak, ajans araştırmasının kutsal kaselerinden biridir. Örneğin: Microsoft Nisan ayında, belge düzenlemeyi içeren uzun ufuklu görevlerde 19 LLM'yi test eden ve sınır modeller de dahil olmak üzere tüm modellerin belgeleri hatalarla doldurduğunu keşfeden bir araştırma yayınladı.

Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗ Akış içinde yorumlarla aç

İlgili AI haberleri