← Tüm AI haberleri

Türkçe

SpaceXAI'dan uzun süreli ajan görevlerine odaklanan yeni model: Grok 4.6

webrazzi.com · 13.08.2026 · Base of AGI özeti

SpaceXAI'dan uzun süreli ajan görevlerine odaklanan yeni model: Grok 4.6
© cdn.webrazzi.com — görsel kaynağa aittir

Elon Musk’ın daha önce xAI adıyla faaliyet gösteren yapay zeka şirketi SpaceXAI, yeni amiral gemisi yapay zeka modeli Grok 4.6’yı tanıttı . Grok 4.5’in yayınlanmasından yaklaşık bir ay sonra kullanıma sunulan model; uzun süreli yapay zeka ajanları, kodlama, bilgi işleri ve görsel uygulama geliştirme alanlarına odaklanıyor.

SpaceXAI’ın aktardığına göre Grok 4.6; araştırma yapmak, farklı kaynaklardaki bilgileri analiz etmek, büyük kod tabanları üzerinde çalışmak ve bir fikri işlevsel bir uygulamaya dönüştürmek gibi çok adımlı görevleri sürdürebiliyor. Modelin özellikle uzun süren görevlerde bağlamını koruması ve çalışmasını tamamlamadan önce kendi çıktısını test etmesi hedefleniyor.

Grok 4.6’nın geliştirilmesi sırasında Grok 4.5’e kıyasla daha uzun bir ek eğitim süreci yürütüldüğü belirtiliyor. Paylaşılan bilgilere göre; bu süreçte muhakeme ve ileri teknik kavramlara yönelik, modeller tarafından oluşturulan seçilmiş veriler kullanıldı. Eğitim veri setine yüksek kaliteli mühendislik verileri de dahil edilirken, modelin optimizasyon yöntemi ve eğitim yaklaşımı güncellendi.

Şirket daha sonra Grok 4.5’i kullanarak farklı muhakeme seviyeleri, ajan altyapıları, STEM, yazılım mühendisliği ve bilgi işleri için denetimli ince ayar, yani SFT verilerini yeniden oluşturdu. Sorunlu eğitim örnekleri ise model tabanlı kontrollerden geçirilerek veri setinden çıkarıldı. Grok 4.6’nın pekiştirmeli öğrenme aşamasında genel kodlama ve bilgi işlerinin yanı sıra çekirdek optimizasyonu, web geliştirme ve bilgisayar destekli tasarım gibi alanlara özel ajan görevlerinden yararlanıldı.

SpaceXAI, Grok 4.6’nın genel bir ürün fikrini çalışan bir ilk sürüme dönüştürme konusunda önceki modele kıyasla daha başarılı olduğunu belirtiyor. Modelin bilmediği bir alanı araştırabildiği, uygulamanın yapısını kurabildiği, temel etkileşimleri geli��tirebildiği ve kullanıcı geri bildirimleri doğrultusunda çıktıyı birkaç tur boyunca iyileştirebildiği ifade ediliyor.

Görsel ve etkileşimli projelerde de Grok 4.5’e göre daha güçlü ilk çıktılar üreten model, bir uygulamanın yapısını ve görsel dilini tek seferde oluşturabiliyor. Şirket, uzun görevlerde modelin ilerlemeden önce kendi çalışmasını test etme ve doğrulama eğiliminin de arttığını söylüyor.

Grok 4.6, dokuz farklı testi bir araya getiren Artificial Analysis Intelligence Index ’te 61 puan aldı. Grok 4.5’in aynı testteki puanı 56 seviyesindeydi.

Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗ Akış içinde yorumlarla aç

İlgili AI haberleri