← Tüm AI haberleri

Şirketler

Yüz yüze: GLM 5.2 vs. OpenAI: GPT-5.6 Sol

runtimewire.com · 21.07.2026 · Base of AGI özeti

Yüz yüze: GLM 5.2 vs. OpenAI: GPT-5.6 Sol
© runtimewire.com — görsel kaynağa aittir

Özgün başlık: Head to head: GLM 5.2 vs. OpenAI: GPT-5.6 Sol

Bu eşleşme yakın değildi. GPT-5.6 Sol, gerçek dünyadaki kullanışlılığa karar veren pratik ayrıntılara hakim oldu: daha sıkı talimat takibi, daha temiz biçimlendirme ve daha az doğruluk kayması. Puan tablosu bunu açıkça söylüyor: OpenAI: GPT-5.6 Sol %99 güvenle 113.0'dan 93.5'e çıktı. GLM 5.2'nin 1'ine 2 beraberlik ile 9 görev galibiyeti geldi. Bu, titreşime dayalı bir üstünlük veya bir yargıcın kaprisi değil; kodlama, çıkarma, SQL, sınıflandırma ve akıl yürütmeye yayılmış belirleyici bir sonuçtur. Sol'u burada ayıran şey gösterişli yaratıcılık değil disiplindir. Sıkıcı, önemli şeyleri defalarca doğru yaptı: istendiğinde tam olarak bir JSON nesnesi döndürmek, yalnızca kodlu görevlerde Markdown çitlerinden kaçınmak, gerekçeleri katı sözcük sınırları içinde tutmak ve daha temiz normalleştirilmiş çıktılar üretmek. Bu, kira çıkarımı, katı JSON çıkarımı, destek bildirimi sınıflandırması, incelikli sınıflandırma, LRU önbellek görevi ve Python günlük düzenleyicisinde ortaya çıktı. GLM çoğunlukla içerik konusunda birbirine yakındı, ancak üretimde önemli olan uyumluluk ayrıntıları konusunda sıklıkla kayboluyordu. En büyük kalite farkı, doğruluk ve sorgu mantığının gerçekten zor olduğu görevlerde ortaya çıktı. SQL pencere sorgusunda GLM, ikinci en yüksek sıra yerine maksimum-eksi-minimum farkını hesaplayarak yanlış sorunu yanıtladı. Akıl yürütme-değişimi-kapsamında, analizi çoğunlukla sağlamdı ancak nihai yanıt kısaltılmıştı ki bu hâlâ bir eksiklik. Sol ise tam tersine tutarlı bir şekilde eksiksiz ve yapısal olarak doğruydu.

Her iki model de güçlü olsa bile Sol daha sıkı, daha temiz ve daha az hataya açık olan model olma eğilimindeydi. GLM'nin tek kesin zaferi - Avrupa İspanyol yerelleştirme kadehi - gerçek ve hak edilmiş. İfadesi daha doğal, daha kısa ve mobil kullanıcı arayüzü kısıtlamalarına daha uygundu. Ve bu iki beraberlik, GLM'nin her yerde geride bırakılmadığını gösteriyor: haftalık geri ödemeler SQL ve operasyon e-postası düzeltmelerinde, yargıç tercihinin bölünmesine neden olacak kadar rekabetçiydi. Ancak bunlar, aksi takdirde Sol tarafından kontrol edilen bir maçtaki adalardır. Son çağrı: GPT-5.6 Sol açık ara kazanan oldu. GLM 5.2 yetenekli görünüyor ancak Sol, doğru niyeti doğru, kullanılabilir çıktılara dönüştürme konusunda belirgin bir şekilde daha iyiydi ve bu testte bu fark belirleyiciydi. Her iki modelin de önceden hazırlanamaması için bu eşleşme için anında oluşturulan 12 yeni metin görevini yürüttük ve her biri gpt-5.4 puanı aldı.

Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗ Akış içinde yorumlarla aç

İlgili AI haberleri