Kimi K3, siber saldırılarda ABD modellerinin gerisinde kalıyor ve damıtma bunun nedenini açıklayabilir

Özgün başlık: Kimi K3 trails frontier US models by a wide margin on cyber exploits, and distillation may explain why
İngiliz Yapay Zeka Güvenlik Enstitüsü ve ABD Yapay Zeka Standartları ve Yenilik Merkezi, Moonshot Yapay Zeka'nın Kimi K3'ünü saldırgan siber görevlerde test etti. Kimi K3, ExploitBench'te yüzde 32 puan alırken, önde gelen ABD modellerinde bu oran yüzde 76 iken, güvenlik önlemleri açıklardan yararlanma gelişimini veya simüle edilmiş saldırıları engellemede başarısız oldu. Güçlü genel kıyaslama puanları ile daha zayıf siber performans arasındaki fark, Moonshot AI'nın Anthropic modellerini damıttığı iddialarına da uyuyor. Kimi K3 makalesi, siber saldırılar konusunda sınırdaki ABD modellerini geniş bir farkla takip ediyor ve bu damıtma, neden The Decoder'da ilk kez ortaya çıktığını açıklayabilir.