MOE (Qwen 35B A4B+) cinsinden token başına aktif parametrelerin artırılması, muhakeme tokenini % 8,5 azaltır - ve eğitmenize veya ince ayar yapmanıza gerek yoktur!
Özgün başlık: Increasing active parameters per token in MOE (Qwen 35B A4B+) reduce reasoning token by 8.5% - and you don't need to train or finetune!
Bu gelişmenin ayrıntıları kaynağında yer alıyor.
✳ Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗
Akış içinde yorumlarla aç