MTP ile karşılaştırıldığında lama sunucusunda DeepSeek-V4-Flash ile DSpark taslak model performansı (1-2 t/s) son derece yavaş mı?
Özgün başlık: Extremely slow DSpark draft model performance (1-2 t/s) with DeepSeek-V4-Flash on llama-server compared to MTP?
Bu gelişmenin ayrıntıları kaynağında yer alıyor.
✳ Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗
Akış içinde yorumlarla aç