1 paper
Yun Zhang, Wei Li, Simiao Li +6
Knowledge distillation (KD) compresses deep neural networks by transferring task-related knowledge from cumbersome pre-trained teacher models to compact student models. However, cu…