1 paper
Gaurav Kumar Nayak, Monish Keswani, Sharan Seshadri +1
Knowledge Distillation (KD) utilizes training data as a transfer set to transfer knowledge from a complex network (Teacher) to a smaller network (Student). Several works have recen…