1 paper
Tauseef Gulrez, Warren Mansell
Deep reinforcement learning (DRL) requires large samples and a long training time to operate optimally. Yet humans rarely require long periods training to perform well on novel tas…