1 paper
Zesheng Yao, Zhen-Hua Wan, Canjun Yang +2
Model-free deep reinforcement learning (DRL) methods suffer from poor sample efficiency. To overcome this limitation, this work introduces an adaptive reduced-order-model (ROM)-bas…