1 paper · 1 filter
Boxuan Zhang, Runqing Wang, Wei Xiao +5
A critical bottleneck in deep reinforcement learning (DRL) is sample inefficiency, as training high-performance agents often demands extensive environmental interactions. Model-bas…