1 paper
Jijia Liu, Feng Gao, Qingmin Liao +2
Reinforcement learning (RL) for continuous control often requires large amounts of online interaction data. Value-based RL methods can mitigate this burden by offering relatively h…