1 paper
Qijun Liao, Jue Yang, Yiting Kang +3
Deep reinforcement learning for continuous control often suffers from high variance, low energy efficiency, and poor generalization under distribution shift, as purely data-driven…