1 paper · 1 filter
Qijun Liao, Jue Yang, Yiting Kang +3
Deep reinforcement learning for continuous control often suffers from high variance, low energy efficiency, and poor generalization under distribution shift, as purely data-driven…