1 paper · 1 filter
Xingrui Gu, Chuyi Jiang, Laixi Shi
Reinforcement learning (RL) has achieved significant success but is hindered by inefficiency and instability, relying on large amounts of trial-and-error data and failing to effici…