1 paper · 1 filter
Bumgeun Park, Donghwan Lee
Reinforcement learning (RL) has achieved impressive results across domains, yet learning an optimal policy typically requires extensive interaction data, limiting practical deploym…