2 papers
cs.LG2025
State Entropy Regularization for Robust Reinforcement Learning
Yonatan Ashlag, Uri Koren, Mirco Mutti +3
State entropy regularization has empirically shown better exploration and sample complexity in reinforcement learning (RL). However, its theoretical guarantees have not been studie…
cs.LG2025
Policy Gradient with Tree Search: Avoiding Local Optimas through Lookahead
Uri Koren, Navdeep Kumar, Uri Gadot +3
Classical policy gradient (PG) methods in reinforcement learning frequently converge to suboptimal local optima, a challenge exacerbated in large or complex environments. This work…