1 paper · 1 filter
Lingxiao Wang, Ping Li
Model-based Reinforcement Learning (MBRL) has been widely adapted due to its sample efficiency. However, existing worst-case regret analysis typically requires optimistic planning,…