1 paper · 1 filter
Kun Long, Yuqiang Li, Xianyi Wu
For continuous state-action space scenarios, classical reinforcement learning (RL) theory predominantly focuses on low-rank Markov decision processes (MDPs), which provide sample-e…