1 paper
Kun Long, Yuqiang Li, Xianyi Wu
For continuous state-action space scenarios, classical reinforcement learning (RL) theory predominantly focuses on low-rank Markov decision processes (MDPs), which provide sample-e…