1 paper
Runlin Zhou, Chixiang Chen, Elynn Chen
We study meta-reinforcement learning in finite-horizon MDPs where related tasks share similar structures in their optimal action-value functions. Specifically, we posit a linear re…