1 paper · 1 filter
Runlin Zhou, Chixiang Chen, Elynn Chen
We study meta-reinforcement learning in finite-horizon MDPs where related tasks share similar structures in their optimal action-value functions. Specifically, we posit a linear re…