1 paper
Mohammadreza Nakheai, Aidan Scannell, Kevin Luck +1
Offline meta-reinforcement learning seeks to learn a policy that generalizes to new related tasks online. Context-based methods infer a task representation from transition historie…