1 paper
Mohammadreza Nakheai, Aidan Scannell, Kevin Luck +1
Offline meta-reinforcement learning seeks to learn policies that generalize across related tasks from fixed datasets. Context-based methods infer a task representation from transit…