1 paper
Kausthubh Manda, Raghuram Bharadwaj Diddigi
We study offline multitask reinforcement learning in settings where multiple tasks share a low-rank representation of their action-value functions. In this regime, a learner is pro…