1 paper · 1 filter
Leo Muxing Wang, Pengkun Yang, Lili Su
We study personalized multi-agent average reward TD learning, in which a collection of agents interacts with different environments and jointly learns their respective value functi…