1 paper · 1 filter
Pengcheng Dai, He Wang, Dongming Wang +2
We study a networked multi-agent reinforcement learning (NMARL) problem with human feedback in an infinite-horizon setting, where agents interact over an underlying network with lo…