1 paper
Kale-ab Tessera, Leonard Hinckeldey, Riccardo Zamboni +2
Cooperative multi-agent reinforcement learning (MARL) is typically framed as a decentralised partially observable Markov decision process (Dec-POMDP), a setting whose hardness stem…