1 paper
F. Bredell, H. A. Engelbrecht, J. C. Schoeman
Traditional multi-agent reinforcement learning (MARL) algorithms, such as independent Q-learning, struggle when presented with partially observable scenarios, and where agents are…